AI的拒绝困境与减肥药副作用:我们高估了什么?
本期MIT科技评论《The Download》聚焦两大议题:AI模型的"拒绝困境"——我们过度信任AI说"不"的能力,却忽视其判断的脆弱性;以及减肥神药GLP-1受体激动剂的副作用争议——在追捧疗效的同时,长期风险正在浮现。两则新闻共同指向一个核心命题:技术的能力边界与信任的合理尺度。
本期MIT科技评论《The Download》聚焦两大议题:AI模型的"拒绝困境"——我们过度信任AI说"不"的能力,却忽视其判断的脆弱性;以及减肥神药GLP-1受体激动剂的副作用争议——在追捧疗效的同时,长期风险正在浮现。两则新闻共同指向一个核心命题:技术的能力边界与信任的合理尺度。
《法律与秩序》第26季首播把矛头对准人工智能:剧中一位权力欲极强的AI公司CEO,把监管视为创新的敌人、把安全警告当成噪音,直到技术造成不可挽回的伤害。这部播出三十余年的老牌律政剧,用最经典的方式完成了对AI狂人的控诉,也折射出好莱坞对人工智能的双重焦虑——既怕丢工作,也怕权力被彻底改写。
2026年10月7日,Atlassian在阿姆斯特丹Team '26 Europe大会发布Agentic Multiplayer Protocol(AMP),允许AI代理以具名身份进入Jira、Confluence协作空间,配备权限范围与完整审计追踪。Teamwork Graph已连接逾2500亿个对象,重建后的MCP服务器日均处理超1500万次调用,较六个月前增长15倍。OpenAI同步宣布扩大
澳大利亚助理部长查尔顿10月8日宣布,政府将要求AI企业自建风险管理流程并举证安全系统有效,年底出台国家标准,2027年立法。该框架直接对标银行和航空的系统性监管模式,将举证责任从政府转移至开发者。这是迄今最接近强制过程问责的国家级AI治理方案之一,与欧盟的"禁止清单"路线形成鲜明对照。
在波士顿一场衰老研究会议上,有研究指出服用GLP-1类减肥药的超重与糖尿病人群,其生物学年龄比相似人群年轻约两到三岁。这条线索令人兴奋,却也提醒我们:从肌肉流失到停药反弹,从胃肠道反应到罕见眼部风险,这类被数百万人使用的药物,其长期影响清单远未写完。
当无人机开始把披萨和寿司送到家门口,一个全新的职业随之诞生——远程机长(RPIC)。本文走近FlyTrex公司的维施涅夫斯基,揭秘这份"未来工作"的日常,并探讨当天空挤满配送无人机时,谁来指挥这场空中交通。
从HAL 9000到今天主流的“拒绝式对齐”,我们一直相信AI应当具备说“不”的能力。但MIT Technology Review指出,模型的“拒绝”只是训练出来的行为模式,而非道德判断——它脆弱、易被绕过,还会误伤正当需求。把安全寄托在AI的“不”上,或许正是当前AI安全范式中最被高估的一环。
2026年10月7日,OpenAI为ChatGPT青少年版推出College Planner,将院校申请条件、截止日期与财务援助整合为动态计划,并同步上线iOS多图笔记扫描、自动抽认卡与互动测验。工具披露:单周120万青少年使用学习功能,用户日均使用不足15分钟。此举直接切入Naviance等成熟升学工具赛道,但非营利机构Common Sense Media同期将ChatGPT青少年版评级为"不可
2026年9月29日OpenAI DevDay上,ChatGPT插件扩展正式发布:开发者可在侧边栏、对话面板和文件查看器中构建应用级交互体验,首批落地的Canva、Figma、Adobe分别以不同方式打通设计与编辑流程。这一举措标志着ChatGPT从对话工具向可扩展应用平台的转型,也是OpenAI在企业创意工具链上与微软Copilot正面交锋的关键一步。
2025年,斯坦福大学博士生塞缪尔·金用生成式AI模型提出了若干微型病毒的基因蓝图,被视为AI设计生命形态的初步答案。这还算不上AI创造生命,但下一步可能就是了。2026年10月16日,MIT Technology Review举办圆桌讨论,与这位研究者聊聊AI与生命的边界、从蓝图到活体的现实门槛,以及随之而来的生物安全争议。
热门AI模型排行榜LMArena的母公司Arena在10个月内估值近乎翻倍,达到31亿美元。该公司完成由Lightspeed和Khosla领投的2亿美元融资,并宣布将评估AI模型在诚实性等对齐问题上的表现。此举标志着AI评测领域正从单纯的性能比拼转向对模型可信度的深度审视,引发行业广泛关注。
一位工程师把美国诉伊丽莎白·霍尔姆斯案中公开的上千份邮件、幻灯片、短信和文件搬上网页,搭建出一个可以“坐在”Theranos创始人办公桌前翻抽屉的模拟网站。这既是一次技术致敬,也让公众得以用第一视角重新审视硅谷史上最著名的创业骗局之一。
本周WIRED播客《Uncanny Valley》聚焦三条线索:马斯克的政治行动委员会在中期选举中豪掷数百万美元;特朗普再度将某种意识形态定性为「危险」;Muse标志的设计师遭遇网络围攻。科技、政治与文化的边界正在加速消失,一场关于资本、话语与符号的博弈正在上演。
OpenAI向投资者披露,截至2026年9月底,公司年化营收约为500亿美元。这一数字远低于此前在投资圈广泛流传的约680亿至700亿美元,差距接近200亿美元。分歧的根源不是业绩滑坡,而是一场会计口径的误算——投资者在将OpenAI与竞争对手Anthropic的数据做横向比较时,用了不等价的计量标准。这一披露引发AI相关股票集体下挫,也重新拉开了外界对OpenAI商业化路径与即将到来的IPO估值
谷歌宣布将智能体能力引入 Gemini,并率先面向企业市场开放。新版 Gemini 能自主规划并执行任务、跨业务系统操作,还可把工作委派给子智能体、调度多个 AI 模型,并拥有独立的工作身份与邮箱地址。这标志着 AI 正从“内容生成工具”转向“可承担工作的数字员工”,同时把权限、审计与治理问题推到了台前。
据TechCrunch报道,此前有消息称OpenAI的年化收入约为700亿美元,但最新报告显示这一数字可能远低于预期,差距高达200亿美元。这一消息引发业界对AI巨头商业模式可持续性的广泛关注,也让市场重新审视大模型公司的真实盈利能力与高昂运营成本之间的巨大鸿沟。
好莱坞影星本·阿弗莱克近日因一段展示其深厚AI知识的视频走红网络。他不仅熟知神经网络和Transformer架构,还能深入探讨开放权重等专业概念。今年早些时候,他将自己的AI电影制作初创公司出售给Netflix。这位演员正用实际行动证明,自己远不止是银幕上的明星,更是一位真正的AI内行。互联网对此反应热烈。
字体设计师杰西卡·希斯接下了Meta新AI标志的设计委托。她早知道为这家公司工作会招来非议,却低估了公众怒火的烈度。一枚标志为何会成为情绪的靶心?这场风波折射的,是设计师个人选择与科技巨头伦理争议之间越来越难以切割的纠缠,也是整个创意行业正在面对的新难题。
三名被OpenAI解雇的AI安全研究员发表公开信,否认公司关于其“不当处理敏感信息”的指控,并警告称这些解雇正在公司内部制造寒蝉效应,使从事安全与对齐研究的员工不敢发声。这封信再度将OpenAI的安全文化、内部治理与商业竞争压力之间的张力推到聚光灯下。
2026-10-09 赢政指数 Smoke 快测覆盖 14 个模型,Claude Sonnet 4.6 以 94.74 分位居当日首位。Smoke 为每日 10 题快测,适合观察短期信号,不等同 Full 周榜结论。
TechCrunch Disrupt 2026 将迎来 Ambrosia Energy 首席执行官 Ben Longmier 与 Bloom Energy 高级副总裁 Bill Thayer,两位能源领域高管将在 Smart Systems 舞台探讨 AI 基础设施热潮背后正在浮现的机遇。当算力需求以指数级速度吞噬电力,能源供给正从配角变成 AI 竞赛的胜负手。
可穿戴厂商Natura推出一款售价99美元的Interface智能戒指,用户只需轻按戒指即可召唤AI智能体,代为完成任务、记录灵感并控制周边设备,同时它还能充当健康追踪器,监测心率与睡眠等数据。在Oura、三星等玩家盘踞的智能戒指赛道,这枚戒指把“AI入口”与“健康硬件”两种叙事合二为一,也把AI智能体的争夺战推向了更贴身的位置。
TechCrunch报道,OpenAI近期发布大量数学证明,却偏离了由数学研究者为其制定的指南。这些证明被指缺乏严格形式化、未充分引用文献,也未经过同行评审,引发数学界对AI生成数学结果可信度的质疑。事件折射出AI公司追求基准突破与学术规范之间的张力,也提醒行业:数学推理的进步不能只看答案对错,更要看证明过程是否可验证、可复现。
曾凭卡路里追踪应用Cal AI走红的少年创业者Zach Yadegari,如今19岁再度出发,为新公司募集1000万美元,正式切入个人AI智能体赛道。新公司将直面Instinct、Muse、Bee等竞争对手,试图把AI从聊天工具变成真正替你办事的数字助理。这笔融资也再度点燃外界对少年创业者与AI应用层机会的讨论。
AI智能体安全监控长期面临高昂成本难题。Goodfire推出全新「由内而外」监控方案:不再付费让第二个AI逐条审查智能体的所有行为,而是直接窥探模型内部的运行状态,仅在发现可疑信号时才调用额外资源介入。这一思路有望大幅降低智能体安全防护成本。
中国AI初创公司Manus在与Meta分拆后完成首轮融资,融资金额超过5亿美元。本轮由博裕资本和IDG资本联合领投,腾讯、HSG(原红杉中国)、真格基金等现有股东继续跟投。此次融资标志着Manus独立发展后的首次大规模资本运作,也凸显资本对中国AI Agent赛道的持续看好。在AI应用层竞争加剧的背景下,Manus能否凭借通用智能体定位突围,成为市场关注焦点。
Google 推出全新 AI Edge Foresight 应用,主打本地优先的离线会议笔记体验,直接对标热门工具 Granola。它能在设备端完成对话转写、笔记生成和问答,无需将敏感音频上传云端。此举既顺应端侧 AI 浪潮,也凸显 Google 在隐私、延迟与成本上的新思路。面对 Granola、Otter.ai 等玩家,会议记录赛道竞争将进一步升温。
TechCrunch Disrupt 2026 将于10月13日至15日在旧金山 Moscone West 举行,距开幕仅剩五天。主办方提醒,提前在线购票最高可省100美元,现场购票将按更高价格执行;同类型门票第二张还可享五折优惠。作为全球创投生态的年度风向标,本届大会预计将围绕 AI 从演示走向生产、智能体与企业级落地等议题展开。
2026年10月7日,JFrog安全研究团队披露LMCache 0.3.9至0.5.6版本存在CVSS 9.8严重RCE漏洞。该漏洞位于多进程模式下的ZeroMQ ROUTER socket,默认无加密无认证,攻击者可通过单条消息触发pickle反序列化,以root权限执行任意代码。官方容器镜像及Kubernetes部署推荐配置均可能直接暴露端口,目前尚无补丁发布,公开PoC已同步公开。
2026年10月7日,OpenAI因一处符号错误撤回三篇数学论文,涉及基础成果及两篇依赖论文。此前该公司于10月6日公开722篇手稿,仅42%成果获Lean形式化验证。此事凸显AI批量生成数学内容时速度与验证能力失衡的系统性问题,为行业评测提供现实案例。