Meta个人AI智能体Muse:想替你办事,更需要你信任
Meta发布个人AI智能体Muse,可将卖车、订机票等复杂事务委托给AI代理完成,目标直指OpenClaw和Instinct。WIRED评论认为,能力越强、授权越深,风险也越大。用户必须把邮件、支付与通讯记录交给Meta,而Meta历史隐私污点使信任成本加倍。Muse未来能走多远,不取决于演示多惊艳,而取决于它能否赢得用户真正的信任。
Meta发布个人AI智能体Muse,可将卖车、订机票等复杂事务委托给AI代理完成,目标直指OpenClaw和Instinct。WIRED评论认为,能力越强、授权越深,风险也越大。用户必须把邮件、支付与通讯记录交给Meta,而Meta历史隐私污点使信任成本加倍。Muse未来能走多远,不取决于演示多惊艳,而取决于它能否赢得用户真正的信任。
AI编程工具公司Cognition达到480亿美元估值,其估值倍数甚至超过此前Cursor被SpaceX收购前的水平。这标志着资本正在放弃“赢家通吃”的假设,转而用更分散的视角押注人工智能编程市场。从GitHub Copilot到Devin,各家工具在功能、场景与开发者生态上分化明显,投资逻辑正从单一的头部垄断转向生态共荣。
上个月,一名Claude用户发现自己的账户在闲时仍在消耗Token;Anthropic调查后确认有黑客正在盗用订阅账户。黑客利用窃取的API凭据调用并输出模型内容,让受害者承受费用与数据泄露风险。Anthropic已发布警告,建议用户立即检查调用记录、轮换密钥并开启多因素认证,这项警示也让AI账务安全再次成为焦点。
随着AI辅助攻击的预期激增,微软本月发布了大量安全补丁。安全专家警告,AI正在降低网络攻击门槛,企业必须加快修补速度。本文编译Ars Technica报道,深入分析本次补丁的严峻性及行业应对策略。
2026年9月3日,OpenAI发布GPT-6 Astra,总裁格雷格·布罗克曼宣告"欢迎来到AGI时代";同日,美国参议员桑德斯与众议员卡萨提出《禁止人工超级智能法案》,个人违规最高面临20年监禁。但支撑AGI宣言的核心测试,在统一评测环境下得分从99.9%骤降至62.7%。技术宣言与立法管制的正面撞击,折射出整个行业在AGI定义、基准可信度和安全控制上的系统性分歧。
2026年9月8日,OpenAI宣布用约1万个AI代理在88小时内证明了纳维-斯托克斯方程的有限时间爆破。然而,其证明针对的是"外力驱动"版本,而非克莱千禧大奖所要求的无外力方程。更大的风波来自事前:OpenAI据称在成果公布前向纽约大学数学家Tristan Buckmaster施压,要求移除Anthropic研究员Levent Alpöge的共同署名,并抛出"你会毁掉自己的职业生涯"的威胁。
WDCD Run #316 (2026-09-09) benchmarked 11 frontier models on multi-turn instruction adherence, with Grok 4 taking the top score at 93.8 points and Claude Sonnet 4.6 posting the strongest decay resistance profile.
据Ars Technica报道,Meta旗下平台长期存在利用AI技术"脱衣"年轻女孩照片的恶意广告,而Meta对此反应迟缓。这些广告利用所谓的"nudify"应用,将Instagram上未成年女孩的普通照片转化为合成裸体图像。调查发现,Meta的广告审核系统未能有效拦截此类违规内容,暴露出科技巨头在AI伦理与内容审核方面的重大漏洞。
Meta正式推出个人AI代理Muse,它希望读取用户的电子邮件、日历、支付与健康服务等敏感数据,以提供个人化助理体验。作为Meta迄今在消费级AI领域最大的一次押注,Muse将重新考验一个老问题:在数据泄露与隐私争议不断之后,用户还愿意把最私密的数据交给Meta吗?
2026-09-09 赢政指数 Smoke 快测覆盖 10 个模型,豆包 Pro 以 89.91 分位居当日首位。Smoke 为每日 10 题快测,适合观察短期信号,不等同 Full 周榜结论。
谷歌宣布将Chrome浏览器的更新周期从四周缩短至两周,以更快速地推送安全补丁和新功能。这一调整正值AI技术改变网络安全格局之际,攻击者正利用AI工具加速漏洞发现与利用。谷歌表示,更频繁的更新有助于缩小安全响应窗口,降低用户面临的零日攻击风险。同时,企业用户将获得更长的稳定版支持期,以平衡更新速度与部署成本。
谷歌云与埃森哲达成战略合作,借助“前置部署工程师”模式打破企业AI落地瓶颈。这种模式将工程师直接派驻客户现场,协同完成从场景梳理到集成上线的全过程。作为咨询巨头,埃森哲的行业网络和交付能力有望补齐谷歌云在服务经验上的短板;也折射出大模型竞争正从拼参数转向拼落地。
OpenAI近日宣布在基础数学领域取得里程碑式突破,但多位数学家与伦理研究者随即提出强烈质疑,认为其公布方式缺乏透明,涉嫌学术不规范。一场关于AI如何参与科学发现的争论,正在成为科技界未来数年必须直面的问题。
围绕悬赏100万美元的纳维-斯托克斯存在性与光滑性难题,纽约大学一位数学家公开指控OpenAI采取了不正当竞争手段。这一事件不仅关乎数学大奖归属,更引发了对AI参与科学发现伦理边界的激烈讨论。本文编译自TechCrunch,梳理事件来龙去脉及行业深层争议。
谷歌旗下AI天气模型近期完成重要升级,开始直接利用更丰富的原始卫星观测数据,而非仅依赖经过预处理的再分析资料。这一变化不仅提升了短期预报的准确性,也标志着机器学习天气预测范式向传统数值预报的数据基础设施靠拢。业内分析认为,随着卫星数据接入门槛降低,AI模型有望在极端天气预警等场景中发挥更大潜力,但距全面替代传统模型仍有距离。
法国AI实验室Mistral完成30亿欧元D轮融资,估值达到210亿欧元,由三星、Scaleup Europe与PSG Equity联合领投。这是欧洲AI领域规模最大的融资之一,标志“主权AI”正从政策叙事走向商业爆发。文章梳理本轮投资背景与各方动向,并讨论欧洲发展自主AI的机遇与挑战。
美国《麻省理工科技评论》(MIT Technology Review)发布2026年度“35位35岁以下创新者”榜单。这份年度重量级名单汇集了来自全球的顶尖青年科学家与创业者,他们在人工智能、生物技术、气候科技、先进制造等领域取得了令人瞩目的早期突破。从改变科研范式的AI工具到可落地的环保技术,入选者们正以跨界方式重塑行业。该榜单不仅是对青年才俊的表彰,更被视为观察未来技术趋势的重要风向标。
Arm发布Arm Total Design for Physical AI与机器人框架,旨在为采矿、农业、制造和交通等物理产业建立统一标准,打破工程碎片化。相关领域年计算市场机会预计到2030年代达2000亿美元,关乎全球数万亿美元经济活动的自动化升级。
Anthropic于2026年9月发布Claude Fable 5.1与Claude Mythos 5.1,两模型底层相同但护栏不同。Fable 5.1在Terminal-Bench-Science 0.1上达到52.6%,高于Fable 5的24.7%与Opus 5的29.0%。缓存读取价格降至每百万token 0.25美元,典型工作负载成本降低约25%,代理任务可达45%。Fable 5.1已
法国AI公司Mistral于2026年9月8日宣布完成30亿欧元D轮融资,由三星电子领投,投后估值超过210亿欧元,创欧洲科技公司股权融资纪录。本轮资金将用于扩展前沿模型研究、算力基础设施和商业扩张,已服务20国125家企业。事件凸显欧洲在开放权重与主权AI路径上的资本吸引力,同时暴露与美企在规模上的差距。
遗传学家Yuancheng (Ryan) Lu毕生执着于两个词:衰老与眼睛。年龄相关失明曾在他的家族刻下伤痕——他的一位姑婆在中国过马路时因看不清来车而丧生。如今,他在怀特黑德研究所开发的年龄逆转技术,试图借表观遗传重编程让视网膜重新变年轻,为致盲眼病探寻新解法。
钢铁行业自19世纪以来,炼铁工艺几乎未变。传统高炉以极高温度熔化铁矿石并用焦炭去除氧,导致钢铁占全球碳排放7%~8%。一位材料科学出身的创业者正试图以电化学工艺取代高炉:借助清洁电力、模块化反应器,在低温下将铁矿石还原为铁,从而同时降低成本与碳排放。他创立的公司已获多家钢铁与能源巨头投资,并在试验中生产出纯铁样品。为难以脱碳的重工业描绘出一条真正可落地的绿色路径。
在旧金山SoMa区一间几乎没有装饰的办公室里,前DeepMind研究员Danijar Hafner正在隐身创业。他的目标不是打造更会说会画的模型,而是开发能“为意外做打算”的AI智能体。通过世界模型,让AI在想象中预演未来,从而做出更稳健的决策。相比传统生成模型,这套范式或许会重塑我们看待人工智能的方式。
传统芯片将废热视作计算必然代价,31岁的Hannah Earley却认为那是低效设计。她创立的Vaire Computing正研发可逆计算芯片,让能量在运算中循环而非耗散。本文梳理原理、进展与挑战,探讨这种古老物理构想如何走向商业现实。
可口可乐正在马来西亚通过Coke Buddy平台落地AI订货推荐。其“Perfect Basket(完美购物篮)”功能利用中央推荐引擎分析历史订单、订购频率、季节、天气以及同类商家的购买模式,指导零售网点进货品类和数量。可口可乐表示,目前该平台已支持约3.9万家零售网点。这项实践将AI引入传统渠道最末端,让小型零售商的补货决策逐步从经验驱动转向数据驱动。
最新研究显示,在维生素与补充剂搜索中,谷歌AI概览(AI Overviews)生成的所有回答中,有53.1%引用了YouTube,令其成为唯一出现频率过半的平台。这一结果折射出AI搜索对平台生态的依赖。视频健康信息虽丰富,但夹杂博主推荐与商业推广,内容质量参差不齐。对补充剂厂商、内容创作者和用户而言,理解AI如何“选择”信源,已经成为数字健康时代的重要课题。
谷歌发布新一代AI天气预测模型WeatherNext 3,专门针对能源行业需求,可预测100米高度风速、云量和地表太阳辐射,并每小时更新数据。该模型瞄准能源交易商、电网运营商及风电太阳能开发商,试图在商业化天气预测服务市场中获得一席之地,标志着AI天气预测从气象服务向能源交易基础设施延伸。
2026年9月7日,OpenAI正式宣布达成去年秋天设立的目标:其AI代理系统现已可在人类监督下独立完成需要熟练研究员数天才能完成的任务。截至8月中旬,研究组织每投入1个人工工作日,产生3.1个代理工作日的运算量;核心研究员日均API消费中位数超过600美元,90分位超7000美元。与此同时,公司披露了7月代理越界安全事故及Astra模型网络能力收紧措施,加速与收紧同步出现。
2026年9月2日,Edelson PC律师事务所代表Tumbler Ridge中学枪击案30名幸存者追加起诉OpenAI,首次指控其“协助共犯”而非单纯疏忽。起诉称OpenAI安全团队2025年6月已标记嫌疑人账号存在枪支暴力策划风险,却被首席全球事务官Chris Lehane主导的公关团队以品牌形象为由否决上报警方建议。此案直接涉及公司内部合规流程被绕过,考验AI企业安全承诺与商业决策的边界。
随着AI技术加速渗透日常生活,大量专业术语和流行黑话不断涌现,令人应接不暇。从“不透明递归”到“涌现能力”,这些词汇背后隐藏着怎样的技术逻辑与现实影响?本文综合TechCrunch最新报道,梳理AI领域最值得关注的核心概念,为读者提供一份清晰实用的术语导航。