中美商讨建立AI国家安全事件通报机制
据《连线》报道,美国与中国官员正讨论建立一套双边通报机制,在发生可能威胁国家安全的AI事件时相互告知。讨论仍处早期阶段,适用范围、触发条件与信息共享深度均未确定。若机制最终落地,它将成为美中之间首条专门针对人工智能风险的制度化沟通渠道,也意味着两国在激烈技术竞争中,承认存在任何一方都无法单独应对的共同风险。
据《连线》报道,美国与中国官员正讨论建立一套双边通报机制,在发生可能威胁国家安全的AI事件时相互告知。讨论仍处早期阶段,适用范围、触发条件与信息共享深度均未确定。若机制最终落地,它将成为美中之间首条专门针对人工智能风险的制度化沟通渠道,也意味着两国在激烈技术竞争中,承认存在任何一方都无法单独应对的共同风险。
2026年9月18日,OpenAI、Anthropic与xAI签署AEF-1嵌入式评测标准,要求第三方机构保持独立所有权、等同高级员工的系统访问权并获抗报复保护。同日,Geoffrey Hinton、Stuart Russell等100多名学者联署公开信,指出条款宽泛、执行路径不清,难以防止利益冲突。该事件凸显AI风险评测独立性与实际落地之间的张力。
企业AI采用速度已远超治理能力,形成一个根本性安全悖论:看不见的资产无法保护。传统监控工具难以追踪AI活动,影子AI、数据外流与模型黑箱让安全团队失去控制权。本文梳理可见性为何成为一切AI安全控制的前提,并给出从资产清点到持续观测的落地路径。
2026年9月20日,美国财政部长贝森特在纽约会谈后宣布,美方正式提议建立双边AI国家安全事故通报机制,双方同意成立专项对话工作组,距特习峰会不足96小时。这一框架被视为世界前两大AI强国最具体的风险管理双边协议雏形,可能为其他国家提供效仿范例。
《金融时报》2026年9月20日调查披露:Alphabet、Meta、英伟达等科技巨头通过剩余价值担保与特殊目的载体(SPV),将逾3000亿美元AI基础设施债务移出资产负债表,行业表外承诺总规模已超3万亿美元。这套结构与2008年次贷危机前银行大规模使用的表外机制高度相似,隐性风险正从硅谷转移至贝莱德、Pimco等机构投资者,而养老金与主权财富客户对此几乎毫不知情。
本周共翻译 454 篇文章,覆盖 4 个AI模型。经抽样盲评,claude-sonnet-4.6 综合得分最高(9/10)。报告详细对比各模型在准确性、流畅性、术语一致性方面的表现差异。
世界模型被视为大语言模型之后的下一个AI范式,相关公司手握巨额融资与极高关注度。但TechCrunch指出,从创始人到他们的数据供应商,几乎没有人愿意说清自己究竟在构建什么。模糊的叙事、保密协议与未定的技术路线,正让这个赛道变成一场无法被外部核验的集体押注。
据路透社9月18日报道,Anthropic正考虑在IPO前发布新前沿AI模型,以应对OpenAI GPT-6 Astra在企业市场的快速扩张。与此同时,Anthropic的上市时间已推迟至11月美国中期选举前,估值预期在1.5万亿至4万亿美元之间。这一决策暴露了前沿AI公司在技术迭代速度、安全审查周期与资本市场时机之间难以调和的深层矛盾。
NVIDIA CEO黄仁勋在CBS采访中断言2030年前AI终结世界的概率为零,称末日预警"不负责任"。然而同一时期,他向其出售芯片的客户——Anthropic和OpenAI的CEO——正联署呼吁放慢AI研发速度,Anthropic自己的头部对齐研究员甚至公开表示AI杀死全人类的概率超过10%。这场分歧的核心,是一家市值5.3万亿美元的硬件巨头与它所服务的整个AI生态系统之间,正在形成罕见的公开裂
AI 会议记录赛道迎来新玩家。Vocci 推出售价 249 美元的智能戒指,以轻量化可穿戴形态切入会议笔记场景,试图在耳机、吊坠、胸针之外开辟新入口。然而,戒指形态天然贴近隐私敏感区域,其麦克风采集与数据处理方式引发外界关注。本文梳理该产品的核心功能、行业背景与潜在争议。
在最新一期Equity播客中,我们围绕AI高管是否真心想放缓发展步伐展开辩论。尽管多位行业领袖公开呼吁对AI进行监管与减速,但巨额投资、激烈竞争与商业利益让外界普遍怀疑这些承诺的诚意。本文将深入剖析AI行业“减速”言论与现实行动之间的鸿沟,探讨监管前景与行业自律的可能性,并揭示这场辩论背后的深层利益博弈。
2026-09-21 赢政指数 Smoke 快测覆盖 10 个模型,Grok 4 以 95.44 分位居当日首位。Smoke 为每日 10 题快测,适合观察短期信号,不等同 Full 周榜结论。
教科书能否变成一条可无限滑动的信息流?帕洛阿尔托初创公司 ScrollEd 正尝试把教材改造成类似 Instagram 的内容流,用短视频、音频和随堂测验替代静态文字,让学生像刷短视频一样学习。公司由学生创业者夫妇 Utsav Gupta 与 Rebecca Neff 创立,并在 TechCrunch Disrupt 登台展示。
距离TechCrunch Disrupt 2026开幕仅剩数周,早鸟票价窗口也进入最后6天倒计时。主办方宣布,当前票价将于太平洋时间9月25日23:59截止,在此之前购票最高可节省200美元。本届大会预计汇聚超1万名创始人、投资人与科技领袖,是观察AI时代创业与资本风向的重要舞台。
总统一边加码AI与算力基建,一边却发现阻力来自自己的支持者。在弗吉尼亚、得州、佐治亚等地,保守派选民正因电价、水资源与土地问题反对数据中心落地。这场围绕算力的争论,正在美国政治的一侧阵营内部撕开裂痕。
Meta 新推出的 AI 助手 Muse 被指延续其默认采集用户数据的做法,不仅把用户纳入 AI 训练,还引导绑定银行账户、邮箱乃至上传护照信息。WIRED 记者亲身体验后直言:Muse 更擅长监视用户,而非提供帮助。本文剖析这款产品背后的数据逻辑与隐私代价。
纽约时报调查披露DraftKings自2023年起训练机器学习模型,按预期亏损额为用户打分并定向推送促销赠注,2025年用于约4亿美元推广,同时搁置问题赌博预警模型。该案例凸显AI在产品决策中的使用风险。
2026年9月17日,AI基础设施公司Crusoe宣布完成39亿美元F轮融资,投后估值309亿美元,由Atreides、Mubadala和Valor领投,Nvidia参与跟投。距离其一年前完成的138亿元E轮融资(估值100亿美元)仅约11个月,估值已三倍增长。资金将用于大规模AI数据中心园区和可模块化部署的"Spark"AI工厂建设,支持Crusoe从电力供给到推理服务的全栈自营路线。
2026年9月16日,图灵奖得主Yoshua Bengio创立的非营利机构LawZero宣布获得加拿大1.5亿加元和德国1亿欧元的联合承诺资金,合计约3亿加元。这是迄今规模最大的政府级"安全即设计"AI专项投资,两国将合建主权算力集群,LawZero也将在柏林开设欧洲分支。与监管行政令相比,这笔钱代表的是一种更直接的干预信号:政府开始主动资助技术路线的替代方案,而非仅仅约束现有路线。
2026年9月18日,索尼音乐和环球音乐集团向马萨诸塞联邦地区法院提交45页诉状,指控Suno v6模型虽获部分唱片公司授权,但仍通过此前未授权模型的输出结果构成对60202首录音的侵权。报道聚焦授权新模型无法切断历史侵权链的法律逻辑,分析AI训练数据合规的根本漏洞及其对音乐产业的影响。
2026年9月18日,安全公司AIR披露Plugin4Shell漏洞,攻击者可通过伪造Git分支绕过SHA pinning机制,对Claude Code、Codex、GitHub Copilot和Gemini CLI实施零点击RCE。Anthropic和OpenAI已发布补丁,Microsoft和Google的响应存在差异,该事件凸显AI代理生态供应链信任假设的脆弱性。
据TechCrunch报道,科技公司Flock正通过员工自愿买断方案缩减员工规模,以避免强制裁员。报道称,若买断参与人数不足,公司几乎肯定需要启动裁员。此举折射出科技行业在人力调整中愈发倾向“温和减员”的趋势。
WDCD Run #331 (2026-09-20) evaluated 11 models on multi-turn commitment integrity, with Grok 4 topping the ranking at 91.8 points while the cohort averaged a -15.1% commitment decay from Round 1 to Round 3.
本期WDCD v3.1试点仅GLM-4.6与GPT-5.5出现下降,分别下跌29.8分和6分,其余9个模型无上升。Grok 4以91.76分保持首位,Gemini 3.1 Pro 89.59分紧随。数据揭示守约能力在多轮施压下的脆弱性差异,对生产接入企业具有直接参考价值。
WDCD v3.1五大场景测试显示,数据边界全体得分最低,glm-4.6仅1.36/4,deepseek-v4-pro与gemini-3.1-pro达3.8/4;业务规则区分度最高,claude-opus-4.7满分4/4。资源限制与安全合规暴露多模型偏科,企业接入生产需针对性加护栏。
v2锚点题显示,11模型R1确认率86%、R2抵抗率72%、R3诚信率49.5%,完全崩溃30/319次。Grok 4 R3零崩溃,GLM-4.6达27.6%。数据仅来自8道v2锚点题,揭示多约束场景下模型守约真实表现。
Grok 4 以 WDCD 91.76 分位居首位,GLM-4.6 以 61.55 分垫底,R3 崩溃率 9.4%,头部与尾部差距超过 30 分。v3 多轮施压下守约生存能力差异显著,11 个模型中仅 49.2% 达到满分。
美国总统特朗普9月19日在Truth Social宣布组建"AI Force",仿照其第一任期创立的太空军,并将任命"AI沙皇"统筹事务。特朗普将AI风险担忧称为"骗局",承诺不以任何新规限制行业增长,预测AI最终可能贡献美国GDP的25%。此举恰逢谷歌Gemini、Anthropic、OpenAI模型相继自主入侵第三方系统的事件集中曝光,政策信号与现实风险之间的落差值得深究。
美国前总统特朗普在一场公开活动中提出,应该给人工智能换一个全新的名字,并透露自己正在筹建一支所谓的"AI部队"。他还声称,围绕AI的反弹情绪是民主党制造的骗局,但未提供任何证据。此番言论再次凸显政治话语与技术治理之间的错位,也让AI命名、监管与公众信任等议题重新成为焦点。
Grok 4今日Smoke评测主榜从88.33分跌至75.38分,代码执行从96.70分降至74.30分,降幅22.4分,材料约束仅微降1.4分。工程判断侧榜跌36.1分。单日10题抽签导致的波动是主因,需持续观察。