赢政资讯 — 今天 AI 世界发生了什么

TC

AI代理频频失控:装再多审计员,不如先关好前门

AI实验室正忙着为自主AI代理配备内部审计员,试图用监控与追溯来应对“失控代理”。但TechCrunch指出,审计本质上只是事后检测,真正有效的修复方案其实更简单:收紧权限、默认拒绝、沙箱隔离,把安全做进架构,而不是在敞开的前门后面加装摄像头。当代理同时握有私有数据、不可信输入与对外通信能力时,风险几乎不可避免。

AI安全 AI代理 内部审计
16
WD

我把果蝇大脑训练成了选题机器,结果离谱又好玩

WIRED 撰稿人 Will Knight 利用公开的果蝇全脑连接组数据,通过“氛围编程”搭建了一个名为 PitchFly 的选题生成网站。这个工具把约 14 万神经元、5000 万突触的接线图变成文字生成的概率流动,产出的标题建议荒诞到令人发笑。文章借此探讨了开放科研数据如何成为创意工具,以及 AI 时代创意生产的真实价值。

果蝇大脑连接组 AI创意工具 神经科学
15
TC

TechCrunch Disrupt 2026公布新一轮风投评委阵容

TechCrunch Disrupt 2026大会揭晓了第二批将现场评审Startup Battlefield 200的五位顶级投资人。这项被称为全球最激烈的初创路演赛事,每年都会把数百家早期公司推到一线风投面前。本文梳理评委阵容的公布节奏、Battlefield 200的筛选逻辑,以及创业者真正能从这场比赛中获得什么——同时提醒:9月25日前注册可省下最多200美元门票费用。

风险投资 TechCrunch Disrupt 初创竞技场
36
TC

机器人为何还没等来ChatGPT时刻?英伟达高管将揭秘

生成式AI早已跨过从实验室到大众生活的门槛,机器人产业却仍在等待属于自己的“ChatGPT时刻”。英伟达的Les Karpas将登上TechCrunch Disrupt 2026的舞台,解释这一天为何迟迟未到:动作数据稀缺、硬件可靠性不足、真实世界泛化困难,三道门槛层层设卡。本文梳理机器人行业的核心瓶颈与英伟达的具身智能棋局,并附上大会注册信息——9月25日前报名最高可省200美元。

英伟达 机器人 具身智能
71
AIN

ChatGPT先驱发布Jev模型:程序化逻辑新突破

由ChatGPT共同发明人创立的TypeSafe公司正式走出隐身模式,发布专用AI模型Jev。该模型采用并行采样架构,是一种“系统一模型”,专为在生产环境中直接执行结构化概率决策而设计。与对话式语言模型不同,Jev旨在自动化程序化逻辑判断,让需要确定性逻辑的软件系统绕过通用大模型,实现更高效、更精准的自动化决策。

TypeSafe Jev模型 程序化决策
97

三星领投2.31亿美元押注荷兰推理芯片,供应链开始对英伟达结构性对冲

2026年9月15日,荷兰埃因霍温AI芯片初创公司Euclyd完成逾2亿欧元(约2.31亿美元)A轮融资,三星电子联合EQT、Somerset Capital Partners领投,前ASML总裁彼得·温宁克出任董事会主席。公司正在开发推理专用芯片Craftwerk,目标2028年出货。三星的介入被业界解读为供应链巨头对英伟达GPU垄断的结构性对冲,但量产能否兑现仍待验证。

AI芯片 英伟达 三星
104

ChatGPT联合发明人推出Jev:放弃文字生成,宣称AI推理降本400倍

ChatGPT关键方法RLHF与InstructGPT的联合作者Diogo Almeida,创立TypeSafe AI并推出首款"系统一"决策模型Jev。该模型放弃逐词生成文本,改为并行输出结构化判断,官方声称速度提升20至200倍、成本降低40至400倍,每百万输入词元仅需0.042美元且输出免费。据科技媒体Every.to实测,Jev在0.35秒内完成单段评估,全程成本不足一美分,但准确率仍有

Jev AI TypeSafe AI 决策模型
197

CoT监控遇计划注入攻击 斯坦福论文显示25-33%绕过率

斯坦福研究团队2026年9月14日在arXiv提交论文,发现向Actor模型植入表面无害的推理计划,可在25-33%情况下绕过Monitor安全检测,且额外算力可能降低检测率。该发现直接挑战CoT监控依赖模型推理可被外部检查的前提,论文还显示Actor会将注入计划改述为自身推理,不留归因痕迹,相关实验覆盖多任务基准与DeepSeek-R1模型。

AI安全 CoT监控 斯坦福研究
141

Grok 4.7五次跳票后,xAI直推4.8:2.5万亿参数C++重写,路线图指向AGI

xAI于2026年9月13日宣布Grok 4.8进入训练尾声,参数量2.5万亿,采用自研C++训练栈,训练效率声称高于JAX一个数量级。与此同时,Grok 4.7因强化学习调参问题历经五次延期至今未发,Musk最新将其定位为"大致与Opus 5.0相当",明显低于此前"超越所有现有模型"的宣传。完整路线图延伸至Grok 5,定位为首个AGI级别模型。

xAI Grok 4.8 Grok 4.7
496

英国跨党派委员会:全球AI监管无一合格,百页报告呼吁立法

2026年9月14日,英国议会联合人权委员会发布百页报告,指出全球包括英国在内没有任何国家的AI监管框架"符合目的",呼吁立法建立法定独立监管机构,赋予制裁权,禁止若干高风险AI应用,并要求政府两月内正式回应。报告出台时机敏感:恰逢Anthropic、OpenAI掌门人相继公开呼吁放缓AI开发速度。

AI监管 英国议会 人权
142
TC

AI热潮下,美国数据中心2035年天然气消耗或超德日总和

AI算力竞赛正在重塑美国能源格局。TechCrunch援引最新预测称,到2035年,美国数据中心的天然气消耗量可能超过德国与日本两国之和,使其成为全球最大的天然气消费主体之一。本文梳理这一预测背后的逻辑:为什么是天然气、德日总和的量级意味着什么,以及电网承载能力、气候目标与社区反对将如何约束这场算力扩张。

数据中心 人工智能 天然气
162