赢政资讯 — 今天 AI 世界发生了什么

OpenAI DevDay 2026:Agents API接管软件界面,企业AI代理拐点来临还是成本陷阱?

OpenAI于2026年9月29日在旧金山DevDay大会上宣布Agents API公测上线,并新增Computer Use能力,支持AI代理自主操控任意软件界面执行任务。同步发布的还有基于GPT-6 Luna的Decisions API(单次决策约150毫秒)、速度达标准档6倍的Ultrafast付费档(GPT-6 Astra输出定价每百万token 300美元),以及与AWS Bedrock的

OpenAI DevDay Agents API
40

GPT-6.1 Sol 同题补测:GPT-6 家族四模型与单次分数的噪声

GPT-6.1 Sol于2026年9月29日发布,OpenAI官方称其在多项任务上接近GPT-6 Astra。赢政指数以完全相同的18道题对GPT-6家族四款模型各跑1-2次:GPT-6.1 Sol两次完全一致(综合95.91),而Astra两次之间相差5.94分且差异集中在扎实度一层——说明单次分数的噪声量级不小于模型间差距,这批题上两者目前无法区分。

GPT-6.1 Sol OpenAI 赢政指数
48
ARS

谷歌发布Gemini 4 Argon:跳过3.5 Pro,但暂不可用

Ars Technica报道,谷歌宣布新一代AI模型Gemini 4 Argon,但普通用户尚无法访问。此前传闻的Gemini 3.5 Pro似乎被跳过,显示谷歌正加速模型迭代。文章分析Argon可能的定位、谷歌的发布策略、与OpenAI和Anthropic的竞争,以及“发布但不可用”背后的安全评估与商业考量。对于开发者和用户而言,真正的悬念不是名称,而是何时能用、能力如何、价格怎样。

谷歌 Gemini 4 AI模型
190
TC

OpenAI发布Decisions API:廉价智能成智能体关键

OpenAI 近日推出 Decisions API,被业内视为对创业公司 Jev 的"克隆"。该接口不追求最强推理,而是把单次调用的延迟与成本压到极致,专门服务于智能体运行中的高频微决策。TechCrunch 认为,这确认了"快速、廉价智能"在智能体时代的核心地位,也折射出杰文斯悖论在 AI 产业中的现代版本——越便宜,用得越多。

OpenAI Decisions API AI智能体
119
ARS

RFK Jr.:AI将带我们逃离医疗事实的“暴政”

美国卫生与公众服务部部长小罗伯特·F·肯尼迪近日抛出惊人言论,称人工智能将帮助人们摆脱医疗事实与专业知识的“暴政”。这位长期质疑疫苗和公共卫生机构的部长,似乎将AI视为挑战医学权威的新武器。然而AI本身并不完美,其“幻觉”问题广为人知。作者讽刺地指出:AI或许会犯错,但比起肯尼迪散布的医学谬误,它的幻觉可能还少一些。

AI医疗 小罗伯特·肯尼迪 医疗事实
78
TC

Meta否认Muse AI未经许可读取用户私信:一场围绕AI智能体隐私边界的争议

Meta近日否认其Muse AI智能体能够在未经用户明确许可的情况下读取Messages信息,回应了一名记者声称该智能体在其Mac设置关闭时仍读取了私人消息的说法。这一争议再次将AI智能体的隐私权限与透明度问题推向风口浪尖,也引发了业界对AI助手行为边界与用户知情权的广泛讨论。

Meta AI智能体 隐私争议
80
TC

AI智能体催生持久化基础设施,Restate融资2000万美元

由Apache Flink老兵创立的初创公司Restate完成2000万美元融资,主打持久化执行(durable execution)基础设施,直面工作流编排领域重量级玩家Temporal。随着AI智能体从演示走向生产环境,任务可能运行数小时甚至数天,过程中任何一次崩溃、超时或网络抖动都可能让昂贵的工作付诸东流——这正是持久化基础设施需求激增的根本原因,也是资本押注这一赛道的关键逻辑。

持久化执行 AI智能体 工作流编排
106
TC

Instinct 推荐功能引反感:用户不想被“种草”

TechCrunch 报道,Instinct 正推出人工策展的产品与旅行推荐,希望帮用户发现好物,却让部分用户反感。问题不在内容本身,而在于建议并非用户主动请求。当平台把商业化推荐嵌入日常体验,用户对隐私、自主权和边界的敏感会被放大。本文分析这场推荐功能引发的信任摩擦,并探讨个性化与尊重用户之间的平衡。

Instinct 产品推荐 用户反感
54