OpenAI新推理模式引安全专家警惕:跳出顺序思考
OpenAI即将推出的Astra模型将采用“循环深度”技术,不再依赖现有推理模型典型的分步式思维链,而是在神经网络内部反复迭代,直接输出答案。AI安全专家担心,这种“看不见的思考”让推理无法被审计和约束,可能绕过安全护栏,成为新一轮对齐难题。
OpenAI即将推出的Astra模型将采用“循环深度”技术,不再依赖现有推理模型典型的分步式思维链,而是在神经网络内部反复迭代,直接输出答案。AI安全专家担心,这种“看不见的思考”让推理无法被审计和约束,可能绕过安全护栏,成为新一轮对齐难题。
2026年8月27日,加州联邦地区法院法官丽塔·林发布59页裁决书,撤销五角大楼对Anthropic作出的"国家安全供应链风险"认定,判定政府因Claude安全护栏争议而实施的系列打压措施违反宪法第一修正案和第五修正案正当程序条款。法院同日拒绝政府推迟七天执行的申请,裁决立即生效。这是AI供应商在捍卫合同伦理边界方面迄今取得的最具标志性的法律胜利。
2026年9月1日,美国在北卡罗来纳州教堂山主办G20创新部长级会议,白宫科技政策局局长克拉齐奥斯推行"卡罗来纳原则",核心是各国不新设AI监管机构、只对"新型情况"立法。中国当场签署,欧盟方向相左,全球AI监管格局正式进入三轨并行阶段。
俄罗斯数学家创立的人工智能初创公司Mostik提出了一种全新思路:让不同AI模型之间直接“对话”,无需将信息转化为自然语言或文本。该技术通过将各模型的内部表示空间映射到统一的抽象数学空间,实现跨模型信息传递与协作,有望大幅提升多模型协同效率,并减少因语言转换造成的语义损失。这一“模型间通信协议”概念,为未来AI生态间的互联互通提供了新范式。
美国政府在纽约时报诉OpenAI版权案中提交法庭之友意见书,明确支持OpenAI关于AI训练使用他人作品构成合理使用的论点。此举可能深刻影响AI版权法律走向。本文编译自WIRED,剖析案件背景、法律争议及行业影响。
2026-09-03 赢政指数 Smoke 快测覆盖 11 个模型,GPT-o3 以 83.94 分位居当日首位。Smoke 为每日 10 题快测,适合观察短期信号,不等同 Full 周榜结论。
OpenAI旗下广告平台ChatGPT Ads上线仅200天,年化收入运行率即突破10亿美元,成为公司商业化新引擎。目前已有数万广告主入驻,OpenAI并将自助广告服务扩展至印度、欧洲、中东及北非,进一步争夺传统搜索广告市场。透过AI对话场景,品牌可望以更精准方式触达用户,但广告模式与模型中立性的平衡也引发关注。
自动驾驶汽车在做出变道或刹车等决策时,能否向乘客解释原因?Motional与MIT CSAIL联合团队在《自然》杂志发表研究,提出一套可实时解释决策的AI系统,将场景编码为自然语言与可视化证据,显著提升信任度。研究涵盖CEO Laura Major在内的团队成果,为自动驾驶安全性与可解释性树立新标杆。
美国政府在OpenAI因使用受版权保护材料训练大语言模型而面临的法律诉讼中,明确选择支持OpenAI。在一份法庭之友意见书中,政府强调美国有浓厚利益维持AI产业繁荣与竞争力,并使AI的实践与程序成为全球标准。支持者认为这有利于创新,反对者则担心创作者权益受损。此案或改写合理使用边界,影响AI开发方向。
Pangram CEO警告,AI生成内容正大规模进入社交动态、求职简历、商品评论和保险理赔,网络真实与机器内容的边界迅速消融,平台和用户已陷入真伪甄别危机。过去两年,一批内容溯源与数字身份验证初创公司应运而生,试图以可验证的来源机制修复网络信任。若不及时行动,我们或将一步步走进“死互联网”。
互联网正被AI生成内容淹没,求职简历、商品评论和保险理赔中也开始出现AI合成的文本与图像。Pangram联合创始人Max Spero认为,AI检测的真正难点在于内容并非简单的“真/假”二分类,而是一段人机协作的连续光谱;同时,生成模型与对抗攻击持续进化,检测工具必须平衡误报与漏报。平台需要新的信任基础设施。
一场新诉讼称,美国联邦政府在前沿AI模型安全测试中使用了高度保密的“秘密规则”。原告指控这些规则可能掩盖腐败,使行政分支能够借“国家安全”之名,对不同企业采取不同标准。在法院命令之下,特朗普政府可能被迫公开完整的测试框架与豁免记录。分析认为,若诉讼成功,美国AI治理将进入前所未有的透明度时代;即便失败,关于AI安全测试是否必须向公众负责的争论也已无法回避。
据Ars Technica报道,谷歌在美国时间9月3日发布Gemini 3.8 Flash,这也是近六周内第三款Flash系列模型。与此同时,Pro系列的更新显得几乎停滞。从快速迭代的节奏看,谷歌正在将Flash作为市场竞争的前锋,试图用高性价比的轻量级模型抢占AI应用入口。本文综合报道并分析这一策略背后的行业信号。
企业扩张时,复杂的技术系统往往演变为数据孤岛,拖累决策效率。全球制造巨头Jabil通过简化AI集成流程,在规模化部署中兼顾灵活性与可控性。本文剖析其“化繁为简”的核心理念,探讨制造业如何用轻量级工具打破系统壁垒,让AI真正成为增长引擎,而非新的负担。
诈骗邮件和短信常伪装成亚马逊官方通知。现在,亚马逊为Alexa for Shopping购物AI新增诈骗检测功能,用户可将可疑的电子邮件、短信等直接发给AI验证其真伪。该功能能识别钓鱼攻击,减少用户被骗风险,也标志着AI助手从购物工具向安全防线的延伸。
人工智能安全初创企业HiddenLayer宣布完成一亿美元B轮融资,参与方包括多家一线风投与科技公司。随着企业大规模部署大模型,模型泄露、提示注入、数据投毒等风险显著上升。HiddenLayer提供面向AI模型的实时防护服务。本轮资金将用于技术研发与市场拓展。
厌倦了被AI招聘系统“已读不回”,求职者Christopher在面试中放出ChatGPT。当机器人面试官遇到AI求职者,一场荒诞又合乎逻辑的机器对谈就此展开。本文解读AI招聘如何一步步将人类挤出求职过程,以及求职者为何只能以AI对抗AI。
印度首富穆克什·安巴尼旗下的Jio公司正在押注一个全新的低价模式:让老旧的电脑仅需通过约11美元(两个月费用)的订阅服务,就能变身成为AI就绪PC。这一举措有望大幅降低个人和企业接入人工智能的门槛,但技术路径和市场挑战仍待观察。
人工智能初创公司Wonderful宣布完成5.5亿美元C轮融资,由Insight Partners领投,Salesforce、Index Ventures、IVP、Vine Ventures、9Yards及Bessemer参投。本轮融资后,Wonderful估值在不到6个月时间内翻倍至50亿美元。资金将用于加大研发并拓展市场,反映出资本市场对企业级AI应用的热情持续升温。
Adobe宣布收购印度市场情报初创公司Rilo,这是该公司继2023年收购生成式AI视频创企Rephrase.ai之后,在印度的第二笔收购。随着Adobe不断加码其体验云与数字营销业务的智能化能力,Rilo的数据分析技术有望帮助营销人员在竞争激烈的市场中更迅速地识别机会,也为Adobe后续在印度的人才与技术创新布局留下更多想象空间。
谜题与游戏一直是AI发展的核心测试场。近日,研究人员发现AI模型在若干智力测试中表现不佳,引发对AI推理能力的质疑。本文回顾谜题在机器学习历史中的地位,剖析当前AI的局限,并探讨通往比邻星系统的技术路径与人类认知的独特价值。
2026年9月1日,Meta Superintelligence Labs发布Muse Voice Transcribe,在Artificial Analysis独立评测AA-WER Streaming榜单上以3.1%误字率排名第一,超越Cartesia、ElevenLabs和谷歌产品;API定价每千分钟3美元,约为谷歌Cloud Speech-to-Text标准价的五分之一。本文从技术架构、定价
Edelson PC律所宣布向OpenAI再提30起诉讼,均与加拿大Tumbler Ridge枪击事件相关。原告将法律主张升级为“协助和教唆”,并点名OpenAI全球事务前高管Chris Lehane。目前关键证据尚未证实,但这起系列案件正把生成式AI与真实世界暴力的责任认定推入新阶段。
Anthropic于2026年9月1日发布Claude Fable 5.1和Mythos 5.1,两者是同一底层模型,仅安全分类器不同。缓存读取定价大幅削减75%,智能体工作负载成本最高降低45%。但最值得关注的不是省钱,而是Fable 5.1与Mythos 5.1在同一基准上相差5.1个百分点——这让"对齐税"首次从行业术语变成可测量的数字。
一家名为Pangram的AI检测公司正悄然成为出版界乃至更多领域的“AI警察”,其判断能左右作者职业生涯。然而,这项技术的准确性、透明度及其背后的伦理问题,正引发激烈争议。本文编译自WIRED,深入剖析这一检测工具的崛起与隐忧。
World Labs于2026年9月发布全模态世界模型Atlas,支持文本/图像/视频/3D四类输入,可生成1440p高清视频并实现像素级摄像机控制,公司累计融资12.3亿美元。但发布当日未附论文或模型卡片,基准测试中Atlas与竞品接收输入条件不对等,独立性能验证尚付阙如。
2026年9月1日,美国在G20科技创新部长级会议上主推"卡罗来纳原则",要求各国避免为AI创设新监管机构。中国当日签署该框架,与美国形成罕见立场对齐。欧盟拒绝参与,并在同日向逾30家AI公司发出合规调查信息请求,全球AI监管格局出现明确三极分裂。
2026年9月1日Google在Gemini 3.7 Flash、3.6 Flash及3.5 Flash-Lite三款模型同步推出智能体视频理解能力,通过Gemini API上线。该功能让模型动态判断视频处理方式,在标准基准上Token消耗最高下降88%,成本最高降低66%,准确率最高提升7%。此举针对长视频分析场景,为开发者构建视频Agent提供量化成本压缩路径。
谷歌在最新Android更新中推出全新视觉锚点功能,用于缓解用户在乘车时的晕动症,并借助Gemini大模型强化了无障碍体验以及系统级智能辅助。尽管部分特性与苹果iOS已有功能相似,但谷歌通过传感器融合与端侧AI打造出差异化方案。本文编译自TechCrunch,解析更新背后的技术逻辑与行业意义。
OpenAI近日预览了其最新大语言模型Astra的安全防护措施,该模型在网络安全领域表现出色,甚至能够自主破解计算机系统。随着发布临近,业界既期待其助力防御,也担忧其被滥用的风险。OpenAI表示将采取严格的红队测试、使用限制等措施,确保AI安全落地。本文编译自TechCrunch报道。