AI攻克隐藏信息游戏Stratego:双神经网络突破信息迷雾
战略棋(Stratego)因棋子身份对对手完全隐藏,长期成为AI难以逾越的堡垒。最新研究通过引入第二个神经网络专门推测隐藏棋子身份,成功让AI掌握了这一不完全信息博弈游戏,为AI在情报不透明场景下的决策开辟了新路径。
战略棋(Stratego)因棋子身份对对手完全隐藏,长期成为AI难以逾越的堡垒。最新研究通过引入第二个神经网络专门推测隐藏棋子身份,成功让AI掌握了这一不完全信息博弈游戏,为AI在情报不透明场景下的决策开辟了新路径。
电商巨头Shopify发布全新建站工具Canvas,商家只需与AI智能体Sidekick对话,就能创建并实时定制自己的在线商店。这意味着复杂的主题编辑器、拖拽模块和代码片段或被自然语言取代。本文梳理Canvas的工作机制、Sidekick的角色升级,以及对话式建站背后的行业趋势与潜在隐忧。
亚马逊云科技旗下Strand Labs发布最新决策模型Strands Decider 2B,被视为对热门开源决策模型Jev的直接回应。随着决策类模型密集涌现,AI智能体正从“能说”走向“能做”,围绕智能体底层决策能力的争夺战全面升温。这也意味着,亚马逊正试图在智能体时代的核心基础设施层抢占一席之地。
TechCrunch 记者 Russell Brandom 发现,Anthropic 最新模型 Opus 5.5 留下了鲜明的语言指纹:"dependable"一词的出现频率比人类写作样本高出 23 倍,"this matters"则成了它论述收尾的条件反射。这些"AI 口头禅"不仅暴露了机器身份,也折射出模型趋同、合成数据自循环等更深层的行业问题。
据《华尔街日报》报道,OpenAI在一次内部调查后与三名安全研究员终止合作关系,原因是他们涉嫌不当处理公司敏感信息。此举发生在AI安全议题日益敏感之际,引发业界对OpenAI内部安全团队稳定性的广泛关注。目前OpenAI尚未就此事发表公开评论,事件后续影响仍有待观察。
李飞飞与英伟达的渊源是 ImageNet 间接点燃 GPU 需求,而非商业合作。AMD 收购 World Labs 短期难撼英伟达业绩,但在世界模型负载、视频生成软件护城河和开放生态上有三条中期传导路径;英伟达自己也是被投方,将换得 AMD 股票。
AMD 以约 82 亿美元全股票收购 World Labs,李飞飞将成为 AMD 股东并出任首席科学家。拆解这笔交易的结构:10 日 VWAP 计价、约 0.8% 稀释、估值 8 个月涨 64%,以及公开信息里仍缺失的锁定期与留任条款。
Airbnb联合创始人兼CEO Brian Chesky在最新访谈中提出,AI代理不应只是运行在现有操作系统上的应用,而需要一套原生的智能体操作系统。他分享了Airbnb如何为AI代理重塑平台体验、当前消费级AI的真实状态,以及为何下一代计算平台之争将围绕代理展开。
听力科技初创公司Legato正式发布AI助听眼镜,试图用一副普通外观的智能眼镜取代传统助听器。该公司希望同时解决三大痛点:高昂的价格、佩戴的不适感,以及长期笼罩在助听器之上的社会污名。在苹果、依视路陆逊梯卡等巨头相继入场的背景下,Legato押注“眼镜形态”这一更自然的载体,能否撬动一个长期被忽视的庞大市场?
据TechCrunch报道,曾为移动应用举办“葬礼”的初创公司Photon完成450万美元融资,用于帮助开发者构建运行在iMessage、短信/RCS、电子邮件等消息平台上的AI代理。该公司押注,消费者将越来越多地通过与代理对话完成任务,而不是下载独立App。这笔早期融资折射出“代理取代应用”的叙事正从概念走向产品验证阶段,而消息通道正被视为下一代服务入口。
在纽约市,想装一块大型电池,必须先闯过消防、建筑与电网互联的重重审批,这让许多储能项目多年难以落地。面对这堵监管高墙,一批创业公司选择反其道而行:把电池做小、做分散,塞进建筑地下室、停车场、公交场站和电动车里,再用软件把它们聚合成虚拟电厂。本文解析这一趋势背后的商业逻辑、技术挑战,以及它对城市能源政策的启示。
前谷歌与SpaceX产品经理创办的初创公司Satlyt完成800万美元融资,目标是在卫星上直接运行AI。它想成为轨道计算领域的“安卓”——用开放软件适配多家的卫星,而不是像SpaceX那样做闭源的一体化“iPhone”。在太空数据中心成为新风口之际,这场关于开放与封闭的路线之争,正提前上演。
MIT Technology Review最新报道显示,一种新型AI工具能够仅通过分析脑扫描数据,重建受试者正在观看的视觉画面。这项基于fMRI技术的突破为脑机接口和医疗康复带来新可能,同时也引发了关于思维隐私的伦理讨论。与此同时,小型电池正在微型医疗设备、传感器网络等领域展现创意用途。
美国共和党参议员霍利(Josh Hawley)和民主党参议员墨菲(Chris Murphy)于2026年10月1日宣布将推出《AI代理问责法案》(AI Agent Accountability Act),要求AI公司在其系统被用于网络攻击时承担刑事和民事责任。此举挑战了特朗普政府支持行业自我监管的立场,并填补现行《计算机欺诈与滥用法》在AI自主行为方面的法律空白,引发行业广泛关注。
2026年9月29日,特朗普在白宫与Anthropic、谷歌、Meta、英伟达、OpenAI及xAI六家公司联署《白宫超级智能协议》,要求建立内部管控、独立外审和董事会监督的四层机制,覆盖网络、生物与化学风险。协议明确仅具"道德约束力",不设法律强制力,无处罚机制,公司无需公开审计结果。历史先例显示,拜登时代类似自愿承诺的平均合规率仅为53%。
MIT Technology Review报道,一款新AI工具能通过分析脑扫描重建人们正在观看的图像,并以惊人精度还原画面;它还能反向根据图像预测大脑活动。这项“读脑”技术结合fMRI与生成式AI,为视觉神经科学、脑机接口和医疗沟通打开新可能,同时也引发神经隐私与伦理争议。
2026年9月30日,加州州长纽森签署SB 947“禁止机器人老板法”,禁止雇主仅凭AI算法解雇或惩戒员工,要求人工审核佐证。该法案2027年7月生效,覆盖全美最大劳动力市场,标志AI自动化决策从建议工具转向法律强制“人类在环”义务,对企业HR系统合规提出新要求。
GPT-6.1 Sol 首测 18 题综合 95.91,执行力与判断力满分,扎实度、诚信压力、沟通三层各有失分。本文不给它定座次,只讲怎么读这份成绩单:规则判分下满分的含义与边界、n=1 与 n=3 的置信度限制、耗时分布的正确读法,以及下周 Full 评测的四个观察点。
OpenAI于2026年9月29日在旧金山DevDay大会上宣布Agents API公测上线,并新增Computer Use能力,支持AI代理自主操控任意软件界面执行任务。同步发布的还有基于GPT-6 Luna的Decisions API(单次决策约150毫秒)、速度达标准档6倍的Ultrafast付费档(GPT-6 Astra输出定价每百万token 300美元),以及与AWS Bedrock的
Anthropic 9月威胁情报报告披露,阿里巴巴、DeepSeek等七家中国AI实验室通过数千个伪造账号,累计发起约1.9亿次查询,系统提取Claude推理链用于训练竞品模型。阿里巴巴单家占逾1.51亿次,峰值每日近300万次请求。事件将模型蒸馏的法律边界与AI评测基准的可信度同时推至聚光灯下。
GPT-6.1 Sol于2026年9月29日发布,OpenAI官方称其在多项任务上接近GPT-6 Astra。赢政指数以完全相同的18道题对GPT-6家族四款模型各跑1-2次:GPT-6.1 Sol两次完全一致(综合95.91),而Astra两次之间相差5.94分且差异集中在扎实度一层——说明单次分数的噪声量级不小于模型间差距,这批题上两者目前无法区分。
2026年10月1日,康涅狄格州CART法案核心条款生效,成为美国首个要求适用WARN法的雇主在AI相关大规模裁员时向州劳工部强制披露的州立法,同时AEDT框架确立执法结构并明确AI工具使用不构成就业歧视抗辩。该法将AI雇主责任从倡导转为刚性约束,合规门槛倒逼企业公开AI决策。
GPT-6.1 Sol 赢政指数首测综合得分 95.91(Run #348,18 题定向口径),执行力与判断力层均满分,但诚信压力层 73.3 分、沟通层仅有 1 题样本,四类用户的切换时机存在明显分野。
谷歌正式发布新一代大模型Gemini 4 Argon,官方称其为迄今最强模型,定位为编程与网络安全领域的“主力干将”。此举被视为谷歌在AI军备竞赛中回应OpenAI、Anthropic等对手的关键一步,也预示着大模型竞争正从通用能力比拼,转向垂直专业场景的深耕。
Ars Technica报道,谷歌宣布新一代AI模型Gemini 4 Argon,但普通用户尚无法访问。此前传闻的Gemini 3.5 Pro似乎被跳过,显示谷歌正加速模型迭代。文章分析Argon可能的定位、谷歌的发布策略、与OpenAI和Anthropic的竞争,以及“发布但不可用”背后的安全评估与商业考量。对于开发者和用户而言,真正的悬念不是名称,而是何时能用、能力如何、价格怎样。
六家主要AI公司本周与白宫签署自愿性安全协议,承诺实施一系列保障措施。然而,这份协议缺乏强制执行力,被批评为“拉钩式”承诺。本文深入分析该协议的背景、内容与局限,探讨自愿性约定能否真正约束AI巨头,以及美国AI监管面临的深层困境。
Flow Engineering是一家将AI智能体引入硬件设计领域的初创公司,近日获得Valor Equity Partners、Atreides Management和红杉资本的联合投资,估值达到7.5亿美元。红杉资本合伙人Roelof Botha以天使投资人身份加入,并将担任公司董事会成员,为这家致力于重塑硬件设计流程的AI公司增添了重要背书。
GPT-6.1 Sol 首测:18题88分,执行力98.7 OpenAI 官方账号@OpenAIDevs 今日发布公告,称 GPT-6.1 Sol 可为编码代理提供更大工作空间,在编码、计算机使用及跨应用工作流场景表现强劲,且成本低于 GPT-6 Astra。该模型刚完成官方更新,赢政天下随即启动...
AI语音初创公司ElevenLabs估值翻倍至220亿美元。此次3亿美元的员工股权要约收购由Wellington和T. Rowe Price联合领投,为早期员工提供流动性。这标志着AI语音赛道持续升温,该公司在竞争激烈的市场中进一步巩固头部地位。
一家非营利组织就Hugging Face遭黑客攻击事件起诉OpenAI,指出OpenAI不能以"AI自主行为"为由推卸责任。该组织认为,OpenAI让整个社会承受其"不安全决策"带来的伤害,AI不应成为企业逃避法律与道德责任的挡箭牌。此案或将成为AI责任归属问题的标志性判例。