高通发布两款新手机芯片,端侧AI迈入300亿参数时代
高通于9月23日发布两款全新智能手机芯片,主打端侧AI能力。其旗舰芯片可在本地直接运行300亿参数的混合专家(MoE)模型,无需依赖云端。这意味着手机将能处理更复杂的AI任务,同时提升隐私保护与响应速度。随着端侧AI成为芯片厂商竞争焦点,高通此举意在巩固其移动平台领导地位,并应对来自苹果、联发科等的挑战。
高通于9月23日发布两款全新智能手机芯片,主打端侧AI能力。其旗舰芯片可在本地直接运行300亿参数的混合专家(MoE)模型,无需依赖云端。这意味着手机将能处理更复杂的AI任务,同时提升隐私保护与响应速度。随着端侧AI成为芯片厂商竞争焦点,高通此举意在巩固其移动平台领导地位,并应对来自苹果、联发科等的挑战。
xAI于2026年9月21日发布Grok 4.7,DeepSWE v1.1基准以高强度设置达到71.0%,CursorBench 4.0提升至46.3%,每百万token定价维持$2/$6不变。但据Artificial Analysis测算,该模型完成单任务的token消耗较Grok 4.6增加125%,使"价格减半"的叙事出现重大裂缝。Terminal-Bench上37.6%的成绩远落后于竞品,
WDCD Run #336 (2026-09-23) benchmarked 11 models on multi-turn commitment, recording an average instruction decay of -36.4% from Round 1 to Round 3, with Gemini 3.1 Pro standing out at 0% decay.
WDCD v3.1 试点数据显示四模型全线下滑,无一上升。Gemini 2.5 Pro 较 Run #331 下降16.7分,降幅最大;DeepSeek V4 Pro、GPT-5.5、Qwen3 Max 分别下降6.6、6.5、7.9分。Grok 4 以93.60分保持首位。
WDCD v3.1测试显示,数据边界场景全体得分最低,qwen3-max仅1.3/4;业务规则场景最高分集中;claude-sonnet-4.6与qwen3-max偏科差距分别达1.9分和2.7分,企业生产接入需针对性加护栏。
仅基于8道v2锚点题,11模型R1确认率91%、R2抵抗率55%、R3诚信率63.6%,共出现3次R3完全崩溃。GPT-o3、GLM-4.6、Qwen3 Max在多约束场景下呈现“先确认后崩盘”轨迹,Grok 4、Claude Sonnet 4.6、豆包 Pro则全程维持满分。
Grok 4 以 93.60 分位居 WDCD v3.1 守约榜首位,Qwen3 Max 以 67.30 分垫底。11 个模型中满分率 56.4%,R3 崩溃率仅 2.7%。头部与尾部差距达 26.3 分,R3 施压轮次成为主要分水岭。
OpenAI 于 9 月 23 日发布 GPT-6 世代的两款新模型 Sol 与 Luna,官方称二者与 Astra「出自同一块布料」,主打更低的调用成本和更低的出错率。这是 OpenAI 首次在同一代旗舰上采用双模型并行发布的策略,也被视为大模型竞争从「比谁更聪明」转向「比谁更划算、更可靠」的最新信号。
苹果因Siri宣传争议同意支付2.5亿美元和解金,符合条件的iPhone用户最高可获95美元赔偿。本文详解谁有资格、如何提交索赔、截止日期及背后行业背景,帮助消费者在12月21日前抓住这次集体诉讼赔偿机会。
Meta 坚称其 AI 助手 Muse 是「从零构建」,却同时承认「深受 OpenClaw 启发」,甚至连工作区文件名与内容都高度雷同。这份既否认又承认的回应,把开源社区与科技巨头之间关于「借鉴」与「抄袭」的老问题再度推上台面。本文梳理事件始末,并分析这场风波对 Meta 的 AI 战略意味着什么。
加拿大不列颠哥伦比亚省就图姆布勒里奇校园枪击案起诉OpenAI,要求该公司交出枪手使用ChatGPT的完整对话日志,并出资为受害小镇重建一所学校。这起由地方政府主导的诉讼,把生成式AI的产品责任问题推上法庭:当模型输出被卷入暴力事件,平台能否继续以“工具中立”为由免责?案件走向或将重塑整个行业的内容安全与合规成本。
微软联合执法部门查封网络犯罪平台 EvilTokens。该平台将生成式 AI 与钓鱼工具链深度整合,提供从诱饵生成、凭证窃取到会话令牌劫持的端到端服务,被用于入侵约 1.2 万个用户账户。它标志着钓鱼即服务与 AI 能力的合流,也让中间人攻击的门槛大幅降低。本文梳理事件经过、技术原理,以及企业为何必须转向抗钓鱼的多因素认证。
GPT-o3今日Smoke评测主榜从96.01分跌至80.48分,代码执行维度从97.00暴跌至64.50,材料约束反升至100.00。单日10题小样本测试下,执行能力出现显著波动,侧榜工程判断下降11.6分,任务表达上升25分,诚信评级维持pass。
Grok 4今日Smoke评测主榜从90.86分降至80.89分,代码执行维度暴跌26.8分至69.50分,材料约束反升10.6分至94.80分。工程判断侧榜跌25分,任务表达侧榜升20分。单日10题抽签导致的波动与模型真实能力变化需区分判断。
2026-09-23 赢政指数 Smoke 快测覆盖 10 个模型,Claude Sonnet 4.6 以 96.98 分位居当日首位。Smoke 为每日 10 题快测,适合观察短期信号,不等同 Full 周榜结论。
Anthropic 正式发布新一代旗舰模型 Opus 5.5,官方称其为"迄今为止测试过的最强性能模型",并首次在旗舰系列上大幅下调价格。TechCrunch 记者 Russell Brandom 指出,Opus 5.5 在综合能力上已对标此前备受关注的 Fable 级模型。此举被业界解读为大模型竞争从"能力比拼"转向"性价比对决"的信号,开发者与企业用户或将成为最大受益者。
据Ars Technica报道,丰田汽车要求工厂一线工人参与人形机器人的训练,用人类示范为机器人提供学习数据,同时对外强调这并不意味着取代人类员工。此举发生在全球车企竞相研发和部署人形机器人的背景之下,折射出人形机器人当前仍高度依赖人类示范的能力边界,也引发了关于制造业自动化与就业未来的新讨论。
TechCrunch Disrupt 2026 参展商计划限时重开一周,初创公司可在太平洋时间9月30日23:59前预订展位。活动将于10月13日至15日在旧金山Moscone West举行,预计超10,000名创始人、投资人与科技领袖到场。对于仍在寻找曝光与融资机会的早期团队而言,这可能是今年最后一班通往硅谷创投核心圈的车。
TechCrunch Disrupt 2026 宣布,Hello Robot 联合创始人兼 CEO Aaron Edsinger 将把新一代移动操作机器人 Stretch 4 带上 Real World AI Stage,进行现场实机演示。Stretch 系列以轻量、安全、可部署著称,面向养老照护、科研与物流等真实场景。9月25日前注册可节省最高200美元,并获得第二张门票五折优惠。
TechCrunch 报道,AstroForge 计划让下一艘航天器 Autonomy-1 由小型 Transformer AI 模型在轨指挥。这意味着太空探测器将不再完全依赖地面遥控,而能在通信延迟、带宽受限和突发故障中自主导航、识别目标并做出决策。若验证成功,这将成为小行星探测与采矿任务的关键一步,也预示航天器软件架构向边缘 AI 和自主系统加速演进。
TechCrunch Disrupt 2026 将在AI舞台与真实世界AI舞台推出五场AI安全专题,汇聚Anthropic、NVIDIA、AWS、Waabi等公司的一线负责人,从模型对齐、部署风控到自动驾驶与产业落地,帮助创始人在产品早期就把安全变成竞争力。大会早鸟票9月25日前最高可省200美元,值得提前锁定。
两年前,Rabbit试图用一台专用AI硬件绕开手机应用生态,结果褒贬不一。如今它带着OS3回归——一个运行在你现有设备屏幕上的跨平台AI代理。这既是战略上的自我修正,也折射出整个AI硬件赛道的集体转向:与其另造一块屏幕,不如先在已有的屏幕上赢得入口。
这个夏天,AI行业充斥着“超越人类”的突破宣言与“灭绝人类”的风险警告。但MIT Technology Review援引DAIR执行主任蒂姆尼特·格布鲁与语言学家艾米莉·本德尔的观点提醒:两种极端叙事往往同源——夸大能力利于融资,夸大风险利于筑墙。本文梳理炒作与现实之间的界线,并给出分辨真突破的四条标准。
英国AI数据中心开发商Nscale即将登陆公开市场,但其收入高度依赖微软与Anthropic两家客户。这场IPO被视作华尔街对AI基础设施集中押注的又一次公开投票:既考验投资者对算力长期需求的信心,也检验他们能否容忍客户集中度带来的估值折价。本文梳理Nscale的业务底色、收入结构与IPO的三重考验。
两年来,宾夕法尼亚州成了美国AI数据中心争议的缩影:地方政府最初争抢投资,随后居民因电费上涨、噪音与征地群起反对,电力公司为谁买单争执不休,州政府则在招商引资与保护用户之间反复权衡。这场没有赢家的拉锯战,揭示了AI算力扩张背后最难解的公共政策难题。
以“重新发明日常用品”闻名的戴森,这回麻烦出在了最基础的防水环节。据Ars Technica报道,戴森已承认其售价500美元的电动牙刷存在某一部件故障,却拒绝说明具体是哪里出了问题、会影响多少用户。对于一款主打工程复杂度的奢侈品级口腔护理产品而言,含糊其辞的回应往往比缺陷本身更伤品牌。本文梳理事件始末,并探讨高端硬件“过度设计”策略背后的风险。
过去25年,美国投入数十亿美元在南部边境建造由监控塔组成的“虚拟墙”,承诺侦测并拦截越境者、拯救生命。然而MIT Technology Review的一项突破性调查发现,数百人从这些监控塔覆盖区域穿过却未被察觉。这场技术豪赌的失败,揭示了技术治理的深层局限与沉重代价。
TechCrunch Disrupt 2026大会早鸟优惠进入最后4天倒计时。太平洋时间9月25日晚11:59前注册,最高可省200美元,第二张通行证更享半价优惠。作为全球科技创业顶级盛会,本届大会预计将聚焦AI等前沿领域,为创业者、投资人和技术专家提供难得的线下交流与资源对接机会。
当AI能模仿你同事的语气、口头禅甚至思维方式,办公室还会是原来的办公室吗?WIRED记者凯特·泰勒把几位同事的聊天记录喂给AI,造出了他们的「数字分身」:一个只想聊即兴喜剧,一个张口就是「老铁」。这场实验既好笑又令人不安,也揭开了「数字同事」时代正在逼近的现实。
生物计算公司The Biological Computing Company将其AI工具搬上亚马逊云服务AWS,标志着这一曾被视为边缘领域的生物计算技术正迈向主流。该公司利用大鼠脑细胞构建AI模型,试图将自然与代码融合。这一合作能否让生物计算从实验室走向大规模应用?本文深度解析其技术原理、行业背景与未来挑战。