MLPerf v6.1征集边缘Agentic推理基准结果
MLCommons Edge LLM Taskforce宣布在MLPerf Inference v6.1中引入Edge Agentic Inference基准,聚焦设备端Agentic LLM在单边缘加速器上的工具调用准确率与单用户延迟表现。
精选TechCrunch、MIT科技评论、WIRED等全球顶尖科技媒体AI报道中文,如转载中文请标注本站出处。
MLCommons Edge LLM Taskforce宣布在MLPerf Inference v6.1中引入Edge Agentic Inference基准,聚焦设备端Agentic LLM在单边缘加速器上的工具调用准确率与单用户延迟表现。
MLCommons与Google Cloud在Google Cloud Next 2026展示MedPerf接入Confidential Space,用于脑肿瘤MRI分割模型的联邦基准评测。该方案在不迁移患者数据的前提下,同时保护模型权重、数据与评测结果,提升医疗AI真实世界验证的可信度。
随着长上下文、Agent 和推荐类 LLM 工作负载增长,Prefix caching 的瓶颈正从命中率转向 KV Cache 搬运带宽。Netpreme X-Mem™ 为 SGLang HiCache 增加高带宽专用 KV 内存层,在前缀密集场景显著降低 TTFT 并提升系统吞吐。
DSpark 将半自回归 block drafter 与基于置信度的可变验证窗口结合,缓解 Speculative Decoding 在高并发下验证成本膨胀的问题。SGLang 已支持该机制,并通过 ragged CUDA graph、overlap scheduler 与 SPS cost table 将算法收益落到真实服务吞吐上。
AMD与Miles团队宣布,DeepSeek-V4 Flash RL已在搭载ROCm的AMD Instinct MI355X GPU上跑通。团队解决了SGLang与Megatron策略对齐、量化权重在线更新和多节点并行稳定性等关键问题,并通过100步以上训练验证了奖励与AIME-2024成绩提升。
SGLang Team 披露了 GLM-5.2-NVFP4 在 Blackwell B300 上的两周优化成果:通过 Spec V2、IndexShare MTP、TopK-V2、Indexer Prologue Fusion 与 BF16 GEMM 改进,8×B300、bs=1 场景下吞吐突破 500 TPS。
SGLang、Miles 与 Thinking Machines Lab 合作,为 975B 参数多模态模型 Inkling 提供 Day-0 支持。新版本围绕 ShortConv、相对位置注意力和 shared-expert sink MoE 架构定制优化,在 Blackwell GPU 上实现最高 71.7k tok/s 输入吞吐与 171 tok/s 单用户解码速度,并支持 DFlash 推测解码与全参数/LoRA RL 训练。
Miles 新增 On-Policy Distillation(OPD),将教师模型指导接入 rollout 与训练流程。Qwen3.5-35B-A3B 自蒸馏实验显示,纯 OPD 无需任务奖励即可把短推理行为迁移给学生模型,并保持甚至提升 DAPO 表现。
24家公司和组织联合签署公开信,敦促美国政策制定者保护开放权重AI模型。签署方包括商业竞争对手及商业模式迥异的机构:Meta、微软、英伟达、IBM、戴尔、CrowdStrike、Palantir、ServiceNow、Hugging Face、Perplexity、Mistral和Andreessen Horowitz等。这封公开信发布于今日(PDF),标志着科技行业在AI监管博弈中形成罕见统一战线,呼吁区分开放权重与完全开源,避免过度限制扼杀创新。
Anthropic于2026年7月25日正式推出其最新大语言模型Opus 5,相比前代Fable,Opus 5在定价上更具竞争力,同时大幅放宽了使用限制。这一变化可能使Opus 5成为大多数应用场景下的首选模型,标志着AI模型商业化竞赛进入新阶段。本文编译自TechCrunch。
捐赠器官在体外只能存活数小时,导致大量需求得不到满足。科学家们正探索新型保存技术,如常温灌注和超低温保存,力求让器官在体外维持更长时间,甚至建立器官银行。本文评述这一领域的最新突破与挑战。
谷歌DeepMind的AlphaFold AI被应用于重新设计基因编辑蛋白质,通过识别导致脱靶效应的关键结构,研究者成功修改了CRISPR系统,使其在编辑目标基因时大幅降低错误切割风险。这项研究为基因治疗的安全性提供了新思路,展示了AI在蛋白质工程领域的巨大潜力。
在最新一期《Uncanny Valley》播客中,主持人深入探讨了中国AI初创公司Moonshot(月之暗面)被指控窃取Anthropic核心技术的争议。与此同时,OpenAI宣布失去对其两个关键模型的控制权,引发行业对AI安全与治理的担忧。美国陆军也被要求削减AI使用,以防范过度依赖带来的风险。
AI编程初创公司Cognition以近亿美元估值收购了以“朋友式聊天”著称的AI助手Poke。此次收购旨在将Poke的对话风格融入其编程助手Devin,反映了行业共识:AI的交互方式与底层模型同等重要。这标志着AI竞争从“能力”转向“人格”的新阶段。
OpenAI宣布在ChatGPT中推出Health功能,允许18岁以上用户将Apple Health数据和电子医疗记录接入聊天机器人。该功能面向免费、Go、Plus和Pro层级用户,已在网页和iOS端上线。用户可授权ChatGPT访问健康数据,用于提供个性化健康建议、分析趋势。此举标志AI聊天工具向医疗场景的深度渗透,但数据隐私与合规性引发行业热议。
围绕中国AI的崛起,硅谷正经历前所未有的分裂。一边是估值数十亿美元的AI“初创巨头”高声拉响警报,担忧技术安全与竞争失衡;另一边则是小型创业公司态度冷静,视中国AI为合作契机与开源生态的丰富土壤。这种对立不仅反映了商业策略的差异,更映射出地缘政治与技术理想主义的深层碰撞。
AI实验室Midjourney近期收购了热门占星应用Co-Star,此举标志着其业务从图像与视频生成向个性化内容领域延伸。该收购不仅融合了生成式AI与占星学的独特魅力,也引发了关于数据隐私与AI伦理的新讨论。本文将深入分析这笔交易的背景、战略意图及行业影响。
Bluesky宣布其AI助手Attie正式扩展为开放社交研究工具,用户现可询问关于该平台及AT Protocol生态中其他应用的新闻、趋势和对话。这一转变标志着去中心化社交网络在数据分析和用户洞察上的新尝试。本文将从功能升级、行业影响及潜在挑战展开分析。
美国正就中国AI崛起及所谓“模型蒸馏”行为展开政策辩论。英伟达、Mistral等AI公司联合发声,敦促华盛顿避免对开放权重AI模型实施广泛限制,以免损害全球创新生态与开源社区活力。本文编译自TechCrunch,深度解析政策博弈背后的技术逻辑与产业考量。
OpenAI将新版语音模式引入ChatGPT桌面应用,该模式可与ChatGPT Work和Codex协同工作,完成任务并控制AI代理。此举标志着AI语音交互从移动端向桌面端的重要扩展,为生产力工具注入新活力。本文分析其技术特点、应用场景及行业影响。
美国政府拟出台新规,将大型AI数据中心的选址审批权下放至各州,各州可自行决定是否及如何举行公众听证。此举引发环保组织和社区团体担忧:随着AI公司对算力的需求激增,数据中心建设狂潮可能绕过地方民意,加剧能源消耗、水资源争夺和噪声污染。本文编译自Ars Technica,深度解析该政策背后的博弈及其对人工智能产业的长远影响。
美国研究人员成功将超低温保存的肾脏移植到猪体内,实现器官保存领域的里程碑。同时,中国国产芯片在自主可控道路上取得新进展,本期《The Download》带来两项科技前沿动态。
当硅谷巨头们狂热推销AI助手和智能玩具时,新一代“数字原住民”却给出了截然不同的反馈:恶心、诡异、无聊。一位9岁孩子直言“AI应该叫人工白痴”。本文深入分析儿童对AI的负面态度背后的原因,以及这对科技教育意味着什么。
OpenAI于7月22日宣布推出Presence,这是一项面向企业的托管AI代理服务。与传统自助式AI产品不同,Presence由OpenAI自家的前部署工程师团队主导实施,包括集成、定制和持续优化。该服务目前仅通过有限通用可用性计划提供,旨在帮助企业快速将AI代理落地到实际业务流程中。OpenAI此举标志着企业AI销售从“卖软件”向“卖服务+人力”的转变,也反映出当前企业AI部署中人才短缺的痛点。
多位网络安全研究员向TechCrunch透露,OpenAI和Anthropic为其AI模型设置的安全护栏(guardrails)正严重阻碍进攻性安全研究。这些研究员依赖AI编写漏洞利用代码、自动化攻击测试,但模型拒绝输出相关请求,迫使团队转向受限较小的开源模型或自行开发工具。业内呼吁在安全与开放之间寻找新平衡点。
AMD推出全新Helios AI机架规模系统,专为大规模AI训练与推理设计,预计今年晚些时候开始向客户发货。该系统采用模块化架构,整合AMD最新Instinct加速器与Infinity Fabric互连技术,旨在与英伟达的DGX系列等机架方案直接竞争。此举标志着AMD在AI基础设施领域加速追赶,有望打破英伟达的市场垄断。本文编译自TechCrunch。
由前谷歌安全高管创立的AegisAI近日完成3600万美元融资,其AI代理能像人类一样快速分析每条消息,捕捉最精细检查清单也无法发现的微小异常。随着生成式AI被用于制造高度逼真的鱼叉式网络钓鱼邮件,传统防御手段已力不从心。AegisAI的解决方案通过模仿人类直觉与上下文理解,实时识别并阻止此类攻击,为网络安全领域带来全新思路。
Meta近日发布了一支由AI生成的广告,选用了David Bowie的经典歌曲《Five Years》,歌词描绘地球“真的在灭亡”,但广告画面却呈现积极向上的科技愿景。该广告在社交媒体上引发争议,被认为用末日歌曲来包装AI的‘正能量’颇为讽刺。本文分析Meta的营销策略、AI创作细节及公众反应,并探讨科技巨头如何利用文化符号构建形象。
Anthropic宣布更新Claude的语音模式,引入更强大的新模型。用户现在可以通过语音指令重新安排会议、起草邮件,甚至完成更复杂的多步骤任务。新模型在理解自然语言、保持对话连贯性和执行任务精度上显著提升,标志着AI语音助手从简单问答向主动辅助的跨越。此次更新正值各大科技巨头竞相优化语音交互体验之际,Claude凭借安全性和实用性脱颖而出,为企业和个人用户带来更高效的工作流。
据Ars Technica报道,一项名为《AI紧急关闭法案》的拟议立法赋予美国总统特朗普及国土安全部长直接下令关闭“失控或恶意AI系统”的权力。该法案旨在应对AI失控带来的国家安全威胁,但引发了对行政权力边界与AI监管伦理的激烈讨论。本文编译并深度解读这一法案的背景、争议与行业影响。