海外AI精选

精选TechCrunch、MIT科技评论、WIRED等全球顶尖科技媒体AI报道中文,如转载中文请标注本站出处。

TechCrunch MIT Tech Review VentureBeat WIRED AI News

Higgs Audio v3 TTS 登陆 SGLang-Omni:实时可控语音代理新突破

Boson AI 与 SGLang-Omni 团队近日宣布,Higgs Audio v3 TTS 模型已在 SGLang-Omni 框架上实现端到端部署。该模型专为对话式语音代理设计,支持 100 种语言且 WER/CER 保持个位数,同时允许开发者通过文本流直接控制情感、风格、韵律和音效。模型基于约 4B 参数的自回归解码器,采用多阶段生成架构,适合流式交互场景。SGLang-Omni 通过阶段抽象、轻量通信和内存隔离机制,高效支持此类多阶段模型的推理,显著提升了实时语音生成的性能与灵活性。

LMSYS TTS语音合成 多语言模型
451

LMSYS 宣布2026年博士奖学金首位获得者

LMSYS 正式宣布2026年博士奖学金首位获奖者为加州大学圣地亚哥分校博士生Will Lin。他因在开源AI基础设施领域的杰出贡献获此殊荣,奖学金最高可达5万美元,用于支持学费及相关费用。Will Lin目前领导FastVideo项目,已在GitHub获得3700+星标,并被NVIDIA Dynamo集成。其研究涵盖生成视频、世界模型全栈优化,包括稀疏注意力、量化、蒸馏及实时推理等。LMSYS通过该奖学金计划,旨在支持开源AI人才,推动社区驱动的创新研究,助力下一代AI基础设施发展。

LMSYS 博士奖学金 开源AI
563

SGLang-Omni 部署 MOSS-TTS Local Transformer v1.5:原生 48kHz 流式语音服务

本文介绍 MOSS-TTS-Local-Transformer-v1.5 在 SGLang-Omni 上的端到端部署方案。该模型支持 48kHz 立体声音频、零样本语音克隆、长时合成、多语言生成及原生流式输出。SGLang-Omni 将请求拆分为预处理、AR 引擎和流式声码器三阶段流水线,并通过参考音频缓存、CUDA Graph、状态化解码等优化显著提升吞吐与延迟。模型在 Seed-TTS-Eval 等基准上表现优异,适合高并发生产环境。

LMSYS TTS模型 语音合成
529

SGLang-JAX 在 TPU 上优化 Ling-2.6-1T:单 Pallas 内核隐藏 MoE 数据移动

SGLang-JAX 现已支持 inclusionAI 的 Ling-2.6-1T 在 TPU v7x 上高效部署。通过分析发现 Mixture-of-Experts(MoE)路径是主要瓶颈。全新 Fused MoE V2 内核将 scatter、expert FFN 与 gather 融合,并重叠计算与数据搬运。实测显示 MoE prefill 延迟从 5.16 ms 降至 2.42 ms(下降 53%),16 块 TPU v7x 的 decode 输出吞吐达到 16 张 H200 的 1.29×–1.77×。本文详述内核设计、性能数据与端到端收益。

LMSYS MoE 优化 TPU 推理
427

SGLang 中 Waterfill 与 LPLB 优化 DeepEP MoE 负载均衡

本文介绍 SGLang 中针对 DeepEP MoE 推理的两种调度时负载均衡方案:Waterfill 和 LPLB。Waterfill 通过将共享专家动态分配给负载较低的 rank,在 DeepSeek-V3/R1 类工作负载下吞吐提升 1.48%-4.66%,DeepSeek V4 最高达 +4.92%。LPLB 利用线性规划对冗余专家副本进行负载感知分发,吞吐提升 0.84%-7.34%。两项技术均已在 SGLang PR 中落地,显著缓解专家路由不均导致的 rank 等待问题。

LMSYS MoE SGLang
567
TC

AI力不从心,福特重聘“灰胡子”工程师

福特汽车公司原以为引入人工智能就能彻底提升生产质量,但现实给了它一记重击。AI在复杂制造流程中频繁出错,导致缺陷率不降反升。为此,福特不得不重新返聘多位退休的资深工程师——他们被内部戏称为“灰胡子”——依靠其数十年的经验来弥补AI的短板。这一转折不仅揭示了当前AI能力的局限性,更引发了业界对“人机协同”模式的深刻反思。

福特 人工智能 制造业
698
TC

华尔街为何认为美光将是下一个英伟达

华尔街投资者正急切寻找下一个像英伟达那样在人工智能浪潮中暴涨的上市公司,而美国存储芯片制造商美光科技被寄予厚望。随着AI训练和推理对高带宽内存(HBM)需求的激增,美光凭借其在DRAM和HBM领域的技术优势,有望成为继英伟达之后最大的AI硬件受益者。分析师认为,美光的HBM3E产品已进入英伟达供应链,且产能扩张计划明确,营收和利润增长曲线堪比英伟达早期的爆发阶段。

美光 AI硬件 HBM
518
TC

马斯克轨道数据中心遭软银CEO质疑

软银CEO孙正义公开质疑埃隆·马斯克提出的轨道数据中心计划,认为其技术和经济可行性尚不明确。这一质疑并非孤例,业内专家普遍对太空数据中心的散热、延迟、维护等核心挑战持保留态度。然而,马斯克仍坚持其愿景,试图通过Starlink和SpaceX的技术积累推动太空计算基础设施的落地。本文梳理各方观点,并结合行业背景进行深度分析。

轨道数据中心 马斯克 软银
512
TC

健身达人创始人患癌,如何用AI对抗病魔?

Connor Christou,一位极度注重健康的创始人,在确诊癌症后决定用AI反击。他将所有与健康状况相关的数据——血液检测结果、影像扫描、可穿戴设备输出、日记记录——全部输入Anthropic的AI助手Claude。Claude不仅帮他整合了碎片化的医疗信息,还通过模式识别预测副作用、优化治疗方案,甚至发现了医生可能忽略的关联。这场人与AI的协作,为重症医疗提供了一种全新的可能性。

AI医疗 癌症治疗 Claude
397
TC

亚洲AI初创竞推“神话级”模型,美国出口禁令反噬市场

随着美国AI公司Anthropic的模型出口禁令持续发酵,亚洲AI初创企业纷纷推出性能媲美甚至超越西方前沿模型的“神话级”大模型。这些模型不仅规避了出口限制,更以本地化优势快速占领市场。专家分析指出,美国AI实验室可能永远失去这个全球增长最快的市场。本文深度解析亚洲AI新势力的崛起路径与行业影响。

AI出口禁令 亚洲AI 神话级模型
540
WD

白宫点头:Anthropic“神话”模型开放美国关键机构

经过数周紧张谈判,白宫最终批准AI初创公司Anthropic向少数美国企业和政府机构开放其最先进AI模型“Mythos”。这一决定标志着联邦政府首次在AI安全审查与商业利益之间达成微妙平衡,但同时也引发了对技术垄断和潜在滥用的担忧。据悉,首批获准使用该模型的机构包括国防部、国家实验室及几家头部科技企业,协议中包含严格的数据隔离与持续监控条款。

Anthropic AI模型 白宫
460
TC

OpenAI挖角Uber印度主管,领导美以外最大市场

OpenAI正式任命Uber印度前负责人Prabhdeep Singh担任印度市场主管,这是其在美国以外最大市场的最新布局。随着印度成为AI增长最快的市场之一,OpenAI正加速本地化运营,包括设立新办公室、深化与当地企业的合作以及大规模招聘。此举不仅体现了OpenAI对印度战略地位的重视,也意味着其在全球范围内与Google、微软等巨头的竞争进一步升级。

OpenAI 印度市场 人事任命
402
TC

OpenAI的Jalapeño芯片:大科技公司对英伟达最辛辣的反击

英伟达长期统治AI芯片市场,但完全依赖的时代可能即将结束。OpenAI刚刚宣布与博通合作研发定制推理芯片Jalapeño,加入谷歌、苹果、SpaceX等公司行列,试图摆脱单一供应商风险。这一举措不仅可能重塑AI芯片格局,更标志着科技巨头正从“买芯片”转向“造芯片”,开启去英伟达化的新纪元。

OpenAI Jalapeño芯片 AI芯片
483
TC

英伟达霸主地位动摇?OpenAI、SpaceX纷纷自研芯片

英伟达长期主导AI芯片市场,但随着依赖单一供应商的风险日益凸显,从OpenAI、Google到SpaceX等科技巨头纷纷转向自研芯片。OpenAI宣布与博通合作开发定制推理芯片Jalapeño,标志着AI芯片竞争进入新阶段。本文深入分析巨头自研芯片的动机、技术趋势及其对英伟达的潜在冲击,揭示AI产业供应链正在发生的深刻变革。

AI芯片 自研芯片 英伟达
492
WD

欧洲受够了,决心打造自己的AI

欧洲正加速推进自主AI战略,试图摆脱对美国的依赖。虽然短期内构建顶尖模型仍面临算力、资金和人才短板,但一个意想不到的变量——唐纳德·特朗普——可能成为欧洲的转折点。特朗普的政策不确定性、贸易摩擦以及对华技术封锁,正在迫使欧洲重新思考技术主权。本文分析欧洲AI发展的现状、挑战与机遇,探讨“欧洲制造”AI的可能性。

欧洲AI 技术主权 特朗普
589