2026年7月19日,阿里巴巴Qwen团队在上海WAIC期间预览Qwen3.8-Max-Preview,该模型总参数规模达2.4万亿,被描述为仅次于Fable 5的前沿系统。
事实还原
预览版本已通过Alibaba Token Plan订阅服务提供,定价为标准价格的10%。模型支持文本、图像、视频和文档处理,是Qwen团队首个超过1万亿参数的多模态模型。公告称其在编码、全栈开发、数据分析和办公工作流上优于Qwen3.7-Max。模型计划近期开放权重。
此次发布距离Moonshot AI推出Kimi K3仅两天,后者参数规模为2.8万亿,目前为全球最大开源权重模型。两家实验室的发布时间重叠,均选择在WAIC期间公布。
机制拆解
Qwen3.8-Max-Preview采用稀疏MoE架构,总参数2.4万亿但激活参数数量未公开。此前Qwen3-235B-A22B激活22亿参数,Qwen3-30B-A3B激活约3亿参数,显示激活规模直接决定推理成本。2.4万亿参数以4位精度存储权重需约1.2TB,单张Nvidia H200显存141GB,八卡配置仍面临实际部署限制。
预览版本通过API提供,兼容OpenAI和Anthropic协议,上下文窗口继承Qwen3.7-Max的1M token。Shuai Bai指出模型处于持续演进状态,当前为早期版本。
产业影响
对开发者而言,10%定价降低API调用门槛,但缺少激活参数和基准细节,难以评估长期自托管成本。企业用户可通过订阅快速测试多模态能力,但自托管需等待开放权重版本。
对竞争格局,Kimi K3与Qwen3.8-Max-Preview同期推出,显示中国实验室在多万亿参数模型上形成并行推进态势。开放权重计划可能加速企业可控部署,减少对闭源模型依赖。
对上下游,算力需求将因总参数规模上升,定价策略需平衡预览折扣与正式版本收益。
对照与先例
与Kimi K3相比,两模型均采用开放权重路线,参数规模接近。Qwen历史显示MoE设计可降低激活成本,但本次未披露激活参数,与此前版本形成对比。
战略判断
接下来最可能出现的情况是Alibaba公布激活参数或提供量化检查点,以降低部署门槛。验证信号包括开放权重发布时间及实际基准数据发布。
© 2026 Winzheng.com 赢政天下 | 转载请注明来源并附原文链接