阿里巴巴Qwen3.8-Max-Preview预览2.4万亿参数模型 紧随Kimi K3发布

2026年7月19日阿里巴巴在WAIC期间预览Qwen3.8-Max-Preview,该2.4万亿参数多模态模型通过Token Plan订阅提供预览访问,定价为标准价的10%,计划近期开放权重。此举紧随Moonshot AI两天前发布Kimi K3 2.8万亿参数模型之后,凸显中国实验室在多万亿参数模型竞赛中的并行推进。

2026年7月19日,阿里巴巴Qwen团队在上海WAIC期间预览Qwen3.8-Max-Preview,该模型总参数规模达2.4万亿,被描述为仅次于Fable 5的前沿系统。

事实还原

预览版本已通过Alibaba Token Plan订阅服务提供,定价为标准价格的10%。模型支持文本、图像、视频和文档处理,是Qwen团队首个超过1万亿参数的多模态模型。公告称其在编码、全栈开发、数据分析和办公工作流上优于Qwen3.7-Max。模型计划近期开放权重。

此次发布距离Moonshot AI推出Kimi K3仅两天,后者参数规模为2.8万亿,目前为全球最大开源权重模型。两家实验室的发布时间重叠,均选择在WAIC期间公布。

机制拆解

Qwen3.8-Max-Preview采用稀疏MoE架构,总参数2.4万亿但激活参数数量未公开。此前Qwen3-235B-A22B激活22亿参数,Qwen3-30B-A3B激活约3亿参数,显示激活规模直接决定推理成本。2.4万亿参数以4位精度存储权重需约1.2TB,单张Nvidia H200显存141GB,八卡配置仍面临实际部署限制。

预览版本通过API提供,兼容OpenAI和Anthropic协议,上下文窗口继承Qwen3.7-Max的1M token。Shuai Bai指出模型处于持续演进状态,当前为早期版本。

产业影响

对开发者而言,10%定价降低API调用门槛,但缺少激活参数和基准细节,难以评估长期自托管成本。企业用户可通过订阅快速测试多模态能力,但自托管需等待开放权重版本。

对竞争格局,Kimi K3与Qwen3.8-Max-Preview同期推出,显示中国实验室在多万亿参数模型上形成并行推进态势。开放权重计划可能加速企业可控部署,减少对闭源模型依赖。

对上下游,算力需求将因总参数规模上升,定价策略需平衡预览折扣与正式版本收益。

对照与先例

与Kimi K3相比,两模型均采用开放权重路线,参数规模接近。Qwen历史显示MoE设计可降低激活成本,但本次未披露激活参数,与此前版本形成对比。

战略判断

接下来最可能出现的情况是Alibaba公布激活参数或提供量化检查点,以降低部署门槛。验证信号包括开放权重发布时间及实际基准数据发布。