2026年8月20日前后,一款名为Ox Alpha的未知模型以stealth/ox-alpha命名出现在OpenRouter平台,支持105万token上下文窗口以及文本、图像、视频多模态输入,早期测试显示其在编码和代理任务上超越GPT-5.6 Sol与Fable 5,已获独立媒体证实。
事实还原
根据OpenRouter页面信息,Ox Alpha于8月20日前后发布,提供一周免费使用,上下文窗口达到105万token,最大输出13万token,支持文本图像视频输入。来源2显示其缓存命中率约77.9%,知识截止范围延伸至2025年11月。来源3确认其为Stealth匿名系列首个原生支持全模态的模型,当前在OpenRouter和OpenCode Zen上免费调用,执行零数据留存协议。
机制拆解
该模型采用匿名部署策略,无公司公告或品牌宣传,仅通过OpenRouter平台开放。来源2指出,其分词器特征与智谱GLM系列在全部11项指标上一致,数字探针测试中消耗29个token,与GLM完全匹配而非DeepSeek的98个token。部署配置与GLM-5.3高度吻合,包括收紧的参数接口,且GLM-5.3新配置上线仅两天后Ox Alpha即采用相同设置。智谱创始人唐杰此前表示多模态模式即将上线,距离该表态已过3个月。
产业影响
对开发者而言,1M上下文允许直接输入整个代码库进行重构,无需RAG切片,视频输入可用于诊断前端交互Bug。企业用户可通过标准OpenAI接口快速接入Cursor、Aider等工具,零留存协议降低数据风险。对竞争格局而言,匿名测试模式让智谱能在正式发布前收集高并发数据,类似此前GLM-5和MiMo-V2-Pro的路径。对上下游平台,OpenRouter获得流量增长,来源3显示其提供超高并发服务能力。
对照与先例
来源3对比显示,Ox Alpha的1M上下文与Gemini 3.7 Flash接近,但支持视频输入且当前免费;DeepSeek V4 Flash上下文仅128K,采用峰谷计费。历史Stealth案例中,匿名模型最终揭晓为GLM-5或MiMo系列,Ox Alpha的Tokenizer匹配度与GLM-5.3配置一致度均指向同一来源。
战略判断
基于现有事实,智谱最可能在近期正式发布多模态GLM版本,Ox Alpha作为预热测试已验证1M上下文和视频能力。开发者可通过OpenRouter API测试其长程编码表现。以上判断基于已公开的Tokenizer探针和配置匹配分析。
对选型建议,开发者若需处理整库代码和多模态输入,可优先尝试Ox Alpha的免费额度,同时保留GPT-5.6 Sol作为基准对比;企业则应关注零留存协议的实际执行情况,并在正式版本发布后评估长期定价。来源1和来源3均确认其当前定价为0美元每百万token。
© 2026 Winzheng.com 赢政天下 | 转载请注明来源并附原文链接