Ox Alpha 全解:OpenRouter 匿名模型的实测数据与身份指纹

最后更新: 2026-08-26 · 本页为常青参考页,随事件进展与最新公开评测数据持续更新
2026 年 8 月 20 日前后,一款名为 Ox Alpha 的匿名模型以 stealth/ox-alpha 身份登陆 OpenRouter:105 万 token 上下文、文本/图像/视频全模态、限时免费,早期测试在编码与代理任务上超越 GPT-5.6 Sol。本指南梳理已证实的事实、指向智谱 GLM 的技术指纹、网络猜测的来龙去脉,以及开发者试用建议。

时间线:一款没有署名的模型上线了

2026 年 8 月 20 日前后,Ox Alpha 以 stealth/ox-alpha 命名出现在 OpenRouter,没有公司公告、没有技术白皮书。已由独立媒体证实的参数:上下文窗口 105 万 token、最大输出 13 万 token,支持文本、图像、视频输入,是 Stealth 匿名系列首个原生全模态模型;上线即提供一周免费调用(定价 0 美元/百万 token),执行零数据留存协议,知识截止延伸至 2025 年 11 月,缓存命中率约 77.9%。详见本站首发报道:Ox Alpha 匿名上线 OpenRouter

Benchmarks 怎么说:超越 GPT-5.6 的成绩可信吗

早期社区测试显示,Ox Alpha 在编码与代理任务上超越 GPT-5.6 Sol 与 Fable 5;1M 上下文规格与 Gemini 3.7 Flash 相当,但支持视频输入且当前免费;对比之下 DeepSeek V4 Flash 上下文仅 128K。这些成绩值得关注,但要打两个折扣:其一,匿名模型没有官方基准报告,社区测试的口径与样本量参差不齐;其二,免费期内的服务配置未必等于正式版。

我们对匿名爆款成绩的一贯建议与 Qwen 3.8 27B 基准争议指南中的结论一致:厂商未署名、方法不透明的分数,一律按"待独立验证"处理,用自己的真实任务小规模实测最可靠。

它是谁的:指向智谱 GLM 的技术指纹

虽然没有署名,但技术指纹相当密集:分词器特征与智谱 GLM 系列在全部 11 项指标上一致;数字探针测试中 Ox Alpha 消耗 29 个 token,与 GLM 完全匹配(DeepSeek 为 98 个);部署配置与 GLM-5.3 高度吻合,且 GLM-5.3 新配置上线仅两天后 Ox Alpha 即采用相同设置。此外,智谱创始人唐杰三个月前刚预告"多模态模式即将上线"。历史上的 Stealth 匿名模型最终揭晓为 GLM-5 或 MiMo 系列,这类"匿名预热收集高并发数据"的路径已有先例。综合判断:Ox Alpha 最可能是智谱多模态 GLM 版本的隐秘测试。

另一条故事线:网络考古与"AI 不明飞行物"

与冷静的指纹分析并行的,是一场典型的网络狂欢:8 月 21 日凌晨匿名用户在 GitHub Gist 发布对话截图,展示 Ox Alpha 解决奥数级问题;两位知名 AI 安全研究员发出"我们面对的不只是新模型"式暧昧推文后火速删除;Reddit 与 Hacker News 在 72 小时内陷入猜测——OpenAI 影子实验?黑客逆向产物?还是一场行为艺术?OpenAI 与 Google 拒绝置评。详见本站报道:神秘模型 Ox Alpha 引爆网络猜测

这场喧嚣本身是个提醒:当一项技术强大到无法被验证时,公众想象力会填补所有空白——对匿名模型保持事实与猜测的边界,比站队更重要。

开发者试用建议

如果你的场景涉及整库代码理解或多模态输入,Ox Alpha 的免费额度值得一试:1M 上下文允许直接喂入整个代码库做重构,无需 RAG 切片;视频输入可用于诊断前端交互 Bug;API 兼容标准 OpenAI 接口,可快速接入 Cursor、Aider 等工具。

三条注意:保留 GPT-5.6 Sol 等已知模型作为基准对照;"零数据留存"是平台声明,涉密数据仍应谨慎;匿名测试模型随时可能下线或改价,不要把生产链路押在它上面——等正式版发布后再评估长期定价与 SLA。

常见问题

Ox Alpha 是什么模型?

Ox Alpha 是 2026 年 8 月 20 日前后以 stealth/ox-alpha 身份匿名登陆 OpenRouter 的大模型:105 万 token 上下文、最大输出 13 万 token,支持文本、图像、视频输入,上线时限时免费并执行零数据留存协议。发布方未署名。

Ox Alpha 背后是谁?

未官方证实,但技术指纹高度指向智谱 GLM 系列:分词器特征 11 项指标全部与 GLM 一致,数字探针消耗 29 个 token 与 GLM 完全匹配,部署配置与 GLM-5.3 高度吻合。历史上的 Stealth 匿名模型最终均揭晓为 GLM-5 或 MiMo 系列,最可能的解释是智谱多模态 GLM 的隐秘预热测试。

Ox Alpha 的 benchmark 成绩可信吗?

早期社区测试显示其在编码和代理任务上超越 GPT-5.6 Sol 与 Fable 5,但这些是非官方、口径不一的测试,且免费期配置未必等于正式版。建议按"待独立验证"处理,用自己的真实任务实测,并保留已知模型做基准对照。

现在还能免费用 Ox Alpha 吗?

上线时通过 OpenRouter 和 OpenCode Zen 提供一周免费调用(0 美元/百万 token)。匿名测试模型的可用性和定价随时可能变化,试用前请以 OpenRouter 页面的当前状态为准,且不建议将生产链路依赖于它。