太长不看版
| 项目 | 信息 |
|---|---|
| 是什么 | 8月20日 OpenRouter 匿名上线的神秘模型,代号 Ox Alpha(国内网友叫"牛来") |
| 免费窗口 | 上线一周内免费调用,目前已进入免费期第 4 天 |
| 硬指标 | 约 104.8 万 token 上下文、最大输出 13.1 万 token、支持文本/图像/视频输入 |
| 编程测试 | DeepSWE 10 个任务通过 8 个(80%),高于 Claude Fable 5(65%)和 GPT-5.6 Sol(52%) |
| 身份猜测 | 技术指纹高度指向智谱 GLM-5.x 系列,官方未确认 |
| 怎么用 | OpenRouter 网页直接聊,或 API 调用;OpenCode 已接入 |
| 注意 | 匿名模型不背书、样本量小,别拿生产环境赌 |
一款来历不明的模型,48 小时刷屏
8 月 20 日,AI 模型聚合平台 OpenRouter 发了一条推文:上线一款代号 Ox Alpha 的匿名新模型。官方只给了一句描述——面向编码、长时间智能体任务和实际生产环境的前沿模型。开发方是谁,一个字没提。
参数倒是给了不少:上下文窗口约 104.8 万 token,最大输出 13.1 万 token,支持文本、图像和视频输入,预览期间免费。开源终端编程智能体 OpenCode 当天就宣布接入,并声称准备了每天 100 万亿 token 的调用容量。
上线几个小时后,社区就炸了。独立研究员 Ben Davis 用软件工程基准 DeepSWE 里的 10 个子任务测试,Ox Alpha 通过率约 80%,把 Claude Fable 5(65%)、GLM-5.3 和 Grok 4.6(62%)、GPT-5.6 Sol(52%)全甩在身后。其中一个叫 meriyah-explicit-resource-declarations 的任务它一次通过,而 GLM-5.3、GPT-5.6-sol、Grok 4.6 此前都是 0/4;Ox Alpha 还保持了 51,469 项回归测试全部通过。
Ox 在英文里是”牛”的意思,国内网友顺势给它起了个接地气的名字:“牛来”大模型。
它到底是谁家的?四个方向,一个最可疑
对一款上线不到 12 小时的匿名模型,大家最好奇的是出处。社区猜测集中在四个方向:
| 猜测 | 依据 | 疑点 |
|---|---|---|
| 小米 MiMo | 8/18 小米 CFO 透露新一代 MiMo 在训练;MiMo-V2-Pro 曾以 Hunter Alpha 匿名测试 | 视频编码指纹不匹配 |
| 智谱 Z.ai | 2 月 Pony Alpha 匿名测试后被证实是 GLM-5;模型路线接近 | 无 |
| 腾讯混元 | 撑得起如此大规模免费调用的厂商不多 | 无直接证据 |
| Google Gemini | 百万上下文 + 原生视频输入像 Gemini 组合 | 套话测试最容易证伪 |
Ben Davis 在 X 上直接表态:99% 确定属于智谱 GLM-5.x 系列。他的技术溯源有几个关键证据:
- 视频编码器:四组受控视频中,ox-alpha 与 GLM-5V-Turbo 的 video token 消耗完全一致——帧率无关的帧采样、约每秒 147 token 的时长缩放、逐帧分辨率缩放,三项特征全部吻合。MiMo v2.5、Qwen 3.8 Max、GLM-4.6V 都表现出明显不同的编码特征。
- 分词器:25 个提示词测试,ox-alpha 的 token 计数与 GLM-5.3 完全吻合,只差一个固定的 +75 token 隐藏封装,基本可以判定共享同一套词表。
- 音频行为:ox-alpha 拒绝音频输入,与 GLM-5V 一致;而被列为头号竞争候选的 MiMo v2.5 支持音频输入,直接削弱了小米的可能性。
- 输出风格:每千字符约 1.3 个 emoji,与 GLM/Qwen 系列接近;Claude、GPT-5.6、Grok 同环境下 emoji 使用率接近零。
不过要泼一盆冷水:这些都是个人测试和技术推断,智谱官方至今没有确认。同一款匿名模型在问及身份时还会给出反复横跳的答案——它自称过 Gemini,但模型完全可能从训练数据里生成一个看似合理实则失实的回答。身份这事,等官宣。
为什么值得关注:免费窗口 + 生态接入
对普通用户和开发者,Ox Alpha 刷屏不只是八卦,有实打实的价值:
第一,免费。 上线一周内可以零成本调用,这对想测编码模型的人是真金白银的福利。对比一下,GPT-5.6 Sol 和 Claude Fable 5 都要订阅或按量付费。
第二,OpenCode 接入。 OpenCode 是目前增长最快的开源编程智能体之一,8/21 刚宣布用户突破 20 万。它保持模型中立,你可以在里面直接切到 Ox Alpha 干活,不用自己折腾 API。
第三,能力确实能打。 即使剔除”80% 通过率”这种小样本数据,51,469 项回归测试全过、单一任务一次通过的表现,也说明这不是个花架子模型。若它真是 GLM-5.x 系列的变体,那智谱下一代旗舰的编程能力,大概率会比 GLM-5.3 再上一个台阶。
第四,市场格局信号。 就在 Ox Alpha 上线前后,DeepSeek 开源了 Harness agent 框架(8/13),OpenAI 开源了 Codex Harness(8/21),DeepSeek V4 免费通道下线,OpenCode 上只剩 Big Pickle、腾讯混元 Hy3 等 5 款免费模型。匿名测试、开源框架、免费模型洗牌,AI 编程赛道明显进入了新一轮军备竞赛。
怎么免费体验
方式一:OpenRouter 网页直接聊
- 打开 OpenRouter,搜索
stealth/ox-alpha(或直接访问模型页面)。 - 不需要充值,免费期内直接开始对话。
- 想传图传视频,在对话框上传附件即可;想测长上下文,直接把大段代码或文档贴进去。
方式二:OpenRouter API 调用
拿到 OpenRouter 的 API Key 后,请求里把 model 参数写成 stealth/ox-alpha:
1 | curl https://openrouter.ai/api/v1/chat/completions \ |
免费期内不扣费;免费期结束后,按 OpenRouter 页面的实时价格计费。
方式三:OpenCode 里直接用
OpenCode 已原生接入 Ox Alpha,安装 OpenCode 后在模型列表里选 ox-alpha 即可,适合直接丢进真实代码仓库做重构、修 bug、写测试。
客观说几句:别被 80% 冲昏头
- 样本小:DeepSWE 只测了 10 个任务,且各模型测试次数不一致,Ox Alpha 还没进 DeepSWE 官方排行榜。80% 是参考,不是定论。
- 匿名不背书:没有 system card、没有安全评估报告、没有官方文档,跑生产环境风险自负。
- 免费窗口有限:一周后大概率收费或下架,想测趁早。
FAQ
Q:Ox Alpha 和 GLM-5.3 是什么关系? A:多项技术指纹(分词器、视频编码器、音频行为)指向同一家族,但智谱未官宣。即便同源,Ox Alpha 在 DeepSWE 的表现也优于 GLM-5.3,可能是更新版本或针对编码优化的变体。
Q:它比 GPT-5.6 强吗? A:在 Ben Davis 的 DeepSWE 小样本测试里通过率更高(80% vs 52%),但真实能力需要更大规模、官方级别的基准验证。说”全面超越”为时过早。
Q:免费期过了还能用吗? A:按 OpenRouter 惯例,免费期后转为按量付费,具体价格以模型页实时显示为准。
Q:中国用户能访问 OpenRouter 吗? A:OpenRouter 需要跨境网络才能顺畅访问。如果你在测试或日常使用中遇到连接问题,可以参考文末的跨境网络加速方案,选择支持 IEPL 专线的服务商保障 API 调用稳定。
相关阅读
- GLM-5.3 上手指南:智谱新一代模型怎么用
- DeepSeek Harness:DeepSeek 开源的 agent 框架解读
- Claude Code 完整指南:终端里的 AI 编程助手
- Kimi K3 新版本变化与上手
- DeepSeek V4-Flash 正式版指南
跨境网络加速方案推荐
测试 Ox Alpha、调用 OpenRouter API、体验 OpenCode,都离不开稳定的跨境网络。这里按不同需求推荐几家经过长期验证的服务商:
| 需求 | 推荐 | 特点 |
|---|---|---|
| 主力推荐 | 光速云 | IEPL 专线,IEPL专线 多路复用,100+ 节点,不限设备 |
| 开发测试 | 飞猫云 | IEPL 线路,稳定性好,性价比高 |
| 团队协作 | SS-ID | IEPL 专线,流媒体解锁,5 设备,月付 ¥20 起 |
| 预算入门 | 微风网络 | 全球 80+ 地区覆盖,¥6.99/月起 |
定价以各服务商官网实时显示为准。本文写于 2026-08-23,Ox Alpha 免费窗口状态以 OpenRouter 页面为准。