
Ox Alpha vs GLM-5.3 深度对比实测:到底是不是同一个模型?
六组独立指纹证据 + 官方参数逐项核对:Ox Alpha 几乎可以确定是智谱 GLM-5.3 家族的多模态变体(GLM-5.3 Flash)。本文讲清完整证据链、三处关键差异,以及免费窗口期怎么调用。
先说结论:Ox Alpha 几乎可以确定就是智谱(Z.ai)GLM-5.3 家族的模型,但它不是 8 月 14 日发布的纯文本版 GLM-5.3 本身,而是多了图片/视频输入能力的同门变体(社区普遍指向尚未官宣的 GLM-5.3 Flash)。 判断依据是六组相互独立的技术指纹:tokenizer 探针 11/11 全中、60 项指标比对满分、视频编码器逐 token 一致、隐藏配置与 GLM-5.3 完全相同。本文把两者的官方参数逐项核对,讲清证据链,并给出免费窗口期的使用建议。
本文最后更新于 2026 年 8 月 25 日。Ox Alpha 目前仍处于匿名(Stealth)状态,官方尚未认领,结论基于公开可验证的技术指纹与官方文档核对。
本文速览
- Ox Alpha 和 GLM-5.3 各是什么
- 两者官方参数逐项对照(含核对日期与数据源)
- 六组身份鉴定证据 + 三处关键差异
- 免费窗口期怎么调用 Ox Alpha、两者怎么选

Ox Alpha 是什么?
Ox Alpha 是 2026 年 8 月 20 日晚出现在 OpenRouter 上的匿名模型(模型 ID:stealth/ox-alpha),提供方仅标注为 "Stealth",限免一周。OpenRouter 官方模型页对它的定位是:面向编码、长程 Agent 任务和生产负载的推理模型,支持 1M token 上下文、最高 128K token 输出,支持文本、图片、视频输入。
上线后热度非常夸张:据社区统计,5 天内 OpenRouter 累计处理约 2 万亿 tokens,冲上日榜第 1、周榜第 9;编程工具 OpenCode 同步宣布免费接入,宣称日产能 100 万亿 tokens;在 DeepSWE 编程基准上跑出了约 80% 的成绩。
我们此前的 Ox Alpha 深度评测与上手指南 已覆盖基础用法,本文聚焦大家最关心的问题:它和 GLM-5.3 到底是不是同一个模型?
GLM-5.3 是什么?
GLM-5.3 是智谱(Z.ai)于 2026 年 8 月 14 日正式发布的旗舰推理模型。按 z.ai 官方文档的说法,它与 GLM-5.2 使用同一底座,全部提升来自后训练:在 Z.ai Code Bench 上比 GLM-5.2 提升 50%,并在 Terminal Bench 3.0 等公开榜单上达到开源模型 SOTA。
它的关键规格:1M token 上下文、最大输出 128K token、强制开启推理且不可关闭、推理档位分 low / high / max(默认 max)、目前仅支持文本输入。API 定价约 1.4 美元 / 百万输入 token、4.4 美元 / 百万输出 token。智谱的开源模型权重托管在 GitHub zai-org。
Ox Alpha 和 GLM-5.3 参数对比
下表是我们在 2026 年 8 月 25 日逐项核对 OpenRouter API 实时返回参数与 z.ai 官方文档后的结果:
| 对比项 | Ox Alpha | GLM-5.3 |
|---|---|---|
| 上下文窗口 | 1,048,576(1M) | 1,048,576(1M) |
| 最大输出 | 131,072(128K) | 128K |
| 推理模式 | 强制开启 | 强制开启,不可关闭 |
| 推理档位 | low / high / max,默认 max | low / high / max,默认 max |
| 输入模态 | 文本 + 图片 + 视频 | 仅文本 |
| 价格 | 免费(限免一周) | 输入 $1.4 / 输出 $4.4 每百万 token |
| 提供方 | Stealth(匿名) | Z.ai 官方 |
| 上线时间 | 8 月 20 日 | 8 月 14 日 |
五项核心工程参数完全一致——上下文窗口、输出上限、强制推理、档位命名、默认档位。其中 low / high / max 这套推理档位命名是 GLM-5.3 特有的设计,其他厂商并不使用。真正的分歧点只有两处:输入模态和计费方式。
六组独立证据:为什么说它们是同一个模型

1. Tokenizer 指纹 11/11 全中。 研究者 @sushsrinivasan 用 11 组 tokenizer 探针测试了 10 个候选模型,Ox Alpha 对 GLM 家族 11 项全部命中,其他实验室的模型最高只中 4 项。
2. 60 项指标比对满分。 @RodrigOrnellas 做了目前最大规模的横向对比:GLM 系 60/60,Kimi 8/60,混元 3/60,Qwen 2/60,DeepSeek 1/60,小米 MiMo 0/60。
3. Token 计数恒定偏移 +75。 @MaxForAI 用 25 组完全不同的 prompt 对比发现:Ox Alpha 的原始 token 数与 GLM-5.3 几乎一模一样,每次固定多出 75 个 token——正好是一个隐藏 system wrapper 的长度。
4. 视频编码器逐 token 相同。 @RichardAGetz 用 4 段对照视频测试:Ox Alpha 与 GLM-5V-Turbo 的 token 消耗模式逐 token 吻合(约 147 tokens/秒的时长缩放;同一段 2 秒测试视频,两者都恰好消耗 296 个 token),而 MiMo、Qwen、GLM-4.6V 的指纹都对不上。
5. 隐藏配置与错误字符串逐字一致。 有开发者发现 Ox Alpha 在 OpenRouter 的隐藏配置与 GLM-5.3 完全相同;另有开发者比对其错误字符串,与 chat.z.ai 的接口规范逐字一致,且 reasoning contract 只在 GLM-5.3 上存在。
6. 文体统计特征吻合。 Ox Alpha 平均每千字符使用 1.3 个 emoji,与 GLM、Qwen 等中文大模型的特征吻合;Claude、GPT-5.6、Grok 的 emoji 使用率几乎为 0。
OpenRouter 的 stealth 历史也支持这一判断:此前的 Pony Alpha 被证实是智谱 GLM-5,Hunter / Healer Alpha 是小米 MiMo——每次都是厂商自己匿名投放,尚无第三方伪装的先例。
三处关键差异:更像 GLM-5.3 Flash 而非 GLM-5.3
既然参数和指纹都一样,为什么不能直接画等号?因为存在三处真实差异:
- 多模态输入:GLM-5.3 官方文档明确"目前仅支持文本输入",而 Ox Alpha 支持图片和视频,且视频编码指纹与 GLM-5V-Turbo 一致——更像是把 GLM-5.3 的文本能力接到了 GLM-5V 成熟的视觉路线上。
- 安全对齐策略不一致:社区测试敏感话题时,Ox Alpha 的应答策略与正式版 GLM-5.3 不完全相同,可能是匿名灰度期间放宽了部分限制。
- 计费方式:正式版按 token 计费,Ox Alpha 限免一周,是典型的 stealth 发布收集真实负载反馈的打法。
综合全部证据,最合理的结论是:Ox Alpha 是 GLM-5.3 家族的多模态变体(社区称 GLM-5.3 Flash),与 GLM-5.3 同源同底座,但不是同一个发布形态。
反对声音:还有哪些不确定性
严谨起见,两类反对意见值得了解:
- Nous Research 的 Teknium 指出:tokenizer 相同也可能是第三方拿 GLM 开源权重做后训练后自行部署,配置一致只能证明基础设施来源,不能证明是智谱官方在运营。这个论点技术上成立,但与 OpenRouter 历次 stealth 的厂商直营先例不符。
- 有海外账号声称"已确认身份,你们全猜错了",但至今未给出任何可验证的证据,无法推翻指纹结论。
因此在官方正式认领之前,严谨的表述是"指纹证据强烈指向",而不是 100% 官宣。
现在怎么用 Ox Alpha(免费窗口期)
- 注册 OpenRouter 账号并创建 API Key
- 调用时模型 ID 填
stealth/ox-alpha,按任务复杂度选择推理档位(写代码建议 max) - 可直接接入 Claude Code、Cursor 等编程工具——详细步骤见 Ox Alpha 免费模型 API 接入教程
注意:限免期到 8 月 27 日前后结束,之后大概率恢复计费或与正式版合并,想压测和体验要趁早。想找更多同类 AI 编程工具,可以逛我们的 AI 工具导航。
对比结论:Ox Alpha 和 GLM-5.3 该选哪个
- 想零成本体验顶级编码与 Agent 能力:趁限免窗口直接用 Ox Alpha
- 需要稳定商用、官方支持:等官方揭晓身份,或直接用正式版 GLM-5.3
- 需要图片/视频理解:目前只能选 Ox Alpha(或 GLM-5V-Turbo),正式版 GLM-5.3 暂不支持
总结
Ox Alpha vs GLM-5.3 的答案是:同源、同底座、同指纹,不同形态。Ox Alpha 是智谱 GLM-5.3 家族带视觉能力的匿名变体,六组相互独立的技术指纹彼此印证,这是目前证据链最完整的判断。官方揭晓之前,你可以趁免费窗口在 OpenRouter 上直接体验它的编码与多模态能力;本文会在官方认领后第一时间更新结论。
常见问题
Ox Alpha 和 GLM-5.3 是同一个模型吗?
指纹证据强烈指向"同一家族":tokenizer 探针 11/11 全中、60 项指标比对满分、隐藏配置完全一致。但 Ox Alpha 多了图片/视频输入能力,更准确的定位是 GLM-5.3 的多模态变体(社区称 GLM-5.3 Flash),而非 8 月 14 日发布的纯文本版 GLM-5.3 本身。
Ox Alpha 是免费的吗?
目前是。Ox Alpha 以 stealth 身份限免一周(OpenRouter 定价显示输入输出均为 0 美元),限免期至 2026 年 8 月 27 日前后,之后可能转为计费或与正式版合并,建议在免费窗口内完成测试。
Ox Alpha 是谁开发的?
所有可验证的技术指纹都指向智谱(Z.ai):错误字符串与 chat.z.ai 逐字一致、视频编码器与 GLM-5V-Turbo 逐 token 相同、low/high/max 推理档位命名是 GLM-5.3 特有设计。官方尚未认领,但按 OpenRouter stealth 惯例(Pony Alpha 后被证实为 GLM-5),基本可以锁定。
Ox Alpha 怎么调用?
在 OpenRouter 创建 API Key 后,用 OpenAI 兼容协议调用,模型 ID 填 stealth/ox-alpha 即可;也可以接入 Claude Code、Cursor 等编程工具,站内有详细的接入教程。
GLM-5.3 支持图片和视频输入吗?
不支持。z.ai 官方文档明确 GLM-5.3 目前仅支持文本输入;需要多模态能力可以选 GLM-5V-Turbo,或直接使用支持图片/视频输入的 Ox Alpha。
Ox Alpha 的免费额度有多少?
限免期内不限量免费,上下文窗口 1M token、单次最大输出 128K token,推理档位可选 low / high / max。限免期为上架后一周,之后的政策以 OpenRouter 和模型方公布为准。

京ICP备2024094994号-29