Ox Alpha vs GLM-5.3 深度对比实测:到底是不是同一个模型?封面图
AI 编程约 8 分钟

Ox Alpha vs GLM-5.3 深度对比实测:到底是不是同一个模型?

AI 指南··0 浏览

六组独立指纹证据 + 官方参数逐项核对:Ox Alpha 几乎可以确定是智谱 GLM-5.3 家族的多模态变体(GLM-5.3 Flash)。本文讲清完整证据链、三处关键差异,以及免费窗口期怎么调用。

先说结论:Ox Alpha 几乎可以确定就是智谱(Z.ai)GLM-5.3 家族的模型,但它不是 8 月 14 日发布的纯文本版 GLM-5.3 本身,而是多了图片/视频输入能力的同门变体(社区普遍指向尚未官宣的 GLM-5.3 Flash)。 判断依据是六组相互独立的技术指纹:tokenizer 探针 11/11 全中、60 项指标比对满分、视频编码器逐 token 一致、隐藏配置与 GLM-5.3 完全相同。本文把两者的官方参数逐项核对,讲清证据链,并给出免费窗口期的使用建议。

本文最后更新于 2026 年 8 月 25 日。Ox Alpha 目前仍处于匿名(Stealth)状态,官方尚未认领,结论基于公开可验证的技术指纹与官方文档核对。

本文速览

  • Ox Alpha 和 GLM-5.3 各是什么
  • 两者官方参数逐项对照(含核对日期与数据源)
  • 六组身份鉴定证据 + 三处关键差异
  • 免费窗口期怎么调用 Ox Alpha、两者怎么选

Ox Alpha vs GLM-5.3 事件时间线:从 GLM-5.3 发布到 Ox Alpha 匿名上架

Ox Alpha 是什么?

Ox Alpha 是 2026 年 8 月 20 日晚出现在 OpenRouter 上的匿名模型(模型 ID:stealth/ox-alpha),提供方仅标注为 "Stealth",限免一周。OpenRouter 官方模型页对它的定位是:面向编码、长程 Agent 任务和生产负载的推理模型,支持 1M token 上下文、最高 128K token 输出,支持文本、图片、视频输入。

上线后热度非常夸张:据社区统计,5 天内 OpenRouter 累计处理约 2 万亿 tokens,冲上日榜第 1、周榜第 9;编程工具 OpenCode 同步宣布免费接入,宣称日产能 100 万亿 tokens;在 DeepSWE 编程基准上跑出了约 80% 的成绩。

我们此前的 Ox Alpha 深度评测与上手指南 已覆盖基础用法,本文聚焦大家最关心的问题:它和 GLM-5.3 到底是不是同一个模型?

GLM-5.3 是什么?

GLM-5.3 是智谱(Z.ai)于 2026 年 8 月 14 日正式发布的旗舰推理模型。按 z.ai 官方文档的说法,它与 GLM-5.2 使用同一底座,全部提升来自后训练:在 Z.ai Code Bench 上比 GLM-5.2 提升 50%,并在 Terminal Bench 3.0 等公开榜单上达到开源模型 SOTA。

它的关键规格:1M token 上下文、最大输出 128K token、强制开启推理且不可关闭、推理档位分 low / high / max(默认 max)、目前仅支持文本输入。API 定价约 1.4 美元 / 百万输入 token、4.4 美元 / 百万输出 token。智谱的开源模型权重托管在 GitHub zai-org

Ox Alpha 和 GLM-5.3 参数对比

下表是我们在 2026 年 8 月 25 日逐项核对 OpenRouter API 实时返回参数与 z.ai 官方文档后的结果:

对比项 Ox Alpha GLM-5.3
上下文窗口 1,048,576(1M) 1,048,576(1M)
最大输出 131,072(128K) 128K
推理模式 强制开启 强制开启,不可关闭
推理档位 low / high / max,默认 max low / high / max,默认 max
输入模态 文本 + 图片 + 视频 仅文本
价格 免费(限免一周) 输入 $1.4 / 输出 $4.4 每百万 token
提供方 Stealth(匿名) Z.ai 官方
上线时间 8 月 20 日 8 月 14 日

五项核心工程参数完全一致——上下文窗口、输出上限、强制推理、档位命名、默认档位。其中 low / high / max 这套推理档位命名是 GLM-5.3 特有的设计,其他厂商并不使用。真正的分歧点只有两处:输入模态和计费方式。

六组独立证据:为什么说它们是同一个模型

Ox Alpha 身份鉴定:60 项指纹指标比对,GLM 家族满分领先

1. Tokenizer 指纹 11/11 全中。 研究者 @sushsrinivasan 用 11 组 tokenizer 探针测试了 10 个候选模型,Ox Alpha 对 GLM 家族 11 项全部命中,其他实验室的模型最高只中 4 项。

2. 60 项指标比对满分。 @RodrigOrnellas 做了目前最大规模的横向对比:GLM 系 60/60,Kimi 8/60,混元 3/60,Qwen 2/60,DeepSeek 1/60,小米 MiMo 0/60。

3. Token 计数恒定偏移 +75。 @MaxForAI 用 25 组完全不同的 prompt 对比发现:Ox Alpha 的原始 token 数与 GLM-5.3 几乎一模一样,每次固定多出 75 个 token——正好是一个隐藏 system wrapper 的长度。

4. 视频编码器逐 token 相同。 @RichardAGetz 用 4 段对照视频测试:Ox Alpha 与 GLM-5V-Turbo 的 token 消耗模式逐 token 吻合(约 147 tokens/秒的时长缩放;同一段 2 秒测试视频,两者都恰好消耗 296 个 token),而 MiMo、Qwen、GLM-4.6V 的指纹都对不上。

5. 隐藏配置与错误字符串逐字一致。 有开发者发现 Ox Alpha 在 OpenRouter 的隐藏配置与 GLM-5.3 完全相同;另有开发者比对其错误字符串,与 chat.z.ai 的接口规范逐字一致,且 reasoning contract 只在 GLM-5.3 上存在。

6. 文体统计特征吻合。 Ox Alpha 平均每千字符使用 1.3 个 emoji,与 GLM、Qwen 等中文大模型的特征吻合;Claude、GPT-5.6、Grok 的 emoji 使用率几乎为 0。

OpenRouter 的 stealth 历史也支持这一判断:此前的 Pony Alpha 被证实是智谱 GLM-5,Hunter / Healer Alpha 是小米 MiMo——每次都是厂商自己匿名投放,尚无第三方伪装的先例。

三处关键差异:更像 GLM-5.3 Flash 而非 GLM-5.3

既然参数和指纹都一样,为什么不能直接画等号?因为存在三处真实差异:

  1. 多模态输入:GLM-5.3 官方文档明确"目前仅支持文本输入",而 Ox Alpha 支持图片和视频,且视频编码指纹与 GLM-5V-Turbo 一致——更像是把 GLM-5.3 的文本能力接到了 GLM-5V 成熟的视觉路线上。
  2. 安全对齐策略不一致:社区测试敏感话题时,Ox Alpha 的应答策略与正式版 GLM-5.3 不完全相同,可能是匿名灰度期间放宽了部分限制。
  3. 计费方式:正式版按 token 计费,Ox Alpha 限免一周,是典型的 stealth 发布收集真实负载反馈的打法。

综合全部证据,最合理的结论是:Ox Alpha 是 GLM-5.3 家族的多模态变体(社区称 GLM-5.3 Flash),与 GLM-5.3 同源同底座,但不是同一个发布形态。

反对声音:还有哪些不确定性

严谨起见,两类反对意见值得了解:

  • Nous Research 的 Teknium 指出:tokenizer 相同也可能是第三方拿 GLM 开源权重做后训练后自行部署,配置一致只能证明基础设施来源,不能证明是智谱官方在运营。这个论点技术上成立,但与 OpenRouter 历次 stealth 的厂商直营先例不符。
  • 有海外账号声称"已确认身份,你们全猜错了",但至今未给出任何可验证的证据,无法推翻指纹结论。

因此在官方正式认领之前,严谨的表述是"指纹证据强烈指向",而不是 100% 官宣。

现在怎么用 Ox Alpha(免费窗口期)

  1. 注册 OpenRouter 账号并创建 API Key
  2. 调用时模型 ID 填 stealth/ox-alpha,按任务复杂度选择推理档位(写代码建议 max)
  3. 可直接接入 Claude Code、Cursor 等编程工具——详细步骤见 Ox Alpha 免费模型 API 接入教程

注意:限免期到 8 月 27 日前后结束,之后大概率恢复计费或与正式版合并,想压测和体验要趁早。想找更多同类 AI 编程工具,可以逛我们的 AI 工具导航

对比结论:Ox Alpha 和 GLM-5.3 该选哪个

  • 零成本体验顶级编码与 Agent 能力:趁限免窗口直接用 Ox Alpha
  • 需要稳定商用、官方支持:等官方揭晓身份,或直接用正式版 GLM-5.3
  • 需要图片/视频理解:目前只能选 Ox Alpha(或 GLM-5V-Turbo),正式版 GLM-5.3 暂不支持

总结

Ox Alpha vs GLM-5.3 的答案是:同源、同底座、同指纹,不同形态。Ox Alpha 是智谱 GLM-5.3 家族带视觉能力的匿名变体,六组相互独立的技术指纹彼此印证,这是目前证据链最完整的判断。官方揭晓之前,你可以趁免费窗口在 OpenRouter 上直接体验它的编码与多模态能力;本文会在官方认领后第一时间更新结论。

常见问题

Ox Alpha 和 GLM-5.3 是同一个模型吗?

指纹证据强烈指向"同一家族":tokenizer 探针 11/11 全中、60 项指标比对满分、隐藏配置完全一致。但 Ox Alpha 多了图片/视频输入能力,更准确的定位是 GLM-5.3 的多模态变体(社区称 GLM-5.3 Flash),而非 8 月 14 日发布的纯文本版 GLM-5.3 本身。

Ox Alpha 是免费的吗?

目前是。Ox Alpha 以 stealth 身份限免一周(OpenRouter 定价显示输入输出均为 0 美元),限免期至 2026 年 8 月 27 日前后,之后可能转为计费或与正式版合并,建议在免费窗口内完成测试。

Ox Alpha 是谁开发的?

所有可验证的技术指纹都指向智谱(Z.ai):错误字符串与 chat.z.ai 逐字一致、视频编码器与 GLM-5V-Turbo 逐 token 相同、low/high/max 推理档位命名是 GLM-5.3 特有设计。官方尚未认领,但按 OpenRouter stealth 惯例(Pony Alpha 后被证实为 GLM-5),基本可以锁定。

Ox Alpha 怎么调用?

在 OpenRouter 创建 API Key 后,用 OpenAI 兼容协议调用,模型 ID 填 stealth/ox-alpha 即可;也可以接入 Claude Code、Cursor 等编程工具,站内有详细的接入教程。

GLM-5.3 支持图片和视频输入吗?

不支持。z.ai 官方文档明确 GLM-5.3 目前仅支持文本输入;需要多模态能力可以选 GLM-5V-Turbo,或直接使用支持图片/视频输入的 Ox Alpha。

Ox Alpha 的免费额度有多少?

限免期内不限量免费,上下文窗口 1M token、单次最大输出 128K token,推理档位可选 low / high / max。限免期为上架后一周,之后的政策以 OpenRouter 和模型方公布为准。

评论 (0)

?
0/1

还没有评论,来发第一条吧

网站上的服务均为第三方提供,
请用户注意自行甄别。

北京酷讯互动科技有限公司

备案京ICP备2024094994号-29

© 2026 AI345 · All Rights Reserved

用户服务协议·隐私政策