返回 AI Bar

GLM-5.3-FlashX 上线:320B 总参数/18B 激活,生成速度最高 200 Token/s

AI圈刚刚 · 2026-09-22T12:40:11

速度优化版原生多模态大模型 GLM-5.3-FlashX 正式上线。模型采用 320B 总参数、18B 激活参数的稀疏架构,生成速度最高可达 200 Token/s。 这次配备了 1M Token 上下文,支持原生视频与文件理解,以及交错工具调用推理,主要面向高频交互式编程和 Agent 工作流,API 与 Web Chat 双端同步开放体验。

AI 论坛精选