# 智谱 GLM-5.3-FlashX 模型上线，最高 200 tokens/s

- 来源：IT之家（RSS）
- 发布时间：2026-09-18 12:45
- AIHOT 分数：40
- AIHOT 链接：https://aihot.news/items/cmu6ikvfu04rsro0f98fm9p6a
- 原文链接：https://www.ithome.com/1/004/061.htm

## AI 摘要

智谱推出 GLM-5.3-FlashX，最高 200 tokens/s，API 已上线，Model Key 为 GLM-5.3-FlashX。该模型上下文 1M，输入单价 2 元、输出 7 元每百万 Tokens，缓存命中 0.57 元，支持图片、视频、文件和文本输入，价格高于 GLM-5.3-Flash。

## 正文

IT之家 9 月 18 日消息，智谱今日宣布推出 GLM-5.3-FlashX（最高 200 tokens/s），为企业与开发者带来更快、更流畅的模型体验。

智谱官方表示，GLM-5.3-Flash 此前以“Ox Alpha”之名与全球开发者见面，获得海内外开发者的广泛认可，调用量持续攀升。面对快速增长的需求，智谱在 10 万张国产芯片提供的推理算力基础上，进一步加大对 Infra 侧的投入与推理优化。GLM-5.3-Flash 长期保持同尺寸最强智能水平，本次提速进一步形成智能、价格、速度的全面竞争力。

GLM-5.3-FlashX API 现已上线，Model Key：GLM-5.3-FlashX。

价格方面，GLM-5.3-FlashX 相比 GLM-5.3-Flash 更贵一些：

模型名称上下文输入单价（元 / 百万 Tokens）输出单价（元 / 百万 Tokens）缓存存储（元 / 百万 Tokens / 小时）缓存命中（元 / 百万 Tokens）输入模态

GLM-5.31M828限时免费2文本

GLM-5.3-Flash1M0.82.8限时免费0.23图片、视频、文件、文本

GLM-5.3-FlashX1M27限时免费0.57图片、视频、文件、文本

IT之家附 API 调用方法：

https://docs.bigmodel.cn/api-reference/模型-api/对话补全
