# 智谱上线 GLM-5.3-FlashX，推理速度最高 200 tokens/s

- 来源：公众号：智谱（GLM）
- 作者：智谱
- 发布时间：2026-09-18 12:37
- AIHOT 分数：61
- AIHOT 链接：https://aihot.news/items/cmu6hckr10onyrofjchvt53ss
- 原文链接：https://mp.weixin.qq.com/s?__biz=MzkyMzI3NzQ0Mg%3D%3D&mid=2247494219&idx=1&sn=f42bab9190e6e13f6db5cf5c90d850a9

## AI 摘要

智谱正式推出 GLM-5.3-FlashX，在 GLM-5.3-Flash 基础上加大对 Infra 侧投入与推理优化，速度最高 200 tokens/s，算力基于 10 万张国产芯片。该模型此前曾以 Ox Alpha 之名面向开发者，官方称其长期保持同尺寸最强智能水平并具备高性价比，API 已上线，Model Key：GLM-5.3-FlashX。

## 正文

公众号正文需在微信内阅读，站内仅提供摘要。

> 站内仅提供摘要，全文见原文。
