# 摩尔线程Day-0支持智谱GLM-5.3-Flash极速适配

- 来源：IT之家（RSS）
- 发布时间：2026-08-27 18:26
- AIHOT 分数：39
- AIHOT 链接：https://aihot.news/items/cmtbfs3sl0v1troampg71it1y
- 原文链接：https://www.ithome.com/0/995/237.htm

## AI 摘要

摩尔线程宣布基于MTT S5000智算卡及MUSA软件栈，Day-0支持智谱开源模型GLM-5.3-Flash (320B-A18B)。该模型为GLM-5系列首个原生多模态模型，在AA综合智能指数中取得57分，与Claude Opus 4.8持平。摩尔线程针对其KDA机制完成算子定制与深度调优，释放长上下文推理效率优势。

## 正文

IT之家 8 月 27 日消息，智谱近日上线并开源 GLM-5.3-Flash (320B-A18B)。摩尔线程官方今日宣布，基于 AI 训推一体智算卡 MTT S5000 及 MUSA 软件栈，Day-0 支持，实现了对该模型的极速适配与高效运行。

据介绍，作为 GLM-5 系列的首个原生多模态模型，GLM-5.3-Flash 总参数为 320B，激活参数仅 18B，在全球权威的 Artificial Analysis Intelligence Index（AA 综合智能指数）中取得 57 分，进入全球前沿模型能力区间，与 Anthropic 最受欢迎的模型 Claude Opus 4.8 得分持平。在自研 Z.ai Code Bench 体感评估中，其编程表现与 Claude Opus 4.8 相当。

此前，该模型以代号 Ox-Alpha（社区昵称“牛来”）在 OpenCode 和 OpenRouter 进行匿名公测，凭借出色的推理速度与智能表现，迅速成为当周最受欢迎的模型，创下双平台调用量新高。

GLM-5.3-Flash 发布当日，摩尔线程工程团队完成模型架构拆解、核心技术分析与典型算子梳理。针对其混合架构中线性注意力采用的 KDA 机制，团队基于 MATE 算子优化引擎，快速完成了状态矩阵更新、分块并行扫描等全新算子形态的定制实现与深度调优，并与 SGLang-MUSA 缓存管理体系深度协同、无缝打通，释放了 KDA 在长上下文推理中的效率优势。

IT之家附 GLM-5.3-Flash 开源地址：
