智谱发布 GLM-5.3-Flash 原生多模态模型
事件全貌
AI 综述智谱于2026年8月26日发布并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,总参数量320B、激活参数仅18B,支持1M-token上下文窗口,采用MIT许可证。模型在AA综合智能指数取得57分,与Claude Opus 4.8持平,编程表现亦相当。
该模型此前以Ox Alpha代号在OpenRouter上预览,6天内处理了超过20万亿token,是OpenRouter上有史以来最大的模型。现已接入HuggingFace、API、ZCode、SiliconFlow等平台,完全运行于国产AI芯片集群。
定价方面,GLM-5.3-Flash为GLM-5.3的1/10,限时折扣价为GLM-5.3的1/20,为Claude Opus 4.8的1/40。模型采用稀疏注意力与线性注意力混合架构。
最新报道补充,在Artificial Analysis智能指数上以最大推理强度得57分,仅比GLM-5.3低3分,与GPT-5.6 Terra和Muse Spark 1.2持平。另有报道称该模型线上流量完全运行在10万颗国产芯片上,发布前匿名Ox Alpha模型在OpenRouter和OpenCode上处理了62T token,供应商可能包括华为、海光和摩尔线程。
AI 汇总报道生成 · 19天前更新。单篇报道保留其发布时的原貌。
GLM-5.3-Flash已在SiliconFlow上线,成本降低90%以上。
报道时间线
沿着报道,了解事件的不同侧面。
- GLM-5.3-Flash 开源上线硅基流动
Ox-Alpha🐮 已揭晓。👀 认识来自 @Zai_org 的 GLM-5.3-Flash —— 现已开源,并已在 SiliconFlow 上线。⚡ 一如既往的 Day-0 支持。 总计 320B 参数,仅 18B 激活。原生多模态。MIT 许可。让前沿智能更可及。强于 GLM-5.2。成本降低 90%。编码与智能体任务接近 Opus 4.8。成本降低 >95%。 在 SiliconFlow 上:优化推理、高可用性、生产级规模容量。立即在 SiliconFlow 上构建。🚀
- 智谱开源GLM-5.3-Flash,国产芯片驱动
智谱于8月26日开源GLM-5.3-Flash,这是GLM-5系列首个原生多模态模型。其线上流量完全运行在10万颗国产芯片上。发布前,匿名“Ox Alpha”模型在OpenRouter和OpenCode上处理了62T token——同样使用中国硬件。据报道,供应商可能包括华为、海光和摩尔线程。该模型在Artificial Analysis上得分为57,与Claude Opus 4.8持平,而成本仅为GLM-5.3的十分之一。开放模型、国产算力、全球需求。
- GLM-5.3-Flash 发布:3200 亿参数、百万上下文,成本仅为 GLM-5.3 的约 1/7.5
Z.ai 发布 GLM-5.3-Flash,3200 亿总参数(180 亿激活)、百万 token 上下文窗口,MIT 许可开源。该模型在 Intelligence Index 上得 57 分,接近 GLM-5.3 的 60 分,但每任务成本仅 0.09 美元,约为后者的 7.5 分之一。该模型全程运行于国产 AI 芯片,Z.ai 自研服务软件实现了与 Nvidia GPU 相当的性能。
- GLM-5.3-Flash:前沿智能进入普惠时代
智谱上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,在AA综合智能指数取得57分,与Claude Opus 4.8持平。其定价为GLM-5.3的1/10(限时1/20),为Opus 4.8的1/40,并首次在大规模流量中由国产芯片集群提供算力支持。模型已接入ZCode等平台,同步开放API调用。
- 智谱发布GLM-5.3-Flash,匿名模型OX Alpha正式亮相
智谱正式发布GLM-5.3-Flash,即此前在OpenRouter和OpenCode上爆火的匿名模型OX Alpha。该模型为总参数320B、激活18B的MoE架构,是GLM-5系列首个原生多模态模型,支持图像、视频和文本输入,原生上下文100万。
- Z.ai 发布 GLM-5.3-Flash:320B-A18B 原生多模态 MoE,支持 100 万 token 上下文
Z.ai 发布 GLM-5.3-Flash,这是 GLM-5 系列首款原生多模态模型,320B 总参数、18B 激活参数,支持 100 万 token 上下文和图像/视频输入,权重以 MIT 许可开源在 Hugging Face。
- 智谱发布GLM-5.3-Flash开源多模态模型
ZHIPU AI 🔥:GLM-5.3-Flash(Ox Alpha)已正式发布! > GLM-5.3-Flash 是一款 320B-A18B 多模态模型。 > 采用 MIT 许可证。 > 此前名为 Ox Alpha,是 OpenRouter 上的一个隐身模型。 看来 GLM-5.3-Flash 和 Gemini 3.7 Flash 确实是“好朋友”。
- GLM-5.3 Flash 发布:18B 激活参数效率惊人
GLM-5.3 Flash(Ox Alpha)正式发布,320B MoE 架构、每 token 仅激活 18B 参数,开源且 MIT 许可,原生多模态,支持 1M 上下文。
- GLM-5.3-Flash发布:多模态1M上下文
智谱发布GLM-5.3-Flash,原生多模态并支持1M token上下文窗口,性能对标Opus-4.8。该320B-A18B模型以MIT许可证开源,此前代号Ox Alpha,完全运行于国产AI芯片,现已通过HuggingFace、API等全平台上线。
- GLM-5.3-Flash 开源:320B 总参数、AA 指数 57 分,定价为 Opus 4.8 的 1/40
智谱上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型,AA 综合智能指数 57 分,与 Claude Opus 4.8 持平。其定价为 GLM-5.3 的 1/10,限时折扣内为 Opus 4.8 的 1/40,并已接入 ZCode 等平台开放 API 调用。该模型采用稀疏注意力与线性注意力混合架构,推理服务已跑在国产芯片集群上。
- OpenRouter 揭晓 GLM-5.3-Flash 多模态模型
Ox Alpha 揭晓:@Zai_org 的 GLM-5.3-Flash,GLM-5 系列中首个原生多模态模型。 Ox Alpha 是 OpenRouter 上有史以来最大的模型,6 天内处理了超过 20 万亿 token。 立即继续使用该模型:https://openrouter.ai/z-ai/glm-5.3-flash
- 智谱发布GLM-5.3-Flash,MIT开源320B模型
智谱推出GLM-5.3-Flash,原生多模态,支持1M-token上下文窗口,320B-A18B参数,MIT许可证开源。该模型此前以Ox Alpha代号预览,完全运行于国产AI芯片,现已在HuggingFace、API等全平台上线,主打高性价比。
- 智谱开源 GLM-5.3-Flash 原生多模态模型,限时折扣价为 GLM-5.3 的 1/20
智谱上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型,总参数量 320B、激活参数仅 18B。该模型在 AA 综合智能指数取得 57 分,与 Claude Opus 4.8 持平,编程表现亦相当;定价为 GLM-5.3 的 1/10,限时折扣为 1/20,为 Opus 4.8 的 1/40。模型已接入 ZCode 等平台,并开放 API 调用。