热点事件 历史事件

智谱发布 GLM-5.3-Flash 原生多模态模型

13 篇报道13 个精选信源

事件全貌

AI 综述

智谱于2026年8月26日发布并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,总参数量320B、激活参数仅18B,支持1M-token上下文窗口,采用MIT许可证。模型在AA综合智能指数取得57分,与Claude Opus 4.8持平,编程表现亦相当。

该模型此前以Ox Alpha代号在OpenRouter上预览,6天内处理了超过20万亿token,是OpenRouter上有史以来最大的模型。现已接入HuggingFace、API、ZCode、SiliconFlow等平台,完全运行于国产AI芯片集群。

定价方面,GLM-5.3-Flash为GLM-5.3的1/10,限时折扣价为GLM-5.3的1/20,为Claude Opus 4.8的1/40。模型采用稀疏注意力与线性注意力混合架构。

最新报道补充,在Artificial Analysis智能指数上以最大推理强度得57分,仅比GLM-5.3低3分,与GPT-5.6 Terra和Muse Spark 1.2持平。另有报道称该模型线上流量完全运行在10万颗国产芯片上,发布前匿名Ox Alpha模型在OpenRouter和OpenCode上处理了62T token,供应商可能包括华为、海光和摩尔线程。

AI 汇总报道生成 · 19天前更新。单篇报道保留其发布时的原貌。

最新进展

GLM-5.3-Flash已在SiliconFlow上线,成本降低90%以上。

报道时间线

沿着报道,了解事件的不同侧面。

显示 13全部报道最新在前
  1. X:硅基流动 SiliconFlow (@SiliconFlowAI)官方一手
    GLM-5.3-Flash 开源上线硅基流动

    Ox-Alpha🐮 已揭晓。👀 认识来自 @Zai_org 的 GLM-5.3-Flash —— 现已开源,并已在 SiliconFlow 上线。⚡ 一如既往的 Day-0 支持。 总计 320B 参数,仅 18B 激活。原生多模态。MIT 许可。让前沿智能更可及。强于 GLM-5.2。成本降低 90%。编码与智能体任务接近 Opus 4.8。成本降低 >95%。 在 SiliconFlow 上:优化推理、高可用性、生产级规模容量。立即在 SiliconFlow 上构建。🚀

  2. X:X.PIN (@thexpin)
    智谱开源GLM-5.3-Flash,国产芯片驱动

    智谱于8月26日开源GLM-5.3-Flash,这是GLM-5系列首个原生多模态模型。其线上流量完全运行在10万颗国产芯片上。发布前,匿名“Ox Alpha”模型在OpenRouter和OpenCode上处理了62T token——同样使用中国硬件。据报道,供应商可能包括华为、海光和摩尔线程。该模型在Artificial Analysis上得分为57,与Claude Opus 4.8持平,而成本仅为GLM-5.3的十分之一。开放模型、国产算力、全球需求。

  3. The Decoder:AI News
    GLM-5.3-Flash 发布:3200 亿参数、百万上下文,成本仅为 GLM-5.3 的约 1/7.5

    Z.ai 发布 GLM-5.3-Flash,3200 亿总参数(180 亿激活)、百万 token 上下文窗口,MIT 许可开源。该模型在 Intelligence Index 上得 57 分,接近 GLM-5.3 的 60 分,但每任务成本仅 0.09 美元,约为后者的 7.5 分之一。该模型全程运行于国产 AI 芯片,Z.ai 自研服务软件实现了与 Nvidia GPU 相当的性能。

  4. 智谱:研究官方一手精选
    GLM-5.3-Flash:前沿智能进入普惠时代

    智谱上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,在AA综合智能指数取得57分,与Claude Opus 4.8持平。其定价为GLM-5.3的1/10(限时1/20),为Opus 4.8的1/40,并首次在大规模流量中由国产芯片集群提供算力支持。模型已接入ZCode等平台,同步开放API调用。

  5. 公众号:数字生命卡兹克
    智谱发布GLM-5.3-Flash,匿名模型OX Alpha正式亮相

    智谱正式发布GLM-5.3-Flash,即此前在OpenRouter和OpenCode上爆火的匿名模型OX Alpha。该模型为总参数320B、激活18B的MoE架构,是GLM-5系列首个原生多模态模型,支持图像、视频和文本输入,原生上下文100万。

  6. MarkTechPost
    Z.ai 发布 GLM-5.3-Flash:320B-A18B 原生多模态 MoE,支持 100 万 token 上下文

    Z.ai 发布 GLM-5.3-Flash,这是 GLM-5 系列首款原生多模态模型,320B 总参数、18B 激活参数,支持 100 万 token 上下文和图像/视频输入,权重以 MIT 许可开源在 Hugging Face。

  7. X:Testing Catalog (@testingcatalog)
    智谱发布GLM-5.3-Flash开源多模态模型

    ZHIPU AI 🔥:GLM-5.3-Flash(Ox Alpha)已正式发布! > GLM-5.3-Flash 是一款 320B-A18B 多模态模型。 > 采用 MIT 许可证。 > 此前名为 Ox Alpha,是 OpenRouter 上的一个隐身模型。 看来 GLM-5.3-Flash 和 Gemini 3.7 Flash 确实是“好朋友”。

  8. X:Kim (@kimmonismus)
    GLM-5.3 Flash 发布:18B 激活参数效率惊人

    GLM-5.3 Flash(Ox Alpha)正式发布,320B MoE 架构、每 token 仅激活 18B 参数,开源且 MIT 许可,原生多模态,支持 1M 上下文。

  9. X:Elvis Saravia (@omarsar0, DAIR.AI)
    GLM-5.3-Flash发布:多模态1M上下文

    智谱发布GLM-5.3-Flash,原生多模态并支持1M token上下文窗口,性能对标Opus-4.8。该320B-A18B模型以MIT许可证开源,此前代号Ox Alpha,完全运行于国产AI芯片,现已通过HuggingFace、API等全平台上线。

  10. 公众号:智谱(GLM)官方一手精选
    GLM-5.3-Flash 开源:320B 总参数、AA 指数 57 分,定价为 Opus 4.8 的 1/40

    智谱上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型,AA 综合智能指数 57 分,与 Claude Opus 4.8 持平。其定价为 GLM-5.3 的 1/10,限时折扣内为 Opus 4.8 的 1/40,并已接入 ZCode 等平台开放 API 调用。该模型采用稀疏注意力与线性注意力混合架构,推理服务已跑在国产芯片集群上。

  11. X:OpenRouter (@OpenRouter)官方一手
    OpenRouter 揭晓 GLM-5.3-Flash 多模态模型

    Ox Alpha 揭晓:@Zai_org 的 GLM-5.3-Flash,GLM-5 系列中首个原生多模态模型。 Ox Alpha 是 OpenRouter 上有史以来最大的模型,6 天内处理了超过 20 万亿 token。 立即继续使用该模型:https://openrouter.ai/z-ai/glm-5.3-flash

  12. X:智谱 Z.ai (@Zai_org)官方一手
    智谱发布GLM-5.3-Flash,MIT开源320B模型

    智谱推出GLM-5.3-Flash,原生多模态,支持1M-token上下文窗口,320B-A18B参数,MIT许可证开源。该模型此前以Ox Alpha代号预览,完全运行于国产AI芯片,现已在HuggingFace、API等全平台上线,主打高性价比。

  13. IT之家
    智谱开源 GLM-5.3-Flash 原生多模态模型,限时折扣价为 GLM-5.3 的 1/20

    智谱上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型,总参数量 320B、激活参数仅 18B。该模型在 AA 综合智能指数取得 57 分,与 Claude Opus 4.8 持平,编程表现亦相当;定价为 GLM-5.3 的 1/10,限时折扣为 1/20,为 Opus 4.8 的 1/40。模型已接入 ZCode 等平台,并开放 API 调用。