公众号正文需在微信内阅读,站内仅提供摘要。
在微信中打开原文(在新标签页打开)智谱上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s
AI 导读
智谱正式推出 GLM-5.3-FlashX,在 GLM-5.3-Flash 基础上加大对 Infra 侧投入与推理优化,速度最高 200 tokens/s,算力基于 10 万张国产芯片。该模型此前曾以 Ox Alpha 之名面向开发者,官方称其长期保持同尺寸最强智能水平并具备高性价比,API 已上线,Model Key:GLM-5.3-FlashX。
公众号:智谱(GLM)
61
AI 编辑部评分,满分 100智谱上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s
智谱正式推出 GLM-5.3-FlashX,在 GLM-5.3-Flash 基础上加大对 Infra 侧投入与推理优化,速度最高 200 tokens/s,算力基于 10 万张国产芯片。该模型此前曾以 Ox Alpha 之名面向开发者,官方称其长期保持同尺寸最强智能水平并具备高性价比,API 已上线,Model Key:GLM-5.3-FlashX。
来源:公众号:智谱(GLM)· mp.weixin.qq.com