返回
AI 评分 51/100

IBM Research 展示用 llm-d 在 544 块 NVIDIA H100 上服务 GLM-5.2 智能体负载

IBM Research:AI·2026-09-08 20:00·4天前
AI 导读

IBM Research 联合 Red Hat、Google 的开源项目 llm-d 展示在 544 块 NVIDIA H100 GPU 上部署 753B 参数的开放权重 MoE 模型 GLM-5.2(约 39B 激活),在数百到 3000 个并发编码智能体负载下峰值输出超 6.6M tokens 每分钟,零抢占。

IBM Research:AI
51AI 编辑部评分,满分 100

IBM Research 展示用 llm-d 在 544 块 NVIDIA H100 上服务 GLM-5.2 智能体负载

2026-09-08 20:00· 4天前
AI 导读

IBM Research 联合 Red Hat、Google 的开源项目 llm-d 展示在 544 块 NVIDIA H100 GPU 上部署 753B 参数的开放权重 MoE 模型 GLM-5.2(约 39B 激活),在数百到 3000 个并发编码智能体负载下峰值输出超 6.6M tokens 每分钟,零抢占。

按该来源的展示范围,站内仅提供摘要。

前往原站阅读(在新标签页打开)

来源:IBM Research:AI· research.ibm.com