# 追踪瓶颈：在 AMD Instinct MI355X 上优化 MiniMax M3

- 来源：vLLM 官方博客（RSS）
- 作者：AMD and Embedded LLM Teams
- 发布时间：2026-09-10 08:00
- AIHOT 分数：46
- AIHOT 链接：https://aihot.news/items/cmtym20dc0002rovu9zgu9lh6
- 原文链接：https://vllm.ai/blog/2026-09-10-minimax-m3-mi355x

## AI 摘要

MiniMax M3 在 AMD Instinct MI355X 上的 vLLM 服务性能经逐层瓶颈优化大幅提升。MXFP8 标准服务在并发 32 下从 109.1 升至 342.4 output tokens/s/GPU（3.14×），MXFP4 在 TP2/EP1 下达到 943.5，为初始结果的 4.45×。

## 正文

按该来源的展示范围，站内仅提供摘要。

> 站内仅提供摘要，全文见原文。
