跳到正文
原文
vLLM 官方博客(RSS)· AMD and Embedded LLM Teams·· 21 天前AI 评分40

追踪瓶颈:在 AMD Instinct MI355X 上优化 MiniMax M3

Following the Bottleneck: Optimizing MiniMax M3 on AMD Instinct MI355X

AI 导读

MiniMax M3 在 AMD Instinct MI355X 上的 vLLM 服务性能大幅提升:SemiAnalysis InferenceX 基准显示,并发 32 时 MXFP8 标准服务从 109.1 升至 342.4 output tokens/s/GPU(3.14×),中位 TTFT 从 1.46 秒降至 0.67 秒。

来源:vLLM 官方博客(RSS) · vllm.ai