跳到正文
原文
LMSYS:Blog(Chatbot Arena 团队)·· 13 小时前AI 评分41

AMD Instinct GPU 迎来 Miles 强化学习框架 ROCm 支持

News ROCm Support for Miles: Large-Scale RL Post-Training on AMD Instinct™ GPUs Reinforcement learning (RL) has rapidly become a core stage of modern foundation-model development. While large-scale pretraining remains essential, today's most capable models rely heavily on post-tr... AMD & Miles Team March 17, 2026

AI 导读

Miles 强化学习框架现已支持 AMD Instinct GPU(含 MI300/350 系列),可在 ROCm 上原生运行大规模 RL 后训练。Miles 基于 SGLang 与 Slime 生态,支持 GRPO/PPO、Ray 编排及 Megatron-LM 集成,并提供预构建容器。在单节点 8 卡 MI300X 上,团队用 GRPO 训练了 Qwen3-30B-A3B。

来源:LMSYS:Blog(Chatbot Arena 团队) · lmsys.org