LMSYS:Blog(Chatbot Arena 团队)·· 13 小时前AI 评分41
AMD Instinct GPU 迎来 Miles 强化学习框架 ROCm 支持
News ROCm Support for Miles: Large-Scale RL Post-Training on AMD Instinct™ GPUs Reinforcement learning (RL) has rapidly become a core stage of modern foundation-model development. While large-scale pretraining remains essential, today's most capable models rely heavily on post-tr... AMD & Miles Team March 17, 2026
AI 导读
Miles 强化学习框架现已支持 AMD Instinct GPU(含 MI300/350 系列),可在 ROCm 上原生运行大规模 RL 后训练。Miles 基于 SGLang 与 Slime 生态,支持 GRPO/PPO、Ray 编排及 Megatron-LM 集成,并提供预构建容器。在单节点 8 卡 MI300X 上,团队用 GRPO 训练了 Qwen3-30B-A3B。
来源:LMSYS:Blog(Chatbot Arena 团队) · lmsys.org