NVIDIA Technical Blog(开发者技术博客 · RSS)· Tanya Lenz·· 17 天前AI 评分33
NVIDIA Transformer Engine 如何加速 JAX 中的 Dropless MoE 训练
Accelerating Dropless MoE Training in JAX with NVIDIA Transformer Engine
AI 导读
NVIDIA 技术博客介绍如何用 NVIDIA Transformer Engine 在 JAX 中加速 Dropless MoE 训练。MoE 通过条件计算实现高效训练,DeepSeek、Qwen、Mixtral 等模型以远低于稠密模型的训练算力达到或超越其性能。文章针对传统 MoE 依赖共享稠密 FFN 的做法,给出 Dropless 训练路径。
来源:NVIDIA Technical Blog(开发者技术博客 · RSS) · developer.nvidia.com