vLLM 官方博客(RSS)· Tencent Hunyuan AI Infra Team and vLLM Team·· 2026-07-06AI 评分60
腾讯混元 HPC-Ops Attention 与 MoE 后端合入 vLLM 主分支
vLLM × HPC-Ops: High-Performance Attention and MoE Backends from Tencent Hunyuan
AI 导读
腾讯混元 AI Infra 团队的 HPC-Ops 算子库中的 Attention 和 MoE 内核已合入 vLLM 主分支,成为一等后端,针对 NVIDIA Hopper 架构优化,在 H20 上效果最好。
来源:vLLM 官方博客(RSS) · vllm.ai