Together AI 研究与产品博客(RSS)·· 2026-06-23AI 评分50
Together AI 发布 ParallelKernelBench:前沿模型尚难写出快速多GPU kernel
ParallelKernelBench: Frontier LLMs can't write fast multi-GPU kernels (yet)
AI 导读
Together AI 发布多GPU kernel生成基准 ParallelKernelBench(PKB),含87道源自 Megatron-LM、DeepSpeed、TensorRT-LLM 等真实代码库的问题,任务是将 PyTorch + NCCL 参考实现替换为直接通过 NVLink 通信的 CUDA kernel。
来源:Together AI 研究与产品博客(RSS) · together.ai