Google DeepMind:Blog(RSS)·· 2026-06-11精选AI 评分76
Google DeepMind 发布开源实验模型 DiffusionGemma,GPU 文本生成最高提速 4 倍
DiffusionGemma: 4x faster text generation
AI 导读
Google DeepMind 发布实验性开源模型 DiffusionGemma,基于文本扩散方法,在专用 GPU 上实现最高 4 倍的文本生成提速。该模型为 26B 总参数的 MoE,推理时仅激活 3.8B 参数,量化后可装入 18GB 显存,单张 NVIDIA H100 上超过 1000 tokens 每秒,RTX 5090 上超过 700 tokens 每秒。
推荐理由
官方给出具体吞吐数字、显存占用和质量取舍,读者可据此判断它适不适合本地交互式工作流。
来源:Google DeepMind:Blog(RSS) · deepmind.google