跳到正文
原文
Google DeepMind·· 2026-06-11精选AI 评分74

Google DeepMind 发布开源实验模型 DiffusionGemma,GPU 文本生成最快提速 4 倍

DiffusionGemma: 4x faster text generation

AI 导读

Google DeepMind 发布开源实验模型 DiffusionGemma,采用 26B 总参数、3.8B 激活的 MoE 扩散架构,在专用 GPU 上文本生成最高提速 4 倍,单块 NVIDIA H100 超过 1000 tokens/s,RTX 5090 超过 700 tokens/s。

推荐理由

官方给出扩散文本生成的速度数据、显存占用与质量取舍,适合评估本地交互场景的落地条件。

来源:Google DeepMind · deepmind.google