Google DeepMind·· 2026-06-11精选AI 评分74
Google DeepMind 发布开源实验模型 DiffusionGemma,GPU 文本生成最快提速 4 倍
DiffusionGemma: 4x faster text generation
AI 导读
Google DeepMind 发布开源实验模型 DiffusionGemma,采用 26B 总参数、3.8B 激活的 MoE 扩散架构,在专用 GPU 上文本生成最高提速 4 倍,单块 NVIDIA H100 超过 1000 tokens/s,RTX 5090 超过 700 tokens/s。
推荐理由
官方给出扩散文本生成的速度数据、显存占用与质量取舍,适合评估本地交互场景的落地条件。
来源:Google DeepMind · deepmind.google