DiffusionGemma:4倍速文本生成模型
DiffusionGemma: 4x faster text generation
Google DeepMind 发布 DiffusionGemma,一款基于扩散架构的实验性轻量模型,在专用 GPU 上推理速度提升高达 4 倍,为速度敏感的交互式本地工作流开辟新可能。
Google DeepMind 发布 DiffusionGemma,这是一款全新的开放实验模型,采用扩散架构实现文本生成。与传统自回归模型不同,DiffusionGemma 通过并行去噪过程生成文本,在专用 GPU 上推理速度提升高达 4 倍。该模型特别适合速度敏感的交互式本地工作流,为开发者提供了在本地运行高效文本生成的新选择。DiffusionGemma 延续了 Gemma 系列的开源传统,研究人员表示其性能在多项基准测试中与同等规模自回归模型相当,但延迟显著降低。
对 AI 行业的影响
DiffusionGemma 标志着文本生成领域从自回归向扩散模型的重要转向。4倍加速意味着本地推理成本大幅降低,边缘设备上的实时文本生成成为可能。对开发者社区而言,这是开源生态中一个值得关注的新方向。
原文参考
来源:Google DeepMind Blog · 2026-06-10