Google releases DiffusionGemma, an open AI model that generates text in parallel

14 sources
  • Google DeepMind released DiffusionGemma, an open-source model under Apache 2.0 that uses diffusion-based decoding to generate text blocks simultaneously.
  • The 26B Mixture of Experts model activates only 3.8B parameters during inference, fitting within 18GB VRAM on consumer GPUs when quantized.
  • Google says the model trails Gemma 4 on benchmark quality, targeting researchers exploring speed-critical tasks like code infilling and in-line editing.
Sources (14)
  1. 1 Google debuts DiffusionGemma for faster text generation letsdatascience.com
  2. 2 DiffusionGemma: 4x faster text generation blog.google
  3. 3 DiffusionGemma model overview | Google AI for Developers ai.google.dev
  4. 4 Google's latest DiffusionGemma open AI model comes with a 4x speed boost arstechnica.com
  5. 5 Alert: Google DeepMind Gemma 4 12B Breaks Multimodal AI 2026 news.sunbposolutions.com
  6. 6 Gemini Diffusion: Google DeepMind's experimental research model blog.google
  7. 7 Google launches DiffusionGemma with 4x faster text generation www.investing.com
  8. 8 NVIDIA Powers Google DeepMind's DiffusionGemma for High-Speed AI blockchain.news
  9. 9 Session Details: Google Cloud Summit 2026 London www.googlecloudevents.com
  10. 10 Google's Gemma Optimized to Run on NVIDIA GPUs blogs.nvidia.com
  11. 11 Accelerating Diffusion LLMs via Adaptive Parallel Decoding openreview.net
  12. 12 Gemini Diffusion deepmind.google
  13. 13 history changes. An NVIDIA H100 GPU—100 times more ... www.facebook.com
  14. 14 Accelerating Diffusion LLMs via Adaptive Parallel Decoding neurips.cc

Leave a Reply