Google lanza DiffusionGemma, un modelo de IA abierto que genera texto en paralelo

14 fuentes
  • Google DeepMind lanzó DiffusionGemma, un modelo de código abierto bajo licencia Apache 2.0 que utiliza decodificación basada en difusión para generar bloques de texto simultáneamente.
  • El modelo de mezcla de expertos de 26B activa solo 3.8B de parámetros durante la inferencia, ajustándose a 18GB de VRAM en GPUs de consumo cuando se cuantiza.
  • Google afirma que el modelo está por detrás de Gemma 4 en calidad de referencia, dirigido a investigadores que exploran tareas críticas de velocidad como el relleno de código y la edición en línea.
Fuentes (14)
  1. 1 Google debuts DiffusionGemma for faster text generation letsdatascience.com
  2. 2 DiffusionGemma: 4x faster text generation blog.google
  3. 3 DiffusionGemma model overview | Google AI for Developers ai.google.dev
  4. 4 Google's latest DiffusionGemma open AI model comes with a 4x speed boost arstechnica.com
  5. 5 Alert: Google DeepMind Gemma 4 12B Breaks Multimodal AI 2026 news.sunbposolutions.com
  6. 6 Gemini Diffusion: Google DeepMind's experimental research model blog.google
  7. 7 Google launches DiffusionGemma with 4x faster text generation www.investing.com
  8. 8 NVIDIA Powers Google DeepMind's DiffusionGemma for High-Speed AI blockchain.news
  9. 9 Session Details: Google Cloud Summit 2026 London www.googlecloudevents.com
  10. 10 Google's Gemma Optimized to Run on NVIDIA GPUs blogs.nvidia.com
  11. 11 Accelerating Diffusion LLMs via Adaptive Parallel Decoding openreview.net
  12. 12 Gemini Diffusion deepmind.google
  13. 13 history changes. An NVIDIA H100 GPU—100 times more ... www.facebook.com
  14. 14 Accelerating Diffusion LLMs via Adaptive Parallel Decoding neurips.cc

Deja un comentario