Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

cnbc+1nvidianews.nvidia+1cnbcNvidia anunció el lunes que su acelerador de inferencia de IA dedicado, Groq 3 LPX, ha entrado en plena producción, marcando la comercialización de la tecnología proveniente de la mayor adquisición en la historia de la compañía. El chip, diseñado para ofrecer una generación ultrarrápida de tokens para cargas de trabajo de IA agente, será implementado en el proveedor de nube neocloud Nebius a finales de este año.
El anuncio, realizado en la conferencia Hot Chips 2026 en Palo Alto, California, llega mientras Nvidia se prepara para presentar sus resultados financieros el miércoles.cnbc
En pruebas realizadas por Artificial Analysis, el rack Groq 3 LPX alcanzó 3.400 tokens de salida por segundo ejecutando el modelo de código abierto Gemma 4 31B de Google con una ventana de contexto de 100.000 tokens, el rendimiento más rápido jamás registrado para este modelo. Nvidia afirma que esto lo hace cuatro veces más receptivo para cargas de trabajo sensibles a la latencia que la alternativa más cercana.nvidianews.nvidia+1
El rack integra 256 chips Groq 3 individuales, cada uno con 500 megabytes de SRAM en el chip para reducir los cuellos de botella de memoria. Los chips son fabricados por Samsung, mientras que Taiwan Semiconductor Manufacturing produce las GPU de Nvidia.cnbc
"No se trata de reemplazar las GPU", dijo a los periodistas Dion Harris, director senior de Nvidia. "Se trata de usar el precio correcto y el procesador adecuado para la parte correcta de la carga de trabajo".cnbc
Nvidia adquirió los activos de la startup Groq en diciembre por 20.000 millones de dólares, contratando al fundador Jonathan Ross y al presidente Sunny Madra como parte del acuerdo. La arquitectura Groq se centra exclusivamente en la inferencia en lugar del entrenamiento, apuntando a la fase de "decodificación" del servicio de modelos de IA donde la latencia es crítica.siliconangle
El panorama competitivo se está intensificando. Advanced Micro Devices anunció a principios de este año que integraría sistemas a escala de rack con chips de Cerebras para inferencia de baja latencia, mientras que el modo Ultrafast de OpenAI promete 750 tokens por segundo impulsados por Cerebras.cnbc
Junto con el lanzamiento de Groq 3 LPX, Nvidia reveló que SpaceXAI ha firmado para implementar las CPU Nvidia Vera, que la compañía denomina la primera CPU construida específicamente para agentes de IA, con el fin de acelerar la orquestación, la ejecución de herramientas y las tareas de simulación que abarcan desde centros de datos terrestres hasta satélites orbitales.blogs.nvidia+1
"Vera Rubin extiende esa visión con configuraciones de fábrica de IA optimizadas para cargas de trabajo diseñadas para la era de la IA agente", dijo el CEO Jensen Huang.nvidianews.nvidia
El CTO de Nebius, Danila Shtan, dijo que la compañía planea integrar Groq 3 LPX en su plataforma de inferencia Token Factory. "Nos aseguramos de que cada paso del bucle de un agente se sienta instantáneo", dijo Shtan. La nube centrada en inferencia Groq planea seguir como uno de los primeros adoptantes de la plataforma.nvidianews.nvidia