Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

cerebras.ai+1cerebras.ai+1Business Insider+1AMD Advanced Micro Devices, Inc. y Cerebras Systems anunciaron una asociación técnica el martes para construir una plataforma de inferencia de IA desagregada que combina la infraestructura a escala de rack Helios de AMD con la tecnología Wafer-Scale Engine de Cerebras. Las empresas indicaron que se espera que el sistema combinado ofrezca hasta cinco veces más tokens por segundo por vatio en comparación con una configuración exclusiva de Cerebras WSE, según modelos internos realizados en julio de 2026.cerebras.ai+1
La oferta conjunta asigna diferentes porciones de una carga de trabajo de inferencia al hardware más adecuado para cada etapa. AMD Helios se encargará del procesamiento de prefill de alto rendimiento, el paso computacionalmente intensivo de leer la indicación de un usuario, mientras que la tecnología WSE de Cerebras maneja la generación de tokens, donde sus ventajas de ancho de banda de memoria son más pronunciadas.Investing.com+1
Está previsto que la plataforma esté disponible a través de Cerebras Cloud en el segundo semestre de 2026.cerebras.ai+1
El anuncio se realizó durante la presentación principal de la directora ejecutiva de AMD, Lisa Su, en el evento Advancing AI 2026 de la compañía en San Francisco el 23 de julio. Business Insider informó que la asociación refleja la apuesta más amplia de AMD de que la inferencia desagregada, que consiste en dividir las cargas de trabajo de IA en hardware especializado en lugar de ejecutar todo en un solo chip, representa la siguiente fase de la infraestructura de IA.Business Insider+2
Este enfoque ha ganado impulso en toda la industria. AWS y Cerebras anunciaron una colaboración similar en marzo de 2026, combinando los chips Trainium de Amazon para el prefill con el hardware de Cerebras para la decodificación en Amazon Bedrock. Nvidia adquirió Groq para buscar una arquitectura comparable. UBS escribió en junio que las limitaciones de los sistemas actuales "están impulsando un cambio hacia la inferencia desagregada", según Business Insider.youtube+2
El acuerdo con Cerebras se produjo en medio de una ráfaga de anuncios en Advancing AI 2026. AMD presentó su sistema de rack Helios completo, que agrupa 72 aceleradores Instinct MI455X con 31 TB de memoria HBM4 y ofrece aproximadamente tres exaflops de IA por rack. Su afirmó que Helios ofrece hasta un 30% más de tokens de inferencia por dólar que el rack Vera Rubin NVL72 de Nvidia.DCDNoticias+2
AMD también anunció una asociación de infraestructura multimillonaria con Anthropic el día anterior, sumándose a las relaciones existentes con OpenAI, Meta , Microsoft y Oracle .Business Insider
Para Cerebras, el acuerdo con AMD amplía una serie de asociaciones importantes tras su OPI a principios de este año, que recaudó 6.400 millones de dólares en lo que la empresa denominó la OPI de semiconductores más grande de todos los tiempos. Cerebras ya impulsa el modelo GPT-5.4 de OpenAI bajo un acuerdo multimillonario firmado en enero.The New York Times+2