Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

quiverquant+1quiverquantquiverquant+1Cerebras Systems anunció el jueves que está impulsando un nuevo nivel de servicio "Ultrarrápido" en la API de OpenAI para GPT-5.6 Sol, ofreciendo hasta 750 tokens de salida por segundo, hasta 14 veces más rápido que el procesamiento estándar sin pérdida de inteligencia en el modelo.quiverquant+1
El lanzamiento, confirmado simultáneamente por OpenAI y Cerebras, marca una profundización en la asociación entre ambas compañías y representa una nueva frontera en el equilibrio entre la capacidad del modelo y la velocidad de inferencia.
Disponible inicialmente en vista previa limitada para un grupo selecto de clientes de OpenAI, el modo Ultrarrápido ejecuta GPT-5.6 Sol a velocidades que, según Cerebras, son 5 veces más rápidas que Claude Opus 4.8 en modo rápido y 11 veces más rápidas que Claude Fable 5, basándose en las velocidades de salida reportadas por Artificial Analysis.investing+1
"GPT-5.6 Sol en modo Ultrarrápido es la prueba de que la velocidad y la inteligencia ya no son mutuamente excluyentes", afirmó Andrew Feldman, CEO y cofundador de Cerebras.quiverquant
Sachin Katti, vicepresidente de Estrategia de Cómputo e Infraestructura GPT en OpenAI, señaló que las empresas están "explorando lo que es posible cuando los clientes pueden obtener la inteligencia de nuestros modelos más capaces con una latencia significativamente menor", añadiendo que OpenAI planea comenzar con un pequeño grupo de clientes antes de expandir el servicio.openai+1
En Humanity's Last Exam, un benchmark de 2,500 preguntas que abarca temas de nivel de posgrado, GPT-5.6 Sol Ultrarrápido respondió al conjunto completo de preguntas en 11 horas y 11 minutos, en comparación con más de tres días para Claude Fable 5, logrando una precisión comparable casi siete veces más rápido. En GDP-Val, un benchmark de tareas de trabajo intelectual económicamente valiosas, el modo Ultrarrápido ofreció una aceleración de extremo a extremo de 5.6 veces sin degradación de la calidad.cerebras+1
La ventaja de velocidad proviene de la arquitectura Wafer-Scale Engine de Cerebras, que mantiene los pesos del modelo en el chip con 44 GB de SRAM en cada chip del tamaño de una oblea, eliminando el cuello de botella del ancho de banda de memoria que limita la inferencia basada en GPU.cerebras
El anuncio se produce mientras las acciones de Cerebras cayeron bruscamente el jueves a pesar de que la compañía elevó sus pronósticos sobre la demanda de IA tras un fuerte crecimiento en el segundo trimestre. Múltiples analistas elevaron sus objetivos de precio para la acción, con UBS manteniendo una calificación de Compra y Morgan Stanley manteniendo una calificación de Sobreponderar.marketscreener