inferencia

Cerebras lanza modo ultrarrápido para GPT-5.6 Sol de OpenAI

Cerebras Systems anunció el jueves que está impulsando un nuevo nivel de servicio "Ultrarrápido" en la API de OpenAI para GPT-5.6 Sol, ofreciendo hasta 750 tokens de salida por segundo, hasta 14 veces más rápido que el procesamiento estándar sin…

AMD comprará startup que integra modelos de IA directamente en sus chips

Advanced Micro Devices, Inc. anunció el jueves que ha llegado a un acuerdo definitivo para adquirir Taalas, una startup con sede en Toronto que integra los pesos de los modelos de IA directamente en el silicio para ofrecer velocidades de…

OpenAI encuentra una optimización que reduce a la mitad los costes de inferencia

Los ingenieros de OpenAI desarrollaron a principios de este mes una optimización que reduce los costes de inferencia en más de la mitad para los modelos a los que se ha aplicado, según un informe de The Information. El avance,…