Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

quiverquant+1quiverquantquiverquant+1Cerebras Systems a annoncé jeudi qu'il alimentait un nouveau niveau de service "Ultrarapide" dans l'API OpenAI pour GPT-5.6 Sol, offrant jusqu'à 750 jetons de sortie par seconde, soit jusqu'à 14 fois plus vite que le traitement standard sans perte d'intelligence du modèle.quiverquant+1
Ce lancement, confirmé simultanément par OpenAI et Cerebras, marque un renforcement du partenariat entre les deux sociétés et représente une nouvelle frontière dans le compromis entre la capacité du modèle et la vitesse d'inférence.
Disponible initialement en préversion limitée pour un groupe restreint de clients OpenAI, le mode Ultrarapide exécute GPT-5.6 Sol à des vitesses que Cerebras revendique comme étant 5 fois plus rapides que Claude Opus 4.8 en mode rapide et 11 fois plus rapides que Claude Fable 5, selon les vitesses de sortie rapportées par Artificial Analysis.investing+1
"GPT-5.6 Sol en mode Ultrarapide est la preuve que la vitesse et l'intelligence ne sont plus mutuellement exclusives", a déclaré Andrew Feldman, PDG et cofondateur de Cerebras.quiverquant
Sachin Katti, vice-président de la stratégie de calcul et de l'infrastructure GPT chez OpenAI, a déclaré que les entreprises "explorent ce qui devient possible lorsque les clients peuvent obtenir l'intelligence de nos modèles les plus performants avec une latence nettement inférieure", ajoutant qu'OpenAI prévoit de commencer avec un petit groupe de clients avant d'étendre le service.openai+1
Dans le cadre de Humanity's Last Exam, un test de référence de 2 500 questions couvrant des sujets de niveau universitaire, GPT-5.6 Sol Ultrarapide a répondu à l'ensemble des questions en 11 heures et 11 minutes, contre plus de trois jours pour Claude Fable 5, atteignant une précision comparable près de sept fois plus rapidement. Sur GDP-Val, un test de référence portant sur des tâches de travail intellectuel à valeur économique, le mode Ultrarapide a permis une accélération globale de 5,6 fois sans dégradation de la qualité.cerebras+1
L'avantage en termes de vitesse provient de l'architecture Wafer-Scale Engine de Cerebras, qui conserve les poids du modèle sur la puce avec 44 Go de SRAM sur chaque puce de la taille d'une tranche, éliminant le goulot d'étranglement de la bande passante mémoire qui limite l'inférence basée sur les GPU.cerebras
L'annonce intervient alors que les actions de Cerebras ont fortement chuté jeudi, malgré le relèvement des prévisions de l'entreprise concernant la demande en IA suite à une forte croissance au deuxième trimestre. Plusieurs analystes ont relevé leurs objectifs de cours sur l'action, UBS maintenant une recommandation d'achat et Morgan Stanley maintenant une recommandation de surpondération.marketscreener