Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

theregister+1theregistertheregister+1Cerebras Systems a dévoilé le CS-4, son accélérateur d'IA en rack de nouvelle génération, lors de l'événement Supernova de l'entreprise à San Francisco mardi, affirmant que le système offre une inférence jusqu'à 30 fois plus rapide que les solutions basées sur GPU. Cette annonce marque la tentative la plus agressive du fabricant de puces à ce jour pour défier Nvidia sur le marché en pleine croissance de l'inférence IA.
Le CS-4 est construit autour de trois des processeurs WSE-3 Turbo récemment annoncés par Cerebras, des puces de la taille d'une assiette qui doublent la puissance de calcul et la bande passante mémoire de leurs prédécesseurs en poussant le silicium existant plutôt qu'en introduisant une nouvelle conception de puce. Chaque WSE-3T délivre 250 petaFLOPs de calcul IA et 43,2 pétaoctets par seconde de bande passante mémoire, obtenus en doublant approximativement la vitesse d'horloge à environ 2,8 GHz grâce à une meilleure alimentation électrique.theregister
Au total, les trois puces confèrent au CS-4 un total de 750 PFLOPs de calcul IA et 129,6 pétaoctets par seconde de bande passante mémoire. Sur GPT-OSS-120B, Cerebras affirme que le système atteint plus de 4 400 jetons par seconde par utilisateur, contre environ 350 jetons par seconde pour le service d'inférence basé sur GPU le plus rapide, selon la société d'analyse Artificial Analysis.quiverquant+1
"Dans l'IA, la vitesse est synonyme de productivité", a déclaré le PDG Andrew Feldman lors de l'événement. "Le Cerebras CS-4 offre des vitesses de pointe sur les plus grands modèles de frontière, changeant fondamentalement le paradigme."quiverquant
Le CS-4 introduit une architecture modulaire avec 50 % de composants en moins que son prédécesseur, ce qui, selon le directeur technique Sean Lie, accélérera la construction des centres de données. Le système dispose également de connexions puce à puce sans commutateur utilisant une topologie en tore 2D, réduisant la latence d'interconnexion de cinq microsecondes à deux.investing+2
Cerebras a déclaré que les premières livraisons commenceraient plus tard ce trimestre. L'entreprise a également présenté ses plans pour une puce et un serveur de nouvelle génération en 2027, Feldman prévoyant que la société fournira 600 mégawatts de puissance de calcul d'ici la fin de cette année-là et atteindra un débit 20 fois supérieur.investing
Ce lancement intervient alors que Cerebras tente de se tailler une place face à la domination de Nvidia dans le matériel d'IA. The Register a noté que les chiffres de performance du WSE-3T reposent fortement sur la sparsité, qui "en règle générale ne profite pas à l'inférence LLM", et que Cerebras s'associe désormais à AWS Amazon.com, Inc. et AMD Advanced Micro Devices, Inc. pour gérer le traitement de pré-remplissage intensif sur leur matériel. La semaine dernière, Cerebras a déclaré une perte ajustée de 6,9 millions de dollars pour un chiffre d'affaires de 180,1 millions de dollars.theregister+1