Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

cnbc+1theregister+1cnbc+1Advanced Micro Devices, Inc. a annoncé jeudi avoir conclu un accord définitif pour acquérir Taalas, une startup basée à Toronto qui intègre directement les poids des modèles d'IA dans le silicium pour offrir des vitesses d'inférence bien supérieures à celles des GPU conventionnels. Les conditions financières n'ont pas été divulguées.bloomberg+1
L'accord, annoncé à la clôture des marchés, permet à AMD de concurrencer plus directement Nvidia , qui a investi 20 milliards de dollars dans un accord de licence avec Groq en décembre dernier pour renforcer ses propres capacités d'inférence.cnbc+1
Fondée en 2023 par l'ancien PDG de Tenstorrent, Ljubisa Bajic, et d'anciens ingénieurs d'AMD, Taalas adopte une approche radicalement différente de l'inférence en gravant les poids des modèles directement dans le silicium plutôt que de les stocker en mémoire. Le résultat est essentiellement un circuit intégré dédié à un modèle spécifique.eetimes+1
En février, Taalas a présenté sa première puce de test, la HC1, fabriquée selon le procédé 6nm de Taiwan Semiconductor Manufacturing Company Limited . La puce a fait tourner le modèle Llama 3.1 8B de Meta à 16 960 jetons par seconde, soit 48 fois plus vite que les GPU de Nvidia et 8,5 fois plus vite que les accélérateurs de Cerebras au moment de cette annonce.theregister+1
Le compromis est net : une fois déployée, une puce Taalas ne peut exécuter que le modèle qui y est intégré. Toute modification au-delà d'un adaptateur LoRA nécessite une nouvelle version de la puce, bien que l'entreprise affirme que seules deux couches métalliques doivent être modifiées, un processus qu'elle prévoit de réaliser en environ deux mois.eetimes+1
AMD prévoit d'associer les puces Taalas à ses GPU Instinct et à ses systèmes en rack Helios dans une architecture désagrégée où les GPU gèrent le traitement intensif des requêtes, tandis que les accélérateurs Taalas gèrent la génération de jetons. Cela reflète l'approche de Nvidia avec Groq, où des puces de décodage spécialisées travaillent aux côtés des GPU.investing+2
"La technologie de Taalas et son équipe d'ingénieurs de classe mondiale renforcent notre portefeuille d'IA en offrant des performances et une efficacité d'inférence différenciées", a déclaré Vamsi Boppana, vice-président senior de l'IA chez AMD.investing
La PDG d'AMD, Lisa Su, a déclaré lors d'un lancement de produit en juillet qu'elle "croit fermement qu'il n'existe pas de solution unique en matière de puces", tout en notant que les GPU continueront de représenter la majorité du marché des puces d'IA.cnbc
Cette acquisition poursuit la série d'achats d'AMD visant à construire sa plateforme d'IA, après le rachat de ZT Systems pour 4,9 milliards de dollars et l'acquisition de Silo AI pour 665 millions de dollars en 2024. Taalas a levé 219 millions de dollars en capital-risque depuis sa création.cnbc
Les principaux clients des GPU Instinct d'AMD, notamment OpenAI, Anthropic et Meta, pourraient être les premiers candidats à des déploiements combinant les accélérateurs Taalas et Instinct. L'opération devrait être finalisée au quatrième trimestre, sous réserve de l'approbation des autorités réglementaires.betakit+1