Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

reuterstechcrunchreuters+1Google travaille sur une nouvelle puce serveur qui intégrerait des éléments de son modèle d'intelligence artificielle Gemini directement dans le matériel, une démarche visant à améliorer considérablement l'efficacité du service d'IA pour des centaines de millions d'utilisateurs, a rapporté lundi The Information.
La puce, surnommée informellement "Frozen v2", pourrait être six à dix fois plus efficace que les dernières puces IA personnalisées de Google, en termes de nombre de jetons IA servis par unité d'énergie, selon des personnes proches du dossier citées par le média. Les actions d'Alphabet ont progressé à la suite de cette annonce.finance.yahoo+1
Le projet Frozen v2 est une réponse directe à une pénurie de capacité de calcul IA qui a mis Google sous pression en interne et contraint Google Cloud à refuser des affaires venant de clients externes. Lors de la conférence sur les résultats du premier trimestre 2026 d'Alphabet en avril, les dirigeants ont reconnu que la croissance du cloud était "limitée par la capacité", alors même que les revenus trimestriels ont dépassé les 20 milliards de dollars pour la première fois, soit une augmentation de 63 % sur un an, largement portée par la demande en IA.economictimes.indiatimes+3
Cette crise a entraîné des dépenses d'infrastructure agressives. Alphabet a engagé 75 milliards de dollars en dépenses d'investissement pour 2025 et a conclu un accord d'une valeur allant jusqu'à 30 milliards de dollars avec SpaceX pour louer environ 110 000 GPU Nvidia jusqu'à la mi-2029, selon le New York Times.w+1
Le projet Frozen représente une gamme distincte de puces maison, différente des unités de traitement tensoriel (TPU) de Google, qui restent centrales pour l'infrastructure IA de l'entreprise. Google a dévoilé ses TPU de huitième génération, la TPU 8t pour l'entraînement et la TPU 8i pour l'inférence, lors de sa conférence Cloud Next en avril, vantant une vitesse d'entraînement jusqu'à trois fois supérieure et une performance par dollar améliorée de 80 %.axios+2
Les ingénieurs finalisent encore la conception de Frozen v2 et déterminent quelle part du modèle Gemini peut être intégrée dans la puce, avec un déploiement visé dès 2028. En intégrant les paramètres du modèle dans le silicium plutôt que de les charger depuis la mémoire à chaque fois, cette approche pourrait réduire considérablement les coûts d'énergie et de latence de l'inférence, le processus qui se produit chaque fois qu'un utilisateur soumet une requête.reuters+1
Cet effort intervient alors que les principaux fournisseurs de cloud rivalisent pour réduire leur dépendance aux GPU de Nvidia. Les expéditions de serveurs IA basés sur des ASIC personnalisés devraient représenter près de 28 % de toutes les expéditions de serveurs IA en 2026, avec une croissance annuelle d'environ 45 %, soit près du triple du taux des GPU standard, selon TrendForce. Meta Platforms a révélé ce mois-ci son intention de commencer à fabriquer sa propre puce IA à partir de septembre, dans le but de doubler sa capacité de calcul pour atteindre 14 gigawatts en 2027.tomshardware+2
La question de savoir si Google peut verrouiller suffisamment l'architecture de Gemini dans le matériel sans sacrifier la flexibilité nécessaire pour mettre à jour ses modèles en évolution rapide reste ouverte, et déterminera si le projet Frozen tient ses promesses d'efficacité ou s'il devient un détour coûteux.