Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

cnbc+1blogs.nvidiacnbcNvidia a lancé mardi Nemotron 3.5 Lightning, un modèle d'IA gratuit et open source conçu pour les entreprises et capable de fonctionner sur un seul GPU, ainsi qu'un nouvel outil d'aiguillage de modèles appelé NeMo Switchyard, destiné à réduire les coûts des charges de travail d'IA.
Ce lancement marque le premier modèle open source de Nvidia depuis que son PDG, Jensen Huang, a publié une lettre ouverte sur X fin juillet pour défendre les modèles d'IA ouverts et exhorter le gouvernement américain à éviter des restrictions qui pourraient pousser l'innovation à l'étranger.cnbc
Nemotron 3.5 Lightning est un modèle de mélange d'experts de 30 milliards de paramètres conçu pour des tâches spécialisées à grand volume au sein de systèmes multi-agents plus vastes. Nvidia a indiqué que le modèle offre une vitesse d'exécution jusqu'à quatre fois plus rapide et une exécution des tâches agentiques 30 % plus rapide que les autres modèles de sa catégorie.blogs.nvidia+1
Le modèle est entièrement personnalisable et peut être entraîné sur les données propres d'une entreprise. Kari Briski, vice-présidente des logiciels d'IA générative chez Nvidia, a déclaré au Wall Street Journal News Corp que le modèle est « remarquablement facile à personnaliser ». Elle a cité l'exemple de CodeRabbit : l'entreprise a utilisé la méthode d'entraînement standard de Nvidia et a créé un agent d'aiguillage pour 85 dollars en environ deux heures. Des entreprises comme CrowdStrike et Harvey ont également testé et personnalisé le modèle.siliconangle+1
Pour Nvidia, l'IA open source répond à un intérêt commercial évident. « L'IA gratuite devrait être une excellente chose pour le matériel », a déclaré Huang à Axios le mois dernier. « L'IA gratuite devrait être une excellente chose pour les puces ».cnbc
Parallèlement à Lightning, Nvidia a lancé NeMo Switchyard, une bibliothèque d'aiguillage de modèles open source qui dirige automatiquement chaque requête d'agent d'IA vers le modèle le plus adapté en fonction de la qualité, de la latence et du coût. Des tests internes ont montré que Switchyard maintenait une précision de pointe tout en réduisant le coût d'exécution des tâches à près d'un tiers par rapport à l'utilisation d'un seul modèle de pointe.blogs.nvidia
Les partenaires ont fait part de premiers résultats prometteurs : Ramp a égalé les performances des modèles de pointe tout en réduisant les coûts de 58 % et le temps d'exécution de 33 %, tandis que LangChain a obtenu une baisse de coût de 74 % en n'orientant que 7 % des requêtes vers un modèle de pointe.developer.nvidia+1
Ce lancement intervient un jour après que le PDG de Meta Platforms , Mark Zuckerberg, a publié un manifeste plaidant pour l'IA open source, alors que Meta lançait un nouveau modèle de codage. L'initiative de Nvidia fait également suite à l'intervention de Huang dans un débat politique suscité par le modèle chinois Kimi K3, qui a suscité des inquiétudes à Washington concernant le vol de propriété intellectuelle par le biais de techniques de distillation.cnbc
Nemotron 3.5 Lightning est disponible sur Hugging Face, ModelScope, OpenRouter et les propres plateformes de Nvidia. Nvidia développe également déjà un modèle Nemotron 4 de nouvelle génération, selon The Information.tradingview+1