Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

reutersreuters+1reuters+1Nvidia utvecklar en ny familj av öppna AI-modeller kallad Nemotron 4, där den största versionen förväntas innehålla minst 1 biljon parametrar, enligt en rapport som publicerades på tisdagen av The Information med hänvisning till anställda som arbetar med projektet.
Chiptillverkaren har inte satt något officiellt lanseringsdatum och har ännu inte slutfört den slutgiltiga träningen, men anställda tror att modellen kan vara klar så tidigt som under senhösten, rapporterar Reuters. Satsningen positionerar Nvidia som ett av få stora amerikanska företag som släpper öppna toppmodeller i en tid då stigande AI-kostnader och konkurrenstryck från billiga kinesiska alternativ omformar branschen.reuters
"Nvidia investerar i Nemotron eftersom vi anser att varje företag och varje land behöver tillgängliga, öppna toppmodeller för att stärka säkerheten, accelerera innovation och tillhandahålla en grund som de kan lita på från en generation till nästa," säger Kari Briski, vice vd för generativ AI, i ett uttalande via e-post.firstpost+1
Draget kommer samtidigt som billigare kinesiska modeller har minskat prestandagapet till ledande system från Anthropic och OpenAI, och en rad nyligen avslöjade hackerattacker involverande autonoma AI-agenter har ökat intresset för öppna modeller som saknar restriktioner för cybersäkerhetsanvändning. Nvidia anslöt sig förra månaden till en koalition fokuserad på AI-säkerhet och undertecknade ett öppet brev tillsammans med Microsoft och andra företag för att försvara öppna modeller och förhindra att innovation flyttar utomlands.reuters+2
Nemotron-koalitionen, som tillkännagavs vid GTC i mars, inkluderar Mistral AI, Black Forest Labs och LangChain som grundande medlemmar som samarbetar kring öppna toppmodeller byggda på Nvidias DGX Cloud-infrastruktur.cryptobriefing
Vid sidan av utvecklingen av Nemotron 4 släppte Nvidia på tisdagen två nya produkter. Nemotron 3.5 Lightning är en "mixture-of-experts"-modell med 30 miljarder parametrar, varav 3 miljarder är aktiva, utformad för kontinuerliga agentuppgifter såsom kodgranskning, verktygsanvändning, övervakning av säkerhetsvarningar och fakturafrågor. Företaget hävdar att den levererar upp till 4x snabbare token-generering än liknande modeller, vilket innebär ungefär 30 % snabbare slutförande av agentuppgifter.seekingalpha+2
Nvidia lanserade även NeMo Switchyard, ett bibliotek med öppen källkod för modell-ruting som automatiskt dirigerar AI-uppgifter till den bäst lämpade tillgängliga modellen, vilket gör att företag kan köra uppsättningar med flera modeller utan att behöva bygga om sina applikationer.firstpost+1