Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

infoq+1tech.yahoo+1axiosMeta on julkaissut Muse Glimmerin, 30 miljardin parametrin avoimen painoarvon tekoälymallin, joka voi toimia täysin offline-tilassa kuluttajalaitteistolla. Tämä on merkittävä askel yhtiön pyrkimyksessä tehdä suorituskykyisestä tekoälystä saavutettavaa ilman pilvitilauksia tai internetyhteyttä.
Apache 2.0 -lisenssillä julkaistu Muse Glimmer on saatavilla Hugging Facessa, josta kuka tahansa voi ladata, muokata ja ottaa sen vapaasti käyttöön. Malli hyväksyy sekä teksti- että kuvasyötteitä, tukee yli 100 kieltä ja käsittelee yli 131 000 tokenin konteksti-ikkunoita.infoq+1
Täydellä tarkkuudella malli vaatisi noin 64 gigatavua videomuistia, mikä ylittää tyypillisen kuluttajalaitteiston kapasiteetin. Meta ratkaisee tämän 4-bittisellä dynaamisella kvantisoinnilla, joka pakkaa mallin kahteen versioon: 32 gigatavun versioon, joka menettää vain 0,2 % tarkkuudestaan, ja 17 gigatavun versioon, joka mahtuu 24 gigatavun VRAM-muistiin noin 1 % tarkkuuden heikennyksellä. Yhteensopivaa laitteistoa ovat muun muassa Nvidian RTX 5090, RTX 4090, RTX 3090 tai Applen Silicon Max -sirut.tech.yahoo+1
DFlash-niminen spekulatiivinen dekoodausjärjestelmä yhdistää kevyen "luonnostelija"-mallin pääverkkoon, ehdottaen useita tokeneita kerralla rinnakkaista validointia varten. RTX 5090 -näytönohjaimella tämä nostaa generointinopeuden 74,9 tokenista sekunnissa 233,4 tokeniin, mikä on noin 3,1-kertainen suorituskyvyn kasvu.infoq+1
Muse Glimmer on rakennettu autonomiseen, monivaiheiseen tehtävien suorittamiseen. Kun API-kutsu tai terminaalikomento epäonnistuu, malli diagnosoi virheen ja kokeilee vaihtoehtoisia lähestymistapoja pysähtymisen sijaan. Erillinen 1,8 miljardin parametrin havainnointikooderi käsittelee kuvakaappauksia, kaavioita ja dokumentaatiota työnkulkujen aikana.infoq
Standardoiduissa vertailuarvoissa, kuten SWE-Bench, DeepSearch QA ja MCP-Atlas, Muse Glimmer johtaa vertailumalleja, kuten Googlen Gemma 4 31B:tä ja Alibaban Qwen 3.6 27B:tä, suunnittelussa ja monivaiheisten työkalujen luotettavuudessa, vaikka se jääkin jälkeen työpöytätoiminnoissa. Malli on tislattu Metan suuremmasta Muse Sparkista monivaiheisella prosessilla, joka yhdistää logit-tislausta, pitkän kontekstin jatkokoulutusta ja vahvistusoppimisen kohdistamista.tech.yahoo+1
Julkaisu on osa toimitusjohtaja Mark Zuckerbergin laajempaa strategista panostusta. Hän julkaisi tällä viikolla pitkän manifestin, jossa hän kuvaili pyrkimystä "superälyksi kaikille". Axios raportoi, että Metan avoimen painoarvon mallit on suunniteltu "puristamaan eturintamaa alhaalta päin", tarjoten kilpailukykyistä suorituskykyä huomattavasti edullisemmin kuin suljetut vaihtoehdot.axios
Käänne seuraa Metan pettymykseksi jäänyttä Llama 4 -julkaisua ja sitä seurannutta uudelleenjärjestelyä, johon kuului 14,3 miljardin dollarin investointi Scale AI -yhtiöön. Silti eräs Metan työntekijä kertoi Axiosille, että yhtiö "tuntee olevansa yhä jäljessä alan huippulaboratorioita mallien suorituskyvyssä ja kehityksessä".axios
Muse Glimmer on nyt saatavilla Hugging Facen, Ollaman, LM Studion ja muiden paikallisten päättelykehysten kautta.tech.yahoo+1