Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

siliconrepublic+1kucoinkucoinThinking Machines Lab julkaisi torstaina Inkling-Smallin, avoimen painotuksen multimodaalisen mallin, joka vastaa tai ylittää edeltäjänsä Inklingin suorituskyvyn käyttäen vain noin neljäsosaa parametreista. Tämä muutos laskee merkittävästi huippuluokan tekoälyjärjestelmän ajamiseen tarvittavia laskentaresursseja.
Inkling-Small käyttää Mixture-of-Experts-arkkitehtuuria, jossa on yhteensä 276 miljardia parametria ja 12 miljardia aktivoitua parametria päättelyä kohden, verrattuna Inklingin 975 miljardiin kokonaisparametriin ja 41 miljardiin aktiiviseen parametriin. Malli hyväksyy teksti-, kuva- ja äänisyötteitä ja tukee jopa miljoonan tokenin konteksti-ikkunaa.siliconrepublic+1
Thinking Machinesin mukaan malli vastaa tai ylittää Inklingin päättely- ja koodaustehtävissä. Humanity's Last Exam -testissä Inkling-Small sai yli 31 prosentin tuloksen Inklingin 29,7 prosentin sijaan, ja SWE-Bench Verified -testissä se ylitti 80 prosentin rajan. Artificial Analysis antoi sille 40 pistettä älykkyysindeksissään, vain yhden pisteen vähemmän kuin Inklingin 41 pistettä.artificialanalysis+1
Yhtiö saavutti nämä tulokset kaksivaiheisella jälkikoulutusprosessilla: on-policy-tislaamalla Inklingiä opettajamallina, jota seurasi kahden viikon agenttikeskeinen vahvistusoppiminen.kucoin
Siinä missä alkuperäinen Inkling vaati vähintään kaksi teratavua yhdistettyä VRAM-muistia BF16-tarkistuspisteiden ajamiseen, Inkling-Small laskee näitä vaatimuksia huomattavasti. Malli on saatavilla sekä BF16- että NVFP4-muodoissa Hugging Facessa ja Thinking Machinesin Tinker-palvelun kautta.gigazine+1
"Tinker-asiakkaat ovat nähneet omakohtaisesti, että oikein hienosäädetty malli voi voittaa suljetut mallit useissa tehtävissä, ja tehdä sen nopeammin ja halvemmalla", yhtiö totesi. Pienempi koko tekee LoRA- ja täysparametrien hienosäädöstä toteutettavissa olevaa keskikokoisille tiimeille, mikä oli aiemmin mahdollista vain suurille yrityksille.kucoin+1
Julkaisu tapahtuu Nvidian tukeman startup-yrityksen jatkuvan johtajuusmyllerryksen keskellä. Lilian Weng, yksi kuudesta alkuperäisestä perustajajäsenestä, ilmoitti lähdöstään 26. heinäkuuta terveydellisiin syihin vedoten, ja hänen viimeinen työpäivänsä oli 29. heinäkuuta. Hän on sittemmin palannut OpenAI:lle johtamaan rekursiivisen itsekehityksen parissa tehtävää työtä. Perustajaryhmästä ovat jäljellä enää Mira Murati ja John Schulman.kucoin+3
Thinking Machines julkaisi ensimmäisen mallinsa, Inklingin, 15. heinäkuuta. Alle kaksi viikkoa myöhemmin se toimitti seuraajan, joka suoriutuu sitä paremmin – tahti, joka viittaa yhtiön sanoin "tuotantolinjaan" mallien luomiseksi kertaluontoisen ponnistuksen sijaan.kucoin+1