Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

eweek+1basic-tutorialseweek+1„Xiaomi“ šią savaitę pristatė „MiMo-V2.6“ – atvirojo svorio dirbtinio intelekto modelių rinkinį, kuris trečiųjų šalių testuose užėmė pirmąją vietą tarp atvirojo kodo modelių. Tai įvyko praėjus vos kelioms dienoms po to, kai „Anthropic“ viešai apkaltino bendrovę naudojantis „Claude“ modeliu mokymo duomenims išgauti.
Rugsėjo 21–22 d. išleistame pakete yra „MiMo-V2.6-Pro“, „MiMo-V2.6-Flash“ ir mažesnis 9 milijardų parametrų tyrimų modelis „MiMo-V2.6-Distill-Qwen-9B“. Visi jie paskelbti „Hugging Face“ platformoje pagal MIT licencijas. „Pro“ versija turi 1,02 trilijono parametrų (apie 42 mlrd. aktyvių vienoje užklausoje), o „Flash“ – 310 mlrd. parametrų (15 mlrd. aktyvių). Abu modeliai palaiko tekstą, vaizdus, garsą ir vaizdo įrašus su vieno milijono žetonų konteksto langu.eweek+2
„MiMo-V2.6-Pro“ gavo 46 balus „Artificial Analysis Intelligence Index“ reitinge, tapdamas aukščiausiai įvertintu atvirojo svorio modeliu, kurį išbandė ši nepriklausoma vertinimo įmonė. „VentureBeat“ duomenimis, „Flash“ per API kainuoja 0,14 USD už milijoną įvesties žetonų ir 0,28 USD už milijoną išvesties žetonų, o „Pro“ – atitinkamai 0,435 USD ir 0,87 USD. Tai yra tik dalis kainos, lyginant su pirmaujančiais uždarais modeliais, tokiais kaip „Anthropic Claude Opus 5“, kainuojančiais 5 ir 25 USD už milijoną žetonų.basic-tutorials+2
Be modelių svorių, „Xiaomi“ paskelbė daugiau nei 7 000 pastiprinamojo mokymosi užduočių aplinkų ir visą mokymo sistemą. Bendrovė pranešė, kad RL mokymas kainavo apie 2,62 mln. USD „Pro“ modeliui ir 850 000 USD „Flash“ modeliui.eweek
Šis pristatymas vyksta įtemptu laikotarpiu. Rugsėjo 10 d. „Anthropic“ paskelbė grėsmių žvalgybos ataskaitą, kurioje septynios Kinijoje įsikūrusios DI laboratorijos, įskaitant „Xiaomi“, kaltinamos plataus masto „distiliavimo atakomis“ prieš „Claude“. „Anthropic“ teigia, kad „Xiaomi“ (naudodama vidinį kodą GTG-16008) 2026 m. kovą ir balandį per tarpinius įrankius į „Claude“ išsiuntė daugiau nei 400 000 vartotojų pokalbių, siekdama išgauti mokymo duomenis. Iš viso septyniose įvardytose įmonėse, tarp kurių yra ir „Alibaba“ , „DeepSeek“ bei „Moonshot AI“, „Anthropic“ užfiksavo beveik 200 milijonų mainų, kuriuos klasifikavo kaip neteisėtą distiliavimą.qz+2
„The Wall Street Journal“ pranešė, kad Kinijos DI įmonės naudojo tarpinių platformų tinklus vartotojų užklausoms į „Claude“ nukreipti, o kai kuriose transliacijose buvo perduodami jautrūs duomenys, pavyzdžiui, vietos informacija ir slaptažodžiai. „Xiaomi“ į šiuos kaltinimus viešai išsamiai neatsakė.wsj
Laikas sulaukė didelio dėmesio, nes „Anthropic“ ataskaita pasirodė likus maždaug dviem savaitėms iki „MiMo-V2.6“ pristatymo. Verslo klientams modeliai yra viešai prieinami ir nepriklausomai testuojami. Tačiau, kaip pažymėjo „eWeek“, „Epoch AI“ atkreipė dėmesį į tai, kad keli „Xiaomi“ cituojami testai, įskaitant „SWE-bench Verified“ ir „DeepSWE v1.1“, kelia abejonių dėl balų skaičiavimo ir duomenų užterštumo, todėl išvadų darymas vien tik iš šių rezultatų yra ribotas.basic-tutorials+1
Ar kaltinimai dėl distiliavimo turės įtakos modelių naudojimui, priklausys nuo to, kaip organizacijos vertins „Xiaomi“ konkurencingą kainodarą ir atviras licencijas, palyginti su neišspręstais klausimais dėl modelių mokymo duomenų kilmės.