Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

commandline.microsoft.commandline.microsoft.commandline.microsoft.„Microsoft“ penktadienį, spalio 9 d., išleido „Microsoft-Decision-1“. Šis modelis nerašo laisvos formos teksto. Jis pasirenka iš nustatytų variantų ir kiekvienam priskiria kalibruotą tikimybę, todėl programinė įranga gali nedelsdama reaguoti į rezultatą. Modelis jau prieinamas „Microsoft Foundry“ platformoje, o vėliau pasieks ir „OpenRouter“. „Microsoft“ teigia, kad greičiu ir tikslumu jis pranoko tiek didelius kalbinius modelius, tiek kitus sprendimų priėmimo modelius. Kaina siekia 0,042 JAV dolerio už milijoną įvesties žetonų, o išvesties žetonai yra nemokami.commandline.microsoft
„Microsoft“ siūlo šį modelį kaip pigų valdymo sluoksnį dirbtinio intelekto agentams. Šie agentai priima daugybę mažų sprendimų tarp veiksmų: kokį modelį kviesti, ar bandyti dar kartą, kada perduoti darbą žmogui. Kiekvienas toks pasirinkimas didina vėlavimą ir kaštus.testingcatalog+1
Generalinis direktorius Satya Nadella apie modelį paskelbė „X“ platformoje. „Jis užtikrina aukščiausią našumą atliekant struktūrizuotus sprendimų priėmimo uždavinius, lenkdamas tiek kalbinius, tiek kitus sprendimų modelius pagal delsą ir kokybę“, – rašė jis. Jis pridūrė, kad „Microsoft“ „jau testuoja jį visoje bendrovėje – nuo reagavimo į incidentus ir kokybės kontrolės iki mokslinių atradimų“.seekingalpha+1
„Microsoft“ sukūrė „Decision-1“ papildomai apmokiusi „Qwen3.5-9B“ – atvirojo kodo modelį iš „Alibaba“ – kad šis vertintų variantus vienu kartu. Bendrovė planuoja jį perkurti naudojant kitus bazinius modelius, įskaitant savo „MAI“ ir „OpenAI“ modelius. Jis apdoroja „taip/ne“ klausimus, klausimus su keliais atsakymų variantais ir vertinimo skales. Jis taip pat gali vertinti DI atsakymus ir agentų veiksmus pagal nustatytus kriterijus.commandline.microsoft
„Kiekvienas sprendimas didina vėlavimą, ypač kai vienas žingsnis priklauso nuo kito“, – pranešime rašė Achintas Srivastava, „Microsoft“ CTO biuro viceprezidentas. Jis pažymėjo, kad pridėjus 100 milisekundžių prie kiekvieno iš 20 sprendimų iš eilės, darbo eiga pailgėja dviem sekundėmis.commandline.microsoft
„Microsoft“ teigia, kad „Decision-1“ pasiekė didžiausią tikslumą atliekant 36 etaloninius testus, apimančius beveik 150 000 klausimų, kurie nebuvo naudojami mokymui. Tai taip pat buvo greičiausias išmatuotas modelis: 4,5 karto greitesnis už artimiausią konkurentą „Quyet-1.0-Large“ ir maždaug 35 kartus greitesnis už „OpenAI“ „GPT-6 Sol“ pagal vidutinę delsą. „Microsoft“ išbandė aštuonis būdus, kaip perfrazuoti ar pertvarkyti tą patį užklausimą, ir modelis savo atsakymą pakeitė vidutiniškai 1,3% atvejų. Saugumo testai apėmė 5 250 užklausų pagal 11 etaloninių rodiklių.commandline.microsoft
Šie rezultatai gauti atliekant „Microsoft“ vidinius testus ir nebuvo nepriklausomai patikrinti.fourweekmba+1
„Xbox Research“ naudojo šį modelį daugiau nei 10 000 žaidėjų atsiliepimų suskirstymui į temas. Pranešama, kad kokybė prilygo „GPT-6 Sol“, tačiau modelis veikė daugiau nei 14 kartų greičiau ir kainavo du šimtus kartų mažiau. „Microsoft“ „Copilot“ komanda nustatė, kad jis konkuruoja su „GPT-5.6 Luna“ ir yra 100 kartų greitesnis vertinant atsakymų kokybę. „Microsoft Discovery“ sistemoje jo vertinimas buvo 46 kartus nuoseklesnis nei naudojant didelį kalbinį modelį.commandline.microsoft
Po šio pranešimo „Microsoft“ akcijos pabrango, rodo „Futu“ cituojami rinkos duomenys.news.futunn
„Dabar, kai agentinis DI tapo realybe, pamatėme, kad kaina vaidina svarbų vaidmenį priimant sprendimus dėl DI naudojimo“, – rašė „Microsoft“.commandline.microsoft