didieji kalbos modeliai

„DeepReinforce“ išleido „Ornith-1.5“: teigia prilygstanti „Claude Opus 4.8“

„DeepReinforce“ 2026 m. rugpjūčio 19 d. išleido „Ornith-1.5“ – atviro svorio kalbos modelių šeimą, susidedančią iš trijų dydžių (397B, 35B ir 9B parametrų), kurie, bendrovės teigimu, prilygsta arba lenkia „Anthropic“ „Claude Opus 4.8“ keliuose programavimo ir loginio mąstymo testuose. Modeliai…

Viską peržiūrėjote

Peržiūrėjote visas svarbiausias pastarųjų 2 dienų naujienas.

„Alibaba“ mažasis DI modelis prilygsta „OpenAI“ „GPT-5.6 Luna“

„Alibaba“ išleido 27 milijardų parametrų dirbtinio intelekto modelį, kuris veikia taip pat gerai kaip „OpenAI“ modelis „GPT-5.6 Luna“ ir beveik prilygsta „DeepSeek“ bei „Zhipu“ sistemoms, turinčioms trilijonus parametrų, rodo pirmadienį paskelbti lyginamieji duomenys. Tai dar vienas pavyzdys, kaip Kinijos laboratorijos,…

„DeepSeek“ pristatė pavyzdinį modelį „V4 Pro“: didesnės agentų galimybės ir pakilusios kainos

„DeepSeek“ perkėlė savo 1,6 trilijono parametrų pavyzdinį modelį „V4 Pro 0813“ iš bandomosios versijos į visuotinį naudojimą. Kartu pristatyta atvirojo kodo agentų sistema ir atlikta kainodaros pertvarka, užbaigianti itin pigios API prieigos erą.

„Alibaba“ išleido „Qwen 3.8-27B“ su atvirais svoriais, aplenkdama „Meta“ modelį

„Alibaba“ išleido „Qwen3.8-27B“ – 27 milijardų parametrų tankų multimodalų modelį pagal „Apache 2.0“ licenciją, įvykdydama rugpjūčio 3 d. duotą pažadą per kelias savaites atverti tiek kompaktiškus, tiek flagmanų modelius.

„Meta“ pristatė „Muse Glimmer“: 30 mlrd. parametrų DI modelį, veikiantį asmeniniuose kompiuteriuose

„Meta“ išleido „Muse Glimmer“ – 30 milijardų parametrų atvirojo svorio DI modelį, kuris gali veikti visiškai neprisijungus prie interneto vartotojų kompiuteriuose. Tai svarbus žingsnis bendrovės pastangose padaryti galingą DI prieinamą be debesijos prenumeratų ar interneto ryšio.

„Google“ ir „SpaceXAI“ eskaluoja dirbtinio intelekto kainų karą naujais modeliais

„SpaceXAI“ trečiadienį, rugpjūčio 12 d., pristatė „Grok 4.6“, teigdama, kad jos naujausias modelis prilygsta „OpenAI“ ir „Anthropic“ našumui, tačiau kainuoja pigiau. Tai naujausias etapas intensyvėjančiame dirbtinio intelekto kainų kare, kurio metu „Google Alphabet Inc.“ vos po dienos išleido savo pigesnį…

„Alibaba“ nemokamai atvėrė didžiausią savo dirbtinio intelekto modelį

„Alibaba“ platformoje „Hugging Face“ išleido savo pavyzdinio modelio „Qwen3.8-2.4T-A95B“ svorius: tai pirmas kartas, kai bendrovė atvėrė „Max“ klasės modelį. 2,4 trilijono parametrų ekspertų mišinio sistema, aktyvuojanti 95 milijardus parametrų vienam žetonui, platformoje pasirodė rugpjūčio 12 d. ir yra suderinama su…

„SpaceXAI“ pristatė „Grok 4.6“, teigdama, kad jis prilygsta „GPT-5.6 Sol“ ir „Fable 5“

Trečiadienį „SpaceXAI“ pristatė „Grok 4.6“, pozicionuodama savo naujausią DI modelį kaip tiesioginį „OpenAI“ „GPT-5.6 Sol“ ir „Anthropic“ „Fable 5“ konkurentą, kainuojantį maždaug perpus pigiau. Modelis jau prieinamas per „Cursor“, „Grok Build“, „Grok Bot“ ir „SpaceXAI API“.

„Nvidia“ kuria 1 trilijono parametrų atvirojo kodo DI modelį, siekdama konkuruoti su lyderiais

„Nvidia“ kuria naują atvirojo kodo DI modelių šeimą, vadinamą „Nemotron 4“, kurios didžiausia versija turėtų turėti bent 1 trilijoną parametrų, teigiama antradienį „The Information“ paskelbtoje ataskaitoje, remiantis keliais su projektu dirbančiais darbuotojais.

„ByteDance“ kuria aukščiausio lygio DI duomenų padalinį: taikosi į 10 trilijonų parametrų modelį

„ByteDance“ įsteigė naują pirmosios pakopos padalinį „AI Data & Security“, taip sustiprindama bendrovės požiūrį į duomenų valdymą, kai pradedamas mokyti vienas didžiausių pasaulyje DI modelių.

FT: „ByteDance“ kuria 10 trilijonų parametrų DI modelį

Bendrovė „ByteDance“ kuria dirbtinio intelekto modelį, turintį net 10 trilijonų parametrų. Šis mastas gali prilygti pažangiausiai „Anthropic“ sistemai „Mythos“, penktadienį pranešė „Financial Times“, remdamasi informuotais šaltiniais.

„Alibaba“ DI modelis užėmė pirmąją vietą pasauliniame reitinge, aplenkdamas „Claude“ ir „GPT“

„Alibaba“ modelis „Qwen3.8-Max“ užėmė pirmąją vietą „Artificial Analysis“ agentinių sistemų reitinge („Agentic Index“) su 55,4 balo, nežymiai aplenkdamas „Anthropic“ „Claude Opus 5“ (55,3 balo) ir „OpenAI“ „GPT 5.6“, rodo šią savaitę paskelbti naujausi vertinimo organizacijos duomenys. Tai pirmas kartas, kai…

„OpenAI“ pristatė „GPT-5.6 Luna“ kaip numatytąjį modelį ir panaikino teksto pokalbių limitus nemokamiems vartotojams

„OpenAI“ ketvirtadienį paskelbė, kad „GPT-5.6 Luna“ taps numatytuoju modeliu „ChatGPT“ nemokamo ir „Go“ plano vartotojams, o šie vartotojai galės neribotai bendrauti tekstu, taip pašalinant vieną didžiausių kliūčių nemokamai auditorijai.

„Alibaba“ pristatė didžiausią savo atvirojo kodo DI modelį „Qwen3.8-Max“

Pirmadienį „Alibaba“ išleido savo naujausią pavyzdinį DI modelį „Qwen3.8-Max“, turintį 2,4 trilijono parametrų. Bendrovė teigia, kad jo našumas prilygsta pirmaujantiems „OpenAI“ ir „Anthropic“ modeliams. Po šio pranešimo Honkongo biržoje listinguojamos „Alibaba“ akcijos ankstyvojoje prekyboje sparčiai pabrango.

„Thinking Machines“ pristatė „Inkling-Small“: flagmano galia keturis kartus mažesniame modelyje

Ketvirtadienį „Thinking Machines Lab“ išleido „Inkling-Small“ – daugiarūšį atvirojo svorio modelį, kuris prilygsta arba viršija savo pirmtaką „Inkling“, naudodamas maždaug ketvirtadalį parametrų. Tai žingsnis, kuris dramatiškai sumažina skaičiavimo išteklius, reikalingus pažangios dirbtinio intelekto sistemos veikimui.

Kinijos dirbtinio intelekto modeliai užėmė visas penkias pirmąsias vietas pasauliniame reitinge

Pirmą kartą Kinijoje sukurti didieji kalbos modeliai užėmė visas penkias dažniausiai naudojamas pozicijas „OpenRouter“ platformoje, kuri yra didžiausia neutrali LLM maršrutizavimo platforma pasaulyje. Tai žymi svarbų etapą Kinijai sparčiai tampant dominuojančia atvirojo kodo dirbtinio intelekto modelių tiekėja pasauliniu mastu.

„Moonshot AI“ nemokamam atsisiuntimui išleido „Kimi K3“ modelio svorius

Kinijos bendrovė „Moonshot AI“ išleido visus savo „Kimi K3“ modelio svorius. Ši 2,8 trilijono parametrų sistema dabar yra didžiausias pasaulyje atvirųjų svorių dirbtinio intelekto modelis, kurį galima nemokamai atsisiųsti, pritaikyti savo poreikiams ir talpinti savo serveriuose. Svoriai platformoje „Hugging Face“…

E. Muskas žada „Grok 4.6“ po dviejų savaičių, o „Grok 4.7“: po keturių

Elonas Muskas ketvirtadienį pranešė, kad „xAI“ modelis „Grok 4.6“ bus išleistas po dviejų savaičių, o „Grok 4.7“: po keturių. Taip nustatytas itin agresyvus tempas, leisiantis pristatyti du naujus pažangiausius modelius per vieną mėnesį.

„DeepSeek V4“ artėja prie pilno pristatymo, „Alibaba“ pristatė „Qwen 3.8“

Dvi iš žinomiausių Kinijos dirbtinio intelekto laboratorijų per kelias dienas viena po kitos išleidžia pagrindinius modelius, paaštrindamos kainų ir našumo konkurenciją, kuri 2026 m. pakeitė pasaulinį DI kraštovaizdį. „DeepSeek“ šią savaitę perkelia savo V4 modelių šeimą iš peržiūros į bendrą…

„Moonshot AI“ stabdo naujas „Kimi K3“ prenumeratas dėl GPU pajėgumų trūkumo

Praėjus trims dienoms po „Kimi K3“ – didžiausio kada nors išleisto atvirojo svorio DI modelio – pristatymo, Kinijos startuolis „Moonshot AI“ sekmadienį, liepos 19 d., sustabdė naujas vartotojų prenumeratas, teigdamas, kad vartotojų paklausa priartino skaičiavimo infrastruktūrą prie ribos.

Muskas: „xAI“ 2 trilijonų parametrų modelio mokymas bus baigtas kitą savaitę

Elonas Muskas liepos 18 d. atskleidė, kad kitas „xAI“ didysis kalbos modelis, 2 trilijonų parametrų sistema, kurią tikimasi pavadinti „Grok 4.6“, kitą savaitę baigs pradinį mokymo etapą: tai tiesioginis atsakas į „Moonshot AI“ vos prieš dvi dienas pristatytą „Kimi K3“.

„Alibaba“ pristatė 2,4 trilijono parametrų „Qwen3.8“: teigia, kad jis prilygsta geriausiems DI modeliams

Šeštadienį „Alibaba“ pranešė apie „Qwen3.8“, 2,4 trilijono parametrų didžiojo kalbos modelio, išleidimą. Įmonės teigimu, pagal bendrą našumą jis nusileidžia tik „Fable 5“. Bandomoji versija „Qwen3.8-Max-Preview“ jau prieinama kūrėjams per „Alibaba“ „Token Plan“ prenumeratas bei jos programavimo platformas „Qoder“ ir „QoderWork“,…

„Anthropic“ nuo sekmadienio visam laikui įtrauks „Fable 5“ į brangiausius „Claude“ planus

Po kelias savaites trukusių nuolatinių terminų pratęsimų ir pajėgumų ribojimų bendrovė „Anthropic“ paskelbė, kad jos pavyzdinis modelis „Claude Fable 5“ nuo liepos 20 dienos taps nuolatine „Max“ ir „Team Premium“ prenumeratos planų dalimi ir bus prieinamas taikant 50 % standartinio…

„Moonshot AI“ pristatė „Kimi K3“: didžiausią atvirojo svorio DI modelį

Kinijos DI startuolis „Moonshot AI“ trečiadienį pristatė „Kimi K3“ – 2,8 trilijono parametrų ekspertų mišinio modelį, kurį vadina didžiausiu kada nors išleistu atvirojo svorio kalbos modeliu. Tai dar labiau aštrina konkurenciją tarp Kinijos ir JAV DI laboratorijų tuo metu, kai…

„Moonshot AI“ pristatė 2,8 trilijono parametrų „Kimi K3“

Kinijos dirbtinio intelekto startuolis „Moonshot AI“ trečiadienį pristatė „Kimi K3“ – 2,8 trilijono parametrų modelį, kurį bendrovė pozicionuoja kaip tiesioginį konkurentą „Anthropic“ „Claude Opus 4.8“. Dėl šio išleidimo K3 tapo didžiausiu atvirojo svorio modeliu iš Kinijos laboratorijos, beveik patrigubinusiu savo…

„Moonshot AI“ ruošiasi pristatyti „Kimi K3“ – 2,5 trilijono parametrų modelį

Pekine įsikūręs startuolis „Moonshot AI“, sukūręs „Kimi“ kalbos modelių seriją, ruošiasi išleisti „Kimi K3“ – modelį su maždaug 2,5 trilijono parametrų, kuris, pasak insaiderių, prilygs pažangiausių JAV laboratorijų, įskaitant „Anthropic“ ir „OpenAI“, galimybėms. Šis pristatymas, kuris, remiantis nutekintu „Moonshot“ API…

„Tencent“ Hy3 DI modelio naudojimas išaugo 68 kartus, jis užėmė pirmąją vietą pasauliniame reitinge

„Tencent“ pagrindinio didelio kalbos modelio Hy3 bendras API užklausų skaičius išaugo daugiau nei 68 kartus, palyginti su jo pirmtaku Hy2, praėjus vos savaitei po oficialaus pristatymo liepos 6 d., pranešė „Tencent Hunyuan“ komanda. Modelis taip pat užėmė pirmąją vietą „OpenRouter“…

„Anthropic“ pratęsia nemokamą prieigą prie „Claude Fable 5“ iki liepos 19 d.

„Anthropic“ dar kartą atidėjo „Claude Fable 5“ įtraukimo į mokamus prenumeratos planus terminą, šį kartą iki liepos 19 d., bendrovė paskelbė šeštadienį. Šis pratęsimas yra jau trečias kartas, kai „Anthropic“ atideda modelio perėjimą prie apmokestinimo pagal naudojimą nuo pradinės birželio…

„MiniMax“ planuoja 2,7 trilijono parametrų atvirojo svorio DI modelį – didžiausią iš Kinijos įmonės

Kinijos DI startuolis „MiniMax Group“ kuria didelį kalbos modelį su 2,7 trilijono parametrų, kurį planuoja išleisti kaip atvirojo svorio programinę įrangą jau šį ketvirtį, antradienį pranešė „Reuters“. Tai būtų didžiausias kada nors Kinijos įmonės išleistas atvirojo svorio modelis ir potencialiai…

„AMI Labs“ įkūrėja ICML pagrindiniame pranešime meta iššūkį LLM dominavimui

Pagrindinė ICML 2026 konferencijos programa Seule pirmadienį prasidėjo kviestiniu pranešimu, kuriuo buvo tiesiogiai taikytasi į dominuojančią dirbtinio intelekto paradigmą. „Advanced Machine Intelligence Labs“ įkūrėja ir vyriausioji tyrimų bei inovacijų pareigūnė Pascale Fung skaitė pranešimą pavadinimu „Link DI agentų realiame pasaulyje“,…