დიდი ენობრივი მოდელები

DeepReinforce-მა გამოუშვა Ornith-1.5, რომელიც Claude Opus 4.8-ის დონეზეა

DeepReinforce-მა 2026 წლის 19 აგვისტოს გამოუშვა Ornith-1.5, ღია წონის ენობრივი მოდელების სერია სამი ზომით: 397B, 35B და 9B პარამეტრებით. კომპანიის თქმით, მოდელები უტოლდება ან აღემატება Anthropic-ის Claude Opus 4.8-ს კოდირებისა და მსჯელობის რამდენიმე ტესტში. მოდელები ხელმისაწვდომია MIT ლიცენზიით Hugging Face-ზე,…

ყველაფერს გაეცანი

შენ უკვე ნახე ბოლო 2 დღის ყველა მთავარი ამბავი.

Alibaba-ს მცირე AI მოდელი OpenAI-ს GPT-5.6 Luna-ს უთანაბრდება

Alibaba -მ გამოუშვა 27 მილიარდი პარამეტრის მქონე AI მოდელი, რომელიც OpenAI-ს GPT-5.6 Luna-ს დონეზე მუშაობს და თითქმის უთანაბრდება DeepSeek-ისა და Zhipu-ს ტრილიონიან სისტემებს. ეს მონაცემები ორშაბათს გამოქვეყნებულ ბენჩმარკშია ასახული: ჩინური ლაბორატორიების მორიგი მაგალითი, თუ როგორ ამცირებენ ისინი ჩამორჩენას ამერიკელ კონკურენტებთან…

DeepSeek-ი V4 Pro-ს აახლებს: გაუმჯობესებული აგენტური ფუნქციები და გაზრდილი ფასი

DeepSeek-მა თავისი 1.6 ტრილიონი პარამეტრის მქონე ფლაგმანური მოდელი, V4 Pro 0813, სატესტო რეჟიმიდან სრულ ხელმისაწვდომობაში გადაიყვანა. ამ სიახლეს ახლავს ღია კოდის აგენტური ფრეიმვორკი და საფასო პოლიტიკის გადახედვა, რაც კომპანიის ულტრა-იაფი API წვდომის ეპოქას ასრულებს.

Alibaba-მ Qwen 3.8-27B ღია წონებით გამოუშვა, რითაც Meta-ს მოდელს აჯობა

Alibaba -მ გამოუშვა Qwen3.8-27B, 27-მილიარდიანი პარამეტრის მქონე მულტიმოდალური მოდელი Apache 2.0 ლიცენზიით. ამით კომპანიამ შეასრულა 3 აგვისტოს დაპირება, რომ რამდენიმე კვირაში გახსნიდა როგორც კომპაქტურ, ისე ფლაგმანურ მოდელებს.

Meta-მ გამოუშვა Muse Glimmer: 30 მილიარდიანი AI მოდელი, რომელიც მუშაობს ოფლაინ რეჟიმში

Meta -მ გამოუშვა Muse Glimmer, 30 მილიარდი პარამეტრის მქონე ღია AI მოდელი, რომელიც სრულად მუშაობს ოფლაინ რეჟიმში ჩვეულებრივ კომპიუტერებზე. ეს არის მნიშვნელოვანი ნაბიჯი კომპანიის სტრატეგიაში, გახადოს ძლიერი AI ხელმისაწვდომი ღრუბლოვანი გამოწერების ან ინტერნეტის გარეშე.

Google და SpaceXAI ხელოვნური ინტელექტის ფასების ომს აძლიერებენ

SpaceXAI-მ ოთხშაბათს, 12 აგვისტოს, წარადგინა Grok 4.6 და განაცხადა, რომ მისი უახლესი მოდელი OpenAI-სა და Anthropic-ის დონეს უტოლდება, თუმცა მათზე დაბალ ფასად. ეს არის ხელოვნური ინტელექტის სფეროში მიმდინარე ფასების ომის მორიგი ეტაპი, რომელსაც Google Alphabet Inc.-მა ერთი დღის შემდეგ საკუთარი…

Alibaba-მ თავისი ყველაზე დიდი AI მოდელი უფასოდ გაასაჯაროა

Alibaba-მ თავისი ფლაგმანური Qwen3.8-2.4T-A95B მოდელის წონები Hugging Face-ზე გამოაქვეყნა, რაც პირველი შემთხვევაა, როდესაც კომპანიამ Max-კლასის მოდელი გაასაჯაროა. 2.4 ტრილიონი პარამეტრის მქონე ექსპერტთა ნარევის სისტემა, რომელიც თითოეულ ტოკენზე 95 მილიარდ პარამეტრს აქტიურებს, პლატფორმაზე 12 აგვისტოს განთავსდა და თავსებადია სტანდარტულ ინფერენციულ სისტემებთან,…

SpaceXAI-მა გამოუშვა Grok 4.6, რომელიც GPT-5.6 Sol-სა და Fable 5-ის დონეზეა

ოთხშაბათს SpaceXAI-მა გამოუშვა Grok 4.6, რითაც თავისი უახლესი ხელოვნური ინტელექტის მოდელი OpenAI-ის GPT-5.6 Sol-ისა და Anthropic-ის Fable 5-ის პირდაპირ კონკურენტად აქცია, თანაც დაახლოებით ნახევარ ფასად. მოდელი უკვე ხელმისაწვდომია Cursor-ის, Grok Build-ის, Grok Bot-ისა და SpaceXAI API-ის მეშვეობით.

Nvidia 1 ტრილიონი პარამეტრის მქონე ღია კოდის AI მოდელს ქმნის

The Information-ის ცნობით, რომელიც პროექტზე მომუშავე თანამშრომლებზე დაყრდნობით ავრცელებს ინფორმაციას, Nvidia ქმნის ღია კოდის AI მოდელების ახალ ოჯახს, სახელწოდებით Nemotron 4. მოსალოდნელია, რომ მისი უდიდესი ვერსია სულ მცირე 1 ტრილიონ პარამეტრს შეიცავს.

ByteDance-მა AI მონაცემთა უმაღლესი დონის დეპარტამენტი შექმნა: მიზანი 10-ტრილიონიანი მოდელია

ByteDance-მა შექმნა ახალი, პირველი დონის დეპარტამენტი სახელწოდებით „AI Data & Security“ (AI მონაცემები და უსაფრთხოება). ამ ნაბიჯით კომპანია მონაცემთა მართვის მიდგომას ახალ საფეხურზე აიყვანს, რადგან იწყებს მუშაობას მოდელზე, რომელიც მსოფლიოში ერთ-ერთი უდიდესი ხელოვნური ინტელექტის მოდელი იქნება.

ByteDance-ი 10 ტრილიონი პარამეტრის მქონე AI მოდელს წვრთნის, წერს FT

ByteDance-ი წვრთნის ხელოვნური ინტელექტის მოდელს 10 ტრილიონამდე პარამეტრით. ეს არის მასშტაბი, რომელიც შესაძლოა Anthropic-ის ყველაზე დახვეწილ Mythos სისტემას გაუტოლდეს, იტყობინება Financial Times-ი პარასკევს საქმის კურსში მყოფ პირებზე დაყრდნობით.

Alibaba-ს AI მოდელმა გლობალურ რეიტინგში Claude-სა და GPT-ს გადაუსწრო

Alibaba-ს Qwen3.8-Max-მა Artificial Analysis-ის Agentic Index-ზე პირველი ადგილი დაიკავა 55.4 ქულით, რითაც მცირედით აჯობა Anthropic-ის Claude Opus 5-ს (55.3 ქულა) და OpenAI-ის GPT 5.6-ს. ეს არის პირველი შემთხვევა, როდესაც ჩინურმა AI მოდელმა დაიკავა პირველი ადგილი აგენტური შესაძლებლობების ლიდერბორდზე, რომელიც ზომავს…

OpenAI-მა GPT-5.6 Luna სტანდარტულ მოდელად აქცია და უფასო მომხმარებლებისთვის ჩატის ლიმიტები გააუქმა

OpenAI-მ ხუთშაბათს განაცხადა, რომ GPT-5.6 Luna გახდება სტანდარტული მოდელი ChatGPT-ის უფასო და Go ტარიფის მომხმარებლებისთვის, და რომ ეს მომხმარებლები მიიღებენ შეუზღუდავ ტექსტურ საუბრებს, რაც აქრობს ჩატბოტის ერთ-ერთ ყველაზე ხანგრძლივ შემაფერხებელ ფაქტორს არამომხიბვლელი აუდიტორიისთვის.

Alibaba-მ თავისი ყველაზე დიდი ღია კოდის მქონე AI მოდელი Qwen3.8-Max წარადგინა

ორშაბათს Alibaba-მ თავისი უახლესი ფლაგმანური AI მოდელი, Qwen3.8-Max წარადგინა, რომელსაც 2.4 ტრილიონი პარამეტრი აქვს და, კომპანიის მტკიცებით, კონკურენციას უწევს OpenAI-სა და Anthropic-ის წამყვან მოდელებს. განცხადების შემდეგ, ჰონგ-კონგის ბირჟაზე Alibaba-ს აქციების ფასი მკვეთრად გაიზარდა.

Thinking Machines-მა Inkling-Small წარადგინა: მცირე ზომის მოდელი, რომელიც ფლაგმანის შესაძლებლობებს უტოლდება

ხუთშაბათს Thinking Machines Lab-მა წარადგინა Inkling-Small, მულტიმოდალური მოდელი, რომელიც თავის წინამორბედ Inkling-ს უტოლდება ან აღემატება, თუმცა პარამეტრების მხოლოდ მეოთხედს იყენებს. ეს ნაბიჯი მნიშვნელოვნად ამცირებს უმაღლესი კლასის ხელოვნური ინტელექტის სისტემის გაშვებისთვის საჭირო გამოთვლით სიმძლავრეს.

ჩინური AI მოდელები გლობალური გამოყენების რეიტინგის ხუთეულს ლიდერობენ

პირველად ისტორიაში, ჩინური წარმოების დიდი ენობრივი მოდელები OpenRouter-ის, მსოფლიოში ყველაზე დიდი ნეიტრალური LLM მარშრუტიზაციის პლატფორმის, ხუთივე წამყვან პოზიციას იკავებენ. ეს მოვლენა ჩინეთის, როგორც ღია წონის AI მოდელების გლობალური მიმწოდებლის, სწრაფი აღზევების მნიშვნელოვანი ეტაპია.

Moonshot AI-მ Kimi K3 მოდელის წონები უფასოდ გამოაქვეყნა

ჩინურმა კომპანიამ Moonshot AI-მ გამოაქვეყნა თავისი Kimi K3-ის სრული მოდელის წონები. ეს არის 2.8 ტრილიონი პარამეტრის მქონე სისტემა, რომელიც ამჟამად მსოფლიოში ყველაზე დიდი ღია წონის მქონე ხელოვნური ინტელექტის მოდელია, რომელიც ხელმისაწვდომია უფასო ჩამოსატვირთად, დასაჰოსტად და დასაკონფიგურირებლად (fine-tuning). წონები Hugging Face-ზე…

მასკის განცხადებით, Grok 4.6 ორ კვირაში, ხოლო Grok 4.7 ოთხ კვირაში გამოვა

ილონ მასკმა ხუთშაბათს განაცხადა, რომ xAI-ის Grok 4.6 ორ კვირაში, ხოლო Grok 4.7 ოთხ კვირაში გამოვა. ეს არის ამბიციური გრაფიკი, რომელიც ერთი თვის განმავლობაში ორი ახალი წამყვანი მოდელის წარდგენას ითვალისწინებს.

DeepSeek V4 სრულფასოვანი გაშვების მოლოდინშია, Alibaba-მ კი Qwen 3.8 წარადგინა

ჩინეთის ორი ყველაზე გავლენიანი ხელოვნური ინტელექტის ლაბორატორია ერთმანეთის მიყოლებით უშვებს ფლაგმანურ მოდელებს, რაც კიდევ უფრო ამძაფრებს კონკურენციას ფასებისა და წარმადობის კუთხით, რამაც 2026 წელს გლობალური AI ლანდშაფტი შეცვალა. DeepSeek თავის V4 მოდელების ოჯახს საცდელი ვერსიიდან სრულფასოვან რეჟიმზე გადაიყვანს, ხოლო Alibaba…

Moonshot AI-მა Kimi K3-ზე ახალი რეგისტრაციები GPU-ს ლიმიტების გამო შეაჩერა

Kimi K3-ის, ყველაზე დიდი ღია წონის მქონე AI მოდელის გამოშვებიდან სამი დღის შემდეგ, ჩინურმა სტარტაპმა Moonshot AI-მ კვირას, 19 ივლისს, ახალი მომხმარებლებისთვის გამოწერები შეაჩერა. კომპანიის განცხადებით, მომხმარებელთა მოთხოვნამ მათი გამოთვლითი ინფრასტრუქტურა ზღვრულ ნიშნულამდე მიიყვანა.

მასკი: xAI-ის 2-ტრილიონიანი მოდელის წვრთნა მომავალ კვირას დასრულდება

ილონ მასკმა 18 ივლისს განაცხადა, რომ xAI-ის შემდეგი დიდი ენობრივი მოდელი, 2-ტრილიონიანი პარამეტრის მქონე სისტემა, რომელსაც, სავარაუდოდ, Grok 4.6 ერქმევა, პირველად წვრთნას მომავალ კვირას დაასრულებს, რაც პირდაპირი პასუხია სულ რაღაც ორი დღით ადრე Moonshot AI-ის მიერ Kimi K3-ის წარდგენაზე.

Alibaba-მ 2.4-ტრილიონპარამეტრიანი Qwen3.8 წარადგინა: კომპანია ამტკიცებს, რომ ის წამყვან AI მოდელებს არ ჩამოუვარდება

შაბათს Alibaba-მ გამოაცხადა Qwen3.8-ის გამოშვება. ეს არის 2.4 ტრილიონი პარამეტრის მქონე დიდი ენობრივი მოდელი, რომელიც, კომპანიის თქმით, საერთო წარმადობით „მხოლოდ Fable 5-ს ჩამოუვარდება“. საცდელი ვერსია, Qwen3.8-Max-Preview, უკვე ხელმისაწვდომია დეველოპერებისთვის Alibaba-ს Token Plan-ის გამომწერებისთვის და მისი კოდირების პლატფორმებზე Qoder და QoderWork,…

Anthropic კვირიდან Fable 5-ს Claude-ის პრემიუმ ტარიფებში მუდმივად ჩართავს

ვადების არაერთგზის გადაწევისა და სისტემური შეზღუდვების შემდეგ, Anthropic-მა გამოაცხადა, რომ მისი ფლაგმანი მოდელი Claude Fable 5, 20 ივლისიდან, მუდმივად ჩაერთვება Max და Team Premium სააბონენტო ტარიფებში და ხელმისაწვდომი იქნება სტანდარტული მოხმარების ლიმიტის 50%-ით.

Moonshot AI-მა ყველაზე დიდი ღია წონის AI მოდელი Kimi K3 წარადგინა

ჩინურმა AI სტარტაპმა Moonshot AI-მ ოთხშაბათს წარადგინა Kimi K3, 2.8 ტრილიონი პარამეტრის მქონე მოდელი, რომელსაც ის ყველაზე დიდ ღია წონის ენობრივ მოდელს უწოდებს. ეს ნაბიჯი კიდევ უფრო ამძაფრებს კონკურენციას ჩინურ და ამერიკულ AI ლაბორატორიებს შორის იმ დროს, როდესაც ბიზნესები სულ…

Moonshot AI-მ 2.8 ტრილიონი პარამეტრის მქონე Kimi K3 გამოუშვა

ჩინურმა AI სტარტაპმა Moonshot AI-მ ოთხშაბათს გამოუშვა Kimi K3, 2.8 ტრილიონი პარამეტრის მქონე მოდელი, რომელსაც კომპანია Anthropic-ის Claude Opus 4.8-ის პირდაპირ კონკურენტად აცხადებს. ამ გამოშვებით K3 გახდა ჩინური ლაბორატორიის ყველაზე დიდი ღია წონის მოდელი, რომელმაც თითქმის სამჯერ გაზარდა წინამორბედის პარამეტრების…

Moonshot AI-მ შესაძლოა 2.5 ტრილიონი პარამეტრის მქონე მოდელი Kimi K3 გამოუშვას

პეკინში დაფუძნებული სტარტაპი Moonshot AI, რომელიც Kimi-ს ენობრივი მოდელების სერიის უკან დგას, ემზადება Kimi K3-ის გამოსაშვებად. ეს არის დაახლოებით 2.5 ტრილიონი პარამეტრის მქონე მოდელი, რომელიც, ინსაიდერების თქმით, კონკურენციას გაუწევს აშშ-ის წამყვან ლაბორატორიებს, მათ შორის Anthropic-სა და OpenAI-ს. გაჟონილი Moonshot API…

Tencent-ის Hy3 AI მოდელმა გამოყენების 68-ჯერადი ზრდა აჩვენა და გლობალური ლიდერბორდის სათავეში მოექცა

Tencent-ის ფლაგმანურმა დიდმა ენობრივმა მოდელმა Hy3-მა, 6 ივლისს ოფიციალური გაშვებიდან სულ რაღაც ერთ კვირაში, API გამოძახებების საერთო მოცულობის 68-ჯერადი ზრდა აჩვენა თავის წინამორბედ Hy2-თან შედარებით, იტყობინება კომპანიის Tencent Hunyuan გუნდი. მოდელმა ასევე დაიკავა პირველი ადგილი OpenRouter-ის მოდელების გამოყენების გლობალურ ყოველკვირეულ…

Anthropic-მა Claude Fable 5-ზე უფასო წვდომა 19 ივლისამდე გაახანგრძლივა

Anthropic-მა კვლავ გადაწია Claude Fable 5-ზე წვდომის ვადა ფასიანი სააბონენტო გეგმებისთვის, ამჯერად 19 ივლისამდე, განაცხადა კომპანიამ შაბათს. ეს გახანგრძლივება მესამე შემთხვევაა, როდესაც Anthropic-მა მოდელის მოხმარებაზე დაფუძნებულ ტარიფებზე გადასვლა გადაავადა 22 ივნისის თავდაპირველი ვადის შემდეგ.

MiniMax გეგმავს 2.7 ტრილიონი პარამეტრის მქონე ღია წონის AI მოდელის შექმნას, რაც ჩინური ფირმისთვის ყველაზე მასშტაბური იქნება

ჩინური AI სტარტაპი MiniMax Group ავითარებს დიდ ენობრივ მოდელს 2.7 ტრილიონი პარამეტრით, რომლის ღია წონის პროგრამულ უზრუნველყოფად გამოშვებასაც კომპანია მიმდინარე კვარტალში გეგმავს, იტყობინება Reuters სამშაბათს. ეს იქნება ყველაზე დიდი ღია წონის მოდელი, რაც კი ოდესმე ჩინურ კომპანიას გამოუშვია და შესაძლოა,…

AMI Labs-ის თანადამფუძნებელი ICML-ის მთავარ მოხსენებას იყენებს LLM-ების დომინირების გამოწვევისთვის

ICML 2026-ის მთავარი კონფერენციის პროგრამა სეულში ორშაბათს გაიხსნა მოწვეული მოხსენებით, რომელიც პირდაპირ მიმართული იყო ხელოვნური ინტელექტის დომინანტური პარადიგმის წინააღმდეგ. პასკალ ფუნგმა, Advanced Machine Intelligence Labs-ის თანადამფუძნებელმა და კვლევისა და ინოვაციების მთავარმა ოფიცერმა, წარადგინა მოხსენება სათაურით „AI აგენტებისკენ რეალურ სამყაროში“, სადაც…