Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

qz+1garymarcus.substackcacm.acm+11 აგვისტოს OpenAI-მ განაცხადა, რომ მისმა გამოუქვეყნებელმა Astra-ს მოდელების ოჯახმა გადაჭრა 10 ხანგრძლივი ღია პრობლემა მათემატიკასა და თეორიულ კომპიუტერულ მეცნიერებაში. კომპანიამ GitHub-ზე გამოაქვეყნა 249-გვერდიანი ხელნაწერი და Lean 4-ის სრულად ვერიფიცირებული მტკიცებულებები. შედეგები მოიცავს ისეთ სფეროებს, როგორიცაა მაღალგანზომილებიანი გეომეტრია, კოდირების თეორია, ჯგუფთა თეორია, კვანტური სირთულე და ექსტრემალური კომბინატორიკა. კომპანიის ცნობით, გამოთვლითი ღირებულება GPT-5.6 Sol API-ის ტარიფებით დაახლოებით 2000 დოლარი იყო.ndtv+2
OpenAI-ის ბლოგპოსტის თანახმად, Astra-მ მიაღწია პროგრესს სფეროების შეფუთვის საზღვრებში, შეცდომების გამოსწორების კოდებში და პირველი ექსპლიციტური არასოფიკური ჯგუფის კონსტრუქციაში, რაც 1999 წლიდან ღია კითხვად რჩებოდა. მოდელმა ასევე დაამტკიცა კვანტური პარალელური გამეორების თეორემა ზოგადი ორმოთამაშიანი ჩახლართული თამაშებისთვის და მიიღო შედეგები ერჰარტის მოცულობის ჰიპოთეზასა და კონესის სიმკაცრის ჰიპოთეზაზე. Quartz-ის ცნობით, პოლ ერდოშის კატალოგიდან კიდევ სამი პრობლემა იქნა გადაჭრილი.qz+2
OpenAI-მ განაცხადა, რომ მისმა ხელოვნურმა ინტელექტმა შექმნა ძირითადი მათემატიკური არგუმენტები, ხოლო მკვლევარებმა შემდგომში დააფორმალეს თითოეული მტკიცებულება Lean-ის დამხმარე პროგრამის გამოყენებით. GitHub-ის რეპოზიტორში "sorry"-ს რაოდენობა, რაც დაუმოწმებელი ნაბიჯების მაჩვენებელია, ნულის ტოლია, რაც ნიშნავს, რომ ყველა ლოგიკური ნაბიჯი მანქანურად არის შემოწმებული.qz
ფორმალური ვერიფიკაციის მიუხედავად, კრიტიკოსები ეჭვქვეშ აყენებენ, წარმოადგენს თუ არა ეს შედეგები ხელოვნური ინტელექტის შესაძლებლობების ნამდვილ ნახტომს. ცნობილმა მკვლევარმა გარი მარკუსმა დაწერა, რომ Anthropic-ის მათემატიკოსმა, ლევენტ ალპოგემ, შეძლო OpenAI-ის შედეგების ნახევრის ნაწილობრივი რეპლიკაცია 24 საათში, უკვე საჯაროდ ხელმისაწვდომი მოდელის, Fable-ის გამოყენებით. მარკუსი ამტკიცებს, რომ ეს აჩენს ეჭვებს, არის თუ არა Astra თავად გარღვევა, თუ პროგრესი მდგომარეობს იმის იდენტიფიცირებაში, თუ რომელი პრობლემებია შესაფერისი ძიებისა და ვერიფიკაციის ტექნიკებისთვის.garymarcus.substack
"OpenAI არ აცხადებს, თუ რომელი პრობლემების გადაჭრა სცადეს და ვერ შეძლეს. მათ მოგვცეს მრიცხველი მნიშვნელის გარეშე, რაც ყოველთვის საგანგაშო ნიშანია," წერს მარკუსი. მან ასევე აღნიშნა, რომ OpenAI-ს ჯერ არ გადაუწყვეტია, უწოდოს Astra-ს GPT-6 თუ GPT-5.7, რაც მიანიშნებს, რომ შიდა დონეზე ეს ნახტომი შესაძლოა ინკრემენტულად მიიჩნეოდეს.garymarcus.substack
ACM-ის ბლოგმა 4 აგვისტოს გამოაქვეყნა ანალიზი, სადაც Astra-ს "საოცარი, მაგრამ საგრძნობლად გადაჭარბებული" უწოდა. ამასობაში, ლეიდენის დეკლარაციამ მათემატიკაში ხელოვნური ინტელექტის შესახებ, რომელსაც ხელი მოაწერა ასობით მათემატიკოსმა 2026 წლის ივნისში, ყურადღება გაამახვილა ხელოვნური ინტელექტის მიერ გენერირებული მტკიცებულებების არასანდოობასა და ავტორობის საკითხებზე.analyticsinsight+1
OpenAI-ს არ გამოუცხადებია Astra-ს გამოშვების თარიღი და მოდელმა მომხმარებლებამდე მისვლამდე უნდა გაიაროს ფედერალური უსაფრთხოების შემოწმება. კომპანიამ აღიარა დებატები და განაცხადა, რომ "ღრმა პატივისცემითა და გაგებით ეკიდება მათ, ვინც შეშფოთებულია მისი გავლენით" და გეგმავს მეთოდოლოგიის გამოქვეყნებას. OpenAI-მ ასევე ცოტა ხნის წინ გაუშვა ChatGPT აკადემიური მკვლევრებისთვის, რაც 100 000 მეცნიერს აძლევს უფასო წვდომას მის უახლეს მოდელებზე.analyticsinsight+1
მათემატიკოსმა ტერენს ტაომ, 26 ივლისის ლექციაში, რომელსაც მარკუსი ეყრდნობა, გაავლო ზღვარი იზოლირებული ღია პრობლემების გადაჭრასა და მათემატიკური თეორიის აგებას შორის, სადაც ხელოვნური ინტელექტის შესაძლებლობების არანაირი მტკიცებულება ჯერ არ არსებობს.garymarcus.substack