Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

qz+1garymarcus.substackcacm.acm+1Rugpjūčio 1 d. „OpenAI“ paskelbė, kad jos neišleista „Astra“ modelių šeima pateikė sprendimus 10 ilgai neišspręstų matematikos ir teorinės informatikos problemų, „GitHub“ paskelbdama 249 puslapių rankraštį ir visiškai patikrintus „Lean 4“ įrodymų sertifikatus. Rezultatai apima tokias sritis kaip aukštesnių matmenų geometrija, kodavimo teorija, grupių teorija, kvantinis sudėtingumas ir ekstremali kombinatorika, o bendrovė nurodė, kad bendros skaičiavimo sąnaudos siekė apie 2000 JAV dolerių pagal „GPT-5.6 Sol“ API įkainius.ndtv+2
Remiantis „OpenAI“ tinklaraščio įrašu, „Astra“ padarė pažangą sferų pakavimo ribų, klaidų taisymo kodų ir pirmosios aiškios „non-sofic“ grupės konstrukcijos srityse – tai struktūra, kuri liko atviru klausimu nuo 1999 m. Modelis taip pat įrodė kvantinės lygiagrečios pakartojimo teoremą bendriems dviejų žaidėjų susietiems žaidimams ir pateikė rezultatų apie Ehrharto tūrio spėjimą bei Connes standumo spėjimą. Pasak „Quartz“ pranešimų, taip pat buvo išspręstos trys papildomos problemos iš Paulo Erdőso katalogo.qz+2
„OpenAI“ teigė, kad jos dirbtinis intelektas sugeneravo pagrindinius matematinius argumentus, o tyrėjai vėliau formalizavo kiekvieną įrodymą naudodami „Lean“ įrodymų asistentą. „GitHub“ saugykloje „sorry“ skaičius, rodantis nepatikrintus veiksmus, yra lygus nuliui, o tai reiškia, kad kiekvienas loginis žingsnis visuose dešimtyje įrodymų yra patikrintas mašininiu būdu.qz
Nepaisant formalaus patikrinimo, kritikai suabejojo, ar rezultatai rodo tikrą dirbtinio intelekto galimybių šuolį. Žinomas DI tyrėjas Gary Marcus rašė, kad „Anthropic“ matematikas Leventas Alpöge sugebėjo iš dalies pakartoti pusę „OpenAI“ rezultatų per 24 valandas naudodamas „Fable“ – jau viešai išleistą modelį. Marcus teigė, kad tai kelia abejonių, ar pati „Astra“ yra proveržis, ar pažanga slypi gebėjime nustatyti, kurios problemos yra tinkamos paieškos ir patikrinimo metodams.garymarcus.substack
„OpenAI“ nepraneša, su kokiomis problemomis jie bandė susidoroti ir patyrė nesėkmę. Jie pateikė skaitiklį be vardiklio, o tai visada yra nerimą keliantis ženklas“, – rašė Marcus. Jis taip pat pažymėjo, kad „OpenAI“ dar nenusprendė, ar „Astra“ vadinti „GPT-6“, ar „GPT-5.7“, užsimindamas, kad viduje šis šuolis gali būti laikomas laipsnišku.garymarcus.substack
Rugpjūčio 4 d. ACM „Communications“ tinklaraštyje buvo paskelbta analizė, kurioje „Astra“ apibūdinta kaip „nuostabi, bet smarkiai pervertinta“. Tuo tarpu 2026 m. birželį šimtų matematikų pasirašytoje Leideno deklaracijoje dėl DI matematikoje buvo iškeltas susirūpinimas dėl nepatikimų DI sugeneruotų įrodymų ir autorystės.analyticsinsight+1
„OpenAI“ nepaskelbė „Astra“ išleidimo datos, ir modelis turės gauti federalinį DI saugos patvirtinimą, kol pasieks vartotojus. Bendrovė pripažino diskusijas, teigdama, kad „jaučia didelę pagarbą ir supratimą tiems, kurie nerimauja dėl jos poveikio“, ir planuoja paskelbti savo metodiką. „OpenAI“ taip pat neseniai pristatė „ChatGPT for Academic Researchers“, suteikdama 100 000 mokslininkų nemokamą prieigą prie naujausių modelių.analyticsinsight+1
Matematikas Terence'as Tao liepos 26 d. paskaitoje, kurią citavo Marcus, nubrėžė ribą tarp atskirų atvirų problemų sprendimo, kur DI atrodo stiprus, ir matematinės teorijos kūrimo, kur kol kas nėra jokių įrodymų apie DI galimybes.garymarcus.substack