Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

qz+1garymarcus.substackcacm.acm+1Společnost OpenAI 1. srpna oznámila, že její dosud nevydaná rodina modelů Astra vyřešila 10 dlouhodobě otevřených problémů v matematice a teoretické informatice. Na GitHubu zveřejnila 249stránkový rukopis a plně ověřené certifikáty důkazů v systému Lean 4. Výsledky pokrývají oblasti, jako je vícerozměrná geometrie, teorie kódování, teorie grup, kvantová složitost a extrémní kombinatorika, přičemž společnost uvedla, že celkové náklady na výpočetní výkon činily přibližně 2 000 dolarů při sazbách API GPT-5.6 Sol.ndtv+2
Podle blogového příspěvku OpenAI dosáhla Astra pokroku v mezích pro balení koulí, samoopravných kódech a konstrukci první explicitní non-sofic grupy, což byla struktura, která zůstávala otevřenou otázkou od roku 1999. Model také dokázal teorém o kvantové paralelní repetici pro obecné hry dvou hráčů se zapletením a přinesl výsledky týkající se Ehrhartovy domněnky o objemu a Connesovy domněnky o tuhosti. Podle zpráv serveru Quartz byly vyřešeny i tři další problémy z katalogu Paula Erdőse.qz+2
OpenAI uvedla, že její umělá inteligence vygenerovala základní matematické argumenty, zatímco výzkumníci následně každý důkaz formalizovali pomocí asistenta Lean. Počet "sorry" v repozitáři na GitHubu, což je indikátor neověřených kroků, je nulový, což znamená, že každý logický krok ve všech deseti důkazech je strojově ověřen.qz
Navzdory formálnímu ověření kritici zpochybňují, zda výsledky představují skutečný skok v schopnostech AI. Gary Marcus, významný výzkumník v oblasti AI, napsal, že matematik ze společnosti Anthropic, Levent Alpöge, dokázal polovinu výsledků OpenAI částečně replikovat během 24 hodin pomocí modelu Fable, který je již veřejně dostupný. Marcus argumentoval, že to vyvolává pochybnosti o tom, zda je průlomem samotná Astra, nebo zda pokrok spočívá v identifikaci problémů, které jsou přístupné technikám vyhledávání a ověřování.garymarcus.substack
"OpenAI neuvádí, o které problémy se pokusili a neuspěli. Dali nám čitatele bez jmenovatele, což je vždy znepokojivé znamení," napsal Marcus. Poznamenal také, že OpenAI se zatím nerozhodla, zda Astru označí jako GPT-6 nebo GPT-5.7, což naznačuje, že interně může být tento skok považován za postupný.garymarcus.substack
Blog Communications asociace ACM publikoval 4. srpna analýzu, která Astru popisuje jako "úžasnou, ale značně nadhodnocenou". Mezitím Leidenské prohlášení o AI v matematice, které v červnu 2026 podepsaly stovky matematiků, upozornilo na širší obavy ohledně nespolehlivých důkazů generovaných AI a otázek autorství.analyticsinsight+1
OpenAI zatím neoznámila datum vydání modelu Astra a model bude muset projít federální kontrolou bezpečnosti AI, než se dostane k uživatelům. Společnost debatu uznala s tím, že má "hluboký respekt a pochopení pro ty, kteří se obávají jejího dopadu", a plánuje zveřejnit svou metodiku. OpenAI také nedávno spustila ChatGPT pro akademické výzkumníky, čímž poskytla 100 000 vědcům bezplatný přístup ke svým nejnovějším modelům.analyticsinsight+1
Matematik Terence Tao v přednášce z 26. července, na kterou Marcus odkazoval, rozlišil mezi řešením izolovaných otevřených problémů, kde se AI jeví jako silná, a budováním matematické teorie, kde zatím neexistují žádné důkazy o schopnostech AI.garymarcus.substack