Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

qz+1garymarcus.substackcacm.acm+1OpenAI, 1 Ağustos'ta henüz yayınlanmamış Astra model ailesinin matematik ve teorik bilgisayar bilimindeki 10 uzun süreli açık probleme çözüm ürettiğini duyurdu ve 249 sayfalık bir makale ile tamamen doğrulanmış Lean 4 kanıt sertifikalarını GitHub'da paylaştı. Sonuçlar yüksek boyutlu geometri, kodlama teorisi, grup teorisi, kuantum karmaşıklığı ve ekstremal kombinatorik gibi alanları kapsıyor ve şirket toplam hesaplama maliyetinin GPT-5.6 Sol API oranlarında yaklaşık 2.000 dolar olduğunu bildirdi.ndtv+2
OpenAI'ın blog yazısına göre Astra, küre paketleme sınırları, hata düzeltme kodları ve 1999'dan beri açık bir soru olan ilk açık sofik olmayan grubun inşasında ilerlemeler kaydetti. Model ayrıca genel iki oyunculu dolaşık oyunlar için kuantum paralel tekrar teoremini kanıtladı ve Ehrhart hacim varsayımı ile Connes'in katılık varsayımı üzerine sonuçlar sundu. Quartz'ın haberine göre, Paul Erdős'un kataloğundan üç ek problem daha çözüldü.qz+2
OpenAI, yapay zekasının temel matematiksel argümanları oluşturduğunu, araştırmacıların ise daha sonra her bir kanıtı Lean kanıt asistanını kullanarak resmileştirdiğini belirtti. GitHub deposundaki doğrulanmamış adımların göstergesi olan "sorry" sayısı sıfırda duruyor, bu da on kanıtın tamamındaki her mantıksal adımın makine tarafından kontrol edildiği anlamına geliyor.qz
Resmi doğrulamaya rağmen eleştirmenler, sonuçların yapay zeka yeteneğinde gerçek bir sıçramayı temsil edip etmediğini sorguladı. Önde gelen bir yapay zeka araştırmacısı olan Gary Marcus, bir Anthropic matematikçisi olan Levent Alpöge'nin, halihazırda halka açık olan Fable modelini kullanarak OpenAI'ın sonuçlarının yarısını 24 saat içinde kısmen kopyalayabildiğini yazdı. Marcus, bunun Astra'nın kendisinin mi bir atılım olduğu yoksa ilerlemenin hangi problemlerin arama ve doğrulama tekniklerine uygun olduğunu belirlemekte mi yattığı konusunda şüpheler uyandırdığını savundu.garymarcus.substack
Marcus, "OpenAI hangi problemleri denediklerini ve başarısız olduklarını rapor etmiyor. Bize paydasız bir pay veriyorlar, bu her zaman endişe verici bir işarettir" diye yazdı. Ayrıca OpenAI'ın Astra'yı GPT-6 mı yoksa GPT-5.7 olarak mı adlandıracağına henüz karar vermediğini belirterek, kurum içinde bu sıçramanın artımlı olarak görülebileceğini öne sürdü.garymarcus.substack
ACM'nin İletişim blogu 4 Ağustos'ta Astra'yı "harika ama fazlasıyla abartılmış" olarak tanımlayan bir analiz yayınladı. Bu arada, Haziran 2026'da yüzlerce matematikçi tarafından imzalanan Matematikte Yapay Zeka üzerine Leiden Deklarasyonu, yapay zeka tarafından üretilen kanıtların güvenilmezliği ve atıf konusunda daha geniş endişeleri dile getirdi.analyticsinsight+1
OpenAI, Astra için bir çıkış tarihi açıklamadı ve modelin kullanıcılara ulaşmadan önce federal yapay zeka güvenlik incelemesini geçmesi gerekecek. Şirket, tartışmayı kabul ederek "etkisinden endişe duyanlara karşı derin bir saygı ve anlayışa sahip olduğunu" belirtti ve metodolojisini yayınlamayı planladığını ifade etti. OpenAI ayrıca kısa süre önce Akademik Araştırmacılar için ChatGPT'yi başlattı ve 100.000 bilim insanına en son modellerine ücretsiz erişim sağladı.analyticsinsight+1
Matematikçi Terence Tao, Marcus tarafından referans verilen 26 Temmuz tarihli bir konferansta, yapay zekanın güçlü göründüğü izole açık problemleri çözmek ile yapay zeka yeteneğine dair henüz hiçbir kanıtın bulunmadığı matematiksel teori oluşturmak arasında bir ayrım yaptı.garymarcus.substack