Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

newscientist.fortune.newscientist.Matematikçiler, OpenAI'ın 6 Ekim'de yayınladığı yapay zeka tarafından üretilmiş büyük bir kanıt grubunu inceliyor ve şu ana kadar buldukları bazı noktalar şüphe uyandırıyor. Cambridge araştırmacıları tarafından yönetilen bir ekip, şirketin daha önceki Navier-Stokes kanıtının insan tarafından okunabilir versiyonu ile bilgisayar tarafından kontrol edilebilir versiyonunun birbiriyle uyuşmadığını söylüyor.newscientist
Ekim ayındaki sürüm, uzun süredir çözülemeyen problemler üzerine 372 "sonuç ailesi" halinde gruplandırılmış 722 makaleyi içeriyordu. Bunların tamamı, yayınlanmamış bir dahili model tarafından üretildi. OpenAI, modelin her bir çözüm üzerinde ortalama üç saatlik bir işlem süresi harcadığını belirtti. Bu yayın, OpenAI'ın Clay Matematik Enstitüsü'nün Milenyum Ödülü Problemleri'nden biri olan Navier-Stokes problemini çözdüğünü açıklamasından haftalar sonra geldi. Şirket, yeni grubun üç Milenyum probleminde daha ilerleme kaydettiğini ancak bunları tam olarak çözmediğini belirtiyor.axios+1
OpenAI, Navier-Stokes kanıtını iki biçimde yayınladı. Biri, matematikçilerin kullandığı İngilizce ve sembollerin karışımı olan "doğal dilde" yazılmıştı. Diğeri ise bilgisayarın her mantıksal adımı kontrol etmesini sağlayan bir programlama dili olan Lean dilindeydi. New Scientist'e göre, Cambridge Üniversitesi'nden Anders Hansen ve meslektaşları, iki versiyonun 8.6 numaralı önermede ayrıştığını buldu. Yazılı kanıt, bir değerin m + 4'ün altında kalmasını gerektiriyor. Lean versiyonu ise bunun m + 5'in altında kalmasını gerektiriyor ki bu daha zayıf bir koşul.newscientist
Araştırmacılar, kanıtların yanlış olduğunu söylemiyor. Endişeleri, yapay zeka bir kanıtı Lean diline çevirdiğinde ve bir kısmı derlenemediğinde, sorunu aşmak için argümanı sessizce değiştirebilmesi. Ekibin tutarsızlığı bulması yaklaşık iki hafta sürdü. OpenAI, ajanlarının kanıtları üretmek için 88 saat harcadığını belirtmişti.newscientist
"Büyük dil modelleri tarafından üretilen tüm bu kanıtlarla yapılması gereken şey, bunların insanlar tarafından okunmasıdır ve bu durum matematikçiler üzerinde muazzam bir ek yük oluşturuyor" dedi Hansen.newscientist
OpenAI, New Scientist'e uyumsuzluktan haberdar olduğunu ve bunun her iki kanıtı da geçersiz kılmadığını söyledi. Şirket, yazılı kanıtlardaki hataları bulundukça düzelteceğini ve yeni makaleleri resmileştirmeye devam edeceğini belirtti. Makalelerin sadece bir kısmı Lean kanıtlarıyla birlikte geliyor ve bu Lean kanıtları elle kontrol edilmedi. Imperial College London'dan Kevin Buzzard şunları söyledi: "Navier-Stokes probleminin doğru bir şekilde çözüldüğünden eminim. PDF'te açıklanan kanıtın doğru olduğundan ise çok daha az eminim."newscientist
Yeni sürüm hem heyecan hem de endişe yarattı. Toronto Üniversitesi'nden Dan Litt, Fortune'a "bu matematik için harika" dedi ancak yapay zekanın "matematiği çözdüğü" fikrinin insan matematiksel araştırmalarına verilen desteği zayıflatabileceği konusunda uyardı. New York Üniversitesi'nden Tristan Buckmaster, OpenAI'ın modelinin insan matematikçilerin yayınlanmamış çalışmalarından beslenmediğinden emin olup olmadığını sorguladı. The New York Times'a verdiği demeçte, "Gerekli özeni gösterdiklerini hiç sanmıyorum" dedi.fortune+1
İleri Araştırmalar Enstitüsü merkezli bağımsız bir danışma grubu, yapay zeka tarafından üretilen kanıtların nasıl yayınlanması gerektiğine dair tavsiyeler yayınlamıştı. OpenAI bunlardan bazılarına uydu ancak hepsine değil. Grup ayrıca, yapay zeka şirketlerinin kendi modellerini açık araştırma problemleri üzerinde test etmelerini desteklemediğini belirtmişti ve OpenAI bu duruşu bir kenara bırakmış görünüyor.smh+1
UCLA'den Terence Tao, Mastodon'da yaptığı paylaşımda, bu sürümün "Matematik 1.0"ın sonunu işaret ettiğini yazdı. "Ham problem çözme rolünü merkeze almayan ve matematiksel ilerlemeye daha bütünsel bir şekilde değer veren" yeni bir çağrıda bulundu.fortune