Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

qz+1garymarcus.substackcacm.acm+1Օգոստոսի 1-ին OpenAI-ը հայտարարեց, որ իր չթողարկված Astra մոդելների ընտանիքը լուծել է մաթեմատիկայի և տեսական համակարգչային գիտության 10 վաղեմի բաց խնդիրներ՝ GitHub-ում հրապարակելով 249-էջանոց ձեռագիր և Lean 4-ի լիովին ստուգված ապացույցների վկայագրեր: Արդյունքները ընդգրկում են այնպիսի ոլորտներ, ինչպիսիք են բարձր չափականության երկրաչափությունը, կոդավորման տեսությունը, խմբերի տեսությունը, քվանտային բարդությունը և ծայրահեղ կոմբինատորիկան, ընդ որում ընկերությունը հաշվարկային ընդհանուր արժեքը գնահատել է մոտ 2000 դոլար՝ GPT-5.6 Sol API-ի սակագներով:ndtv+2
OpenAI-ի բլոգային գրառման համաձայն՝ Astra-ն առաջընթաց է գրանցել գնդերի փաթեթավորման սահմանների, սխալների ուղղման կոդերի և առաջին բացահայտ ոչ-սոֆիկ խմբի կառուցման մեջ, որը 1999 թվականից մնում էր բաց հարց: Մոդելը նաև ապացուցել է քվանտային զուգահեռ կրկնության թեորեմը ընդհանուր երկխաղացող խճճված խաղերի համար և արդյունքներ է տվել Էրհարթի ծավալի վարկածի և Կոննեսի կոշտության վարկածի վերաբերյալ: Quartz-ի հաղորդմամբ՝ լուծվել են նաև Պոլ Էրդյոշի կատալոգից ևս երեք խնդիրներ:qz+2
OpenAI-ը հայտարարել է, որ իր արհեստական բանականությունը ստեղծել է հիմնական մաթեմատիկական փաստարկները, մինչդեռ հետազոտողները հետագայում ձևակերպել են յուրաքանչյուր ապացույց՝ օգտագործելով Lean ապացույցների օգնականը: GitHub-ի պահոցում «sorry»-ների քանակը, որը չստուգված քայլերի ցուցանիշ է, հավասար է զրոյի, ինչը նշանակում է, որ բոլոր ապացույցների յուրաքանչյուր տրամաբանական քայլ մեքենայական ստուգում է անցել:qz
Չնայած պաշտոնական ստուգմանը՝ քննադատները կասկածի տակ են դնում, թե արդյոք արդյունքները ներկայացնում են արհեստական բանականության կարողությունների իրական թռիչք: ԱԲ-ի հայտնի հետազոտող Գերի Մարկուսը գրել է, որ Anthropic-ի մաթեմատիկոս Լևենտ Ալպյոգեն կարողացել է 24 ժամվա ընթացքում մասամբ կրկնել OpenAI-ի արդյունքների կեսը՝ օգտագործելով Fable-ը՝ արդեն հրապարակայնորեն թողարկված մոդելը: Մարկուսը պնդում է, որ դա կասկածներ է հարուցում այն մասին, թե արդյոք Astra-ն ինքնին բեկումնային է, թե՞ առաջընթացը կայանում է նրանում, որ պարզվել է, թե որ խնդիրներն են հարմար որոնման և ստուգման տեխնիկաների համար:garymarcus.substack
«OpenAI-ը չի հայտնում, թե որ խնդիրներն են փորձել և ձախողել: Նրանք մեզ տվել են համարիչ առանց հայտարարի, ինչը միշտ անհանգստացնող նշան է», գրել է Մարկուսը: Նա նաև նշել է, որ OpenAI-ը դեռ չի որոշել՝ Astra-ն անվանել GPT-6, թե GPT-5.7, ինչը հուշում է, որ ներքին մակարդակում այս թռիչքը կարող է համարվել աստիճանական:garymarcus.substack
ACM-ի բլոգը օգոստոսի 4-ին հրապարակել է վերլուծություն, որտեղ Astra-ն նկարագրել է որպես «հիանալի, բայց խիստ չափազանցված»: Միևնույն ժամանակ, մաթեմատիկայում ԱԲ-ի վերաբերյալ Լեյդենի հռչակագիրը, որը ստորագրվել է հարյուրավոր մաթեմատիկոսների կողմից 2026 թվականի հունիսին, մտահոգություններ է հայտնել ԱԲ-ի կողմից ստեղծված ապացույցների անվստահելիության և հեղինակության վերաբերյալ:analyticsinsight+1
OpenAI-ը չի հայտարարել Astra-ի թողարկման ամսաթիվը, և մոդելը օգտատերերին հասանելի դառնալուց առաջ պետք է անցնի դաշնային անվտանգության ստուգում: Ընկերությունը ընդունել է բանավեճը՝ հայտարարելով, որ «խորին հարգանքով և ըմբռնումով է վերաբերվում նրանց, ովքեր մտահոգված են դրա ազդեցությամբ» և նախատեսում է հրապարակել իր մեթոդաբանությունը: OpenAI-ը նաև վերջերս գործարկել է ChatGPT-ն ակադեմիական հետազոտողների համար՝ 100,000 գիտնականների տրամադրելով անվճար մուտք իր վերջին մոդելներին:analyticsinsight+1
Մաթեմատիկոս Տերենս Տաոն հուլիսի 26-ի դասախոսության մեջ, որին հղում է կատարել Մարկուսը, տարբերակել է մեկուսացված բաց խնդիրների լուծումը, որտեղ ԱԲ-ն ուժեղ է թվում, և մաթեմատիկական տեսության կառուցումը, որտեղ ԱԲ-ի կարողությունների որևէ ապացույց դեռ գոյություն չունի:garymarcus.substack