Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

unite+1unitecryptobriefing+1Չորեքշաբթի օրը OpenAI-ն թողարկեց MentalHealthBench-ը՝ հոգեկան առողջության 1,215 սինթետիկ զրույցներից բաղկացած բաց չափանիշ, որը ստեղծվել է ավելի քան 80 լիցենզավորված մասնագետների հետ՝ չափելու համար, թե ինչպես են AI մոդելները արձագանքում տարբեր սցենարների՝ ամենօրյա սթրեսից մինչև հրատապ ճգնաժամեր:unite+1
Չափանիշը, որը OpenAI-ը նկարագրում է որպես գոյություն ունեցող գնահատումների բացը լրացնող, որոնք հիմնականում կենտրոնանում են արտակարգ իրավիճակների վրա, ստեղծվել է 22 երկրների լիցենզավորված հոգեբանների և հոգեբույժների կողմից, ովքեր խոսում են 19 լեզուներով և ներկայացնում են հոգեկան առողջության գրեթե 20 ենթամասնագիտություններ: Տվյալների բազան ներառում է 5,262 փորձագիտական չափանիշ, և յուրաքանչյուր զրույց վերանայվել է առնվազն երեք կլինիցիստի կողմից:openai+1
MentalHealthBench-ը ընդգրկում է ոչ սուր ամենօրյա զրույցներ (53.5%), հոգեկան առողջության լուրջ խնդիրներին վերաբերող բարձր սրության զրույցներ (18.2%) և արտակարգ իրավիճակներ, որոնք պահանջում են անվտանգության անհապաղ միջամտություն (28.3%): Ներկայացված է օգտատերերի չորս պրոֆիլ՝ մեծահասակներ (68.1%), դեռահասներ (21.2%), կլինիցիստներ (5.8%) և խնամակալներ (4.9%):unite+1
«Հոգեկան առողջությունը գոյություն ունի շարունակականության մեջ՝ ծաղկումից մինչև ամենօրյա սթրես և սուր ճգնաժամ», — ասել է Ամերիկյան հոգեբանական ասոցիացիայի գործադիր տնօրեն դոկտոր Արթուր Էվանսը OpenAI-ի հայտարարության մեջ: «AI համակարգերը, որոնք ներգրավում են մարդկանց այդ տիրույթում, պետք է հիմնված լինեն ինչպես կլինիկական գիտության, այնպես էլ կենսափորձի վրա»:openai
Յուրաքանչյուր չափանիշ ունի -10-ից +10 կշիռ, որտեղ դրական միավորները խրախուսում են օգտակար վարքագիծը, իսկ բացասականները՝ պատժում վնասակարը: Ավտոմատ գնահատողը՝ GPT-5.6 Sol-ը, գնահատում է մոդելի պատասխանները փորձագետների կողմից գրված չափանիշների համաձայն:unite+1
OpenAI-ի գնահատմամբ՝ GPT-6 Astra-ն հավաքել է ամենաբարձր՝ 57.3% միավորը, որին հաջորդում են GPT-6 Sol-ը՝ 53.9%-ով, Claude Opus 5.5-ը՝ 52.4%-ով և GPT-6 Luna-ն՝ 50.2%-ով: Ավելի հին մոդելները ավելի ցածր միավորներ են ստացել, GPT-4o-ն՝ 32.1%, իսկ Google-ի Alphabet Inc.-ի Gemini 2.5 Pro-ն՝ 29.5%:cryptobriefing+1
Առանձին վերլուծությունը, որին մասնակցել են 16 երկրների 44 մեծահասակներ, ովքեր օգտագործել են AI-ն հոգեկան առողջության աջակցության համար, ցույց է տվել, որ օգտատերերի և փորձագետների արժեքները տարբերվում են. օգտատերերը շեշտը դնում են գործնական քայլերի և տոնայնության վրա, մինչդեռ կլինիցիստները առաջնահերթություն են տալիս համատեքստի հավաքագրմանը և երկիմաստ իրավիճակների մեկնաբանմանը:unite+1
Չափանիշի հետ մեկտեղ OpenAI-ը մատնանշել է անվտանգության մի շարք միջոցառումներ, որոնք ներդրվել են վերջին ամիսներին, ներառյալ ChatGPT-ի ուժեղացված պատասխանները զգայուն զրույցներում, տեղական ճգնաժամային թեժ գծերի հասանելիության ընդլայնումը, մայիսին ներկայացված Trusted Contact գործառույթը, որը ծանուցում է նշանակված անձին, եթե հայտնաբերվում են ինքնավնասման լուրջ մտահոգություններ, և ChatGPT-ն դեռահասների համար, որը ներառում է պաշտպանություն այնպիսի ոլորտներում, ինչպիսիք են ինքնավնասումը և սննդային խանգարումները: OpenAI-ն ընդգծել է, որ ChatGPT-ն թերապիայի կամ մասնագիտական խնամքի փոխարինող չէ:openai+2