Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

wiredwiredlinkedinՀետազոտողների թիմը մշակել է տեխնիկա, որը թույլ է տալիս դուրս բերել առաջատար AI մոդելների թաքնված տրամաբանական հետքերը: Սա վկայում է այն մասին, որ չինական առնվազն մեկ AI համակարգ կարող էր մարզվել ամերիկյան գործընկերների գիտելիքների դիստիլյացիայի միջոցով, թեև հետազոտողներն ընդգծում են, որ իրենց բացահայտումները վերջնական ապացույց չեն հանդիսանում:
Տյուբինգենի համալսարանի, Մաքս Պլանկի ինստիտուտի, MATS Research անվտանգության կազմակերպության և Snyk կիբերանվտանգության ընկերության համակարգչային գիտնականները հայտնաբերել են խոցելիություն OpenAI, Anthropic և Google Alphabet Inc. ընկերությունների մոդելներում: Այն թույլ է տալիս դուրս բերել թաքնված տրամաբանական քայլերը, այսինքն՝ այն մանրամասն մտածողության ընթացքը, որն օգտագործում են այդ համակարգերը բարդ խնդիրներ լուծելու համար:wired
«Մեր ուսումնասիրած բոլոր առաջատար մոդելներն ունեն այս խոցելիությունը», — ասել է Տյուբինգենի համալսարանի համակարգչային գիտնական Ալեքսանդր Պանֆիլովը, որը մասնակցել է հետազոտությանը: «Սա կարող է հանգեցնել անձնական տվյալների արտահոսքի և նպաստում է լայնածավալ տրամաբանական դիստիլյացիայի հարձակումներին»:wired
Իրենց աշխատության մեջ հետազոտողները ցույց են տալիս, որ Moonshot AI-ի Kimi K3 մոդելը որոշակի հարցումների դեպքում ստեղծում է Claude Opus 4.8-ի և GPT 5.6 Sol-ի թաքնված տրամաբանական հետքերին «զարմանալիորեն նման» արդյունքներ: Այնուամենայնիվ, նրանք զգուշացնում են, որ իրենց աշխատանքը «չի կարող պատճառահետևանքային կապով հաստատել դիստիլյացիան»: Հետազոտողները նաև պարզել են, որ երկու այլ մոդելներ՝ չինական DeepSeek-ը և ամերիկյան Thinking Machines ընկերության Inkling-ը, չեն ցուցադրել նույն տրամաբանական նմանությունը Claude Opus-ի հետ:wired
Դիստիլյացիայի հարցից դուրս, տեխնիկան բացահայտել է անվտանգության խոցելիություն, որը կարող է օգտագործվել մոդելի ներքին տրամաբանությունից գաղտնի տեղեկատվություն, օրինակ՝ գաղտնաբառեր և API բանալիներ ստանալու համար: Պանֆիլովը և նրա համահեղինակները զգուշացրել են OpenAI-ին, Anthropic-ին և Google-ին այս խնդրի մասին, և յուրաքանչյուր ընկերություն կարգավորել է իր API-ն՝ խնդիրը մեղմելու համար: Թեև գաղտնի տեղեկատվության դուրսբերումն այլևս հնարավոր չէ, Պանֆիլովը նշել է, որ որոշ տրամաբանական հետքեր դեռ կարող են բացահայտվել այս մեթոդով, և դիստիլյացիայի ռիսկը լիովին վերացնելու համար կպահանջվի «հիմնարար վերանայում այն բանի, թե ինչպես են աշխատում այդ ընկերությունների API-ները»:linkedin
Այս բացահայտումները տեղի են ունենում ամերիկյան և չինական ընկերությունների միջև AI դիստիլյացիայի շուրջ շարունակվող լարվածության ֆոնին: 2026 թվականի փետրվարին Anthropic-ը և OpenAI-ը հրապարակեցին չինական AI ընկերությունների կողմից իրականացվող համակարգված դիստիլյացիայի արշավների ապացույցներ: Ավելի ուշ, երբ Moonshot AI-ն հուլիսին թողարկեց Kimi K3-ը, Սպիտակ տան գիտական խորհրդական Մայքլ Կրացիոսը ընկերությանը մեղադրեց Anthropic-ի տեխնոլոգիան պատճենելու մեջ: Անկախ փորձագետները, սակայն, կասկածի տակ են դրել, թե արդյոք Claude-ի հրապարակային թողարկման և Kimi K3-ի գործարկման միջև ընկած ժամանակահատվածը բավարար էր այդ պնդումը հիմնավորելու համար:iaps+2
Պանֆիլովի թիմի նոր հետազոտությունը տեխնիկական հարթություն է ավելացնում բանավեճին՝ առաջարկելով մեթոդ, որը սկզբունքորեն կարող է մասշտաբով հայտնաբերել դիստիլյացիան, միաժամանակ ընդգծելով, թե ինչպես նույն թափանցիկության գործիքները, որոնք նպաստում են AI անվտանգությանը, կարող են նաև մոդելները ենթարկել մրցակցային արտահանման վտանգին: