Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

insideai+1arxiv+1techxplore+1MIT-ի, Բոստոնի համալսարանի և երեխաների անվտանգության Thorn կազմակերպության հետազոտողները ներկայացրել են մի տեխնիկա, որը կարող է պարզել, թե արդյոք բաց կոդով AI մոդելը հարմարեցվել է երեխաների սեռական բռնության նյութեր (CSAM) արտադրելու համար՝ առանց որևէ պատկեր ստեղծելու: Gaussian probing կոչվող մեթոդը թեստավորման ընթացքում 100% ճշգրտությամբ հայտնաբերել է CSAM-ի վրա մասնագիտացված մոդելների տարբերակները, ըստ arXiv-ում հրապարակված և երկուշաբթի օրը Tech Xplore-ի կողմից հաղորդված տվյալների:insideai+1
Տեխնիկան լուծում է իրավական և գործնական պարադոքսը. ԱՄՆ օրենսդրությամբ CSAM ստեղծելու փորձը, նույնիսկ մոդելի հնարավորությունները ստուգելու նպատակով, ինքնին անօրինական է: Սա հոսթինգային հարթակներին թողել է սակավաթիվ գործիքներ՝ ստուգելու մոդելի թեթև ձևափոխումները, որոնք հայտնի են որպես LoRA ադապտերներ, որոնք օգտատերերը հրապարակայնորեն վերբեռնում և տարածում են:
Gaussian probing-ը լիովին շրջանցում է պատկերների ստեղծման անհրաժեշտությունը: Մոդելին հուշում տալու և դրա արդյունքները ստուգելու փոխարեն, մեթոդը հարմարեցված մոդելի միջով անցկացնում է պատահական գաուսյան աղմուկ՝ պատկերներ ստեղծող դիֆուզիոն մոդելների ելակետը, և գրանցում, թե ինչպես են արձագանքում դրա ներքին շերտերը: Ներքին ակտիվացման այս օրինաչափությունները վերլուծելով՝ դասակարգիչը կարող է որոշել, թե արդյոք ադապտերը վարժեցվել է վնասակար բովանդակության վրա:arxiv+1
«Երեխաների անվտանգության հետ կապված հսկայական խնդիրներ կան» բաց կշռով մոդելների էկոհամակարգերում, նշել են հետազոտողները՝ մատնանշելով CivitAI-ի նման հարթակները, որոնք հաղորդում են ամսական հարյուր հազարավոր նոր LoRA ադապտերների վերբեռնման մասին: Մոտեցումը նախագծված է հարթակի մակարդակով տեղակայման համար և պահանջում է միայն ստանդարտ ուղիղ անցումներ մոդելի միջով՝ առանց հուշումների նախագծման կամ արդյունքների մարդկային վերանայման:techxplore+1
Հետազոտությունը հրապարակվել է AI-ի կողմից ստեղծված CSAM-ի աճի ֆոնին: Ըստ զեկույցի՝ Անհետ կորած և շահագործվող երեխաների ազգային կենտրոնը 2024 թվականին ստացել է AI-ի կողմից ստեղծված CSAM-ի 67,000 հաղորդում՝ նախորդ տարվա 4,700-ի դիմաց: Internet Watch Foundation-ի 2026 թվականի զեկույցը փաստագրել է 2025 թվականին հայտնաբերված 3,443 AI-ի կողմից ստեղծված երեխաների սեռական բռնության տեսանյութեր՝ նախորդ տարվա ընդամենը 13-ի դիմաց:casescan+1
Հետազոտողները փորձարկել են իրենց մեթոդը երեք մոդելային ճարտարապետությունների վրա՝ Stable Diffusion 1.5, SDXL 1.0 և FLUX.1-dev՝ օգտագործելով CSAM-ի վրա մասնագիտացված LoRA-ներ, որոնք ձեռք են բերվել լիազորված անձանց միջոցով՝ գործող օրենսդրությանը համապատասխան: Gaussian probing-ը ճիշտ է դասակարգել CSAM-ի վրա մասնագիտացված բոլոր մոդելները՝ պահպանելով կեղծ դրական արդյունքների ցածր մակարդակը և ապացուցելով կայունությունը այնպիսի մանիպուլյատիվ տեխնիկաների նկատմամբ, ինչպիսին է քաշի վերամասշտաբավորումը, որը հաղթահարել էր հայտնաբերման այլընտրանքային մեթոդները:arxiv+1
Հոդվածի համահեղինակներն են MIT-ի Վինիթ Սուրիակումարը և Աշիա Ուիլսոնը՝ Thorn-ի և Բոստոնի համալսարանի հետազոտողների հետ միասին:arxiv+1