Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

insideai+1arxiv+1techxplore+1Vísindamenn við MIT, Boston University og barnaverndarsamtökin Thorn hafa kynnt tækni sem getur greint hvort opið gervigreindarlíkan hafi verið fínstillt til að framleiða kynferðislegt efni með börnum, án þess að búa til eina einustu mynd. Aðferðin, sem kallast Gaussian probing, náði 100% nákvæmni við að bera kennsl á CSAM-sérhæfð líkanaafbrigði við prófanir, samkvæmt niðurstöðum sem birtar voru í grein á arXiv og Tech Xplore greindi frá á mánudaginn.insideai+1
Tæknin tekur á lagalegri og hagnýtri þversögn: samkvæmt bandarískum lögum er það ólöglegt að reyna að búa til CSAM — jafnvel í þeim tilgangi að prófa hvort líkan geti framleitt það. Þetta hefur skilið hýsingarvettvanga eftir með fá tæki til að skima léttar líkanabreytingar, þekktar sem LoRA-millistykki, sem notendur hlaða upp og deila opinberlega.
Gaussian probing kemst hjá þörfinni á myndsköpun algjörlega. Í stað þess að gefa líkani fyrirmæli og skoða úttak þess, sendir aðferðin handahófskenndan Gaussian-hávaða — upprunalegan upphafspunkt fyrir myndskapandi dreifingarlíkön — í gegnum aðlagaða líkanið og skráir hvernig innri lög þess bregðast við. Með því að greina þessi innri virkjunarmynstur getur flokkari ákvarðað hvort millistykkið hafi verið þjálfað á skaðlegu efni.arxiv+1
„Það er gríðarlegur fjöldi barnaverndaráhyggja“ tengdur vistkerfum líkana með opnum þyngdum, bentu vísindamennirnir á, og vísuðu til vettvanga eins og CivitAI sem greina frá hundruðum þúsunda nýrra LoRA-millistykki sem hlaðið er upp í hverjum mánuði. Aðferðin er hönnuð til að vera nógu sveigjanleg fyrir dreifingu á vettvangsstigi og krefst aðeins staðlaðra framvirkra skrefa í gegnum líkanið án þess að þurfa fyrirmælahönnun eða mannlega yfirferð á úttaki.techxplore+1
Rannsóknin kemur í kjölfar aukningar á gervigreindarframleiddu CSAM. National Center for Missing and Exploited Children fékk 67.000 skýrslur um gervigreindarframleitt CSAM árið 2024, samanborið við 4.700 árið áður, samkvæmt greininni. Skýrsla Internet Watch Foundation frá 2026 skráði 3.443 gervigreindarframleidd myndbönd af kynferðislegu ofbeldi gegn börnum sem greindust árið 2025, samanborið við aðeins 13 árið áður.casescan+1
Vísindamennirnir prófuðu aðferð sína á þremur líkanauppbyggingum — Stable Diffusion 1.5, SDXL 1.0 og FLUX.1-dev — með því að nota CSAM-sérhæfð LoRA sem nálgast var í gegnum viðurkennda aðila í samræmi við gildandi lög. Gaussian probing flokkaði rétt öll CSAM-sérhæfð líkön á meðan það hélt lágum hlutföllum rangra jákvæðra niðurstaðna, og reyndist öflugt gegn andstæðum meðferðaraðferðum eins og vigtarendurkvörðun sem sigruðu aðrar greiningaraðferðir.arxiv+1
Greinin var skrifuð af Vinith Suriyakumar og Ashia Wilson frá MIT, ásamt vísindamönnum frá Thorn og Boston University.arxiv+1