Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

wiredwiredlinkedinRannsóknarteymi hefur þróað tækni til að draga út falin röksemdafærsluferli úr helstu gervigreindarlíkönum, sem bendir til þess að að minnsta kosti eitt kínverskt gervigreindarkerfi gæti hafa verið þjálfað með því að eima innsýn frá bandarískum hliðstæðum, þótt vísindamennirnir leggi áherslu á að niðurstöðurnar séu ekki endanleg sönnun.
Tölvunarfræðingar frá háskólanum í Tübingen, Max Planck stofnuninni, gervigreindaröryggissamtökunum MATS Research og netöryggisfyrirtækinu Snyk uppgötvuðu veikleika í líkönum frá OpenAI, Anthropic og Google Alphabet Inc. sem gerir kleift að draga út falin röksemdafærsluskref, það er ítarleg ferli sem þessi kerfi nota til að leysa flókin verkefni.wired
"Allir helstu veitendur gervigreindarlíkana sem við skoðuðum sýna þennan veikleika," sagði Alexander Panfilov, tölvunarfræðingur við háskólann í Tübingen sem tók þátt í rannsókninni. "Þetta gæti leitt til leka á persónuupplýsingum og auðveldar stórfelldar árásir þar sem röksemdafærslur eru eimaðar."wired
Í grein sinni sýna vísindamennirnir fram á að Kimi K3, opið líkan frá Moonshot AI, skilar úttaki sem er "ótrúlega líkt" falnum röksemdafærslum Claude Opus 4.8 og GPT 5.6 Sol fyrir ákveðnar skipanir. Þeir vara þó við því að vinna þeirra "geti ekki sannað orsakasamhengi við eimingu." Vísindamennirnir komust einnig að því að tvö önnur opin líkön, DeepSeek frá Kína og Inkling frá bandaríska fyrirtækinu Thinking Machines, sýndu ekki sömu líkindi í röksemdafærslum og Claude Opus.wired
Fyrir utan spurninguna um eimingu leiddi tæknin í ljós öryggisveikleika sem gæti verið nýttur til að ná í viðkvæmar upplýsingar eins og lykilorð og API-lykla úr innri röksemdafærslu líkans. Panfilov og meðhöfundar hans vöruðu OpenAI, Anthropic og Google við málinu og hvert fyrirtæki breytti sínu API til að draga úr vandanum. Þótt ekki sé lengur hægt að draga út einkaupplýsingar sagði Panfilov að enn sé hægt að afhjúpa sum röksemdafærsluferli með þessari aðferð og að fullkomin lausn á eimingaráhættunni krefjist "grundvallarbreytinga á því hvernig API-viðmót þessara fyrirtækja virka."linkedin
Niðurstöðurnar koma í kjölfar vaxandi spennu milli bandarískra og kínverskra fyrirtækja vegna eimingar á gervigreind. Í febrúar 2026 birtu Anthropic og OpenAI sönnunargögn um kerfisbundna eimingarherferð kínverskra gervigreindarfyrirtækja. Nýlega, þegar Moonshot AI gaf út Kimi K3 í júlí, sakaði Michael Kratsios, vísindaráðgjafi Hvíta hússins, fyrirtækið um að stela tækni Anthropic. Óháðir sérfræðingar hafa þó dregið í efa hvort tímaramminn milli útgáfu Claude og Kimi K3 hafi verið nægilega stuttur til að styðja þá fullyrðingu.iaps+2
Nýja rannsóknin frá teymi Panfilovs bætir tæknilegri vídd við umræðuna og býður upp á aðferð sem gæti í grundvallaratriðum greint eimingu í stórum stíl, um leið og hún undirstrikar hvernig sömu gagnsæisverkfæri og efla öryggi gervigreindar geta einnig gert líkön berskjölduð fyrir samkeppnislegri útdrætti.