Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

wiredwiredlinkedinEt team av forskere har utviklet en teknikk for å hente ut skjulte resonneringsspor fra ledende AI-modeller, noe som avdekker bevis på at minst ett kinesisk AI-system kan ha blitt trent ved å destillere innsikt fra amerikanske motparter, selv om forskerne understreker at funnene ikke utgjør et endelig bevis.
Datavitere fra Universitetet i Tübingen, Max Planck-instituttet, AI-sikkerhetsorganisasjonen MATS Research og cybersikkerhetsfirmaet Snyk oppdaget en sårbarhet i modeller fra OpenAI, Anthropic og Google Alphabet Inc. som tillater uthenting av skjulte resonneringstrinn, de detaljerte tankeprosessene disse systemene bruker for å løse komplekse problemer.wired
"Alle ledende leverandører av grenseoverskridende modeller vi undersøkte, har denne sårbarheten," sier Alexander Panfilov, dataviter ved Universitetet i Tübingen som deltok i forskningen. "Dette kan føre til lekkasje av personopplysninger og legger til rette for storskala angrep basert på resonneringsdestillering."wired
I sin rapport viser forskerne at Moonshot AI sin modell Kimi K3 produserer resultater som er "bemerkelsesverdig like" de skjulte resonneringssporene til Claude Opus 4.8 og GPT 5.6 Sol for visse forespørsler. De advarer imidlertid om at arbeidet deres "ikke kan bevise årsakssammenheng for destillering". Forskerne fant også at to andre modeller, kinesiske DeepSeek og amerikanske Thinking Machines sin Inkling, ikke viste den samme resonneringslikheten med Claude Opus.wired
Utover spørsmålet om destillering, avdekket teknikken en sikkerhetssårbarhet som kan utnyttes til å hente ut sensitiv informasjon som passord og API-nøkler fra en modells interne resonnering. Panfilov og hans medforfattere varslet OpenAI, Anthropic og Google om problemet, og hvert selskap justerte sine API-er for å begrense risikoen. Selv om det ikke lenger er mulig å hente ut privat informasjon, sier Panfilov at enkelte resonneringsspor fortsatt kan avdekkes ved bruk av metoden, og at en fullstendig løsning på destilleringsrisikoen vil kreve "en fundamental overhaling av hvordan disse selskapenes API-er fungerer".linkedin
Funnene kommer midt i en pågående spenning rundt AI-destillering mellom amerikanske og kinesiske selskaper. I februar 2026 publiserte Anthropic og OpenAI bevis på systematiske destilleringskampanjer fra kinesiske AI-selskaper. Da Moonshot AI lanserte Kimi K3 i juli, anklaget Det hvite hus sin vitenskapsrådgiver Michael Kratsios selskapet for å kopiere Anthropics teknologi. Uavhengige eksperter har imidlertid stilt spørsmål ved om tidslinjen mellom Claudes offentlige lansering og Kimi K3 sin utgivelse var kort nok til å støtte den påstanden.iaps+2
Den nye forskningen fra Panfilovs team tilfører debatten en teknisk dimensjon ved å tilby en metode som i prinsippet kan oppdage destillering i stor skala, samtidig som den understreker hvordan de samme åpenhetsverktøyene som fremmer AI-sikkerhet, også kan eksponere modeller for konkurransemessig uthenting.