Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

wiredwiredlinkedinEtt forskarlag har utvecklat en teknik för att utvinna dolda resonemangsspår från ledande AI-modeller, vilket ger bevis för att minst ett kinesiskt AI-system kan ha tränats genom att destillera insikter från amerikanska motsvarigheter, även om forskarna betonar att deras resultat inte utgör ett definitivt bevis.
Datavetare från Tübingens universitet, Max Planck-institutet, AI-säkerhetsorganisationen MATS Research och cybersäkerhetsföretaget Snyk upptäckte en sårbarhet i modeller från OpenAI, Anthropic och Google Alphabet Inc. som möjliggör utvinning av dolda resonemangssteg, de detaljerade tankeprocesser som dessa system använder för att lösa komplexa problem.wired
"Alla ledande leverantörer av gränsöverskridande modeller som vi undersökte uppvisar denna sårbarhet," säger Alexander Panfilov, datavetare vid Tübingens universitet som deltog i forskningen. "Detta kan leda till läckage av personuppgifter och underlättar storskaliga attacker baserade på resonemangsdestillering."wired
I sin rapport visar forskarna att Moonshot AI:s modell Kimi K3 producerar resultat som är "anmärkningsvärt lika" de dolda resonemangsspåren hos Claude Opus 4.8 och GPT 5.6 Sol för vissa frågor. De varnar dock för att deras arbete "inte kausalt kan fastställa destillering". Forskarna fann också att två andra modeller, kinesiska DeepSeek och amerikanska Thinking Machines Inkling, inte uppvisade samma resonemangslikhet med Claude Opus.wired
Utöver frågan om destillering avslöjade tekniken en säkerhetssårbarhet som kan utnyttjas för att hämta känslig information som lösenord och API-nycklar från en modells interna resonemang. Panfilov och hans medförfattare varnade OpenAI, Anthropic och Google om problemet, och varje företag justerade sina API-er för att mildra risken. Även om det inte längre är möjligt att utvinna privat information, säger Panfilov att vissa resonemangsspår fortfarande kan blottläggas med metoden, och att en fullständig lösning på destilleringsrisken skulle kräva "en grundläggande översyn av hur dessa företags API-er fungerar".linkedin
Funnena kommer mitt i en pågående spänning kring AI-destillering mellan amerikanska och kinesiska företag. I februari 2026 publicerade Anthropic och OpenAI bevis på systematiska destilleringskampanjer från kinesiska AI-företag. När Moonshot AI lanserade Kimi K3 i juli anklagade Vita husets vetenskapsrådgivare Michael Kratsios företaget för att kopiera Anthropics teknik. Oberoende experter har dock ifrågasatt om tidslinjen mellan Claudes offentliga lansering och Kimi K3:s lansering var tillräckligt kort för att stödja det påståendet.iaps+2
Den nya forskningen från Panfilovs team tillför en teknisk dimension till debatten genom att erbjuda en metod som i princip kan upptäcka destillering i stor skala, samtidigt som den understryker hur samma transparensverktyg som främjar AI-säkerhet även kan exponera modeller för konkurrensmässig utvinning.