Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

wiredwiredlinkedinTutkijaryhmä on kehittänyt tekniikan, jolla voidaan uuttaa piilotettuja päättelyjälkiä johtavista tekoälymalleista. Tämä paljastaa viitteitä siitä, että ainakin yhtä kiinalaista tekoälyjärjestelmää on saatettu kouluttaa tislatuilla tiedoilla yhdysvaltalaisista vastineista, vaikka tutkijat korostavatkin, etteivät heidän havaintonsa ole lopullinen todiste.
Tietojenkäsittelytieteilijät Tübingenin yliopistosta, Max Planck -instituutista, tekoälyturvallisuusjärjestö MATS Researchista ja kyberturvallisuusyritys Snykistä löysivät haavoittuvuuden OpenAI:n, Anthropicin ja Google Alphabet Inc:n malleista. Haavoittuvuus mahdollistaa piilotettujen päättelyvaiheiden uuttamisen, eli ne yksityiskohtaiset päättelyketjut, joita nämä järjestelmät käyttävät monimutkaisten ongelmien ratkaisemiseen.wired
"Kaikissa tutkimissamme johtavissa tekoälymalleissa on tämä haavoittuvuus", sanoi tutkimukseen osallistunut Tübingenin yliopiston tutkija Alexander Panfilov. "Tämä voi johtaa henkilötietojen vuotamiseen ja helpottaa laajamittaisia päättelyn tislaushyökkäyksiä."wired
Tutkijat osoittavat artikkelissaan, että Moonshot AI:n avoimen painoarvon Kimi K3 -malli tuottaa tietyillä kehotteilla tuloksia, jotka ovat "huomattavan samankaltaisia" Claude Opus 4.8:n ja GPT 5.6 Solin piilotettujen päättelyjälkien kanssa. He kuitenkin varoittavat, että heidän työnsä "ei voi osoittaa syy-yhteyttä tislaamiselle". Tutkijat havaitsivat myös, että kaksi muuta avoimen painoarvon mallia – kiinalainen DeepSeek ja yhdysvaltalaisen Thinking Machinesin Inkling – eivät osoittaneet samaa päättelyn samankaltaisuutta Claude Opuksen kanssa.wired
Tislauskysymyksen lisäksi tekniikka paljasti tietoturva-aukon, jota voitaisiin hyödyntää arkaluonteisten tietojen, kuten salasanojen ja API-avainten, hakemiseen mallin sisäisestä päättelystä. Panfilov ja hänen kollegansa ilmoittivat asiasta OpenAI:lle, Anthropicille ja Googlelle, ja jokainen yritys päivitti API-rajapintansa ongelman lieventämiseksi. Vaikka yksityisten tietojen uuttaminen ei ole enää mahdollista, Panfilov totesi, että joitakin päättelyjälkiä voidaan yhä paljastaa tällä menetelmällä, ja tislausriskin täydellinen poistaminen vaatisi "perustavanlaatuista uudistusta näiden yritysten API-rajapintojen toimintaan".linkedin
Havainnot tulevat Yhdysvaltojen ja Kiinan yritysten välisen tekoälyn tislausta koskevan jännitteen keskellä. Helmikuussa 2026 Anthropic ja OpenAI julkaisivat todisteita kiinalaisten tekoälyyritysten järjestelmällisistä tislauskampanjoista. Kun Moonshot AI julkaisi Kimi K3:n heinäkuussa, Valkoisen talon tiedeneuvonantaja Michael Kratsios syytti yritystä Anthropicin teknologian kopioimisesta. Riippumattomat asiantuntijat ovat kuitenkin kyseenalaistaneet, oliko Clauden julkisen julkaisun ja Kimi K3:n lanseerauksen välinen aika riittävän lyhyt väitteen tueksi.iaps+2
Panfilovin ryhmän uusi tutkimus tuo keskusteluun teknisen ulottuvuuden tarjoamalla menetelmän, jolla tislausta voitaisiin periaatteessa havaita laajassa mittakaavassa. Samalla se korostaa, kuinka samat läpinäkyvyystyökalut, jotka edistävät tekoälyn turvallisuutta, voivat myös altistaa mallit kilpailulliselle uuttamiselle.