Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

wiredwiredlinkedinTým vědců vyvinul techniku pro extrakci skrytých myšlenkových postupů z předních modelů umělé inteligence, což odhaluje důkazy, že nejméně jeden čínský systém AI mohl být vytrénován destilací poznatků z amerických protějšků – vědci však zdůrazňují, že jejich zjištění nejsou definitivním důkazem.
Počítačoví vědci z Tübingenské univerzity, Institutu Maxe Plancka, organizace pro bezpečnost AI MATS Research a kybernetickobezpečnostní firmy Snyk objevili zranitelnost napříč modely od společností OpenAI, Anthropic a Google Alphabet Inc. , která umožňuje extrakci skrytých kroků uvažování – detailních myšlenkových procesů, které tyto systémy používají k řešení složitých problémů.wired
"Všichni přední poskytovatelé modelů, které jsme zkoumali, vykazují tuto zranitelnost," uvedl Alexander Panfilov, počítačový vědec z Tübingenské univerzity, který se na výzkumu podílel. "To by mohlo vést k úniku osobních údajů a usnadňuje rozsáhlé útoky založené na destilaci uvažování."wired
Ve své studii vědci ukazují, že model s otevřenými vahami Kimi K3 od společnosti Moonshot AI produkuje výstupy "pozoruhodně podobné" skrytým myšlenkovým stopám modelů Claude Opus 4.8 a GPT 5.6 Sol u určitých výzev. Varují však, že jejich práce "nemůže kauzálně prokázat destilaci." Vědci také zjistili, že dva další modely s otevřenými vahami – čínský DeepSeek a Inkling od americké firmy Thinking Machines – nevykazovaly stejnou podobnost v uvažování jako Claude Opus.wired
Kromě otázky destilace odhalila technika bezpečnostní zranitelnost, kterou lze zneužít k získání citlivých informací, jako jsou hesla a API klíče, z vnitřního uvažování modelu. Panfilov a jeho spoluautoři na problém upozornili společnosti OpenAI, Anthropic a Google a každá z nich upravila své API, aby problém zmírnila. Ačkoliv extrakce soukromých informací již není možná, Panfilov uvedl, že některé myšlenkové stopy lze touto metodou stále odhalit a úplné vyřešení rizika destilace by vyžadovalo "zásadní přepracování způsobu, jakým API těchto společností fungují."linkedin
Zjištění přicházejí uprostřed pokračujícího napětí mezi americkými a čínskými firmami ohledně destilace AI. V únoru 2026 zveřejnily společnosti Anthropic a OpenAI důkazy o systematických destilačních kampaních čínských firem zabývajících se umělou inteligencí. Nedávno, když společnost Moonshot AI v červenci vydala Kimi K3, obvinil vědecký poradce Bílého domu Michael Kratsios tuto firmu z kopírování technologie Anthropic. Nezávislí experti však zpochybnili, zda byl časový odstup mezi veřejným vydáním Claude a uvedením Kimi K3 dostatečně krátký na to, aby toto tvrzení podpořil.iaps+2
Nový výzkum týmu Panfilova přidává do debaty technický rozměr – nabízí metodu, která by v principu mohla detekovat destilaci ve velkém měřítku – a zároveň podtrhuje, jak stejné nástroje transparentnosti, které zvyšují bezpečnost AI, mohou modely vystavit riziku konkurenční extrakce.