Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

wiredwiredlinkedinBir grup araştırmacı, önde gelen yapay zeka modellerinden gizli akıl yürütme izlerini çıkarmak için bir teknik geliştirdi. Bu bulgular, en az bir Çinli yapay zeka sisteminin Amerikan muadillerinden elde edilen içgörülerin damıtılmasıyla eğitilmiş olabileceğine dair kanıtlar sunuyor, ancak araştırmacılar bulgularının kesin bir kanıt teşkil etmediğinin altını çiziyor.
Tübingen Üniversitesi, Max Planck Enstitüsü, yapay zeka güvenliği kuruluşu MATS Research ve siber güvenlik firması Snyk'ten bilgisayar bilimcileri, OpenAI, Anthropic ve Google Alphabet Inc. modellerinde gizli akıl yürütme adımlarının, yani bu sistemlerin karmaşık problemleri çözmek için kullandığı detaylı düşünce zinciri süreçlerinin çıkarılmasına olanak tanıyan bir güvenlik açığı keşfetti.wired
Araştırmaya katılan Tübingen Üniversitesi'nden bilgisayar bilimcisi Alexander Panfilov, "İncelediğimiz tüm önde gelen sınır modeli sağlayıcıları bu güvenlik açığını sergiliyor," dedi. "Bu durum kişisel verilerin sızmasına yol açabilir ve büyük ölçekli akıl yürütme damıtma saldırılarını kolaylaştırabilir."wired
Araştırmacılar makalelerinde, Moonshot AI'ın açık ağırlıklı modeli Kimi K3'ün belirli istemler için Claude Opus 4.8 ve GPT 5.6 Sol'un gizli akıl yürütme izlerine "şaşırtıcı derecede benzer" çıktılar ürettiğini gösteriyor. Ancak, çalışmalarının "nedensel olarak damıtmayı kanıtlayamayacağı" konusunda uyarıyorlar. Araştırmacılar ayrıca, diğer iki açık ağırlıklı model olan Çinli DeepSeek ve ABD merkezli Thinking Machines'in Inkling modelinin, Claude Opus ile aynı akıl yürütme benzerliğini göstermediğini tespit etti.wired
Damıtma sorununun ötesinde, teknik, bir modelin içsel akıl yürütmesinden şifreler ve API anahtarları gibi hassas bilgileri almak için kullanılabilecek bir güvenlik açığını ortaya çıkardı. Panfilov ve ortak yazarları, OpenAI, Anthropic ve Google'ı bu sorun hakkında uyardı ve her şirket sorunu hafifletmek için API'sini güncelledi. Özel bilgilerin çıkarılması artık mümkün olmasa da, Panfilov bazı akıl yürütme izlerinin bu yöntemle hala ortaya çıkarılabileceğini ve damıtma riskini tamamen çözmenin "bu şirketlerin API'lerinin çalışma şeklinde köklü bir değişiklik gerektireceğini" belirtti.linkedin
Bulgular, ABD ve Çinli firmalar arasında yapay zeka damıtma konusunda süregelen gerilimlerin ortasında geldi. Şubat 2026'da Anthropic ve OpenAI, Çinli yapay zeka şirketlerinin sistematik damıtma kampanyalarına dair kanıtlar yayınladı. Daha yakın zamanda, Moonshot AI Temmuz ayında Kimi K3'ü piyasaya sürdüğünde, Beyaz Saray bilim danışmanı Michael Kratsios şirketi Anthropic'in teknolojisini kopyalamakla suçladı. Ancak bağımsız uzmanlar, Claude'un halka açık sürümü ile Kimi K3'ün lansmanı arasındaki sürenin bu iddiayı desteklemek için yeterli olup olmadığını sorguladı.iaps+2
Panfilov'un ekibinin yeni araştırması, tartışmaya teknik bir boyut ekleyerek prensipte damıtmayı büyük ölçekte tespit edebilecek bir yöntem sunuyor ve aynı zamanda yapay zeka güvenliğini artıran şeffaflık araçlarının modelleri nasıl rekabetçi çıkarım risklerine maruz bırakabileceğini vurguluyor.