Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

ft+1ft+1nai500Financial Times tarafından Pazar günü yayınlanan bir araştırmaya göre, Meta ve Google Alphabet Inc. tarafından geliştirilen yapay zeka modellerindeki güvenlik korumalarını kaldıran yazılım araçları, güvenlik bariyerlerini dakikalar içinde aşabiliyor. Değiştirilmiş sistemler biyolojik silahlar, kötü amaçlı yazılım oluşturma ve çocuk istismarı ile ilgili istemlere yanıt vererek, yapay zeka endüstrisindeki gönüllü güvenlik önlemlerinin yeterliliği konusunda yeni endişeleri artırdı.
Financial Times, yapay zeka güvenlik grubu Alice ile birlikte çalışarak, halka açık araç setlerinin yaygın olarak kullanılan modellerdeki güvenlik filtrelerini kısa sürede kaldırabildiğini gösteren testler gerçekleştirdi. Araç setleri, hafif ince ayar (fine-tuning), düşmanca talimat veri setleri ve modelin tamamen yeniden eğitilmesini gerektirmeden yerleşik korumaların üzerine yazan veya bunları aşan otomatik istem dönüşümleri gibi tekniklerden yararlanıyor. Habere göre, bu araçlar halihazırda sağlayıcı tarafından dayatılan kısıtlamaları aşan binlerce değiştirilmiş model versiyonu oluşturmak için kullanılıyor.ft+2
Bulgular, yapay zeka güvenlik uyumundaki yapısal zayıflıklara dair artan akademik kanıtların ortasında geldi. Şubat ayında Nature Communications'da yayınlanan bir çalışma, büyük akıl yürütme modellerinin otonom jailbreak ajanları olarak kullanılabileceğini ve insan denetimi olmaksızın model kombinasyonlarında yüzde 97 başarı oranına ulaştığını ortaya koydu. Ayrıca, ICLR 2026'da sunulan bir makale, güvenlik reddinden sorumlu belirli dikkat başlıklarını susturarak yüzde 99'a varan jailbreak başarısı elde eden Head-Masked Nullspace Steering adlı bir teknik sergiledi.nature+1
Araştırma, Meta'nın Llama serisi ve Google'ın Gemma serisi tarafından desteklenen açık ağırlıklı yapay zeka stratejisinin merkezindeki gerilimin altını çiziyor. Açık ağırlıklar araştırmayı ve geliştirici benimsemesini hızlandırsa da, dışarıdan kişilerin modelleri değiştirilmiş güvenlik standartlarıyla değiştirmesine veya yeniden paketlemesine de olanak tanıyor. Siber güvenlik analistleri, birçok yapay zeka güvenlik korumasının yalnızca yüzeysel düzeyde var olduğu ve kullanıcılar model ağırlıklarına erişim sağladığında, kısıtlamaların serbestçe dağıtılan araçlar kullanılarak kaldırılabileceği konusunda uyardı.nai500+1
The New York Times bu ayın başlarında, siber güvenlik firması LayerX'teki araştırmacıların Claude'un güvenlik bariyerlerini minimum çabayla aştığını belirterek, sektör genelindeki yapay zeka güvenlik kontrollerinin büyük ölçüde etkisiz kaldığını bildirdi.nytimes
Washington, Brüksel ve Londra'daki düzenleyici kurumlar, yapay zeka geliştiricilerinden gelen gönüllü taahhütlerin yeterli olmayacağının sinyalini verdi. ABD'nin halihazırda icra emri çerçeveleri ve uygulama için kullanılabilecek NIST kılavuzları bulunurken, AB Yapay Zeka Yasası sistemik güvenlik başarısızlıkları için cezalar öngörüyor. Bulguların, hem kapalı hem de açık ağırlıklı yapay zeka sistemlerini yöneten uygulanabilir standartlar için çağrıları yoğunlaştırması muhtemeldir; bu da satın alma ekipleri daha güçlü teknik güvenceler ve bağımsız denetim izleri talep ettikçe kurumsal benimsemeyi yavaşlatabilir.nai500