Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

reutersreutersreuters+1Çinli yapay zeka girişimi Z.ai, Cuma günü yaptığı açıklamada, açık kaynaklı GLM-5.3 modelinin yazılım açığı tespit kıyaslama testi olan CyberGym'de %84.5 puan alarak, Anthropic'in kısıtlı Mythos 5 modeli için bildirilen %83.8'lik skoru az farkla geçtiğini duyurdu. Bağımsız olarak doğrulanmayan bu sonuçlar, bir Çinli yapay zeka şirketinin ABD'nin ileri düzey yapay zeka yeteneklerindeki hakimiyetine meydan okuma çabalarının sonuncusu olarak öne çıkıyor.reuters
GLM-5.3, yazılım açıklarını tanımlama konusunda öne geçse de, bu keşifleri savunma amaçlı güvenlik araştırmalarının standart bir bileşeni olan çalışan istismarlara dönüştürme konusunda Mythos 5'in gerisinde kaldı. Z.ai, modelinin ExploitBench testinde %54.4 puan aldığını, Mythos 5'in ise %78.0 puan aldığını bildirdi. Süreli bir egzersizde GLM-5.3, iki saat içinde 105 saldırı geliştirme görevini tamamlarken, Anthropic'in modeli 181 görev gerçekleştirdi.reuters
Siber güvenliğin ötesinde, 743 milyar parametreli model, Z.ai markasının arkasındaki şirket olan Zhipu AI'nın teknik raporuna göre, Terminal-Bench 3.0'da açık kaynaklı modeller arasında 28.3 puanla en yüksek skoru elde ederek Moonshot AI'nın Kimi K3 modelini geride bıraktı ve DeepSWE 1.1'de 66.9 puan aldı. Zhipu, GLM-5.3'ün kodlama ve ajan yeteneklerinin Anthropic'in Claude Fable 5 modeline yaklaştığını belirtti.chinadaily
Z.ai, bu lansmanı, Anthropic'in yalnızca denetlenmiş kuruluşlara sunduğu, siber güvenlik korumaları kaldırılmış bir Claude Fable 5 sürümü olan Mythos'un kapalı erişim yaklaşımına doğrudan bir meydan okuma olarak çerçeveledi. Z.ai, gelişmiş siber savunma araçlarının kapalı model sağlayıcılarının kontrolü yerine açık kaynak geliştiricileri ve küçük güvenlik ekipleri için erişilebilir olması gerektiğini savundu.reuters
Şirket, güvenlik değerlendirmelerini tamamladıktan sonra modeli yaklaşık iki hafta içinde halka açmayı planladığını belirtti. En hassas siber güvenlik işlevleri, yalnızca doğrulanmış kullanıcılar için "güvenilir erişim" programı aracılığıyla sunulacak. Z.ai ayrıca, açık kaynak projelerini denetlemek ve savunma amaçlı model erişimi sağlamak için "Open Source Shield" girişimini duyurdu.devdiscourse+1
Eleştirmenler, model ağırlıkları halka açık olarak yayınlandığında korumaları uygulamanın zorlaştığını, bunun da başkalarının modeli değiştirmesine veya harici araçlarla birleştirmesine olanak tanıdığını belirtiyor. Z.ai, riskli istekleri taramak, çıktıları izlemek ve modeli kötü niyetli görevleri reddetmesi için eğitmek gibi sistemler dahil olmak üzere korumalar eklediğini ifade etti.reuters
Z.ai, Mythos seviyesinde yeteneklere sahip olduğunu iddia eden ilk Çinli firma değil. Siber güvenlik şirketi 360, Haziran ayında Tulongfeng sisteminin yapay zeka modellerini güvenlik verileri ve otomatik araçlarla birleştirerek eşdeğer performans elde ettiğini iddia etmişti, ancak bu iddialar da doğrulanmamıştı. GLM-5.3, önde gelen ABD modellerine yaklaşan yetenekleri daha düşük maliyetle sunarak denizaşırı geliştiriciler arasında popülerlik kazanan selefi GLM-5.2'nin küresel başarısının üzerine inşa ediliyor.reuters