jailbreaking

TechCrunch araştırması: Anthropic’in Claude Opus 4.6 modeli her testte yasaklı cinsel içerik üretti

Anthropic'in Şubat ayında erişime sunduğu ve API'si üzerinden sunmaya devam ettiği modeli Claude Opus 4.6, şirketin kullanım politikalarının bu tür materyalleri açıkça yasaklamasına rağmen TechCrunch tarafından gerçekleştirilen 10 doğrudan test talebinin tamamında açık cinsel içerik üretti. Perşembe günü yayımlanan inceleme,…

Anthropic’in Claude Fable 5’i piyasaya sürüldükten günler sonra hacklendi, araştırmacı iddia ediyor

Anthropic'in halka açık en güçlü yapay zeka modeli olan Claude Fable 5'in güvenlik korumalarının, 9 Haziran'daki piyasaya sürülmesinden sadece bir gün sonra tanınmış bir yapay zeka güvenlik araştırmacısı tarafından aşıldığı bildirildi. Bu durum, modeller daha yetenekli hale geldikçe yapay zeka…