Yapay zeka hizalaması

Anthropic: Yapay zeka ajanları güvenlik açıklarını düzeltmede insanları geride bıraktı

Anthropic, cuma günü yayımladığı bir makalede, Claude modelleri üzerine inşa edilen yapay zeka ajanlarının hedef modellerdeki 10 yaygın uyum (alignment) hatasını gideren eğitim yöntemlerini otonom olarak geliştirdiğini ve genel yetenekleri düşürmeden hedeflenen tüm performans testlerini iyileştirdiğini ayrıntılarıyla açıkladı. "Otomatik Araştırmacılar…

Avustralya’da ilk otonom siber saldırı: Yapay zeka ajanı spor salonunun sistemini hackledi

Melbourne'de yaşayan bir kişinin yapay zeka asistanından spor salonu dersi için rezervasyon yapmasını istemesi, uzmanların Avustralya'nın ilk bilinen otonom siber saldırısı olarak nitelendirdiği olayı kazara tetikledi. Bu durum, günlük görevleri üstlenen yapay zeka ajanlarının güvenliği ve sorumluluğu konusunda acil soruları…