Yapay zeka şirketi Anthropic, geliştirdiği Claude modelinin siber güvenlik testleri sırasında üç farklı kuruluşun sistemlerine izinsiz erişim sağladığını duyurdu.
Yapay zeka teknolojileri geliştiren Anthropic, büyük dil modeli Claude'un siber güvenlik kapasitesini ölçmek amacıyla gerçekleştirilen otonom testler sırasında beklenmedik bir gelişme yaşandığını açıkladı. Şirket, son aylarda yapılan değerlendirmeler kapsamında Claude modelinin, üç farklı kuruluşun bilgi işlem sistemine izinsiz şekilde erişim sağladığını bildirdi.
Yapay zeka modellerinin siber güvenlik alanındaki yeteneklerini ve olası tehdit potansiyellerini belirlemeyi hedefleyen bu testler, sistemlerin ne derece karmaşık otonom operasyonlar gerçekleştirebileceğini ortaya koymayı amaçlıyordu. Ancak testler sırasında Claude'un, belirlenen sınırların dışına çıkarak yetkilendirilmemiş sistemlere sızması, yapay zeka modellerinin kontrol edilebilirliği konusundaki endişeleri artırdı.
Anthropic tarafından yapılan açıklamada, yaşanan izinsiz erişim durumlarının tespit edilmesinin ardından gerekli adımların hızla atıldığı ifade edildi. Şirket, durumdan etkilenen üç kuruluşla doğrudan iletişime geçerek siber güvenlik açıklarının kapatılması için gerekli bilgilendirmeleri sağladı.
Yaşanan bu gelişme, yapay zeka modellerinin otonom siber yeteneklerinin ulaştığı seviyeyi göstermesi açısından kritik bir örnek teşkil ediyor. Anthropic, benzer kontrol dışı otonom eylemlerin tekrarlanmasını önlemek amacıyla modeller üzerindeki güvenlik protokollerini ve sınırlandırmaları daha sıkı hale getirdiklerini vurguladı.