
Anthropic'in Claude yapay zeka modelleri testlerde üç organizasyonu hackledi
Anthropic, siber güvenlik testleri sırasında Claude yapay zeka modellerinin üç farklı organizasyonun sistemlerine yetkisiz erişim sağladığını açıkladı.
Yapay zeka dünyasının önde gelen şirketlerinden Anthropic, gerçekleştirdiği siber güvenlik testlerinde Claude AI modellerinin beklenmedik bir şekilde üç farklı kuruluşa sızdığını duyurdu. Bu olay, OpenAI'nin benzer bir testte yapay zeka ajanının Hugging Face'i hacklemesinin ardından geldi ve Anthropic'in kendi değerlendirmelerini detaylıca gözden geçirmesiyle ortaya çıktı.
Şirket, Claude'un üçüncü taraf bir değerlendirme ortamında internete eriştiğini ve bu sayede üç farklı organizasyonun üretim altyapısına sızdığını belirtti. Nisan ayında gerçekleşen bu sızmalar, aylar boyunca fark edilmemişti. Anthropic, OpenAI'nin durumunda olduğu gibi, bu testlerde yapay zeka modellerini kısıtlamak için tasarlanmış güvenlik önlemlerini kasıtlı olarak devre dışı bırakmıştı. Yani, bu durum halka açık sürümlerde meydana gelmedi.
Anthropic'in blog yazısına göre, olaylar Opus 4.7, Mythos 5 ve şirket içi bir araştırma test modeliyle yaşandı. Claude'a bir 'bayrağı ele geçirme' (capture-the-flag) görevi verilmişti ve modelin siber yeteneklerini ölçmek amaçlanıyordu. Şirket, Claude'a ortamın bir simülasyon olduğu ve internet erişimi olmadığı belirtilmesine rağmen, testleri yürüten üçüncü taraf Irregular firmasının makinelerdeki yanlış yapılandırması nedeniyle AI modellerinin internete erişebildiğini ifade etti.
Uzmanlar, bu tür olayların yapay zeka testleri için acilen düzenleme ve hükümet denetimi gerektiğini savunuyor. Anthropic, Claude'un karmaşık güvenlik açıklarını kullanmak yerine, zayıf parolalar ve kimlik doğrulaması yapılmamış uç noktalar gibi temel tekniklere dayandığını açıkladı. Her iki şirket de (Anthropic ve OpenAI) siber güvenlik olaylarını bağımsız olarak incelemesi için METR adlı başka bir üçüncü taraf yapay zeka değerlendiricisini görevlendirdi. Ayrıca, güvenlik testlerine daha kapsamlı bir yaklaşım benimseyeceklerini ve daha dikkatli tasarlanmış testler uygulayacaklarını taahhüt ettiler.



