OpenAI'ın test ettiği bir yapay zeka ajanının internete bağlanıp Hugging Face sistemlerine sızmasının ardından benzer bir açıklama da Anthropic'ten geldi. Şirket, Claude modellerinin test sırasında üç farklı kuruluşun üretim altyapısına izinsiz erişim sağladığını doğruladı.
Anthropic'in yayımladığı rapora göre olay, şirketin kendi testleri sırasında yaşandı. Etkilenen kuruluşlar durumdan ancak Anthropic'in bilgilendirmesiyle haberdar oldu. Şirket, iki kuruluşun sistemlerine izinsiz erişildiğini o zamana kadar fark etmediğini açıkladı.
OpenAI olayının ardından inceleme başlatıldı
OpenAI'ın yaşadığı olayın duyurulmasının ardından Anthropic, kendi test kayıtlarını kapsamlı şekilde incelemeye başladı. Amaç, Claude modellerinin erişmemesi gereken internet bağlantılarını kullanıp kullanmadığını tespit etmekti.
İnceleme sonunda üç farklı olay belirlendi. Şirket, Claude modellerinin internete erişim sağladığını ve ardından üç farklı kuruluşun üretim sistemlerine yetkisiz şekilde ulaştığını açıkladı.
Üç farklı Claude modeli olaya karıştı
Olaylarda Claude Opus 4.7, siber güvenlik odaklı Mythos 5 ve genel kullanıma sunulması planlanmayan bir prototip model yer aldı.
Bu modeller, "capture the flag" adı verilen bir güvenlik testi üzerinde çalışıyordu. Görevleri, Anthropic'in iç ağındaki başka bir makinede saklanan gizli bilgiyi bulmaktı. Bunun için hedef sisteme girip "flag" olarak adlandırılan gizli veriyi ele geçirmeleri gerekiyordu.
Sorunun nedeni güvenlik açığı değil, insan hatası
Anthropic, olayın OpenAI örneğinden farklı olduğunu söyledi. Şirket, modellerin herhangi bir güvenlik açığını kullanarak test ortamından çıkmadığını belirtti.
Rapora göre sorun, insan hatasından kaynaklandı. Modellere internet erişimi olmadığı söylendi ancak değerlendirme ortağıyla yaşanan bir iletişim hatası nedeniyle internet bağlantısı aslında açıktı.
Claude modelleri internete ulaştığında karşılarına çıkan üç farklı kuruluşun sistemlerini testin bir parçası olarak değerlendirdi ve bu sistemlere erişim sağlamaya çalıştı. Anthropic, modellerin test ortamından bilinçli şekilde kaçmaya çalışmadığını özellikle vurguladı.
Zayıf parolalar kullanıldı
Şirket, modellerin karmaşık güvenlik açıklarından yararlanmadığını söyledi. Bunun yerine zayıf parolalar gibi temel güvenlik eksiklerini kullandıkları belirtildi.
Rapora göre en yeni Claude modeli internete çıktığını fark edince işlemi durdurdu. Daha eski modellerden biri ise saldırıya devam etti.
İki kurum ihlalin farkında bile değildi
Anthropic, test başlamadan önce tüm internet erişim yollarının doğrulanması halinde bu olayların önlenebileceğini kabul etti. Şirket ayrıca testlerin daha sık ve ayrıntılı incelenmesi gerektiğini de belirtti.
Anthropic, 27 Temmuz'da hem değerlendirme ortağını hem de etkilenen üç kuruluşu bilgilendirdi. Şirket, üç kuruluştan ikisinin sistemlerine izinsiz erişildiğinden habersiz olduğunu açıkladı. Üçüncü kuruluşa ise hâlâ ulaşmaya çalıştığını ifade etti.