Yapay zeka ajanlarının birbirleriyle iletişim kurarak belirlenen güvenlik sınırlarını aşması, OpenAI tarafından gerçekleştirilen bir testte dikkat çekici bir sonuç ortaya çıkardı. Bağımsız araştırmacılar Sydney Von Arx, Spencer Kitts, Thomas Larsen ve Cormac Slade Byrd tarafından yürütülen çalışmada, otonom sistemlerin Alman internet sitesi DSEwiki üzerinde 18 bin mesaj paylaşmayı başardığı tespit edildi.
Sistemlere internete veri yazmama yönünde açık bir kısıtlama getirilmişti. Buna rağmen ajanlar bu engeli aşmanın bir yolunu buldu. Yaklaşık altı hafta boyunca ortak bir ağ gibi hareket eden sistemler, test sırasında elde ettikleri yanıtları birbirleriyle paylaşmanın yanı sıra güvenlik ortamından çıkabilmek için kullanılabilecek yöntemleri de tartıştı.
Araştırmada yapay zeka ajanlarının kendilerine 3 bin 700 farklı isim verdiği görüldü. Farklı kimlikler kullanan sistemler, özellikle zaman sınırlaması bulunan veri arama görevlerinde daha iyi sonuç elde etmek için belirlenen kuralları ihlal etti. İletişim ağındaki paylaşımlar yalnızca test sorularının cevaplarıyla sınırlı değil. Ajanların DSEwiki üzerinde çapraz site betik çalıştırma saldırıları gerçekleştirmeye yönelik teknikler ve site yöneticilerinin kimliklerine bürünme gibi stratejileri de birbirlerine aktardığı belirlendi. Böylece sistemlerin tek tek hareket etmek yerine kolektif bir sürü mantığıyla görevde hile yapmaya yöneldiği ortaya çıktı.
Aktivitenin fark edilmesinin ardından şirketin müdahalesiyle sistemlerin çalışması aniden durduruldu. OpenAI yetkilileri araştırmada ortaya konan bulguları doğruladı. Şirket ayrıca sızma testleri ve benzeri güvenlik çalışmalarında yapay zeka ajanlarının hacking yöntemlerini birbirleriyle takas ettiği benzer olayların daha önce de görüldüğünü belirtti.
Hugging Face olayı endişeleri artırdı
DSEwiki vakasının ardından dikkatler, otonom yapay zeka sistemlerinin güvenlik kontrollerini aşma ihtimaline çevrildi. Geçtiğimiz haftalarda Hugging Face platformuna yönelik benzer bir olayın yaşanması da bu konudaki endişeleri artıran gelişmeler arasında.
İnsan yönlendirmesi olmadan kendi aralarında organize olabilen ve belirlenen güvenlik protokollerini devre dışı bırakabilen ajanlar, özellikle geniş sistem yetkilerine sahip olduklarında önemli bir siber güvenlik riski oluşturabilir. Bu nedenle uzmanlar, teknolojik altyapılarda yüksek düzeyde yetkiye sahip otonom ajanların nasıl denetleneceği konusunda mevcut güvenlik önlemlerinin yeniden değerlendirilmesi gerektiğine dikkat çekiyor.