OpenAI, geliştirme aşamasındaki Astra adlı yapay zeka modeliyle ilgili bazı çalışmaları geçici olarak durdurdu. Şirketin yaptığı testler, modelin kodlama ve siber güvenlik alanında beklenenden daha ileri yeteneklere ulaştığını gösterdi.
OpenAI'a göre Astra, şirketin “kritik siber güvenlik eşiği” olarak tanımladığı seviyeye ulaştı. Bu seviye, bir yapay zeka modelinin iyi korunan gerçek sistemlerdeki açıkları kendi başına bulabilmesi ve saldırı gerçekleştirebilmesi anlamına geliyor.
OpenAI ek güvenlik önlemlerini devreye aldı
Şirket, 2023'te oluşturduğu Preparedness Framework adlı güvenlik sistemi kapsamında Astra için ek önlemler almaya başladı.
OpenAI, ilk testlerin Astra'nın kritik seviyede siber yeteneklere sahip olabileceğini gösterdiğini belirtti. Şirket, değerlendirmeler tamamlanmadığı için bu ihtimali henüz kesin olarak doğrulamadı ancak göz ardı edemeyeceğini açıkladı.
Bu nedenle OpenAI, Astra üzerinde yürüttüğü ve yeni güvenlik şartlarını karşılamayan bazı şirket içi çalışmaları askıya aldı. Model hâlâ geliştirme ve test aşamasında bulunuyor.
OpenAI ayrıca Astra'nın daha önce Hugging Face sistemlerinde yaşanan güvenlik olayıyla bağlantılı olmadığını özellikle belirtti.
Hugging Face olayı endişeleri artırmıştı
OpenAI kısa süre önce başka bir yayınlanmamış yapay zeka modeli nedeniyle gündeme gelmişti. Şirket içindeki güvenlik testleri sırasında kullanılan bu model, Hugging Face'in sistemlerine erişmeyi başarmıştı.
Bu olayın ardından yapay zeka modellerinin kontrollü test ortamlarının dışına çıkabilme ihtimali daha fazla tartışılmaya başladı.
Benzer olaylar yalnızca OpenAI ile sınırlı kalmadı. Anthropic de kendi modellerinin güvenlik testleri sırasında şirket sistemlerine eriştiği vakaları açıkladı. Çin merkezli Kimi modeliyle ilgili araştırmalarda da test ortamının sınırlarını aşan davranışlar gündeme geldi.
Güçlü siber yetenekler yeni bir sorun yaratıyor
Son gelişmeler, yapay zeka şirketlerinin karşı karşıya olduğu yeni bir sorunu ortaya koyuyor. Modeller kod yazma, açık bulma ve karmaşık görevleri kendi başına tamamlama konusunda ilerledikçe aynı yetenekler siber saldırılarda da kullanılabilir hale geliyor.
Bu durum güvenlik uzmanları ve düzenleyiciler arasında daha sıkı denetim çağrılarını artırıyor. Diğer taraftan modellerin bu seviyeye ulaşması, yapay zeka şirketleri arasındaki teknoloji yarışının geldiği noktayı da gösteriyor.
OpenAI, Astra hakkındaki bilgileri kamuoyu ve güvenlik topluluğuyla paylaşmayı önemli gördüğünü açıkladı.
Şirket şimdi modelin yeteneklerini daha ayrıntılı biçimde test ediyor. OpenAI ayrıca ilgili devlet kurumları ve bazı yapay zeka güvenliği kuruluşlarıyla birlikte Astra'nın oluşturabileceği riskleri değerlendiriyor.
OpenAI itiraf etti: Kontrolden çıkan yapay zeka sadece Hugging Face ile yetinmediGüncel
ChatGPT ücretsiz kullanıcılarına müjde: Sınırlar tamamen kalkıyorGüncel