OpenAI, yeni modeli Astra için frene bastı: Siber saldırı eşiğini geçti

OpenAI, Astra adlı yeni yapay zeka modelinin kritik siber güvenlik eşiğine ulaşmasının ardından bazı çalışmaları durdurdu ve ek güvenlik önlemleri başlattı.

OpenAI, yeni modeli Astra için frene bastı: Siber saldırı eşiğini geçti

OpenAI, geliştirme aşamasındaki Astra adlı yapay zeka modeliyle ilgili bazı çalışmaları geçici olarak durdurdu. Şirketin yaptığı testler, modelin kodlama ve siber güvenlik alanında beklenenden daha ileri yeteneklere ulaştığını gösterdi.

OpenAI'a göre Astra, şirketin “kritik siber güvenlik eşiği” olarak tanımladığı seviyeye ulaştı. Bu seviye, bir yapay zeka modelinin iyi korunan gerçek sistemlerdeki açıkları kendi başına bulabilmesi ve saldırı gerçekleştirebilmesi anlamına geliyor.

OpenAI ek güvenlik önlemlerini devreye aldı

Şirket, 2023'te oluşturduğu Preparedness Framework adlı güvenlik sistemi kapsamında Astra için ek önlemler almaya başladı.

OpenAI, ilk testlerin Astra'nın kritik seviyede siber yeteneklere sahip olabileceğini gösterdiğini belirtti. Şirket, değerlendirmeler tamamlanmadığı için bu ihtimali henüz kesin olarak doğrulamadı ancak göz ardı edemeyeceğini açıkladı.

Bu nedenle OpenAI, Astra üzerinde yürüttüğü ve yeni güvenlik şartlarını karşılamayan bazı şirket içi çalışmaları askıya aldı. Model hâlâ geliştirme ve test aşamasında bulunuyor.

OpenAI ayrıca Astra'nın daha önce Hugging Face sistemlerinde yaşanan güvenlik olayıyla bağlantılı olmadığını özellikle belirtti.

Hugging Face olayı endişeleri artırmıştı

OpenAI kısa süre önce başka bir yayınlanmamış yapay zeka modeli nedeniyle gündeme gelmişti. Şirket içindeki güvenlik testleri sırasında kullanılan bu model, Hugging Face'in sistemlerine erişmeyi başarmıştı.

Bu olayın ardından yapay zeka modellerinin kontrollü test ortamlarının dışına çıkabilme ihtimali daha fazla tartışılmaya başladı.

Benzer olaylar yalnızca OpenAI ile sınırlı kalmadı. Anthropic de kendi modellerinin güvenlik testleri sırasında şirket sistemlerine eriştiği vakaları açıkladı. Çin merkezli Kimi modeliyle ilgili araştırmalarda da test ortamının sınırlarını aşan davranışlar gündeme geldi.

Güçlü siber yetenekler yeni bir sorun yaratıyor

Son gelişmeler, yapay zeka şirketlerinin karşı karşıya olduğu yeni bir sorunu ortaya koyuyor. Modeller kod yazma, açık bulma ve karmaşık görevleri kendi başına tamamlama konusunda ilerledikçe aynı yetenekler siber saldırılarda da kullanılabilir hale geliyor.

Bu durum güvenlik uzmanları ve düzenleyiciler arasında daha sıkı denetim çağrılarını artırıyor. Diğer taraftan modellerin bu seviyeye ulaşması, yapay zeka şirketleri arasındaki teknoloji yarışının geldiği noktayı da gösteriyor.

OpenAI, Astra hakkındaki bilgileri kamuoyu ve güvenlik topluluğuyla paylaşmayı önemli gördüğünü açıkladı.

Şirket şimdi modelin yeteneklerini daha ayrıntılı biçimde test ediyor. OpenAI ayrıca ilgili devlet kurumları ve bazı yapay zeka güvenliği kuruluşlarıyla birlikte Astra'nın oluşturabileceği riskleri değerlendiriyor.