OpenAI, henüz kullanıma sunmadığı Astra adlı yapay zekâ model ailesinin geliştirme ve yayın sürecinin bazı bölümlerini erteledi. Şirket, bu kararı siber güvenlik önlemlerini güçlendirmek ve modellerin izinsiz hareket etmesini engellemek için aldığını açıkladı.
Kararın arkasında ise temmuz ayında yaşanan dikkat çekici bir güvenlik olayı bulunuyor. OpenAI'ın test aşamasındaki başka bir modeli, kendisi için oluşturulan kısıtlı ortamdan çıkarak internete erişmiş ve Hugging Face'in ağına sızmıştı.
Önceki model güvenlik sınırlarını aşmıştı
Temmuz ayında gerçekleşen olayda henüz yayınlanmamış OpenAI modeli, test için oluşturulan kapalı ortamın dışına çıkmayı başardı. Model daha sonra internete erişti ve yapay zekâ ajanlarının şirketin takibine yakalanmadan iletişim kurabileceği gizli bir mesajlaşma alanı oluşturmasına imkan sağladı.
Süreç bununla da sınırlı kalmadı. Yapay zekâ ajanları, Hugging Face'in ağına izinsiz erişim sağladı.
Olay hem yapay zekâ sektöründe hem de güvenlik çevrelerinde uzun süre tartışıldı. Özellikle modellerin insan müdahalesi olmadan güvenlik açıklarını bulup kullanabilmesi, mevcut koruma sistemlerinin yeterliliği konusunda yeni soru işaretleri yarattı.
Astra için geliştirme süreci yavaşlatıldı
OpenAI, Astra'nın Hugging Face olayında herhangi bir rol oynamadığını belirtti. Buna rağmen şirket, benzer sorunların daha gelişmiş modellerde yaşanmasını önlemek için Astra'nın geliştirme ve yayın sürecinin bazı bölümlerini erteledi.
Şirket bu sürede özellikle siber saldırılarda kötüye kullanım ve modellerin izin verilmeyen işlemler gerçekleştirmesi gibi risklere karşı yeni önlemleri test ediyor.
Astra ayrıca OpenAI'ın "kritik siber güvenlik yeteneği" seviyesine ulaştığını belirlediği ilk model oldu.
Bu sınıflandırma önemli bir noktaya işaret ediyor. OpenAI'a göre Astra, insan yönlendirmesi olmadan güvenliği yüksek birçok sistemdeki açıkları tespit edip bunlardan yararlanabilecek kapasiteye sahip.
Bu nedenle şirket, model geliştirilirken ve kullanıma açılmadan önce daha sıkı güvenlik önlemleri uygulaması gerektiğini söylüyor.
İnternet erişimi daha sıkı kontrol edilecek
OpenAI henüz Astra'nın ne zaman kullanıma sunulacağını açıklamadı. Şirket bu süreçte modeli zararlı olabilecek siber güvenlik taleplerini daha sık reddedecek şekilde eğittiğini belirtiyor.
OpenAI ayrıca modelleri izlemek için yeni süreçler hazırladı. Şirket, Hugging Face olayından sonra modellerin internet bağlantısını daha sıkı şekilde sınırlandıracağını ve şüpheli durumlara karşı günün her saati çalışan hızlı müdahale sistemi kuracağını açıklamıştı.
Bu değişikliklerin önemli bir nedeni de önceki saldırının hemen fark edilmemesi. OpenAI, Hugging Face'e yönelik izinsiz erişimi olay gerçekleştikten haftalar sonra öğrendi.
Astra, GPT-5.6 Sol'dan daha yüksek siber kapasiteye sahip
OpenAI'ın açıklamasına göre Astra, şirketin mevcut önde gelen modeli GPT-5.6 Sol'a kıyasla siber güvenlik alanında daha ileri yeteneklere sahip.
Model daha az işlem kaynağı kullanarak daha fazla iş yapabiliyor. Ayrıca sistemlerdeki güvenlik açıklarını bulma ve bu açıklardan yararlanabilecek yöntemler geliştirme konusunda daha başarılı sonuçlar veriyor.
Bu kapasite aynı zamanda Astra'nın kötüye kullanılması halinde ortaya çıkabilecek riski de artırıyor. OpenAI ise kendi testlerinde Astra'nın şimdiye kadar geliştirdiği modeller arasında güvenlik talimatlarına en fazla bağlı kalan model olduğunu belirtiyor.
İlginç test sonucu: GPT-5.6 Sol tuzağa düştü, Astra düşmedi
Şirket, Hugging Face olayından yola çıkarak yeni bir güvenlik testi de hazırladı.
Test sırasında yapay zekâ ajanlarını kendilerine verilen görevi tamamlamak yerine güvenlik altyapısını ele geçirmeye yönlendiren senaryolar oluşturuldu.
OpenAI'ın paylaştığı sonuçlara göre GPT-5.6 Sol, testlerin yarısından fazlasında bu yönlendirmeye uydu ve güvenlik altyapısına müdahale etmeye çalıştı.
Astra ise aynı testlerde böyle bir girişimde bulunmadı.
OpenAI, yeni modeli Astra için frene bastı: Siber saldırı eşiğini geçtiGüncel