Çin'den Anthropic'e açık kaynaklı rakip: GLM-5.3 güvenlik açıklarının peşinde

Z.ai, açık kaynak GLM-5.3 modelinin güvenlik açığı bulma testinde Anthropic Mythos 5'i geçtiğini açıkladı. Ancak saldırı geliştirme testlerinde tablo değişiyor.

Çin'den Anthropic'e açık kaynaklı rakip: GLM-5.3 güvenlik açıklarının peşinde

Çin merkezli yapay zekâ şirketi Z.ai, açık kaynak olarak yayımlamaya hazırlandığı GLM-5.3 modelinin yazılımlardaki güvenlik açıklarını bulma konusunda Anthropic'in sınırlı erişime sahip Mythos 5 modeline yaklaştığını açıkladı.

Şirketin paylaştığı sonuçlara göre GLM-5.3, kodları inceleyen ve güvenlik açıklarını tespit eden CyberGym testinde yüzde 84,5 puan aldı. Z.ai, Mythos 5'in aynı testte yüzde 83,8 seviyesinde kaldığını belirtti. Ancak bağımsız kuruluşlar bu sonuçları henüz doğrulamadı.

Güvenlik açığını buluyor ancak saldırıya dönüştürmede geride

GLM-5.3 güvenlik açıklarını tespit etme testinde güçlü bir sonuç ortaya koysa da bulunan açıkları çalışan saldırılara dönüştürme testinde Mythos 5'in gerisinde kaldı.

Z.ai'nin verilerine göre GLM-5.3, ExploitBench testinde yüzde 54,4 puan aldı. Mythos 5 ise yüzde 78'e ulaştı.

İki model arasındaki fark süreli testlerde de ortaya çıktı. GLM-5.3 iki saat içinde 105, altı saat içinde ise 130 saldırı geliştirme görevini tamamladı. Mythos 5 aynı sürelerde sırasıyla 181 ve 247 görevi bitirdi.

Bu tür testler yalnızca saldırı amacı taşımıyor. Güvenlik ekipleri de yazılımlardaki açıkları saldırganlardan önce bulmak ve kapatmak için benzer yöntemlerden yararlanıyor.

Anthropic, Mythos 5'in erişimini sınırlıyor

Anthropic, Claude Fable 5'in siber güvenlik kısıtlamaları kaldırılmış bir sürümü olan Mythos'u yalnızca onayladığı kuruluşlara açıyor.

Bu sınırlamanın arkasında önemli bir güvenlik sorunu bulunuyor. Güçlü yapay zekâ modelleri yazılımlardaki açıkları bulup bunlardan yararlanmanın yollarını geliştirebiliyor. Aynı özellikler güvenlik ekiplerinin işini kolaylaştırırken kötü niyetli kişilerin saldırı geliştirmesini de kolaylaştırabilir.

Z.ai ise GLM-5.3 için farklı bir yol izlemeye hazırlanıyor.

GLM-5.3 yaklaşık iki hafta sonra yayımlanacak

Şirket, güvenlik testlerini tamamladıktan ve koruma sistemlerini güçlendirdikten sonra GLM-5.3'ü yaklaşık iki hafta içinde kamuya açmayı planlıyor.

Ancak şirket modelin en hassas siber güvenlik özelliklerini herkese sunmayacak. Z.ai, bu araçlara yalnızca kimliğini doğruladığı kullanıcıların "güvenilir erişim" programı üzerinden ulaşmasına izin verecek.

İlk aşamada şirket belirli iş ortaklarına erişim sağlayacak. Ardından programı kontrollü biçimde daha fazla kullanıcıya açacak.

Z.ai ayrıca modele riskli istekleri tespit eden, modelin yaptığı işlemleri takip eden ve kötü amaçlı görevleri reddetmesini sağlayan çeşitli korumalar eklediğini belirtiyor.

Şirket bu sistemlerin kötü amaçlı saldırılar ile hata düzeltme, siber güvenlik eğitimi ve izinli güvenlik testleri gibi yasal kullanımları birbirinden ayırmasını hedefliyor.

Ancak açık kaynak modeller burada önemli bir sorun yaratıyor. Kullanıcılar modeli indirip değiştirdiğinde veya başka araçlarla birleştirdiğinde geliştiricinin koyduğu güvenlik önlemlerini korumak zorlaşıyor.

Açık kaynak ve kapalı model tartışması büyüyor

Z.ai, GLM-5.3'ü Anthropic'in sınırlı erişim yaklaşımına alternatif olarak konumlandırıyor. Şirket, gelişmiş siber savunma araçlarının yalnızca büyük ve kapalı yapay zekâ sağlayıcılarının kontrolünde kalmaması gerektiğini savunuyor.

Bu kapsamda Z.ai, "Open Source Shield" adlı yeni bir girişim de başlatacak. Şirket seçtiği açık kaynak projelerindeki kodları güvenlik açıkları için inceleyecek, savunma amaçlı çalışmalara model erişimi sağlayacak ve ZCode programlama aracına kod denetleme özellikleri ekleyecek.

Concordia AI araştırmacısı Gabriel Wagner'e göre Z.ai'nin modelin açık şekilde yayımlanmasını güvenlik gerekçesiyle ertelemesi Çin'deki yapay zekâ şirketleri açısından dikkat çekici bir değişime işaret ediyor. Wagner, Çin'deki açık model geliştiricilerinin risk yönetimi konusunda daha kapsamlı yöntemler kullanmaya başladığını düşünüyor.

GLM serisi daha önce de siber saldırı gündemine gelmişti

Z.ai'nin modelleri siber güvenlik alanında ilk kez gündeme gelmiyor. Hugging Face geçen ay Z.ai'nin önceki modeli GLM-5.2'yi, sistemlerine giren kontrol dışı bir OpenAI aracının gerçekleştirdiği siber saldırıya karşı savunmada kullandığını açıklamıştı.

Çin'den Mythos'a rakip olma iddiasıyla çıkan tek sistem de GLM-5.3 değil. Siber güvenlik şirketi 360, haziran ayında Tulongfeng adlı güvenlik açığı bulma sisteminin yapay zekâ modellerini güvenlik verileri ve otomatik araçlarla birleştirerek Mythos seviyesine ulaştığını öne sürdü. Bağımsız testler bu iddiayı da henüz doğrulamadı.

GLM-5.3 ise yalnızca siber güvenlik için geliştirilmiş bir sistem değil. Model genel amaçlı kodlama görevlerini de yerine getiriyor. Z.ai, GLM-5.2 ile aynı temel modeli kullandığını ancak yeni sürümü daha uzun ve daha çeşitli görevlerle eğittiğini belirtiyor.

GLM-5.2 son aylarda özellikle kod yazma ve bağımsız görevleri yerine getirme yetenekleri nedeniyle Çin dışındaki geliştiricilerin de dikkatini çekmişti. GLM-5.3 ile şirket şimdi bu ilgiyi siber güvenlik alanına taşımaya çalışıyor.