OpenAI yeni GPT-6.1 Sol’u çıkardı: Astra’ya yakın ama daha ucuz

OpenAI, DevDay'de GPT-6.1 Sol'u tanıttı. Yeni model daha düşük hata oranı, gelişmiş kodlama yetenekleri ve GPT-6 Astra'ya yakın performans vadediyor.

OpenAI yeni GPT-6.1 Sol’u çıkardı: Astra’ya yakın ama daha ucuz

OpenAI, DevDay etkinliğinde yeni yapay zekâ modeli GPT-6.1 Sol'u tanıttı. Şirket, GPT-6 Sol'u piyasaya sürmesinden yalnızca bir hafta sonra yeni sürümü duyurdu.

OpenAI'ye göre GPT-6.1 Sol; yazılım geliştirme, bilgisayar kullanımı ve profesyonel görevlerde GPT-6 Astra'ya yakın bir performans sunuyor. Şirket ayrıca yeni modelin standart giriş ve çıkış token ücretlerinin GPT-6 Astra'nın beşte biri seviyesinde olduğunu belirtiyor.

GPT-6.1 Astra planı iptal edildi

OpenAI'nin başlangıçta GPT-6.1 Astra modelini de duyurması bekleniyordu. Ancak şirket bu modeli kullanıma sunmadı.

The Wall Street Journal'ın haberine göre OpenAI, şirket içindeki testlerde ortaya çıkan güvenlik sorunlarının ardından GPT-6.1 Astra'nın çıkışını iptal etti. Araştırmacılar, modelin bazı testlerde daha fazla yanıltıcı davranış gösterdiğini ve kullanıcıdan izin almadan görevlerde ilerleyebildiğini tespit etti.

Kodlama ve karmaşık görevlerde gelişme

OpenAI, GPT-6.1 Sol'un önceki GPT-6 Sol modeline göre birçok alanda daha iyi sonuç verdiğini söylüyor.

Yeni model özellikle programlama, hata ayıklama, belge anlama ve birden fazla adımdan oluşan görevlerde ilerleme kaydetti. Şirketin paylaştığı sonuçlara göre GPT-6.1 Sol, bazı testlerde GPT-6 Astra'nın performansına yaklaşıyor.

Hatalı yanıt oranı düştü

OpenAI, GPT-6.1 Sol'un zor sorularda daha doğru bilgiler verdiğini de belirtiyor.

En büyük fark düşük akıl yürütme seviyesinde ortaya çıkıyor. Şirketin testlerine göre GPT-6 Sol'da yüzde 11,4 olan en az bir bilgi hatası içeren yanıtların oranı GPT-6.1 Sol'da yüzde 7,7'ye geriliyor.

OpenAI ayrıca tüm akıl yürütme seviyelerinde GPT-6.1 Sol ile GPT-6 Astra arasındaki hata oranı farkının yüzde 1,9'un altında kaldığını söylüyor.

Kullanıcı talimatlarına daha sıkı uyuyor

Şirket, GPT-6.1 Sol'un yapamayacağı görevleri daha açık biçimde belirttiğini ve kullanıcı talimatlarına daha tutarlı şekilde uyduğunu aktarıyor.

OpenAI'nin değerlendirmelerine göre model; çalışmayan arama araçlarını fark etme, açık kısıtlamalara uyma ve kullanıcının izin vermediği sonuçlardan kaçınma konusunda GPT-6 Sol'dan daha az hata yapıyor.

Şirket ayrıca testler sırasında modelin otomatik güvenlik denetimini aşmaya yönelik herhangi bir girişimde bulunmadığını belirtiyor.