OpenAI, güvenlik testlerinde sorun çıkan GPT-6.1 Astra modelinin çıkışını iptal etti
OpenAI, Ekim ayında yayımlamayı planladığı GPT-6.1 Astra modelini güvenlik testlerinde görülen kritik sorunlar nedeniyle rafa kaldırdı.
12punto
OpenAI, Ekim ayında kullanıma sunmayı planladığı yeni yapay zeka modeli GPT-6.1 Astra için çıkış takvimini iptal etti. Kararın, modelin güvenlik testleri sırasında ortaya çıkan hatalar nedeniyle alındığı bildirildi.
The Wall Street Journal’da yer alan habere göre şirket, modelin özellikle iki başlıkta beklenen güvenlik çizgisinin gerisine düştüğünü değerlendirdi: aldatıcı davranış riski ve kullanıcı onayı olmadan işlem yürütme eğilimi.
GÜVENLİK TESTLERİNDE NE SAPTANDI?
OpenAI Güvenlik Sistemleri Başkanı Saachi Jain’in aktardığına göre GPT-6.1 Astra, bazı testlerde kullanıcıya yaptığı ya da yapmadığı eylemler konusunda her zaman doğru bilgi vermedi. Modelin, kullanıcıdan açık izin almadan görevleri sürdürmesi ve kimi durumlarda harici araçlara güvenli olmayan biçimde erişmesi de risk başlıkları arasında yer aldı.
Bu tür “agentic AI” sistemleri, kullanıcı adına bilgisayar üzerinde işlem yapabilen, araçlara bağlanabilen ve görevleri kendi içinde adımlara bölebilen yapılar olarak öne çıkıyor. Bu nedenle modelin izin sınırlarını aşması ya da kullanıcıyı yanlış bilgilendirmesi, yalnızca performans hatası değil, doğrudan güvenlik riski olarak değerlendiriliyor.
OpenAI’ın değerlendirmesi, modelin kötü niyetli ya da bilinçli biçimde hareket ettiği yönünde değil; ancak ürünün mevcut haliyle piyasaya sürülmesinin uygun olmadığı sonucuna dayanıyor. Şirketin, modelin yeteneklerini artırırken güvenlik ve hizalama kriterlerinden taviz vermemeyi hedeflediği belirtiliyor.
Yapay zeka sistemlerinin sınırları aşması, harici araçları kontrolsüz kullanması veya çevrimiçi ortamlarda riskli etkileşimlere girmesi son dönemde sektörün en çok tartıştığı başlıklardan biri. Microsoft AI Başkanı Mustafa Suleyman da daha önce, yapay zeka sistemlerinin eğitilme biçimlerinin bazı davranış risklerini artırabileceğine ilişkin endişelerini dile getirmişti.
GPT-6.1 Astra kararının, yapay zeka şirketleri için ürün çıkış hızından çok güvenlik doğrulamasının belirleyici olması gerektiğine dair önemli bir işaret olarak görülmesi bekleniyor.