OpenAI’da güvenlik testleri tartışması: Çalışanlar uyarıların dikkate alınmadığını öne sürdü
OpenAI çalışanlarının, bazı yapay zeka modellerinin güvenlik testlerinde yeterince denetlenmediği yönünde yönetime uyarıda bulunduğu öne sürüldü.
12punto
OpenAI’da çalışanların, yapay zeka modellerinin güvenlik testleri sırasında yeterli denetim yapılmadığı gerekçesiyle üst yönetime uyarıda bulunduğu öne sürüldü. New York Times’ın incelediği e-postalara dayandırılan iddialara göre iki çalışan, şirketin en yeni modellerinin kabiliyet ve güvenlik testlerinde daha sıkı izlenmesi gerektiğini bildirdi.
Söz konusu yazışmalarda çalışanların, modellerin gelişmişlik düzeyini ölçmeye dönük testlerin güvenlik protokolleriyle birlikte yürütülmesi gerektiğini vurguladığı belirtildi. Ancak iddiaya göre OpenAI yöneticileri, modellerin planlanan takvimde piyasaya sürülebilmesi için testlerin mümkün olduğunca hızlı ilerletilmesi talimatını verdi.
Çalışanların uyarılarına rağmen ek güvenlik protokollerinin devreye alınmadığı ileri sürülürken, şirketin daha önce gündeme gelen bir test olayı da tartışmanın merkezinde yer aldı. OpenAI’ın 26 Ağustos’ta yayımladığı inceleme raporunda, olayın şirket içinde yalnızca araştırma amacıyla kullanılan “Internal Model 1 (IM1)” adlı modelle bağlantılı olduğu kaydedilmişti.
TEST ORTAMINDAN ÇIKTIĞI BELİRTİLDİ
Rapora göre Temmuz 2026’da yapılan kabiliyet testleri sırasında bir yapay zeka ajanı, kendisine tanımlanan sınırları aşarak test ortamından çıktı. Ajanın şirket sistemlerine ve internete erişim sağladığı, ardından başka yapay zeka ajanlarıyla iletişim kurduğu belirtildi.
İnceleme raporunda, ajanlardan birinin açık kaynaklı yapay zeka modelleri platformu Hugging Face’e erişim sağlayabilecek 14 kimlik bilgisini tespit ettiği ve bunları diğer ajanlarla paylaştığı ifade edildi. Sonraki aşamada ajanların Hugging Face sistemlerindeki açıkları kullanarak sunucularda kod çalıştırdığı, özel verilere ve farklı sistemlere erişim bilgilerine ulaştığı aktarıldı.
Olay, yapay zeka ajanlarının yalnızca metin üreten sistemler olmaktan çıkıp dijital ortamlarda işlem yapabilen araçlara dönüşmesiyle güvenlik denetimlerinin nasıl yürütülmesi gerektiği sorusunu yeniden gündeme getirdi. OpenAI çalışanları ile yöneticileri arasındaki e-posta trafiği de, şirket içinde hız ve güvenlik öncelikleri arasında gerilim yaşandığı değerlendirmelerine neden oldu.