OpenAI’den ChatGPT için ‘aldatıcı davranış’ açıklaması
OpenAI, son altı ayda modellerin eğitimi ve değerlendirilmesi sırasında altı “hizalama bozukluğu” vakası tespit edildiğini duyurdu.
OpenAI, yapay zeka modellerinin eğitim ve değerlendirme süreçlerinde aldatıcı ya da izinsiz davranışlar sergilediğine ilişkin yeni örnekler tespit ettiğini açıkladı. Şirket, bu tür vakaları kamuoyuyla daha düzenli paylaşmak için yeni bir raporlama süreci başlattığını bildirdi.
Açıklamaya göre OpenAI, bundan sonra endişe verici yapay zeka davranışlarına ilişkin bulguları birden fazla örneği tek raporda toplamak için bekletmek yerine daha sık duyuracak. Şirket, sektörde ortak bir standart bulunmaması nedeniyle bu alanda daha fazla şeffaflık sağlamayı hedeflediğini belirtti.
ALTI AYDA ALTI VAKA
OpenAI, son altı ayda modellerin eğitimi ve değerlendirilmesi sırasında altı ayrı “hizalama bozukluğu” gözlemlediğini duyurdu. Şirket, bu raporların tekil vakaları belgelediğini, söz konusu davranışların yaygın olduğu anlamına gelmediğini vurguladı.
“Hizalama”, yapay zeka sistemlerinin insanların istediği ve beklediği şekilde davranmasını sağlama süreci olarak tanımlanıyor. OpenAI, çarşamba günü yayımladığı blog yazısında, yapay zeka sistemleri geliştikçe ve kullanım alanları genişledikçe bu alandaki araştırmalarda daha geniş bir uzlaşıya ihtiyaç duyulduğunu ifade etti.
Yapay zeka sistemleri daha gelişmiş hâle geldikçe ve daha yaygın biçimde kullanıldıkça, hizalama araştırmalarındaki ilerleme konusunda daha geniş ve daha bilgili bir uzlaşı oluşturmamız gerekiyor.

Şirketin aktardığı örnekler arasında, henüz piyasaya sürülmemiş bir araştırma modelinin sohbet botlarını sınırlayan rol ve kimliklerden “kurtulması” yer aldı. Bir başka modelin ise eğitim sırasında başarısızlıklarını kullanıcıdan gizlemek için bilgi uydurma eğilimi gösterdiği belirtildi.
OpenAI’nin paylaştığı diğer vakalarda, bir yapay zeka ajanının kendisine bu yönde talimat verilmemesine rağmen dosyaları internete yükleyip bunlara atıfta bulunduğu; bazı botların da yalnızca yerel dosyalarla çalışmaları istenmesine karşın bir görevde iş birliği yapmak için dosyaları kamuya açık biçimde paylaştığı kaydedildi.
Şirket, bildirilen vakaların tamamının henüz kamuya açıklanmamış modeller ya da araştırma modelleriyle ilgili olduğunu belirtti.
YAVAŞLAMA ÇAĞRILARI GÜNDEMDE
OpenAI’nin açıklaması, yapay zekanın geliştirilme hızına ilişkin tartışmaların yeniden yoğunlaştığı bir döneme denk geldi. Teknoloji sektöründen bazı isimler, düzenleme, test süreçleri ve güvenlik araştırmalarının bu hıza yetişebilmesi için geliştirme çalışmalarında yavaşlamaya gidilmesi gerektiğini savunuyor.
Anthropic CEO’su Dario Amodei, geçen hafta yayımladığı makalede yapay zeka geliştirme sürecinde frene basılması çağrısı yapmıştı. OpenAI CEO’su Sam Altman ve SpaceX CEO’su Elon Musk da bu görüşe katıldıklarını belirtmişti.
Yapay zeka laboratuvarlarında çalışan bazı araştırmacılar da benzer endişeleri dile getiriyor. Eski Anthropic araştırmacısı Jacob Coxon, X’te yaptığı paylaşımda Anthropic ve OpenAI’nin kendini geliştirebilen ve onarabilen yapay zeka için yarıştığını öne sürerek bunun “hayatlarımızla kumar oynamak” anlamına geldiğini ifade etmiş ve istifa ettiğini duyurmuştu.
Haber Kaynağı : 12punto
Çok Okunanlar
İspanya Süper Kupa'nın İstanbul programı belli oldu
İstasyonlar tabelaya sığmayan fiyatı EPDK'ya sordu
Gençlik ve Spor Bakanlığı'ndan Galatasaray açıklaması
Erdoğan-Trump görüşmesi New York’ta yapılacak
Aziz Yıldırım'dan başkanlığı bırakma kararı
Ümit Özdağ'dan Diyarbakır'daki tabelalar için suç duyurusu
THY Kadın Voleybol Takımı’na vize engeli
Kabzımal meselesi!
Yunanların Türklere karşı uyguladığı 'Mora Katliamı' ve kıyımlarını unutmayalım
Hedef Holding’den Namık Kemal Gökalp açıklaması