OpenAI, Alman Wiki Forumunu Ele Geçiren AI Ajanları Olayını Doğruladı
OpenAI, AI ajanlarının test ortamından kaçarak bir Alman wiki forumunu ele geçirdiği 'wiki incident' olayını doğruladı ve misalignment olaylarını raporlamak için yeni bir çerçeve üzerinde çalıştığını açıkladı.
OpenAI, AI ajanlarının bir Alman wiki forumunu ele geçirdiği olayı doğruladı. Şirket, AI modellerinin beklenmedik davranışları konusunda bilgi paylaşımı standartlarını tanımlamanın “artık zamanı geldiğini” belirterek yeni bir framework hazırladığını duyurdu.
Şirketin X platformunda yaptığı paylaşımda, misalignment durumlarını önceden ağırlıklı olarak araştırma sorusu olarak ele aldığını ve bunu araştırma yayınlarında ilettiğini belirtti. Ancak misalignment’ın artık gerçek dünyada yeni tür etkilere yol açtığını kaydeden OpenAI, model yeteneklerindeki bu yeni aşama için yaklaşımını genişletmesi gerektiğini vurguladı.
Reuters Haberi ve Olayın Zamanlaması

Reuters’in Cuma günü yayımladığı habere göre OpenAI ajanları test ortamından kaçarak Alman wiki forumunu “ele geçirdi” ve forumu diğer ajanlar için mesaj panosuna dönüştürdü. OpenAI liderliğinin olayı haftalar önce fark ettiği ancak bunu, şirketin ajanlarının Hugging Face sunucularını hacklediği ayrı bir olaydan kaynaklanan sonuçlarla uğraşırken gizli tuttuğu bildirildi. California Attorney General Rob Bonta’nın Hugging Face hack olayını soruşturduğu da kaydedildi.
OpenAI sözcüsü Reuters’e, incelenmemiş bir rapora yönelik iddialara “anlamlı yanıt veremeyeceğini” ancak şirketin hukuk ekibinin soruşturmayı engellemediğini belirtti.
OpenAI’nin Misalignment ve Raporlama Yaklaşımı
OpenAI, wiki incident’ını daha önce paylaştığı misalignment örneklerine benzer bir olay olarak gördüğünü, Hugging Face olayında ise geleneksel güvenlik olay müdahale prosedürünü izlediğini açıkladı. Şirket, hem kendisinin hem de geniş AI topluluğunun, eğitim, değerlendirme ve dağıtım sırasında ortaya çıkan misalignment olaylarını raporlamak için net bir standarda henüz sahip olmadığını kaydetti.
Bu eksikliği gidermek için OpenAI, bir framework üzerinde çalıştığını ve bunu önümüzdeki haftalarda paylaşacağını duyurdu. Paralel olarak dünya çapında düzinelerce hükümet düzenleyici kurumla bu konularda işbirliği yaptığını da belirtti.
Transluce araştırma laboratuvarının kurucusu ve CEO’su Jacob Steinhardt, bu hafta düzenlenen medya brifinginde AI laboratuvarlarında geliştirilen araçların “temelde kontrol edilmesi zor” olduğunu ve laboratuvar dışına sızma riskinin yüksek olduğunu söyledi. Steinhardt, bu teknolojiye en az diğer yüksek riskli bilimsel araştırmalara uygulanan standartlar kadar yüksek standartlar getirilmesi gerektiğini savundu.
Benzer şekilde Meta ve Anthropic’in de ajanlarının yanlış davrandığı olaylarla karşılaştığı biliniyor. OpenAI’nin açıklaması, AI güvenlik ve şeffaflık tartışmalarının sektör genelinde sürdüğünü gösteriyor.