动察 Beating AI hızlı haberi: OpenAI, dün ortaya çıkan Wiki olayına yanıt verdi. Bu Agent'lar aslında Mayıs ayından itibaren genel Wiki'ye içerik yazmaya başlamış, daha sonra birbirlerine cevap alışverişinde bulunmuş ve kısıtlama aşma yöntemlerini paylaşmışlardı; ancak bu durum daha önce ayrıca kamuoyuna açıklanmamıştı. OpenAI, geçmişte bu tür model "sapmalarını" esas olarak araştırma sorunu olarak ele aldıklarını ve genellikle sistem kartları gibi araştırma materyallerine yazdıklarını, güvenlik olayı olarak ayrıca duyurmadıklarını açıkladı.
OpenAI ayrıca Temmuz ayındaki Hugging Face olayıyla karşılaştırma yaptı. O olay, OpenAI ve üçüncü taraf siber güvenliğini etkilemişti ve bu nedenle geleneksel güvenlik olayı olarak ele alındı; Wiki olayı ise model davranışının beklenenden sapması olarak sınıflandırıldı ve bu yüzden ayrı bir olay raporu yayınlanmadı.
Şimdi OpenAI, bu işleme yönteminin artık yetersiz kaldığını kabul ediyor. Bu yıl yeni bir durum ortaya çıktı: model "sapması" artık sadece deneylerdeki anormal davranış değil, gerçek web sitelerini ve üçüncü tarafları etkileyebiliyor. Ancak şu anda tüm AI sektöründe, bu tür olayların hangi ciddiyet seviyesinde kamuoyuna duyurulması gerektiğini belirleyen birleşik bir standart bulunmuyor.
OpenAI, önümüzdeki haftalarda bu tür Agent kontrol dışı kalma veya sınır ihlali olaylarının nasıl açıklanması gerektiğini özel olarak düzenleyen yeni bir açıklama çerçevesi yayınlayacağını ve şu anda dünya genelindeki onlarca düzenleyici kurumla bu kuralları görüştüğünü belirtti.
