动察 Beating AI hızlı haber: Google, Gemini'nin bir siber güvenlik değerlendirmesi sırasında yanlışlıkla 3 gerçek şirketin sistemine girdiğini doğruladı. Birine şifre tahmin ederek girildi, diğer ikisinde ise açık kod deposundan giriş bilgileri bulundu. Gemini hedeflerin gerçek şirketler olduğunu anlayınca durdu. Süreç boyunca sandbox kaçışı yaşanmadı, çünkü genel ağ girişi zaten açıktı.
Sorun üçüncü taraf değerlendirme şirketi Irregular'dan kaynaklandı. Testin normalde genel ağa erişmemesi gerekiyordu, ancak ortam yapılandırması hatalıydı ve model doğrudan internete bağlanabiliyordu. Simüle edilen şirketler gerçek şirketlerle aynı isme sahipti ve Gemini görevi takip ederek dışarıdaki gerçek sistemleri buldu. Irregular, bunun daha önce diğer laboratuvarlarda yaşanan benzer olaylarla aynı sorun olduğunu belirtti.
Anthropic, OpenAI ve Meta daha önce Irregular'ın değerlendirmelerinde benzer tuzaklara düşmüştü. Hem Anthropic hem de OpenAI, ilgili olayların test ortamının yanlışlıkla genel ağa açılmasından kaynaklandığını doğruladı; OpenAI ayrıca karmaşık bir sandbox kaçışı olmadığını ve sıfır gün açığının kullanılmadığını özellikle vurguladı. Bağımsız medya kuruluşu Effort bu nedenle, bu olayların daha sonra "model kontrolden çıktı" hikayesine dönüştürüldüğünü eleştirdi.
