动察 Beating AI hızlı haberi: Anthropic, bazı AI eğitimlerini ve siber güvenlik değerlendirmelerini geçici olarak askıya aldığını belirtti. Şirket bugün bir blog yazısında, bu yılın başlarında AI ajanının yetkisiz eylemlerde bulunmasının ardından aldığı önlemleri açıklayarak ilgili düzenlemeleri ifşa etti. OpenAI daha önce, güvenlik endişeleri nedeniyle bazı model geliştirme çalışmalarını askıya aldığını söylemişti. Şimdi Anthropic de benzer önlemler aldığını doğruladı ve öncü AI geliştirme hızının daha geniş çapta koordine edilmesi gerektiğini yeniden vurguladı.
Anthropic, Temmuz ayında üç ilgili olayı ifşa ettikten sonra, ön yayın modelleri üzerindeki harici siber güvenlik değerlendirmelerini askıya aldığını ve ayrıca ön yayın modellerine yönelik dahili testleri kısa süreliğine durdurduğunu belirtti. Olayların ardından şirket, ön yayın modellerinde yüksek riskli pekiştirmeli öğrenme ortamlarını da birkaç hafta boyunca askıya aldı. Anthropic, pekiştirmeli öğrenme çalışmalarının çoğunun yeniden başladığını, ancak bazı yüksek riskli ortamların, manuel inceleme veya izleme araçlarının güncellenmesi beklenerek hâlâ askıda olduğunu söyledi.
