Beating监测ine göre, OpenAI öncü model eğitimini bilinçli olarak yavaşlatmaya başladı. Şirket bir noktada öncü RL eğitiminin bir kısmını iki hafta boyunca duraklattı ve en büyük birkaç tanesi hâlâ yeniden başlatılmadı. Astra'nın birçok eğitim ve değerlendirme süreci de hâlâ askıda.
Hugging Face saldırısı bunun yalnızca bir nedeni. OpenAI aynı zamanda Astra'nın siber saldırı yeteneğinin şirket içinde tanımlanan "Kritik" eşiğine ulaşmış olabileceğini keşfetti. Bu tür yüksek riskli eğitimlerin devam edebilmesi için öncelikle izolasyon, izleme ve hizalama süreçlerinin daha yüksek standartlara getirilmesi gerekiyor.
Altman daha önce, model yetenekleri güvenlik önlemlerinden daha hızlı ilerlerse AI geliştirmenin yavaşlatılması gerektiğini söylemişti. Hugging Face olayının ardından, ilk kez öncü model güvenlik risklerini gerçekten hissettiğini de belirtti. Ardından 1200'den fazla üst düzey AI şirketi çalışanı, sektör genelinde birleşik bir yavaşlatma mekanizması kurulması için ortak imza attı; buna birçok OpenAI çekirdek araştırmacısı da dahildi.
Şimdi OpenAI kendi frenine bastı.
