动察 Beating AI hızlı haber: Anthropic, "gömülü değerlendirme" uygulamasına resmen başladı. Accenture bünyesindeki AI şirketi Faculty, Anthropic'in içine personel göndererek modelleri değerlendirecek ve kırmızı takım testleri yapacak, hizalama değerlendirmeleri gerçekleştirecek ve güvenlik önlemlerini denetleyecek.
Bu, sıradan dış değerlendirmelerden oldukça farklı. Değerlendiriciler neredeyse çalışan düzeyinde yetkilere sahip olacak, model eğitim sürecini görebilecek, geliştirme ve dağıtım kararlarını öğrenebilecek ve doğrudan iç çalışanlarla iletişim kurabilecek.
Her iki taraf da önümüzdeki beş yıl içinde bu değerlendirme kapasitesini oluşturmak için en az 1 milyar dolar yatırım yapacak. Anthropic de sektörde henüz birleşik kuralların olmadığını kabul ediyor; değerlendiricilerin tam olarak neleri görebileceği, sonuçların nasıl kamuya açıklanacağı ve masrafları kimin karşılayacağı hâlâ belirleniyor. Şu anda Accenture'ın değerlendirme çalışmaları doğrudan Anthropic tarafından finanse ediliyor.
Ancak Accenture'ın kendisi Anthropic'in uzun vadeli stratejik ortağı ve özel olarak Anthropic Business Group kurarak yaklaşık 30 bin kişiyi Claude kullanımı konusunda eğitti. AI Evaluator Forum'un aynı gün öne sürdüğü asgari koşullardan biri de değerlendirme kuruluşlarının değerlendirilen şirketle önemli ticari ilişkilerinin olmaması gerektiğidir.
Anthropic daha sonra başka değerlendirme kuruluşlarını da devreye alacak ve METR (ki o da Anthropic'in eski ortağıdır) gibi kâr amacı gütmeyen kuruluşlarla pilot çalışmalar görüşüyor.
