动察 Beating AI hızlı haberi, açık kaynak modelleri "reddetme yanıtı kaldırılmış" versiyona dönüştürmede uzmanlaşan Abliteration.ai, GLM-5.3'ün reddetme yanıtı kaldırılmış sürümü olan abliterated-model-large-v2'yi yayınladı. Bu, model ağırlıklarını doğrudan değiştirerek modelin istek reddetme mekanizmasını zayıflatıyor ve saldırgan siber güvenlik, kırmızı takım ve ajan testlerine odaklanıyor; ayrıca ücretli API sunuyor.
Zhipu daha önce GLM-5.3'ün açık ağırlıklarını güvenlik değerlendirmesi ve sağlamlaştırma için iki hafta ertelemişti. Ağırlıklar 28 Ağustos'ta açıldıktan sonra, Abliteration bu sürümü yalnızca 3 günde yayınladı.
GLM-5.3'ün siber saldırı yeteneği zaten 5.2'den çok daha güçlü. ExploitBench %24,4'ten %54,4'e yükseldi, ExploitGym'de iki saatte tamamlanan görev sayısı 29'dan 105'e çıktı. Abliteration şu anda reddetme yanıtı kaldırıldıktan sonraki yeniden test sonuçlarını açıklamadı.
API'si varsayılan olarak yalnızca çocuk cinsel içeriğini ve kendine zarar vermeyi zorunlu olarak engelliyor; yasa dışı faaliyetler, nefret, taciz, yetişkin cinsel içeriği gibi şeyler varsayılan olarak serbest bırakılıyor.
