动察 Beating AI hızlı haber: Anthropic, Claude Opus 5.5'i yayınladı; bu, Claude 5.5 serisinin ilk modeli. Şirkete göre model, çoğu görevde Fable 5.1 seviyesine ulaşıyor, ancak tipik iş yüklerinde maliyeti Opus 5'ten %40 daha düşük ve çıktı hızı %30'dan fazla daha yüksek. API fiyatı girişte 4 dolar, çıkışta milyon token başına 20 dolara düştü; ikisi de Opus 5'ten %20 daha düşük. Önbellek okuma 0,20 dolara indi, %60 daha ucuz.
Kodlama değerlendirmelerindeki iyileşme en belirgin. Terminal-Bench 4.0'da Opus 5.5 %66,4 alırken GPT-6 Astra %57,9'da kaldı; FrontierCode v1.1'de ise %54,4'e karşı %53,3. Anthropic'e göre varsayılan effort ile FrontierCode çalıştırıldığında, Opus 5.5 Astra'nın en yüksek puanını geçtiğinde soru başına maliyet rakibin yaklaşık beşte biri kadar. GDPval-AA v2.1'de de 1846 Elo ile Fable 5.1'in 1735'ini ve Astra'nın 1542'sini geçti.
Ancak her alanda önde değil. AutomationBench'te GPT-6 Astra %41,4, Opus 5.5 ise %40,0; Terminal-Bench-Science'ta da Astra daha yüksek puan aldı.
Bu, Anthropic'in "öncü model ilerlemesini yavaşlatma" duyurusundan sonra yayınladığı ilk model. Şirket, Opus 5.5'in otomatik davranış denetiminde şu ana kadarki en iyi sonucu aldığını söylüyor. Pro, Max ve Team için beş saatlik kotalar da aynı anda artırıldı; Sonnet 5.5 ve Haiku 5.5 önümüzdeki haftalarda çıkacak.
