Anthropic, Claude Opus 5.5’i 22 Eylül 2026’da, Opus 5’ten iki ay sonra yayınladı. Ana mesaj tek cümleye sığıyor: şirketin en büyük modeli Claude Fable 5.1 seviyesinde sonuçlar; üstelik token başına Opus 5’ten %20, Anthropic’in tahminine göre tipik iş yüklerinde ise %40 daha düşük maliyetle. Model; Claude uygulamalarında, Claude Platform’da claude-opus-5-5 adıyla ve Amazon Web Services, Google Cloud ile Microsoft Azure’da kullanıma açık.
TechCrunch, 9to5Mac ve Yahoo Finance aynı noktayı öne çıkardı: bu yalnızca daha güçlü değil, aynı zamanda daha ucuz bir model. Sürümü yapay zekâ laboratuvarı olmayan işletmeler için önemli kılan da bu kombinasyon.
Claude Opus 5.5’in maliyeti
Anthropic’in lansman sayfası, milyon token başına API fiyatlarını şöyle listeliyor:
- Giriş: 4 $ (Opus 5: 5 $).
- Çıkış: 20 $ (Opus 5: 25 $).
- Önbellekten okuma: 0,20 $ (Opus 5: 0,50 $), %60 daha düşük. Önbelleğe yazma 5 $.
- Hızlı mod: giriş 8 $, çıkış 40 $; 2,5 kata kadar daha hızlı.
Anthropic’e göre asıl tasarruf, modelin aynı işi daha az adımda ve daha az tokenle yapmasından geliyor. Çıktı üretimi Opus 5’ten %30 daha hızlı. Lansman sayfasındaki müşteri alıntıları bunu rakamlarla destekliyor: Optiver, Opus 5.5’in Opus 5’in kalitesini “turların, sürenin ve çıkış tokenlerinin yaklaşık yarısıyla” yakaladığını söylüyor; Kiro ise tokenlerin yarısını kullanarak yaklaşık %40 daha az çağrı yapıldığını bildiriyor.
Abonelik kullananlar için 9to5Mac, Pro, Max ve Team planlarında beş saatlik kullanım limitlerinin yükseldiğini ve abonelerin artık saklayıp istedikleri zaman kullanabilecekleri bir limit sıfırlama hakkı aldığını belirtiyor.
Fable 5.1, Opus 5 ve GPT-6 Astra ile karşılaştırma
Anthropic bir karşılaştırma tablosu yayımladı. Bunlar bağımsız testler değil, üreticinin kendi ölçümleri; bu yüzden onları bir başlangıç noktası olarak görün:
| Kıyaslama | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra |
|---|---|---|---|---|
| Terminal-Bench 4.0 (ajan tabanlı kodlama) | %66,4 | %55,8 | %52,3 | %57,9 |
| FrontierCode v1.1 | %54,4 | %50,3 | %48,0 | %53,3 |
| GDPval-AA v2.1 (bilgi işi, Elo) | 1846 | 1735 | 1708 | 1542 |
| AutomationBench | %40,0 | %31,4 | %26,9 | %41,4 |
| OSWorld 2.0 (bilgisayar kullanımı) | %81,8 | %80,7 | %74,0 | — |
| Humanity’s Last Exam (araçlarla) | %67,7 | %65,6 | %63,6 | %57,2 |
İki ayrıntı dikkat çekiyor. GPT-6 Astra, AutomationBench’te ve Terminal-Bench-Science’ta (Astra %64,6, Opus 5.5 %58,7) hâlâ önde; yani Opus 5.5 her alanda lider değil. 9to5Mac ise FrontierCode’da Opus 5.5’in Astra’yı, görev başına onun maliyetinin yaklaşık %20’siyle az farkla geçtiğine dikkat çekiyor; bu da skorun kendisinden daha önemli.
Anthropic’e göre pratikte ne değişti
Uzun işler. Anthropic, bir günden kısa sürede tamamlanan 680.000 satırlık bir kod taşıma projesini ve modelden bir web uygulamasının tüm sayfalarında yükleme sürelerini kısaltmasının istendiği bir testi örnek gösteriyor: Opus 5.5 40 denemenin 39’unda başarılı oldu; Opus 5 ise daha küçük iyileştirmeler yaptı ve bunlar uygulamanın davranışını da değiştirdi.
Daha net yazım. Şirkete göre model önemli bilgiyi başa koyuyor ve daha az jargon kullanıyor. Box, doğruluktan ödün vermeden Opus 5’e kıyasla %40 daha az laf kalabalığı içeren çıktılar bildiriyor. TechCrunch da aynı değişikliği öne çıkardı.
Analiz ve kontrol. Deloitte’a göre Opus 5.5, yüksek efor ayarında bilinen hataların %72’sini yakaladı (Opus 5’te bu oran %56) ve daha az yanlış alarm verdi. Thomson Reuters Labs ve Hebbia, kendi araştırma görevlerinde %86,6 kapsama oranı bildiriyor; Opus 5’te bu oran %60,3.
Güvenlik. Anthropic, kendi otomatik davranış denetiminde son Claude modelleri arasındaki en iyi skorları, Opus 5’e göre izolasyon sınırlarını aşma girişimlerinde %85 azalmayı ve prompt injection’a karşı daha iyi direnci raporluyor. Model, yayın öncesinde METR ve Frontier Design tarafından değerlendirildi. Yahoo Finance, bunun CEO Dario Amodei’nin bu ay yapay zekâ gelişiminin yavaşlatılması çağrısında bulunan bir makale yayımlamasından sonra Anthropic’in çıkardığı ilk model olduğunu not ediyor.
Sırada ne var. Anthropic bunu 5.5 dalgasının ilk sürümü olarak tanımlıyor: Sonnet 5.5 ve Haiku 5.5’in önümüzdeki haftalarda gelmesi bekleniyor.
İşletmeniz için ne anlama geliyor
“Yeterince iyi”nin fiyatı yine düştü. Bir ay önce seçim şuydu: amiral gemisi fiyatına amiral gemisi bir model ya da daha fazla düzeltme gerektiren daha ucuz bir model. Anthropic’in rakamları sizin görevlerinizde de tutarsa, Fable seviyesinde kalite artık Opus fiyatına. Bizim görüşümüz: sizin için gerçekten önemli olan üç görevi yeniden çalıştırmanın ve token başına fiyatı değil, tamamlanan görev başına maliyeti karşılaştırmanın tam zamanı. Yapay zekâ sağlayıcıları, modellerden ChatGPT Sponsored Agents reklamlarına kadar işi tamamlamanın maliyeti üzerinden rekabet ediyor; sizin karşılaştırmanız da aynı ölçüye dayanmalı.
Fazla pahalı olan otomasyonlar artık kendini amorti edebilir. Potansiyel müşteri yönlendirme, gelen taleplerin ön elemesi, CRM düzeni, haftalık raporlar: bunlar ayda binlerce kez çalışıyor ve %40 daha düşük bir fatura yatırımın hesabını değiştiriyor. CRM ve pazarlama otomasyonu projelerimizin çoğu tam da bu hesapta tıkanıyor; bu yüzden hesabı yeni fiyatlarla yeniden yapmaya değer.
Hız en çok web sitelerinde ve kodda önemli. Site genelindeki bir performans görevini birkaç tur yerine tek seferde bitiren bir model, e-ticaret mağazası ya da çok dilli bir site işleten herkes için faydalı. Kendi web sitesi geliştirme çalışmalarımızda pratik kazanç sihir değil, daha az inceleme turu.
Bir manşete bakıp model değiştirmeyin. Üretici kıyaslamaları üreticinin kendi kurulumunda ölçülür. Kendi verilerinizle test edin, eski modeli bir hafta yedek olarak tutun ve yenisinin nerede farklı karar verdiğini izleyin. Bu, özellikle müşteriye dönük metinler için geçerli: daha kısa ve daha doğrudan bir üslup, ancak hâlâ markanızın sesini taşıyorsa bir gelişmedir.
Şeffaflık notu: M-ADS günlük işlerinde Claude kullanıyor; bu makalenin araştırması ve taslağı lansman günü Claude Opus 5.5 ile yapıldı, ardından aşağıda listelenen kaynaklarla karşılaştırılarak kontrol edildi. Anthropic ile herhangi bir ticari ilişkimiz yok.