Anthropic udostępnił Claude Opus 5.5 22 września 2026 r., dwa miesiące po Opus 5. Główny przekaz mieści się w jednym zdaniu: wyniki na poziomie Claude Fable 5.1, największego modelu firmy, w cenie za token o 20% niższej niż Opus 5, a według szacunków Anthropic — o 40% niższej przy typowych obciążeniach. Model działa już w aplikacjach Claude, na Claude Platform jako claude-opus-5-5 oraz w Amazon Web Services, Google Cloud i Microsoft Azure.
TechCrunch, 9to5Mac i Yahoo Finance zaczęły od tego samego: to nie tylko mocniejszy model, ale i tańszy. Właśnie to połączenie sprawia, że premiera ma znaczenie dla firm, które nie są laboratoriami AI.
Ile kosztuje Claude Opus 5.5
Na stronie premierowej Anthropic podaje ceny API za milion tokenów:
- Wejście: 4 USD (Opus 5: 5 USD).
- Wyjście: 20 USD (Opus 5: 25 USD).
- Odczyty z pamięci podręcznej: 0,20 USD (Opus 5: 0,50 USD), czyli o 60% mniej. Zapis do pamięci podręcznej kosztuje 5 USD.
- Tryb szybki: 8 USD za wejście i 40 USD za wyjście, nawet 2,5 raza szybciej.
Większa oszczędność, według Anthropic, wynika z tego, że model wykonuje tę samą pracę w mniejszej liczbie kroków i przy mniejszej liczbie tokenów. Odpowiedzi generowane są o 30% szybciej niż w Opus 5. Wypowiedzi klientów na stronie premierowej przekładają to na liczby: Optiver mówi, że Opus 5.5 dorównał jakości Opus 5 „w mniej więcej połowie tur, czasu i tokenów wyjściowych”, a Kiro odnotowuje około 40% mniej wywołań przy zużyciu połowy tokenów.
W przypadku subskrypcji 9to5Mac zwraca uwagę, że w planach Pro, Max i Team podniesiono pięciogodzinne limity użycia, a subskrybenci otrzymują teraz reset limitu, który mogą zachować i wykorzystać w wybranym przez siebie momencie.
Jak wypada na tle Fable 5.1, Opus 5 i GPT-6 Astra
Anthropic opublikował tabelę porównawczą. To pomiary samego producenta, a nie niezależne testy, więc warto traktować je jako punkt wyjścia:
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra |
|---|---|---|---|---|
| Terminal-Bench 4.0 (programowanie agentowe) | 66,4% | 55,8% | 52,3% | 57,9% |
| FrontierCode v1.1 | 54,4% | 50,3% | 48,0% | 53,3% |
| GDPval-AA v2.1 (praca umysłowa, Elo) | 1846 | 1735 | 1708 | 1542 |
| AutomationBench | 40,0% | 31,4% | 26,9% | 41,4% |
| OSWorld 2.0 (obsługa komputera) | 81,8% | 80,7% | 74,0% | — |
| Humanity’s Last Exam (z narzędziami) | 67,7% | 65,6% | 63,6% | 57,2% |
Warto zwrócić uwagę na dwa szczegóły. GPT-6 Astra nadal prowadzi w AutomationBench i w Terminal-Bench-Science (64,6% wobec 58,7%), więc Opus 5.5 nie wygrywa wszędzie. Z kolei 9to5Mac zauważa, że w FrontierCode Opus 5.5 minimalnie wyprzedza Astrę przy mniej więcej 20% kosztu na zadanie, co ma większe znaczenie niż sam wynik.
Co według Anthropic zmieniło się w praktyce
Długie zadania. Anthropic przytacza migrację kodu liczącego 680 000 wierszy, ukończoną w niecały dzień, oraz test, w którym model miał skrócić czas ładowania wszystkich stron aplikacji internetowej: Opus 5.5 poradził sobie 39 razy na 40, a Opus 5 wprowadził mniejsze usprawnienia, które przy okazji zmieniły działanie aplikacji.
Jaśniejsze teksty. Firma twierdzi, że model podaje najważniejsze informacje na początku i używa mniej żargonu. Box odnotowuje odpowiedzi o 40% mniej rozwlekłe niż w Opus 5, bez utraty dokładności. Tę samą zmianę wyróżnił TechCrunch.
Analiza i weryfikacja. Deloitte podaje, że Opus 5.5 wychwycił 72% znanych błędów wobec 56% w przypadku Opus 5 przy wysokim poziomie wysiłku, generując przy tym mniej fałszywych alarmów. Thomson Reuters Labs i Hebbia raportują w swoich zadaniach badawczych pokrycie 86,6% wobec 60,3% dla Opus 5.
Bezpieczeństwo. Anthropic informuje o najlepszych wynikach spośród wszystkich niedawnych modeli Claude w swoim automatycznym audycie zachowań, o 85% mniejszej liczbie prób obejścia granic izolacji niż w Opus 5 oraz o lepszej odporności na prompt injection. Przed premierą model ocenili METR i Frontier Design. Yahoo Finance zauważa, że to pierwszy model Anthropic od czasu, gdy CEO Dario Amodei opublikował w tym miesiącu esej wzywający do spowolnienia rozwoju AI.
Co dalej. Anthropic nazywa to pierwszym wydaniem fali 5.5: Sonnet 5.5 i Haiku 5.5 mają pojawić się w najbliższych tygodniach.
Co to oznacza dla Państwa firmy
Cena „wystarczająco dobrego” znów spadła. Miesiąc temu wybór wyglądał tak: model z czołówki za cenę czołówki albo tańszy, ale z większą liczbą poprawek. Jeśli dane Anthropic potwierdzą się w Państwa zadaniach, jakość na poziomie Fable kosztuje teraz tyle, co Opus. Naszym zdaniem to dobry moment, by ponownie przetestować trzy zadania, na których naprawdę Państwu zależy, i porównać koszt jednego ukończonego zadania, a nie cenę za token. Dostawcy AI konkurują kosztem wykonanej pracy — od modeli po sponsorowanych agentów w ChatGPT — i Państwa porównanie powinno być mierzone w ten sam sposób.
Automatyzacje, które były zbyt drogie, mogą się teraz opłacić. Kierowanie leadów, wstępna selekcja zapytań, porządkowanie danych w CRM, cotygodniowe raporty: takie procesy uruchamiają się tysiące razy w miesiącu, a rachunek niższy o 40% zmienia ich uzasadnienie biznesowe. Większość naszych projektów CRM i automatyzacji marketingu utyka właśnie na tym wyliczeniu, więc warto przeliczyć je od nowa według nowych cen.
Szybkość liczy się najbardziej przy stronach internetowych i kodzie. Model, który kończy zadanie optymalizacji wydajności całej witryny za jednym podejściem zamiast kilku, przyda się każdemu, kto prowadzi sklep internetowy lub stronę wielojęzyczną. W naszym tworzeniu stron internetowych praktyczny zysk to mniej rund poprawek, a nie magia.
Proszę nie zmieniać modelu na podstawie nagłówka. Benchmarki producenta są mierzone na konfiguracji producenta. Warto przetestować model na własnych danych, przez tydzień utrzymywać stary jako zapasowy i obserwować, gdzie nowy podejmuje inne decyzje. Dotyczy to szczególnie tekstów kierowanych do klientów, w których krótszy, bardziej bezpośredni styl jest ulepszeniem tylko wtedy, gdy nadal brzmi jak Państwa marka.
Słowo o przejrzystości: M-ADS korzysta z Claude w codziennej pracy, a materiały do tego artykułu zebrano i jego wersję roboczą napisano z pomocą Claude Opus 5.5 w dniu premiery, po czym tekst sprawdzono ze źródłami wymienionymi poniżej. Nie łączą nas żadne relacje handlowe z Anthropic.