Az Anthropic 2026. szeptember 22-én adta ki a Claude Opus 5.5 modellt, két hónappal az Opus 5 után. Az üzenet egy sorban elfér: a cég legnagyobb modelljének, a Claude Fable 5.1-nek a szintjén hozott eredmények, tokenenként 20%-kal alacsonyabb áron, mint az Opus 5, tipikus munkaterhelésnél pedig az Anthropic becslése szerint 40%-kal olcsóbban. A modell már elérhető a Claude alkalmazásokban, a Claude Platformon claude-opus-5-5 néven, valamint az Amazon Web Services, a Google Cloud és a Microsoft Azure kínálatában.
A TechCrunch, a 9to5Mac és a Yahoo Finance egyaránt ugyanazzal kezdett: ez nemcsak erősebb, hanem olcsóbb modell is. Éppen ez a kombináció teszi a bejelentést fontossá azoknak a vállalkozásoknak is, amelyek nem AI-laborok.
Mennyibe kerül a Claude Opus 5.5
Az Anthropic bejelentő oldala millió tokenenként adja meg az API-árakat:
- Bemenet: 4 $ (Opus 5: 5 $).
- Kimenet: 20 $ (Opus 5: 25 $).
- Cache-olvasás: 0,20 $ (Opus 5: 0,50 $), 60%-kal kevesebb. A cache-írás 5 $.
- Gyors mód: 8 $ bemenet és 40 $ kimenet, akár 2,5-szer gyorsabban.
A nagyobb megtakarítás az Anthropic szerint abból adódik, hogy a modell ugyanazt a munkát kevesebb lépésben és kevesebb tokennel végzi el. A kimenet 30%-kal gyorsabban készül, mint az Opus 5-nél. A bejelentő oldalon szereplő ügyfélidézetek számokkal is alátámasztják ezt: az Optiver szerint az Opus 5.5 az Opus 5 minőségét „nagyjából feleannyi körrel, idővel és kimeneti tokennel” hozta, a Kiro pedig körülbelül 40%-kal kevesebb hívásról számol be, feleannyi token felhasználásával.
Az előfizetők kapcsán a 9to5Mac megjegyzi, hogy a Pro, Max és Team csomagokban megemelkedtek az ötórás használati limitek, és az előfizetők mostantól kapnak egy limit-visszaállítást, amelyet félretehetnek, és akkor használhatnak fel, amikor akarnak.
Hogyan viszonyul a Fable 5.1-hez, az Opus 5-höz és a GPT-6 Astrához
Az Anthropic összehasonlító táblázatot tett közzé. Ezek a gyártó saját mérései, nem független tesztek, ezért kiindulópontként kezelje őket:
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra |
|---|---|---|---|---|
| Terminal-Bench 4.0 (ágensalapú programozás) | 66,4% | 55,8% | 52,3% | 57,9% |
| FrontierCode v1.1 | 54,4% | 50,3% | 48,0% | 53,3% |
| GDPval-AA v2.1 (tudásmunka, Elo) | 1846 | 1735 | 1708 | 1542 |
| AutomationBench | 40,0% | 31,4% | 26,9% | 41,4% |
| OSWorld 2.0 (számítógép-használat) | 81,8% | 80,7% | 74,0% | — |
| Humanity’s Last Exam (eszközökkel) | 67,7% | 65,6% | 63,6% | 57,2% |
Két részletet érdemes kiemelni. A GPT-6 Astra továbbra is vezet az AutomationBench és a Terminal-Bench-Science teszten (64,6% a 58,7%-kal szemben), vagyis az Opus 5.5 nem mindenhol jár az élen. A 9to5Mac pedig rámutat, hogy a FrontierCode-on az Opus 5.5 hajszállal megelőzi az Astrát, a feladatonkénti költségének nagyjából 20%-áért, és ez többet számít, mint maga a pontszám.
Mi változott a gyakorlatban az Anthropic szerint
Hosszú feladatok. Az Anthropic egy 680 000 soros kódmigrációt említ, amely kevesebb mint egy nap alatt elkészült, valamint egy tesztet, amelyben a modellnek egy webalkalmazás minden oldalán csökkentenie kellett a betöltési időt: az Opus 5.5 40-ből 39 alkalommal sikerrel járt, míg az Opus 5 kisebb javításokat ért el, amelyek ráadásul az alkalmazás működését is megváltoztatták.
Világosabb szöveg. A cég szerint a modell a fontos információt teszi előre, és kevesebb szakzsargont használ. A Box 40%-kal kevésbé bőbeszédű kimenetről számol be az Opus 5-höz képest, pontosságvesztés nélkül. A TechCrunch ugyanezt a változást emelte ki.
Elemzés és ellenőrzés. A Deloitte szerint az Opus 5.5 magas effort-szinten az ismert hibák 72%-át szúrta ki, szemben az Opus 5 56%-ával, kevesebb téves riasztással. A Thomson Reuters Labs és a Hebbia egyaránt 86,6%-os lefedettségről számol be a kutatási feladataiban, szemben az Opus 5 60,3%-ával.
Biztonság. Az Anthropic szerint az Opus 5.5 érte el a legjobb eredményt a legutóbbi Claude-modellek közül a cég automatizált viselkedési auditján, 85%-kal kevesebbszer próbálta megkerülni az elszigetelési korlátokat, mint az Opus 5, és jobban ellenáll a prompt injectionnek. A modellt a megjelenés előtt a METR és a Frontier Design értékelte. A Yahoo Finance megjegyzi, hogy ez az Anthropic első modellje azóta, hogy Dario Amodei vezérigazgató ebben a hónapban esszét tett közzé, amelyben az AI-fejlesztés lassítását sürgeti.
Mi jön ezután. Az Anthropic ezt az 5.5-ös hullám első kiadásának nevezi: a Sonnet 5.5 és a Haiku 5.5 a következő hetekben várható.
Mit jelent ez az Ön vállalkozása számára
Az „elég jó” ára ismét csökkent. Egy hónappal ezelőtt a választás így szólt: élvonalbeli modell élvonalbeli áron, vagy egy olcsóbb, több utómunkával. Ha az Anthropic számai az Ön feladatain is megállják a helyüket, a Fable-szintű minőség most Opus-áron kapható. A mi véleményünk: most érdemes újra lefuttatni azt a három feladatot, amely igazán számít Önnek, és a befejezett feladatonkénti költséget összehasonlítani, nem a tokenenkénti árat. Az AI-szolgáltatók az elvégzett munka költségében versenyeznek, a modellektől a ChatGPT szponzorált ügynökeiig, és az Ön összehasonlítását is így érdemes mérni.
A korábban túl drága automatizálások most megtérülhetnek. Leadek irányítása, megkeresések osztályozása, rend a CRM-adatokban, heti riportok: ezek havonta ezerszámra futnak, és egy 40%-kal alacsonyabb számla megváltoztatja az üzleti számítást. A legtöbb CRM- és marketingautomatizálási projektünk éppen ezen a számításon akad el, ezért érdemes az új árakkal újra elvégezni.
A sebesség a weboldalaknál és a kódnál számít a legtöbbet. Egy modell, amely egy teljes webhelyre kiterjedő teljesítményfeladatot több menet helyett egyetlen menetben végez el, hasznos mindenkinek, aki webáruházat vagy többnyelvű oldalt üzemeltet. Saját weboldal-fejlesztési munkáinkban a gyakorlati nyereség kevesebb ellenőrzési kör, nem varázslat.
Ne váltson egy főcím alapján. A gyártói benchmarkokat a gyártó saját környezetében mérik. Teszteljen a saját adatain, egy hétig tartsa meg a régi modellt tartaléknak, és figyelje, hol dönt másként az új. Ez különösen igaz az ügyfeleknek szóló szövegekre, ahol a rövidebb, közvetlenebb stílus csak akkor javulás, ha továbbra is az Ön márkájának hangján szól.
Egy megjegyzés az átláthatóságról: az M-ADS a napi munkájában használja a Claude-ot, és ezt a cikket a megjelenés napján a Claude Opus 5.5 segítségével kutattuk és írtuk meg, majd az alább felsorolt forrásokkal vetettük össze. Semmilyen üzleti kapcsolatban nem állunk az Anthropickal.