Anthropic hat Claude Opus 5.5 am 22. September 2026 veröffentlicht, zwei Monate nach Opus 5. Die Botschaft passt in eine Zeile: Ergebnisse auf dem Niveau von Claude Fable 5.1, dem größten Modell des Unternehmens, zu einem Preis, der pro Token 20 % unter Opus 5 liegt und nach Schätzung von Anthropic bei typischen Workloads 40 % darunter. Das Modell ist in den Claude-Apps, auf der Claude Platform als claude-opus-5-5 sowie bei Amazon Web Services, Google Cloud und Microsoft Azure verfügbar.
TechCrunch, 9to5Mac und Yahoo Finance stellten alle dasselbe in den Vordergrund: Das ist nicht nur ein stärkeres Modell, sondern auch ein günstigeres. Genau diese Kombination macht das Release für Unternehmen relevant, die keine KI-Labore sind.
Was Claude Opus 5.5 kostet
Die Launch-Seite von Anthropic nennt die API-Preise pro Million Tokens:
- Input: 4 $ (Opus 5: 5 $).
- Output: 20 $ (Opus 5: 25 $).
- Cache-Lesezugriffe: 0,20 $ (Opus 5: 0,50 $), 60 % weniger. Cache-Schreibzugriffe kosten 5 $.
- Schnellmodus: 8 $ Input und 40 $ Output, bis zu 2,5-mal schneller.
Die größere Ersparnis entsteht laut Anthropic dadurch, dass das Modell dieselbe Aufgabe in weniger Schritten und mit weniger Tokens erledigt. Die Ausgabe ist 30 % schneller als bei Opus 5. Kundenzitate auf der Launch-Seite beziffern das: Laut Optiver erreichte Opus 5.5 die Qualität von Opus 5 „mit etwa der Hälfte der Turns, der Zeit und der Output-Tokens“, und Kiro berichtet von rund 40 % weniger Aufrufen bei halbem Tokenverbrauch.
Für Abonnenten merkt 9to5Mac an, dass die Fünf-Stunden-Nutzungslimits in den Tarifen Pro, Max und Team angehoben wurden; zudem erhalten Abonnenten jetzt ein Zurücksetzen des Rate Limits, das sie aufsparen und zu einem selbst gewählten Zeitpunkt einlösen können.
So schneidet es im Vergleich zu Fable 5.1, Opus 5 und GPT-6 Astra ab
Anthropic hat eine Vergleichstabelle veröffentlicht. Es handelt sich um Messungen des Herstellers selbst, nicht um unabhängige Tests; betrachten Sie sie daher als Ausgangspunkt:
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra |
|---|---|---|---|---|
| Terminal-Bench 4.0 (agentisches Coding) | 66,4 % | 55,8 % | 52,3 % | 57,9 % |
| FrontierCode v1.1 | 54,4 % | 50,3 % | 48,0 % | 53,3 % |
| GDPval-AA v2.1 (Wissensarbeit, Elo) | 1846 | 1735 | 1708 | 1542 |
| AutomationBench | 40,0 % | 31,4 % | 26,9 % | 41,4 % |
| OSWorld 2.0 (Computernutzung) | 81,8 % | 80,7 % | 74,0 % | — |
| Humanity’s Last Exam (mit Tools) | 67,7 % | 65,6 % | 63,6 % | 57,2 % |
Zwei Details verdienen Beachtung. GPT-6 Astra liegt bei AutomationBench und bei Terminal-Bench-Science (64,6 % gegenüber 58,7 %) weiterhin vorn, Opus 5.5 führt also nicht überall. Und 9to5Mac weist darauf hin, dass Opus 5.5 Astra bei FrontierCode knapp schlägt, und das bei etwa 20 % der Kosten pro Aufgabe – was mehr zählt als der Score selbst.
Was sich laut Anthropic in der Praxis geändert hat
Lange Aufgaben. Anthropic nennt eine Code-Migration mit 680.000 Zeilen, die in weniger als einem Tag abgeschlossen war, und einen Test, bei dem das Modell die Ladezeiten aller Seiten einer Web-App verkürzen sollte: Opus 5.5 gelang das 39 von 40 Malen, während Opus 5 kleinere Verbesserungen erzielte, die zudem das Verhalten der App veränderten.
Klarere Texte. Nach Angaben des Unternehmens stellt das Modell die wichtigen Informationen an den Anfang und verwendet weniger Fachjargon. Box berichtet von Ausgaben, die 40 % weniger weitschweifig sind als bei Opus 5, ohne an Genauigkeit zu verlieren. TechCrunch hob dieselbe Änderung hervor.
Analyse und Prüfung. Laut Deloitte fand Opus 5.5 72 % der bekannten Fehler, gegenüber 56 % bei Opus 5 mit hohem Effort, und das mit weniger Fehlalarmen. Thomson Reuters Labs und Hebbia melden bei ihren Rechercheaufgaben beide eine Abdeckung von 86,6 % gegenüber 60,3 % bei Opus 5.
Sicherheit. Anthropic meldet die besten Werte aller neueren Claude-Modelle in seinem automatisierten Verhaltensaudit, 85 % weniger Versuche als Opus 5, Eindämmungsgrenzen zu umgehen, und eine bessere Widerstandsfähigkeit gegen Prompt Injection. Das Modell wurde vor der Veröffentlichung von METR und Frontier Design evaluiert. Yahoo Finance merkt an, dass es das erste Modell von Anthropic ist, seit CEO Dario Amodei in diesem Monat einen Essay veröffentlicht hat, in dem er eine Verlangsamung der KI-Entwicklung fordert.
Wie es weitergeht. Anthropic bezeichnet dies als erstes Release der 5.5-Welle: Sonnet 5.5 und Haiku 5.5 sollen in den kommenden Wochen folgen.
Was das für Ihr Unternehmen bedeutet
Der Preis für „gut genug“ ist erneut gesunken. Vor einem Monat lautete die Wahl: ein Frontier-Modell zum Frontier-Preis oder ein günstigeres mit mehr Nacharbeit. Wenn die Zahlen von Anthropic bei Ihren Aufgaben halten, kostet Qualität auf Fable-Niveau jetzt so viel wie Opus. Unsere Einschätzung: Jetzt ist der Moment, die drei Aufgaben, auf die es Ihnen wirklich ankommt, erneut durchlaufen zu lassen und die Kosten pro erledigter Aufgabe zu vergleichen, nicht den Preis pro Token. KI-Anbieter konkurrieren über die Kosten erledigter Arbeit, von Modellen bis zu ChatGPT Sponsored Agents, und Ihr Vergleich sollte nach demselben Maßstab messen.
Automatisierungen, die zu teuer waren, können sich jetzt rechnen. Lead-Routing, Triage von Anfragen, CRM-Datenpflege, Wochenberichte: Solche Abläufe laufen tausende Male im Monat, und eine um 40 % niedrigere Rechnung verändert den Business Case. Die meisten unserer Projekte für CRM und Marketing-Automatisierung geraten genau an dieser Rechnung ins Stocken, deshalb lohnt es sich, sie mit den neuen Preisen neu aufzustellen.
Tempo zählt vor allem bei Websites und Code. Ein Modell, das eine Performance-Aufgabe für die gesamte Website in einem Durchgang statt in mehreren erledigt, ist für alle nützlich, die einen Onlineshop oder eine mehrsprachige Website betreiben. Bei unserer eigenen Website-Entwicklung liegt der praktische Gewinn in weniger Review-Runden, nicht in Zauberei.
Wechseln Sie nicht wegen einer Schlagzeile. Herstellerbenchmarks werden im Setup des Herstellers gemessen. Testen Sie mit Ihren eigenen Daten, behalten Sie das alte Modell eine Woche lang als Fallback und achten Sie darauf, wo das neue anders entscheidet. Das gilt besonders für Texte mit Kundenkontakt, bei denen ein kürzerer, direkterer Stil nur dann eine Verbesserung ist, wenn er weiterhin nach Ihrer Marke klingt.
Ein Hinweis zur Transparenz: M-ADS nutzt Claude in der täglichen Arbeit, und dieser Artikel wurde am Tag des Launchs mit Claude Opus 5.5 recherchiert und entworfen und anschließend anhand der unten aufgeführten Quellen geprüft. Wir stehen in keiner geschäftlichen Beziehung zu Anthropic.