Anthropic a lancé Claude Opus 5.5 le 22 septembre 2026, deux mois après Opus 5. L’argument tient en une ligne : des résultats au niveau de Claude Fable 5.1, le plus grand modèle de l’entreprise, pour un prix inférieur de 20 % à celui d’Opus 5 par token et, selon l’estimation d’Anthropic, de 40 % sur des charges de travail typiques. Le modèle est disponible dans les applications Claude, sur la Claude Platform sous le nom claude-opus-5-5, ainsi que sur Amazon Web Services, Google Cloud et Microsoft Azure.
TechCrunch, 9to5Mac et Yahoo Finance ont tous mis en avant la même chose : ce n’est pas seulement un modèle plus puissant, c’est aussi un modèle moins cher. C’est cette combinaison qui rend cette sortie pertinente pour les entreprises qui ne sont pas des laboratoires d’IA.
Combien coûte Claude Opus 5.5
La page de lancement d’Anthropic indique les prix de l’API par million de tokens :
- Entrée : 4 $ (Opus 5 : 5 $).
- Sortie : 20 $ (Opus 5 : 25 $).
- Lectures en cache : 0,20 $ (Opus 5 : 0,50 $), soit 60 % de moins. Les écritures en cache coûtent 5 $.
- Mode rapide : 8 $ en entrée et 40 $ en sortie, jusqu’à 2,5 fois plus rapide.
L’économie la plus importante, selon Anthropic, vient du fait que le modèle accomplit le même travail en moins d’étapes et avec moins de tokens. La génération est 30 % plus rapide qu’avec Opus 5. Les témoignages clients publiés sur la page de lancement le chiffrent : Optiver indique qu’Opus 5.5 a égalé la qualité d’Opus 5 « en environ deux fois moins de tours, de temps et de tokens de sortie », et Kiro fait état d’environ 40 % d’appels en moins, avec deux fois moins de tokens.
Côté abonnements, 9to5Mac précise que les limites d’utilisation sur cinq heures ont été relevées sur les offres Pro, Max et Team, et que les abonnés bénéficient désormais d’une réinitialisation de leur limite de débit (rate limit) qu’ils peuvent mettre de côté et utiliser quand ils le souhaitent.
Comment il se compare à Fable 5.1, Opus 5 et GPT-6 Astra
Anthropic a publié un tableau comparatif. Ce sont les mesures de l’éditeur lui-même, pas des tests indépendants : prenez-les comme un point de départ.
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra |
|---|---|---|---|---|
| Terminal-Bench 4.0 (code agentique) | 66,4 % | 55,8 % | 52,3 % | 57,9 % |
| FrontierCode v1.1 | 54,4 % | 50,3 % | 48,0 % | 53,3 % |
| GDPval-AA v2.1 (travail intellectuel, Elo) | 1846 | 1735 | 1708 | 1542 |
| AutomationBench | 40,0 % | 31,4 % | 26,9 % | 41,4 % |
| OSWorld 2.0 (utilisation d’un ordinateur) | 81,8 % | 80,7 % | 74,0 % | — |
| Humanity’s Last Exam (avec outils) | 67,7 % | 65,6 % | 63,6 % | 57,2 % |
Deux détails méritent l’attention. GPT-6 Astra reste en tête sur AutomationBench et sur Terminal-Bench-Science (64,6 % contre 58,7 %) : Opus 5.5 ne domine donc pas partout. Et 9to5Mac souligne que sur FrontierCode, Opus 5.5 devance de peu Astra pour environ 20 % du coût par tâche, ce qui compte davantage que le score lui-même.
Ce qui change en pratique, selon Anthropic
Les tâches longues. Anthropic cite une migration de code de 680 000 lignes bouclée en moins d’une journée, ainsi qu’un test dans lequel le modèle devait réduire les temps de chargement de toutes les pages d’une application web : Opus 5.5 a réussi 39 fois sur 40, tandis qu’Opus 5 apportait des améliorations plus modestes qui modifiaient en outre le comportement de l’application.
Une écriture plus claire. L’entreprise indique que le modèle place l’information importante en premier et utilise moins de jargon. Box constate des réponses 40 % moins verbeuses qu’avec Opus 5, sans perte de précision. TechCrunch a relevé le même changement.
Analyse et vérification. Selon Deloitte, Opus 5.5 a détecté 72 % des bugs connus, contre 56 % pour Opus 5 en effort élevé, avec moins de fausses alertes. Thomson Reuters Labs et Hebbia font tous deux état d’une couverture de 86,6 % contre 60,3 % pour Opus 5 sur leurs tâches de recherche.
Sécurité. Anthropic annonce les meilleurs scores de tous ses modèles Claude récents à son audit comportemental automatisé, 85 % de tentatives en moins qu’Opus 5 pour contourner les limites de confinement, et une meilleure résistance à l’injection de prompt. Le modèle a été évalué avant sa sortie par METR et Frontier Design. Yahoo Finance note qu’il s’agit du premier modèle d’Anthropic depuis que son PDG, Dario Amodei, a publié ce mois-ci un essai appelant à ralentir le développement de l’IA.
La suite. Anthropic présente cette sortie comme la première de la vague 5.5 : Sonnet 5.5 et Haiku 5.5 sont attendus dans les semaines à venir.
Ce que cela signifie pour votre entreprise
Le prix du « suffisamment bon » a encore baissé. Il y a un mois, le choix se faisait entre un modèle de pointe au prix fort et un modèle moins cher, avec davantage de reprises. Si les chiffres d’Anthropic se confirment sur vos tâches, une qualité de niveau Fable coûte désormais le prix d’un Opus. Notre avis : c’est le moment de relancer les trois tâches qui comptent vraiment pour vous et de comparer le coût par tâche menée à bien, pas le prix par token. Les éditeurs d’IA se livrent concurrence sur le coût du travail effectivement accompli, des modèles jusqu’aux Sponsored Agents de ChatGPT, et votre comparaison doit se mesurer de la même manière.
Des automatisations trop coûteuses peuvent désormais devenir rentables. Routage des leads, tri des demandes, hygiène du CRM, rapports hebdomadaires : ces processus tournent des milliers de fois par mois, et une facture 40 % plus basse change l’équation économique. La plupart de nos projets CRM et d’automatisation marketing butent précisément sur ce calcul : il vaut la peine de le refaire avec les nouveaux prix.
La vitesse compte surtout pour les sites web et le code. Un modèle qui mène à bien une optimisation des performances sur tout un site en un seul passage plutôt qu’en plusieurs est utile à quiconque gère une boutique en ligne ou un site multilingue. Dans notre propre activité de développement de sites web, le gain concret, ce sont moins de cycles de relecture, pas de la magie.
Ne changez pas de modèle sur la foi d’un gros titre. Les benchmarks des éditeurs sont mesurés sur leur propre configuration. Testez sur vos propres données, gardez l’ancien modèle en solution de repli pendant une semaine et observez où le nouveau tranche différemment. C’est particulièrement vrai pour les textes destinés aux clients, où un style plus court et plus direct n’est un progrès que s’il sonne toujours comme votre marque.
Une note de transparence : M-ADS utilise Claude au quotidien, et cet article a été documenté et rédigé avec Claude Opus 5.5 le jour du lancement, puis vérifié à l’aide des sources indiquées ci-dessous. Nous n’avons aucune relation commerciale avec Anthropic.