Claude Opus 5.5 : plus de capacités, moins de coût, de nouvelles règles
Anthropic a lancé Claude Opus 5.5 le 22 septembre 2026. Il promet le niveau de Fable 5.1 sur la plupart des tâches, pour un prix inférieur à celui d'Opus 5. Voici ce qui change pour une équipe qui le met en production.
Claude Opus 5.5 coûte 4 $ par million de tokens en entrée et 20 $ en sortie (Opus 5 : 5 $ et 25 $), conserve une fenêtre de contexte d'un million de tokens et, selon Anthropic, se comporte comme Claude Fable 5.1 sur la plupart des tâches, génère plus de 30 % plus vite qu'Opus 5 et coûte 40 % de moins à faire tourner sur des charges typiques.
Pour les équipes techniques, il apporte des changements incompatibles : le raisonnement ne peut plus être désactivé, l'effort par défaut descend à medium et l'appel forcé d'outils disparaît. Notre lecture : c'est le nouveau point de départ pour les agents et le travail intellectuel, à condition de le valider sur vos propres prompts.
Ce qu'est Claude Opus 5.5 et ce qu'il promet
Claude Opus 5.5 est le nouveau modèle de la gamme Opus d'Anthropic, publié le mardi 22 septembre 2026, deux mois après Opus 5 (24 juillet). Anthropic le présente comme un modèle pour le code agentique de longue durée et le travail intellectuel, et sa documentation recommande désormais de commencer par Opus 5.5 pour la plupart des usages.
Les promesses principales, toutes d'Anthropic : des performances au niveau de Claude Fable 5.1 (son modèle le plus capable largement diffusé) sur la plupart des tâches, un coût d'exploitation inférieur de 40 % à celui d'Opus 5 sur des charges typiques et une génération plus de 30 % plus rapide. Il est disponible via l'API Claude, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry et Claude Platform on AWS, ainsi que dans les offres Pro, Max, Team et Enterprise.
C'est aussi le premier modèle lancé par Anthropic depuis que son PDG, Dario Amodei, a publié en septembre 2026 l'essai We Must Pace the Frontier, qui appelle à ralentir le rythme des progrès de capacités pour laisser du temps à l'alignement et à l'évaluation externe. Le même jour, OpenAI a lancé GPT-6 Sol et GPT-6 Luna, et Anthropic a annoncé Claude Sonnet 5.5 et Claude Haiku 5.5 pour les prochaines semaines.
Sa place dans la famille Claude
Quatre modèles actuels, quatre niveaux de prix.
| Modèle | Entrée / sortie | Contexte | Sortie max. | Effort par défaut | Connaissances jusqu'à |
|---|---|---|---|---|---|
| Claude Fable 5.1 | 10 / 50 | 1M | 128K | high | juin 2026 |
| Claude Opus 5.5 | 4 / 20 | 1M | 128K | medium | juin 2026 |
| Claude Sonnet 5 | 2 / 10 | 1M | 128K | high | janvier 2026 |
| Claude Haiku 4.5 | 1 / 5 | 200K | 64K | sans objet | février 2025 |
La lecture pratique : Opus 5.5 prend la place qui exigeait jusqu'ici de payer le niveau Fable. Fable 5.1 reste pour le raisonnement le plus exigeant et les agents à très long horizon, ou quand vos évaluations d'Opus 5.5 en effort élevé restent insuffisantes. Sonnet 5 et Haiku 4.5 demeurent les options pour le volume et la latence.
Deux détails de prix comptent en production : une lecture de cache de prompt sur Opus 5.5 coûte 0,20 $ par million de tokens (5 % du prix d'entrée, contre 0,50 $ sur Opus 5), et l'API Batch applique une remise de 50 %. En batch, Opus 5.5 accepte jusqu'à 300 000 tokens de sortie avec un en-tête bêta.
Lire les benchmarks avec prudence
Ce que publie Anthropic et ce que disent les classements indépendants.
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 66,4 % | 55,8 % | 52,3 % | 57,9 % |
| FrontierCode v1.1 | 54,4 % | 50,3 % | 48,0 % | 53,3 % |
| CursorBench 4.0 | 57,8 % | 51,8 % | 46,6 % | non publié |
| OSWorld 2.0 (usage de l'ordinateur, score partiel) | 81,8 % | 80,7 % | 74,0 % | non publié |
| Humanity's Last Exam (avec outils) | 67,7 % | 65,6 % | 63,6 % | 57,2 % |
| AutomationBench | 40,0 % | 31,4 % | 26,9 % | 41,4 % |
| Terminal-Bench-Science 0.1 | 58,7 % | 52,6 % | non publié | 64,6 % |
Trois précautions avant de décider sur cette base. D'abord, ces tests sont exécutés ou choisis par l'éditeur lui-même, plusieurs dans des versions récentes (Terminal-Bench 4.0, OSWorld 2.0) sans long historique de comparaison. Ensuite, il ne gagne pas partout : dans le même tableau, GPT-6 Astra passe devant sur AutomationBench et Terminal-Bench-Science. Enfin, aucun de ces tests n'est en espagnol ou en français d'entreprise, là où nous voyons le plus souvent les modèles casser.
Les classements indépendants vont dans le même sens, avec des nuances. Les 25 et 26 septembre, Opus 5.5 était en tête du classement texte d'Arena (1 509 points) et de l'indice d'intelligence d'Artificial Analysis (58 points, version 4.3.2). Il ne figurait pas encore dans le tableau officiel de Terminal-Bench 4.0, mené par GPT-6 Astra à 58,2 %, et sur ARC-AGI-2 GPT-6 Astra obtenait 95,0 % contre 93,3 % pour Opus 5.5, mais pour un coût par tâche presque trois fois supérieur.
Anthropic cite aussi des cas clients : une migration de 680 000 lignes de code en moins d'une journée, ou l'audit d'une base de code de 200 000 lignes en moins de trois heures. Ce sont des anecdotes de communication : un signal utile sur la direction du modèle, pas une promesse pour votre projet.
Ce qui change pour les équipes techniques
Quatre changements cassent le code écrit pour Opus 5.
Le raisonnement est toujours actif. Opus 5.5 raisonne de façon adaptative et on ne peut pas le désactiver ; le seul réglage est le paramètre effort (low, medium, high, xhigh, max). La valeur par défaut descend à medium, un cran sous Opus 5. Anthropic affirme qu'Opus 5.5 en medium dépasse Opus 5 en high sur ses évaluations de code et de travail intellectuel, et que sur plusieurs évaluations de code low s'en approche pour un coût bien moindre. Nous détaillons ce point dans quand payer pour réfléchir.
- Envoyer
thinking: disabledou un budget fixe de tokens de raisonnement renvoie une erreur 400. - L'appel forcé d'outils (
tool_choicesuranyou un outil précis) n'est plus accepté : utilisezautoavec des outils stricts, ou des sorties structurées. - Les blocs de raisonnement sont liés au modèle et à la conversation : si votre code modifie des tours précédents, les comptes créés depuis le 31 août 2026 reçoivent une erreur. L'historique doit être en ajout seul.
- L'usage de l'ordinateur passe uniquement par le nouveau
computer_toolset_20260801; l'ancien outil est refusé.
Un dernier changement ne casse rien mais surprend : les courtes notes que le modèle écrit entre deux appels d'outils arrivent désormais sous forme de blocs de raisonnement, vides par défaut. Si votre interface affiche cette progression, elle restera muette tant que vous n'activez pas le mode d'affichage des mises à jour. Enfin, le mode rapide (aperçu, API Claude uniquement) promet jusqu'à 2,5 fois plus de vitesse pour 8 $ / 40 $ par million de tokens.
Fixez effort explicitement sur chaque route de votre application et relancez votre batterie d'évaluation. Reprendre les réglages d'Opus 5 donne des tours plus longs et plus de tokens de sortie, car à niveau égal Opus 5.5 a tendance à réfléchir davantage.
Ce que cela coûte vraiment : un exemple chiffré
Le prix au token baisse de 20 % ; le coût par tâche peut baisser bien davantage.
Prenons une étape typique d'agent : 12 000 tokens en entrée, dont 10 000 forment un préfixe stable (instructions, outils, documents de référence) que l'on peut mettre en cache, et 2 000 tokens en sortie, raisonnement compris, facturé comme de la sortie. Ce sont des hypothèses illustratives, pas des mesures de projet.
| Scénario | Coût par étape | Pour 100 000 étapes |
|---|---|---|
| Opus 5, sans cache | 0,110 $ | 11 000 $ |
| Opus 5.5, sans cache | 0,088 $ | 8 800 $ |
| Opus 5, préfixe en cache | 0,065 $ | 6 500 $ |
| Opus 5.5, préfixe en cache | 0,050 $ | 5 000 $ |
La grosse économie ne vient pas du prix catalogue mais de la combinaison : lectures de cache bon marché, effort par défaut plus bas et, selon Anthropic, moins de tokens par tâche résolue. Le chiffre à suivre est le coût par tâche terminée : une étape moins chère qui exige deux nouvelles tentatives ne l'est pas. Si le travail n'est pas interactif, l'API Batch divise la facture par deux. D'autres leviers dans le vrai coût de l'IA.
Sécurité et refus : ce que votre équipe doit savoir
Opus 5.5 applique des classificateurs de sécurité en cybersécurité et en biologie, proches de ceux de Fable 5.1 ; celui de biologie est nouveau par rapport à Opus 5. Selon la documentation, chercher des vulnérabilités dans du code source est autorisé, tandis que les demandes de recherche biologique à double usage sont refusées, sauf pour les participants au programme de vérification d'Anthropic. Une nouvelle catégorie, reasoning_extraction, refuse les tentatives de faire recopier au modèle son raisonnement interne dans la réponse.
Pour une équipe produit, la conséquence est concrète : un refus arrive comme une réponse normale avec stop_reason: refusal, pas comme une erreur. Votre code doit le traiter, le journaliser et, si besoin, relancer la requête sur un autre modèle ; l'API permet de configurer ce repli côté serveur. Les équipes de pentest et de sécurité offensive ont intérêt à tester leurs flux réels avant de migrer.
Côté robustesse, Anthropic affirme qu'Opus 5.5 égale ou dépasse Opus 5 face à l'injection de prompt dans tous les scénarios testés, et tente de contourner les limites de confinement 85 % moins souvent qu'Opus 5. C'est une bonne nouvelle, mais aucun modèle ne règle seul l'injection de prompt : la conception de l'agent reste la défense principale, comme nous l'expliquons dans injection de prompt et sécurité des agents.
Quel modèle pour quel travail
Notre point de départ avant d'évaluer ; il ne remplace pas l'évaluation.
| Travail | Modèle de départ | Effort de départ | Pourquoi |
|---|---|---|---|
| Agents de code, migrations, longues refontes | Opus 5.5 | medium, puis high en cas d'échec | Le cas pour lequel Anthropic l'a conçu |
| Analyse de longs documents, finance, juridique | Opus 5.5 | medium | 1M de contexte et lectures de cache bon marché |
| Raisonnement très difficile, agents à très long horizon | Fable 5.1 ou Opus 5.5 en xhigh | high ou plus | Comparer les deux dans votre évaluation |
| Service client et chat à fort volume | Sonnet 5 ou Haiku 4.5 | low ou medium | Latence et coût par conversation |
| Classification et extraction en masse | Haiku 4.5 en batch | sans objet | Le coût prime ; la qualité suffit souvent |
| Réponses en temps réel avec Opus | Opus 5.5 en mode rapide | low ou medium | Seulement si la latence justifie de payer le double |
Anthropic ne garantit Haiku 4.5 qu'au moins jusqu'au 15 octobre 2026 et a déjà annoncé Haiku 5.5. Si vous lancez aujourd'hui une nouvelle route à fort volume, prévoyez cette migration dès la conception. GPT-6 Sol (2 $ / 10 $) et les Gemini Flash jouent sur le même segment.
Ce tableau n'est qu'un point de départ. La méthode que nous utilisons pour trancher, avec 30 prompts réels par client et en trois langues, est décrite dans comment nous choisissons un modèle, et le paysage complet des fournisseurs dans la carte des modèles de septembre 2026.
Check-list pour migrer depuis Opus 5
- Fixez
effortpar route et lancez votre évaluation en low, medium et high avant de choisir. - Supprimez tout
thinking: disabledou budget fixe de raisonnement. - Remplacez l'appel forcé d'outils par
autoavec des outils stricts ou des sorties structurées. - Rendez l'historique de conversation en ajout seul : plus aucune modification des tours précédents.
- Si vous utilisez l'usage de l'ordinateur, passez à
computer_toolset_20260801et testez-le d'abord sur Opus 5, qui accepte les deux versions. - Affichez les mises à jour de progression entre outils si votre interface en dépend.
- Traitez
stop_reason: refusalavec journalisation et modèle de repli. - Vérifiez les limites de débit de votre niveau pour Opus 5.5 avant de basculer du volume.
- Comparez le coût par tâche terminée, pas le prix au token, sur au moins une semaine de trafic réel.
Ce que cela signifie pour les entreprises en Colombie et en Europe
Achats et contrats. Opus 5.5 est disponible sur les trois grands clouds (AWS, Google Cloud et Microsoft). Pour beaucoup d'entreprises colombiennes et européennes, cela permet de l'utiliser dans des contrats et engagements de dépense existants, sans référencer un nouveau fournisseur. Attention au coût de la résidence : l'inférence limitée aux États-Unis coûte 1,1 fois le prix de base, et les endpoints régionaux de Bedrock et Google Cloud portent une majoration de 10 %.
Risque d'accès. Le 12 juin 2026, une directive américaine de contrôle des exportations a obligé Anthropic à retirer Fable 5 et Mythos 5 à tous ses utilisateurs ; Fable 5 est revenu le 1er juillet. Toute entreprise hors des États-Unis devrait disposer d'un modèle de repli d'un autre fournisseur, testé et prêt à être activé.
Données personnelles. En Colombie, envoyer des données personnelles à un modèle hébergé à l'étranger constitue un transfert international au sens de la loi 1581 de 2012 : vérifiez l'autorisation des personnes concernées et les garanties du fournisseur. Dans l'Union européenne, le RGPD s'applique et, depuis le 2 août 2026, les obligations de transparence de l'AI Act pour quiconque déploie un chatbot. Les obligations liées aux modèles à usage général pèsent sur Anthropic ; les vôtres portent sur votre usage. Détails dans notre carte réglementaire 2026.
Langues. Aucun benchmark publié ne mesure l'espagnol d'un assureur colombien ou le français d'un cabinet parisien. Ce test vous revient. Au Slash AI Lab, nous passons Opus 5.5 par la même batterie de 30 prompts par client que pour tout nouveau modèle ; nous ne publierons aucun chiffre avant d'avoir des résultats reproductibles.
Si vous utilisez Opus 5 ou Fable 5.1 en production, lancez cette semaine un essai contrôlé d'Opus 5.5, avec l'effort fixé et votre évaluation en espagnol et en français. Si vous utilisez Sonnet pour le volume, attendez Sonnet 5.5, annoncé dans les prochaines semaines, avant de basculer cette route.
L'essentiel
- Opus 5.5 (22 septembre 2026) coûte 4 $ / 20 $ par million de tokens, 20 % de moins qu'Opus 5, avec 1M de contexte.
- Anthropic le place au niveau de Fable 5.1 sur la plupart des tâches ; les benchmarks viennent de l'éditeur et GPT-6 Astra en remporte deux.
- Le raisonnement ne se désactive plus : l'effort est le levier et sa valeur par défaut descend à
medium. - Quatre changements cassent le code écrit pour Opus 5 ; la migration demande une check-list et une nouvelle évaluation.
- Mesurez le coût par tâche terminée : le cache à 0,20 $ et le batch pèsent plus sur la facture que le prix catalogue.
Sources
- Introducing Claude Opus 5.5
- Claude Opus 5.5: model page
- What's new in Claude Opus 5.5
- Migrating to Claude Opus 5.5
- Models overview
- Pricing
- Claude Opus 5.5 system card
- Anthropic releases Opus 5.5 with lower prices and Fable-level performance
- Anthropic Releases Claude Opus 5.5
- We Must Pace the Frontier
- Update on access to Claude Fable 5 and Claude Mythos 5
- GPT-6 Astra
- Text leaderboard
- AI model leaderboards (Intelligence Index)
- Terminal-Bench leaderboard
- ARC-AGI leaderboard
Note éditoriale : cette analyse reflète les informations publiques disponibles à la date de révision. Modèles, prix et règles évoluent vite ; chaque donnée tierce renvoie à sa source et nos opinions sont présentées comme telles. Une erreur ? Écrivez à contact@slash-digital.io.
Les questions qu'on nous pose souvent
Quand Claude Opus 5.5 est-il sorti ?
Le 22 septembre 2026. Anthropic s'engage à le maintenir disponible au moins jusqu'au 22 septembre 2027.
Combien coûte Claude Opus 5.5 ?
4 $ par million de tokens en entrée et 20 $ en sortie ; la lecture de cache coûte 0,20 $ par million et l'API Batch offre 50 % de remise.
Est-il meilleur que Claude Fable 5.1 ?
Selon Anthropic, il atteint ce niveau sur la plupart des tâches pour moins de la moitié du prix. Fable 5.1 reste recommandé pour le raisonnement le plus exigeant. Seule votre évaluation le confirme pour votre cas.
Puis-je désactiver le raisonnement pour économiser ?
Non. Le raisonnement est toujours actif ; pour économiser, on baisse le paramètre effort à low ou medium.
Est-il disponible depuis la Colombie et l'UE ?
Oui, via l'API Claude et via AWS, Google Cloud et Microsoft. Vérifiez les régions disponibles et vos obligations de protection des données avant d'envoyer des données personnelles.
D'autres analyses à lire
La carte des modèles d'IA, septembre 2026
Claude Opus 5.5, GPT-6 Astra, Gemini 3.8 Flash, Grok 4.7, Muse Spark : qui mène en septembre 2026, ce que coûte chaque gamme et quoi tester selon votre usage.
ModèlesModèles de raisonnement : quand payer pour réfléchir
Réfléchir coûte des tokens et des secondes. Comment Anthropic, OpenAI et Google exposent l'effort, où il paie, où non, et comment le régler au coût par tâche résolue.
Stratégie et régulationLe vrai coût de l'IA
Comment l'IA est facturée, pourquoi le coût par tâche résolue compte plus que le prix au token, leviers chiffrés, coûts cachés et seuil local ou API.
Mettons-le en production
Racontez-nous votre défi. Nous répondons sous 24 heures ouvrées avec une première lecture honnête : si nous pouvons aider, nous dirons comment ; sinon, nous dirons qui peut.
Je réponds en personne. Pas de formulaires interminables ni de réponses automatiques.