Modèles · Septembre 2026

Claude Opus 5.5 : plus de capacités, moins de coût, de nouvelles règles

Anthropic a lancé Claude Opus 5.5 le 22 septembre 2026. Il promet le niveau de Fable 5.1 sur la plupart des tâches, pour un prix inférieur à celui d'Opus 5. Voici ce qui change pour une équipe qui le met en production.

4 $ / 20 $ par million de tokens1M tokens de contexte22 sept. 2026 lancement
En bref

Claude Opus 5.5 coûte 4 $ par million de tokens en entrée et 20 $ en sortie (Opus 5 : 5 $ et 25 $), conserve une fenêtre de contexte d'un million de tokens et, selon Anthropic, se comporte comme Claude Fable 5.1 sur la plupart des tâches, génère plus de 30 % plus vite qu'Opus 5 et coûte 40 % de moins à faire tourner sur des charges typiques.

Pour les équipes techniques, il apporte des changements incompatibles : le raisonnement ne peut plus être désactivé, l'effort par défaut descend à medium et l'appel forcé d'outils disparaît. Notre lecture : c'est le nouveau point de départ pour les agents et le travail intellectuel, à condition de le valider sur vos propres prompts.

Ce qu'est Claude Opus 5.5 et ce qu'il promet

Claude Opus 5.5 est le nouveau modèle de la gamme Opus d'Anthropic, publié le mardi 22 septembre 2026, deux mois après Opus 5 (24 juillet). Anthropic le présente comme un modèle pour le code agentique de longue durée et le travail intellectuel, et sa documentation recommande désormais de commencer par Opus 5.5 pour la plupart des usages.

Les promesses principales, toutes d'Anthropic : des performances au niveau de Claude Fable 5.1 (son modèle le plus capable largement diffusé) sur la plupart des tâches, un coût d'exploitation inférieur de 40 % à celui d'Opus 5 sur des charges typiques et une génération plus de 30 % plus rapide. Il est disponible via l'API Claude, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry et Claude Platform on AWS, ainsi que dans les offres Pro, Max, Team et Enterprise.

C'est aussi le premier modèle lancé par Anthropic depuis que son PDG, Dario Amodei, a publié en septembre 2026 l'essai We Must Pace the Frontier, qui appelle à ralentir le rythme des progrès de capacités pour laisser du temps à l'alignement et à l'évaluation externe. Le même jour, OpenAI a lancé GPT-6 Sol et GPT-6 Luna, et Anthropic a annoncé Claude Sonnet 5.5 et Claude Haiku 5.5 pour les prochaines semaines.

Sa place dans la famille Claude

Quatre modèles actuels, quatre niveaux de prix.

Données de la documentation d'Anthropic (models overview), consultée le 26 septembre 2026. Prix en dollars par million de tokens.
ModèleEntrée / sortieContexteSortie max.Effort par défautConnaissances jusqu'à
Claude Fable 5.110 / 501M128Khighjuin 2026
Claude Opus 5.54 / 201M128Kmediumjuin 2026
Claude Sonnet 52 / 101M128Khighjanvier 2026
Claude Haiku 4.51 / 5200K64Ksans objetfévrier 2025

La lecture pratique : Opus 5.5 prend la place qui exigeait jusqu'ici de payer le niveau Fable. Fable 5.1 reste pour le raisonnement le plus exigeant et les agents à très long horizon, ou quand vos évaluations d'Opus 5.5 en effort élevé restent insuffisantes. Sonnet 5 et Haiku 4.5 demeurent les options pour le volume et la latence.

Deux détails de prix comptent en production : une lecture de cache de prompt sur Opus 5.5 coûte 0,20 $ par million de tokens (5 % du prix d'entrée, contre 0,50 $ sur Opus 5), et l'API Batch applique une remise de 50 %. En batch, Opus 5.5 accepte jusqu'à 300 000 tokens de sortie avec un en-tête bêta.

Lire les benchmarks avec prudence

Ce que publie Anthropic et ce que disent les classements indépendants.

Résultats publiés par Anthropic le 22 septembre 2026, en effort maximal. Quand un classificateur de sécurité est intervenu, la tâche a tourné sur Opus 4.8 ou Opus 5. GPT-6 Astra est le modèle d'OpenAI de sa comparaison.
BenchmarkOpus 5.5Fable 5.1Opus 5GPT-6 Astra
Terminal-Bench 4.066,4 %55,8 %52,3 %57,9 %
FrontierCode v1.154,4 %50,3 %48,0 %53,3 %
CursorBench 4.057,8 %51,8 %46,6 %non publié
OSWorld 2.0 (usage de l'ordinateur, score partiel)81,8 %80,7 %74,0 %non publié
Humanity's Last Exam (avec outils)67,7 %65,6 %63,6 %57,2 %
AutomationBench40,0 %31,4 %26,9 %41,4 %
Terminal-Bench-Science 0.158,7 %52,6 %non publié64,6 %

Trois précautions avant de décider sur cette base. D'abord, ces tests sont exécutés ou choisis par l'éditeur lui-même, plusieurs dans des versions récentes (Terminal-Bench 4.0, OSWorld 2.0) sans long historique de comparaison. Ensuite, il ne gagne pas partout : dans le même tableau, GPT-6 Astra passe devant sur AutomationBench et Terminal-Bench-Science. Enfin, aucun de ces tests n'est en espagnol ou en français d'entreprise, là où nous voyons le plus souvent les modèles casser.

Les classements indépendants vont dans le même sens, avec des nuances. Les 25 et 26 septembre, Opus 5.5 était en tête du classement texte d'Arena (1 509 points) et de l'indice d'intelligence d'Artificial Analysis (58 points, version 4.3.2). Il ne figurait pas encore dans le tableau officiel de Terminal-Bench 4.0, mené par GPT-6 Astra à 58,2 %, et sur ARC-AGI-2 GPT-6 Astra obtenait 95,0 % contre 93,3 % pour Opus 5.5, mais pour un coût par tâche presque trois fois supérieur.

Anthropic cite aussi des cas clients : une migration de 680 000 lignes de code en moins d'une journée, ou l'audit d'une base de code de 200 000 lignes en moins de trois heures. Ce sont des anecdotes de communication : un signal utile sur la direction du modèle, pas une promesse pour votre projet.

Ce qui change pour les équipes techniques

Quatre changements cassent le code écrit pour Opus 5.

Le raisonnement est toujours actif. Opus 5.5 raisonne de façon adaptative et on ne peut pas le désactiver ; le seul réglage est le paramètre effort (low, medium, high, xhigh, max). La valeur par défaut descend à medium, un cran sous Opus 5. Anthropic affirme qu'Opus 5.5 en medium dépasse Opus 5 en high sur ses évaluations de code et de travail intellectuel, et que sur plusieurs évaluations de code low s'en approche pour un coût bien moindre. Nous détaillons ce point dans quand payer pour réfléchir.

  • Envoyer thinking: disabled ou un budget fixe de tokens de raisonnement renvoie une erreur 400.
  • L'appel forcé d'outils (tool_choice sur any ou un outil précis) n'est plus accepté : utilisez auto avec des outils stricts, ou des sorties structurées.
  • Les blocs de raisonnement sont liés au modèle et à la conversation : si votre code modifie des tours précédents, les comptes créés depuis le 31 août 2026 reçoivent une erreur. L'historique doit être en ajout seul.
  • L'usage de l'ordinateur passe uniquement par le nouveau computer_toolset_20260801 ; l'ancien outil est refusé.

Un dernier changement ne casse rien mais surprend : les courtes notes que le modèle écrit entre deux appels d'outils arrivent désormais sous forme de blocs de raisonnement, vides par défaut. Si votre interface affiche cette progression, elle restera muette tant que vous n'activez pas le mode d'affichage des mises à jour. Enfin, le mode rapide (aperçu, API Claude uniquement) promet jusqu'à 2,5 fois plus de vitesse pour 8 $ / 40 $ par million de tokens.

Règle pratique

Fixez effort explicitement sur chaque route de votre application et relancez votre batterie d'évaluation. Reprendre les réglages d'Opus 5 donne des tours plus longs et plus de tokens de sortie, car à niveau égal Opus 5.5 a tendance à réfléchir davantage.

Ce que cela coûte vraiment : un exemple chiffré

Le prix au token baisse de 20 % ; le coût par tâche peut baisser bien davantage.

Prenons une étape typique d'agent : 12 000 tokens en entrée, dont 10 000 forment un préfixe stable (instructions, outils, documents de référence) que l'on peut mettre en cache, et 2 000 tokens en sortie, raisonnement compris, facturé comme de la sortie. Ce sont des hypothèses illustratives, pas des mesures de projet.

Calcul illustratif aux prix catalogue d'Anthropic. Hors écriture initiale du cache (cache de 5 minutes : 5 $ par million de tokens sur Opus 5.5), amortie sur les requêtes.
ScénarioCoût par étapePour 100 000 étapes
Opus 5, sans cache0,110 $11 000 $
Opus 5.5, sans cache0,088 $8 800 $
Opus 5, préfixe en cache0,065 $6 500 $
Opus 5.5, préfixe en cache0,050 $5 000 $

La grosse économie ne vient pas du prix catalogue mais de la combinaison : lectures de cache bon marché, effort par défaut plus bas et, selon Anthropic, moins de tokens par tâche résolue. Le chiffre à suivre est le coût par tâche terminée : une étape moins chère qui exige deux nouvelles tentatives ne l'est pas. Si le travail n'est pas interactif, l'API Batch divise la facture par deux. D'autres leviers dans le vrai coût de l'IA.

Sécurité et refus : ce que votre équipe doit savoir

Opus 5.5 applique des classificateurs de sécurité en cybersécurité et en biologie, proches de ceux de Fable 5.1 ; celui de biologie est nouveau par rapport à Opus 5. Selon la documentation, chercher des vulnérabilités dans du code source est autorisé, tandis que les demandes de recherche biologique à double usage sont refusées, sauf pour les participants au programme de vérification d'Anthropic. Une nouvelle catégorie, reasoning_extraction, refuse les tentatives de faire recopier au modèle son raisonnement interne dans la réponse.

Pour une équipe produit, la conséquence est concrète : un refus arrive comme une réponse normale avec stop_reason: refusal, pas comme une erreur. Votre code doit le traiter, le journaliser et, si besoin, relancer la requête sur un autre modèle ; l'API permet de configurer ce repli côté serveur. Les équipes de pentest et de sécurité offensive ont intérêt à tester leurs flux réels avant de migrer.

Côté robustesse, Anthropic affirme qu'Opus 5.5 égale ou dépasse Opus 5 face à l'injection de prompt dans tous les scénarios testés, et tente de contourner les limites de confinement 85 % moins souvent qu'Opus 5. C'est une bonne nouvelle, mais aucun modèle ne règle seul l'injection de prompt : la conception de l'agent reste la défense principale, comme nous l'expliquons dans injection de prompt et sécurité des agents.

Quel modèle pour quel travail

Notre point de départ avant d'évaluer ; il ne remplace pas l'évaluation.

Recommandation du Slash AI Lab en septembre 2026, pour démarrer les tests. La décision finale vient de vos prompts.
TravailModèle de départEffort de départPourquoi
Agents de code, migrations, longues refontesOpus 5.5medium, puis high en cas d'échecLe cas pour lequel Anthropic l'a conçu
Analyse de longs documents, finance, juridiqueOpus 5.5medium1M de contexte et lectures de cache bon marché
Raisonnement très difficile, agents à très long horizonFable 5.1 ou Opus 5.5 en xhighhigh ou plusComparer les deux dans votre évaluation
Service client et chat à fort volumeSonnet 5 ou Haiku 4.5low ou mediumLatence et coût par conversation
Classification et extraction en masseHaiku 4.5 en batchsans objetLe coût prime ; la qualité suffit souvent
Réponses en temps réel avec OpusOpus 5.5 en mode rapidelow ou mediumSeulement si la latence justifie de payer le double
Attention à Haiku 4.5

Anthropic ne garantit Haiku 4.5 qu'au moins jusqu'au 15 octobre 2026 et a déjà annoncé Haiku 5.5. Si vous lancez aujourd'hui une nouvelle route à fort volume, prévoyez cette migration dès la conception. GPT-6 Sol (2 $ / 10 $) et les Gemini Flash jouent sur le même segment.

Ce tableau n'est qu'un point de départ. La méthode que nous utilisons pour trancher, avec 30 prompts réels par client et en trois langues, est décrite dans comment nous choisissons un modèle, et le paysage complet des fournisseurs dans la carte des modèles de septembre 2026.

Check-list pour migrer depuis Opus 5

  1. Fixez effort par route et lancez votre évaluation en low, medium et high avant de choisir.
  2. Supprimez tout thinking: disabled ou budget fixe de raisonnement.
  3. Remplacez l'appel forcé d'outils par auto avec des outils stricts ou des sorties structurées.
  4. Rendez l'historique de conversation en ajout seul : plus aucune modification des tours précédents.
  5. Si vous utilisez l'usage de l'ordinateur, passez à computer_toolset_20260801 et testez-le d'abord sur Opus 5, qui accepte les deux versions.
  6. Affichez les mises à jour de progression entre outils si votre interface en dépend.
  7. Traitez stop_reason: refusal avec journalisation et modèle de repli.
  8. Vérifiez les limites de débit de votre niveau pour Opus 5.5 avant de basculer du volume.
  9. Comparez le coût par tâche terminée, pas le prix au token, sur au moins une semaine de trafic réel.

Ce que cela signifie pour les entreprises en Colombie et en Europe

Achats et contrats. Opus 5.5 est disponible sur les trois grands clouds (AWS, Google Cloud et Microsoft). Pour beaucoup d'entreprises colombiennes et européennes, cela permet de l'utiliser dans des contrats et engagements de dépense existants, sans référencer un nouveau fournisseur. Attention au coût de la résidence : l'inférence limitée aux États-Unis coûte 1,1 fois le prix de base, et les endpoints régionaux de Bedrock et Google Cloud portent une majoration de 10 %.

Risque d'accès. Le 12 juin 2026, une directive américaine de contrôle des exportations a obligé Anthropic à retirer Fable 5 et Mythos 5 à tous ses utilisateurs ; Fable 5 est revenu le 1er juillet. Toute entreprise hors des États-Unis devrait disposer d'un modèle de repli d'un autre fournisseur, testé et prêt à être activé.

Données personnelles. En Colombie, envoyer des données personnelles à un modèle hébergé à l'étranger constitue un transfert international au sens de la loi 1581 de 2012 : vérifiez l'autorisation des personnes concernées et les garanties du fournisseur. Dans l'Union européenne, le RGPD s'applique et, depuis le 2 août 2026, les obligations de transparence de l'AI Act pour quiconque déploie un chatbot. Les obligations liées aux modèles à usage général pèsent sur Anthropic ; les vôtres portent sur votre usage. Détails dans notre carte réglementaire 2026.

Langues. Aucun benchmark publié ne mesure l'espagnol d'un assureur colombien ou le français d'un cabinet parisien. Ce test vous revient. Au Slash AI Lab, nous passons Opus 5.5 par la même batterie de 30 prompts par client que pour tout nouveau modèle ; nous ne publierons aucun chiffre avant d'avoir des résultats reproductibles.

Notre recommandation

Si vous utilisez Opus 5 ou Fable 5.1 en production, lancez cette semaine un essai contrôlé d'Opus 5.5, avec l'effort fixé et votre évaluation en espagnol et en français. Si vous utilisez Sonnet pour le volume, attendez Sonnet 5.5, annoncé dans les prochaines semaines, avant de basculer cette route.

L'essentiel

  • Opus 5.5 (22 septembre 2026) coûte 4 $ / 20 $ par million de tokens, 20 % de moins qu'Opus 5, avec 1M de contexte.
  • Anthropic le place au niveau de Fable 5.1 sur la plupart des tâches ; les benchmarks viennent de l'éditeur et GPT-6 Astra en remporte deux.
  • Le raisonnement ne se désactive plus : l'effort est le levier et sa valeur par défaut descend à medium.
  • Quatre changements cassent le code écrit pour Opus 5 ; la migration demande une check-list et une nouvelle évaluation.
  • Mesurez le coût par tâche terminée : le cache à 0,20 $ et le batch pèsent plus sur la facture que le prix catalogue.

Sources

  1. Introducing Claude Opus 5.5 · Anthropic, 2026-09-22
  2. Claude Opus 5.5: model page · Anthropic documentation, 2026-09-22
  3. What's new in Claude Opus 5.5 · Anthropic documentation, 2026-09-22
  4. Migrating to Claude Opus 5.5 · Anthropic documentation, 2026-09-22
  5. Models overview · Anthropic documentation, 2026-09
  6. Pricing · Anthropic documentation, 2026-09
  7. Claude Opus 5.5 system card · Anthropic, 2026-09-22
  8. Anthropic releases Opus 5.5 with lower prices and Fable-level performance · TechCrunch, 2026-09-22
  9. Anthropic Releases Claude Opus 5.5 · MarkTechPost, 2026-09-22
  10. We Must Pace the Frontier · Dario Amodei, 2026-09
  11. Update on access to Claude Fable 5 and Claude Mythos 5 · Anthropic, 2026-06-12
  12. GPT-6 Astra · OpenAI, 2026-09-03
  13. Text leaderboard · Arena, 2026-09-25
  14. AI model leaderboards (Intelligence Index) · Artificial Analysis, 2026-09-26
  15. Terminal-Bench leaderboard · Terminal-Bench, 2026-09-26
  16. ARC-AGI leaderboard · ARC Prize, 2026-09-26

Note éditoriale : cette analyse reflète les informations publiques disponibles à la date de révision. Modèles, prix et règles évoluent vite ; chaque donnée tierce renvoie à sa source et nos opinions sont présentées comme telles. Une erreur ? Écrivez à contact@slash-digital.io.

Questions fréquentes

Les questions qu'on nous pose souvent

Quand Claude Opus 5.5 est-il sorti ?

Le 22 septembre 2026. Anthropic s'engage à le maintenir disponible au moins jusqu'au 22 septembre 2027.

Combien coûte Claude Opus 5.5 ?

4 $ par million de tokens en entrée et 20 $ en sortie ; la lecture de cache coûte 0,20 $ par million et l'API Batch offre 50 % de remise.

Est-il meilleur que Claude Fable 5.1 ?

Selon Anthropic, il atteint ce niveau sur la plupart des tâches pour moins de la moitié du prix. Fable 5.1 reste recommandé pour le raisonnement le plus exigeant. Seule votre évaluation le confirme pour votre cas.

Puis-je désactiver le raisonnement pour économiser ?

Non. Le raisonnement est toujours actif ; pour économiser, on baisse le paramètre effort à low ou medium.

Est-il disponible depuis la Colombie et l'UE ?

Oui, via l'API Claude et via AWS, Google Cloud et Microsoft. Vérifiez les régions disponibles et vos obligations de protection des données avant d'envoyer des données personnelles.

Parler à Slash

Mettons-le en production

Racontez-nous votre défi. Nous répondons sous 24 heures ouvrées avec une première lecture honnête : si nous pouvons aider, nous dirons comment ; sinon, nous dirons qui peut.

Je réponds en personne. Pas de formulaires interminables ni de réponses automatiques.

Écrire à Esteban