logo
  • Environnements
  • Entreprise
  • Tarifs
Blogs
Sep 22, 2026

Claude Opus 5.5 : Nouveautés, Benchmarks et Tarifs

Le premier modèle Claude 5.5 d'Anthropic est 40 % moins cher qu'Opus 5, domine les benchmarks de codage agentique et affiche ses meilleurs scores de sécurité.

EigentEigent
Share to
Claude Opus 5.5 : Nouveautés, Benchmarks et Tarifs
  • Qu'est-ce que Claude Opus 5.5 ?
  • Benchmarks de Claude Opus 5.5
  • La vraie histoire : l'efficacité
  • Tarifs de Claude Opus 5.5
  • Sécurité et le mécanisme de repli
  • Faut-il passer à Opus 5.5 ?
  • Faites-le avec votre propre équipe IA
Automate Everything with
AI Workforce on Desktop
Download Eigent

Le 22 septembre 2026, Anthropic a lancé Claude Opus 5.5, le premier modèle de sa nouvelle famille Claude 5.5. En résumé : il atteint des performances comparables à Claude Fable 5.1 sur la plupart des tâches, coûte environ 40 % moins cher à faire tourner qu'Opus 5, et génère les résultats plus de 30 % plus vite. Il affiche également les meilleurs scores de sécurité jamais obtenus par Anthropic. Voici ce qui a réellement changé, ce que disent les benchmarks, ce que ça coûte, et si cela vaut la peine de migrer vos agents.

Qu'est-ce que Claude Opus 5.5 ?

Claude Opus 5.5 est le nouveau modèle phare d'Anthropic et la première version de la génération Claude 5.5. Selon l'annonce d'Anthropic, il représente une avancée majeure par rapport à Opus 5 sur les tâches les plus exigeantes — migrations de grandes bases de code, ingénierie multi-dépôts et tâches d'utilisation informatique — tout en consommant moins de calcul par tâche.

Il est également notable pour une seconde raison : c'est la première version d'Anthropic depuis que la société a appelé à « ralentir la course aux frontières ». Le message cette fois est moins « capacité brute à n'importe quel prix » et davantage « résultats de niveau frontier, moins chers et plus sûrs ».

Claude Sonnet 5.5 et Haiku 5.5 sont prévus dans les semaines à venir avec des améliorations similaires.

Benchmarks de Claude Opus 5.5

Dans le tableau publié par Anthropic, Opus 5.5 est en tête sur le codage agentique, l'utilisation informatique et le travail de connaissance. Tous les chiffres d'Opus 5.5 utilisent la réflexion adaptative à effort maximal, sauf indication contraire.

BenchmarkOpus 5.5Fable 5.1Opus 5GPT-6 Astra
Terminal-Bench 4.0 (codage agentique)66,4 %55,8 %52,3 %57,9 %
FrontierCode v1.1, Main (codage agentique)54,4 %50,3 %48,0 %53,3 %
CursorBench 4.0 (codage agentique)57,8 %51,8 %46,6 %—
GDPval-AA v2.1 (travail de connaissance, Elo)1846173517081542
AutomationBench (flux de travail métier)40,0 %31,4 %26,9 %41,4 %
Humanity's Last Exam (avec outils)67,7 %65,6 %63,6 %57,2 %
Terminal-Bench-Science 0.158,7 %52,6 %29,0 %64,6 %
OSWorld 2.0 (utilisation informatique, partiel)81,8 %80,7 %74,0 %—

Source : Anthropic.

Deux mises en garde honnêtes. Premièrement, Anthropic lui-même reconnaît qu'à ce niveau, les marges des benchmarks sont un indicateur moins fiable de la qualité réelle — dans ses propres usages, l'écart entre Opus 5.5 et Fable 5.1 est plus étroit que les scores ne le suggèrent. Deuxièmement, certains scores sont pénalisés par les garde-fous : sur les tâches où les protections sont intervenues, le travail en cybersécurité a été redirigé vers Opus 4.8 et le travail en biologie vers Opus 5, ce qui a probablement abaissé les chiffres rapportés.

La vraie histoire : l'efficacité

L'avantage d'Opus 5.5 est le plus net en termes de coût par unité de travail. Il coûte moins par token et utilise moins de tokens par tâche, ce qui aboutit à la réduction de 40 % mise en avant par Anthropic.

Les exemples de codage sont concrets :

  • Un testeur précoce a audité et corrigé une base de code de 200 000 lignes en moins de trois heures, là où Opus 5 prenait plus de 20 heures et utilisait 2,5 fois plus de tokens.
  • Un autre a réalisé une migration de code de 680 000 lignes en moins d'une journée — un travail qu'Anthropic présente comme nécessitant plusieurs semaines pour une équipe d'ingénieurs.
  • Sur une réécriture interne de HAProxy de C vers Rust, Opus 5.5 a terminé en 9,5 heures contre 12 pour Fable 5.1, et a coûté 51 % moins cher.

Anthropic indique également qu'il surpasse GPT-6 Astra sur FrontierCode à environ 20 % du coût par tâche, et égale Astra sur Terminal-Bench 4.0 pour environ 40 % du coût. Pour les charges de travail agentiques — où l'on paie pour de nombreuses étapes et beaucoup de contexte relu — cette efficacité se cumule rapidement.

Tarifs de Claude Opus 5.5

Opus 5.5 est tarifé en dessous d'Opus 5 sur toute la ligne :

Pour 1 M de tokensOpus 5.5Opus 5
Entrée4 $5 $
Sortie20 $25 $
Lectures de cache0,20 $0,50 $
Écritures de cache5 $6,25 $

La réduction sur les lectures de cache est celle qui compte le plus pour les agents : à 0,20 $ par million (60 % moins cher), elle réduit directement le coût du contexte relu en boucle qui domine les factures de codage et d'agents multi-étapes.

Il existe également un mode Fast dans Claude Code et la plateforme Claude, fonctionnant jusqu'à 2,5 fois plus vite, à 8 $ en entrée / 40 $ en sortie par million de tokens. En plus de la baisse de prix, Anthropic a relevé les limites d'utilisation sur cinq heures pour les abonnements Pro, Max et Team, et offre aux abonnés une réinitialisation de limite de débit qu'ils peuvent conserver et utiliser quand ils le souhaitent.

Sécurité et le mécanisme de repli

Anthropic indique qu'Opus 5.5 est le modèle le plus performant à ce jour sur son audit comportemental automatisé — son test d'alignement le plus complet. Il est plus résistant à l'injection de prompts (prompt injection) qu'Opus 5 et moins susceptible d'effectuer des actions difficiles à annuler ou de sortir des limites qui lui sont assignées. Il a été testé avant sa sortie par des évaluateurs externes, dont METR.

Un détail opérationnel mérite d'être signalé. Parce qu'Opus 5.5 est comparable à Claude Mythos 5.1 en biologie et cybersécurité, il est livré avec les garde-fous de classe Fable 5.1 — et sur certaines tâches à double usage, ces garde-fous redirigent la requête vers un modèle plus ancien (Opus 4.8 ou Opus 5) plutôt que de répondre directement. Comme l'a noté The New Stack, cela signifie qu'un appel d'agent peut silencieusement basculer vers un modèle différent en arrière-plan. Si vous développez sur Opus 5.5, il vaut la peine de savoir dans quels cas cela peut se produire.

Les organisations vérifiées peuvent dès maintenant postuler au Programme de vérification des sciences de la vie d'Anthropic, avec un accès élargi au Programme de vérification Cyber prévu dans les semaines suivantes.

Faut-il passer à Opus 5.5 ?

Une lecture rapide par cas d'usage :

  • Agents de codage à long horizon — probablement oui. L'efficacité en tokens combinée aux lectures de cache 60 % moins chères cible précisément les exécutions multi-étapes à contexte lourd.
  • Charges de travail à fort volume et sensibles aux coûts — oui ; la réduction de 40 % des coûts est la raison principale de migrer le trafic Opus 5. Testez sur votre charge de travail réelle, car les économies dépendent de votre part de lectures de cache.
  • Applications sensibles à la latence — la sortie 30 % plus rapide (ou le mode Fast) représente un gain réel par rapport à Opus 5.
  • Travaux cyber/bio à double usage — attendez-vous à un routage par les garde-fous vers des modèles plus anciens sur certaines tâches ; planifiez autour du mécanisme de repli plutôt que de supposer qu'Opus 5.5 répond à tout.

Pour la plupart des développeurs, le résumé est simple : qualité proche de Fable 5.1, clairement moins cher et plus rapide sur les charges de travail qui étaient coûteuses, avec les meilleurs scores de sécurité jamais publiés par Anthropic.

Faites-le avec votre propre équipe IA

Les plus grands gains d'Opus 5.5 apparaissent sur les tâches longues et riches en outils — migrations à l'échelle d'une base de code, audits, ingénierie multi-dépôts — ce qui correspond exactement à la forme du vrai travail agentique. Eigent est une application de bureau open source « Cowork » qui fait tourner une équipe d'agents IA localement, vous permettant de diriger des modèles frontier comme Claude Opus 5.5 sur des flux de travail de codage et de recherche sur votre propre machine. Découvrez comment il gère l'ingénierie multi-étapes dans notre flux de travail de revue de pull requests GitHub, ou téléchargez Eigent et configurez vos propres agents dès aujourd'hui.

Recent Posts

GPT-6 Sol et Luna : les modèles OpenAI moins chers pour le code et l'agentique
Sep 22, 2026

GPT-6 Sol et Luna : les modèles OpenAI moins chers pour le code et l'agentique

GPT-6 Sol et Luna étendent la famille GPT-6 d'OpenAI en dessous d'Astra avec des réductions de prix importantes et de meilleures capacités de codage. Voici ce qui a changé, les benchmarks et quand utiliser chacun.

EigentEigent
Periodic Neon : l'IA entraînée en laboratoire qui surpasse les modèles frontier en science
Sep 18, 2026

Periodic Neon : l'IA entraînée en laboratoire qui surpasse les modèles frontier en science

Periodic Neon est une IA de 1 000 milliards de paramètres entraînée sur des données de laboratoire physique qui surpasse GPT-6 Astra en analyse de diffraction. Voici ce qu'elle fait et pourquoi cela est important.

EigentEigent
Qu'est-ce que Jev ? Le modèle System One de TypeSafe AI, expliqué
Sep 18, 2026

Qu'est-ce que Jev ? Le modèle System One de TypeSafe AI, expliqué

Jev de TypeSafe AI est un modèle System One qui retourne des décisions typées et probabilistes plutôt que du texte. Voici comment il fonctionne, ce qu'il coûte, et où il s'intègre.

EigentEigent
Automate everything with AI workforce on desktop
Download Eigent

Essayez Eigent dès aujourd’hui

Téléchargez l’application de bureau open source. Votre workforce IA, exécutée sur votre machine.

Télécharger Eigent
Eigent

Recevez les dernières mises à jour, tutoriels et versions sur l’automatisation de la workforce IA.

Merci pour votre abonnement !

ProduitEigentEnvironnementsTarifsEntreprise
ExplorerSolutionsCas d’usageCompétencesPluginsBlogs
DéveloppeursDocumentationGitHubCAMEL-AIOpen Source FundPartenaire
TéléchargementPour open source
EntrepriseÀ propos de nousMarqueCarrièresConditions d’utilisationPolitique de confidentialitéSécurité et confiancePolitique relative aux cookiesPolitique de remboursement et d’essai

Tous droits réservés © 2026 EIGENT UK LTD