L'arène · test de modèle IA

Claude Opus 5

par Anthropic

La mise à jour Opus de juillet 2026 signée Anthropic : une intelligence proche de Fable 5 pour moitié moins cher, au même tarif de 5 $/25 $ qu'Opus 4.8.

Note de l'arène 4/563 % le recommandent · 4 votes
Raisonnement5.0
Code5.0
Écriture4.0
Vitesse2.0
Rapport qualité-prix4.0
Visiter Claude Opus 5le codage frontière au quotidien et les agents, sans payer le tarif de Fable 5le travail de connaissance en entreprise (documents, tableurs, présentations)les équipes confrontées à des faux positifs des classificateurs de Fable 5l'orchestration multi-agents et les schémas rédacteur-vérificateur
Prix

$25/1M out

Prix officiel de la liste API Anthropic pour claude-opus-5 : 5 $ par million de tokens en entrée, 25 $ par million en sortie, inchangé depuis Opus 4.8, un seul palier avec un contexte de 1M de tokens à la fois par défaut et au maximum, 128K tokens de sortie maximum, mise en cache des prompts dès 512 tokens. Le mode rapide en avant-première de recherche, à 10 $/50 $ (environ 2,5 fois plus rapide), n'est disponible que sur l'API Claude. Vérifié sur platform.claude.com (What's new in Opus 5) en juillet 2026.

Éditeur

Anthropic

Fenêtre de contexte

1M tokens

Prix en entrée

$5/1M in

Prix en sortie

$25/1M out

Modalités

text, vision

Poids ouverts

Non

Qu'est-ce que Claude Opus 5 ?

Sorti le 24/07/2026 en remplacement direct d'Opus 4.8 dans la gamme Series 5 d'Anthropic (Mythos 5, Fable 5, Sonnet 5, Opus 5). Sous l'identifiant API claude-opus-5 : 5 $/25 $ par million de tokens (inchangé depuis Opus 4.8), une fenêtre de contexte de 1M de tokens à la fois par défaut et au maximum, 128K tokens de sortie maximum, et un mode réflexion (thinking) activé par défaut avec une échelle d'effort à cinq niveaux (de faible à max). Positionné comme une intelligence proche de la frontière à moitié prix de Fable 5, il dépasse même Fable 5 sur Frontier-Bench (43,3 % contre 33,7 %) et GDPval-AA v2 (Elo 1861 contre 1747), tout en restant légèrement derrière sur SWE-bench Pro (79,2 % contre 80,0 %). Les classificateurs de sécurité se déclenchent 85 % moins souvent que sur Fable 5, et un mode de repli par défaut évite les erreurs de refus silencieux.

Claude Opus 5 : points forts et points faibles

Points forts

  • Classé numéro 1 en intelligence composite parmi 190 modèles sur Artificial Analysis au lancement, avec 43,3 % sur Frontier-Bench v0.1 contre 34,4 % pour GPT-5.6 Sol et 33,7 % pour Claude Fable 5
  • 3,9 fois meilleur que GPT-5.6 Sol en raisonnement inédit sur ARC-AGI-3 (30,2 % contre 7,8 %), et un Elo de 1861 sur GDPval-AA v2 (travail de connaissance économique), devant Fable 5 (1747)
  • 79,2 % sur SWE-bench Pro, à un point de Fable 5 (80,0 %) et 10 points au-dessus d'Opus 4.8 (69,2 %), pour moitié prix de Fable 5 ; selon le cofondateur de Cursor, il offre « une intelligence proche de Fable 5, à la vitesse et au coût d'Opus »
  • Le même tarif de 5 $/25 $ qu'Opus 4.8, avec une fenêtre plus large : le contexte de 1M de tokens devient le seul et unique palier par défaut, avec 128K tokens de sortie maximum et une mise en cache des prompts dès 512 tokens
  • Les classificateurs de sécurité à double usage se déclenchent 85 % moins souvent que sur Fable 5, et le nouveau mode de repli par défaut évite les refus silencieux en cours de session qui avaient plombé le lancement de Fable 5
  • Il autovérifie son travail sans qu'on le lui demande, gère les changements d'outils en cours de conversation (bêta) sans casser le cache de prompt, et est disponible dès le premier jour sur Claude.ai, l'API, Bedrock, Vertex et Microsoft Foundry

Points faibles

  • Notablement lent et très verbeux : 52,6 tokens de sortie par seconde et 68 secondes avant le premier token sur Artificial Analysis, ayant consommé environ 100 millions de tokens de sortie lors de leur évaluation contre une médiane de 63 millions
  • Cette verbosité pose un vrai problème de coût réel : CodeRabbit a mesuré qu'il lit environ 50 % de texte en plus et en écrit environ 65 % de plus que les modèles de référence à chaque revue de code
  • Aucune vraie baisse de prix malgré le discours « rentable » : identique à Opus 4.8 (5 $/25 $), presque au tarif de GPT-5.6 (5 $/30 $), et plus de 2 fois les tarifs comparables de Gemini ou Grok
  • Les testeurs décrivent une personnalité « brillante mais agaçante » : sur-vérification, prudence excessive et refus occasionnels de tâches banales comme résoudre un conflit de fusion (revue de terrain de Lenny's Newsletter)
  • Un changement d'API qui casse la compatibilité pour les migrants d'Opus 4.8 : le mode réflexion est activé par défaut et ne peut pas être désactivé aux niveaux d'effort xhigh ou max (renvoie une erreur 400) ; le mode rapide (10 $/50 $, environ 2,5 fois plus rapide) n'est disponible que via l'API, pas sur Bedrock ni Vertex

Le verdict de l'arène

Claude Opus 5 est le choix par défaut raisonnable de la gamme Series 5 : la majeure partie de l'intelligence de Fable 5 (et même davantage sur Frontier-Bench et GDPval) pour exactement moitié prix en tokens, avec des classificateurs qui se déclenchent 85 % moins souvent. Si des charges de travail ont migré vers Fable 5 pour ses capacités mais que la facture ou les faux refus posent problème, il est temps de les déplacer ici ; pour ceux encore sur Opus 4.8, la mise à niveau apporte 10 points de SWE-bench Pro gratuitement. Deux raisons honnêtes de regarder ailleurs : la latence et la verbosité. À 52,6 tokens par seconde avec 68 secondes avant le premier token, il convient mal aux expériences interactives, et son appétit en tokens gonfle discrètement les coûts réels au-delà du prix affiché ; les pipelines à fort volume sensibles au budget restent donc mieux servis par Sonnet 5, Gemini ou DeepSeek. Fable 5 ne mérite d'être conservé que pour les sessions autonomes les plus longues, où son léger avantage sur SWE-bench Pro finit par compter.

Pouce levé ou pouce baissé

Rendez votre verdict

Recommanderiez-vous Claude Opus 5, ou mettriez-vous la foule en garde ?

63%score de la foule · 4

Meilleures alternatives à Claude Opus 5

Toutes les alternatives
1
Claude Haiku 4.5

Le modèle le plus rapide d'Anthropic : environ 90 % du niveau de codage de Sonnet 4.5 à $1/$5 par million de tokens, contexte 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Le vaisseau amiral de classe Mythos d'Anthropic (juin 2026) : 80,3 % sur SWE-bench Pro, 11 points devant tous les autres modèles frontière

$50/1M out63%(4)
Visit
3
Kimi K3

Le MoE à 2,8 billions de paramètres de Moonshot qui a déclenché le « nouveau moment DeepSeek » : des scores proches de la frontière à 3 $/15 $

$15/1M out57%(3)
Visit

Comparez Claude Opus 5 en face-à-face

Ce qu'en dit la foule

Pouce en Bassicus

The sticker price is unchanged but my invoice is not: it writes essays where Opus 4.8 wrote answers. 68 seconds to first token killed it for our support chat, we went back to Sonnet 5.

Le Juge Bienveillant

Fed it a 40-tab financial model with cross-sheet formulas and asked for a scenario deck. It got the edge cases the analysts missed. For document-heavy enterprise work this is the best model I have used.

Sire Ship-Beaucoup

We moved off Fable 5 because the bio classifier kept flagging our genomics tooling. Opus 5 does the same work at half the price and I have not seen a single silent reroute since.

Gardien du Repo

Migrated our agents from Opus 4.8 the day it dropped. Same bill, and tasks that used to stall at the planning stage now just finish. The 10-point SWE-bench jump is not marketing, our merge queue feels it.

Claude Opus 5 : questions fréquentes

Combien coûte Claude Opus 5 par million de tokens ?

Claude Opus 5 coûte $5/1M in par million de tokens en entrée et $25/1M out par million de tokens en sortie. Prix officiel de la liste API Anthropic pour claude-opus-5 : 5 $ par million de tokens en entrée, 25 $ par million en sortie, inchangé depuis Opus 4.8, un seul palier avec un contexte de 1M de tokens à la fois par défaut et au maximum, 128K tokens de sortie maximum, mise en cache des prompts dès 512 tokens. Le mode rapide en avant-première de recherche, à 10 $/50 $ (environ 2,5 fois plus rapide), n'est disponible que sur l'API Claude. Vérifié sur platform.claude.com (What's new in Opus 5) en juillet 2026.