Claude Opus 5 en bref : les faits

Commençons par l'essentiel, sans détour.

  • Date de sortie : le 24 juillet 2026, disponible immédiatement sur toutes les plateformes d'Anthropic.
  • Positionnement : Anthropic le décrit comme un modèle « réfléchi et proactif » qui s'approche de l'intelligence de Claude Fable 5 pour la moitié du prix.
  • Tarif API : 5 $ par million de tokens en entrée et 25 $ en sortie, soit environ 4,40 € et 21,90 € au taux BCE de fin juillet 2026. Exactement le même prix que son prédécesseur, Opus 4.8.
  • Accès : modèle par défaut sur Claude Max, modèle le plus puissant disponible sur Claude Pro, et identifiant claude-opus-5 sur l'API.
  • Nouveauté clé : un curseur d'effort qui permet de choisir combien de « réflexion » — et donc combien d'argent — le modèle consacre à une tâche.
  • Fenêtre de contexte : 1 million de tokens, avec le mode réflexion activé par défaut.

Un token, rappelons-le, est l'unité de texte que manipule un modèle de langage : environ trois quarts d'un mot en français. C'est aussi l'unité de facturation. Nous détaillons ce mécanisme dans notre article de fond sur les LLM en 2026.

Où se situe Opus 5 dans la gamme Anthropic ?

La nomenclature d'Anthropic s'est considérablement complexifiée au premier semestre 2026. Un point de repère s'impose, car beaucoup de professionnels s'y perdent — et choisir le mauvais modèle coûte cher.

Cinq niveaux, du plus puissant au plus économique

  • Mythos 5 : le sommet de la gamme, réservé à un petit nombre d'organisations dans le cadre du programme Project Glasswing. Pas d'accès public.
  • Fable 5 : le même modèle sous-jacent que Mythos, mais assorti de garde-fous supplémentaires en biologie, cybersécurité et recherche sur les IA. C'est le modèle le plus capable réellement accessible au public. Tarif : 10 $ / 50 $ par million de tokens (environ 8,75 € / 43,80 €).
  • Opus 5 : le nouveau venu. Le modèle « de tous les jours » pour le travail exigeant.
  • Sonnet 5 : sorti le 30 juin 2026, l'équilibre performance/prix. Tarif de lancement de 2 $ / 10 $ jusqu'au 31 août 2026, puis 3 $ / 15 $ (environ 2,65 € / 13,15 €).
  • Haiku 4.5 : le plus rapide et le moins cher, à 1 $ / 5 $ par million de tokens.

Cette segmentation n'est pas propre à Anthropic. Google décline Gemini en Pro et Flash, OpenAI a adopté sa trilogie Sol, Terra et Luna, Mistral et DeepSeek font de même. La bataille ne porte plus sur la puissance brute d'un modèle unique, mais sur le bon rapport entre puissance, vitesse et coût pour chaque usage.

Un détail important : Opus 5 n'est pas le modèle le plus puissant d'Anthropic

Anthropic est explicite sur ce point dans sa documentation : Opus 5 n'est pas globalement plus capable que Fable 5. C'est un modèle de classe Opus considérablement amélioré, qui vient combler l'écart avec Fable tout en restant au tarif d'Opus 4.8. La nuance a son importance quand on lit les annonces marketing.

Le curseur d'effort : la vraie nouveauté

C'est probablement l'innovation la plus concrète de cette sortie, et elle mérite une explication.

Les modèles de raisonnement récents « réfléchissent » avant de répondre : ils génèrent une chaîne de pensée interne, invisible pour l'utilisateur, avant de produire leur réponse finale. Cette réflexion consomme des tokens — donc de l'argent et du temps.

Le paramètre effort d'Opus 5 permet de régler cette profondeur de réflexion sur une échelle allant de low (faible) à max (maximale), en passant par medium, high et xhigh. Concrètement :

  • À effort maximal, vous obtenez le meilleur du modèle, mais vous payez le plein tarif en tokens de réflexion.
  • À effort réduit, le modèle conserve une bonne partie de ses performances tout en consommant nettement moins.

Anthropic affirme que même à son réglage le plus faible, Opus 5 réussit davantage de tâches que n'importe quel autre modèle sur le banc d'essai Zapier AutomationBench. Sur OSWorld 2.0, un test qui mesure la capacité à piloter un ordinateur comme le ferait un humain, l'éditeur indique qu'Opus 5 dépasse le meilleur score de Fable 5 pour un peu plus du tiers du coût.

Pour une entreprise, ce curseur transforme une question technique en décision budgétaire. C'est exactement le type d'arbitrage sur lequel Digital-m accompagne ses clients : quel modèle, à quel niveau d'effort, pour quelle tâche — et à quel coût mensuel réel.

Les benchmarks : ce que disent les chiffres (et ce qu'ils ne disent pas)

Anthropic revendique un état de l'art sur plusieurs bancs d'essai. Un benchmark est un test standardisé qu'on fait passer aux modèles pour les comparer, un peu comme un examen. Voici les résultats les plus commentés, tels que rapportés par la presse spécialisée à partir de l'annonce officielle.

  • Frontier-Bench v0.1 (codage agentique en terminal) : 43,3 % pour Opus 5, contre 33,7 % pour Fable 5 et 34,4 % pour GPT-5.6 Sol. Anthropic indique que ce score représente plus du double de celui d'Opus 4.8, pour un coût par tâche inférieur.
  • ARC-AGI 3 (résolution de problèmes inédits) : environ 30 % pour Opus 5, soit près de trois fois le score du modèle suivant. C'est l'écart le plus spectaculaire de tout le lancement.
  • GDPval-AA v2 (travail intellectuel évalué par des humains) : un score Elo d'environ 1 861, le plus élevé mesuré, devant Fable 5.
  • OSWorld 2.0 (utilisation autonome d'un ordinateur) : environ 70 %, contre près de 56 % pour Opus 4.8.
  • SWE-bench Pro (résolution de vrais bugs sur des dépôts privés) : autour de 79 %, où Fable 5 conserve un léger avantage.

Une réserve méthodologique s'impose, et elle a été soulevée dès la publication. Anthropic a diffusé ses résultats sous forme de graphiques images plutôt que de tableaux chiffrés lisibles. Sur Hacker News, où le fil de discussion a dépassé les 1 300 votes, plusieurs commentateurs ont reproché à l'éditeur une présentation avantageuse des données. D'autres ont rappelé que la fiche technique du modèle — le system card, un document de près de 200 pages — détaille les méthodologies employées.

Comme nous le répétons systématiquement sur Horizon GEO : les scores publiés par un éditeur sur son propre modèle sont toujours à prendre avec précaution. Croisez-les avec des évaluations indépendantes comme Artificial Analysis ou LMArena.

Combien ça coûte vraiment, en euros

Anthropic facture en dollars, sans grille officielle en euros. Voici la conversion au taux de référence de la Banque centrale européenne fin juillet 2026 (1 € ≈ 1,14 $), pour un million de tokens.

  • Haiku 4.5 : environ 0,90 € en entrée, 4,40 € en sortie.
  • Sonnet 5 : environ 1,75 € / 8,75 € (tarif de lancement jusqu'au 31 août 2026), puis 2,65 € / 13,15 €.
  • Opus 5 : environ 4,40 € / 21,90 €.
  • Fable 5 : environ 8,75 € / 43,80 €.

Un mode Fast est également proposé : le modèle tourne environ 2,5 fois plus vite, au double du tarif de base.

Côté abonnements grand public, l'accès à Opus 5 passe par Claude Pro (environ 21 € TTC par mois en France) ou Claude Max (environ 105 € ou 210 € selon le palier). Sur Claude Max, Opus 5 est devenu le modèle par défaut.

Prix au token ≠ prix à la tâche

Voilà le piège le plus fréquent, et il mérite un paragraphe à lui seul.

Comparer deux modèles sur leur seul tarif au million de tokens est trompeur, parce que deux modèles ne consomment pas le même nombre de tokens pour accomplir la même tâche. Un modèle deux fois plus cher au token mais qui résout le problème en une passe peut revenir moins cher qu'un modèle bon marché qu'il faut relancer cinq fois.

C'est précisément l'argument commercial d'Anthropic sur Opus 5 : un meilleur rapport capacité/euro dépensé. C'est aussi, on le verra, l'endroit où les premiers retours d'expérience sont les plus contrastés.

Les critiques : trop bavard, trop zélé

Un article d'agence honnête ne se contente pas de relayer un communiqué. Dans les jours qui ont suivi la sortie, une critique récurrente est remontée du terrain : Opus 5 en fait trop.

  • Élargissement des tâches : plusieurs utilisateurs rapportent que le modèle déborde du périmètre demandé, ajoute des fonctionnalités non sollicitées et produit des réponses très longues. Un testeur a vu une seule requête tourner plus de quarante minutes — avec, il faut le préciser, un résultat final qu'il a jugé excellent.
  • Consommation de tokens : l'éditeur d'outils de revue de code CodeRabbit a mesuré qu'Opus 5 lisait environ 50 % de contexte en plus et écrivait environ 65 % de sortie en plus que les modèles GPT-5.6 sur les mêmes tâches. Le coût par tâche peut donc grimper malgré un tarif au token attractif.
  • Baisser l'effort ne suffit pas toujours : Anthropic reconnaît elle-même qu'un réglage d'effort plus bas réduit le volume de réflexion sans raccourcir de façon fiable la réponse visible.
  • Excès de confiance : la fiche technique du modèle relève une tendance à affirmer une réponse avec certitude alors qu'il n'est pas sûr de lui — un défaut classique des LLM, mais qui reste préoccupant sur des tâches d'analyse.
  • Expériences contradictoires : certains développeurs le décrivent comme le plus grand bond depuis Opus 4.5, d'autres comme un modèle plus verbeux et plus frustrant que son prédécesseur. Les deux vécus semblent authentiques et dépendent fortement de l'environnement de travail et de la façon de formuler les consignes.

Autre signal intéressant relevé par la communauté technique : avec Mythos 5, Fable 5, Opus 5, Sonnet 5 et Haiku 4.5 disponibles simultanément, le vrai enjeu devient le routage de modèle — la capacité à envoyer automatiquement chaque tâche vers le bon palier. Se tromper de niveau coûte désormais plus cher que de choisir « le mauvais » fournisseur.

Alignement et sécurité : l'argument différenciant d'Anthropic

C'est le terrain historique de l'entreprise, et Opus 5 y marque des points.

Lors des tests précédant le déploiement, l'audit comportemental automatisé d'Anthropic conclut qu'Opus 5 est le modèle le plus aligné qu'elle ait publié : il respecte mieux la Constitution de Claude qu'Opus 4.8, Sonnet 5 ou Fable 5, présente les taux les plus faibles de comportement trompeur et se laisse moins facilement détourner de son usage prévu. Son score global de comportement mal aligné s'établit à 2,3, le plus bas de la série récente.

L'alignement désigne le fait qu'un modèle agisse conformément aux valeurs et aux intentions de ses concepteurs et de ses utilisateurs. Nous avons détaillé les mécanismes qui y mènent — RLHF, Constitutional AI, DPO — dans un article dédié.

Sur les capacités sensibles, Anthropic assume une position claire : Opus 5 ne fait pas progresser la frontière des usages à double tranchant. Il reste derrière Mythos 5 en recherche biologique et en cybersécurité offensive. Ses classificateurs — des filtres automatiques qui analysent les requêtes — lui permettent de chercher des vulnérabilités dans du code source, mais bloquent la génération d'exploits et les tests d'intrusion. L'éditeur estime que ces filtres se déclenchent environ 85 % moins souvent que ceux de Fable 5. Quand une requête est bloquée, elle bascule par défaut vers Opus 4.8, un mécanisme de repli qu'on appelle fallback.

Ce sujet n'est pas anecdotique pour une entreprise européenne. En juin 2026, l'accès à Fable 5 et Mythos 5 avait été temporairement suspendu pour se conformer à des contrôles à l'export américains, avant d'être rétabli le 1er juillet. La dépendance à un fournisseur étranger unique est devenue une question stratégique — un point que nous abordons aussi sous l'angle réglementaire dans notre article sur l'AI Act européen.

Ce que la sortie d'Opus 5 change pour votre visibilité

Question légitime : en quoi la sortie d'un modèle payant concerne-t-elle votre référencement ? Réponse en trois points.

1. Vos acheteurs B2B utilisent Claude

Selon les données de Menlo Ventures, Anthropic est devenu le premier fournisseur du marché des API de modèles de langage en entreprise, avec environ 40 % des dépenses, devant OpenAI. Traduction concrète : quand un directeur technique, un responsable achat ou un dirigeant de PME fait une recherche préparatoire avant de choisir un prestataire, il y a de fortes chances qu'il la fasse dans Claude.

Sur le trafic grand public en revanche, ChatGPT reste largement dominant — il concentre l'écrasante majorité du trafic de référencement provenant des plateformes d'IA. Claude est un canal de faible volume mais de très haute valeur, particulièrement en B2B.

2. Un modèle plus rigoureux favorise les contenus vérifiables

Les retours d'usage convergent sur un point : Opus 5 vérifie davantage son propre travail, recoupe ses résultats et pousse ses vérifications plus loin que ses prédécesseurs. Une entreprise de génomique interrogée par Anthropic décrit un modèle qui se comporte « comme un scientifique prudent ».

Pour votre contenu, la conséquence est directe. Un modèle qui recoupe privilégie :

  • les pages qui citent leurs sources et les rendent traçables ;
  • les contenus datés avec une date de mise à jour visible ;
  • les entités nommées explicites — noms de marques, de personnes, de lieux, de produits — plutôt que les formulations vagues ;
  • les affirmations chiffrées attribuées à un émetteur identifiable.

C'est la logique de l'autorité thématique et du grounding — l'ancrage des réponses d'une IA dans des sources réelles.

3. Une fenêtre d'un million de tokens change la lecture de vos pages

Avec un contexte d'un million de tokens, un modèle peut ingérer votre page entière, vos pages connexes et vos documents annexes en une seule fois. La profondeur informationnelle cesse d'être un handicap et devient un avantage — à condition que la structure reste lisible.

Un rappel qui n'a pas bougé : d'après les analyses de Position.digital, environ 44 % des citations produites par les LLM proviennent du premier tiers du texte. Votre réponse principale, vos chiffres clés et vos entités nommées doivent figurer en haut de page, pas en conclusion. C'est le principe que nous appliquons systématiquement aux contenus que nous produisons via notre agence de rédaction web.

Faut-il basculer sur Opus 5 ? Notre grille de décision

Voici comment nous arbitrons chez Digital-m, en fonction du profil.

  • Vous utilisez Claude au quotidien pour rédiger et analyser : Opus 5 est déjà votre modèle par défaut si vous êtes sur Max, et le plus puissant accessible sur Pro. Testez-le, mais surveillez la longueur des réponses — vous devrez sans doute demander explicitement de la concision.
  • Vous développez avec l'API et vous étiez sur Opus 4.8 : la migration est cohérente, le tarif est identique. Mesurez votre coût réel par tâche avant et après, pas votre coût au token.
  • Vous utilisez Fable 5 par réflexe : testez Opus 5 sur vos cas courants. À moitié prix, il suffira probablement. Gardez Fable 5 pour les missions autonomes très longues et le code le plus complexe.
  • Vous cherchez le meilleur rapport qualité/prix : Sonnet 5 reste souvent le bon choix, surtout pendant sa période de tarif de lancement.
  • Vous ne savez pas par où commencer : notre outil « Bien choisir son LLM en 6 questions » vous oriente en deux minutes.

Et si vous voulez que vos équipes maîtrisent ces arbitrages en interne, notre formation GEO certifiée Qualiopi couvre le choix des modèles, le calcul du coût réel et l'optimisation des contenus pour les moteurs génératifs.

Conclusion : la course s'est déplacée vers l'économie

Claude Opus 5 raconte quelque chose de plus large que ses benchmarks. Depuis dix-huit mois, la compétition entre laboratoires portait sur la capacité brute. Elle porte désormais sur le coût de l'intelligence à l'usage : combien de tokens pour finir la tâche, combien de reprises, combien d'euros à la fin du mois.

Opus 5 répond à cette question avec un curseur d'effort, un tarif figé et un discours assumé sur ce qu'il ne fait pas — il n'est pas le modèle le plus puissant d'Anthropic, et l'éditeur le dit. C'est plutôt rafraîchissant dans un secteur habitué aux superlatifs.

Reste la critique la plus insistante : un modèle qui parle trop et en fait trop. Elle se corrige en grande partie par la façon dont on le sollicite. Elle rappelle surtout une constante du métier — un LLM ne remplace pas le pilotage, il le déplace.

Vous voulez savoir si votre entreprise est visible dans les réponses de Claude, de ChatGPT ou de Gemini ? Parlons-en : nous réalisons des audits de visibilité IA pour les PME, artisans et équipes marketing partout en France.

Et vous, avez-vous testé Opus 5 ? Trop bavard ou vraiment plus fiable ? Dites-le nous en commentaire !