Accueil/News/Intelligence Artificielle
Intelligence Artificielle

Claude Opus 5.5 : moins cher, plus bridé dans Claude Code

Opus 5.5 promet le niveau de Fable 5.1 pour 40 % de moins. Ce que montrent les tests indépendants et ce que ses garde-fous changent dans Claude Code.

Claude Opus 5.5 : moins cher, plus bridé dans Claude Code

J'utilise Claude Code avec un abonnement Pro, dans mon terminal, et j'en atteins souvent les limites. Opus 5.5, sorti ce 22 septembre, m'intéresse donc d'abord pour son prix et ses quotas. Réponse courte : il est plus fort et moins cher au token, mais il hérite des garde-fous cyber de Fable 5.1, plus stricts que ceux d'Opus 5. Voici ce qui est mesuré, ce qui est seulement annoncé, et ce que ça change pour toi.

Mon verdict en 30 secondes

Sur le papier, Opus 5.5 est une bonne nouvelle pour un développeur : des tokens 20 % moins chers, des limites relevées sur les abonnements, et la première place de l'indice d'Artificial Analysis. Deux nuances comptent pourtant. Le « −40 % » d'Anthropic se mesure à l'effort par défaut : en effort maximal, Artificial Analysis trouve un coût par tâche proche de celui d'Opus 5. Et ses garde-fous cyber, alignés sur Fable 5.1, risquent de faire basculer ta session vers Opus 4.8 plus souvent qu'avant.

Je n'ai pas encore testé Opus 5.5. Ce qui suit s'appuie sur l'annonce officielle d'Anthropic et sur des mesures tierces, pas sur mon usage.

Ce qu'Anthropic annonce

Opus 5.5 ouvre la famille Claude 5.5. Selon Anthropic, il se situe au niveau de Claude Fable 5.1 sur la plupart des tâches et coûte 40 % de moins à faire tourner qu'Opus 5, aux réglages par défaut et sur des charges de travail typiques.

Les prix, eux, sont confirmés : 4 $ par million de tokens en entrée et 20 $ en sortie, contre 5 $ et 25 $ pour Opus 5. La lecture du cache (le contexte déjà envoyé et réutilisé) tombe à 0,20 $, soit 60 % de moins. D'après Anthropic, c'est ce poste qui pèse le plus dans le travail agentique et le code. La génération serait aussi plus de 30 % plus rapide, et un mode rapide, jusqu'à 2,5 fois plus véloce, est proposé dans Claude Code au tarif de 8 $ et 40 $.

Sonnet 5.5 et Haiku 5.5 doivent suivre dans les prochaines semaines.

Les benchmarks : ce qui est annoncé, ce qui est mesuré

MesureOpus 5.5Opus 5GPT-6 AstraSource
Terminal-Bench 4.066,4 %52,3 %57,9 %Anthropic (chiffre d'Astra communiqué par OpenAI)
Indice Artificial Analysis (effort max)585153Artificial Analysis

La première ligne, ce sont les chiffres de l'éditeur, mesurés garde-fous activés : quand ils intervenaient, Opus 4.8 prenait le relais sur les tâches cyber. Anthropic prévient lui-même qu'à ce niveau, les écarts de benchmark reflètent de moins en moins l'usage réel.

La seconde ligne est indépendante. Artificial Analysis place Opus 5.5 en tête de son indice avec 58 points en effort maximal, cinq points devant GPT-6 Astra et Fable 5.1, à égalité à 53. Le modèle arrive premier sur six des dix évaluations de l'indice. Les résultats ne sont toutefois pas directement comparables : la ligne Terminal-Bench du tableau reprend les chiffres communiqués par les éditeurs, tandis qu'Artificial Analysis utilise son propre protocole. La fenêtre de contexte reste à un million de tokens, comme sur Opus 5.

Le « −40 % » dépend de ton niveau d'effort

C'est la nuance que l'annonce ne met pas en avant. En effort maximal, Artificial Analysis mesure environ 119 000 tokens de sortie par tâche pour Opus 5.5, contre 73 000 pour Opus 5. Il en produit donc 1,6 fois plus. Le prix au token baisse, mais le volume monte, et le coût par tâche finit au niveau de celui d'Opus 5.

Les deux chiffres ne se contredisent pas : Anthropic mesure à l'effort par défaut, Artificial Analysis à l'effort maximal. Mais la conséquence est concrète. À mon sens, si tu règles l'effort au maximum par réflexe, ne compte pas sur une facture qui fond. L'économie annoncée se joue aux réglages par défaut.

Des garde-fous cyber hérités de Fable 5.1

Sur la plupart des tâches, Anthropic place Opus 5.5 au niveau de Fable 5.1. Mais en biologie et en cybersécurité, l'éditeur le compare à Claude Mythos 5.1, la déclinaison à accès restreint de Fable 5.1. C'est ce qui justifie son déploiement avec des protections proches de celles de Fable 5.1. Concrètement, tu peux toujours identifier et corriger les bugs de ton code dans le cadre normal du développement. En revanche, la plupart des tâches de cybersécurité sont redirigées vers Opus 4.8.

C'est un durcissement par rapport à Opus 5. Pour ce dernier, la page d'aide d'Anthropic parlait d'un ensemble restreint de requêtes à risque, et ses premiers tests montraient 85 % de bascules en moins qu'avec Fable 5. Opus 5.5 revient au système le plus strict. J'en déduis que les bascules seront plus fréquentes qu'avec Opus 5, mais c'est une déduction : personne ne l'a encore mesuré.

Pour les professionnels de la sécurité, Anthropic prévoit d'étendre son programme de vérification cyber à Opus 5.5 dans les prochaines semaines. Ce programme gratuit, accessible sur dossier, est le dispositif prévu par Anthropic pour permettre aux chercheurs vérifiés de travailler sur des usages défensifs avec moins de blocages. Les usages interdits, comme le développement de rançongiciels, restent bloqués dans tous les cas.

Un rapprochement m'a frappé. Opus 4.8, le modèle de repli, est celui qui échouait à produire l'exploit dans l'affaire Hacktron, où le refus du modèle suivant avait sauté avec un simple habillage en exercice de sécurité. Anthropic ajoute désormais un classifieur qui contrôle chaque action avant son exécution. Je ne sais pas s'il résisterait au même déguisement : rien dans l'annonce ne permet de le dire.

→ Voir aussi : Trois chercheurs ont atteint des comptes OpenAI avec Claude

Le vrai problème : les faux positifs

Le principe se défend. L'exécution, elle, pose question. Sur le dépôt GitHub de Claude Code, des développeurs décrivent depuis juin des sessions Fable 5 et 5.1 basculées vers Opus 4.8 pendant un travail défensif sur leur propre code : durcissement d'une application, préparation d'une version, administration de leur réseau.

Un signalement du 12 septembre, d'un abonné Max sous Fable 5.1, décrit le pire scénario : après un premier signalement, tous les messages suivants sont restés sur Opus 4.8, même en resélectionnant Fable. Désactiver la bascule automatique n'aide pas : le message signalé est alors bloqué.

Pour Opus 5.5, je n'ai trouvé aucun retour à ce jour : il est sorti il y a quelques heures. De mon côté, je n'ai jamais vu ce bandeau de bascule dans mes sessions Claude Code.

→ Voir aussi : Le piège des agents IA : tu surveilles la mauvaise chose

Ce qui change pour un abonné Pro

Anthropic relève les limites sur cinq heures des offres Pro, Max, Team et Enterprise, et offre aux abonnés une réinitialisation de limite qu'ils peuvent garder et utiliser quand ils le souhaitent. C'est la ligne qui me concerne le plus, puisque le quota Pro est mon premier frein. Mais l'annonce ne chiffre pas cette hausse. Je ne peux donc pas te dire de combien tu gagnes.

→ Voir aussi : Claude Code Projects : plusieurs agents, quelles limites ?

Mon avis

Je ne tranche pas à ta place sur le principe. Rediriger les tâches cyber à risque vers un modèle moins capable peut se justifier, surtout pour un modèle qu'Anthropic juge au niveau de Mythos 5.1 dans ce domaine. Si tu codes une application web, fais du refactoring ou des migrations, rien dans l'annonce ne dit que tu seras gêné.

Ma critique porte sur l'exécution. Une bascule silencieuse qui contamine toute la session peut transformer un faux positif en session inutilisable et consommer du quota sans que l'utilisateur comprenne immédiatement pourquoi. Si ton travail touche à la sécurité de ton propre code, surveille quel modèle répond réellement après un signalement. Sécurité ou confort : l'arbitrage t'appartient, mais il mérite d'être fait en connaissance de cause.

FAQ

Combien coûte Claude Opus 5.5 ?

4 $ par million de tokens en entrée et 20 $ en sortie, soit 20 % de moins qu'Opus 5. La lecture du cache passe à 0,20 $ par million de tokens, et le mode rapide coûte 8 $ et 40 $.

Opus 5.5 coûte-t-il 40 % de moins qu'Opus 5 ?

Aux réglages par défaut, selon Anthropic. En effort maximal, Artificial Analysis mesure 1,6 fois plus de tokens de sortie par tâche, et un coût par tâche au niveau d'Opus 5.

Pourquoi Claude Code bascule-t-il vers Opus 4.8 ?

Parce qu'un classifieur a jugé ta requête liée à une tâche de cybersécurité à risque. Opus 5.5 applique des garde-fous proches de ceux de Fable 5.1 : la correction de bugs reste permise, mais la plupart des tâches cyber sont redirigées vers Opus 4.8.

Opus 5.5 est-il meilleur que GPT-6 Astra ?

Sur l'indice d'Artificial Analysis, Opus 5.5 devance Astra, 58 à 53. Pour Terminal-Bench, les chiffres communiqués donnent 66,4 % contre 57,9 %, mais il ne s'agit pas d'un test indépendant commun aux deux modèles. Ce sont des benchmarks, pas une garantie pour ton usage.


Transparence : article préparé avec l'aide de Claude Opus 5.5, puis vérifié à partir de l'annonce officielle d'Anthropic et des mesures d'Artificial Analysis. Je n'ai pas encore testé Opus 5.5 dans Claude Code.

garde-fous cybersécuritéClaude Codeclaude opus 5.5Anthropic
Partager :TwitterLinkedIn