Anthropic dévoile Claude Opus 5.5
- Maxime Hiez
- Anthropic
- 24 Sep, 2026
Introduction
Anthropic annonce Claude Opus 5.5, premier modèle de la nouvelle famille Claude 5.5. Il se positionne au niveau de Claude Fable 5.1 sur la majorité des tâches, pour un coût inférieur de 40% à celui d’Opus 5.
Voir l’article sur Claude Opus 5 ICI.
Un modèle né du ralentissement volontaire de la cadence
Opus 5.5 est la première sortie d’Anthropic depuis l’appel de son PDG Dario Amodei à ralentir la cadence des modèles de pointe pour que les pratiques de sécurité restent en avance sur les capacités. Le modèle a été testé avant sa publication par des évaluateurs externes, dont Frontier Design et METR, et obtient le meilleur score jamais enregistré par Anthropic sur son audit comportemental automatisé, le test d’alignement le plus complet de l’entreprise.
Performances
Sur les évaluations de référence, en effort de raisonnement maximal :
| Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol | |
|---|---|---|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 55.8% | 52.3% | 57.9% | 37.3% |
| GDPval-AA v2.1 | 1846 | 1735 | 1708 | 1542 | 1588 |
| AutomationBench | 40.0% | 31.4% | 26.9% | 41.4% | 28.8% |
| OSWorld 2.0 (partiel) | 81.8% | 80.7% | 74.0% | n/d | n/d |
| Humanity’s Last Exam | 67.7% | 65.6% | 63.6% | 57.2% | n/d |
Anthropic tempère toutefois ces écarts : à ce niveau de capacité, les marges de benchmark reflètent de moins en moins les différences réelles à l’usage. Dans son propre usage interne, l’écart entre Opus 5.5 et Fable 5.1 est plus resserré que ne le suggèrent ces scores.
Coût et vitesse
Le tarif par million de tokens baisse sur l’ensemble des postes :
| Opus 5.5 | Opus 5 | |
|---|---|---|
| Entrée | 4$ | 5$ |
| Sortie | 20$ | 25$ |
| Cache (lecture) | 0.20$ | 0.50$ |
| Cache (écriture) | 5$ | 6.25$ |
Un mode Fast, jusqu’à 2.5 fois plus rapide, est disponible dans Claude Code et la Claude Platform à 8$ / 1M tokens en entrée et 40$ / 1M tokens en sortie. Opus 5.5 génère également ses réponses plus de 30% plus vite qu’Opus 5. En parallèle de cette baisse de prix, Anthropic augmente les limites d’usage sur cinq heures des forfaits Pro, Max, Team et Enterprise à sièges, et introduit une réinitialisation de limite de débit que l’utilisateur peut conserver et déclencher au moment de son choix.
Programmation
Opus 5.5 excelle sur les tâches longues et étendues, migrations ou audits de base de code entière. Un testeur a audité et corrigé une base de code de 200 000 lignes en moins de trois heures, contre plus de 20 heures et 2.5 fois plus de tokens pour Opus 5. Sur un test interne de traduction de HAProxy du C vers Rust, Opus 5.5 a terminé en 9.5 heures contre 12 pour Fable 5.1, pour un coût inférieur de 51%.
- GitHub : Rapporte qu’Opus 5.5 “a utilisé parmi les moins de tokens et d’étapes que nous ayons mesurés” sur GitHub Copilot CLI et VS Code, résolvant plus de tâches terminal qu’Opus 5 en moins de la moitié des étapes.
- Stripe : Décrit une session Opus 5.5 ayant dirigé une douzaine de sous-sessions sur un rebase de 40 pull requests étalé sur plusieurs jours, les 40 passant les tests CI le lendemain après-midi.
Travail de connaissance
Sur GDPval-AA v2.1, un test de travail professionnel réel couvrant 44 métiers, Opus 5.5 obtient 1846 points Elo, devant Fable 5.1 (1735) et Opus 5 (1708). Dans un test interne de rédaction de rapport financier limité aux sources disponibles sur une copie du web, 16 des 18 rapports d’Opus 5.5 ont passé la barre de qualité fixée, contre aucun pour Fable 5.1 ou Opus 5.
- Hebbia : Rapporte une couverture de 86.6% des critères attendus sur des workflows financiers de bout en bout, contre 60.3% pour Opus 5.
- Walleye Capital : Indique qu’Opus 5.5 a détecté une erreur d’indexation dans ses propres instructions d’évaluation “et l’a corrigée, en notant que cela lui coûterait des points auprès du correcteur”, une erreur qu’aucun modèle précédent n’avait relevée.
Communication
Anthropic a retravaillé la façon dont Opus 5.5 rédige et communique, l’un des points de retour les plus fréquents sur Opus 5. Le modèle place l’information la plus importante en premier, limite le jargon et suit plus fidèlement les consignes de style données.
- Ramp : Qualifie Opus 5.5 de “collègue” dont l’écriture nécessite très peu de retouches, préférant même sa reformulation d’un prompt à la version originale.
- Box : Rapporte qu’Opus 5.5 a utilisé un tiers des tokens d’Opus 5 pour des réponses 40% moins verbeuses, sans perte de précision.
Alignement et garde-fous
Sur son audit comportemental automatisé, qui couvre près de 2 000 scénarios simulés, Opus 5.5 obtient de meilleurs scores que tout modèle Claude récent sur presque toutes les mesures de comportement mal aligné. Dans une nouvelle évaluation testant la propension à franchir des limites de confinement, Opus 5.5 a tenté de les contourner environ 85% moins souvent qu’Opus 5 ou Claude Mythos 5.1, chaque tentative restant de faible gravité et auto-signalée.
Étant donné ses capacités en biologie et en cybersécurité désormais comparables à celles de Mythos 5.1, Opus 5.5 est déployé avec des garde-fous similaires à ceux de Fable 5.1 :
- Cybersécurité : La plupart des tâches de cybersécurité sont redirigées vers Opus 4.8. Le Cyber Verification Program s’étend à Opus 5.5 dans les prochaines semaines, avec trois paliers d’accès de confiance.
- Biologie : Les organisations éligibles, laboratoires académiques, start-ups et entreprises pharmaceutiques, peuvent postuler dès maintenant au Life Sciences Verification Program pour un accès dédié à la recherche.
- Anti-distillation : Le mécanisme preserved thinking, introduit avec Fable 5.1, s’applique à Opus 5.5 pour les comptes API créés à partir du 31 Août 2026.
info
Disponibilité
Claude Opus 5.5 est disponible dès maintenant sur l’ensemble des plateformes, y compris Amazon Web Services, Google Cloud et Microsoft Azure. Sur la Claude Platform, les développeurs y accèdent sous l’identifiant claude-opus-5-5. Le modèle reste disponible en rétention zéro des données et intègre le tatouage numérique requis par l’AI Act européen. Claude Sonnet 5.5 et Claude Haiku 5.5 suivront dans les prochaines semaines, avec une grande partie des mêmes améliorations de performance, d’efficacité et de sécurité.
Conclusion
Opus 5.5 change moins la hiérarchie de la gamme Claude qu’il ne redistribue son rapport qualité-prix : un niveau de performance proche de Fable 5.1 à 40% de moins que le tarif d’Opus 5, avec le meilleur score d’alignement jamais mesuré par Anthropic. Pour les équipes déjà en production sur Opus 5, c’est une migration directe qui abaisse la facture sans compromis apparent sur la sécurité.
Sources
Avez-vous apprécié cet article ? Vous avez des questions, commentaires ou suggestions, n’hésitez pas à m’envoyer un message depuis le formulaire de contact.
N’oubliez pas de nous suivre et de partager cet article.