Anthropic a rendu Claude Opus 5 disponible sur toutes ses plateformes. Le modèle approcherait l'intelligence de Claude Fable 5 pour moitié moins cher, tout en restant derrière Mythos 5 sur les tâches de cybersécurité. Il devient le modèle par défaut de Claude Max et le plus performant de Claude Pro.
Le tarif reste de 5 dollars par million de tokens en entrée et 25 dollars en sortie, comme Opus 4.8. Un mode Fast, environ 2,5 fois plus rapide, coûte le double. Un réglage d'effort permet d'arbitrer entre intelligence, rapidité et coût en tokens.
Sur les benchmarks, Opus 5 dominerait Frontier-Bench v0.1 et plus que doublerait la performance d'Opus 4.8 à coût inférieur par tâche. Sur CursorBench 3.2, il se place à 0,5 % du score maximal de Fable 5 pour moitié moins cher. Son score ARC-AGI 3 serait trois fois supérieur au meilleur concurrent, et sa réussite sur l'AutomationBench de Zapier environ 1,5 fois meilleure. Sur OSWorld 2.0, un benchmark d'utilisation d'ordinateur, Opus 5 surpasserait tout autre modèle à coût égal, dépassant le meilleur résultat de Fable 5 pour un peu plus d'un tiers du coût. Les évaluations en sciences de la vie progressent partout, avec +10,2 points en chimie organique et +7,7 points en prédiction de variants protéiques.
Anthropic souligne des comportements agentiques : Opus 5 a écrit sa propre pipeline de vision par ordinateur pour reconstruire une pièce mécanique en 3D sous FreeCAD à partir d'un plan non directement visible ; il a corrigé la cause racine d'un bug réel d'un gestionnaire de paquets open source ; et il a construit en une session un flux de données de marché pour une nouvelle bourse, avec son propre harnais de test. Des clients comme Cursor, Zapier, Lovable, JetBrains et Box rapportent des gains notables.
Côté alignement, Opus 5 obtient 2,3 sur l'audit comportemental, le score le plus bas des modèles récents. Il reste derrière Mythos 5 en biologie et cybersécurité offensive et n'a volontairement pas été entraîné sur des tâches cyber. Ses classifieurs cyber interviendraient 85 % moins souvent que ceux de Fable 5 ; les requêtes signalées basculent par défaut sur Opus 4.8.
Deux fonctions bêta accompagnent le lancement : modification des outils en cours de conversation sans invalider le cache de prompts, et fallbacks API automatiques pour les requêtes signalées. Le modèle est accessible via l'API Claude sous le nom claude-opus-5, sans obligation de conservation des données.
Commentaires
Pas encore de commentaire — écrivez le premier.
Rejoindre la discussion
Connectez-vous avec votre adresse e-mail — sans mot de passe. Nous vous envoyons un lien de connexion à usage unique.
Vérifiez votre boîte mail
Nous avons envoyé un lien de connexion à …. Ouvrez-le dans ce navigateur — ou saisissez ci-dessous le code à 6 chiffres s’il s’ouvre ailleurs.