Anthropic affirme désormais qu’Opus 5.5 devance le modèle plus grand Fable dans plusieurs benchmarks et réussit des tâches informelles que Fable n’avait pas pu mener à bien. Le modèle est arrivé deux mois après Opus 5, lancé le 24 juillet.

Opus 5.5 s’exécute plus rapidement, car son fonctionnement demande moins de calcul selon Anthropic. Son style de réponse a également changé. Le modèle emploie moins de jargon et place plus tôt les informations importantes.

Anthropic prévoit de lancer Sonnet 5.5 et Haiku 5.5 dans les prochaines semaines, avec des progrès comparables. L’entreprise juge Opus 5.5 comparable à Mythos en biologie et en cybersécurité. Le modèle reçoit donc les mêmes garde-fous que Fable. Ces mesures limitent notamment la recherche d’exploits dans des programmes compilés et la mise au point d’armes biologiques identifiables.

Ce lancement est le premier d’Anthropic depuis que son PDG Dario Amodei a demandé de ralentir l’avancée des capacités de pointe. Il estime que le travail d’alignement et de prévention des risques doit disposer de davantage de temps. La formation de sécurité d’Opus 5.5 ressemble globalement à celle de ses prédécesseurs. Elle comprend des tests d’alignement et des évaluations avant publication menées par METR et Frontier Design. Anthropic prépare pour ses futurs modèles des systèmes de formation et d’évaluation plus avancés, ainsi que de meilleurs outils de sécurité et de surveillance. L’entreprise estime aussi que les pouvoirs publics doivent jouer un rôle accru dans la sécurité de l’IA et dit mettre en place l’infrastructure correspondante.