Anthropic a lancé Claude Haiku 5.5 le 7 octobre 2026. Le modèle vise les tâches nombreuses et sensibles au coût, notamment les résumés, la compaction, les requêtes de base de données et la classification. Il convient aussi aux usages qui exigent de la rapidité, comme le support client en direct et la navigation web. Anthropic le présente comme un sous-agent de programmation pouvant travailler avec Opus 5.5 et Sonnet 5.5.

À vitesse standard, Anthropic présente Haiku 5.5 comme son modèle le plus rapide à ce jour. Les modèles Opus sont plus rapides en Fast Mode. Haiku 5.5 coûte environ 75 % moins cher à exploiter que Haiku 4.5 en moyenne. Le tarif affiché baisse de 90 % pour les prompts jusqu’à 100 000 tokens et de 50 % au-delà. Un tokenizer mis à jour entraîne une consommation légèrement supérieure de tokens par tâche.

Les chiffres publiés par Anthropic suivent l’ordre Haiku 5.5, Haiku 4.5, GPT-6 Luna et Sonnet 5.5. Sur GDPval-AA v2.1, les scores sont de 1620, 735, 1437 et 1840. Sur AA-Briefcase v1.1, ils sont de 1578, 614, 1336 et 1824. Sur la partie hors ligne d’OSWorld 2.1, les résultats atteignent 72,4 %, 15,7 %, 48,9 % et 83,9 %.

Pour Humanity’s Last Exam, les scores sans outils sont de 45,9 %, 10,2 %, aucun résultat indiqué et 56,9 %. Avec outils, ils sont de 57,4 %, 18,7 %, aucun résultat indiqué et 64,5 %. Terminal-Bench 4.0 donne 39,2 %, 0,0 %, 16,4 % et 70,6 %. FrontierCode 1.1 Main donne 46,4 %, aucun résultat indiqué, 42,4 % et 52,1 % en mode Xhigh. Les scores de Chartography sans outils sont de 46,4 %, 6,4 %, 29,1 % et 61,6 %.

OSWorld 2.1 mesure la capacité d’agents informatiques à mener des tâches longues en plusieurs étapes. GDPval-AA v2.1 évalue du travail professionnel dans 44 métiers. Humanity’s Last Exam porte sur les connaissances et le raisonnement académiques de niveau expert. Terminal-Bench 4.0 teste des tâches complexes en ligne de commande. Haiku 5.5 est le premier modèle de la gamme Haiku à proposer un niveau d’effort réglable. L’utilisateur peut ainsi arbitrer le coût et les capacités. Anthropic présente ce réglage sur OSWorld, GDPval-AA v2.1 et Humanity’s Last Exam.

Les premiers tests clients font état d’une latence réduite et de meilleurs scores. Dans les évaluations d’AI Teammates, Aaron Vinh, d’Asana, a mesuré une baisse de plus de 30 % de la latence d’exécution et une inférence jusqu’à 2,5 fois plus rapide par tour d’agent. Ze’ev Klapow, de HubSpot, rapporte une moyenne de 92,8 % sur trois exécutions de tâches CRM. Haiku 5.5 a aussi été le plus rapide, avec le meilleur taux de détection et le plus faible taux de faux positifs du groupe testé.

AlphaSense exécute environ 8 millions d’appels Ask in Document par semaine. Daniel Campos indique que 400 requêtes de test sont passées de 0,76 avec Haiku 4.5 à 0,84 avec Haiku 5.5, avec une différence statistiquement significative. Yashodha Bhavnani, de Box, rapporte un gain de 11 points par rapport à Haiku 4.5 avec environ deux fois moins de latence. Alex Wang, de Rogo, cite les recherches rapides, les résumés et les sous-agents. Walden Yan, de Cognition, rapporte pour Devin Fusion un score de 66,2 à FrontierCode avec Haiku 5.5 comme sidekick, ainsi qu’une baisse des coûts et de la latence.

Les tarifs sont indiqués pour 1 million de tokens. Pour des prompts jusqu’à 100 000 tokens et au-delà, Haiku 5.5 facture respectivement 0,01 et 0,05 dollar pour les lectures du cache, 0,125 et 0,625 dollar pour les écritures du cache, 0,10 et 0,50 dollar pour les entrées, puis 0,50 et 2,50 dollars pour les sorties. Haiku 4.5 facture 0,10 dollar pour les lectures du cache, 1,25 dollar pour les écritures, 1,00 dollar pour les entrées et 5,00 dollars pour les sorties. Sonnet 5.5 facture 0,10, 2,50, 2,00 et 10,00 dollars dans ces catégories. Environ 90 % des requêtes adressées à l’ancien modèle Haiku restaient sous 100 000 tokens.

Haiku 5.5 présente moins de comportements désalignés et coopère moins volontiers avec les usages abusifs dans presque toutes les évaluations d’alignement d’Anthropic. Ses protections en cybersécurité sont plus strictes que celles de Haiku 4.5 et moins restrictives que celles de plusieurs modèles récents. Elles autorisent davantage de tâches défensives que les protections de Sonnet 5.5, tout en bloquant les tests d’intrusion et les techniques susceptibles d’aider un attaquant. Les protections biologiques sont identiques à celles de Sonnet 5, Sonnet 5.5 et Opus 5. Les questions de recherche sont permises, les demandes jugées susceptibles de causer un préjudice sont limitées. Anthropic renvoie les organisations ayant des besoins plus larges vers son Life Sciences Verification Program et son Cyber Verification Program.

Claude Haiku 5.5 est disponible sur la plateforme Anthropic, Amazon Web Services, Google Cloud et Microsoft Azure. Son identifiant de modèle est claude-haiku-5-5. Anthropic publie aussi un guide de migration.

Anthropic a également réduit le prix des lectures du cache de Sonnet 5.5, de 0,20 à 0,10 dollar par million de tokens. Cette mesure doit réduire d’environ 20 % le coût de Sonnet 5.5 sur la plupart des tâches agentiques. Les abonnés Max 5x recevront 100 dollars de crédits API par mois, les abonnés Max 20x 200 dollars et les abonnés Team jusqu’à 500 dollars partagés entre leurs utilisateurs. Le déploiement commence pendant la semaine du lancement. Les crédits fonctionnent avec tous les modèles Claude sur la Claude Platform.

Anthropic ajoute la prise en charge bêta de l’utilisation de l’ordinateur et du navigateur à ses SDK Claude Python et TypeScript. L’entreprise recommande particulièrement Haiku 5.5 pour ces usages en raison de son rapport entre vitesse, capacités et prix. Sonnet 5.5 et Opus 5.5 restent mieux adaptés au codage agentique complexe évalué par Terminal-Bench 4.0.