Anthropic lanzó Claude Haiku 5.5 el 7 de octubre de 2026. El modelo está orientado a tareas de gran volumen y sensibles al coste, como resúmenes, compactación, consultas a bases de datos y clasificación. También se adapta a usos que requieren rapidez, como la atención al cliente en directo y la navegación web. Anthropic lo plantea como subagente para programación junto con Opus 5.5 y Sonnet 5.5.
Anthropic presenta Haiku 5.5 como su modelo más rápido hasta la fecha a la velocidad estándar de cada modelo. Los modelos Opus funcionan más rápido en Fast Mode. Haiku 5.5 cuesta alrededor de un 75 % menos que Haiku 4.5 en promedio. El precio baja un 90 % para prompts de hasta 100.000 tokens y un 50 % por encima de ese límite. Un tokenizer actualizado hace que use algo más de tokens por tarea.
Las cifras publicadas por Anthropic siguen el orden Haiku 5.5, Haiku 4.5, GPT-6 Luna y Sonnet 5.5. En GDPval-AA v2.1, las puntuaciones son 1620, 735, 1437 y 1840. En AA-Briefcase v1.1 son 1578, 614, 1336 y 1824. En el subconjunto offline de OSWorld 2.1, los resultados son 72,4 %, 15,7 %, 48,9 % y 83,9 %.
En Humanity’s Last Exam, las puntuaciones sin herramientas son 45,9 %, 10,2 %, sin dato y 56,9 %. Con herramientas alcanzan 57,4 %, 18,7 %, sin dato y 64,5 %. Terminal-Bench 4.0 registra 39,2 %, 0,0 %, 16,4 % y 70,6 %. FrontierCode 1.1 Main obtiene 46,4 %, sin dato, 42,4 % y 52,1 % en Xhigh. Chartography sin herramientas queda en 46,4 %, 6,4 %, 29,1 % y 61,6 %.
OSWorld 2.1 mide la capacidad de agentes informáticos para completar tareas largas con varios pasos. GDPval-AA v2.1 evalúa trabajo profesional en 44 ocupaciones. Humanity’s Last Exam comprueba conocimientos académicos y razonamiento de nivel experto. Terminal-Bench 4.0 mide tareas complejas en la línea de comandos. Haiku 5.5 es el primer modelo de la clase Haiku con un nivel de esfuerzo ajustable. El usuario puede equilibrar coste y capacidad. Anthropic muestra esta opción en OSWorld, GDPval-AA v2.1 y Humanity’s Last Exam.
Las primeras pruebas de clientes apuntan a una menor latencia y mejores resultados. Aaron Vinh, de Asana, informó de una reducción superior al 30 % en la latencia de finalización y de una inferencia hasta 2,5 veces más rápida por turno de agente en las evaluaciones de AI Teammates. Ze’ev Klapow, de HubSpot, obtuvo una media del 92,8 % en tres ejecuciones de tareas de CRM. Haiku 5.5 también fue el más rápido, con la mayor tasa de aciertos y la menor tasa de falsos positivos del conjunto probado.
AlphaSense procesa unos 8 millones de llamadas semanales de Ask in Document. Daniel Campos indicó que 400 consultas de prueba mejoraron de 0,76 con Haiku 4.5 a 0,84 con Haiku 5.5, con una diferencia estadísticamente significativa. Yashodha Bhavnani, de Box, comunicó una mejora de 11 puntos frente a Haiku 4.5 con aproximadamente la mitad de latencia. Alex Wang, de Rogo, señaló las consultas rápidas, los resúmenes y los subagentes como usos adecuados. Walden Yan, de Cognition, comunicó una puntuación de 66,2 en FrontierCode para Devin Fusion con Haiku 5.5 como sidekick, además de menores costes y latencia.
Los precios se expresan por 1 millón de tokens. Para prompts de hasta 100.000 tokens y por encima de ese límite, Haiku 5.5 cobra 0,01 y 0,05 dólares por lecturas de caché, 0,125 y 0,625 dólares por escrituras de caché, 0,10 y 0,50 dólares por entradas, y 0,50 y 2,50 dólares por salidas. Haiku 4.5 cobra 0,10 dólares por lecturas de caché, 1,25 dólares por escrituras, 1,00 dólar por entradas y 5,00 dólares por salidas. Sonnet 5.5 cobra 0,10, 2,50, 2,00 y 10,00 dólares en esas categorías. Cerca del 90 % de las solicitudes al modelo Haiku anterior estaban dentro del límite de 100.000 tokens.
Haiku 5.5 muestra menos comportamientos desalineados y una menor disposición a colaborar con usos indebidos en casi todas las evaluaciones de alineación de Anthropic. Sus protecciones de ciberseguridad son más estrictas que las de Haiku 4.5 y menos restrictivas que las aplicadas a varios modelos recientes. Permiten más tareas defensivas que las protecciones de Sonnet 5.5, pero bloquean las pruebas de penetración y las técnicas con mayor potencial de uso ofensivo. Las protecciones biológicas coinciden con las de Sonnet 5, Sonnet 5.5 y Opus 5. Se permiten preguntas de investigación y se restringen las solicitudes consideradas potencialmente dañinas. Anthropic remite a las organizaciones con necesidades más amplias al Life Sciences Verification Program y al Cyber Verification Program.
Claude Haiku 5.5 está disponible en la plataforma de Anthropic, Amazon Web Services, Google Cloud y Microsoft Azure. Su identificador de modelo es claude-haiku-5-5. Anthropic también ofrece una guía de migración.
Anthropic redujo además el precio de las lecturas de caché de Sonnet 5.5 de 0,20 a 0,10 dólares por millón de tokens. La compañía calcula que el cambio reducirá alrededor de un 20 % el coste de Sonnet 5.5 en la mayoría de los trabajos agénticos. Los suscriptores Max 5x recibirán 100 dólares mensuales en créditos de API, los Max 20x recibirán 200 dólares y los suscriptores Team obtendrán hasta 500 dólares compartidos entre sus usuarios. El despliegue comienza durante la semana del lanzamiento. Los créditos sirven para cualquier modelo Claude en Claude Platform.
Anthropic está incorporando soporte beta para usar el ordenador y el navegador en sus SDK de Claude para Python y TypeScript. La compañía destaca Haiku 5.5 para estas tareas por su combinación de velocidad, capacidad y precio. Sonnet 5.5 y Opus 5.5 siguen siendo opciones más adecuadas para programación agéntica compleja, como la que mide Terminal-Bench 4.0.




Comentarios
Aún no hay comentarios — escribe el primero.
Inicia la conversación
Sin cuenta ni contraseña — introduce tu correo y te enviamos un enlace de acceso de un solo uso. ¿Primera vez? Todo se configura automáticamente.
Tu valoración se aplicará automáticamente al iniciar sesión.
Revisa tu bandeja de entrada
Hemos enviado un enlace de acceso a …. Ábrelo en este dispositivo — esta pestaña te conectará automáticamente.
¿No llega nada? Mira en la carpeta de spam — y marca el correo como «No es spam» para que la próxima vez llegue directo.