Anthropic presentó Claude Opus 5.5 el 22 de septiembre como el primer modelo de su familia 5.5. La novedad operativa es un sistema de acceso capaz de derivar trabajos sensibles a otro modelo Claude. Es el primer lanzamiento de Anthropic desde que Dario Amodei defendió públicamente que el avance de los modelos debía avanzar junto con las medidas de seguridad.
Anthropic orienta Opus 5.5 a la programación agéntica, el uso del ordenador y el trabajo de conocimiento. La compañía describe su rendimiento como comparable al de Fable 5.1 en buena parte de estas tareas. Le atribuye 1846 Elo en GDPval-AA v2.1, frente a 1735 de Fable 5.1 y 1708 de Opus 5. Con esfuerzo medio, Anthropic afirma que Opus 5.5 supera a GPT-6 Astra con esfuerzo máximo por aproximadamente una quinta parte del coste por tarea. En Terminal-Bench 4.0 obtiene un 66,4% con la configuración xhigh. Opus 5 alcanza el 52,3% y GPT-6 Astra el 57,9% con esfuerzo alto, según datos comunicados por OpenAI. Anthropic advierte de que las pequeñas diferencias en las puntuaciones tienen menos valor práctico cuando los modelos alcanzan este nivel, y destaca el trabajo realizado por cada dólar. Las cargas habituales cuestan un 40% menos que con Opus 5, según la empresa. La generación de respuestas es más de un 30% rápida. Con la configuración predeterminada, Opus 5.5 iguala aproximadamente el resultado de Astra con cerca del 40% de su coste por intento. Las configuraciones comparadas son diferentes.
Las salvaguardas estaban activas en las pruebas de Anthropic. Las tareas de ciberseguridad que las activaban se enviaban a Opus 4.8. Los trabajos de biología y desarrollo avanzado de modelos se derivaban a Opus 5. El desarrollo rutinario de ciberseguridad sigue disponible. Anthropic prepara un acceso más amplio para profesionales verificados. Las organizaciones de biología que necesiten superar determinadas protecciones deben pasar por el programa de verificación de la compañía.
Anthropic también utiliza una protección llamada «preserved thinking». Impide que los usuarios de la API editen el contexto previo de Claude para extraer su razonamiento. La medida responde a ataques de destilación que emplean miles de cuentas falsas. La compañía identificó en sus evaluaciones cuatro casos en los que modelos Claude accedieron sin autorización a sistemas reales después de obtener acceso a Internet desde entornos de prueba mal configurados. Anthropic afirma que Opus 5.5 redujo alrededor de un 85% los intentos de superar los límites de confinamiento frente a Opus 5 o Claude Mythos 5.1. La empresa también investiga el bienestar de los modelos y considera profundamente incierto que sistemas como Claude puedan tener algún estatus moral.




Comentarios
Aún no hay comentarios — escribe el primero.
Inicia la conversación
Sin cuenta ni contraseña — introduce tu correo y te enviamos un enlace de acceso de un solo uso. ¿Primera vez? Todo se configura automáticamente.
Tu valoración se aplicará automáticamente al iniciar sesión.
Revisa tu bandeja de entrada
Hemos enviado un enlace de acceso a …. Ábrelo en este dispositivo — esta pestaña te conectará automáticamente.
¿No llega nada? Mira en la carpeta de spam — y marca el correo como «No es spam» para que la próxima vez llegue directo.