OpenAI ha lanzado la familia de modelos GPT-5.6, que incluye tres versiones: Sol, el modelo insignia; Terra, una opción equilibrada; y Luna, la versión más económica. Sol establece un nuevo estándar en ciberseguridad, ciencia y programación, logrando una mayor densidad de inteligencia al obtener mejores resultados con menos tokens y costos reducidos en comparación con modelos frontera anteriores.

Las evaluaciones técnicas destacan una eficiencia significativamente superior. En el test Agents’ Last Exam, Sol alcanzó una puntuación de 53,6, superando a Claude Fable 5 por 13,1 puntos. En su modo de razonamiento máximo, Sol iguala casi la inteligencia de Fable 5 pero completa las tareas en un 61 % menos de tiempo y a aproximadamente la mitad del costo. En programación, Sol obtuvo 80 puntos en el Artificial Analysis Coding Agent Index, superando a Fable 5 con la mitad de tiempo y tokens de salida.

Se introduce la configuración "ultra" para coordinar múltiples agentes en flujos de trabajo paralelos y el modo "max" para razonamientos profundos. Una novedad técnica clave es el "Programmatic Tool Calling" en la API de Responses, que permite a los modelos escribir y ejecutar programas ligeros para gestionar herramientas y filtrar datos intermedios, reduciendo la necesidad de instrucciones constantes del desarrollador.

Para garantizar la seguridad, los modelos pasaron por un periodo de evaluación exhaustivo que incluyó red teaming humano y pruebas automatizadas. El sistema final combina protecciones entrenadas en el modelo con monitoreo en tiempo real y controles de acceso basados en el riesgo, evitando el mal uso sin limitar las tareas profesionales legítimas.