OpenAI ha lanzado GPT-6.1 Sol, una actualización de GPT-6 Sol orientada a la programación agéntica y el trabajo profesional complejo. La compañía afirma que el modelo se acerca a GPT-6 Astra en tareas exigentes, con precios estándar de entrada y salida de aproximadamente una quinta parte. GPT-6 Astra sigue siendo el modelo Frontier más capaz de OpenAI.

El acceso por API cuesta 2 dólares por millón de tokens de entrada, 0,10 dólares por millón de tokens de entrada almacenados en caché y 10 dólares por millón de tokens de salida. El precio de la entrada en caché es un 95 % inferior al precio estándar. Esto reduce el coste de los agentes que reutilizan contexto entre varias solicitudes.

En DeepSWE v1.1, una prueba de desarrollo sobre bases de código reales, GPT-6.1 Sol alcanza el rendimiento comunicado de GPT-6 Astra por cerca de una quinta parte del coste. Supera en 6,4 puntos porcentuales el mejor resultado de GPT-6 Sol, con menor esfuerzo de razonamiento y un gasto inferior.

GDP.pdf evalúa respuestas basadas en PDF complejos con tablas, gráficos, diagramas y texto pequeño. GPT-6.1 Sol obtiene mejores resultados que Opus 5.5 con fallbacks en todos los niveles de razonamiento probados. Cuesta menos de la mitad por tarea y se acerca a GPT-6 Astra por alrededor de una quinta parte del precio. En AutomationBench, GPT-6.1 Sol supera a Opus 5.5 en 2,2 puntos en el nivel de razonamiento medio y cuesta aproximadamente un tercio. También aventaja a GPT-6 Sol en 4,8 puntos con la misma configuración.

AutomationBench 1.0.6 prueba flujos de trabajo completos con 47 herramientas de ventas, marketing, operaciones, soporte, finanzas y recursos humanos. El coste publicado para Claude Fable 5.1 es inferior al real porque no incluye los fallbacks. Estos se produjeron en aproximadamente el 40 % de las tareas.

GPT-6.1 Sol también mejora en el uso del ordenador. En el conjunto de datos offline OSWorld 2.0, supera a GPT-6 Sol en siete puntos con el máximo nivel de razonamiento y cuesta menos de la mitad. Queda 2,1 puntos por debajo de GPT-6 Astra, pero el coste por tarea es de aproximadamente una séptima parte.

Terminal-Bench Science 0.1 mide flujos científicos relacionados con análisis de datos, simulaciones y demostraciones de teoremas. Con el máximo razonamiento, GPT-6.1 Sol obtiene más del doble de puntuación que GPT-6 Sol. Cada tarea cuesta de media 5,47 dólares, frente a 23,21 dólares para Opus 5.5 y 23,80 dólares para GPT-6 Astra. GPT-6 Astra conserva la mejor puntuación, con un 68,1 %, y sigue siendo la opción indicada para las investigaciones más difíciles.

La tasa de errores factuales de GPT-6.1 Sol es del 4,1 % con un razonamiento muy alto. GPT-6 Sol alcanza el 4,5 % y GPT-6 Astra el 4,0 %. El coste por tarea es aproximadamente un 83 % menor que el de Astra. La evaluación utiliza conversaciones desidentificadas en las que los usuarios habían señalado un error de un modelo anterior. Las consultas fueron seleccionadas por su dificultad y no representan el uso habitual.

OpenAI también informa de una mejora de alineamiento frente a GPT-6 Sol. En pruebas difíciles, GPT-6.1 Sol identifica con más fiabilidad las herramientas de búsqueda defectuosas y evita resultados no autorizados en tareas agénticas. Al igual que con GPT-6 Astra y GPT-6 Sol, no se observaron intentos de eludir controles de seguridad automatizados. En la prueba de la herramienta de búsqueda defectuosa, el modelo no señaló el problema en el 2,8 % de los casos. Las cifras fueron del 4,9 % para GPT-6 Sol, el 1,5 % para GPT-6 Astra y el 28,7 % para GPT-6 Luna. La prueba usó el máximo razonamiento y estaba diseñada para provocar errores.

GPT-6.1 Sol ya está disponible para suscriptores Plus, Pro, Business, Enterprise y Edu en ChatGPT Work y Codex. No está disponible en ChatGPT. Los equipos de desarrollo pueden usarlo mediante la API con el identificador gpt-6.1-sol.

OpenAI también ha presentado GPT-6 Astra Ultrafast y GPT-6.1 Sol Ultrafast. La compañía describe Astra Ultrafast como el modelo Frontier más rápido del mundo, con una velocidad de hasta ocho veces la de GPT-6 Astra. Ambos modelos Ultrafast están disponibles mediante la API y en ChatGPT Work y Codex con el nuevo nivel Pro. Este plan cuesta 500 dólares al mes y ofrece los límites de uso más altos. GPT-6.1 Sol Ultrafast busca ofrecer una capacidad cercana a Astra con hasta ocho veces más velocidad, por un coste de API aproximadamente igual al que tenía GPT-6 Astra hasta ahora.