Lanzamientos
GPT-6.1 Sol acerca el trabajo de Astra a un precio menor
Después del lanzamiento de GPT-6 Sol, OpenAI presenta GPT-6.1 Sol para agentes de programación y tareas profesionales complejas. El modelo busca acercarse al rendimiento de GPT-6 Astra por una quinta parte de sus precios estándar por token. La API cuesta 2 dólares por millón de tokens de entrada, 0,10 dólares por entradas en caché y 10 dólares por salidas. Está disponible en ChatGPT Work, Codex y la API, pero no en ChatGPT.
OpenAI ha lanzado GPT-6.1 Sol, una actualización de GPT-6 Sol orientada a la programación agéntica y el trabajo profesional complejo. La compañía afirma que el modelo se acerca a GPT-6 Astra en tareas exigentes, con precios estándar de entrada y salida de aproximadamente una quinta parte. GPT-6 Astra sigue siendo el modelo Frontier más capaz de OpenAI.
El acceso por API cuesta 2 dólares por millón de tokens de entrada, 0,10 dólares por millón de tokens de entrada almacenados en caché y 10 dólares por millón de tokens de salida. El precio de la entrada en caché es un 95 % inferior al precio estándar. Esto reduce el coste de los agentes que reutilizan contexto entre varias solicitudes.
En DeepSWE v1.1, una prueba de desarrollo sobre bases de código reales, GPT-6.1 Sol alcanza el rendimiento comunicado de GPT-6 Astra por cerca de una quinta parte del coste. Supera en 6,4 puntos porcentuales el mejor resultado de GPT-6 Sol, con menor esfuerzo de razonamiento y un gasto inferior.
GDP.pdf evalúa respuestas basadas en PDF complejos con tablas, gráficos, diagramas y texto pequeño. GPT-6.1 Sol obtiene mejores resultados que Opus 5.5 con fallbacks en todos los niveles de razonamiento probados. Cuesta menos de la mitad por tarea y se acerca a GPT-6 Astra por alrededor de una quinta parte del precio. En AutomationBench, GPT-6.1 Sol supera a Opus 5.5 en 2,2 puntos en el nivel de razonamiento medio y cuesta aproximadamente un tercio. También aventaja a GPT-6 Sol en 4,8 puntos con la misma configuración.
AutomationBench 1.0.6 prueba flujos de trabajo completos con 47 herramientas de ventas, marketing, operaciones, soporte, finanzas y recursos humanos. El coste publicado para Claude Fable 5.1 es inferior al real porque no incluye los fallbacks. Estos se produjeron en aproximadamente el 40 % de las tareas.
GPT-6.1 Sol también mejora en el uso del ordenador. En el conjunto de datos offline OSWorld 2.0, supera a GPT-6 Sol en siete puntos con el máximo nivel de razonamiento y cuesta menos de la mitad. Queda 2,1 puntos por debajo de GPT-6 Astra, pero el coste por tarea es de aproximadamente una séptima parte.
Terminal-Bench Science 0.1 mide flujos científicos relacionados con análisis de datos, simulaciones y demostraciones de teoremas. Con el máximo razonamiento, GPT-6.1 Sol obtiene más del doble de puntuación que GPT-6 Sol. Cada tarea cuesta de media 5,47 dólares, frente a 23,21 dólares para Opus 5.5 y 23,80 dólares para GPT-6 Astra. GPT-6 Astra conserva la mejor puntuación, con un 68,1 %, y sigue siendo la opción indicada para las investigaciones más difíciles.
La tasa de errores factuales de GPT-6.1 Sol es del 4,1 % con un razonamiento muy alto. GPT-6 Sol alcanza el 4,5 % y GPT-6 Astra el 4,0 %. El coste por tarea es aproximadamente un 83 % menor que el de Astra. La evaluación utiliza conversaciones desidentificadas en las que los usuarios habían señalado un error de un modelo anterior. Las consultas fueron seleccionadas por su dificultad y no representan el uso habitual.
OpenAI también informa de una mejora de alineamiento frente a GPT-6 Sol. En pruebas difíciles, GPT-6.1 Sol identifica con más fiabilidad las herramientas de búsqueda defectuosas y evita resultados no autorizados en tareas agénticas. Al igual que con GPT-6 Astra y GPT-6 Sol, no se observaron intentos de eludir controles de seguridad automatizados. En la prueba de la herramienta de búsqueda defectuosa, el modelo no señaló el problema en el 2,8 % de los casos. Las cifras fueron del 4,9 % para GPT-6 Sol, el 1,5 % para GPT-6 Astra y el 28,7 % para GPT-6 Luna. La prueba usó el máximo razonamiento y estaba diseñada para provocar errores.
GPT-6.1 Sol ya está disponible para suscriptores Plus, Pro, Business, Enterprise y Edu en ChatGPT Work y Codex. No está disponible en ChatGPT. Los equipos de desarrollo pueden usarlo mediante la API con el identificador gpt-6.1-sol.
OpenAI también ha presentado GPT-6 Astra Ultrafast y GPT-6.1 Sol Ultrafast. La compañía describe Astra Ultrafast como el modelo Frontier más rápido del mundo, con una velocidad de hasta ocho veces la de GPT-6 Astra. Ambos modelos Ultrafast están disponibles mediante la API y en ChatGPT Work y Codex con el nuevo nivel Pro. Este plan cuesta 500 dólares al mes y ofrece los límites de uso más altos. GPT-6.1 Sol Ultrafast busca ofrecer una capacidad cercana a Astra con hasta ocho veces más velocidad, por un coste de API aproximadamente igual al que tenía GPT-6 Astra hasta ahora.
Tribuna de lectores
Aún no hay aportaciones — abre el debate.
Inicia la conversación
Sin cuenta ni contraseña — introduce tu correo y te enviamos un enlace de acceso de un solo uso. ¿Primera vez? Todo se configura automáticamente.
Tu valoración se aplicará automáticamente al iniciar sesión.
Revisa tu bandeja de entrada
Hemos enviado un enlace de acceso a …. Ábrelo en este dispositivo — esta pestaña te conectará automáticamente.
¿No llega nada? Mira en la carpeta de spam — y marca el correo como «No es spam» para que la próxima vez llegue directo.