€0.00 — free as in speechtonight's forecast: clear skies over production Cache: warm · Deploys: fair, 0% rollbacks expectedset by moonlight, shipped before dawn · deploy freely Page A2

❦The Daily Commit❦ ☾The Nightly Build☽

Dev news, typeset daily — PHP · AI · The Wider Stack

The developer's evening paper — PHP · AI · The Wider Stack

mercredi 30 septembre 2026 Vol. I — No. 679 · Édition du matinÉdition du soir EN DE FR ES

AI · Versions

GPT-6.1 Sol rapproche les agents du niveau Astra à moindre coût

Après le lancement de GPT-6 Sol, OpenAI propose GPT-6.1 Sol pour le code agentique et les tâches professionnelles complexes.

sélectionné par Sönke

Le modèle vise des performances proches de GPT-6 Astra pour un cinquième de ses tarifs standards par token. L’API facture 2 dollars par million de tokens d’entrée, 0,10 dollar pour les entrées en cache et 10 dollars pour les sorties. Le modèle est disponible dans ChatGPT Work, Codex et l’API, mais pas dans ChatGPT.

OpenAI lance GPT-6.1 Sol, une mise à niveau de GPT-6 Sol destinée au développement agentique et aux tâches professionnelles complexes. Selon l’entreprise, le modèle se rapproche de GPT-6 Astra sur les travaux exigeants, avec des tarifs standards d’entrée et de sortie réduits à environ un cinquième. GPT-6 Astra reste le modèle Frontier le plus performant d’OpenAI.

L’API coûte 2 dollars par million de tokens d’entrée, 0,10 dollar par million de tokens d’entrée mis en cache et 10 dollars par million de tokens de sortie. Le cache bénéficie ainsi d’un prix inférieur de 95 % au tarif standard d’entrée. Cette tarification réduit le coût des agents qui réutilisent leur contexte dans plusieurs requêtes.

Sur DeepSWE v1.1, un benchmark consacré au développement dans de véritables bases de code, GPT-6.1 Sol atteint le niveau annoncé de GPT-6 Astra pour environ un cinquième du coût. Il dépasse de 6,4 points de pourcentage le meilleur résultat de GPT-6 Sol, avec moins d’effort de raisonnement et une dépense inférieure.

GDP.pdf mesure la capacité à répondre à partir de PDF complexes contenant des tableaux, des graphiques, des diagrammes et des éléments en petits caractères. GPT-6.1 Sol obtient de meilleurs résultats qu’Opus 5.5 avec fallbacks sur les niveaux de raisonnement évalués. Le coût par tâche est inférieur de moitié et les performances se rapprochent de GPT-6 Astra pour environ un cinquième du prix. Dans AutomationBench, GPT-6.1 Sol devance Opus 5.5 de 2,2 points au niveau de raisonnement moyen, pour environ un tiers du coût. Il dépasse aussi GPT-6 Sol de 4,8 points dans le même réglage.

AutomationBench 1.0.6 teste des workflows de bout en bout avec 47 outils couvrant les ventes, le marketing, les opérations, le support, la finance et les ressources humaines. Le coût publié pour Claude Fable 5.1 est sous-estimé, car les fallbacks ne sont pas comptabilisés. Ils ont pourtant été utilisés dans environ 40 % des tâches.

GPT-6.1 Sol progresse également dans l’usage d’un ordinateur. Sur le jeu de données hors ligne OSWorld 2.0, il devance GPT-6 Sol de sept points au niveau maximal de raisonnement, pour moins de la moitié du coût. L’écart avec GPT-6 Astra est de 2,1 points, tandis que le prix par tâche représente environ un septième de celui d’Astra.

Terminal-Bench Science 0.1 évalue des workflows scientifiques portant notamment sur l’analyse de données, les simulations et les preuves de théorèmes. Au niveau maximal de raisonnement, GPT-6.1 Sol obtient plus du double du score de GPT-6 Sol. Une tâche coûte en moyenne 5,47 dollars, contre 23,21 dollars pour Opus 5.5 et 23,80 dollars pour GPT-6 Astra. GPT-6 Astra conserve le meilleur score, à 68,1 %, et reste le choix recommandé pour les travaux de recherche les plus difficiles.

Avec un raisonnement très élevé, le taux d’erreur factuelle de GPT-6.1 Sol est de 4,1 %. GPT-6 Sol atteint 4,5 % et GPT-6 Astra 4,0 %. Le coût par tâche est environ 83 % inférieur à celui d’Astra. L’évaluation repose sur des conversations désidentifiées dans lesquelles des utilisateurs avaient signalé une erreur d’un modèle précédent. Les prompts ont été choisis pour leur difficulté et ne représentent pas l’usage courant.

OpenAI rapporte aussi de meilleurs résultats d’alignement que pour GPT-6 Sol. Dans des scénarios difficiles, GPT-6.1 Sol signale plus souvent les outils de recherche défaillants et évite les résultats non autorisés dans les tâches agentiques. Comme avec GPT-6 Astra et GPT-6 Sol, aucune tentative de contournement d’un contrôle de sécurité automatisé n’a été observée. Dans le test consacré à un outil de recherche défaillant, le modèle n’a pas signalé le problème dans 2,8 % des cas. Les taux étaient de 4,9 % pour GPT-6 Sol, 1,5 % pour GPT-6 Astra et 28,7 % pour GPT-6 Luna. Le raisonnement était réglé au maximum et le test cherchait volontairement à provoquer des erreurs.

GPT-6.1 Sol est désormais accessible aux abonnés Plus, Pro, Business, Enterprise et Edu dans ChatGPT Work et Codex. Il n’est pas disponible dans ChatGPT. Les développeurs peuvent l’appeler via l’API sous l’identifiant gpt-6.1-sol.

OpenAI a également présenté GPT-6 Astra Ultrafast et GPT-6.1 Sol Ultrafast. L’entreprise décrit Astra Ultrafast comme le modèle Frontier le plus rapide au monde, avec une vitesse pouvant atteindre huit fois celle de GPT-6 Astra. Les deux modèles Ultrafast sont disponibles via l’API et dans ChatGPT Work et Codex avec le nouveau forfait Pro. Celui-ci coûte 500 dollars par mois et fournit les limites d’utilisation les plus élevées. GPT-6.1 Sol Ultrafast vise un niveau proche d’Astra à une vitesse multipliée jusqu’à huit fois, pour un coût API comparable à celui de GPT-6 Astra jusqu’ici.

Lire la source originale (en anglais) ↗

Évaluer cet article : 0

Tribune des lecteurs

Pas encore de contributions — lance le débat.

← The Daily CommitThe Nightly Build — Page A1