OpenAI présente GPT-6.1 Sol : un modèle économique pour la programmation et les agents intelligents

Publié le 29.09.2026

OpenAI a lancé GPT-6.1 Sol, une mise à jour de son modèle GPT-6 Sol qui rapproche les performances de celles de GPT-6 Astra, son modèle le plus puissant, avec un coût équivalent à un cinquième des prix standards d'Astra pour les jetons d'entrée et de sortie.

L'entreprise positionne ce modèle comme l'option offrant le meilleur rapport coût-performance parmi ses alternatives disponibles, avec des améliorations en programmation, utilisation de l'ordinateur, travail professionnel et recherche scientifique.

Qu'est-ce que GPT-6.1 Sol et pourquoi améliore-t-il le rapport coût-performance

GPT-6.1 Sol est une version améliorée de GPT-6 Sol qui réduit l'écart de capacité avec GPT-6 Astra, le modèle de pointe d'OpenAI, à un coût considérablement inférieur.

Son entrée en cache coûte 0,10 USD par million de jetons, une réduction de 95 % par rapport au prix d'entrée standard, ce qui le rend plus économique pour les charges de travail avec des agents qui réutilisent le contexte dans des requêtes répétées.

Comme l'explique OpenAI sur son site web, « GPT‑6 Astra reste notre modèle de pointe avec la plus grande capacité générale. GPT‑6.1 Sol offre un nouvel équilibre entre capacité et coût pour les tâches importantes que les utilisateurs souhaitent effectuer plus fréquemment et pour les clients de l'API qui créent et exécutent des applications à grande échelle ».

L'entreprise maintient trois niveaux de modèles avec des prix différenciés. GPT-6 Astra, défini comme le plus intelligent pour obtenir les meilleurs résultats, coûte 10 dollars pour l'entrée, 50 dollars pour la sortie et 1 dollar pour l'entrée en cache.

GPT-6.1 Sol se situe à un point intermédiaire avec 2 dollars pour l'entrée, 10 dollars pour la sortie et 0,10 dollar pour l'entrée en cache. GPT-6 Luna, orienté vers le travail quotidien rapide et efficace à grande échelle, a les valeurs les plus basses : 0,10 dollar pour l'entrée, 0,50 dollar pour la sortie et 0,01 dollar pour l'entrée en cache.

Performance en programmation et utilisation de l'ordinateur

Dans DeepSWE v1.1, une évaluation qui mesure des tâches complexes d'ingénierie logicielle sur des bases de code réelles, GPT-6.1 Sol égale GPT-6 Astra à environ un cinquième du coût. De plus, il surpasse le meilleur score de GPT-6 Sol de 6,4 points de pourcentage avec un effort de raisonnement et un coût associés inférieurs.

Dans le domaine de l'utilisation de l'ordinateur, les progrès sont également substantiels. Dans le jeu de données hors ligne OSWorld 2.0, qui évalue les agents dans des flux de travail exigeants d'interaction avec des applications, GPT-6.1 Sol surpasse GPT-6 Sol de sept points de pourcentage avec le maximum d'effort de raisonnement, à moins de la moitié du coût.

Avec cette même configuration, GPT-6.1 Sol reste à seulement 2,1 points de pourcentage du score d'Astra, mais à environ un septième du coût par tâche, selon les données diffusées par l'entreprise.

Travail professionnel et automatisation des flux d'entreprise

Dans GDP.pdf, une évaluation qui mesure la précision des réponses aux questions professionnelles à partir de documents PDF complexes contenant des tableaux, des graphiques, des diagrammes et des détails en petit caractères, GPT-6.1 Sol dépasse le score d'Opus 5.5 avec des modèles de secours pour moins de la moitié du coût par tâche. Il se rapproche également des performances de GPT-6 Astra à environ un cinquième de son coût.

Dans AutomationBench, qui évalue si les agents complètent correctement des flux de travail d'entreprise en plusieurs étapes, GPT-6.1 Sol devance Opus 5.5 de 2,2 points de pourcentage avec un effort de raisonnement moyen, à environ un tiers du coût. Ce même score dépasse de 4,8 points de pourcentage celui obtenu par GPT-6 Sol dans la même configuration.

Recherche scientifique et précision factuelle du modèle

Dans Terminal-Bench Science 0.1, une évaluation des flux de travail scientifiques tels que l'analyse de données, la simulation et la démonstration de théorèmes, GPT-6.1 Sol obtient plus du double du score de GPT-6 Sol avec un effort de raisonnement maximal, pour moins de la moitié du coût par tâche.

Avec l'effort au maximum, GPT-6.1 Sol coûte en moyenne 5,47 dollars par tâche, contre 23,21 dollars pour Opus 5.5 et 23,80 dollars pour Astra, ce qui représente un coût inférieur de plus de 75 % à celui de ces deux modèles.

Cependant, GPT-6 Astra conserve le score le plus élevé parmi les modèles évalués, avec 68,1 %, restant ainsi l'option recommandée pour les tâches de recherche scientifique les plus exigeantes.

En matière de précision factuelle, GPT-6.1 Sol présente également des améliorations. Avec un effort de raisonnement très élevé, son taux d'erreurs factuelles est de 4,1 %, inférieur aux 4,5 % de GPT-6 Sol et proche des 4,0 % d'Astra dans la même configuration, pour un coût par tâche environ 83 % inférieur à celui d'Astra.

Cette évaluation mesure la proportion de réponses contenant au moins une erreur factuelle dans des conversations où les utilisateurs ont précédemment signalé des erreurs d'un modèle antérieur, elle n'est donc pas représentative de l'usage habituel.

Ajustement et comportement sûr du modèle

GPT-6.1 Sol montre des améliorations substantielles par rapport à GPT-6 Sol dans les évaluations d'alignement d'OpenAI, ce qui le rapproche du comportement de GPT-6 Astra. Le modèle est plus transparent sur ses propres limites et plus fiable pour respecter l'intention de l'utilisateur et les contraintes de sécurité établies.

Dans des évaluations exigeantes, GPT-6.1 Sol affiche des taux d'échec plus bas que son prédécesseur lorsqu'il rapporte l'utilisation d'outils de recherche non fonctionnels, respecte les restrictions explicites et évite les résultats non autorisés dans les tâches exécutées avec des agents.

OpenAI a précisé qu'aucune tentative de contournement d'un réviseur de sécurité automatisé n'a été observée, un comportement cohérent avec celui enregistré dans GPT-6 Astra et GPT-6 Sol. L'entreprise a clarifié que ces évaluations testent délibérément des situations difficiles et ne mesurent pas les taux d'échec lors de l'utilisation habituelle du modèle.

Disponibilité et prix de GPT-6.1 Sol sur l'API

GPT-6.1 Sol est disponible dès aujourd'hui pour tous les utilisateurs de Plus, Pro, Business, Enterprise et Edu sur ChatGPT Work et Codex, bien qu'il ne soit pas encore accessible via Chat. Les développeurs peuvent également y accéder via l'API d'OpenAI sous le nom gpt-6.1-sol.

Ses tarifs standard sur l'API sont de 2 dollars par million de tokens d'entrée, 0,10 dollar par million de tokens d'entrée en cache et 10 dollars par million de tokens de sortie.

Avec ce lancement, OpenAI a également présenté GPT-6 Astra Ultrafast, décrit comme le modèle d'avant-garde le plus rapide au monde, offrant jusqu'à huit fois la vitesse de GPT-6 Astra, ainsi qu'une version GPT-6.1 Sol Ultrafast.

Ces deux modèles sont disponibles sur l'API et sur ChatGPT Work et Codex pour les utilisateurs du nouveau niveau Pro, qui offre les limites d'utilisation les plus élevées pour 500 dollars par mois.

« Avec GPT‑6.1 Sol Ultrafast, les développeurs peuvent obtenir une intelligence proche de celle d'Astra avec jusqu'à 8 fois la vitesse, pour environ le même coût sur l'API que celui requis auparavant par GPT‑6 Astra », a indiqué OpenAI.

Bibliothèque Mot Avec

Pour aller plus loin

Trois guides choisis en fonction du sujet de cet article.

Voir les 8 livres
Deprecated: explode(): Passing null to parameter #2 ($string) of type string is deprecated in /home/httpd/vhosts/iphone-dev.ch/mot-avec.com/index.php on line 171