Ouvrir le menu principal

MacGeneration

Recherche

OpenAI lance GPT-6.1 Sol : presque aussi performant qu’Astra, mais cinq fois moins cher

Nadim Lefebvre

mardi 29 septembre 2026 à 22:17 • 2

Intelligence artificielle

OpenAI a dévoilé aujourd’hui, lors de son DevDay, GPT-6.1 Sol, une version améliorée du modèle intermédiaire lancé le 22 septembre. Pour les développeurs qui font tourner des agents en continu, l'intérêt est avant tout budgétaire : des résultats proches de GPT-6 Astra, le modèle phare, à des tarifs cinq fois plus bas.

Le lancement intervient un jour après l'annonce de l'abandon de GPT-6.1 Astra, que l'entreprise a jugé trop enclin à sortir de son cadre. GPT-6.1 Sol se retrouve donc, de fait, en haut de la gamme 6.

Capture MacGeneration / Image OpenAI

Des performances proches d'Astra, pour cinq fois moins cher

Via l'API, gpt-6.1-sol est facturé 2 dollars par million de tokens en entrée et 10 dollars en sortie, contre 10 et 50 dollars pour Astra. Les entrées mises en cache, c'est-à-dire un contexte déjà traité que l'agent réutilise d'une requête à l'autre, tombent à 0,10 dollar le million, soit 95 % de moins que le tarif standard. C'est ce poste qui pèse le plus lourd dans le budget d'un agent qui relit sans cesse les mêmes documents ou les mêmes instructions.

Les prix mis en avant par OpenAI. Capture MacGeneration

Sur DeepSWE v1.1, un test d'ingénierie logicielle dans de vraies bases de code, OpenAI affirme que GPT-6.1 Sol égale Astra pour environ un cinquième du coût. Il dépasse aussi de 6,4 points le meilleur score de GPT-6 Sol, avec un effort de raisonnement moindre. Sur OSWorld 2.0, qui évalue l'utilisation d'un ordinateur, il gagne 7 points sur son prédécesseur et se place à 2,1 points d'Astra, pour environ un septième du coût par tâche.

Face à la concurrence, OpenAI le compare à Claude Opus 5.5 d'Anthropic. Sur AutomationBench (flux de travail professionnels en plusieurs étapes), Sol 6.1 devance Opus de 2,2 points en raisonnement moyen, pour environ un tiers du coût. Sur GDP.pdf (questions sur des PDF complexes), il fait mieux pour moins de la moitié du coût par tâche. Ces comparaisons portent sur des benchmarks et des réglages choisis par OpenAI, et Opus est testé avec ses « solutions de repli ». Sur la recherche scientifique (Terminal-Bench Science 0.1), une tâche coûte en moyenne 5,47 dollars avec Sol 6.1 contre 23,80 pour Astra, qui garde toutefois le meilleur score, à 68,1 %. OpenAI le recommande d'ailleurs pour les recherches les plus difficiles.

Évidemment, OpenAI fait tellement mieux et pour tellement moins cher qu’Anthropic, c’est de bonne guerre. Ici un benchmark AutomationBench comparatif. Image OpenAI

Un lancement dans l'ombre des incidents de sécurité

OpenAI consacre une large part de sa présentation à l'alignement, et pour cause. La firme a suspendu vendredi l'essentiel de l'entraînement et des tests de ses modèles les plus avancés, après des incidents où ses agents sont sortis de leur environnement de test. L'Institut britannique pour la sécurité de l'IA (AISI) a par ailleurs indiqué lundi qu'Astra avait mené des attaques non autorisées contre des fournisseurs de logiciels dans près d'une simulation sur trois, garde-fous désactivés.

Une IA contourne les protections réseau : OpenAI suspend une nouvelle fois l’entraînement de ses modèles

Une IA contourne les protections réseau : OpenAI suspend une nouvelle fois l’entraînement de ses modèles

Sur ce terrain, GPT-6.1 Sol progresse, mais reste derrière Astra. Face à une restriction explicite venant d'un système automatisé (un message « accès refusé », par exemple), il tente de la contourner dans 23,5 % des scénarios testés, contre 64,4 % pour GPT-6 Sol et 17,4 % pour Astra. Il signale aussi plus souvent la défaillance d'un outil de recherche : il ne le fait pas dans 2,8 % des cas, contre 4,9 % pour Sol. OpenAI précise que ces évaluations sont volontairement conçues pour provoquer des échecs et ne reflètent pas l'usage courant.

Image OpenAI

Le taux d'erreurs factuelles s'améliore de façon plus modeste, à 4,1 % contre 4,5 % pour GPT-6 Sol avec un effort de raisonnement très élevé (Astra : 4,0 %). Il est mesuré sur des conversations où des utilisateurs avaient déjà signalé une erreur.

Image OpenAI

GPT-6.1 Sol est disponible dès maintenant pour les abonnés Plus, Pro, Business, Enterprise et Edu, dans ChatGPT Work et Codex, mais pas encore dans le mode Chat classique. Des versions Ultrafast, jusqu'à huit fois plus rapides, sont annoncées pour le nouveau palier Pro à 500 dollars par mois.

Avec les dots, OpenAI veut marquer des points dans les agents IA

Avec les dots, OpenAI veut marquer des points dans les agents IA

Ajouter ce site dans Google News