Décryptage · Modèles
GPT-6.1 Sol : OpenAI rapproche son modèle économique d'Astra au cinquième du prix
OpenAI lance GPT-6.1 Sol, qui approche les performances de GPT-6 Astra en codage et usage d'ordinateur pour un cinquième du prix par tâche.

OpenAI a mis fin à l'arbitrage brutal entre puissance et coût qui structurait jusque-là sa gamme de modèles. GPT‑6.1 Sol, disponible depuis le 29 septembre 2026 pour les utilisateurs Plus, Pro, Business, Enterprise et Edu de ChatGPT ainsi que via l'API sous l'identifiant `gpt-6.1-sol`, vise une cible précise : rapprocher l'intelligence du modèle haut de gamme Astra d'un tarif cinq fois inférieur.
Des scores proches d'Astra sur le codage et l'usage d'ordinateur
Sur DeepSWE v1.1, un benchmark qui évalue la résolution de tâches d'ingénierie logicielle complexes dans des bases de code réelles, GPT‑6.1 Sol égale GPT‑6 Astra tout en dépassant le meilleur score de GPT‑6 Sol de 6,4 points, avec un effort de raisonnement et un coût inférieurs. Sur OSWorld 2.0, qui teste des agents sur des flux de travail d'usage d'ordinateur de bout en bout, le nouveau modèle dépasse GPT‑6 Sol de sept points à effort de raisonnement maximal, pour moins de la moitié du coût, et s'approche d'Astra à moins de 2,1 points d'écart pour environ un septième de son prix.
Le document professionnel et la recherche scientifique, points forts
Sur GDP.pdf, qui mesure la capacité à répondre à des questions professionnelles à partir de documents PDF complexes (tableaux, graphiques, petites lignes), GPT‑6.1 Sol dépasse Opus 5.5 avec recours à des modèles de secours, pour moins de la moitié du coût par tâche. Sur Terminal-Bench Science 0.1, qui évalue des flux de travail scientifiques incluant l'analyse de données et la simulation, le modèle plus que double le score de GPT‑6 Sol à effort maximal pour moins de la moitié du coût, revendiquant une capacité scientifique substantielle à plus de 75 % moins cher qu'Astra ou qu'Opus 5.5. OpenAI précise toutefois qu'Astra reste la référence pour les tâches de recherche les plus exigeantes, avec un score de 68,1 % sur ce même benchmark.
Un changement de logique commerciale
Jusqu'ici, la gamme GPT-6 d'OpenAI opposait deux mondes : Sol, rapide et économique mais nettement en retrait sur les tâches complexes, et Astra, la référence de capacité mais au tarif dissuasif pour un usage massif. GPT‑6.1 Sol brouille cette frontière en ciblant explicitly les usages professionnels récurrents — débogage de code, compréhension de documents, exécution de flux de travail métier à plusieurs étapes — là où les entreprises ont besoin de volume plutôt que de performance maximale ponctuelle. Le signal envoyé aux développeurs est clair : il n'est plus nécessaire de payer le prix d'Astra pour obtenir une intelligence quasi équivalente sur la majorité des tâches du quotidien, Astra restant réservé aux cas les plus exigeants, comme le confirme le score supérieur du modèle haut de gamme sur Terminal-Bench Science.
Sur le plan tarifaire, l'API facture GPT‑6.1 Sol à 2 dollars par million de jetons d'entrée standard, 0,10 dollar par million de jetons d'entrée en cache — soit 95 % moins cher que l'entrée standard et 50 % moins cher que le cache de GPT‑6 Sol — et 10 dollars par million de jetons de sortie. Cette baisse du coût du cache est significative pour les agents qui réutilisent un contexte volumineux entre deux requêtes successives, un cas d'usage de plus en plus courant à mesure que les entreprises déploient des agents autonomes de longue durée.
Facturer la factualité plutôt que la promettre
Au-delà des benchmarks de capacité, OpenAI met en avant un progrès sur la fiabilité factuelle, mesurée sur des conversations ChatGPT désidentifiées où les utilisateurs avaient précédemment signalé une erreur. À effort de raisonnement faible, GPT‑6.1 Sol réduit la part de réponses contenant au moins une erreur factuelle de 11,4 % à 7,7 %, soit une baisse d'environ 32 %. Sur l'ensemble des réglages testés, son taux d'erreur reste à moins de 1,9 point de celui de GPT‑6 Astra, pour un cinquième du coût par tâche. OpenAI précise que ces prompts, délibérément difficiles, ne représentent pas l'usage typique — où les erreurs factuelles restent plus rares — mais ils servent de test de résistance utile pour comparer les modèles entre eux.
Sécurité et déploiement
Dans l'addendum à sa fiche système publié le même jour, OpenAI indique que GPT‑6.1 Sol se montre plus transparent sur ses limites et plus fiable pour respecter les restrictions explicites et les intentions des utilisateurs lors de tâches agentiques, avec des taux d'échec inférieurs à ceux de GPT‑6 Sol sur ces critères. Aucune tentative de contournement d'un réviseur de sécurité automatisé n'a été observée, à égalité avec Astra et Sol. Le modèle n'est pas encore disponible dans l'onglet Chat de ChatGPT, et un mode Ultrafast, promettant jusqu'à huit fois plus de vitesse de génération dans Codex, doit arriver dans les prochains jours. Cette sortie s'inscrit dans la cadence resserrée imposée par OpenAI depuis le lancement des agents permanents dots, le même mois.