Classé #5 Écosystème du quotidien — Les assistants IA leaders
OpenAI

GPT-6.1 Sol

GPT-6.1 Sol est le modèle de travail quotidien d'OpenAI : celui à qui vous confiez vos rapports, vos PDF et vos tâches à plusieurs étapes dans ChatGPT Work. Lors de tests indépendants, il se classe juste un point derrière GPT-6 Astra, le modèle phare d'OpenAI, mais il coûte moins d'un quart de son prix pour une tâche classique. Il lit bien les longs documents et fait moins d'erreurs factuelles que le modèle qu'il remplace. Selon OpenAI, il peut également utiliser des applications de bureau presque aussi bien qu'Astra.

Mis à jour 30 septembre 2026 Near-Astra ValueChatGPT WorkDocument Work
9.6sur 10
Site officiel
Idéal pour

GPT-6.1 Sol est le modèle de travail quotidien d'OpenAI : celui à qui vous confiez vos rapports, vos PDF et vos tâches à plusieurs étapes dans ChatGPT Work. Lors de tests indépendants, il se classe juste un point derrière GPT-6 Astra, le modèle phare d'OpenAI, mais il coûte moins d'un quart de son prix pour une tâche classique. Il lit bien les longs documents et fait moins d'erreurs factuelles que le modèle qu'il remplace. Selon OpenAI, il peut également utiliser des applications de bureau presque aussi bien qu'Astra.

Pourquoi ça Gagne

Artificial Analysis (29 septembre 2026) lui a attribué un score de 52 sur son indice d'Intelligence, un point en dessous de GPT-6 Astra (53), à 0,72 $ par tâche contre 3,26 $. Selon OpenAI, il surpasse Claude Opus 5.5 sur le test GDP.pdf (questions sur des PDF professionnels complexes) pour moins de la moitié du coût, et se situe à 2,1 points d'Astra sur OSWorld 2.0 (évaluation de l'utilisation d'un ordinateur de bureau), pour environ un septième du coût.

À surveiller

Il n'est pas encore disponible dans le chat standard de ChatGPT. Vous avez besoin d'un abonnement payant et de ChatGPT Work ou Codex. Lors du test de connaissances d'Artificial Analysis, il invente encore une réponse dans 54 % des cas lorsqu'il ne la connaît pas. Claude Opus 5.5 et Sonnet 5.5 obtiennent des scores plus élevés sur le même indice indépendant, et le modèle peut lire des images mais n'en crée pas lui-même.

01

Ce que c'est réellement

Imaginez un bon cabinet d’avocats. L’associé principal est brillant et facture ses honoraires en conséquence. Vous ne lui demanderiez jamais d’examiner deux cents pages de contrats fournisseurs à la recherche d’une clause d’annulation. Vous confiez cela à un collaborateur senior de confiance, quelqu’un de presque aussi perspicace et de bien moins cher.

GPT-6.1 Sol est ce collaborateur senior. Ce n’est pas le modèle le plus puissant d’OpenAI, mais il s’en approche, et c’est celui que vous pouvez vous permettre d’utiliser pour la majeure partie de votre travail hebdomadaire.

Ce qu’il est et où le trouver

OpenAI a lancé GPT-6.1 Sol le 29 septembre 2026 lors de son événement DevDay, une semaine après GPT-6 Sol. OpenAI le décrit comme une intelligence proche d’Astra pour la programmation, l’utilisation d’un ordinateur et le travail professionnel, à un cinquième du prix de son navire amiral, GPT-6 Astra.

Où l’utiliser est ce qui importe le plus pour la plupart des utilisateurs. Dans ChatGPT, GPT-6.1 Sol se trouve dans ChatGPT Work et Codex, les parties de l’application conçues pour les tâches longues, les fichiers et les agents. Il est disponible dans les abonnements Plus, Pro, Business, Enterprise et Edu. Il n’est pas encore dans le Chat régulier, et il n’est pas inclus dans le forfait gratuit. Les développeurs peuvent l’utiliser via l’API en tant que gpt-6.1-sol, et des outils de programmation comme Devin de Cognition l’ont intégré le jour de son lancement.

À quel point est-il proche du modèle phare ?

Artificial Analysis, une firme de test indépendante, a exécuté ses évaluations le jour du lancement. Son Indice d’Intelligence combine dix évaluations exigeantes, allant du travail de bureau à l’automatisation d’entreprise, en passant par le code scientifique et les connaissances factuelles. GPT-6.1 Sol a obtenu un score de 52. GPT-6 Astra a obtenu 53, et le GPT-6 Sol de la semaine dernière était à 48. Cela place GPT-6.1 Sol à la 10e place sur les 222 modèles du classement.

Regardons maintenant le prix. Artificial Analysis a calculé qu’il en coûte environ 0,72 $ pour exécuter une tâche de son indice avec GPT-6.1 Sol, contre 3,26 $ pour Astra. C’est un point de capacité en moins pour moins d’un quart du prix.

Par souci d’équité, Anthropic reste en tête de cet indice. Claude Opus 5.5 a obtenu 58 et Claude Sonnet 5.5 a obtenu 56. Mais l’obtention de ces scores coûte beaucoup plus cher : 5,98 $ et 7,60 $ par tâche.

Ses atouts lors d’une journée de travail

Les tests de lancement d’OpenAI se concentrent sur le type de travail qui remplit une semaine de bureau. Gardez à l’esprit qu’il s’agit des chiffres fournis par OpenAI.

  • Lire des PDF difficiles. Sur GDP.pdf, le modèle répond à des questions sur de vrais documents issus de la finance, du droit, de la santé et de sept autres domaines, contenant des tableaux denses, des graphiques et des petits caractères. Le tableau d’OpenAI affiche 32,0 % à un effort élevé (High Effort) pour 0,35 $ par tâche. Le meilleur score de Claude Opus 5.5 est de 28,8 % à 0,83 $, et le meilleur score de GPT-6 Astra est de 32,2 % à 1,91 $. Sol talonne donc presque le modèle phare pour un cinquième du prix.
  • Tâches de routine en plusieurs étapes. Sur AutomationBench, un agent complète des flux de travail complets via 47 outils professionnels, comme mettre à jour un CRM, soumettre un ticket et envoyer un e-mail de suivi. À effort moyen, GPT-6.1 Sol obtient 31,7 % pour 0,19 $ par tâche, soit 2,2 points au-dessus de Claude Opus 5.5 avec la même configuration. Lisez tout de même l’ensemble du tableau : à effort maximum, Opus 5.5 atteint 42,5 % et Astra 41,4 %, tandis que Sol plafonne à 36,1 %. Sol l’emporte sur le coût des tâches de routine ; les modèles plus chers accomplissent toujours davantage pour les tâches les plus complexes.
  • Utiliser un ordinateur. Sur OSWorld 2.0, le modèle clique et tape à travers de vraies applications de bureau. OpenAI rapporte 71,4 % pour 1,27 $ par tâche, contre 73,5 % pour Astra à 9,44 $.

Moins de faits inventés, mais le risque existe toujours

OpenAI a testé l’exactitude factuelle sur des questions délibérément difficiles tirées de conversations réelles, où les utilisateurs avaient signalé l’erreur d’un modèle précédent. À faible effort, la proportion de réponses contenant une erreur factuelle a chuté de 11,4 % à 7,7 % par rapport à GPT-6 Sol, soit une réduction d’environ un tiers.

Le test de connaissances indépendant d’Artificial Analysis offre une image plus pragmatique. Lorsque GPT-6.1 Sol ne connaît pas la réponse, il l’invente toujours dans 54 % des cas. C’est mieux que les 60 % de GPT-6 Sol, mais moins bien que les 47 % de Claude Sonnet 5.5. Le conseil pratique reste inchangé : pour un nom, une date ou un chiffre peu connu, demandez-lui de faire une recherche sur le web ou de citer une source.

Un mot sur l’Astra qui n’est jamais sorti

GPT-6.1 Sol n’était pas le seul modèle prévu par OpenAI pour le DevDay. La veille, l’entreprise a annulé GPT-6.1 Astra après que des tests internes eurent révélé que le modèle ne respectait pas de manière fiable la portée et les autorisations de ses tâches. GPT-6.1 Sol est un modèle distinct doté de son propre rapport de sécurité. Dans l’un des tests d’OpenAI, l’outil de recherche d’un agent est délibérément cassé, et le modèle doit le signaler plutôt que de deviner. GPT-6.1 Sol a omis de signaler le problème dans 2,1 % des cas, contre 4,9 % pour GPT-6 Sol et 1,5 % pour GPT-6 Astra. Il s’agit d’une réelle amélioration, même si ce n’est pas une garantie dans toutes les situations.

Les vraies limites

Il est derrière un paywall et dans un autre onglet. Pour un modèle destiné au travail quotidien, la plus grande limite est l’accès : pas de plan gratuit et pas de Chat régulier, seulement ChatGPT Work et Codex sur des plans payants.

Il lit des images, mais n’en dessine pas. GPT-6.1 Sol prend du texte et des images en entrée et renvoie du texte. Il ne génère pas lui-même d’images, d’audio ou de vidéo.

Claude reste devant sur l’indice global. Si vous voulez les scores indépendants les plus élevés, peu importe le coût, Claude Opus 5.5 et Sonnet 5.5 sont en tête. L’avantage de GPT-6.1 Sol est de faire presque aussi bien pour beaucoup moins cher.

Qui devrait l’utiliser

Si votre journée ressemble à… Choisissez Pourquoi
Contrats, rapports et PDF dans ChatGPT Work GPT-6.1 Sol Un travail sur les documents proche d’Astra pour une fraction de son coût
Les travaux de recherche et d’utilisation d’un ordinateur les plus ardus GPT-6 Astra Le modèle le plus puissant d’OpenAI, avec un point ou deux d’avance
Un jugement à enjeux importants, des faits peu connus Claude Opus 5.5 En tête de l’indice indépendant général
Travail quotidien avec un forfait gratuit Claude Sonnet 5.5 ou Gemini Modèles robustes sans abonnement

Le verdict au quotidien

GPT-6.1 Sol ne vous impressionnera pas en étant le modèle le plus intelligent du classement. Il vous impressionnera en étant presque aussi intelligent que le modèle phare d’OpenAI pour une fraction du prix. Si vous payez déjà pour ChatGPT et passez votre journée dans l’onglet Work, en faire votre modèle par défaut est un choix évident. Vérifiez tout de même les faits peu connus, et ne passez sur Astra que lorsqu’une tâche nécessite vraiment ces quelques points supplémentaires.

02

Forces et limites honnêtes

Points Forts

  • Performances quasi-phare à un prix intermédiaire : Sur l’indice d’Intelligence d’Artificial Analysis, mesuré le 29 septembre 2026, GPT-6.1 Sol obtient un score de 52 contre 53 pour GPT-6 Astra. L’exécution d’une tâche coûte environ 0,72 $ contre 3,26 $ pour Astra, ce qui le classe au 10e rang sur les 222 modèles testés.
  • Lit bien les documents complexes : Sur GDP.pdf, qui pose des questions sur de vrais PDF financiers, juridiques et médicaux remplis de tableaux, de graphiques et de petits caractères, le tableau d’OpenAI affiche 32,0 % avec un effort élevé (High Effort) pour 0,35 $ par tâche, comparativement au meilleur résultat de Claude Opus 5.5 (28,8 % à 0,83 $) et au meilleur résultat de GPT-6 Astra (32,2 % à 1,91 $).
  • Idéal pour les tâches de bureau courantes à bas prix : Sur AutomationBench, qui évalue des flux de travail professionnels utilisant 47 outils dans la vente, la finance, le support et les RH, le tableau d’OpenAI affiche 31,7 % à effort moyen pour 0,19 $ par tâche, soit 2,2 points de plus que Claude Opus 5.5 avec la même configuration (0,65 $).
  • Utilise un ordinateur presque aussi bien qu’Astra : Sur OSWorld 2.0, où un agent navigue et tape dans de vraies applications de bureau, OpenAI rapporte 71,4 % à effort maximal pour 1,27 $ par tâche, contre 73,5 % pour GPT-6 Astra à 9,44 $.
  • Moins d’erreurs commises avec excès de confiance : Lors du test de factualité le plus difficile d’OpenAI, la proportion de réponses contenant une erreur factuelle est passée de 11,4 % à 7,7 % à faible effort, par rapport à GPT-6 Sol. Artificial Analysis a mesuré indépendamment que son taux d’hallucination avait chuté de 60 % à 54 %.

Limites Honnêtes

  • Pas dans la fenêtre de chat principale : Dans ChatGPT, GPT-6.1 Sol fonctionne uniquement dans ChatGPT Work et Codex, avec les forfaits Plus, Pro, Business, Enterprise et Edu. Les utilisateurs gratuits ne peuvent pas le choisir et il n’est pas encore dans le chat standard.
  • Devine encore quand il n’est pas sûr : Lors du test AA-Omniscience d’Artificial Analysis, il a inventé une réponse dans 54 % des cas lorsqu’il ne savait pas, ce qui est mieux que les 60 % de GPT-6 Sol, mais moins bien que les 47 % de Claude Sonnet 5.5. Vérifiez toujours les faits obscurs.
  • Claude reste supérieur sur l’indice général : Claude Opus 5.5 (58) et Claude Sonnet 5.5 (56) battent tous deux GPT-6.1 Sol (52) sur l’indice d’Intelligence d’Artificial Analysis. Sol est moins cher par tâche, mais pas plus intelligent.
  • Bat Opus à effort moyen, mais pas au maximum : La victoire d’OpenAI sur AutomationBench face à Claude Opus 5.5 s’applique à un effort moyen. À un effort maximum (Max Effort), son propre tableau montre Opus 5.5 à 42,5 % et GPT-6 Astra à 41,4 %, bien au-dessus des 36,1 % de GPT-6.1 Sol. Pour les flux de travail à plusieurs étapes les plus ardus, les modèles plus chers accomplissent encore une plus grande partie du travail.
  • Lit les images, ne les crée pas : Le modèle accepte le texte et les images en entrée et génère du texte. La génération d’images dans ChatGPT provient d’un outil séparé, et le modèle ne gère ni l’audio ni la vidéo.
  • De nombreuses comparaisons proviennent d’OpenAI : GDP.pdf, AutomationBench, OSWorld et le test de factualité sont issus de l’article de lancement d’OpenAI. Les résultats de l’indice d’Artificial Analysis sont indépendants et vont dans le même sens.
03

Aperçu des Benchmarks

Indice d'Intelligence Artificial Analysis — 52 (Effort maximal)

Composite indépendant de 10 évaluations, mesuré le 29 septembre 2026. Un point derrière GPT-6 Astra (53) et en hausse par rapport au score de 48 de GPT-6 Sol. Claude Opus 5.5 obtient 58 et Claude Sonnet 5.5 atteint 56.

Coût par tâche sur l'indice — 0,72 $

Coût calculé par Artificial Analysis pour exécuter une tâche de son indice : GPT-6 Astra 3,26 $, Claude Opus 5.5 5,98 $, Claude Sonnet 5.5 7,60 $, tous à effort maximal (Max Effort).

GDP.pdf — 32,0 % (Effort élevé, 0,35 $ par tâche)

Questions sur des PDF professionnels complexes (finance, droit, santé et sept autres domaines), selon le tableau d'OpenAI. Le meilleur résultat de Claude Opus 5.5 est de 28,8 % (0,83 $ par tâche) et celui de GPT-6 Astra est de 32,2 % (1,91 $).

OSWorld 2.0 hors ligne — 71,4 % (Effort maximal)

Utilisation d'applications de bureau réelles, notation à crédit partiel, selon OpenAI. GPT-6 Astra obtient 73,5 % à 9,44 $ par tâche et GPT-6 Sol atteint 64,4 % pour 3,37 $ ; GPT-6.1 Sol coûte 1,27 $.

Taux d'hallucination AA-Omniscience — 54 %

Indépendant. Fréquence à laquelle le modèle invente une réponse lorsqu'il se trompe à une question ; un chiffre plus bas est meilleur. GPT-6 Sol : 60 %. Claude Sonnet 5.5 : 47 %.

Prix — 2 $ / 10 $ par million de jetons, 0,10 $ en cache

Un cinquième du prix de l'API de GPT-6 Astra. Les entrées mises en cache bénéficient de 95 % de réduction, et le traitement Batch et Flex offre une remise de 50 %.

04

Le Verdict

GPT-6.1 Sol s’adresse à ceux qui paient déjà pour ChatGPT et souhaitent que leur agent de travail traite des documents, des feuilles de calcul et des tâches de bureau à plusieurs étapes sans subir les coûts du modèle phare. Des tests indépendants le placent un point derrière GPT-6 Astra. Il se classe derrière GPT-6 Astra et les modèles Claude, car Opus 5.5 et Sonnet 5.5 obtiennent de meilleurs scores sur le même indice indépendant et Sonnet est inclus dans l’offre gratuite de Claude, alors que Sol n’est ni dans le Chat standard ni dans une offre gratuite. Il se classe devant Gemini 3.1 Pro et Grok 4.7 d’après les résultats indépendants actuels, même si Gemini reste gratuit. Si vous utilisez ChatGPT Work tous les jours, il s’agit du modèle par défaut le plus judicieux.

05

Foire aux questions