Imaginez un bon cabinet d’avocats. L’associé principal est brillant et facture ses honoraires en conséquence. Vous ne lui demanderiez jamais d’examiner deux cents pages de contrats fournisseurs à la recherche d’une clause d’annulation. Vous confiez cela à un collaborateur senior de confiance, quelqu’un de presque aussi perspicace et de bien moins cher.
GPT-6.1 Sol est ce collaborateur senior. Ce n’est pas le modèle le plus puissant d’OpenAI, mais il s’en approche, et c’est celui que vous pouvez vous permettre d’utiliser pour la majeure partie de votre travail hebdomadaire.
Ce qu’il est et où le trouver
OpenAI a lancé GPT-6.1 Sol le 29 septembre 2026 lors de son événement DevDay, une semaine après GPT-6 Sol. OpenAI le décrit comme une intelligence proche d’Astra pour la programmation, l’utilisation d’un ordinateur et le travail professionnel, à un cinquième du prix de son navire amiral, GPT-6 Astra.
Où l’utiliser est ce qui importe le plus pour la plupart des utilisateurs. Dans ChatGPT, GPT-6.1 Sol se trouve dans ChatGPT Work et Codex, les parties de l’application conçues pour les tâches longues, les fichiers et les agents. Il est disponible dans les abonnements Plus, Pro, Business, Enterprise et Edu. Il n’est pas encore dans le Chat régulier, et il n’est pas inclus dans le forfait gratuit. Les développeurs peuvent l’utiliser via l’API en tant que gpt-6.1-sol, et des outils de programmation comme Devin de Cognition l’ont intégré le jour de son lancement.
À quel point est-il proche du modèle phare ?
Artificial Analysis, une firme de test indépendante, a exécuté ses évaluations le jour du lancement. Son Indice d’Intelligence combine dix évaluations exigeantes, allant du travail de bureau à l’automatisation d’entreprise, en passant par le code scientifique et les connaissances factuelles. GPT-6.1 Sol a obtenu un score de 52. GPT-6 Astra a obtenu 53, et le GPT-6 Sol de la semaine dernière était à 48. Cela place GPT-6.1 Sol à la 10e place sur les 222 modèles du classement.
Regardons maintenant le prix. Artificial Analysis a calculé qu’il en coûte environ 0,72 $ pour exécuter une tâche de son indice avec GPT-6.1 Sol, contre 3,26 $ pour Astra. C’est un point de capacité en moins pour moins d’un quart du prix.
Par souci d’équité, Anthropic reste en tête de cet indice. Claude Opus 5.5 a obtenu 58 et Claude Sonnet 5.5 a obtenu 56. Mais l’obtention de ces scores coûte beaucoup plus cher : 5,98 $ et 7,60 $ par tâche.
Ses atouts lors d’une journée de travail
Les tests de lancement d’OpenAI se concentrent sur le type de travail qui remplit une semaine de bureau. Gardez à l’esprit qu’il s’agit des chiffres fournis par OpenAI.
- Lire des PDF difficiles. Sur GDP.pdf, le modèle répond à des questions sur de vrais documents issus de la finance, du droit, de la santé et de sept autres domaines, contenant des tableaux denses, des graphiques et des petits caractères. Le tableau d’OpenAI affiche 32,0 % à un effort élevé (High Effort) pour 0,35 $ par tâche. Le meilleur score de Claude Opus 5.5 est de 28,8 % à 0,83 $, et le meilleur score de GPT-6 Astra est de 32,2 % à 1,91 $. Sol talonne donc presque le modèle phare pour un cinquième du prix.
- Tâches de routine en plusieurs étapes. Sur AutomationBench, un agent complète des flux de travail complets via 47 outils professionnels, comme mettre à jour un CRM, soumettre un ticket et envoyer un e-mail de suivi. À effort moyen, GPT-6.1 Sol obtient 31,7 % pour 0,19 $ par tâche, soit 2,2 points au-dessus de Claude Opus 5.5 avec la même configuration. Lisez tout de même l’ensemble du tableau : à effort maximum, Opus 5.5 atteint 42,5 % et Astra 41,4 %, tandis que Sol plafonne à 36,1 %. Sol l’emporte sur le coût des tâches de routine ; les modèles plus chers accomplissent toujours davantage pour les tâches les plus complexes.
- Utiliser un ordinateur. Sur OSWorld 2.0, le modèle clique et tape à travers de vraies applications de bureau. OpenAI rapporte 71,4 % pour 1,27 $ par tâche, contre 73,5 % pour Astra à 9,44 $.
Moins de faits inventés, mais le risque existe toujours
OpenAI a testé l’exactitude factuelle sur des questions délibérément difficiles tirées de conversations réelles, où les utilisateurs avaient signalé l’erreur d’un modèle précédent. À faible effort, la proportion de réponses contenant une erreur factuelle a chuté de 11,4 % à 7,7 % par rapport à GPT-6 Sol, soit une réduction d’environ un tiers.
Le test de connaissances indépendant d’Artificial Analysis offre une image plus pragmatique. Lorsque GPT-6.1 Sol ne connaît pas la réponse, il l’invente toujours dans 54 % des cas. C’est mieux que les 60 % de GPT-6 Sol, mais moins bien que les 47 % de Claude Sonnet 5.5. Le conseil pratique reste inchangé : pour un nom, une date ou un chiffre peu connu, demandez-lui de faire une recherche sur le web ou de citer une source.
Un mot sur l’Astra qui n’est jamais sorti
GPT-6.1 Sol n’était pas le seul modèle prévu par OpenAI pour le DevDay. La veille, l’entreprise a annulé GPT-6.1 Astra après que des tests internes eurent révélé que le modèle ne respectait pas de manière fiable la portée et les autorisations de ses tâches. GPT-6.1 Sol est un modèle distinct doté de son propre rapport de sécurité. Dans l’un des tests d’OpenAI, l’outil de recherche d’un agent est délibérément cassé, et le modèle doit le signaler plutôt que de deviner. GPT-6.1 Sol a omis de signaler le problème dans 2,1 % des cas, contre 4,9 % pour GPT-6 Sol et 1,5 % pour GPT-6 Astra. Il s’agit d’une réelle amélioration, même si ce n’est pas une garantie dans toutes les situations.
Les vraies limites
Il est derrière un paywall et dans un autre onglet. Pour un modèle destiné au travail quotidien, la plus grande limite est l’accès : pas de plan gratuit et pas de Chat régulier, seulement ChatGPT Work et Codex sur des plans payants.
Il lit des images, mais n’en dessine pas. GPT-6.1 Sol prend du texte et des images en entrée et renvoie du texte. Il ne génère pas lui-même d’images, d’audio ou de vidéo.
Claude reste devant sur l’indice global. Si vous voulez les scores indépendants les plus élevés, peu importe le coût, Claude Opus 5.5 et Sonnet 5.5 sont en tête. L’avantage de GPT-6.1 Sol est de faire presque aussi bien pour beaucoup moins cher.
Qui devrait l’utiliser
| Si votre journée ressemble à… | Choisissez | Pourquoi |
|---|---|---|
| Contrats, rapports et PDF dans ChatGPT Work | GPT-6.1 Sol | Un travail sur les documents proche d’Astra pour une fraction de son coût |
| Les travaux de recherche et d’utilisation d’un ordinateur les plus ardus | GPT-6 Astra | Le modèle le plus puissant d’OpenAI, avec un point ou deux d’avance |
| Un jugement à enjeux importants, des faits peu connus | Claude Opus 5.5 | En tête de l’indice indépendant général |
| Travail quotidien avec un forfait gratuit | Claude Sonnet 5.5 ou Gemini | Modèles robustes sans abonnement |
Le verdict au quotidien
GPT-6.1 Sol ne vous impressionnera pas en étant le modèle le plus intelligent du classement. Il vous impressionnera en étant presque aussi intelligent que le modèle phare d’OpenAI pour une fraction du prix. Si vous payez déjà pour ChatGPT et passez votre journée dans l’onglet Work, en faire votre modèle par défaut est un choix évident. Vérifiez tout de même les faits peu connus, et ne passez sur Astra que lorsqu’une tâche nécessite vraiment ces quelques points supplémentaires.