Classé #2 Écosystème du quotidien — Les assistants IA leaders
OpenAI

GPT-5.6

GPT-5.6 n'est pas un chatbot unique qui parle plus fort. C'est une équipe de trois modèles dans le ChatGPT élargi : Sol pour les travaux qui justifient le cerveau coûteux, Terra pour le quotidien, Luna pour le volume. ChatGPT Work et l'app de bureau unifiée transforment cette équipe en véritable collègue numérique.

Mis à jour 10 juillet 2026 AgenticChatGPT WorkSol / Terra / Luna
9.9sur 10
Site officiel
Idéal pour

GPT-5.6 n'est pas un chatbot unique qui parle plus fort. C'est une équipe de trois modèles dans le ChatGPT élargi : Sol pour les travaux qui justifient le cerveau coûteux, Terra pour le quotidien, Luna pour le volume. ChatGPT Work et l'app de bureau unifiée transforment cette équipe en véritable collègue numérique.

Pourquoi ça Gagne

Disponibilité générale dans ChatGPT, Codex et l'API. Sol porte l'ambition d'OpenAI pour les agents de code et l'usage de l'ordinateur; Terra propose un travail quotidien compétitif avec GPT-5.5 pour la moitié du prix par token de Sol; Luna est le niveau rapide pour le volume. ChatGPT Work relie apps, fichiers, navigateur et bureau, tandis qu'Ultra ajoute des agents parallèles aux tâches difficiles.

À surveiller

La famille est largement disponible, mais les réglages utiles ne sont pas identiques selon les forfaits : Sol, max et ultra ont des règles d'accès différentes dans ChatGPT Work et Codex. Les longues tâches Work consomment davantage de quota, les apps connectées demandent des permissions précises et les protections cyber de Sol peuvent ralentir des cas légitimes. Les benchmarks montrent une avance en code agentique, pas un balayage de tous les tests de programmation.

01

Ce que c'est réellement

Si GPT-5.5 était un très bon collègue, GPT-5.6 est un petit service avec aiguilleur. Sol fait la réflexion difficile et chère. Terra fait le travail normal. Luna vide la file. La grande nouveauté n’est pas seulement ces trois noms, mais l’endroit où OpenAI les a installés.

ChatGPT Work est l’agent pour les tâches trop grandes pour une petite bulle de chat. Donnez-lui un projet, des sources et des apps connectées : il peut réunir le contexte, découper le travail, continuer en arrière-plan et produire des documents, slides, tableurs, Sites ou apps web modifiables. Les tâches planifiées maintiennent le travail répétitif en mouvement; vous restez la personne qui valide et explique le tableur lundi.

Sur bureau, l’ancienne app Codex fusionne avec la nouvelle app ChatGPT. Codex reste l’agent de code, à côté de Chat et Work, avec édition de diff en ligne, revue de pull request, Computer Use plus rapide et projets multi-repositories. Un navigateur intégré et Computer Use peuvent aussi agir dans vos apps locales avec votre autorisation. OpenAI relie donc chat, travail, code et actions de bureau dans une même surface.

Choisir le bon outil, pas une religion

Tâche Choisir Pourquoi
Enquête complexe, codebase sérieuse, recherche à plusieurs volets Sol Capacité maximale de la famille et meilleurs résultats de code agentique
Analyse, rédaction, travail produit courant, agents multi-étapes habituels Terra Niveau compétitif avec GPT-5.5 à la moitié du prix API de Sol
Classification, extraction, rédaction et automatisation de routine en volume Luna Le niveau GPT-5.6 le plus rapide et le moins cher
Grande mission parallélisable Sol + ultra Plusieurs agents travaillent en parallèle ; à n’utiliser que si l’effort le justifie

La raison pour laquelle ce routage compte est l’efficacité. OpenAI rapporte pour Sol 53,6% à Agents’ Last Exam, 80 à l’Artificial Analysis Coding Agent Index avec raisonnement max, et 62,6% à OSWorld 2.0. Ce sont des chiffres de lancement impressionnants, et l’entreprise rapporte également des temps, des tokens ou un coût estimé nettement inférieurs à ceux de plusieurs concurrents sur certains tests. Ce ne sont pas des haricots magiques : la configuration du benchmark, le niveau d’effort, les outils et la tâche elle-même font toute la différence.

Le changement majeur d’ergonomie réside dans la disponibilité : GPT-5.6 est lancé sur ChatGPT, Codex et l’API. Mais la famille à trois niveaux n’est pas un buffet au menu identique. Les utilisateurs du chat sur Plus et au-delà peuvent utiliser Sol avec un niveau d’effort moyen ou élevé ; Work et Codex exposent des choix différents selon l’abonnement ; ultra est plus restreint. Commencez par vérifier les contrôles de modèle et d’effort réellement visibles sur votre compte avant d’acheter un forfait pour une fonctionnalité pas encore déployée chez vous.

Le compromis honnête

Plus d’autonomie signifie plus de responsabilité. Une longue tâche Work peut consommer bien plus de crédit qu’une simple réponse de chat. Les applications connectées et Computer Use sont utiles précisément parce qu’ils accèdent au contexte réel de l’entreprise, ce qui rend les autorisations et les points de validation non négociables. De plus, les garde-fous plus stricts de Sol peuvent ralentir ou complexifier un travail de sécurité pourtant légitime.

Ainsi, la bonne habitude n’est pas « toujours Sol », mais Sol pour la montagne, Terra pour le trajet quotidien, Luna pour le tapis roulant — avec ChatGPT Work comme bureau de projet qui coordonne les trois sans qu’ils ne se marchent sur les pieds.

02

Forces et limites honnêtes

Points Forts

  • ChatGPT Work est le véritable changement de produit : il peut découper un projet ambitieux, avancer pendant des heures et transformer le contexte d’apps connectées en documents, présentations, tableurs, Sites et applications web modifiables. Ce n’est pas seulement un nouveau sélecteur de modèle.
  • Une équipe de trois cerveaux logique : Sol est le fleuron pour le travail difficile; Terra est le modèle quotidien moins cher et compétitif avec GPT-5.5; Luna est le niveau le plus rapide et abordable. Les prix API sont clairs : Sol $5/$30, Terra $2,50/$15, Luna $1/$6 par million de tokens entrée/sortie.
  • Davantage de puissance seulement quand elle paie : max laisse plus de temps à GPT-5.6 pour raisonner, vérifier et réviser. ultra coordonne plusieurs agents en parallèle—quatre par défaut—afin qu’une grosse mission avance sur plusieurs fronts.
  • L’usage de l’ordinateur et la qualité des livrables comptent enfin : Sol atteint 62,6% sur OSWorld 2.0 dans la table de lancement d’OpenAI; l’entreprise indique aussi une meilleure fidélité aux modèles de documents, tableurs et présentations.
  • Moins de colle d’orchestration pour les développeurs : dans la Responses API, Programmatic Tool Calling permet à GPT-5.6 d’écrire et d’exécuter de petits programmes en mémoire pour coordonner les outils et filtrer les résultats intermédiaires, avec moins d’allers-retours au modèle.

Limites Honnêtes

  • Disponibilité large, capacités échelonnées : Sol dans Chat est réservé aux utilisateurs Plus, Pro, Business et Enterprise avec un effort moyen ou supérieur. Free et Go obtiennent Terra dans ChatGPT Work et Codex. Ultra est limité à Pro et Enterprise dans Work, et à Plus et supérieur dans Codex.
  • Le travail long consomme un vrai quota : ChatGPT Work suit la même structure d’usage que Codex. Une tâche qui recherche, navigue, révise des fichiers et attend des validations peut consommer une part notable du quota agentique inclus.
  • Sol est volontairement plus prudent dans les domaines sensibles : OpenAI dit que ses protections cyber bloquent davantage d’activité potentiellement nuisible que les anciens modèles. Le travail défensif de sécurité, systèmes ou proche de la biologie peut donc rencontrer davantage de contrôles ou de refus.
  • Un graphique n’est pas une couronne universelle : Sol mène plusieurs évaluations agentiques et de code, mais Claude Fable 5 conserve le meilleur résultat SWE-Bench Pro publié dans ce leaderboard. Adaptez le modèle à votre tâche réelle.
  • Le travail connecté demande une supervision adulte : ChatGPT Work peut toucher du contexte précieux dans des plugins, onglets, fichiers locaux et apps de bureau. Donnez des permissions limitées et vérifiez le résultat final.
03

Aperçu des Benchmarks

Agents' Last Exam — Sol 53,6%

OpenAI annonce un nouveau maximum sur cette évaluation de flux professionnels longs couvrant 55 domaines. Ce sont des résultats de lancement, pas un substitut à vos propres essais.

Artificial Analysis Coding Agent Index — Sol 80

Sol avec raisonnement max mène la comparaison de lancement d'OpenAI sur cet indice indépendant d'agents de code, avec 2,8 points d'avance sur Claude Fable 5.

OSWorld 2.0 — Sol 62,6%

Résultat d'usage de l'ordinateur d'OpenAI : un bon signal pour le bureau et le web, pas la garantie qu'un workflow d'apps tourne sans supervision.

Échelle API — $5/$30 · $2,50/$15 · $1/$6

Prix officiels entrée/sortie par 1M de tokens pour Sol, Terra et Luna. Les lectures de cache reçoivent 90% de remise; le coût final dépend toujours du routage et du nombre d'agents.

04

Le Verdict

GPT-5.6 passe au #2 quotidien : Opus 5 offre au lancement un meilleur mélange d’intelligence indépendante, travail professionnel, ordinateur et prix, tandis que ChatGPT reste le système de travail le plus large. Work, plugins, navigateur, Computer Use, Sites et Codex de bureau portent Sol de la recherche au livrable et au code. Choisissez GPT-5.6 pour une plateforme intégrée ; Opus 5 pour le jugement par dollar.

05

Foire aux questions