Si GPT-5.5 était un très bon collègue, GPT-5.6 est un petit service avec aiguilleur. Sol fait la réflexion difficile et chère. Terra fait le travail normal. Luna vide la file. La grande nouveauté n’est pas seulement ces trois noms, mais l’endroit où OpenAI les a installés.
ChatGPT Work est l’agent pour les tâches trop grandes pour une petite bulle de chat. Donnez-lui un projet, des sources et des apps connectées : il peut réunir le contexte, découper le travail, continuer en arrière-plan et produire des documents, slides, tableurs, Sites ou apps web modifiables. Les tâches planifiées maintiennent le travail répétitif en mouvement; vous restez la personne qui valide et explique le tableur lundi.
Sur bureau, l’ancienne app Codex fusionne avec la nouvelle app ChatGPT. Codex reste l’agent de code, à côté de Chat et Work, avec édition de diff en ligne, revue de pull request, Computer Use plus rapide et projets multi-repositories. Un navigateur intégré et Computer Use peuvent aussi agir dans vos apps locales avec votre autorisation. OpenAI relie donc chat, travail, code et actions de bureau dans une même surface.
Choisir le bon outil, pas une religion
| Tâche | Choisir | Pourquoi |
|---|---|---|
| Enquête complexe, codebase sérieuse, recherche à plusieurs volets | Sol | Capacité maximale de la famille et meilleurs résultats de code agentique |
| Analyse, rédaction, travail produit courant, agents multi-étapes habituels | Terra | Niveau compétitif avec GPT-5.5 à la moitié du prix API de Sol |
| Classification, extraction, rédaction et automatisation de routine en volume | Luna | Le niveau GPT-5.6 le plus rapide et le moins cher |
| Grande mission parallélisable | Sol + ultra | Plusieurs agents travaillent en parallèle ; à n’utiliser que si l’effort le justifie |
La raison pour laquelle ce routage compte est l’efficacité. OpenAI rapporte pour Sol 53,6% à Agents’ Last Exam, 80 à l’Artificial Analysis Coding Agent Index avec raisonnement max, et 62,6% à OSWorld 2.0. Ce sont des chiffres de lancement impressionnants, et l’entreprise rapporte également des temps, des tokens ou un coût estimé nettement inférieurs à ceux de plusieurs concurrents sur certains tests. Ce ne sont pas des haricots magiques : la configuration du benchmark, le niveau d’effort, les outils et la tâche elle-même font toute la différence.
Le changement majeur d’ergonomie réside dans la disponibilité : GPT-5.6 est lancé sur ChatGPT, Codex et l’API. Mais la famille à trois niveaux n’est pas un buffet au menu identique. Les utilisateurs du chat sur Plus et au-delà peuvent utiliser Sol avec un niveau d’effort moyen ou élevé ; Work et Codex exposent des choix différents selon l’abonnement ; ultra est plus restreint. Commencez par vérifier les contrôles de modèle et d’effort réellement visibles sur votre compte avant d’acheter un forfait pour une fonctionnalité pas encore déployée chez vous.
Le compromis honnête
Plus d’autonomie signifie plus de responsabilité. Une longue tâche Work peut consommer bien plus de crédit qu’une simple réponse de chat. Les applications connectées et Computer Use sont utiles précisément parce qu’ils accèdent au contexte réel de l’entreprise, ce qui rend les autorisations et les points de validation non négociables. De plus, les garde-fous plus stricts de Sol peuvent ralentir ou complexifier un travail de sécurité pourtant légitime.
Ainsi, la bonne habitude n’est pas « toujours Sol », mais Sol pour la montagne, Terra pour le trajet quotidien, Luna pour le tapis roulant — avec ChatGPT Work comme bureau de projet qui coordonne les trois sans qu’ils ne se marchent sur les pieds.