Classé #2 Écosystème du quotidien — Les assistants IA leaders
OpenAI

GPT-6 Astra

GPT-6 Astra est le nouveau vaisseau amiral d'OpenAI pour la part du travail qui se passe hors de la fenêtre de chat. Il pilote le navigateur, clique dans les applications de bureau, mène des flux de travail professionnels en plusieurs étapes jusqu'au bout, et vérifie ses propres faits environ deux fois mieux que GPT-5.6 Sol — dans le même écosystème ChatGPT, Codex et API que vous connaissez déjà.

Mis à jour 5 septembre 2026 AgenticChatGPT WorkComputer Use
9.8sur 10
Site officiel
Idéal pour

GPT-6 Astra est le nouveau vaisseau amiral d'OpenAI pour la part du travail qui se passe hors de la fenêtre de chat. Il pilote le navigateur, clique dans les applications de bureau, mène des flux de travail professionnels en plusieurs étapes jusqu'au bout, et vérifie ses propres faits environ deux fois mieux que GPT-5.6 Sol — dans le même écosystème ChatGPT, Codex et API que vous connaissez déjà.

Pourquoi ça Gagne

Les tests indépendants d'Artificial Analysis donnent à Astra 61,2 sur son Intelligence Index — une égalité statistique avec Sol — tandis que les tableaux de lancement affichent 72,6% sur OSWorld 2.0 (usage de l'ordinateur) en environ la moitié du temps de Sol, 59,3% sur Agents' Last Exam, 62,7% sur le harnais standard d'ARC-AGI-3 (99,9% uniquement avec l'adaptateur d'OpenAI), 64,6% sur Terminal-Bench Science et des hallucinations environ réduites de moitié à précision supérieure. Disponible dès le premier jour dans ChatGPT, Codex, l'API, Azure et Bedrock.

À surveiller

C'est une mise à niveau de spécialiste, pas un nouveau record de QI. Les scores indépendants de travail de connaissance (GDPval-AA) ont reculé sous Sol, Claude Fable 5.1 reste en tête des composites d'intelligence générale, et le tarif API est 2,5 fois celui de Sol à 10/50 $ par million de tokens avec une lecture de cache à 1 $. Les réponses laconiques d'Astra ont perdu du terrain sur les épreuves de droit, de finance et de présentation, et le lancement du premier jour a laissé des abonnés payants dehors.

01

Ce que c'est réellement

Chaque lancement de vaisseau amiral arrive avec la même affiche : le modèle le plus intelligent jamais construit. Celle de GPT-6 Astra est différente, et plus utile. Elle dit : cette fois, la machine prend directement les commandes du clavier. Astra est le nouveau fer de lance d’OpenAI pour le travail qui se passe hors du chat — piloter un navigateur, cliquer dans des applications de bureau, porter un flux professionnel en plusieurs étapes jusqu’au bout — et il vérifie bien mieux ses propres faits en le faisant.

L’histoire mesurée tient le discours. Sur OSWorld 2.0, le test d’opérations de bureau, Astra marque 72,6% et finit en environ 40 minutes là où GPT-5.6 Sol en prenait environ 75 ; Opus 5 est à 70,2%. Sur Agents’ Last Exam, une évaluation de flux professionnels de long terme sur 55 domaines, il atteint 59,3%. Et le suivi de factualité d’Artificial Analysis montre un taux d’hallucinations environ réduit de moitié par rapport à Sol, à précision supérieure. Moins d’erreurs assurées, du travail fini plus vite : c’est la mise à niveau qu’on sent dès la première semaine.

Voilà l’astérisque honnête. Sur l’Intelligence Index d’Artificial Analysis, Astra marque 61,2 — une égalité statistique avec les 60,9 de Sol — tandis que Claude Fable 5.1 mène à 65,7. Sur le travail de connaissance GDPval-AA v2, les ~1629 d’Astra sont derrière Opus 5 (1824) et Fable 5.1 (1853) — et derrière Sol. Si votre journée, c’est due diligence, synthèses et jugement, le nouvel amiral n’est pas automatiquement le meilleur outil ; c’est un outil différent. Et le tarif API — 10/50 $ par million de tokens, 2,5 fois Sol, avec des lectures de cache à 1 $ — affiche cette différence sans détour.

Aiguiller le travail

Tâche Aiguiller vers Pourquoi
« Fais-le sur ma machine » : navigateur, fichiers, applications, jusqu’au bout Astra Meilleur usage d’ordinateur mesuré, environ deux fois plus vite par tâche
Travail de connaissance à fort jugement, due diligence, longs documents Opus 5 GDPval supérieur pour un quart du prix API
Le raisonnement pur le plus dur et le contexte long et embrouillé Fable 5 / Fable 5.1 En tête des composites indépendants d’intelligence
Volume, brouillons de routine, le tapis roulant quotidien Sol / Terra / Luna Toujours là, toujours les places les moins chères

Le hic honnête

Astra est laconique de tempérament. Ce style vitesse gagne les évaluations de code et perd les grilles de droit, de finance et de fiscalité qui récompensent l’énumération de chaque étape ; sa qualité de présentation a reculé par rapport à Sol quand sa qualité d’analyse bondissait. Le lancement du premier jour a été chaotique — les abonnés payants ont joué à la loterie de l’accès, et les comptes Enterprise sont arrivés avec Astra désactivé par défaut. Pas de génération d’images native, pas de sortie audio ou vidéo. Et ses capacités cyber bien plus fortes (100% sur ExploitBench, avec des 0-days inconnus découverts pendant l’évaluation) viennent avec des garde-fous plus stricts qui peuvent ralentir le travail légitime voisin de la sécurité.

Donc l’habitude gagnante : Astra au volant, Opus pour le jugement, Fable pour la pensée dure, Sol pour le tapis roulant. OpenAI n’a pas construit un cerveau plus gros ; il a construit de meilleures mains. Pour beaucoup de vrai travail, c’est la mise à niveau qui compte.

02

Forces et limites honnêtes

Points Forts

  • Un usage de l’ordinateur qui va au bout : Astra affiche 72,6% sur OSWorld 2.0 contre 65,7% pour Sol et 70,2% pour Opus 5, et boucle la série de tâches en environ 40 minutes là où Sol en mettait environ 75. Dans ChatGPT Work, cela donne un agent qui navigue, clique, tape et déplace des fichiers jusqu’à ce que le travail soit fini — avec vous en approbateur.
  • Environ deux fois moins d’hallucinations : le suivi de factualité d’Artificial Analysis montre le taux d’hallucinations d’Astra réduit à environ la moitié de celui de Sol, tandis que la précision gagnait environ quatre points. Pour le travail professionnel, moins d’erreurs assurées d’elles-mêmes vaut plus qu’un point d’examen de plus.
  • Un vrai collègue scientifique : Astra marque 64,6% sur Terminal-Bench Science — contre 52,6% pour Fable 5.1 et 22,4% pour Sol — et environ 97,6% sur FrontierMath Tier 4. Il a même produit des preuves pour deux des 68 problèmes ouverts d’Erdős pendant l’évaluation : une anecdote de recherche, pas une promesse produit.
  • Des muscles pour problèmes inédits : sur le harnais standard d’ARC-AGI-3, Astra atteint 62,7%, environ le double des 30,2% d’Opus 5. Le chiffre de 99,9% que vous avez peut-être vu exige l’adaptateur et la compaction d’OpenAI ; tenez 62,7% pour le nombre honnête et comparable.
  • Continuité de l’écosystème : Astra s’installe dès le premier jour dans ChatGPT Work, Codex, l’application de bureau et Sites, avec l’identifiant API gpt-6-astra, des référencements Azure et Bedrock, la rétention zéro des données pour les usages API éligibles, un contexte d’environ 1,05 million de tokens et un support dès le jour un dans des outils comme Devin.

Limites Honnêtes

  • Pas un bond d’intelligence générale : Artificial Analysis place Astra à 61,2 contre 60,9 pour Sol — une égalité — tandis que Claude Fable 5.1 mène à 65,7. Sur le travail de connaissance GDPval-AA v2, les ~1629 d’Astra sont derrière Opus 5 (1824) et Fable 5.1 (1853) — et derrière Sol. Si votre journée, c’est notes de synthèse, due diligence et jugement, Astra n’est pas automatiquement le meilleur achat.
  • Une économie premium : l’API est à 10/50 $ par million de tokens entrée/sortie — 2,5 fois Sol — avec une lecture de cache à 1 $ (Fable 5.1 facture 0,25 $), une écriture à 12,50 $, un prix d’entrée doublé au-delà de 272k tokens de prompt et un tarif doublé en mode rapide. Artificial Analysis calcule qu’Astra coûte environ 75% de plus par tâche de l’index d’intelligence que Sol, tout en consommant environ 10% de tokens en moins.
  • Frictions de style et d’accès : Astra est laconique ; il perd donc des points de grille sur les évaluations de droit, de finance et de fiscalité, et sa qualité de présentation a reculé par rapport à Sol quand sa qualité d’analyse bondissait. Le lancement du premier jour a été chaotique — l’accès Enterprise est arrivé désactivé par défaut — et il n’y a ni génération d’images native ni sortie audio/vidéo. Des garde-fous cyber renforcés ralentissent certains travaux légitimes proches de la sécurité, et les tableaux d’OpenAI eux-mêmes ont bougé après publication : traitez chaque cellule à ±1–2 points.
03

Aperçu des Benchmarks

OSWorld 2.0 — Astra 72,6% en ~40 min

Tableau d'usage d'ordinateur d'OpenAI, contre Sol à 65,7% (~75 min) et Opus 5 à 70,2%. Mesuré sur un jeu de tâches partiel et hors ligne : un signal directionnel fort, pas une garantie pour vos applications précises.

Artificial Analysis Intelligence Index — 61,2

Composite indépendant : à égalité avec GPT-5.6 Sol à 60,9 et derrière Claude Fable 5.1 à 65,7. Le titre honnête, c'est « plus agentique », pas « plus intelligent ».

Suivi de factualité AA — hallucinations environ réduites de moitié

Mesure indépendante montrant environ la moitié du taux d'hallucinations de Sol pour environ quatre points de précision en plus — le changement de fiabilité que les professionnels ressentent vraiment.

ARC-AGI-3 — 62,7% standard / 99,9% adaptateur fournisseur

Résolution de problèmes interactifs inédits. 62,7% est le chiffre comparable du harnais standard (Opus 5 : 30,2%) ; 99,9% inclut le harnais Responses et la compaction d'OpenAI et doit toujours porter cette note.

Tarifs API — 10/50 $ · lecture cache 1 $ · écriture 12,50 $

Par million de tokens entrée/sortie, plus 2x entrée / 1,5x sortie au-delà de 272k tokens de prompt et 2x en mode rapide. Comparez le coût par tâche finie et le comportement du cache, pas les prix d'étiquette.

04

Le Verdict

GPT-6 Astra prend la place quotidienne n°2 de GPT-5.6 parce qu’il est l’agent d’usage d’ordinateur et de science le plus capable au sein de la plateforme grand public la plus large — ChatGPT Work, Codex, bureau, Sites et l’API. Opus 5 garde la n°1 au jugement par dollar pour le travail de connaissance pur, et Fable 5 reste le spécialiste d’intelligence. Choisissez Astra quand le travail, c’est « fais-le sur ma machine et termine » ; choisissez Opus 5 quand le livrable est du jugement ; gardez Sol, Terra et Luna pour le volume aux anciens tarifs.

05

Foire aux questions