- GPT-6 Astra est le modèle de raisonnement phare d'OpenAI, annoncé le 3 septembre 2026, conçu pour les jobs bout-en-bout les plus durs : raisonnement complexe, code, Computer Use, recherche et documents longs
- L'identifiant API est
gpt-6-astra, en ligne le 4 septembre ; tarif standard entrée $10 / sortie $50 (par million de tokens) ; le palier API gratuit n'est pas pris en charge - ChatGPT Plus ne met pas Astra dans le sélecteur Chat habituel : l'entrée est dans Work et Codex. GPT-6 Pro du Chat standard s'adresse à Pro / Business / Enterprise
- Il coûte environ 2,5× plus que GPT-5.6 Sol. Gardez Sol pour la boucle quotidienne ; les cas durs, les agents longs et Computer Use montent d'un cran. Les courses longues ont besoin d'un Cloud Mac qui ne s'endort pas
OpenAI a annoncé GPT-6 Astra le 3 septembre 2026 et a placé le lendemain le modèle API gpt-6-astra dans la documentation développeur. La phrase officielle : « Notre modèle le plus fort, conçu pour les travaux bout-en-bout les plus durs. » Ce que les développeurs doivent vraiment demander, ce n'est pas le slogan, mais : en quoi il diffère de GPT-5.6 Sol, combien il coûte, quel point d'entrée ChatGPT est cliquable, et s'il faut changer le routage par défaut.
Cet article s'appuie sur la page modèle OpenAI, la page des prix et le centre d'aide ChatGPT. Prix et entrées correspondent à la documentation visible au 8 septembre 2026. Pendant le déploiement progressif, le sélecteur du produit fait foi.
Qu’est-ce que GPT-6 Astra
GPT-6 Astra est le phare texte le plus fort qu'OpenAI rende public — pas un énième modèle « un peu plus fluide ». La documentation le place sur les travaux bout-en-bout les plus durs : raisonnement complexe, génie logiciel, Computer Use, recherche et rédaction de documents. L'entrée accepte texte et image, la sortie est du texte ; l'audio et la vidéo ne font pas partie des modalités.
Face à l'étage précédent GPT-5.6 Sol, le saut se joue sur la durée de tâche et la boucle d'outils : Astra est conçu pour enchaîner, en une requête, le code à l'échelle d'un dépôt, le bureau, la recherche et l'écriture, au lieu de vous faire cliquer « continuer » toutes les deux minutes. C'est la même ligne industrielle que Claude Fable 5, qui met les agents longs sur le devant — la compétition bascule de la réponse unique vers le travail fini sans surveillance.
La coupure des connaissances officielle est le 30 avril 2026. Pour des faits plus récents, passez par Web search et les outils du même type : ne supposez pas qu'il connaît le monde après mai.
Date de sortie et rythme de déploiement
| Date (2026) | Ce qui s'est passé | Ce que vous pouvez utiliser |
|---|---|---|
| 3 septembre | OpenAI annonce GPT-6 Astra | Les entreprises de confiance Daybreak le voient d'abord ; le centre d'aide parle des « prochains jours » pour les formules payantes |
| 4 septembre | Le modèle API gpt-6-astra arrive |
Les comptes API payants peuvent appeler ; le palier gratuit est explicitement exclu |
| À partir du 4 septembre | ChatGPT Plus / Business se déploient dans Work et Codex | Le sélecteur Chat habituel n'est toujours pas l'entrée principale d'Astra pour Plus |
| Date de rédaction (8 septembre) | Le déploiement progressif continue | Un même compte peut être désynchronisé selon les surfaces ; Enterprise est désactivé par défaut |
OpenAI évoque aussi une disponibilité ultérieure via Azure et AWS Bedrock. Tant que les fiches marketplace n'existent pas, ne figez pas ces identifiants dans le routage de production. Côté Codex, une expérience parallèle « prendre des notes sur plusieurs fenêtres de contexte » : les longues sessions ne sont plus compressées en un résumé à chaque fois, les anciennes fenêtres restent interrogeables. C'est un signal produit pour le code de fond, pas un SLA.
Fonctionnalités : niveaux de raisonnement, outils et Computer Use
La liste des capacités d'Astra se comprime en trois couches : penser plus loin, manier des outils, tenir un long contexte.
- Niveaux de raisonnement :
reasoning.effortacceptelow,medium,high,xhigh,max. Les passerelles defaultent souvent surlow. Montez d'un cran sur les cas durs — n'ouvrez pas toutes les requêtes àmax. - Specs : environ 1,05 million de tokens de contexte, au plus 128 000 tokens de sortie. Un prompt très long déclenche la règle de surcoût du paragraphe suivant.
- Capacités structurées : streaming, appels de fonctions et Structured Outputs sont disponibles ; pas de fine-tuning.
- Outils Responses API : Web search, File search, génération d'images, Code interpreter, Hosted shell, Apply patch, Skills, Computer Use, MCP, Tool search.
Pour les développeurs iOS / macOS, la vraie nouveauté est Computer Use + Hosted shell + Apply patch dans une même session : modifier des fichiers, lancer des commandes, voir le résultat. Dès que le modèle monte en puissance, le goulot devient tout de suite l'environnement d'exécution qui s'endort en cours de route — laptop refermé, agent coupé.
OpenAI a publié quelques scores auto-déclarés (sans revue tierce unifiée) : Terminal-Bench 4 vers 57,7, DeepSWE vers 74,1, GPQA vers 96,0, BrowseComp vers 91,5. Traitez-les comme un signal de direction, pas comme une clause d'acceptation. Comme pour le classement des outils de code : un benchmark dit « des dépôts plus durs sont croquables », pas « votre monorepo fusionne dans la nuit ».
Correspondance avec GPT-5.6 et GPT-6 Pro
Dans la vague de septembre, les noms se mélangent le plus facilement. Astra est le phare sous-jacent ; GPT-6 Pro est le nom produit sur la surface Chat.
| Ce que l'interface affiche | Modèle réel | Qui peut l'utiliser |
|---|---|---|
| GPT-6 Astra | Le phare lui-même | API ; ChatGPT Work / Codex (formules payantes en déploiement) |
| GPT-6 Pro | Palier Chat haut de gamme, alimenté par Astra | Chat standard de Pro, Business, Enterprise |
| GPT-5.6 Sol | Le cheval de trait de l'étage précédent | Défaut du Chat payant ; toujours le quotidien haute fréquence en API |
| GPT-5.6 Terra / Luna | Milieu / léger | Work, Codex, API ; rarement sélectionnable dans le Chat habituel. Free et Go voient souvent Luna |
Si un utilisateur Plus ne trouve pas Astra dans le dialogue habituel, ce n'est pas « pas ouvert ». OpenAI place l'Astra de Plus dans Work (faire le travail) et Codex (écrire du code), et réserve GPT-6 Pro du Chat standard aux formules supérieures. Les espaces Enterprise sont désactivés par défaut ; un administrateur doit ouvrir les droits modèle.
API : identifiant, endpoints et points d'appel
L'identifiant stable à mettre en config est gpt-6-astra. Les alias snapshot pointent pour l'instant vers la même chaîne ; pour verrouiller une version, consultez le tableau Snapshots de la page modèle — n'inventez pas de suffixe de date.
La documentation liste comme endpoints principaux Chat Completions (v1/chat/completions) et Responses (v1/responses). Boucles d'outils, Computer Use et MCP passent par Responses. RPM/TPM du palier gratuit : « non pris en charge » ; le quota commence au Tier 1 et monte avec l'usage.
Mettez model à gpt-6-astra et pilotez la profondeur de pensée avec reasoning.effort. low par défaut pour tester le routage, puis high / xhigh si la tâche le mérite. Search, Computer Use et les autres outils se facturent à part : ne regardez pas seulement le prix du token.
const response = await client.responses.create({
model: "gpt-6-astra",
reasoning: { effort: "high" },
input: "Repère le timeout de paiement dans le dépôt, fournis le plus petit diff de correctif et indique la commande de vérification."
});
Conseil production : Sol reste la boucle par défaut, Astra l'escalade. Déclenchez via scores d'éval ou contrôles manuels, pas chaque phrase utilisateur à max. Changer de modèle exige le même harness — le même principe que dans le guide prix et perfs LLM.
Prix : standard, cache, long contexte, Fast / Batch
Les chiffres ci-dessous viennent de la page de prix OpenAI au jour de rédaction : dollars par million de tokens. Les appels d'outils (search, Computer Use, etc.) s'ajoutent.
| Palier | Entrée | Entrée en cache | Écriture cache | Sortie |
|---|---|---|---|---|
| Astra Standard · contexte court | $10 | $1 | $12.50 | $50 |
| Astra Standard · long contexte (>272K en entrée) | $20 | $2 | $25 | $75 |
| Astra Batch / Flex | 50% du tarif standard | |||
| Astra Fast | 2× le palier applicable (environ 2,5× plus rapide selon OpenAI) | |||
| Promo GPT-5.6 Sol (au moins jusqu'au 21 novembre) | $4 | $0.40 | $5 | $20 |
- 272K est un interrupteur pour toute la requête. Dès que l'entrée dépasse la ligne, toute la demande passe au tarif long contexte — pas seulement le surplus.
- L'écriture cache coûte 1,25× l'entrée non mise en cache. Remplir un gros dépôt la première fois n'est pas bon marché ; le tarif $1 n'arrive qu'aux hits suivants.
- Fast double la facture. Acceptable pour l'attente interactive ; les lots de nuit restent en Standard ou Batch/Flex.
- Quota d'abonnement ChatGPT ≠ prix unitaire API. La promo Sol baisse l'usage mesuré, elle n'offre pas un tiers de messages en plus à Plus.
Ordre de grandeur : les mêmes 1 million d'entrée + 100k de sortie coûtent environ $6 en promo Sol, $15 en Astra Standard, $30 en Fast Astra. Les boucles d'agent multiplient par le nombre de tours. Pour le cadre plus large « API vs hôte cloud vs local », voir le récent comparatif du coût de calcul des AI Agent.
Utiliser ChatGPT (par formule)
Le jour du lancement, la confusion la plus fréquente était : « Officiellement Plus y a droit — pourquoi je ne le vois pas dans Chat ? » La réponse est une surface différente, pas un compte cassé.
Plus : via Work et Codex
- Ouvrez ChatGPT Desktop (Work sur le web / mobile tourne dans le cloud ; Codex est surtout desktop).
- En haut à gauche, passez de Chat à Work, ou ouvrez la vue Codex.
- Dans le sélecteur de cette surface, choisissez GPT-6 Astra.
- En ligne de commande, passez le CLI Codex à 0.153.0 ou plus et mettez à jour Desktop. Un ancien CLI cache simplement Astra.
Les quotas Work et Codex se comptent à part du Chat habituel. Les tâches longues se décomptent selon « combien de travail a été fait », pas selon « combien de messages ». Quota épuisé : passez à Sol / Terra ou attendez le reset — changer de surface ne recharge pas la tasse. Pour les plafonds hebdo, voir limite hebdomadaire Codex atteinte.
Pro / Business / Enterprise
GPT-6 Pro (alimenté par Astra) est dans le Chat standard pour Pro, Business et Enterprise. Le quota de messages Pro de Business est partagé avec GPT-5.6 Sol Pro : basculer dans les deux sens n'ajoute pas une ration. Enterprise démarre désactivé ; l'admin de l'espace doit ouvrir l'accès modèle.
Free et Go : le Chat standard reste sur GPT-5.6 Luna en première ligne — pas d'Astra / GPT-6 Pro.
Quand basculer vers Astra
- Rester sur Sol : pair quotidien, diffs courts, boucles d'outils haute fréquence, extraction par lots sensible au coût. Le tarif promo tient au moins jusqu'au 21 novembre — toujours le cheval de trait par défaut.
- Monter sur Astra : refonte inter-modules, le modèle lance les tests puis corrige, Computer Use sur le bureau, un long document avalé d'un coup, navigation de recherche. Budgétez en « jours ingénieur », pas en messages de chat.
- Ne pas monter pour le nom : copier la même phrase de Chat vers Work ne rend pas Plus plus malin, ça brûle seulement le quota plus vite.
- Face à Claude / Gemini, figer le harness : même dépôt, mêmes tests, même timeout. Ne faites pas concourir l'éval de modèles et le dev quotidien sur la même machine.
Pourquoi les tâches longues doivent tourner sur un Cloud Mac
Computer Use, Hosted shell et les longues sessions Codex d'Astra posent les mêmes exigences dures que Fable 5 : la session ne doit pas couper, il faut une vraie toolchain macOS, disque et mémoire suffisants, idéalement la même machine que la CI.
- Pas d'endormissement : les jobs d'heures et de nuit ne supportent pas le sleep du laptop. Work local desktop peut synchroniser le contexte vers le cloud, mais
xcodebuildet le simulateur ne s'acceptent que sur Mac. - Vraie toolchain : après Apply patch sur du Swift, les tests doivent tourner sur la même machine ; un démarrage à froid macOS hébergé par GitHub allonge la boucle de l'agent.
- Évals comparatives : Astra vs Sol vs Fable 5 doivent lancer les mêmes scripts en parallèle — l'histoire GPU/RAM du laptop explose en premier.
L'identifiant de modèle changera peut-être encore l'an prochain, l'hôte et le workflow n'ont pas à être jetés. Posez les boucles Codex / Agent sur un Vuncloud Cloud Mac, le laptop ne lit que les diffs — c'est la couche physique commune des modèles phares en 2026, pas l'accessoire d'une seule marque.
FAQ
Qu’est-ce que GPT-6 Astra ?
Le modèle de raisonnement phare d'OpenAI, annoncé le 3 septembre 2026, pour le raisonnement complexe, le code, Computer Use, la recherche et les documents longs. ID API : gpt-6-astra.
Quand est-il sorti ?
Annonce le 3 septembre, API le 4 septembre. Les formules ChatGPT se déploient surface par surface ; centre d'aide et sélecteur du produit font foi.
Combien coûte l'API ?
Contexte court standard : $10 entrée / $1 entrée en cache / $12.50 écriture cache / $50 sortie (par million de tokens). Au-delà de 272K en entrée, toute la requête passe au tarif long contexte. Batch/Flex à moitié, Fast au double. Palier API gratuit non pris en charge.
Plus y a-t-il droit ?
Oui, mais dans Work et Codex, pas dans le sélecteur Chat habituel. GPT-6 Pro du Chat standard est réservé aux formules supérieures.
Astra et GPT-6 Pro sont-ils le même ?
Même phare en dessous. Le Chat affiche GPT-6 Pro ; Work, Codex et l'API utilisent Astra / gpt-6-astra.
Quelle longueur de contexte ?
Environ 1,05 million de tokens de contexte, 128 000 de sortie au plus ; coupure des connaissances 2026-04-30. Une entrée au-delà de 272K coûte plus cher.
Conclusion
Trois phrases pour fermer : Astra est le phare OpenAI de septembre 2026 ; ce qui coûte, c'est la longue boucle d'outils, pas le ton de chat ; les utilisateurs Plus doivent aller dans Work / Codex au lieu d'attendre dans le Chat habituel. Le routage par défaut reste Sol, les cas durs montent d'un cran. Calculez d'abord l'interrupteur 272K et le facteur Fast avant de lui livrer un dépôt toute la nuit.
Les modèles changeront encore de nom. Ce qu'il faut vraiment préparer, c'est un environnement d'exécution qui ne coupe pas — et une règle d'escalade écrite clairement.
Astra qui retravaille le dépôt toute la nuit a besoin d'un Mac qui ne s'endort pas
Posez Codex / Computer Use sur un Cloud Mac : tmux en course longue, xcodebuild sur la même machine, DerivedData encore là. Le laptop ne lit que les diffs.
Pour aller plus loin
- 2026 : calcul AI Agent moins cher : cloud, API ou local ?
- Prix, config, perfs et publics LLM 2026—le guide complet
- Limite hebdomadaire Codex atteinte ? 7 correctifs, mécanique des quotas et APIs alternatives (2026)
- D'Opus 4.8 à Fable 5 : qu'est-ce qu'Anthropic a vraiment changé ?
- Meilleurs outils de codage IA en 2026 : Claude, Cursor, GitHub Copilot, Codex, Gemini