- DevDay 2026 le 29 septembre à Fort Mason, San Francisco ; Altman vers 10 h 00, keynote en live gratuit, inscriptions sur place closes
- GPT-6 Astra est en ligne depuis les 3–4 septembre, pas une première le 29. ID API
gpt-6-astra, contexte court standard $10 / $50 (par million de tokens) - Agents API beta publique le 10 septembre :
POST /v1/agents/sessions, le harness Codex est hébergé pour vous, l'interface elle-même sans surcoût - Hosted Sandbox s'écrit
openai_hosted: Linux + Python / Node, répertoire/workspace; conteneur à part, 1–64 Go environ $0.03–$1.92 / 20 minutes - Le 29, surveillez le passage GA d'Agents, les notes Codex par défaut, prix/quotas, specs sandbox, entrées ChatGPT. Pas de liste officielle complète — écartez les rumeurs
Il ne reste que quelques jours avant OpenAI DevDay 2026. Le site fixe la date au mardi 29 septembre 2026, lieu Fort Mason, San Francisco. La keynote vers 10 h 00, Sam Altman ouvre, le live est gratuit ; les replays des breakouts suivent sur openai.com. Les inscriptions sur place sont closes, le billet était à $650. Pour la plupart des gens, ce qui compte, c'est le live et la doc — pas le siège en salle.
Plus utile que « un nouveau nom de modèle le 29 ? » : ce qui est déjà dans les mains des développeurs début septembre suffit-il pour changer le routage, la facture et l'environnement d'exécution maintenant ? Astra, Agents API, Hosted Sandbox et le harness Codex sont dans la doc, pas sur des slides. Ce texte s'appuie sur le site DevDay, l'annonce Astra, l'annonce Agents API et la page des prix. Prix et points d'entrée selon la doc visible au 20 septembre 2026. Le 29, c'est la console produit qui fait foi.
Ce qu’est le DevDay du 29 septembre
C'est la conférence annuelle d'OpenAI pour les gens qui écrivent du code, pas un show grand public. Le site vise ingénieurs, fondateurs techniques, chercheurs et responsables tech qui construisent (ou s'apprêtent à construire) des produits avec l'IA. Agenda selon les créneaux publics :
| Heure (locale) | Créneau | Ce que vous suivez |
|---|---|---|
| 08:00 | Petit-déjeuner | Sur place seulement |
| 10:00 | Opening Keynote (Sam Altman) | Live gratuit ; entrée principale pour le public distant |
| 11:15–15:30 | Breakouts & Programming | Sessions techniques sur place ; replays ensuite sur le site |
| 16:00 | Closing Session | Clôture, souvent une carte des capacités du jour |
| 16:45–19:00 | Reception | Sur place seulement |
OpenAI évoque aussi l'extension mondiale des DevDay Exchanges, mais le 29 reste la journée de San Francisco. Inscrivez le rappel live sur devday.openai.com, pas besoin de billet sur place.
Comme chaque année : la keynote raconte l'histoire. Les chiffres qui iront dans vos configs sont sur developers.openai.com — page modèle, prix, guide Agents. Dans les 24 heures suivantes, vérifiez la doc, ne commandez pas sur une capture des réseaux.
Déjà en ligne : le quatuor à ne pas attendre
Début septembre 2026, OpenAI a déjà remis aux développeurs la « stack Agent de prochaine génération » en quatre blocs. Le 29 ressemble davantage à les rassembler en une ligne produit qu'à un lancement depuis zéro.
| Capacité | Statut (date de rédaction) | Ce que vous pouvez déjà écrire dans la config |
|---|---|---|
| GPT-6 Astra | Annoncé le 3 septembre, API le 4 | gpt-6-astra ; ChatGPT Work / Codex en cours de déploiement |
| Agents API | Beta publique le 10 septembre | POST /v1/agents/sessions + OpenAI-Beta: agents=v1 |
| Hosted Sandbox | Fourni avec l'API Agents | environment.type = "openai_hosted" |
| Codex harness | Open source + hébergé | CLI / Desktop en local ; côté API, OpenAI opère la même orchestration |
Fonctions, points d'entrée ChatGPT et règles d'escalade d'Astra : on les a déjà dans Qu’est-ce que GPT-6 Astra ? Fonctionnalités, prix, API et utilisation dans ChatGPT. Ici, le point de vue DevDay : comment ces briques deviennent une stack Agent facturable, et quels curseurs peuvent bouger le 29.
GPT-6 Astra : phare, points d'entrée et prix
GPT-6 Astra est le phare texte public actuel d'OpenAI, pour « les jobs bout-en-bout les plus durs » : raisonnement complexe, génie logiciel, Computer Use, recherche et documents longs. Entrée texte + image, sortie texte. La phrase officielle : « notre modèle le plus fort, bâti pour les jobs bout-en-bout les plus durs » — retenez l'ID et la facture, pas le slogan.
- ID API :
gpt-6-astra. Aussi via Microsoft Azure et AWS Bedrock ; ne figez pas le routage prod avant l'entrée marketplace. - Contexte : environ 1,05 million de tokens, plafond de sortie environ 128 000 ; coupure des connaissances 2026-04-30. Une entrée au-delà de 272K bascule toute la requête au tarif long contexte (entrée 2×, sortie 1,5×).
- Tarif standard : entrée $10 / entrée en cache $1 / écriture cache $12.50 / sortie $50 (par million de tokens). Fast environ 2× la vitesse et 2× le prix ; Batch / Flex la moitié.
- ChatGPT : Plus passe par Work et Codex ; le sélecteur Chat habituel n'est pas l'entrée principale. GPT-6 Pro du Chat standard s'adresse à Pro / Business / Enterprise. Enterprise est désactivé par défaut, un admin doit l'ouvrir.
Chiffres OpenAI : Computer Use sur OSWorld 2.0 environ 72,6 %, Agents' Last Exam environ 59,3 % ; avec le harness Codex mis à jour, environ 1,9× la vitesse de GPT-5.6 Sol sur Mind2Web. Traitez-les comme un signal de direction, pas une clause d'acceptation. Comme dans le classement 2026 des outils de codage IA : un benchmark dit « le dépôt plus dur est croquable », pas « votre monorepo se merge cette nuit ».
Gardez la boucle quotidienne sur GPT-5.6 Sol (promo au moins jusqu'au 21 novembre : $4 / $20). Cas durs, agents longs, Computer Use : montez sur Astra. Ne changez pas le routage par défaut parce que « DevDay va parler d'Astra ».
Agents API : le harness Codex en interface
Le 10 septembre 2026, OpenAI a livré à tous les développeurs l'orchestration derrière Codex et ChatGPT for Work, en beta publique de l'API Agents. Version officielle : un agent utile a besoin d'un harness pour le contexte, d'outils efficaces et de sous-agents — plus une infra capable de tourner plusieurs jours, de lire/écrire des fichiers et de garder des résultats intermédiaires.
Vous choisissez la tâche, le modèle, les outils et l'environnement ; OpenAI héberge et maintient le harness. Le calcul peut atterrir dans le bac à sable OpenAI, sur votre machine, ou chez Blaxel, Cloudflare, Daytona, DigitalOcean, E2B, Modal, Oracle, Runloop, Vercel et d'autres partenaires. L'interface elle-même n'a pas de surcoût — vous payez tokens et outils. Ce n'est pas « encore une plateforme Agent avec frais de plateforme ».
Chiffres des early adopters : score Ciridae de 0,71 à 0,85, sous-agents qui baissent la latence d'environ 4× ; SafetyKit baisse le coût par dossier d'environ 60 % ; Hypha baisse les réponses en échec d'environ 86 % après avoir séparé harness et bac à sable. Autodéclarations pour comprendre : ils achètent de l'orchestration, pas un énième wrapper de chat.
La forme d'un appel
L'entrée de session est POST /v1/agents/sessions avec l'en-tête OpenAI-Beta: agents=v1. Forme SDK : client.beta.agents.sessions.create. La clé a besoin de api.agents.read, api.agents.write et, pour l'inférence, api.responses.write. La clé reste côté appli, pas dans les variables d'environnement du bac à sable — les noms réservés OPENAI_API_KEY, PATH, CODEX_* sont refusés.
Modèle gpt-6-astra, environnement openai_hosted. D'abord générer un fichier, l'exécuter, relire la sortie réelle. Ajoutez MCP, sous-agents et environnement maison seulement après l'éval.
curl --no-buffer --fail-with-body https://api.openai.com/v1/agents/sessions \
-H "OpenAI-Beta: agents=v1" \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"agent": {
"model": "gpt-6-astra",
"instructions": "Write clean code, run it, and report the actual output."
},
"environment": { "type": "openai_hosted" },
"input": "Create tree.py, print a readable tree of the current directory, run it, show the output.",
"stream": true
}'
La doc de beta publique le dit : l'API Agents ne prend pas en charge Zero Data Retention. self_hosted ne devient pas magiquement ZDR. Pour un projet de conformité, lisez d'abord Data controls, puis décidez si la session peut sortir du réseau interne.
Sous-agents, recherche d'outils et longues sessions
L'API Agents rentre dans la couche hébergée trois choses que vous construisiez avant :
- Compression des longues sessions : compact automatique près de la limite de contexte, en gardant ce qu'il faut pour continuer. Les flux multi-fenêtres n'ont plus besoin d'un résumeur maison.
- Recherche d'outils + appels programmables : charger les définitions à la demande, baisser les tokens ; appels programmables en parallèle, en série, filtrer les résultats dans le code et ne ramener que les extraits utiles. MCP, fonctions custom, Web search intégré.
- Multi-agent :
multi_agent.enabled+max_concurrent_subagents. Chaque sous-agent tient son contexte, l'agent principal agrège. Adapté à la recherche, l'analyse et le code parallélisables — sans orchestrateur maison.
Le harness est open source ; la version hébergée monte avec le modèle. Une nouvelle capacité modèle, c'est souvent juste monter l'ID, pas réécrire l'orchestration. C'est l'histoire d'ingénierie à écouter au DevDay : la concurrence passe de « qui a la plus longue chaîne de prompts » à « quel harness suit le modèle ».
Hosted Sandbox : comment utiliser openai_hosted
Le OpenAI hosted sandbox vous donne un espace Linux : Python, Node.js, outils CLI inclus. OpenAI ouvre l'accès ; vous donnez la tâche, vous récupérez le résultat. Le répertoire de travail est /workspace. Vous pouvez monter fichiers, wrappers, skills, plugins ; env pose des variables chaîne, sans écraser les noms réservés du runtime.
Le réseau est serré par défaut, selon la tâche. Les exemples de doc utilisent souvent network.access: "disabled" — faites tourner le script hors ligne d'abord, ouvrez le net ensuite. Image à vous, specs CPU / GPU / RAM, VPC ou stockage de clés privé : passez à self_hosted ou à un partenaire, ne forcez pas le bac à sable hébergé.
- Vous avez besoin de
xcodebuild, du simulateur iOS, de la signature, de TestFlight — le bac à sable hébergé est Linux, pas macOS - Le code ou les clés ne doivent pas quitter votre VPC
- Entraînement / rendu GPU, ou le cold start et les paliers RAM ne collent pas à la table officielle des conteneurs
- Vous partagez DerivedData, certificats et sources de paquets privés avec le CI existant
Conteneurs au tarif standard Hosted Shell / Code Interpreter : 1 / 4 / 16 / 64 Go environ $0.03 / $0.12 / $0.48 / $1.92, par 20 minutes, par conteneur. Les sessions éligibles peuvent être à la minute, minimum 5 minutes par session. Tokens modèle à part. Une heure de marche à vide peut coûter plus cher que le « bac à sable gratuit » que vous aviez en tête.
Codex : notes inter-fenêtres et Computer Use
Avec Astra, OpenAI a aussi mis à jour le harness Codex. Les longues sessions compactaient le travail en un résumé — les causes d'échec et le comportement des composants se perdaient. Astra peut prendre des notes sur plusieurs fenêtres de contexte ; les anciennes restent interrogeables pour les exigences et les résultats de tests. L'interrupteur d'expérience est dans le config.toml Codex ; officiellement, ce sera le défaut Astra dans les semaines qui viennent.
La phrase Codex à écouter le 29 : les notes sont-elles activées par défaut, version minimale du CLI, le Desktop suit-il ? Un vieux CLI cache Astra — il a déjà fallu 0.153.0 pour le voir.
Computer Use + Hosted shell + Apply patch : dans une session, modifier des fichiers, lancer des commandes, voir l'écran. Pour les développeurs iOS / macOS, le bac à sable Linux fait scripts et frontend ; la vraie chaîne d'outils exige un Mac qui ne coupe pas. Le modèle pense dans le cloud, xcodebuild doit valider sur macOS.
Prix API : Astra, Sol, conteneurs
Ci-dessous les dollars par million de tokens de la page tarifaire au jour de rédaction. Appels d'outils (recherche, Computer Use, etc.) à part. L'API Agents n'a pas de troisième « frais de plateforme ».
| Poste | Entrée | Entrée en cache | Écriture cache | Sortie |
|---|---|---|---|---|
| gpt-6-astra · contexte court | $10 | $1 | $12.50 | $50 |
| gpt-6-astra · long contexte (>272K) | $20 | $2 | $25 | $75 |
| gpt-5.6-sol · contexte court (promo jusqu'au 11/21) | $4 | $0.40 | $5 | $20 |
| gpt-5.6-terra / luna · contexte court | $2 / $0.20 | $0.20 / $0.02 | $2.50 / $0.25 | $12 / $1.20 |
| Conteneur hébergé 1 / 4 / 16 / 64 Go | $0.03 / $0.12 / $0.48 / $1.92 par 20 minutes (minimum 5 minutes) | |||
- 272K est un interrupteur pour toute la requête. Une entrée au-delà de la ligne passe toute la demande au tarif long contexte — pas seulement le surplus.
- Les boucles Agents se multiplient par tours. Agent principal + 3 sous-agents, ce n'est pas le prix « d'un message ».
- Conteneur selon la durée de session. Une marche à vide de nuit remplit d'abord le minimum de 5 minutes, puis les minutes.
- Fast double la facture modèle. OK pour l'attente interactive ; batch et évals en Standard ou Batch / Flex.
- Quota d'abonnement ChatGPT ≠ prix unitaire API. Plus utilise Astra dans Work / Codex sans facture $10/$50, mais consomme le quota selon « combien de travail ».
Ordre de grandeur : 1 million d'entrée + 100 000 de sortie, promo Sol environ $6, Astra standard environ $15, Fast Astra environ $30. Puis multipliez par les tours d'agent et le conteneur. Le cadre plus complet « API vs hôte cloud vs local » est dans 2026 : calcul AI Agent moins cher : cloud, API ou local ? et Prix, config, perfs et publics LLM 2026—le guide complet.
Cinq choses à surveiller le 29
OpenAI n'a pas publié de liste produit DevDay complète. Ci-dessous des curseurs déjà identifiables dans la doc, susceptibles d'être resserrés ou étendus le jour J — pas des fuites.
- Agents API beta publique → version finale ? Langage SLA, ZDR / résidence des données, limites de débit, date GA. Un contrat aujourd'hui ne peut porter que beta.
- Notes Codex inter-fenêtres par défaut. Si ça devient le défaut Astra, les hypothèses de harness pour un long refactor changent : moins « compresser un résumé à chaque fois ».
- Prix et quotas. Les $10/$50 d'Astra, l'interrupteur 272K, la fin de promo Sol, les quotas ChatGPT Work / Codex. Historiquement, DevDay bouge souvent un palier de prix ou ajoute un Fast en keynote.
- Specs Hosted Sandbox et partenaires. Plus de RAM, cold start plus court, GPU ou nouveaux partenaires VPC changent directement ce que vous pouvez laisser à
openai_hosted. - Surfaces ChatGPT. Plus verra-t-il GPT-6 Pro dans le Chat habituel ? Enterprise reste-t-il fermé par défaut ? Si l'entrée change, la doc interne de formation doit suivre le jour même.
N'attendez pas un GPT-7 le 29. Plus probable : rassembler le quatuor déjà en ligne début septembre en une histoire développeur « du modèle au bac à sable à l'orchestration », puis ajouter deux ou trois interrupteurs.
Comment se préparer avant l'événement
- Faire tourner une session Agents minimale. Astra +
openai_hosted+ une tâche qui écrit des fichiers et lance des commandes. Pendant le live, comparez « ce qu'ils montrent » et « ce que votre compte sait déjà appeler ». - Geler une suite d'éval. Même dépôt, mêmes tests, même timeout — Sol vs Astra vs votre routage Claude / Gemini actuel. Ne partagez pas la machine du quotidien avec le changement de modèle.
- Facture en trois lignes. Tokens modèle, outils intégrés, conteneur. Sans ces trois lignes, aucun « moins cher » du DevDay ne colle à votre facture.
- Mettre à jour Codex CLI / Desktop. Les vieux clients cachent les modèles. Activez l'expérience notes dans
config.tomlavant, pour comparer le comportement par défaut le 29. - Séparer bac à sable Linux et validation macOS. Scripts, frontend, analyse de données dans Hosted Sandbox ;
xcodebuild, simulateur, signature sur Cloud Mac ou en local. - Ne pas changer le routage par défaut pour la keynote. Attendez 24 heures que la doc se stabilise avant de toucher le champ
modelen prod. Les alias de la scène mettent souvent une nuit à arriver sur la page modèle.
Pourquoi un agent long atterrit sur un Cloud Mac
L'API Agents règle l'orchestration ; Hosted Sandbox règle l'exécution Linux générique. Il manque aux développeurs Apple la troisième couche : session qui ne coupe pas, vraie chaîne macOS, disque et RAM suffisants, idéalement la même machine que le CI.
- Pas d'endormissement : les jobs d'heures ou de nuit ne survivent pas au sommeil du laptop. Work desktop peut synchroniser le contexte vers le cloud, mais
xcodebuildet le simulateur ne valident que sur Mac. - Vraie chaîne d'outils : Apply patch a modifié du Swift — les tests doivent tourner sur la même machine ; le cold start macOS hébergé par GitHub allonge la boucle Agent.
- Évals comparatives : Astra vs Sol vs Fable 5 en parallèle sur les mêmes scripts — les histoires GPU / RAM locales explosent en premier.
- Division du travail avec openai_hosted : scripts génériques, données, QA frontend dans le bac à sable hébergé ; builds iOS / macOS, certificats, DerivedData sur Cloud Mac. Un seul environnement ne doit pas prétendre tout faire.
L'ID du modèle peut encore changer l'an prochain, l'hôte et le flux de travail n'ont pas à être jetés. Posez les boucles Codex / Agent sur un Vuncloud Cloud Mac, le laptop ne lit que les diffs — c'est la couche physique commune des modèles phares 2026, pas l'accessoire d'une seule maison.
FAQ
Quelle est la date d’OpenAI DevDay 2026 ?
Mardi 29 septembre 2026, Fort Mason, San Francisco. Keynote vers 10 h 00, Sam Altman ouvre, live gratuit. Inscriptions sur place closes.
Astra sera-t-il annoncé ce jour-là ?
Pas en première. Astra a été annoncé le 3 septembre, API le 4. Le 29, plutôt capacité, défauts Codex et intégration Agents.
L'API Agents est-elle déjà utilisable ? Combien ça coûte ?
Oui, beta publique le 10 septembre. Pas de surcoût d'interface ; tokens modèle, outils et conteneur. Astra standard, contexte court $10 / $50 (par million de tokens).
Qu’est-ce que Hosted Sandbox ?
Espace Linux hébergé par OpenAI, environment.type = openai_hosted. Python, Node et CLI, répertoire /workspace. Image custom, GPU ou réseau privé : self_hosted ou partenaire.
Quel lien entre Codex et l'API Agents ?
L'API Agents transforme le harness open source de Codex en API hébergée. CLI / Desktop locaux restent autonomes ; côté API, OpenAI opère la même orchestration.
Que surveiller le 29 ?
Passage GA d'Agents, notes Codex par défaut, prix et quotas, specs / partenaires sandbox, points d'entrée ChatGPT. Liste complète : site et doc du jour.
Conclusion
Trois phrases pour fermer : le 29 est un jour de resserrement, pas l'anniversaire d'Astra ; Agents API + Hosted Sandbox ferment déjà la boucle minimale ; le routage par défaut reste Sol, les cas durs montent d'un cran. Préparez la suite d'éval, la facture en trois lignes et le client Codex — pendant le live, vous entendrez quel curseur bouge.
Les noms de modèles changeront encore. Ce qu'il faut vraiment préparer, c'est un environnement d'exécution qui ne coupe pas — et une règle d'escalade écrite clairement.
Un agent qui retravaille le dépôt toute la nuit a besoin d'un Mac qui ne s'endort pas
Bac à sable Linux pour les scripts, Cloud Mac pour xcodebuild. Longues sessions Codex / Agents dans tmux, DerivedData encore là, le laptop ne lit que les diffs.
Pour aller plus loin
- Qu’est-ce que GPT-6 Astra ? Fonctionnalités, prix, API, date de sortie et utilisation dans ChatGPT
- 2026 : calcul AI Agent moins cher : cloud, API ou local ?
- Prix, config, perfs et publics LLM 2026—le guide complet
- Limite hebdomadaire Codex atteinte ? 7 correctifs, mécanique des quotas et APIs alternatives (2026)
- Meilleurs outils de codage IA en 2026 : Claude, Cursor, GitHub Copilot, Codex, Gemini