- DevDay 2026 am 29. September in Fort Mason, San Francisco; Altman gegen 10:00, Keynote kostenlos im Livestream, Vor-Ort-Anmeldung geschlossen
- GPT-6 Astra ist seit 3.–4. September live, keine Premiere am 29. API-ID
gpt-6-astra, Standard kurzer Kontext $10 / $50 (pro Million Token) - Agents API Public Beta seit 10. September:
POST /v1/agents/sessions, das Codex-Harness wird für Sie gehostet, die Schnittstelle selbst ohne Aufpreis - Hosted Sandbox als
openai_hosted: Linux + Python / Node, Arbeitsverzeichnis/workspace; Container extra, 1–64 GB etwa $0.03–$1.92 / 20 Minuten - Am 29. achten Sie auf Agents-GA, Codex-Notizen als Default, Preis/Kontingent, Sandbox-Specs, ChatGPT-Einstiege. Eine vollständige Liste gibt es noch nicht — Gerüchte beiseitelegen
Bis zum OpenAI DevDay 2026 bleiben nur wenige Tage. Die Website setzt das Datum auf Dienstag, 29. September 2026, Ort Fort Mason, San Francisco. Die Keynote beginnt gegen 10:00 Uhr, Sam Altman eröffnet, der Livestream ist kostenlos; Breakout-Aufzeichnungen folgen später auf openai.com. Die Vor-Ort-Anmeldung ist geschlossen, Tickets lagen bei $650. Für die meisten zählt der Stream plus die Doku — nicht der Sitzplatz.
Nützlicher als „kommt am 29. noch ein neuer Modellname?“ ist die Frage: Reicht das, was Anfang September schon bei Entwicklern liegt, um Routing, Rechnung und Ausführungsumgebung jetzt umzubauen? Astra, Agents API, Hosted Sandbox und das Codex-Harness stehen in der Dokumentation, nicht auf Folien. Dieser Text folgt der DevDay-Website, der Astra-Ankündigung, der Agents-API-Ankündigung und der Preisseite. Preise und Einstiege gelten nach der am 20. September 2026 sichtbaren Doku. Änderungen am 29. entscheidet die Konsole im Produkt.
Was der DevDay am 29. September ist
Das ist OpenAIs Jahreskonferenz für Menschen, die Code schreiben — keine Consumer-Show. Die Website nennt Ingenieure, technische Gründer, Forscher und Tech-Leads, die mit KI Produkte bauen oder das vorhaben. Agenda nach den öffentlichen Slots:
| Zeit (lokal) | Slot | Was Sie mitbekommen |
|---|---|---|
| 08:00 | Frühstück | Nur vor Ort |
| 10:00 | Opening Keynote (Sam Altman) | Kostenloser Livestream; Haupteinstieg für Remote-Zuschauer |
| 11:15–15:30 | Breakouts & Programming | Technische Sessions vor Ort; Aufzeichnungen später auf der Website |
| 16:00 | Closing Session | Abschluss, oft eine Karte der Fähigkeiten des Tages |
| 16:45–19:00 | Reception | Nur vor Ort |
OpenAI erwähnt außerdem, dass DevDay Exchanges global wachsen — der Haupttag am 29. bleibt San Francisco. Livestream-Erinnerungen tragen Sie auf devday.openai.com ein, ein Vor-Ort-Ticket ist nicht nötig.
Wie jedes Jahr: Die Keynote erzählt die Geschichte. Zahlen, die in Configs landen, stehen auf developers.openai.com — Modellseite, Preise, Agents-Guide. In den 24 Stunden danach gegen die Doku prüfen, nicht gegen Social-Media-Screenshots bestellen.
Schon live: das Viererteam, auf das Sie nicht warten müssen
Anfang September 2026 hat OpenAI den „Next-Gen-Agent-Stack“ in vier Teile an Entwickler übergeben. Der 29. wirkt eher wie das Zusammenziehen zu einer Produktlinie als wie ein Start bei null.
| Fähigkeit | Status (Stichtag) | Was Sie jetzt in die Config schreiben können |
|---|---|---|
| GPT-6 Astra | 3. September angekündigt, 4. September API | gpt-6-astra; ChatGPT Work / Codex rollen aus |
| Agents API | Public Beta seit 10. September | POST /v1/agents/sessions + OpenAI-Beta: agents=v1 |
| Hosted Sandbox | Mit der Agents API | environment.type = "openai_hosted" |
| Codex harness | Open Source + gehostet | CLI / Desktop lokal; API-Seite betreibt OpenAI dieselbe Orchestrierung |
Funktionen, ChatGPT-Einstiege und Eskalationsregeln von Astra haben wir in Was ist GPT-6 Astra? Funktionen, Preise, API und Nutzung in ChatGPT beschrieben. Hier kommt die DevDay-Perspektive: Wie diese Bausteine zu einem abrechenbaren Agent-Stack werden — und welche Regler sich am 29. bewegen könnten.
GPT-6 Astra: Flaggschiff, Einstiege und Preise
GPT-6 Astra ist OpenAIs aktuell öffentliches Text-Flaggschiff für „die härtesten End-to-End-Jobs“: komplexes Reasoning, Software Engineering, Computer Use, Research und lange Dokumente. Input Text + Bild, Output Text. Offiziell: „unser stärkstes Modell, für die härtesten End-to-End-Jobs gebaut“ — merken Sie sich Modell-ID und Rechnung, nicht den Slogan.
- API-ID:
gpt-6-astra. Auch über Microsoft Azure und AWS Bedrock; Produktionsrouting nicht festschreiben, bevor der Marketplace-Eintrag da ist. - Kontext: etwa 1,05 Millionen Token, Output-Deckel etwa 128.000; Knowledge Cutoff 2026-04-30. Input über 272K schaltet die ganze Anfrage auf den Long-Context-Preis (Input 2×, Output 1,5×).
- Standardpreis: Input $10 / Cached Input $1 / Cache Write $12.50 / Output $50 (pro Million Token). Fast etwa 2× Tempo und 2× Preis; Batch / Flex die Hälfte.
- ChatGPT: Plus läuft über Work und Codex; der normale Chat-Wähler ist nicht der Haupteinstieg. GPT-6 Pro im Standard-Chat gehört zu Pro / Business / Enterprise. Enterprise ist standardmäßig aus, der Admin muss es öffnen.
OpenAI selbst: Computer Use auf OSWorld 2.0 etwa 72,6 %, Agents' Last Exam etwa 59,3 %; zusammen mit dem aktualisierten Codex-Harness etwa 1,9× so schnell wie GPT-5.6 Sol bei Mind2Web-Aufgaben. Als Richtungssignal nutzen, nicht in Abnahmeklauseln schreiben. Wie im Ranking der besten KI-Coding-Tools 2026: Benchmarks sagen „härtere Repos sind fressbar“, nicht „Ihr Monorepo mergen Sie über Nacht“.
Den Alltagstakt weiter mit GPT-5.6 Sol fahren (Aktionspreis mindestens bis 21. November: $4 / $20). Harte Fälle, lange Agents, Computer Use auf Astra eskalieren. Default-Routing nicht umbauen, nur weil „DevDay über Astra spricht“.
Agents API: das Codex-Harness als Schnittstelle
Am 10. September 2026 hat OpenAI die Orchestrierung hinter Codex und ChatGPT for Work als Agents API Public Beta an alle Entwickler gegeben. Offiziell: nützliche Agents brauchen ein Harness für Kontext, effiziente Tools und Sub-Agents — plus Infrastruktur, die Tage läuft, Dateien liest/schreibt und Zwischenergebnisse hält.
Sie wählen Aufgabe, Modell, Tools und Umgebung; OpenAI hostet und pflegt das Harness. Compute kann in der OpenAI-Sandbox, auf Ihrer Maschine oder bei Partnern wie Blaxel, Cloudflare, Daytona, DigitalOcean, E2B, Modal, Oracle, Runloop, Vercel landen. Die Schnittstelle selbst hat keinen Aufpreis — Sie zahlen Token und Tools. Das ist etwas anderes als „noch eine Agent-Plattform mit Plattformgebühr“.
Zahlen aus Early-Adopter-Feedback: Ciridae-Score 0,71 auf 0,85, Sub-Agents senken Latenz um etwa 4×; SafetyKit senkt Fallkosten um etwa 60 %; Hypha senkt Fehlantworten um etwa 86 %, nachdem Harness und Sandbox getrennt wurden. Selbstberichte, die erklären: Sie kaufen Orchestrierung, nicht noch einen Chat-Wrapper.
Die Form eines Aufrufs
Session-Einstieg ist POST /v1/agents/sessions mit Header OpenAI-Beta: agents=v1. SDK-Form: client.beta.agents.sessions.create. Der Schlüssel braucht api.agents.read, api.agents.write und für Inferenz api.responses.write. Schlüssel bleibt auf der App-Seite, nicht in Sandbox-Umgebungsvariablen — reservierte Namen wie OPENAI_API_KEY, PATH, CODEX_* werden abgelehnt.
Modell gpt-6-astra, Umgebung openai_hosted. Zuerst Datei erzeugen, ausführen, echte Ausgabe zurücklesen. Erst nach der Evaluation MCP, Sub-Agents und eigene Umgebung dazunehmen.
curl --no-buffer --fail-with-body https://api.openai.com/v1/agents/sessions \
-H "OpenAI-Beta: agents=v1" \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"agent": {
"model": "gpt-6-astra",
"instructions": "Write clean code, run it, and report the actual output."
},
"environment": { "type": "openai_hosted" },
"input": "Create tree.py, print a readable tree of the current directory, run it, show the output.",
"stream": true
}'
In der Public-Beta-Doku: Die Agents API unterstützt kein Zero Data Retention. self_hosted macht daraus auch nicht magisch ZDR. Compliance-Projekte zuerst Data Controls lesen, dann entscheiden, ob die Session das Intranet verlassen darf.
Sub-Agents, Tool Search und lange Sessions
Die Agents API zieht drei Dinge in die Hosted-Schicht, die Sie früher selbst bauen mussten:
- Kompression langer Sessions: nahe am Kontextlimit automatisch compact, behält was zum Weiterarbeiten nötig ist. Multi-Fenster-Workflows brauchen keine eigene Summarizer-Logik.
- Tool Search + programmierbare Aufrufe: Tool-Definitionen on demand laden, Token senken; programmierbare Aufrufe parallel, in Serie, Ergebnisse im Code filtern und nur relevante Fragmente zurück ins Kontextfenster. MCP, eigene Funktionen, eingebautes Web Search.
- Multi-Agent:
multi_agent.enabled+max_concurrent_subagents. Jeder Sub-Agent hält eigenen Kontext, der Haupt-Agent aggregiert. Gut für parallele Recherche, Analyse und Coding — ohne eigene Orchestrierung.
Das Harness ist Open Source; die Hosted-Version steigt mit dem Modell. Neue Modellfähigkeiten heißen oft nur: Modell-ID anheben, Orchestrierung nicht neu schreiben. Das ist die Engineering-Story, die am DevDay zählt: Der Wettbewerb wandert von „wer hat die längere Prompt-Kette“ zu „wessen Harness dem Modell folgt“.
Hosted Sandbox: so nutzen Sie openai_hosted
Die OpenAI hosted sandbox gibt Ihnen einen Linux-Workspace: Python, Node.js, CLI-Tools dabei. OpenAI richtet Zugang und Anbindung ein; Sie geben die Aufgabe, holen das Ergebnis. Arbeitsverzeichnis ist /workspace. Dateien, Wrapper, Skills, Plugins lassen sich einhängen; env setzt String-Variablen, überschreibt aber keine reservierten Runtime-Namen.
Netz ist standardmäßig aufgabenbezogen eng. In Doku-Beispielen oft network.access: "disabled" — Script zuerst offline durchziehen, Netz erst bei Bedarf öffnen. Eigenes Image, CPU / GPU / RAM-Specs, VPC oder privater Key-Store: auf self_hosted oder Partnerumgebung wechseln, die Hosted-Sandbox nicht verbiegen.
- Sie brauchen
xcodebuild, iOS-Simulator, Signing, TestFlight — die Hosted-Sandbox ist Linux, kein macOS - Code oder Schlüssel dürfen Ihre VPC nicht verlassen
- GPU-Training / Rendering, oder Cold-Start und RAM-Stufen passen nicht zur offiziellen Containertabelle
- Sie teilen DerivedData, Zertifikate, private Package-Quellen mit bestehendem CI
Container zum Standardpreis von Hosted Shell / Code Interpreter: 1 / 4 / 16 / 64 GB etwa $0.03 / $0.12 / $0.48 / $1.92, je 20 Minuten, je Container. Qualifizierte Sessions können minutenweise laufen, Minimum 5 Minuten pro Session. Modell-Token extra. Eine Stunde Leerlauf kann teurer werden als die „kostenlose Sandbox“, die Sie im Kopf hatten.
Codex: Notizen über Fenster und Computer Use
Mit Astra hat OpenAI das Codex-Harness mitgezogen. Lange Sessions verdichteten die Arbeit bisher per Compaction zu einer Zusammenfassung — Ursachen fehlgeschlagener Fixes und Komponentenverhalten gingen verloren. Astra kann über mehrere Kontextfenster Notizen halten; alte Fenster bleiben für Anforderungen und Testergebnisse durchsuchbar. Der Experiment-Schalter sitzt in der Codex-config.toml; offiziell wird das in den nächsten Wochen Astra-Default.
Der Codex-Satz, den Sie am 29. hören sollten: Sind Notizen standardmäßig an, welche CLI-Mindestversion, synct Desktop? Eine alte CLI versteckt Astra — schon einmal brauchte es 0.153.0, bis das Modell sichtbar wurde.
Computer Use plus Hosted Shell plus Apply Patch: in einer Session Dateien ändern, Befehle laufen, den Bildschirm sehen. Für iOS- / macOS-Entwickler macht die Linux-Sandbox Scripts und Frontend; die echte Toolchain braucht einen Mac, der nicht abreißt. Das Modell denkt in der Cloud, xcodebuild muss auf macOS abnehmen.
API-Preise: Astra, Sol, Container
Unten die Dollar pro Million Token der Preisseite am Stichtag. Tool-Aufrufe (Search, Computer Use usw.) extra. Die Agents API hat keine dritte „Plattformgebühr“.
| Position | Input | Cached Input | Cache Write | Output |
|---|---|---|---|---|
| gpt-6-astra · kurzer Kontext | $10 | $1 | $12.50 | $50 |
| gpt-6-astra · langer Kontext (>272K) | $20 | $2 | $25 | $75 |
| gpt-5.6-sol · kurzer Kontext (Aktion bis 11/21) | $4 | $0.40 | $5 | $20 |
| gpt-5.6-terra / luna · kurzer Kontext | $2 / $0.20 | $0.20 / $0.02 | $2.50 / $0.25 | $12 / $1.20 |
| Hosted-Container 1 / 4 / 16 / 64 GB | $0.03 / $0.12 / $0.48 / $1.92 je 20 Minuten (Minimum 5 Minuten) | |||
- 272K ist ein Ganzauftrag-Schalter. Ein Input über der Linie macht die ganze Anfrage Long-Context — nicht nur den Überschuss.
- Agents-Schleifen mal Runden. Haupt-Agent + 3 Sub-Agents ist nicht der Preis „einer Nachricht“.
- Container nach Sessiondauer. Über-Nacht-Leerlauf füllt zuerst die 5-Minuten-Mindestzeit, dann Minuten.
- Fast verdoppelt die Modellrechnung. Für interaktives Warten okay; Batches und Evals mit Standard oder Batch / Flex.
- ChatGPT-Abo-Kontingent ≠ API-Stückpreis. Plus nutzt Astra in Work / Codex ohne $10/$50-Rechnung, verbraucht aber Kontingent nach „wie viel Arbeit“.
Grobrechnung: 1 Million Input + 100.000 Output, Sol-Aktion etwa $6, Astra Standard etwa $15, Fast Astra etwa $30. Dann mal Agent-Runden und Container. Das vollständigere Gerüst „API vs. Cloud-Host vs. lokal“ steht in 2026 AI-Agent-Rechenleistung günstiger kaufen? Cloud, API und lokal im Vergleich und LLM-Preise, Config, Performance & Zielgruppen 2026—komplett erklärt.
Fünf Dinge, die Sie am 29. beobachten sollten
Eine vollständige DevDay-Produktliste gibt es noch nicht. Unten sind Regler, die schon in der Doku stehen und am Tag selbst gebündelt oder erweitert werden könnten — keine Leaks.
- Agents API Public Beta → GA? SLA-Sprache, ZDR / Datenresidenz, Rate Limits, GA-Datum. Verträge können heute nur Beta tragen.
- Werden Codex-Notizen über Fenster Default? Wird das Astra-Standard, ändern sich Harness-Annahmen für lange Refactors: weniger „jedes Mal eine Zusammenfassung pressen“.
- Preis und Kontingent. Astras $10/$50, der 272K-Schalter, Sol-Aktionsende, ChatGPT Work / Codex-Kontingent. Historisch ändert DevDay in der Keynote oft eine Preisstufe oder legt Fast nach.
- Hosted-Sandbox-Specs und Partner. Mehr RAM, kürzerer Cold-Start, GPU oder neue VPC-Partner ändern direkt, was Sie
openai_hostedübergeben können. - ChatGPT-Oberflächen. Sieht Plus GPT-6 Pro im normalen Chat? Bleibt Enterprise standardmäßig aus? Ändert sich der Einstieg, muss die interne Schulung noch am selben Tag mit.
Erwarten Sie am 29. kein GPT-7. Wahrscheinlicher: das Viererteam vom frühen September zu einer Entwicklergeschichte „Modell → Sandbox → Orchestrierung“ zusammenziehen und zwei, drei Schalter nachziehen.
Was Entwickler vor dem Event vorbereiten
- Minimale Agents-Session durchziehen. Astra +
openai_hosted+ eine Aufgabe, die Dateien schreibt und Befehle ausführt. Im Livestream „was sie zeigen“ gegen „was Ihr Konto schon kann“ halten. - Eine Eval-Suite einfrieren. Dasselbe Repo, dieselben Tests, dasselbe Timeout — Sol vs. Astra vs. Ihr heutiges Claude- / Gemini-Routing. Modellwechsel nicht auf dem Alltagsrechner.
- Rechnung in drei Zeilen. Modell-Token, eingebaute Tools, Container. Ohne die drei Zeilen passt kein DevDay-„günstiger“ auf Ihre Rechnung.
- Codex CLI / Desktop aktualisieren. Alte Clients verstecken Modelle. Notizen-Experiment vorher in
config.tomlan, damit Sie am 29. Default-Verhalten vergleichen können. - Linux-Sandbox und macOS-Abnahme trennen. Scripts, Frontend, Datenanalyse in die Hosted Sandbox;
xcodebuild, Simulator, Signing auf Cloud Mac oder lokal. - Default-Routing nicht für die Keynote ändern. Produktions-
modelerst 24 Stunden später, wenn die Doku steht. Aliase aus der Rede brauchen oft eine Nacht, bis sie auf der Modellseite stehen.
Warum lange Agents auf einem Cloud Mac landen
Die Agents API löst Orchestrierung; Hosted Sandbox löst allgemeine Linux-Ausführung. Apple-Entwicklern fehlt die dritte Schicht: Session darf nicht reißen, echte macOS-Toolchain, genug Platte und RAM, am besten dieselbe Maschine wie CI.
- Kein Einschlafen: stundenlange, über-nächtige Jobs überleben Laptop-Sleep nicht. Desktop-Work kann Kontext in die Cloud spiegeln, aber
xcodebuildund Simulator nehmen nur auf dem Mac ab. - Echte Toolchain: Apply Patch ändert Swift — Tests müssen auf derselben Maschine laufen; GitHub-hosted macOS-Cold-Starts ziehen die Agent-Schleife in die Länge.
- Vergleichende Evals: Astra vs. Sol vs. Fable 5 parallel auf denselben Scripts — lokale GPU- / RAM-Geschichten platzen zuerst.
- Arbeitsteilung mit openai_hosted: allgemeine Scripts, Daten, Frontend-QA in die Hosted-Sandbox; iOS- / macOS-Builds, Zertifikate, DerivedData auf den Cloud Mac. Eine Umgebung darf nicht so tun, als könne sie alles.
Die Modell-ID wechselt nächstes Jahr vielleicht wieder, Host und Workflow müssen Sie nicht umwerfen. Codex- / Agent-Schleifen auf einen Vuncloud Cloud Mac legen, der Laptop nur Diffs lesen — das ist 2026 die gemeinsame physische Schicht der Flaggschiff-Modelle, kein Anhängsel einer einzelnen Firma.
FAQ
Wann ist OpenAI DevDay 2026?
Dienstag, 29. September 2026, Fort Mason, San Francisco. Keynote gegen 10:00 Uhr, Sam Altman eröffnet, Livestream kostenlos. Vor-Ort-Anmeldung geschlossen.
Wird GPT-6 Astra an dem Tag vorgestellt?
Nicht als Premiere. Astra wurde am 3. September angekündigt, API am 4. September. Am 29. eher Kapazität, Codex-Defaults und Agents-Integration.
Kann man die Agents API schon nutzen? Was kostet sie?
Ja, Public Beta seit 10. September. Kein Schnittstellenaufpreis; Modell-Token, Tools und Container. Astra Standard, kurzer Kontext $10 / $50 (pro Million Token).
Was ist Hosted Sandbox?
Ein von OpenAI gehosteter Linux-Workspace, environment.type = openai_hosted. Python, Node und CLI, Verzeichnis /workspace. Eigenes Image, GPU oder privates Netz: self_hosted oder Partner.
Wie hängen Codex und die Agents API zusammen?
Die Agents API macht das Open-Source-Codex-Harness zur gehosteten API. Lokale CLI / Desktop bleiben separat; API-Seite betreibt OpenAI dieselbe Orchestrierung.
Worauf am 29. achten?
Agents-GA, Codex-Notizen als Default, Preis und Kontingent, Sandbox-Specs / Partner, ChatGPT-Einstiege. Vollständige Liste: Website und Doku des Tages.
Fazit
Drei Sätze zum Schluss: Der 29. ist ein Bündelungstag, kein Astra-Geburtstag; Agents API + Hosted Sandbox schließen den Minimal-Kreis schon; Default-Routing bleibt Sol, harte Fälle eskalieren. Eval-Suite, Drei-Zeilen-Rechnung und Codex-Client vorher bereitlegen — dann hören Sie im Livestream, welcher Regler sich bewegt.
Modellnamen wechseln weiter. Was Sie wirklich vorbereiten sollten, ist eine Ausführungsumgebung, die nicht abreißt — und eine Eskalationsregel, die klar aufgeschrieben ist.
Agent über Nacht am Repo? Dafür braucht es einen Mac, der nicht einschläft
Linux-Sandbox für Scripts, Cloud Mac für xcodebuild. Lange Codex- / Agents-Sessions in tmux, DerivedData bleibt, der Laptop liest nur Diffs.
Weiterlesen
- Was ist GPT-6 Astra? Funktionen, Preise, API, Veröffentlichungsdatum und Nutzung in ChatGPT
- 2026 AI-Agent-Rechenleistung günstiger kaufen? Cloud, API und lokal im Vergleich
- LLM-Preise, Config, Performance & Zielgruppen 2026—komplett erklärt
- Codex-Wochenlimit erreicht? 7 Fixes, Kontingent-Mechanik & alternative APIs (2026)
- Beste KI-Coding-Tools 2026 im Ranking: Claude, Cursor, GitHub Copilot, Codex, Gemini