Vuncloud Blog
← Zurück zu den Entwicklernotizen

Was ist GPT-6 Astra? Funktionen, Preise, API, Veröffentlichungsdatum und Nutzung in ChatGPT

GPT-6 Astra · gpt-6-astra · $10 / $50 · ChatGPT Work / Codexca. 13 Min. Lesezeit

Laptop mit geöffnetem KI-Code-Editor — Workflow für GPT-6 Astra, ChatGPT Codex und die API
TL;DR · Vier Sätze zuerst
  • GPT-6 Astra ist OpenAIs Flaggschiff-Reasoning-Modell vom 3. September 2026, gebaut für die härtesten End-to-End-Jobs: komplexes Reasoning, Coding, Computer Use, Research und lange Dokumente
  • Die API-Modell-ID ist gpt-6-astra, live seit dem 4. September; Standardpreis Input $10 / Output $50 (pro Million Token); die kostenlose API-Stufe unterstützt es nicht
  • ChatGPT Plus legt Astra nicht in den normalen Chat-Wähler; der Einstieg sitzt in Work und Codex. GPT-6 Pro im Standard-Chat ist für Pro / Business / Enterprise
  • Es ist rund 2,5× teurer als GPT-5.6 Sol. Den Alltagstakt weiter über Sol fahren; harte Fälle, lange Agenten und Computer Use eskalieren. Lange Läufe brauchen einen Cloud Mac, der nicht einschläft

OpenAI hat am 3. September 2026 GPT-6 Astra vorgestellt und am Folgetag das API-Modell gpt-6-astra in die Entwicklerdoku gelegt. Der offizielle Satz: «Unser stärkstes Modell, gebaut für die härtesten End-to-End-Arbeiten.» Was Entwickler wirklich brauchen, ist keine Slogan-Folie, sondern: wo es sich von GPT-5.6 Sol unterscheidet, was es kostet, welcher ChatGPT-Einstieg klickbar ist und ob das Default-Routing umgestellt werden soll.

Dieser Text folgt der OpenAI-Modellseite, der Preisseite und dem ChatGPT Help Center. Preise und Einstiege gelten für die sichtbare Doku vom 8. September 2026. Solange der Rollout läuft, zählt der Modellwähler im Produkt.

9/3–9/4
Ankündigung / API live (2026)
$10 / $50
Standard, kurzer Kontext (pro Million Token)
1.05M
Kontextfenster · Output-Limit 128K

Was ist GPT-6 Astra

GPT-6 Astra ist OpenAIs öffentlich stärkstes Text-Flaggschiff — kein weiteres «etwas flüssigeres» Chat-Modell. Die Doku setzt es auf die härtesten End-to-End-Jobs: komplexes Reasoning, Software Engineering, Computer Use, Research und Dokumentenarbeit. Input sind Text und Bild, Output ist Text; Audio und Video gehören nicht zu den Modalitäten.

Gegenüber der vorherigen Stufe GPT-5.6 Sol sitzt der Sprung in Taskdauer und Tool-Schleife: Astra soll Repo-Coding, Desktop-Bedienung, Recherche und Schreiben in einer Anfrage durchziehen, statt dass Sie alle zwei Minuten «Weiter» klicken. Das liegt auf derselben Branchenlinie wie Claude Fable 5, das lange Agenten in den Vordergrund rückt — der Wettbewerb wandert von der Einzelantwort zum unbeaufsichtigten Fertigmachen.

Der Knowledge Cutoff steht offiziell auf dem 30. April 2026. Brauchen Sie neuere Fakten, gehen Sie über Web search und ähnliche Tools — gehen Sie nicht davon aus, dass es die Welt nach Mai kennt.

Veröffentlichungsdatum und Rollout

Datum (2026) Was passiert ist Was Sie nutzen können
3. September OpenAI kündigt GPT-6 Astra an Daybreak-Vertrauenskunden sehen es zuerst; das Help Center spricht von «den nächsten Tagen» für bezahlte Tarife
4. September API-Modell gpt-6-astra geht live Bezahlte API-Konten können aufrufen; die Free-Stufe ist ausdrücklich ausgeschlossen
Ab 4. September ChatGPT Plus / Business rollen in Work und Codex aus Der normale Chat-Wähler bleibt für Plus nicht der Astra-Haupteinstieg
Redaktionsschluss (8. September) Der Rollout läuft weiter Dasselbe Konto kann auf verschiedenen Surfaces asynchron sein; Enterprise ist standardmäßig aus

OpenAI erwähnt außerdem eine spätere Bereitstellung über Azure und AWS Bedrock. Solange die Marketplace-Einträge fehlen, sollten Produktionsrouten diese IDs nicht fest verdrahten. Auf der Codex-Seite läuft parallel das Experiment «Notizen über mehrere Kontextfenster»: lange Sessions werden nicht jedes Mal zu einer Zusammenfassung gequetscht, ältere Fenster bleiben durchsuchbar. Das ist ein Produktsignal für Coding-Langstrecken, kein SLA.

Funktionen: Reasoning-Stufen, Tools und Computer Use

Die Fähigkeitsliste von Astra lässt sich auf drei Schichten pressen: tiefer denken, Tools bedienen, langen Kontext halten.

  • Reasoning-Stufen: reasoning.effort kennt low, medium, high, xhigh, max. Gateways defaulten oft auf low. Schwere Fälle hochstufen — nicht jeden Request auf max drehen.
  • Specs: rund 1,05 Millionen Token Kontext, höchstens 128.000 Output-Token. Sehr lange Prompts lösen die Aufschlagsregel im nächsten Abschnitt aus.
  • Struktur: Streaming, Function Calling und Structured Outputs gehen; Fine-Tuning gibt es nicht.
  • Responses-API-Tools: Web search, File search, Image Generation, Code interpreter, Hosted shell, Apply patch, Skills, Computer Use, MCP, Tool search.

Für iOS- und macOS-Entwickler ist das Neue Computer Use + Hosted shell + Apply patch in einer Session: Dateien ändern, Befehle fahren, Ergebnis sehen. Sobald das Modell stärker wird, rutscht der Engpass sofort zur Ausführungsumgebung, die mittendrin einschläft — Laptop zu, Agent tot.

OpenAI hat eigene Scores genannt (ohne einheitliche Drittprüfung): Terminal-Bench 4 etwa 57,7, DeepSWE etwa 74,1, GPQA etwa 96,0, BrowseComp etwa 91,5. Das sind Richtungssignale, keine Abnahmeklausel im Vertrag. Wie beim Ranking der Coding-Tools von Anthropic & Co.: Benchmarks sagen «härtere Repos sind knackbar», nicht «Ihr Monorepo merget über Nacht».

Entwickler prüft Code an der Tastatur — lange Coding-Jobs über GPT-6 Astra API und Codex

Zuordnung zu GPT-5.6 und GPT-6 Pro

Im September-Schub verheddern sich die Namen am leichtesten. Astra ist das Flaggschiff darunter; GPT-6 Pro ist der Produktname auf der Chat-Surface.

Was die UI zeigt Tatsächliches Modell Wer es nutzen kann
GPT-6 Astra Das Flaggschiff selbst API; ChatGPT Work / Codex (bezahlte Tarife im Rollout)
GPT-6 Pro Chat-Hochstufe, angetrieben von Astra Standard-Chat für Pro, Business, Enterprise
GPT-5.6 Sol Die Arbeitspferd-Stufe davor Default im bezahlten Chat; in der API weiter der Hochfrequenz-Alltag
GPT-5.6 Terra / Luna Mittel / leicht Work, Codex, API; im normalen Chat meist nicht wählbar. Free und Go sehen oft Luna

Wenn Plus-Nutzer Astra im normalen Dialog nicht finden, heißt das nicht «nicht freigeschaltet». OpenAI legt Plus-Astra in Work (Arbeit erledigen) und Codex (Code schreiben) und behält GPT-6 Pro im Standard-Chat den höheren Tarifen vor. Enterprise-Workspaces sind standardmäßig aus; ein Admin muss die Modellrechte öffnen.

API: Modell-ID, Endpunkte und Aufrufdetails

Die stabile ID für die Config ist gpt-6-astra. Snapshot-Aliase zeigen derzeit auf dieselbe Zeichenkette; wer eine Version festnageln will, schaut in die Snapshots-Tabelle auf der Modellseite — keine selbst erfundenen Datums-Suffixe.

Die Doku nennt als Hauptendpunkte Chat Completions (v1/chat/completions) und Responses (v1/responses). Tool-Schleifen, Computer Use und MCP laufen über Responses. Free-Tier RPM/TPM steht auf «nicht unterstützt»; Kontingent gibt es ab Tier 1 und steigt mit der Nutzungsstufe.

Minimale Aufrufform (Responses)

Setzen Sie model auf gpt-6-astra und steuern Sie die Denktiefe mit reasoning.effort. Default low zum Routen-Test, dann high / xhigh, wenn die Aufgabe es wert ist. Search, Computer Use und andere Tools werden extra abgerechnet — schauen Sie nicht nur auf den Token-Stückpreis.

const response = await client.responses.create({
  model: "gpt-6-astra",
  reasoning: { effort: "high" },
  input: "Finde im Repository das Payment-Timeout, liefere den kleinsten Fix-Diff und nenne den Verifikationsbefehl."
});

Produktionsrat: Sol bleibt die Default-Schleife, Astra die Eskalation. Auslöser über Eval-Scores oder Stichproben, nicht jeder Nutzersatz auf max. Modellwechsel brauchen dasselbe Harness — dasselbe Prinzip wie im LLM-Preis- und Performance-Vergleich.

Preise: Standard, Cache, Long Context, Fast / Batch

Die folgenden Zahlen stammen von der OpenAI-Preisseite am Redaktionstag: US-Dollar pro Million Token. Tool-Aufrufe (Search, Computer Use usw.) kommen extra.

Stufe Input Cached Input Cache Write Output
Astra Standard · kurzer Kontext $10 $1 $12.50 $50
Astra Standard · Long Context (>272K Input) $20 $2 $25 $75
Astra Batch / Flex 50% des Standardpreises
Astra Fast 2× der geltenden Stufe (offiziell etwa 2,5× Tempo)
GPT-5.6 Sol Promo (mindestens bis 21. November) $4 $0.40 $5 $20
Abrechnungsfallen (die den Etat härter treffen als der Stückpreis)
  • 272K ist ein Ganzauftrags-Schalter. Überschreitet der Input die Linie, gilt der Long-Context-Preis für die ganze Anfrage — nicht nur für den Überhang.
  • Cache Write kostet 1,25× uncached Input. Das erste Befüllen mit einem großen Repo ist nicht billig; der $1-Tarif gilt erst beim späteren Hit.
  • Fast verdoppelt die Rechnung. Für interaktives Warten vertretbar; Übernacht-Batches auf Standard oder Batch/Flex lassen.
  • ChatGPT-Abo-Kontingent ≠ API-Stückpreis. Die Sol-Promo senkt den metered Verbrauch, schenkt Plus keine Extra-Nachrichten.

Grobrechnung: dieselben 1 Mio. Input + 100k Output kosten in der Sol-Promo etwa $6, Astra Standard etwa $15, Fast Astra etwa $30. Agent-Schleifen multiplizieren mit den Runden. Den vollständigeren Rahmen «API vs. Cloud-Host vs. lokal» finden Sie im aktuellen Vergleich der AI-Agent-Rechenkosten.

ChatGPT-Nutzung (nach Tarif)

Am Launch-Tag war die häufigste Verwirrung: «Offiziell kann Plus das — warum fehlt es im Chat?» Die Antwort ist eine andere Surface, kein kaputtes Konto.

Plus: über Work und Codex

  1. Öffnen Sie die ChatGPT-Desktop-App (Work im Web / Mobil läuft in der Cloud; Codex ist vor allem Desktop).
  2. Oben links von Chat auf Work wechseln oder die Codex-Ansicht öffnen.
  3. Im Modellumschalter dieser Surface GPT-6 Astra wählen.
  4. CLI-Nutzer bringen die Codex CLI auf 0.153.0 oder höher und aktualisieren Desktop. Alte CLIs verstecken Astra einfach.

Work- und Codex-Kontingente werden vom normalen Chat getrennt gezählt. Lange Jobs zählen nach «wie viel Arbeit erledigt wurde», nicht nach «wie viele Nachrichten». Ist das Kontingent leer, auf Sol / Terra wechseln oder auf den Reset warten — Surface-Hopping füllt die Tasse nicht nach. Zum Umgang mit Wochenlimits siehe Codex-Wochenlimit erreicht.

Pro / Business / Enterprise

GPT-6 Pro (angetrieben von Astra) sitzt im Standard-Chat für Pro, Business und Enterprise. Das Pro-Nachrichtenkontingent von Business teilt sich mit GPT-5.6 Sol Pro; Hin- und Herschalten schenkt keine zweite Ration. Enterprise startet ausgeschaltet; der Workspace-Admin muss den Modellzugriff öffnen.

Free und Go: Im Standard-Chat bleibt GPT-5.6 Luna die erste Linie — kein Astra / GPT-6 Pro.

Wann auf Astra wechseln

  • Bei Sol bleiben: Alltags-Pairing, kurze Diffs, hochfrequente Tool-Schleifen, kostensensible Batch-Extraktion. Der Promo-Preis gilt mindestens bis 21. November — weiter das Default-Arbeitspferd.
  • Auf Astra eskalieren: modulübergreifendes Refactoring, selbst Tests fahren und nachbessern, Computer Use am Desktop, ein langes Dokument in einem Rutsch, forschendes Browsen. Budget in «Ingenieur-Tagen» rechnen, nicht in Chat-Nachrichten.
  • Nicht wegen des Namens eskalieren: Denselben Satz von Chat nach Work zu kopieren macht Plus nicht schlauer — es verbrennt nur schneller Kontingent.
  • Gegen Claude / Gemini dasselbe Harness halten: gleiches Repo, gleiche Tests, gleiches Timeout. Modell-Evals nicht auf dem Rechner fahren, der den Alltagscode trägt.

Warum lange Tasks auf einem Cloud Mac landen

Astras Computer Use, Hosted shell und lange Codex-Sessions stellen dieselben harten Anforderungen wie Fable 5: die Session darf nicht reißen, es braucht eine echte macOS-Toolchain, Platte und RAM müssen reichen, am besten dieselbe Maschine wie CI.

  • Kein Einschlafen: Stunden- und Übernachtjobs vertragen keinen Laptop-Sleep. Lokales Desktop-Work kann Kontext in die Cloud spiegeln, aber xcodebuild und Simulator akzeptieren nur auf dem Mac.
  • Echte Toolchain: Nach Apply patch an Swift müssen die Tests auf derselben Maschine laufen; ein kalter GitHub-hosted-macOS-Start zieht die Agent-Schleife in die Länge.
  • Vergleichende Evals: Astra vs. Sol vs. Fable 5 brauchen dieselben Skripte parallel — die GPU-/RAM-Geschichte auf dem Laptop knallt zuerst.

Die Modell-ID wechselt nächstes Jahr vielleicht wieder, Host und Workflow müssen Sie nicht umwerfen. Codex- / Agent-Schleifen auf einen Vuncloud Cloud Mac legen, der Laptop nur Diffs lesen — das ist 2026 die gemeinsame physische Schicht der Flaggschiff-Modelle, kein Anhängsel einer einzelnen Firma.

FAQ

Was ist GPT-6 Astra?

OpenAIs Flaggschiff-Reasoning-Modell vom 3. September 2026 für komplexes Reasoning, Coding, Computer Use, Research und lange Dokumente. API-ID: gpt-6-astra.

Wann wurde es veröffentlicht?

Ankündigung am 3. September, API am 4. September. ChatGPT-Tarife rollen surfaceweise; Help Center und Produktwähler gelten.

Was kostet die API?

Standard, kurzer Kontext: $10 Input / $1 Cached Input / $12.50 Cache Write / $50 Output (pro Million Token). Über 272K Input gilt der Long-Context-Preis für die ganze Anfrage. Batch/Flex halb, Fast doppelt. Free-API-Stufe nicht unterstützt.

Geht Plus?

Ja, aber in Work und Codex, nicht im normalen Chat-Wähler. GPT-6 Pro im Standard-Chat gehört zu den höheren Tarifen.

Sind Astra und GPT-6 Pro dasselbe?

Dasselbe Flaggschiff darunter. Chat zeigt GPT-6 Pro; Work, Codex und API nutzen Astra / gpt-6-astra.

Wie lang ist der Kontext?

Etwa 1,05 Millionen Token Kontext, höchstens 128.000 Output; Knowledge Cutoff 2026-04-30. Input über 272K wird teurer.

Fazit

Drei Sätze zum Schluss: Astra ist OpenAIs Flaggschiff vom September 2026; teuer ist die lange Tool-Schleife, nicht der Chat-Ton; Plus-Nutzer müssen nach Work / Codex, statt im normalen Chat zu warten. Default-Routing bleibt bei Sol, harte Fälle eskalieren. Rechnen Sie zuerst den 272K-Schalter und den Fast-Faktor, bevor Sie Repo-Jobs die ganze Nacht übergeben.

Modelle werden weiter umbenannt. Was Sie wirklich vorbereiten sollten, ist eine Ausführungsumgebung, die nicht abreißt — und eine Eskalationsregel, die klar aufgeschrieben ist.

Über Nacht am Repo? Astra braucht einen Mac, der nicht einschläft

Legen Sie Codex / Computer Use auf einen Cloud Mac: tmux-Langlauf, xcodebuild auf derselben Maschine, DerivedData bleibt. Der Laptop liest nur Diffs.

Tarife ansehen

Entwicklerjournal · GPT-6

Ein Flaggschiff-Modell braucht eine Flaggschiff-Umgebung

GPT-6 Astra · Codex · Computer Use · Cloud Mac

Tarife ansehen
Zeitlich begrenztes Angebot Tarife ansehen