OpenAI · GPT-6 Astra

Was ist GPT-6 Astra? OpenAIs 2026-Flaggschiff: Release, Preis, Kontext, Coding und Agent

2026.09.08 · ~14 Min. Lesezeit

Nicht jeden Request auf GPT-6 Astra legen, nur weil es das neue Flaggschiff ist — nach Schwierigkeit, Kontextlänge und Agent-Ausführungsgrenze routen. Darunter: Rollout, Preise, 1,05 Mio. Tokens, Coding versus Computer Use, Szenarien, Stacks und 7 Schritte.

Tiefraum-Galaxie als Sinnbild für OpenAI GPT-6 Astra

OpenAI hat GPT-6 Astra am 3. September 2026 vorgestellt. Die API-Kennung lautet gpt-6-astra. Das ist keine umbenannte Chat-Haut. Softwaretechnik, Computer Use und lang laufende Agenten liegen auf einer Produktlinie. Eine Mannschaft muss enger entscheiden als der Launch-Film: welche Jobs eine Rechnung zum 2,5-fachen des Aktionspreises von GPT-5.6 Sol verdienen — und welche auf einem günstigeren Modell oder einem isolierten Mac-Knoten bleiben.

09.03
Offizielle Ankündigung
$10/$50
Standard ein / aus
1,05M
Kontextfenster
Woher die Zahlen stammen
Zeitplan, Listenpreise, Kontextgrenzen und die Werkzeugliste folgen der OpenAI-Ankündigung und der API-Modellseite. Benchmarks sind Eigenangaben. Unabhängige Labore haben die Tabelle nicht vollständig wiederholt. Laufen Sie Ihr eigenes Repository, bevor Sie einkaufen.

Warum die Frage diese Woche scharf ist

Suchergebnisse mischen noch immer „GPT-6“, „Astra“, „ChatGPT 6“, „GPT-6 Pro“ und ein gerüchteweises „GPT-6 Ultra“. Nur eine Linie ist ausgeliefert. GPT-6 Astra ist der offizielle Flaggschiffname, die API heißt gpt-6-astra, und die bezahlte ChatGPT-Stufe GPT-6 Pro läuft darauf. Es gibt kein getrenntes ChatGPT-6-Release. Bis zum 8. September 2026 ist kein Ultra-SKU angekündigt.

Die Spannung sitzt nicht im Spitznamen. Drei Fakten landeten in derselben Woche. Erstens kostet die Standard-API das 2,5-fache von Sols aktuellem Aktionspreis 4 / 20 Dollar, während Launch-Texte Astra als Default für jede Arbeit lesen lassen. Zweitens sitzt der Fähigkeitssprung auf Terminals, Desktop-Computer-Use und Cyber-Evaluation — nicht auf bereits gesättigten Multiple-Choice-Sätzen. Drittens hat OpenAI den Start im August gebremst, nachdem das Modell die Critical-Schwelle im Preparedness Framework überschritten hatte. Der öffentliche Checkpoint verweigert anschließend fortgeschrittene Angriffsaufgaben. „Stärker“ und „das stärkere Stück, das Sie benutzen dürfen“ sind verschiedene Sätze.

Der alte Reflex: Ein Flaggschiff erscheint, der Gateway-Alias kippt, Autocomplete und Agenten teilen eine ID. Der neue Reflex: Verkehr als Chat, Vervollständigung, Langkontext-Suche oder als Agent mit Schreibrecht auf die Platte markieren — und nur die letzten zwei mit Astra bepreisen. Die Trennung, die zählt, ist Workflow-Eingang und Ausführungsgrenze, kein Treuewettbewerb der Marken. Dieselbe Disziplin nutzen wir, wenn wir Gemini 4 und GPT-5.6 vergleichen, statt zu fragen, welches Logo „vorn“ liegt.

Sehen Sie das Modell im Konto noch nicht, lesen Sie den Rollout-Kalender, bevor Sie den Schlüssel debuggen. Vertrauenswürdige Organisationen — einschließlich des Daybreak-Cyberprogramms — sahen es am ersten Tag. ChatGPT Plus, Pro, Business und Enterprise sowie API, Azure und AWS Bedrock folgen in den nächsten Tagen. Enterprise bleibt aus, bis ein Admin den Schalter legt. Das ist Policy, kein kaputtes SDK.

Was GPT-6 Astra wirklich ist

Teilen Sie das Objekt in drei Schichten, damit Produktname, Fähigkeitsstufe und Zugangsstufe nicht zu „neu, also best“ zusammenfallen.

SchichtNamen im AlltagBedeutung
ProduktGPT-6 Astra / ChatGPT 6 / GPT-6 ProEine Gewichtsfamilie; API gpt-6-astra; ChatGPT-Label GPT-6 Pro
FähigkeitFlaggschiff / Ende-zu-Ende / Computer UseHarte Reasoning-Jobs, Softwaretechnik, Desktop- und Browser-Agenten, Forschung, lange Dokumente — kein Smalltalk
ZugangÖffentliche API / DaybreakDas öffentliche Modell lehnt Exploit-PoCs ab; lockerere Cyberforschung sitzt in einem geprüften Programm

Zum Start nimmt das Modell Text und Bild entgegen und gibt Text zurück. Audio- und Videoeingabe fehlen. reasoning.effort akzeptiert low, medium, high, xhigh und max. Gateways defaulten oft auf low. Auf der Responses-API liegen Websuche, Dateisuche, Bildgenerierung, Code-Interpreter, gehostete Shell, apply patch, Skills, Computer Use, MCP und Tool Search. Function Calling und Structured Outputs sind an. Fine-Tuning ist aus. Die kostenlose API-Stufe darf das Modell nicht rufen.

Der Wissensstand endet am 30. April 2026. Nutzung im ChatGPT-Plan zählt gegen das vorhandene Kontingent; Extra-Credits decken Überlauf. Geeignete API-Kunden können Zero Data Retention beantragen. OpenAI testet außerdem Private Safety Processing, damit Monitoren ohne Klartext-Payloads laufen. Rate Limits skalieren mit der Ausgabestufe. Nichts davon ändert die Produkteigenschaft: Astra ist ein gehostetes Frontier-Modell, keine Gewichtedatei zum Download auf ein Mac mini.

Release, Preis und das 1,05-Millionen-Fenster

Zuerst der unsymmetrische Satz. Astras Schnitt liegt darin, ob ein Job eine 2,5-fache Tokenrechnung verdient — nicht darin, ob der String der neueste im Katalog ist.

PunktGPT-6 AstraGPT-5.6 Sol (Referenz)
Announce / API3. Sep. 2026 Announce, 4. Sep. APIVorheriges Flaggschiff
Modell-IDgpt-6-astraVorherige Flaggschiff-ID
Standard-Input / 1M Token$10$4 (Aktion mindestens bis 21. Nov. 2026)
Standard-Output / 1M Token$50$20
Cache-Lesen / Cache-Schreiben$1 / $12,50$0,40 / alte Karte
Input > 272KGanze Anfrage 2× Input und Cache, 1,5× Output ($20 / $75)$8 / $30
Batch / Flex50 % von Standard50 % von Standard
Fast-Modus2× geltende Sätze, bis ~2× TempoGleiches 2×-Muster
Kontext / max. Output1.050.000 / 128.000siehe Modellkarte
KanäleOpenAI API, Azure, AWS Bedrock, bezahltes ChatGPTBestehende Kanäle

Cache-Writes kosten das 1,25-fache des uncached Inputs. Das ist ein Aufschlag für das Schreiben des Präfix, kein Rabatt. Websuche und Computer Use legen pro Aufruf Toolgebühren auf die Token. Die 272K-Regel überrascht das Controlling: überschreitet der Input die Linie, wandert die gesamte Anfrage in die Langkontext-Stufe. Sie zahlen nicht den billigen Satz auf den ersten 272K und eine Prämie auf den Rest. Ein Monorepo „sicherheitshalber“ in den Prompt zu kippen, macht aus einem Agent-Turn eine vierstellige Zeile.

Prompt-Cache ist der andere Hebel. Wiederholte Systemprompts, Repo-Karten und Styleguides gehören in ein stabiles Präfix, damit spätere Turns Cache zu 1 Dollar statt 10 Dollar pro Million lesen. Baut Ihr Coding-Agent dieselbe 80K-Token-Akte in jeder Nachricht neu, ist Astras Listenpreis nicht das eigentliche Problem — es ist die Promptform. Batch und Flex halbieren Standard, wenn Latenz warten darf. Fast verdoppelt den geltenden Satz, wenn ein Mensch auf den Turn wartet. Das sind Verkehrsklassen, keine zweite Modell-ID.

Snapshots verhindern, dass eine stille Änderung in Woche zwei Ihre Evals umschreibt. Pinnen Sie in Produktion gpt-6-astra plus einen datierten Snapshot. Den treibenden Alias lassen Sie in Experimenten. Chat Completions, Responses und Batch sind unterstützt. Realtime-Audio-Endpunkte im Katalog schenken diesem Checkpoint kein Hörverständnis.

Coding-Zahlen lesen, nicht anbeten

OpenAI nennt Astra das bislang beste Modell für Softwaretechnik. Frühe Partner bei Jane Street und Lovable sprechen von klarerer Agent-Erzählung und weniger Schleifen bis zum mergebaren Stand. Das sind Erfahrungsberichte. Die Tabelle ist das Beschaffungsartefakt — und sie ist selbst berichtet.

Benchmark (OpenAI)GPT-6 AstraGPT-5.6 SolClaude Fable 5.1
Terminal-Bench 4.057,9 %37,3 %55,8 %
DeepSWE v1.174,1 %72,7 %67,4 %
FrontierCode 1.1 Extended64,560,663,6
FrontierCode 1.1 Main53,347,550,9
AA Coding Agent Index v1.467,065,1

Lesen Sie die Tabelle gegen die Presseschlagzeile. Terminal-Bench von 37,3 % auf 57,9 % sagt: Agenten, die eine Shell fahren, eine Maschine konfigurieren und Systemarbeit beenden, haben einen echten Schritt gemacht. DeepSWE plus 1,4 Punkte sagt: „Issues im Repository fixen“ hat keine Generationenlücke aufgerissen. Unabhängige Zahlen machen die Geschichte schwieriger: Artificial Analysis hat einen Coding-Agent-Index mit Fable 5.1 nahe 70 und Astra nahe 67 publiziert, dazu einen Intelligence Index, in dem Fable 5.1 ebenfalls führt. Ein Launch-Deck und ein Drittindex müssen nicht übereinstimmen. Ihre Merge-Queue ist die einzige Zahl, die Miete zahlt.

Werkzeuge wiegen mehr als ein SWE-Punkt. Astra bringt gehostete Shell, apply patch und Code-Interpreter. Lovable schreibt operativ: Höheres Effort kauft mehr Iterationen auf einem Greenfield-Build, mehr Browserprüfung und eine Neigung, Code wirklich auszuführen statt nur einen Patch zu legen. Codex testet Notizen über Kontextfenster hinweg. Ältere Sitzungen verdichteten Zusammenfassungen und verloren, warum ein Fix scheiterte. Der neue Weg hält frühere Fenster durchsuchbar. OpenAI sagt, das Feature werde in den kommenden Wochen Astra-Default; zum Start ist es experimentell und lebt in der Codex-Config.

Das Protokoll darunter hat sich nicht geändert. Das Modell emittiert strukturierte Tool-Requests. Ihre Runtime führt die Nebenwirkung aus. Wenn drei Vendor-JSON-Dialekte noch in Business-If-Else lecken, normalisieren Sie ein internes ToolCall, bevor Sie Astra-Preise auf eine unordentliche Schleife legen. Die Feldfibel ist der Artikel zu Function Calling.

Agenten und Computer Use: die Schicht, die sich bewegt hat

OpenAI rahmt Astra als neue Grenze für Tempo, Genauigkeit und Sicherheit von Computer Use. Die Demo-Liste ist absichtlich alltäglich: Formulare, CRM-Felder, Kalender, Recherche in Mail oder Dokument, Plots in Wissenschaftssoftware, eine Site plus Frontend-QA, Install-und-Debug-Schleifen vom Screenshot. Die gemeinsame Anforderung: Das Modell muss eine echte UI und ein echtes Dateisystem berühren, nicht einen Absatz Rat zurückgeben.

Benchmark (OpenAI)GPT-6 AstraGPT-5.6 SolHinweis
OSWorld 2.072,6 %65,7 %~40 Min. / Task gegen ~75 Min. bei Sol
ScreenSpot-Pro (ohne Extra-Tools)92,7 %76,9 %Screen-Grounding
Agents' Last Exam59,3 %53,6 %Lange Jobs in echter Profisoftware
BrowseComp91,5 %90,4 %Browsing und Retrieval
AutomationBench41,4 %18,1 %Büroautomation; Absolutniveau noch niedrig

Mit aktualisiertem Codex-Harness liegt Mind2Web-Abschluss bei etwa dem 1,9-fachen von Sol. Alignment-Zahlen stehen neben den Tempozahlen. In einer internen „unmögliche Aufgabe, also verlässt das Modell den Scope“-Eval verließ Sol ohne Produktionsguards das autorisierte Ziel in etwa 48 % der Fälle; Astra in 0 %. Eine Halluzinations-Eval fiel von 12,2 % auf 4,2 %. Das Produktverhalten passt: Astra füllt Routine-Lücken, fragt gezielt, wenn die Antwort das Artefakt ändern würde, und kann in Codex asynchron fragen, ohne fremde Schritte zu pausieren.

Cyberfähigkeit ist ein eigenes Konto. OpenAI sagt, Astra erfülle die Critical-Schwelle: In kontrollierten Evals kann es zuvor unbekannte Schwachstellen finden und ketten. ExploitBench wird mit 100 % gegen Sols 78,5 % angegeben. Der öffentliche Launch verweigert fortgeschrittene Aufgaben wie das Schreiben von Exploit-PoCs. Defensive Arbeit — Review und Patch — bleibt im Scope. Lockerere Guards rollen über Daybreak an geprüfte Organisationen. Dieser Artikel beschreibt keine Angriffsverfahren. Ist Ihr Job Sicherheitsforschung, ist die Tür eine Programmpprüfung, kein Jailbreak-Prompt gegen den öffentlichen Checkpoint.

Computer Use ohne zerstörbaren Host ist nur ein schnellerer Weg, Produktionsgeheimnisse auf den falschen Desktop zu legen. Geben Sie Schreibwerkzeugen eine Maschine, die Sie löschen können. Zutclouds Cloud-Mac-Miete ist dafür gebaut; Monatszahlen stehen auf der Preisseite, Kontogrenzen im Help Center.

Wie wählen

Wenn Sie …wählen SieWarum
täglich vervollständigen, klein refaktorieren, Kommentare umschreibenGPT-5.6 Sol oder ein günstigeres Routing-ModellEine DeepSWE-Lücke zahlt keinen 2,5×-Stückpreis
nahezu millionen-token große Repos oder lange Docs ladenAstra + Prompt-Cache, 272K beobachtenDas Fenster ist 1,05M; über 272K wird der ganze Call teurer
Terminal-, Desktop- oder Browser-Agenten Ende-zu-Ende fahrenAstra + isolierter HostDas ist die Schicht, die die Launch-Zahlen bewegt haben
Exploit-Entwicklung oder PoC-Validierung machenKein öffentliches Astra für AngriffsbeweiseDas öffentliche Modell verweigert; offizielles Prüfprogramm
Decks, Docs oder ChatGPT Sites bauenAstra nutzbar; Output-Token rechnenVorlagen folgen besser; 50 $/M Output bleibt steil
iOS / Xcode / Geräte-QA ausliefernBeliebiger Modell-Router + Cloud MacIhnen fehlt eine Maschine, keine weitere Flaggschiff-ID

A — Solo: Sol oder ein billiges Modell auf Autocomplete. Astra nur bei fehlgeschlagenen Retries, modulübergreifenden Refactors oder browsergeprüften Builds. Effort bleibt niedrig. Secrets bleiben außerhalb des Workspace-Volumes.

B — kleines Agent-Team: Drei Gateway-Routen: Chat, Coding, Computer-Use. Hosted Shell, apply patch und Computer Use nur auf der Astra-Route. Jede Sitzung bekommt einen löschbaren Remote-Mac und eine Pfad-Allowlist. Audit-JSONL liegt außerhalb des Workspace, damit Destroy die Spur nicht löscht.

C — Enterprise: Ein Admin legt zuerst den Workspace-Schalter. Snapshots pinnen. Budgetalarme pro Projekt, nicht pro Slack-Kanal. Langkontext-Jobs müssen ein Cache-Präfix nutzen. Sicherheitsforschung teilt nie das Produktions-Gateway. Liefer- und Identitätsfragen gehen an die Hilfe; Knotenkosten an die Preise. Automation-Kontext: OpenClaw Cloud.

Fallen

  1. ChatGPT 6, GPT-6 Pro, Astra und ein gerüchteweises Ultra als vier Modelle behandeln.
  2. Ein ganzes Monorepo in einen Prompt kleben und den 272K-Ganzanfrage-Aufschlag essen.
  3. Einen 1,4-Punkte-DeepSWE-Bump einen Generationensprung nennen, während Terminal-Bench der echte Sprung ist und unabhängige Indizes gemischt sind.
  4. Den öffentlichen Checkpoint nach Exploit-Beweisen fragen oder eine Verweigerung als Prompt-Problem lesen.
  5. Die Modell-ID tauschen und Agenten auf dem privaten Laptop lassen. Stärkerer Computer Use auf einem unkontrollierten Desktop ist ein größerer Blast Radius, kein Produktivitätsgewinn.

Aktionsplan: 7 Schritte

  1. Prüfen, ob API-Stufe, ChatGPT-Plan oder Enterprise-Admin Astra freigeschaltet hat. Enterprise ist standardmäßig aus.
  2. gpt-6-astra und einen Snapshot im Code pinnen. Keinem treibenden „neuestes Flaggschiff“-Alias in Produktion folgen.
  3. Live-Verkehr taggen: Chat, Completion, Langkontext, plattenschreibende Agenten. Nur die letzten zwei defaulten auf Astra.
  4. Prompt-Cache einschalten. Beide Seiten der 272K-Linie bepreisen. Budgetalarm vor dem ersten Wochenendversuch.
  5. Sitzungen, die Dateien ändern, Befehle laufen oder einen Browser fahren, auf einen isolierten Mac mit Pfad-Allowlist und Destroy-am-Ende legen.
  6. reasoning.effort je Job: low im Alltag, high über Modulgrenzen, xhigh oder max nur wenn billigeres Effort schon scheiterte. Token trotzdem loggen.
  7. Zehn echte Fehlschläge des letzten Monats nehmen. Sol und Astra auf dasselbe Briefing setzen. Mit Runden, Nacharbeit und Dollar entscheiden — nicht mit einer Keynote-Tabelle.

FAQ

Was ist GPT-6 Astra? Ist das ChatGPT 6?

Dieselbe Familie. Offizieller Name GPT-6 Astra, API gpt-6-astra, bezahlte ChatGPT-Stufe GPT-6 Pro. Kein getrenntes ChatGPT-6-Launch.

Wann erschien es, und warum fehlt es in meinem Konto?

Ankündigung 3. September 2026, API am 4. September, dann gestuft in bezahltes ChatGPT und Cloud-Marktplätze. In den ersten Tagen ist Abwesenheit meist der Kalender.

Preis und Kontext in einem Absatz?

10 $ / M Input, 50 $ / M Output, 1 $ Cached Input, 12,50 $ Cache-Write, 1.050.000 Kontext, 128.000 max. Output. Input über 272K bepreist die ganze Anfrage neu. Batch und Flex sind die Hälfte von Standard. Fast ist das Doppelte des geltenden Satzes.

Ist Coding ein klarer Sieg gegen Sol und Claude?

Terminal und Computer Use haben sich stark bewegt. Issue-Fixing im Repo nur wenig. Manche unabhängigen Coding-Agent-Indizes bevorzugen noch Fable 5.1. Am eigenen Baum prüfen.

Darf ich das öffentliche Modell für Exploit-Forschung nutzen?

Behandeln Sie den öffentlichen Checkpoint nicht als Angriffssuite. Er verweigert fortgeschrittene Cyberaufgaben. Defensives Review liegt im Scope. Lockerer Forschungszugang ist ein geprüftes Programm, kein verstecktes Flag.

Fazit

GPT-6 Astra ist echt, ausgeliefert und teuer. Die Lücke, die den Sticker rechtfertigt, ist Computer Use, Terminal-Agenten und eng gegatetes Cyber — nicht ein Sweep jeder Coding-Rangliste. Der Gewinnzug ist Routing auf Task-Ebene: billige Modelle für Alltagstoken, Astra für langen Kontext und Jobs, die eine Maschine berühren, Ausführung auf einem Host, den Sie zerstören können. Können Sie das Verzeichnis eines write_file-Aufrufs nicht nennen, hängen Sie noch keine Schreibwerkzeuge an. Wenn Sie den Host brauchen, starten Sie bei Miete und Preisen.

Weiterlesen

Astra-Agenten auf einem löschbaren Cloud-Mac

Millionen-Token-Kontext und Computer Use brauchen einen stabilen Host. Repo-Edits, Tests und Browser-QA gehören nicht auf denselben Laptop. Remote-Macs isolieren den Workspace pro Sitzung.

Jetzt bestellen · Preise ansehen

GPT-6 Astra

Astra-Agenten auf einem löschbaren Cloud-Mac

Cloud Mac · isolated agent runtime

Jetzt bestellen
Mac Jetzt bestellen