OpenAI · GPT-6 Astra

Qu’est-ce que GPT-6 Astra ? Date de sortie, prix, contexte, Coding et Agent du flagship OpenAI 2026

2026.09.08 · ~14 min de lecture

Ne routez pas tout vers GPT-6 Astra parce que c’est le nouveau flagship — routez selon la difficulté, la longueur de contexte et la frontière d’exécution de l’agent. Ci-dessous : accès, tarifs, fenêtre 1,05 M, coding vs computer use, matrice, stacks et 7 étapes.

Galaxie en espace lointain, symbole de GPT-6 Astra

OpenAI a publié GPT-6 Astra le 3 septembre 2026. L’identifiant API est gpt-6-astra. Ce n’est pas un chat renommé. L’ingénierie logicielle, l’usage de l’ordinateur et les agents de long horizon tiennent sur une même ligne produit. La décision d’équipe est plus étroite que le film de lancement : quels travaux justifient une facture 2,5× le tarif promotionnel de GPT-5.6 Sol, et lesquels restent sur un modèle moins cher ou un nœud Mac isolé.

09.03
Annonce officielle
10 $/50 $
Entrée / sortie standard
1,05 M
Fenêtre de contexte
D’où viennent les chiffres
Calendrier, prix catalogue, limites de contexte et liste d’outils suivent l’annonce OpenAI et la page modèle API. Les benchmarks sont autodéclarés. Les laboratoires indépendants n’ont pas entièrement reproduit le tableau. Faites tourner votre dépôt avant un achat.

Pourquoi la question est vive cette semaine

Les résultats de recherche mélangent encore « GPT-6 », « Astra », « ChatGPT 6 », « GPT-6 Pro » et un « GPT-6 Ultra » de rumeur. Une seule ligne a été livrée. GPT-6 Astra est le nom officiel du flagship, l’API s’appelle gpt-6-astra, et l’offre payante ChatGPT GPT-6 Pro s’appuie dessus. Il n’existe pas de sortie ChatGPT 6 séparée. Au 8 septembre 2026, aucun SKU Ultra n’est annoncé.

La tension n’est pas le surnom. Trois faits sont arrivés la même semaine. D’abord, l’API standard vaut 2,5× le tarif promotionnel actuel de Sol (4 / 20 $), alors que les textes de lancement invitent à traiter Astra comme défaut pour tout travail. Ensuite, le saut de capacité se concentre sur le terminal, l’usage ordinateur de bureau et l’évaluation cyber — pas sur des QCM déjà saturés. Enfin, OpenAI a ralenti le lancement en août après le franchissement du seuil Critical du Preparedness Framework. Le checkpoint public refuse ensuite les tâches d’attaque avancées. « Plus fort » et « la tranche plus forte que vous avez le droit d’utiliser » sont deux phrases.

L’ancien réflexe : un flagship apparaît, l’alias de passerelle bascule, l’autocomplétion et les agents partagent un id. Le nouveau : étiqueter le trafic en chat, complétion, recherche à long contexte ou agent qui écrit sur le disque, puis ne tarifer que les deux derniers à Astra. La coupure qui compte est l’entrée de workflow et la frontière d’exécution, pas un concours de logos. C’est la même discipline que pour Gemini 4 contre GPT-5.6.

Si le modèle n’apparaît pas encore dans un compte, lisez le calendrier avant de déboguer la clé. Des organisations de confiance — dont le programme cyber Daybreak — l’ont vu le premier jour. ChatGPT Plus, Pro, Business et Enterprise, plus l’API, Azure et AWS Bedrock, suivent les jours suivants. L’accès Enterprise est éteint jusqu’à ce qu’un admin l’allume. C’est une politique, pas un SDK cassé.

Ce qu’est vraiment GPT-6 Astra

Coupez l’objet en trois couches pour qu’un nom produit, un palier de capacité et un palier d’accès ne s’effondrent pas en « plus récent, donc meilleur ».

CoucheNoms entendusSens
ProduitGPT-6 Astra / ChatGPT 6 / GPT-6 ProUne famille de poids ; API gpt-6-astra ; libellé ChatGPT GPT-6 Pro
CapacitéFlagship / bout-en-bout / computer useRaisonnement dur, génie logiciel, agents bureau et navigateur, recherche, longs documents — pas le bavardage
AccèsAPI publique / DaybreakLe modèle public refuse les preuves d’exploit ; la recherche cyber assouplie est dans un programme examiné

Au lancement, le modèle accepte texte et image et renvoie du texte. Audio et vidéo en entrée ne sont pas pris en charge. reasoning.effort accepte low, medium, high, xhigh et max. Les passerelles restent souvent sur low. Sur l’API Responses : recherche web, recherche de fichiers, génération d’images, interpréteur de code, shell hébergé, apply patch, Skills, computer use, MCP et tool search. Function calling et sorties structurées sont pris en charge. Le fine-tuning ne l’est pas. L’étage API gratuit ne peut pas l’appeler.

La coupure de connaissances est le 30 avril 2026. L’usage dans un forfait ChatGPT compte dans l’allocation existante ; des crédits extra couvrent le dépassement. Les clients API éligibles peuvent demander la rétention zéro. OpenAI teste aussi Private Safety Processing pour surveiller sans stocker les payloads en clair. Les limites de débit suivent le palier de dépense. Rien de cela ne change le fait produit : Astra est un modèle frontière hébergé, pas un fichier de poids à télécharger sur un Mac mini.

Date de sortie, prix et fenêtre 1,05 M

L’asymétrie d’abord. La coupure Astra, c’est de savoir si un travail justifie une facture de tokens 2,5×, pas si la chaîne est la plus récente du catalogue.

PosteGPT-6 AstraGPT-5.6 Sol (référence)
Annonce / API3 sept. 2026 annonce, 4 sept. APIFlagship précédent
Identifiantgpt-6-astraId flagship antérieur
Entrée standard / 1 M tokens10 $4 $ (promo au moins jusqu’au 21 nov. 2026)
Sortie standard / 1 M tokens50 $20 $
Cache lu / écriture cache1 $ / 12,50 $0,40 $ / carte antérieure
Entrée > 272 KToute la requête 2× entrée et cache, 1,5× sortie (20 $ / 75 $)8 $ / 30 $
Batch / Flex50 % du Standard50 % du Standard
Mode Fast2× les taux applicables, jusqu’à ~2× la vitesseMême schéma 2×
Contexte / sortie max1 050 000 / 128 000Voir la fiche du modèle
CanauxAPI OpenAI, Azure, AWS Bedrock, ChatGPT payantCanaux existants

Les écritures de cache facturent 1,25× l’entrée non mise en cache. C’est un surcoût d’écriture du préfixe, pas une remise. La recherche web et le computer use ajoutent des frais d’outil par appel. La règle des 272 K surprend la finance : une fois la ligne franchie, toute la requête passe au palier long contexte. Vous ne payez pas le tarif bas sur les 272 K premiers et une prime sur la queue. Vider un monorepo « au cas où » transforme un tour d’agent en ligne à quatre chiffres.

Le cache de prompts est l’autre levier. Systèmes répétés, cartes de dépôt et guides de style doivent vivre dans un préfixe stable pour que les tours suivants lisent le cache à 1 $ / M au lieu de 10 $ / M. Si votre agent reconstruit le même brief de 80 K tokens à chaque message, le prix catalogue d’Astra n’est pas le vrai problème — c’est la forme du prompt. Batch et Flex divisent le Standard par deux quand la latence peut attendre. Fast double le taux applicable quand un humain est bloqué. Ce sont des classes de trafic, pas un second identifiant de modèle.

Les snapshots empêchent qu’un changement silencieux en semaine deux réécrive vos évaluations. Épinglez en production gpt-6-astra plus un snapshot daté. Laissez l’alias flottant aux expériences. Chat Completions, Responses et Batch sont pris en charge. Les points de terminaison audio temps réel du catalogue n’ajoutent pas la compréhension audio à ce checkpoint.

Lire les scores de coding

OpenAI présente Astra comme le meilleur modèle à ce jour pour le génie logiciel. Des partenaires chez Jane Street et Lovable parlent d’une narration d’agent plus claire et de moins de boucles avant un merge. Ce sont des retours d’expérience. Le tableau est l’artefact d’achat — et il est autodéclaré.

Benchmark (OpenAI)GPT-6 AstraGPT-5.6 SolClaude Fable 5.1
Terminal-Bench 4.057,9 %37,3 %55,8 %
DeepSWE v1.174,1 %72,7 %67,4 %
FrontierCode 1.1 Extended64,560,663,6
FrontierCode 1.1 Main53,347,550,9
AA Coding Agent Index v1.467,065,1

Lisez le tableau à l’envers du titre. Terminal-Bench de 37,3 % à 57,9 % dit que les agents qui pilotent un shell, configurent une machine et finissent un travail système ont vraiment avancé. DeepSWE +1,4 point dit que « corriger des issues dans un dépôt » n’ouvre pas un fossé générationnel. Les chiffres indépendants brouillent encore : Artificial Analysis a publié un Coding Agent Index avec Fable 5.1 vers 70 et Astra vers 67, et un Intelligence Index où Fable 5.1 mène aussi. Un deck de lancement et un index tiers n’ont pas à s’accorder. Votre file de merge est le seul score qui paie le loyer.

Les outils pèsent plus qu’un point SWE. Astra livré avec shell hébergé, apply patch et interpréteur de code. Lovable note qu’élever l’effort de low à high achète plus d’itérations sur un build neuf, plus de vérifications navigateur, et un biais vers l’exécution réelle plutôt que le seul patch. Codex teste des notes qui survivent d’une fenêtre de contexte à l’autre. Les anciennes sessions compactaient des résumés et perdaient pourquoi un correctif avait échoué. Le nouveau chemin garde les fenêtres antérieures interrogeables. OpenAI dit que la fonction deviendra le défaut Astra dans les semaines suivantes ; au lancement elle reste expérimentale dans la config Codex.

Le protocole dessous n’a pas changé. Le modèle émet des requêtes d’outils structurées. Votre runtime exécute l’effet de bord. Si trois dialectes JSON fuient encore dans des if métier, normalisez un ToolCall interne avant de payer le tarif Astra sur une boucle sale. Le guide de terrain est l’article Function Calling.

Agents et computer use : la couche qui a bougé

OpenAI cadre Astra comme une nouvelle frontière de vitesse, d’exactitude et de sûreté de l’usage ordinateur. La liste de démos est volontairement banale : formulaires, champs CRM, calendriers, recherche collée dans un mail ou un doc, graphes dans un logiciel scientifique, un site plus QA front, boucles d’install-debug depuis une capture. L’exigence commune : le modèle doit toucher une UI réelle et un système de fichiers réel, pas renvoyer un paragraphe de conseils.

Benchmark (OpenAI)GPT-6 AstraGPT-5.6 SolNote
OSWorld 2.072,6 %65,7 %~40 min / tâche contre ~75 min pour Sol
ScreenSpot-Pro (sans outils extra)92,7 %76,9 %Ancrage écran
Agents' Last Exam59,3 %53,6 %Longs travaux dans de vrais logiciels pro
BrowseComp91,5 %90,4 %Navigation et retrieval
AutomationBench41,4 %18,1 %Automatisation de bureau ; niveau absolu encore bas

Avec un harnais Codex mis à jour, l’achèvement Mind2Web est environ 1,9× Sol. Les chiffres d’alignement côtoient ceux de vitesse. Sur une eval interne « tâche impossible, donc le modèle sort du périmètre », Sol sans gardes de production quittait la cible autorisée environ 48 % du temps ; Astra 0 %. Une eval de type hallucination est passée de 12,2 % à 4,2 %. Le comportement produit suit : Astra comble les trous de routine, pose une question ciblée si la réponse changerait l’artefact, et dans Codex peut demander en asynchrone sans figer les étapes indépendantes.

La capacité cyber est un grand livre à part. OpenAI dit qu’Astra atteint le seuil Critical : dans des évaluations contrôlées, il peut identifier et enchaîner des vulnérabilités auparavant inconnues. ExploitBench est annoncé à 100 % contre 78,5 % pour Sol. Le lancement public refuse les tâches avancées telles que la rédaction de preuves d’exploit. Le travail défensif — revue sûre et correctifs — reste dans le périmètre. Des gardes plus souples vont aux organisations examinées via Daybreak. Cet article ne décrit pas de procédures d’attaque. Si votre métier est la recherche en sécurité, la porte est une revue de programme, pas un prompt de jailbreak contre le checkpoint public.

Le computer use sans hôte jetable n’est qu’une façon plus rapide de poser des secrets de production sur le mauvais bureau. Donnez aux outils d’écriture une machine que vous pouvez détruire. La location Cloud Mac de Zutcloud est faite pour cet isolement ; les montants mensuels sont sur la page tarifs, les limites de compte dans le centre d’aide.

Comment choisir

Si vous…choisissezPourquoi
complétez au quotidien, petits refactors, réécriture de commentairesGPT-5.6 Sol ou un modèle routé moins cherUn écart taille DeepSWE ne paie pas un prix unitaire 2,5×
bourrez des dépôts proches du million de tokens ou de longs docsAstra + cache de prompts, surveiller 272 KLa fenêtre fait 1,05 M ; au-delà de 272 K toute l’appel est re-tarifée
pilotez des agents terminal, bureau ou navigateur bout-en-boutAstra + hôte isoléC’est la couche que les chiffres de lancement ont vraiment déplacée
faites du développement d’exploit ou de la validation de PoCPas d’Astra public pour des preuves d’attaqueLe modèle public refuse ; programme officiel examiné
construisez decks, docs ou ChatGPT SitesAstra utilisable ; chiffrer les tokens de sortieMeilleur respect des modèles ; 50 $ / M de sortie reste raide
livrez iOS / Xcode / QA appareilN’importe quel routeur de modèles + Cloud MacIl vous manque une machine, pas un autre id flagship

A — solo : Sol ou un modèle bon marché sur l’autocomplétion. Promouvoir vers Astra seulement sur retries échoués, refactors inter-modules ou builds vérifiés navigateur. Effort bas par défaut. Secrets hors du volume de workspace.

B — petite équipe agent : Trois routes de passerelle : chat, coding, computer-use. Shell hébergé, apply patch et computer use seulement sur la route Astra. Chaque session a un Mac distant jetable et une allowlist de chemins. Le JSONL d’audit vit hors du workspace pour qu’un destroy n’efface pas la trace.

C — entreprise : Un admin bascule d’abord l’interrupteur d’espace. Épingler les snapshots. Alertes budget par projet, pas par canal Slack. Les jobs long contexte doivent utiliser un préfixe en cache. La recherche sécu ne partage jamais la passerelle de production. Questions de livraison : aide ; coût de nœud : tarifs. Contexte automation : OpenClaw cloud.

Pièges

  1. Traiter ChatGPT 6, GPT-6 Pro, Astra et un Ultra de rumeur comme quatre modèles.
  2. Coller tout un monorepo dans un prompt et manger le surcoût 272 K sur toute la requête.
  3. Appeler un +1,4 DeepSWE un saut de génération alors que Terminal-Bench est le vrai saut et que les index indépendants sont mêlés.
  4. Demander au checkpoint public des preuves d’exploit ou lire un refus comme un problème de prompt.
  5. Changer l’id de modèle et laisser les agents sur un portable personnel. Un computer use plus fort sur un bureau non géré est un plus grand rayon d’explosion, pas un gain de productivité.

Plan d’action : 7 étapes

  1. Confirmer si l’étage API, le forfait ChatGPT ou l’admin entreprise a activé Astra. Enterprise est éteint par défaut.
  2. Épingler gpt-6-astra et un snapshot dans le code. Ne pas suivre un alias flottant « dernier flagship » en production.
  3. Étiqueter le trafic live : chat, complétion, long contexte, agents qui écrivent le disque. Seuls les deux derniers vont à Astra par défaut.
  4. Activer le cache de prompts. Tarifer les deux côtés de la ligne 272 K. Alarme budget avant le premier essai week-end.
  5. Déplacer les sessions qui éditent des fichiers, lancent des commandes ou pilotent un navigateur vers un Mac isolé avec allowlist et destroy en fin de session.
  6. Régler reasoning.effort par job : low au quotidien, high hors module, xhigh ou max seulement si un effort moins cher a déjà échoué. Logger les tokens dans tous les cas.
  7. Prendre dix vrais échecs du mois dernier. Lancer Sol et Astra sur le même brief. Décider avec tours, reprise et dollars — pas avec un tableau de keynote.

FAQ

Qu’est-ce que GPT-6 Astra ? Est-ce ChatGPT 6 ?

Même famille. Nom officiel GPT-6 Astra, API gpt-6-astra, palier ChatGPT payant GPT-6 Pro. Pas de lancement ChatGPT 6 séparé.

Quand est-il sorti, et pourquoi manque-t-il à mon compte ?

Annonce le 3 septembre 2026, API le 4, puis déploiement échelonné dans ChatGPT payant et les places cloud. Les premiers jours, l’absence est en général le calendrier.

Prix et contexte en un paragraphe ?

10 $ / M en entrée, 50 $ / M en sortie, 1 $ en cache lu, 12,50 $ en écriture cache, 1 050 000 de contexte, 128 000 de sortie max. Au-delà de 272 K d’entrée, toute la requête est re-tarifée. Batch et Flex valent la moitié du Standard. Fast vaut 2× le taux applicable.

Le coding est-il une victoire nette sur Sol et Claude ?

Terminal et computer use ont beaucoup bougé. La correction d’issues dans le dépôt un peu. Certains index d’agents de coding indépendants préfèrent encore Fable 5.1. Validez sur votre arbre.

Puis-je utiliser le modèle public pour la recherche d’exploits ?

Ne traitez pas le checkpoint public comme une suite d’attaque. Il refuse les tâches cyber avancées. La revue défensive est dans le périmètre. Un accès recherche plus souple est un programme examiné, pas un drapeau caché.

Conclusion

GPT-6 Astra est réel, livré et cher. L’écart qui justifie l’étiquette est le computer use, les agents terminal et le cyber étroitement contrôlé — pas un balayage de tous les classements de coding. Le bon coup est le routage au niveau de la tâche : modèles bon marché pour les tokens du quotidien, Astra pour le long contexte et les travaux qui touchent une machine, exécution sur un hôte que vous pouvez détruire. Si vous ne savez pas quel répertoire un write_file va frapper, n’attachez pas encore d’outils d’écriture. Quand vous avez besoin de cet hôte, partez de la location et des tarifs.

Pour aller plus loin

Exécuter les agents Astra sur un Cloud Mac jetable

Un contexte d’un million de tokens et le computer use exigent un hôte stable. Éditions de dépôt, tests et QA navigateur ne doivent pas partager le bureau portable. Les Mac distants isolent l’espace par session.

Commander · Voir les tarifs

GPT-6 Astra

Exécuter les agents Astra sur un Cloud Mac jetable

Cloud Mac · isolated agent runtime

Commander
Mac Commander