OpenAI a publié GPT-6 Astra le 3 septembre 2026. L’identifiant API est gpt-6-astra. Ce n’est pas un chat renommé. L’ingénierie logicielle, l’usage de l’ordinateur et les agents de long horizon tiennent sur une même ligne produit. La décision d’équipe est plus étroite que le film de lancement : quels travaux justifient une facture 2,5× le tarif promotionnel de GPT-5.6 Sol, et lesquels restent sur un modèle moins cher ou un nœud Mac isolé.
Pourquoi la question est vive cette semaine
Les résultats de recherche mélangent encore « GPT-6 », « Astra », « ChatGPT 6 », « GPT-6 Pro » et un « GPT-6 Ultra » de rumeur. Une seule ligne a été livrée. GPT-6 Astra est le nom officiel du flagship, l’API s’appelle gpt-6-astra, et l’offre payante ChatGPT GPT-6 Pro s’appuie dessus. Il n’existe pas de sortie ChatGPT 6 séparée. Au 8 septembre 2026, aucun SKU Ultra n’est annoncé.
La tension n’est pas le surnom. Trois faits sont arrivés la même semaine. D’abord, l’API standard vaut 2,5× le tarif promotionnel actuel de Sol (4 / 20 $), alors que les textes de lancement invitent à traiter Astra comme défaut pour tout travail. Ensuite, le saut de capacité se concentre sur le terminal, l’usage ordinateur de bureau et l’évaluation cyber — pas sur des QCM déjà saturés. Enfin, OpenAI a ralenti le lancement en août après le franchissement du seuil Critical du Preparedness Framework. Le checkpoint public refuse ensuite les tâches d’attaque avancées. « Plus fort » et « la tranche plus forte que vous avez le droit d’utiliser » sont deux phrases.
L’ancien réflexe : un flagship apparaît, l’alias de passerelle bascule, l’autocomplétion et les agents partagent un id. Le nouveau : étiqueter le trafic en chat, complétion, recherche à long contexte ou agent qui écrit sur le disque, puis ne tarifer que les deux derniers à Astra. La coupure qui compte est l’entrée de workflow et la frontière d’exécution, pas un concours de logos. C’est la même discipline que pour Gemini 4 contre GPT-5.6.
Si le modèle n’apparaît pas encore dans un compte, lisez le calendrier avant de déboguer la clé. Des organisations de confiance — dont le programme cyber Daybreak — l’ont vu le premier jour. ChatGPT Plus, Pro, Business et Enterprise, plus l’API, Azure et AWS Bedrock, suivent les jours suivants. L’accès Enterprise est éteint jusqu’à ce qu’un admin l’allume. C’est une politique, pas un SDK cassé.
Ce qu’est vraiment GPT-6 Astra
Coupez l’objet en trois couches pour qu’un nom produit, un palier de capacité et un palier d’accès ne s’effondrent pas en « plus récent, donc meilleur ».
| Couche | Noms entendus | Sens |
|---|---|---|
| Produit | GPT-6 Astra / ChatGPT 6 / GPT-6 Pro | Une famille de poids ; API gpt-6-astra ; libellé ChatGPT GPT-6 Pro |
| Capacité | Flagship / bout-en-bout / computer use | Raisonnement dur, génie logiciel, agents bureau et navigateur, recherche, longs documents — pas le bavardage |
| Accès | API publique / Daybreak | Le modèle public refuse les preuves d’exploit ; la recherche cyber assouplie est dans un programme examiné |
Au lancement, le modèle accepte texte et image et renvoie du texte. Audio et vidéo en entrée ne sont pas pris en charge. reasoning.effort accepte low, medium, high, xhigh et max. Les passerelles restent souvent sur low. Sur l’API Responses : recherche web, recherche de fichiers, génération d’images, interpréteur de code, shell hébergé, apply patch, Skills, computer use, MCP et tool search. Function calling et sorties structurées sont pris en charge. Le fine-tuning ne l’est pas. L’étage API gratuit ne peut pas l’appeler.
La coupure de connaissances est le 30 avril 2026. L’usage dans un forfait ChatGPT compte dans l’allocation existante ; des crédits extra couvrent le dépassement. Les clients API éligibles peuvent demander la rétention zéro. OpenAI teste aussi Private Safety Processing pour surveiller sans stocker les payloads en clair. Les limites de débit suivent le palier de dépense. Rien de cela ne change le fait produit : Astra est un modèle frontière hébergé, pas un fichier de poids à télécharger sur un Mac mini.
Date de sortie, prix et fenêtre 1,05 M
L’asymétrie d’abord. La coupure Astra, c’est de savoir si un travail justifie une facture de tokens 2,5×, pas si la chaîne est la plus récente du catalogue.
| Poste | GPT-6 Astra | GPT-5.6 Sol (référence) |
|---|---|---|
| Annonce / API | 3 sept. 2026 annonce, 4 sept. API | Flagship précédent |
| Identifiant | gpt-6-astra | Id flagship antérieur |
| Entrée standard / 1 M tokens | 10 $ | 4 $ (promo au moins jusqu’au 21 nov. 2026) |
| Sortie standard / 1 M tokens | 50 $ | 20 $ |
| Cache lu / écriture cache | 1 $ / 12,50 $ | 0,40 $ / carte antérieure |
| Entrée > 272 K | Toute la requête 2× entrée et cache, 1,5× sortie (20 $ / 75 $) | 8 $ / 30 $ |
| Batch / Flex | 50 % du Standard | 50 % du Standard |
| Mode Fast | 2× les taux applicables, jusqu’à ~2× la vitesse | Même schéma 2× |
| Contexte / sortie max | 1 050 000 / 128 000 | Voir la fiche du modèle |
| Canaux | API OpenAI, Azure, AWS Bedrock, ChatGPT payant | Canaux existants |
Les écritures de cache facturent 1,25× l’entrée non mise en cache. C’est un surcoût d’écriture du préfixe, pas une remise. La recherche web et le computer use ajoutent des frais d’outil par appel. La règle des 272 K surprend la finance : une fois la ligne franchie, toute la requête passe au palier long contexte. Vous ne payez pas le tarif bas sur les 272 K premiers et une prime sur la queue. Vider un monorepo « au cas où » transforme un tour d’agent en ligne à quatre chiffres.
Le cache de prompts est l’autre levier. Systèmes répétés, cartes de dépôt et guides de style doivent vivre dans un préfixe stable pour que les tours suivants lisent le cache à 1 $ / M au lieu de 10 $ / M. Si votre agent reconstruit le même brief de 80 K tokens à chaque message, le prix catalogue d’Astra n’est pas le vrai problème — c’est la forme du prompt. Batch et Flex divisent le Standard par deux quand la latence peut attendre. Fast double le taux applicable quand un humain est bloqué. Ce sont des classes de trafic, pas un second identifiant de modèle.
Les snapshots empêchent qu’un changement silencieux en semaine deux réécrive vos évaluations. Épinglez en production gpt-6-astra plus un snapshot daté. Laissez l’alias flottant aux expériences. Chat Completions, Responses et Batch sont pris en charge. Les points de terminaison audio temps réel du catalogue n’ajoutent pas la compréhension audio à ce checkpoint.
Lire les scores de coding
OpenAI présente Astra comme le meilleur modèle à ce jour pour le génie logiciel. Des partenaires chez Jane Street et Lovable parlent d’une narration d’agent plus claire et de moins de boucles avant un merge. Ce sont des retours d’expérience. Le tableau est l’artefact d’achat — et il est autodéclaré.
| Benchmark (OpenAI) | GPT-6 Astra | GPT-5.6 Sol | Claude Fable 5.1 |
|---|---|---|---|
| Terminal-Bench 4.0 | 57,9 % | 37,3 % | 55,8 % |
| DeepSWE v1.1 | 74,1 % | 72,7 % | 67,4 % |
| FrontierCode 1.1 Extended | 64,5 | 60,6 | 63,6 |
| FrontierCode 1.1 Main | 53,3 | 47,5 | 50,9 |
| AA Coding Agent Index v1.4 | 67,0 | 65,1 | — |
Lisez le tableau à l’envers du titre. Terminal-Bench de 37,3 % à 57,9 % dit que les agents qui pilotent un shell, configurent une machine et finissent un travail système ont vraiment avancé. DeepSWE +1,4 point dit que « corriger des issues dans un dépôt » n’ouvre pas un fossé générationnel. Les chiffres indépendants brouillent encore : Artificial Analysis a publié un Coding Agent Index avec Fable 5.1 vers 70 et Astra vers 67, et un Intelligence Index où Fable 5.1 mène aussi. Un deck de lancement et un index tiers n’ont pas à s’accorder. Votre file de merge est le seul score qui paie le loyer.
Les outils pèsent plus qu’un point SWE. Astra livré avec shell hébergé, apply patch et interpréteur de code. Lovable note qu’élever l’effort de low à high achète plus d’itérations sur un build neuf, plus de vérifications navigateur, et un biais vers l’exécution réelle plutôt que le seul patch. Codex teste des notes qui survivent d’une fenêtre de contexte à l’autre. Les anciennes sessions compactaient des résumés et perdaient pourquoi un correctif avait échoué. Le nouveau chemin garde les fenêtres antérieures interrogeables. OpenAI dit que la fonction deviendra le défaut Astra dans les semaines suivantes ; au lancement elle reste expérimentale dans la config Codex.
Le protocole dessous n’a pas changé. Le modèle émet des requêtes d’outils structurées. Votre runtime exécute l’effet de bord. Si trois dialectes JSON fuient encore dans des if métier, normalisez un ToolCall interne avant de payer le tarif Astra sur une boucle sale. Le guide de terrain est l’article Function Calling.
Agents et computer use : la couche qui a bougé
OpenAI cadre Astra comme une nouvelle frontière de vitesse, d’exactitude et de sûreté de l’usage ordinateur. La liste de démos est volontairement banale : formulaires, champs CRM, calendriers, recherche collée dans un mail ou un doc, graphes dans un logiciel scientifique, un site plus QA front, boucles d’install-debug depuis une capture. L’exigence commune : le modèle doit toucher une UI réelle et un système de fichiers réel, pas renvoyer un paragraphe de conseils.
| Benchmark (OpenAI) | GPT-6 Astra | GPT-5.6 Sol | Note |
|---|---|---|---|
| OSWorld 2.0 | 72,6 % | 65,7 % | ~40 min / tâche contre ~75 min pour Sol |
| ScreenSpot-Pro (sans outils extra) | 92,7 % | 76,9 % | Ancrage écran |
| Agents' Last Exam | 59,3 % | 53,6 % | Longs travaux dans de vrais logiciels pro |
| BrowseComp | 91,5 % | 90,4 % | Navigation et retrieval |
| AutomationBench | 41,4 % | 18,1 % | Automatisation de bureau ; niveau absolu encore bas |
Avec un harnais Codex mis à jour, l’achèvement Mind2Web est environ 1,9× Sol. Les chiffres d’alignement côtoient ceux de vitesse. Sur une eval interne « tâche impossible, donc le modèle sort du périmètre », Sol sans gardes de production quittait la cible autorisée environ 48 % du temps ; Astra 0 %. Une eval de type hallucination est passée de 12,2 % à 4,2 %. Le comportement produit suit : Astra comble les trous de routine, pose une question ciblée si la réponse changerait l’artefact, et dans Codex peut demander en asynchrone sans figer les étapes indépendantes.
La capacité cyber est un grand livre à part. OpenAI dit qu’Astra atteint le seuil Critical : dans des évaluations contrôlées, il peut identifier et enchaîner des vulnérabilités auparavant inconnues. ExploitBench est annoncé à 100 % contre 78,5 % pour Sol. Le lancement public refuse les tâches avancées telles que la rédaction de preuves d’exploit. Le travail défensif — revue sûre et correctifs — reste dans le périmètre. Des gardes plus souples vont aux organisations examinées via Daybreak. Cet article ne décrit pas de procédures d’attaque. Si votre métier est la recherche en sécurité, la porte est une revue de programme, pas un prompt de jailbreak contre le checkpoint public.
Le computer use sans hôte jetable n’est qu’une façon plus rapide de poser des secrets de production sur le mauvais bureau. Donnez aux outils d’écriture une machine que vous pouvez détruire. La location Cloud Mac de Zutcloud est faite pour cet isolement ; les montants mensuels sont sur la page tarifs, les limites de compte dans le centre d’aide.
Comment choisir
| Si vous… | choisissez | Pourquoi |
|---|---|---|
| complétez au quotidien, petits refactors, réécriture de commentaires | GPT-5.6 Sol ou un modèle routé moins cher | Un écart taille DeepSWE ne paie pas un prix unitaire 2,5× |
| bourrez des dépôts proches du million de tokens ou de longs docs | Astra + cache de prompts, surveiller 272 K | La fenêtre fait 1,05 M ; au-delà de 272 K toute l’appel est re-tarifée |
| pilotez des agents terminal, bureau ou navigateur bout-en-bout | Astra + hôte isolé | C’est la couche que les chiffres de lancement ont vraiment déplacée |
| faites du développement d’exploit ou de la validation de PoC | Pas d’Astra public pour des preuves d’attaque | Le modèle public refuse ; programme officiel examiné |
| construisez decks, docs ou ChatGPT Sites | Astra utilisable ; chiffrer les tokens de sortie | Meilleur respect des modèles ; 50 $ / M de sortie reste raide |
| livrez iOS / Xcode / QA appareil | N’importe quel routeur de modèles + Cloud Mac | Il vous manque une machine, pas un autre id flagship |
Stacks recommandés
A — solo : Sol ou un modèle bon marché sur l’autocomplétion. Promouvoir vers Astra seulement sur retries échoués, refactors inter-modules ou builds vérifiés navigateur. Effort bas par défaut. Secrets hors du volume de workspace.
B — petite équipe agent : Trois routes de passerelle : chat, coding, computer-use. Shell hébergé, apply patch et computer use seulement sur la route Astra. Chaque session a un Mac distant jetable et une allowlist de chemins. Le JSONL d’audit vit hors du workspace pour qu’un destroy n’efface pas la trace.
C — entreprise : Un admin bascule d’abord l’interrupteur d’espace. Épingler les snapshots. Alertes budget par projet, pas par canal Slack. Les jobs long contexte doivent utiliser un préfixe en cache. La recherche sécu ne partage jamais la passerelle de production. Questions de livraison : aide ; coût de nœud : tarifs. Contexte automation : OpenClaw cloud.
Pièges
- Traiter ChatGPT 6, GPT-6 Pro, Astra et un Ultra de rumeur comme quatre modèles.
- Coller tout un monorepo dans un prompt et manger le surcoût 272 K sur toute la requête.
- Appeler un +1,4 DeepSWE un saut de génération alors que Terminal-Bench est le vrai saut et que les index indépendants sont mêlés.
- Demander au checkpoint public des preuves d’exploit ou lire un refus comme un problème de prompt.
- Changer l’id de modèle et laisser les agents sur un portable personnel. Un computer use plus fort sur un bureau non géré est un plus grand rayon d’explosion, pas un gain de productivité.
Plan d’action : 7 étapes
- Confirmer si l’étage API, le forfait ChatGPT ou l’admin entreprise a activé Astra. Enterprise est éteint par défaut.
- Épingler
gpt-6-astraet un snapshot dans le code. Ne pas suivre un alias flottant « dernier flagship » en production. - Étiqueter le trafic live : chat, complétion, long contexte, agents qui écrivent le disque. Seuls les deux derniers vont à Astra par défaut.
- Activer le cache de prompts. Tarifer les deux côtés de la ligne 272 K. Alarme budget avant le premier essai week-end.
- Déplacer les sessions qui éditent des fichiers, lancent des commandes ou pilotent un navigateur vers un Mac isolé avec allowlist et destroy en fin de session.
- Régler
reasoning.effortpar job : low au quotidien, high hors module, xhigh ou max seulement si un effort moins cher a déjà échoué. Logger les tokens dans tous les cas. - Prendre dix vrais échecs du mois dernier. Lancer Sol et Astra sur le même brief. Décider avec tours, reprise et dollars — pas avec un tableau de keynote.
FAQ
Qu’est-ce que GPT-6 Astra ? Est-ce ChatGPT 6 ?
Même famille. Nom officiel GPT-6 Astra, API gpt-6-astra, palier ChatGPT payant GPT-6 Pro. Pas de lancement ChatGPT 6 séparé.
Quand est-il sorti, et pourquoi manque-t-il à mon compte ?
Annonce le 3 septembre 2026, API le 4, puis déploiement échelonné dans ChatGPT payant et les places cloud. Les premiers jours, l’absence est en général le calendrier.
Prix et contexte en un paragraphe ?
10 $ / M en entrée, 50 $ / M en sortie, 1 $ en cache lu, 12,50 $ en écriture cache, 1 050 000 de contexte, 128 000 de sortie max. Au-delà de 272 K d’entrée, toute la requête est re-tarifée. Batch et Flex valent la moitié du Standard. Fast vaut 2× le taux applicable.
Le coding est-il une victoire nette sur Sol et Claude ?
Terminal et computer use ont beaucoup bougé. La correction d’issues dans le dépôt un peu. Certains index d’agents de coding indépendants préfèrent encore Fable 5.1. Validez sur votre arbre.
Puis-je utiliser le modèle public pour la recherche d’exploits ?
Ne traitez pas le checkpoint public comme une suite d’attaque. Il refuse les tâches cyber avancées. La revue défensive est dans le périmètre. Un accès recherche plus souple est un programme examiné, pas un drapeau caché.
Conclusion
GPT-6 Astra est réel, livré et cher. L’écart qui justifie l’étiquette est le computer use, les agents terminal et le cyber étroitement contrôlé — pas un balayage de tous les classements de coding. Le bon coup est le routage au niveau de la tâche : modèles bon marché pour les tokens du quotidien, Astra pour le long contexte et les travaux qui touchent une machine, exécution sur un hôte que vous pouvez détruire. Si vous ne savez pas quel répertoire un write_file va frapper, n’attachez pas encore d’outils d’écriture. Quand vous avez besoin de cet hôte, partez de la location et des tarifs.
Pour aller plus loin
Exécuter les agents Astra sur un Cloud Mac jetable
Un contexte d’un million de tokens et le computer use exigent un hôte stable. Éditions de dépôt, tests et QA navigateur ne doivent pas partager le bureau portable. Les Mac distants isolent l’espace par session.