OpenAI는 2026년 9월 3일 GPT-6 Astra를 발표했다. API는 gpt-6-astra다. 채팅 창 이름 교체가 아니다. 소프트웨어 공학, 컴퓨터 사용, 장기간 Agent가 한 제품 라인에 올라간다. 팀이 정할 것은 최신이라서 전부 올릴지가 아니라, 어떤 일이 GPT-5.6 Sol 프로모 가격의 2.5배를 받을 자격이 있는지, 무엇을 싼 모델이나 격리 Mac에 남길지다.
왜 지금 이 질문이 날카로운가
검색에는 GPT-6, Astra, ChatGPT 6, GPT-6 Pro, 미발표 Ultra가 섞인다. 출하된 선은 하나다. 공식 플래그십 이름은 GPT-6 Astra, API는 gpt-6-astra, ChatGPT 유료 GPT-6 Pro가 이를 쓴다. 별도 ChatGPT 6도 Ultra SKU 발표도 없다(2026년 9월 8일 기준).
모순은 별명이 아니다. 가격은 Sol 프로모의 2.5배인데 모든 일의 기본처럼 읽히는 문구가 있다. 능력 점프는 터미널, 데스크톱 Computer Use, 사이버 평가에 모이고 포화된 객관식에 있지 않다. 8월 Critical 사이버 임계로 출시가 늦어졌고 공개 체크포인트는 고급 공격 작업을 거부한다. “더 강하다”와 “그 강한 조각을 써도 된다”는 다른 문장이다.
옛 습관은 플래그십이 나오면 게이트웨이를 바꾸는 것이다. 새 습관은 채팅, 보완, 장문맥, 디스크에 쓰는 Agent로 나누고 뒤 둘만 Astra를 붙이는 것이다. 분수령은 브랜드가 아니라 워크플로 입구와 실행 경계다.
GPT-6 Astra의 세 층
| 층 | 들리는 이름 | 의미 |
|---|---|---|
| 제품 | GPT-6 Astra / ChatGPT 6 / GPT-6 Pro | 한 계열. API gpt-6-astra |
| 능력 | 플래그십 / 종단 / Computer Use | 난이도 높은 추론, 구현, 데스크톱·브라우저 Agent. 잡담 기본값 아님 |
| 접근 | 공개 API / Daybreak | 공개 모델은 공격 PoC 작성을 거부. 완화된 연구는 심사제 |
입력은 텍스트와 이미지, 출력은 텍스트. 오디오·비디오 입력은 미지원. reasoning.effort는 low부터 max. Responses 도구는 웹 검색, 파일 검색, 이미지 생성, code interpreter, hosted shell, apply patch, Skills, computer use, MCP, tool search. 함수 호출과 구조화 출력은 가능, 파인튜닝은 불가. 무료 API 티어 제외. 지식 컷오프는 2026년 4월 30일. Enterprise는 관리자 ON이 필요하다.
출시·가격·105만 토큰
분수령은 2.5배 청구를 감당할 일인지이지, 최신 문자열인지가 아니다.
| 항목 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|
| 발표 / API | 2026-09-03 / 09-04 | 기존 플래그십 |
| 입력 / 출력 | $10 / $50 | $4 / $20 (프로모) |
| 캐시 읽기 / 쓰기 | $1 / $12.50 | $0.40 / 이전 카드 |
| 입력 > 272K | 요청 전체가 2× / 1.5× ($20 / $75) | $8 / $30 |
| Batch / Flex / Fast | 반액 / 반액 / 2× | 동일 패턴 |
| 컨텍스트 / 최대 출력 | 1,050,000 / 128,000 | 각 모델 카드 |
캐시 쓰기는 미캐시 입력의 1.25배로 할인이 아니다. 272K를 넘으면 앞부분은 싸고 꼬리만 비싼 구조가 아니라 청구 전체가 올라간다. 검색과 Computer Use는 토큰 외 도구 수수료가 있다.
Coding 점수 읽는 법
| 벤치(OpenAI) | Astra | Sol | Fable 5.1 |
|---|---|---|---|
| Terminal-Bench 4.0 | 57.9% | 37.3% | 55.8% |
| DeepSWE v1.1 | 74.1% | 72.7% | 67.4% |
| FrontierCode Extended / Main | 64.5 / 53.3 | 60.6 / 47.5 | 63.6 / 50.9 |
| AA Coding Agent Index | 67.0 | 65.1 | — |
Terminal-Bench 점프는 셸과 환경을 다루는 Agent가 올라갔다는 뜻이다. DeepSWE 1.4점은 저장소 이슈 수정이 세대 차이가 아니라는 뜻이다. 독립 지표에서는 Fable 5.1이 앞서는 항목도 있다. 실무 도구는 hosted shell, apply patch, code interpreter다. effort를 올리면 반복과 브라우저 검증이 늘어난다고 Lovable은 적는다. Codex의 창 간 메모는 실험 중. 프로토콜은 모델이 JSON을 내고 런타임이 부작용을 실행한다. Function Calling을 먼저 정리한다.
Agent와 Computer Use
| 벤치 | Astra | Sol | 주 |
|---|---|---|---|
| OSWorld 2.0 | 72.6% | 65.7% | 약 40분 vs 75분 |
| ScreenSpot-Pro | 92.7% | 76.9% | 화면 그라운딩 |
| Agents' Last Exam | 59.3% | 53.6% | 업무 소프트웨어 장작업 |
| BrowseComp | 91.5% | 90.4% | 브라우징 |
| AutomationBench | 41.4% | 18.1% | 절대 수준은 아직 낮음 |
Codex 하네스와 겹치면 Mind2Web은 약 1.9배 빠르다. 월권 평가에서 가드 없는 Sol은 약 48%, Astra는 0%. 환각 계열은 12.2%에서 4.2%. 공개 모델은 고급 사이버 작업을 거부하고 완화는 Daybreak. 공격 절차는 쓰지 않는다. Computer Use를 개인 노트북에 직결하지 마라. 폐기 가능한 Cloud Mac과 가격, 도움말을 먼저 본다.
시나리오
| 만약… | 고를 것 | 이유 |
|---|---|---|
| 일상 보완·작은 리팩터 | Sol 또는 싼 모델 | 1.4점으로는 2.5배를 못 갚는다 |
| 백만 토큰급 검색 | Astra + 캐시, 272K 감시 | 창은 넓지만 요금 계단이 있다 |
| 터미널·데스크톱 Agent | Astra + 격리 호스트 | 발표 숫자가 움직인 층 |
| 공격 PoC | 공개 Astra 사용 금지 | 거부된다. 심사 프로그램으로 |
| iOS / Xcode | 라우터 + Cloud Mac | 부족한 것은 기계 |
권장 스택
A 개인: 보완은 저가, 실패와 브라우저 검증만 Astra. effort는 low부터. B 소규모: 채팅 / 구현 / computer-use 세 경로. 쓰기는 폐기 Mac. C 기업: 관리자가 스위치, 스냅샷 고정, 연구는 운영 게이트웨이에 올리지 않는다. 기억 계층은 자체 Memory vs SaaS를 참고.
실수
- ChatGPT 6와 Pro와 Astra와 Ultra를 네 모델로 본다.
- 모노레포를 한 번에 넣어 272K 할증을 밟는다.
- DeepSWE +1.4를 세대 혁명이라고 부른다.
- 공개 모델에 공격 증명을 요구한다.
- 모델만 바꾸고 실행 호스트는 안 바꾼다.
7단계
- API / ChatGPT / 관리자 개방 확인(Enterprise 기본 꺼짐).
gpt-6-astra와 스냅샷 고정.- 트래픽 분류, 뒤 두 종류만 Astra.
- 캐시와 272K 견적, 예산 경보.
- 쓰기 세션을 격리 Mac으로.
- 작업별 effort, 토큰 기록.
- 실제 실패 10건으로 Sol과 비교해 라운드와 달러로 결정.
FAQ
Astra와 ChatGPT 6은 같은가
같은 계열. API는 gpt-6-astra. ChatGPT에서는 GPT-6 Pro.
출시일과 계정에 없는 이유
9월 3일 발표, 4일 API. 단계 배포 중이면 대개 일정 문제다.
가격과 컨텍스트
입력 $10/M, 출력 $50/M, 캐시 읽기 $1, 쓰기 $12.50. 컨텍스트 1,050,000, 최대 출력 128,000. 272K 초과는 전체 고요금.
코딩이 세대 차이인가
터미널과 Computer Use는 크다. DeepSWE는 작다. 독립 지수는 혼재. 자기 저장소로 확인.
공개 모델로 공격 연구?
안 된다. 거부된다. 방어 리뷰는 범위 안. 완화된 연구는 심사제.
정리
Astra는 출하됐고 비싸다. 스티커를 정당화하는 차이는 Computer Use와 터미널 Agent이지 모든 코딩 1위가 아니다. 이기는 쪽은 작업 단위 라우팅이다. 싼 모델로 일상, Astra로 장문맥과 기계를 만지는 일, 실행은 폐기 가능한 호스트. write_file 대상을 말할 수 없으면 쓰기 도구를 붙이지 마라. 대여와 OpenClaw 자동화로 환경을 짠다.