OpenAI · GPT-6 Astra API

Как вызвать GPT-6 Astra API в 2026: Python от ключа до первого запроса

2026.09.09 · ~13 мин чтения

Первый отказ почти всегда из‑за ключа, эндпоинта или ID модели — не из‑за «сломанного» флагмана. Дальше: доступ и секреты, Responses против Chat Completions, минимальный Python, стрим и красные линии счёта, матрица, стеки и 7 шагов.

Разработчик печатает на ноутбуке, готовя вызов GPT-6 Astra API на Python

OpenAI объявила GPT-6 Astra 3 сентября 2026. Идентификатор API — gpt-6-astra; клиенты API смогли вызвать его 4 сентября. Большинство запросов «как вызвать» спотыкаются не о ценник 10/50 долларов и не об окне в 1,05 млн токенов. Они застревают ниже: в ChatGPT уже виден GPT-6 Pro, а Python отвечает model_not_found; или прошлогодний сниппет Chat Completions вставляют как есть, и первое поле tools даёт 400. Эта статья не пересказывает, что такое Astra — это в гайде по релизу, цене и агентам. Она ведёт от ключа API к первому напечатанному output_text.

API Key
Секрет проекта
Responses
По умолчанию для новых приложений
gpt-6-astra
Единственный ID модели
Откуда цифры
ID модели, цены, контекст и списки инструментов — по странице модели GPT-6 Astra и анонсу. Подписка ChatGPT — не счёт API. Бесплатный ярус API Astra не обслуживает. Корпоративные пространства держат модель выключенной, пока админ не откроет.

Почему первый запрос обычно падает

Старый рефлекс — в день флагмана подменить строку модели. Новый — выровнять четыре факта: платный проект, ключ только в окружении, верный эндпоинт, зафиксированный ID плюс effort. Развилка не в том, умеете ли вы собрать OpenAI(). Она в том, считаете ли вы ещё окно ChatGPT и проект API одной системой.

Пять путей отказа независимы и часто складываются. Первый: Plus или Pro может болтать с GPT-6 Pro, а проекта на platform.openai.com с Astra нет. Второй: корпоративные пространства по умолчанию выключают модель; SDK не говорит «спросите админа», он говорит, что модели нет. Третий: бесплатный ярус Astra не обслуживает — не отлаживайте SDK до биллинга. Четвёртый: голый текст ещё можно гнать в Chat Completions, но вызовы инструментов принадлежат Responses. Пятый: ключ в исходнике, ноутбуке или чате после отзыва внезапно даёт 401.

Отсечка знаний — 30 апреля 2026. reasoning.effort принимает low, medium, high, xhigh и max. none нельзя — будет 400. Шлюзы часто держат low. Для первого ping берите low. Вы проверяете путь, а не сжигаете max-рассуждение на «hello».

Лимиты следуют ярусу расхода. Официальные таблицы помечают Free как неподдерживаемый; Tier 1 начинается примерно с 500 RPM и 500 000 TPM и растёт вместе с тратами. Если первый вызов дал 429, проверьте ярус проекта и потолок организации, прежде чем переписывать клиент. Ключ в чужом проекте выглядит как сетевой баг и им не является.

Разделить ключ, эндпоинт и ID модели

Разрежьте услышанные имена на четыре слоя, чтобы «я залогинен в ChatGPT» перестало значить «я могу бить API».

СлойЧто слышитеЧто нужно первому запросу
Дверь продуктаChatGPT / API / Azure / BedrockЭтот учебник — OpenAI API; облака требуют свой SDK и имя деплоя
СекретUser key / project keyСоздать в платном проекте; только окружение; никогда исходник
ЭндпоинтResponses / Chat Completions / BatchНовые приложения: Responses; старый текст: Completions; офлайн-объём: Batch
МодельGPT-6 / Astra / GPT-6 Pro / UltraСлать gpt-6-astra; в проде закрепить снимок из каталога

Кратчайший путь к ключу: открыть platform.openai.com, подтвердить биллинг организации и проекта и что это не free, создать ключ только для этого ноутбука или этого CI и скопировать один раз — UI больше не покажет полное значение. В Windows — системное хранилище или секрет-менеджер; в macOS и Linux — export. Не вставляйте ключ в чат коллеге и не дайте Jupyter сохранить его в ячейке вывода.

Окружение (не коммитить)
# macOS / Linux
export OPENAI_API_KEY="sk-..."

# never commit the key
echo 'OPENAI_API_KEY=sk-...' >> .env
echo '.env' >> .gitignore

Поставьте официальный пакет openai. Старый клиент может вообще не отдавать client.responses. Это выглядит как «Astra закрыта», а на деле SDK только под Completions.

Установка SDK
python3 -m pip install -U "openai>=1.0"
python3 -c "import openai; print(openai.__version__)"

На старте модель принимает текст и изображение на вход и текст на выход. Аудио и видео на вход закрыты. Инструменты Responses: веб-поиск, поиск по файлам, генерация изображений, интерпретатор кода, hosted shell, apply patch, Skills, computer use, MCP и tool search. Function calling и structured output есть; fine-tuning нет. Всё это стоит на работающем текстовом ping. Не цепляйте computer use на шаге один.

Responses против Chat Completions

Асимметричная строка: голый текст может идти в обе двери; инструменты, хостовые возможности и async-вызовы требуют Responses. Не приваривайте нового агента к Completions только потому, что вы уже знаете массив messages.

ВозможностьResponses APIChat CompletionsBatch / Flex
Голый текст gpt-6-astraДа; умолчание для новых приложенийДа; годится для старого текстового путиДа; 50% стандарта
Вызовы функций / structured outputДа; рекомендуемая дверьНе умолчание для нового Astra tool loopПравила batch
Хостовые инструменты (поиск, shell, computer use)ДаНе основной путьНе для интерактивного рабочего стола
СтримДаДаНе для живого терминала
Первый зондРекомендуетсяТолько если шлюз не умеет уйти с CompletionsНе для проверки ключа

Прайс остаётся 10 долларов за миллион входных токенов и 50 за миллион выходных; кэш на чтение — 1, запись кэша — 12,50. Контекст 1 050 000, максимум выхода 128 000. Вход выше 272K тарифицирует весь запрос как 2× вход и кэш и 1,5× выход. Fast — двойной применимый тариф. Поиск и computer use добавляют плату за вызов инструмента. Одно предложение на low должно быть достаточно дешёвым, чтобы его игнорировать. Если первый вызов похож на long-context eval, вы написали бенчмарк, а не зонд.

Цикл инструментов — тот же протокол: модель выдаёт структурированный запрос; рантайм делает побочный эффект. Если три JSON-диалекта вендоров ещё живут в бизнес-if/else, сначала сверните внутренний ToolCall. См. сравнение Function Calling. Маршрутизация против Gemini и прошлой линии GPT: Gemini 4 vs GPT-5.6.

Минимальный Python: от ключа до первого запроса

Скрипт ниже делает три вещи: читает окружение, фиксирует gpt-6-astra и тратит low effort на одно подтверждающее предложение. Успех — не качество прозы. Успех — напечатать output_text и response.id. Сохраните id. «Кажется, сработало» — не артефакт инцидента.

Первый запрос Responses
from openai import OpenAI

client = OpenAI()

response = client.responses.create(
    model="gpt-6-astra",
    instructions="You are a concise engineering assistant.",
    input="Reply with one sentence: Astra API is reachable.",
    reasoning={"effort": "low"},
)

print(response.output_text)
print(response.id)
print(getattr(response, "usage", None))

Если старый шлюз умеет только массив messages, текстовый зонд может идти в Chat Completions. Это доказывает ключ и ID модели. Это не доказывает, что потом можно навесить hosted shell.

Только текст через Chat Completions
from openai import OpenAI

client = OpenAI()

completion = client.chat.completions.create(
    model="gpt-6-astra",
    messages=[
        {"role": "system", "content": "You are a concise engineering assistant."},
        {"role": "user", "content": "Reply with one sentence: Astra API is reachable."},
    ],
)

print(completion.choices[0].message.content)

Стрим — необязательный второй шаг, не первый урок. Сначала посадите нестримовый вызов, потом stream=True. Типы событий следуют установленному SDK. Сниппет читает обычный response.output_text.delta. Если поле другое, печатайте event.type и сверяйтесь с официальной таблицей, а не угадывайте.

Стрим (после стабильного пути)
from openai import OpenAI

client = OpenAI()

stream = client.responses.create(
    model="gpt-6-astra",
    input="List three safe checks before a production cutover.",
    reasoning={"effort": "low"},
    stream=True,
)

for event in stream:
    if getattr(event, "type", "") == "response.output_text.delta":
        print(event.delta, end="", flush=True)

Не повторяйте каждую ошибку. Обрывы соединения — сеть и прокси. 429 — Retry-After и ярус. 400 почти всегда плохой ID, effort или схема: десять тысяч ретраев не вылечат. 401 и 403 возвращают к выключателю проекта и области ключа. Если причина — free-ярус или корпоративный замок, не меняйте модели тихо в прикладном коде. Так прод незаметно едет за старым флагманом.

Ветвить по классу ошибки; не ретраить вслепую
from openai import APIConnectionError, APIStatusError, OpenAI, RateLimitError

client = OpenAI()

try:
    client.responses.create(
        model="gpt-6-astra",
        input="ping",
        reasoning={"effort": "low"},
    )
except APIConnectionError as exc:
    print("network", exc)
except RateLimitError as exc:
    print("rate_limit", exc)
except APIStatusError as exc:
    print(exc.status_code, exc.message)
Публичная модель — не атакующий набор
Публичная Astra отказывается от продвинутых киберзадач и доказательств эксплойтов. Этот учебник — инженерный зонд: текст, стрим, счёт, изолированное исполнение. Исследования безопасности — через проверенную программу, не через jailbreak-промпт.

Как выбирать

Если вывыбирайтеПочему
Впервые проверяете ключ и ID моделиResponses + gpt-6-astra + effort lowКратчайший путь, самый дешёвый счёт, самые богатые поля отладки
Застряли на шлюзе только с messagesChat Completions лишь для текстового зондаДоказывает доступ; новая инструментальная работа всё равно уходит в Responses
Вешаете функции, поиск, shell или computer useResponses, не сварку CompletionsХостовые инструменты сидят на Responses
Можете отложить офлайн-оценкиBatch / FlexПоловина цены; плохо для «мне нужно первое предложение сейчас»
Собираетесь править репозиторий, гонять тесты или браузерЛюбой текстовый путь + изолированный MacНе хватает границы исполнения
Делаете research в духе эксплойтовНе публичную модель для атакующих доказательствОна откажется; проверенный канал

A — соло-разработчик: локальная переменная окружения, официальный SDK, один скрипт Responses. По умолчанию low. Стрим — только когда этот путь скучно надёжен. Ключ API держите отдельно от логина ChatGPT. Повседневные дополнения могут остаться на более дешёвой модели; Astra — для уже упавших ретраев и длинной работы.

B — шлюз маленькой команды: ключи проекта; CI получает отдельный секрет только на чтение. Зафиксируйте gpt-6-astra и снимок в конфиге. Не гонитесь за плавающим алиасом «последний флагман». Чат остаётся дешёвым; маршруты кода и computer-use берут Astra. Сверните JSON инструментов до хостовых тулов.

C — предприятие: админ сначала включает пространство; нулевое хранение данных — отдельный запрос для подходящих клиентов. Бюджетные алерты по проектам. Длинные промпты требуют префикс кэша и следят за надбавкой 272K на весь запрос. Сессии с записью садятся на уничтожаемый удалённый Mac с белым списком путей. Поставка и аккаунт: справка; месячная цена узла: цены Mac mini.

Частые ловушки

  1. Считать GPT-6 Pro в ChatGPT доказательством, что API открыт.
  2. Класть ключ в исходник, вывод ноутбука или чат и называть модель «капризной».
  3. Ставить effort=max или запихивать полмонорепозитория в первый ping и платить длинное рассуждение плюс 272K.
  4. Приваривать новый tool loop к Chat Completions, пока каждый hosted shell не станет 400.
  5. Слать gpt-6, chatgpt-6 или слуховой Ultra.

План: 7 шагов

  1. Подтвердите, что у API-проекта есть биллинг и это не free; предприятия просят админа включить Astra.
  2. Создайте ключ платформы, храните его только в окружении или секрет-хранилище и добавьте .env в .gitignore.
  3. Поставьте актуальный SDK openai и убедитесь, что есть client.responses.create.
  4. Отправьте однопредложенческий Responses-запрос с model="gpt-6-astra" и reasoning.effort="low".
  5. Напечатайте output_text, response.id и usage; сохраните id для сверки.
  6. Когда текстовый путь стабилен, добавьте стрим или инструменты; JSON сверьте со статьёй Function Calling.
  7. Сессии, которые правят файлы, гоняют команды или открывают браузер, сажайте на изолированный удалённый Mac и уничтожайте workspace в конце.

FAQ

В ChatGPT уже GPT-6 Pro. Почему падает Python?

ChatGPT и API — разные счета и ворота. Корпоративные пространства по умолчанию выключают Astra. Бесплатный ярус API модель не обслуживает. Создайте ключ в платном проекте на platform.openai.com.

Сначала Responses или Chat Completions?

Голый текст идёт в оба. Новые приложения — Responses. Вызовы функций, хостовые инструменты, structured output и async требуют Responses.

Какой ID модели?

Используйте gpt-6-astra. В проде закрепите датированный снимок из каталога. Не выдумывайте gpt-6, chatgpt-6 или Ultra.

Можно ли reasoning.effort = none?

Нет. Astra принимает low, medium, high, xhigh и max. none даёт HTTP 400. Первый ping — low.

Класть ключ в исходник?

Нет. Переменная окружения или секрет-хранилище. Не коммитить. При утечке сразу отозвать.

Итог

Первый урок GPT-6 Astra — не культ флагмана. Это выравнивание четырёх фактов: платный проект, ключ, который никогда не входит в репозиторий, Responses (или текстовый путь Completions, который вам пришлось оставить) и зафиксированный gpt-6-astra. Первый запрос — одно предложение на low. Путь существует только после печати output_text. Инструменты, длинный контекст и computer use — следующий урок, и они принадлежат уничтожаемому хосту. Нужен стабильный удалённый Mac — начните с аренды и цен; вопросы аккаунта — в справку.

Читать дальше

После первого успеха инструменты — на уничтожаемом Cloud Mac

Текстовый ping можно гонять локально. Hosted shell, apply patch и computer use не должны делить повседневный рабочий стол. Удалённый Mac изолирует workspace на сессию.

Заказать · Смотреть цены

GPT-6 Astra API

После первого успеха инструменты — на уничтожаемом Cloud Mac

Cloud Mac · isolated agent runtime

Заказать
Mac Заказать