OpenAI выпустила GPT-6 Astra и изменила саму механику долгих AI-workflows
3 сентября 2026 OpenAI представила GPT-6 Astra — модель для сложных end-to-end задач. Контекст 1,05 млн, тариф Standard $10/$50. Async tool calling и mid-turn steering по WebSocket в Responses API меняют механику долгих workflow: править курс на ходу, не рвать цепочку «стоп → перезапуск».
Коротко
- Что запустили: 3 сентября 2026 OpenAI представила GPT-6 Astra — модель для сложных end-to-end задач: рассуждения, код, computer use, браузер, исследования и артефакты вроде документов, таблиц и презентаций. В API имя модели — `gpt-6-astra`.
- Кому доступно: сейчас — ограниченный круг организаций; в ближайшие дни — ChatGPT Plus, Pro, Business и Enterprise, плюс OpenAI API, Microsoft Azure и AWS Bedrock. На Enterprise доступ по умолчанию выключен, включает администратор.
- Главное ограничение: тариф Standard в API — $10 за миллион входных токенов и $50 за миллион выходных. Запросы с более чем 272 тысячами входных токенов дороже на всём запросе. Это не модель «по умолчанию на всё подряд».
- Главное последствие: долгий workflow можно направлять на ходу, а не рвать цепочку «стоп → правка → заново». Для оркестрации агентов это смена механики, а не только «умнее модель».
Что изменилось
Раньше длинный агентный сценарий я часто резала на короткие вызовы: модель сделала шаг, инструмент ответил, контекст или усилие рассуждений менялись — и приходилось собирать заново. OpenAI для Astra завязывает длинные цепочки на Responses API.
Контекст релиза: 1 сентября OpenAI опубликовала Path to Astra — про критический кибер-порог Preparedness Framework и защитные меры «скоро». 3 сентября — уже продуктовый выход Astra и model card в API.
По документации async tool calling модель может продолжать работу после вызова инструмента, не дожидаясь результата: медленный запрос стартует раньше, независимую часть ответа можно закрыть параллельно, а вывод инструмента вернуть позже по тому же `call_id`. Это не «инструмент крутится у OpenAI сам», а ваш код — но пауза модели на каждый вызов инструмента больше не обязательна.
Mid-turn steering доступен у GPT-6 Astra по WebSocket к Responses API (у GPT-5.6 и раньше — нет). Событие `response.steer`: добавить требования или сменить направление, не дожидаясь конца ответа. Уже отданный вывод не переписывается; стартовавшие инструменты не отменяются. Транспорт — WebSocket mode; семантика коррекции курса — гайд Mid-turn steering.
Параметры со страницы модели
| Параметр | GPT-6 Astra |
|---|---|
| Окно контекста | 1 050 000 токенов |
| Макс. вывод | 128 000 токенов |
| Standard: вход / выход | $10 / $50 за миллион токенов |
| Кеш входа | $1 за миллион |
| Запись в кеш | $12,50 за миллион |
| Вход > 272k токенов | 2× вход и кеш, 1,5× выход на весь запрос |
| Fast mode | до 2× скорости Standard при 2× цене |
| reasoning.effort | low, medium, high, xhigh, max |
Цифры бенчмарков с анонса не размножаю.
Почему это важно
Для меня здесь не «ещё один лидерборд», а возможность вести длинный workflow как управляемый процесс: запустить инструмент, не стопорить всё остальное; поправить курс mid-turn; держать большой контекст, если задача этого требует — и помнить про цену длинного входа.
Вывод для оркестрации: оркестратор и слой данных — отдельно, модель — отдельно. Astra в Responses API поддерживает tool calling, включая MCP как тип инструмента у OpenAI. Это не обещание «ваш контур уже на Astra» и не CTA на MCP Panel.
Я бы не ставила Astra по умолчанию на короткие сводки: тариф Standard $10/$50 и удорожание длинного входа — для дорогих цепочек с высокой ценой ошибки.
Что протестировать
- Один сценарий 30–90 минут: исследование → правки → документ/таблица → проверка человеком.
- Async tool calling на одном медленном шаге — замерить независимую работу до ответа инструмента.
- Один `response.steer` на ходу без «стоп → перезапуск».
- Тот же бриф на более дешёвой модели короткими шагами — сравнить принятый пакет.
- Вход около/выше 272k только если реально нужно.
Источники
- GPT-6 Astra: A new generation of intelligence — OpenAI, 2026-09-03
- GPT-6 Astra Model — OpenAI API, 2026-09-03
- Async tool calling — OpenAI API, 2026-09-03
- Mid-turn steering — OpenAI API, 2026-09-03
- WebSocket Mode — OpenAI API, 2026-09-03
- Path to Astra — OpenAI, 2026-09-01