OpenAI выпустила GPT-6 Astra и изменила саму механику долгих AI-workflows

· Обновлено · 4 минут чтения · Любовь Черемисина · OpenAI AI-агенты · ОбновленоПрактика · Аудио

3 сентября 2026 OpenAI представила GPT-6 Astra — модель для сложных end-to-end задач. Контекст 1,05 млн, тариф Standard $10/$50. Async tool calling и mid-turn steering по WebSocket в Responses API меняют механику долгих workflow: править курс на ходу, не рвать цепочку «стоп → перезапуск».

Научная гравюра на кремовой бумаге: длинный конвейер AI-workflow с непрерывным рельсом и штурвалом mid-course steering вместо обрывов на каждой станции

Коротко

  • Что запустили: 3 сентября 2026 OpenAI представила GPT-6 Astra — модель для сложных end-to-end задач: рассуждения, код, computer use, браузер, исследования и артефакты вроде документов, таблиц и презентаций. В API имя модели — `gpt-6-astra`.
  • Кому доступно: сейчас — ограниченный круг организаций; в ближайшие дни — ChatGPT Plus, Pro, Business и Enterprise, плюс OpenAI API, Microsoft Azure и AWS Bedrock. На Enterprise доступ по умолчанию выключен, включает администратор.
  • Главное ограничение: тариф Standard в API — $10 за миллион входных токенов и $50 за миллион выходных. Запросы с более чем 272 тысячами входных токенов дороже на всём запросе. Это не модель «по умолчанию на всё подряд».
  • Главное последствие: долгий workflow можно направлять на ходу, а не рвать цепочку «стоп → правка → заново». Для оркестрации агентов это смена механики, а не только «умнее модель».

Что изменилось

Раньше длинный агентный сценарий я часто резала на короткие вызовы: модель сделала шаг, инструмент ответил, контекст или усилие рассуждений менялись — и приходилось собирать заново. OpenAI для Astra завязывает длинные цепочки на Responses API.

Контекст релиза: 1 сентября OpenAI опубликовала Path to Astra — про критический кибер-порог Preparedness Framework и защитные меры «скоро». 3 сентября — уже продуктовый выход Astra и model card в API.

По документации async tool calling модель может продолжать работу после вызова инструмента, не дожидаясь результата: медленный запрос стартует раньше, независимую часть ответа можно закрыть параллельно, а вывод инструмента вернуть позже по тому же `call_id`. Это не «инструмент крутится у OpenAI сам», а ваш код — но пауза модели на каждый вызов инструмента больше не обязательна.

Mid-turn steering доступен у GPT-6 Astra по WebSocket к Responses API (у GPT-5.6 и раньше — нет). Событие `response.steer`: добавить требования или сменить направление, не дожидаясь конца ответа. Уже отданный вывод не переписывается; стартовавшие инструменты не отменяются. Транспорт — WebSocket mode; семантика коррекции курса — гайд Mid-turn steering.

Параметры со страницы модели

ПараметрGPT-6 Astra
Окно контекста1 050 000 токенов
Макс. вывод128 000 токенов
Standard: вход / выход$10 / $50 за миллион токенов
Кеш входа$1 за миллион
Запись в кеш$12,50 за миллион
Вход > 272k токенов2× вход и кеш, 1,5× выход на весь запрос
Fast modeдо 2× скорости Standard при 2× цене
reasoning.effortlow, medium, high, xhigh, max

Цифры бенчмарков с анонса не размножаю.

Почему это важно

Для меня здесь не «ещё один лидерборд», а возможность вести длинный workflow как управляемый процесс: запустить инструмент, не стопорить всё остальное; поправить курс mid-turn; держать большой контекст, если задача этого требует — и помнить про цену длинного входа.

Вывод для оркестрации: оркестратор и слой данных — отдельно, модель — отдельно. Astra в Responses API поддерживает tool calling, включая MCP как тип инструмента у OpenAI. Это не обещание «ваш контур уже на Astra» и не CTA на MCP Panel.

Я бы не ставила Astra по умолчанию на короткие сводки: тариф Standard $10/$50 и удорожание длинного входа — для дорогих цепочек с высокой ценой ошибки.

Что протестировать

  1. Один сценарий 30–90 минут: исследование → правки → документ/таблица → проверка человеком.
  2. Async tool calling на одном медленном шаге — замерить независимую работу до ответа инструмента.
  3. Один `response.steer` на ходу без «стоп → перезапуск».
  4. Тот же бриф на более дешёвой модели короткими шагами — сравнить принятый пакет.
  5. Вход около/выше 272k только если реально нужно.

Источники

← Все новости AI и MCP