OpenAI снизила цену GPT‑5.6 Luna на 80% и запустила ускоренный режим Sol

· 6 минут чтения · Любовь Черемисина · OpenAI AI-агенты Маркетинг и аналитика · Сегодня

30 июля 2026 OpenAI снизила цены программного интерфейса (API) для двух уровней GPT‑5.6: Luna — на 80%, Terra — на 20%. Для флагманского Sol появился ускоренный режим — до 2,5× быстрее стандартного при двукратной стоимости. Для вас это сигнал: постоянный AI на больших объёмах (классификация лидов, проверка рекламы, обогащение CRM) становится экономически реалистичным — если считать не токены, а стоимость готового результата.

Три шестерни разного размера на механизме с красной стрелкой маршрутизации — метафора маршрутизации между уровнями GPT‑5.6

Коротко

  • Что изменилось: цены программного интерфейса для GPT‑5.6 Luna и Terra; ускоренный режим для Sol вместо приоритетной обработки.
  • Luna: $0,20 / $1,20 за миллион входных и выходных токенов — было $1 / $6 (минус 80%).
  • Terra: $2 / $12 — было $2,50 / $15 (минус 20%).
  • Sol: $5 / $30 — без изменений; ускоренный режим — до 2,5× быстрее при двукратной стоимости.
  • Главное последствие: постоянные фоновые AI-процессы на больших объёмах становятся заметно дешевле.

Что изменилось

30 июля 2026 OpenAI в анонсе снизила цены двух уровней семейства GPT‑5.6 и представила ускоренный режим для флагмана. Изменения уже в прайсе; на облачных площадках партнёров раскатка шла в течение дня.

Цены за 1 млн токенов (стандартный режим):

УровеньВход — былоВход — сталоВыход — былоВыход — стало
Флагман$5,00$5,00$30,00$30,00
Сбалансированный$2,50$2,00$15,00$12,00
Экономичный$1,00$0,20$6,00$1,20

Соответствие уровней семейства GPT‑5.6: флагман — Sol, сбалансированный — Terra, экономичный — Luna.

Снижение затрагивает и производные тарифы: пакетный и гибкий режимы, кэшированный ввод и длинный контекст — по тем же пропорциям.

Ускоренный режим для Sol заменяет приоритетную обработку. По заявлению OpenAI:

  • до 2,5× выше скорость, чем в стандартном режиме;
  • двукратная стоимость ($10 / $60 за 1 млн входных и выходных токенов для флагмана);
  • качество ответа модели не меняется;
  • обратная совместимость: старые запросы с приоритетным тарифом работают без изменений кода.

OpenAI рекомендует комбинировать модели внутри одного процесса: флагман — для сложного планирования, экономичный уровень — для массовых, хорошо определённых операций, сбалансированный — для повседневной работы средней сложности.

В ChatGPT Work и Codex цены подписок и квоты не менялись, но расход кредитов на Luna и Terra снизился пропорционально новым тарифам.

OpenAI объясняет снижение эффективностью, которую команда добилась при разработке GPT‑5.6: оптимизация вычислительного ядра (−20% стоимости обслуживания) и улучшение предсказательного декодирования (+15% эффективности генерации токенов).

Почему это важно

Три недели назад GPT‑5.6 вышел в общий доступ с тремя уровнями. Тогда главный вопрос был «какую модель выбрать для задачи». Сейчас вопрос смещается: какие процессы можно держать постоянно, а не запускать точечно на пилоте.

При старых ценах экономичный уровень многие сценарии «на каждый лид / каждый объект / каждую строку CRM» были слишком дорогими для ежедневного фона. После снижения на 80% та же модель стоит в пять раз меньше — и Luna по-прежнему умеет вызывать инструменты и проходить многошаговые рабочие процессы.

Экономически реалистичными становятся процессы, которые раньше откладывали «до масштаба»:

  • классификация всех лидов и обращений;
  • ежедневная проверка тысяч рекламных объектов;
  • мониторинг конкурентов и цен;
  • массовое обогащение CRM;
  • фоновая проверка результатов более дорогого агента.

Главная единица оптимизации теперь — не цена токена, а стоимость принятого бизнес-результата: сколько стоит один корректно обработанный лид, одна проверенная кампания, одна строка CRM без ручной правки.

Что это означает для бизнеса

  1. Пересмотрите «дорогие» пилоты. Процессы, которые вы отложили из-за прайса Luna, стоит пересчитать — цифры в смете могли устареть за одну ночь.
  2. Маршрутизация важнее выбора одной модели. Флагман планирует → экономичный уровень выполняет → сбалансированный или флагман проверяет — это уже не теория, а экономически оправданная схема при новых ценах.
  3. Ускоренный режим — для задержки, не для качества. Если агент ждёт ответ флагмана на критическом шаге и пользователь видит паузу, ускоренный режим убирает узкое место. Для ночных пакетных задач он избыточен.
  4. Считайте итог, а не таблицу. Дешёвая Luna на объёме может съесть бюджет, если каждый третий прогон требует переделки на флагмане. Сравнивайте стоимость готового результата, а не миллиона токенов.

Что протестировать

На 50 одинаковых маркетинговых задачах (например, классификация лидов из CRM или проверка объявлений по чек-листу) сравните три схемы:

  1. Только флагман — одна модель на весь процесс.
  2. Только экономичный уровень — та же задача на Luna.
  3. Флагман планирует → Luna выполняет → Terra проверяетмаршрутизация по шагам.

Метрики для каждой схемы:

  • качество принятого результата (доля без ручных правок);
  • число повторных запусков;
  • задержка до готового ответа;
  • итоговая стоимость прогона;
  • доля задач, потребовавших вмешательства человека.

Зафиксируйте правило: при какой доле ошибок Luna эскалируется на Terra или флагман — и кто в команде это утверждает.

Главный вывод

OpenAI не просто подрезала прайс — она сдвигает границу «что можно держать постоянно». Luna по новым ценам ближе к инфраструктурному расходу, чем к разовому эксперименту.

Для бизнеса это значит: составьте список фоновых AI-процессов, которые вы откладывали, пересчитайте их на актуальных тарифах и прогоните сравнительный тест на реальных данных. Побеждает не самая дешёвая модель, а схема с меньшей стоимостью принятого результата.

Не ждите, что Luna «починит» кривые справочники и рассинхрон меток. Она ускорит правильный процесс — и быстрее размножит неправильный. Сначала данные и правила, потом масштаб.

Источники

← Все новости AI и MCP