OpenAI снизила цену GPT‑5.6 Luna на 80% и запустила ускоренный режим Sol
30 июля 2026 OpenAI снизила цены программного интерфейса (API) для двух уровней GPT‑5.6: Luna — на 80%, Terra — на 20%. Для флагманского Sol появился ускоренный режим — до 2,5× быстрее стандартного при двукратной стоимости. Для вас это сигнал: постоянный AI на больших объёмах (классификация лидов, проверка рекламы, обогащение CRM) становится экономически реалистичным — если считать не токены, а стоимость готового результата.
Коротко
- Что изменилось: цены программного интерфейса для GPT‑5.6 Luna и Terra; ускоренный режим для Sol вместо приоритетной обработки.
- Luna: $0,20 / $1,20 за миллион входных и выходных токенов — было $1 / $6 (минус 80%).
- Terra: $2 / $12 — было $2,50 / $15 (минус 20%).
- Sol: $5 / $30 — без изменений; ускоренный режим — до 2,5× быстрее при двукратной стоимости.
- Главное последствие: постоянные фоновые AI-процессы на больших объёмах становятся заметно дешевле.
Что изменилось
30 июля 2026 OpenAI в анонсе снизила цены двух уровней семейства GPT‑5.6 и представила ускоренный режим для флагмана. Изменения уже в прайсе; на облачных площадках партнёров раскатка шла в течение дня.
Цены за 1 млн токенов (стандартный режим):
| Уровень | Вход — было | Вход — стало | Выход — было | Выход — стало |
|---|---|---|---|---|
| Флагман | $5,00 | $5,00 | $30,00 | $30,00 |
| Сбалансированный | $2,50 | $2,00 | $15,00 | $12,00 |
| Экономичный | $1,00 | $0,20 | $6,00 | $1,20 |
Соответствие уровней семейства GPT‑5.6: флагман — Sol, сбалансированный — Terra, экономичный — Luna.
Снижение затрагивает и производные тарифы: пакетный и гибкий режимы, кэшированный ввод и длинный контекст — по тем же пропорциям.
Ускоренный режим для Sol заменяет приоритетную обработку. По заявлению OpenAI:
- до 2,5× выше скорость, чем в стандартном режиме;
- двукратная стоимость ($10 / $60 за 1 млн входных и выходных токенов для флагмана);
- качество ответа модели не меняется;
- обратная совместимость: старые запросы с приоритетным тарифом работают без изменений кода.
OpenAI рекомендует комбинировать модели внутри одного процесса: флагман — для сложного планирования, экономичный уровень — для массовых, хорошо определённых операций, сбалансированный — для повседневной работы средней сложности.
В ChatGPT Work и Codex цены подписок и квоты не менялись, но расход кредитов на Luna и Terra снизился пропорционально новым тарифам.
OpenAI объясняет снижение эффективностью, которую команда добилась при разработке GPT‑5.6: оптимизация вычислительного ядра (−20% стоимости обслуживания) и улучшение предсказательного декодирования (+15% эффективности генерации токенов).
Почему это важно
Три недели назад GPT‑5.6 вышел в общий доступ с тремя уровнями. Тогда главный вопрос был «какую модель выбрать для задачи». Сейчас вопрос смещается: какие процессы можно держать постоянно, а не запускать точечно на пилоте.
При старых ценах экономичный уровень многие сценарии «на каждый лид / каждый объект / каждую строку CRM» были слишком дорогими для ежедневного фона. После снижения на 80% та же модель стоит в пять раз меньше — и Luna по-прежнему умеет вызывать инструменты и проходить многошаговые рабочие процессы.
Экономически реалистичными становятся процессы, которые раньше откладывали «до масштаба»:
- классификация всех лидов и обращений;
- ежедневная проверка тысяч рекламных объектов;
- мониторинг конкурентов и цен;
- массовое обогащение CRM;
- фоновая проверка результатов более дорогого агента.
Главная единица оптимизации теперь — не цена токена, а стоимость принятого бизнес-результата: сколько стоит один корректно обработанный лид, одна проверенная кампания, одна строка CRM без ручной правки.
Что это означает для бизнеса
- Пересмотрите «дорогие» пилоты. Процессы, которые вы отложили из-за прайса Luna, стоит пересчитать — цифры в смете могли устареть за одну ночь.
- Маршрутизация важнее выбора одной модели. Флагман планирует → экономичный уровень выполняет → сбалансированный или флагман проверяет — это уже не теория, а экономически оправданная схема при новых ценах.
- Ускоренный режим — для задержки, не для качества. Если агент ждёт ответ флагмана на критическом шаге и пользователь видит паузу, ускоренный режим убирает узкое место. Для ночных пакетных задач он избыточен.
- Считайте итог, а не таблицу. Дешёвая Luna на объёме может съесть бюджет, если каждый третий прогон требует переделки на флагмане. Сравнивайте стоимость готового результата, а не миллиона токенов.
Что протестировать
На 50 одинаковых маркетинговых задачах (например, классификация лидов из CRM или проверка объявлений по чек-листу) сравните три схемы:
- Только флагман — одна модель на весь процесс.
- Только экономичный уровень — та же задача на Luna.
- Флагман планирует → Luna выполняет → Terra проверяет — маршрутизация по шагам.
Метрики для каждой схемы:
- качество принятого результата (доля без ручных правок);
- число повторных запусков;
- задержка до готового ответа;
- итоговая стоимость прогона;
- доля задач, потребовавших вмешательства человека.
Зафиксируйте правило: при какой доле ошибок Luna эскалируется на Terra или флагман — и кто в команде это утверждает.
Главный вывод
OpenAI не просто подрезала прайс — она сдвигает границу «что можно держать постоянно». Luna по новым ценам ближе к инфраструктурному расходу, чем к разовому эксперименту.
Для бизнеса это значит: составьте список фоновых AI-процессов, которые вы откладывали, пересчитайте их на актуальных тарифах и прогоните сравнительный тест на реальных данных. Побеждает не самая дешёвая модель, а схема с меньшей стоимостью принятого результата.
Не ждите, что Luna «починит» кривые справочники и рассинхрон меток. Она ускорит правильный процесс — и быстрее размножит неправильный. Сначала данные и правила, потом масштаб.
Источники
- Advancing the price-performance frontier with GPT-5.6 — OpenAI, 2026-07-30
- Fast mode for API Customers — OpenAI, 2026-07-30