OpenAI резко снижает цены на GPT-5.6 и ускоряет флагманскую модель

30 июля 2026 года OpenAI объявила о значительном снижении стоимости двух из трёх моделей серии GPT-5.6 в API. Начиная с этого дня, GPT-5.6 Luna подешевела на 80%, а GPT-5.6 Terra — на 20%. Одновременно для флагманского GPT-5.6 Sol появился новый режим Fast Mode, обеспечивающий скорость до 2,5 раза выше стандартной при двойной тарифной ставке. Это прямое следствие того, что сама модель помогла оптимизировать собственный запуск.


Что такое серия GPT-5.6

GPT-5.6 — большая языковая модель (LLM, Large Language Model), разработанная OpenAI и выпущенная 9 июля 2026 года. В отличие от предыдущих поколений, где OpenAI выпускала единую модель с настраиваемым уровнем усилий, GPT-5.6 вышла сразу в трёх отдельных уровнях: Sol, Terra и Luna — каждый настроен под свою точку баланса между ценой, скоростью и возможностями.

ℹ Три уровня GPT-5.6
  • Sol — флагман для сложных задач: кодирование, кибербезопасность, биология, долгосрочные агентные сценарии.
  • Terra — сбалансированная модель для ежедневной работы.
  • Luna — самая быстрая и доступная, для высокообъёмных задач с низкой латентностью.

GPT-5.6 Sol устанавливает новый стандарт как по интеллекту, так и по эффективности: модель достигает рекордных результатов в кодировании, работе со знаниями, кибербезопасности и науке, превосходя предыдущие и конкурирующие фронтирные модели при меньшем количестве токенов и более низкой расчётной стоимости.


Новые цены: что и сколько стоит

После снижения GPT-5.6 Luna стоит $0,20 за миллион входных токенов и $1,20 за миллион выходных. Тариф GPT-5.6 Terra установлен на уровне $2 за миллион входных и $12 за миллион выходных токенов.

МодельВходные токены (1M)Выходные токены (1M)Изменение
Sol$5,00$30,00без изменений
Terra$2,00$12,00−20%
Luna$0,20$1,20−80%
💡 Совет для разработчиков
Если вы запускаете высокообъёмные pipeline’ы — классификацию, маршрутизацию, черновые генерации — Luna после снижения цены становится одним из самых дешёвых коммерческих вариантов на рынке. Используйте Sol только там, где точность критична.

Снижение цен для Luna и Terra также учитывается при подсчёте использования в платных подписках Codex и ChatGPT Work.


Откуда взялась экономия

Снижение цен — не маркетинговый ход, а результат инженерной работы. Прорывы в эффективности частично обусловлены тем, что GPT-5.6 Sol самостоятельно переписал производственные kernel-коды (низкоуровневые вычислительные процедуры), сократив стоимость обслуживания модели на 20%.

Работа с ядрами снизила сквозную стоимость обслуживания модели на 20%, а эксперименты увеличили эффективность генерации токенов более чем на 15%. Эта работа продолжается, создавая более тесную петлю обратной связи: по мере того как модели улучшаются и способны работать более автономно, ускоряется и возможность повышать эффективность.


graph TD
    A[GPT-5.6 Sol оптимизирует kernel-код] --> B[Стоимость инференса −20%]
    A --> C[Эффективность токен-генерации +15%]
    B --> D[Снижение цен Luna −80% / Terra −20%]
    C --> D
    D --> E[Экономия для клиентов API]


Fast Mode для Sol: скорость по запросу

Для лёгкой модели GPT-5.6 Luna цена API снизилась на 80%, для среднего уровня GPT-5.6 Terra — на 20%. Новый API Fast Mode для флагманского GPT-5.6 Sol обеспечивает скорость до 2,5 раза выше стандартной при двойном тарифе — это замена прежнему уровню Priority Processing.

«GPT-5.6 даёт бизнесу значительно больше возможностей для оптимизации соотношения цены и качества» — OpenAI


Контекст: ценовые войны в AI

Снижение цен происходит через несколько дней после того, как Anthropic выпустила Claude Opus 5 по той же цене, что и Opus 4.8, а Google представила Gemini 3.6 Flash и Gemini 3.5 Flash-Lite — две конкурирующие модели, ориентированные на снижение стоимости инференса, более быстрое выполнение и эффективные агентные нагрузки.

AI-стартап Cognition отметил в X, что GPT-5.6 теперь «находится на кривой Парето по соотношению цена/производительность», — модели серии теперь предлагают одни из лучших показателей интеллекта при наименьшей стоимости на рынке.

Luna почти соответствует пиковой производительности GPT-5.5 при менее чем половине расчётной стоимости, тогда как Terra превосходит его при меньших затратах.

⚠ Важно
При этом конкурент не сдаётся: Claude Opus 5 от Anthropic остаётся примерно сопоставимым по производительности с GPT-5.6 Sol, но при этом на 6% дешевле. Выбор модели по-прежнему зависит от конкретной задачи.

Итог

OpenAI делает ставку на доступность: агрессивное снижение цен на Luna и Terra расширяет возможности для высокообъёмных enterprise-задач, тогда как Fast Mode для Sol позволяет платить за скорость только тогда, когда она действительно нужна. Делая каждый слой более эффективным, OpenAI обеспечивает более высокую производительность за доллар в большем числе корпоративных рабочих нагрузок.