OpenAI снижает цены GPT-5.6 Luna на 80% и добавляет Fast Mode для Sol
OpenAI объявила о снижении цен GPT-5.6 Luna на 80% и Terra на 20%, а также о запуске Fast Mode для флагманского Sol. Что изменилось и зачем.
OpenAI резко снижает цены на GPT-5.6 и ускоряет флагманскую модель
30 июля 2026 года OpenAI объявила о значительном снижении стоимости двух из трёх моделей серии GPT-5.6 в API. Начиная с этого дня, GPT-5.6 Luna подешевела на 80%, а GPT-5.6 Terra — на 20%. Одновременно для флагманского GPT-5.6 Sol появился новый режим Fast Mode, обеспечивающий скорость до 2,5 раза выше стандартной при двойной тарифной ставке. Это прямое следствие того, что сама модель помогла оптимизировать собственный запуск.
Что такое серия GPT-5.6
GPT-5.6 — большая языковая модель (LLM, Large Language Model), разработанная OpenAI и выпущенная 9 июля 2026 года. В отличие от предыдущих поколений, где OpenAI выпускала единую модель с настраиваемым уровнем усилий, GPT-5.6 вышла сразу в трёх отдельных уровнях: Sol, Terra и Luna — каждый настроен под свою точку баланса между ценой, скоростью и возможностями.
- Sol — флагман для сложных задач: кодирование, кибербезопасность, биология, долгосрочные агентные сценарии.
- Terra — сбалансированная модель для ежедневной работы.
- Luna — самая быстрая и доступная, для высокообъёмных задач с низкой латентностью.
GPT-5.6 Sol устанавливает новый стандарт как по интеллекту, так и по эффективности: модель достигает рекордных результатов в кодировании, работе со знаниями, кибербезопасности и науке, превосходя предыдущие и конкурирующие фронтирные модели при меньшем количестве токенов и более низкой расчётной стоимости.
Новые цены: что и сколько стоит
После снижения GPT-5.6 Luna стоит $0,20 за миллион входных токенов и $1,20 за миллион выходных. Тариф GPT-5.6 Terra установлен на уровне $2 за миллион входных и $12 за миллион выходных токенов.
| Модель | Входные токены (1M) | Выходные токены (1M) | Изменение |
|---|---|---|---|
| Sol | $5,00 | $30,00 | без изменений |
| Terra | $2,00 | $12,00 | −20% |
| Luna | $0,20 | $1,20 | −80% |
Снижение цен для Luna и Terra также учитывается при подсчёте использования в платных подписках Codex и ChatGPT Work.
Откуда взялась экономия
Снижение цен — не маркетинговый ход, а результат инженерной работы. Прорывы в эффективности частично обусловлены тем, что GPT-5.6 Sol самостоятельно переписал производственные kernel-коды (низкоуровневые вычислительные процедуры), сократив стоимость обслуживания модели на 20%.
Работа с ядрами снизила сквозную стоимость обслуживания модели на 20%, а эксперименты увеличили эффективность генерации токенов более чем на 15%. Эта работа продолжается, создавая более тесную петлю обратной связи: по мере того как модели улучшаются и способны работать более автономно, ускоряется и возможность повышать эффективность.
graph TD
A[GPT-5.6 Sol оптимизирует kernel-код] --> B[Стоимость инференса −20%]
A --> C[Эффективность токен-генерации +15%]
B --> D[Снижение цен Luna −80% / Terra −20%]
C --> D
D --> E[Экономия для клиентов API]
Fast Mode для Sol: скорость по запросу
Для лёгкой модели GPT-5.6 Luna цена API снизилась на 80%, для среднего уровня GPT-5.6 Terra — на 20%. Новый API Fast Mode для флагманского GPT-5.6 Sol обеспечивает скорость до 2,5 раза выше стандартной при двойном тарифе — это замена прежнему уровню Priority Processing.
«GPT-5.6 даёт бизнесу значительно больше возможностей для оптимизации соотношения цены и качества» — OpenAI
Контекст: ценовые войны в AI
Снижение цен происходит через несколько дней после того, как Anthropic выпустила Claude Opus 5 по той же цене, что и Opus 4.8, а Google представила Gemini 3.6 Flash и Gemini 3.5 Flash-Lite — две конкурирующие модели, ориентированные на снижение стоимости инференса, более быстрое выполнение и эффективные агентные нагрузки.
AI-стартап Cognition отметил в X, что GPT-5.6 теперь «находится на кривой Парето по соотношению цена/производительность», — модели серии теперь предлагают одни из лучших показателей интеллекта при наименьшей стоимости на рынке.
Luna почти соответствует пиковой производительности GPT-5.5 при менее чем половине расчётной стоимости, тогда как Terra превосходит его при меньших затратах.
Итог
OpenAI делает ставку на доступность: агрессивное снижение цен на Luna и Terra расширяет возможности для высокообъёмных enterprise-задач, тогда как Fast Mode для Sol позволяет платить за скорость только тогда, когда она действительно нужна. Делая каждый слой более эффективным, OpenAI обеспечивает более высокую производительность за доллар в большем числе корпоративных рабочих нагрузок.