Ценовые войны в сфере ИИ: OpenAI снижает цены на GPT-5.6 Luna на 80%, поскольку конкуренция моделей смещается в сторону стоимости
Источник: VentureBeat · Carl Franzen
Цитируя древнего мастера-джедая «Начались ценовые войны ИИ!»
OpenAI резко снижает цены на две модели из своей передовой линейки GPT-5.6: GPT-5.6 Luna — самую маленькую и быструю модель в серии — подешевела на 80%, а GPT-5.6 Terra, модель среднего уровня, — на 20%. Одновременно с этим для флагманской модели GPT-5.6 Sol добавляется премиальный режим Fast.
Эти снижения цен приближают Luna к самым дешевым коммерческим моделям на рынке и происходят всего через несколько дней после того, как Anthropic выпустила высокопроизводительную Claude Opus 5 по той же цене, что и Opus 4.8, а Google представила Gemini 3.6 Flash и Gemini 3.5 Flash-Lite — две конкурирующие модели, ориентированные на снижение затрат на вывод (inference), более быстрое выполнение и эффективные рабочие нагрузки агентов.
OpenAI успешно снижает цены Google за единицу «интеллекта» и пытается переманить пользователей Anthropic, которым может быть не жалко платить больше, за счет прироста скорости.
OpenAI заявляет, что теперь Luna будет стоить $0,20 за миллион входных токенов и $1,20 за миллион выходных токенов, что составляет в сумме $1,40 за миллион токенов.
Terra будет стоить $2 за миллион входных токенов и $12 за миллион выходных токенов, при общей цене в $14.
Цена на Sol Standard осталась прежней: $5 за миллион входных токенов и $30 за миллион выходных токенов. OpenAI также добавляет режим Sol Fast по цене вдвое выше Standard: $10 за миллион входных токенов и $60 за миллион выходных токенов.
Компания заявляет, что режим Fast обеспечивает пропускную способность до 2,5 раз выше без изменения базового уровня интеллекта модели.
Соучредитель и генеральный директор OpenAI Сэм Альтман написал в X, объявив об изменениях как о «крупном снижении цен сегодня».
Сравнение цен на API передовых моделей ИИ от VentureBeat
|
Модель |
Вход ($/1M) |
Выход ($/1M) |
Итого ($/1M) |
Источник |
|
MiMo-V2.5 Flash |
$0.10 |
$0.30 |
$0.40 |
|
|
deepseek-v4-flash |
$0.14 |
$0.28 |
$0.42 |
|
|
deepseek-v4-pro |
$0.435 |
$0.87 |
$1.305 |
|
|
GPT-5.6 Luna |
$0.20 |
$1.20 |
$1.40 |
|
|
MiniMax-M3 |
$0.30 |
$1.20 |
$1.50 |
|
|
LongCat-2.0 — акция с ограниченным сроком действия |
$0.30 |
$1.20 |
$1.50 |
|
|
Gemini 3.1 Flash-Lite |
$0.25 |
$1.50 |
$1.75 |
|
|
Qwen3.7-Plus |
$0.40 |
$1.60 |
$2.00 |
|
|
MiMo-V2.5 |
$0.40 |
$2.00 |
$2.40 |
|
|
Gemini 3.5 Flash-Lite |
$0.30 |
$2.50 |
$2.80 |
|
|
LongCat-2.0 — стандартная |
$0.75 |
$2.95 |
$3.70 |
|
|
MiMo-V2.5 Pro (≤256K) |
$1.00 |
$3.00 |
$4.00 |
|
|
GLM-5.2 |
$1.40 |
$4.40 |
$5.80 |
|
|
Grok 4.5 |
$2.00 |
$6.00 |
$8.00 |
|
|
MiMo-V2.5 Pro (>256K) |
$2.00 |
$6.00 |
$8.00 |
|
|
Gemini 3.6 Flash |
$1.50 |
$7.50 |
$9.00 |
|
|
Qwen3.7-Max |
$2.50 |
$7.50 |
$10.00 |
|
|
Gemini 3.5 Flash |
$1.50 |
$9.00 |
$10.50 |
|
|
Gemini 3.1 Pro Preview (≤200K) |
$2.00 |
$12.00 |
$14.00 |
|
|
GPT-5.6 Terra |
$2.00 |
$12.00 |
$14.00 |
|
|
GPT-5.4 |
$2.50 |
$15.00 |
$17.50 |
|
|
Kimi K3 |
$3.00 |
$15.00 |
$18.00 |
|
|
Gemini 3.1 Pro Preview (>200K) |
$4.00 |
$18.00 |
$22.00 |
|
|
Claude Opus 5 |
$5.00 |
$25.00 |
$30.00 |
|
|
GPT-5.5 |
$5.00 |
$30.00 |
$35.00 |
|
|
GPT-5.5 Instant (chat-latest) |
$5.00 |
$30.00 |
$35.00 |
|
|
Sakana Fugu Ultra (≤272K) |
$5.00 |
$30.00 |
$35.00 |
|
|
GPT-5.6 Sol — Стандартный режим |
$5.00 |
$30.00 |
$35.00 |
|
|
Claude Fable 5 / Claude Mythos 5 |
$10.00 |
$50.00 |
$60.00 |
|
|
GPT-5.6 Sol — Режим Fast |
$10.00 |
$60.00 |
$70.00 |
Цены указаны за один миллион токенов. Общая стоимость рассчитывается как цена входных данных плюс цена выходных данных. Цены на кэшированные входные данные исключены для обеспечения сопоставимости данных у разных провайдеров.
OpenAI переводит Luna в бюджетный сегмент
Наиболее существенным изменением стало снижение цены на Luna.
Когда OpenAI представила серию GPT-5.6, Luna стоила $1 за миллион входных токенов и $6 за миллион выходных токенов, что в сумме составляло $7. Новые расценки снижают этот суммарный показатель до $1,40.
Это ставит Luna ниже Gemini 3.5 Flash-Lite от Google, которая стоит в сумме $2,80 за миллион входных и выходных токенов, и намного ниже Gemini 3.6 Flash с ее $9. Luna теперь также стоит значительно дешевле собственных моделей OpenAI GPT-5.4 и Terra.
Она не является самой дешевой моделью на широком рынке. MiMo-V2.5 Flash от Xiaomi, flash-модель от DeepSeek и ряд других API остаются более дешевыми из расчёта на чистые токены. Но это снижение выводит передовую модель OpenAI в прямую конкуренцию с бюджетным сегментом вычислений на рынке.
OpenAI заявляет, что серия GPT-5.6 представляет ее семейство передовых моделей, где Sol занимает верхнюю позицию в линейке, Terra — средний уровень, а Luna — самый маленький и быстрый вариант.
Эта линейка была первоначально выпущена в конце июня 2026 года в рамках ограниченного развертывания по запросу правительства США перед более широким доступом, причем каждая модель призвана предложить свой баланс между интеллектом, задержкой и стоимостью.
Sol нацелена на самые сложные рабочие нагрузки, требующие интенсивных рассуждений и работы агентов, включая продвинутое написание кода, многошаговое планирование и системы с использованием инструментов, в то время как Terra разработана для общего производственного использования, где требуется баланс возможностей и эффективности. Luna позиционируется для задач с высокой пропускной способностью и низкой задержкой, таких как суммаризация, классификация, маршрутизация и легкие ассистенты реального времени, где стоимость за запрос является главным ограничением.
Terra дешевеет, сравнявшись с ценами Google Gemini 3.1 Pro
Снижение цены Terra на 20% уменьшает ее общую стоимость с $17,50 до $14 за миллион токенов.
На этом уровне Terra теперь соответствует ценам Google Gemini 3.1 Pro Preview для контекстных окон размером 200 000 токенов или менее.
Она также оказывается дешевле собственной модели OpenAI GPT-5.4, которая по-прежнему стоит $2,50 за миллион входных токенов и $15 за миллион выходных токенов, предлагая тот же уровень интеллекта примерно за 1/13 стоимости, как отметил Ниц Данц (Nic Dunz) из Krea AI в X:
Это изменение создает более четкое разделение между тремя уровнями GPT-5.6 от OpenAI. Luna стоит в десять раз дешевле Terra при простом суммарном подсчете входных и выходных данных, в то время как Terra на 60% дешевле Sol Standard.
Sol Fast движется в противоположном направлении. Общая стоимость в $70 за миллион токенов делает ее самой дорогой конфигурацией модели в приведенном ниже сравнении, что отражает решение OpenAI взимать надбавку за рабочие нагрузки, чувствительные к задержкам, а не снижать базовую цену Sol.
Снижение цен последовало за бюджетными релизами Gemini от Google и Claude Opus 5 от Anthropic
Изменения ценовой политики OpenAI произошли всего через полторы недели после того, как Google представила собственные бюджетные Gemini 3.6 Flash и Gemini 3.5 Flash-Lite.
Google оценила Gemini 3.6 Flash в $1,50 за миллион входных токенов и $7,50 за миллион выходных токенов. Gemini 3.5 Flash-Lite стоит $0,30 за миллион входных токенов и $2,50 за миллион выходных токенов.
Google позиционировала обе модели с точки зрения экономики развертывания агентов, утверждая, что меньшее использование токенов, меньшее количество шагов рассуждения и сокращение вызовов инструментов могут снизить общую стоимость долгосрочных задач программной инженерии и интеллектуального труда.
Сообщается, что Gemini 3.6 Flash использует на 17% меньше выходных токенов, чем Gemini 3.5 Flash по индексу Artificial Analysis Index, а экономия в некоторых долгосрочных инженерных задачах достигает 65%. Gemini 3.5 Flash-Lite позиционируется как самая быстрая модель в серии Google 3.5.
Тем не менее, модели OpenAI обладают более высокой производительностью, чем модели Google, согласно данным сторонних аналитических агентств, таких как Artificial Analysis: даже модель Luna превосходит Gemini 3.6 Flash и более старую модель Gemini 3.1 Pro, что делает показатель стоимости за единицу интеллекта гораздо более выгодным для OpenAI.
Скриншот индекса интеллекта Artificial Analysis по состоянию на июль 2026 года
Как отметил в X ИИ-стартап Cognition, GPT-5.6 теперь «располагается на кривой Парето эффективности соотношения цены и производительности», опубликовав анимацию смещения серии GPT-5.6 влево на графике, где по оси Y отложен интеллект, а по оси X — стоимость. Это демонстрирует, что модели теперь предлагают один из самых высоких уровней интеллекта на рынке при минимальной стоимости.
И тем не менее, конкурирующая Claude Opus 5 от Anthropic остается примерно столь же производительной, как GPT-5.6 Sol, но при этом на 6% дешевле.
Модель стоит $5 за миллион входных токенов и $25 за миллион выходных токенов — те же тарифы, что и у Opus 4.8, но Anthropic заявляет, что она обеспечивает практически весь интеллект своей более дорогой модели Fable 5 примерно за полцены.
В отличие от изменений Luna и Terra в OpenAI, Anthropic не стала снижать розничную цену API Opus. Вместо этого она фактически снизила стоимость за единицу возможностей, заменив Opus 4.8 на более производительную модель по той же суммарной ставке в $30 за входные и выходные данные. Anthropic также добавила регулируемую настройку усиления (effort), которая позволяет разработчикам жертвовать глубиной рассуждений ради скорости и экономии токенов.
Это различие имеет значение для корпоративных покупателей. OpenAI напрямую снижает расценки за токен, Google сочетает более низкие цены со снижением использования токенов и вызовов инструментов, а Anthropic делает акцент на более высокой производительности задач при неизменной цене. Все три подхода нацелены на один и тот же операционный показатель: общую стоимость выполнения производственных работ, а не только на заявленную стоимость отдельного токена.
Выбранный момент подчеркивает, как быстро ценообразование стало рычагом конкуренции среди провайдеров передовых моделей. Ответный шаг OpenAI не предполагает выпуск нового поколения моделей. Вместо этого он меняет экономику развертывания моделей, которые были выпущены совсем недавно.
Рынок смещается от доступа к моделям к их экономике
Снижение цен свидетельствует о том, что доступ к возможностям передового уровня больше не является единственной точкой конкуренции. Следующий вопрос для бизнеса заключается в том, насколько дешево и предсказуемо эти модели могут работать в продакшене.
OpenAI по-прежнему не является самым дешевым провайдером в расчете на чистые токены. Но 80-процентное сокращение стоимости Luna кардинально меняет ее позиции, переводя ее из середины рынка в ценовой сегмент, где представлены более компактные модели от Google, Xiaomi, DeepSeek, MiniMax и других вендоров.
Это важнее всего для высоконагруженных приложений, где относительно небольшие различия в стоимости токенов могут накапливаться в масштабах кодинг-агентов, документных систем, инструментов внутреннего поиска и автоматизированных рабочих процессов.
Таким образом, последний шаг OpenAI выглядит скорее не как рутинная корректировка, а как перепозиционирование серии GPT-5.6. Sol остается премиальным вариантом, Terra приближается к конкурирующим системам про-уровня, а Luna становится прямым ответом компании на растущий в индустрии сегмент бюджетных моделей.



