GPT-6.1 Sol от OpenAI обеспечивает производительность на уровне Astra за пятую часть цены. Новый сверхбыстрый тарифный план выдаёт 300 токенов в секунду.

GPT-6.1 Sol от OpenAI обеспечивает производительность на уровне Astra за пятую часть цены. Новый сверхбыстрый тарифный план выдаёт 300 токенов в секунду.

OpenAI представила GPT-6.1 Sol — обновлённую версию GPT-6 Sol, которая, по словам компании, приближается к флагманской GPT-6 Astra в программировании, работе с компьютером и профессиональных задачах, но обходится в пятую часть стандартной стоимости входных и выходных токенов Astra.

Одновременно OpenAI официально представила Ultrafast — премиальный режим инференса, обеспечивающий генерацию токенов до 8 раз быстрее в Codex и до 6 раз быстрее через API, со скоростью до 300 токенов в секунду.

При такой скорости режим Ultrafast от OpenAI уверенно войдёт в число самых быстрых предложений на современном рынке моделей, но не станет безусловным лидером по пропускной способности.

Независимая сторонняя компания, занимающаяся сравнительным тестированием, Artificial Analysis в настоящее время оценивает скорость Google Gemini 3.5 Flash примерно в 201 токен в секунду, тогда как специализированные модели, ориентированные на скорость, показывают гораздо более высокие результаты: Mercury 2 — около 769 токенов в секунду, а Celeris-1 — около 1 491 токена в секунду.

Artificial Analysis benchmarking of model output speed (tokens per second)

Результаты тестирования скорости вывода моделей (токенов в секунду) от Artificial Analysis. Источник: Artificial Analysis

Разница в том, что OpenAI предлагает скорость до 300 токенов в секунду для своих передовых моделей класса GPT-6, тогда как абсолютные лидеры по скорости, как правило, специально оптимизированы для инференса с чрезвычайно высокой пропускной способностью.

За скорость приходится платить существенную надбавку: использование API обходится в 6 раз дороже стандартного тарифа соответствующей модели. Ultrafast уже доступен для GPT-6 Astra, а версия для 6.1 Sol, по словам компании, появится в ближайшее время.

Вместе эти релизы расширяют спектр соотношения цены и производительности для корпоративных разработчиков. Организации могут поручить сравнительно недорогой модели Sol всё более сложную автономную работу или платить значительно больше, если ограничивающим фактором становится задержка ответа, а не стоимость токенов.

GPT-6.1 Sol сохраняет цены Sol, приближаясь к производительности Astra

Возможно, самая важная деталь в ценовой политике — то, что OpenAI не стала повышать.

GPT-6.1 Sol стоит 2 доллара за миллион входных токенов, 0,10 доллара за миллион кэшированных входных токенов и 10 долларов за миллион выходных токенов.

Тарифы на некэшированные входные и выходные токены такие же, как у GPT-6 Sol, а цена кэшированных входных токенов снизилась с 0,20 до 0,10 доллара за миллион — на 50%. В актуальной документации OpenAI для разработчиков указаны цены GPT-6 Sol: 2 доллара за входные токены, 0,20 доллара за кэшированные входные и 10 долларов за выходные.

С точки зрения планирования бюджета переход между поколениями моделей получается необычайно простым: разработчики могут перейти с GPT-6 Sol на GPT-6.1 Sol, не соглашаясь на повышение базовой стоимости токенов.

Разница с Astra ещё заметнее. Сейчас OpenAI берёт за GPT-6 Astra 10 долларов за миллион входных токенов, 1 доллар за миллион кэшированных входных и 50 долларов за миллион выходных. Таким образом, стандартные тарифы GPT-6.1 Sol на некэшированные входные и выходные токены ровно в пять раз ниже, чем у Astra, а цена кэшированных входных токенов — 0,10 доллара — в десять раз ниже.

Для сравнения: GPT-5.6 Sol, на которую сейчас действует скидка, стоит 4 доллара за миллион входных токенов и 20 долларов за миллион выходных. Это значит, что текущая цена токенов GPT-6.1 Sol вдвое ниже цены этой более старой модели поколения Sol. В документации по ценам OpenAI говорится, что специальный тариф GPT-5.6 Sol будет действовать как минимум до 21 ноября 2026 года.

Модель / тарифный план

Входные токены / 1 млн

Кэшированные входные токены / 1 млн

Выходные токены / 1 млн

GPT-5.6 Sol, текущий специальный тариф

4 доллара

0,40 доллара

20 долларов

GPT-6 Sol

2 доллара

0,20 доллара

10 долларов

GPT-6.1 Sol

2 доллара

0,10 доллара

10 долларов

GPT-6 Astra

10 долларов

1 доллар

50 долларов

Снижение цены на кэшированные входные токены особенно важно для корпоративных агентов. Долго работающие агенты для программирования, исследовательские системы и автоматизация бизнес-процессов часто повторно используют системные инструкции, контекст репозитория, политики, справочные документы и другие материалы промптов в нескольких запросах. Снижение стоимости обработки такого повторно используемого контекста может иметь большее значение, чем заявленная цена входных токенов, если речь идёт о задачах, для выполнения которых требуются сотни или тысячи обращений к модели.

По словам OpenAI, производительность Sol значительно приблизилась к Astra

OpenAI подкрепляет свои аргументы в пользу ценовой политики результатами собственных оценок, показывающих, что GPT-6.1 Sol сокращает отставание от Astra. В тесте DeepSWE v1.1, оценивающем длительную работу по разработке программного обеспечения в реальных кодовых базах, GPT-6.1 Sol показывает результат на уровне Astra примерно за пятую часть её стоимости и превосходит лучший результат GPT-6 Sol на 6,4 процентного пункта, сообщает OpenAI.

В тесте GDP.pdf, который оценивает работу со сложными профессиональными документами, содержащими диаграммы, таблицы, схемы и информацию, напечатанную мелким шрифтом, OpenAI сообщает, что GPT-6.1 Sol превосходит Claude Opus 5.5 от Anthropic с резервными моделями, обходясь менее чем в половину стоимости за задачу. По производительности модель также приближается к Astra, обходясь примерно в пятую часть её стоимости.

Для корпоративного развёртывания агентов, возможно, ещё важнее результаты теста AutomationBench, в котором проверяются сквозные задачи с использованием 47 инструментов в сферах продаж, маркетинга, операционной деятельности, поддержки, финансов и управления персоналом. OpenAI утверждает, что при среднем уровне вычислительных усилий GPT-6.1 Sol превосходит Opus 5.5 на 2,2 процентного пункта, обходясь примерно в треть её стоимости, а также показывает результат на 4,8 процентного пункта лучше GPT-6 Sol при тех же настройках.

При работе с компьютером наблюдается аналогичная картина. По данным OpenAI, в офлайн-наборе OSWorld 2.0 GPT-6.1 Sol при максимальном уровне вычислительных усилий отстаёт от Astra всего на 2,1 процентного пункта, обходясь примерно в седьмую часть её стоимости за задачу.

Это результаты оценок, проведённых OpenAI, а не независимые испытания в реальных условиях. Компания отмечает, что тестирование проходит в исследовательской среде или через API и может несколько отличаться от работы ChatGPT в производственной среде. Однако позиционирование ясно: Astra остаётся вариантом с максимальными возможностями, а Sol становится моделью, которую OpenAI рекомендует разработчикам, когда экономичность многократного запуска агентов не менее важна, чем абсолютные результаты тестов.

Ultrafast превращает скорость инференса в премиальный продукт

Вторая часть анонса OpenAI направлена на устранение другого узкого места. Стандартные передовые модели могут справляться с рабочими процессами, но всё же работать слишком медленно для приложений, в которых человеку приходится ждать каждого ответа. Решение OpenAI — Ultrafast, по сути, премиальный режим инференса.

По словам OpenAI, скорость генерации в этом режиме достигает 300 токенов в секунду; генерация в Codex ускоряется до 8 раз, а через API — до 6 раз. Использование API стоит в 6 раз дороже стандартного тарифа.

Это значительно дороже существующего у OpenAI режима Fast, который раньше назывался Priority processing. Согласно актуальной таблице тарифов API OpenAI, для моделей семейства GPT-6 в этом режиме взимается двойная плата по сравнению со стандартным тарифом: например, цена GPT-6 Sol за входные и выходные токены повышается с 2 и 10 долларов при стандартной обработке до 4 и 20 долларов в режиме Fast, а цена Astra — с 10 и 50 до 20 и 100 долларов.

Модель / тарифный план сервиса

Скорость

Входные токены / 1 млн

Кэшированные входные токены / 1 млн

Выходные токены / 1 млн

Цена относительно стандартного тарифа

GPT-6 Sol — стандартный тариф

Стандартная

2 доллара

0,20 доллара

10 долларов

1X

GPT-6 Sol — режим Fast

Выше, чем на стандартном тарифе

4 доллара

0,40 доллара

20 долларов

2X

GPT-6 Astra — стандартный тариф

Стандартная

10 долларов

1 доллар

50 долларов

1X

GPT-6 Astra — режим Fast

Выше, чем на стандартном тарифе

20 долларов

2 доллара

100 долларов

2X

GPT-6 Astra — Ultrafast

До 6 раз быстрее через API; до 8 раз быстрее в Codex; до 300 токенов в секунду

60 долларов*

6 долларов*

300 долларов*

6X

GPT-6.1 Sol — стандартный тариф

Стандартная

2 доллара

0,10 доллара

10 долларов

1X

GPT-6.1 Sol — Ultrafast

До 6 раз быстрее через API; до 8 раз быстрее в Codex; до 300 токенов в секунду

12 долларов*

0,60 доллара*

60 долларов*

6X

* Расчётные тарифы: OpenAI сообщает, что использование Ultrafast через API стоит в 6 раз дороже стандартного тарифа, однако в материалах DevDay не публикуются отдельно все расценки Ultrafast. Поэтому приведённые выше цены для Astra и GPT-6.1 Sol в режиме Ultrafast рассчитаны на основании опубликованных стандартных тарифов OpenAI и объявленного множителя 6X. По словам OpenAI, Ultrafast стоит втрое дороже режима Fast и в шесть раз дороже стандартного режима для одной и той же базовой модели.

Таким образом, при использовании одной и той же базовой модели Ultrafast стоит втрое дороже режима Fast и в шесть раз дороже стандартной обработки.

Для GPT-6 Astra объявленный множитель 6X означает 60 долларов за миллион входных токенов и 300 долларов за миллион выходных — против 10 и 50 долларов на стандартном тарифе и 20 и 100 долларов в режиме Fast.

Когда появится Ultrafast для GPT-6.1 Sol, тот же объявленный множитель будет означать 12 долларов за миллион входных токенов и 60 долларов за миллион выходных, а цена кэшированных входных токенов составит 0,60 доллара, если множитель применяется и к опубликованному тарифу 0,10 доллара за миллион.

В материалах OpenAI к DevDay указан множитель 6X, но отдельно не приводятся тарифы на токены GPT-6.1 Sol в режиме Ultrafast. Поэтому эти цифры рассчитаны на основании объявленной ценовой политики, а не опубликованы компанией в качестве отдельных тарифов.

С учётом расходов Ultrafast вряд ли заменит стандартный инференс для фоновых агентов, обработки документов и других задач, где важна пропускная способность. Очевидные сферы применения — задачи, в которых ожидание само по себе обходится дорого: интерактивное программирование, поддержка клиентов, финансовый анализ, реагирование на инциденты и другие системы с участием человека.

OpenAI уже экспериментировала с такой идеей. В августе компания представила предварительную версию GPT-5.6 Sol Ultrafast на оборудовании Cerebras: скорость достигала 750 выходных токенов в секунду, а работа шла до 14 раз быстрее стандартного режима. Доступ получили ограниченное число клиентов. Среди первых сценариев применения OpenAI назвала финансовые исследования, торговлю, поддержку и реагирование на инциденты.

Запуск в рамках DevDay превращает этот эксперимент в более широко доступный тарифный план, хотя новые модели GPT-6 ради доступа к более современному интеллекту уступают в максимальной заявленной скорости, достигнутой в предварительной версии.

Доступность и масштабная программа DevDay

GPT-6.1 Sol доступна через API под именем gpt-6.1-sol, а также подписчикам планов Plus, Pro, Business, Enterprise и Edu в ChatGPT Work и Codex. OpenAI особо отмечает, что в обычном чате модель пока недоступна.

GPT-6 Astra Ultrafast уже доступна через API, а также в ChatGPT Work и Codex для клиентов Pro 500 и Enterprise. GPT-6.1 Sol Ultrafast должна появиться в ближайшие дни.

В справочнике API также доступен параметр access-controlled service_tier=ultrafast для поддерживаемых моделей.

Релизы моделей — лишь часть гораздо более масштабной программы DevDay. OpenAI также представила постоянно работающих агентов Dots; инфраструктуру конфиденциальности Private Intelligence; возможность управлять компьютером через Agents API; AWS Bedrock Managed Agents на базе OpenAI; новые функции Codex для облака, командной строки, проверки кода и безопасности; API Decisions; расширенные плагины и автоматизацию с запуском по событиям MCP; совместные пространства ChatGPT Spaces, Pages и слайды; командные задачи; интеграции ChatGPT со Slack и Microsoft Teams; плагин Meetings; вход через Sign in with ChatGPT; новую подписку Pro 500; а также OpenAI Marketplace для корпоративных клиентов.

Однако для руководителей технических подразделений компаний GPT-6.1 Sol и Ultrafast, возможно, нагляднее показывают более значительный сдвиг, лежащий в основе этих отдельных продуктов. OpenAI всё чаще предлагает разработчикам оптимизировать решения не только с учётом того, какая модель умнее, но и по трём отдельным параметрам: интеллекту, стоимости и задержке.

GPT-6.1 Sol заметно снижает стоимость выполнения сложных задач агентами. Ultrafast движется в противоположном направлении: клиентам предлагают платить значительную надбавку, когда важна каждая секунда.

Это даёт корпоративным архитекторам возможность принимать более взвешенные и, потенциально, более экономичные решения: использовать дорогой инференс только там, где низкая задержка приносит бизнесу пользу, а гораздо больший объём автономной работы поручать моделям, чьи возможности всё ближе к передовым, но которые не требуют платить по максимальным тарифам.

Технологии

Смотреть все

Подпишитесь на свежие новости!

Глубокая аналитика для руководителей в области корпоративного ИИ, данных и безопасности

Подписаться по RSS

RSS-ленты обновляются каждые 15 минут.