Grok 4.7 сочетает прирост возможностей программирования с прежней доступной ценой, но высокое потребление токенов ставит под угрозу реальную окупаемость инвестиций
Компания SpaceXAI сегодня выпустила Grok 4.7 — свою новейшую модель для написания кода и профессиональных задач в области обработки знаний, отличающуюся улучшенной производительностью в бенчмарках (особенно в программировании, или Terminal Bench), более длительным циклом обучения с подкреплением и новым набором средств защиты, призванным повысить надежность системы при выполнении многочасовых задач.
Самым важным аспектом этого релиза для разработчиков может оказаться то, что осталось неизменным — цена. Стоимость Grok 4.7 начинается от 2 / 6 долларов США за 1 миллион токенов ввода/вывода, что соответствует расценкам Grok 4.6, выпущенной всего чуть более месяца назад.
Но для инженерных команд, выбирающих модель для маршрутизации агентских рабочих нагрузок, более важным показателем может оказаться вовсе не стоимость токенов. Гораздо важнее затраты на успешное завершение задачи с учетом токенов рассуждения, вызовов инструментов и долго выполняющихся циклов работы агентов. Новое независимое тестирование Grok 4.7 делает этот нюанс особенно актуальным.
SpaceXAI также предлагает ускоренный вариант с повышенной скоростью обработки токенов по цене в 2 раза выше ($4/$12), хотя компания не опубликовала показатель токенов в секунду, а независимые измерения пропускной способности на момент публикации были недоступны.
Сводная таблица сравнения стоимости API пограничных моделей VentureBeat за 1M токенов — конец 2026 г.
|
Модель |
Ввод ($/1M) |
Вывод ($/1M) |
Итого ($/1M) |
Источник |
|
Muse Spark 1.2 / 1.3 Contributor |
$0.10 |
$0.20 |
$0.30 |
|
|
MiMo-V2.5 Flash |
$0.10 |
$0.30 |
$0.40 |
|
|
DeepSeek-V4.1-Flash — вне пиковой нагрузки |
$0.15 |
$0.60 |
$0.75 |
|
|
GPT-5.6 Luna |
$0.20 |
$1.20 |
$1.40 |
|
|
MiniMax-M3 |
$0.30 |
$1.20 |
$1.50 |
|
|
LongCat-2.0 — акция в течение ограниченного времени |
$0.30 |
$1.20 |
$1.50 |
|
|
DeepSeek-V4.1-Flash — часы пик |
$0.30 |
$1.20 |
$1.50 |
|
|
MiMo-V2.5 |
$0.40 |
$2.00 |
$2.40 |
|
|
DeepSeek-V4-Pro — вне пиковой нагрузки |
$0.66 |
$1.98 |
$2.64 |
|
|
LongCat-2.0 — стандартная |
$0.75 |
$2.95 |
$3.70 |
|
|
MiMo-V2.5 Pro (≤256K) |
$1.00 |
$3.00 |
$4.00 |
|
|
Gemini 3.7 Flash — до 31 декабря 2026 г. |
$0.75 |
$3.75 |
$4.50 |
|
|
Gemini 3.8 Flash — до 31 декабря 2026 г. |
$0.75 |
$3.75 |
$4.50 |
|
|
DeepSeek-V4-Pro — часы пик |
$1.32 |
$3.96 |
$5.28 |
|
|
Muse Spark 1.1 / 1.2 / 1.3 |
$1.25 |
$4.25 |
$5.50 |
|
|
GLM-5.3 |
$1.40 |
$4.40 |
$5.80 |
|
|
Grok 4.7 — токенов промпта ≤200K |
$2.00 |
$6.00 |
$8.00 |
|
|
MiMo-V2.5 Pro (>256K) |
$2.00 |
$6.00 |
$8.00 |
|
|
Qwen3.8-Max |
$2.00 |
$6.00 |
$8.00 |
|
|
Gemini 3.7 Flash — с 1 января 2027 г. |
$1.50 |
$7.50 |
$9.00 |
|
|
Gemini 3.8 Flash — с 1 января 2027 г. |
$1.50 |
$7.50 |
$9.00 |
|
|
GPT-5.6 Terra |
$2.00 |
$12.00 |
$14.00 |
|
|
Grok 4.7 — токенов промпта >200K |
$4.00 |
$12.00 |
$16.00 |
|
|
Grok 4.7 Fast (Cursor) — ввод ≤256K |
$4.00 |
$12.00 |
$16.00 |
|
|
GPT-5.4 |
$2.50 |
$15.00 |
$17.50 |
|
|
Kimi K3 |
$3.00 |
$15.00 |
$18.00 |
|
|
Grok 4.7 Fast (Cursor) — ввод >256K, до 500K |
$6.00 |
$18.00 |
$24.00 |
|
|
Claude Opus 5 |
$5.00 |
$25.00 |
$30.00 |
|
|
Sakana Fugu Ultra (≤272K) |
$5.00 |
$30.00 |
$35.00 |
|
|
GPT-5.6 Sol — Стандартный режим |
$5.00 |
$30.00 |
$35.00 |
|
|
Claude Fable 5 / Claude Mythos 5 |
$10.00 |
$50.00 |
$60.00 |
|
|
Claude Fable 5.1 / Claude Mythos 5.1 |
$10.00 |
$50.00 |
$60.00 |
|
|
GPT-6 Astra — Стандартный режим |
$10.00 |
$50.00 |
$60.00 |
|
|
GPT-5.6 Sol — Быстрый режим |
$10.00 |
$60.00 |
$70.00 |
|
|
GPT-6 Astra — Быстрый режим |
$20.00 |
$100.00 |
$120.00 |
Платформа для программирования с использованием ИИ Cursor, которая недавно была приобретена SpaceXAI, также предлагает тариф Fast для Grok 4.7 по цене, вдвое превышающей стандартную стоимость токенов — $4/$12 за 1 миллион токенов ввода/вывода, причем делает Fast вариантом по умолчанию для тарифов Pro и выше.
Cursor не публикует показатели токенов в секунду и не заявляет о точном двукратном увеличении пропускной способности. Для входных данных объемом более 256K токенов Cursor взимает $4/$12 за стандартный Grok 4.7 и $6/$18 за версию Fast вплоть до максимального контекстного окна модели в 500K.
По заявлению SpaceXAI, модель уже доступна в Cursor, Grok Build и Grok API, а также через сторонние инструменты программирования, маршрутизаторы моделей и облачные платформы. GitHub постепенно внедряет Grok 4.7 в Copilot Pro, Pro+, Max, Business и Enterprise с поддержкой в VS Code, Visual Studio, Copilot CLI, облачном агенте GitHub, JetBrains, Xcode и Eclipse.
Эта комбинация — более высокие заявленные возможности без увеличения базовой цены токенов — лежит в основе маркетинговой стратегии SpaceXAI. В презентационных материалах компания описывает Grok 4.7 как свою самую мощную на сегодняшний день модель для написания кода и работы со знаниями, заявляя, что она способна «дольше работать над сложными задачами» и более тщательно проверять свои результаты.
Более крупная модель, обученная для многочасовой работы
SpaceXAI утверждает, что Grok 4.7 использует новую, более крупную базовую модель по сравнению с Grok 4.6, и прошла более длительный цикл обучения с подкреплением с использованием более сложного распределения задач, ориентированных на проблемы, на решение которых уходит много часов. Компания также заявляет, что улучшила управление длинным контекстом и обучила модель еще эффективнее работать с недавно выпущенным инструментом Grok Bot от SpaceXAI, ориентированным на ИИ-агентов.
Этот акцент важен для предприятий, оценивающих модели в качестве агентов, а не интерфейсов для чата. Модель, способная удерживать фокус на задаче в ходе длительной сессии программирования, собирать документ, работать с терминалом или выполнять многоэтапный бизнес-процесс, предъявляет иные операционные требования, чем модель, оптимизированная в первую очередь для изолированных запросов.
Grok 4.7 демонстрирует заметный прирост производительности по сравнению с предшественницей в распространенных сторонних бенчмарках, однако она все еще отстает от новейших моделей американских конкурентов — OpenAI, Anthropic и даже Google.
|
Бенчмарк |
Grok 4.6 |
Grok 4.7 |
Прирост |
|
Terminal-Bench 4.0 |
20.3% |
38.0% |
+17,7 процентных пункта |
|
EEBench |
53.0% |
64.0% |
+11,0 пунктов |
|
HealthBench Professional |
48.5% |
56.7% |
+8,2 пунктов |
|
CursorBench 4.0 |
40.4% |
46.3% |
+5,9 пунктов |
|
DeepSWE v1.1 |
65.2% |
71.0% |
+5,8 пунктов |
|
Harvey Legal Agent Benchmark |
15.8% |
19.6% |
+3,8 пункта |
|
AA Briefcase v1.1 |
1,546 |
1,657 |
+111 Elo |
|
GDPval |
1,605 |
1,695 |
+90 Elo |
И, по выражению разработчика и автора Дэна Макатира (Dan McAteer) в его посте на X, модель показывает «ужасающие» результаты на Terminal-Bench — бенчмарке использования терминала, в котором она продемонстрировала наибольший общий прирост по сравнению с предшественницей.
Сторонняя компания по оценке моделей ИИ Artificial Analysis оценивает производительность Grok 4.7 при настройке уровня рассуждений «xHigh» примерно в 26% в этом бенчмарке по сравнению с 59,6% у GPT-6 Astra xHigh от OpenAI и около 49% у Claude Opus 5 от Anthropic на максимальных настройках.
В бенчмарке CursorBench 4.0 модель Grok 4.7 при уровне усилий xHigh набирает 46,3% по сравнению с 40,4% у Grok 4.6 High. GPT-5.6 Sol Max набирает 41,7% в сравнении SpaceXAI, в то время как Fable 5.1 Max достигает 51,8%. В DeepSWE v1.1 Grok 4.7 набирает 71,0% против 65.2% у Grok 4.6.
Тем не менее, другие пользователи остались впечатлены релизом. Популярный пользователь X, пишущий об ИИ, @haider1 назвал показатели CursorBench «просто абсурдными», указав, что Grok 4.7 xHigh показывает 46,3% примерно за $6,01 за задачу по сравнению с 46,8% за $7,05 у Fable 5.1 Medium и 41,7% за $8,23 у GPT-5.6 Sol Max в таблице лидеров из его поста. Он также подчеркнул улучшение по сравнению с Grok 4.6 при примерно сопоставимой стоимости.
Дешевые токены не обязательно означают самую дешевую задачу
Тестирование Artificial Analysis вносит важную оговорку в историю с номинальной ценой. Grok 4.7 xHigh использовала примерно 81 000 токенов вывода на задачу в индексе Intelligence Index против 36 000 у Grok 4.6 High и 27 000 у GPT-6 Astra Max.
По данным Artificial Analysis, это на 125% больше использования токенов вывода, чем у Grok 4.6, и на 196% больше, чем у GPT-6 Astra.
Кроме того, Artificial Analysis опубликовала расчет стоимости задачи в долларах: около $3,74 за задачу в Intelligence Index для Grok 4.7 xHigh и $2,73 для Grok 4.7 High. Эта методология учитывает стоимость входных данных, кэша, рассуждений и токенов ответов, а не просто сравнивает прейскурантные цены API. Для контекста, в рамках того же сравнения GPT-5.6 Sol Max в настоящее время обходится примерно в $1,99 за задачу, несмотря на существенно более высокие прейскурантные цены на ввод/вывод ($4/$20).
Это меняет интуитивное восприятие прейскуранта API. Модель, взимающая меньше платы за токен, все равно может оказаться дороже при выполнении готовой работы, если для ее выполнения требуется существенно больше токенов рассуждений. И эта разница быстро становится существенной в масштабах предприятия.
При заявленных тарифах $2/$6 рабочая нагрузка, потребляющая 10 миллиардов входных и 2 миллиарда выходных токенов ежемесячно, приведет к расходам на модель в размере около $32 000 в месяц или $384 000 в год. При 50 миллиардах входных и 10 миллиардах выходных токенов те же расценки означают около $160 000 в месяц или $1,92 миллиона в год без учета специфических платформных сборов. Это иллюстративные расчеты объемов, а не оценки типичного развертывания Grok, но они показывают, почему эффективность токенов превращается в вопрос бюджетного планирования инфраструктуры в масштабах производства.
Для ведущего инженера вывод на утро понедельника прост: протестируйте Grok 4.7 на репрезентативных внутренних задачах и отслеживайте стоимость успешного выполнения, потребление токенов, задержки, количество повторных попыток и необходимость вмешательства человека наряду с расценками API.
Система безопасности получает новый стек
SpaceXAI также заявляет, что Grok 4.7 представляет совершенно новый стек средств защиты, сообщая о результате в 62,4% в биозащитном бенчмарке LatchBio и заявляя, что модель пропустила лишь 3,3% рискованных промптов двойного назначения в ходе оценки HackerBench v0.3. Это результаты безопасности, о которых заявляет сама компания, и к ним следует относиться соответствующим образом до проведения более масштабных независимых тестов.
Для инженерных команд, оценивающих Grok 4.7 в этом квартале, практический тест заключается не в том, превосходит ли ее тариф API $2/$6 конкурентов на бумаге. Вопрос в том, выполняет ли модель реальные задачи организации по написанию кода и обработке знаний с меньшими затратами денег, меньшим числом повторных попыток и меньшим вмешательством инженеров. Прирост производительности Grok 4.7 в бенчмарках дает командам повод провести такую оценку; реальные производственные задачи определят, трансформируется ли ее низкая цена токенов в меньший счет за выполненную работу.



