Русская версия VentureBeat: ИИ и корпоративные технологии

Технологии

Grok 4.7 сочетает прирост возможностей программирования с прежней доступной ценой, но высокое потребление токенов ставит под угрозу реальную окупаемость инвестиций

Grok 4.7 сочетает прирост возможностей программирования с прежней доступной ценой, но высокое потребление токенов ставит под угрозу реальную окупаемость инвестиций

Компания SpaceXAI сегодня выпустила Grok 4.7 — свою новейшую модель для написания кода и профессиональных задач в области обработки знаний, отличающуюся улучшенной производительностью в бенчмарках (особенно в программировании, или Terminal Bench), более длительным циклом обучения с подкреплением и новым набором средств защиты, призванным повысить надежность системы при выполнении многочасовых задач.

Самым важным аспектом этого релиза для разработчиков может оказаться то, что осталось неизменным — цена. Стоимость Grok 4.7 начинается от 2 / 6 долларов США за 1 миллион токенов ввода/вывода, что соответствует расценкам Grok 4.6, выпущенной всего чуть более месяца назад.

Но для инженерных команд, выбирающих модель для маршрутизации агентских рабочих нагрузок, более важным показателем может оказаться вовсе не стоимость токенов. Гораздо важнее затраты на успешное завершение задачи с учетом токенов рассуждения, вызовов инструментов и долго выполняющихся циклов работы агентов. Новое независимое тестирование Grok 4.7 делает этот нюанс особенно актуальным.

SpaceXAI также предлагает ускоренный вариант с повышенной скоростью обработки токенов по цене в 2 раза выше ($4/$12), хотя компания не опубликовала показатель токенов в секунду, а независимые измерения пропускной способности на момент публикации были недоступны.

Сводная таблица сравнения стоимости API пограничных моделей VentureBeat за 1M токенов — конец 2026 г.

Модель

Ввод ($/1M)

Вывод ($/1M)

Итого ($/1M)

Источник

Muse Spark 1.2 / 1.3 Contributor

$0.10

$0.20

$0.30

Meta

MiMo-V2.5 Flash

$0.10

$0.30

$0.40

Xiaomi

DeepSeek-V4.1-Flash — вне пиковой нагрузки

$0.15

$0.60

$0.75

DeepSeek

GPT-5.6 Luna

$0.20

$1.20

$1.40

OpenAI

MiniMax-M3

$0.30

$1.20

$1.50

MiniMax

LongCat-2.0 — акция в течение ограниченного времени

$0.30

$1.20

$1.50

LongCat

DeepSeek-V4.1-Flash — часы пик

$0.30

$1.20

$1.50

DeepSeek

MiMo-V2.5

$0.40

$2.00

$2.40

Xiaomi

DeepSeek-V4-Pro — вне пиковой нагрузки

$0.66

$1.98

$2.64

DeepSeek

LongCat-2.0 — стандартная

$0.75

$2.95

$3.70

LongCat

MiMo-V2.5 Pro (≤256K)

$1.00

$3.00

$4.00

Xiaomi

Gemini 3.7 Flash — до 31 декабря 2026 г.

$0.75

$3.75

$4.50

Google

Gemini 3.8 Flash — до 31 декабря 2026 г.

$0.75

$3.75

$4.50

Google

DeepSeek-V4-Pro — часы пик

$1.32

$3.96

$5.28

DeepSeek

Muse Spark 1.1 / 1.2 / 1.3

$1.25

$4.25

$5.50

Meta

GLM-5.3

$1.40

$4.40

$5.80

Z.AI

Grok 4.7 — токенов промпта ≤200K

$2.00

$6.00

$8.00

xAI

MiMo-V2.5 Pro (>256K)

$2.00

$6.00

$8.00

Xiaomi

Qwen3.8-Max

$2.00

$6.00

$8.00

QwenCloud

Gemini 3.7 Flash — с 1 января 2027 г.

$1.50

$7.50

$9.00

Google

Gemini 3.8 Flash — с 1 января 2027 г.

$1.50

$7.50

$9.00

Google

GPT-5.6 Terra

$2.00

$12.00

$14.00

OpenAI

Grok 4.7 — токенов промпта >200K

$4.00

$12.00

$16.00

xAI

Grok 4.7 Fast (Cursor) — ввод ≤256K

$4.00

$12.00

$16.00

Cursor

GPT-5.4

$2.50

$15.00

$17.50

OpenAI

Kimi K3

$3.00

$15.00

$18.00

Moonshot AI

Grok 4.7 Fast (Cursor) — ввод >256K, до 500K

$6.00

$18.00

$24.00

Cursor

Claude Opus 5

$5.00

$25.00

$30.00

Anthropic

Sakana Fugu Ultra (≤272K)

$5.00

$30.00

$35.00

Sakana AI

GPT-5.6 Sol — Стандартный режим

$5.00

$30.00

$35.00

OpenAI

Claude Fable 5 / Claude Mythos 5

$10.00

$50.00

$60.00

Anthropic

Claude Fable 5.1 / Claude Mythos 5.1

$10.00

$50.00

$60.00

Anthropic

GPT-6 Astra — Стандартный режим

$10.00

$50.00

$60.00

OpenAI

GPT-5.6 Sol — Быстрый режим

$10.00

$60.00

$70.00

OpenAI

GPT-6 Astra — Быстрый режим

$20.00

$100.00

$120.00

OpenAI

Платформа для программирования с использованием ИИ Cursor, которая недавно была приобретена SpaceXAI, также предлагает тариф Fast для Grok 4.7 по цене, вдвое превышающей стандартную стоимость токенов — $4/$12 за 1 миллион токенов ввода/вывода, причем делает Fast вариантом по умолчанию для тарифов Pro и выше.

Cursor не публикует показатели токенов в секунду и не заявляет о точном двукратном увеличении пропускной способности. Для входных данных объемом более 256K токенов Cursor взимает $4/$12 за стандартный Grok 4.7 и $6/$18 за версию Fast вплоть до максимального контекстного окна модели в 500K.

По заявлению SpaceXAI, модель уже доступна в Cursor, Grok Build и Grok API, а также через сторонние инструменты программирования, маршрутизаторы моделей и облачные платформы. GitHub постепенно внедряет Grok 4.7 в Copilot Pro, Pro+, Max, Business и Enterprise с поддержкой в VS Code, Visual Studio, Copilot CLI, облачном агенте GitHub, JetBrains, Xcode и Eclipse.

Эта комбинация — более высокие заявленные возможности без увеличения базовой цены токенов — лежит в основе маркетинговой стратегии SpaceXAI. В презентационных материалах компания описывает Grok 4.7 как свою самую мощную на сегодняшний день модель для написания кода и работы со знаниями, заявляя, что она способна «дольше работать над сложными задачами» и более тщательно проверять свои результаты.

Более крупная модель, обученная для многочасовой работы

SpaceXAI утверждает, что Grok 4.7 использует новую, более крупную базовую модель по сравнению с Grok 4.6, и прошла более длительный цикл обучения с подкреплением с использованием более сложного распределения задач, ориентированных на проблемы, на решение которых уходит много часов. Компания также заявляет, что улучшила управление длинным контекстом и обучила модель еще эффективнее работать с недавно выпущенным инструментом Grok Bot от SpaceXAI, ориентированным на ИИ-агентов.

Этот акцент важен для предприятий, оценивающих модели в качестве агентов, а не интерфейсов для чата. Модель, способная удерживать фокус на задаче в ходе длительной сессии программирования, собирать документ, работать с терминалом или выполнять многоэтапный бизнес-процесс, предъявляет иные операционные требования, чем модель, оптимизированная в первую очередь для изолированных запросов.

Grok 4.7 демонстрирует заметный прирост производительности по сравнению с предшественницей в распространенных сторонних бенчмарках, однако она все еще отстает от новейших моделей американских конкурентов — OpenAI, Anthropic и даже Google.

Бенчмарк

Grok 4.6

Grok 4.7

Прирост

Terminal-Bench 4.0

20.3%

38.0%

+17,7 процентных пункта

EEBench

53.0%

64.0%

+11,0 пунктов

HealthBench Professional

48.5%

56.7%

+8,2 пунктов

CursorBench 4.0

40.4%

46.3%

+5,9 пунктов

DeepSWE v1.1

65.2%

71.0%

+5,8 пунктов

Harvey Legal Agent Benchmark

15.8%

19.6%

+3,8 пункта

AA Briefcase v1.1

1,546

1,657

+111 Elo

GDPval

1,605

1,695

+90 Elo

И, по выражению разработчика и автора Дэна Макатира (Dan McAteer) в его посте на X, модель показывает «ужасающие» результаты на Terminal-Bench — бенчмарке использования терминала, в котором она продемонстрировала наибольший общий прирост по сравнению с предшественницей.

Сторонняя компания по оценке моделей ИИ Artificial Analysis оценивает производительность Grok 4.7 при настройке уровня рассуждений «xHigh» примерно в 26% в этом бенчмарке по сравнению с 59,6% у GPT-6 Astra xHigh от OpenAI и около 49% у Claude Opus 5 от Anthropic на максимальных настройках.

В бенчмарке CursorBench 4.0 модель Grok 4.7 при уровне усилий xHigh набирает 46,3% по сравнению с 40,4% у Grok 4.6 High. GPT-5.6 Sol Max набирает 41,7% в сравнении SpaceXAI, в то время как Fable 5.1 Max достигает 51,8%. В DeepSWE v1.1 Grok 4.7 набирает 71,0% против 65.2% у Grok 4.6.

Тем не менее, другие пользователи остались впечатлены релизом. Популярный пользователь X, пишущий об ИИ, @haider1 назвал показатели CursorBench «просто абсурдными», указав, что Grok 4.7 xHigh показывает 46,3% примерно за $6,01 за задачу по сравнению с 46,8% за $7,05 у Fable 5.1 Medium и 41,7% за $8,23 у GPT-5.6 Sol Max в таблице лидеров из его поста. Он также подчеркнул улучшение по сравнению с Grok 4.6 при примерно сопоставимой стоимости.

Дешевые токены не обязательно означают самую дешевую задачу

Тестирование Artificial Analysis вносит важную оговорку в историю с номинальной ценой. Grok 4.7 xHigh использовала примерно 81 000 токенов вывода на задачу в индексе Intelligence Index против 36 000 у Grok 4.6 High и 27 000 у GPT-6 Astra Max.

По данным Artificial Analysis, это на 125% больше использования токенов вывода, чем у Grok 4.6, и на 196% больше, чем у GPT-6 Astra.

Кроме того, Artificial Analysis опубликовала расчет стоимости задачи в долларах: около $3,74 за задачу в Intelligence Index для Grok 4.7 xHigh и $2,73 для Grok 4.7 High. Эта методология учитывает стоимость входных данных, кэша, рассуждений и токенов ответов, а не просто сравнивает прейскурантные цены API. Для контекста, в рамках того же сравнения GPT-5.6 Sol Max в настоящее время обходится примерно в $1,99 за задачу, несмотря на существенно более высокие прейскурантные цены на ввод/вывод ($4/$20).

Это меняет интуитивное восприятие прейскуранта API. Модель, взимающая меньше платы за токен, все равно может оказаться дороже при выполнении готовой работы, если для ее выполнения требуется существенно больше токенов рассуждений. И эта разница быстро становится существенной в масштабах предприятия.

При заявленных тарифах $2/$6 рабочая нагрузка, потребляющая 10 миллиардов входных и 2 миллиарда выходных токенов ежемесячно, приведет к расходам на модель в размере около $32 000 в месяц или $384 000 в год. При 50 миллиардах входных и 10 миллиардах выходных токенов те же расценки означают около $160 000 в месяц или $1,92 миллиона в год без учета специфических платформных сборов. Это иллюстративные расчеты объемов, а не оценки типичного развертывания Grok, но они показывают, почему эффективность токенов превращается в вопрос бюджетного планирования инфраструктуры в масштабах производства.

Для ведущего инженера вывод на утро понедельника прост: протестируйте Grok 4.7 на репрезентативных внутренних задачах и отслеживайте стоимость успешного выполнения, потребление токенов, задержки, количество повторных попыток и необходимость вмешательства человека наряду с расценками API.

Система безопасности получает новый стек

SpaceXAI также заявляет, что Grok 4.7 представляет совершенно новый стек средств защиты, сообщая о результате в 62,4% в биозащитном бенчмарке LatchBio и заявляя, что модель пропустила лишь 3,3% рискованных промптов двойного назначения в ходе оценки HackerBench v0.3. Это результаты безопасности, о которых заявляет сама компания, и к ним следует относиться соответствующим образом до проведения более масштабных независимых тестов.

Для инженерных команд, оценивающих Grok 4.7 в этом квартале, практический тест заключается не в том, превосходит ли ее тариф API $2/$6 конкурентов на бумаге. Вопрос в том, выполняет ли модель реальные задачи организации по написанию кода и обработке знаний с меньшими затратами денег, меньшим числом повторных попыток и меньшим вмешательством инженеров. Прирост производительности Grok 4.7 в бенчмарках дает командам повод провести такую оценку; реальные производственные задачи определят, трансформируется ли ее низкая цена токенов в меньший счет за выполненную работу.