Grok 4.5 от xAI бросает вызов конкурентам в сфере ИИ
Источник: VentureBeat · Michael Nuñez
Компания Илона Маска SpaceX в среду выпустила Grok 4.5 — свою первую модель искусственного интеллекта, обученную специально для написания кода и автономных агентов, а также первый осязаемый продукт после покупки за $60 млрд стартапа в сфере ИИ-кодинга Cursor, завершившейся всего несколько недель назад.
Этот запуск знаменует собой важнейшую проверку для разросшейся вертикально интегрированной ИИ-империи, которую Маск выстроил за последние шесть месяцев, и стратегии, опирающейся на то, что разработчиков меньше волнуют лидерские позиции в бенчмарках, а больше — скорость, стоимость и способность модели реально выполнять работу.
«Представляем Grok 4.5, нашу первую модель, обученную специально для кодинга и агентов, — говорится в сообщении компании в сети X. — Она была обучена с помощью Cursor и предлагает интеллект передового уровня при лидирующих скоростях и экономической эффективности».
Почему стратегия ценообразования Grok 4.5 важнее ее результатов в бенчмарках
SpaceX не утверждает, что Grok 4.5 — самая умная модель в мире. Вместо этого компания приводит экономические аргументы. По ее заявлению, модель использует вдвое меньше токенов на задачу по сравнению с аналогичными моделями, обеспечивает более высокую пропускную способность и стоит менее чем вдвое дешевле: ее цена составляет $2 за миллион входных токенов и $6 за миллион выходных токенов. Это с большим отрывом подрезает цены премиальных уровней таких конкурентов, как линейка Claude Opus от Anthropic и передовые модели OpenAI.
Маск сформулировал это позиционирование без утайки. «Наша внутренняя оценка заключается в том, что Grok 4.5 примерно сопоставима с Opus 4.7, но работает гораздо быстрее, — написал он в X. — Именно сочетание возможностей, более высокой скорости и более низкой стоимости делает ее конкурентоспособной. Мы замыкаем цикл реальной полезности, а не бенчмарков. Хардкорные инженеры в Tesla и SpaceX считают Grok 4.5 действительно полезной, и это то, что имеет реальное значение».
Такая формулировка одновременно является философией и страховкой. Независимые оценки, опубликованные в среду, показывают, что Grok 4.5 действительно конкурентоспособна, но не доминирует по чистым возможностям. Компания по оценке бенчмарков Artificial Analysis поставила модель на четвертое место в своем индексе GDPval-AA v2 для реальной агентной работы со знаниями, присвоив ей рейтинг Elo 1543, «уступая лишь последним релизам Claude от Anthropic». Но показатели стоимости — это то, чем модель выделяется. В Artificial Analysis оценили Grok 4.5 в $0,49 за выполненную задачу — «почти на 90% дешевле моделей, опережающих ее в нашем рейтинге», написала компания, поместив ее «четко на границу Парето по соотношению производительности и стоимости».
Для корпоративных покупателей эта математика имеет огромное значение. Агентные рабочие нагрузки — когда модель работает автономно в течение минут или часов, читая кодовые базы, вызывая инструменты и итеративно улучшая собственный результат — чрезвычайно прожорливы до токенов. Модель, которая на 90% дешевле в расчете на выполненную задачу, пусть даже и чуть менее способная, меняет расчеты для любой инженерной организации, развертывающей агентов на сотни разработчиков. Инвестор Гевин Бейкер (Gavin Baker) выразил осторожный оптимизм рынка: «Парето-доминирование в кодинге по цифрам. Посмотрим на все важные «вайбы»».
Как покупка Cursor за $60 млрд повлияла на обучение Grok 4.5
Grok 4.5 — первое конкретное доказательство того, что приобрела SpaceX при покупке Cursor, причем сама сделка разворачивалась поэтапно. В апреле SpaceX заключила необычное соглашение, дающее ей право выкупить кодинг-стартап за $60 млрд — или выплатить миллиарды в виде комиссионных и вычислительных мощностей в случае отказа, как сообщал тогда Business Insider. Спустя несколько дней после рекордного дебюта SpaceX на бирже Nasdaq в июне компания воспользовалась этим правом, объявив о сделке по приобретению за акции, которая, по данным CNBC, привела к размытию примерно на 3,4% при оценке на момент IPO.
Стратегическая логика всегда заключалась как в данных, так и в продукте. Ориентированный на ИИ редактор кода от Cursor генерирует огромный поток высококачественных данных о взаимодействии: как эксперты-инженеры пишут, редактируют, проверяют и отлаживают код в реальных производственных средах. Маск открыто заявлял этой весной, что данные о взаимодействии с Cursor передаются напрямую для обучения Grok. Cursor, со своей стороны, получил доступ к суперкомпьютеру Colossus компании SpaceX в Мемфисе — примерно 200 000 графических процессоров Nvidia с планами масштабирования до одного миллиона — после того, как публично признал, что его возможности были «ограничены нехваткой вычислительных мощностей».
«Мы объединили усилия со SpaceXAI для обучения Grok 4.5, — сообщил официальный аккаунт Cursor в среду. — Это наша самая мощная модель на сегодняшний день и первая, созданная для задач шире, чем просто разработка программного обеспечения». В SpaceX заявляют, что модель отражает эту родословную: она «превосходно справляется с большими кодовыми базами и долго выполняющимися задачами, охватывающими множество репозиториев, сотни навыков и самые разные инструменты» — именно с той запутанной многофайловой реальностью профессиональной разработки ПО, которую чистые бенчмарки кодинга часто не могут охватить. Ранние реакции разработчиков показывают, что обучение окупилось. «Окей, Grok 4.5 — это дикость, — написал разработчик Эван Бэкон (Evan Bacon). — Она только что создала для меня приложение для отслеживания ракет с данными в реальном времени и 3D-глобусом. После этого мне, пожалуй, понадобится новый бенчмарк».
Изнутри бурного года скандалов, уходов и перестройки в xAI
Глянцевый запуск контрастирует с тем, насколько хаотичным был путь к нему. Grok провел большую часть прошлого года в кризисе. В середине 2025 года чат-бот генерировал антисемитский контент и в какой-то момент назвал себя «МехаГитлером» — эти эпизоды широко освещались NPR и CNN. Ранее в этом году функции генерации изображений позволили пользователям создавать сексуализированные дипфейки, в том числе с участием детей, что вызвало расследования со стороны Европейской комиссии и британского медиарегулятора Ofcom, как сообщало BBC, и побудило SpaceX указать это поведение в качестве бизнес-риска в собственных документах для IPO.
Организация, стоявшая за моделью, также раскалывалась. Все 11 соучредителей xAI Илона Маска покинули компанию к концу марта, согласно данным TechCrunch, а сам Маск публично признал, что xAI «была построена неправильно с самого начала», заявив, что перестраивает ее «с фундамента». Маск лично признался на конференции этой весной, что Grok «в настоящее время отстает в кодинге» — редкое публичное признание от топ-менеджера, который ими обычно не отличается.
На этом фоне Grok 4.5 воспринимается как первый продукт перестроенной организации и первое доказательство смелой истории, которую SpaceX рассказывала инвесторам на открытом рынке. Во время роуд-шоу перед IPO компания заявила об общем объеме адресуемого рынка примерно в $28 трлн, причем около $26 трлн приходятся на ИИ, включая возможность «корпоративных приложений» на $22,7 трлн. Эти цифры казались невероятными даже по меркам Кремниевой долины. Конкурентоспособная и дешевая модель для кодинга — это самый прямой путь от этого нарратива к реальной выручке, и именно поэтому сегодняшний запуск имеет вес, далеко выходящий за рамки обычного релиза модели.
Grok 4.5 против Claude: битва за рынок ИИ-кодинга
Ставки в этой конкурентной борьбе трудно переоценить, поскольку рынок ИИ-кодинга консолидировался вокруг единого лидера, и это не Маск. Даже несмотря на взрывной рост выручки Cursor, ее доля рынка сокращалась. Данные о расходах от Ramp, на которые ссылается CNBC, показали, что доля Cursor в категории ИИ-кодинга упала с 41% в июне 2025 года примерно до 26% к маю 2026 года, в то время как Anthropic захватила около половины рынка. Anthropic также возглавила список Disruptor 50 по версии CNBC в этом году и, по собственным меркам Artificial Analysis, по-прежнему занимает лидирующие позиции в <рейтингах агентной производительности> (https://artificialanalysis.ai/models/capabilities/agentic).
Именно этот разрыв призвана закрыть Grok 4.5 — не за счет того, чтобы превзойти Claude в интеллекте, а за счет более низкой цены. Экономика модели создает классическую динамику подрыва рынка: если она обеспечивает большую часть возможностей передовых моделей за малую долю стоимости одной задачи, чувствительные к цене корпоративные рабочие нагрузки мигрируют, а действующие игроки столкнутся с давлением на свой самый прибыльный API-трафик. Контраргумент заключается в том, что в кодинге качество накапливается. Модель, которая с первой попытки правильно решает сложную ошибку, на практике может оказаться дешевле, чем та, которая стоит вдвое дешевле за токен, но требует трех попыток. Именно поэтому оговорка Бейкера о «вайбах» — принятом в сообществе разработчиков обозначении ощущаемой надежности модели в реальной работе — определит больше, чем любые бенчмарки в день запуска.
В сделке кроется и структурный вопрос. Cursor построила свой бизнес на предоставлении разработчикам свободы выбора моделей, включая Claude и GPT. Если Grok станет любимчиком внутри Cursor (а Маск уже призывал пользователей «Попробовать Grok 4.5 в Cursor!» спустя часы после запуска), продукт рискует оттолкнуть тех самых пользователей, чьи данные сделали возможным появление Grok 4.5. Регуляторы, которые уже пристально изучают Grok по соображениям безопасности в двух юрисдикциях, могут проявить живой интерес к компании, которая одновременно контролирует обучающие данные, саму модель и доминирующий канал дистрибуции.
Что ставка Маска на триллионную вертикальную интеграцию означает для будущего ИИ
Grok 4.5 также кристаллизует то, к чему вела вся эта лихорадочная серия сделок Маска. В феврале SpaceX поглотила xAI в рамках сделки по обмену акциями, которая, как подтвердил CNBC, оценила объединенную компанию в $1,25 трлн — это крупнейшее слияние в истории, оценивающее SpaceX в $1 трлн, а xAI в $250 млрд. За этим последовало июньское IPO — крупнейшее в истории, и с тех пор акции подскочили выше $200 по сравнению с ценой размещения в $135, обогнав Amazon и Microsoft и сделав SpaceX четвертой по величине рыночной стоимости компанией в США.
В результате образовалась единая публичная компания, владеющая практически всем стеком: Colossus для вычислительных мощностей обучения, планы по созданию орбитальных дата-центров для питания будущего масштабирования, передовая модель Grok, канал дистрибуции в виде базы разработчиков Cursor и гарантированный внутренний спрос со стороны инженерных подразделений Tesla и SpaceX. Ни OpenAI, ни Anthropic не могут полностью воспроизвести такую интеграцию; обеим компаниям приходится добираться до разработчиков через сторонние инструменты, часть которых теперь принадлежит Маску. Станет ли эта концентрация неприступным рвом или мишенью для регуляторов — или тем и другим одновременно — один из определяющих вопросов корпоративного ИИ сегодня.
Ближайшие недели начнут давать на него ответы. В Artificial Analysis заявляют, что полные результаты их индекса интеллекта (Intelligence Index) будут опубликованы в ближайшее время. Корпоративные пилотные проекты покажут, выдержат ли заявления об эффективности токенов встречу с реальными кодовыми базами. А Anthropic, которая на каждый серьезный вызов в этом цикле отвечала быстрым ответным релизом, вряд ли тихо уступит первенство по соотношению цены и производительности.
Но более глубокая история Grok 4.5 заключается в том, куда сместилась гонка ИИ. В течение трех лет таблоидным мерилом индустрии был интеллект: чья модель самая умная. Маск, опоздавший к гонке и потрепанный неудачами, решил конкурировать в совершенно другой плоскости — чья модель обходится дешевле в реальном использовании. Это показательный выбор для человека, который сколотил состояние не на изобретении ракеты или электромобиля, а на неуклонном снижении стоимости их производства. Если стратегия сработает, Маск сделает с ИИ то же, что он сделал с космическими полетами. Если нет, он потратит $60 млрд на то, чтобы усвоить: в программном обеспечении, в отличие от ракет, самая дешевая поездка — не всегда та, которую выбирают инженеры.



