xAI выпускает Grok 4.3 по агрессивно низкой цене и представляет новый, быстрый и мощный набор инструментов для клонирования голоса
Источник: VentureBeat · Carl Franzen
Пока Илон Маск судится со своим бывшим коллегой и соучредителем OpenAI Сэмом Альтманом в суде, конкурирующая компания Маска xAI, созданная в противовес OpenAI, не снижает темпов выпуска новых конкурентоспособных продуктов и сервисов.
Прошлой ночью компания xAI выпустила новую проприетарную базовую большую языковую модель (LLM) Grok 4.3 и новый набор инструментов для клонирования голоса в веб-версии.
Эти новые продукты появляются после месяцев потрясений в xAI, в результате которых компанию покинули все 10 первоначальных соучредителей лаборатории, а также десятки исследователей. Кроме того, производительность Grok была превзойдена множеством новых конкурирующих LLM от таких игроков, как OpenAI, Anthropic, Google, а также китайские фирмы DeepSeek, Moonshot (Kimi), Alibaba (Qwen), z.ai и др.
Хотя Grok 4.3 действительно демонстрирует значительный скачок производительности в сторонних бенчмарках по сравнению со своим прямым предшественником Grok 4.2 (согласно данным независимой фирмы по оценке ИИ-моделей Artificial Analysis), она всё же уступает передовым разработкам из последних моделей OpenAI и Anthropic.
Однако главной отличительной особенностью бренда Grok — помимо заявленного Маском противодействия «вокнизму» (wokeness), его более свободолюбивого характера и политики генерации изображений — неизменно оставалась низкая цена при доступе для разработчиков и пользователей через программный интерфейс приложения (API) xAI. Эта тенденция получила дальнейшее развитие в Grok 4.3, которая стоит 1,25 доллара за миллион входных токенов и 2,50 доллара за миллион выходных токенов (при объеме входных данных до 200 000 токенов, после чего стоимость удваивается — стандартная ценовая стратегия ведущих ИИ-лабораторий). Для сравнения, начальная цена API прямого предшественника Grok 4.2 составляла $2/$6 за миллион входных/выходных токенов.
Скриншот цен на API Grok 4.3. Источник: VentureBeat
Согласно заметкам о релизе xAI, бета-тестирование Grok 4.3 началось в апреле для подписчиков тарифного плана SuperGrok от xAI (30 долларов в месяц), а также пользователей родственной социальной сети X по подписке Premium+ (40 долларов в месяц со скидкой 50% на первые два месяца). Теперь модель доступна всем желающим через API xAI и партнерский сервис OpenRouter.
Встроенные механизмы рассуждения и возможности агентного использования инструментов
В основе Grok 4.3 лежит фундаментальный сдвиг в способах обработки информации моделью. В отличие от предыдущих итераций, где «цепочки мыслей» (chain-of-thought) или рассуждения часто можно было включать или настраивать с помощью уровней усилий, в Grok 4.3 рассуждения встроены как активное и постоянное состояние.
Это означает, что модель спроектирована так, чтобы «думать» перед тем, как ответить на каждый запрос — стратегия, призванная максимизировать фактическую точность и качество обработки сложных многошаговых инструкций.
Память модели также впечатляет: ее контекстное окно составляет 1 миллион токенов. Для понимания масштаба: миллион токенов грубо эквивалентен нескольким толстым романам или всей кодовой базе приложения среднего размера.
Это позволяет Grok 4.3 сохранять согласованность при работе с огромными массивами данных, хотя xAI внедрила структуру «ценообразования с повышенным контекстом» для запросов, превышающих порог в 200 000 токенов.
Такое разделение на уровни говорит о том, что хотя «долговременная память» доступна, вычислительные затраты на управление таким объемом информации остаются существенными накладными расходами. Технически модель принимает как текстовые, так и визуальные входные данные, а на выходе выдает текст.
Она специально оптимизирована для агентных рабочих процессов — сценариев, в которых ИИ не просто отвечает на вопрос, а действует как автономный агент для выполнения задачи.
Впервые у Grok появился доступ к тем же инструментам и средам, которыми пользуется профессиональный человек. Свидетельства этого сдвига заметны по ранним взаимодействиям пользователей:
-
Инженерия электронных таблиц: В одном из случаев модель потратила 6 минут и 22 секунды на фазу «размышлений», чтобы создать комплексный анализатор боевого урона в секунду (DPS) для OSRS Sailing. Полученный файл
.xlsxпредставлял собой не простую таблицу, а многостраничный дашборд, включающий набор «Reference_Data» и сложный «DPS_Calculator» с формулами авторасчета. -
Профессиональная документация: Теперь Grok генерирует отформатированные PDF-файлы, такие как 12-страничные отчеты о продукции SpaceX. Эти документы включают в себя фирменный стиль, логотипы, качественные иллюстрации и структурированные таблицы, значительно превосходя блоки разметки (markdown) предыдущих версий.
-
Визуальные презентации: Модель может разрабатывать презентации PowerPoint на 9 слайдов, используя «сэндвич-структуру» (темные титульный и заключительный слайды со светлым содержимым в середине) и интегрируя матричные структуры для принятия решений на основе данных, а также элементы юмора.
Тем не менее, ее знания о мире не безграничны: в примечаниях к релизу указана дата отсечения знаний — декабрь 2025 года. Тем не менее, благодаря встроенному поиску по веб-сайтам, Grok может ссылаться на актуальную информацию и использовать ее.
Фактически Grok 4.3 поставляется с расширенной экосистемой инструментов, призванных превратить его в функционального цифрового сотрудника. Платформа xAI теперь предлагает надежный набор серверных инструментов, которые модель может вызывать автономно в зависимости от сложности запроса.
-
Веб-поиск и поиск в X: Эти инструменты позволяют Grok обходить ограничение по объему знаний путем просмотром живого интернета или поиска по публикациям, профилям пользователей и веткам обсуждений в X (бывший Twitter).
-
Выполнение кода: Модель может запускать код на Python в изолированной среде (песочнице) для решения математических задач или обработки данных.
-
Поиск по файлам и коллекциям: Встроенная система генерации с дополненным поиском (RAG) позволяет пользователям делать запросы по загруженным коллекциям документов или искать конкретные прикрепленные файлы.
Пользовательские голоса от xAI позволяют клонировать голос с высоким качеством всего за минуту-две
Помимо работы с текстом, xAI представила Custom Voices — сложный API для клонирования голоса и веб-интерфейс для создания голосовых клонов.
Этот продукт позволяет разработчикам клонировать голос по эталонной аудиозаписи продолжительностью всего от 120 секунд. После клонирования полученный «идентификатор голоса» можно использовать во всех API Text-to-Speech (TTS) и Voice Agent от xAI.
В документации xAI подчеркивается, что речь идет не просто о тембре; модель спроектирована так, чтобы улавливать манеру произношения.
Если пользователь запишет эталонный ролик в стиле «службы поддержки», полученный ИИ-голос будет имитировать именно эту услужливую профессиональную интонацию.
Несмотря на творческий потенциал, xAI установила строгие географические ограничения на эту функцию, сделав ее доступной только в США, с заметным исключением для штата Иллинойс из-за региональных правил регулирования биометрии и конфиденциальности.
Хотя консольная песочница открыта для общего использования, программный доступ через эндпоинт POST /v1/custom-voices в настоящее время закрыт и доступен только командам с тарифным планом Enterprise.
Я попробовал это сам, и после прохождения необходимых экранов записи голоса в веб-интерфейсе (инструмент просит вас вслух прочитать несколько отрывков несвязанного диалога) у меня действительно появилась копия моего голоса, которая пугающе точно совпадала с моим собственным и правильно произносила новые слова точно так же, как это сделал бы я, читая вслух новый предоставленный ей сценарий.
Вы можете удалить свои пользовательские голоса в один клик в веб-приложении xAI Custom Voices и создавать до 30 новых голосов за раз.
Что касается лицензирования, функция Custom Voices строго «ограничена вашей командой» и никогда не предоставляется другим пользователям, что обеспечивает конфиденциальную коммерческую лицензию на корпоративные активы.
Доступ к новому API голосового агента (grok-voice-think-fast-1.0) тарифицируется по фиксированной ставке 3,00 доллара США в час (0,05 доллара США в минуту) для взаимодействий в режиме «речь-речь». Согласно моему исследованию, это нижний и средний диапазон цен по сравнению с другими конкурирующими голосовыми агентами:
|
Сервис |
Цена за 1 тыс. символов |
Примерная стоимость за минуту |
Примерная стоимость за час |
|
OpenAI TTS (Стандартный) |
$0.015 |
~$0.015 |
~$0.90 |
|
OpenAI TTS (HD) |
$0.030 |
~$0.030 |
~$1.80 |
|
Голосовой агент Grok |
$0.05 |
$3.00 |
|
|
ElevenLabs (Начальный) |
~$0.30 |
~$0.30 |
~$18.00 |
|
ElevenLabs (Профессиональный) |
~$0.18 |
~$0.18 |
~$10.80 |
|
Play.ht |
~$0.20 |
~$0.20 |
~$12.00 |
|
Azure / Google Cloud |
$0.016 — $0.024 |
~$0.02 |
~$1.00 — $1.50 |
Дополнением к этому служит автономная служба преобразования текста в речь (TTS), которая предлагает пять различных голосов (Eve, Ara, Rex, Sal и Leo) по цене 4,20 доллара США за 1 миллион символов.
Для задач транскрипции API Speech-to-Text (STT) обеспечивает потоковую передачу в реальном времени по цене 0,20 доллара в час, в то время как пакетная обработка доступна по сниженной ставке 0,10 доллара в час.
Для обеспечения безопасности клиентских приложений xAI использует временные токены (Ephemeral Tokens), позволяющие устанавливать защищенные соединения WebSocket без раскрытия основных ключей API.
После создания эти голоса остаются конфиденциальными для команды пользователя и могут использоваться во всех голосовых API путем ссылки на уникальный 8-значный буквенно-цифровой идентификатор voice_id.
Для строго регулируемых отраслей xAI поддерживает стандарты готовности к производственному использованию, включая аудит SOC 2 Type II, соответствие требованиям HIPAA для рабочих нагрузок в сфере здравоохранения и соблюдение GDPR.
Агрессивно низкие цены на API как инструмент дифференциации
Наиболее агрессивным аспектом анонса Grok 4.3 является структура ценообразования. Бинду Редди, генеральный директор стартапа в области корпоративных ассистентов Abacus AI, отметила в X, что модель «так же умна, как Sonnet 4.6, и при этом в 5 раз дешевле и быстрее».
Стандартные тарифы API установлены на уровне 1,25 доллара за миллион входных токенов и 2,50 доллара за миллион выходных токенов. Это отражает значительное снижение стоимости по сравнению с предшественником Grok 4.20: по данным Artificial Analysis, входная цена снизилась примерно на 40%, а выходная — на 60%.
Согласно нашим расчетам в VentureBeat, это прочно ставит Grok 4.3 в половину моделей с самыми низкими затратами среди всех основных базовых моделей, гораздо ближе к китайским предложениям с открытым исходным кодом, чем к проприетарным американским конкурентам:
|
Модель |
Вход |
Выход |
Общая стоимость |
Источник |
|
MiMo-V2.5 Flash |
$0.10 |
$0.30 |
$0.40 |
|
|
Grok 4.1 Fast |
$0.20 |
$0.50 |
$0.70 |
|
|
MiniMax M2.7 |
$0.30 |
$1.20 |
$1.50 |
|
|
MiMo-V2.5 |
$0.40 |
$2.00 |
$2.40 |
|
|
Gemini 3 Flash |
$0.50 |
$3.00 |
$3.50 |
|
|
Kimi-K2.5 |
$0.60 |
$3.00 |
$3.60 |
|
|
Grok 4.3 |
$1.25 |
$2.50 |
$3.75 |
|
|
GLM-5 |
$1.00 |
$3.20 |
$4.20 |
|
|
GLM-5-Turbo |
$1.20 |
$4.00 |
$5.20 |
|
|
DeepSeek V4 Pro |
$1.74 |
$3.48 |
$5.22 |
|
|
GLM-5.1 |
$1.40 |
$4.40 |
$5.80 |
|
|
Claude Haiku 4.5 |
$1.00 |
$5.00 |
$6.00 |
|
|
Qwen3-Max |
$1.20 |
$6.00 |
$7.20 |
|
|
Gemini 3 Pro |
$2.00 |
$12.00 |
$14.00 |
|
|
GPT-5.4 |
$2.50 |
$15.00 |
$17.50 |
|
|
Claude Opus 4.7 |
$5.00 |
$25.00 |
$30.00 |
|
|
GPT-5.5 |
$5.00 |
$30.00 |
$35.00 |
Тем не менее, «рассуждающая» природа модели порождает новую категорию тарификации: токены рассуждения (Reasoning tokens).
Это токены, сгенерированные в процессе внутреннего мыслительного процесса модели, и они тарифицируются по той же ставке, что и стандартные токены завершения. Фактически пользователи платят за то, чтобы ИИ «подумал» перед тем, как выдать окончательный ответ. Компания xAI также ввела несколько уникальных структур комиссий:
-
Кэширование промптов: Повторяющиеся промпты обходятся значительно дешевле — 0,20 доллара за миллион токенов, что стимулирует разработчиков повторно использовать контекст.
-
Вызовы инструментов: Хотя использование токенов для инструментов тарифицируется по стандартным ставкам, сам факт вызова инструмента влечет за собой фиксированную плату — 5,00 долларов за 1000 вызовов для веб-поиска или выполнения кода и 10,00 долларов для вложений файлов.
-
Штраф за нарушение правил использования: В рамках шага, который может установить новый прецедент в отрасли, xAI взимает комиссию в размере 0,05 доллара за запросы, которые блокируются ее фильтрами безопасности еще до того, как начнется генерация.
Сама модель остается доступной через стандартный коммерческий API, причем xAI рекомендует всем разработчикам переходить на grok-4.3 как на свою «самую интеллектуальную и быструю модель».
Сторонние оценки и анализ бенчмарков
Прием Grok 4.3 оказался неоднозначным и во многом зависит от конкретного варианта использования. Профессиональные тестеры и разработчики подчеркивают «резкий разрыв» между сильными сторонами модели в конкретных предметных областях и ее общей согласованностью при рассуждениях.
По данным независимой компании по оценке ИИ Vals AI, Grok 4.3 заняла первое место в нескольких специализированных индексах. В настоящее время она занимает 1-е место по индексу CaseLaw v2 (точность 79,3%) и 1-е место по CorpFin.
Такой скачок юридического мышления на 25 пунктов по сравнению с Grok 4.20 говорит о том, что архитектура «постоянно активных рассуждений» особенно хорошо подходит для плотных логических структур права и финансов.
Artificial Analysis подтвердила эту производительность, отметив колоссальный прогресс в агентных задачах: модель набрала 1500 баллов по шкале Эло в бенчмарке GDPval-AA, обогнав таких конкурентов, как Gemini 3.1 Pro и GPT-5.4 mini.
И наоборот, пользователи, ориентированные на универсальных агентов и написание кода, указывают на недостатки.
Компания по автоматизации розничной торговли с помощью ИИ Andon Labs сообщила, что Grok 4.3 представляет собой «серьезный регресс» в бенчмарке Vending-Bench 2, измеряющем способность ИИ совершать последовательные действия в симуляции.
Они живо описали модель как страдающую «нарколепсией», предпочитая оставаться неактивной в течение нескольких дней симуляции вместо того, чтобы предпринимать необходимые действия.
Эти настроения разделили и в Vals AI, отметив, что, хотя модель улучшилась в некоторых аспектах написания кода, она по-прежнему слаба в общих задачах программирования и «испытывает трудности со сложными математическими задачами», набрав всего 11% в ProofBench.
Стоит ли вашему предприятию использовать Grok 4.3?
Запуск Grok 4.3 представляет собой расчетливую ставку xAI на то, что рынок предпочитает специализированный блеск и экстремальную экономичность идеально сбалансированному универсалу.
Добившись оценки 53 по индексу интеллекта Artificial Analysis и при этом оставаясь на «границе Парето» по соотношению стоимости и интеллекта, xAI позиционирует себя как лидера по соотношению «цена-качество» для корпоративных приложений в юридических и финансовых технологиях.
«Постоянно активные рассуждения» — палка о двух концах. Хотя они обеспечивают глубину, необходимую для навигации в сложной прецедентной практике, сообщения сообщества о «нарколепсии» говорят о том, что модель, которая постоянно «думает», может иногда довести себя до состояния паралича или, по крайней мере, до состояния чрезмерной осторожности, которая препятствует агентным действиям.
Кроме того, предыдущие скандалы с моделями Grok, включая версию чат-бота для X, которая называла себя «Мехагитлером» и публиковала антисемитский контент, генерацию сексуализированных дипфэйков и расследования, а также упоминания расовых конфликтов и правые завуалированные формулировки в отношении социальных проблем (которые, судя по всему, отражают многие собственные позиции основателя Маска, вплоть до того, что модель в какой-то момент проверяла собственный аккаунт Маска в X перед ответом в своей реализации для X) — почти наверняка заставят некоторые предприятия задуматься, прежде чем переходить на нее. Неясно, сохранились ли какие-либо из этих проблем в Grok 4.3, однако один пользователь отметил, что системный промпт Grok, судя по всему, содержит инструкцию «вы не назначаете широкие положительные/отрицательные функции полезности группам людей».
Для разработчиков решение о внедрении Grok 4.3, скорее всего, сведется к характеру их данных. Для тех, кому необходимо обрабатывать миллион токенов юридических документов за малую долю стоимости Claude 4.6 или GPT-5.5, Grok 4.3 является явным фаворитом.
Для тех, кто создает высокочастотные автономные агенты или сложные математические солверы, «нарколепсия» и регрессии в кодировании позволяют предположить, что новейшей модели xAI все еще требуется несколько дополнительных «этапов настройки».
Как отметил OpenRouter в X после запуска модели в реальном времени, «большой скачок в агентной производительности» при более низкой цене является неоспоримой вехой. Сможет ли эта производительность сохраниться во всех сферах, остается главным вопросом лета 2026 года.



