OpenAI начинает партнерство с Cerebras для ускорения ИИ-программирования

OpenAI начинает партнерство с Cerebras для ускорения ИИ-программирования

Компания OpenAI в четверг представила GPT-5.3-Codex-Spark — облегченную модель для написания кода, созданную для обеспечения практически мгновенного отклика. Это ознаменовало первое серьезное партнерство компании в области инференса за пределами ее традиционной инфраструктуры, доминирующей на базе Nvidia. Модель работает на оборудовании от Cerebras Systems — производителя чипов из Саннивейла, чьи пластинчатые (wafer-scale) процессоры специализируются на рабочих нагрузках ИИ с низкими задержками.

Это партнерство заключено в поворотный для OpenAI момент. Компания пытается лавировать в условиях испортившихся отношений с давним поставщиком чипов Nvidia, нарастающей критики по поводу решения внедрить рекламу в ChatGPT, недавно анонсированного контракта с Пентагоном, а также внутренних организационных потрясений, в результате которых была распущена команда по безопасности, а по меньшей мере один исследователь подал в отставку в знак протеста.

«Графические процессоры (GPU) по-прежнему лежат в основе наших конвейеров обучения и инференса и обеспечивают наиболее экономически эффективные токены для широкого использования», — заявил представитель OpenAI изданию VentureBeat. — Cerebras дополняет эту основу, превосходно справляясь с рабочими процессами, требующими экстремально низких задержек, и сокращая сквозной цикл, благодаря чему такие сценарии использования, как написание кода в реальном времени в Codex, кажутся более отзывчивыми по мере итераций».

Столь аккуратная формулировка — с акцентом на то, что графические процессоры «остаются фундаментальными», в то время как Cerebras позиционируется как «дополнение» — подчеркивает хрупкий баланс, который должна соблюдать OpenAI, диверсифицируя поставщиков чипов и при этом не отталкивая Nvidia, доминирующую силу на рынке ИИ-ускорителей.

Прирост скорости сопровождается компромиссами в возможностях, на которые, по словам OpenAI, разработчики пойдут

Codex-Spark представляет собой первую модель OpenAI, созданную специально для совместной работы над кодом в реальном времени. Компания утверждает, что при работе на ультранизкозадержном оборудовании модель выдает более 1000 токенов в секунду, хотя и воздержалась от публикации конкретных показателей задержки, таких как время до получения первого токена (time-to-first-token).

«Мы не можем назвать конкретные цифры задержки, однако Codex-Spark оптимизирована так, чтобы ощущаться практически мгновенной — она выдает более 1000 токенов в секунду, оставаясь при этом крайне функциональной для реальных задач программирования», — отметил представитель OpenAI.

Прирост скорости сопряжен с признанными компромиссами в производительности. В бенчмарках SWE-Bench Pro и Terminal-Bench 2.0 — двух отраслевых тестах, оценивающих способность ИИ-систем автономно выполнять сложные задачи разработки ПО, — Codex-Spark уступает полноценной модели GPT-5.3-Codex. OpenAI позиционирует это как приемлемый обмен: разработчики получают ответы достаточно быстро, чтобы сохранять творческий настрой, даже если базовая модель не справляется с самыми сложными многоэтапными задачами программирования.

Модель выпускается с окном контекста в 128 000 токенов и поддерживает только текст — без изображений или мультимодальных входов. OpenAI предоставила ее в качестве исследовательского превью подписчикам ChatGPT Pro через приложение Codex, интерфейс командной строки и расширение для Visual Studio Code. Небольшая группа корпоративных партнеров получит доступ к API для оценки возможностей интеграции.

«Мы делаем Codex-Spark доступной в API для небольшого числа партнерских дизайн-групп, чтобы понять, как разработчики хотят интегрировать Codex-Spark в свои продукты, — пояснил представитель компании. — В ближайшие недели мы расширим доступ по мере продолжения настройки нашей интеграции в условиях реальных рабочих нагрузок».

Оборудование Cerebras устраняет узкие места, от которых страдают традиционные кластеры GPU

Техническая архитектура, лежащая в основе Codex-Spark, иллюстрирует экономику инференса, которая приобретает все большее значение по мере того, как ИИ-компании масштабируют ориентированные на потребителя продукты. Процессор Cerebras Wafer Scale Engine 3 — единый чип размером примерно с обеденную тарелку, содержащий 4 триллиона транзисторов, — устраняет большую часть накладных расходов на связь, которые возникают при распределении ИИ-нагрузок по кластерам из более мелких процессоров.

Для обучения массивных моделей такой распределенный подход остается необходимым, и графические процессоры Nvidia преуспевают в этом. Но для инференса — процесса генерации ответов на запросы пользователей — в Cerebras утверждают, что их архитектура способная выдавать результаты с существенно меньшей задержкой. Шон Ли (Sean Lie), технический директор и соучредитель Cerebras, охарактеризовал партнерство как возможность изменить то, как разработчики взаимодействуют с ИИ-системами.

«Больше всего в GPT-5.3-Codex-Spark нас радует партнерство с OpenAI и сообществом разработчиков с целью выяснить, что делает возможным сверхбыстрый инференс: новые паттерны взаимодействия, новые сценарии использования и принципиально иной опыт работы с моделью, — заявил Ли. — Это превью — только начало».

Команда инфраструктуры OpenAI не ограничилась оптимизацией только под аппаратное обеспечение Cerebras. Компания объявила об улучшении задержек во всем своем стеке инференса, что принесет пользу всем моделям Codex независимо от базового оборудования, включая постоянные соединения WebSocket и оптимизации в рамках Responses API. Результаты: сокращение накладных расходов на один цикл «клиент-сервер» на 80%, снижение накладных расходов на один токен на 30% и уменьшение времени до получения первого токена на 50%.

Мегасделка с Nvidia на 100 миллиардов долларов тихо развалилась за кулисами

Партнерство с Cerebras приобретает дополнительное значение на фоне все более сложных отношений между OpenAI и Nvidia. Прошлой осенью, когда OpenAI объявила об инфраструктурной инициативе Stargate, Nvidia публично пообещала инвестировать 100 миллиардов долларов в поддержку OpenAI при создании инфраструктуры ИИ. Это объявление казалось закреплением стратегического альянса между самой дорогой ИИ-компанией в мире и ее доминирующим поставщиком чипов.

Пять месяцев спустя эта мегасделка фактически застопорилась, судя по многочисленным сообщениям в СМИ. Генеральный директор Nvidia Дженсен Хуанг публично опроверг слухи о напряженности, заявив репортерам в конце января, что здесь «нет никакой драмы» и что Nvidia по-прежнему намерена участвовать в текущем раунде финансирования OpenAI. Тем не менее, отношения заметно остыли, а трения возникают по нескольким причинам.

OpenAI активно добивалась партнерства с альтернативными поставщиками чипов, включая сделку с Cerebras, а также отдельные соглашения с AMD и Broadcom. С точки зрения Nvidia, OpenAI может использовать свое влияние для превращения в биржевой товар (commoditize) именно того оборудования, которое сделало возможным ее прорывы в сфере ИИ. С точки зрения OpenAI, снижение зависимости от единственного поставщика — это разумная бизнес-стратегия.

«Мы продолжим сотрудничать с экосистемой, постоянно оценивая наиболее выгодные по соотношению цены и производительности чипы для всех сценариев использования», — заявил представитель OpenAI изданию VentureBeat. — Графические процессоры остаются нашим приоритетом для чувствительных к затратам и ориентированных на высокую пропускную способность задач как в исследованиях, так и в инференсе». Это заявление выглядит как осторожная попытка избежать конфронтации с Nvidia при сохранении гибкости, а также отражает более широкую реальность: для обучения передовых моделей ИИ по-прежнему требуются именно те массивы параллельных вычислений, которые обеспечивают GPU от Nvidia.

Расформированные команды безопасности и уходы исследователей ставят под вопрос приоритеты OpenAI

Запуск Codex-Spark происходит на фоне серии внутренних проблем OpenAI, которые усилили пристальное внимание к направлению и ценностям компании. Ранее на этой неделе появились сообщения о том, что OpenAI распустила команду по соответствию миссии (mission alignment team) — группу, созданную в сентябре 2024 года для продвижения заявленной цели компании по обеспечению того, чтобы общий искусственный интеллект приносил пользу человечеству. Семеро участников команды были переведены на другие роли, а ее лидер Джошуа Ахиам (Joshua Achiam) получил новую должность «главного футуриста» OpenAI.

Ранее OpenAI уже расформировала другую группу, занимавшуюся безопасностью — команду супериинтеграции (superalignment) в 2024 году. Эта команда была сосредоточена на долгосрочных экзистенциальных рисках, испускаемых ИИ. Тенденция к роспуску команд, ориентированных на безопасность, вызвала критику со стороны исследователей, утверждающих, что коммерческое давление в OpenAI перевешивает ее первоначальную некоммерческую миссию.

Компания также сталкивается с последствиями своего решения внедрить рекламу в ChatGPT. Исследовательница Зои Хициг (Zoë Hitzig) на этой неделе подала в отставку из-за того, что она назвала «скользкой дорожкой» рекламы в ИИ, предупредив в эссе для New York Times, что архив личных разговоров пользователей в ChatGPT создает беспрецедентные возможности для манипуляций. Anthropic воспользовалась этим скандалом, запустив рекламную кампанию на Суперкубке со слоганом: «Реклама идет в ИИ. Но не в Claude».

Кроме того, компания согласилась предоставить ChatGPT Пентагону через Genai.mil — новую программу Министерства обороны, которая требует от OpenAI разрешить «все законные виды использования» без вводимых компанией ограничений (условия, которые Anthropic, как сообщается, отвергла). Также появились сообщения о том, что Райан Байермейстер (Ryan Beiermeister), вице-президент OpenAI по политике в отношении продуктов, выражавшая обеспокоенность по поводу планируемой функции откровенного контента, была уволена в январе после обвинений в дискриминации, которые она отрицает.

OpenAI видит будущее ИИ-помощников по коду как инструментов, совмещающих быстрые правки и сложные автономные задачи

Несмотря на окружающую турбулентность, техническая дорожная карта OpenAI для Codex намекает на амбициозные планы. Компания видит помощника по коду, который органично сочетает молниеносное интерактивное редактирование с долгосрочными автономными задачами — ИИ, который справляется с быстрыми исправлениями и одновременно координирует работу множества агентов, решающих более сложные проблемы в фоновом режиме.

«Со временем режимы будут смешиваться: Codex сможет удерживать вас в узком интерактивном цикле, одновременно делегируя фоновые долгосрочные задачи субагентам или распределяя задачи между множеством моделей параллельно, когда вам нужны охват и скорость, избавляя вас от необходимости выбирать единственный режим заранее», — рассказал представитель OpenAI изданию VentureBeat.

Это видение потребует не просто более быстрого инференса, но и сложной декомпозиции задач и координации между моделями различного размера и возможностей. Codex-Spark создает низкозадержную основу для интерактивной части этого опыта; будущим релизам потребуется обеспечить автономное рассуждение и координацию мультиагентных систем, которые сделают все это возможным в полном объеме.

На данный момент Codex-Spark работает под управлением отдельных лимитов запросов (rate limits), отличных от других моделей OpenAI, что отражает ограниченную емкость инфраструктуры Cerebras в период исследовательского превью. «Поскольку модель работает на специализированном оборудовании с низкими задержками, ее использование регулируется отдельным лимитом, который может корректироваться в зависимости от спроса в ходе исследовательского превью», — отметил представитель компании. Лимиты спроектированы «щедрыми», а OpenAI следит за паттернами использования, определяя стратегию масштабирования.

Настоящая проверка заключается в том, трансформируются ли более быстрые ответы в лучший софт

Анонс Codex-Spark происходит на фоне жесточайшей конкуренции в сфере инструментов для разработчиков на базе ИИ. Продукт Claude Cowork от Anthropic спровоцировал распродажу акций традиционных разработчиков ПО на прошлой неделе на фоне размышлений инвесторов о том, могут ли ИИ-помощники вытеснить привычные корпоративные приложения. Microsoft, Google и Amazon продолжают масштабные инвестиции в возможности написания кода с помощью ИИ, интегрированные в их облачные платформы.

Приложение Codex от OpenAI продемонстрировало стремительное распространение с момента запуска десять дней назад: у него более миллиона загрузок, а еженедельная аудитория активных пользователей растет на 60% неделю к неделе. Более 325 000 разработчиков в настоящее время активно используют Codex как на бесплатных, так и на платных тарифах. Однако фундаментальный вопрос, стоящий перед OpenAI и всей ИИ-индустрией, заключается в том, приведет ли прирост скорости, обещанный Codex-Spark, к реальному росту производительности или просто сделает процесс более приятным, не меняя конечных результатов.

Ранние данные об инструментах кодинга с ИИ показывают, что более быстрые ответы стимулируют к более итеративным экспериментам. Сохраняются ли при этом лучшие показатели качества создаваемого софта — предмет споров среди исследователей и практиков. Очевидным кажется одно: OpenAI рассматривает задержку инференса как конкурентный рубеж, заслуживающий серьезных вложений, даже если эти инвестиции выводят ее за рамки традиционного партнерства с Nvidia на неисследованную территорию альтернативных поставщиков чипов.

Сделка с Cerebras — это расчетливая ставка на то, что специализированное оборудование способно разблокировать сценарии использования, с которыми общегосударственные или универсальные GPU не могут справиться рентабельно. Для компании, которая одновременно сражается с конкурентами, управляет натянутыми отношениями с поставщиками и переживает внутренние разногласия по поводу своего коммерческого курса, это также напоминание о том, что в гонке ИИ остановка смерти подобна. OpenAI создала свою репутацию за счет быстрого движения и разрушения условностей. Теперь ей предстоит доказать, что она может двигаться еще быстрее — не разрушая саму себя.

Технологии

Смотреть все

Подпишитесь на свежие новости!

Глубокая аналитика для руководителей в области корпоративного ИИ, данных и безопасности

Подписаться по RSS

RSS-ленты обновляются каждые 15 минут.