OpenAI представляет свой первый специализированный чип для инференса ИИ под названием Jalapeño, созданный совместно с Broadcom, — его разработка была ускорена с помощью собственных моделей OpenAI

OpenAI представляет свой первый специализированный чип для инференса ИИ под названием Jalapeño, созданный совместно с Broadcom, — его разработка была ускорена с помощью собственных моделей OpenAI

Источник: VentureBeat · Carl Franzen

OpenAI и Broadcom сегодня утром представили свой первый заказной ИИ-ускоритель под названием «Jalapeño», позиционируя его как специализированный процессор для инференса больших языковых моделей (LLM), а не как более универсальные графические процессоры (GPU), предлагаемые такими компаниями, как Nvidia или AMD.

По словам разработчиков, Jalapeño создан для поддержки рабочих нагрузок ChatGPT, Codex, API и будущих продуктов на базе агентов. Примечательно, что в пресс-релизах OpenAI и Broadcom новинка также позиционируется как продукт, который может стать доступным и для сторонних ИИ-компаний — «созданный с нуля для текущих и будущих LLM по всей индустрии». [Прим. автора.]

Как сообщает Bloomberg, чип снижает затраты на инференс примерно на 50%. Напомним, что под инференсом понимается процесс обслуживания готовой ИИ-модели для конечных пользователей, в то время как затраты на обучение, исследования и разработку остаются высокими.

График разработки Jalapeño установил рекордные темпы для полупроводниковой промышленности: путь от первых схем до готовности к производству занял всего девять месяцев, тогда как циклы разработки новых процессоров обычно исчисляются годами. Действительно, о

само партнерство OpenAI и Broadcom было официально объявлено только в октябре 2025 года.

Компании объяснили такую скорость глубоким процессом совместной разработки программного и аппаратного обеспечения, в ходе которого активно использовались собственные модели OpenAI для ускорения отдельных этапов проектирования чипа. Источники, близкие к компаниям, сообщили VentureBeat, что в процессе разработки применялись модели OpenAI предыдущего поколения, хотя представитель OpenAI отказался уточнить, какие именно, когда к нему обратился VentureBeat.

Получив первый физический образец в среду, OpenAI поделилась планами начать внедрение этих процессоров в действующие дата-центры к концу текущего года. Компания заявляет, что уже приступила к тестированию работы по крайней мере одной из своих моделей предыдущего поколения, GPT‑5.3‑Codex‑Spark, на этих чипах в условиях производственной нагрузки, хотя пока в тестовой среде.

Этот релиз знаменует собой крупное стратегическое расширение для создателей ChatGPT, поскольку компания стремится выстроить полный стек вычислений, необходимый для того сделать передовой ИИ быстрее, надежнее и доступнее.

Конечно, остается множество открытых вопросов, включая производительность нового чипа Jalapeño по сравнению с прямыми конкурентами, его стоимость и жизнеспособность серийного производства. Источники, близкие к компании, охарактеризовали начальные показатели производительности (по иронии судьбы) как «выдающиеся».

Президент и сооснователь OpenAI Грег Брокмена (Greg Brockman) и генеральный директор Broadcom Хок Тан (Hock Tan)

выступили на телеканале CNBC сегодня утром, чтобы обсудить новость, и Брокман отметил в интервью, что «это реальное улучшение производительности… в расчете на ватт и на доллар». В отдельном посте на X Брокман написал, что «показатели производительности на ватт выглядят невероятно».

Почему OpenAI создала ASIC

Чтобы понять, почему OpenAI занялась разработкой чипов, полезно взглянуть на архитектуру. Jalapeño представляет собой специализированную интегральную схему, или ASIC.

В отличие от GPU, который может справляться с самыми разными типами задач, ASIC оптимизирован под более узкий спектр применений,

как отмечают эксперты отрасли. Такая узкая специализация может сделать его дешевле и эффективнее для конкретных ИИ-задач, хотя он менее адаптивен, чем графические процессоры в стиле Nvidia.

В случае с Jalapeño компания OpenAI начала с чистого листа, сосредоточившись на обслуживании современных LLM, а не на адаптации более универсального ускорителя под свои нужды. Компания заявляет, что архитектура сформирована на основе ее опыта работы с крупномасштабными ИИ-продуктами и призвана сократить избыточное перемещение данных при более эффективном распределении вычислительных ресурсов, памяти и сетевых возможностей.

Broadcom вносит свой вклад в виде разработки базовых полупроводниковых компонентов и сетевых технологий, включая сетевые чипы Tomahawk, в то время как Celestica помогает с интеграцией плат, стоек и систем. Цель состоит в том, чтобы приблизить чип к его практическому пределу производительности в реальных нагрузках, а не просто улучшить теоретические бенчмарки.

Однако поворот OpenAI к собственной аппаратной экосистеме — это не просто погоня за техническим превосходством: он также может сделать экономику компании гораздо более устойчивой.

Опубликованные финансовые

документы, обнародованные критиком ИИ и специалистом по связям с общественностью Эдом Зитроном (Ed Zitron), показали, что, хотя в 2025 году OpenAI сгенерировала впечатляющую выручку в размере $13,07 млрд, ее общие операционные расходы за год раздулись до $34 млрд, в результате чего операционный убыток составил почти $20,92 млрд.

Главным виновником этого денежного кровотока стали чистые потребности в вычислениях, хотя большая их часть, вероятнее всего, приходится на обучение, а не на инференс.

Только в 2025 году затраты на исследования и разработки, в основном обусловленные инфраструктурой для обучения и обслуживания массивных языковых моделей, составили $19,18 млрд, или примерно 56 процентов от всех расходов компании. Кроме того, по имеющимся данным, в прошлом году OpenAI выплатила Microsoft более $10,59 млрд только за R&D и вычислительную инфраструктуру.

Тем не менее, поскольку OpenAI закладывает основу для долгожданного выхода на биржу в 2026 году, чип инференса Jalapeño может дать частным инвесторам и публичным рынкам уверенность в том, что у компании есть план по выходу из финансовой ямы и движению к прибыльности. Если ей удастся снизить затраты на ИИ-инференс, то, возможно, получится компенсировать часть убытков, потраченных на дорогостоящие циклы обучения.

«Проектируя большую часть стека самостоятельно, мы сможем предоставлять больше интеллектуальных возможностей с большей эффективностью и продолжим продвигать передовой ИИ к более широкому доступу», — отметил Брокмена, слова которого приводятся в пресс-релизе Broadcom.

Что это значит для Nvidia и всех остальных поставщиков чипов для OpenAI?

Появление Jalapeño сразу же вызывает вопросы о стратегическом положении OpenAI на жестко конкурентном рынке полупроводников и графических процессоров.

С момента запуска бума генеративного ИИ в конце 2022 года OpenAI оставалась одним из крупнейших покупателей премиальной продукции лидера рынка GPU компании Nvidia, но при этом также

привлекла миллиарды инвестиций от этой фирмы (что породило обвинения в «цикличных сделках») и расширила сотрудничество с другими конкурирующими производителями чипов для удовлетворения своих аппетитов.

  • Nvidia: В феврале 2026 года Nvidia финализировала прямые инвестиции в OpenAI в размере $30 млрд в рамках масштабного раунда финансирования на $110 млрд. Эта сделка закрепила соглашение о развертывании вычислительных систем мощностью 10 гигаватт (включая 3 гигаватта выделенной мощности для инференса и 2 гигаватта для обучения) на базе платформы Nvidia Vera Rubin следующего поколения. Источники, близкие к компаниям, сообщают VentureBeat, что Nvidia останется центральным партнером OpenAI, особенно в части обучения и разработки моделей.

  • Amazon Web Services (AWS): В рамках того же раунда финансирования в феврале 2026 года компания Amazon инвестировала в OpenAI $50 млрд. Сделка включала обязательство OpenAI задействовать примерно два гигаватта собственной вычислительной мощности Trainium от AWS в течение следующих восьми лет.

  • Advanced Micro Devices (AMD): OpenAI подписала соглашения с главным аппаратным соперником Nvidia — AMD, касающиеся использования последней графических процессоров серии AMD Instinct™ MI450.

  • Cerebras: Компания также заключила пакт с Cerebras — производителем ИИ-чипов, который провел первичное публичное размещение акций в мае 2026 года.

Источники, осведомленные об этих сделках, говорят, что в настоящее время они остаются в силе и не претерпели изменений.

Глобальная кремниевая гонка: OpenAI присоединяется к тяжеловесам ИИ-инфраструктуры

До появления Jalapeño компания OpenAI находилась в заведомо невыгодном структурном положении по сравнению с вертикально интегрированными технологическими империями мира.

Технологические гиганты вроде Google и Amazon годами использовали собственные зрелые программы заказных полупроводников — линейки Google Tensor Processing Units (TPU) и Amazon Trainium — для обслуживания масштабных вычислительных нагрузок со значительно меньшей маржинальностью.

Microsoft, основной облачный провайдер OpenAI и ее крупнейший финансовый спонсор, агрессивно вышла на рынок заказного кремния, выпустив ускоритель Azure Maia 100 в конце 2023 года.

Впоследствии Microsoft усилила это направление в январе 2026 года, представив Maia 200 — мощный чип для инференса на базе 3-нанометрового техпроцесса TSMC, который уже активно обслуживает модели GPT-5.2 от OpenAI в дата-центрах Azure.

Аналогичным образом, Meta за последние годы агрессивно расширила свою линейку процессоров Meta Training and Inference Accelerator (MTIA), представив серии MTIA 300, 400, 450 и 500 для работы своих рекомендательных систем и функций генеративного искусственного интеллекта без полной зависимости от Nvidia.

Jalapeño дает OpenAI возможность догнать конкурентов и нивелировать преимущество гиперскейлеров. Встроив свою архитектуру программного обеспечения непосредственно в проприетарный процессор, OpenAI получает шанс повторить — по крайней мере частично — стратегию Google, Amazon, Microsoft и Meta: перейти из статуса зависимого облачного клиента в роль более независимого поставщика ИИ-инфраструктуры.

Момент выбран как нельзя лучше на фоне стремительно эскалирующей глобальной кремниевой гонки. Отчасти подстегиваемые экспортными ограничениями США, китайские технологические тяжеловесы также активно занимаются разработкой собственных аппаратных решений для ИИ:

  • В мае полупроводниковое подразделение Alibaba, T-Head, представило Zhenwu M890 — проприетарный процессор, специально разработанный для автономных ИИ-агентов, которым требуются огромная пропускная способность памяти и контекстные окна большой длины.

  • Huawei, как сообщается, готовится выпустить свой новый чип Ascend 950DT в следующем месяце.

  • ByteDance, материнская компания TikTok, в июне 2026 года вступила в активные переговоры с Qualcomm о разработке заказных специализированных интегральных схем для своих дата-центров, чтобы избавиться от сторонней зависимости.

Успешно завершив разработку Jalapeño, OpenAI стремится выйти за рамки традиционной софтверной лаборатории и встать плечом к плечу с международными облачными и инфраструктурными гигантами.

Гигаваттное будущее

Эта разветвленная сеть партнерских соглашений подчеркивает грандиозный масштаб инфраструктурных амбиций OpenAI. Конечная цель партнерства OpenAI и Broadcom заключается в развертывании дата-центров гигаваттного масштаба совместно с Microsoft и другими партнерами начиная с 2026 года — то есть дата-центров, чьи вычислительные мощности

требуют энергии масштаба целых городов.

Для Broadcom это партнерство служит мощным катализатором репутации. Компания стала одним из главных бенефициаров бума генеративного ИИ, помогая гиперскейлерам и передовым лабораториям проектировать заказной кремний.

Акции Broadcom отражают этот импульс, продемонстрировав рост на 18% в годовом исчислении в первой половине 2026 года и почти семикратное увеличение с конца 2022 года,

согласно данным CNBC.

В конечном счете Jalapeño подтверждает, что OpenAI считает себя готовой выйти за пределы программного обеспечения и кода в сферу реального заказного «железа».

Контролируя физическую основу своего конвейера инференса и одновременно задействуя капитал и аппаратные мощности Nvidia, Amazon, AMD и Cerebras, OpenAI пытается стремительно переписать экономику будущего для сферы искусственного интеллекта.

Инфраструктура

Смотреть все

Подпишитесь на свежие новости!

Глубокая аналитика для руководителей в области корпоративного ИИ, данных и безопасности

Подписаться по RSS

RSS-ленты обновляются каждые 15 минут.