OpenAI и Broadcom представили Jalapeño – первый чип компании для ИИ, созданный всего за 9 месяцев
OpenAI и Broadcom анонсировали Jalapeño, кастомный процессор для инференса, разработанный специально под современные большие языковые модели и будущие агентные ИИ-нагрузки.
По заявлениям компаний, чип обеспечивает производительность на ватт выше, чем у передового оборудования на рынке сегодня.
OpenAI рассматривает создание собственного железа как стратегическую задачу и видит в Jalapeño первое поколение своей инференс-платформы. Компании также утверждают, что процессор демонстрирует более высокую эффективную утилизацию по сравнению с обычными ИИ-ускорителями.
Это означает, что чип приближается к теоретическому максимуму производительности, что выливается в высокую эффективность как по затратам, так и по энергопотреблению. При этом конкретные показатели производительности Jalapeño не раскрываются, поэтому к подобным заявлениям стоит относиться осторожно.
Инженерные образцы уже работают в лаборатории на целевых частотах и при целевом энергопотреблении, хотя детали тоже не разглашаются. По словам OpenAI, на чипе запускаются машинно-обучающие нагрузки, например GPT-5.3-Codex-Spark.
Компании заявляют, что ранние внутренние тесты показывают существенное превосходство Jalapeño по производительности на ватт над "нынешним передовым оборудованием". Однако никаких точных цифр, бенчмарков, конфигурации памяти или иных подробностей не приводится.
Стоит учитывать, что даже если Jalapeño обходит существующие ускорители AMD Instinct серии MI350 и решения Nvidia на архитектуре Blackwell, неизвестно, насколько конкурентоспособным он окажется против AMD Instinct серии MI400 и продуктов Nvidia на базе Rubin.
Ричард Хо, руководитель аппаратной программы OpenAI заявил:
Jalapeño был спроектирован с нуля для инференса больших языковых моделей на основе детальных данных из нашего тесного сотрудничества с исследователями OpenAI. Мы оптимизировали архитектуру вокруг ядер, перемещения данных в памяти, сетевого взаимодействия и паттернов обслуживания, которые важнее всего для передовых ИИ-моделей. По результатам ранних тестов, Jalapeño будет эффективно выполнять наши важнейшие нагрузки близко к теоретическим пределам оборудования.
Чип достиг стадии прототипа всего за девять месяцев, а его развертывание запланировано на конец 2026 года.
Это исключительно быстрый срок для разработки ASIC, ведь обычно проектирование такого чипа с нуля занимает от полутора до двух лет. Неизвестно, насколько активно Broadcom и OpenAI применяли ИИ для определения архитектуры и разработки Jalapeño, хотя компании признали, что использовали модели OpenAI для ускорения части работ по проектированию и оптимизации.
Еще один способ ускорить цикл разработки, активное переиспользование Broadcom собственной логики между различными кастомными чипами. Это позволяет компании выпускать новые решения быстрее конкурентов.
Примечательно, что согласно анонсу, Jalapeño рассчитан на поддержку не только собственных нагрузок OpenAI, но и нынешних и будущих языковых моделей по всей индустрии. Это потенциально открывает OpenAI возможность продавать свое железо сторонним заказчикам при условии достаточных поставок от Broadcom и TSMC.
Глава Broadcom отмечает, что Jalapeño будет развертываться в дата-центрах гигаваттного масштаба совместно с Microsoft и другими партнерами уже в этом году. При этом неясно, будет ли процессор использоваться исключительно под нагрузки OpenAI или станет доступен и другим арендаторам.
- Похоже, карточный домик OpenAI на грани разрушения
- ИИ повышает продуктивность на рабочих местах, но лишь на час в день
- OpenAI научила ChatGPT признавать собственное нездоровое поведение посредством исповеди