OpenAI и Broadcom представляют чип для инференса, оптимизированный под большие языковые модели
- Раннее тестирование показывает, что ускоритель первого поколения обеспечит производительность на ватт, значительно превосходящую современные передовые аналоги
- Создан с нуля для текущих и будущих LLM по всей индустрии
- Разработан от концепции до производства за девять месяцев при ускорении с помощью моделей OpenAI
- Расширяет полностековую платформу OpenAI, включая продукты, модели, а теперь и чипы
- Будет развернут в гигаваттных масштабах с партмя по дата-центрам в рамках нескольких поколений
OpenAI и Broadcom (NASDAQ: AVGO) представили сегодня Jalapeño — первый процессор искусственного интеллекта от OpenAI: ускоритель, спроектированный на основе видения OpenAI будущего инференса для LLM, а также первый ИИ-ускоритель в многопоколенческой вычислительной платформе, которую компании создают вместе, чтобы сделать передовой ИИ быстрее, надежнее и доступнее для большего числа людей.

Чип Jalapeño был передан генеральному директору OpenAI Сэму Альтману и президенту Грегу Брокману президентом и генеральным директором Broadcom Хоком Таном и президентом Чарли Каввасом, что стало важным шагом в стратегии OpenAI по созданию полного стека для своих моделей и продуктов.
OpenAI разработала этот чип с нуля на основе глубокого понимания принципов работы LLM, опираясь на свою дорожную карту моделей, ядер, систем обслуживания и продуктовых потребностей, вместе с партнерами Broadcom и Celestica, помогая индустриализировать платформу за счет реализации чипа, плат, интеграции стоечных систем, высокопроизводительных сетей и масштабируемых производственных систем. Jalapeño спроектирован с расчетом на гибкость для работы со всеми LLM, основываясь на интуитивном понимании потребностей текущих и будущих моделей ИИ в инференсе по всей отрасли. Инженерные образцы чипа Jalapeño уже выполняют рабочие нагрузки машинного обучения в лаборатории на целевой производственной частоте и мощности, включая GPT‑5.3‑Codex‑Spark.
Хотя OpenAI все еще оценивает финальную производительность, раннее тестирование показывает, что Jalapeño обеспечит производительность на ватт, значительно превосходящую текущие передовые решения. Подробный технический отчет о производительности будет представлен в ближайшие месяцы. Архитектура сокращает перемещение данных и балансирует вычислительные ресурсы, память и сетевые ресурсы для достижения реальной утилизации, максимально приближенной к теоретической пиковой производительности. Кремниевая реализация Broadcom и сетевые технологии, включая сетевые чипы Tomahawk, помогают вывести платформу на крупномасштабное производство.
«Мир переходит к экономике, основанной на вычислительной мощности, — заявил Грег Брокман, президент и сооснователь OpenAI. — Jalapeño является частью нашей долгосрочной стратегии в отношении полностековой инфраструктуры, призванной сделать вычисления более доступными, что приведет к созданию ИИ, который станет быстрее, надежнее, дешевле для людей и бизнеса и сможет использоваться для решения более важных проблем. Проектируя большую часть стека самостоятельно, мы можем эффективнее предоставлять больше интеллекта и продолжать продвигать передовой ИИ к более широкому доступу».
«Чип Jalapeño был спроектирован с нуля для инференса LLM с использованием детальных инсайтов из нашего тесного сотрудничества с исследователями OpenAI, — отметил Ричард Хо, возглавляющий аппаратную программу OpenAI. — Мы оптимизировали архитектуру под ядра, перемещение памяти, сети и паттерны обслуживания, которые имеют наибольшее значение для передовых моделей ИИ. Судя по раннему тестированию, Jalapeño будет эффективно выполнять наши важнейшие рабочие нагрузки, приближаясь к теоретическим пределам оборудования».
«Наше сотрудничество с OpenAI представляет собой фундаментальную приверженность масштабированию физической инфраструктуры, необходимой для следующего десятилетия ИИ, — заявил Хок Тан, президент и генеральный директор Broadcom. — Это только начало многопоколенческой дорожной карты. Совместно разрабатывая наш лучший в отрасли кремний напрямую с OpenAI, мы обеспечиваем развертывание дата-центров гигаваттного масштаба совместно с Microsoft и другими партнерами, начиная с 2026 года».
Создан как лучшая платформа инференса для LLM
Jalapeño — это проект с чистого листа для современного инференса LLM, а не универсальный ускоритель, адаптированный под более ранние ИИ-нагрузки. Он создается с учетом систем, которые OpenAI задействует ежедневно в ChatGPT, Codex, API и будущих агентных продуктах, а также спроектирован для текущих и будущих LLM по всей отрасли. Цель состоит в том, чтобы объединить мощность и пропускную способность ведущих сегодняшних ИИ-ускорителей с задержкой, более близкой к самым быстрым специализированным системам инференса, что делает Jalapeño отлично подходящим для интерактивных LLM-продуктов в масштабном исполнении.
В этом и заключается преимущество полного стека. OpenAI не просто разрабатывает передовые модели или строит на их базе продукты — она проектирует лежащую в их основе инфраструктуру: архитектуру чипов, ядра, системы памяти, сети, планирование, системы развертывания и пользовательский опыт. Поскольку OpenAI работает на всех уровнях стека, каждый слой может быть оптимизирован под единую цель: сделать модели быстрее, надежнее и доступнее для пользователей.
Jalapeño усиливает маховик прогресса OpenAI. Улучшенная инфраструктура повышает эффективность вычислений. Большая эффективность вычислений позволяет улучшить обучение и обслуживание, в конечном итоге обеспечивая работу более мощных моделей ИИ. Улучшенные модели становятся лучшими продуктами для людей, разработчиков и бизнеса. Лучшие продукты стимулируют рост числа пользователей, клиентов и доходов, что позволяет OpenAI реинвестировать средства в следующее поколение инфраструктуры. Со временем этот цикл помогает сделать искусственный интеллект более мощным, надежным и менее дорогим для каждого.
Девятимесячный цикл тейп-аута, ускоренный моделями OpenAI
Jalapeño был совместно разработан от первоначального дизайна до производственного тейп-аута всего за девять месяцев, и эта программа заказных ИИ-ускорителей представляет собой, как мы полагаем, самый быстрый цикл разработки ASIC, когда-либо достигнутый в сфере высокопроизводительных полупроводников. Такая скорость отражает глубокую совместную разработку программного и аппаратного обеспечения командами инженеров OpenAI, экспертизу Broadcom в реализации кремния и использование моделей OpenAI для ускорения этапов проектирования и оптимизации.
Те же модели, которые обслуживают пользователей, помогают улучшать инфраструктуру, используемую для запуска будущих моделей. Если ИИ может помочь инженерам быстрее проектировать лучшие чипы, он сможет снизить стоимость вычислений по всей отрасли и помочь демократизировать доступ к передовому ИИ.
Создание многопоколенческой платформы с партнерами
Jalapeño — это первый шаг в создании многопоколенческой вычислительной платформы, рассчитанной на первоначальное развертывание к концу 2026 года и расширение в последующие годы. Она объединяет разработанные OpenAI ускорители с кремниевой реализацией Broadcom, сетевыми технологиями и технологиями подключения, а также опытом Celestica в создании плат, стоек и систем.
Сделать передовой ИИ более доступным для всех
Смысл этой работы прост: инференс — это то место, где ИИ доходит до людей. каждое улучшение стоимости, скорости и надежности может проявляться в виде более быстрого ответа ChatGPT, задачи для Codex, которая может выполняться за меньшее количество шагов и с меньшим ожиданием, более дешевого в разработке API-продукта или более надежного доступа при высоком спросе.
Демократизация ИИ означает создание передовых моделей, которые доступны, надежны и достаточно недороги для повседневного использования большим количеством людей. Jalapeño помогает OpenAI превращать большую часть своей инфраструктуры в полезный интеллект для студентов, разработчиков, малого бизнеса, исследователей, предприятий и всех, кто пытается учиться, созидать или решать сложные задачи.
Автор
Полный текст статьи читайте на OpenAI
