Борьба с растущими расходами
Разработка собственного чипа Jalapeño стала ответом на колоссальные затраты на инфраструктуру. В прошлом году расходы OpenAI на поддержание работы серверов ChatGPT составили 8,4 млрд долларов. С учетом того, что еженедельно платформой пользуются 900 млн человек, в этом году операционные расходы могут вырасти до 14 млрд долларов.
Текущая финансовая ситуация компании требует оптимизации: при годовой выручке в 25 млрд долларов OpenAI планирует инвестировать около 1,4 трлн долларов в вычислительные мощности в течение следующих восьми лет. Использование стороннего оборудования, например процессоров Nvidia, обходится дорого из-за высокой маржинальности поставщиков.
Специализация вместо универсальности
Новый чип Jalapeño — это специализированная интегральная схема (ASIC), созданная не для общих задач, а конкретно для инференса больших языковых моделей (LLM). Инференс — это процесс работы уже обученной модели, когда она выдает ответ пользователю.
В отличие от универсальных ускорителей, архитектура Jalapeño сбалансирована под конкретные нужды: вычисления, память и сетевое взаимодействие настроены так, чтобы минимизировать задержки при передаче данных. Это позволяет максимально эффективно использовать вычислительную мощность процессора.
Партнерство и производство
Проект стал результатом сотрудничества OpenAI и Broadcom. OpenAI разработала архитектуру, опираясь на свои планы по развитию моделей, а Broadcom взяла на себя проектирование кремния и интеграцию высокопроизводительных сетевых решений. В архитектуру включены сетевые компоненты Tomahawk от Broadcom для эффективной связи чипов в кластерах дата-центров.
Производством физических пластин займется компания TSMC в Тайване, а сборкой плат и стоечных систем — Celestica. Первые лабораторные образцы уже проходят испытания на моделях нового поколения, таких как неанонсированная GPT-5.3-Codex-Spark.
Стратегия вертикальной интеграции
Создание собственного «процессора интеллекта» превращает OpenAI из разработчика программного обеспечения в компанию с полностью интегрированной инфраструктурой. Это напоминает подход Apple, где программное обеспечение и «железо» максимально оптимизированы друг под друга.
Такой подход создает замкнутый цикл: более эффективная инфраструктура снижает стоимость работы моделей. Это делает продукты доступнее и быстрее, что привлекает больше пользователей и дает ресурсы для создания следующего поколения оборудования.
Что это значит
OpenAI вступает на путь создания собственного оборудования, по которому уже работают конкуренты: Google (чипы TPU), Amazon и Meta*. Разработка Jalapeño была ускорена благодаря использованию самих языковых моделей OpenAI для автоматизации проектирования железа. Начало развертывания новых чипов в дата-центрах запланировано на конец 2026 года.
* Деятельность Meta (соцсети Facebook и Instagram) запрещена в России как экстремистская.
