Борьба с растущими расходами

Разработка собственного чипа Jalapeño стала ответом на колоссальные затраты на инфраструктуру. В прошлом году расходы OpenAI на поддержание работы серверов ChatGPT составили 8,4 млрд долларов. С учетом того, что еженедельно платформой пользуются 900 млн человек, в этом году операционные расходы могут вырасти до 14 млрд долларов.

Текущая финансовая ситуация компании требует оптимизации: при годовой выручке в 25 млрд долларов OpenAI планирует инвестировать около 1,4 трлн долларов в вычислительные мощности в течение следующих восьми лет. Использование стороннего оборудования, например процессоров Nvidia, обходится дорого из-за высокой маржинальности поставщиков.

Специализация вместо универсальности

Новый чип Jalapeño — это специализированная интегральная схема (ASIC), созданная не для общих задач, а конкретно для инференса больших языковых моделей (LLM). Инференс — это процесс работы уже обученной модели, когда она выдает ответ пользователю.

В отличие от универсальных ускорителей, архитектура Jalapeño сбалансирована под конкретные нужды: вычисления, память и сетевое взаимодействие настроены так, чтобы минимизировать задержки при передаче данных. Это позволяет максимально эффективно использовать вычислительную мощность процессора.

Партнерство и производство

Проект стал результатом сотрудничества OpenAI и Broadcom. OpenAI разработала архитектуру, опираясь на свои планы по развитию моделей, а Broadcom взяла на себя проектирование кремния и интеграцию высокопроизводительных сетевых решений. В архитектуру включены сетевые компоненты Tomahawk от Broadcom для эффективной связи чипов в кластерах дата-центров.

Производством физических пластин займется компания TSMC в Тайване, а сборкой плат и стоечных систем — Celestica. Первые лабораторные образцы уже проходят испытания на моделях нового поколения, таких как неанонсированная GPT-5.3-Codex-Spark.

Стратегия вертикальной интеграции

Создание собственного «процессора интеллекта» превращает OpenAI из разработчика программного обеспечения в компанию с полностью интегрированной инфраструктурой. Это напоминает подход Apple, где программное обеспечение и «железо» максимально оптимизированы друг под друга.

Такой подход создает замкнутый цикл: более эффективная инфраструктура снижает стоимость работы моделей. Это делает продукты доступнее и быстрее, что привлекает больше пользователей и дает ресурсы для создания следующего поколения оборудования.

Что это значит

OpenAI вступает на путь создания собственного оборудования, по которому уже работают конкуренты: Google (чипы TPU), Amazon и Meta*. Разработка Jalapeño была ускорена благодаря использованию самих языковых моделей OpenAI для автоматизации проектирования железа. Начало развертывания новых чипов в дата-центрах запланировано на конец 2026 года.

* Деятельность Meta (соцсети Facebook и Instagram) запрещена в России как экстремистская.