OpenAI заявила о преимуществе чипа Jalapeño в скорости ИИ-инференса

По данным компании, её специализированный процессор выполняет больше вычислений на ватт и сокращает задержку ответов по сравнению с системами Nvidia. Первые развёртывания в очень небольших объёмах запланированы на конец 2026 года.

An image showing OpenAI’s Jalapeno chip

OpenAI раскрыла первые результаты тестов собственного чипа Jalapeño, предназначенного для ИИ-инференса — запуска уже обученных моделей для обработки запросов и работы агентов. Компания заявляет, что Jalapeño сочетает низкую задержку с высокой производительностью; по словам Ричарда Хо, ИИ-системам обычно приходится выбирать между задержкой и пропускной способностью.

В тестах InferenceX Jalapeño сравнивали с лучшими на тот момент результатами систем на базе Nvidia GB200 или GB300. По данным OpenAI, на моделях GPT-OSS 120B, DeepSeek R1 и Kimi K2.5 1T чип обеспечил в 1,5–1,9 раза больше ИИ-вычислений на ватт. Сквозная задержка при этом оказалась в 1,7–3,6 раза ниже.

Jalapeño — специализированная интегральная схема (ASIC), созданная OpenAI совместно с Broadcom. Разработчики оптимизировали её для этапов инференса, где особенно заметны задержки: предварительной обработки запроса и обмена данными между компонентами системы. Компания сообщила, что стремилась сократить перемещение данных и коммуникационные задержки, в том числе удерживая локально состояние модели и KV-кэш, используемый при формировании ответа.

В OpenAI рассчитывают начать развёртывание Jalapeño в очень небольших объёмах к концу 2026 года, а заметно нарастить объёмы — в 2027-м. При этом компания не собирается полностью заменять существующий парк ускорителей новым чипом и намерена продолжать работать с партнёрами, включая Nvidia.

OpenAI также планирует развивать Jalapeño как платформу нескольких поколений, координируя разработку чипов, памяти, моделей и ИИ-продуктов.