OpenAI показала первые замеры Jalapeño: больше работы на ватт, чем у GB200/GB300
На Hot Chips 2026 OpenAI опубликовала первые результаты кастомного инференс-ASIC вместе с Broadcom. SemiAnalysis InferenceX на GPT-OSS 120B, DeepSeek R1 и Kimi K2.5 1T дал 1,5–1,9× больше ИИ-работы на ватт на пиковой пропускной способности.

25 августа OpenAI опубликовала первые измеренные результаты Jalapeño — кастомного инференс-ASIC, сделанного с Broadcom, — на Hot Chips 2026. SemiAnalysis InferenceX сравнил чип с Nvidia GB200/GB300 на GPT-OSS 120B, DeepSeek R1 и Kimi K2.5 1T.
Что известно
- Jalapeño — кастомный инференс-ASIC вместе с Broadcom; первые измеренные результаты показали на Hot Chips 2026.
- На SemiAnalysis InferenceX с GPT-OSS 120B, DeepSeek R1 и Kimi K2.5 1T чип дал в 1,5–1,9 раза больше ИИ-работы на ватт на пиковой пропускной способности.
- Сквозная задержка ниже в 1,7–3,6 раза, интерактив — в 2,1–4,1 раза против сравнения с Nvidia GB200/GB300.
- Ричард Хо сказал, что малую серию развернут в конце 2026 года, больший объём — в 2027-м.
Takeaways
- Это первые лабораторные замеры, а не серийный SKU.
- Сравнение — GB200/GB300 на трёх названных больших моделях.
- Календарь Хо: конец 2026-го для малой партии и 2027-й для большего объёма.
Source: OpenAI


