Перейти к содержимому
FuriaHub
Pulse
FuriaHub

© 2026. Все права защищены.

Приватность·
  • Pulse
  • Labs
  • Forge
  • Match
  • Dev
  • Digital Zen
Весь Pulse
ИИ·25 августа 2026 г.·3 мин чтения

OpenAI показала первые замеры Jalapeño: больше работы на ватт, чем у GB200/GB300

На Hot Chips 2026 OpenAI опубликовала первые результаты кастомного инференс-ASIC вместе с Broadcom. SemiAnalysis InferenceX на GPT-OSS 120B, DeepSeek R1 и Kimi K2.5 1T дал 1,5–1,9× больше ИИ-работы на ватт на пиковой пропускной способности.

Сигнал

LLM

123 вакансии·1 за неделю·типичная вилка 215 000 – 371 000 ₽

Рядом чаще всего Python, SQL, RAG

Открыть вакансии
Обложка поста OpenAI с первыми результатами Jalapeño

25 августа OpenAI опубликовала первые измеренные результаты Jalapeño — кастомного инференс-ASIC, сделанного с Broadcom, — на Hot Chips 2026. SemiAnalysis InferenceX сравнил чип с Nvidia GB200/GB300 на GPT-OSS 120B, DeepSeek R1 и Kimi K2.5 1T.

Что известно

  • Jalapeño — кастомный инференс-ASIC вместе с Broadcom; первые измеренные результаты показали на Hot Chips 2026.
  • На SemiAnalysis InferenceX с GPT-OSS 120B, DeepSeek R1 и Kimi K2.5 1T чип дал в 1,5–1,9 раза больше ИИ-работы на ватт на пиковой пропускной способности.
  • Сквозная задержка ниже в 1,7–3,6 раза, интерактив — в 2,1–4,1 раза против сравнения с Nvidia GB200/GB300.
  • Ричард Хо сказал, что малую серию развернут в конце 2026 года, больший объём — в 2027-м.

Takeaways

  • Это первые лабораторные замеры, а не серийный SKU.
  • Сравнение — GB200/GB300 на трёх названных больших моделях.
  • Календарь Хо: конец 2026-го для малой партии и 2027-й для большего объёма.

Source: OpenAI

Теги

  • openai
  • jalapeno
  • inference chip
  • broadcom
  • hot chips

Поделиться

Читайте также

Изображение из материала The Register о Portable Computer от Perplexity
ИИ·26 авг.·3 мин чтения

Portable Computer от Perplexity запускает агентский стек на локальном DGX Spark

Portable Computer — локальная версия агента Computer от Perplexity: harness, оркестратор и открытые модели на Nvidia DGX Spark. Локальный инференс обходится без по-токенной платы за API.

Изображение из материала The Register о General Resolution Debian по LLM
ИИ·26 авг.·3 мин чтения

Разработчики Debian голосуют, насколько далеко можно пускать LLM в проект

Debian проводит General Resolution по использованию LLM: восемь пересекающихся предложений — от полного запрета до условного допуска. Руководитель проекта Sruthi Chandran продлила голосование на неделю; The Register на момент публикации насчитал меньше 350 бюллетеней.

Изображение из материала The Verge о входе ChatGPT Work на сайты
ИИ·26 авг.·3 мин чтения

ChatGPT Work теперь может входить на сайты, чтобы доводить задачи

ChatGPT Work умеет входить на сайты для многошаговых дел вроде записи в DMV, отмены брони или заявки на работу. OpenAI заявляет, что никогда не видит логин и пароль пользователя.