Перейти к содержимому
FuriaHub
Pulse
FuriaHub

© 2026. Все права защищены.

Приватность·
  • Pulse
  • Labs
  • Forge
  • Match
  • Dev
  • Digital Zen
Весь Pulse
ИИ·24 августа 2026 г.·3 мин чтения

NVIDIA сообщает, что Groq 3 LPX полностью в производстве для агентного инференса

На Hot Chips NVIDIA назвала Groq 3 LPX ускорителем интерактивного инференса, который расширяет Vera Rubin. На Gemma 4 31B с контекстом 100k Artificial Analysis замерила 3400 выходных токенов в секунду.

Сигнал

LLM

123 вакансии·1 за неделю·типичная вилка 215 000 – 371 000 ₽

Рядом чаще всего Python, SQL, RAG

Открыть вакансии
Обложка анонса NVIDIA о полном производстве Groq 3 LPX

24 августа на Hot Chips NVIDIA сообщила, что интерактивный ускоритель инференса Groq 3 LPX, расширяющий Vera Rubin, полностью в производстве. Artificial Analysis замерила Gemma 4 31B при контексте 100k: 3400 выходных токенов в секунду — в четыре раза быстрее ближайшей альтернативы.

Что известно

  • Groq 3 LPX описан как ускоритель интерактивного инференса, расширяющий Vera Rubin, и уже полностью в производстве.
  • Artificial Analysis зафиксировала 3400 выходных токенов в секунду на Gemma 4 31B с контекстом 100k — вчетверо быстрее ближайшей альтернативы.
  • Первое ИИ-облако — Nebius; облако Groq — среди самых ранних пользователей.
  • CNBC отдельно писал, что в декабре NVIDIA купила активы Groq за $20 млрд и что в стойке LPX — 256 чипов Groq 3.

Takeaways

  • NVIDIA продаёт кремний Groq как серийную надстройку инференса к Vera Rubin, а не как лабораторное демо.
  • Главный бенчмарк — скорость декодирования 31B-модели на длинном контексте.
  • Покупка активов за $20 млрд в декабре и 256 чипов в стойке — из CNBC, не из заметки NVIDIA.

Source: NVIDIA

Теги

  • nvidia
  • groq 3 lpx
  • vera rubin
  • inference
  • nebius

Поделиться

Читайте также

Изображение из материала The Register о Portable Computer от Perplexity
ИИ·26 авг.·3 мин чтения

Portable Computer от Perplexity запускает агентский стек на локальном DGX Spark

Portable Computer — локальная версия агента Computer от Perplexity: harness, оркестратор и открытые модели на Nvidia DGX Spark. Локальный инференс обходится без по-токенной платы за API.

Изображение из материала The Register о General Resolution Debian по LLM
ИИ·26 авг.·3 мин чтения

Разработчики Debian голосуют, насколько далеко можно пускать LLM в проект

Debian проводит General Resolution по использованию LLM: восемь пересекающихся предложений — от полного запрета до условного допуска. Руководитель проекта Sruthi Chandran продлила голосование на неделю; The Register на момент публикации насчитал меньше 350 бюллетеней.

Изображение из материала The Verge о входе ChatGPT Work на сайты
ИИ·26 авг.·3 мин чтения

ChatGPT Work теперь может входить на сайты, чтобы доводить задачи

ChatGPT Work умеет входить на сайты для многошаговых дел вроде записи в DMV, отмены брони или заявки на работу. OpenAI заявляет, что никогда не видит логин и пароль пользователя.