ИИтак

← Назад

NVIDIA запустила в серию ускоритель Groq 3 LPX, который ускоряет ответы ИИ-агентов

Стойка Groq 3 LPX дополняет серверы Vera Rubin NVL72 и отвечает за быструю генерацию токенов. По тесту Artificial Analysis она выдаёт 3 400 токенов в секунду при контексте в 100 тысяч токенов. Первым облаком с LPX стал Nebius.

Изображение: NVIDIA

NVIDIA запустила массовое производство Groq 3 LPX — стоечной системы, которая работает в паре с серверами Vera Rubin NVL72 и отвечает за скорость ответа ИИ-агентов. Компания объявила об этом на конференции Hot Chips в Пало-Альто.

Задачу между частями системы делят так. Графические процессоры Rubin обрабатывают длинный контекст: документы, историю диалога, результаты инструментов. LPX берёт на себя генерацию ответа, где модель выдаёт текст по одному токену. У агентов это узкое место: они рассуждают длинными цепочками, и даже крошечная задержка на каждом шаге складывается в заметное ожидание. В одной стойке LPX может стоять 256 ускорителей LP30, соединённых напрямую друг с другом.

Скорость NVIDIA подтверждает тестом Artificial Analysis. На открытой модели Gemma 4 31B с контекстом в 100 тысяч токенов система выдала 3 400 токенов в секунду. По данным компании, это вчетверо быстрее ближайшей альтернативной платформы.

Первым облаком с LPX стал Nebius: ускоритель добавят к Vera Rubin NVL72 в сервисе Nebius Token Factory. CoreWeave уже использует в работе Spectrum-X Multiplane — новую сетевую схему NVIDIA. Она делит подключение каждого сервера на несколько независимых сетей, поэтому кластер можно нарастить до 512 000 GPU без дополнительного уровня коммутаторов. Если из восьми таких сетей откажет одна, останется около 90% пропускной способности. SpaceXAI собирается строить свою будущую ИИ-инфраструктуру на Vera Rubin, «от центров обработки данных на Земле до спутников на орбите». Процессоры Vera компания займёт управлением агентами, вызовами инструментов и запуском кода.

Кроме того, NVIDIA показала Scale-In — сетевую инфраструктуру на процессорах BlueField-4, которая берёт на себя защиту, доступ к хранилищам и мониторинг, чтобы эта работа не отнимала ресурсы серверов. Технология NVLink Fusion позволяет подключать к платформе NVIDIA собственные чипы крупных облачных компаний. Сроков и цен на LPX компания не назвала, зато пообещала новые оптимизации и поддержку новых моделей.

← Все новости