NVIDIA запустила в полное производство Groq 3 LPX для ИИ-агентов

NVIDIA запустила в полное производство Groq 3 LPX для ИИ-агентов

Ускоритель Groq 3 LPX расширяет платформу Vera Rubin NVL72 и предназначен для ускоренной генерации токенов в агентных системах.
Фото аватара
Редакция The GEEK вчера в 21:18
NVIDIA запустила в полное производство Groq 3 LPX для ИИ-агентов

NVIDIA 24 августа объявила о выходе Groq 3 LPX в полное производство. Стоечная система дополняет платформу Vera Rubin NVL72 и рассчитана на инференс — выполнение уже обученных моделей — в ИИ-агентах.

По данным NVIDIA, в тесте Artificial Analysis с открытой агентной моделью Gemma 4 31B система выдала 3400 выходных токенов в секунду при работе с контекстом на 100 000 токенов. Компания заявляет, что это в четыре раза быстрее ближайшей альтернативной платформы в этом бенчмарке.

NVIDIA запустила в полное производство Groq 3 LPX для ИИ-агентов

В архитектуре Rubin GPU обрабатывают большой контекст, а LPX ускоряет декодирование — этап последовательной генерации ответа, чувствительный к задержке. NVIDIA позиционирует такое разделение задач как способ одновременно повысить отзывчивость и пропускную способность агентных приложений.

Одна стоечная конфигурация Groq 3 LPX может включать 256 ускорителей LP30, соединённых прямыми межчиповыми связями. NVIDIA также сообщила, что облачный провайдер Nebius стал первым пользователем системы.

Компания связывает запуск с ростом нагрузки от агентных систем, которые используют инструменты, обрабатывают большие объёмы контекста и взаимодействуют с другими ИИ-сервисами. Сроки доступности Groq 3 LPX для других облачных провайдеров и предприятий в объявлении не уточняются.