Nvidia запускает в серийное производство чип Groq 3 LPX для ИИ-инференса
Материал подготовлен искусственным интеллектом на основе нескольких источников — ссылки на оригиналы приведены ниже.

Nvidia Corp. объявила на Hot Chips 2026, что её ускоритель ИИ-инференса Groq 3 LPX запущен в серийное производство. Чип предназначен для повышения скорости генерации токенов на платформе Vera Rubin, а первым заказчиком стала Nebius Group N.V. Это заявление сделано в условиях стремления Nvidia сохранить лидерство в области ИИ-вычислений.
Ключевые факты
- Nvidia объявила на Hot Chips 2026 о запуске в серийное производство ускорителя ИИ-инференса Groq 3 LPX.
- Первым заказчиком чипа Groq 3 LPX стала компания Nebius Group N.V.
- В бенчмарках Artificial Analysis Groq 3 LPX достиг рекордных 3400 токенов в секунду при работе с моделью Gemma 4 31B и контекстным окном 100 000 токенов.
- Полноценная стойка может использовать до 256 ускорителей LP30, соединённых высокоскоростными интерконнектами.
- Чип создан с использованием технологий, лицензированных у компании Groq Inc.
Производство и интеграция с платформой
Nvidia объявила о полномасштабном производстве Groq 3 LPX на Hot Chips 2026, после запуска серийного производства процессоров Vera и серверов Vera Rubin. Groq 3 LPX представляет собой специализированное расширение флагманской платформы Nvidia Vera Rubin, предназначенное для разгрузки чувствительных к задержкам задач декодирования с GPU. Полноценная стойка может использовать до 256 ускорителей LP30, соединённых сверхвысокоскоростными интерконнектами Nvidia. Чип создан с использованием технологий, лицензированных у небольшого производителя чипов Groq Inc.
Производительность и первые заказчики
В бенчмарках Artificial Analysis Groq 3 LPX показал рекордные 3400 токенов в секунду при запуске открытой агентной модели Gemma 4 31B с контекстным окном 100 000 токенов. Nvidia утверждает, что это делает чип в четыре раза более отзывчивым для чувствительных к задержкам рабочих нагрузок по сравнению с конкурирующими платформами, позволяя выполнять многошаговые агентные задачи за минуты вместо часов. Неоклауд-провайдер Nebius Group N.V. стал первым заказчиком, обязавшимся использовать новый чип.
3 источника
Nvidia запускает в серийное производство чип Groq 3 LPX для ИИ-инференса


