mimile
На главную

Nvidia запускает в серийное производство чип Groq 3 LPX для ИИ-инференса

AI-дайджест

Материал подготовлен искусственным интеллектом на основе нескольких источников — ссылки на оригиналы приведены ниже.

Nvidia запускает в серийное производство чип Groq 3 LPX для ИИ-инференса

Nvidia Corp. объявила на Hot Chips 2026, что её ускоритель ИИ-инференса Groq 3 LPX запущен в серийное производство. Чип предназначен для повышения скорости генерации токенов на платформе Vera Rubin, а первым заказчиком стала Nebius Group N.V. Это заявление сделано в условиях стремления Nvidia сохранить лидерство в области ИИ-вычислений.

Ключевые факты

  • Nvidia объявила на Hot Chips 2026 о запуске в серийное производство ускорителя ИИ-инференса Groq 3 LPX.
  • Первым заказчиком чипа Groq 3 LPX стала компания Nebius Group N.V.
  • В бенчмарках Artificial Analysis Groq 3 LPX достиг рекордных 3400 токенов в секунду при работе с моделью Gemma 4 31B и контекстным окном 100 000 токенов.
  • Полноценная стойка может использовать до 256 ускорителей LP30, соединённых высокоскоростными интерконнектами.
  • Чип создан с использованием технологий, лицензированных у компании Groq Inc.

Производство и интеграция с платформой

Nvidia объявила о полномасштабном производстве Groq 3 LPX на Hot Chips 2026, после запуска серийного производства процессоров Vera и серверов Vera Rubin. Groq 3 LPX представляет собой специализированное расширение флагманской платформы Nvidia Vera Rubin, предназначенное для разгрузки чувствительных к задержкам задач декодирования с GPU. Полноценная стойка может использовать до 256 ускорителей LP30, соединённых сверхвысокоскоростными интерконнектами Nvidia. Чип создан с использованием технологий, лицензированных у небольшого производителя чипов Groq Inc.

Производительность и первые заказчики

В бенчмарках Artificial Analysis Groq 3 LPX показал рекордные 3400 токенов в секунду при запуске открытой агентной модели Gemma 4 31B с контекстным окном 100 000 токенов. Nvidia утверждает, что это делает чип в четыре раза более отзывчивым для чувствительных к задержкам рабочих нагрузок по сравнению с конкурирующими платформами, позволяя выполнять многошаговые агентные задачи за минуты вместо часов. Неоклауд-провайдер Nebius Group N.V. стал первым заказчиком, обязавшимся использовать новый чип.

3 источника

Nvidia запускает в серийное производство чип Groq 3 LPX для ИИ-инференса