Декабрьская сделка на $20 млрд открыла Nvidia доступ к разработкам стартапа Groq. Соглашение имело нестандартную структуру, но уже принесло первые результаты — ускорители Groq 3 LPX запущены в серийное производство и появятся на рынке до конца года.
Эти чипы специализируются на ускорении инференса в инфраструктуре искусственного интеллекта. На конференции Hot Chips Nvidia также объявила о заключении контракта со SpaceX на поставку компонентов платформы Vera Rubin.
Компания Илона Маска намерена использовать процессоры Vera для синхронизации работы наземных и космических центров обработки данных. Производством чипов Groq 3 LPX для Nvidia занимается Samsung Electronics — это наследие сотрудничества стартапа с южнокорейским контрактным производителем.
Для остальной линейки продукции Nvidia традиционно использует мощности тайваньской TSMC. Весной этого года основатель Nvidia Дженсен Хуанг прогнозировал, что ускорители типа Groq смогут занять до четверти рынка ЦОД в сегменте разработки ПО с применением ИИ.
Ускорители Groq 3 LPX войдут в состав платформы Vera Rubin и будут применяться в агентских задачах. Первым клиентом, подписавшим контракт на поставку этих чипов, стала компания Nebius, основанная Аркадием Воложем — создателем Яндекса.
В одной серверной стойке можно объединить до 256 ускорителей LP30, что позволяет существенно снизить задержки при обработке запросов в агентских ИИ-сценариях. Компания Artificial Analysis провела независимое тестирование чипов на модели Gemma 4 31B.
Результаты показали рекордную пропускную способность в 3400 токенов в секунду при контекстном окне в 100 000 токенов. По данным Nvidia, это повышает отзывчивость системы в четыре раза по сравнению с конкурирующими решениями.
Такой прирост производительности значительно сокращает время выполнения задач ИИ-агентами.
Ключевую роль в достижении этих показателей играет встроенная в чип Groq 3 LPX скоростная память SRAM объёмом 500 Мбайт.
