Дефицит микросхем памяти вынуждает Nvidia пересматривать конфигурации будущих ИИ-ускорителей. По оценкам TrendForce, в большинстве версий Rubin Ultra объём HBM4E придётся урезать.
Скорость важнее объёма. Для Rubin Ultra приоритет — пропускная способность, а не количество отгружаемых GPU. При экономии Nvidia сократит число ярусов в стеке, но не станет жертвовать скоростью передачи данных.
HBM4 в этих ускорителях выжмет максимум 12 Гбит/с, тогда как HBM4E должна поднять планку до 14–16 Гбит/с.
С текущего квартала Nvidia прорабатывает варианты компоновки памяти. Помимо изначального 12-ярусного HBM4E рассматриваются 8-ярусный HBM4E и две версии HBM4 — на 8 и 12 ярусов. Финальные спецификации пока не утверждены.
Причины две. Во-первых, чипов физически выпустят меньше, чем нужно Nvidia. Во-вторых, нет уверенности, что все вендоры успеют сертифицировать 12-ярусные стеки HBM4E к старту поставок — часть спроса закроют 8-ярусными.
Даже рост поставок HBM на 50–60 % в следующем году не покроет возросший спрос
Соответственно, цены на такую память продолжат расти и в 2027 году. Для разработчиков ИИ-ускорителей это станет проблемой вдобавок к самому дефициту.
Nvidia не одинока: облачные гиганты, создающие собственные чипы, тоже готовы умерить аппетиты по HBM.
Параллельно урезаются и другие типы памяти. Производители серверов и облачные клиенты сократили объёмы RDIMM на первое полугодие. Nvidia вдвое уменьшила память SOCAMM в модулях Vera Rubin Superchip.
Причина та же — ожидание нехватки LPDDR5X на протяжении всего 2027 года. Большинство участников рынка памяти сходится во мнении, что дефицит предложения сохранится весь следующий год.
