Китайская компания Dongfang Suanxin представила ИИ-ускоритель DF1000 на полностью отечественных компонентах. Вместо HBM используется 3D DRAM, что снижает стоимость. Ускоритель обеспечивает 520 Тфлопс в BF16, пропускную способность памяти 6,4 Тбайт/с и интерконнект 900 Гбайт/с.
DF1000 превосходит NVIDIA H100 вдвое по пропускной способности и на 33% H200. Быстродействие достигает 500 токенов/с на Llama3 70B. Устройство подходит для обучения LLM и других задач, поддерживает переконфигурацию под задачу.
В разработке DF2000 (2027) с производительностью до 1000 Тфлопс BF16, памятью до 15 Тбайт/с, 14-нм техпроцесс. DF3000 (2028) вдвое мощнее: 2000 Тфлопс BF16, память 20 Тбайт/с, интерконнект 3200 Гбайт/с.
Используется архитектура Near-In-Memory Computing с 3D DRAM и гибридным соединением. Это увеличивает количество межсоединений в 10 раз и пропускную способность памяти в 5 раз при той же ёмкости, формируя аналог HBM.
