ПО включает NVIDIA DCGM, открытые пакеты визуализации, Kubernetes с Multus и Cilium, а также планировщик Slurm. Управляющие серверы работают на Proxmox.
Две подсистемы хранения: внутренняя — гиперконвергентная, масштабируемая; внешняя — с SSD (61 Тбайт) и HDD (2 Пбайт), через InfiniBand NDR и FC32 SAN.
22 узла на NVIDIA H100 80GB и x86 дают 11 792 Тфлопс (FP64) и 700 Пфлопс (FP8/INT8). Итого: 4224 ядра CPU, 33 792 Гбайт RAM, 14 080 Гбайт GPU, 2,97 млн ядер CUDA, 92 928 тензорных ядер.
Каждый ускоритель оснащён 200G InfiniBand NDR, локально — 25GbE, управление — 10GbE.
Разработчики — «Е-Флопс» и «АМДтехнологии» — создали HPC-комплекс для ИИ по заказу топ-10 банка РФ. Внутренний сегмент (без интернета) — только ИИ, внешний — HPC.
Суперкомпьютер запущен в сертифицированном ЦОД провайдера. 16 шкафов с воздушным охлаждением, расширение до 42 узлов.

0 комментариев