Китайская компания Z.ai выпустила модель ИИ GLM-5.2 с открытым исходным кодом, обученную исключительно на процессорах Huawei Ascend 910B без использования Nvidia. Это произошло на фоне усиления экспортного контроля США.
Модель имеет 744 млрд параметров и архитектуру «смесь экспертов» (MoE), активируя 8 из 256 подсетей на каждый токен. Веса доступны по лицензии MIT, что позволяет локальный запуск без ограничений.
Обучение обошлось примерно в $25 млн, что ниже затрат на аналогичные модели в США, благодаря дешевизне чипов Ascend и госсубсидиям. Однако скорость вывода ниже — 17-19 токенов/с против 25-30 у аналогов на Nvidia.
GLM-5.2 показала высокие результаты в бенчмарках: 62,1 балла на SWE-bench Pro (опередив GPT-5.5), первое место в Design Arena, но уступила Claude Opus в SWE-Marathon (13,0 vs 26,0). Разрыв с американскими моделями сократился до 2,7%.
Несмотря на успехи, эксперты отмечают отставание в сложных логических задачах и семимесячное отставание по индексу передовых возможностей. Интеграция разреженного внимания DSA позволяет обрабатывать контекст до 1 млн токенов.
Компания Z.ai внесена в санкционный список США, а модель находится под расследованием. Открытый код делает её недоступной для правительственного отзыва, но облачный API подчиняется китайским законам.

0 комментариев