Microsoft открыла публичный предварительный доступ к двум собственным ИИ-моделям. MAI-Image-2.5-Pro — флагманский генератор изображений, а MAI-Voice-2-Flash рассчитан на обработку речи при больших корпоративных нагрузках.
Обе модели намеренно занимают противоположные точки на кривой «качество — скорость — стоимость». Одна нацелена на максимум качества, вторая — на скорость и низкую цену массовых обращений.
MAI-Image-2.5-Pro выдаёт изображения высокого качества, поддерживает детальное редактирование и точную отрисовку текста. Тарифы API: $5 за 1 млн текстовых токенов на входе, $8 за 1 млн токенов изображений на входе и $106 — на выходе.
Базовая MAI-Image-2.5 недавно заняла второе место в рейтинге моделей для редактирования изображений на платформе Arena.
MAI-Voice-2-Flash вдвое быстрее базовой версии и на 32 % дешевле — $15 за 1 млн знаков. Модель ориентирована на кол-центры, голосовых агентов и приложения реального времени, где критична низкая задержка.
Метрики производительности Microsoft приводит как главный аргумент: компания способна работать на своих моделях, не полагаясь на OpenAI. Её ИИ уже встроен в Bing, PowerPoint, OneDrive, Dynamics 365, Excel, GitHub Copilot и Azure.
«Каждое из этих улучшений — шаг к одной и той же цели: продукты Microsoft, работающие на основе моделей Microsoft», — заявили в компании.
Результаты внедрения:
Bing Image Creator полностью переведён на MAI-Image-2.5
в PowerPoint модель снизила расход ресурсов GPU на 84 % против OpenAI GPT-Image-2
оптимизирована обработка задач в OneDrive
MAI-Voice-2-Flash развернули в Dynamics 365 Contact Center, сократив затраты на GPU до 89 %, и интегрировали в Azure Voice Live для разработчиков.
Сервис Dragon Copilot, которым пользуются 170 000 медучреждений и который за I квартал обработал 28 млн обращений пациентов, переведён на MAI-Transcribe-1.5 с поддержкой 58 языков.
Облегчённая MAI-Code-1-Flash работает в GitHub Copilot с июня. В сравнении с GPT-5.4 Mini и Claude Haiku 4.5 она даёт на 10 % больше принятого кода при на 10 % меньшем медианном расходе токенов.
Пользователи выбирают её повторно на 6 % чаще, чем GPT-5.4 Mini, и на 11 % чаще, чем Claude Haiku 4.5. После дообучения под Excel модель вышла на уровень GPT-5.6 в большинстве типовых задач.
При этом MAI-Code-1-Flash достаточно компактна, чтобы запускаться на устаревших ускорителях Nvidia H100 и даже A100.

0 комментариев