Moonshine Voice — это открытый AI-инструментарий для разработчиков, создающих голосовые агенты и приложения в реальном времени. Всё работает на устройстве, поэтому решение быстрое и приватное — без аккаунта, банковской карты и API-ключей.
Фреймворк и модели оптимизированы для потоковых приложений с низкой задержкой: обработка идёт, пока пользователь ещё говорит. Модели распознавания речи обучены с нуля и превосходят по точности Whisper Large V3, а компактные версии занимают всего 1 МБ.
Одна библиотека работает на Python, iOS, Android, macOS, Linux, Windows, Raspberry Pi, IoT, микроконтроллерах и носимых устройствах. Высокоуровневые API покрывают транскрипцию, синтез речи, клонирование голоса, диаризацию и голосовых агентов.
Поддерживается множество языков: для распознавания — английский, испанский, китайский, японский, корейский, вьетнамский, украинский, арабский; для синтеза речи список ещё шире, включая русский, немецкий, французский и хинди.
GitHub ★ 9,404

0 комментариев