Библиотека для распознавания речи на C/C++, обеспечивающая инференс моделей speech-to-text. Работает с GGUF-моделями на рантайме ggml, поддерживает бэкенды Metal, Vulkan и CUDA для быстрого GPU-инференса, а также CPU-путь с ускорением tinyBLAS.
Поддерживается 16 семейств моделей и 60+ вариантов в потоковом и пакетном режимах. Среди них Parakeet, Canary, Whisper, GigaAM, Moonshine, Qwen3-ASR, SenseVoice, Voxtral и другие. Каждая публикуемая модель численно проверена и протестирована по WER относительно эталонной реализации.
