Стартап Fish Audio из Пало-Альто предлагает библиотеку из более 15 000 голосовых команд для создания выразительных и управляемых ИИ-голосов. Сервисом пользуются 8 млн человек, а годовая выручка достигла $21 млн.
Компания привлекла $50 млн в seed-раунде от Coreline Ventures и Capital Today. Основатель — бывший исследователь NVIDIA, который открыл исходный код модели Fish Speech (более 31 000 звёзд на GitHub).
Fish Audio выпустила пять моделей, включая проприетарную S2.1 Pro. В планах — модель понимания аудио и speech-to-speech. Стартап также автоматизировал процесс удаления голосов по запросу правообладателей.
Рынок насыщен конкурентами вроде ElevenLabs, но тонкие настройки и эффективное обучение моделей дают Fish Audio преимущество.
