Голосовые ИИ-агенты всё лучше решают задачи поддержки, но собеседник почти всегда понимает, что говорит с машиной. Стартап Smallest.ai хочет стереть эту границу.
Компания, основанная в конце 2024 года, делает ставку не на ускорение больших языковых моделей, а на компактные специализированные модели, заточенные под живой диалог.
Идея — воспроизвести человеческий способ общения: слушать, думать и говорить одновременно.
«Пока я говорю, вы уже думаете и можете меня перебить», — объясняет основатель и CEO Сударшан Камат. Именно так работает модель стартапа.
На развитие Smallest.ai привлекла $13 млн в раунде Series A под руководством Seligman Ventures при участии Sierra Ventures и 3one4 Capital. Общий объём инвестиций превысил $21 млн.
По словам Камата, LLM получает весь промпт целиком и только потом начинает рассуждать. В текстовом чате задержка терпима, в разговоре даже короткая пауза звучит неестественно.
Модель стартапа выступает слоем интеллекта реального времени: она ведёт беседу по конкретной теме практически без лага.
Если вопрос выходит за пределы её знаний, запрос передаётся большой фундаментальной модели — клиента ненадолго ставят на удержание, пока система «изучает» проблему, как это сделал бы живой оператор.
Камат уверен, что вскоре все ИИ-агенты будут работать на двух моделях: малой голосовой для взаимодействия и «офлайновой» LLM для сложных задач.
Smallest.ai сосредоточена на голосовой специфике: разные акценты, десятки языков, работа в шумной обстановке.
Среди клиентов — RingCentral и Truecaller. Потенциальными покупателями Камат называет любые сервисы поддержки, включая Sierra и Decagon: для них собственная разработка голоса — отвлечение от основного бизнеса.
Конкуренты — ElevenLabs, Cartesia и региональные игроки вроде Sarvam. Но если часть из них занимается дубляжом и подкастами, Smallest.ai работает только с диалоговыми агентами для бизнеса.
«Мы хотим, чтобы наши модели прошли тест Тьюринга. Вы говорите с моделью и не понимаете, ИИ это или человек», — говорит Камат.
