Smallest.ai создаёт голосовых агентов без заметной задержки

Smallest.ai, основанная в конце 2024 года, привлекла $13 млн в раунде Series A. Общий объём финансирования стартапа превысил $21 млн. Компания разрабатывает компактную голосовую ИИ-модель для естественных разговоров с клиентами практически без задержки.
Почему обычные LLM мешают живому разговору
Большая языковая модель обычно получает законченную реплику и только затем формирует ответ. Для текстового чата такая пауза приемлема, но в телефонном разговоре даже короткая задержка выдаёт машину и нарушает привычный ритм общения.
Smallest.ai предлагает другой подход: специализированная модель одновременно слушает, обрабатывает информацию и говорит. Она может готовить ответ до конца реплики собеседника и корректно реагировать на затянувшийся монолог или перебивание.
Две модели вместо одной
Небольшая модель выступает слоем оперативного интеллекта и ведёт разговор в пределах заданной темы. Если вопрос выходит за границы её базы знаний, система подключает крупную фундаментальную модель, а клиента ненадолго ставит на удержание — как если бы сотрудник уточнял информацию.
«Мы хотим, чтобы наши модели сломали тест Тьюринга. Человек должен говорить с моделью и не понимать, общается он с ИИ или с человеком», — заявил основатель и CEO Smallest.ai Сударшан Камат.
Раунд возглавила Seligman Ventures, к ней присоединились Sierra Ventures и 3one4 Capital. Технология рассчитана на разные акценты, десятки языков и работу в шумной среде. Среди клиентов стартапа уже есть RingCentral и Truecaller, а конкурентами выступают ElevenLabs, Cartesia и Sarvam.
Стратегия Smallest.ai вписывается в гонку за рынок корпоративных голосовых моделей: разработчики всё чаще отделяют быстрый голосовой интерфейс от ресурсоёмкого рассуждения. Для бизнеса это означает возможность внедрять более естественную автоматизацию поддержки, не превращая создание собственной голосовой модели в отдельное направление разработки.

