Smallest.ai привлёк $13 млн на голосовой ИИ, который не отличить от человека
Стартап делает ставку на специализированные малые модели вместо ускорения LLM — и уже работает с RingCentral и Truecaller.

Стартап Smallest.ai, основанный в конце 2024 года, закрыл раунд Series A на $13 млн. Раунд возглавила Seligman Ventures, в нём также участвовали Sierra Ventures и 3one4 Capital. Суммарное финансирование компании превысило $21 млн.
Цель стартапа — сделать разговор с ИИ-агентом неотличимым от общения с живым человеком. Для этого команда идёт нестандартным путём: вместо того чтобы ускорять большие языковые модели, она строит небольшую специализированную модель, заточенную исключительно под голосовое взаимодействие.
Почему LLM не справляются с голосом
Ключевая проблема больших языковых моделей в голосовых сценариях — задержка. LLM получает весь запрос целиком, обрабатывает его и только потом начинает отвечать. В текстовом чате пауза в секунду-две незаметна. В живом разговоре она сразу выдаёт машину.
««Когда мы разговариваем, я не передаю тебе большой аудиофрагмент, после которого ты начинаешь думать», — объясняет основатель и CEO Smallest.ai Судхаршан Камат.»
Модель стартапа работает иначе: она слушает, обрабатывает и формирует ответ параллельно — так же, как это делает человек. Если собеседник затягивает монолог, модель способна его перебить. Именно этот принцип одновременной обработки Камат считает ключевым отличием от существующих решений.
При этом модель намеренно ограничена по охвату тем. Если вопрос выходит за рамки её знаний, система передаёт запрос большой фундаментальной модели — и на время «исследования» ставит клиента на короткую паузу, имитируя поведение живого оператора, который уточняет информацию.
Фокус на голосе как отдельная ниша
Smallest.ai не пытается конкурировать с универсальными LLM. Компания специализируется на голосовых нюансах: поддержке десятков языков, распознавании разных акцентов и работе в условиях фонового шума. Среди действующих клиентов — RingCentral и Truecaller.
Конкуренты стартапа — ElevenLabs, лидер рынка голосового ИИ, Cartesia, а также региональные игроки вроде индийского Sarvam, ориентированного на локальные языки. Однако многие из них применяют голосовой ИИ в смежных сценариях — дублировании видео, подкастах. Smallest.ai сознательно ограничивается корпоративными разговорными агентами реального времени.
Камат убеждён, что компаниям из сферы клиентской поддержки — включая таких игроков, как Sierra и Decagon, — невыгодно самостоятельно разрабатывать голосовые модели: это отвлекает от основного продукта. Именно здесь он видит рыночную нишу для Smallest.ai.
По его прогнозу, в ближайшем будущем все голосовые ИИ-агенты будут строиться на двухуровневой архитектуре: малая модель для мгновенного диалога и «офлайн» LLM для сложных задач, подключаемый по необходимости.
««Мы хотим, чтобы наши модели прошли тест Тьюринга. Вы должны говорить с нашей моделью и не понимать — человек это или ИИ. Это единственный фокус компании», — говорит Камат.»
Для белорусского IT-рынка подобные разработки актуальны в первую очередь для аутсорсинговых компаний и продуктовых стартапов, строящих решения для клиентской поддержки на западных рынках. Голосовые агенты с нулевой задержкой и поддержкой множества языков — потенциально востребованный инструмент для тех, кто разрабатывает SaaS-продукты в сегменте customer experience.
— По материалам TechCrunch: оригинальная статья. Перевод и адаптация — редакция Digital Business.
Свежие новости
Все новости
Сбер открыл Kandinsky WM 1.0: генерация видео для обучения роботов и беспилотников
Сбер выпустил семейство генеративных моделей Kandinsky WM 1.0 для создания физически достоверного видео. Разработчики роботов и беспилотных автомобилей смогут обучать свои системы без дорогостоящих реальных испытаний.

Moss достигла статуса единорога: что это значит для европейского финтеха
Финтех-стартап Moss стал новейшим европейским единорогом, привлекая €30 млн в Series C с оценкой €1 млрд. Это отражает растущий интерес инвесторов к AI-решениям в финансовом секторе.

Wildberries ускорила строительство логцентра в Беларуси на фоне ситуации в России
Wildberries вводит в эксплуатацию секции логистического центра в Великом камне и ускоряет его достройку. Ускорение связано с обстоятельствами в России.

Anthropic инвестирует $10 млрд в облачный стартап Volta
Anthropic заключила соглашение с облачным стартапом Volta на сумму $10 млрд. Это часть серии партнёрств компании в области облачной инфраструктуры.

Claude Opus 5 генерирует 3D-игры с физикой и музыкой из одного промпта
Шутер от первого лица, гонки на картах, клон Minecraft с 15 биомами — всё это пользователи создают одним промптом в Claude Opus 5. Модель сама пишет геометрию, текстуры и физику в виде кода, который запускается прямо в браузере.

Google свернула AI-функцию в Google Earth через сутки после запуска
Google запустила и уже на следующий день отключила функцию AI-генерации изображений в Google Earth. Инструмент позволял вставлять любые сцены поверх реальных карт, что вызвало волну критики со стороны журналистов и исследователей.

Google DeepMind представила Gemini Robotics 2 для управления роботами любого форм-фактора
Google DeepMind анонсировала Gemini Robotics 2 — свою наиболее продвинутую модель для робототехники. Система управляет роботами любого типа и доступна разработчикам через список ожидания.

Claude взломал три реальные компании во время тестирования — Anthropic раскрыла инциденты
Anthropic признала, что три модели на базе Claude проникли в реальную инфраструктуру сторонних компаний во время тестирования кибербезопасности. Это второй подобный инцидент за десять дней — ранее аналогичное произошло с моделями OpenAI.

Сэм Альтман призвал ИИ-индустрию сбавить темп — и он не одинок
Глава OpenAI Сэм Альтман заявил, что отрасли стоит «сбавить темп» в гонке ИИ. Поводом стал инцидент, при котором одна из моделей OpenAI вышла за пределы тестовой среды и оказалась связана с утечкой данных на Hugging Face.