ThunderPhone 2.0 уже доступен.Самостоятельное подключение — от 2 центов/мин.Читать анонс
Поколения голосового ИИ

Большинство автоматических звонков никуда не годится. Новая технология меняет ситуацию.

Проблема была не в том, насколько приятно звучал голос. Старым системам автоматизации звонков не хватало понимания, чтобы поддерживать живой разговор.

Голосовые меню·Эпоха IVR

Звонящему приходилось говорить на языке машины.

Автоматизация сводилась к меню, веткам кнопочного набора и очередям. Она работала, если звонящий уже знал, какой путь выбрать.

Неловкий момент

Интент сводится к нажатию одной кнопки, поэтому всё, чего нет в меню, заканчивается переводом звонка или повторным объяснением.

Пример звонкаЭпоха IVR
Мне нужно перенести завтрашнюю запись.
По вопросам оплаты нажмите 1. По вопросам записи нажмите 2. По всем остальным вопросам нажмите 9.

Результат · Звонящий выбирает наугад, ждёт и снова объясняет одно и то же.

Как думает система · Всего этапов: 3
Голосовое менюисправленоDTMF-ветканестабильноОчередьне работает
Кастомные модели·Первые системы с ИИ

Системы справлялись только с узкими сценариями — и рассыпались за их пределами.

Команды обучали акустические модели, классификаторы интентов и экстракторы слотов под конкретные сценарии звонков. Это работало, но дорабатывать такие системы было дорого.

Неловкий момент

Система распознаёт один из заложенных интентов, но второй запрос упускает или задаёт жёстко заданный уточняющий вопрос.

Пример звонкаПервые системы с ИИ
Можно перенести завтрашнюю запись и добавить к ней моего супруга?
Я могу помочь перенести запись. На какую дату вы хотите её перенести?

Результат · Система упускает информацию о супруге, потому что её нет в обученном сценарии.

Как думает система · Всего этапов: 3
Кастомное распознавание речиисправленоМодель интентовнестабильноЗаполнение слотовне работает
Стеки по модели Vapi / Retell / ElevenLabs·Пайплайны из 3 этапов

Стек стал гибче, но каждый этап безоговорочно полагался на результат предыдущего.

В современных системах часто используют схему, где распознавание речи, LLM и синтез речи замкнуты в единый цикл звонка.

Неловкий момент

Когда в расшифровке ошибка или звонящий перебивает, LLM уверенно отвечает совсем не на то.

Пример звонкаПайплайны из 3 этапов
Нет, я арендую.
Здравствуйте, Ренат — чем могу помочь?

Результат · Одна ошибка распознавания — и система уже произносит неверный ответ.

Как думает система · Всего этапов: 3
Распознавание речине работаетLLMнестабильноСинтез речине работает
Единая архитектура голосового ИИ·ThunderPhone

Система слышит, рассуждает и сама исправляет ошибки за один цикл.

ThunderPhone объединяет анализ аудио, маршрутизацию моделей, управление ходом диалога и генерацию ответов в единую архитектуру.

Что меняется

Несколько каналов распознавания и анализ исходного аудио снижают риск того, что ошибка на одном этапе дойдёт до звонящего.

Пример звонкаThunderPhone
Нет, я арендую.
Понял. Вы арендуете жильё, поэтому вопросы о собственности я пропущу.

Результат · Разговор продолжается, и звонящему не приходится подстраиваться под систему.

Как думает система · Всего этапов: 4
АудиопотокпровереноМногоканальное распознаваниепровереноМаршрутизация моделейпровереноЕстественный ответпроверено

Прорыв не в том, что робот заговорил приятнее, а в архитектуре, которая удерживает разговор в нужном русле.

Точнее распознавание

Система сопоставляет разные сигналы и анализирует аудио, а не полагается на одну расшифровку.

Естественнее ритм разговора

Система понимает, когда говорить и как реагировать на перебивания: это часть самого диалогового цикла.

Гибче маршрутизация

Для каждой реплики система выбирает быстрый маршрут или более глубокий анализ — в зависимости от задачи.

Удобнее для звонящих

Звонящие тратят меньше времени на исправление ошибок автоматизации и больше — на решение своей задачи.

Что это даёт

Рассмотрите интегрированную архитектуру в деталях.