La mayoría de las llamadas automatizadas son un desastre. La nueva tecnología cambia eso.
El problema nunca fue que la automatización telefónica no tuviera una voz agradable. Fue que no entendía lo suficiente para hacer avanzar una conversación real.
Cada vez es más fácil automatizar una llamada.
Con cada generación, el sistema asume una mayor parte del contexto.
Quien llamaba tenía que hablar como una máquina.
02Primeros años de la IALos sistemas entendían casos muy concretos, pero fuera de ellos fallaban.
03Flujos de 3 pasosLa plataforma se volvió flexible, pero cada paso confiaba en el anterior.
04ThunderPhoneEl sistema puede escuchar, razonar y recuperarse en un solo ciclo.
Quien llamaba tenía que hablar como una máquina.
Automatizar significaba usar menús, opciones de teclado y colas de espera. Funcionaba cuando quien llamaba ya sabía qué ruta seguir.
La intención se reduce a pulsar una tecla, así que cualquier solicitud fuera del menú termina en una transferencia o en tener que repetirlo todo.
Resultado · Quien llama prueba opciones, espera y termina explicando lo mismo otra vez.
Los sistemas entendían casos muy concretos, pero fuera de ellos fallaban.
Los equipos entrenaban modelos acústicos, clasificadores de intenciones y extractores de campos para flujos de llamadas específicos. Era útil, pero costoso de modificar.
El sistema puede detectar una intención para la que fue entrenado, pero luego omite la segunda solicitud o responde con una pregunta de seguimiento rígida.
Resultado · El dato del cónyuge se pierde porque no forma parte del flujo con el que se entrenó el sistema.
La plataforma se volvió flexible, pero cada paso confiaba en el anterior.
Un enfoque moderno muy común conecta voz a texto, un LLM y texto a voz en un único ciclo de llamada.
Cuando la transcripción es incorrecta o quien llama interrumpe, el LLM responde con total seguridad a una versión equivocada de la llamada.
Resultado · Un solo error de escucha se convierte en una respuesta equivocada que el sistema dice en voz alta.
El sistema puede escuchar, razonar y recuperarse en un solo ciclo.
ThunderPhone coordina la comprensión del audio, el enrutamiento de modelos, la gestión de turnos y la generación de respuestas en una única arquitectura.
Las múltiples rutas de escucha y el razonamiento basado en el audio reducen las fallas en un único paso antes de que afecten a quien llama.
Resultado · La llamada sigue adelante sin que quien llama tenga que lidiar con el sistema.
El gran avance no es una voz robótica más agradable. Es una arquitectura que mantiene la llamada bien encaminada.
Escucha más precisa
El sistema puede comparar señales y razonar a partir del audio en lugar de confiar en una sola transcripción.
Mejor manejo de los tiempos
La gestión de turnos e interrupciones forma parte del ciclo de la conversación.
Enrutamiento más inteligente
El sistema puede elegir entre rutas rápidas y un razonamiento más profundo según lo que requiera cada turno de la conversación.
Mejor experiencia
Quienes llaman dedican menos tiempo a corregir la automatización y más a completar la tarea.