Tecnología

Ve más allá
del flujo de 3 pasos.

La mayoría de las plataformas de IA de voz funcionan con un flujo de 3 pasos: un solo modelo de transcripción, un solo LLM sin capacidad de razonamiento y un solo motor de texto a voz. Cada paso es un punto único de falla. ThunderPhone reduce los errores al orquestar varios modelos a la vez.

Quien llamó dijo «Rento».
ASR A“Rento”
ASR B“Soy Renzo”
LLM de audio“Rento”
Resultado consolidado: «Rento»2 de 3 rutas coinciden

Lo escucha de varias maneras
y luego concilia las interpretaciones.

ThunderPhone orquesta múltiples modelos a la vez para que unos corrijan los errores de otros.

Quien llama dice “Eu... Rento.” — entre dientes
Otras plataformasFlujo de 3 pasos
Escucha una vez
STT “Soy Renzo”
Si el único modelo oye mal, no hay plan B
Responde rápido

Un LLM rápido solo tiene acceso a la transcripción.

Responde

“Hola, Renzo — ¿cómo puedo ayudarle?”

1 transcripción + 1 LLM = respuesta incorrecta
ThunderPhoneOrquestado
Escucha de tres formas
“Rento”“Soy Renzo”“Rento”
Se conservan tres transcripciones y el audio sin procesar como evidencia
Concilia

Los LLM rápidos y los LLM de razonamiento contrastan sus resultados: 2 de 3 rutas coinciden.

Responde

“Entendido: entonces usted renta.”

Acierta con los datos difíciles a la primera.

Storm bate récords de inteligencia en Big Bench Audio.

BBA evalúa si un modelo puede comprender prompts hablados y responder correctamente preguntas difíciles. Nuestra configuración más potente de Storm ostenta el récord: 99.4% en nuestro conjunto de evaluación público.

0.6% tasa de errores

· Julio de 2026Conjunto de datos en Hugging Face
ThunderPhoneStorm · Extra Intelligence0.6%
Qwen Audio 3.0Realtime Plus0.8%
Qwen3.5 OmniPlus Realtime1.3%
Step-Audio R1.1Realtime2.4%

El resultado de ThunderPhone proviene de nuestro conjunto público de datos de evaluación, enlazado arriba; las demás puntuaciones públicas (clasificación de Artificial Analysis) se incluyen como referencia.

No deberías tener que armar una plataforma de voz a mano.

Otras plataformas de IA de voz, como Vapi, Retell, Pipecat y LiveKit, te obligan a tomar muchas decisiones de configuración para poner tus llamadas en marcha. En ThunderPhone creemos que la puesta a punto es responsabilidad nuestra y que hacer que tus llamadas funcionen sin problemas debería exigirte el mínimo esfuerzo posible.

Otras plataformas de IA de vozMuchos parámetros que ajustar
STTv4-largeSTT de respaldoLLMtemp 0.3LLM de respaldoTTSTTS de respaldoVAD0.62Detección de fin de habla240 msUmbral de interrupción−38 dBFiltro de respuestas de escuchaInterrupcionesLímite de espera por turno800 msReducción de ruidoBúfer de jitter60 msFrecuencia de muestreo8 kHzEsquema de herramientasPolítica de reintentos×3Mecanismos de respaldo

ThunderPhone ajusta todo esto por ti

ThunderPhoneTres decisiones
1
Elige un plan

Spark, Bolt o Storm.

2
Elige una voz

Seleccionada cuidadosamente y probada en llamadas reales.

3
Escribe tu prompt

Comportamiento, políticas y herramientas, en lenguaje claro.

Tres decisiones. Así de simple es la configuración: la orquestación, los respaldos y los ajustes ya vienen integrados.

Elegimos los mejores modelos para cada tarea y hacemos que trabajen en conjunto. Los modelos de última generación de OpenAI, Anthropic y Google trabajan junto a modelos de código abierto, con una orquestación diseñada para ofrecer el mejor rendimiento al mejor precio en cada llamada, para que no tengas que preocuparte por nada.

Un solo prompt.
No un grafo de nodos.

Los editores de flujos existen porque los sistemas más limitados no pueden seguir prompts complejos. Cada paso de la conversación se convierte en un nodo que tienes que crear y mantener manualmente. Storm sigue instrucciones detalladas a partir de un solo prompt, para que no tengas que preocuparte por nodos ni conexiones.

Plataformas con constructor de flujosConfigura cada rama a mano
Saludo prompt · voz
Recopilar número de teléfono prompt · validación
Confirmar número de teléfono repetir prompt ×2
enroll() herramienta · reintentos
Escalar a un agente humano
Respaldo para cualquier caso inválido ×2 · error

Seis nodos para un solo flujo de inscripción, cada uno con sus propios prompts, herramientas, transiciones y gestión de errores.

ThunderPhone StormDescribe el comportamiento una sola vez
Prompt de comportamiento

Saluda a quien llama y recopila su nombre y su número de teléfono. Antes de completar el registro, confirma su consentimiento: es obligatorio. Si pregunta por la facturación, sigue la política de facturación que aparece abajo. Ejecuta enroll() solo cuando hayas confirmado todos los campos. Si pide hablar con una persona, transfiere la llamada a un agente humano.

Ramificación complejaMonitores opcionalesIteraciones más sencillas

Un solo prompt para redactar, probar y perfeccionar, con las ramificaciones incluidas.

Las llamadas en producción son impredecibles. ThunderPhone está preparado.

Personas que hablan entre dientes, conversaciones de fondo, nombres y números, varios idiomas en una misma llamada: ThunderPhone está diseñado para las situaciones que hacen fallar a otros sistemas.

Habla poco clara

Contrasta las señales de audio y texto en lugar de confiar en una sola transcripción.

Audio telefónico de mala calidad

Los modelos de detección y reducción de ruido limpian la señal.

Conversaciones de fondo

Detecta conversaciones paralelas antes de que confundan al agente.

Nombres y direcciones

Contrasta nombres propios, ortografía, números y correcciones.

Conversaciones en varios idiomas

Enruta el audio por flujos de voz multilingües cuando sea necesario.

Prompts largos

Recurre a procesos de razonamiento más robustos cuando el comportamiento no puede reducirse a una sola regla.

Responder mal más rápido no mejora la llamada.

La IA de voz debe responder rápido, pero la velocidad sin precisión solo acelera los errores. Los LLM actuales necesitan un momento para pensar y seguir ofreciendo respuestas confiables; por eso ThunderPhone equilibra la latencia y la precisión.

Spark~3shasta la primera respuesta
Bolt~2shasta la primera respuesta
Storm~2–3s~2 s con confirmaciones · ~3 s sin confirmaciones
Medición

Otros proveedores afirman ofrecer una latencia de 500 ms en condiciones ideales, pero suelen registrar alrededor de 2 s en una llamada real. Medimos nuestra latencia en condiciones reales.

Resiliencia

Los proveedores de IA sufren picos de latencia que pueden arruinar una llamada. La plataforma orquestada de ThunderPhone activa alternativas más rápidas cuando esto ocurre.

La próxima generación de IA de voz ya está aquí.

Las llamadas automatizadas siempre han sido frustrantes… hasta ahora. Con cada ola tecnológica, la experiencia ha mejorado, pero nunca ha llegado a ser realmente fluida. Con ThunderPhone, eso cambia.

1990sGeneración 1

IVR

«Presione uno para ventas; presione dos para soporte». Los menús solo sirven para redirigir llamadas.

2010sGeneración 2

Bots de intención

Di «ventas» o «facturación» y espera que el analizador de slots lo capte.

2024Generación 3

IA en tres pasos

Transcribe, consulta a un LLM rápido y luego habla: cada paso da por bueno el resultado anterior.

2026 · ahoraGeneración 4

IA integrada

Audio, texto, razonamiento, herramientas, voces y medidas de seguridad en un solo sistema.

Creado para las llamadas que hacen fallar todo lo demás

Prueba nuestra plataforma integral con tus llamadas más difíciles.

En marcha en diez minutos. Desde 2¢/min.