Presentamos ThunderPhone
Actualización, agosto de 2026: Este es nuestro anuncio de lanzamiento original de marzo de 2026, conservado para la posteridad. Algunos detalles — especialmente los precios y las opciones de voz — han cambiado desde entonces; consulta los precios actuales para conocer la información vigente hoy. Y la espera terminó: lee el anuncio de lanzamiento de v2.
Hoy nos enorgullece anunciar el lanzamiento público de ThunderPhone, que facilita la automatización de llamadas telefónicas con IA. Con una arquitectura integrada completamente distinta a la de otras plataformas de IA para llamadas, ThunderPhone logra un rendimiento mucho mayor, menor costo y menos problemas de integración. ThunderPhone admite llamadas entrantes y salientes en decenas de idiomas y cumple con HIPAA y GDPR.
La ventaja de la integración
Otras plataformas de IA para llamadas limitan el rendimiento de sus sistemas al imponer una estructura de 3 pasos:
- Un modelo de transcripción que convierte la voz del usuario en texto.
- Un LLM que procesa el texto del usuario y genera una respuesta.
- Un modelo de TTS que convierte el texto de la respuesta nuevamente en audio.
La mayoría también traslada el trabajo de ingeniería a sus usuarios al obligarlos a elegir qué modelos desean utilizar, así como opciones de configuración como parámetros de reducción de ruido y capacidad de respuesta.
Hemos adoptado un enfoque diferente: configuramos lo que, en nuestra opinión, es la mejor plataforma integral posible con los modelos actuales y la dejamos lista para usar sin un esfuerzo de configuración complejo. Nuestro sistema utiliza muchos modelos al mismo tiempo y enruta inteligentemente entre ellos según el desarrollo de la conversación. Esto incluye:
- Combinar varios modelos de transcripción, algunos más rápidos que otros y algunos más precisos que otros, para equilibrar velocidad y precisión y compensar los errores de unos con otros.
- Combinar LLM con entrada de audio, que pueden tener menor inteligencia general pero una mejor comprensión del audio, con LLM de solo texto, que pueden cometer errores por transcripciones imprecisas pero suelen ser más inteligentes.
- Combinar LLM rápidos pero poco inteligentes, que pueden generar respuestas rápidas, con LLM mucho más inteligentes pero más lentos, que pueden ejecutarse en segundo plano y asegurar que la IA siga su prompt y responda correctamente a lo que dice el usuario.
- Combinar modelos comerciales de proveedores líderes, incluidos OpenAI y Google, que ofrecen la mayor inteligencia disponible hoy, con una amplia variedad de modelos de código abierto, que a menudo ofrecen mayor velocidad a menor costo.
- Usar varios modelos simultáneamente para clasificar y eliminar ruido de fondo, conversaciones paralelas y otros ruidos distractores que, de otro modo, podrían desviar una conversación.
Estos componentes y más se orquestan de distintas maneras en nuestros tres niveles de servicio, Spark, Bolt y Storm: optimizamos Spark para el costo, Bolt para la velocidad y Storm para la inteligencia, mientras minimizamos al máximo las desventajas de cada uno. Los tres sistemas comparten beneficios como una comprensión increíblemente precisa de lo que dicen los usuarios, incluso con nombres propios y ortografía.
Consideramos que esta arquitectura estrechamente integrada ofrece a nuestro sistema un rendimiento mucho mayor a menor costo que el enfoque rígido de 3 pasos que ofrecen otros proveedores. De acuerdo con la teoría de la modularidad de Clay Christensen, la IA de voz aún está en sus primeras etapas, y sigue siendo más valioso maximizar el rendimiento con una arquitectura integrada que maximizar la capacidad de personalización con una arquitectura modular.
Decisiones optimizadas
Y en cuanto a la personalización, estamos en contra. La mayoría de las plataformas de IA telefónica actuales obligan a quienes las usan a navegar un sinfín de opciones, desde los modelos exactos que se utilizan hasta parámetros ultradetallados como la rapidez con la que la IA interrumpe a la persona.
En nuestra opinión, es NUESTRO trabajo optimizar estas decisiones entre bastidores para que quienes usan ThunderPhone puedan enfocarse en lo que hacen bien y no tengan que preocuparse por configuraciones detalladas de IA de voz. Nos vemos como una especie de Squarespace, facilitando que quienes nos usan configuren agentes telefónicos con el máximo rendimiento posible de los modelos actuales, sin mover un dedo.
Facilidad de uso
ThunderPhone también es increíblemente fácil de usar, tanto si estás configurando un nuevo agente telefónico como si estás migrando desde otra plataforma o desde una plataforma integral personalizada. Todo lo necesario para configurar un agente telefónico en ThunderPhone es:
- Decide si quieres usar Spark, Bolt o Storm.
- Elige una voz.
- Danos tu prompt. No necesitas agentes con múltiples prompts. Si tu prompt es demasiado complicado para Spark o Bolt, cambia a Storm, que puede manejar incluso casos de uso complejos con un solo prompt.
- Conecta integraciones de software (cualquier endpoint o integración nativa con n8n) con un asistente increíblemente fácil de usar.
- Conecta tu VoIP con un asistente increíblemente fácil de usar.
Todo esto suele tomar 10 minutos o menos.
ThunderPhone cumple con HIPAA y GDPR, y firmaremos y proporcionaremos BAA y DPA a solicitud.
Nuestra historia
Somos un equipo de exalumnos del Laboratorio de IA de Stanford y Y Combinator que trabaja en IA de voz desde 2024. Al principio, nos enfocamos en Flux Interpreting, que traduce llamadas telefónicas entre idiomas. Pero después de que los clientes nos pidieran repetidamente automatizar las llamadas de sus negocios en lugar de solo traducirlas, cambiamos nuestro enfoque a lo que hoy es ThunderPhone.
El problema de las plataformas existentes
Al inicio, comenzamos a crear agentes telefónicos para clientes en plataformas de IA telefónica de otras empresas. Probamos prácticamente todas las plataformas de IA telefónica del mercado, pero por desgracia encontramos deficiencias, especialmente en lo siguiente:
- Comprensión de audio: Las limitaciones de contar con un solo modelo de transcripción para convertir el audio del usuario en texto hacían que la IA a menudo “escuchara mal” al usuario, especialmente con nombres propios, palabras poco comunes y deletreos.
- Seguimiento de instrucciones: Tener un único LLM rápido realizando el verdadero “trabajo mental” detrás de la llamada hacía que las IA a menudo tuvieran dificultades para seguir las instrucciones correctamente y se desviaran del rumbo.
- Integraciones difíciles: Las plataformas que probamos hacían muy difícil conectarse con software externo, y por lo general nos obligaban a escribir extensas configuraciones JSON para llamadas a herramientas y pelear con ellas una y otra vez, con poca o ninguna retroalimentación hasta que de repente empezaban a funcionar.
- Precio: Las plataformas existentes por lo general cobraban una fortuna: normalmente 10 centavos por minuto o más por un rendimiento mediocre.
Crear nuestra propia plataforma
Cuando firmamos un acuerdo para implementar un caso de uso de llamadas de ventas para un cliente empresarial, nos vimos obligados a crear nuestra propia plataforma personalizada para satisfacer sus necesidades. Este caso de uso era exigente: a diferencia del soporte al cliente, donde quienes llaman están en gran medida a merced de la empresa, quienes llaman por ventas cuelgan rápidamente.
La calidad de la llamada debe ser excelente para cerrar la venta en vez de perder al prospecto. Esto implicaba manejar una gran cantidad de nombres propios y deletreos, incluidos nombres y direcciones, que son difíciles de transcribir correctamente para los modelos estándar. Para dominar este caso de uso, creamos lo que hoy es ThunderPhone.
En el camino, seguimos conociendo a personas de la comunidad de IA de voz de San Francisco que estaban creando empresas de agentes telefónicos verticales: para veterinarios, conductores de camiones y más. Sorprendentemente, la mayoría compartía la misma opinión: las plataformas existentes eran suficientemente buenas para demostraciones, pero no para producción.
Sorprendentemente, muchos, si no la mayoría, de nuestros amigos en empresas de IA de voz vertical en realidad estaban “creando sus propias” plataformas... Esto no tenía ningún sentido para nosotros: equivale a que las startups web de los años 90 tuvieran que alojar sus propios servidores web en un servidor dentro de su clóset.
Con esa perspectiva, nos dimos cuenta de que era momento de convertir nuestro sistema de IA telefónica en una plataforma que cualquiera pudiera usar.
Las empresas y consultores de IA de voz vertical deberían poder enfocarse en satisfacer las necesidades de su mercado objetivo con su experiencia específica de la industria, y no en diseñar minuciosamente la IA y la tecnología telefónica subyacentes. Eso es lo que lanzamos hoy con ThunderPhone.
Ha sido un largo camino para llegar hasta aquí. Disculpas a todas las personas que se han registrado con nosotros desde abril pasado y todavía esperan acceso: lo que pensamos que sería una rápida carrera final para terminar el trabajo resultó ser una odisea de varios meses para descubrir cómo combinar los modelos disponibles hoy en un sistema lo más robusto posible.
Pero por fin ya estamos disponibles: pruébalo y dinos qué te parece.
Aunque hemos resuelto los principales problemas, seguramente aún habrá errores en el sistema. Si encuentras algún problema, envía un correo a alex@thunderphone.com y me aseguraré de que se solucione lo antes posible. También avísame si tienes alguna solicitud de funcionalidad y haremos lo posible para implementarla cuanto antes.
Y si tienes necesidades más personalizadas, como soporte para implementaciones e integraciones a medida, cumplimiento normativo más allá de HIPAA y GDPR estándar, acuerdos de nivel de servicio y solicitudes de funcionalidades personalizadas, estaremos encantados de conversar sobre un acuerdo empresarial. Escríbenos a alex@thunderphone.com y hablaremos sobre tus necesidades y sobre si podemos ayudarte.
Y, en términos más generales, nuestro compromiso contigo es que es NUESTRO trabajo asegurarnos de que ThunderPhone funcione desde el primer momento con el mínimo esfuerzo de tu parte y gestione las llamadas de tu negocio tan perfectamente como sea posible con la IA actual, dentro de los límites del nivel de precio que elijas: Spark, Bolt o Storm. Pruébanos; nos entusiasma mostrarte lo que ThunderPhone puede hacer.
Cuéntanos qué te parece y gracias por tu apoyo.