La plupart des plateformes d’IA vocale reposent sur un pipeline en 3 étapes : un modèle de transcription, un LLM sans capacité de raisonnement et un moteur de synthèse vocale. Chaque étape constitue un point de défaillance unique. ThunderPhone réduit les erreurs en orchestrant simultanément de nombreux modèles.
ThunderPhone orchestre simultanément de nombreux modèles et leur permet de corriger mutuellement leurs erreurs.
Un LLM rapide n’a accès qu’à la transcription.
« Bonjour, Julot ! Comment puis-je vous aider ? »
Les LLM rapides et les LLM de raisonnement croisent leurs analyses : 2 voies sur 3 concordent.
« D’accord, vous êtes donc locataire. »
BBA mesure la capacité d’un modèle à comprendre des prompts vocaux et à répondre correctement à des questions difficiles. Notre configuration Storm la plus performante détient le record : 99,4 % sur notre jeu d’évaluation public.
0.6% taux d’erreur
Le résultat de ThunderPhone provient de notre jeu de données public d’évaluation, accessible ci-dessus ; les autres scores publics (classement Artificial Analysis) sont indiqués à titre de comparaison.
Les autres plateformes d’IA vocale, comme Vapi, Retell, Pipecat et LiveKit, vous imposent une multitude de choix de configuration pour faire fonctionner vos appels. Chez ThunderPhone, nous considérons que c’est à nous d’affiner les réglages — et que vous devriez en faire le moins possible pour obtenir des appels fluides.
ThunderPhone règle tout cela pour vous
Spark, Bolt ou Storm.
Soigneusement sélectionnées et testées sur de vrais appels.
Comportement, règles, outils — en langage naturel.
Trois décisions, et c’est tout. L’orchestration, les solutions de secours et les réglages sont intégrés d’office.
Nous sélectionnons les meilleurs modèles pour chaque tâche et les combinons. Les modèles de pointe d’OpenAI, d’Anthropic et de Google travaillent aux côtés de modèles open source — le tout orchestré pour offrir les meilleures performances au meilleur prix à chaque appel, sans que vous ayez à vous en soucier.
Les éditeurs de flux existent parce que les systèmes moins performants ne savent pas suivre des prompts complexes. Chaque étape de la conversation devient alors un nœud à créer et à maintenir manuellement. Storm sait suivre des instructions détaillées à partir d’un seul prompt : vous n’avez donc plus à vous soucier des nœuds ni de leurs connexions.
Six nœuds pour un seul parcours d’inscription — chacun avec ses propres prompts, outils et transitions, et son propre mécanisme de gestion des erreurs.
Accueillez l’appelant et recueillez son nom et son numéro de téléphone. Obtenez son consentement avant de l’inscrire — c’est obligatoire. S’il pose une question sur la facturation, suivez la politique de facturation ci-dessous. N’appelez enroll() qu’une fois tous les champs confirmés. Si l’appelant demande à parler à quelqu’un, transférez l’appel à un humain.
Un seul prompt à rédiger, tester et affiner — embranchements inclus.
Paroles marmonnées, brouhaha ambiant, noms et numéros, mélange de langues : ThunderPhone est conçu pour gérer les situations qui mettent les autres systèmes en échec.
Croiser les signaux audio et textuels au lieu de se fier à une seule transcription.
Des modèles de détection et de réduction du bruit nettoient le signal.
Repérer les conversations parallèles avant qu’elles ne fassent perdre le fil à l’agent vocal.
Recouper les noms propres, les épellations, les chiffres et les corrections.
Assurer le routage via des parcours audio et vocaux multilingues lorsque nécessaire.
Mobiliser des raisonnements plus robustes lorsque le comportement attendu ne peut se résumer à une seule règle.
Une IA vocale doit répondre vite — mais sans justesse, elle ne fait que se tromper plus vite. Les LLM actuels ont besoin d’un instant de réflexion pour rester fiables. ThunderPhone trouve donc le juste équilibre entre latence et précision.
D’autres fournisseurs annoncent une latence de 500 ms dans des conditions idéales, mais atteignent généralement environ 2 s lors d’un appel réel. Nous mesurons notre latence en conditions réelles.
Les fournisseurs d’IA subissent des pics de latence qui peuvent compromettre les appels. Lorsque cela se produit, la stack orchestrée de ThunderPhone bascule vers des options plus rapides.
Les appels téléphoniques automatisés ont longtemps été synonymes de frustration… jusqu’à aujourd’hui. Chaque nouvelle vague technologique a amélioré l’expérience, sans jamais la rendre réellement fluide. ThunderPhone change la donne.
« Appuyez sur 1 pour le service commercial, sur 2 pour l’assistance. » Ces menus se contentent d’assurer le routage.
Dites « service commercial » ou « facturation » et espérez que le parseur de slots comprenne.
Transcrire, interroger un seul LLM rapide, puis restituer la réponse à l’oral — chaque étape dépend de la précédente.
L’audio, le texte, le raisonnement, les outils, les voix et les garde-fous réunis dans un seul système.
Opérationnel en dix minutes. À partir de 2 ¢/min.