La plupart des plateformes d’IA vocale reposent sur un pipeline en 3 étapes : un modèle de transcription, un LLM qui ne réfléchit pas, un moteur de synthèse vocale. Chaque étape constitue un point de défaillance unique. ThunderPhone réduit les erreurs en orchestrant plusieurs modèles à la fois.
ThunderPhone orchestre plusieurs modèles à la fois, afin qu'ils corrigent les erreurs les uns des autres.
BBA teste la capacité d'un modèle à comprendre des prompts oraux et à répondre correctement à des questions difficiles. Notre configuration Storm la plus performante atteint 99,4 % sur notre jeu d'évaluation public — 0,6 % d'erreurs, soit 4× moins que le meilleur score public suivant.
Le taux d'erreur correspond à 100 % moins le taux de réussite BBA. Le résultat de ThunderPhone provient de notre jeu de données d'évaluation public, lié ci-dessus ; les autres scores publics (classement Artificial Analysis) sont indiqués à titre de comparaison. BBA ne reflète pas entièrement les performances en appel téléphonique, mais reste un indicateur utile du raisonnement sur des prompts oraux.
D'autres plateformes d'IA vocale comme Vapi, Retell, Pipecat et LiveKit vous obligent à prendre de nombreuses décisions de configuration pour que vos appels fonctionnent. Chez ThunderPhone, nous pensons que les réglages sont notre travail et que vous devriez avoir à faire le moins de travail possible pour que vos appels se déroulent sans accroc.
Les créateurs de flux existent parce que les systèmes moins performants ne peuvent pas suivre des prompts complexes. Chaque étape de conversation devient un nœud que vous devez créer et maintenir manuellement. Storm suit des instructions riches à partir d'un seul prompt, vous n'avez donc pas à vous soucier des nœuds et des connexions.
Parole marmonnée, conversations en arrière-plan, noms et numéros, langues mélangées — ThunderPhone est conçu pour les situations qui mettent les autres systèmes en échec.
Comparez les signaux audio et textuels au lieu de vous fier à une seule transcription.
Des modèles d’identification et de réduction du bruit nettoient le signal.
Identifiez les conversations parallèles avant qu’elles ne fassent dérailler l’agent.
Vérifiez les noms propres, les orthographes, les numéros et les corrections.
Orientez via des parcours audio et vocaux multilingues lorsque nécessaire.
Utilisez des parcours de raisonnement plus puissants lorsque le comportement ne peut pas se résumer à une seule règle.
L’IA téléphonique doit répondre vite, mais la rapidité sans exactitude ne fait que produire rapidement des erreurs. Les LLM actuels ont besoin d’un moment pour réfléchir afin de rester fiables, alors ThunderPhone équilibre les deux selon le niveau.
Les appels téléphoniques automatisés ont longtemps été frustrants... jusqu'à présent. Chaque vague technologique a amélioré l'expérience, sans jamais la rendre vraiment fluide. ThunderPhone change cela.
Appuyez sur 1 pour les ventes, sur 2 pour l'assistance. Les menus ne font que du routage.
Dites « ventes » ou « facturation » et espérez que l'analyseur de slots le comprenne.
Transcrire, interroger un LLM rapide, puis parler — chaque étape faisant confiance à la précédente.
Audio, texte, raisonnement, outils, voix et garde-fous réunis dans un seul système.
En ligne en dix minutes. À partir de 2 centimes/min.