La plupart des appels téléphoniques automatisés sont une catastrophe. Une nouvelle technologie change la donne.
Le problème de l’automatisation téléphonique d’hier n’était pas l’absence d’une voix agréable, mais un niveau de compréhension insuffisant pour qu’une vraie conversation puisse suivre son cours.
Automatiser un appel devient plus simple.
À chaque génération, la machine prend en charge une plus grande part du contexte.
L’appelant devait parler comme une machine.
02Les débuts de l’IALes systèmes comprenaient des scénarios très ciblés, puis déraillaient.
03Pipelines en 3 étapesLa stack est devenue flexible, mais chaque étape se fiait à la précédente.
04ThunderPhoneLe système peut écouter, raisonner et se corriger au sein d’une même boucle.
L’appelant devait parler comme une machine.
Automatiser, c’était proposer des menus, des choix au clavier et des files d’attente. Cela fonctionnait tant que l’appelant connaissait déjà le bon parcours.
L’intention se résume à une touche. Tout ce qui sort du menu se traduit donc par un transfert ou oblige l’appelant à se répéter.
Résultat · L’appelant tente sa chance, attend, puis doit tout réexpliquer.
Les systèmes comprenaient des scénarios très ciblés, puis déraillaient.
Les équipes entraînaient des modèles acoustiques, des classifieurs d’intentions et des extracteurs de slots pour des parcours d’appel précis. Une approche utile, mais coûteuse à faire évoluer.
Le système peut reconnaître une intention apprise, puis passer à côté de la seconde demande ou poser une question de suivi rigide.
Résultat · La demande concernant le conjoint se perd : le parcours n’a pas été entraîné à la traiter.
La stack est devenue flexible, mais chaque étape se fiait à la précédente.
Une architecture moderne courante enchaîne la transcription vocale, un LLM et la synthèse vocale dans une même boucle d’appel.
Dès que la transcription est erronée ou que l’appelant interrompt le système, le LLM répond avec assurance, mais à côté.
Résultat · Une seule erreur d’écoute se transforme en réponse erronée à voix haute.
Le système peut écouter, raisonner et se corriger au sein d’une même boucle.
ThunderPhone orchestre la compréhension audio, le routage des modèles, la gestion des tours de parole et la génération des réponses au sein d’une architecture unique.
Le croisement de plusieurs voies d’écoute et un raisonnement fondé sur l’audio réduisent les défaillances ponctuelles avant qu’elles n’atteignent l’appelant.
Résultat · L’appel progresse sans que l’appelant ait à batailler avec le système.
L’avancée décisive, ce n’est pas une voix de robot plus agréable. C’est une architecture qui garde l’appel sur la bonne voie.
Une meilleure écoute
Le système peut croiser les signaux et raisonner directement à partir de l’audio, plutôt que de se fier à une seule transcription.
Des échanges mieux rythmés
La gestion des tours de parole et des interruptions fait partie intégrante de la boucle conversationnelle.
Un meilleur routage
À chaque tour de parole, le système peut choisir un traitement rapide ou un raisonnement plus approfondi, selon les besoins.
Une meilleure expérience
Les appelants passent moins de temps à corriger l’automatisation et davantage à aller au bout de leur démarche.