Majoritatea platformelor de IA vocală se bazează pe o arhitectură în 3 etape: un singur model de transcriere, un singur LLM fără raționament și un singur motor de sinteză vocală. O eroare în oricare dintre etape poate compromite întregul apel. ThunderPhone reduce erorile orchestrând simultan mai multe modele.
ThunderPhone coordonează simultan mai multe modele, astfel încât fiecare să poată corecta greșelile celorlalte.
Un LLM rapid vede doar transcrierea.
„Bună ziua, Chiriac — cu ce vă pot ajuta?”
LLM-urile rapide și cele de raționament își verifică reciproc rezultatele: 2 din 3 căi ajung la aceeași concluzie.
„Am înțeles — deci sunteți chiriaș.”
BBA testează dacă un model poate înțelege prompturi rostite și poate răspunde corect la întrebări dificile. Cea mai puternică dintre configurațiile noastre Storm deține recordul: 99,4% pe setul nostru public de evaluare.
0.6% rata erorilor
Rezultatul ThunderPhone provine din setul nostru public de date de evaluare, disponibil la linkul de mai sus; celelalte scoruri publice (din clasamentul Artificial Analysis) sunt prezentate cu titlu orientativ.
Alte platforme de IA vocală, precum Vapi, Retell, Pipecat și LiveKit, vă obligă să luați numeroase decizii de configurare pentru ca apelurile dumneavoastră să funcționeze. La ThunderPhone, credem că optimizarea este responsabilitatea noastră și că dumneavoastră ar trebui să aveți cât mai puțin de lucru pentru ca apelurile să decurgă fără probleme.
ThunderPhone optimizează toate aceste setări pentru dumneavoastră
Spark, Bolt sau Storm.
Voci atent selectate și testate în apeluri reale.
Comportament, politici și instrumente — în limbaj simplu.
Trei decizii. Atât presupune configurarea — orchestrarea, variantele de rezervă și optimizarea sunt incluse din start.
Alegem cele mai bune modele pentru fiecare sarcină și le conectăm într-un sistem unitar. Cele mai avansate modele de la OpenAI, Anthropic și Google lucrează alături de modele open-source — toate orchestrate pentru cea mai bună performanță și cel mai bun preț la fiecare apel, fără să vă mai preocupe detaliile tehnice.
Editoarele de fluxuri există pentru că sistemele mai puțin performante nu pot urma prompturi complexe. Fiecare etapă a conversației devine un nod pe care trebuie să îl creați și să îl întrețineți manual. Storm urmează instrucțiuni detaliate pe baza unui singur prompt, așa că nu mai trebuie să vă preocupați de noduri și muchii.
Șase noduri pentru un singur flux de înscriere — fiecare cu propriile prompturi, instrumente, tranziții și mecanisme de gestionare a erorilor.
Salută apelantul și solicită-i numele și numărul de telefon. Confirmă consimțământul înainte de înscriere — este obligatoriu. Dacă întreabă despre facturare, respectă politica de facturare de mai jos. Apelează enroll() doar după confirmarea tuturor câmpurilor. Dacă apelantul cere să vorbească cu o persoană, transferă apelul către un agent uman.
Un singur prompt pe care îl scrieți, îl testați și îl rafinați — cu toate ramificațiile incluse.
Vorbire neclară, conversații pe fundal, nume și numere, mai multe limbi în același apel — ThunderPhone este conceput pentru situațiile în care alte sisteme cedează.
Corelează semnalele audio cu cele text, în loc să se bazeze pe o singură transcriere.
Modelele de detectare și reducere a zgomotului curăță semnalul.
Detectează discuțiile paralele înainte ca acestea să abată agentul de la conversație.
Verifică prin corelare numele proprii, grafia, numerele și corecturile.
Alege fluxurile audio și vocale multilingve atunci când este nevoie.
Folosește raționamente mai robuste atunci când comportamentul nu poate fi redus la o singură regulă.
Un agent vocal cu IA trebuie să răspundă rapid — dar viteza fără acuratețe înseamnă doar răspunsuri greșite, oferite mai repede. LLM-urile actuale au nevoie de un moment pentru a raționa și a oferi răspunsuri fiabile, așa că ThunderPhone echilibrează latența și acuratețea.
Alți furnizori susțin că oferă o latență de 500 ms în condiții ideale, dar, de obicei, ajung la aproximativ 2 s într-un apel real. Măsurăm latența în condiții reale de utilizare.
Furnizorii AI se confruntă cu vârfuri de latență care pot compromite apelurile. Arhitectura orchestrată ThunderPhone comută automat la opțiuni mai rapide când apar astfel de situații.
Apelurile automate au fost mult timp frustrante… până acum. Fiecare val tehnologic a îmbunătățit experiența, dar niciunul nu a reușit să o facă cu adevărat fluidă. Cu ThunderPhone, lucrurile se schimbă.
„Apăsați tasta 1 pentru vânzări, tasta 2 pentru asistență.” Meniurile nu pot decât să redirecționeze apelul.
Spuneți „vânzări” sau „facturare” și sperați că parserul de sloturi le recunoaște.
Transcriere, interogarea unui singur LLM rapid, apoi redare vocală — fiecare etapă se bazează pe rezultatul celei anterioare.
Audio, text, raționament, instrumente, voci și mecanisme de protecție — toate într-un singur sistem.
Gata de utilizare în 10 minute. De la 2 ¢ pe minut.