Tehnologie

Treceți dincolo de
arhitectura în 3 etape.

Majoritatea platformelor de IA vocală se bazează pe o arhitectură în 3 etape: un singur model de transcriere, un singur LLM fără raționament și un singur motor de sinteză vocală. O eroare în oricare dintre etape poate compromite întregul apel. ThunderPhone reduce erorile orchestrând simultan mai multe modele.

Apelantul a spus „Sunt chiriaș.”
ASR A„Sunt chiriaș”
ASR B„Sunt Chiriac”
LLM audio„Sunt chiriaș”
Rezultat confirmat: „Sunt chiriaș”2 din 3 căi ajung la același rezultat

Interpretăm aceeași replică în mai multe feluri,
apoi punem rezultatele cap la cap.

ThunderPhone coordonează simultan mai multe modele, astfel încât fiecare să poată corecta greșelile celorlalte.

Apelantul mormăie: „Sunt chiriaș.”
Alte platformeFlux în 3 pași
Ascultă o singură dată
STT „Sunt Chiriac”
Nu există o variantă de rezervă dacă singurul model aude greșit
Răspunde rapid

Un LLM rapid vede doar transcrierea.

Vorbește

„Bună ziua, Chiriac — cu ce vă pot ajuta?”

1 transcriere + 1 LLM = un răspuns greșit
ThunderPhoneOrchestrat
Ascultă în trei moduri
„Sunt chiriaș”„Sunt Chiriac”„Sunt chiriaș”
Se păstrează ca dovezi trei transcrieri și semnalul audio brut
Conciliază

LLM-urile rapide și cele de raționament își verifică reciproc rezultatele: 2 din 3 căi ajung la aceeași concluzie.

Vorbește

„Am înțeles — deci sunteți chiriaș.”

Identifică exact din prima chiar și detaliile dificile.

Storm stabilește recorduri de inteligență în benchmarkul Big Bench Audio.

BBA testează dacă un model poate înțelege prompturi rostite și poate răspunde corect la întrebări dificile. Cea mai puternică dintre configurațiile noastre Storm deține recordul: 99,4% pe setul nostru public de evaluare.

0.6% rata erorilor

· Iulie 2026Setul de date pe Hugging Face
ThunderPhoneStorm · Extra Intelligence0.6%
Qwen Audio 3.0Realtime Plus0.8%
Qwen3.5 OmniPlus Realtime1.3%
Step-Audio R1.1Realtime2.4%

Rezultatul ThunderPhone provine din setul nostru public de date de evaluare, disponibil la linkul de mai sus; celelalte scoruri publice (din clasamentul Artificial Analysis) sunt prezentate cu titlu orientativ.

Nu ar trebui să fie nevoie să construiți manual un stack tehnologic pentru agenți vocali.

Alte platforme de IA vocală, precum Vapi, Retell, Pipecat și LiveKit, vă obligă să luați numeroase decizii de configurare pentru ca apelurile dumneavoastră să funcționeze. La ThunderPhone, credem că optimizarea este responsabilitatea noastră și că dumneavoastră ar trebui să aveți cât mai puțin de lucru pentru ca apelurile să decurgă fără probleme.

Alte platforme AI pentru voceMulte setări de optimizat
STTv4-largeVariantă de rezervă STTLLMtemp 0.3LLM de rezervăTTSVariantă de rezervă TTSVAD0.62Detectarea finalului de replică240 msPrag de întrerupere−38 dBFiltru pentru confirmări verbaleÎntreruperiTimp-limită pentru replică800 msReducerea zgomotuluiBuffer de jitter60 msRata de eșantionare8 kHzSchema instrumentelorPolitica de reîncercare×3Strategii de rezervă

ThunderPhone optimizează toate aceste setări pentru dumneavoastră

ThunderPhoneTrei decizii
1
Alegeți planul tarifar

Spark, Bolt sau Storm.

2
Alegeți o voce

Voci atent selectate și testate în apeluri reale.

3
Scrieți promptul

Comportament, politici și instrumente — în limbaj simplu.

Trei decizii. Atât presupune configurarea — orchestrarea, variantele de rezervă și optimizarea sunt incluse din start.

Alegem cele mai bune modele pentru fiecare sarcină și le conectăm într-un sistem unitar. Cele mai avansate modele de la OpenAI, Anthropic și Google lucrează alături de modele open-source — toate orchestrate pentru cea mai bună performanță și cel mai bun preț la fiecare apel, fără să vă mai preocupe detaliile tehnice.

Un singur prompt,
nu un graf de noduri.

Editoarele de fluxuri există pentru că sistemele mai puțin performante nu pot urma prompturi complexe. Fiecare etapă a conversației devine un nod pe care trebuie să îl creați și să îl întrețineți manual. Storm urmează instrucțiuni detaliate pe baza unui singur prompt, așa că nu mai trebuie să vă preocupați de noduri și muchii.

Platforme cu editor de fluxuriConfigurați manual fiecare ramură
Formulă de salut prompt · voce
Solicită numărul de telefon prompt · validare
Confirmă numărul de telefon prompt reluat ×2
enroll() instrument · reîncercări
Transfer la un agent uman
Fallback pentru orice situație invalid ×2 · eroare

Șase noduri pentru un singur flux de înscriere — fiecare cu propriile prompturi, instrumente, tranziții și mecanisme de gestionare a erorilor.

ThunderPhone StormDescrieți comportamentul o singură dată
Prompt de comportament

Salută apelantul și solicită-i numele și numărul de telefon. Confirmă consimțământul înainte de înscriere — este obligatoriu. Dacă întreabă despre facturare, respectă politica de facturare de mai jos. Apelează enroll() doar după confirmarea tuturor câmpurilor. Dacă apelantul cere să vorbească cu o persoană, transferă apelul către un agent uman.

Ramificații complexeMecanisme opționale de supraveghereAjustări mai simple

Un singur prompt pe care îl scrieți, îl testați și îl rafinați — cu toate ramificațiile incluse.

În producție, apelurile sunt imprevizibile. ThunderPhone este pregătit.

Vorbire neclară, conversații pe fundal, nume și numere, mai multe limbi în același apel — ThunderPhone este conceput pentru situațiile în care alte sisteme cedează.

Vorbire neclară

Corelează semnalele audio cu cele text, în loc să se bazeze pe o singură transcriere.

Calitate audio slabă în apeluri

Modelele de detectare și reducere a zgomotului curăță semnalul.

Conversații în fundal

Detectează discuțiile paralele înainte ca acestea să abată agentul de la conversație.

Nume și adrese

Verifică prin corelare numele proprii, grafia, numerele și corecturile.

Vorbire în mai multe limbi

Alege fluxurile audio și vocale multilingve atunci când este nevoie.

Prompturi lungi

Folosește raționamente mai robuste atunci când comportamentul nu poate fi redus la o singură regulă.

Un răspuns greșit dat mai repede nu înseamnă un apel mai bun.

Un agent vocal cu IA trebuie să răspundă rapid — dar viteza fără acuratețe înseamnă doar răspunsuri greșite, oferite mai repede. LLM-urile actuale au nevoie de un moment pentru a raționa și a oferi răspunsuri fiabile, așa că ThunderPhone echilibrează latența și acuratețea.

Spark~3spână la primul răspuns
Bolt~2spână la primul răspuns
Storm~2–3s~2 s cu confirmări · ~3 s fără
Măsurare

Alți furnizori susțin că oferă o latență de 500 ms în condiții ideale, dar, de obicei, ajung la aproximativ 2 s într-un apel real. Măsurăm latența în condiții reale de utilizare.

Reziliență

Furnizorii AI se confruntă cu vârfuri de latență care pot compromite apelurile. Arhitectura orchestrată ThunderPhone comută automat la opțiuni mai rapide când apar astfel de situații.

Următoarea generație de IA vocală este aici.

Apelurile automate au fost mult timp frustrante… până acum. Fiecare val tehnologic a îmbunătățit experiența, dar niciunul nu a reușit să o facă cu adevărat fluidă. Cu ThunderPhone, lucrurile se schimbă.

1990sGenerația 1

IVR

„Apăsați tasta 1 pentru vânzări, tasta 2 pentru asistență.” Meniurile nu pot decât să redirecționeze apelul.

2010sGenerația 2

Boți bazați pe intenții

Spuneți „vânzări” sau „facturare” și sperați că parserul de sloturi le recunoaște.

2024Generația 3

AI în trei pași

Transcriere, interogarea unui singur LLM rapid, apoi redare vocală — fiecare etapă se bazează pe rezultatul celei anterioare.

2026 · acumGenerația 4

AI integrat

Audio, text, raționament, instrumente, voci și mecanisme de protecție — toate într-un singur sistem.

Conceput pentru apelurile la care orice altă soluție eșuează

Puneți sistemul nostru integrat la încercare cu cele mai dificile apeluri pe care le gestionați.

Gata de utilizare în 10 minute. De la 2 ¢ pe minut.