De fleste platforme til stemme-AI bygger på en 3-trins-pipeline: én transskriptionsmodel, én LLM uden ræsonnering og én tekst-til-tale-motor. Hvert trin kan få hele kæden til at fejle. ThunderPhone reducerer antallet af fejl ved at orkestrere mange modeller på én gang.
ThunderPhone orkestrerer mange modeller på én gang, så de kan rette hinandens fejl.
En hurtig LLM ser kun transskriptionen.
“Hi, Brent — how can I help?”
Hurtige + ræsonnerende LLM'er krydstjekker: 2 ud af 3 spor er enige.
“Got it — so you rent.”
BBA tester, om en model kan forstå mundtlige prompts og besvare svære spørgsmål korrekt. Vores stærkeste Storm-konfiguration har rekorden: 99,4 % på vores offentligt tilgængelige evalueringssæt.
0.6% fejlrate
ThunderPhones resultat stammer fra vores offentlige evalueringsdatasæt, som er linket ovenfor. Andre offentlige resultater fra Artificial Analysis-ranglisten er medtaget som pejlemærke.
Andre platforme til stemme-AI som Vapi, Retell, Pipecat og LiveKit kræver, at du træffer en lang række beslutninger om opsætningen for at få dine opkald op at køre. Hos ThunderPhone ser vi det som vores opgave at finjustere systemet, så du skal gøre så lidt som muligt for at få dine opkald til at forløbe problemfrit.
ThunderPhone finjusterer det hele for dig
Spark, Bolt eller Storm.
Nøje udvalgt og testet i rigtige opkald.
Adfærd, retningslinjer og værktøjer – skrevet i almindeligt sprog.
Tre valg. Det er hele opsætningen – orkestrering, fallbacks og finjustering er indbygget fra start.
Vi udvælger de bedste modeller til opgaven og får dem til at spille sammen. De mest avancerede modeller fra OpenAI, Anthropic og Google arbejder side om side med open source-modeller – orkestreret, så du får den bedste ydeevne og pris i hvert eneste opkald uden selv at skulle bekymre dig om det.
Flowværktøjer findes, fordi svagere systemer ikke kan følge komplekse prompts. Hvert trin i samtalen bliver til en node, som du skal bygge og vedligeholde manuelt. Storm følger detaljerede instruktioner fra én enkelt prompt, så du slipper for at bekymre dig om noder og forbindelser.
Seks noder til ét tilmeldingsflow – hver med egne prompts, værktøjer, overgange og fejlhåndtering.
Hils på den, der ringer, og indhent vedkommendes navn og telefonnummer. Bekræft samtykket før tilmelding – det er et krav. Hvis personen spørger til betaling, skal du følge betalingspolitikken nedenfor. Kald kun enroll() én gang, og først når alle felter er bekræftet. Hvis personen beder om at tale med et menneske, skal du stille om til et menneske.
Du skal kun skrive, teste og finjustere én prompt – forgreningerne er inkluderet.
Utydelig tale, snak i baggrunden, navne og tal, flere sprog i samme samtale – ThunderPhone er bygget til de situationer, hvor andre systemer bryder sammen.
Sammenhold lyd- og tekstsignaler frem for at stole på en enkelt transskription.
Modeller til støjregistrering og -reduktion renser signalet.
Opfang samtaler i baggrunden, før de får stemmeagenten på afveje.
Dobbelttjek egennavne, stavemåder, tal og rettelser.
Led samtalen gennem flersprogede lyd- og stemmeforløb efter behov.
Brug stærkere ræsonneringsforløb, når adfærden ikke kan koges ned til én regel.
Stemme-AI skal svare hurtigt – men hastighed uden præcision giver bare hurtige fejl. Nutidens LLM'er har brug for et øjeblik til at tænke for at levere pålidelige svar, så ThunderPhone balancerer svartid og præcision.
Andre udbydere hævder at have en svartid på 500 ms under ideelle forhold, men ender typisk på omkring 2 sekunder i et rigtigt opkald. Vi måler vores svartid under virkelige forhold.
AI-udbyderes svartider kan pludselig stige og få opkald til at gå af sporet. ThunderPhones orkestrerede teknologistak skifter automatisk til hurtigere alternativer, når det sker.
Automatiserede telefonopkald har været frustrerende … indtil nu. Hver ny teknologigeneration har gjort oplevelsen bedre, men aldrig helt gnidningsfri. Det ændrer ThunderPhone på.
“Tryk 1 for salg, tryk 2 for support.” Menuer kan kun sende opkaldet videre.
Sig “salg” eller “fakturering”, og kryds fingre for, at slot-parseren fanger det.
Transskriber, spørg én hurtig LLM, og generér så tale – hvert trin stoler på det forrige.
Lyd, tekst, ræsonnering, værktøjer, stemmer og sikkerhedsmekanismer samlet i ét system.
I drift på ti minutter. Fra 2 cent pr. minut.