ThunderPhone 2.0 är här.Kom igång själv, från 2 cent/minut.Läs lanseringsnyheten
Röst-AI genom generationerna

De flesta automatiserade telefonsamtal är usla. Ny teknik ändrar på det.

Problemet med äldre telefonautomation var inte avsaknaden av en behaglig röst. Det var att förståelsen inte räckte till för att hålla ett riktigt samtal igång.

Knappvalsmenyer·IVR-eran

Den som ringde tvingades prata på maskinens villkor.

Automatisering innebar menyer, knappval och köer. Det fungerade när den som ringde redan visste rätt väg genom systemet.

När det skaver

Den som ringer måste koka ned sin avsikt till ett enda knapptryck. Allt som inte finns i menyn leder därför till vidarekoppling eller till att allt måste tas om.

ExempelsamtalIVR-eran
Jag behöver flytta morgondagens bokade tid.
För fakturafrågor, tryck 1. För bokningar, tryck 2. För alla andra frågor, tryck 9.

Resultat · Den som ringer måste gissa, vänta och förklara samma sak igen.

Så tänker systemet · 3 steg
MenymeddelandeåtgärdadDTMF-förgreningskörbrister
Anpassade modeller·Tidig AI

Systemen förstod bara smala, förutbestämda flöden – sedan föll allt.

Team tränade akustiska modeller, avsiktsklassificerare och fältextraktorer för specifika samtalsflöden. Användbart, men dyrt att ändra.

När det skaver

Systemet kan identifiera en avsikt som det tränats för, men missar sedan den andra begäran eller ställer en stelbent följdfråga.

ExempelsamtalTidig AI
Kan du flytta morgondagens bokade tid och lägga till min partner?
Jag kan hjälpa dig att boka om tiden. Vilket datum vill du ha?

Resultat · Uppgiften om partnern går förlorad eftersom flödet inte har tränats för den.

Så tänker systemet · 3 steg
Anpassad ASRåtgärdadAvsiktsmodellskörFältifyllnadbrister
Stackar i stil med Vapi / Retell / ElevenLabs·Pipelines i 3 steg

Stacken blev flexibel, men varje steg litade blint på det föregående.

Ett vanligt modernt upplägg kopplar ihop tal till text, en LLM och text till tal i en enda samtalsloop.

När det skaver

När transkriberingen är fel eller den som ringer avbryter ger LLM:en tvärsäkert fel svar.

ExempelsamtalPipelines i 3 steg
Nej, jag hyr.
Hej, Jahir — hur kan jag hjälpa till?

Resultat · Ett enda hörfel blir ett fel i det talade svaret.

Så tänker systemet · 3 steg
Tal till textbristerLLMskörText till talbrister
Integrerad röst-AI·ThunderPhone

Systemet kan lyssna, resonera och rätta till fel i en och samma loop.

ThunderPhone samordnar ljudförståelse, modellrouting, turtagning och svarsgenerering i en sammanhållen arkitektur.

Vad som förändras

Flera lyssningsspår och resonemang som utgår från själva ljudet gör att färre fel i enskilda steg når den som ringer.

ExempelsamtalThunderPhone
Nej, jag hyr.
Jag förstår. Du hyr din bostad, så jag hoppar över frågorna om vem som äger den.

Resultat · Samtalet går framåt utan att den som ringer behöver kämpa mot systemet.

Så tänker systemet · 4 steg
LjudströmgodkändParallell lyssninggodkändModellroutinggodkändNaturligt svargodkänd

Genombrottet ligger inte i en behagligare robotröst, utan i en arkitektur som håller samtalet på rätt spår.

Bättre hörförmåga

Systemet kan jämföra signaler och resonera utifrån ljudet i stället för att förlita sig på en enda transkribering.

Bättre tajming

Turtagning och hantering av avbrott ingår i själva samtalsloopen.

Bättre dirigering

För varje replik kan systemet välja snabbspår eller djupare resonemang utifrån vad som behövs.

Bättre upplevelse

Den som ringer lägger mindre tid på att korrigera automatiken och mer på att slutföra sitt ärende.

Vad det innebär i praktiken

Se den integrerade arkitekturen på nära håll.