Die meisten Sprach-KI-Plattformen setzen auf eine 3-stufige Pipeline: ein Transkriptionsmodell, ein LLM ohne Reasoning und eine Text-to-Speech-Engine. Jeder Schritt ist ein Single Point of Failure. ThunderPhone reduziert Fehler, indem es viele Modelle gleichzeitig orchestriert.
ThunderPhone orchestriert zahlreiche Modelle parallel und lässt sie die Fehler der jeweils anderen korrigieren.
Ein schnelles LLM sieht nur das Transkript.
„Hallo, Mieke — wie kann ich helfen?“
Schnelle LLMs und Reasoning-LLMs gleichen ihre Ergebnisse ab: 2 von 3 Pfaden stimmen überein.
„Verstanden — Sie mieten also.“
BBA testet, ob ein Modell gesprochene Prompts versteht und schwierige Fragen richtig beantwortet. Unsere stärkste Storm-Konfiguration hält den Rekord – mit 99,4 % auf unserem öffentlichen Evaluationsset.
0.6% Fehlerquote
Das Ergebnis von ThunderPhone stammt aus unserem oben verlinkten öffentlichen Evaluationsdatensatz; weitere öffentlich verfügbare Werte aus dem Leaderboard von Artificial Analysis dienen zur Orientierung.
Bei anderen Sprach-KI-Plattformen wie Vapi, Retell, Pipecat und LiveKit müssen Sie zahlreiche Entscheidungen zur Konfiguration treffen, bevor Ihre Telefonate überhaupt funktionieren. Wir bei ThunderPhone sind überzeugt: Tuning ist unser Job – und Ihr Aufwand sollte so gering wie möglich sein, damit Ihre Telefonate reibungslos laufen.
ThunderPhone übernimmt das gesamte Tuning für Sie
Spark, Bolt oder Storm.
Sorgfältig ausgewählt und in echten Anrufen getestet.
Verhalten, Richtlinien und Tools – in Klartext.
Drei Entscheidungen. Mehr braucht es für die Einrichtung nicht – Orchestrierung, Fallbacks und Tuning sind bereits integriert.
Wir wählen die besten Modelle für die jeweilige Aufgabe aus und kombinieren sie. Spitzenmodelle von OpenAI, Anthropic und Google arbeiten dabei mit Open-Source-Modellen zusammen – bei jedem Anruf optimal auf Leistung und Preis abgestimmt, ohne dass Sie sich darum kümmern müssen.
Flow-Builder gibt es, weil schwächere Systeme komplexen Prompts nicht folgen können. Jeder Gesprächsschritt wird zu einem Knoten, den Sie manuell anlegen und pflegen müssen. Storm setzt detaillierte Anweisungen aus einem einzigen Prompt um, sodass Sie sich um Knoten und Kanten keine Gedanken machen müssen.
Sechs Knoten für einen einzigen Anmeldeprozess – jeder mit eigenen Prompts, Tools, Übergängen und eigener Fehlerbehandlung.
Begrüßen Sie den Anrufer und erfassen Sie seinen Namen und seine Telefonnummer. Lassen Sie sich vor der Anmeldung die Einwilligung bestätigen – zwingend erforderlich. Bei Fragen zur Abrechnung halten Sie sich an die folgende Abrechnungsrichtlinie. Rufen Sie enroll() erst auf, wenn alle Angaben bestätigt sind. Wenn der Anrufer mit einer Person sprechen möchte, leiten Sie ihn an einen Menschen weiter.
Ein Prompt, den Sie schreiben, testen und iterativ optimieren – alle Verzweigungen inklusive.
Undeutliche Aussprache, Stimmengewirr im Hintergrund, Namen und Zahlen, mehrere Sprachen im selben Gespräch – ThunderPhone wurde für genau die Situationen entwickelt, in denen andere Systeme scheitern.
Gleichen Sie Audio- und Textsignale miteinander ab, statt sich auf nur ein Transkript zu verlassen.
Modelle zur Erkennung und Reduzierung von Störgeräuschen bereinigen das Signal.
Erkennen Sie Nebengespräche, bevor sie den Sprachagenten aus dem Takt bringen.
Gleichen Sie Eigennamen, Schreibweisen, Zahlen und Korrekturen systematisch ab.
Leiten Sie das Gespräch bei Bedarf über mehrsprachige Audio- und Sprachpfade.
Nutzen Sie leistungsfähigere Reasoning-Pfade, wenn sich Verhalten nicht mit einer einzigen Regel abbilden lässt.
Sprach-KI muss am Telefon schnell reagieren – doch wenn die Antwort falsch ist, führt mehr Tempo nur schneller zum Fehler. Aktuelle LLMs brauchen einen Moment zum Nachdenken, um zuverlässig zu arbeiten. Deshalb bringt ThunderPhone Latenz und Genauigkeit ins Gleichgewicht.
Andere Anbieter werben unter Idealbedingungen mit 500 ms Latenz, brauchen in echten Telefongesprächen jedoch meist rund 2 s. Wir messen unsere Latenz unter realen Bedingungen.
Bei KI-Anbietern treten Latenzspitzen auf, die den Gesprächsverlauf erheblich stören können. Der orchestrierte Stack von ThunderPhone schaltet in solchen Fällen auf schnellere Alternativen um.
Automatisierte Telefonate waren bislang vor allem eines: frustrierend. Jede neue Generation hat das Erlebnis verbessert – wirklich reibungslos wurde es trotzdem nie. Mit ThunderPhone ändert sich das.
„Drücken Sie die Eins für den Vertrieb, die Zwei für den Support.“ Menüs können Anrufe nur weiterleiten.
Sagen Sie „Vertrieb“ oder „Abrechnung“ – und hoffen Sie, dass der Slot-Parser die Angabe richtig zuordnet.
Transkribieren, ein schnelles LLM befragen, dann sprechen – und bei jedem Schritt auf den vorherigen vertrauen.
Audio, Text, Reasoning, Tools, Stimmen und Schutzmechanismen in einem System.
In zehn Minuten live. Ab 2 ¢/Min.