ThunderPhone 2.0 ist live.Direkt im Self-Service – ab 2 ¢/Min..Ankündigung lesen
Alle Beiträge

ThunderPhone wird vorgestellt

10. März 2026Alex Kolchinski

Update, August 2026: Dies ist unsere ursprüngliche Ankündigung zur Markteinführung vom März 2026, die wir der Nachwelt erhalten haben. Einige Details — insbesondere Preise und Sprachoptionen — haben sich seitdem geändert; unter aktuellen Preisen finden Sie die heute gültigen Informationen. Und das Warten hat ein Ende: Lesen Sie die Ankündigung zur Einführung von v2!

Heute freuen wir uns, die öffentliche Markteinführung von ThunderPhone bekannt zu geben, mit dem sich Telefonanrufe einfach mit KI automatisieren lassen. Mit einer vollständig anderen integrierten Architektur als andere Telefon-KI-Plattformen erzielt ThunderPhone eine deutlich höhere Leistung, niedrigere Kosten und weniger Integrationsprobleme. ThunderPhone unterstützt eingehende und ausgehende Anrufe in Dutzenden Sprachen und ist HIPAA- und DSGVO-konform.

Der Vorteil der Integration

Andere Telefon-KI-Plattformen begrenzen die Leistung ihrer Systeme, indem sie ihnen eine dreistufige Struktur aufzwingen:

  1. Ein Transkriptionsmodell, das die Stimme des Nutzers in Text umwandelt.
  2. Ein LLM, das den Text des Nutzers verarbeitet und eine Antwort ausgibt.
  3. Ein TTS-Modell, das den Antworttext wieder in Audio umwandelt.

Die meisten verlagern zudem Entwicklungsarbeit auf ihre Nutzer, indem sie diese dazu zwingen, die einzusetzenden Modelle sowie Konfigurationsoptionen wie Parameter zur Rauschunterdrückung und Reaktionsgeschwindigkeit auszuwählen.

Wir haben einen anderen Ansatz gewählt: Wir haben mit den heutigen Modellen den unserer Meinung nach bestmöglichen Stack konfiguriert und ihn ohne aufwendige Konfiguration sofort einsatzbereit gemacht. Unser System nutzt viele Modelle gleichzeitig und leitet je nach Gesprächsverlauf intelligent zwischen ihnen weiter. Dazu gehören:

  • Die Kombination mehrerer Transkriptionsmodelle — einige schneller, andere genauer —, um Geschwindigkeit und Genauigkeit auszubalancieren und Fehler der jeweils anderen auszugleichen.
  • Die Kombination von LLMs mit Audioeingabe, die zwar eine geringere allgemeine Intelligenz, aber ein besseres Audioverständnis haben können, mit rein textbasierten LLMs, die durch ungenaue Transkripte Fehler machen können, aber oft intelligenter sind.
  • Die Kombination schneller, aber weniger intelligenter LLMs, die rasche Antworten erzeugen können, mit deutlich intelligenteren, aber langsameren LLMs, die im Hintergrund laufen und sicherstellen können, dass die KI ihrem Prompt folgt und korrekt auf die Aussagen des Nutzers reagiert.
  • Die Kombination kommerzieller Modelle führender Anbieter, darunter OpenAI und Google, die die heute höchste verfügbare Intelligenz bieten, mit einer breiten Auswahl an Open-Source-Modellen, die häufig höhere Geschwindigkeit zu niedrigeren Kosten ermöglichen.
  • Die gleichzeitige Nutzung mehrerer Modelle zur Klassifizierung und Beseitigung von Hintergrundgeräuschen, Nebengesprächen und anderen störenden Geräuschen, die ein Gespräch ansonsten aus der Bahn werfen können.

Diese Komponenten und weitere werden in unseren drei Service-Tarifen Spark, Bolt und Storm auf unterschiedliche Weise orchestriert — Spark wird auf Kosten optimiert, Bolt auf Geschwindigkeit und Storm auf Intelligenz, während die jeweiligen Nachteile so weit wie möglich minimiert werden. Alle drei Systeme bieten gemeinsame Vorteile wie ein außerordentlich präzises Verständnis dessen, was Nutzer sagen — selbst bei Eigennamen und Buchstabierungen.

Wir stellen fest, dass diese eng integrierte Architektur unserem System eine deutlich höhere Leistung zu niedrigeren Kosten ermöglicht als der starre dreistufige Ansatz anderer Anbieter. Im Einklang mit Clay Christensens Modularitätstheorie befinden wir uns bei Sprach-KI noch in einer frühen Phase, und es ist weiterhin wertvoller, die Leistung mit einer integrierten Architektur zu maximieren, als die Anpassbarkeit mit einer modularen Architektur zu maximieren.

Optimierte Entscheidungen

Und was Anpassbarkeit angeht, sind wir dagegen. Die meisten heutigen Plattformen für Telefon-KI zwingen Nutzer dazu, sich durch endlose Auswahlmöglichkeiten zu arbeiten – von den genau verwendeten Modellen bis hin zu extrem detaillierten Parametern wie der Frage, wie schnell die KI den Nutzer unterbrechen soll.

Unserer Meinung nach ist es UNSERE Aufgabe, diese Entscheidungen im Hintergrund zu optimieren, damit sich die Nutzer von ThunderPhone auf das konzentrieren können, worin sie gut sind, statt sich um detaillierte Konfigurationen der Sprach-KI zu kümmern. Wir verstehen uns gewissermaßen als Squarespace und machen es unseren Nutzern leicht, Telefonagenten mit der bestmöglichen Leistung heutiger Modelle einzurichten – ohne einen Finger zu rühren.

Benutzerfreundlichkeit

ThunderPhone ist zudem unglaublich einfach zu bedienen – egal, ob Sie einen neuen Telefonagenten einrichten oder von einer anderen Plattform beziehungsweise einem individuellen Stack migrieren. Um einen Telefonagenten auf ThunderPhone einzurichten, müssen Sie lediglich:

  1. Entscheiden, ob Sie Spark, Bolt oder Storm verwenden möchten.
  2. Eine Stimme auswählen.
  3. Uns Ihren Prompt geben. Keine Agenten mit mehreren Prompts erforderlich. Wenn Ihr Prompt für Spark oder Bolt zu komplex ist, wechseln Sie zu Storm, das selbst komplexe Anwendungsfälle mit einem einzigen Prompt bewältigen kann.
  4. Softwareintegrationen (jeden Endpunkt oder die native n8n-Integration) mit einem unglaublich benutzerfreundlichen Assistenten verbinden.
  5. Ihr VoIP mit einem unglaublich benutzerfreundlichen Assistenten verbinden.

All das dauert in der Regel 10 Minuten oder weniger.

ThunderPhone ist HIPAA- und DSGVO-konform, und wir unterzeichnen und stellen auf Anfrage BAAs und DPAs bereit.

Unsere Geschichte

Wir sind ein Team aus Alumni des Stanford AI Lab und von Y Combinator und arbeiten seit 2024 an Sprach-KI. Ursprünglich lag unser Fokus auf Flux Interpreting, das Telefongespräche zwischen Sprachen übersetzt. Doch nachdem Kunden uns wiederholt gebeten hatten, Telefonate für ihre Unternehmen zu automatisieren, statt sie nur zu übersetzen, verlagerten wir unseren Fokus auf das, was heute ThunderPhone ist.

Das Problem mit bestehenden Plattformen

Zunächst begannen wir damit, Telefonagenten für Kunden auf Telefonie-KI-Plattformen anderer Unternehmen zu entwickeln. Wir testeten so gut wie jede Telefonie-KI-Plattform auf dem Markt, stellten aber leider fest, dass ihnen vieles fehlte, insbesondere bei:

  • Audioverständnis: Die Einschränkung, nur ein einziges Transkriptionsmodell zur Umwandlung des Audios des Nutzers in Text zu verwenden, führte dazu, dass die KI den Nutzer häufig „falsch verstand“ — insbesondere bei Eigennamen, seltenen Wörtern und Schreibweisen.
  • Befolgen von Anweisungen: Ein einzelnes schnelles LLM, das die eigentliche „Denkarbeit“ hinter dem Gespräch erledigt, bedeutete, dass die KIs oft Schwierigkeiten hatten, Anweisungen korrekt zu befolgen, und vom Kurs abkamen.
  • Schwierige Integrationen: Die von uns getesteten Plattformen machten es sehr schwer, externe Software anzubinden. Meist mussten wir umfangreiche JSON-Konfigurationen für Tool-Aufrufe eingeben und immer wieder damit kämpfen, mit wenig bis gar keinem Feedback, bis sie plötzlich funktionierten.
  • Preis: Bestehende Plattformen verlangten im Allgemeinen ein Vermögen: meist 10 Cent pro Minute oder mehr für mittelmäßige Leistung.

Unser eigener Stack

Als wir einen Vertrag zur Umsetzung eines Vertriebsgesprächs-Anwendungsfalls für einen Enterprise-Kunden unterzeichneten, waren wir gezwungen, unseren eigenen maßgeschneiderten Stack zu entwickeln, um dessen Anforderungen zu erfüllen. Dieser Anwendungsfall war anspruchsvoll: Anders als im Kundensupport, wo Anrufer weitgehend auf das Unternehmen angewiesen sind, legen Anrufer im Vertrieb schnell auf.

Die Gesprächsqualität muss erstklassig sein, um den Verkauf abzuschließen, statt den Lead zu verlieren. Das bedeutete, zahlreiche Eigennamen und Schreibweisen zu verarbeiten, darunter Namen und Adressen, die für Standard-Transkriptionsmodelle schwer korrekt zu erfassen sind. Um diesen Anwendungsfall perfekt umzusetzen, entwickelten wir das, was heute ThunderPhone ist.

Unterwegs trafen wir immer wieder Menschen aus der San-Francisco-Sprach-KI-Community, die vertikale Telefonagenten-Unternehmen aufbauten — für Tierärzte, Lkw-Fahrer und mehr. Überraschenderweise vertraten die meisten dieselbe Meinung: Bestehende Plattformen waren gut genug für Demos, aber nicht für den Produktionseinsatz.

Erschreckenderweise bauten viele, wenn nicht sogar die meisten unserer Freunde in vertikalen Sprach-KI-Unternehmen tatsächlich ihre eigenen Stacks ... Das ergab für uns keinen Sinn — es ist im Grunde das Äquivalent dazu, dass Web-Start-ups in den 90er-Jahren ihre eigenen Webserver auf einem Server im Abstellraum hosten mussten.

Mit dieser Erkenntnis wurde uns klar, dass es an der Zeit war, unser Telefonie-KI-System in eine Plattform zu verwandeln, die jeder nutzen kann.

Vertikale Sprach-KI-Unternehmen und Berater sollten sich darauf konzentrieren können, die Anforderungen ihres Zielmarkts mit ihrer branchenspezifischen Expertise zu erfüllen — nicht darauf, die zugrunde liegende KI- und Telefontechnologie aufwendig zu entwickeln! Genau das führen wir heute mit ThunderPhone ein.

Es war ein langer Weg bis hierher. Entschuldigung an alle, die sich seit letztem April bei uns angemeldet haben und noch immer auf Zugang warten: Was wir für einen kurzen Sprint hielten, um die Arbeit abzuschließen, wurde zu einer mehrmonatigen Odyssee, in der wir herausfinden mussten, wie sich die heute verfügbaren Modelle zu einem möglichst robusten System verbinden lassen.

Aber jetzt sind wir endlich live — probieren Sie es aus und sagen Sie uns, was Sie denken.

Auch wenn wir die größten Probleme gelöst haben, wird es sicherlich noch Fehler im System geben. Falls Sie auf Probleme stoßen, schreiben Sie bitte an alex@thunderphone.com, und ich sorge dafür, dass sie so schnell wie möglich für Sie behoben werden. Teilen Sie uns auch gerne mit, wenn Sie Funktionswünsche haben, und wir werden diese ebenfalls so bald wie möglich umsetzen.

Und falls Sie individuellere Anforderungen haben, etwa Unterstützung bei maßgeschneiderter Implementierung und Integration, Compliance über die üblichen HIPAA- und GDPR-Anforderungen hinaus, SLAs oder individuelle Funktionswünsche, sprechen wir gerne über einen Enterprise-Vertrag. Melden Sie sich unter alex@thunderphone.com, und wir besprechen Ihre Anforderungen und ob wir helfen können.

Und ganz allgemein: Unser Versprechen an Sie ist, dass es UNSERE Aufgabe ist sicherzustellen, dass ThunderPhone mit minimalem Aufwand Ihrerseits sofort funktioniert und die Telefonate Ihres Unternehmens so perfekt bearbeitet, wie es mit der heutigen KI möglich ist — innerhalb der Grenzen der von Ihnen gewählten Preisstufe Spark, Bolt oder Storm. Probieren Sie uns aus, und wir freuen uns darauf, Ihnen zu zeigen, was ThunderPhone leisten kann.

Sagen Sie uns, was Sie denken, und vielen Dank für Ihre Unterstützung!