ThunderPhone 2.0 ist live.Direkt im Self-Service – ab 2 ¢/Min..Ankündigung lesen
Blog

Neuigkeiten und Einblicke vom ThunderPhone-Team.

ThunderPhone v2 ist da

24. August 2026Alex Kolchinski

Heute freue ich mich, den öffentlichen Start unserer ThunderPhone v2 Self-Service-Plattform bekannt zu geben.

Ab sofort kann jeder ThunderPhone direkt einsetzen, um eine Vielzahl unterschiedlicher Telefonanrufe zu automatisieren.

Wie wir hierher gekommen sind

Seit dem vergangenen Jahr arbeiten wir mit einer kleinen Gruppe von Unternehmenskunden daran, ihre Telefonanrufe zu automatisieren. In einigen Fällen handelte es sich um performancekritische Anwendungsfälle wie Pre-Sales und Dateneingabe, bei denen wir festgestellt haben, dass bestehende Sprach-KI-Plattformen so viele Fehler machten, dass zu viele Anrufer frustriert auflegten und damit die Wirtschaftlichkeit des Anwendungsfalls zunichtemachten.

Um diese Probleme zu lösen, haben wir letztlich einen eigenen Stack von Grund auf aufgebaut, der bei Anrufen weniger Fehler macht und schwierige Anwendungsfälle ermöglicht. Nachdem wir in diesem Jahr Tausende Live-Anrufe automatisiert haben, machen wir unseren Stack nun als ThunderPhone v2 Self-Service-Plattform öffentlich verfügbar.

Drei Stufen, ab 2 ¢/Min.

Unser System beginnt bereits bei 2 ¢/Min. für die Spark-Stufe, einschließlich Modelle, und ist damit die günstigste Full-Stack-Sprach-KI-Plattform auf dem Markt. Für mehr Geschwindigkeit bieten wir außerdem Bolt ab 5 ¢/Min. an. Für die höchstmögliche Intelligenz bieten wir Storm ab 9 ¢/Min. an.

Storm kann selbst die komplexesten Anrufabläufe mit hoher Zuverlässigkeit bewältigen, ohne manuell erstellte „Flow-Builder“-Setups – ein Prompt genügt!

Mit aktivierter Option für zusätzliche Intelligenz (+3 ¢/Min.) erreicht Storm 99,4 % bei Big Bench Audio und liegt damit vor jedem Modell auf der bisherigen Artificial Analysis-Rangliste. Unser Evaluierungsdatensatz und die Transkripte sind auf Hugging Face öffentlich verfügbar, und wir werden bald weitere Benchmark-Ergebnisse veröffentlichen. Wenn Sie Fehler bei Ihren Live-Anrufen minimieren möchten, ist Storm Ihre beste Wahl.

Die integrierte Architektur

ThunderPhone kann dank unserer einzigartigen integrierten Architektur sowohl intelligenter als auch günstiger sein als andere Stacks. Statt einer „3-Schritte-Pipeline“, die ein Transkriptionsmodell, ein LLM und ein Text-to-Speech-Modell kombiniert, betreiben wir ein komplexeres Geflecht, in dem mehrere Transkriptionsmodelle, mehrere LLMs usw. auf sorgfältig orchestrierte Weise zusammenwirken, um die bestmögliche Leistung zu den niedrigstmöglichen Kosten zu erzielen.

Neben anderen Vorteilen macht dies unsere Agenten besonders gut darin, Anrufer korrekt zu verstehen, selbst in lauten Umgebungen oder bei starken Akzenten. Dadurch verlaufen Anrufe reibungsloser und die Dateneingabe für Namen, Adressen und mehr wird zuverlässiger. ThunderPhone-Agenten erfassen selbst schwierige Schreibweisen typischerweise in einem einzigen Gesprächszug, während andere Systeme mehrere Versuche benötigen. Und jedes „Entschuldigung, könnten Sie das bitte noch einmal buchstabieren?“ ist eine weitere Gelegenheit für den Anrufer aufzulegen!

Unser System umfasst außerdem zahlreiche Komponenten für die Herausforderungen realer Anrufe, darunter Hintergrundgeräusche, schlechte Signalqualität, Unterbrechungen und mehr. Wir haben die Mechanismen zur Gesprächssteuerung mit Tausenden Stunden realer Daten optimiert, und sie verbessern das Erlebnis für echte Anrufer deutlich.

Eine vollständige Plattform

ThunderPhone bietet außerdem eine umfassende Plattform, mit der Sie Sprachagenten besonders einfach entwickeln, testen, bereitstellen und überwachen können. Ohne ThunderPhone jemals zu verlassen, können Sie:

  • Eingehende und ausgehende Anrufe konfigurieren und Telefonnummern verwalten
  • Telefonagenten durch Menschen und KI testen lassen
  • Anrufe live überwachen, während sie stattfinden
  • Das System wiederkehrende Probleme in Ihren Produktivanrufen erkennen, Lösungen vorschlagen sowie diese prüfen und anwenden lassen
  • Mit Funnel-Berichten sehen, wie Ihre Anrufe performen und wo Optimierungsbedarf besteht

Die ThunderPhone-Plattform macht es außerdem mühelos, Telefonie- und Softwareintegrationen einzurichten. Ein Einrichtungsassistent verbindet Ihr bestehendes Twilio- oder Telnyx-Konto oder jeden Standard-SIP-Trunk mit wenigen Angaben Ihres Anbieters, und native Konnektoren unterstützen Google Sheets, Google Calendar, HubSpot, Salesforce und Cal.com. Für alle anderen Integrationen ermöglicht ein Assistent Verbindungen nach dem Prinzip „einfach einfügen und klicken“ mit jeder API.

Ein ständig verfügbarer Copilot ist in die Web-App integriert, damit Sie ganz einfach herausfinden können, wie Sie die ThunderPhone-Plattform nutzen. Er kann sogar durch die App navigieren und Aktionen für Sie ausführen – und da wir ein Sprach-KI-Unternehmen sind, kann er selbstverständlich mit Ihnen sprechen, statt Sie tippen zu lassen!

APIs, Enterprise und Compliance

Für Anwendungsfälle, die mehr Anpassungen erfordern, als die Web-Plattform bietet, verfügt ThunderPhone außerdem über eine voll ausgestattete API, die zahlreiche individuelle Integrationen ermöglicht. Und für noch umfassendere Plattformanpassungen, individuelle Anforderungen an Kosten und Latenz, Compliance-Anforderungen usw. bieten wir maßgeschneiderte Enterprise-Implementierungen und Support. (Bei Anfragen kontaktieren Sie mich direkt – alex@thunderphone.com)

ThunderPhone ist standardmäßig HIPAA- und DSGVO-konform für Anwendungen im Gesundheitswesen sowie in der EU und im Vereinigten Königreich, und wir unterzeichnen BAAs und DPAs ohne zusätzliche Kosten.

Testen Sie es noch heute

Weitere Informationen finden Sie auf unserer Website, auf der wir ausführlicher auf unsere Technologie, Preise, Plattformfunktionen und mehr eingehen.

Noch besser: Testen Sie ThunderPhone und sehen Sie, wie es sich für Ihren Anwendungsfall bewährt! Der Einstieg dauert nur wenige Minuten, und unsere Web-App sowie unser Copilot sind darauf ausgelegt, Ihnen die Einrichtung von allem, was Sie benötigen, so einfach wie möglich zu machen.

Falls Sie auf Probleme stoßen oder Wünsche haben, kontaktieren Sie mich persönlich unter alex@thunderphone.com

Alex Kolchinski, CEO

ThunderPhone wird vorgestellt

10. März 2026Alex Kolchinski

Update, August 2026: Dies ist unsere ursprüngliche Ankündigung zur Markteinführung vom März 2026, die wir der Nachwelt erhalten haben. Einige Details — insbesondere Preise und Sprachoptionen — haben sich seitdem geändert; unter aktuellen Preisen finden Sie die heute gültigen Informationen. Und das Warten hat ein Ende: Lesen Sie die Ankündigung zur Einführung von v2!

Heute freuen wir uns, die öffentliche Markteinführung von ThunderPhone bekannt zu geben, mit dem sich Telefonanrufe einfach mit KI automatisieren lassen. Mit einer vollständig anderen integrierten Architektur als andere Telefon-KI-Plattformen erzielt ThunderPhone eine deutlich höhere Leistung, niedrigere Kosten und weniger Integrationsprobleme. ThunderPhone unterstützt eingehende und ausgehende Anrufe in Dutzenden Sprachen und ist HIPAA- und DSGVO-konform.

Der Vorteil der Integration

Andere Telefon-KI-Plattformen begrenzen die Leistung ihrer Systeme, indem sie ihnen eine dreistufige Struktur aufzwingen:

  1. Ein Transkriptionsmodell, das die Stimme des Nutzers in Text umwandelt.
  2. Ein LLM, das den Text des Nutzers verarbeitet und eine Antwort ausgibt.
  3. Ein TTS-Modell, das den Antworttext wieder in Audio umwandelt.

Die meisten verlagern zudem Entwicklungsarbeit auf ihre Nutzer, indem sie diese dazu zwingen, die einzusetzenden Modelle sowie Konfigurationsoptionen wie Parameter zur Rauschunterdrückung und Reaktionsgeschwindigkeit auszuwählen.

Wir haben einen anderen Ansatz gewählt: Wir haben mit den heutigen Modellen den unserer Meinung nach bestmöglichen Stack konfiguriert und ihn ohne aufwendige Konfiguration sofort einsatzbereit gemacht. Unser System nutzt viele Modelle gleichzeitig und leitet je nach Gesprächsverlauf intelligent zwischen ihnen weiter. Dazu gehören:

  • Die Kombination mehrerer Transkriptionsmodelle — einige schneller, andere genauer —, um Geschwindigkeit und Genauigkeit auszubalancieren und Fehler der jeweils anderen auszugleichen.
  • Die Kombination von LLMs mit Audioeingabe, die zwar eine geringere allgemeine Intelligenz, aber ein besseres Audioverständnis haben können, mit rein textbasierten LLMs, die durch ungenaue Transkripte Fehler machen können, aber oft intelligenter sind.
  • Die Kombination schneller, aber weniger intelligenter LLMs, die rasche Antworten erzeugen können, mit deutlich intelligenteren, aber langsameren LLMs, die im Hintergrund laufen und sicherstellen können, dass die KI ihrem Prompt folgt und korrekt auf die Aussagen des Nutzers reagiert.
  • Die Kombination kommerzieller Modelle führender Anbieter, darunter OpenAI und Google, die die heute höchste verfügbare Intelligenz bieten, mit einer breiten Auswahl an Open-Source-Modellen, die häufig höhere Geschwindigkeit zu niedrigeren Kosten ermöglichen.
  • Die gleichzeitige Nutzung mehrerer Modelle zur Klassifizierung und Beseitigung von Hintergrundgeräuschen, Nebengesprächen und anderen störenden Geräuschen, die ein Gespräch ansonsten aus der Bahn werfen können.

Diese Komponenten und weitere werden in unseren drei Service-Tarifen Spark, Bolt und Storm auf unterschiedliche Weise orchestriert — Spark wird auf Kosten optimiert, Bolt auf Geschwindigkeit und Storm auf Intelligenz, während die jeweiligen Nachteile so weit wie möglich minimiert werden. Alle drei Systeme bieten gemeinsame Vorteile wie ein außerordentlich präzises Verständnis dessen, was Nutzer sagen — selbst bei Eigennamen und Buchstabierungen.

Wir stellen fest, dass diese eng integrierte Architektur unserem System eine deutlich höhere Leistung zu niedrigeren Kosten ermöglicht als der starre dreistufige Ansatz anderer Anbieter. Im Einklang mit Clay Christensens Modularitätstheorie befinden wir uns bei Sprach-KI noch in einer frühen Phase, und es ist weiterhin wertvoller, die Leistung mit einer integrierten Architektur zu maximieren, als die Anpassbarkeit mit einer modularen Architektur zu maximieren.

Optimierte Entscheidungen

Und was Anpassbarkeit angeht, sind wir dagegen. Die meisten heutigen Plattformen für Telefon-KI zwingen Nutzer dazu, sich durch endlose Auswahlmöglichkeiten zu arbeiten – von den genau verwendeten Modellen bis hin zu extrem detaillierten Parametern wie der Frage, wie schnell die KI den Nutzer unterbrechen soll.

Unserer Meinung nach ist es UNSERE Aufgabe, diese Entscheidungen im Hintergrund zu optimieren, damit sich die Nutzer von ThunderPhone auf das konzentrieren können, worin sie gut sind, statt sich um detaillierte Konfigurationen der Sprach-KI zu kümmern. Wir verstehen uns gewissermaßen als Squarespace und machen es unseren Nutzern leicht, Telefonagenten mit der bestmöglichen Leistung heutiger Modelle einzurichten – ohne einen Finger zu rühren.

Benutzerfreundlichkeit

ThunderPhone ist zudem unglaublich einfach zu bedienen – egal, ob Sie einen neuen Telefonagenten einrichten oder von einer anderen Plattform beziehungsweise einem individuellen Stack migrieren. Um einen Telefonagenten auf ThunderPhone einzurichten, müssen Sie lediglich:

  1. Entscheiden, ob Sie Spark, Bolt oder Storm verwenden möchten.
  2. Eine Stimme auswählen.
  3. Uns Ihren Prompt geben. Keine Agenten mit mehreren Prompts erforderlich. Wenn Ihr Prompt für Spark oder Bolt zu komplex ist, wechseln Sie zu Storm, das selbst komplexe Anwendungsfälle mit einem einzigen Prompt bewältigen kann.
  4. Softwareintegrationen (jeden Endpunkt oder die native n8n-Integration) mit einem unglaublich benutzerfreundlichen Assistenten verbinden.
  5. Ihr VoIP mit einem unglaublich benutzerfreundlichen Assistenten verbinden.

All das dauert in der Regel 10 Minuten oder weniger.

ThunderPhone ist HIPAA- und DSGVO-konform, und wir unterzeichnen und stellen auf Anfrage BAAs und DPAs bereit.

Unsere Geschichte

Wir sind ein Team aus Alumni des Stanford AI Lab und von Y Combinator und arbeiten seit 2024 an Sprach-KI. Ursprünglich lag unser Fokus auf Flux Interpreting, das Telefongespräche zwischen Sprachen übersetzt. Doch nachdem Kunden uns wiederholt gebeten hatten, Telefonate für ihre Unternehmen zu automatisieren, statt sie nur zu übersetzen, verlagerten wir unseren Fokus auf das, was heute ThunderPhone ist.

Das Problem mit bestehenden Plattformen

Zunächst begannen wir damit, Telefonagenten für Kunden auf Telefonie-KI-Plattformen anderer Unternehmen zu entwickeln. Wir testeten so gut wie jede Telefonie-KI-Plattform auf dem Markt, stellten aber leider fest, dass ihnen vieles fehlte, insbesondere bei:

  • Audioverständnis: Die Einschränkung, nur ein einziges Transkriptionsmodell zur Umwandlung des Audios des Nutzers in Text zu verwenden, führte dazu, dass die KI den Nutzer häufig „falsch verstand“ — insbesondere bei Eigennamen, seltenen Wörtern und Schreibweisen.
  • Befolgen von Anweisungen: Ein einzelnes schnelles LLM, das die eigentliche „Denkarbeit“ hinter dem Gespräch erledigt, bedeutete, dass die KIs oft Schwierigkeiten hatten, Anweisungen korrekt zu befolgen, und vom Kurs abkamen.
  • Schwierige Integrationen: Die von uns getesteten Plattformen machten es sehr schwer, externe Software anzubinden. Meist mussten wir umfangreiche JSON-Konfigurationen für Tool-Aufrufe eingeben und immer wieder damit kämpfen, mit wenig bis gar keinem Feedback, bis sie plötzlich funktionierten.
  • Preis: Bestehende Plattformen verlangten im Allgemeinen ein Vermögen: meist 10 Cent pro Minute oder mehr für mittelmäßige Leistung.

Unser eigener Stack

Als wir einen Vertrag zur Umsetzung eines Vertriebsgesprächs-Anwendungsfalls für einen Enterprise-Kunden unterzeichneten, waren wir gezwungen, unseren eigenen maßgeschneiderten Stack zu entwickeln, um dessen Anforderungen zu erfüllen. Dieser Anwendungsfall war anspruchsvoll: Anders als im Kundensupport, wo Anrufer weitgehend auf das Unternehmen angewiesen sind, legen Anrufer im Vertrieb schnell auf.

Die Gesprächsqualität muss erstklassig sein, um den Verkauf abzuschließen, statt den Lead zu verlieren. Das bedeutete, zahlreiche Eigennamen und Schreibweisen zu verarbeiten, darunter Namen und Adressen, die für Standard-Transkriptionsmodelle schwer korrekt zu erfassen sind. Um diesen Anwendungsfall perfekt umzusetzen, entwickelten wir das, was heute ThunderPhone ist.

Unterwegs trafen wir immer wieder Menschen aus der San-Francisco-Sprach-KI-Community, die vertikale Telefonagenten-Unternehmen aufbauten — für Tierärzte, Lkw-Fahrer und mehr. Überraschenderweise vertraten die meisten dieselbe Meinung: Bestehende Plattformen waren gut genug für Demos, aber nicht für den Produktionseinsatz.

Erschreckenderweise bauten viele, wenn nicht sogar die meisten unserer Freunde in vertikalen Sprach-KI-Unternehmen tatsächlich ihre eigenen Stacks ... Das ergab für uns keinen Sinn — es ist im Grunde das Äquivalent dazu, dass Web-Start-ups in den 90er-Jahren ihre eigenen Webserver auf einem Server im Abstellraum hosten mussten.

Mit dieser Erkenntnis wurde uns klar, dass es an der Zeit war, unser Telefonie-KI-System in eine Plattform zu verwandeln, die jeder nutzen kann.

Vertikale Sprach-KI-Unternehmen und Berater sollten sich darauf konzentrieren können, die Anforderungen ihres Zielmarkts mit ihrer branchenspezifischen Expertise zu erfüllen — nicht darauf, die zugrunde liegende KI- und Telefontechnologie aufwendig zu entwickeln! Genau das führen wir heute mit ThunderPhone ein.

Es war ein langer Weg bis hierher. Entschuldigung an alle, die sich seit letztem April bei uns angemeldet haben und noch immer auf Zugang warten: Was wir für einen kurzen Sprint hielten, um die Arbeit abzuschließen, wurde zu einer mehrmonatigen Odyssee, in der wir herausfinden mussten, wie sich die heute verfügbaren Modelle zu einem möglichst robusten System verbinden lassen.

Aber jetzt sind wir endlich live — probieren Sie es aus und sagen Sie uns, was Sie denken.

Auch wenn wir die größten Probleme gelöst haben, wird es sicherlich noch Fehler im System geben. Falls Sie auf Probleme stoßen, schreiben Sie bitte an alex@thunderphone.com, und ich sorge dafür, dass sie so schnell wie möglich für Sie behoben werden. Teilen Sie uns auch gerne mit, wenn Sie Funktionswünsche haben, und wir werden diese ebenfalls so bald wie möglich umsetzen.

Und falls Sie individuellere Anforderungen haben, etwa Unterstützung bei maßgeschneiderter Implementierung und Integration, Compliance über die üblichen HIPAA- und GDPR-Anforderungen hinaus, SLAs oder individuelle Funktionswünsche, sprechen wir gerne über einen Enterprise-Vertrag. Melden Sie sich unter alex@thunderphone.com, und wir besprechen Ihre Anforderungen und ob wir helfen können.

Und ganz allgemein: Unser Versprechen an Sie ist, dass es UNSERE Aufgabe ist sicherzustellen, dass ThunderPhone mit minimalem Aufwand Ihrerseits sofort funktioniert und die Telefonate Ihres Unternehmens so perfekt bearbeitet, wie es mit der heutigen KI möglich ist — innerhalb der Grenzen der von Ihnen gewählten Preisstufe Spark, Bolt oder Storm. Probieren Sie uns aus, und wir freuen uns darauf, Ihnen zu zeigen, was ThunderPhone leisten kann.

Sagen Sie uns, was Sie denken, und vielen Dank für Ihre Unterstützung!