Większość platform głosowej AI działa według 3-etapowego schematu: model do transkrypcji, model LLM bez funkcji rozumowania i silnik zamiany tekstu na mowę. Wystarczy błąd na jednym z etapów, by zawiódł cały system. ThunderPhone ogranicza błędy, koordynując pracę wielu modeli jednocześnie.
ThunderPhone koordynuje pracę wielu modeli naraz, dzięki czemu mogą wzajemnie korygować swoje błędy.
Szybki model LLM ma dostęp tylko do transkrypcji.
„Cześć, Brent — jak mogę pomóc?”
Szybkie modele LLM i modele rozumujące wzajemnie weryfikują wynik: 2 z 3 ścieżek dają ten sam wynik.
„Rozumiem — czyli wynajmujesz.”
BBA sprawdza, czy model rozumie prompty przekazywane głosowo i potrafi poprawnie odpowiadać na trudne pytania. Rekord należy do naszej najmocniejszej konfiguracji Storm: 99,4% w naszym publicznie dostępnym zestawie ewaluacyjnym.
0.6% wskaźnik błędów
Wynik ThunderPhone pochodzi z naszego publicznego zbioru danych ewaluacyjnych, do którego link znajduje się powyżej; pozostałe publiczne wyniki (ranking Artificial Analysis) podajemy dla porównania.
Inne platformy głosowej AI, takie jak Vapi, Retell, Pipecat i LiveKit, zmuszają cię do podejmowania wielu decyzji konfiguracyjnych, zanim połączenia zaczną działać. W ThunderPhone uważamy, że strojenie systemu to nasze zadanie, a po twojej stronie powinno zostać jak najmniej pracy potrzebnej do tego, by rozmowy przebiegały płynnie.
ThunderPhone dostraja to wszystko za Ciebie
Spark, Bolt lub Storm.
Starannie wyselekcjonowane i przetestowane podczas prawdziwych rozmów.
Zachowanie, zasady i narzędzia — opisane prostym językiem.
Trzy decyzje. I gotowe — orkiestracja, mechanizmy awaryjne i strojenie są już wbudowane.
Dobieramy najlepsze modele do każdego zadania i łączymy je w spójną całość. Najbardziej zaawansowane modele OpenAI, Anthropic i Google współpracują z modelami open source — orkiestrujemy je tak, by każde połączenie zapewniało najlepszą wydajność i cenę. Ty nie musisz się tym zajmować.
Kreatory przepływów powstały, ponieważ słabsze systemy nie radzą sobie ze złożonymi promptami. Każdy etap rozmowy staje się węzłem, który trzeba ręcznie zbudować i utrzymywać. Storm realizuje rozbudowane instrukcje z jednego promptu, więc nie musisz zaprzątać sobie głowy węzłami ani krawędziami.
Sześć węzłów dla jednego procesu rejestracji — każdy z własnymi promptami, narzędziami, przejściami i obsługą błędów.
Przywitaj rozmówcę i poproś o imię oraz numer telefonu. Przed zapisaniem upewnij się, że wyraził zgodę — to wymagane. Jeśli zapyta o rozliczenia, postępuj zgodnie z poniższymi zasadami rozliczeń. Wywołaj enroll() tylko raz, dopiero po potwierdzeniu wszystkich danych. Jeśli rozmówca poprosi o rozmowę z człowiekiem, przekaż połączenie konsultantowi.
Piszesz, testujesz i udoskonalasz jeden prompt — rozgałęzienia są już w nim uwzględnione.
Niewyraźna mowa, gwar w tle, imiona i liczby, mieszanie języków — ThunderPhone powstał z myślą o sytuacjach, w których inne systemy zawodzą.
Porównuj sygnały audio i tekstowe, zamiast polegać na pojedynczej transkrypcji.
Modele wykrywania i redukcji szumów oczyszczają sygnał.
Wykrywaj poboczne rozmowy, zanim zakłócą pracę agenta.
Weryfikuj nazwy własne, pisownię, liczby i poprawki.
W razie potrzeby korzystaj z wielojęzycznych ścieżek przetwarzania dźwięku i głosu.
Stosuj bardziej zaawansowane ścieżki rozumowania, gdy zachowania nie da się sprowadzić do jednej reguły.
Głosowa AI musi odpowiadać szybko — ale sama szybkość bez poprawności oznacza tylko szybsze błędy. Dzisiejsze modele LLM potrzebują chwili na namysł, by działać niezawodnie, dlatego ThunderPhone zachowuje równowagę między czasem reakcji a trafnością.
Inni dostawcy deklarują opóźnienie na poziomie 500 ms w idealnych warunkach, choć w rzeczywistej rozmowie zwykle jest to około 2 s. Mierzymy opóźnienia w rzeczywistych warunkach.
U dostawców AI zdarzają się skoki opóźnień, które mogą całkowicie zakłócić przebieg rozmowy. Dzięki orkiestracji stos technologiczny ThunderPhone awaryjnie przełącza się wtedy na szybsze rozwiązania.
Automatyczne rozmowy telefoniczne były źródłem frustracji… aż do teraz. Każda kolejna generacja technologii coś poprawiała, ale nigdy na tyle, by rozmowa była naprawdę płynna. ThunderPhone to zmienia.
„Aby połączyć się z działem sprzedaży, wybierz 1. Aby skontaktować się z pomocą techniczną, wybierz 2”. Takie menu potrafi tylko przekierowywać połączenia.
Powiedz „sprzedaż” albo „rozliczenia” — i licz, że parser slotów to wychwyci.
Najpierw transkrypcja, potem zapytanie do jednego szybkiego LLM, a na końcu synteza mowy — każdy etap zakłada, że wynik poprzedniego jest poprawny.
Dźwięk, tekst, rozumowanie, narzędzia, głosy i zabezpieczenia — połączone w jeden system.
Start w 10 minut. Od 2 centów za minutę.