Teknologi

Melampaui pipeline 3 langkah.

Sebagian besar platform AI suara mengandalkan pipeline 3 langkah: satu model transkripsi, satu LLM yang tidak bernalar, dan satu mesin text-to-speech. Setiap langkah adalah satu titik kegagalan. ThunderPhone mengurangi kesalahan dengan mengorkestrasi banyak model sekaligus.

Penelepon mengatakan “Saya sewa.”
ASR A“Saya sewa”
ASR B“Saya Dewa”
LLM Audio“Saya sewa”
Dikonfirmasi “Saya sewa” 2 dari 3 jalur setuju
Arsitektur terintegrasi

Dengarkan dengan banyak cara, lalu selaraskan.

ThunderPhone mengorkestrasi banyak model sekaligus, sehingga model-model tersebut dapat saling memperbaiki kesalahan.

Platform lain · alur 3 langkah

Setiap langkah memercayai langkah sebelumnya.

Audio penelepon
“Saya sewa.” · diucapkan bergumam
STT A
“Saya Dewa”
STT B
LLM Audio
Tidak ada cadangan saat satu model salah dengar
LLM
Model cepat hanya melihat transkrip.
→ menjawab “Halo, Dewa — apa yang bisa saya bantu?”
LLM cepat membuat kesalahan saat mengikuti instruksi
TTS
Jawabannya diucapkan kembali.
→ mengucapkan “Halo, Dewa — apa yang bisa saya bantu?” ✗
1 transkrip + 1 LLM = jawaban salah
ThunderPhone · terorkestrasi

Banyak jalur, satu jawaban yang terkoordinasi.

Audio penelepon
“Saya sewa.” · diucapkan bergumam
STT A
“Saya sewa”
STT B
“Saya Dewa”
LLM Audio
“Saya sewa”
Tiga transkrip + audio mentah disimpan sebagai bukti
Lapisan penalaran
LLM cepat + berpikir menimbang bukti teks dan audio.
→ 2 dari 3 jalur setuju: “Saya sewa”
LLM berpikir + cepat saling memeriksa sebelum menjawab
TTS
Suara yang dikurasi meminimalkan halusinasi pada ejaan dan karakter alfanumerik.
→ “Baik — jadi Anda menyewa.” ✓
Memahami detail rumit dengan tepat sejak pertama kali.
Bukti performa

Storm mencetak rekor kecerdasan di Big Bench Audio.

BBA menguji apakah sebuah model dapat memahami perintah lisan dan menjawab pertanyaan sulit dengan benar. Konfigurasi Storm terkuat kami mencapai 99.4% pada set evaluasi publik kami — 0.6% kesalahan, 4× lebih sedikit daripada skor publik terbaik berikutnya.

Model
Tingkat kesalahan↓ lebih rendah lebih baik
Skor
ThunderPhone Storm · Extra Intelligence4× lebih sedikit kesalahan
0.6%
Step-Audio R1.1
2.4%
Grok Voice Think Fast
2.9%
Ultravox v0.7 Thinking
3.0%
GPT-Realtime-2 High
3.4%
Gemini 3.1 Flash Live High
3.4%
Lihat dataset evaluasi BBA-Storm di Hugging Face

Tingkat kesalahan adalah 100% dikurangi tingkat keberhasilan BBA. Hasil ThunderPhone berasal dari dataset evaluasi publik kami, yang ditautkan di atas; skor publik lainnya (papan peringkat Artificial Analysis) dicantumkan sebagai referensi. BBA tidak sepenuhnya menangkap performa panggilan telepon, tetapi merupakan sinyal yang berguna untuk penalaran atas perintah lisan.

Pendekatan tegas mengalahkan konfigurabilitas

Anda tidak seharusnya perlu merakit tumpukan suara secara manual.

Platform AI suara lain seperti Vapi, Retell, Pipecat, dan LiveKit memaksa Anda membuat banyak keputusan konfigurasi agar panggilan Anda berfungsi. Di ThunderPhone, kami percaya bahwa penyetelan adalah tugas kami, dan Anda seharusnya perlu melakukan sesedikit mungkin pekerjaan agar panggilan Anda berjalan lancar.

Platform AI suara lain · banyak pengaturan untuk disesuaikan
STT LLM TTS Penentuan akhir ujaran Pengurangan noise Interupsi Cadangan Skema alat Latensi VAD
ThunderPhone menyetel semua ini untuk Anda
ThunderPhone · tiga keputusan
1
Pilih tingkat
Spark, Bolt, atau Storm.
2
Pilih suara
Dikurasi, diuji pada panggilan nyata.
3
Tulis prompt Anda
Perilaku, kebijakan, alat — bahasa yang sederhana.
Tiga keputusan. Itulah pengaturannya — orkestrasi, cadangan, dan penyetelan sudah tersedia secara bawaan.
Kami memilih model terbaik untuk setiap tugas dan menggabungkannya. Model terdepan dari OpenAI, Anthropic, dan Google, bekerja bersama model sumber terbuka — diorkestrasi untuk performa dan harga terbaik pada setiap panggilan, sehingga Anda tidak perlu memikirkannya.
Satu prompt, lebih sedikit kerumitan graf

Satu prompt, bukan graf node.

Pembuat alur ada karena sistem yang lebih lemah tidak dapat mengikuti prompt yang kompleks. Setiap langkah percakapan menjadi node yang harus Anda buat dan pelihara secara manual. Storm mengikuti instruksi kaya dari satu prompt, jadi Anda tidak perlu mengkhawatirkan node dan edge.

Platform pembuat alur

Rangkai setiap cabang secara manual.

Sapaanprompt · suara
Kumpulkan nomor teleponprompt · validasi
Konfirmasi nomor teleponprompt ulang ×2
enroll()alat · percobaan ulang
Eskalasike manusia
Cadangantangani semua
tidak valid ×2kesalahan
Enam node untuk satu alur pendaftaran — masing-masing dengan prompt, alat, transisi, dan penanganan kegagalannya sendiri.
ThunderPhone Storm

Jelaskan perilakunya sekali saja.

Prompt perilaku
Sapa penelepon dan kumpulkan nama serta nomor telepon mereka.
Konfirmasikan persetujuan sebelum mendaftarkan mereka — wajib.
Jika mereka bertanya tentang penagihan, ikuti kebijakan penagihan di bawah ini.
Panggil enroll() hanya setelah setiap kolom dikonfirmasi.
Jika penelepon meminta seseorang, alihkan ke manusia.
Percabangan kompleks Pengawas opsional Iterasi lebih mudah
Satu prompt untuk ditulis, diuji, dan diiterasi — termasuk percabangan.
Mengapa ini penting

Panggilan produksi itu rumit. ThunderPhone siap.

Ucapan yang tidak jelas, percakapan di latar belakang, nama dan angka, bahasa campuran — ThunderPhone dirancang untuk situasi yang membuat sistem lain gagal.

Ucapan tidak jelas

Bandingkan sinyal audio dan teks alih-alih memercayai satu transkrip.

Audio telepon buruk

Model identifikasi dan pengurangan kebisingan membersihkan sinyal.

Obrolan latar belakang

Identifikasi percakapan sampingan sebelum mengganggu agen.

Nama & alamat

Periksa silang nama diri, ejaan, angka, dan koreksi.

Ucapan campuran bahasa

Arahkan melalui jalur audio dan suara multibahasa saat diperlukan.

Prompt panjang

Gunakan jalur penalaran yang lebih kuat saat perilaku tidak dapat diringkas menjadi satu aturan.

Latensi, kualitas & biaya

Jawaban yang salah tetapi lebih cepat bukanlah panggilan yang lebih baik.

AI telepon harus menjawab dengan cepat — tetapi kecepatan tanpa ketepatan hanya menghasilkan kesalahan lebih cepat. LLM saat ini memerlukan waktu sejenak untuk bernalar agar tetap andal, sehingga ThunderPhone menyeimbangkan keduanya di setiap tingkat.

Spark
~3s
hingga respons pertama
Bolt
~2s
hingga respons pertama
Storm
~2–3s
~2 dtk dengan konfirmasi · ~3 dtk tanpa konfirmasi
PengukuranPenyedia lain mengklaim latensi 500 md dalam kondisi ideal, tetapi biasanya membutuhkan sekitar 2 dtk dalam panggilan nyata.Kami mengukur latensi kami dalam kondisi nyata.
KetahananPenyedia AI mengalami lonjakan latensi yang dapat mengganggu panggilan.Tumpukan terorkestrasi ThunderPhone beralih ke opsi yang lebih cepat saat ini terjadi.
Generasi AI suara

Generasi berikutnya dari AI suara telah hadir

Panggilan telepon otomatis selalu menjadi pengalaman yang membuat frustrasi... hingga kini. Setiap gelombang teknologi telah meningkatkan pengalaman, tetapi belum pernah sampai benar-benar mulus. ThunderPhone mengubahnya.

1990s2010s20242026 · sekarang
Generasi 1

IVR

Tekan satu untuk penjualan, tekan dua untuk dukungan. Menu hanya dapat meneruskan panggilan.

Generasi 2

Bot intent

Ucapkan “penjualan” atau “penagihan” dan berharap parser slot menangkapnya.

Generasi 3

AI tiga langkah

Transkripsikan, ajukan pertanyaan ke satu LLM cepat, lalu berbicara — setiap langkah memercayai langkah sebelumnya.

Generasi 4

AI Terintegrasi

Audio, teks, penalaran, alat, suara, dan pengaman dalam satu sistem.

Dibuat untuk panggilan yang membuat semua solusi lain gagal

Lihat tumpukan terintegrasi
untuk panggilan paling sulit Anda.

Aktif dalam sepuluh menit. Mulai dari 2¢/menit.