Memperkenalkan ThunderPhone
Pembaruan, Agustus 2026: Ini adalah pengumuman peluncuran awal kami dari Maret 2026, yang tetap kami tampilkan untuk dokumentasi sejarah. Beberapa detail — khususnya harga dan opsi suara — telah berubah sejak saat itu; lihat harga saat ini untuk informasi yang berlaku hari ini. Dan penantian telah berakhir: baca pengumuman peluncuran v2!
Hari ini, kami dengan bangga mengumumkan peluncuran publik ThunderPhone, yang memudahkan otomatisasi panggilan telepon dengan AI. Dengan arsitektur terintegrasi yang sepenuhnya berbeda dari Platform AI telepon lainnya, ThunderPhone mampu mencapai performa yang jauh lebih tinggi, biaya lebih rendah, dan lebih sedikit kendala integrasi. ThunderPhone mendukung panggilan masuk dan keluar dalam puluhan bahasa serta mematuhi HIPAA dan GDPR.
Keunggulan Terintegrasi
Platform AI telepon lain membatasi performa sistem mereka dengan menerapkan struktur 3 langkah:
- Satu model transkripsi, yang mengubah suara pengguna menjadi teks.
- Satu LLM, yang memproses teks pengguna dan menghasilkan respons.
- Satu model TTS, yang mengubah teks respons kembali menjadi audio.
Sebagian besar juga membebankan pekerjaan rekayasa kepada pengguna dengan memaksa pengguna memilih model yang ingin digunakan, serta opsi konfigurasi seperti pengurangan noise dan parameter responsivitas.
Kami mengambil pendekatan berbeda: kami telah mengonfigurasi tumpukan yang menurut kami terbaik dengan model-model yang tersedia saat ini, lalu membuatnya siap digunakan tanpa upaya konfigurasi yang rumit. Sistem kami menggunakan banyak model secara bersamaan, dengan sistem yang mengarahkan di antara model-model tersebut secara cerdas berdasarkan alur percakapan. Ini mencakup:
- Menggabungkan beberapa model transkripsi, sebagian lebih cepat dari yang lain, sebagian lebih akurat dari yang lain, untuk menyeimbangkan kecepatan dan akurasi serta menutupi kesalahan satu sama lain.
- Menggabungkan LLM input audio, yang mungkin memiliki kecerdasan umum lebih rendah tetapi pemahaman audio lebih baik, dengan LLM khusus teks, yang dapat membuat kesalahan akibat transkrip yang tidak akurat tetapi sering kali lebih cerdas.
- Menggabungkan LLM yang cepat tetapi kurang cerdas, yang dapat menghasilkan respons cepat, dengan LLM yang jauh lebih cerdas tetapi lebih lambat, yang dapat berjalan di latar belakang dan memastikan AI mengikuti Prompt-nya serta merespons ucapan pengguna dengan benar.
- Menggabungkan model komersial dari penyedia terkemuka termasuk OpenAI dan Google, yang menawarkan kecerdasan tertinggi yang tersedia saat ini, dengan beragam model sumber terbuka, yang sering kali menawarkan kecepatan lebih baik dengan biaya lebih rendah.
- Menggunakan beberapa model secara bersamaan untuk mengklasifikasikan dan menghilangkan noise latar belakang, percakapan sampingan, serta noise mengganggu lainnya yang dapat menggagalkan percakapan.
Komponen-komponen ini dan lainnya diorkestrasi dengan cara berbeda dalam tiga tingkat layanan kami, Spark, Bolt, dan Storm — mengoptimalkan Spark untuk biaya, Bolt untuk kecepatan, dan Storm untuk kecerdasan, sambil meminimalkan kekurangan masing-masing semaksimal mungkin. Ketiga sistem berbagi keunggulan seperti pemahaman yang sangat akurat terhadap ucapan pengguna, bahkan untuk nama diri dan ejaan.
Kami mendapati bahwa arsitektur yang terintegrasi erat ini memberi sistem kami performa jauh lebih tinggi dengan biaya lebih rendah dibandingkan pendekatan 3 langkah yang kaku dari vendor lain. Sejalan dengan teori modularitas Clay Christensen, AI suara masih berada di tahap awal, dan memaksimalkan performa dengan arsitektur terintegrasi masih lebih bernilai daripada memaksimalkan kemampuan penyesuaian dengan arsitektur modular.
Keputusan yang Dioptimalkan
Dan sejauh menyangkut kustomisasi, kami menentangnya! Sebagian besar platform AI telepon saat ini memaksa pengguna menavigasi pilihan tanpa akhir, mulai dari model yang tepat untuk digunakan hingga parameter yang sangat mendetail seperti seberapa cepat AI menyela pengguna.
Menurut kami, adalah tugas KAMI untuk mengoptimalkan pilihan-pilihan ini di balik layar agar pengguna ThunderPhone dapat berfokus pada hal yang mereka kuasai dan tidak perlu mengkhawatirkan konfigurasi AI suara yang mendetail. Kami melihat diri kami seperti Squarespace, yang memudahkan pengguna kami menyiapkan agen telepon dengan performa setinggi mungkin menggunakan model saat ini, tanpa perlu melakukan apa pun.
Kemudahan Penggunaan
ThunderPhone juga sangat mudah digunakan, baik Anda sedang menyiapkan agen telepon baru maupun bermigrasi dari platform lain atau stack kustom. Yang perlu dilakukan untuk menyiapkan agen telepon di ThunderPhone hanyalah:
- Tentukan apakah Anda ingin menggunakan Spark, Bolt, atau Storm.
- Pilih suara.
- Berikan Prompt Anda kepada kami. Tidak perlu agen multi-Prompt! Jika Prompt Anda terlalu rumit untuk Spark atau Bolt, tingkatkan ke Storm, yang dapat menangani bahkan kasus penggunaan yang kompleks dengan satu Prompt.
- Hubungkan integrasi perangkat lunak (endpoint apa pun, atau integrasi n8n native) dengan wizard yang sangat mudah digunakan.
- Hubungkan VoIP Anda dengan wizard yang sangat mudah digunakan.
Semua ini biasanya memerlukan waktu 10 menit atau kurang.
ThunderPhone mematuhi HIPAA dan GDPR, dan kami akan menandatangani serta menyediakan BAA dan DPA berdasarkan permintaan.
Kisah Kami
Kami adalah tim yang terdiri dari alumni Stanford AI Lab dan Y Combinator yang telah mengembangkan AI suara sejak 2024. Awalnya, fokus kami adalah Flux Interpreting, yang menerjemahkan panggilan telepon antarbahasa. Namun, setelah pelanggan berulang kali meminta kami untuk mengotomatiskan panggilan telepon bagi bisnis mereka, alih-alih sekadar menerjemahkannya, kami mengalihkan fokus ke apa yang kini menjadi ThunderPhone.
Masalah dengan Platform yang Ada
Awalnya, kami mulai dengan membangun agen telepon untuk pelanggan di platform AI telepon milik perusahaan lain. Kami menguji hampir setiap platform AI telepon di pasar, tetapi sayangnya menemukan banyak kekurangan, terutama dalam hal:
- Pemahaman audio: Keterbatasan karena hanya memiliki satu model transkripsi untuk mengubah audio pengguna menjadi teks berarti AI sering kali “salah dengar” pengguna, terutama untuk nama diri, kata yang tidak umum, dan ejaan.
- Mengikuti instruksi: Mengandalkan satu LLM cepat untuk melakukan “pemikiran utama” di balik panggilan berarti AI sering kesulitan mengikuti instruksi dengan benar dan keluar dari jalur.
- Integrasi yang sulit: Platform yang kami coba membuat koneksi ke perangkat lunak eksternal menjadi sangat sulit, yang umumnya mengharuskan kami mengetik konfigurasi JSON yang panjang untuk pemanggilan alat dan berulang kali mengutak-atiknya dengan bash tanpa banyak umpan balik hingga semuanya tiba-tiba berfungsi.
- Harga: Platform yang ada umumnya mengenakan biaya sangat mahal: biasanya 10 sen per menit atau lebih untuk performa yang biasa saja.
Membangun Stack Kami Sendiri
Ketika kami menandatangani kesepakatan untuk menerapkan use case panggilan penjualan bagi klien perusahaan besar, kami terpaksa membangun stack kustom sendiri untuk memenuhi kebutuhan mereka. Use case ini menuntut: tidak seperti dukungan pelanggan, ketika penelepon sebagian besar bergantung pada bisnis, penelepon penjualan cepat menutup telepon.
Kualitas panggilan harus sangat baik untuk menghasilkan penjualan, bukan kehilangan prospek. Ini berarti menangani banyak nama diri dan ejaan, termasuk nama dan alamat, yang sulit dikenali dengan benar oleh model transkripsi standar. Untuk menyempurnakan use case ini, kami membangun apa yang kini menjadi ThunderPhone.
Dalam prosesnya, kami terus bertemu orang-orang di komunitas AI suara San Francisco yang membangun perusahaan agen telepon vertikal — untuk dokter hewan, pengemudi truk, dan banyak lagi. Mengejutkannya, sebagian besar dari mereka memiliki pendapat yang sama: platform yang ada cukup baik untuk demo, tetapi belum untuk produksi.
Mengejutkannya, banyak, kalau bukan sebagian besar, teman kami di perusahaan AI suara vertikal sebenarnya “membangun stack sendiri”... Ini tidak masuk akal bagi kami — ini benar-benar setara dengan startup web pada tahun 90-an yang harus meng-host server web mereka sendiri di server yang disimpan di lemari mereka.
Dengan pemahaman itu, kami menyadari bahwa sudah waktunya mengubah sistem AI telepon kami menjadi platform yang dapat digunakan siapa saja.
Perusahaan AI suara vertikal dan konsultan seharusnya dapat berfokus memenuhi kebutuhan pasar sasaran mereka dengan keahlian khusus industri mereka — bukan pada rekayasa rumit AI dan teknologi telepon yang mendasarinya! Itulah yang kami luncurkan hari ini bersama ThunderPhone.
Perjalanannya panjang untuk sampai ke sini! Kami mohon maaf kepada semua orang yang telah mendaftar dengan kami sejak April lalu dan masih menunggu akses: yang kami kira akan menjadi sprint singkat untuk menyelesaikan pekerjaan ternyata menjadi perjalanan berbulan-bulan untuk mencari cara merangkai model yang tersedia saat ini menjadi sistem yang seandal mungkin.
Namun, kini kami akhirnya sudah aktif — cobalah dan lihat pendapat Anda!
Walaupun kami telah mengatasi kendala-kendala utama, pasti masih ada bug dalam sistem. Jika Anda menemukan masalah, silakan kirim email ke alex@thunderphone.com dan saya akan memastikan masalah tersebut diperbaiki untuk Anda secepat mungkin. Beri tahu kami juga jika Anda memiliki permintaan fitur, dan kami akan mewujudkannya untuk Anda sesegera mungkin.
Jika Anda memiliki kebutuhan yang lebih kustom, seperti dukungan implementasi dan integrasi kustom, kepatuhan di luar HIPAA dan GDPR standar, SLA, serta permintaan fitur kustom, kami dengan senang hati akan membicarakan kesepakatan enterprise. Hubungi alex@thunderphone.com dan kami akan membahas kebutuhan Anda serta apakah kami dapat membantu.
Secara lebih umum: komitmen kami kepada Anda adalah bahwa menjadi TUGAS KAMI untuk memastikan ThunderPhone dapat langsung digunakan dengan upaya minimal dari Anda, serta menangani panggilan bisnis Anda sesempurna mungkin dengan AI saat ini, dalam batas tingkat harga yang Anda pilih, Spark, Bolt, atau Storm. Cobalah, dan kami antusias untuk menunjukkan kepada Anda apa yang dapat dilakukan ThunderPhone.
Beri tahu kami pendapat Anda, dan terima kasih atas dukungan Anda!