ThunderPhone की घोषणा
अपडेट, अगस्त 2026: यह मार्च 2026 की हमारी मूल लॉन्च घोषणा है, जिसे इतिहास के लिए रखा गया है। तब से कुछ विवरण — खासकर मूल्य निर्धारण और वॉइस विकल्प — बदल गए हैं; आज की सही जानकारी के लिए वर्तमान मूल्य निर्धारण देखें। और इंतज़ार खत्म हुआ: v2 लॉन्च घोषणा पढ़ें!
आज, हमें ThunderPhone के सार्वजनिक लॉन्च की घोषणा करते हुए गर्व हो रहा है, जो AI के साथ फोन कॉल स्वचालित करना आसान बनाता है। अन्य फोन AI प्लेटफ़ॉर्म से पूरी तरह अलग इंटीग्रेटेड आर्किटेक्चर के साथ, ThunderPhone कहीं अधिक परफॉर्मेंस, कम लागत और इंटीग्रेशन से जुड़ी कम परेशानियाँ हासिल कर सकता है। ThunderPhone दर्जनों भाषाओं में इनबाउंड और आउटबाउंड कॉल सपोर्ट करता है और HIPAA तथा GDPR के अनुरूप है।
इंटीग्रेटेड लाभ
अन्य फोन AI प्लेटफ़ॉर्म अपने सिस्टम पर 3-स्टेप संरचना लागू करके उनकी परफॉर्मेंस सीमित करते हैं:
- एक ट्रांसक्रिप्शन मॉडल, जो उपयोगकर्ता की आवाज़ को टेक्स्ट में बदलता है।
- एक LLM, जो उपयोगकर्ता के टेक्स्ट को प्रोसेस करता है और जवाब आउटपुट करता है।
- एक TTS मॉडल, जो जवाब के टेक्स्ट को फिर से ऑडियो में बदलता है।
इनमें से अधिकांश इंजीनियरिंग का काम भी अपने उपयोगकर्ताओं पर डाल देते हैं, क्योंकि वे उपयोगकर्ताओं को यह चुनने के लिए मजबूर करते हैं कि कौन से मॉडल इस्तेमाल करने हैं, साथ ही डीनॉइज़िंग और रिस्पॉन्सिवनेस पैरामीटर जैसे कॉन्फ़िगरेशन विकल्प भी चुनने होते हैं।
हमने एक अलग तरीका अपनाया है: हमने आज उपलब्ध मॉडलों के साथ, हमारी राय में, सबसे बेहतरीन संभव स्टैक कॉन्फ़िगर किया है और उसे जटिल कॉन्फ़िगरेशन प्रयास के बिना इस्तेमाल के लिए तैयार बनाया है। हमारा सिस्टम एक ही समय में कई मॉडलों का उपयोग करता है और बातचीत के प्रवाह के आधार पर उनके बीच समझदारी से रूटिंग करता है। इसमें शामिल है:
- कई ट्रांसक्रिप्शन मॉडलों को मिलाना, जिनमें कुछ दूसरों से तेज़ और कुछ दूसरों से अधिक सटीक हैं, ताकि गति और सटीकता में संतुलन बनाया जा सके और वे एक-दूसरे की गलतियों को कवर कर सकें।
- ऑडियो-इनपुट LLMs, जिनकी सामान्य बुद्धिमत्ता कम लेकिन ऑडियो समझ बेहतर हो सकती है, को टेक्स्ट-ओनली LLMs के साथ मिलाना, जो गलत ट्रांसक्रिप्ट के कारण गलतियाँ कर सकते हैं लेकिन अक्सर अधिक स्मार्ट होते हैं।
- तेज़ लेकिन कम बुद्धिमान LLMs, जो तुरंत जवाब जनरेट कर सकते हैं, को कहीं अधिक स्मार्ट लेकिन धीमे LLMs के साथ मिलाना, जो बैकग्राउंड में चल सकते हैं और सुनिश्चित कर सकते हैं कि AI अपने प्रॉम्प्ट का पालन कर रहा है और उपयोगकर्ता की बात का सही जवाब दे रहा है।
- OpenAI और Google सहित शीर्ष प्रदाताओं के कमर्शियल मॉडल, जो आज उपलब्ध सबसे उच्च बुद्धिमत्ता प्रदान करते हैं, को ओपन-सोर्स मॉडलों की विस्तृत श्रृंखला के साथ मिलाना, जो अक्सर कम लागत पर बेहतर गति देते हैं।
- बैकग्राउंड नॉइज़, साइड बातचीत और अन्य ध्यान भटकाने वाले शोर को वर्गीकृत करने और हटाने के लिए एक साथ कई मॉडलों का उपयोग करना, जो अन्यथा बातचीत को पटरी से उतार सकते हैं।
इन घटकों और अन्य चीज़ों को हमारे तीन सेवा टियर, Spark, Bolt और Storm में अलग-अलग तरीकों से ऑर्केस्ट्रेट किया जाता है — Spark को लागत के लिए, Bolt को गति के लिए और Storm को बुद्धिमत्ता के लिए ऑप्टिमाइज़ करते हुए, और हर एक की कमियों को यथासंभव कम करते हुए। तीनों सिस्टम ऐसे लाभ साझा करते हैं जैसे उपयोगकर्ता क्या कहते हैं इसकी अविश्वसनीय रूप से सटीक समझ, यहाँ तक कि व्यक्तिवाचक नामों और स्पेलिंग के साथ भी।
हम पाते हैं कि यह कसकर इंटीग्रेटेड आर्किटेक्चर हमारे सिस्टम को अन्य विक्रेताओं के कठोर 3-स्टेप तरीके की तुलना में कम लागत पर कहीं अधिक परफॉर्मेंस देता है। Clay Christensen के मॉड्यूलरिटी सिद्धांत के अनुरूप, वॉइस AI अभी शुरुआती दौर में है, और मॉड्यूलर आर्किटेक्चर के साथ कस्टमाइज़ेबिलिटी को अधिकतम करने के बजाय इंटीग्रेटेड आर्किटेक्चर के साथ परफॉर्मेंस को अधिकतम करना अभी भी अधिक मूल्यवान है।
अनुकूलित निर्णय
और जहाँ तक कस्टमाइज़ेबिलिटी की बात है, हम इसके खिलाफ हैं! आज के ज़्यादातर फोन AI प्लेटफ़ॉर्म यूज़र्स को अंतहीन विकल्पों में उलझने पर मजबूर करते हैं, इस्तेमाल किए जाने वाले सटीक मॉडल से लेकर AI यूज़र को कितनी जल्दी बीच में टोके जैसे बेहद विस्तृत पैरामीटर्स तक।
हमारी राय में, इन विकल्पों को पर्दे के पीछे ऑप्टिमाइज़ करना हमारा काम है, ताकि ThunderPhone के यूज़र्स उस काम पर ध्यान दे सकें जिसमें वे अच्छे हैं और उन्हें विस्तृत वॉइस AI कॉन्फ़िगरेशन की चिंता न करनी पड़े। हम खुद को एक तरह के Squarespace के रूप में देखते हैं, जो हमारे यूज़र्स के लिए आज के मॉडलों के साथ संभव सबसे उच्च प्रदर्शन वाले फोन एजेंट सेट अप करना आसान बनाता है, बिना उन्हें कुछ किए।
इस्तेमाल में आसानी
ThunderPhone इस्तेमाल करने में भी बेहद आसान है, चाहे आप नया फोन एजेंट सेट अप कर रहे हों या किसी दूसरे प्लेटफ़ॉर्म या कस्टम स्टैक से माइग्रेट कर रहे हों। ThunderPhone पर फोन एजेंट सेट अप करने के लिए बस यह करना ज़रूरी है:
- तय करें कि आप Spark, Bolt या Storm का इस्तेमाल करना चाहते हैं।
- एक आवाज़ चुनें।
- हमें अपना प्रॉम्प्ट दें। मल्टी-प्रॉम्प्ट एजेंट की ज़रूरत नहीं है! अगर आपका प्रॉम्प्ट Spark या Bolt के लिए बहुत जटिल है, तो Storm पर अपग्रेड करें, जो एक ही प्रॉम्प्ट के साथ जटिल यूज़ केस भी संभाल सकता है।
- बेहद आसान-से-इस्तेमाल विज़ार्ड के साथ सॉफ़्टवेयर इंटीग्रेशन (कोई भी एंडपॉइंट या नेटिव n8n इंटीग्रेशन) कनेक्ट करें।
- बेहद आसान-से-इस्तेमाल विज़ार्ड के साथ अपना VoIP कनेक्ट करें।
आमतौर पर यह सब 10 मिनट या उससे कम समय लेता है।
ThunderPhone HIPAA और GDPR के अनुरूप है, और अनुरोध पर हम BAA और DPA पर हस्ताक्षर करेंगे और उपलब्ध कराएँगे।
हमारी कहानी
हम Stanford AI Lab और Y Combinator के पूर्व छात्रों की एक टीम हैं, जो 2024 से वॉइस AI पर काम कर रही है। शुरुआत में हमारा फोकस Flux Interpreting पर था, जो अलग-अलग भाषाओं के बीच फोन कॉल का अनुवाद करता है। लेकिन ग्राहकों ने बार-बार हमसे कहा कि वे केवल कॉल का अनुवाद नहीं, बल्कि अपने व्यवसायों के लिए फोन कॉल ऑटोमेट करना चाहते हैं, इसलिए हमने अपना फोकस उस चीज़ पर शिफ्ट किया जो आज ThunderPhone है।
मौजूदा प्लेटफ़ॉर्म की समस्या
शुरुआत में, हमने अन्य कंपनियों के फोन AI प्लेटफ़ॉर्म पर ग्राहकों के लिए फोन एजेंट बनाना शुरू किया। हमने बाज़ार में मौजूद लगभग हर फोन AI प्लेटफ़ॉर्म को टेस्ट किया, लेकिन दुर्भाग्य से वे कमज़ोर पाए गए, खासकर इन मामलों में:
- ऑडियो समझना: यूज़र के ऑडियो को टेक्स्ट में बदलने के लिए सिर्फ़ एक ट्रांसक्रिप्शन मॉडल होने की सीमा का मतलब था कि AI अक्सर यूज़र को “गलत सुन” लेता था, खासकर प्रॉपर नाउन, असामान्य शब्दों और स्पेलिंग के मामले में।
- निर्देशों का पालन: कॉल के पीछे वास्तविक “ब्रेनवर्क” करने वाला सिर्फ़ एक तेज़ LLM होने का मतलब था कि AI अक्सर निर्देशों का सही ढंग से पालन करने में संघर्ष करते थे और पटरी से उतर जाते थे।
- मुश्किल इंटीग्रेशन: जिन प्लेटफ़ॉर्म को हमने आज़माया, वे बाहरी सॉफ़्टवेयर से कनेक्ट करना बहुत कठिन बनाते थे। आम तौर पर हमें टूल कॉल के लिए बड़े JSON कॉन्फ़िगरेशन टाइप करने पड़ते थे और बिना किसी या बहुत कम फीडबैक के उन्हें बार-बार आज़माना पड़ता था, जब तक कि वे अचानक काम न करने लगें।
- कीमत: मौजूदा प्लेटफ़ॉर्म आम तौर पर बहुत महंगे थे: औसत प्रदर्शन के लिए भी अक्सर 10 सेंट प्रति मिनट या उससे ज़्यादा।
अपना स्टैक बनाना
जब हमने एक एंटरप्राइज़ क्लाइंट के लिए सेल्स कॉल यूज़ केस लागू करने का सौदा साइन किया, तो उनकी ज़रूरतें पूरी करने के लिए हमें अपना कस्टम स्टैक बनाना पड़ा। यह यूज़ केस चुनौतीपूर्ण था: कस्टमर सपोर्ट के विपरीत, जहाँ कॉलर काफी हद तक व्यवसाय पर निर्भर होते हैं, सेल्स कॉलर तुरंत कॉल काट देते हैं।
लीड खोने के बजाय सेल पूरा करने के लिए कॉल क्वालिटी बेहतरीन होनी चाहिए। इसका मतलब था बड़ी संख्या में प्रॉपर नाउन और स्पेलिंग को संभालना, जिनमें नाम और पते शामिल हैं, जिन्हें स्टैंडर्ड ट्रांसक्रिप्शन मॉडल के लिए सही पहचानना मुश्किल होता है। इस यूज़ केस को पूरी तरह सही करने के लिए हमने वही बनाया जो आज ThunderPhone है।
इस दौरान, हम San Francisco वॉइस AI कम्युनिटी में ऐसे लोगों से लगातार मिले जो वर्टिकल फोन एजेंट कंपनियाँ बना रहे थे — पशु चिकित्सकों, ट्रक ड्राइवरों और अन्य के लिए। हैरानी की बात यह थी कि उनमें से अधिकतर की राय एक जैसी थी: मौजूदा प्लेटफ़ॉर्म डेमो के लिए काफी अच्छे थे, लेकिन प्रोडक्शन के लिए नहीं।
चौंकाने वाली बात यह थी कि वर्टिकल वॉइस AI कंपनियों में हमारे कई, अगर अधिकतर नहीं, दोस्त वास्तव में अपने स्टैक खुद बना रहे थे... यह हमें बिल्कुल समझ नहीं आया — यह वैसा ही है जैसे 90 के दशक में वेब स्टार्टअप्स को अपनी अलमारी में रखे सर्वर पर अपने वेब सर्वर खुद होस्ट करने पड़ते।
इस समझ के साथ, हमें एहसास हुआ कि अब समय आ गया है कि हम अपने फोन AI सिस्टम को ऐसे प्लेटफ़ॉर्म में बदलें जिसे कोई भी इस्तेमाल कर सके।
वर्टिकल वॉइस AI कंपनियों और कंसल्टेंट्स को अपनी इंडस्ट्री-विशेष विशेषज्ञता के साथ अपने टारगेट मार्केट की ज़रूरतें पूरी करने पर फोकस करने में सक्षम होना चाहिए — न कि मूल AI और फोन टेक्नोलॉजी को जटिल रूप से इंजीनियर करने पर! आज हम ThunderPhone के साथ यही लॉन्च कर रहे हैं।
यहाँ तक पहुँचने का सफर लंबा रहा है! पिछले अप्रैल से हमारे साथ साइन अप करने वाले और अब भी एक्सेस का इंतज़ार कर रहे सभी लोगों से माफ़ी: हमें लगा था कि काम पूरा करने के लिए यह एक तेज़ स्प्रिंट होगा, लेकिन यह कई महीनों की ऐसी यात्रा बन गई जिसमें हमें समझना पड़ा कि आज उपलब्ध मॉडलों को एक साथ कैसे जोड़ा जाए ताकि सिस्टम जितना संभव हो उतना मजबूत बने।
लेकिन अब हम आखिरकार लाइव हैं — इसे आज़माएँ और हमें बताएं कि आपको कैसा लगा!
हालाँकि हमने बड़ी समस्याएँ सुलझा ली हैं, फिर भी सिस्टम में कुछ बग ज़रूर हो सकते हैं। अगर आपको कोई समस्या मिलती है, तो कृपया alex@thunderphone.com पर ईमेल करें, और मैं सुनिश्चित करूँगा कि उसे आपके लिए जल्द से जल्द ठीक किया जाए। अगर आपके पास कोई फीचर रिक्वेस्ट हो, तो वह भी बताएं, और हम उन्हें भी जितनी जल्दी हो सके पूरा करेंगे।
और अगर आपकी ज़रूरतें अधिक कस्टम हैं, जैसे कस्टम इम्प्लीमेंटेशन और इंटीग्रेशन सपोर्ट, नियमित HIPAA और GDPR से आगे का कंप्लायंस, SLA, और कस्टम फीचर रिक्वेस्ट, तो हमें एंटरप्राइज़ डील पर बात करने में खुशी होगी। alex@thunderphone.com पर संपर्क करें, और हम आपकी ज़रूरतों और इस बारे में बात करेंगे कि हम कैसे मदद कर सकते हैं।
और व्यापक रूप से कहें तो: आपसे हमारी प्रतिबद्धता यह है कि ThunderPhone को आपकी ओर से न्यूनतम प्रयास के साथ तुरंत काम करना सुनिश्चित करना हमारा काम है, और आपके व्यवसाय की कॉल को आज के AI से जितना संभव हो उतना बेहतरीन ढंग से संभालना हमारा काम है, आपके चुने हुए मूल्य स्तर — Spark, Bolt, या Storm — की सीमाओं के भीतर। हमें आज़माएँ, और हम आपको यह दिखाने के लिए उत्साहित हैं कि ThunderPhone क्या कर सकता है।
हमें बताएं कि आप क्या सोचते हैं, और आपके समर्थन के लिए धन्यवाद!