ThunderPhone 2.0 اب لائیو ہے۔خود سیٹ اپ کریں، قیمت 2¢ فی منٹ سے شروع۔اعلان پڑھیں
تمام پوسٹس

ThunderPhone کا اعلان

10 مارچ، 2026Alex Kolchinski

تازہ کاری، اگست 2026: یہ مارچ 2026 کا ہمارا اصل لانچ اعلان ہے، جسے تاریخی ریکارڈ کے لیے برقرار رکھا گیا ہے۔ اس کے بعد سے کچھ تفصیلات — خاص طور پر قیمتیں اور وائس کے اختیارات — تبدیل ہو چکی ہیں؛ آج کی درست معلومات کے لیے موجودہ قیمتیں دیکھیں۔ اور انتظار ختم ہو گیا ہے: v2 کے لانچ کا اعلان پڑھیں!

آج ہمیں ThunderPhone کے عوامی لانچ کا اعلان کرتے ہوئے فخر ہے، جو AI کے ذریعے فون کالز کو خودکار بنانا آسان بناتا ہے۔ دیگر فون AI پلیٹ فارمز سے بالکل مختلف مربوط آرکیٹیکچر کے ساتھ، ThunderPhone نمایاں طور پر بہتر کارکردگی، کم لاگت، اور انٹیگریشن کی کم پیچیدگیاں فراہم کر سکتا ہے۔ ThunderPhone درجنوں زبانوں میں آنے والی اور جانے والی کالز کی معاونت کرتا ہے اور HIPAA اور GDPR کے مطابق ہے۔

مربوط نظام کا فائدہ

دیگر فون AI پلیٹ فارمز اپنے سسٹمز پر تین مرحلوں کی ساخت نافذ کر کے ان کی کارکردگی محدود کر دیتے ہیں:

  1. ایک ٹرانسکرپشن ماڈل، جو صارف کی آواز کو متن میں تبدیل کرتا ہے۔
  2. ایک LLM، جو صارف کے متن پر کارروائی کرتا ہے اور جواب تیار کرتا ہے۔
  3. ایک TTS ماڈل، جو جواب کے متن کو دوبارہ آڈیو میں تبدیل کرتا ہے۔

ان میں سے زیادہ تر اپنے صارفین کو یہ مجبور کر کے انجینئرنگ کا کام بھی منتقل کر دیتے ہیں کہ وہ خود منتخب کریں کہ کون سے ماڈلز استعمال کرنے ہیں، اور ساتھ ہی شور کم کرنے اور ردعمل کی رفتار جیسے کنفیگریشن کے اختیارات بھی طے کریں۔

ہم نے مختلف طریقہ اختیار کیا ہے: ہم نے آج کے ماڈلز کے ساتھ، ہماری رائے میں، بہترین ممکنہ اسٹیک تشکیل دیا ہے اور اسے پیچیدہ کنفیگریشن کی محنت کے بغیر استعمال کے لیے تیار کر دیا ہے۔ ہمارا نظام ایک ہی وقت میں بہت سے ماڈلز استعمال کرتا ہے، اور گفتگو کے بہاؤ کے مطابق ذہانت سے ان کے درمیان راستہ طے کرتا ہے۔ اس میں شامل ہے:

  • متعدد ٹرانسکرپشن ماڈلز کو یکجا کرنا، جن میں کچھ دوسروں سے تیز اور کچھ دوسروں سے زیادہ درست ہوتے ہیں، تاکہ رفتار اور درستگی میں توازن رکھا جائے اور ایک دوسرے کی غلطیوں کا ازالہ ہو سکے۔
  • آڈیو ان پٹ LLMs، جن کی عمومی ذہانت کم لیکن آڈیو سمجھنے کی صلاحیت بہتر ہو سکتی ہے، کو صرف متن والے LLMs کے ساتھ یکجا کرنا، جو غلط ٹرانسکرپٹس کی وجہ سے غلطیاں کر سکتے ہیں مگر عموماً زیادہ ذہین ہوتے ہیں۔
  • تیز مگر کم ذہین LLMs، جو فوری جوابات تیار کر سکتے ہیں، کو بہت زیادہ ذہین مگر سست LLMs کے ساتھ یکجا کرنا، جو پس منظر میں چل سکتے ہیں اور یقینی بنا سکتے ہیں کہ AI اپنے prompt پر عمل کر رہا ہے اور صارف کی بات کا درست جواب دے رہا ہے۔
  • OpenAI اور Google سمیت اعلیٰ فراہم کنندگان کے تجارتی ماڈلز، جو آج دستیاب سب سے زیادہ ذہانت پیش کرتے ہیں، کو اوپن سورس ماڈلز کے وسیع مجموعے کے ساتھ یکجا کرنا، جو اکثر کم لاگت پر بہتر رفتار فراہم کرتے ہیں۔
  • پس منظر کے شور، ضمنی گفتگوؤں، اور دیگر توجہ بٹانے والے شور کو درجہ بند کرنے اور ختم کرنے کے لیے بیک وقت متعدد ماڈلز استعمال کرنا، جو بصورت دیگر گفتگو کو پٹڑی سے اتار سکتے ہیں۔

یہ اجزا اور مزید خصوصیات ہماری تین سروس سطحوں، Spark، Bolt، اور Storm، میں مختلف طریقوں سے ترتیب دیے گئے ہیں — Spark کو لاگت، Bolt کو رفتار، اور Storm کو ذہانت کے لیے بہتر بناتے ہوئے، اور ہر ایک کی خامیوں کو جتنا ممکن ہو کم کرتے ہوئے۔ تینوں سسٹمز میں ایسے فوائد مشترک ہیں جیسے صارفین کی بات کو انتہائی درستگی سے سمجھنا، حتیٰ کہ اسمائے خاص اور ہجوں کے ساتھ بھی۔

ہمیں معلوم ہوا ہے کہ یہ مضبوطی سے مربوط آرکیٹیکچر ہمارے سسٹم کو دیگر فراہم کنندگان کے پیش کردہ سخت تین مرحلوں والے طریقے کے مقابلے میں کم لاگت پر کہیں زیادہ کارکردگی دیتا ہے۔ کلیٹن کرسٹنسن کے ماڈیولرٹی کے نظریے کے مطابق، وائس AI ابھی ابتدائی مرحلے میں ہے، اور ماڈیولر آرکیٹیکچر کے ذریعے حسبِ ضرورت بنانے کی صلاحیت کو زیادہ سے زیادہ کرنے کے بجائے مربوط آرکیٹیکچر کے ذریعے کارکردگی کو زیادہ سے زیادہ کرنا اب بھی زیادہ قیمتی ہے۔

بہتر بنائے گئے فیصلے

اور جہاں تک تخصیص پذیری کا تعلق ہے، ہم اس کے حق میں نہیں ہیں! آج کے زیادہ تر فون AI پلیٹ فارمز صارفین کو لامتناہی انتخابوں میں الجھنے پر مجبور کرتے ہیں، استعمال ہونے والے عین ماڈلز سے لے کر اس قدر تفصیلی پیرامیٹرز تک کہ AI صارف کی بات کتنی جلدی کاٹے۔

ہمارے خیال میں، پردۂ پس منظر میں ان انتخابوں کو بہتر بنانا ہماری ذمہ داری ہے تاکہ ThunderPhone کے صارفین اس کام پر توجہ دے سکیں جس میں وہ مہارت رکھتے ہیں اور تفصیلی وائس AI کنفیگریشن کی فکر نہ کریں۔ ہم خود کو کسی حد تک Squarespace کی طرح سمجھتے ہیں، جو ہمارے صارفین کے لیے آج کے ماڈلز کے ساتھ ممکنہ طور پر اعلیٰ ترین کارکردگی والے فون ایجنٹس ترتیب دینا آسان بناتا ہے، بغیر کوئی اضافی محنت کیے۔

استعمال میں آسانی

ThunderPhone استعمال میں بھی انتہائی آسان ہے، چاہے آپ نیا فون ایجنٹ ترتیب دے رہے ہوں، یا کسی دوسرے پلیٹ فارم یا کسٹم اسٹیک سے منتقل ہو رہے ہوں۔ ThunderPhone پر فون ایجنٹ ترتیب دینے کے لیے آپ کو صرف یہ کرنا ہوتا ہے:

  1. فیصلہ کریں کہ آپ Spark، Bolt، یا Storm میں سے کون سا استعمال کرنا چاہتے ہیں۔
  2. ایک آواز منتخب کریں۔
  3. ہمیں اپنا prompt دیں۔ ملٹی-prompt ایجنٹس کی ضرورت نہیں! اگر آپ کا prompt Spark یا Bolt کے لیے بہت پیچیدہ ہے، تو Storm پر اپ گریڈ کریں، جو ایک ہی prompt کے ساتھ پیچیدہ استعمال کے معاملات بھی سنبھال سکتا ہے۔
  4. انتہائی آسان وزرڈ کے ذریعے سافٹ ویئر انٹیگریشنز (کوئی بھی endpoint، یا مقامی n8n انٹیگریشن) منسلک کریں۔
  5. انتہائی آسان وزرڈ کے ذریعے اپنا VoIP منسلک کریں۔

یہ سب عموماً 10 منٹ یا اس سے کم وقت لیتا ہے۔

ThunderPhone HIPAA اور GDPR کے تقاضوں کے مطابق ہے، اور درخواست پر ہم BAA اور DPA پر دستخط کریں گے اور فراہم کریں گے۔

ہماری کہانی

ہم Stanford AI Lab اور Y Combinator کے سابق اراکین پر مشتمل ایک ٹیم ہیں جو 2024 سے وائس AI پر کام کر رہی ہے۔ ابتدا میں ہماری توجہ Flux Interpreting پر تھی، جو مختلف زبانوں کے درمیان فون کالز کا ترجمہ کرتا ہے۔ لیکن جب صارفین نے ہم سے بار بار صرف ترجمہ کرنے کے بجائے اپنے کاروبار کے لیے فون کالز خودکار بنانے کی درخواست کی، تو ہم نے اپنی توجہ اس چیز کی طرف منتقل کر دی جو آج ThunderPhone ہے۔

موجودہ پلیٹ فارمز کا مسئلہ

ابتدا میں، ہم نے دیگر کمپنیوں کے فون AI پلیٹ فارمز پر صارفین کے لیے فون ایجنٹس بنانا شروع کیے۔ ہم نے مارکیٹ میں موجود تقریباً ہر فون AI پلیٹ فارم آزمایا، لیکن بدقسمتی سے وہ ناکافی ثابت ہوئے، خاص طور پر ان معاملات میں:

  • آڈیو کی سمجھ: صارف کی آڈیو کو متن میں تبدیل کرنے کے لیے صرف ایک ٹرانسکرپشن ماڈل کی حد بندی کا مطلب یہ تھا کہ AI اکثر صارف کو “غلط سن” لیتا تھا، خاص طور پر اسمائے خاص، غیر عام الفاظ، اور ہجے کے معاملے میں۔
  • ہدایات پر عمل: کال کے پیچھے اصل “ذہنی کام” کرنے والا صرف ایک تیز LLM ہونے کی وجہ سے AI اکثر ہدایات پر درست طور پر عمل کرنے میں دشواری محسوس کرتے تھے اور راستے سے ہٹ جاتے تھے۔
  • مشکل انٹیگریشنز: جن پلیٹ فارمز کو ہم نے آزمایا، ان میں بیرونی سافٹ ویئر سے جڑنا بہت مشکل تھا۔ عموماً ہمیں ٹول کالز کے لیے طویل JSON کنفیگریشنز لکھنی پڑتی تھیں اور بہت کم یا کوئی فیڈبیک ملے بغیر انہیں بار بار آزمانا پڑتا تھا، یہاں تک کہ وہ اچانک کام کرنا شروع کر دیتیں۔
  • قیمت: موجودہ پلیٹ فارمز عموماً بہت زیادہ قیمت لیتے تھے: اوسط درجے کی کارکردگی کے لیے بھی عام طور پر 10 سینٹ فی منٹ یا اس سے زیادہ۔

اپنا اسٹیک بنانا

جب ہم نے ایک انٹرپرائز کلائنٹ کے لیے سیلز کال کے استعمال کے منظرنامے کو نافذ کرنے کا معاہدہ کیا، تو ان کی ضروریات پوری کرنے کے لیے ہمیں اپنا مخصوص اسٹیک بنانا پڑا۔ یہ استعمال کا منظرنامہ سخت تقاضوں والا تھا: کسٹمر سپورٹ کے برعکس، جہاں کال کرنے والے بڑی حد تک کاروبار کے رحم و کرم پر ہوتے ہیں، سیلز کال کرنے والے جلدی کال منقطع کر دیتے ہیں۔

لیڈ کھونے کے بجائے فروخت مکمل کرنے کے لیے کال کا معیار بہترین ہونا ضروری ہے۔ اس کا مطلب ایسے بہت سے اسمائے خاص اور ہجوں کو سنبھالنا تھا، جن میں نام اور پتے شامل ہیں، جنہیں درست سمجھنا عام ٹرانسکرپشن ماڈلز کے لیے مشکل ہوتا ہے۔ اس استعمال کے منظرنامے کو بہترین بنانے کے لیے، ہم نے وہ چیز بنائی جو آج ThunderPhone ہے۔

اس دوران، ہماری San Francisco کی وائس AI کمیونٹی میں ایسے لوگوں سے ملاقات ہوتی رہی جو مخصوص شعبوں کے لیے فون ایجنٹ کمپنیاں بنا رہے تھے — جانوروں کے ڈاکٹروں، ٹرک ڈرائیورز، اور مزید کے لیے۔ حیرت انگیز طور پر، ان میں سے زیادہ تر کی ایک ہی رائے تھی: موجودہ پلیٹ فارمز ڈیموز کے لیے کافی اچھے تھے، مگر پروڈکشن کے لیے نہیں۔

حیرت انگیز طور پر، مخصوص شعبوں کی وائس AI کمپنیوں میں ہمارے بہت سے، اگر زیادہ تر نہیں، دوست دراصل “اپنا اسٹیک خود بنا رہے تھے”... یہ ہمارے لیے بے معنی تھا — یہ بالکل ایسا ہی ہے جیسے 90 کی دہائی میں ویب اسٹارٹ اپس کو اپنی الماری میں موجود سرور پر اپنے ویب سرورز خود ہوسٹ کرنے پڑتے۔

اس سمجھ کے ساتھ، ہمیں احساس ہوا کہ اب وقت آ گیا ہے کہ ہم اپنے فون AI سسٹم کو ایک ایسے پلیٹ فارم میں تبدیل کریں جسے کوئی بھی استعمال کر سکے۔

مخصوص شعبوں کی وائس AI کمپنیاں اور کنسلٹنٹس کو اپنی صنعت سے متعلق مہارت کے ذریعے اپنی ہدف مارکیٹ کی ضروریات پوری کرنے پر توجہ مرکوز کرنے کے قابل ہونا چاہیے — بنیادی AI اور فون ٹیکنالوجی کو پیچیدگی سے انجینئر کرنے پر نہیں! آج ہم ThunderPhone کے ساتھ یہی لانچ کر رہے ہیں۔

یہاں تک پہنچنے کا سفر طویل رہا ہے! گزشتہ اپریل سے ہمارے ساتھ سائن اپ کرنے والے اور اب بھی رسائی کے منتظر تمام لوگوں سے معذرت: جس کام کو مکمل کرنے کے لیے ہم نے ایک مختصر مرحلہ سمجھا تھا، وہ کئی ماہ پر مشتمل ایک سفر ثابت ہوا، جس میں یہ جاننا شامل تھا کہ آج دستیاب ماڈلز کو ایک ایسے سسٹم میں کیسے جوڑا جائے جو ممکنہ حد تک مضبوط ہو۔

لیکن اب ہم آخرکار لائیو ہیں — اسے آزمائیں اور دیکھیں کہ آپ کیا سوچتے ہیں!

اگرچہ ہم نے بڑی مشکلات دور کر لی ہیں، لیکن سسٹم میں اب بھی کچھ بگز ضرور ہو سکتے ہیں۔ اگر آپ کو کوئی مسئلہ ملے تو براہ کرم alex@thunderphone.com پر ای میل کریں، اور میں یقینی بناؤں گا کہ اسے آپ کے لیے جلد از جلد ٹھیک کر دیا جائے۔ اگر آپ کے پاس کسی فیچر کی درخواست ہو تو وہ بھی بتائیں، اور ہم انہیں بھی جتنی جلد ممکن ہو آپ کے لیے ممکن بنائیں گے۔

اور اگر آپ کی مزید مخصوص ضروریات ہیں، جیسے کسٹم نفاذ اور انٹیگریشن سپورٹ، معمول کے HIPAA اور GDPR سے آگے کی کمپلائنس، SLAs، اور کسٹم فیچر کی درخواستیں، تو ہم انٹرپرائز معاہدے پر بات کرنے میں خوش ہوں گے۔ alex@thunderphone.com پر رابطہ کریں، اور ہم آپ کی ضروریات اور یہ کہ آیا ہم مدد کر سکتے ہیں، پر بات کریں گے۔

اور عمومی طور پر: آپ سے ہمارا عہد یہ ہے کہ یہ ہمارا کام ہے کہ ThunderPhone آپ کی کم سے کم کوشش کے ساتھ فوراً کام کرے، اور آپ کے کاروبار کی کالز کو آج کے AI کے ذریعے ممکنہ حد تک بہترین انداز میں سنبھالے، اس قیمت کی سطح کی حدود کے اندر جو بھی آپ Spark، Bolt، یا Storm میں سے منتخب کریں۔ ہمیں آزمائیں، اور ہم آپ کو یہ دکھانے کے لیے پُرجوش ہیں کہ ThunderPhone کیا کر سکتا ہے۔

ہمیں بتائیں کہ آپ کیا سوچتے ہیں، اور آپ کی حمایت کا شکریہ!