ThunderPhone 2.0 এখন লাইভ।নিজেই শুরু করুন, খরচ মিনিটে 2¢ থেকে।ঘোষণাটি পড়ুন
সব পোস্ট

ThunderPhone ঘোষণা করছি

১০ মার্চ, ২০২৬Alex Kolchinski

আপডেট, আগস্ট 2026: এটি মার্চ 2026-এর আমাদের মূল উদ্বোধনী ঘোষণা, স্মৃতির জন্য রাখা হয়েছে। এরপর থেকে কিছু বিবরণ — বিশেষ করে মূল্য ও ভয়েস বিকল্প — বদলেছে; আজকের সঠিক তথ্যের জন্য বর্তমান মূল্য দেখুন। আর অপেক্ষার অবসান হয়েছে: v2 উদ্বোধনী ঘোষণা পড়ুন!

আজ, আমরা গর্বের সঙ্গে ThunderPhone-এর সর্বজনীন উদ্বোধন ঘোষণা করছি, যা AI দিয়ে ফোনকল স্বয়ংক্রিয় করা সহজ করে। অন্যান্য ফোন AI প্ল্যাটফর্মের তুলনায় সম্পূর্ণ ভিন্ন সমন্বিত আর্কিটেকচারের কারণে, ThunderPhone অনেক বেশি পারফরম্যান্স, কম খরচ এবং কম ইন্টিগ্রেশন-সংক্রান্ত ঝামেলা দিতে পারে। ThunderPhone কয়েক ডজন ভাষায় ইনবাউন্ড ও আউটবাউন্ড কল সমর্থন করে এবং HIPAA ও GDPR-সম্মত।

সমন্বিত সুবিধা

অন্যান্য ফোন AI প্ল্যাটফর্ম তাদের সিস্টেমে 3-ধাপের কাঠামো বাধ্যতামূলক করে পারফরম্যান্স সীমিত করে:

  1. একটি ট্রান্সক্রিপশন মডেল, যা ব্যবহারকারীর ভয়েসকে টেক্সটে রূপান্তর করে।
  2. একটি LLM, যা ব্যবহারকারীর টেক্সট প্রক্রিয়াকরণ করে এবং একটি উত্তর তৈরি করে।
  3. একটি TTS মডেল, যা উত্তরের টেক্সটকে আবার অডিওতে রূপান্তর করে।

এদের বেশিরভাগই ব্যবহারকারীদের ওপর ইঞ্জিনিয়ারিংয়ের কাজ চাপিয়ে দেয়—কোন মডেল ব্যবহার করবেন তা বেছে নিতে বাধ্য করার পাশাপাশি ডিনয়েজিং ও প্রতিক্রিয়াশীলতার প্যারামিটারের মতো কনফিগারেশন বিকল্পও নির্ধারণ করতে হয়।

আমরা ভিন্ন পদ্ধতি নিয়েছি: আজকের মডেলগুলো দিয়ে আমাদের মতে সম্ভাব্য সেরা স্ট্যাক কনফিগার করেছি এবং জটিল কনফিগারেশনের পরিশ্রম ছাড়াই ব্যবহারের জন্য প্রস্তুত করেছি। আমাদের সিস্টেম একই সময়ে অনেক মডেল ব্যবহার করে এবং কথোপকথনের গতিপ্রবাহ অনুযায়ী বুদ্ধিমত্তার সঙ্গে তাদের মধ্যে রাউট করে। এর মধ্যে রয়েছে:

  • একাধিক ট্রান্সক্রিপশন মডেল একত্র করা—কিছু অন্যগুলোর চেয়ে দ্রুত, কিছু অন্যগুলোর চেয়ে বেশি নির্ভুল—যাতে গতি ও নির্ভুলতার ভারসাম্য থাকে এবং তারা একে অপরের ভুল সামলাতে পারে।
  • অডিও-ইনপুট LLM, যেগুলোর সাধারণ বুদ্ধিমত্তা কম হলেও অডিও বোঝার ক্ষমতা ভালো হতে পারে, সেগুলোকে শুধু-টেক্সট LLM-এর সঙ্গে একত্র করা; শুধু-টেক্সট LLM ভুল ট্রান্সক্রিপ্ট থেকে ভুল করতে পারে, কিন্তু প্রায়ই বেশি বুদ্ধিমান।
  • দ্রুত কিন্তু কম বুদ্ধিমান LLM, যা দ্রুত উত্তর তৈরি করতে পারে, সেগুলোকে অনেক বেশি বুদ্ধিমান কিন্তু ধীর LLM-এর সঙ্গে একত্র করা; ধীর মডেলগুলো ব্যাকগ্রাউন্ডে চলতে পারে এবং নিশ্চিত করতে পারে যে AI তার prompt অনুসরণ করছে ও ব্যবহারকারী যা বলেন তার সঠিক উত্তর দিচ্ছে।
  • OpenAI ও Google-সহ শীর্ষ প্রদানকারীদের বাণিজ্যিক মডেল, যা আজ উপলভ্য সর্বোচ্চ বুদ্ধিমত্তা দেয়, সেগুলোকে বিস্তৃত ওপেন-সোর্স মডেলের সঙ্গে একত্র করা; ওপেন-সোর্স মডেল প্রায়ই কম খরচে ভালো গতি দেয়।
  • ব্যাকগ্রাউন্ডের শব্দ, পাশের কথোপকথন এবং অন্যান্য বিভ্রান্তিকর শব্দ শ্রেণিবদ্ধ ও দূর করতে একসঙ্গে একাধিক মডেল ব্যবহার করা, যা অন্যথায় একটি কথোপকথনকে বিপথে নিতে পারে।

এই উপাদানগুলো এবং আরও অনেক কিছু আমাদের তিনটি সেবা স্তর—Spark, Bolt ও Storm-এ ভিন্ন ভিন্ন উপায়ে অর্কেস্ট্রেট করা হয়। এতে Spark খরচের জন্য, Bolt গতির জন্য এবং Storm বুদ্ধিমত্তার জন্য অপ্টিমাইজ করা হয়, পাশাপাশি প্রতিটির সীমাবদ্ধতা যতটা সম্ভব কমানো হয়। তিনটি সিস্টেমই ব্যবহারকারীরা যা বলেন তা অবিশ্বাস্য নির্ভুলতায় বোঝার মতো সুবিধা ভাগ করে, এমনকি ব্যক্তিনাম ও বানান থাকলেও।

আমরা দেখি যে এই নিবিড়ভাবে সমন্বিত আর্কিটেকচার অন্য বিক্রেতাদের দেওয়া কঠোর 3-ধাপের পদ্ধতির তুলনায় কম খরচে আমাদের সিস্টেমকে অনেক বেশি পারফরম্যান্স দেয়। Clay Christensen-এর মডুলারিটি তত্ত্বের সঙ্গে সামঞ্জস্য রেখে, ভয়েস AI এখনও প্রাথমিক পর্যায়ে রয়েছে, এবং মডুলার আর্কিটেকচারের মাধ্যমে কাস্টমাইজযোগ্যতা সর্বোচ্চ করার চেয়ে সমন্বিত আর্কিটেকচারের মাধ্যমে পারফরম্যান্স সর্বোচ্চ করা এখনও বেশি মূল্যবান।

অপ্টিমাইজ করা সিদ্ধান্ত

আর কাস্টমাইজযোগ্যতার ক্ষেত্রে, আমরা এর বিপক্ষে। আজকের অধিকাংশ ফোন AI প্ল্যাটফর্ম ব্যবহারকারীদের অসংখ্য বিকল্পের মধ্যে যেতে বাধ্য করে—ব্যবহৃত সুনির্দিষ্ট মডেল থেকে শুরু করে AI কত দ্রুত ব্যবহারকারীকে বাধা দেবে, এমন অতিবিস্তারিত প্যারামিটার পর্যন্ত।

আমাদের মতে, পর্দার আড়ালে এই পছন্দগুলো অপ্টিমাইজ করা আমাদেরই কাজ, যাতে ThunderPhone-এর ব্যবহারকারীরা যেটিতে ভালো, সেটিতে মনোযোগ দিতে পারেন এবং বিস্তারিত ভয়েস AI কনফিগারেশন নিয়ে চিন্তা করতে না হয়। আমরা নিজেদেরকে এক ধরনের Squarespace হিসেবে দেখি, যা আমাদের ব্যবহারকারীদের জন্য আজকের মডেলগুলোর মাধ্যমে সম্ভব সর্বোচ্চ পারফরম্যান্সে ফোন এজেন্ট সেট আপ করা সহজ করে তোলে—কোনো পরিশ্রম ছাড়াই।

ব্যবহার সহজতা

ThunderPhone ব্যবহার করাও অত্যন্ত সহজ—আপনি নতুন ফোন এজেন্ট সেট আপ করুন, অন্য কোনো প্ল্যাটফর্ম থেকে মাইগ্রেট করুন, বা কাস্টম স্ট্যাক থেকে আসুন। ThunderPhone-এ ফোন এজেন্ট সেট আপ করতে শুধু যা করতে হবে:

  1. আপনি Spark, Bolt, নাকি Storm ব্যবহার করতে চান, তা ঠিক করুন।
  2. একটি ভয়েস বেছে নিন।
  3. আমাদের আপনার prompt দিন। একাধিক-prompt এজেন্টের প্রয়োজন নেই। আপনার prompt যদি Spark বা Bolt-এর জন্য অতিরিক্ত জটিল হয়, তাহলে Storm-এ আপগ্রেড করুন, যা একটি মাত্র prompt দিয়েই জটিল ব্যবহারের ক্ষেত্র সামলাতে পারে।
  4. অত্যন্ত সহজে ব্যবহারযোগ্য উইজার্ড দিয়ে সফটওয়্যার ইন্টিগ্রেশন (যেকোনো endpoint, অথবা নেটিভ n8n ইন্টিগ্রেশন) সংযুক্ত করুন।
  5. অত্যন্ত সহজে ব্যবহারযোগ্য উইজার্ড দিয়ে আপনার VoIP সংযুক্ত করুন।

এসব সাধারণত 10 মিনিট বা তার কম সময় নেয়।

ThunderPhone HIPAA এবং GDPR অনুগত, এবং অনুরোধের ভিত্তিতে আমরা BAA ও DPA স্বাক্ষর করে প্রদান করব।

আমাদের গল্প

আমরা Stanford AI Lab এবং Y Combinator-এর প্রাক্তন সদস্যদের একটি দল, যারা 2024 সাল থেকে ভয়েস AI নিয়ে কাজ করছি। শুরুতে আমাদের মূল লক্ষ্য ছিল Flux Interpreting, যা বিভিন্ন ভাষার মধ্যে ফোন কল অনুবাদ করে। কিন্তু গ্রাহকেরা বারবার শুধু অনুবাদের বদলে তাঁদের ব্যবসার ফোন কল স্বয়ংক্রিয় করার অনুরোধ করায়, আমরা এখনকার ThunderPhone-এর দিকে মনোযোগ সরিয়ে নিই।

বিদ্যমান প্ল্যাটফর্মগুলোর সমস্যা

শুরুতে আমরা অন্যান্য কোম্পানির ফোন AI প্ল্যাটফর্মে গ্রাহকদের জন্য ফোন এজেন্ট তৈরি করতাম। বাজারের প্রায় সব ফোন AI প্ল্যাটফর্মই আমরা পরীক্ষা করেছি, কিন্তু দুর্ভাগ্যবশত সেগুলোতে ঘাটতি পেয়েছি, বিশেষ করে এই ক্ষেত্রগুলোতে:

  • অডিও বোঝাপড়া: ব্যবহারকারীর অডিওকে টেক্সটে রূপান্তরের জন্য মাত্র একটি ট্রান্সক্রিপশন মডেলের সীমাবদ্ধতার কারণে AI প্রায়ই ব্যবহারকারীকে “ভুল শুনত”, বিশেষ করে ব্যক্তিনাম, অপ্রচলিত শব্দ ও বানানের ক্ষেত্রে।
  • নির্দেশনা অনুসরণ: কলের পেছনের আসল “মস্তিষ্কের কাজ” একটি দ্রুত LLM করার কারণে AI-গুলো প্রায়ই সঠিকভাবে নির্দেশনা অনুসরণ করতে হিমশিম খেত এবং নিয়ন্ত্রণের বাইরে চলে যেত।
  • কঠিন ইন্টিগ্রেশন: আমরা যেসব প্ল্যাটফর্ম চেষ্টা করেছি, সেগুলোতে বাহ্যিক সফটওয়্যারের সঙ্গে সংযোগ করা খুব কঠিন ছিল। সাধারণত টুল কলের জন্য দীর্ঘ JSON কনফিগারেশন লিখতে হতো এবং কোনো প্রতিক্রিয়া ছাড়াই বারবার সেগুলো নিয়ে কাজ করতে হতো, যতক্ষণ না হঠাৎ করে সেগুলো কাজ শুরু করত।
  • মূল্য: বিদ্যমান প্ল্যাটফর্মগুলো সাধারণত অত্যন্ত বেশি মূল্য নিত: মাঝারি মানের পারফরম্যান্সের জন্য সাধারণত প্রতি মিনিটে 10 সেন্ট বা তার বেশি।

নিজেদের স্ট্যাক তৈরি করা

একটি এন্টারপ্রাইজ গ্রাহকের জন্য বিক্রয় কলের একটি ব্যবহারিক ক্ষেত্র বাস্তবায়নের চুক্তি করার পর, তাঁদের চাহিদা পূরণে আমাদের নিজেদের কাস্টম স্ট্যাক তৈরি করতে হয়। এই ব্যবহারিক ক্ষেত্রটি ছিল কঠিন: কাস্টমার সাপোর্টের বিপরীতে, যেখানে কলাররা মূলত ব্যবসার ওপর নির্ভরশীল থাকেন, বিক্রয় কলাররা খুব দ্রুত কল কেটে দেন।

লিড হারানোর বদলে বিক্রয় সম্পন্ন করতে কলের মান অবশ্যই সর্বোচ্চ হতে হবে। এর অর্থ ছিল নাম ও ঠিকানাসহ বিপুলসংখ্যক ব্যক্তিনাম ও বানান সামলানো, যা সাধারণ ট্রান্সক্রিপশন মডেলগুলোর জন্য সঠিকভাবে বোঝা কঠিন। এই ব্যবহারিক ক্ষেত্রটি নিখুঁত করতে আমরা তৈরি করেছি আজকের ThunderPhone।

এই সময়ে San Francisco-এর ভয়েস AI কমিউনিটিতে আমরা এমন অনেকের সঙ্গে পরিচিত হয়েছি, যারা পশুচিকিৎসক, ট্রাকচালক এবং আরও নানা ক্ষেত্রের জন্য উল্লম্ব ফোন এজেন্ট কোম্পানি তৈরি করছিলেন। বিস্ময়করভাবে, তাঁদের বেশিরভাগেরই একই মত ছিল: বিদ্যমান প্ল্যাটফর্মগুলো ডেমোর জন্য যথেষ্ট ভালো, কিন্তু প্রোডাকশনের জন্য নয়।

বিস্ময়করভাবে, উল্লম্ব ভয়েস AI কোম্পানিতে থাকা আমাদের অনেক, যদি বেশিরভাগ না-ও হয়, বন্ধু আসলে নিজেদের স্ট্যাকই তৈরি করছিলেন... আমাদের কাছে এর কোনো অর্থই হয়নি — এটি অনেকটা এমন, যেন 90-এর দশকের ওয়েব স্টার্টআপগুলোকে নিজেদের আলমারির ভেতরের একটি সার্ভারে নিজেদের ওয়েব সার্ভার হোস্ট করতে হতো।

এই উপলব্ধি থেকে আমরা বুঝলাম, আমাদের ফোন AI সিস্টেমকে এমন একটি প্ল্যাটফর্মে রূপ দেওয়ার সময় এসেছে যা যে কেউ ব্যবহার করতে পারবেন।

উল্লম্ব ভয়েস AI কোম্পানি ও পরামর্শদাতাদের তাঁদের শিল্পভিত্তিক দক্ষতা দিয়ে লক্ষ্যবাজারের চাহিদা পূরণে মনোযোগ দিতে পারা উচিত — ভিত্তির AI ও ফোন প্রযুক্তিকে জটিলভাবে প্রকৌশল করার দিকে নয়! আজ ThunderPhone-এর মাধ্যমে আমরা সেটিই চালু করছি।

এখানে পৌঁছাতে দীর্ঘ পথ পাড়ি দিতে হয়েছে! গত এপ্রিল থেকে যাঁরা আমাদের সঙ্গে নিবন্ধন করেছেন এবং এখনো অ্যাক্সেসের অপেক্ষায় আছেন, তাঁদের সবার কাছে ক্ষমাপ্রার্থী: কাজটি শেষ করার জন্য যেটিকে আমরা দ্রুত একটি ছোট দৌড় ভেবেছিলাম, সেটি আসলে বহু মাসের এক যাত্রায় পরিণত হয়েছিল—আজ উপলব্ধ মডেলগুলোকে কীভাবে একত্রে বুনে যতটা সম্ভব শক্তিশালী একটি সিস্টেম তৈরি করা যায়, তা বের করতে।

কিন্তু অবশেষে আমরা এখন লাইভ — একবার চেষ্টা করে দেখুন এবং আপনার মতামত জানান!

বড় সমস্যাগুলো সমাধান করলেও, সিস্টেমে এখনো কিছু বাগ থাকার সম্ভাবনা অবশ্যই আছে। কোনো সমস্যা পেলে অনুগ্রহ করে alex@thunderphone.com-এ ইমেইল করুন, আর আমি নিশ্চিত করব যেন আপনার জন্য তা ASAP ঠিক করা হয়। আপনার কোনো ফিচার অনুরোধ থাকলেও জানাবেন, আমরা যত দ্রুত সম্ভব সেগুলোও বাস্তবায়ন করব।

আর আপনার যদি আরও কাস্টম চাহিদা থাকে, যেমন কাস্টম বাস্তবায়ন ও ইন্টিগ্রেশন সহায়তা, নিয়মিত HIPAA ও GDPR-এর বাইরের কমপ্লায়েন্স, SLA এবং কাস্টম ফিচার অনুরোধ, তাহলে এন্টারপ্রাইজ চুক্তি নিয়ে কথা বলতে আমরা আনন্দিত। alex@thunderphone.com-এ যোগাযোগ করুন, আমরা আপনার চাহিদা এবং কীভাবে সহায়তা করতে পারি তা নিয়ে কথা বলব।

আরও সাধারণভাবে বললে: আপনার প্রতি আমাদের অঙ্গীকার হলো, আপনার ন্যূনতম প্রচেষ্টায় ThunderPhone যেন বাক্স খুলেই কাজ করে এবং আপনি যে মূল্যস্তরই বেছে নিন—Spark, Bolt বা Storm—তার সীমার মধ্যে আজকের AI দিয়ে যতটা সম্ভব নিখুঁতভাবে আপনার ব্যবসার কল সামলানো নিশ্চিত করা আমাদের দায়িত্ব। আমাদের একবার চেষ্টা করে দেখুন, ThunderPhone কী করতে পারে তা আপনাকে দেখাতে আমরা উচ্ছ্বসিত।

আপনার মতামত জানান, আর আপনার সমর্থনের জন্য ধন্যবাদ!