મોટાભાગના ઑટોમેટેડ ફોન કૉલ બેકાર હોય છે. નવી ટેક્નોલોજી આ સ્થિતિ બદલે છે.
અગાઉ સમસ્યા એ નહોતી કે ફોન ઑટોમેશનનો અવાજ સુખદ ન હતો. વાસ્તવિક વાતચીતને આગળ ધપાવવા જેટલી સમજ તેમાં નહોતી.
ફોન કૉલને ઑટોમેટ કરવું વધુ સરળ બનતું જાય છે.
દરેક પેઢી વાતચીતનો વધુ સંદર્ભ મશીનને સોંપે છે.
કૉલ કરનારે મશીન સમજે એવી ભાષામાં બોલવું પડતું.
02શરૂઆતનું AIસિસ્ટમ મર્યાદિત દાયરામાં જ સમજતી—એની બહાર વાત જાય એટલે નિષ્ફળ જતી.
033-તબક્કાની પાઇપલાઇનસ્ટૅક લવચીક બન્યો, પણ દરેક તબક્કો તેની પહેલાંના તબક્કાને સાચો જ માનીને ચાલતો રહ્યો.
04ThunderPhoneસિસ્ટમ એક જ લૂપમાં સાંભળી, તર્ક કરી અને ભૂલ સુધારીને આગળ વધી શકે છે.
કૉલ કરનારે મશીન સમજે એવી ભાષામાં બોલવું પડતું.
ત્યારે ઑટોમેશન એટલે મેનુ, કીપેડના વિકલ્પો અને ક્યૂ. કૉલરને સાચો રસ્તો પહેલેથી ખબર હોય, ત્યારે જ એ કામ કરતું.
કૉલરનો આખો ઇન્ટેન્ટ એક બટન દબાવવામાં સમેટાઈ જાય છે; એટલે મેનુની બહારની કોઈ પણ વાતમાં કૉલ ટ્રાન્સફર થાય છે અથવા કૉલરે એ જ વાત ફરી કહેવી પડે છે.
પરિણામ · કૉલર અંદાજે વિકલ્પ પસંદ કરે છે, રાહ જુએ છે અને એ જ વાત ફરીથી સમજાવે છે.
સિસ્ટમ મર્યાદિત દાયરામાં જ સમજતી—એની બહાર વાત જાય એટલે નિષ્ફળ જતી.
ટીમોએ ચોક્કસ કૉલ ફ્લો માટે અકાઉસ્ટિક મોડલ, ઇન્ટેન્ટ ક્લાસિફાયર અને સ્લૉટ એક્સ્ટ્રેક્ટર ટ્રેઇન કર્યાં. આ પદ્ધતિ ઉપયોગી હતી, પણ તેમાં ફેરફાર કરવો ખર્ચાળ હતો.
સિસ્ટમ ટ્રેઇન કરેલો એક ઇન્ટેન્ટ સમજી શકે છે, પણ પછી બીજી વિનંતી ચૂકી જાય છે અથવા ચોક્કસ ઢાંચામાં જ ફૉલો-અપ પ્રશ્ન પૂછે છે.
પરિણામ · ટ્રેઇન કરેલા ફ્લોમાં એ સામેલ ન હોવાથી જીવનસાથીને ઉમેરવાની વાત રહી જાય છે.
સ્ટૅક લવચીક બન્યો, પણ દરેક તબક્કો તેની પહેલાંના તબક્કાને સાચો જ માનીને ચાલતો રહ્યો.
આજકાલની સામાન્ય ગોઠવણીમાં સ્પીચ-ટુ-ટેક્સ્ટ, LLM અને ટેક્સ્ટ-ટુ-સ્પીચને જોડીને કૉલનો એક લૂપ બનાવવામાં આવે છે.
ટ્રાન્સક્રિપ્ટ ખોટું હોય અથવા કૉલ કરનાર વચ્ચે બોલે, ત્યારે LLM પૂરા આત્મવિશ્વાસથી ખોટો જવાબ આપે છે.
પરિણામ · સાંભળવામાં થયેલી એક જ ભૂલ બોલાયેલા ખોટા જવાબમાં ફેરવાઈ જાય છે.
સિસ્ટમ એક જ લૂપમાં સાંભળી, તર્ક કરી અને ભૂલ સુધારીને આગળ વધી શકે છે.
ThunderPhone ઑડિયોની સમજ, મોડલ રાઉટિંગ, વાર્તાલાપના વારોનું સંચાલન અને જવાબ તૈયાર કરવાની પ્રક્રિયાને એક જ આર્કિટેક્ચરમાં સંકલિત કરે છે.
સાંભળવાના અનેક માર્ગો અને ઑડિયોને ધ્યાનમાં રાખતું તર્ક, એક જ તબક્કામાં થતી ખામીઓ કૉલ કરનાર સુધી પહોંચે તે પહેલાં જ ઘટાડી દે છે.
પરિણામ · કૉલ કરનારને સિસ્ટમ સાથે ઝઝૂમવું ન પડે અને કૉલ આગળ વધતો રહે.
ખરો બ્રેકથ્રૂ વધુ સરસ રોબોટિક અવાજ નથી. એ એવું આર્કિટેક્ચર છે, જે કૉલને સાચા માર્ગે રાખે છે.
વધુ સારી સાંભળવાની ક્ષમતા
સિસ્ટમ માત્ર એક ટ્રાન્સક્રિપ્ટ પર ભરોસો રાખવાને બદલે વિવિધ સિગ્નલ્સની સરખામણી કરી શકે છે અને ઑડિયોના આધારે રીઝનિંગ કરી શકે છે.
વધુ સચોટ ટાઇમિંગ
ક્યારે કોનો બોલવાનો વારો છે અને વચ્ચે કોઈ બોલે ત્યારે તેને કેવી રીતે સંભાળવું—બંને વાતચીતના લૂપનો ભાગ છે.
વધુ સારું રાઉટિંગ
વાતચીતના દરેક ટર્નની જરૂરિયાત પ્રમાણે ઝડપી પાથ કે વધુ ઊંડું રીઝનિંગ પસંદ કરી શકાય છે.
વધુ સારો અનુભવ
કૉલ કરનારાઓ ઑટોમેશનને સુધારવામાં ઓછો સમય અને પોતાનું કામ પૂરું કરવામાં વધુ સમય વિતાવે છે.