ਜ਼ਿਆਦਾਤਰ ਵੌਇਸ AI ਪਲੇਟਫ਼ਾਰਮ 3-ਪੜਾਵੀ ਪਾਈਪਲਾਈਨ ਦੇ ਸਹਾਰੇ ਚੱਲਦੇ ਹਨ: ਇੱਕ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਮਾਡਲ, ਇੱਕ ਅਜਿਹਾ LLM ਜੋ ਸੋਚ-ਵਿਚਾਰ ਨਹੀਂ ਕਰਦਾ, ਅਤੇ ਇੱਕ ਟੈਕਸਟ-ਟੂ-ਸਪੀਚ ਇੰਜਣ। ਕਿਸੇ ਵੀ ਇੱਕ ਪੜਾਅ ਦੀ ਗੜਬੜ ਪੂਰੀ ਪ੍ਰਕਿਰਿਆ ਨੂੰ ਨਾਕਾਮ ਕਰ ਸਕਦੀ ਹੈ। ThunderPhone ਇੱਕੋ ਵੇਲੇ ਕਈ ਮਾਡਲਾਂ ਨੂੰ ਤਾਲਮੇਲ ਨਾਲ ਚਲਾ ਕੇ ਗ਼ਲਤੀਆਂ ਘਟਾਉਂਦਾ ਹੈ।
ThunderPhone ਇੱਕੋ ਵੇਲੇ ਕਈ ਮਾਡਲਾਂ ਨੂੰ ਤਾਲਮੇਲ ਨਾਲ ਚਲਾਉਂਦਾ ਹੈ, ਤਾਂ ਜੋ ਉਹ ਇੱਕ-ਦੂਜੇ ਦੀਆਂ ਗ਼ਲਤੀਆਂ ਠੀਕ ਕਰ ਸਕਣ।
ਤੇਜ਼ LLM ਸਿਰਫ਼ ਟ੍ਰਾਂਸਕ੍ਰਿਪਟ ਵੇਖਦਾ ਹੈ।
“Hi, Brent — how can I help?”
ਤੇਜ਼ + ਸੋਚ-ਵਿਚਾਰ ਕਰਨ ਵਾਲੇ LLM ਆਪਸ ਵਿੱਚ ਜਾਂਚ ਕਰਦੇ ਹਨ: 3 ਵਿੱਚੋਂ 2 ਰਾਹਾਂ ਦਾ ਨਤੀਜਾ ਇੱਕੋ ਹੈ।
“Got it — so you rent.”
BBA ਇਹ ਪਰਖਦਾ ਹੈ ਕਿ ਕੋਈ ਮਾਡਲ ਬੋਲ ਕੇ ਦਿੱਤੇ prompts ਨੂੰ ਸਮਝ ਕੇ ਔਖੇ ਸਵਾਲਾਂ ਦੇ ਸਹੀ ਜਵਾਬ ਦੇ ਸਕਦਾ ਹੈ ਜਾਂ ਨਹੀਂ। ਸਾਡੀ ਸਭ ਤੋਂ ਤਾਕਤਵਰ Storm ਕਨਫ਼ਿਗਰੇਸ਼ਨ ਦੇ ਨਾਮ ਇਹ ਰਿਕਾਰਡ ਹੈ: ਸਾਡੇ ਜਨਤਕ ਮੁਲਾਂਕਣ ਸੈੱਟ 'ਤੇ 99.4%।
0.6% ਗਲਤੀ ਦੀ ਦਰ
ThunderPhone ਦਾ ਨਤੀਜਾ ਉੱਪਰ ਲਿੰਕ ਕੀਤੇ ਸਾਡੇ ਜਨਤਕ ਮੁਲਾਂਕਣ ਡੇਟਾਸੈੱਟ ਤੋਂ ਹੈ; ਹੋਰ ਜਨਤਕ ਸਕੋਰ (Artificial Analysis ਲੀਡਰਬੋਰਡ) ਸੰਦਰਭ ਲਈ ਦਰਜ ਕੀਤੇ ਗਏ ਹਨ।
Vapi, Retell, Pipecat ਅਤੇ LiveKit ਵਰਗੇ ਹੋਰ ਵੌਇਸ AI ਪਲੇਟਫ਼ਾਰਮਾਂ 'ਤੇ ਕਾਲਾਂ ਠੀਕ ਤਰ੍ਹਾਂ ਚਲਾਉਣ ਲਈ ਤੁਹਾਨੂੰ ਕਨਫ਼ਿਗਰੇਸ਼ਨ ਨਾਲ ਜੁੜੇ ਬਹੁਤ ਸਾਰੇ ਫ਼ੈਸਲੇ ਖ਼ੁਦ ਕਰਨੇ ਹੀ ਪੈਂਦੇ ਹਨ। ThunderPhone ਦੀ ਸੋਚ ਸਾਫ਼ ਹੈ—ਟਿਊਨਿੰਗ ਸਾਡਾ ਕੰਮ ਹੈ, ਤਾਂ ਜੋ ਆਪਣੀਆਂ ਕਾਲਾਂ ਸੁਚਾਰੂ ਢੰਗ ਨਾਲ ਚਲਾਉਣ ਲਈ ਤੁਹਾਨੂੰ ਘੱਟ ਤੋਂ ਘੱਟ ਮਿਹਨਤ ਕਰਨੀ ਪਵੇ।
ThunderPhone ਇਹ ਸਭ ਤੁਹਾਡੇ ਲਈ ਟਿਊਨ ਕਰਦਾ ਹੈ
Spark, Bolt ਜਾਂ Storm।
ਸੋਚ-ਸਮਝ ਕੇ ਚੁਣੀ, ਅਸਲ ਕਾਲਾਂ 'ਤੇ ਪਰਖੀ ਹੋਈ।
ਵਿਹਾਰ, ਨੀਤੀ ਤੇ ਟੂਲ—ਸਿੱਧੀ-ਸਾਦੀ ਭਾਸ਼ਾ ਵਿੱਚ।
ਸਿਰਫ਼ ਤਿੰਨ ਫ਼ੈਸਲੇ। ਬੱਸ, ਇੰਨਾ ਹੀ ਸੈਟਅੱਪ ਹੈ—ਆਰਕੈਸਟ੍ਰੇਸ਼ਨ, ਫਾਲਬੈਕ ਅਤੇ ਟਿਊਨਿੰਗ ਪਹਿਲਾਂ ਤੋਂ ਹੀ ਸ਼ਾਮਲ ਹਨ।
ਅਸੀਂ ਹਰ ਕੰਮ ਲਈ ਸਭ ਤੋਂ ਢੁਕਵੇਂ ਮਾਡਲ ਚੁਣ ਕੇ ਉਨ੍ਹਾਂ ਨੂੰ ਇੱਕ ਸਿਸਟਮ ਵਿੱਚ ਜੋੜਦੇ ਹਾਂ। OpenAI, Anthropic ਅਤੇ Google ਦੇ ਅਤਿ-ਆਧੁਨਿਕ ਮਾਡਲ ਖੁੱਲ੍ਹੇ ਸਰੋਤ ਵਾਲੇ ਮਾਡਲਾਂ ਨਾਲ ਮਿਲ ਕੇ ਕੰਮ ਕਰਦੇ ਹਨ—ਹਰ ਕਾਲ 'ਤੇ ਕਾਰਗੁਜ਼ਾਰੀ ਅਤੇ ਕੀਮਤ, ਦੋਵਾਂ ਪੱਖੋਂ ਸਭ ਤੋਂ ਵਧੀਆ ਨਤੀਜੇ ਲਈ ਸਭ ਕੁਝ ਸੁਚੱਜੇ ਢੰਗ ਨਾਲ ਆਰਕੈਸਟ੍ਰੇਟ ਹੁੰਦਾ ਹੈ, ਤਾਂ ਜੋ ਤੁਹਾਨੂੰ ਇਸ ਦੀ ਚਿੰਤਾ ਨਾ ਕਰਨੀ ਪਵੇ।
ਕਮਜ਼ੋਰ ਸਿਸਟਮ ਪੇਚੀਦਾ prompt ਮੁਤਾਬਕ ਨਹੀਂ ਚੱਲ ਸਕਦੇ, ਇਸੇ ਕਰਕੇ ਫ਼ਲੋ ਬਿਲਡਰਾਂ ਦੀ ਲੋੜ ਪੈਂਦੀ ਹੈ। ਗੱਲਬਾਤ ਦਾ ਹਰ ਪੜਾਅ ਇੱਕ ਨੋਡ ਬਣ ਜਾਂਦਾ ਹੈ, ਜਿਸ ਨੂੰ ਤੁਹਾਨੂੰ ਖ਼ੁਦ ਬਣਾਉਣਾ ਅਤੇ ਸੰਭਾਲਣਾ ਪੈਂਦਾ ਹੈ। Storm ਇੱਕੋ prompt ਵਿੱਚ ਦਿੱਤੀਆਂ ਵੇਰਵੇਦਾਰ ਹਦਾਇਤਾਂ ਦੀ ਪਾਲਣਾ ਕਰਦਾ ਹੈ, ਇਸ ਲਈ ਤੁਹਾਨੂੰ ਨੋਡਾਂ ਤੇ ਐਜਾਂ ਦੀ ਚਿੰਤਾ ਨਹੀਂ ਕਰਨੀ ਪੈਂਦੀ।
ਇੱਕ ਐਨਰੋਲਮੈਂਟ ਫ਼ਲੋ ਲਈ 6 ਨੋਡ—ਹਰੇਕ ਦਾ ਆਪਣਾ prompt, ਟੂਲ, ਟ੍ਰਾਂਜ਼ਿਸ਼ਨ ਅਤੇ ਨਾਕਾਮੀ ਨਾਲ ਨਜਿੱਠਣ ਦਾ ਤਰੀਕਾ।
ਕਾਲਰ ਦਾ ਸਵਾਗਤ ਕਰੋ ਅਤੇ ਉਨ੍ਹਾਂ ਦਾ ਨਾਮ ਤੇ ਫ਼ੋਨ ਨੰਬਰ ਲਵੋ। ਰਜਿਸਟਰ ਕਰਨ ਤੋਂ ਪਹਿਲਾਂ ਸਹਿਮਤੀ ਦੀ ਪੁਸ਼ਟੀ ਕਰੋ—ਇਹ ਲਾਜ਼ਮੀ ਹੈ। ਜੇ ਉਹ ਬਿਲਿੰਗ ਬਾਰੇ ਪੁੱਛਣ, ਤਾਂ ਹੇਠਾਂ ਦਿੱਤੀ ਬਿਲਿੰਗ ਨੀਤੀ ਦੀ ਪਾਲਣਾ ਕਰੋ। ਹਰ ਫ਼ੀਲਡ ਦੀ ਪੁਸ਼ਟੀ ਹੋ ਜਾਣ ਤੋਂ ਬਾਅਦ ਹੀ enroll() ਨੂੰ ਕਾਲ ਕਰੋ। ਜੇ ਕਾਲਰ ਕਿਸੇ ਵਿਅਕਤੀ ਨਾਲ ਗੱਲ ਕਰਨੀ ਚਾਹੇ, ਤਾਂ ਕਾਲ ਮਨੁੱਖੀ ਏਜੰਟ ਨੂੰ ਟ੍ਰਾਂਸਫਰ ਕਰੋ।
ਲਿਖਣ, ਟੈਸਟ ਕਰਨ ਤੇ ਵਾਰ-ਵਾਰ ਨਿਖਾਰਨ ਲਈ ਸਿਰਫ਼ ਇੱਕ prompt—ਬ੍ਰਾਂਚਿੰਗ ਸਮੇਤ।
ਅਸਪਸ਼ਟ ਬੋਲੀ, ਪਿੱਛੇ ਹੁੰਦੀ ਗੱਲਬਾਤ, ਨਾਂ ਤੇ ਨੰਬਰ, ਰਲੀਆਂ-ਮਿਲੀਆਂ ਭਾਸ਼ਾਵਾਂ—ThunderPhone ਉਹਨਾਂ ਹਾਲਾਤਾਂ ਲਈ ਬਣਿਆ ਹੈ ਜਿੱਥੇ ਹੋਰ ਸਿਸਟਮ ਨਾਕਾਮ ਹੋ ਜਾਂਦੇ ਹਨ।
ਇੱਕੋ ਟ੍ਰਾਂਸਕ੍ਰਿਪਟ ’ਤੇ ਭਰੋਸਾ ਕਰਨ ਦੀ ਥਾਂ, ਆਡੀਓ ਅਤੇ ਟੈਕਸਟ ਸਿਗਨਲਾਂ ਨੂੰ ਆਪਸ ਵਿੱਚ ਮਿਲਾ ਕੇ ਵੇਖੋ।
ਸ਼ੋਰ ਪਛਾਣਨ ਅਤੇ ਘਟਾਉਣ ਵਾਲੇ ਮਾਡਲ ਸਿਗਨਲ ਨੂੰ ਸਾਫ਼ ਕਰ ਦਿੰਦੇ ਹਨ।
ਪਾਸੇ ਚੱਲ ਰਹੀ ਗੱਲਬਾਤ ਏਜੰਟ ਨੂੰ ਭਟਕਾਉਣ ਤੋਂ ਪਹਿਲਾਂ ਹੀ ਪਛਾਣੋ।
ਨਾਂ, ਉਨ੍ਹਾਂ ਦੀ ਸਪੈਲਿੰਗ, ਨੰਬਰ ਅਤੇ ਸੋਧਾਂ—ਸਭ ਨੂੰ ਆਪਸ ਵਿੱਚ ਮਿਲਾ ਕੇ ਜਾਂਚੋ।
ਲੋੜ ਪੈਣ ’ਤੇ ਕਾਲ ਨੂੰ ਬਹੁਭਾਸ਼ੀ ਆਡੀਓ ਅਤੇ ਵੌਇਸ ਪਾਥਾਂ ਰਾਹੀਂ ਰੂਟ ਕਰੋ।
ਜਦੋਂ ਏਜੰਟ ਦੇ ਵਿਹਾਰ ਨੂੰ ਇੱਕੋ ਨਿਯਮ ਵਿੱਚ ਨਹੀਂ ਸਮੇਟਿਆ ਜਾ ਸਕਦਾ, ਤਾਂ ਹੋਰ ਮਜ਼ਬੂਤ ਤਰਕ-ਮਾਰਗ ਵਰਤੋ।
ਵੌਇਸ AI ਨੂੰ ਫ਼ੌਰਨ ਜਵਾਬ ਦੇਣਾ ਪੈਂਦਾ ਹੈ—ਪਰ ਗ਼ਲਤ ਜਵਾਬ ਭਾਵੇਂ ਕਿੰਨੀ ਵੀ ਤੇਜ਼ੀ ਨਾਲ ਆਵੇ, ਰਹਿੰਦਾ ਗ਼ਲਤ ਹੀ ਹੈ। ਅੱਜ ਦੇ LLMs ਨੂੰ ਭਰੋਸੇਯੋਗ ਜਵਾਬ ਦੇਣ ਲਈ ਸੋਚਣ ਵਾਸਤੇ ਥੋੜ੍ਹਾ ਸਮਾਂ ਚਾਹੀਦਾ ਹੈ, ਇਸੇ ਲਈ ThunderPhone ਲੇਟੈਂਸੀ ਅਤੇ ਸਟੀਕਤਾ ਵਿਚਕਾਰ ਸੰਤੁਲਨ ਰੱਖਦਾ ਹੈ।
ਹੋਰ ਵੈਂਡਰ ਆਦਰਸ਼ ਹਾਲਾਤਾਂ ਵਿੱਚ 500 ਮਿਲੀਸਕਿੰਟ ਲੇਟੈਂਸੀ ਦਾ ਦਾਅਵਾ ਕਰਦੇ ਹਨ, ਪਰ ਆਮ ਤੌਰ 'ਤੇ ਇਹ ਅਸਲ ਕਾਲ ਵਿੱਚ ਲਗਭਗ 2 ਸਕਿੰਟ ਰਹਿੰਦੀ ਹੈ। ਅਸੀਂ ਆਪਣੀ ਲੇਟੈਂਸੀ ਅਸਲ ਹਾਲਾਤਾਂ ਵਿੱਚ ਮਾਪਦੇ ਹਾਂ।
AI ਵੈਂਡਰਾਂ ਦੀ ਲੇਟੈਂਸੀ ਕਈ ਵਾਰ ਅਚਾਨਕ ਵਧ ਜਾਂਦੀ ਹੈ, ਜਿਸ ਨਾਲ ਕਾਲ ਵਿਗੜ ਸਕਦੀ ਹੈ। ਜਦੋਂ ਅਜਿਹਾ ਹੁੰਦਾ ਹੈ, ThunderPhone ਦਾ ਆਰਕੈਸਟ੍ਰੇਟਿਡ ਸਟੈਕ ਆਪਣੇ ਆਪ ਹੋਰ ਤੇਜ਼ ਵਿਕਲਪਾਂ 'ਤੇ ਸਵਿੱਚ ਹੋ ਜਾਂਦਾ ਹੈ।
ਆਟੋਮੇਟਿਡ ਫ਼ੋਨ ਕਾਲਾਂ ਹੁਣ ਤੱਕ ਖਿੱਝ ਹੀ ਚੜ੍ਹਾਉਂਦੀਆਂ ਰਹੀਆਂ ਹਨ… ਪਰ ਹੁਣ ਨਹੀਂ। ਤਕਨਾਲੋਜੀ ਦੀ ਹਰ ਨਵੀਂ ਲਹਿਰ ਨਾਲ ਕਾਲ ਦਾ ਤਜਰਬਾ ਬਿਹਤਰ ਹੋਇਆ, ਪਰ ਕਦੇ ਵੀ ਪੂਰੀ ਤਰ੍ਹਾਂ ਸਹਿਜ ਨਹੀਂ ਬਣਿਆ। ThunderPhone ਨਾਲ ਹੁਣ ਇਹ ਬਦਲ ਗਿਆ ਹੈ।
“Press one for sales, press two for support.” ਮੀਨੂ ਸਿਰਫ਼ ਕਾਲ ਨੂੰ ਸਹੀ ਥਾਂ ਭੇਜ ਸਕਦੇ ਹਨ।
“sales” ਜਾਂ “billing” ਕਹੋ ਅਤੇ ਬਸ ਉਮੀਦ ਕਰੋ ਕਿ ਸਲੌਟ ਪਾਰਸਰ ਇਸਨੂੰ ਸਮਝ ਲਵੇ।
ਆਵਾਜ਼ ਨੂੰ ਲਿਖਤ ਬਣਾਓ, ਇੱਕ ਤੇਜ਼ LLM ਤੋਂ ਜਵਾਬ ਲਵੋ, ਫਿਰ ਬੋਲੋ—ਹਰ ਪੜਾਅ ਪਿਛਲੇ ਨਤੀਜੇ ਨੂੰ ਸਹੀ ਮੰਨ ਕੇ ਚੱਲਦਾ ਹੈ।
ਆਡੀਓ, ਟੈਕਸਟ, ਤਰਕ, ਟੂਲ, ਆਵਾਜ਼ਾਂ ਅਤੇ ਸੁਰੱਖਿਆ ਨਿਯਮ—ਸਭ ਇੱਕੋ ਸਿਸਟਮ ਵਿੱਚ।
10 ਮਿੰਟਾਂ ਵਿੱਚ ਲਾਈਵ ਹੋਵੋ। 2¢/ਮਿੰਟ ਤੋਂ ਸ਼ੁਰੂ।