ThunderPhone 2.0 đã chính thức ra mắt.Tự thiết lập, từ 2 xu/phút.Xem thông báo ra mắt
Các thế hệ AI giọng nói

Hầu hết cuộc gọi tự động đều rất tệ. Công nghệ mới đang thay đổi điều đó.

Vấn đề của hệ thống gọi điện tự động trước đây không phải là thiếu một giọng nói dễ nghe, mà là chưa đủ khả năng thấu hiểu để duy trì mạch trò chuyện thực sự.

Tổng đài IVR phân nhánh·Kỷ nguyên IVR

Người gọi buộc phải nói theo ngôn ngữ của máy.

Tự động hóa khi ấy chỉ là menu, các nhánh phím bấm và hàng đợi. Cách này hiệu quả khi người gọi đã biết sẵn đúng luồng cần chọn.

Khoảnh khắc gượng gạo

Ý định bị thu gọn thành một lần bấm phím, nên mọi yêu cầu ngoài menu đều dẫn đến chuyển máy hoặc phải nói lại.

Cuộc gọi mẫuKỷ nguyên IVR
Tôi cần dời lịch hẹn ngày mai.
Về hóa đơn, bấm phím 1. Để đặt lịch, bấm phím 2. Với mọi câu hỏi khác, bấm phím 9.

Kết quả · Người gọi phải tự đoán lựa chọn, chờ đợi rồi trình bày lại từ đầu.

Hệ thống tư duy như thế nào · 3 giai đoạn
Thông báo menuđã sửaNhánh DTMFdễ lỗiHàng đợibị lỗi
Mô hình tùy chỉnh·AI đời đầu

Hệ thống chỉ hiểu các luồng giới hạn — ra ngoài luồng là thất bại.

Các đội ngũ phải huấn luyện mô hình âm học, bộ phân loại ý định và bộ trích xuất trường thông tin cho từng luồng cuộc gọi cụ thể. Hữu ích, nhưng mỗi thay đổi đều tốn kém.

Khoảnh khắc gượng gạo

Hệ thống chỉ nhận ra một ý định đã được huấn luyện, rồi bỏ sót yêu cầu thứ hai hoặc hỏi tiếp một cách máy móc.

Cuộc gọi mẫuAI đời đầu
Bạn có thể dời lịch hẹn ngày mai và thêm vợ/chồng tôi vào không?
Tôi có thể giúp bạn đổi lịch. Bạn muốn chuyển sang ngày nào?

Kết quả · Thông tin về vợ/chồng bị bỏ sót vì không có trong luồng đã huấn luyện.

Hệ thống tư duy như thế nào · 3 giai đoạn
ASR tùy chỉnhđã sửaMô hình nhận diện ý địnhdễ lỗiĐiền trường thông tinbị lỗi
Các stack kiểu Vapi / Retell / ElevenLabs·Quy trình 3 bước

Stack linh hoạt hơn, nhưng mỗi bước vẫn mặc nhiên tin vào bước ngay trước đó.

Mô hình phổ biến hiện nay kết nối công nghệ chuyển giọng nói thành văn bản, LLM và công nghệ chuyển văn bản thành giọng nói trong cùng một vòng lặp xử lý cuộc gọi.

Khoảnh khắc gượng gạo

Khi bản chép lời bị sai hoặc người gọi chen ngang, LLM vẫn tự tin trả lời sai ý người gọi.

Cuộc gọi mẫuQuy trình 3 bước
Không, tôi thuê chỗ này.
Đã hiểu. Chào Huệ, tôi nghe đúng chứ?

Kết quả · Một lần nghe nhầm là đủ để hệ thống nói ra câu trả lời sai.

Hệ thống tư duy như thế nào · 3 giai đoạn
Chuyển giọng nói thành văn bảnbị lỗiLLMdễ lỗiChuyển văn bản thành giọng nóibị lỗi
AI giọng nói tích hợp·ThunderPhone

Hệ thống có thể nghe, suy luận và tự khắc phục ngay trong một vòng lặp.

ThunderPhone phối hợp khả năng hiểu âm thanh, định tuyến mô hình, quản lý lượt thoại và tạo phản hồi trong một kiến trúc thống nhất.

Điểm khác biệt

Khả năng nghe đa luồng và suy luận trực tiếp từ âm thanh giúp giảm lỗi ở từng bước trước khi chúng ảnh hưởng đến người gọi.

Cuộc gọi mẫuThunderPhone
Không, tôi thuê chỗ này.
Đã hiểu. Bạn đang thuê nhà, nên tôi sẽ bỏ qua các câu hỏi về quyền sở hữu.

Kết quả · Cuộc gọi tiếp tục liền mạch mà người gọi không phải chật vật với hệ thống.

Hệ thống tư duy như thế nào · 4 giai đoạn
Luồng âm thanhđạtNghe đa luồngđạtĐịnh tuyến mô hìnhđạtPhản hồi tự nhiênđạt

Đột phá không nằm ở một giọng robot nghe hay hơn, mà ở kiến trúc giúp cuộc gọi luôn đi đúng hướng.

Nghe chính xác hơn

Hệ thống có thể đối chiếu nhiều tín hiệu và suy luận trực tiếp trên âm thanh thay vì phụ thuộc vào một bản chép lời duy nhất.

Phản hồi đúng nhịp hơn

Cơ chế luân phiên hội thoại và xử lý ngắt lời được tích hợp ngay trong vòng lặp hội thoại.

Điều phối thông minh hơn

Hệ thống có thể chọn luồng xử lý nhanh hoặc suy luận chuyên sâu tùy theo nhu cầu ở từng lượt hội thoại.

Trải nghiệm tốt hơn

Người gọi mất ít thời gian sửa lỗi cho hệ thống tự động hơn và có nhiều thời gian hoàn thành công việc hơn.

Giá trị mang lại

Khám phá cận cảnh kiến trúc tích hợp.