Thư viện giọng nói, bản xem trước và giọng nói tùy chỉnh
Tìm kiếm và xem trước giọng nói ThunderPhone, tạo mẫu giọng nói, yêu cầu quyền truy cập giọng nói tùy chỉnh, tạo giọng nói từ âm thanh, và quản lý giá cũng như trạng thái giọng nói.
Mở Giọng nói (/dashboard/voices) để khám phá giọng nói cho tác nhân của bạn và,
khi được bật cho tổ chức của bạn, tạo giọng nói tùy chỉnh từ một mẫu âm thanh ngắn.
Duyệt thư viện giọng nói
Dùng tìm kiếm cùng bộ lọc Ngôn ngữ và Giới tính để thu hẹp danh mục. Mỗi hàng hiển thị tên giọng nói, thông tin ngôn ngữ được hỗ trợ, mẫu âm thanh có sẵn và mọi phụ phí cao cấp áp dụng cho tất cả hoặc một số ngôn ngữ.
Trình tạo tác nhân lọc cùng danh mục này theo các giọng nói tương thích với ngôn ngữ chính và ngôn ngữ bổ sung của tác nhân. Chọn một giọng nói trong thư viện không thay đổi tác nhân; mở tab Cấu hình của tác nhân để gán giọng nói đó.
Nghe giọng nói đọc văn bản của bạn
Chọn Nghe giọng nói đọc lời của bạn, nhập 1–500 ký tự, chọn một ngôn ngữ được hỗ trợ và tạo mẫu.
- Mỗi mẫu mới tốn 3¢ từ số dư của tổ chức.
- Hộp thoại xác nhận hiển thị khoản phí trước khi tạo.
- Mẫu được lưu vào bộ nhớ đệm giống hệt sẽ được cung cấp miễn phí và đánh dấu Lấy từ bộ nhớ đệm.
- Mỗi tổ chức có thể tạo tối đa 30 mẫu mỗi giờ.
- Chỉ có thể xem trước giọng nói bằng các ngôn ngữ có sẵn cho giọng nói đó.
API mẫu giọng nói cung cấp cùng quy trình này theo lập trình.
Yêu cầu quyền truy cập giọng nói tùy chỉnh
Giọng nói tùy chỉnh được bật theo từng tổ chức. Nếu quyền truy cập chưa được bật, chọn Yêu cầu quyền truy cập, nhập số vị trí giọng nói bạn cần và tùy chọn mô tả trường hợp sử dụng trong tối đa 2.000 ký tự.
Mỗi lần chỉ có thể có một yêu cầu đang chờ xử lý. Sau khi quyền truy cập được bật, trang hiển thị số vị trí giọng nói tùy chỉnh đã dùng và còn trống. Dùng Yêu cầu thêm vị trí khi bạn cần hạn mức cao hơn.
Tạo giọng nói tùy chỉnh
- Xác nhận quyền của bạn
Xác nhận rằng bạn có quyền sử dụng và sao chép giọng nói. Không thể tạo giọng nói tùy chỉnh nếu chưa có xác nhận này.
- Ghi âm hoặc tải lên một mẫu rõ ràng
Ghi âm tối đa 15 giây trong trình duyệt hoặc tải lên tệp WAV hoặc MP3 có dung lượng tối đa 4 MB. Dùng một người nói, tốc độ ổn định và ít tiếng ồn nền nhất có thể.
- Đặt tên và phân loại
Nhập tên từ 1–100 ký tự, chọn ngôn ngữ và tùy chọn đánh dấu giọng nói là nữ hoặc nam. Chọn Tạo giọng nói.
Quá trình tạo diễn ra không đồng bộ. Giọng nói sẽ chuyển qua trạng thái Đang tạo, Sẵn sàng hoặc Thất bại. Giọng nói sẵn sàng có thể được phát và gán cho tác nhân; giọng nói thất bại có thể được thử lại bằng một mẫu mới.
Đổi tên, thử lại và xóa
- Đổi tên thay đổi nhãn hiển thị trên toàn bộ bảng điều khiển mà không thay đổi id giọng nói.
- Thử lại bắt đầu một lần tạo mới sau khi thất bại.
- Xóa loại bỏ giọng nói khỏi bộ chọn của tổ chức và giải phóng vị trí hạn mức của giọng nói đó. Các tác nhân đang dùng giọng nói này vẫn giữ cấu hình đã lưu cho đến khi bạn lưu lại chúng với một giọng nói khác.
Để xem đầy đủ các hợp đồng về đối tượng, trạng thái, yêu cầu hạn mức, xem trước, đổi tên và xóa, xem API giọng nói tùy chỉnh.
Giá
Các cặp giọng nói/ngôn ngữ cao cấp cố định được đánh dấu +3¢/phút trong thư viện và trình tạo. Phụ phí lời nói thực tế dựa trên tổ hợp giọng nói-ngôn ngữ thực tế; nhãn ngôn ngữ và giọng nói cao cấp không cộng dồn thành hai khoản phí 3¢ riêng biệt. Giá giọng nói tùy chỉnh dành riêng cho tổ chức, khi áp dụng, được trả về bởi chính sách giọng nói tùy chỉnh và phản ánh trong mức giá trọn gói của trình tạo.