음성 라이브러리, 미리 듣기 및 맞춤 음성
ThunderPhone 음성을 검색하고 미리 듣고, 음성 샘플을 생성하고, 맞춤 음성 액세스를 요청하고, 오디오로 음성을 만들고, 음성 가격과 상태를 관리합니다.
에이전트용 음성을 탐색하고, 조직에서 활성화된 경우 짧은 오디오 샘플로 맞춤 음성을 만들려면 음성 (/dashboard/voices)을 엽니다.
음성 라이브러리 찾아보기
검색과 언어, 성별 필터를 사용하여 카탈로그 범위를 좁힙니다. 각 행에는 음성 이름, 지원 언어 정보, 기본 제공 오디오 샘플, 전체 또는 일부 언어에 적용되는 프리미엄 추가 요금이 표시됩니다.
에이전트 빌더는 이 카탈로그에서 에이전트의 기본 언어 및 추가 언어와 호환되는 음성만 필터링합니다. 라이브러리에서 음성을 선택해도 에이전트는 변경되지 않습니다. 음성을 할당하려면 에이전트의 구성 탭을 엽니다.
음성이 내 문장을 말하게 듣기
음성이 내 문장을 말하는 것 듣기를 선택하고, 1–500자를 입력한 다음 지원 언어를 선택하여 샘플을 생성합니다.
- 새 샘플마다 조직 잔액에서 3¢가 차감됩니다.
- 확인 대화 상자에 생성 전 요금이 표시됩니다.
- 동일한 캐시 샘플은 무료로 제공되며 캐시에서 제공됨으로 표시됩니다.
- 각 조직은 시간당 최대 30개 샘플을 만들 수 있습니다.
- 음성은 해당 음성에서 사용할 수 있는 언어로만 미리 들을 수 있습니다.
음성 샘플 API는 동일한 워크플로를 프로그래밍 방식으로 제공합니다.
맞춤 음성 액세스 요청
맞춤 음성은 조직별로 활성화됩니다. 액세스가 활성화되지 않은 경우 액세스 요청을 선택하고, 필요한 음성 슬롯 수를 입력한 뒤 선택적으로 최대 2,000자 이내로 사용 사례를 설명합니다.
한 번에 하나의 요청만 대기 상태일 수 있습니다. 액세스가 활성화되면 페이지에 사용한 맞춤 음성 슬롯 수와 사용 가능한 슬롯 수가 표시됩니다. 더 높은 할당량이 필요하면 추가 슬롯 요청을 사용합니다.
맞춤 음성 만들기
- 권한 확인
음성을 사용하고 복제할 권한이 있는지 확인합니다. 이 확인 없이는 맞춤 음성을 만들 수 없습니다.
- 깨끗한 샘플 녹음 또는 업로드
브라우저에서 최대 15초를 녹음하거나 최대 4 MB 크기의 WAV 또는 MP3 파일을 업로드합니다. 한 명의 화자를 사용하고, 일정한 속도로 말하며, 배경 소음은 가능한 한 적게 합니다.
- 이름 지정 및 분류
1–100자의 이름을 입력하고 언어를 선택한 다음, 필요에 따라 음성을 여성 또는 남성으로 표시합니다. 음성 만들기를 선택합니다.
생성은 비동기로 처리됩니다. 음성은 생성 중, 준비됨, 또는 실패 상태를 거칩니다. 준비된 음성은 재생하고 에이전트에 할당할 수 있으며, 실패한 음성은 새 샘플로 다시 시도할 수 있습니다.
이름 변경, 재시도 및 삭제
- 이름 변경은 음성 ID를 변경하지 않고 대시보드 전체에 표시되는 레이블을 변경합니다.
- 다시 시도는 실패 후 새 생성 시도를 시작합니다.
- 삭제는 조직의 선택기에서 음성을 제거하고 할당량 슬롯을 해제합니다. 이미 해당 음성을 사용하는 에이전트는 다른 음성으로 다시 저장할 때까지 저장된 구성을 유지합니다.
전체 객체, 상태, 할당량 요청, 미리 보기, 이름 변경 및 삭제 계약은 맞춤 음성 API를 참조합니다.
가격
고정 프리미엄 음성/언어 경로는 라이브러리와 빌더에서 +3¢/분으로 표시됩니다. 실제 음성 추가 요금은 실제 음성-언어 조합을 기준으로 하며, 언어 및 프리미엄 음성 레이블이 별도의 3¢ 요금 두 개로 중복 적용되지는 않습니다. 해당하는 경우 조직별 맞춤 음성 가격은 맞춤 음성 정책에서 반환되며 빌더의 전체 요금에 반영됩니다.