1 Amazon Polly
- Amazon Polly는 텍스트를 자연스럽고 생동감 있는 음성으로 변환하는 서비스입니다.
- 다양한 언어와 음성을 지원하여 여러 글로벌 사용자를 위한 음성 애플리케이션을 쉽게 개발할 수 있습니다.
- 머신러닝을 활용하여 높은 품질의 음성 합성을 제공합니다.
2 주요 기능
2.1 다양한 언어 및 음성 지원
- Amazon Polly는 다양한 언어와 음성을 지원합니다.
- 남성 및 여성 음성을 선택할 수 있으며, 각 언어마다 여러 음성 옵션을 제공합니다.
- 30개 이상의 언어와 60개 이상의 음성을 지원합니다.
2.2 텍스트-음성 변환 (TTS)
- 텍스트를 자연스럽고 생동감 있는 음성으로 변환할 수 있습니다.
- 뉴스, 소설, 기술 문서 등 다양한 종류의 텍스트를 음성으로 변환하여 사용자가 청취할 수 있습니다.
- 실시간 스트리밍과 배치 작업 모두 지원합니다.
2.3 사용자 정의 음성 사전 (Lexicon)
- 특정 단어의 발음을 사용자 정의할 수 있습니다.
- 예를 들어, 'St3ph4ne'을 'Stephane'으로, 'AWS'를 'Amazon Web Services'로 발음하도록 설정할 수 있습니다.
- 사용자 정의 음성 사전을 업로드하고 SynthesizeSpeech 작업에서 사용할 수 있습니다.
2.4 Speech Synthesis Markup Language (SSML) 지원
- SSML을 사용하여 음성의 억양, 속도, 볼륨 등을 조정할 수 있습니다.
- 텍스트 에 SSML 태그를 추가하여 음성 합성을 세밀하게 제어할 수 있습니다.
- 특정 단어나 구를 강조하거나, 음성 발음을 사용하거나, 숨소리와 속삭임을 포함할 수 있습니다.
- 뉴스 스타일의 음성을 사용할 수 있습니다.
2.5 자동 언어 감지
- 입력 텍스트의 언어를 자동으로 감지하고 해당 언어로 음성을 생성할 수 있습니다.
- 다국어 콘텐츠를 효율적으로 처리할 수 있습니다.
2.6 음성 스트리밍
- 실시간으로 텍스트를 음성으로 변환하여 스트리밍할 수 있습니다.
- 웹 애플리케이션, 모바일 앱, IoT 기기 등 다양한 플랫폼에서 실시간 음성 출력을 사용할 수 있습니다.
2.7 Polly Newscaster
- 뉴스와 같은 정보 전달에 적합한 음성을 생성할 수 있습니다.
- 뉴스 기사, 안내 방송 등 전문적인 톤의 음성을 제공하여 정보를 효과적으로 전달할 수 있습니다.
3 사용 사례