다화자 음성 합성 시스템

Multi speaker speech synthesis system

초록

본 논문은 스피커 임베딩을 이용한 다회자 음성 합성 시스템을 제안한다. 이 모델은 인공신경망을 기반으로 하는 단일화자 음성 합성 시스템인 타코트론을 기초로 구성된다. 제안 된 모델은 입력 데이터에 화자 임베딩을 추가 데이터로 함께 넣어주는 간단한 방식으로 구현되며 단일화자 모델에 비해 큰 성능 저하 없이 성공적으로 음성을 생성한다.

제목
다화자 음성 합성 시스템
제목 (타언어)
Multi speaker speech synthesis system
저자
Jun-Mo, LeeChang, Joon Hyuk
발행일
2018-05
유형
Proceeding
저널명
한국정보처리학회 2018년도 춘계학술발표대회
페이지
338 ~ 339