Sequence to Sequence 기술을 이용한 음성합성 기술개발 동향

초록

DNN 을 이용한 음성 합성은 최근 기존 연구에 비해 뛰어난 결과를 내고 있다. 하지만 시간 정보를 담아 내기 힘든 DNN 의 특성으로 인해 문맥에 따른 발음의 변화 등을 추정해내는 데는 어려움이 있었다. 최근 공개 된 Sequence to sequence(이하 seq2seq) [1],[2] 기술을 이용한 음성합성 모델들은 문맥 정보를 반영하는 능력이 기존 DNN, 은닉 마코브 모델 등을 이용한 모델에 비해 훨씬 향상 되었다.

제목
Sequence to Sequence 기술을 이용한 음성합성 기술개발 동향
저자
장준혁이준모
발행일
2017-06
유형
Proceeding
저널명
한국통신학회 학술대회논문집
페이지
956 ~ 956