Diphone-based Intonation and VoiceXML document Generation using Multi-dimensional Linguistic Information

다양한 언어 정보를 이용한 음소 단위 억양 및 VoiceXML 문서 생성

  • 이화진 (한국과학기술원 전산학 및 첨단정보기술연구센터) ;
  • 박종철 (한국과학기술원 전산학 및 첨단정보기술연구센터)
  • Published : 2002.10.11

Abstract

최근 음성 합성 과정에서 화자의 의도를 가장 많이 반영하는 언어 정보인 문맥 정보를 사용하려는 시도가 이루어지고 있으나 문맥 정보를 적은 비중으로 사용하기 때문에 자연성 향상에 큰 도움을 주지 못하고 있다. 본 연구에서는 구문 정보, 의미 정보를 억양 생성 과정에 이용함과 동시에 문맥 정보와 음성 정보와의 관계를 음성 데이터를 바탕으로 분석하여 다양한 문맥 정보를 음성 합성 과정에 반영하는 방법을 제안한다. 또한 한국어에서 나타나는 다양한 억양 곡선 유형을 형태소를 이용하여 의다 효율적으로 처리할 수 있는 방법을 제안하여 자연스러운 억양 생성 시스템을 구현하고 시스템의 결과를 음소 단위 억양 생성기와 VoiceXML을 이용하여 적용시켜보고 결과를 논의한다.

Keywords