A Postprocessing of Character Recognition Based on Korean Lexicon

한국어 Lexicon에 의존한 문자 인식의 후처리

  • Lim, Han-Kyu (Korea Software Development Institute IBM Korea)
  • 임한규 (한국아이비엠(주) 소프트웨어연구소)
  • Published : 1993.10.08

Abstract

본 논문에서는 문자 인식이 끝난 한국어 원문에 대해 한국어 Lexicon에 기반을 둔 후처리의 구현을 보여주는 것을 목적으로 한다. 빈번하게 오인식되는 음절에 대해 이의 옳은 음절을 대응시킨 테이블을 만들어 놓고, 오인식이라고 정의된 음절이 출현했을 때는 이를 원래의 옳은 음절로 대체시킨 어절과 오인식된 음절이 포함된 어절에 대해 한국어 형태소 분석을 행함으로써, 올바른 형태소가 분석될 경우, 이를 옳은 음절로 간주한다. 실험결과 약 90%에서 95%에 달하는 인식율이 이 후처리 방법에 의해서 95%에서 99%로 높아졌다.

Keywords