Title Named Entity Recognition based on Automatically Constructed Context Patterns and Entity Dictionary

자동 구축된 문맥 패턴과 개체명 사전에 기반한 제목 개체명 인식

  • Lee, Joo-Young (Department of Computer Science and Engineering, Korea University) ;
  • Song, Young-In (Department of Computer Science and Engineering, Korea University) ;
  • Rim, Hae-Chang (Department of Computer Science and Engineering, Korea University)
  • Published : 2004.10.08

Abstract

본 논문에서는 영화명, 도서명, 음악명 등의 제목 개체명 인식을 위한 새로운 방법에 대해 기술한다. 제목 개체명은 개체명 내부에 기존 MUC에서 분류한 인명, 지명, 기관명 등과 같은 일반적인 개체명과는 달리, 철자 자질 등 내부 자질을 사용하기 어려우며, 제목 개체명 부착 말뭉치가 없기 때문에 기존 연구에서 좋은 성능을 보인 방법들을 적용하기는 힘들다. 이러한 문제를 해결하기 위해 본 논문에서는 원시 말뭉치에서 자동으로 구축한 문맥 패턴 정보와 개체명 사전을 사용하여 제목 개체명을 인식하는 방법을 제안한다. 패턴과 제목 개체명 사전 구축을 위해, 사전 정보를 이용한 패턴 확장과 이렇게 구축된 패턴 정보를 사용한 사전 확장 단계를 반복 수행하여 문맥 패턴과 제목 개체명 사진을 점진적으로 증가시키는 방법을 사용하였으며, 이러한 정보가 제목 개체명 인식에 도움이 됨을 실험적으로 입증하였다.

Keywords