Determining the Specificity of Terms based on Compositional and Contextual Information

구성정보와 문맥정보를 이용한 용어의 전문성 측정 방법

  • 류법모 (한국과학기술원 전산학과) ;
  • 배선미 (한국과학기술원 전산학) ;
  • 최기선 (한국과학기술원 전산학과)
  • Published : 2004.04.01

Abstract

어떤 용어가 전문적인 개념을 많이 내포하고 있을 때 전문성(specificity)이 높다고 말한다. 본 논문에서는 정보이론에 기반한 방법으로 전운용어가 내포하는 전문성을 정량적으로 계산하는 방법을 제안한다. 제안한 방법은 전문용어의 구성정보를 이용하는 방법과 문맥정보를 이용하는 방법으로 나눈다. 구성정보를 이용하는 방법에서는 전문용어틀 구성하는 단어의 빈도수, tf.idf 값, 내부 수식구조 등을 이용하고, 문맥정보를 이용하는 방법에서는 전문용어를 수식하는 단어들의 분포를 이용한다. 제안한 방법은 분야에 독립적으로 적용될 수 있고, 전문용어 생성 절차에 대한 특징을 잘 표현할 수 있는 장정이 있다. MeSH 트리에 포함된 질병명을 대상으로 실험한 결과 82.0%의 정확률을 보였다.

Keywords