A Two-Pass Algorithm for Fast Retrieval of Korean Words

한글 단어의 고속 검색을 위한 두 단계 알고리즘

  • 양진호 (전북대학교 컴퓨터과학과) ;
  • 오일석 (전북대학교 컴퓨터과학과)
  • Published : 2001.10.01

Abstract

대용량 한글 문서를 대상으로 하는 검색 시스템은 고속의 단어 매칭 알고리즘을 필요로 한다. 이 논문은 두 단계 매칭 접근 방법을 제시하고 그 유용성을 실험을 통해 입증한다. 특징으로는 웨이브렛(wavelet) 계수를 사용하여 첫 단계에서는 적은 수의 특징만을 사용하여, 거친 정합(coarse matching)을 하며 두 번째 단계에서는 미세한 정합(fine matching)을 한다. 거친 정합은 가능성이 없는 단어를 아주 빠른 속도로 걸러내는 역할을 한다. 실제 한글 단어 영상 데이터베이스에 적용한 실험 결과 검색률의 희생 없이 약 7배의 속도 향상을 얻었다.

Keywords