Proceedings of the Korean Society for Information Management Conference (한국정보관리학회:학술대회논문집)
- 1998.08a
- /
- Pages.243-246
- /
- 1998
Preliminary Study on the Analysis of Term Associations in Korean Text
한국어 텍스트 내 용어연관성 분석을 위한 기초 연구
Abstract
텍스트 자동분석을 통해 얻어진 통계적인 용어연관성은 정보검색 및 언어 처리와 관련된 여러 분야에서 폭넓게 이용되고 있다. 용어연관성을 구하기 위한 연관계수는 여러 가지가 있지만 적용분야에 관계없이 유사계수 공식이나 상호정보량 공식이 주류를 차지하고 있다. 이런 공식들은 그 통계적 특성이 서로 다르기 때문에 알맞은 적용분야를 파악할 필요가 있다. 이 연구에서는 필요 연관계수 공식의 특성을 이론적으로 파악하였고, 실험으로 검증하기 위하여 240만 어절 분량의 실험용 한국어 신문기사 데이터베이스를 구축하였다.
Keywords