한국정보처리학회:학술대회논문집 (Proceedings of the Korea Information Processing Society Conference)
- 한국정보처리학회 2001년도 춘계학술발표논문집 (하)
- /
- Pages.837-840
- /
- 2001
- /
- 2005-0011(pISSN)
- /
- 2671-7298(eISSN)
클러스터링을 이용한 텍스트 특성 인식
Text Characteristic Recognition Using by Clustering
초록
텍스트 특성을 인식하는 방법적 접근은 텍스트의 기본적 특성을 이용하는 것에서부터 다변량 기법까지 다양한 방법이 제안되고 이용되고 있다. 이 논문에서는 이런 여러 기법들 중 클러스터링 기법을 이용하여 텍스트의 특성을 인식하고 그 인식능력의 효과성을 확인하고자 하였다. p 개의 변수로 구성된 N 개의 개체들은 p-차원 공간에 흩어진 N 개의 점으로 생각될 수 있으며 이들이 어떤 의미의 조밀성을 가지고 cluster를 이루고 있는지에 대한 정보는 자료의 구조를 이해하는데 매우 중요한 의미를 가지게 된다. 이런 결과들은 현재 우리학계의 도작사건논쟁, 인문학계 특히 고대사학과 민족 정체성에 대한 거대 담론들에 대한 여러 형태의 유용한 실증적 전거를 마련해주게 될 것이다.
키워드