Proceedings of the Korean Society for Information Management Conference (한국정보관리학회:학술대회논문집)
- 2003.08a
- /
- Pages.65-72
- /
- 2003
Improving Time Efficiency of kNN Classifier Using Keywords
대표용어를 이용한 kNN 분류기의 처리속도 개선
Abstract
kNN 기법은 높은 자동분류 성능을 보여주지만 처리 속도가 느리다는 단점이 있다. 이를 극복하기 위해 입력문서의 대표용어 w개를 선정하고 이를 포함한 학습문서만으로 학습집단을 축소함으로써 자동분류 속도를 향상시키는 kw_kNN을 제안하였다. 실험 결과 대표 용어를 5개 사용할 경우에는 kNN 대비 문서간 비교횟수를 평균 18.4%로 축소할 수 있었다. 그러면서도 성능저하를 최소화하여 매크로 평균 F1 척도면에서는 차이가 없고 마이크로 평균정확률 면에서는 약 l∼2% 포인트 이내로 kNN 기법의 성능에 근접한 결과를 얻었다.
Keywords