WWW상에서 음란물 검색기법

Obscene Material Searching Method in WWW

  • 노경택 (서울보건전문대학 사무자동학과) ;
  • 김경우 (서울보건전문대학 사무자동학과) ;
  • 이기영 (서울보건전문대학 사무자동학과) ;
  • 김규호 (서울보건전문대학 사무자동학과)
  • 발행 : 1999.06.01

초록

WWW은 기존의 인터넷이 단순 문자 자료 중심의 데이타 교환을 멀티미디어화 하기 위한 프로토콜이며, 자료들을 하이퍼텍스트 형태로 저장함으로써 초보자들도 쉽게 원하는 자료를 찾고, 접근할 수 있도록 되어있다. 이러한 WWW의 멀티미디어 데이타의 검색 및 접근의 용이성은 음란물 데이타가 보편화, 멀티미디어화 되는데 결정적인 역활을 하였으며, 음란물의 상업화를 가능케 하는 사회적 문제를 야기하였다. 한편, 이러한 문제를 해결하기 위해 음란물을 제공하는 사이트를 효율적으로 차단하기 연구가 활발하게 진행되고 있다. 본 논문에서는 이러한 음란물을 제공하는 사이트를 효율적으로 검색하여, 미성년자의 음란성 사이트접근을 차단하기 위한 기법을 제시하고 이를 구현하였다. 제안된 기법은 링크를 기반으로 정보 검색 기능을 수행하며, 가장 정확한 결과를 보여 주는 것으로 알려진 확률 모델과 비교한 결과 제안된 모델(Link-Based Model)이 확률 모델보다 평균 재현율과 정확율에서 12%와 8% 성능이 우수하였다. 특히 텍스트 이외의 데이타와 적은 링크를 가진 문서들을 검색하는데 크게 효율성이 향상되었다.

World-Wide Web(WWW) is a protocol for changing information exchanges which is central to text documents in the existing network to make a multimedia data exchanges. It is possible for a beginner to search and access data which he wants to find as data were stored in the form of hypertext. The easiness for searching and accessing the multimedia data in WWW makes a important role for obscene materials to be toward generalization and multimedia and occurs social problems for them to be commercialized, while other researchers have actively studied the way to block effectively the site providing obscene materials for solving such problems. This paper presents and implements the blocking method for the sites having obscene material as it effectively search them. The proposed model was based on Link-Based information retrieval method and proved that it accomplished more efficient retrieval of relevant documents than probabilistic model when compared the one with the other which is known to generate the most correct results. The improvements in the average recall and precision ratio were shown as 12% and 8% respectively. Especially, the retrieval capability of relevant documents which include non-text data and have a few links increased highly.

키워드