초록
현재 인터넷 사용자가 증가하면서 비속어 사용이 무분별하게 증가하고 있다. 이에 따른 청소년들의 사이버폭력도 매우 심각하게 증가하고 있으며 그중에서도 사이버 언어폭력이 가장 심각하게 대두되고 있다. 사이버 언어폭력을 근절하기 위해 비속어 판별 연구가 계속 진행되고 있으나 단어의 의미와 문맥의 흐름을 보고 비속어를 판별하는 방법은 정확도가 미흡한 실정이다. 따라서 본 논문에서는 고의로 변형한 비속어와 비속어로 잘못 판별된 표준어를 문맥의 흐름을 보고 정확하게 판별할 수 있도록 FastText 모델과 LSTM 모델을 활용하여 비속어를 판별하는 방법을 제안한다.
Currently, as Internet users increase, the use of swearword is indiscriminately increasing. As a result, cyber violence among teenagers is increasing very seriously, and among them, cyber-language violence is the most serious. In order to eradicate cyber-language violence, research on detection of swearword has been conducted, but the method of detecting swearword by looking at the meaning of words and the flow of context is insufficient. Therefore,in this paper,we propose a method of detecting swearword using FastText model and LSTM model so that deliberately modified swearword and standard language can be accurately detected by looking at the flow of context.