Sentiment Analysis of movie review for predicting movie rating

영화리뷰 감성 분석을 통한 평점 예측 연구

  • 조정태 ((주)사이버다임) ;
  • 최상현 (충북대학교 경영정보학과, BK21+BSO 사업팀)
  • Received : 2015.05.08
  • Accepted : 2015.09.15
  • Published : 2015.09.30

Abstract

Currently, the influence of the Internet portal sites that can make it quick and easy to contact the vast amount of information is increasing. Users can connect the Internet through a portal to obtain information, such as communication between Internet users, which can be used to meet a variety of purposes. People are exposed to a variety of information from other users in the search for a movie and get information. The impact on the reviews and ratings with the limited number of characters of the film allows users to form a relationship to the movie, decide whether you want to see the movie or find another movie. but, the user can not read the whole movie review. When user see the overall evaluation, the user can receive the correct information. This research conducted a study on the prediction of the rating by the use of review data. Information of reviews, is divided into two main areas: the"fact" and "opinion". "Fact" is to convey the dispassionate information and "Opinion" is, to represent the user's feelings. In this study, we built sentiment dictionary based on the assessment and evaluation of the online review and applied to evaluate other movies. In the comparative study with a simple emotion evaluation technique, we found the suggested algorithm got the more accurate results.

인터넷 포털은 많은 양의 정보를 빠르고 쉽게 이용 할 수 있다는 특성 때문에 지속적으로 영향력이 커지고 있다. 웹 이용자들은 다양한 정보 습득, 네티즌 간의 정보 교환 등 다양한 목적을 위해 포털 사이트를 사용하고 있다. 문화콘텐츠 이용자들은 타인의 경험을 미리 알아보기 위해 포털 사이트에서 정보를 검색한 후 해당콘텐츠를 사용하고 개인적인 의견을 게시하기도 한다. 영화를 보고자 하는 이용자들은 관련 정보를 검색하고 얻는 과정에서 영화에 대한 다른 이용자들이 게시한 다양한 정보들을 접하게 된다. 영화 관련 포털사이트에서는 영화에 대한 제한된 글자수의 리뷰와 평점을 제공하는데 이와 같은 정보의 영향으로 영화에 대한 태도를 형성할 뿐 아니라, 영화 관람 여부를 결정하도록 만들 수 있다. 하지만 영화 리뷰는 사용자가 전체를 읽을 수 없기 때문에 일부 리뷰와 리뷰 개개의 평점보다는 전체 평점을 참고 하여 의사결정을 하는 정도가 대부분이다. 이처럼 전체 평점만을 참고하게 되면 편향적인 정보 습득으로 인하여 잘못된 판단을 할 수 있게 된다. 이러한 리뷰의 특성에도 불구하고 리뷰는 사용자의 의견을 풍부하게 드러내고 영화를 보지 않은 다른 이용자들의 선택에 영향을 미친다는 점에서 다양한 실용적 활용성을 갖는 데이터임은 분명하다. 본 연구에서는 리뷰 데이터를 활용하여 평점을 예측하기 위한 평점예측 연구를 수행하였다. 리뷰테이터를 형태소로 추출하고 형태소별로 극성값을 계산하여 리뷰에 대한 평점을 예측하는 모형으로서, 기존의 긍부정 값만을 근거로 하는 모형에 비해 정확도가 높아진 것을 확인하였다.

Keywords