• 제목/요약/키워드: 성능정보

검색결과 26,804건 처리시간 0.052초

소셜 미디어 상에서의 인공지능 관련 사회적 여론에 대한 다 범주 감성 분석 (Multi-Category Sentiment Analysis for Social Opinion Related to Artificial Intelligence on Social Media)

  • 이상원;최창욱;김동성;여운영;김종우
    • 지능정보연구
    • /
    • 제24권4호
    • /
    • pp.51-66
    • /
    • 2018
  • 인공지능 기술의 비약적인 발전으로 인하여, 사용자의 편의성 증대를 목적으로 다양한 분야에서 관련된 제품과 서비스들의 개발이 이루어지고 있다. 이러한 기술의 발전에는 긍정적인 파급 효과에 대한 기대감이 존재하나, 향후 발생 가능한 부정적인 측면에 대한 논의도 활발히 이루어지고 있다. 예를 들어, 인공지능 기술 기반의 자율주행 자동차의 경우 안정성의 향상이라는 측면에서 많은 관심을 받고 있으나, 트롤리 딜레마, 시스템 보안 문제 등의 사회적 이슈 또한 활발히 논의되고 있다. 이에 따라, 인공지능 관련 기술의 발전과 사회적 수용을 위해서는 사회적으로 논의되는 주요 관련 이슈들에 대한 확인과 효과적인 분석이 요구된다. 이를 위해, 본 연구에서는 '이세돌 vs 알파고' 시점인 2016년 3월을 포함하여 2016년 1월부터 2017년 12월까지 2년 동안의 인공지능과 관련된 사회적인 이슈들을 파악하고 온라인상에서 발생되는 사회적 여론에 대하여 다 범주 감성을 분석하고자 한다. 이를 위하여 국내 대표적인 포털 사이트에서 인공지능 관련 뉴스의 수와 관련된 뉴스 제목, 뉴스의 댓글을 웹 크롤링(Web Crawling) 하였다. 사회적 여론에 대한 다 범주 감성 분석은 논의되는 이슈들의 중요성을 고려하여 단순 긍정 또는 부정이 아닌, 분노, 혐오, 두려움, 행복, 중립, 슬픔, 놀라움의 7가지 다 범주 감성으로 분석하였다. 분석 결과, 대부분의 이벤트 기간에 대하여 1위 감성은 '행복'으로 나타났지만 각 키워드에 대하여 나오는 감성이 상이함을 볼 수 있었다. 또한 2016년 상반기, 하반기, 2017년 상반기, 하반기로 나누어 보았을 때 시간이 지남에 따라 '분노'의 감성이 낮아짐을 확인하였다. 이러한 분석 결과를 바탕으로 인공지능과 관련하여 현재 논의되고 있는 다양한 이슈와 동향 파악이 가능하며, 이에 대한 대응 방안 마련에 활용이 가능할 것이다. 향후 감성 분석기의 성능 향상과 댓글에 대한 공감 및 비공감도의 가중치를 추가하여 분석한다면 사회적 여론을 보다 세밀하게 파악 할 수 있을 것이다.

적대적 생성 모델을 활용한 사용자 행위 이상 탐지 방법 (Anomaly Detection for User Action with Generative Adversarial Networks)

  • 최남웅;김우주
    • 지능정보연구
    • /
    • 제25권3호
    • /
    • pp.43-62
    • /
    • 2019
  • 한때, 이상 탐지 분야는 특정 데이터로부터 도출한 기초 통계량을 기반으로 이상 유무를 판단하는 방법이 지배적이었다. 이와 같은 방법론이 가능했던 이유는 과거엔 데이터의 차원이 단순하여 고전적 통계 방법이 효과적으로 작용할 수 있었기 때문이다. 하지만 빅데이터 시대에 접어들며 데이터의 속성이 복잡하게 변화함에 따라 더는 기존의 방식으로 산업 전반에 발생하는 데이터를 정확하게 분석, 예측하기 어렵게 되었다. 따라서 기계 학습 방법을 접목한 SVM, Decision Tree와 같은 모형을 활용하게 되었다. 하지만 지도 학습 기반의 모형은 훈련 데이터의 이상과 정상의 클래스 수가 비슷할 때만 테스트 과정에서 정확한 예측을 할 수 있다는 특수성이 있고 산업에서 생성되는 데이터는 대부분 정답 클래스가 불균형하기에 지도 학습 모형을 적용할 경우, 항상 예측되는 결과의 타당성이 부족하다는 문제점이 있다. 이러한 단점을 극복하고자 현재는 클래스 분포에 영향을 받지 않는 비지도 학습 기반의 모델을 바탕으로 이상 탐지 모형을 구성하여 실제 산업에 적용하기 위해 시행착오를 거치고 있다. 본 연구는 이러한 추세에 발맞춰 적대적 생성 신경망을 활용하여 이상 탐지하는 방법을 제안하고자 한다. 시퀀스 데이터를 학습시키기 위해 적대적 생성 신경망의 구조를 LSTM으로 구성하고 생성자의 LSTM은 2개의 층으로 각각 32차원과 64차원의 은닉유닛으로 구성, 판별자의 LSTM은 64차원의 은닉유닛으로 구성된 1개의 층을 사용하였다. 기존 시퀀스 데이터의 이상 탐지 논문에서는 이상 점수를 도출하는 과정에서 판별자가 실제데이터일 확률의 엔트로피 값을 사용하지만 본 논문에서는 자질 매칭 기법을 활용한 함수로 변경하여 이상 점수를 도출하였다. 또한, 잠재 변수를 최적화하는 과정을 LSTM으로 구성하여 모델 성능을 향상시킬 수 있었다. 변형된 형태의 적대적 생성 모델은 오토인코더의 비해 모든 실험의 경우에서 정밀도가 우세하였고 정확도 측면에서는 대략 7% 정도 높음을 확인할 수 있었다.

비대칭 오류 비용을 고려한 XGBoost 기반 재범 예측 모델 (A Recidivism Prediction Model Based on XGBoost Considering Asymmetric Error Costs)

  • 원하람;심재승;안현철
    • 지능정보연구
    • /
    • 제25권1호
    • /
    • pp.127-137
    • /
    • 2019
  • 재범예측은 70년대 이전부터 전문가들에 의해서 꾸준히 연구되어온 분야지만, 최근 재범에 의한 범죄가 꾸준히 증가하면서 재범예측의 중요성이 커지고 있다. 특히 미국과 캐나다에서 재판이나 가석방심사 시 재범 위험 평가 보고서를 결정적인 기준으로 채택하게 된 90년대를 기점으로 재범예측에 관한 연구가 활발해졌으며, 비슷한 시기에 국내에서도 재범요인에 관한 실증적인 연구가 시작되었다. 지금까지 대부분의 재범예측 연구는 재범요인 분석이나 재범예측의 정확성을 높이는 연구에 집중된 경향을 보이고 있다. 그러나 재범 예측에는 비대칭 오류 비용 구조가 있기 때문에 경우에 따라 예측 정확도를 최대화함과 동시에 예측 오분류 비용을 최소화하는 연구도 중요한 의미를 가진다. 일반적으로 재범을 저지르지 않을 사람을 재범을 저지를 것으로 오분류하는 비용은 재범을 저지를 사람을 재범을 저지르지 않을 것으로 오분류하는 비용보다 낮다. 전자는 추가적인 감시 비용만 증가되는 반면, 후자는 범죄 발생에 따른 막대한 사회적, 경제적 비용을 야기하기 때문이다. 이러한 비대칭비용에 따른 비용 경제성을 반영하여, 본 연구에서 비대칭 오류 비용을 고려한 XGBoost 기반 재범 예측모델을 제안한다. 모델의 첫 단계에서 최근 데이터 마이닝 분야에서 높은 성능으로 각광받고 있는 앙상블 기법, XGBoost를 적용하였고, XGBoost의 결과를 로지스틱 회귀 분석(Logistic Regression Analysis), 의사결정나무(Decision Trees), 인공신경망(Artificial Neural Networks), 서포트 벡터 머신(Support Vector Machine)과 같은 다양한 예측 기법과 비교하였다. 다음 단계에서 임계치의 최적화를 통해 FNE(False Negative Error)와 FPE(False Positive Error)의 가중 평균인 전체 오분류 비용을 최소화한다. 이후 모델의 유용성을 검증하기 위해 모델을 실제 재범예측 데이터셋에 적용하여 XGBoost 모델이 다른 비교 모델 보다 우수한 예측 정확도를 보일 뿐 아니라 오분류 비용도 가장 효과적으로 낮춘다는 점을 확인하였다.

KOMPSAT-3/3A 영상 기반 하천의 탁도 산출 연구 (A Study on the Retrieval of River Turbidity Based on KOMPSAT-3/3A Images)

  • 김다희;원유준;한상명;한향선
    • 대한원격탐사학회지
    • /
    • 제38권6_1호
    • /
    • pp.1285-1300
    • /
    • 2022
  • 탁도는 부유물질에 의한 빛의 산란 또는 흡수로 인한 수체의 흐림을 나타내는 수치로 수질 관리 분야에서 중요 지표로 활용되고 있다. 탁도는 소규모의 하천에서 변동성이 심할 수 있으며, 이는 국가하천의 수질에 직접적으로 영향을 준다. 따라서 고해상도의 탁도 공간정보 산출은 매우 중요하다. 이 연구에서는 Korea Multi-Purpose Satellite-3 및 -3A (KOMPSAT-3/3A) 영상으로부터 한강 수계 하천의 고해상도 탁도 매핑을 위한 eXtreme Gradient Boosting (XGBoost) 알고리즘 기반의 탁도 산출 모델을 개발하였다. 이를 위해 총 24장의 KOMPSAT-3/3A 영상과 150장의 Landsat-8 영상으로부터 계산된 대기 상단(Top Of Atmosphere, TOA) 반사율을 활용하였으며, Landsat-8 TOA 반사율은 KOMPSAT-3/3A의 관측 파장 대역에 적합하도록 교차검보정을 수행하였다. 국가수질자동관측망에서 측정된 탁도를 탁도 산출 모델의 참조자료로 사용하였고, 입력 변수로는 탁도가 실측된 위치에서의 TOA 분광반사율과 탁도 분석에 널리 이용되어 온 분광지수인 정규식생지수, 정규수분지수, 정규탁도지수, 그리고 Moderate Resolution Imaging Spectroradiometer (MODIS)의 대기 산출물(에어로졸 광학 두께, 수증기량, 오존)을 사용하였다. 또한 고탁도와 저탁도에 대한 KOMPSAT-3/3A TOA 분광반사율을 분석하여 탁도를 설명할 수 있는 새로운 정규탁도지수(new normalized difference turbidity index, nNDTI)를 제안하였고, 이를 탁도 산출 모델에 입력 변수로 추가하였다. XGBoost 기반 탁도 산출 모델은 현장관측 탁도와 비교하여 2.70 NTU의 평균 제곱근 오차(root mean square error, RMSE) 및 14.70%의 정규화된 RMSE(normalized RMSE)를 가지는 탁도를 예측하여 우수한 성능을 보였으며, 이 연구에서 새롭게 제안한 nNDTI가 탁도 산출에 있어 가장 중요한 변수로 사용되었다. 개발된 탁도 산출 모델을 KOMPSAT-3/3A 영상에 적용하여 하천 탁도를 고해상도로 매핑하였으며, 탁도의 시공간적 변동에 대한 분석이 가능하였다. 이 연구를 통하여 고해상도의 정확한 탁도 공간정보 산출에 KOMPSAT-3/3A 영상이 매우 유용함을 확인할 수 있었다.

YOLO 알고리즘 기반 국토위성영상의 선박 모니터링 가능성 평가 연구: 부산 신항과 캘리포니아 오클랜드항을 대상으로 (A Study on Evaluating the Possibility of Monitoring Ships of CAS500-1 Images Based on YOLO Algorithm: A Case Study of a Busan New Port and an Oakland Port in California)

  • 박상철;박영빈;장소영;김태호
    • 대한원격탐사학회지
    • /
    • 제38권6_1호
    • /
    • pp.1463-1478
    • /
    • 2022
  • 한국 수출입의 99.7%는 해상운송이 차지하고 있으며, 항만의 효율적 운영을 위해 해운 물류 모니터링 시스템 개발 필요성이 대두되고 있다. 현재 automatic identification system (AIS)를 기반으로 선박의 정보를 조회하여 해상 물동량 추정 연구가 진행되고 있지만, AIS를 운영하지 않는 선박들에 대한 모니터링은 불가능하다는 한계가 있다. 고해상도 광학 위성 영상은 광역의 범위에서 AIS 미운영 선박 및 소형 선박을 식별할 수 있기 때문에 AIS 기반 물동량 모니터링의 공백을 보완할 수 있다. 그러므로 선박 및 물동량 모니터링에 활용하기 위해, 고해상도 광학 위성영상에서 선박을 탐지하고 화물선 및 소형 선박을 분류하는 연구가 필요하다. 본 연구는 초기 국토위성영상을 이용하여 생산된 학습 자료 기반으로 인공지능 모델을 훈련시키고 다른 영상에서 탐지를 수행함으로써, 국토위성영상의 딥러닝 학습 자료 생산 및 선박 모니터링 활용 가능성을 알아보고자 하였다. 학습 자료는 황해 및 황해 주요 항만 구역 내 선박들을 추출하여 제작했으며, You Only Look Once (YOLO) 알고리즘을 사용하여 탐지 모델은 구축하고 국내외 주요 항만 각 1개소를 대상으로 선박 탐지 성능을 평가하였다. 항만 접안 및 해상 정박중인 선박을 대상으로 탐지 모델에 적용한 결과를 AIS의 선종 정보와 비교하였고, 국내 항만에서 85.5%와 89%, 국외 항만에서 70%의 선종 분류 정확도를 확인하였다. 본 연구 결과는 정박중인 선박을 중심으로 고해상도 국토위성영상을 활용하여 모니터링이 가능함을 확인하였다. 향후 지속적인 학습 자료 구축을 통해 탐지 모델의 정확도를 향상시킨다면 전세계 주요 항만에서 선박 및 물동량 모니터링 분야에 활용할 수 있을 것으로 기대된다.

LED 조명의 광원별 최소 분광분포를 사용하여 자연광 색온도를 재현하는 방법 (A Method of Reproducing the CCT of Natural Light using the Minimum Spectral Power Distribution for each Light Source of LED Lighting)

  • 김양수;오승택;임재현
    • 인터넷정보학회논문지
    • /
    • 제24권2호
    • /
    • pp.19-26
    • /
    • 2023
  • 인간은 자연 빛에 적응하고 진화해왔으나 현재는 실내 생활의 비중이 높아짐에 따라 생체리듬 교란의 문제가 유발되었다. 이의 해결을 위해 일출~일몰간 다채롭게 변화하는 자연광의 색온도를 재현하는 조명이 연구되고 있다. 자연광 색온도의 재현을 위해서는 색온도가 다른 다수의 LED 광원을 사용하여 조명을 제작한 후 수백에서 수천 단계의 광원별 인가전류의 조합에 대한 광특성을 측정 및 수집하여 제어지표 DB를 구성하고 광특성 매칭 방법을 통해 조명을 제어하였다. 이러한 제어 방법은 인가전류의 조합 단계를 세밀하게 할수록 많은 시간 및 경제적 비용이 발생한다는 문제가 있다. 이에 본 논문에서는 LED 광원별 최소 분광분포로 보간 및 조합 연산을 수행하여 자연광 색온도를 재현하는 방법을 제안한다. 먼저 색온도가 다른 광원 채널로 구성되고 각 채널별 256단계의 인가전류 제어 기능을 구현한 LED 조명을 대상으로 채널별 5개의 최소 분광분포(Spectral Power Distribution, SPD)를 실측·수집한다. 이후 수집한 SPD를 대상으로 각 채널별 256단계의 SPD를 생성하는 보간 연산을 수행하고, 채널별 SPD의 조합 연산을 통해 LED 조명의 모든 제어 조합에 대한 SPD를 생성한다. 생성된 SPD를 통해 조도와 색온도를 산출하여 제어지표 DB를 구축한 후 매칭 기법을 통해 자연광의 색온도를 재현한다. 성능 평가에서는 실내 권장 조도 기준을 충족하면서도 평균 오차율 0.18%의 범위 내에서 자연광의 시간별 색온도를 제공하였다.

GOCI-II 기반 괭생이모자반 모니터링 시스템 성능 평가: 황해 및 동중국해 해역 오탐지 제거 결과를 중심으로 (Performance Evaluation of Monitoring System for Sargassum horneri Using GOCI-II: Focusing on the Results of Removing False Detection in the Yellow Sea and East China Sea)

  • 이한빛;김주은;김문선;김동수;민승환;김태호
    • 대한원격탐사학회지
    • /
    • 제39권6_2호
    • /
    • pp.1615-1633
    • /
    • 2023
  • 괭생이모자반은 황해 및 동중국해에서 대규모 번식하는 부유조류 중 하나로 우리나라 연안에 유입되어 환경 파괴 및 양식업 피해 등 다양한 문제점을 야기한다. 효율적인 피해 예방 및 연안 환경 보존을 위하여 최근 인공위성 기반 원격탐사 기술을 활용한 괭생이모자반 탐지 알고리즘 개발이 활발하게 이루어지고 있다. 하지만, 잘못된 탐지 정보는 해상 수거 선박의 이동 거리 증가, 지자체나 유관기관의 대응 혼선 등을 유발하므로 괭생이모자반 공간정보 생산 시 오탐지 최소화는 매우 중요하다. 본 연구는 국립해양조사원 국가해양위성센터의 GOCI-II 기반 괭생이모자반 탐지 알고리즘을 활용하여 자동으로 오탐지 화소를 제거하는 기술을 적용하였다. 주요 오탐지 발생 원인 분석 결과를 바탕으로 선형·산발적 오탐지 및 봄, 여름철에 중국 연안에서 대량으로 발생하는 녹조류를 오탐지로 간주하여 제거하는 과정을 포함하였다. 2022년 2월 24일부터 6월 25일까지 괭생이모자반 발생일을 대상으로 오탐지 자동 제거 기법을 적용하고, 중해상도 위성 영상을 이용하여 육안 판독 결과를 생성하고 정성적, 정량적 평가를 수행하였다. 선형 오탐지는 완전히 제거하였으며, 산발적 및 녹조 오탐지는 분포 파악에 영향을 주는 대부분의 오탐지 결과를 제거하였다. 자동 오탐지 제거 과정 이후에도 육안 판독 결과 대비 괭생이모자반의 분포 면적 확인이 가능하였으며, 이진분류모델을 이용하여 정확도와 정밀도는 각각 평균 97.73%, 95.4%로 산출하였다. 재현율은 매우 낮은 29.03%였는데, 이는 GOCI-II와 중해상도 위성영상의 관측 시간 불일치에 의한 괭생이모자반 이동 영향, 공간해상도 차이, 정사보정에 따른 위치 편차, 그리고 구름 마스킹 영향에 의한 것으로 추정하였다. 본 연구의 괭생이모자반 오탐지 제거 결과는 공간적인 분포 현황을 준실시간으로 파악할 수 있으나 생체량을 정확하게 추정하는 것은 한계가 존재하였다. 따라서, 지속적인 괭생이모자반 모니터링 시스템 고도화 연구를 통해 향후 괭생이모자반 대응계획수립을 위한 자료로 활용하고자 한다.

스마트 전시환경에서 부스 추천시스템의 사용자 의도에 관한 조사연구 (Analyzing the User Intention of Booth Recommender System in Smart Exhibition Environment)

  • 최재호;상균영;문현실;최일영;김재경
    • 지능정보연구
    • /
    • 제18권3호
    • /
    • pp.153-169
    • /
    • 2012
  • 전시회는 새로운 상품이나 서비스를 현재 고객들과 미래의 잠재고객들에게 홍보하기 위해 개최하는 효과적인 마케팅 수단으로 중요하다. 기업들은 전시회에 참여를 통해 현재 고객 및 잠재고객들과 대면접촉을 함으로써 기업의 이미지 제고 및 새로운 판로를 확보할 수 있다. 이처럼 전시회의 경제적 중요성이 커짐에 따라, 전시주최자들은 참여기업 및 참관객을 유치하기 위하여 새로운 IT 기술을 전시회에 적용하고 있을 뿐만 아니라 연구자들 또한 참관객의 관람패턴을 분석하기 위하여 다양한 연구를 시도하고 있다. 최근에는 스마트 기술이 발전함으로써 전시 공간 내에서 참관객의 활동을 실시간으로 모니터링 할 수 있어 온라인 전시환경처럼 오프라인 전시회를 방문한 참관객의니즈를 실시간으로 추론하여 참관객의 선호에 적합한 서비스를 제공하기 위한 부스 추천시스템에 대한 연구가 활발히 진행되고 있다. 그러나 새로운 기술 개발 측면에서 시스템의 성능을 개선하려는 연구는 지속적으로 진행되어 왔으나 향후 시스템의 개발 방향 및 보급 활성화에 영향을 미치는 요인에 관한 연구들이 부족한 실정이다. 부스 추천시스템은 스마트 전시환경에서 새로 도입되는 기술로 부스 추천시스템에 대한 참관객의 수용 후 재사용 의도는 TAM 관점보다는 부스 추천시스템이 참관객의 선호에 적합한 추천정보를 제공하는가에 초점을 맞출 필요가 있다. 따라서, 본 연구에서는 기존 문헌 고찰을 통해 전시환경에서의 부스 추천시스템에 대한 참관객의 만족 및 재사용 의도에 영향을 주는 요인을 도출하여 연구모형을 설계하였다. 이를 통해 향후 스마트 전시환경에서 부스 추천시스템의 개발과 보급 전략에 있어 유용한 시사점을 제공하고자 하였다. 이러한 연구목적을 달성하기 위하여 2011년 11월 DMC 컬처 오픈 행사에서 부스 추천시스템을 사용한 참관객을 대상으로 설문조사를 실시하였고 회귀분석을 통해 가설을 검증하였다. 그 결과, 참관객의 만족에 영향을 미치는 요인은 부스 추천시스템의 효과성, 편의성, 추천품질, 의외성으로 나타났다. 또한, 부스 추천시스템에 대한 참관객의 만족은 재사용 의도 형성에 긍정적인 영향을 미치는 것으로 밝혀졌다. 본 연구가 가지는 의의는 다음과 같다. 먼저, 본 연구결과를 토대로 스마트 전시환경에서 부스 추천시스템에 대한 참관객의 지속적인 서비스 이용을 유도하기 위한 전략을 수립할 때 고려해야 할 주요한 요인을 실증연구를 통해 구체화시켰다는데 의의가 있다. 또한, 스마트 전시환경에서 부스 추천시스템이 성공적으로 도입 및 활용되기 위해서는 참관객의 수용 전후 차별화된 관리가 필요함을 본 연구결과를 통해 제시하였다.

카테고리 연관 규칙 마이닝을 활용한 추천 정확도 향상 기법 (A Study on the Improvement of Recommendation Accuracy by Using Category Association Rule Mining)

  • 이동원
    • 지능정보연구
    • /
    • 제26권2호
    • /
    • pp.27-42
    • /
    • 2020
  • 인터넷이라는 가상 공간을 활용함으로써 물리적 공간의 제약을 갖는 오프라인 쇼핑의 한계를 넘어선 온라인 쇼핑은 다양한 기호를 가진 소비자를 만족시킬 수 있는 수많은 상품을 진열할 수 있게 되었다. 그러나, 이는 역설적으로 소비자가 구매의사결정 과정에서 너무 많은 대안을 비교 평가해야 하는 어려움을 겪게 함으로써 오히려 상품 선택을 방해하는 원인이 되기도 한다. 이런 부작용을 해소하기 위한 노력으로서, 연관 상품 추천은 수많은 상품을 다루는 온라인 상거래에서 소비자의 구매의사결정 과정 중 정보탐색 및 대안평가에 소요되는 시간과 노력을 줄여주고 이탈을 방지하며 판매자의 매출 증대에 기여할 수 있다. 연관 상품 추천에 사용되는 연관 규칙 마이닝 기법은 통계적 방법을 통해 주문과 같은 거래 데이터로부터 서로 연관성 높은 상품을 효과적으로 발견할 수 있다. 하지만, 이 기법은 거래 건수를 기반으로 하므로, 잠재적으로 판매 가능성이 높을지라도 충분한 거래 건수가 확보되지 못한 상품은 추천 목록에서 누락될 수 있다. 이렇게 추천 시 제외된 상품은 소비자에게 구매될 수 있는 충분한 기회를 확보하지 못할 수 있으며, 또 다시 다른 상품에 비해 상대적으로 낮은 추천 기회를 얻는 악순환을 겪을 수도 있다. 본 연구는 구매의사결정이 결국 상품이 지닌 속성에 대한 사용자의 평가를 기반으로 한다는 점에 착안하여, 추천 시 상품의 속성을 반영하면 소비자가 특정 상품을 선택할 확률을 좀더 정확하게 예측할 수 있다는 점을 추천 시스템에 반영하기 위한 목적으로 수행되었다. 즉, 어떤 상품 페이지를 방문한 소비자는 그 상품이 지닌 속성들에 어느 정도 관심을 보인 것이며 추천 시스템은 이런 속성들을 기반으로 연관성을 지닌 상품을 더 정교하게 찾을 수 있다는 것이다. 상품의 주요 속성의 하나로서, 카테고리는 두 상품 간에 아직 드러나지 않은 잠재적인 연관성을 찾기에 적합한 대상이 될 수 있다고 판단하였다. 본 연구는 연관 상품 추천에 상품 간의 연관성뿐만 아니라 카테고리 간의 연관성을 추가로 반영함으로써 추천의 정확도를 높일 수 있는 예측모형을 개발하였고, 온라인 쇼핑몰로부터 수집된 주문 데이터를 활용하여 이루어진 실험은 기존 모형에 비해 추천 성능이 개선됨을 보였다. 실무적인 관점에서 볼 때, 본 연구는 소비자의 구매 만족도를 향상시키고 판매자의 매출을 증가시키는 데에 기여할 수 있을 것으로 기대된다.

마켓 인사이트를 위한 상품 리뷰의 다차원 분석 방안 (Multi-Dimensional Analysis Method of Product Reviews for Market Insight)

  • 박정현;이서호;임규진;여운영;김종우
    • 지능정보연구
    • /
    • 제26권2호
    • /
    • pp.57-78
    • /
    • 2020
  • 인터넷의 발달로, 소비자들은 이커머스에서 손쉽게 상품 정보를 확인한다. 이때 활용되는 상품 리뷰는 사용자 경험을 토대로 작성되어 구매의사결정의 효율성을 높일 뿐만 아니라 상품 개발에 도움을 주기도 한다. 하지만, 방대한 양의 상품 리뷰에서 관심있는 평가차원의 세부내용을 파악하는 데에는 많은 시간과 노력이 소비된다. 예를 들어, 노트북을 구매하려는 소비자들은 성능, 무게, 디자인과 같은 평가차원에 대해 각 차원별로 비교 상품의 평가를 확인하고자 한다. 따라서 본 논문에서는 상품 리뷰에서 다차원 상품평가 점수를 자동적으로 생성하는 방안을 제안하고자 한다. 본 연구에서 제시하는 방안은 크게 2단계로 구성된다. 사전준비 단계와 개별상품평가 단계로, 대분류 상품군 리뷰를 토대로 사전에 생성된 차원분류모델과 감성분석모델이 개별상품의 리뷰를 분석하게 된다. 차원분류모델은 워드임베딩과 연관분석을 결합함으로써 기존 연구에서 차원과 단어들의 관련성을 찾기 위한 워드임베딩 방식이 문장 내 단어의 위치만을 본다는 한계를 보완한다. 감성분석모델은 정확한 극성 판단을 위해 구(phrase) 단위로 긍부정이 태깅된 학습데이터를 구성하여 CNN 모델을 생성한다. 이를 통해, 개별상품평가 단계에서는 구 단위의 리뷰에 준비된 모델들을 적용하고 평가차원별로 종합함으로써 다차원 평가점수를 얻을 수 있다. 본 논문의 실험에서는 대분류 상품군 리뷰 약 260,000건으로 평가모델을 구성하고, S사와 L사의 노트북 리뷰 각 1,011건과 1,062건을 실험데이터로 활용한다. 차원분류모델은 구로 분해한 개별상품 리뷰를 6개 평가차원으로 분류했고, 기존 워드임베딩 방식보다 연관분석을 결합한 모델의 정확도가 13.7% 증가했음을 볼 수 있었다. 감성분석모델은 문장보다 구 단위로 학습한 모델이 평가차원을 면밀히 분석함으로써 29.4% 더 높은 정확도를 보임을 확인했다. 본 연구를 통해 판매자, 소비자 모두가 상품의 다차원적 비교가 가능하다는 점에서 구매 및 상품 개발에 효율적인 의사결정을 기대할 수 있다.