• 제목/요약/키워드: 트윗

검색결과 169건 처리시간 0.029초

토픽 모델링을 이용한 트위터 데이터의 공간 분포 패턴 분석 (Spatial Distribution Patterns of Twitter Data with Topic Modeling)

  • 우현지;김영훈
    • 한국지역지리학회지
    • /
    • 제23권2호
    • /
    • pp.376-387
    • /
    • 2017
  • 본 연구는 트위터를 대상으로 트윗 공간 데이터에서 지리적 의미를 탐색하기 위한 방법을 모색하였다. 트윗 공간 데이터의 구축 과정 및 지리적 분석의 프레임워크를 정립하고 지리적 연구 방법론을 제안하였다. 이를 위해 본 연구는 제주도의 GPS 좌표 참조 트윗(geotweet)을 대상으로 트윗의 내용적 특성과 트윗 발생 위치의 공간 분포 특성을 확인하였다. 제주도 좌표 참조 트윗에서는 지명 또는 장소명이 많이 출현하였는데, 이는 자신의 위치를 알리고자하는 의도로 파악하였다. 트윗의 공간 분포는 제주공항을 중심으로 한 일부 관광지 주변으로 핫스팟이 확인되었고, 이는 제주도 유동인구 핫스팟과 유사한 패턴을 보였다. 주제 중심의 트윗 분석을 위해 본 연구에서는 토픽 모델링 알고리즘을 이용하여 분석하였다. 분석 결과, 주제의 지리적 위치와 트윗의 내용은 서로 관련이 있음을 알 수 있었다. 마지막으로 본 연구는 토픽 모델링 분석을 통해 방대한 트윗 데이터의 내용에 상응하는 지역 분포 특성을 직관적으로 확인하는데 유용하게 활용될 수 있다는 것을 확인하였다.

  • PDF

소셜 데이터에서 재난 사건 추출을 위한 사용자 행동 및 시간 분석을 반영한 토픽 모델

  • 촐몽 바야르;이경순
    • 정보와 통신
    • /
    • 제34권6호
    • /
    • pp.43-50
    • /
    • 2017
  • 본고에서는 소셜 빅데이터에서 공공안전에 위협되고 사회적으로 이슈가 되는 재난사건을 추출하기 위한 방법으로 소셜 네트워크상에서 사용자 행동 분석과 시간분석을 반영한 토픽 모델링 기법을 알아본다. 소셜 사용자의 글 수, 리트윗 반응, 활동주기, 팔로워 수, 팔로잉 수 등 사용자의 행동 분석을 통하여 활동적이고 신뢰성 있는 사용자를 분류함으로써 트윗에서 스팸성과 광고성을 제외하고 이슈에 대해 신뢰성 높은 사용자가 쓴 트윗을 중요하게 반영한다. 또한, 트위터 데이터에서 새로운 이슈가 발생한 것을 탐지하기 위해 시간별 핵심어휘 빈도의 분포 변화를 측정하고, 이슈 트윗에 대해 감성 표현 분석을 통해 핵심이슈에 대해 사건 어휘를 추출한다. 소셜 빅데이터의 특성상 같은 날짜에 여러 이슈에 대한 트윗이 많이 생성될 수 있기 때문에, 트윗들을 토픽별로 그룹핑하는 것이 필요하므로, 최근 많이 사용되고 있는 LDA 토픽모델링 기법에 시간 특성과 사용자 특성을 분석한 시간상에서의 중요한 사건 어휘를 반영하고, 해당이슈에 대한 신뢰성 있는 사용자가 쓴 트윗을 중요시 반영하도록 토픽모델링 기법을 개선한 소셜 사건 탐지 방법에 대해 알아본다.

K-POP 연관 해시태그 크롤링을 이용한 맛집 추천 시스템 개발 (Development of Restaurant Recommendation System Using K-Pop Hashtag Crawling)

  • 김화선;이채연;조서윤;나정은
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2022년도 추계학술발표대회
    • /
    • pp.878-880
    • /
    • 2022
  • COVID-19 상황 속에서도 전 세계 Twitter K-POP 콘텐츠 관련 트윗 양은 78억 건 이상으로 매년 성장세를 보인다. Twitter 내 K-POP 팬들은 아티스트 관련 해시태그를 포함한 트윗을 작성하여 같은 팬덤끼리 실시간으로 정보를 전달하고 생산한다. 이러한 맛집 트윗들은 K-POP 팬들이 Twitter 내에서 신뢰도 있는 맛집 정보를 얻는 용도로 사용된다. 하지만 팬들이 정보를 얻기 위해서는 여러 맛집 해시태그로 검색하고 리트윗 수가 많은 트윗을 직접 찾아야 한다. 기존의 맛집 추천 시스템은 서비스 제공자 중심의 구조를 띤다. 서비스 제공자가 일방적으로 정보를 전달하거나, 사용자 리뷰 갱신 간격이 길다는 한계가 존재한다. 본 논문에서는 Twitter 내 K-POP 맛집 해시태그가 포함된 트윗을 Twitter API와 Tweepy를 사용하여 크롤링하였다. 수집한 데이터의 좋아요 수와 리트윗 수를 바탕으로 데이터 필터링을 진행하여 bot user와 광고 계정이 제외된 맛집 관련 트윗을 추출한다. 최종적으로는 추출한 트윗의 정보를 마커로 표시하여 웹 사이트를 제작하였다. K-POP 팬들은 맛집 해시태그를 검색하여 일일이 찾을 필요 없이 웹 사이트에 방문하여 맛집 위치를 확인할 수 있다. 웹 사이트 사용자의 위치가 지도상에 표시되어 가까운 맛집을 찾기도 편리하다. 본 논문에서는 맛집의 위치를 서대문구로 한정하여 진행했다.

트위터에서 트윗 주기와 사용자 속도 사이 관계 (Relationship Between Tweet Frequency and User Velocity on Twitter)

  • 전소영;이알찬;서고은;신원용
    • 한국정보통신학회논문지
    • /
    • 제19권6호
    • /
    • pp.1380-1386
    • /
    • 2015
  • 최근 위치 정보를 제공하는 온라인 소셜 네트워크 서비스들의 급증으로 인해 사용자들의 지리적 위치 데이터의 중요성이 강조되고 있다. 본 논문에서는 사용자들의 고 정밀 위치 정보를 알려주는 공간 태그된 트윗 (geo-tagged tweet) 정보를 활용하여 트위터 사용자들의 정확한 위치와 트윗 전송시각을 알아낸 후, 이를 통해 사용자의 평균 이동속도와 트윗 주기 (tweet frequency) 사이의 관계를 분석한다. 구체적으로, 트윗 빈도수 계산 알고리즘을 소개하며, 결과에 대한 분석은 국가별, 도시별로 나누어 진행한다. 주요 결과로써, 사용자 속도에 따른 트윗 주기가 멱 법칙 분포 (power-law distribution) (또는 Zipf의 법칙 분포, Pareto 분포)를 따름을 보인다. 또한, 미국과 일본에서의 결과를 비교할 때, 일본에서의 분포도 지수가 미국의 경우에 비해 작음을 확인한다.

유명인과의 트위터 매개 상호작용 특성 탐색 (Characteristics of Interactions between Fan and Celebrities on Twitter)

  • 황유선
    • 한국콘텐츠학회논문지
    • /
    • 제13권8호
    • /
    • pp.72-82
    • /
    • 2013
  • 본 연구에서는 트위터 상에서의 유명인과 트위터 이용자 사이에 이루어지는 트위터 매개 상호작용의 특성 및 감정 반응에 대해 탐색하였다. 이를 위해 유명인과의 트위터 매개 상호작용 유형을 '의사 교호작용', '정보 허브', 그리고 '팬덤' 등의 세 가지로 구분하였고, 유명인의 유형은 '연예인', '정치인', '전문인', 그리고 '블로거' 등의 네 가지로 분류하였다. 이렇게 구분된 트위터 매개 상호작용 및 유명인의 유형 범주에 따라 트위터 이용자들이 수행하는 트윗 행위의 특성을 분석 비교하였다. 또한 트위터 이용자들의 감정 반응을 나타내는 지표로 상정한 '이모티콘 이용'과 '감정 표현 제시' 빈도가 트위터 매개의 상호작용 유형 및 유명인 유형 범주에 따라 어떠한 차이가 있는지도 확인하였다. 분석을 위한 자료는 한국 트위터 공식 사이트를 통해 수집되었다. 공식 사이트를 활용하여 각 유형별 유명인에 대해 이루어진 트윗을 검색해 총 960개의 트윗을 수집하였고 각각의 트윗에 대한 내용 분석을 실시하였다. 분석 결과, 트위터 이용자들의 의사 교호작용 트윗 형태는 정치인과 전문가 유형에 대해서 가장 빈번했고, 팬덤 성격의 트윗은 연예인 유형에 대해서 가장 현저했으며, 정보 허브를 표방하는 트윗은 블로거 유형에 대해서 제일 빈번하게 수행된 것을 알 수 있었다. 감정 반응과 관련해서는 팬덤 유형의 트위터 매개 상호작용에 있어서 이모티콘 이용과 감정 표현의 제시 빈도가 가장 현저했다. 또 유명인 유형 중에서는 연예인에 대한 트윗에서 감정 반응이 가장 현저하게 드러났으며 이모티콘 이용 빈도는 전문인의 경우가 그 뒤를 이었고, 감정 표현 사용은 전문인과 정치인 유형이 유사한 것으로 확인되었다.

트윗 감정 분류를 위한 다양한 기계학습 자질에 대한 비교 연구 (Comparative Study of Various Machine-learning Features for Tweets Sentiment Classification)

  • 홍초희;김학수
    • 한국콘텐츠학회논문지
    • /
    • 제12권12호
    • /
    • pp.471-478
    • /
    • 2012
  • 문서를 대상으로 한 다양한 감정 분류 연구가 진행되어 왔으며, 최근에는 트윗 감정 분류에 그대로 적용되고 있다. 그러나 이러한 연구들은 트윗의 구조, 이모티콘, 철자 오류 그리고 신조어와 같은 트윗의 특징을 고려하지 않아 좋은 성능을 보이지 못하고 있다. 본 논문에서는 기계학습을 기반으로 다양한 자질을(이모티콘 극성, 리트윗 극성, 사용자 극성, 대체 어휘)사용하여 실험하여 트윗 감정 분류 성능의 영향을 확인하였다. 기계 학습기 SVM(Support Vector Machine) 기반의 감정 분류 실험으로 이모티콘 극성 자질과 사용자 극성 자질이 트윗 감정 분류 모델의 성능 향상에 기여를 하는 것을 알 수 있었다. 이와 비교하여 리트윗 극성과 대체 어휘 자질은 트윗 감정 분류 모델에 큰 영향이 없는 것을 알 수 있었다.

2014년~2015년 국가기록원 관련 트윗 이슈분석 (A study on the issue analysis of National Archives of Korea based on SNS(tweet) analysis between 2014~2015)

  • 서지원;박준형;오효정;윤은하
    • 기록학연구
    • /
    • 제50호
    • /
    • pp.139-175
    • /
    • 2016
  • 본 연구는 2014년과 2015년 국가기록원과 관련된 트윗을 수집, 내용분석에 기반한 이슈 파악에 대한 연구이다. 이를 위하여 2014년과 2015년에 생산된 트윗 중 '국가기록원'이라는 키워드가 언급된 모든 트윗을 수집하고, 내용을 분석, 세부 유형과 이슈들에 대해 분석하였다. 분석결과는 다음과 같다. 첫째, 국가기록원 소장 기록물 공개 및 소개에 대한 트윗들은 2년에 걸쳐 그 양은 증가하였지만 비슷한 생산 유형을 보이고 있었다. 둘째, 정치 사회적 트윗의 특징은 정치 사회적 이슈에 관한 국가기록원의 역할에 대한 내용으로 일반 트윗 이용자들에 의해 작성되었다.

이고-네트워크에 기반한 개인화된 트윗 추천 시스템 (Personalized Tweet Recommendation based on Ego-Network)

  • 송상철;홍지원;김상욱
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2016년도 춘계학술발표대회
    • /
    • pp.577-579
    • /
    • 2016
  • 트위터 이용자 수 증가로 인해, 유저의 타임라인에 하루 새롭게 기재되는 트윗 수가 급증하는 정보과다 현상이 중요한 이슈로 자리 잡은 지 오래다. 이에 본 논문은 이고-네트워크 정보를 바탕으로 학습 된 분류 시스템을 이용해 각각의 이고 유저마다 트윗 추천에 유리한 추천 방식을 예측하고, 이를 기반으로 선호할만한 트윗을 우선적으로 선별해주는 그래프 기반 트윗 추천 시스템을 제안한다. 실험을 통하여 단일한 추천 방식보다, 최고 11.5% 추천 정확도 성능이 향상함을 확인하였다.

한국어 트위터의 감정 분석 도구 (A Sentiment Analysis Tool for Korean Twitter)

  • 서형원;전길호;최명길;남유림;김재훈
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2011년도 제23회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.94-97
    • /
    • 2011
  • 본 논문은 자동으로 한글 트위터 메시지(트윗: tweet)에 포함된 감정을 분석하는 방법에 대하여 기술한다. 제안된 시스템에 의하여 수집된 트윗들은 어떤 질의에 대해 긍정 혹은 부정으로 분류된다. 이것은 일반적으로 어떤 상품을 구매하기 원하는 고객이나, 상품에 대한 고객들의 평가를 수집하기 원하는 기업에게 유용하다. 영문 트윗에 대한 연구는 이미 활발하게 진행되고 있지만 한글 트윗, 특히 감정 분류에 대한 연구는 아직 공개된 것이 없다. 수집된 트윗들은 기계 학습(Naive Bayes, Maximum Entropy, 그리고 SVM)을 이용하여 분류하였고 한글 특성에 따라 자질 선택의 기본 단위를 2음절과 3음절로 나누어 실험하였다. 기존의 영어에 대한 연구는 80% 이상의 정확도를 가지는 반면에, 본 실험에서는 60% 정도의 정확도를 얻을 수 있었다.

  • PDF

특징추출을 이용한 트위터 메시지 주제 분류 방법 (A Method of Classifying Tweet by subject using features)

  • 송지민;김한우;김동주;정성훈
    • 한국정보통신학회:학술대회논문집
    • /
    • 한국정보통신학회 2014년도 춘계학술대회
    • /
    • pp.905-907
    • /
    • 2014
  • 트위터는 전세계적으로 다양한 정보와 의견을 공유하는 교류의 장으로 이용되고 있다. 트위터에서 생성되는 막대한 양의 데이터를 활용하려는 시도가 이루어지고 있다. 그 중 다양한 주제별 정보를 추출하여 이용하려는 연구가 활발히 진행되고 있다. 트위터는 140자의 짧은 메시지로 정보를 공유하는 서비스이다. 이러한 짧은 메시지는 트윗에서 다양한 주제별 정보를 추출하는 것을 어렵게 한다. 본 논문에서는 트윗의 기능들과 분류할 주제의 특징을 이용하여 트윗 주제별 분류 방법을 제안한다. 이 방법의 유용성을 검증하기 위해, 트윗 API를 사용하여 수집된 10000개의 트윗으로 실험하였다. 그 결과 기존 연구들보다 뛰어난 결과를 얻었다.

  • PDF