• 제목/요약/키워드: 텍스트 수집

검색결과 697건 처리시간 0.023초

대선후보의 SNS 평판이 선거결과에 미치는 영향 분석 - 19대 대선을 중심으로 - (Analysis of the Influence of Presidential Candidate's SNS Reputation on Election Result: focusing on 19th Presidential Election)

  • 이예나;최은정;김명주
    • 디지털융복합연구
    • /
    • 제16권2호
    • /
    • pp.195-201
    • /
    • 2018
  • 최근 스마트폰과 PC 이용이 대중화됨 따라 웹상에 데이터가 기하급수적으로 축적되고 있다. 특히 SNS를 통해서 자유로운 의사소통은 물론 간편한 정보공유가 가능하여 다양한 의견들이 대량 데이터 형태로 축적된다. 이러한 데이터들을 분석하여 특정 주제에 대한 여론을 예견하는 빅데이터 기반의 여론분석기술이 주목받고 있다. 본 논문에서는 SNS 상에 표현된 사용자들의 의견을 수집하고 분석하여 대한민국 19대 대통령 후보자들에 대한 유권자들의 숨어있는 표심을 분석해 보았다. 이를 위해 19대 대선 후보에 관한 SNS상의 정보를 수집한 후 텍스트 마이닝 기법과 오피니언 마이닝 기법을 적용하여 언급 빈도수와 관련 키워드를 통한 평판 분석을 실시하였다. 본 논문에서 제시한 SNS를 통한 19대 대선후보의 평판분석 결과가 기존의 여론조사결과에 비하여 더 정확하게 예측했음을 확인할 수 있다.

SNS 데이터 분석을 통한 스마트 충북관광 구축 (Implementation of smart chungbuk tourism based on SNS data analysis)

  • 조완섭;조아;권가은;류관희
    • Journal of the Korean Data and Information Science Society
    • /
    • 제26권2호
    • /
    • pp.409-418
    • /
    • 2015
  • SNS 등 온라인에 쏟아지는 고객의 감성분석을 활용하여 마케팅 등 다양한 분야에서 성과를 내고 있다. 고객의 제품사용 후기 데이터를 수집하여 신제품의 마케팅 전략과 제품개선 방안을 도출하고 있으며, 선거철에는 유권자들의 마음을 실시간으로 읽어서 선거 전략을 수립하고 있다. 본 연구에서는 온라인 상에서 충북관광에 관한 글들을 수집하여 텍스트 마이닝 기법을 활용하여 분석함으로써 충북관광을 위한 홍보전략과 관광진흥 정책을 수립하는 방안을 제시한다. 사용된 데이터는 주요 블로그, 뉴스, 관광관련 공공 데이터 등이며, 충북전역의 관광지를 대상으로 한다. 분석결과 충청북도 북부지역의 관광지들이 주요 이슈 관광지로 나타났으며, 관광지별로 연관 관광지와 연관 키워드들이 분석되었다. 또한, 주요 관광지별 감성분석을 통하여 긍/부정 현황과 그 원인을 파악할 수 있도록 하였다. 특히 이들 분석에 다차원 분석 기법을 연계함으로써 관광관련 텍스트 정보를 다각도로 분석하여 전략을 수립하는데 활용할 수 있도록 하였다.

통계적 텍스트 마이닝을 이용한 빅 데이터 전처리 (A Big Data Preprocessing using Statistical Text Mining)

  • 전성해
    • 한국지능시스템학회논문지
    • /
    • 제25권5호
    • /
    • pp.470-476
    • /
    • 2015
  • 빅 데이터는 여러 분야에서 다양하게 사용되고 있다. 예를 들어, 컴퓨터학과 사회학에서 빅 데이터에 대한 서로간의 접근방법에 대한 차이는 있겠지만 빅 데이터의 분석을 통한 활용 측면에서는 공통적인 부분을 갖는다. 따라서 대부분의 분야에서 빅 데이터에 대한 의미 있는 분석과 활용은 필요하게 된다. 통계학과 기계학습은 빅 데이터의 분석을 위한 다양한 방법론을 제공한다. 본 논문에서는 빅 데이터분석 과정에 대하여 알아보고 수집된 빅데이터의 원천에서부터 분석을 거쳐 최종적으로 분석결과를 활용하는 전체 과정을 위한 효율적인 빅 데이터 분석방법에 대하여 연구한다. 특히, 빅 데이터의 특성을 갖는 여러 데이터 중 하나인 특허문서 데이터에 대하여 빅데이터분석을 적용하여 효과적인 특허분석을 수행하고 이 결과를 연구개발 기획에 적용하는 방법론에 대하여 제안한다. 제안방법에 대한 실제적용을 위하여 전 세계 특허데이터베이스로부터 실제 기업의 전체 출원, 등록 특허 문서를 수집, 분석하고 연구개발 업무에 활용하는 전 과정에 대한 사례연구를 수행하였다.

SNS 데이터 분석을 기반으로 인공지능에 대한 인식 변화 비교 분석 (A SNS Data-driven Comparative Analysis on Changes of Attitudes toward Artificial Intelligence)

  • 윤유동;양영욱;임희석
    • 디지털융복합연구
    • /
    • 제14권12호
    • /
    • pp.173-182
    • /
    • 2016
  • 인공지능은 현재의 컴퓨팅시스템 성능한계를 극복하고 컴퓨팅 환경을 발전시켜 다양한 분야의 기술 발전을 위한 핵심 기술로서 주목받고 있다. 이에 세계 국가들은 물론이고, 국내에서도 인터넷 기업을 중심으로 사업화 기술개발이 이루어지고 있다. 정부 역시 인공지능 기술 개발을 위해 다양한 지원을 아끼지 않고 있으며, 이에 따른 기술의 발전으로 인공지능에 대한 관심이 증폭되고 있다. 그러나 긍정적인 시각과 부정적인 시각이 공존하고 있는 인공지능 분야에서 사람들의 의견을 분석하는 연구는 매우 부족한 실정이다. 이에 따라 본 연구에서는 텍스트 마이닝 기법을 활용하여 SNS (Social Networking Service)에서 수집된 인공지능에 대한 사람들의 의견 데이터를 연도별로 비교 분석하여 수집된 데이터에 대한 긍정, 부정 여부와 함께 연도별 키워드를 확인하였다. 분석 결과, 국내 인공지능 분야의 연도별 키워드를 확인하였으며, 시간의 흐름에 따라 인공지능에 대해 부정적인 의견이 증가하는 것을 확인하였다. 그리고 이러한 비교분석 결과를 기반으로 인공지능 분야의 흐름에 대해 예측할 수 있었다.

텍스트마이닝을 통한 디지털플랫폼정부의 방향 모색: 4차산업혁명시대 담론으로부터의 교훈 (Exploring the Direction of Digital Platform Government by Text Mining Technique: Lessons from the Fourth Industrial Revolution Agenda)

  • 박수경;조지연;이봉규
    • 한국인터넷방송통신학회논문지
    • /
    • 제22권5호
    • /
    • pp.139-146
    • /
    • 2022
  • 최근 몇 년간 빅데이터·AI를 활용하여 산업·사회문제를 해결하고 새로운 가치를 창출하는 것이 국가의 주요 정책목표로 논의되고 있다. 새 정부 또한 빅데이터·AI를 기반으로 국민·기업·정부가 사회문제 해결과 새로운 가치 창출하는 디지털플랫폼정부를 주요 국정과제로 설정하였다. 아직까지 그간의 논의를 정리하고 향후의 정책 방향을 논의한 연구는 많이 전개되지 못한 상황이다. 이에 본 연구는 지난 5년간의 논의의 진단을 통하여 우리의 현황과 과제를 살펴보고자 한다. 이를 위하여 앞서 통용되고 있던 개념인 4차산업혁명을 키워드로 하여, 신문사설을 수집하여 분석하였다. 텍스트 마이닝 기법을 적용하여 2017년부터 2022년까지 뉴스사설을 수집한 후 9개의 주요의제를 발견하였으며, 이를 기반으로 디지털플랫폼정부 기반의 미래사회에 대응을 위한 준비과제에 대한 시사점을 제공하였다.

빅데이터 분석을 통한 코로나 이전과 이후 메타버스에 대한 소비자의 인식에 관한 연구 (A Study on the Consumer Perception of Metaverse Before and After COVID-19 through Big Data Analysis)

  • 박성우;박준호;류기환
    • 문화기술의 융합
    • /
    • 제8권6호
    • /
    • pp.287-294
    • /
    • 2022
  • 본 연구의 목적은 코로나 19 발병 이후 비대면 사회가 지속됨에 따라 새롭게 각광받는 기술인 "메타버스"에 대한 소비자들의 인식을 빅데이터 분석을 통하여 알아보고자 함에 있다. 본 연구는 코로나19 이전과 이후로 나누어 메타버스에 대한 소비자의 인식을 분석하기 위해 텍스트 마이닝을 활용한 빅데이터 분석을 수행하였다. 단어 정제를 통하여 상위 30개의 키워드를 추출, 이를 토대로 각 키워드간의 연결망 분석, Concor분석을 통하여 시각화를 진행하였다. 분석을 진행한 결과 비대면 사회가 지속되며 메타버스가 트렌드로 급 부상하였다는 것을 확인하였다. 이전의 메타버스는 라이프 로깅의 한부분으로써 SNS 같은 텍스트 데이터에 치중되어 있었지만 이후, 가상현실 공간에 주목하기 시작하여 많은 플랫폼을 발생시키고 산업도 확대 되었다. 본 연구의 한계점은 포털사이트의 검색빈도를 통해 데이터를 수집하였기 때문에 익명성이 보장되어있어 데이터 수집 시 인구통계학적 특성이 반영되지 않았다는 점이다.

LDA기반 토픽모델링을 활용한 공공데이터 기반의 교육용 데이터마이닝 연구 (A Study on Educational Data Mining for Public Data Portal through Topic Modeling Method with Latent Dirichlet Allocation)

  • 신승기
    • 정보교육학회논문지
    • /
    • 제26권5호
    • /
    • pp.439-448
    • /
    • 2022
  • 본 연구에서는 공공데이터포털에서 제공하는 교육관련 데이터를 검색하고 토픽모델링 기법을 활용한 분류를 통해 어떠한 데이터의 종류가 구축되어 있으며 활용이 가능한지를 살펴보고자 하였다. 공공데이터포털의 데이터에 대하여 분류체계를 기준으로 교육분야의 파일데이터는 3,072건이 수집되었으며, 검색어를 활용하여 '교육'을 검색하여 나타난 파일데이터 2,361건으로 나타났다. 각각의 데이터셋에 대하여 불용어처리를 실시하고 데이터 전처리를 수행하여 LDA기반 토픽모델링을 활용하여 텍스트마이닝 분석을 실시하였다. 사전에 교육으로 분류된 데이터셋에서는 현재 재학중인 학교급별 학생을 대상으로 지원하는 프로그램과 정보에 대한 내용이 제공되고 있었다. 한편, 교육으로 검색하여 수집된 데이터셋에서는 장애인, 학부모, 노인, 아동 등 평생교육의 관점으로 제공되는 교육 프로그램 및 지원현황이라는 특징이 나타났다. 데이터과학기반의 의사결정 및 문제해결력을 기르기 위해 공공데이터포털이 제공하는 데이터에서 교육과정 및 내용이 충분히 제공되는 것도 좋은 기회가 될 것이다.

텍스트 마이닝 분석기법을 활용한 인공지능 리터러시 및 인공지능 융합 교육에 관한 인식 연구 (A Study on the Perception of Artificial Intelligence Literacy and Artificial Intelligence Convergence Education Using Text Mining Analysis Techniques)

  • 윤혁;김정랑
    • 정보교육학회논문지
    • /
    • 제26권6호
    • /
    • pp.553-566
    • /
    • 2022
  • 본 논문에서는 포털 사이트와 RISS에서 소셜 데이터와 학술 연구 데이터를 수집하고 TF-IDF, N-Gram, 의미 연결망 분석, CONCOR 분석을 실시하였다. 이를 통해 사회적 인식 양상과 현 상황을 파악하고, 시사점과 방향성을 제시하고자 하였다. 소셜 데이터에서 '인공지능 리터러시'보다 '인공지능 융합 교육'의 수집량이 2배 이상 많아 '인공지능 리터러시'에 관한 인식이 상대적으로 적은 것으로 나타났다. '인공지능 리터러시'에 소셜 데이터에서 '인간' 키워드는 소속된 군집이 없는 것으로 나타나 인문학 및 인공지능과 인간의 대한 철학적인 관심과 인식이 부족한 것으로 나타났다. 또한 '교육부' 키워드가 '인공지능 융합 교육'의 소셜 데이터에서만 빈도, 중요도, 연결 중심성이 모두 높게 나타나 '인공지능 융합 교육'이 정부의 정책과 관련 깊은 것이 확인되었다.

한국어 문서 요약 기법을 활용한 휘발유 재고량에 대한 미디어 분석 (Media-based Analysis of Gasoline Inventory with Korean Text Summarization)

  • 윤성연;박민서
    • 문화기술의 융합
    • /
    • 제9권5호
    • /
    • pp.509-515
    • /
    • 2023
  • 국가 차원의 지속적인 대체 에너지 개발에도 석유 제품의 사용량은 지속적으로 증가하고 있다. 특히, 대표적인 석유 제품인 휘발유는 국제유가의 변동에 그 가격이 크게 변동한다. 주유소에서는 휘발유의 가격 변화에 대응하기 위해 휘발유 재고량을 조절한다. 따라서, 휘발유 재고량의 주요 변화 요인을 분석하여 전반적인 휘발유 소비 행태를 분석할 필요가 있다. 본 연구에서는 주유소의 휘발유 재고량 변화에 영향을 미치는 요인을 파악하기 위해 뉴스 기사를 활용한다. 첫째, 웹 크롤링을 통해 자동으로 휘발유와 관련한 기사를 수집한다. 둘째, 수집한 뉴스 기사를 KoBART(Korean Bidirectional and Auto-Regressive Transformers) 텍스트 요약 모델을 활용하여 요약한다. 셋째, 추출한 요약문을 전처리하고, N-Gram 언어 모델과 TF-IDF(Term Frequency Inverse Document Frequency)를 통해 단어 및 구 단위의 주요 요인을 도출한다. 본 연구를 통해 휘발유 소비 형태의 파악 및 예측이 가능하다.

라이프 로그 서비스를 위한 지능형 가젯 기술 동향 (Overview of Intelligent Gadget Technology for Life Log Service)

  • 배창석;원종호;유동완;노경주;이광희;최은정
    • 전자통신동향분석
    • /
    • 제21권5호통권101호
    • /
    • pp.81-92
    • /
    • 2006
  • 최근 미니홈피, 블로그 등의 개인 홈페이지가 활성화되면서 개인의 생활 경험 정보를 기록으로 남기고자 하는 욕구가 증대되고 있다. 이와 같은 시도는 주로 영상이나 텍스트에 의존한 기록이 주를 이루고 있다. 정보 통신 기술의 급속한 발전은 디지털 라이프로그라는 개념으로 개인의 전반적인 일상 생활을 디지털 미디어로 기록해 두고자 하는 시도를 가능하게 하고 있다. 라이프 로그에서 저장되는 정보는 단순히 개인이 보고 듣는 정보뿐 아니라 개인의 주변상황 및 신체상태 등 그 다양성이 더욱 커질 수 있다. 이러한 다양한 정보를 개인의 실생활에서 수집하기 위해 개인이 일상 생활에서 사용하는 사물에 정보 수집 및 처리 기능을 부가하자는 연구가 활발히 진행되고 있다. 본 고에서는 이와 같이 지능화된 사물을 지능형 가젯(gadget)이라 부른다. 지능형 가젯은 단순한 사용자의 개인 생활 정보를 수집하는 수단 외에도 가젯들 간의 상호 정보 교환으로 사용자의 현재 상황 정보를 인지할 수 있으며 라이프 로그가 저장된 서버와의 정보 교환으로 사용자의 과거 경험 정보로부터 사용자의 의도나 취향을 분석할 수 있다. 이러한 정보를 활용하여 사용자에게 가장 적합하고 특화된 서비스를 제공할 수 있는 환경을 구현할 수 있다. 본 고에서는 이를 위한 기본이 되는 라이프 로그 서비스를 위한 지능형 가젯의 각 구성 모듈인 지능형 가젯 플랫폼, 지능형 가젯 네트워크, 그리고 지능형가젯 미들웨어의 기술 동향과 라이프 로그 서비스의 연구 사례에 대해 살펴본다.