• 제목/요약/키워드: news big data

검색결과 287건 처리시간 0.025초

자율주행과 공간정보의 빅데이터 기반 연계성 분석을 통한 동향 및 예측에 관한 연구 (A study on trends and predictions through analysis of linkage analysis based on big data between autonomous driving and spatial information)

  • 조국;이종민;김종서;민규식
    • 지적과 국토정보
    • /
    • 제50권2호
    • /
    • pp.101-115
    • /
    • 2020
  • 자율주행 분야 글로벌 동향 파악 및 공간정보 서비스 활성화 방안 도출을 위해 빅데이터 분석방법을 활용하였다. 사용된 빅데이터는 뉴스기사와 특허문헌을 상호 연계하여 활용하고, 뉴스 기사를 통한 동향 분석, 특허문헌 정보를 활용한 기술 분석이 진행 되었다. 본 논문에서는 자율주행에 대한 주요 뉴스에서 토픽모델을 기반으로 한 LDA(Latent Dirichlet Allocation)를 활용하여 빅데이터화 하고 주요 단어를 추출하였다. 특허정보의 주요 단어를 기반으로 적용된 워드넷(WordNet)을 활용하여 공간정보와 연계성 분석, 글로벌 기술 동향 분석을 실시하고 공간정보 분야의 동향 분석 및 예측을 실시하였다. 본 논문에서는 주요뉴스와 특허문헌 정보를 기반으로 한 빅데이터 분석방법으로 자율주행 분야와 공간정보와의 연계성 분석을 통하여 최신 동향과 미래를 예측하는 방법을 제시한다. 빅데이터 분석으로 도출된 자율주행 분야 공간정보의 글로벌 동향은 플랫폼 얼라이언스, 비지니스 파트너쉽, 기업 인수합병, 합작회사 설립, 표준화 및 기술개발로 도출되었다.

The Big Data Analytics Regarding the Cadastral Resurvey News Articles

  • Joo, Yong-Jin;Kim, Duck-Ho
    • 한국측량학회지
    • /
    • 제32권6호
    • /
    • pp.651-659
    • /
    • 2014
  • With the popularization of big data environment, big data have been highlighted as a key information strategy to establish national spatial data infrastructure for a scientific land policy and the extension of the creative economy. Especially interesting from our point of view is the cadastral information is a core national information source that forms the basis of spatial information that leads to people's daily life including the production and consumption of information related to real estate. The purpose of our paper is to suggest the scheme of big data analytics with respect to the articles of cadastral resurvey project in order to approach cadastral information in terms of spatial data integration. As specific research method, the TM (Text Mining) package from R was used to read various formats of news reports as texts, and nouns were extracted by using the KoNLP package. That is, we searched the main keywords regarding cadastral resurvey, performing extraction of compound noun and data mining analysis. And visualization of the results was presented. In addition, new reports related to cadastral resurvey between 2012 and 2014 were searched in newspapers, and nouns were extracted from the searched data for the data mining analysis of cadastral information. Furthermore, the approval rating, reliability, and improvement of rules were presented through correlation analyses among the extracted compound nouns. As a result of the correlation analysis among the most frequently used ones of the extracted nouns, five groups of data consisting of 133 keywords were generated. The most frequently appeared words were "cadastral resurvey," "civil complaint," "dispute," "cadastral survey," "lawsuit," "settlement," "mediation," "discrepant land," and "parcel." In Conclusions, the cadastral resurvey performed in some local governments has been proceeding smoothly as positive results. On the other hands, disputes from owner of land have been provoking a stream of complaints from parcel surveying for the cadastral resurvey. Through such keyword analysis, various public opinion and the types of civil complaints related to the cadastral resurvey project can be identified to prevent them through pre-emptive responses for direct call centre on the cadastral surveying, Electronic civil service and customer counseling, and high quality services about cadastral information can be provided. This study, therefore, provides a stepping stones for developing an account of big data analytics which is able to comprehensively examine and visualize a variety of news report and opinions in cadastral resurvey project promotion. Henceforth, this will contribute to establish the foundation for a framework of the information utilization, enabling scientific decision making with speediness and correctness.

빅데이터 LDA 토픽 모델링을 활용한 국내 코로나19 대유행 기간 마스크 관련 언론 보도 및 태도 변화 분석 (An analysis of the change in media's reports and attitudes about face masks during the COVID-19 pandemic in South Korea: a study using Big Data latent dirichlet allocation (LDA) topic modelling)

  • 서예령;고금석;이재우
    • 한국정보통신학회논문지
    • /
    • 제25권5호
    • /
    • pp.731-740
    • /
    • 2021
  • 본 연구는 LDA 토픽모델링 분석을 적용하여 한국 내 세 번의 코로나19 대유행 시기를 기준으로 마스크와 관련된 뉴스 빅데이터를 수집, 분석하였다. 분석 결과 각 시기별 마스크라는 단어를 중심으로 언론보도가 마스크 정책과 관련된 주제에서 사건사고 위주로 바뀌어가는 것을 실증적으로 살펴볼 수 있었다. 즉 제1차 시기의 경우 마스크 생산과 공급이, 제2차 시기에서는 마스크 착용 의무화 및 관련 사건사고가, 마지막인 제 3차 시기에는 주로 사건사고 위주로 토픽이 다뤄진 것을 확인 할 수 있었다. 해당 연구를 통해 마스크 공급, 확보, 착용 외 다른 보건정보에는 상대적으로 소홀했을 가능성을 확인할 수 있었으며, 제2,3차 시기 보도가 사건사고에 치우친 부분은 향후 언론보도의 접근성 및 태도에 대한 개선점이 있음을 시사한다. 따라서 코로나19에 보다 효과적으로 대응하기 위해서는 보다 거시적이고 사회 전체적인 논의가 진행될 수 있도록 언론보도가 변화해야 할 것이다.

A Trend Analysis on E-sports using Social Big Data

  • Kyoung Ah YEO;Min Soo KIM
    • Journal of Sport and Applied Science
    • /
    • 제8권1호
    • /
    • pp.11-17
    • /
    • 2024
  • Purpose: The purpose of the study was to understand a trend of esports in terms of gamers' and fans' perceptions toward esports using social big data. Research design, data, and methodology: In this study, researchers first selected keywords related to esports. Then a total of 10,138 buzz data created at twitter, Facebook, news media, blogs, café and community between November 10, 2022 and November 19, 2023 were collected and analyzed with 'Textom', a big data solution. Results: The results of this study were as follows. Firstly, the news data's main articles were about competitions hosted by local governments and policies to revitalize the gaming industry. Secondly, As a result of esports analysis using Textom, there was a lot of interest in the adoption of the Hangzhou Asian Games as an official event and various esports competitions. As a result of the sentiment analysis, the positive content was related to the development potential of the esports industry, and the negative content was a discussion about the fundamental problem of whether esports is truly a sport. Thirdly, As a result of analyzing social big data on esports and the Olympics, there was hope that it would be adopted as an official event in the Olympics due to its adoption as an official event in the Hangzhou Asian Games. Conclusions: There was a positive opinion that the adoption of esports as an official Olympic event had positive content that could improve the quality of the game, and a negative opinion that games with actions that violate the Olympic spirit, such as murder and assault, should not be adopted as an official Olympic event. Further implications were discussed.

Framing city image: A content analysis of Chinese city image construction on Korean press

  • YANG Ting;LIU Jing
    • International Journal of Advanced Culture Technology
    • /
    • 제12권1호
    • /
    • pp.158-168
    • /
    • 2024
  • With Wenhai big data SaaS cloud platform.2.0, this study analyzed data of 135 news reports relating to Chinese city Chongqing from Yonhap News Agency and ten South Korean mainstream newspapers from May 1st, 2018 to September 30th, 2022. Under the framework of Frame Theory, this research conducted data mining and analysis on how Korean mainstream media shaped city image of Chongqing, what kind of city images were shaped from dimensions of politics, economy, society, culture & sports as well as tourism and whether they are consistent with those in Chinese media. At the last part, discussions and suggestions was made.

뉴스와 주가 : 빅데이터 감성분석을 통한 지능형 투자의사결정모형 (Stock-Index Invest Model Using News Big Data Opinion Mining)

  • 김유신;김남규;정승렬
    • 지능정보연구
    • /
    • 제18권2호
    • /
    • pp.143-156
    • /
    • 2012
  • 누구나 뉴스와 주가 사이에는 밀접한 관계를 있을 것이라 생각한다. 그래서 뉴스를 통해 투자기회를 찾고, 투자이익을 얻을 수 있을 것으로 기대한다. 그렇지만 너무나 많은 뉴스들이 실시간으로 생성 전파되며, 정작 어떤 뉴스가 중요한지, 뉴스가 주가에 미치는 영향은 얼마나 되는지를 알아내기는 쉽지 않다. 본 연구는 이러한 뉴스들을 수집 분석하여 주가와 어떠한 관련이 있는지 분석하였다. 뉴스는 그 속성상 특정한 양식을 갖지 않는 비정형 텍스트로 구성되어있다. 이러한 뉴스 컨텐츠를 분석하기 위해 오피니언 마이닝이라는 빅데이터 감성분석 기법을 적용하였고, 이를 통해 주가지수의 등락을 예측하는 지능형 투자의사결정 모형을 제시하였다. 그리고, 모형의 유효성을 검증하기 위하여 마이닝 결과와 주가지수 등락 간의 관계를 통계 분석하였다. 그 결과 뉴스 컨텐츠의 감성분석 결과값과 주가지수 등락과는 유의한 관계를 가지고 있었으며, 좀 더 세부적으로는 주식시장 개장 전 뉴스들과 주가지수의 등락과의 관계 또한 통계적으로 유의하여, 뉴스의 감성분석 결과를 이용해 주가지수의 변동성 예측이 가능할 것으로 판단되었다. 이렇게 도출된 투자의사결정 모형은 여러 유형의 뉴스 중에서 시황 전망 해외 뉴스가 주가지수 변동을 가장 잘 예측하는 것으로 나타났고 로지스틱 회귀분석결과 분류정확도는 주가하락 시 70.0%, 주가상승 시 78.8%이며 전체평균은 74.6%로 나타났다.

Keyword Analysis of COVID-19 in News Big Data : Focused on 4 Major Daily Newspapers

  • Kwon, Seong-Wook
    • 한국컴퓨터정보학회논문지
    • /
    • 제25권12호
    • /
    • pp.101-107
    • /
    • 2020
  • 본 논문은 장기전에 접어든 코로나19와 관련한 국내 주요 4개 일간지의 뉴스 빅데이터(빅카인즈)를 활용하여 진보와 보수신문의 정치적 성향 등에 따른 주요 키워드를 비교 분석하는 것을 목적으로 한다. 이를 위해 2020년 1월 20일부터 9월 15일까지 보도된 93,917건의 뉴스를 4단계로 구분하여 4개 신문사의 주요 키워드를 워드클라우드로 구현하여 분석하였다. 분석 결과, 보수신문은 진보신문보다 '정부', '대통령', '사태', '마스크' 키워드를 더 많이 언급함으로써 정부의 대응과 비판, 중국의 책임 등에 주목하였으며, 진보신문은 질병의 심각성과 위험 상황 발생을 강조하는 키워드를 많이 사용하는 것으로 나타났다. 조선일보는 대규모 집단감염 발생(2.18~5.15)기에 다양한 키워드의 사용으로 다양성을 나타내기도 하였으며 특히, 중앙일보가 코로나19와 같은 감염병 보도와 관련해서는 정부 정책을 비판하는 키워드를 사용하기도 하지만 진보신문이 사용하는 질병의 심각성과 위험한 상황 발생을 강조하는 키워드도 함께 사용한다는 점을 밝혀냈다.

뉴스 빅데이터를 활용한 수소 이슈 탐색 (A Study on Social Issues for Hydrogen Industry Using News Big Data)

  • 최일영;김혜경
    • 한국수소및신에너지학회논문집
    • /
    • 제33권2호
    • /
    • pp.121-129
    • /
    • 2022
  • With the advent of the post-2020 climate regime, the hydrogen industry is growing rapidly around the world. In order to build the hydrogen economy, it is important to identify social issues related to hydrogen and prepare countermeasures for them. Accordingly, this study conducted a semantic network analysis on hydrogen news from NAVER. As a result of the analysis, the number of hydrogen news in 2020 increased by 4.5 times compared to 2016, and as of 2018, the hydrogen issue has shifted from an environmental aspect to an economic aspect. In addition, although the initial government-led hydrogen industry is expanding to the mobility field such as privately-led fuel cell electric vehicles and hydrogen fuel, terms showing concerns about the safety such as explosions are constantly being exposed. Thus, it is necessary not only to expand the hydrogen ecosystem through the participation of private companies, but also to promote hydrogen safety.

소셜 빅데이터 마이닝 기반 실시간 랜섬웨어 전파 감지 시스템 (Real-Time Ransomware Infection Detection System Based on Social Big Data Mining)

  • 김미희;윤준혁
    • 정보처리학회논문지:컴퓨터 및 통신 시스템
    • /
    • 제7권10호
    • /
    • pp.251-258
    • /
    • 2018
  • 파일을 암호화시켜 몸값을 요구하는 악성 소프트웨어인 랜섬웨어는 빠른 전파력과 지능화로 더욱 위협적이 되고 있다. 이에 빠른 탐지 및 위험 분석이 요구되고 있지만, 실시간 분석 및 보고가 미비한 상태이다. 본 논문에서는 실시간 분석이 가능하도록 소셜 빅데이터 마이닝 기술을 활용하여 랜섬웨어 전파 감지 시스템을 제안한다. 본 시스템에서는 트위터 스트림을 실시간 분석하여 랜섬웨어와 관련된 키워드를 가진 트윗을 크롤링한다. 또한 뉴스피드 분석기를 통해 뉴스서버를 크롤링하여 랜섬웨어 관련 키워드를 추출하고, 보안업체의 서버나 탐색 엔진을 통해 뉴스나 통계데이터를 추출한다. 수집된 데이터는 데이터 마이닝 알고리즘으로 랜섬웨어 감염 정도를 분석한다. 2017년 전파가 많이 되었던 워너크라이와 록키 랜섬웨어 감염전파 시 관련 트윗의 수와 구글 트렌드(통계 정보) 정보, 관련 기사를 비교하여 트윗을 이용한 본 시스템의 랜섬웨어 감염 탐지 가능성을 보이고, 엔트로피와 카이-스퀘어 분석을 통해 제안 시스템 성능을 보인다.

Sentence-BERT를 활용한 YouTube 가짜뉴스 탐지 시스템 연구 (A Study On YouTube Fake News Detection System Using Sentence-BERT)

  • 김범중;허지혜;이협건;김영운
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2023년도 추계학술발표대회
    • /
    • pp.667-668
    • /
    • 2023
  • IT 기술의 발달로 인해 뉴스를 제공하는 플랫폼들이 다양해 졌고 최근 해외 인터뷰 영상, 해외 뉴스를 Youtube Shorts형태로 제작하여 화자의 의도와는 다른 자막을 달며 가짜 뉴스가 생성되는 문제가 대두되고 있다. 이에 본 논문에서는 Sentence-BERT를 활용한 YouTube 가짜 뉴스 탐지 시스템을 제안한다. 제안하는 시스템은 Python 라이브러리를 사용해 유튜브 영상에서 음성과 영상 데이터를 분류하고 분류된 영상 데이터는 EasyOCR을 사용해 자막 데이터를 텍스트로 추출 후 Sentence-BERT를 활용해 문자 유사도를 분석한다. 분석결과 음성 데이터와 영상 자막 데이터가 일치한 경우 일치하지 않은 경우보다 약 62% 더 높은 문장 유사도를 보였다.