• 제목/요약/키워드: Social Embedding of Technology

검색결과 22건 처리시간 0.03초

그래프 임베딩을 활용한 코로나19 가짜뉴스 탐지 연구 - 사회적 참여 네트워크의 이용 여부에 따른 탐지 성능 비교 (A study on the detection of fake news - The Comparison of detection performance according to the use of social engagement networks)

  • 정이태;안현철
    • 지능정보연구
    • /
    • 제28권1호
    • /
    • pp.197-216
    • /
    • 2022
  • 인터넷 및 모바일 기술의 발달과 소셜미디어의 확산으로 인해 다량의 정보들이 온라인 상에서 생성, 유통되고 있다. 이중에는 대중에게 도움이 되는 유익한 정보들도 있지만, 역기능을 하는 이른바 가짜뉴스들도 함께 유통되고 있다. 지난 2020년 코로나19의 전세계적인 확산 이후, 온라인 상에는 이와 관련한 수많은 가짜뉴스들이 유통되었다. 다른 가짜뉴스들과 달리 코로나19와 관련된 가짜뉴스는 사람들의 건강, 나아가 생명까지 위협할 수 있다는 점에서 그 심각성이 매우 크다고 할 수 있다. 때문에 코로나19와 관련한 가짜뉴스를 자동으로 탐지하고, 이를 예방하는 지능형 기술은 사회적 건강도를 제고하는데 매우 의미 있는 연구주제라 할 수 있다. 이러한 배경에서 본 연구에서는 코로나19 관련 가짜뉴스 탐지를 효과적으로 수행하기 위해 그래프 임베딩 방법 중 하나인 Graph2vec을 활용한 방법을 제안한다. 가짜뉴스 탐지에 대한 주류 방법은 뉴스 콘텐츠 기반 즉, 텍스트에 대한 특징 분석으로 진행되었으나 본 연구에서는 사회적 참여 네트워크 내에서의 정보 전달 관계를 추가로 활용함으로써 보다 효과적으로 코로나19와 관련된 가짜뉴스를 탐지할 수 있었으며 성능 측면에서 정확도 향상을 확인할 수 있었다.

문서 임베딩을 이용한 소셜 미디어 문장의 개체 연결 (Document Embedding for Entity Linking in Social Media)

  • 박영민;정소윤;이정엄;신동수;김선아;서정연
    • 한국어정보학회:학술대회논문집
    • /
    • 한국어정보학회 2017년도 제29회 한글및한국어정보처리학술대회
    • /
    • pp.194-196
    • /
    • 2017
  • 기존의 단어 기반 접근법을 이용한 개체 연결은 단어의 변형, 신조어 등이 빈번하게 나타나는 비정형 문장에 대해서는 좋은 성능을 기대하기 어렵다. 본 논문에서는 문서 임베딩과 선형 변환을 이용하여 단어 기반 접근법의 단점을 해소하는 개체 연결을 제안한다. 문서 임베딩은 하나의 문서 전체를 벡터 공간에 표현하여 문서 간 의미적 유사도를 계산할 수 있다. 본 논문에서는 또한 비교적 정형 문장인 위키백과 문장과 비정형 문장인 소셜 미디어 문장 사이에 선형 변환을 수행하여 두 문형 사이의 표현 격차를 해소하였다. 제안하는 개체 연결 방법은 대표적인 소셜 미디어인 트위터 환경 문장에서 단어 기반 접근법과 비교하여 높은 성능 향상을 보였다.

  • PDF

문서 임베딩을 이용한 소셜 미디어 문장의 개체 연결 (Document Embedding for Entity Linking in Social Media)

  • 박영민;정소윤;이정엄;신동수;김선아;서정연
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2017년도 제29회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.194-196
    • /
    • 2017
  • 기존의 단어 기반 접근법을 이용한 개체 연결은 단어의 변형, 신조어 등이 빈번하게 나타나는 비정형 문장에 대해서는 좋은 성능을 기대하기 어렵다. 본 논문에서는 문서 임베딩과 선형 변환을 이용하여 단어 기반 접근법의 단점을 해소하는 개체 연결을 제안한다. 문서 임베딩은 하나의 문서 전체를 벡터 공간에 표현하여 문서 간 의미적 유사도를 계산할 수 있다. 본 논문에서는 또한 비교적 정형 문장인 위키백과 문장과 비정형 문장인 소셜 미디어 문장 사이에 선형 변환을 수행하여 두 문형 사이의 표현 격차를 해소하였다. 제안하는 개체 연결 방법은 대표적인 소셜 미디어인 트위터 환경 문장에서 단어 기반 접근법과 비교하여 높은 성능 향상을 보였다.

  • PDF

아이템 네트워크를 활용한 기술 중심 사업 다각화 기회 탐색 지원 방법론 (Technology-Focused Business Diversification Support Methodology Using Item Network)

  • 배국진;김지은;김남규
    • 한국IT서비스학회지
    • /
    • 제19권3호
    • /
    • pp.17-34
    • /
    • 2020
  • Recently, various attempts have been made to discover promising items and technologies. However, there are very few data-driven approaches to support business diversification by companies with specific technologies. Therefore, there is a need for a methodology that can detect items related to a specific technology and recommend highly marketable items among them as business diversification targets. In this paper, we devise Labeled Item Network for Business Diversification Consulting Support System. Our research is performed with three sub-studies. In Sub-study 1, we find the proper source documents to build the item network and construct item dictionary. In Sub-study 2, we derive the Labeled Item Network and devise four index for item evaluation. Finally, we introduce the application scenario of our methodology and describe the result of real-case analysis in Sub-study 3. The Labeled Item Network, one of the main outcome of this study, can identify the relationships between items as well as the meaning of the relationship. We expect that more specific business item diversification opportunities can be found with the Labeled Item Network. The proposed methodology can help many SMEs diversify their business on the basis of their technology.

Enhancing the Text Mining Process by Implementation of Average-Stochastic Gradient Descent Weight Dropped Long-Short Memory

  • Annaluri, Sreenivasa Rao;Attili, Venkata Ramana
    • International Journal of Computer Science & Network Security
    • /
    • 제22권7호
    • /
    • pp.352-358
    • /
    • 2022
  • Text mining is an important process used for analyzing the data collected from different sources like videos, audio, social media, and so on. The tools like Natural Language Processing (NLP) are mostly used in real-time applications. In the earlier research, text mining approaches were implemented using long-short memory (LSTM) networks. In this paper, text mining is performed using average-stochastic gradient descent weight-dropped (AWD)-LSTM techniques to obtain better accuracy and performance. The proposed model is effectively demonstrated by considering the internet movie database (IMDB) reviews. To implement the proposed model Python language was used due to easy adaptability and flexibility while dealing with massive data sets/databases. From the results, it is seen that the proposed LSTM plus weight dropped plus embedding model demonstrated an accuracy of 88.36% as compared to the previous models of AWD LSTM as 85.64. This result proved to be far better when compared with the results obtained by just LSTM model (with 85.16%) accuracy. Finally, the loss function proved to decrease from 0.341 to 0.299 using the proposed model

Spam Image Detection Model based on Deep Learning for Improving Spam Filter

  • Seong-Guk Nam;Dong-Gun Lee;Yeong-Seok Seo
    • Journal of Information Processing Systems
    • /
    • 제19권3호
    • /
    • pp.289-301
    • /
    • 2023
  • Due to the development and dissemination of modern technology, anyone can easily communicate using services such as social network service (SNS) through a personal computer (PC) or smartphone. The development of these technologies has caused many beneficial effects. At the same time, bad effects also occurred, one of which was the spam problem. Spam refers to unwanted or rejected information received by unspecified users. The continuous exposure of such information to service users creates inconvenience in the user's use of the service, and if filtering is not performed correctly, the quality of service deteriorates. Recently, spammers are creating more malicious spam by distorting the image of spam text so that optical character recognition (OCR)-based spam filters cannot easily detect it. Fortunately, the level of transformation of image spam circulated on social media is not serious yet. However, in the mail system, spammers (the person who sends spam) showed various modifications to the spam image for neutralizing OCR, and therefore, the same situation can happen with spam images on social media. Spammers have been shown to interfere with OCR reading through geometric transformations such as image distortion, noise addition, and blurring. Various techniques have been studied to filter image spam, but at the same time, methods of interfering with image spam identification using obfuscated images are also continuously developing. In this paper, we propose a deep learning-based spam image detection model to improve the existing OCR-based spam image detection performance and compensate for vulnerabilities. The proposed model extracts text features and image features from the image using four sub-models. First, the OCR-based text model extracts the text-related features, whether the image contains spam words, and the word embedding vector from the input image. Then, the convolution neural network-based image model extracts image obfuscation and image feature vectors from the input image. The extracted feature is determined whether it is a spam image by the final spam image classifier. As a result of evaluating the F1-score of the proposed model, the performance was about 14 points higher than the OCR-based spam image detection performance.

게임산업의 위상과 전망에 대한 일고찰 (The Prospects of Game Industries in Emerging Contents Economy System)

  • 성제환
    • 한국게임학회 논문지
    • /
    • 제1권1호
    • /
    • pp.5-16
    • /
    • 2001
  • 최근 세계의 중심가치는 네트웍으로부터 콘텐츠로 이행하고 있으며, 이에 따라 핵심산업 분야도 IT산업에서 문화콘텐츠산업으로 그 중심이 옮겨지고 있다. 특히 문화산업 중 게임산업은 규모면에서나 사회적 영향면에서 타 문화산업에 비해 가장 큰 영향력을 가진 산업으로 부상할 것으로 예측되고 있다. 게임산업은 문화산업 가운데 기술, 문화, 인문학, 산업 부문을 포함하는 ‘종합엔터테인먼트산업'적 특성이 가장 잘 나타나는 산업이며, 분리되어 있던 각 게임분야와 문화산업분야 간의 연계(One-Source Multi-Use)를 확대하는 방향으로 게임개발이 이루어지고 있어 문화산업 전체의 발전을 견인할 수 있는 산업으로 자리매김되고 있다. 국가전략산업으로서 국내 게임산업의 세계경쟁력을 확보하기 위해서는 이같이 게임산업에 내재해 있는 콘텐츠시대의 가치와 특성에 대한 이해와 함께 국내게임산업의 인력부문 및 기술부문의 취약점에 대한 국가적 차원의 정책 마련이 무엇보다 중요하다.

  • PDF

단어 임베딩 기법을 이용한 한글의 의미 변화 파악 (Understanding the semantic change of Hangeul using word embedding)

  • 선현석;이영섭;임창원
    • 응용통계연구
    • /
    • 제34권3호
    • /
    • pp.295-308
    • /
    • 2021
  • 최근 들어 많은 사람들이 자신의 관심사를 SNS에 게시하거나 인터넷과 컴퓨터의 기술 발달로 디지털 형태의 문서 저장이 가능하게 됨으로써 생성되는 텍스트 자료의 양이 폭발적으로 증가하게 되었다. 이에 따라 수많은 문서 자료로부터 가치 있는 정보를 창출하기 위한 기술의 요구 또한 증가하고 있다. 본 연구에서는 대통령 연설 기록문과 신문기사 공공데이터를 활용하여 한글 단어들이 시간에 따라 어떻게 의미가 변화되어 가는지를 통계적 기법을 통해 발굴하였다. 이를 이용하여 한글의 통시적 변화 연구에 활용할 수 있는 방안을 제시한다. 기존 언어학자나 원어민의 직관에 의해 연구되던 한글의 이론적 언어 현상 연구에서 벗어나 누구나 사용할 수 있는 공공문서를 통해 수치화된 값을 도출하고 단어의 의미변화 현상을 설명하고자 한다.

한국도로공사 VOC 데이터를 이용한 토픽 모형 적용 방안 (Application of a Topic Model on the Korea Expressway Corporation's VOC Data)

  • 김지원;박상민;박성호;정하림;윤일수
    • 한국IT서비스학회지
    • /
    • 제19권6호
    • /
    • pp.1-13
    • /
    • 2020
  • Recently, 80% of big data consists of unstructured text data. In particular, various types of documents are stored in the form of large-scale unstructured documents through social network services (SNS), blogs, news, etc., and the importance of unstructured data is highlighted. As the possibility of using unstructured data increases, various analysis techniques such as text mining have recently appeared. Therefore, in this study, topic modeling technique was applied to the Korea Highway Corporation's voice of customer (VOC) data that includes customer opinions and complaints. Currently, VOC data is divided into the business areas of Korea Expressway Corporation. However, the classified categories are often not accurate, and the ambiguous ones are classified as "other". Therefore, in order to use VOC data for efficient service improvement and the like, a more systematic and efficient classification method of VOC data is required. To this end, this study proposed two approaches, including method using only the latent dirichlet allocation (LDA), the most representative topic modeling technique, and a new method combining the LDA and the word embedding technique, Word2vec. As a result, it was confirmed that the categories of VOC data are relatively well classified when using the new method. Through these results, it is judged that it will be possible to derive the implications of the Korea Expressway Corporation and utilize it for service improvement.

텍스트 마이닝을 이용한 주제기반의 기업인 네트워크 계층 분석 (Topic Based Hierarchical Network Analysis for Entrepreneur Using Text Mining)

  • 이동훈;김용화;김관호
    • 한국전자거래학회지
    • /
    • 제23권3호
    • /
    • pp.33-49
    • /
    • 2018
  • 다양한 고객의 요구를 만족시키기 위한 신제품 설계 및 개발의 필요성 때문에 중소기업 간의 융합 활동의 중요성은 증대하고 있다. 특히, 최고 의사결정을 가지는 중소기업 대표는 적합한 융합 활동 파트너를 구하기 위해 인맥관리는 필수적이다. 한편 기업인들은 많은 양의 인맥을 형성하는 것이 중요할 뿐만 아니라 유사한 토픽정보를 가진 기업인과의 인맥관계를 이해하는 것이 중요하다. 그러나 중소기업의 현황 부재와 산업분야별 기업인들의 기술과 특성을 나타낼 수 있는 토픽정보를 수집하는데 어려운 한계가 존재한다. 본 논문에서는 토픽 추출기법을 통해 이와 같은 문제점을 해결하고 3가지 측면에서 기업 네트워크를 분석한다. 구체적으로 C, S, T-Layer 모델이 있으며 각각의 모델은 인맥의 양, 인맥 중심성, 토픽 유사성을 분석한다. 실 데이터를 통한 실험 결과, 인맥의 양이 적은 경우 중심성이 높은 기업과 네트워크를 강화하여 인맥 네트워크를 활성화 시켜야 할 필요가 있고, 토픽 유사성이 낮은 경우 주제 기반의 네트워크를 활성화 시켜야 할 필요가 있다는 것을 실험을 통해 확인하였다.