• 제목/요약/키워드: Text mining analysis

검색결과 1,221건 처리시간 0.027초

Brand Personality of Global Automakers through Text Mining

  • Kim, Sungkuk
    • Journal of Korea Trade
    • /
    • 제25권2호
    • /
    • pp.22-45
    • /
    • 2021
  • Purpose - This study aims to identify new attributes by analyzing reviews conducted by global automaker customers and to examine the influence of these attributes on satisfaction ratings in the U.S. automobile sales market. The present study used J.D. Power for customer responses, which is the largest online review site in the USA. Design/methodology - Automobile customer reviews are valid data available to analyze the brand personality of the automaker. This study collected 2,998 survey responses from automobile companies in the U.S. automobile sales market. Keyword analysis, topic modeling, and the multiple regression analysis were used to analyze the data. Findings - Using topic modeling, the author analyzed 2,998 responses of the U.S. automobile brands. As a result, Topic 1 (Competence), Topic 5 (Sincerity), and Topic 6 (Prestige) attributes had positive effects, and Topic 2 (Sophistication) had a negative effect on overall customer responses. Topic 4 (Conspicuousness) did not have any statistical effect on this research. Topic 1, Topic 5, and Topic 6 factors also show the importance of buying factors. This present study has contributed to identifying a new attribute, personality. These findings will help global automakers better understand the impacts of Topic 1, Topic 5, and Topic 6 on purchasing a car. Originality/value - Contrary to a traditional approach to brand analysis using questionnaire survey methods, this study analyzed customer reviews using text mining. This study is timely research since a big data analysis is employed in order to identify direct responses to customers in the future.

중국과 미국의 무역클레임 유형과 중요도 비교 연구 : 텍스트 마이닝 기법을 활용하여 (A Comparative Study on the Types and its Importance of Trade Claims between China and the United States: Using Text Mining Techniques)

  • 유천;황윤섭
    • 무역학회지
    • /
    • 제47권3호
    • /
    • pp.177-190
    • /
    • 2022
  • This study is designed to identify the differences in the types and importance of trade claims at the national level. For analysis data, abstracts of arbitration and court judgments published on the website of the United Nations Commission on International Trade Law are collected and used. The target countries are China and the United States, with 102 cases from China and 59 cases from the United States. By applying topic modeling techniques to the collection decisions of China and the United States, trade claims are categorized, and the importance of each type is identified using the network centrality index derived through semantic network analysis. The analysis results are as follows. First, the main types of trade claims were the same for both the United States and China: product nonconformity, delivery issues, and payments. However, in China, the order of product nonconformity > delivery issues > payments was important, and in the United States, payments > product nonconformity > delivery issues were found to be important. This study is significant in that it presents a strategic trade claim management plan using a quantitative methodology.

유튜브 댓글을 통해 살펴본 버추얼 인플루언서에 대한 인식 연구 -캐릭터 디자인에 대한 긍부정 감성 반응을 중심으로- (A Study on Perceptions of Virtual Influencers through YouTube Comments -Focusing on Positive and Negative Emotional Responses Toward Character Design-)

  • 안효선;김지영
    • 한국의류학회지
    • /
    • 제47권5호
    • /
    • pp.873-890
    • /
    • 2023
  • This study analyzed users' emotional responses to VI character design through YouTube comments. The researchers applied text-mining to analyze 116,375 comments, focusing on terms related to character design and characteristics of VI. Using the BERT model in sentiment analysis, we classified comments into extremely negative, negative, neutral, positive, or extremely positive sentiments. Next, we conducted a co-occurrence frequency analysis on comments with extremely negative and extremely positive responses to examine the semantic relationships between character design and emotional characteristic terms. We also performed a content analysis of comments about Miquela and Shudu to analyze the perception differences regarding the two character designs. The results indicate that form elements (e.g., voice, face, and skin) and behavioral elements (e.g., speaking, interviewing, and reacting) are vital in eliciting users' emotional responses. Notably, in the negative responses, users focused on the humanization aspect of voice and the authenticity aspect of behavior in speaking, interviewing, and reacting. Furthermore, we found differences in the character design elements and characteristics that users expect based on the VI's field of activity. As a result, this study suggests applications to character design to accommodate these variations.

홍콩 영화에 관한 고객 리뷰의 텍스트 마이닝 기반 분석: 관객 선호도의 진화 발견 (Text Mining-Based Analysis of Customer Reviews in Hong Kong Cinema: Uncovering the Evolution of Audience Preferences )

  • 손화양;이정승
    • Journal of Information Technology Applications and Management
    • /
    • 제30권4호
    • /
    • pp.77-86
    • /
    • 2023
  • This study conducted sentiment analysis on Hong Kong cinema from two distinct eras, pre-2000 and post-2000, examining audience preferences by comparing keywords from movie reviews. Before 2000, positive keywords like 'actors,' 'performance,' and 'atmosphere' revealed the importance of actors' popularity and their performances, while negative keywords such as 'forced' and 'violence' pointed out narrative issues. In contrast, post-2000 cinema emphasized keywords like 'scale,' 'drama,' and 'Yang Yang,' highlighting production scale and engaging narratives as key factors. Negative keywords included 'story,' 'cheesy,' 'acting,' and 'budget,' indicating challenges in storytelling and content quality. Word2Vec analysis further highlighted differences in acting quality and emotional engagement. Pre-2000 cinema focused on 'elegance' and 'excellence' in acting, while post-2000 cinema leaned towards 'tediousness' and 'awkwardness.' In summary, this research underscores the importance of actors, storytelling, and audience empathy in Hong Kong cinema's success. The industry has evolved, with a shift from actors to production quality. These findings have implications for the broader Chinese film industry, emphasizing the need for engaging narratives and quality acting to thrive in evolving cinematic landscapes.

토픽모델링을 이용한 무인지상차량(UGV) 특허 동향 분석 (Patent Trend Analysis of Unmanned Ground Vehicles(UGV) using Topic Modeling)

  • 김기환;전차수;송지훈;전정환
    • 한국군사과학기술학회지
    • /
    • 제27권3호
    • /
    • pp.395-405
    • /
    • 2024
  • This study provides a thorough examination of Unmanned Ground Vehicles(UGVs), focusing on crucial technologies and trends across major global markets. It includes an in-depth patent analysis revealing the dominant positions of the United States and the European Union in this field. Additionally, it underscores substantial advancements made by China, Japan, and Korea since 2010. Using Latent Dirichlet Allocation(LDA)-based patent text mining, the study identified key technology areas in UGV development, such as advanced control systems, navigation technologies, power supply mechanisms, and sensing and communication tools. Through linear regression analysis, the study predicted the future paths of these technology areas, offering important insights into the evolving world of UGV technology. The findings can provide strategic guidance for stakeholders in the defense, commercial, and academic sectors, pointing out the future directions in UGV advancements.

소셜미디어 및 면접 영상 분석 기반 온라인 채용지원시스템 프로토타입 설계 및 구현 (Prototype Design and Development of Online Recruitment System Based on Social Media and Video Interview Analysis)

  • 조진형;강환수;유우창;박규태
    • 디지털융복합연구
    • /
    • 제19권3호
    • /
    • pp.203-209
    • /
    • 2021
  • 본 연구에서는 구직자의 채용지원 서류에 대한 진정성 검증 및 잠재 직무역량과 성향에 대한 정보여과 기능을 기반으로 효과적인 원격 채용 및 적정한 업무배치 의사결정을 지원할 수 있는 온라인 채용지원시스템 프로토타입 설계 및 구현 사례를 제안하고자 하였다. 이를 위해 구직자의 공개된 소셜미디어 정보에 대해 다차원적으로 자동 크롤링 및 분석하는 기능을 접목하여 구직자의 성향과 직무역량 정보를 도출하고, 텍스트마이닝 기법을 적용하여 채용지원 서류에 표현된 텍스트 정보 및 면접 영상 정보에 대한 지능적인 분석기능이 포함된 시스템 모델을 제안하였다. 제안하는 채용지원시스템의 효용성 검증을 위하여 프로토타입을 기반으로 주요 성능지표인 텍스트마이닝 정확도 및 면접 음성문자변환 기능 인식률 등에 대한 성능평가 실험을 진행하고 결과를 분석하였다. 제안하는 시스템은 효율적인 맞춤형 채용지원 기능이 가능하도록 지능형 웹/앱 개발에 필요한 요소기술을 융합하여 설계하였으며, 도출된 설계 사양 및 프로토타입 개발 결과를 바탕으로 상용화 구현이 된다면 인재 채용시장에서 필요한 지능형 온라인 채용시스템 기술로 확대 활용이 기대될 수 있다.

텍스트마이닝을 이용한 건설공사 위험요소의 계절별 중요도 분석 (Analysis of Seasonal Importance of Construction Hazards Using Text Mining)

  • 박기창;김형관
    • 대한토목학회논문집
    • /
    • 제41권3호
    • /
    • pp.305-316
    • /
    • 2021
  • 건설사고는 근로자의 부주의, 안전장비 미착용, 안전규칙 미준수 등 다양한 요인이 복합적으로 작용해 발생할 수 있다. 건설사고를 유발하는 여러 요인 중 야외작업이 많은 건설업의 특성상 기상 조건은 건설사고 발생 요인 중 하나가 될 수 있다. 과거 발생한 건설사고 데이터는 사고예방을 위한 좋은 자료로 활용될 수 있지만, 건설업 재해사례 데이터는 자연어로 기술된 텍스트형태로 제공되기 때문에 건설업 재해사례 데이터에서 건설공사 위험요소(Hazard)를 추출하는 것은 많은 시간과 비용이 발생한다. 따라서, 본 연구에서는 텍스트마이닝을 이용해 국내에서 발생한 2,026건의 건설업 재해사례 텍스트데이터에서 건설공사 위험요소를 추출하고 빈도 분석(Frequency analysis)과 중심성 분석(Centrality analysis)을 통해 건설공사 위험요소의 계절별 중요도분석을 수행했다. 국토교통부에서 정의한 254개 건설공사 위험요소 중 51개 위험요소를 건설사고 텍스트데이터에서 추출했으며, 분석결과 봄, 가을은 거푸집, 여름은 비계, 겨울은 크레인이 계절별 가장 중요한 위험요소로 나타났다. 제안방법은 날씨, 계절, 기후 관련 건설사고 안전대책 마련에 활용될 수 있다.

텍스트 마이닝 기반의 이슈 관련 R&D 키워드 패키징 방법론 (Methodology for Issue-related R&D Keywords Packaging Using Text Mining)

  • 현윤진;윌리엄;김남규
    • 인터넷정보학회논문지
    • /
    • 제16권2호
    • /
    • pp.57-66
    • /
    • 2015
  • 빅데이터 기술에 대한 관심이 급증함에 따라, 소셜 미디어를 통해 유통되는 방대한 양의 비정형 데이터를 분석하고자 하는 시도가 활발히 이루어지고 있다. 이에 따라서 텍스트 형태의 비정형 데이터 분석을 통해 의미 있는 정보를 찾고자 하는 시도가 비즈니스 영역뿐 아니라, 정치, 경제, 문화 등 다양한 영역에서 이루어지고 있다. 특히 최근에는 여러 현안 및 이슈들을 발굴하여 이를 의사결정에 활용하고자 하는 시도가 활발히 이루어지고 있다. 이처럼 빅데이터 분석을 통해 국가현안이나 이슈를 발굴하고자 하는 시도가 꾸준히 이루어져왔음에도 불구하고, 국가현안 및 이슈로부터 이와 관련된 R&D 문서를 효율적으로 제공하는 방안은 마련되지 않고있다. 이는 사용자들이 인식하는 현안 키워드와 실제 사용되는 R&D 키워드 사이의 이질성이 존재하기 때문이다. 따라서 현안 및 R&D키워드간의 이질성을 극복하기 위한 중간 장치가 필요하며, 이 중간 장치를 통해 각 현안 키워드와 R&D 키워드간에 적절한 대응이 이루어져야 한다. 이를 위해 본 연구에서는 (1) 현안 키워드 추출을 위한 하이브리드 방법론, (2) 현안 대응 R&D 정보 패키징 방법론, 그리고 (3) R&D 관점에서의 연관 현안 네트워크 구축 방법론의 총 세 가지 방법론을 제안한다. 제안하는 방법론은 텍스트 마이닝, 소셜네트워크 분석, 그리고 연관 규칙 마이닝 등의 데이터 분석 기법들을 활용하여 수행하였으며, 그 결과, (1)에 의한 키워드 보강률은 42.8%로 나타났으며, (2)의 경우, 현안 키워드와 R&D 키워드간 다수의 연관 규칙이 나타났다. (3)의 경우는 현재 진행 중에 있으며, 향후 가시적 성과를 낼 수 있을 것으로 예상된다.

Data Mining Research on Maehwado Painting Poetry in the Early Joseon Dynasty

  • Haeyoung Park;Younghoon An
    • Journal of Information Processing Systems
    • /
    • 제19권4호
    • /
    • pp.474-482
    • /
    • 2023
  • Data mining is a technique for extracting valuable information from vast amounts of data by analyzing statistical and mathematical operations, rules, and relationships. In this study, we employed data mining technology to analyze the data concerning the painting poetry of Maehwado (plum blossom paintings) from the early Joseon Dynasty. The data was extracted from the Hanguk Munjip Chonggan (Korean Literary Collections in Classical Chinese) in the Hanguk Gojeon Jonghap database (Korea Classics DB). Using computer information processing techniques, we carried out web scraping and classification of the painting poetry from the Hanguk Munjip Chonggan. Subsequently, we narrowed down our focus to the painting poetry specifically related to Maehwado in the early Joseon Dynasty. Based on this, refined dataset, we conducted an in-depth analysis and interpretation of the text data at the syllable corpus level. As a result, we found a direct correlation between the corpus statistics for each syllable in Maehwado painting poetry and the symbolic meaning of plum blossoms.

빈도 분석을 이용한 HTML 텍스트 추출 (HTML Text Extraction Using Frequency Analysis)

  • 김진환;김은경
    • 한국정보통신학회논문지
    • /
    • 제25권9호
    • /
    • pp.1135-1143
    • /
    • 2021
  • 최근 빅데이터 분석을 위해 웹 크롤러를 이용한 텍스트 수집이 빈번하게 이루어지고 있다. 하지만 수많은 태그와 텍스트로 복잡하게 구성된 웹 페이지에서 필요한 텍스트만을 수집하기 위해서는 웹 크롤러에 빅데이터 분석에 필요한 본문이 포함된 HTML태그와 스타일 속성을 명시해야 하는 번거로움이 있다. 본 논문에서는 HTML태그와 스타일 속성을 명시하지 않고 웹 페이지에서 출현하는 텍스트의 빈도를 이용하여 본문을 추출하는 방법을 제안하였다. 제안한 방법에서는 수집된 모든 웹 페이지의 DOM 트리에서 텍스트를 추출하여 텍스트의 출현 빈도를 분석한 후, 출현 빈도가 높은 텍스트를 제외시킴으로써 본문을 추출하였으며, 본 연구에서 제안한 방법과 기존 방법의 정확도 비교를 통해서 본 연구에서 제안한 방법의 우수성을 검증하였다.