• 제목/요약/키워드: 키워드빈도분석

검색결과 352건 처리시간 0.024초

빅데이터 분석을 활용한 4차 산업혁명 키워드에 대한 통찰 (A Insight Study on Keyword of 4th Industrial Revolution Utilizing Big Data)

  • 남수태;진찬용
    • 한국정보통신학회:학술대회논문집
    • /
    • 한국정보통신학회 2017년도 춘계학술대회
    • /
    • pp.153-155
    • /
    • 2017
  • 빅데이터 분석은 데이터베이스에 잘 정리된 정형 데이터뿐 아니라 인터넷, 소셜 네트워크 서비스, 모바일 환경에서 생성되는 웹 문서, 이메일, 소셜 데이터 등 비정형 데이터를 효과적으로 분석하는 기술을 말한다. 대부분의 빅데이터 분석 기술 방법들은 기존 통계학과 전산학에서 사용되던 데이터 마이닝, 기계 학습, 자연 언어 처리, 패턴 인식 등이 이에 해당된다. 글로벌 리서치 기관들은 빅데이터를 2011년 이래로 최근 가장 주목받는 신기술로 지목해오고 있다. 따라서 대부분의 산업에서 기업들은 빅데이터의 적용을 통해 가치 창출을 위한 노력을 기하고 있다. 본 연구에서는 다음 커뮤니케이션의 빅데이터 분석도구인 소셜 매트릭스를 활용하여 2017년 5월, 1개월 시점을 설정하고 "4차 산업혁명" 키워드에 대한 소비자들의 인식들을 살펴보았다. 빅데이터 분석의 결과는 다음과 같다. 첫째, 4차 산업혁명 키워드에 대한 연관 검색어 1위는 "후보"가 빈도수(7,613)인 것으로 나타났다. 둘째, 연관 검색어 2위는 "안철수"가 빈도수(7,297), 3위는 "문재인"이 빈도수(5,183)로 각각 나타났다. 다음으로 "4차 산업혁명" 키워드에 대한 검색어 긍정적 여론 빈도수 1위는 새로운(895)으로 나타났고, 부정적 여론 빈도수 1위는 위기(516)가 차지하였다. 이러한 결과 분석결과를 바탕으로 연구의 한계와 시사점을 제시하고자 한다.

  • PDF

키워드 빈도와 중심성 분석에 기반한 사물인터넷 국내 연구 동향 (Domestic Research Trend of Internet of Things based on Keyword Frequency and Centrality Analysis)

  • 이택균
    • 한국콘텐츠학회논문지
    • /
    • 제20권12호
    • /
    • pp.23-35
    • /
    • 2020
  • 본 연구는 산업과 사회 전반에 걸쳐서 많은 영향을 미칠 사물인터넷에 관한 국내 논문들을 수집하고 분석하여 사물인터넷 분야의 동향을 살펴보고자 한다. 본 연구를 위한 조사 기간은 2015년에서 2019년까지로 하였으며 네이버의 학술정보를 이용하여 사물인터넷에 관한 국내 논문들을 수집하였다. 기간별로 수집된 국내 논문으로부터 빈도가 높은 키워드들을 추출하였으며 빈도가 높은 키워드 중에서 중심적인 키워드를 파악하기 위해서 중심성 분석을 하였다. 키워드 빈도에서는 2015년부터 2017년까지는 '센서', '보안' 그리고 2017년부터는 '차', '지능'이 빈도가 높은 상위 키워드로 나타났다. 키워드 중심성에서는 2015년부터 2016년까지 '보안', '센서' 그리고 2017년부터는 '지능', '차', '산업혁명'이 중심성이 높은 키워드로 나타났다.

키워드 분석에 대한 최신 접근법 비교 연구: 성경 코퍼스를 중심으로 (A Comparative Study of a New Approach to Keyword Analysis: Focusing on NBC)

  • 하명호
    • 디지털융복합연구
    • /
    • 제19권7호
    • /
    • pp.33-39
    • /
    • 2021
  • 본 연구는 구약 성경 코퍼스와 신약 성경 코퍼스, 그리고 구약과 신약 성경을 통합한 코퍼스에서 추출된 키워드 목록의 어휘적 특징을 분석하고, 또 사용빈도 기반의 키워드 분석보다 분포도 기반 키워드 분석이 더 우수한 분석 방식임을 밝히고자 하였다. 이를 위해 Bible Hub의 NLT 웹사이트에서 성경 파일을 다운받아 약 57만 어절의 구약 성경 코퍼스와 약 20만 어절의 신약 성경 코퍼스를 구축하였다. 목표 코퍼스와 참조 코퍼스의 비교를 통한 키워드 목록을 추출하기 위해서 Scott(2020)의 WordSmith 8.0 프로그램을 사용하였다. 그 결과, 분포도 기반 키워드 분석이 사용빈도 기반의 키워드 분석보다 키워드 목록의 어휘적 특징을 보다 더 잘 나타낼 수 있었고, 또 코퍼스 내용의 대표성과 변별성을 충분히 충족시킬 수 있는 최적의 키워드 목록을 추출하기 위해서는 분포도 기반 키워드 분석이 더 우수한 방식임을 밝혔다.

키워드 출현 빈도 분석과 CONCOR 기법을 이용한 ICT 교육 동향 분석 (Analysis of ICT Education Trends using Keyword Occurrence Frequency Analysis and CONCOR Technique)

  • 이영석
    • 산업융합연구
    • /
    • 제21권1호
    • /
    • pp.187-192
    • /
    • 2023
  • 본 연구는 기계학습의 키워드 출현 빈도 분석과 CONCOR(CONvergence of iteration CORrealtion) 기법을 통한 ICT 교육에 대한 흐름을 탐색한다. 2018년부터 현재까지의 등재지 이상의 논문을 'ICT 교육'의 키워드로 구글 스칼라에서 304개 검색하였고, 체계적 문헌 리뷰 절차에 따라 ICT 교육과 관련이 높은 60편의 논문을 선정하면서, 논문의 제목과 요약을 중심으로 키워드를 추출하였다. 단어 빈도 및 지표 데이터는 자연어 처리의 TF-IDF를 통한 빈도 분석, 동시 출현 빈도의 단어를 분석하여 출현 빈도가 높은 49개의 중심어를 추출하였다. 관계의 정도는 단어 간의 연결 구조와 연결 정도 중심성을 분석하여 검증하였고, CONCOR 분석을 통해 유사성을 가진 단어들로 구성된 군집을 도출하였다. 분석 결과 첫째, '교육', '연구', '결과', '활용', '분석'이 주요 키워드로 분석되었다. 둘째, 교육을 키워드로 N-GRAM 네트워크 그래프를 진행한 결과 '교육과정', '활용'이 가장 높은 단어의 관계로 나타났다. 셋째, 교육을 키워드로 군집분석을 한 결과, '교육과정', '프로그래밍', '학생', '향상', '정보'의 5개 군이 형성되었다. 이러한 연구 결과를 바탕으로 ICT 교육 동향의 분석 및 트렌드 파악을 토대로 ICT 교육에 필요한 실질적인 연구를 수행할 수 있을 것이다.

키워드 네트워크 분석을 이용한 연구데이터 관련 국내 연구 동향 분석 (An Analysis of Domestic Research Trend on Research Data Using Keyword Network Analysis)

  • 한상우
    • 한국도서관정보학회지
    • /
    • 제54권4호
    • /
    • pp.393-414
    • /
    • 2023
  • 본 연구는 연구데이터 관련 국내 연구의 동향을 파악하기 위하여 RISS에서 연구데이터 관련 논문을 수집하였으며, 데이터 정제 후 총 58건의 연구논문을 대상으로 134개의 저자 키워드를 추출하여 키워드 네트워크 분석을 수행하였다. 분석 결과, 첫째, 아직까지 국내에서 연구데이터 관련 연구의 수가 58건에 지나지 않아 추후 많은 관련 연구가 진행될 필요가 있음을 알 수 있었다. 둘째, 연구데이터 관련 연구 분야는 대부분 복합학 중 문헌정보학에 집중되어 있었다. 셋째, 연구데이터 관련 저자 키워드의 빈도분석 결과 '연구데이터관리', '연구데이터공유', '데이터리포지터리', '오픈사이언스' 등이 다빈도 주요 키워드로 분석되어 연구데이터 관련 연구는 위의 키워드를 중심으로 진행되고 있음을 알 수 있었다. 키워드 네트워크 분석 결과에서도 다빈도 키워드는 연결 중심성 및 매개 중심성에서 중심적인 위치를 차지하며 관련 연구에서 핵심 키워드에 위치하고 있음을 알 수 있었다. 본 연구의 결과를 통하여 최근의 연구데이터 관련 동향을 파악할 수 있었고, 향후 집중적으로 연구해야 하는 분야를 확인할 수 있었다.

메타버스를 이용한 비대면 교육환경의 확산 현황 분석 (Analysis of the Spread of Non-face-to-face Educational Environment using Metaverse)

  • 황의철
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2022년도 제65차 동계학술대회논문집 30권1호
    • /
    • pp.163-164
    • /
    • 2022
  • 본 연구는 최근 2년(2019.12.1.~2021. 11.30)간 빅카인즈를 이용하여 '메타버스 AND 비대면 교육' 키워드가 포함된 뉴스 검색 결과 1148건을 바탕으로 관계도 분석, 연관어 키워드 빈도수 및 연관어 가중치 분석을 하였다. 첫째, 관계도 분석에서 가중치 '5'로 적용한 12개의 키워드 가중치로 코로나19(64), 아바타(43), 코로나(22), 유니버스(21), 게더타운(15), 패러다임(12), 신입사원(12), 로블록스(7)로 나타났다. 둘째, 연관어 키워드 월간 빈도수로는 2019.12~ 2020.9(0건), 2020.10(1건), 2021.3(19건), 2021.4(34건), 2021.6(72건), 2021.9 (196건), 2021.11애는 233건으로 급격하게 증가하였다. 셋째 키워드와의 연관성(가중치/키워드 빈도수)으로 코로나19(113.96/515), 가상세계(67.75/ 344), 메타버스(58.36/103), 메타(49.8/5730), 가상공간(45.57/380) 순이었다. 이 분석 결과에서 위드코로나 시대의 비대면 교육으로 메타버스에 기반을 둔 가상공간 활용 교육은 더욱 증가될 것으로 예상된다.

  • PDF

인문학 및 사회과학 분야 국내 학술논문의 저자키워드 출현빈도와 피인용횟수의 상관관계 연구 (A Study on the Correlation between the Appearance Frequency of Author Keyword and the Number of Citation in the Humanities and Social Science Journal Articles of the Korea Citation Index (KCI))

  • 고영만;송민선;김비연;민혜령
    • 정보관리학회지
    • /
    • 제30권2호
    • /
    • pp.227-243
    • /
    • 2013
  • 본 연구의 목적은 저자키워드의 출현빈도와 해당 키워드가 속한 논문들의 총피인용횟수 간 상관관계 여부를 확인하고자 하는 것이다. 연구의 배경은 인문사회과학 분야 학술용어사전을 구축하는데 있어서 실제 연구에서의 활용도가 높고 다른 키워드와의 의미적 연관관계가 많은 학술용어를 추출하기 위한 방법론을 개발해 보고자 하는 것이다. 본 연구의 목적을 이루기 위해 한국연구재단 한국학술지인용색인(KCI)에 수록된 2007년에서 2011년까지의 인문학 및 사회과학 분야 학술지 논문의 저자키워드와 피인용횟수를 분석하였다. 분석 결과 저자키워드의 출현빈도와 해당 키워드가 속한 논문들의 총피인용횟수는 통계적으로 상관관계가 있으며, 저자키워드의 출현빈도가 늘어날수록 논문의 총피인용횟수도 많아지는 것으로 나타났다.

텍스트 마이닝을 활용한 대학도서관과 공공도서관의 장서개발 정책 키워드 분석 (A Keyword Analysis of Collection Development Policies of University and Public Libraries Using Text Mining)

  • 이다현;신동희
    • 한국문헌정보학회지
    • /
    • 제58권1호
    • /
    • pp.285-302
    • /
    • 2024
  • 장서개발 정책은 도서관 서비스의 근간이며, 도서관의 성격과 정체성이 드러나는 성문화된 문서이다. 본 연구에서는 국립중앙도서관에서 원문 추출이 가능한 장서개발 정책 관련 원문 11개를 대상으로 빈도분석, 토픽 모델링, 네트워크 분석을 수행하였다. 장서개발 정책과 관련된 주요 키워드를 추출하고, 해당 키워드 간의 관계를 분석하였다. 그 후 대학도서관과 공공도서관의 관종별 장서개발 정책의 특징을 도출하기 위해 파이 계수 분석을 수행하였다. 분석 결과 '자료', '도서관', '장서개발', '이용자', '수집' 등의 키워드가 빈도 분석과 네트워크 중심성에서 주요 키워드로 나타났으며, 파이 계수 분석 결과 대학도서관은 '대학(0.73)', '구축', '학생', '대상', '비용' 등의 키워드가 나타나므로, 이용자의 학술적 요구와 디지털 자원에 대한 논의가, 공공도서관은 '성인', '설문조사', '특징', '종교' 등 다양한 이용자계층의 정보 요구와 관련된 키워드가 주요 쟁점으로 드러났다.

텍스트마이닝을 활용한 숭례문 관련 기사의 트렌드 분석 (Trend Analysis of News Articles Regarding Sungnyemun Gate using Text Mining)

  • 김민정;김철주
    • 한국콘텐츠학회논문지
    • /
    • 제17권3호
    • /
    • pp.474-485
    • /
    • 2017
  • 국보 제1호인 숭례문은 2008년 2월 10일 화재로 일부가 소실되었으나 화재 이후 복구 작업을 통해 2013년 5월 4일 시민에게 공개되었다. 이로 인해 숭례문은 국가적으로 큰 이슈가 되어 언론의 관심을 받으며 동시에 많은 연구의 대상이 되었다. 본 연구는 문화재로서 숭례문을 키워드로 하여 2002년부터 2016년까지 신문 기사에 대한 빈도분석을 통해 숭례문 관련 어떤 키워드들이 자주 나타나고 있는지에 대해 파악하였다. 또한 추출된 숭례문 관련 키워드들간 연관관계 분석을 통해 키워드간 연결의 맥락을 파악하고 분석하였다. 다음으로 숭례문 화재 전후, 언론사별 주요 키워드 추출을 통해 공통점과 차이점을 보여줌으로써 관점의 다양성을 제공하였다. 본 연구를 통해 문화재로서 숭례문 관련 키워드는 화재 이후에 나타난 키워드가 전체 기사에서 고빈도어로 나타남을 알 수 있었고 몇 가지 키워드간 상관관계가 높게 나타났다. 또한 화재 전후 키워드에는 명확한 차이를 보이고 있었으며 언론사별 키워드에서 상위 키워드들은 명확한 차이는 보여주지 않았지만 차상위 키워드들은 차이가 발생하여 언론사별로 주로 다루어진 기사들의 내용은 차이가 있다는 것을 발견했다. 본 연구는 문화재로서 숭례문 관련 기사에 대해 텍스트마이닝 기법을 활용하여 다량의 데이터를 분석하였음에 의미가 있으며 정보생산자 및 정보소비자들에게 숭례문 관련 기사의 동향과 정보를 제공할 수 있을 것이라 기대한다.

빅데이터를 통한 2016년의 다이어트 실태 분석 (Analysis of dieting practices in 2016 using big data)

  • 정은진;장은재;조경애
    • 한국식품과학회지
    • /
    • 제51권2호
    • /
    • pp.176-181
    • /
    • 2019
  • 인터넷과 대중매체의 발전은 새로운 다이어트에 대한 사람들의 접근을 용이하게 만들었다. 그러나 사람들의 관심은 시시각각으로 변화하기 때문에 이슈가 되는 다이어트는 매년 달라지고 있다. 따라서 본 연구에서는 2016년의 다이어트에 대한 경향을 알아보고 분석하기 위해서 빅데이터 분석 방법을 이용하였고, 포털 사이트 네이버를 통해 2016년 1월 1일부터 2016년 12월 31일 까지 1년간 다이어트 키워드가 포함된 문장을 수집하고 분석하여 단순빈도 분석, N-gram 분석, 키워드 네트워크 분석, 계절성 분석을 시행하였다. 단순빈도분석을 통해 가장 많이 출현한 키워드는 '운동'으로(191,032개)나타났고, 그 다음으로 '식단'이(102,631개)로 나타났으며, 키워드 간의 연관빈도를 분석한 N-gram 분석결과 상위 결과로 다이어트-식단, 다이어트-시작, 다이어트-성공으로 나타났고, 다이어트-도시락이 새롭게 나타나 다이어트 시장의 새로운 변화를 확인할 수 있었다. 또한 다이어트 키워드와 연관된 키워드를 유사한 성격들끼리 그룹화한 키워드 네트워크 분석을 통해 식이그룹, 운동 그룹, 상업적 다이어트 식품, 상업적 다이어트 프로그램 그룹으로 총 4개의 그룹으로 세분화되었다. 계절성 분석을 통해 2월부터 7월까지 꾸준한 상승을 보였으나, 10월에 다이어트 출현빈도 수치가 급격히 상승하였고, 대중매체를 통해 소개된 고지방 다이어트의 월별 출현빈도도 10월에 급격한 상승이 있었다. 따라서 대중매체의 영향이나 새로운 다이어트의 유행이 사람들에게 큰 영향을 미치는 것을 확인할 수 있었다. 이상의 결과를 바탕으로 다이어트의 패턴은 1년을 기준으로 일정한 양상을 띠고 있으나, 새롭게 유행하는 다이어트의 출현을 통해 사람들의 관심이 변화하여 다이어트의 패턴에도 영향을 미치는 것을 확인하였다. 결국 시시각각 변화하는 다이어트를 빠르게 파악하기 위해서는 주기적이기 보다는 지속적인 모니터링과 분석이 필요하다고 판단되어진다.