• 제목/요약/키워드: 과학 빅데이터

검색결과 528건 처리시간 0.025초

빅데이터 및 고성능컴퓨팅 프레임워크를 활용한 유전체 데이터 전처리 과정의 병렬화 (Parallelization of Genome Sequence Data Pre-Processing on Big Data and HPC Framework)

  • 변은규;곽재혁;문지협
    • 정보처리학회논문지:컴퓨터 및 통신 시스템
    • /
    • 제8권10호
    • /
    • pp.231-238
    • /
    • 2019
  • 차세대 염기 서열 분석법이 생성한 유전체 원시 데이터를 기존의 방식대로 하나의 서버에서 분석하기 위해서는 데이터 크기에 따라 수십 시간이 필요할 수 있다. 그러나 응급 환자의 진단처럼 수 시간 내에 결과를 알아야 하는 상황이 존재하기 때문에 단일 유전체 분석의 성능을 향상시킬 필요가 있다. 본 연구에서는 빅데이터 기술의 병렬화 기법과 고속의 네트워크로 연결되고 병렬파일시스템을 공유하는 고성능컴퓨팅 클러스터를 적극적으로 활용하여 분석 시간을 크게 단축시킬 수 있는 유전체 데이터 분석의 전처리 프로세스의 병렬화 방법을 제안한다. 분석 데이터의 신뢰성을 위해 기존의 검증된 분석 도구 및 알고리즘을 새로운 환경에 맞게 병렬화 하는 전략을 선택하였다. 프로세스의 병렬화, 데이터의 분배 및 병렬 병합 기법을 개발하였고 실험을 통해 성능 향상을 확인하였다.

이러닝과 빅데이터의 융합 기반 스마트러닝 전략 (Smart Learning Strategies utilizing Convergence of e-Learning and Bigdata)

  • 노규성
    • 디지털융복합연구
    • /
    • 제13권1호
    • /
    • pp.487-493
    • /
    • 2015
  • 본 연구는 선진국의 사례를 기반으로 이러닝과 빅데이터의 융합적 접근을 통한 이러닝의 고도화 대안으로서 스마트러닝의 전략적 시사점을 도출한다. 이를 위해 본 연구는 먼저 국내 이러닝 현황 및 해결 과제를 도출한 다음 해외 주요 선진기업과 대학들의 이러닝과 데이터과학의 융합 사례를 분석한다. 아울러 이러닝 기업의 임직원을 대상으로 빅데이터 적용에 관한 인식 조사를 실시한 다음 조사된 자료의 분석을 통해 산업 현장에서 실효성을 갖는 빅데이터 융합 기반 스마트러닝의 전략적 대안을 도출한다.

빅데이터와 엔터테인먼트 콘텐츠 : 사례연구 및 전망 (Big Data and Entertainment Content : Case Studies and Prospects)

  • 김해원;이미나
    • 인터넷정보학회논문지
    • /
    • 제17권2호
    • /
    • pp.109-118
    • /
    • 2016
  • 빅데이터는 데이터과학의 발전에 힘입어 경제적 및 정책적 변화의 키워드로 각광받고 있다. 본 연구에서는 엔터테인먼트 분야에서 빅데이터 활용이 증가하고 성공사례 역시 빈번히 관찰되고 있음에 따라 국내 엔터테인먼트 콘텐츠 기업에서의 빅데이터 활용 현황을 살펴보고자 했다. 이를 위해 변화된 엔터테인먼트 콘텐츠 제작과 배포, 소비환경의 특성을 요약했으며 국내외의 대표적인 사례를 소개했다. 또한 콘텐츠 기업 블로터와 네오터치포인트의 사례 연구를 통해 콘텐츠 분야에서 데이터를 어떻게 활용하고 있으며, 앞으로에 대한 전망은 어떠한지 파악하고자 하였다. 분석을 통해 콘텐츠의 특정 흥미 요소를 파악하고 공유 조건을 분석하는 등, 소비자 이용 형태와 콘텐츠 제작에 빅데이터를 활용하고 있음을 알 수 있었다. 현재 국내 엔터테인먼트 콘텐츠 영역에서 빅데이터는 전면적인 활용을 준비하는 단계이지만 앞으로의 전망을 위해서는 개발자와 분야 전문가의 협업, 구체적인 목적의 설정과 설계의 필요성이 제시됐다.

해상교통 관제 빅데이터 체계의 설계 및 구현 (Design and Implementation of Bigdata Platform for Vessel Traffic Service)

  • 김혜진;오재용
    • 해양환경안전학회지
    • /
    • 제29권7호
    • /
    • pp.887-892
    • /
    • 2023
  • 해상교통관제센터에는 RADAR, AIS(Automatic Identification System), 기상센서, VHF(Very High Frequency) 등이 설치되어 운영되고 있으며, 해상교통관제사는 이를 활용하여 관제구역을 통항하는 선박의 동정을 관찰하고 정보를 제공하는 관제 업무를 수행한다. 이들 장비에서 생성되는 각종 관제 데이터는 해상교통 상황을 분석하기 위한 자료로 그 활용 가치가 매우 높지만, 시스템 제조사간 호환성 부족 또는 정책상의 문제로 인해 체계적으로 관리되지 않고 있는 실정이다. 이에 본 연구에서는 해상교통관제센터에서 수집되는 관제 데이터를 효율적으로 수집, 저장, 관리할 수 있는 관제 빅데이터 체계를 개발하였다. 개발된 관제 빅데이터 체계는 체계 개발의 중요한 이슈 중 하나였던 운영 안정성을 확보하기 위해 마이크로서비스 아키텍처를 적용하였으며, 효율적인 실시간 운항 정보의 탐색을 위해 저장소를 이원화하여 체계 성능을 향상시킬 수 있었다. 구현된 체계는 실해역 데이터를 적용한 시범 운영을 통해 성능을 확인하고 추가적인 개선 사항을 파악하였으며, 실제 관제 환경에서의 활용 가능성을 검토하였다.

KISTI-ML 플랫폼: 과학기술 데이터를 위한 커뮤니티 기반 AI 모델 개발 도구 (KISTI-ML Platform: A Community-based Rapid AI Model Development Tool for Scientific Data)

  • 이정철;안선일
    • 인터넷정보학회논문지
    • /
    • 제20권6호
    • /
    • pp.73-84
    • /
    • 2019
  • 최근 서비스로서의 머신러닝(MLaaS) 개념은 데이터 자체를 제외하고 네트워크 서버, 스토리지 또는 데이터 과학자 없이도 생산적인 서비스 모델을 구축할 수 있다는 점에서 기계학습을 다루는 대부분의 산업 분야와 연구 그룹들의 많은 관심을 받고 있다. 그러나 과학 분야에서는 양질의 빅데이터를 확보하는 가정 자체가 커다란 도전이 된다. 즉, 연구자 간 연구 결과물의 공유가 쉽지 않을 뿐 아니라 과학기술 데이터의 비정형성 문제를 해결해야하는 문제가 선행된다. 본 논문에서 제안된 KISTI-ML 플랫폼은 과학기술 데이터를 위한 AI 모델 고속 개발 도구로서, 머신러닝에 익숙하지 않은 연구자들을 위해 웹 기반 GUI 인터페이스를 제공하고 연구자는 자신의 데이터를 이용하여 머신러닝 코드를 손쉽게 생성하고 구동할 수 있다. 또한 승인된 커뮤니티 멤버들을 중심으로 데이터셋 및 특징 추출에 사용되는 데이터전처리, 학습 네트워크 설계 등이 포함되는 프로그래밍 코드를 공유할 수 있는 환경을 제공한다.

구텐베르그 프로젝트 텍스트 데이터를 활용한 시각화 및 용례 검색 (Text Visualization and Concordance Search Using Gutenberg Project Text Data)

  • 김동성;신연수;이지안;유지민
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2017년도 제29회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.175-178
    • /
    • 2017
  • 본 연구는 거시적 빅데이터 인문학과 미시적 언어 텍스트 검색 시스템을 구축하고, 이를 통해서 언어를 통한 문화의 역동적 변화를 시간적 순서에 따라 살펴보고자 한다. 연구의 최종적인 목표는 문화도 생물체처럼 변화하는 존재라 여기고 그 구성요소들을 연구한다는 뜻인 '문화체학(文化體學; Culturomics)'과 같은 '인문학 + 정보과학 + 사회과학' 등등의 다학문간의 융합적 연구에 있다. 이 시스템을 통해서 인류 역사의 기록인 텍스트 빅데이터를 통한 인문학적 성찰을 시각화하고 있다. 이러한 구글의 업적은 인문학과 정보기술의 융합을 통해서 인문학 자체의 지평을 넓히고, 사회과학을 변형시키고, 산업과 상아탑 사이의 관계를 재조정하는데 있다.

  • PDF

구텐베르그 프로젝트 텍스트 데이터를 활용한 시각화 및 용례 검색 (Text Visualization and Concordance Search Using Gutenberg Project Text Data)

  • 김동성;신연수;이지안;유지민
    • 한국어정보학회:학술대회논문집
    • /
    • 한국어정보학회 2017년도 제29회 한글및한국어정보처리학술대회
    • /
    • pp.175-178
    • /
    • 2017
  • 본 연구는 거시적 빅데이터 인문학과 미시적 언어 텍스트 검색 시스템을 구축하고, 이를 통해서 언어를 통한 문화의 역동적 변화를 시간적 순서에 따라 살펴보고자 한다. 연구의 최종적인 목표는 문화도 생물체처럼 변화하는 존재라 여기고 그 구성요소들을 연구한다는 뜻인 '문화체학(文化體學; Culturomics)'과 같은 '인문학 + 정보과학 + 사회과학' 등등의 다학문간의 융합적 연구에 있다. 이 시스템을 통해서 인류 역사의 기록인 텍스트 빅데이터를 통한 인문학적 성찰을 시각화하고 있다. 이러한 구글의 업적은 인문학과 정보기술의 융합을 통해서 인문학 자체의 지평을 넓히고, 사회과학을 변형시키고, 산업과 상아탑 사이의 관계를 재조정하는데 있다[1].

  • PDF

빅데이터를 위한 트랜스포머 기반의 언어 인식 기법 (Transformer-based Language Recognition Technique for Big Data)

  • 황치곤;윤창표;이수욱
    • 한국정보통신학회:학술대회논문집
    • /
    • 한국정보통신학회 2022년도 추계학술대회
    • /
    • pp.267-268
    • /
    • 2022
  • 최근, 빅데이터 분석은 기계학습의 발전에 따른 다양한 기법들을 이용할 수 있다. 현실에서 수집된 빅데이터는 단어 간의 관계성에 대한 의미적 분석을 바탕으로 같거나 유사한 용어에 대한 자동화된 정제기법이 부족하다. 빅데이터는 보통 문장의 형태로 구성되어 있고, 이에 대한 형태소 분석이나 문장의 이해가 필요하다. 이에 자연어를 분석하기 위한 기법인 NLP는 단어의 관계성과 문장을 이해할 수 있다. 본 논문에서는 빅데이터를 시계열 접근법인 RNN의 단점을 보완한 기법인 트랜스포머와 리포머의 장단점에 대해 연구한다.

  • PDF

과학기술 빅 데이터 기반 기술 동향 분석 및 예측 (Analysis and Forecast of Technology Trends from S&T Big Data)

  • 정한민
    • 한국콘텐츠학회:학술대회논문집
    • /
    • 한국콘텐츠학회 2012년도 춘계 종합학술대회 논문집
    • /
    • pp.169.1-169.1
    • /
    • 2012
  • 최근 높은 관심과 기술적 이슈를 끌어내고 있는 빅 데이터는 과학기술 분야에도 무수히 존재한다. 위성사진, 동영상을 비롯하여 링크드 데이터 (Linked Data)에 이르기까지 데이터 유형과 무관하게 처리해야 할 대상은 계속 늘어가고 있는 실정이다. 최근 몇 년동안 과학기술 문헌을 대상으로 시맨틱 기술과 자연어처리 기술을 이용하여 기술 동향을 분석하고 예측하는 연구를 수행해 온 KISTI는 빅 데이터 환경에 맞추어 분석 플랫폼을 분산/병렬화하는 동시에 모바일 서비스 플랫폼을 통해 신속한 의사 결정을 지원하는 전략을 취하고 있다. 또한, 법무부, 국방기술품질원, 관세청에 적용한 분석 기술을 더욱 고도화하여 사용자 적응형 가이드 서비스를 개발하고 이를 통해 연구 개발 전략 수립을 실제적으로 지원할 수 있도록 노력하고 있다.

  • PDF