• Title/Summary/Keyword: 과학기술 데이터

Search Result 2,575, Processing Time 0.038 seconds

Design and Implementation of Big Data Streaming Query Processing System for Realtime Power Plant Sensor data (실시간 발전소 시설 장비 센서 데이터에 대한 빅데이터 스트리밍 질의 처리 시스템 설계 및 구현)

  • Um, Jung-Ho;Yu, Chan Hee;Sarda, Komal;Park, Kyongseok
    • Annual Conference of KIPS
    • /
    • 2020.11a
    • /
    • pp.88-91
    • /
    • 2020
  • 발전 시설은 연간 무중단으로 운영되어야 하고, 고장이 발생하면 손해가 막대하기 때문에 발전 시설 장비에는 수십만 개의 센서 데이터가 설치되어 있다. 본 논문에서는 효율적인 센서 데이터의 수집과 시설 모니터링 및 고장 예측 등을 위한 빅데이터 스트리밍 질의 처리 시스템을 설계 및 구현하였다. 또한 실시간 데이터 수집의 효율적인 관리를 위해 인코딩 방식을 설계하였으며, 데이터 전송 성능을 측정하여 문자열로 데이터를 전송하는 것보다 평균 12%, 최대 32% 데이터 처리 성능이 향상됨을 보였다. 또한, 스트리밍 데이터에 대한 윈도우 질의 처리 성능을 측정하여 약 0.97초의 평균 집계 질의 처리 시간이 소요됨을 확인하였다. 향후에는 고장 감지를 위한 인공지능 추론 모델을 제안하는 빅데이터 스트리밍 질의 처리 시스템에 적용할 예정이다.

High-performance and Highly Scalable Big Data Analysis Platform (고성능, 고확장성 빅데이터 분석 플랫폼)

  • Park, Kyongseok;Yu, Chan Hee;Kim, Yuseon;Um, Jung-Ho
    • Annual Conference of KIPS
    • /
    • 2021.11a
    • /
    • pp.535-536
    • /
    • 2021
  • 빅데이터를 활용한 기계학습 모델을 개발하기 위해서는 빅데이터 처리를 위한 플랫폼과 딥러닝 프레임 워크 등 고급 분석을 수행할 수 있는 도구의 활용이 동시에 요구된다. 그러나 빅데이터 플랫폼과 딥러닝 프레임워크를 자유롭게 활용하기 위해서는 상당한 수준의 기술적 지식과 경험이 필요하다. 또한 빅데이터를 이용한 딥러닝 모델을 개발할 경우 분산처리와 병렬처리에 대한 지식과 추가적인 작업이 요구된다. 본 연구에서는 빅데이터를 활용한 기계학습 모형을 자유롭게 개발 및 공유하고 분산 딥러닝을 위한 시스템적 지원을 통해 분야별로 딥러닝 모형을 개발하는 응용 연구자들이 활용할 수 있는 플랫폼을 제시하였다. 본 연구를 통해 다양한 분야의 연구자들이 자신의 데이터를 이용하여 모형을 개발할 경우 분산처리와 병렬처리를 위한 기술적 제약을 극복하고 보다 빠르고 효율적인 방법으로 모형을 개발하고 현업에 활용할 수 있을 것으로 기대한다.

A Construction of Management System and Its Portal Site for NTIS Data Quality Management (NTIS 데이터 품질관리 체계와 포털 사이트 구축)

  • Lee, Byeong-Hee;Jung, Ock-Nam;Choi, Heeseok;Lim, ChulSu;Kim, Jaesoo
    • Annual Conference of KIPS
    • /
    • 2009.04a
    • /
    • pp.984-987
    • /
    • 2009
  • 데이터가 기업 및 기관 활동의 중요한 자산으로 인식이 높아지고 있지만 저 품질 데이터로 인한 막대한 손실과 비용의 증가는 큰 문제가 되고 있다. 본 논문에서는 교육과학기술부와 KISTI에서 2007년부터 범부처 차원에서 수행중인 국가R&D 정보자원의 데이터 품질관리를 위해 각 부처와 협의하고 수행해 온 국가R&D 데이터 품질관리 체계 수립과 포털 사이트 구축에 관하여 알아본다. 범부처 국가R&D정보 자원의 데이터 품질관리체계 수립과 범부처 적용 지침 및 가이드라인 제시를 위해 NTIS사업단 및 15개 부처(16개 대표전문기관)의 실무팀장 및 DB 관리자 중심으로 총 33명의 설문을 실시하여 품질관리체계 현황을 조사 분석하였다. 또한 부처(기관)별로 국가R&D표준정보 데이터품질 지표 마련과 주기별 데이터 품질 및 개선도 자체점검을 지원하기 위해, 데이터 점검기준과 절차를 마련하고 이를 기반으로 부처(기관)와 협력하여 데이터품질 점검을 기반을 마련하였다. 이렇게 마련된 품질관리체계와 프로세스를 지원하기 위한 자동화 솔루션을 운영하고자 본 논문에서는 NTIS 데이터 품질관리 체계 및 프로세스, 기능이 통합된 웹 포털 구축에 대해서도 알아본다.

Design and Implementation of Workflow Federation Method for Multi-cluster Based Korea Research Data Commons (멀티 클러스터 기반 국가연구데이터커먼즈 간 워크플로우 연계 방안 설계 및 구현)

  • Dasol Kim;Sang-baek Lee;Seong-eun Park;Minhee Cho;Mikyoung Lee;Sa-kwang Song;Hyung-jun Yim
    • Annual Conference of KIPS
    • /
    • 2023.11a
    • /
    • pp.100-102
    • /
    • 2023
  • 최근 오픈 사이언스 문화가 확산됨에 따라 오픈 데이터, 오픈 소스 소프트웨어와 같은 공개된 리소스들을 효율적으로 공유 및 활용하기 위한 방법이 주목을 받고 있다. 본 논문에서는 연구 소프트웨어의 재현성을 향상시키기 위한 국가연구데이터커먼즈(KRDC)를 소개하고 다중 KRDC 클러스터 간 워크플로우 연계 방안을 제안한다. 국가연구데이터커먼즈는 연구 소프트웨어와 분석 환경인 인프라를 결합하여 함께 제공하는 서비스로, 멀티 노드 쿠버네티스(kubernetes) 클러스터를 기반으로 동작한다. 따라서, 서로 다른 KRDC 프레임워크에 존재하는 리소스들을 하나의 워크플로우로 연계하는 것은 복잡한 사용자 인증/인가 문제, 보안 상의 문제를 고려하여야 한다. 본 논문에서는 프록시(proxy) 앱을 사용하는 워크플로우 연계 기능을 제안하고, 이를 지원하기 위한 통합 인증, 인가 체계와 연계 방안을 구현한다. 제안하는 방법을 두 개의 KRDC 프레임워크를 대상으로 적용하여 제안 워크플로우 연계 방법의 유효함을 확인한다. 본 논문에서 제안하는 워크플로우 연계 방법과 시나리오는 실제 멀티 클러스터 연계 방안을 구현한 사례로, KRDC 프레임워크 뿐만 아니라 다양한 쿠버네티스 기반 리소스 연계에 활용할 수 있는 우수한 결과로 사료된다.

과학기술데이터위원회(CODATA)의 조직과 활동

  • Waddington, Guy
    • Journal of Information Management
    • /
    • v.6 no.5
    • /
    • pp.127-130
    • /
    • 1973
  • 1966년에 국제학술연합회의(ICSU)는 과학기술데이터위원회(CODATA)를 조직하였는데 이는 세계적으로 수치데이터 수집에 관한 조정(調整)을 꾀하고 유도해주며 해당 사기관, 정부기관 및 정부간기관의 데이터 수집을 적극 지원해 주기 위한 것이었다. 현재 위원회는 8개국으로부터의 회원과 10개의 국제연맹을 가지고 있으며 이들은 CODATA의 목적을 달성하기 위하여 내부적인 수법을 사용해 오고 있고, 또한 각국의 관련단체들은 비공식적인 전달수단을 통하여 서로 연결되어져 있다. CODATA의 중앙국은 원래 워싱턴에 있었으나, 지금은 독일의 프랑크푸르트에 위치하고 있으며, 중요한 데이터평가 및 수집센터의 간행물을 분석한 요약판이 곧 발행될 것이다. 그밖에 특수한 문제를 해결하기 위하여 기본상수, 수치데이터처리를 위한 전자계산기의 응용, 수집가가 사용하는 중요입력데이터의 표준 등에 관한 작업반이 설치되었다. 한편, 세계적으로 수치데이터 수집가들간의 협력이 활발히 이루어지고 있다.

  • PDF

Global Open Research Commons and Implications (글로벌 개방형 연구데이터 커먼즈 및 시사점)

  • Sa-kwang Song;Minhee Cho;Mikyoung Lee;Hyung-Jun Yim
    • Annual Conference of KIPS
    • /
    • 2023.11a
    • /
    • pp.85-88
    • /
    • 2023
  • 오픈 사이언스 운동의 활성화로 인해 다양한 연구 관련 자원들 간의 상호 운용성 확보를 위한 노력이 활발해지고 있다. 특히, 글로벌 연구데이터 커먼즈(Global Open Research Commons) 모델 개발 관련 표준화 활동이 세계 최대 연구데이터 커뮤니티인 RDA(Research Data Alliance)의 주도로 진행되어 왔고, 최근에 GORC Working Group 에서 버전 1.0 모델을 오픈하였다. 이에 이 모델에 대해 살펴보고 국내의 연구데이터 커먼즈인 KRDC(Korea Research Data Commons)와 비교 및 시사점을 논하고 향후 연구 방향을 소개한다.

Deployment and performance measurement of containerized collaborative research platform in Science DMZ environment (Science DMZ 환경에서의 컨테이너 기반 협업연구 플랫폼 구성 및 성능 측정)

  • Hong, Wontaek;Lee, Sangkwon;Kim, Kihyeon;Moon, Jeonghoon
    • Annual Conference of KIPS
    • /
    • 2021.05a
    • /
    • pp.59-61
    • /
    • 2021
  • 고성능 네트워크를 기반으로 하는 과학응용 협업연구 환경에서 대용량 데이터의 고속 전송을 위해 활용되고 있는 전용의 데이터 전송 노드는 이용률을 감안하여 연산을 위한 부수적인 목적을 위해 활용이 가능하다 본. 논문에서는 이러한 분산된 데이터 전송 노드들을 활용한 컨테이너 기반 협업연구 플랫폼의 구성 사례를 소개하고 해당 플랫폼 상에서 분산 학습을 실험하고 소요시간 측면에서 성능을 측정하여 제시한다.

An Economic Ripple Effect Analysis of National Scientific Data Center Construction (국가 과학데이터센터 구축의 경제적 파급효과 분석)

  • Park, Sung-Uk;Hahn, Sun-Hwa
    • Journal of Information Management
    • /
    • v.42 no.3
    • /
    • pp.55-69
    • /
    • 2011
  • In the modern scientific R&D, the efficient acquisition, curation, analysis and visualization are core elements of the science development. The value of scientific data is very important in data intensive research. An output of scientific data is drastically increasing. However we have only each individual system of scientific data in now. Therefore We feel a lack of efficiency of scientific data. In this paper, We analyze an economic ripple effects in terms of production inducement effect, added value inducement effect, labor inducement effect and forward backward linkage effect of national scientific data center construction using an input-out analysis of the bank of Korea(2009). We also examine an economic propriety of national scientific data center construction.

Faster Data Transfer using Optimized Intermediate Node (최적성능노드 경유 고속전송 방안 연구)

  • Woojin seok
    • Annual Conference of KIPS
    • /
    • 2024.05a
    • /
    • pp.130-132
    • /
    • 2024
  • 본 논문에서는 과학 빅데이터를 위한 고속 데이터 전송 방식을 제안한다. 최근의 과학연구는 이전보다 훨씬 더 많은 양의 데이터를 요구하지만, 잘 알려진 네트워킹 문제인 라스트마일 문제로 인해 여전히 데이터를 수신하는 데 시간이 오래 걸린다. 과학 빅데이터 전송시 라스트마일 문제로 인한 패킷 손실에 대해 더 나은 방법을 제안한다. 제안하는 방법은 원격 전송에 최적화된 중간 서버를 사용하고 종단간 네트워크 경로에서 라스트마일을 분리한다. 전송 측정을 통해 향상된 성능을 확인한다.

A Study on Awareness and Experience of Data Publishing by Scientists (과학기술분야 연구자들의 데이터 출판경험 및 인식 연구)

  • Hyekyong Hwang;Youngim Jung;Sung-Nam Cho;Tae-Sul Seo;Jihyun Kim
    • Journal of Korean Library and Information Science Society
    • /
    • v.54 no.1
    • /
    • pp.45-68
    • /
    • 2023
  • This study aims to investigate the awareness and experiences of domestic researchers regarding data publishing, which has been recognized as a new channel of data sharing as scholarly communication evolves in the open science environment. A survey is conducted among researchers from five government-funded research institutes in the field of science and technology and members of the GeoAI Data Society to confirm the awareness of data publishing. As a result of the study, domestic researchers recognized providing explanations for data, stable access to data, citation, and quality assurance through peer review as the advantages of data journals. On the contrary, a low level of recognition for data paper as one of the research outputs was presented. With regard to the properties of data publication, the respondents answered that the data description, metadata description, and permanent identifiers are highly related, however, their recognition of the relation between the properties of data publication and the data submission to a repository and data peer review was relatively low. Finally, to expand the data publication, the need for the development of an editorial system that supports data paper peer review and cross-linking to a data repository as well as the development of a repository that supports data citation was identified. This study on the domestic researchers' experience and awareness of data publishing can provide insights for the implementation of data publishing services and infrastructure in the future.