• 제목/요약/키워드: 데이터 논문

검색결과 41,262건 처리시간 0.053초

데이터논문 동료심사를 위한 핵심 개념 분석과 프로세스 모델링 (Analysis and Modeling of Essential Concepts and Process for Peer-Reviewing Data Paper)

  • 안성수;조성남;정영임
    • 한국도서관정보학회지
    • /
    • 제54권3호
    • /
    • pp.321-346
    • /
    • 2023
  • 연구데이터를 서술하는 데이터논문은 데이터를 생산한 연구자에게 연구논문과 같은 학술적 성과로 인정받을 수 있게 하고 다른 연구자가 데이터논문에서 공유한 데이터를 활용하여 기존 연구를 재현하거나 새로운 연구를 시작할 수 있도록 도움을 준다. 이러한 장점으로 데이터논문의 동료심사, 출판, 인용은 지속적으로 증가하고 있다. 데이터논문을 출판하고자 하는 학술단체는 연구논문과 다른 데이터논문의 핵심 개념, 데이터논문 심사 절차, 데이터논문 출판과 관계된 정보시스템 등을 이해하고 데이터논문에 포함할 구성요소 정의, 동료심사 절차 수립, 그리고 데이터저장소와 연계 등 세부 사항을 결정하는 것이 필요하다. 하지만, 데이터논문의 동료심사와 관련하여 다루어야 할 정보가 방대하고, 데이터논문 출판에 관한 연구 및 체계적인 정보가 부족하여 국내 학술단체는 데이터논문의 동료심사 업무에 어려움을 겪고 있다. 이러한 문제를 해결하는 데 도움이 될 수 있도록, 본 논문은 국내외 다섯 종 데이터학술지의 데이터논문 양식, 동료심사 사례를 조사·분석하여 데이터논문의 핵심 구성요소를 포함한 데이터논문 동료심사의 핵심 개념을 제안하고 프로세스를 모델링하였다. 데이터논문을 신규로 출판하거나, 기존의 연구논문과 함께 데이터논문을 심사하여 출판하고자 하는 학술단체는 본 논문에서 제시한 데이터논문의 핵심 개념과 동료심사 프로세스를 활용하여 데이터논문의 양식 개발, 체계적인 동료심사 프로세스 정립, 출판 정책 개발 등의 학술지업무에 신속하고 효과적으로 적용할 수 있을 것으로 기대된다.

데이터 출판과 도서관 (Data Publishing and Library)

  • 정영임
    • 한국정보관리학회:학술대회논문집
    • /
    • 한국정보관리학회 2017년도 제24회 학술대회 논문집
    • /
    • pp.101-101
    • /
    • 2017
  • 연구 성과물에 대한 접근성을 개선함으로써 다른 연구에도 도움을 주어 또 다른 과학적 발명과 발견에 기여할 수 있어야 한다는 오픈 사이언스의 철학이 전세계적으로 설득력을 얻으면서 연구 데이터 공개 및 출판을 위한 사회적 논의도 활발하게 이루어지고 있다. 또한, 지난 몇년 동안 글로벌 표준식별자 개발, 메타데이터 및 인용 방식의 표준화, 데이터 리포지토리 구축 등 연구 데이터 공개 및 출판을 위한 기술이 비약적으로 발전하고 있다. 전통적으로 학술지 논문의 부속 자료로 여겨지던 데이터(연구 데이터)는 이제 다양한 분야에서 논문과는 독립적으로 데이터 리포지토리에 기탁되어 공개되거나 데이터 저널에 출판되기도 한다. 그러나 학술 논문의 출판과는 달리 데이터 출판은 종종 다른 용어와 의미로 정의되기도 하며 분야마다 데이터 출판의 방식과 구현의 정도가 크게 다르다. 본 연구에서는 현재 진행 중인 데이터 공개 및 출판 이니셔티브를 소개하고 데이터의 공적 이용가능성, 문서화, 인용, 식별자 부여, 검증 및 데이터 출판의 단계별 구현 사례를 분석한다. 또한 국내에서 데이터 출판과 관련하여 수행 중인 과제를 검토한다. 마지막으로, 학술 정보 출판과 연구데이터 관리를 도서관의 기능으로 인식하고 출판과 관련한 다양한 관심사를 논의하는 도서관 중심 이니셔티브를 살펴봄으로써 데이터 출판과 관련한 도서관의 역할을 모색하고자 한다.

  • PDF

Scientific Data 학술지 분석을 통한 데이터 논문 현황에 관한 연구 (An Investigation on Scientific Data for Data Journal and Data Paper)

  • 정은경
    • 정보관리학회지
    • /
    • 제36권1호
    • /
    • pp.117-135
    • /
    • 2019
  • 데이터 학술지와 데이터 논문이 오픈과학 패러다임에서 데이터 공유와 재이용이라는 학술활동이 등장하여 지속적으로 성장하고 있다. 본 논문은 영향력있는 다학제적 분야의 데이터 학술지인 Scientific Data에 게제된 총 713건의 논문을 대상으로 저자, 인용, 주제분야 측면을 분석하였다. 그 결과 저자의 주된 주제 영역은 생명공학, 물리학 등으로 나타났으며, 공저자 수는 평균 12명이다. 공저 형태를 네트워크로 살펴보면, 특정 연구자 그룹이 패쇄적으로 공저활동을 수행하는 것으로 나타났다. 인용의 주제영역을 살펴보면, 데이터 논문 저자의 주제영역과 크게 다르지 않게 나타났으나, 방법론을 주로 다루는 학술지의 인용 비중이 높은 것은 데이터 논문의 특징으로 볼 수 있다. 데이터 논문 저자의 키워드를 사용하여 동시출현단어분석 네트워크로 살펴본 데이터 논문의 주제영역은 생물학이 중심이며, 구체적으로 해양생태, 암, 게놈, 데이터베이스, 기온 등의 세부 주제 영역을 확인할 수 있다. 이러한 결과는 다학제학문 분야를 다루는 데이터 학술지이지만, 데이터 학술지 출간에 관한 논의를 일찍부터 시작해온 생명공학 분야에 집중된 현상을 보여준다.

인문학 분야 연구데이터를 위한 연구논문의 의미구조 기반 메타데이터 연구 (A Study on the Metadata based on the Semantic Structure of the Humanities Research Articles for Research Data)

  • 안병군;고영만
    • 한국비블리아학회지
    • /
    • 제33권1호
    • /
    • pp.345-369
    • /
    • 2022
  • 본 연구의 목적은 인문학 분야 연구데이터와 연구논문을 연계할 수 있는 '인문학 분야 연구데이터를 위한 연구논문 의미구조 기반 메타데이터'를 개발하는 것이다. 인문학 분야 연구자의 관심 정보를 파악하기 위해 키워드 유형화를 진행하고 이를 일반적인 연구논문의 의미구조를 기준으로 분석함으로써 인문학 분야의 특성을 반영하기 위해 추가될 요소를 확인하였다. 이를 기반으로 인문학 분야 연구논문의 의미구조 기반 메타데이터를 구성하였으며 해당 메타데이터가 인문학 분야 연구데이터의 메타데이터로서 적합한지를 평가하기 위하여 인문학 분야 연구자를 대상으로 설문을 진행하였다. 인문학 분야 연구논문의 의미구조를 기반으로 도출된 17개의 메타데이터 요소 중 인문학 분야 연구데이터 메타데이터로 활용하기에 적합하다고 판단된 요소는 7개이며, 그 외 10개 요소는 사용 가능한 요소로 확인되었다. 평가 결과를 바탕으로 인문학 분야 연구데이터를 위한 연구논문 의미구조기반 메타데이터를 구성하였다.

스트림 데이터 환경에서의 효율적인 필터 연산자 순서화 (Efficient Filter Operator Ordering On Stream Data Environments)

  • 민준기
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2006년도 추계학술발표대회
    • /
    • pp.321-324
    • /
    • 2006
  • 인터넷과 인트라넷의 확산에 따라, 스트림 데이터 처리 (stream data processing) 와 같은 새로운 분야가 등장하게 되었다. 스트림 데이터의 특징은 실 시간적이고 연속적으로 생성된다는 것이다. 따라서 기존의 질의 처리와는 달리 질의 또한 연속적으로 처리된다. 본 논문에서는 시간에 따라서 예측할 수 없게 특성이 바뀌는 데이터 스트림에 대한 처리에 대하여 다룬다. 특별히, 본 논문에서는 스트림 데이터에 대한 질의문을 구성하는 연산자들 간의 효율적인 수행 순서 생성 기법을 제안한다. 본 논문에서 제안하는 방법은 시스템의 부담을 적게 주면서도 데이터의 변화에 따라 수행 순서를 변화시킨다. 또한 본 논문에서는 고정 연산자 순서와 비교하여 제안한 기법의 우수성을 보였다.

  • PDF

학술논문 메타데이터 변환 도구의 설계 (A Design of Metadata Conversion Tool for Research Paper)

  • 이민호;이원구;윤화묵;성원경
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2011년도 추계학술발표대회
    • /
    • pp.1222-1225
    • /
    • 2011
  • 대량의 데이터를 분석하여 보다 차원 높은 정보서비스를 제공하기 위해서는 다양한 데이터의 통합관리가 필수적이다. 특히 과학기술 분야에서는 논문 메타데이터를 분석하여 연구동향 파악, 선도 연구자 파악 등을 하기 위한 연구가 진행 중이다. 논문 메타 데이터의 통합 관리를 위해서는 메타데이터 스키마의 매핑과 데이터 변환이 필요한데, 본 논문에서는 논문 메타데이터 변환에서의 문제를 분석하여 보고, 해결하기 위한 방법을 제시하였다. 또한 다양한 구문을 지원하면서 스키마에 유연하여 시스템 수정이 필요없는 도구를 설계하였다.

Web of Science 데이터학술지 게재 데이터논문의 지적구조 규명 (An Investigation of Intellectual Structure on Data Papers Published in Data Journals in Web of Science)

  • 정은경
    • 정보관리학회지
    • /
    • 제37권1호
    • /
    • pp.153-177
    • /
    • 2020
  • 오픈과학의 흐름에서 데이터 공유와 재이용은 중요한 연구자의 활동이 되어가고 있다. 데이터 공유와 재이용에 관한 여러 논의 중에서 데이터학술지와 데이터논문의 발간이 가시적인 결과를 보여주고 있다. 데이터학술지는 여러 학문 분야에서 발간되고 있으며, 논문의 수도 점차 증가하고 있다. 데이터논문은 데이터 자체와는 다르게 인용을 주고 받는 활동이 포함되어, 따라서 이들이 형성하는 고유한 지적구조가 생겨나게 된다. 본 연구는 데이터학술지와 데이터논문이 학술커뮤니티에서 구성하는 지적구조를 규명하고자 Web of Science에 색인된 14종의 데이터학술지와 6,086건의 데이터논문과 인용된 참고문헌 84,908건을 분석하였다. 저자사항과 함께 동시인용분석과 서지결합분석을 네트워크로 시각화하여 데이터논문이 형성한 세부 주제 분야를 규명하였다. 분석결과, 저자, 저자소속기관, 국가를 추출하여 출현빈도를 살펴보면, 전통적인 학술지 논문과 다른 양상을 보인다. 이러한 결과는 데이터의 생산이 용이한 기관과 국가에 주로 데이터논문을 출간하기 때문이라고 해석될 수 있다. 동시인용분석와 서지결합분석 모두 분석도구, 데이터베이스, 게놈구성 등이 주된 세부 주제 영역으로 나타났다. 동시인용분석결과는 9개의 군집으로 형성되었는데, 특정 주제 분야로 나타난 영역은 수질과 기후 등의 분야이다. 서지결합분석은 총 27개의 컴포넌트로 구성되었는데, 수질, 기후 이 외에도 해양, 대기 등의 세부 주제 영역이 파악되었다. 특기할만한 사항으로는 사회과학 분야의 주제 영역도 나타났다는 점이다.

과학 데이터의 출판과 인용에 관한 연구 (A Study on Publishing and Citing the Scientific Data)

  • 이상호;이유선
    • 한국콘텐츠학회:학술대회논문집
    • /
    • 한국콘텐츠학회 2011년도 춘계 종합학술대회 논문집
    • /
    • pp.303-304
    • /
    • 2011
  • 과학적 논문의 기초가 되는 과학 데이터들은 국가 차원에서 체계적으로 관리가 되지 않아 원활하게 유통 및 재활용이 되지 않고 있으며 논문 원문과 데이터들이 서로 연계, 통합되지 않아서 과학 데이터의 유통이 더욱 어려워지고 있다. 이 연구에서는 유통 측면에서 과학 논문과 데이터를 비교하고 연계, 통합을 위한 영구식별자의 도입 및 제도적 측면에서 데이터 기탁 및 데이터 리파지토리의 활성화 방안에 대해 논의한다.

  • PDF

메타데이터 레지스트리를 위한 메타데이터 교환 프로토콜의 질의 효율성 평가 (Query Efficiency Evaluation of the Metadata Exchanging Protocol for Metadata Registries)

  • 정동원
    • 한국시뮬레이션학회논문지
    • /
    • 제14권2호
    • /
    • pp.73-81
    • /
    • 2005
  • 이 논문에서는 메타데이터 레지스트리간의 메타데이터 교환을 위해 제안된 교환 프로토콜의 장점을 명시적으로 보이기 위한 시뮬레이션 결과에 대하여 기술한다. 기존 접근 방법들은 교환 메커니즘의 높은 복잡도, 지역 메타데이터 관리 시스템으로의 종속성, 새로운 메타데이터 관리 시스템의 추가를 위한 높은 비용 등의 문제점을 지닌다. 이를 해결하기 메타데이터 교환 프로토콜이 제안되었다. 그러나 지금까지의 연구에서는 정성적으로만 그 장점을 보였다. 이 논문의 목적은 정략적 관점에서 제안된 프로토콜의 장점을 기술하고자 함에 있다. 특히 이 논문에서는 질의 효율이 가장 중요한 문제로서 다른 요인에 의한 결과에도 영향을 주기 때문에 질의 효율성 문제에 초점을 둔다. 이를 위해 평가 항목과 평가 모델에 대해 정의한다. 질의 효율성 평가를 위한 요인 중에서 대상 메타데이터의 개수, 각 메타데이터를 구성하는 컴포넌트의 개수 및 각 컴포넌트들을 구성하는 속성들의 개수를 주 파라미터로 이용하였다. 이에 따라 시뮬레이션은 크게 세 가지 유형을 지니게 된다 정량적 평가를 통해 교환 프로토콜이 요구되는 이유와 그 정당성을 명시적으로 보인다.

  • PDF

오류 데이터로부터의 데이터 품질 메트릭의 정립 (Establishing Data Quality Metric from Dirty Data)

  • 김수경;최병주
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2000년도 가을 학술발표논문집 Vol.27 No.2 (1)
    • /
    • pp.409-411
    • /
    • 2000
  • 소프트웨어 제품의 품질을 보증하는 일은 매우 중요하며, 국제 표준인 ISO/IEC9126은 소프트웨어 품질 특성 및 측적 메트릭 표준을 제공하고 있다. 이때 ISO/IEC 9126에서는 소프트웨어를 프로그램, 절차, 규칙 및 관련문서로 한정하고 있기 때문에 데이터의 품질에는 적용할 수 없다. 본 논문에서는 데이터 품질 평가 및 제어를 위하여 오류 데이터 형태를 분류하고, 이를 기반으로 데이터 품질 특성을 추출한다. 추출된 데이터 품질 특성을 측정하기 위해, 오류 데이터를 품질 속성으로 하는 데이터 품질 특성을 추출한다. 본 논문에서 제시하는 데이터 품질 메트릭은 지식 공학(knowledge engineering) 시스템이 최종 사용자에게 제공하는 데이터나 지식의 품질 측정 및 제어에 기준이 된다.

  • PDF