• Title/Summary/Keyword: 메타데이터 추출 알고리즘

Search Result 33, Processing Time 0.024 seconds

Extracting and Validating Metadata in Electronic Records (전자기록물의 메타데이터 추출 및 비교 검증 기술 연구)

  • Choi, Joo Ho;Lee, Jae Young
    • Journal of Korean Society of Archives and Records Management
    • /
    • v.12 no.1
    • /
    • pp.7-32
    • /
    • 2012
  • When migrate electronic records, the validation of the required metadata in electronic records and verified with the metadata in the document are also important. This paper presents a method and implements a tool to extract data from files in various formats and use them to validate metadata associated with the files in electronic records. Compared to other metadata extraction tools, especially developed in foreign countries, the standard form of documents used in Korean government is taken into account and metadata is extracted from the content of files. The tool compares the extracted data to encapsulated metadata for validation.

Enhanced Meta Process Implementation For Growing Data Warehouse (데이터웨어하우스 성장에 따른 개선된 메타프로세스 구현)

  • Lee, Dong-Won;Moon, Seung-Jin
    • Annual Conference of KIPS
    • /
    • 2000.04a
    • /
    • pp.7-9
    • /
    • 2000
  • 데이터 웨어하우스는 기업의 의사 결정 과정을 향상시킬 수 있게 하는 정보기술이다. 대표적인 정의로는 '기업의 의사결정 과정을 지원하기 위한 주제 중심적이고 통합적이며 시간성을 가지는 비휘발성 자료의 집합 '이다.[1] 즉, 기업들이 보유하고 있는 분산된 대량의 데이터를 추출, 변환, 통합하여 요약된 읽기 전용의 데이터베이스로 구축함으로써, 경영분석이나 기업내의 의사 결정 지원 자료로 주로 활용된다. 데이터 웨어하우스의 경우, 일반사용자는 웨어하우스내에 저장된 데이터를 직접 이용하는 경우가 대부분이다. 따라서, 데이터의 구조와 의미에 대한 일반 사용자의 이해가 필요하게 되었다. 즉, 데이터의 추출 및 정제규칙, 데이터의 통합규칙, 요약알고리즘, 데이터 처리스케쥴 등을 알아야만 한다. 메타데이터는 최소한의 데이터 구조, 데이터의 요약에 사용된 알고리즘, 운영 데이터베이스와 데이터 웨어하우스사이의 대응관계와 같은 정보를 포함하여야 한다.[3] 여기서 변환프로세스에 대한 정보를 데이터의 형식에 대한 정보와 일반적인 데이터들과 차별화하여 메타프로세스라 한다.[5] 메타프로세스는 데이터를 변환하여 데이터 웨어하우스에 적재하는 과정에서 생성되는 메타데이터의 일부로써 데이터 웨어하우스에 통합된 자료들이 어떤 변환과정을 거쳐 생성된 자료인지를 알려주는 변환프로세스에 관한 정보를 제공한다. 본 연구에서는 대부분의 데이터 웨어하우스에서 구현되고 있는 메타데이터들은 데이터 항목의 속성정보를 위주로 한 것이며, 변환 프로세스와 관련된 데이터 관리가 미약하다. 따라서, 데이터 웨어하우스의 메타데이터 중 메타프로세스 정보의 추출 및 관리 시스템을 제안하는 것이다.

  • PDF

Consideration upon Importance of Metadata Extraction for a Hyper-Personalized Recommender System on Unsupervised Learning (비지도 학습 기반 초개인화 추천 서비스를 위한 메타데이터 추출의 중요성 고찰)

  • Paik, Juryon;Ko, Kwang-Ho
    • Proceedings of the Korean Society of Computer Information Conference
    • /
    • 2022.01a
    • /
    • pp.19-22
    • /
    • 2022
  • 서비스 관점에서 구축되는 추천 시스템의 성능은 얼마나 효율적인 추천 모델을 적용하여 심층적으로 설계되었는가에 좌우된다고도 볼 수 있다. 특히, 추천 시스템의 초개인화는 세계적인 추세로 1~2년 전부터 구글, 아마존, 알리바바 등의 데이터 플랫폼 강자들이 경쟁적으로 딥 러닝 기반의 알고리즘을 개발, 자신들의 추천 서비스에 적용하고 있다. 본 연구는 갈수록 고도화되는 추천 시스템으로 인해 발생하는 여러 문제들 중 사용자 또는 서비스 정보가 부족하여 계속적으로 발생하고 있는 Cold-start 문제와 추천할 서비스와 사용자는 지속적으로 늘어나지만 실제로 사용자가 소비하게 되는 서비스의 비율은 현저하게 감소하는 데이터 희소성 문제 (Sparsity Problem)에 대한 솔루션을 모색하는 알고리즘 관점에서 연구하고자 한다. 본 논문은 첫 단계로, 적용하는 메타데이터에 따라 추천 결과의 정확성이 얼마나 차이가 나는지를 보이고 딥러닝 비지도학습 방식을 메타데이터 선정 및 추출에 적용하여 실시간으로 변화하는 소비자의 실제 생활 패턴 및 니즈를 예측해야 하는 필요성에 대해서 기술하고자 한다.

  • PDF

A Theoretical Study on Indexing Methods using the Metadata for the Automatic Construction of a Thesaurus Browser (시소러스 브라우저 자동구현을 위한 Metadata를 이용한 색인어 처리방안에 대한 연구)

  • Seo , Whee
    • Journal of Korean Library and Information Science Society
    • /
    • v.35 no.4
    • /
    • pp.451-467
    • /
    • 2004
  • This paper is intended to present the theoretical analyses on automatic indexing, which is vital in the process of constructing a thesaurus browser, and clustering algorithms to construct hierarchical relations among terms as well as the methods for the automatic construction of a thesaurus browser. The methods to select the index term automatically in the web documents are studied by surveying the methods for analyzing and processing metadata which conforms to bibliographical roles of traditional paper documents in web documents. Also, the result of the study suggests to adding or involving the metadata in web documents, using the metadata automatic editor because metadata is not listed in most of the web documents.

  • PDF

The Design of Object-of-Interest Extraction System Utilizing Metadata Filtering from Moving Object (이동객체의 메타데이터 필터링을 이용한 관심객체 추출 시스템 설계)

  • Kim, Taewoo;Kim, Hyungheon;Kim, Pyeongkang
    • Journal of KIISE
    • /
    • v.43 no.12
    • /
    • pp.1351-1355
    • /
    • 2016
  • The number of CCTV units is rapidly increasing annually, and the demand for intelligent video-analytics system is also increasing continuously for the effective monitoring of them. The existing analytics engines, however, require considerable computing resources and cannot provide a sufficient detection accuracy. For this paper, a light analytics engine was employed to analyze video and we collected metadata, such as an object's location and size, and the dwell time from the engine. A further data analysis was then performed to filter out the target of interest; as a result, it was possible to verify that a light engine and the heavy data analytics of the metadata from that engine can reject an enormous amount of environmental noise to extract the target of interest effectively. The result of this research is expected to contribute to the development of active intelligent-monitoring systems for the future.

Full Motion Video Abstraction and Search System (동영상 요약 및 검색 시스템)

  • 정진국;박주현;낭종호;김경수;하명환;정병희
    • Journal of Broadcast Engineering
    • /
    • v.7 no.2
    • /
    • pp.114-125
    • /
    • 2002
  • Although there have been a lot of researches on a video abstraction algorithm, the video abstraction tool is necessary to correctly pick up some important shots in a video because the important shots might vary on the person's subjectivity. This paper proposes a video abstraction and search system for making a video abstraction automatically or manually. Proposed system has two main components, server and client. The server generates the Metadata and makes a video abstraction file. The description for video abstraction file is based on MPEG-7. Since proposed system has a function to manually correct the results of each step, the author could produce a good video abstraction easily and efficiently. The proposed system could be used to build a digital video library.

Hydrographic Survey Data Processing Sl Automatic Inventory Archiving System for Nautical Chart (해도제작을 위한 해양탐사자료의 처리 및 탐사 기록 자동생성 시스템 개발)

  • 박요섭;김학일
    • Proceedings of the Korean Institute of Information and Commucation Sciences Conference
    • /
    • 1999.11a
    • /
    • pp.218-223
    • /
    • 1999
  • 국제 수로 기구(IHO, International Hydrographic Organization)에서는 해도제작을 위한 해양조사의 기준을 마련하고, 전세계적으로 사용되는 해도의 정확도를 표준화하고 있다. IHO에서는 탐사 기술의 발달을 반영하여, 기존의 단 빔 음향 측심기 이외에도 멀티 빔 음향 측심기(Multibeam Echo Sounder)와 사이드 스캔 소나(Side Scan Sonar)를 이용한 해양 탐사 시에 요구되는 정확도와 탐사 자료에 대한 메타 데이터(Metadata)의 작성을 요구하고 있다. 본 논문은 수로 측량에서 얻어진 측량 자료들의 처리절차와 자료관리 기법에 대한 연구이다. IHO 해양탐사 기준에 맞는 탐사 자료 처리와, 메타 데이터를 자동으로 생성하여 측량자료관리 DB구축 및 관리를 주 기능으로 하는 시스템을 설계하고 구현한다. 특히, 본 논문은 해양 탐사 자료 처리 시스템을 개발하기 위하여, 해양 자료 처리 과정을 표준화하고, 국제적 해양 자료의 교환 표준인 MGD77과 호환 가능한 메타 데이터를 자동 생성하며, 1Hz로 수집되는 GPS 측위자료로부터 특징점(Waypoint)을 정의하고, 이를 추출하여 측심선을 벡터화 (Trackline Vectorizing) 하는 알고리즘을 구현한다. 개발된 시스템은 현재 국립 해양조사원의 해양2000호에서 획득된 탐사자료에 적용, 운영되고 있다.

  • PDF

An Automative Melody Track Selection in MIDI Files for Query By Humming(QBH) Application (Query By Humming 응용을 위한 MIDI 파일에서의 자동 멜로디 트랙 선택 방법)

  • Kim, Moo-Jung;Nang, Jong-Ho
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 2011.06b
    • /
    • pp.405-408
    • /
    • 2011
  • 기존의 작곡가, 곡명 등의 질의어로 대표될 수 있는 메타 데이터 기반 음악 검색은 음악 데이터의 양이 급증함에 따라 탐색 근거가 되는 사항을 모를 경우 사용자의 요구를 충족시켜 줄 수 없는 단점을 가지고 있다 [1]. 반면 음악의 내용을 기반으로 한 검색의 경우 이러한 제약에서 보다 자유로울 수 있다. 내용 기반 검색[2]의 연구에 있어서 음악 데이터로부터 사용자의 질의를 처리해주기 위한 멜로디를 추출해주는 것이 중요한 문제가 되는데, 데이터의 추출과 편집이 용이한 MIDI 파일이 많이 사용되고 있다. 본 논문에서는 사용자의 질의를 바탕으로 한 QBH system상에서의 음악 데이터 구축을 위해 MIDI파일에서 추출해 낼 수 있는 특징들을 이용해 MIDI파일의 멜로디 트랙 멜로디 트랙과 반주 트랙을 자동으로 구분하는 것을 목적으로, MIDI트랙에서 추출해서 이용할 수 있는 특징들에 대해 알아보고 그에 따른 간단한 분류 알고리즘의 제안과 실험 결과에 대해 소개한다.

WATERMARKING SYSTEM FOR CONTENTS ADPATATION IN UBIQUITOUS ENVIRONMENT (유비쿼터스 환경에서 컨텐츠 적응변환을 위한 워터마킹 시스템)

  • 강석준;배태면;노용만;인소란
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 2004.04a
    • /
    • pp.268-270
    • /
    • 2004
  • 유비쿼터스 환경에서 컨텐츠 서비스를 하기 위해 DRM 시스템은 컨텐츠 적응변환을 필요로 한다. 그러나 DRM 시스템에서 컨텐츠의 저작권 보호를 위해 삽입된 워터91크는 컨텐츠 적응변환으로 인해 왜곡된다. 본 논문에서는 워터마킹기술과 컨텐츠 적응변환을 함께 사용하기 위한, 유비쿼터스 DRM 시스템에서의 워터마킹 시스템을 제안한다. IMPRIMATUR 모델에 기반한 DRM시스템에서 컨텐츠 적응변환 후 워터마크의 생존여부를 나타내는 워터마크 유효 정보 추출과정과 이를 표현하는 메타데이터를 제안한다. 마지막으로 기존에 사용되고 있는 워터마킹 알고리즘을 컨텐츠 적응변환에 적용하는 실험을 통해서 제안한 워터마킹 시스템이 컨텐츠 적응변환에 유용하다는 것을 증명하였다.

  • PDF

The Method of Searching Metathesaurus, Using Automatic Modified a Query (질의어 자동수정을 이용한 메타시소러스 검색 방법)

  • 김종광;하원식;김태용;류중경;이정현
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 2003.10b
    • /
    • pp.454-456
    • /
    • 2003
  • UMLS(2003AA edition 기준)의 메타시소러스는 다국어를 지원하며 875.233개의 개 (concept)과 2,146,897개의 개념명(concept name)을 포함한다. 현재 UMLS 메타시소러스 검색을 제공하는 PubMed나 NLM에서는 UMLS에서는 개념명에 존재하지 않는 잘못된 질의나, 잘못된 구문 또는 개념명의 일부를 이용한 검색이 불가능하다. 이는 사용자가 UMLS에서 정보를 얻기 위해서는 정확한 의학용어를 숙지해야 되며. UMLS 메타시소러스의 데이터가 잘못 되었을 경우 정보를 얻을 수 없다. 본 연구에서는 이러한 문제점을 보완하기 위해서 자연어처리에서 연구되고 있는 문자열 간의 유사도 측정방식을 적용하여 잘못된 질의어에 대한 자동수정 기능을 이용한 메타시소러스 검색방법을 제안한다. 제안한 방법에서는 질의어를 자동수정하기 위하여 철자사전을 자동으로 추출하고 문자열 비교알고리즘을 도입하여 질의어와 철자사전간의 용어의 유사도를 측정한다. 유사도에 의하여 얻어진 용어를 메타시소러스의 형식에 맞게 변환하여 질의에 대한 최적의 결과를 얻을 수 있도록 한다. 제안된 방법의 성능을 평가하기 위해서 최근(2003년 8월) bi-gram 방식을 도입한 NLM에서의 시스템과 비교 평가한다.

  • PDF