• Title, Summary, Keyword: 정보 추출

Search Result 13,915, Processing Time 0.065 seconds

Information Extraction Using the Ontology (온톨로지를 이용한 정보 추출)

  • Kim, In-Su;Lee, Bog-Ju
    • Proceedings of the Korean Information Science Society Conference
    • /
    • /
    • pp.652-654
    • /
    • 2005
  • 정보 추출은 텍스트로 되어 있는 비 정형화된 데이터로부터 정형화된 정보를 추출하는 분야이다. 기존의 정보 추출이 구문 중심의 방법인데 비해 본 논문에서는 시맨틱 웹과 온톨로지를 이용한 의미 기반의 정보 추출을 시도한다. 또한 본 논문에서는 기존의 정보 추출 모델을 분류해 보고 반자동 정보 추출이라는 새로운 모델을 제시한다. 이 모델에 기반하여 개인 정보를 자동으로 정형화 시켜주는 정보 추출 도구를 개발하고 이를 소개한다.

  • PDF

The Lines Extraction and Analysis of The Palm using Fuzzy Binarization and Fuzzy Reasoning Rule (퍼지 이진화와 퍼지 추론 기법을 이용한 손금 추출 및 분석)

  • Jang, Su-Jae;Kim, Kwang-Beak
    • Proceedings of the Korean Institute of Information and Commucation Sciences Conference
    • /
    • /
    • pp.179-182
    • /
    • 2010
  • 본 논문에서는 영상으로부터 손금을 추출하기 위해서 획득된 영상을 YCbCr 컬러 공간으로 변환한다. YCbCr 컬러 공간에서 Y:65~255, Cb:25~255, Cr:130~255에 해당되는 피부색 정보를 추출하고 이 피부색 정보를 임계치로 설정하여 손 영역을 추출한다. 추출된 손 영역에서 내부 픽셀의 3:1 이상, 전체 영상의 2:1 이상인 손의 형태학적 정보와 8 방향 윤곽선 추적 기법을 이용하여 잡음을 제거한다. 잡음이 제거된 영상에서 손금을 추출하기 위해서 스트레칭 기법과 소벨 마스크를 이용하여 에지를 추출한다. 추출된 에지 영상에서도 미세한 잡음이 존재하므로 퍼지 이진화 기법을 이용하여 효과적으로 이진화 한다. 이진화된 영상에서 손금의 형태학적 정보를 이용하여 손의 윤곽선을 제외한 손금 영역을 추출한다. 추출된 손금 영역은 동치 테이블을 이용하는 연결 영역 검색 기법과 퍼지 추론 기법을 적용하여 개별 손금의 중요선을 추출하고 분석한다. 다양한 손금 영상을 대상으로 실험한 결과, 제안된 방법이 기존의 손금 추출 방법보다 손금을 분석하는데 효율적인 것을 확인하였다.

  • PDF

Automatic Wrapper Generating Agent based on XML (XML 기반의 Wrapper 자동 생성 에이전트)

  • 서희경;양재영;정현섭;최중민
    • Proceedings of the Korean Information Science Society Conference
    • /
    • /
    • pp.48-50
    • /
    • 2000
  • 본 논문은 사용자를 대신해서 웹상의 여러 곳에 존재하는 정보를 추출하고 통합하여 사용자에게 제공하기 위한 에이전트 시스템을 설계하고자 한다. 정확한 정보 추출을 위해서는 추출하고자 하는 정보의 위치를 찾아내는 정보 추출 규칙이 요구된다. 이러한 규칙을 알아내기 위해서 본 논문에서 제안하는 시스템은 XML로 기술된 도메인 지식을 이용한다. 이 도메인 지식은 논리적 라인의 의미 분석에 사용되며, 논리적 라인의 의미를 기반으로 도메인 문서에서 추출해야 하는 정보의 패턴을 학습한다. 학습된 패턴에서 XML로 기술된 규칙을 생성하는데, 이 규칙은 Wrapper이 된다. 이렇게 생성된 규칙을 이용해서 정보를 추출하게 되며, 추출된 정보를 통합해서 사용자에게 제공하게 된다.

  • PDF

Extraction of Face and Components Using Color, Contour, and Structural Information of Face (얼굴의 색상, 윤곽선, 구조적 정보를 이용한 얼굴 및 구성요소 추출)

  • 선영범;김진태
    • Proceedings of the Korea Multimedia Society Conference
    • /
    • /
    • pp.142-145
    • /
    • 2001
  • 본 논문에서는 얼굴추출을 하는데 있어서 빠른 속도로 얼굴의 구성요소들을 분할하고 추출한다. 효율적인 분할과 추출물 위해서 3가지의 정보를 사용한다. 첫 번째는 얼굴의 색상정보로써 배경 속의 얼굴을 찾는데 이용한다. 두 번째는 얼굴의 윤곽선 정보로 얼굴의 구성요소를 추출해 내는데 사용한다. 세 번째는 얼굴의 구조적인 정보를 이용하여 색상 및 윤곽선 정보를 이용하여 추출된 요소에 대해 얼굴의 다른 구성요소를 추출하는데 이용한다.

  • PDF

Automatic Information Extraction for Structured Web Documents (구조화된 웹 문서에 대한 자동 정보추출)

  • Yun, Bo-Hyun
    • Journal of Internet Computing and Services
    • /
    • v.6 no.3
    • /
    • pp.129-145
    • /
    • 2005
  • This paper proposes the web information extraction system that extracts the pre-defined information automatically from web documents (i.e, HTML documents) and integrates the extracted information, The system recognizes entities without lables by the probabilistic based entity recognition method and extends the existing domain knowledge semiautomatically by using the extracted data, Moreover, the system extracts the sub-linked information linked to the basic page and integrates the similar results extracted from heterogeneous sources, The experimental result shows that the system extracts the sub-linked information and uses the probabilistic based entity recognition enhances the precision significantly against the system using only the domain knowledge, Moreover, the presented system can the more various information precisely due to applying the system with flexibleness according to domains, Because bath the semiautomatic domain knowledge expansion and the probabilistic based entity recognition improve the quality of the information, the system can increase the degree of user satisfaction at its maximum. Thus, this system can satisfy the intellectual curiosity of users from movie sites, performance sites, and dining room sites, We can construct various comparison shopping mall and contribute the revitalization of e-business.

  • PDF

Query Expansion based on Knowledge Extraction and Latent Dirichlet Allocation for Clinical Decision Support (의학 문서 검색을 위한 지식 추출 및 LDA 기반 질의 확장)

  • Jo, Seung-Hyeon;Lee, Kyung-Soon
    • Annual Conference on Human and Language Technology
    • /
    • /
    • pp.31-34
    • /
    • 2015
  • 본 논문에서는 임상 의사 결정 지원을 위한 UMLS와 위키피디아를 이용하여 지식 정보를 추출하고 질의 유형 정보를 이용한 LDA 기반 질의 확장 방법을 제안한다. 질의로는 해당 환자가 겪고 있는 증상들이 주어진다. UMLS와 위키피디아를 사용하여 병명과 병과 관련된 증상, 검사 방법, 치료 방법 정보를 추출한다. UMLS와 위키피디아를 사용하여 추출한 의학 정보를 이용하여 질의와 관련된 병명을 추출한다. 질의와 관련된 병명을 이용하여 추가 증상, 검사 방법, 치료 방법 정보를 확장 질의로 선택한다. 또한, LDA를 실행한 후, Word-Topic 클러스터에서 질의와 관련된 클러스터를 추출하고 Document-Topic 클러스터에서 초기 검색 결과와 관련이 높은 클러스터를 추출한다. 추출한 Word-Topic 클러스터와 Document-Topic 클러스터 중 같은 번호를 가지고 있는 클러스터를 찾는다. 그 후, Word-Topic 클러스터에서 의학 용어를 추출하여 확장 질의로 선택한다. 제안 방법의 유효성을 검증하기 위해 TREC Clinical Decision Support(CDS) 2014 테스트 컬렉션에 대해 비교 평가한다.

  • PDF

Face Region Extraction for the Facial Expression Recognition System (얼굴 표정 인식 시스템을 위한 얼굴 영역 추출)

  • Lim Ju-Hyuk;Song Kun-Woen
    • Proceedings of the Korea Information Processing Society Conference
    • /
    • /
    • pp.903-906
    • /
    • 2004
  • 본 논문에서는 얼굴 표정 인식 시스템을 위한 얼굴 영역 추출 알고리즘을 제안한다. 이는 입력 영상으로부터 얼굴 후보 영역을 추출하고, 추출된 얼굴 후보 영역에서 눈의 위치를 정확히 추출한다. 그리고 추출된 눈 영역들의 정보와 타원 방정식을 이용하여 최종 얼굴 영역을 추출한다. 얼굴 후보 영역은 HSI 칼라 좌표계에 기반한 적응적 피부색 구간 범위를 설정하여 추출하였다. 추출된 얼굴 후보 영역에서의 눈 영역 추출을 위해 밝기 정보를 이용하여 먼저 눈의 후보 화소들을 추출하고, 레이블링 과정을 통하여 영역별로 그룹화하였다. 각 후보 영역들의 화소 수, 가로세로비 및 위치 정보를 고려하여 최종 눈 영역을 추출하였다. 추출된 두 눈 영역에서 무게중심을 구하고 이를 이용하여 장축과 단축을 설정하여 타원방정식을 이용 최종 얼굴 영역을 추출하였다. 제안된 알고리즘은 조명 변화, 다양한 배경들을 가지는 얼굴 영상에서도 정확히 얼굴 영역을 추출할 수 있었다.

  • PDF

Scheme about extracting feature points by using edge information and Scale Space Filtering (에지정보와 Scale Space 필터를 이용한 특징점 추출 기법)

  • 김정학;박영태
    • Proceedings of the Korean Information Science Society Conference
    • /
    • /
    • pp.565-567
    • /
    • 2002
  • 동영상에서 특정 물체를 추적하기 위하여 여러 가지 알고리즘이 적용된다. 그 중에서 특징점을 추출하고 정합하여, 움직이고 있는 물체를 추적하는 방법을 소개한다. 특징점을 추출하는 방법 중에서 에지정보를 이용하는 방법과 직접 이미지에 접근하는 방식이 있다. 본 논문에서는 물체의 에지정보를 이용하여 특징점을 추출하는 기법을 제안한다. 널리 이용되고 있는 Canny Edge Detection(1) 알고리즘 이용, 에지를 얻게 되는데, 여기서 특징점 추출에 오류를 발생시킬 수 있는 경우에 대비하여 에지를 보정하고, 결과의 에지에서 특징 점을 추출한다. 보정된 에지정보에서 시작점, 끝점, 둘 이상의 에지가 모인 분기점과 굴곡률이 국부 최대인 지점을 찾아 특징점을 추출한다.

  • PDF

Pattern Decoding for Depth Map Acquisition System using time-varying structured lights (시변화 가시구조광 깊이 영상 획득을 위한 칼라 패턴 해석)

  • Choo, Hyon-Gon;Choi, Jinsu;Kim, Jinwoong
    • Proceedings of the Korean Society of Broadcast Engineers Conference
    • /
    • /
    • pp.244-246
    • /
    • 2011
  • 컬러 구조광을 이용한 깊이 정보 획득 시스템에서 구조광의 패턴의 색상 정보를 정확하게 추출하는 것이 중요하다. 본 논문에서는 시변화 가시구조광 시스템을 위한 색상 패턴을 해석하는 방법에 대해서 제안한다. 제안하는 방법은 시변화 가시구조광의 패턴이 투사된 영상으로부터 투사된 색상 정보를 추출하고, 추출된 색상 정보로부터 색상 패턴의 ID를 추출한다. 추출된 정보는 물체에 대한 깊이 정보로 계산될 수 있다. 패턴 ID를 빠르고 정확하게 추출하기 위해 최초의 원 패턴 정보를 기반으로 하여 Look-up 테이블을 구성하고, 이 테이블 정보를 이용하여 초기 패턴 ID 정보를 추출한다. 이후 추출된 패턴 ID에 대해서 신뢰도를 바탕으로 비어있는 정보를 채워준다. 본 논문의 실험에서는 제안하는 방법이 기존의 방법에 비해 정확하면서도 빠르게 색상 패턴 정보를 찾을 수 있음을 보여준다.

  • PDF

Effective Information Extraction Wrapper Generation and Maintenance by Using a Block-Based Graph Model (블록 단위 그래프 모델을 통한 효율적인 정보 추출 Wrapper 생성과 유지 관리)

  • Park, Ju-Young;Yang, Jae-Young;Choi, Joong-Min
    • Proceedings of the Korean Information Science Society Conference
    • /
    • /
    • pp.322-327
    • /
    • 2007
  • 기존의 정보 추출에서는 웹 문서의 구조가 변경되었을 때 Wrapper가 원하는 정보를 추출할 수 없었다. 또한 웹 문서의 구조가 바뀌는 경우 동일한 정보를 Wrapping함에도 불구하고 사용자는 정보를 추출 할 수 없었던 이유를 찾지 못하는 경우가 대부분이었다. 이 문제를 해결하기 위해 본 논문에서는 Web 페이지를 시각적 블록 단위로 잘라 인접한 블록들을 통해 그래프를 형성하여 웹 문서의 구조가 일부 변경되어도 기존의 Wrapper를 통해 정보를 추출할 수 있도록 보다 효율적으로 Wrapper를 생성하고 유지관리 하는 방법을 제안한다. 또한 웹 문서를 블록 단위로 분할하여 그래프를 생성함으로써 블록 내부에 추출하고자 하는 정보에 대한 규칙이 좀 더 유연하게 표현 될 수 있으며 문서의 구조가 아닌 추출하고자 하는 정보를 중심으로 규칙을 생성함으로써 그래프의 구조뿐 아니라 그래프를 구성하고 있는 블록 내부의 구조가 일부 변하더라도 기존의 규칙을 이용하여 정보를 추출할 수 있도록 하였다.

  • PDF