• Title/Summary/Keyword: 자동정보 추출

Search Result 1,995, Processing Time 0.035 seconds

Extraction of Informative Features for Automatic Indexation of Human Sensibility Ergonomic Documents (감성공학 문서 데이터의 지표 자동화를 위한 코퍼스 분석 기반 특성정보 추출)

  • 배희숙;곽현민;채균식;이상태
    • Science of Emotion and Sensibility
    • /
    • v.7 no.2
    • /
    • pp.133-140
    • /
    • 2004
  • A large number of indices are produced from human sensibility ergonomic data, which are accumulated by the project "Study on the Development of Web-Based Database System of Human Sensibility and its Support". Since the research in this field will be increased rapidly, it is necessary to automate the index processing of human sensibility ergonomic data. From the similarity between indexation and summarization, we propose the automation of this process. In this paper, we study on extraction of keywords, information types and expression features that are considered as basic elements of following techniques for automatic summarization: classification of documents, extraction of information types and linguistic features. This study can be applied to automatic summarization system and knowledge management system in the domain of human sensibility ergonomics.rgonomics.

  • PDF

Automatic Background Keyword of Movie Extraction Method from Media Reviews (미디어 리뷰를 이용한 영화 배경 키워드 자동 추출 기법)

  • Kim, Hyung W.;Cho, Joonmyun;Yoo, Jeongju
    • Annual Conference of KIPS
    • /
    • 2013.11a
    • /
    • pp.1149-1151
    • /
    • 2013
  • 본 연구는 영화 콘텐츠의 배경(공간적/시간적)에 해당하는 키워드를 자동으로 추출하는 기법을 제안한다. 제안된 기법은 영화 콘텐츠들의 리뷰 텍스트 데이터를 웹 상으로부터 수집하는 과정, 수집된 텍스트 리뷰 데이터의 전처리 과정에 해당하는 형태소 분석 및 개체명인식 과정, 마지막으로 통계적 기법을 이용하여 최종적으로 배경에 해당하는 단어를 선택하는 과정으로 이루어진다. 자동으로 추출된 배경 정보는 사용자 평가를 통하여 정확도를 측정하였으며, 자동 생성된 배경 정보를 이용하여 영화 콘텐츠의 검색 및 추천 등에 다양하게 사용될 수 있을 것으로 예상된다.

Developing Operator and Algorithm for Road Automated Recognition (도로 자동인식을 위한 연산자 및 알고리즘 개발)

  • Lim, In-Seop;Choi, Seok-Keun;Lee, Jae-Kee
    • Journal of Korean Society for Geospatial Information Science
    • /
    • v.10 no.3 s.21
    • /
    • pp.41-51
    • /
    • 2002
  • Recently, many studies extracting the geography information using digital aerial image have been implemented. But it is very difficult that automatically recognizing objects using edge detection method on the aerial image, and so that work have practiced manually or semi-automatically. Therefore, in this study, we have removed impedimental elements for recognition using the image which overlapped the significant information bands of brightness-sliced aerial images, then have developed the algorithm which can automatically recognize and extract road information and we will try to apply that method when we develope a system. For this, first of all, we have developed the 'template conformal-transformation moving operator' for automatically recognizing crosswalk area from crosswalk band image and the 'window normal search algorithm' which is able to track road area based on long-side length of crosswalk, so that we have proposed the method that can extract directly the road information from the aerial image.

  • PDF

Automatic Classification of Web Documents Using Concept-Based Keyword Information (개념 기반 키워드 정보를 이용한 웹 문서의 자동 분류)

  • 박사준;김기태
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 2003.10a
    • /
    • pp.151-153
    • /
    • 2003
  • 본 연구에서는 웹 문서를 분류하기 위해서 분류하고자 하는 영역(category)에 대한 개념 지식을 이용한다. 먼저, 영역별 개념 지식을 기구축된 웹 문서의 집합으로부터 제목과 하이퍼링크에 기반한 앵커 텍스트를 이용하여 개념을 보유한 키워드를 추출한다. 추출된 키워드를 형태소 분석을 통해 색인어로 추출한다. 추출된 색인어에 대해 TFIDF를 확장한 영역 적용 색인 가중치 TFIDFc를 적용하여 영역별 개념 기반 색인어와 색인를 구축한다. 색인은 TFIDF를 영역별로 확장하여 구축한다. 구축된 영역별 개념 기반 색인을 이용하여 새로운 웹 문서에 대해서 어떤 영역에 해당하는 가를 결정하는 자동 분류 알고리즘을 수행한다. 자동 분류 알고리즘에 의해 수행된 문서는 영역별로 정리되며, 또한, 분류된 웹 문서의 색인어는 새로운 개념 기반 키워드로 추출되어 개념 기반 영역 지식을 구축한다.

  • PDF

Automatic Speechreading Feature Detection Using Color Information (색상 정보를 이용한 자동 독화 특징 추출)

  • Lee, Kyong-Ho;Yang, Ryong;Rhee, Sang-Burm
    • Journal of the Korea Society of Computer and Information
    • /
    • v.13 no.6
    • /
    • pp.107-115
    • /
    • 2008
  • Face feature detection plays an important role in application such as automatic speechreading, human computer interface, face recognition, and face image database management. We proposed a automatic speechreading feature detection algorithm for color image using color information. Face feature pixels is represented for various value because of the luminance and chrominance in various color space. Face features are detected by amplifying, reducing the value and make a comparison between the represented image. The eye and nose position, inner boundary of lips and the outer line of the tooth is detected and show very encouraging result.

  • PDF

ISA Relation Extraction from Wikipedia Category Structure (위키피디아 카테고리 구조를 이용한 상하위 관계 추출)

  • Choi, DongHyun;Choi, Key-Sun
    • Annual Conference on Human and Language Technology
    • /
    • 2009.10a
    • /
    • pp.1-5
    • /
    • 2009
  • 상하위 관계 자동 추출은 분류체계를 자동 구축하는 데 있어서 핵심적인 내용이며, 이렇게 자동으로 구축된 분류 체계는 정보 추출과 같은 여러 가지 분야에 있어서 중요하게 사용된다. 본 논문에서는 위키피디아 카테고리 구조로부터 상하위 관계를 추출하는 방식에 대하여 제안한다. 본 논문에서는 판별하고자하는 위키피디아 카테고리 구조뿐만이 아닌, 그와 관련된 다른 위키피디아 카테고리 구조까지 고려하여 카테고리 이름에 나타난 토큰들간의 수식 그래프를 구축한 후, 그래프 분석 알고리즘을 통하여 각 카테고리 구조가 상하위 관계일 가능성에 대한 점수를 매긴다. 실험 결과, 본 알고리즘은 기존의 연구로 상하위 관계임을 판별할 수 없었던 일부 카테고리 구조에 대하여 성공적으로 상하위 관계인지를 판별하였다.

  • PDF

Metadata based digital broadcasting with TV-Anytime specification (사용자 패턴의 자동추출을 통한 TV-Anytime 기반 사용자 선호정보 관리 시스템)

  • Shin, Sa-Im;Lee, Jong-Soel;Lee, Soek-Pll
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 2006.10b
    • /
    • pp.34-37
    • /
    • 2006
  • 디지털 방송에서의 맞춤형 서비스란 사용자가 원하는 방송 프로그램만을 사용자가 원하는 시간에 볼 수 있게 해 두는 서비스를 말한다. 본 연구는 맞춤형 방송 서비스를 위한 사용자 별 선호정보를 자동으로 추출하여 관리하는 사용자 선호정보 관리 시스템을 개발하였다. 이 시스템은 맞춤형 방송 서비스를 위한 표준인 TV-Anytime에서 제안하고 있는 메타데이터를 기반으로 사용자 선호정보와 사용자 히스토리 정보를 사용하여 맞춤형 방송 서비스를 위한 선호 프로그램과 채널을 예상하여 사용자에게 제시한다. 이 과정에서 사용하는 사용자 선호정보는 사용자 별로 청취 과정에서 채널, 시간대, 방송에 따른 반응 행동기록을 토대로 자동으로 추출하고 업데이트하는 방법을 제안한다.

  • PDF

Automatic Reporting System through ID Number Recognition at ID Card Image (주민등록증 이미지의 숫자 인식을 통한 보고서 자동 기입 시스템)

  • Lea, Jong-Ho
    • Annual Conference on Human and Language Technology
    • /
    • 2002.10e
    • /
    • pp.57-61
    • /
    • 2002
  • 대부분의 공문서들이 주민등록증에 기입된 정보들을 반복적으로 기입하도록 요구하는 경우가 많다. 자동으로 주민 정보들을 기입하기 위해서 기계적으로 해독 가능한 정보로는 현재 주민등록증의 이미지만이 가능하다. 본 연구에서는 주민등록증을 스캐닝해서 얻은 이미지에서 주민번호를 추출하여, 개인신용정보의 조회나 반복적인 서류 작성에 개인정보들이 자동으로 기입되는 시스템을 개발하였다. 주민증의 이미지에는 사진과 위조 방지 문양, 그리고 성명, 주소, 주민번호 등의 문자 정보들이 들어있는데, 이 중에서 주민번호 숫자만 추출하였다. 이렇게 인식된 주민번호를 이용해서, 전산화가 되어 있는 주민 정보와의 대조를 할 수 있게 하였고, 개인 정보들을 XML로 정리하여 각종 문서 양식에 자동으로 기입될 수 있도록 하였다. 위조방지문양과 스캐너의 잡음 등에 기인한 왜곡을 해소하기 위해, 히스토그램 기법을 이용하여 숫자영역을 분리하고, 이진화한 다음, 특징점(끝점, 교차점, 분기점)의 정보와 ART1를 사용하여 숫자들을 분류하였다.

  • PDF

Automatic Generation of Information Extraction Rules Through User-interface Agents (사용자 인터페이스 에이전트를 통한 정보추출 규칙의 자동 생성)

  • 김용기;양재영;최중민
    • Journal of KIISE:Software and Applications
    • /
    • v.31 no.4
    • /
    • pp.447-456
    • /
    • 2004
  • Information extraction is a process of recognizing and fetching particular information fragments from a document. In order to extract information uniformly from many heterogeneous information sources, it is necessary to produce information extraction rules called a wrapper for each source. Previous methods of information extraction can be categorized into manual wrapper generation and automatic wrapper generation. In the manual method, since the wrapper is manually generated by a human expert who analyzes documents and writes rules, the precision of the wrapper is very high whereas it reveals problems in scalability and efficiency In the automatic method, the agent program analyzes a set of example documents and produces a wrapper through learning. Although it is very scalable, this method has difficulty in generating correct rules per se, and also the generated rules are sometimes unreliable. This paper tries to combine both manual and automatic methods by proposing a new method of learning information extraction rules. We adopt the scheme of supervised learning in which a user-interface agent is designed to get information from the user regarding what to extract from a document, and eventually XML-based information extraction rules are generated through learning according to these inputs. The interface agent is used not only to generate new extraction rules but also to modify and extend existing ones to enhance the precision and the recall measures of the extraction system. We have done a series of experiments to test the system, and the results are very promising. We hope that our system can be applied to practical systems such as information-mediator agents.

Automatic People Position Information Extraction for IT-People Event Ontology (온톨로지 인스턴스 생성을 위한 인물의 직위 정보 자동 추출)

  • Park, Yun-Hee;Lee, Young-Hwa;Lee, Sang-Jo
    • Annual Conference on Human and Language Technology
    • /
    • 2007.10a
    • /
    • pp.183-188
    • /
    • 2007
  • 온톨로지란 프로그램과 인간이 지식을 공유하는데 도움을 주기 위해 사용된 개념적 명세서로써 지식을 정형화하는 방법을 제시하여 추론의 기반을 제공하여 준다. 온톨로지 구축에 관한 기존 연구들은 스키마의 모델링에 초점을 두었다. 그러나 자료가 대용량화 됨에 따라 인스턴스를 자동으로 추출하는 기술은 온톨로지 구축에 꼭 필요하다. 이에 본 논문에서는 문서에서 인물의 직위 정보를 자동으로 추출하였으며, 문서 내에서 인물 상호 참조 처리를 통해 인물의 축약 명칭을 복원하였다. 또한 구 단위에서의 실패한 변동된 직위 정보는 중심 술어를 대상으로 격틀 정보를 완성해 나감으로써 확장한 결과 정확률 97.6%를 얻었다.

  • PDF