• 제목/요약/키워드: 정보 검색 패턴

검색결과 486건 처리시간 0.028초

가변 블록 DCT를 이용한 영상 검색 기법 (Image Retrieval using Variable Block Size DCT)

  • 김동우;서은주;윤태승;안재형
    • 한국멀티미디어학회논문지
    • /
    • 제4권5호
    • /
    • pp.423-429
    • /
    • 2001
  • 본 논문은 JPEG/MPEG과 같은 영상 압축에 사용되는 DCT(Discrete cosine transform)의 DC 성분으로 영상을 검색하는 방법을 개선한 기법을 제시한다. 기존의 방법은 DCT의 블록 크기를 고정한 후 DC비교로 검색한다. 이 방법은 블록 크기를 늘리면 검색 속도는 빠르지만 정보의 정확성이 떨어진다. 반대로 블록 크기를 줄이면 정보의 정확성은 높아지나 검색속도가 느려지는 단점이 있다. 이 문제를 해결하기 위해 가변블록 DCT를 제안한다. 이 기법은 우선 각 블록의 객체 영역 존재를 판단하여, 영상영역 패턴 테이블을 작성한다. 그 후 이 테이블을 이용하여 객체가 있는 영역에서 블록 크기를 줄이고, 그 밖의 영역에서는 블록 크기를 늘려 블록 크기를 가변한다. 제안한 가변 블록 DCT 영상 기법을 사용시 정확성이 15% 정도 향상되었다. 한편 동일 패턴의 영상이 거의 없는 경우에는 영상영역 패턴 비교만으로 빠르게 검색할 수 있다.

  • PDF

상황이론을 이용한 정보흐름에 대한 패턴인식을 위한 ontology 모델링 (Ontology Modeling for Pattern Recognition of Information Flow Using Situation Theory)

  • 임영문
    • 산업경영시스템학회지
    • /
    • 제28권4호
    • /
    • pp.63-68
    • /
    • 2005
  • 주어진 시스템에서 정보와 정보흐름에 대한 패턴인식을 하기 위해서는, 정보를 내포하고 있는 문맥이 내용에 따라서 다른 단어나 다른 정보를 추론하여 원래의미를 전달함에 있어 오도할 수 있기 때문에, 문맥의 분해에서 정보 조각의 묶음 형태로 전환하는 작업에서부터 연구는 시작되어야만 한다. 많은 연구자들이 정보의 저장, 재표현, 부호화, 검색 등에 관해 효과적인 방법론을 찾고자 노력해 오고 있다. 유사한 노력의 일환으로 본 논문에서는 군이론과 상황이론을 응용해서 정보 및 정보흐름의 패턴인식에 관한 새로운 모델링 기법을 제안하고자 한다. 정보처리에 관련된 선행연구와 비교해서, 본 연구에서 제안하는 방법은 수학이론인 군이론과 상황이론에서 사용되고 있는 개념과 정의를 사용하였다는 점에서 매우 새로운 접근방법이라 할 수 있다. 본 논문에서는 정보흐름의 패턴인식을 위한 모델링 기법으로 Abelian Pattern Semi-Group을 제시하는데 이러한 접근방법은 최근 중요한 연구 분야가 되고 있는 유비쿼터스 컴퓨팅 환경에서도 활용될 수 있을 것이다.

그래프 기반의 상호 중요도 측정 기법을 이용한 영역별 개체명 자동 추출 (Automatic Named Entities Extraction Using the Graph-based Measurement Technique of the Mutual Importance)

  • 배상준;고영중
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2008년도 제20회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.17-22
    • /
    • 2008
  • 본 논문에서는 영역별로 자동으로 개체명을 추출하기 위하여 씨앗단어를 이용하고, 웹페이지와 개체명 후보들 간의 상호 중요도를 측정하여 개체명 후보들의 순위를 정하는 방식을 제안한다. 제안된 방식은 크게 세 단계에 의해서 수행되어 지는데 먼저 씨앗단어 정보를 이용하여 웹페이지를 검색하고, 검색되어진 웹 페이지와 씨앗단어 정보를 이용하여 패턴 규칙을 추출한다. 추출된 패턴 규칙을 웹페이지에 적용하여 개체명 후보들을 추출하고 추출된 후보들과 웹페이지 사이의 상호 중요도를 재귀적으로 계산하여 최종적으로 개체명 후보들의 순위가 정해 진다. 한국어와 영어 개체명 영역에 제안된 기법을 적용하여 실험한 결과 한국어에서는 78.72%의 MAP를 얻을 수 있었고, 영어에서는 96.48%의 MAP를 얻었다. 특히 영어 개체명 인식에서의 성능은 구글에서 제공하고 있는 구글셋의 결과보다도 높은 성능을 보였다.

  • PDF

연관 규칙 탐사 기법을 이용한 해양 전문 검색 엔진에서의 질의어 처리에 관한 연구 (Research on User's Query Processing in Search Engine for Ocean using the Association Rules)

  • 하창승;윤병수;류길수
    • 한국컴퓨터정보학회논문지
    • /
    • 제8권2호
    • /
    • pp.8-15
    • /
    • 2003
  • 최근 여러 가지 정보들이 WWW를 경유하여 제공되고 있기 때문에 검색엔진의 필요성은 점점 커지고 있다. 그러나 대부분의 검색엔진은 정보의 추출을 위해 웹 문서와 사용자 질의를 단순 패턴비교 방법을 사용함으로써 검색엔진의 효율은 비교적 낮은 편이다. 일반적으로 사용자의 검색 목적에 따라 다른 검색 엔진이 사용되기 때문에 여러 전문검색엔진을 개발하고 있지만 대부분의 검색엔진들이 사용자의 요구를 제대로 반영하고 있지 못하다. 본 연구에서는 웹 데이터마이닝의 연관규칙을 이용하여 사용자 질의를 처리하는 해양전문검색엔진을 제안한다. 데이터 마이닝 분야에서 주로 연구되어온 연관규칙탐사 기법은 지지도와 신뢰도에 따라 연관자료의 확신도를 측정할 수 있기 때문에 웹 문서 사이의 관련성을 입증하는데 이 규칙을 적용하여 기존의 검색 방법에서 자료의 재현률과 정확률을 개선하였다.

  • PDF

행동패턴 인식기법을 이용한 지능형 감시 시스템 (Intelligent Surveillance System using an Activity Recognition Technique)

  • 박진희;이조셉;김호준
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2007년도 추계학술발표대회
    • /
    • pp.63-65
    • /
    • 2007
  • 본 연구에서는 비디오 영상데이터로부터 인간의 행동패턴의 인식기술 및 상황인식 기법을 소개하고 이를 활용한 실용적 응용으로서 지능형 감시시스템을 제안한다. 순차적 영상신호에서 형태기반의 정적 특징과 목표물의 움직임 요소를 측정한 동적 특징을 결합한 형태의 특징 표현 및 추출기법과 행동패턴 및 상황패턴에 대한 인식 모델을 제시하고 구현한다. 모듈구조의 시스템에서 영상처리 모듈과 패턴인식 모듈은 특징추출 및 인식과정을 수행하며, 감시영상에 대한 상황판단 기능은 데이터베이스 모듈과 연동하여 효과적인 검색기능과 경보기능 등을 지원한다. 이러한 기능은 기존의 시스템에서 운영자의 지속적인 감시작업과 상황판단 작업을 보조 또는 대행하여 수행할 수 있을 뿐만 아니라 데이터저장 공간을 획기적으로 줄이고 부수적으로 효율적인 영상의 조회기능 및 추적기능 등의 유용한 인터페이스를 지원한다.

접미사 패턴을 이용한 온톨러지의 구축방안 (Ontology Construction methodology with Suffix pattern)

  • 임수연;구상옥;송무희;이상조
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2003년도 가을 학술발표논문집 Vol.30 No.2 (1)
    • /
    • pp.547-549
    • /
    • 2003
  • 본 논문에서 는 특정 도메인에서 사용되는 정보들과 그들의 관계를 정의해놓은 온톨로지를 반자동으로 구축하기 위하여 특정 도메인의 코퍼스에 있는 텍스트의 분석 결과를 이용하는 방안을 제시하고자 한다. 이를 위하여, 실험 도메인 내에서 빈번히 출현하는 전문용어들을 접미사와의 결합형태에 따라 추출하고 계층구조를 설정하는 알고리즘을 제안하고 약품매뉴얼을 대상으로 실험을 행하였다. 구축된 온톨로지는 자연스런 의미군을 형성하면서 풍부한 의미정보를 포함함으로써 정보검색 등의 전문적인 지식의 접근에 유용하게 쓰일 수 있으며, 검색의 성능을 향상시키기 위한 추론의 기반으로도 이용할 수 있다.

  • PDF

디지털 콘텐츠의 URL 식별패턴 표준화에 관한 연구 (A Study on the Standardization of URL Identifier Pattern for Digital Contents)

  • 김문정;이두영
    • 한국정보관리학회:학술대회논문집
    • /
    • 한국정보관리학회 2001년도 제8회 학술대회 논문집
    • /
    • pp.265-270
    • /
    • 2001
  • 아날로그 환경에서와 마찬가지로 디지털 환경에서도 디지털 컨텐츠 하나 하나에 고유 식별기호를 부여하여야 한다. 이러한 디지털 컨텐츠를 위한 식별기호로 IETF(Internet Engineering Task Force)에서는 URI(Uniform Resource Identifier)체계 하에 인터넷 자원에 대한 접근 메카니즘을 지정하는 URL (uniform resource locator)을 사용하고 있다. 그러나 도서관의 경우 각각 다른 OPAC(Online Public Access)시스템 환경 하에서 각각 다른 URL 식별 패턴을 사용하고 있기 때문에 동일한 자원을 검색하는데 있어서 문제가 되고 있는 것이 현실이다. 이러한 문제에 착안하여 본 연구는 디지털 콘텐츠에 대한 URL 식별구문패턴의 표준화 방안을 연구하고자 한다.

  • PDF

효과적인 외래어 이형태 생성을 위한 확률 문맥 의존 치환 방법 (A Probabilistic Context Sensitive Rewriting Method for Effective Transliteration Variants Generation)

  • 이재성
    • 한국콘텐츠학회논문지
    • /
    • 제7권2호
    • /
    • pp.73-83
    • /
    • 2007
  • 완전 일치 방법을 주로 사용하는 정보 검색 시스템에서 외래어 이형태를 검색할 수 있도록 위해서는 외래어 이형태를 자동 생성하는 전처리나 질의어 확장이 필요하다. 본 연구에서는 하나의 외래어가 입력되면, 이를 근거로 실제 사용될 만한 외래어 이형태들을 효과적으로 생성하기 위한 방법을 제안한다. 혼동 자소를 단순하게 치환하는 방법은 불필요한 이형태를 과도하게 생성하므로, 본 연구에서는 실제 문서에 사용된 외래어 이형태들로부터 혼동 패턴을 학습하고, 이를 확률로 계산하여 생성 순서를 조절하였다. 특히, 혼동 패턴에서 좌우문맥을 고려하고 지역 치환 확률과 전역 치환 확률을 계산하여 조기에 많이 사용하는 이형태를 생성하도록 하였다. KT SET 2.0에서 추출한 이형태 데이터에 대해 실험한 결과, 상위 20개의 생성으로도 평균 80% 이상 찾아내어 이 방법이 매우 효과적임을 보였다.

생물학적 서열들에서 빈발한 연속 서열 패턴 마이닝 (Mining Frequent Contiguous Sequence Patterns in Biological Sequences)

  • 강태호;유재수
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2007년도 한국컴퓨터종합학술대회논문집 Vol.34 No.1 (B)
    • /
    • pp.27-31
    • /
    • 2007
  • 생물학적 서열 데이터는 크게 DNA 염기 서열과 단백질 아미노산 서열이 있다. 이들 서열은 일반적으로 많은 수의 항목들을 가지고 있어 그 길이가 매우 길다. 생물학적 데이터 서열들에는 보통 빈번하게 발생하는 부분 연속 서열들이 존재하는데 이들 서열들을 찾아내는 것은 다양한 서열 분석에서 유용하게 사용될 수 있다. 이를 위해 초기에는 Apriori 알고리즘을 기반으로 하는 순차패턴 마이닝 알고리즘들을 활용하는 방법들이 많이 제시되었다. 그중 PrefixSpan 알고리즘은 Apriori기반의 가장 효율적인 순차패턴 마이닝 기법이다. 하지만 이 알고리즘은 길이-1인 빈발 패턴들로부터 서열 패턴을 확장해나가는 방식으로 길이가 긴 연속 서열을 포함하는 생물학적 데이터 서열들에 대한 검색방법으로는 적합하지 않다. 최근에는 기존의 PrefixSpan방식을 이용하면서도 반복적인 처리과정을 줄인 MacosVSpan이 제안되었다. 하지만 이 알고리즘 또한 원본 데이터베이스보다 크기가 큰 별도의 프로젝션 데이터베이스를 사용함으로서 많은 비용부담이 발생하고 특히 길이가 긴 서열에 대해서는 더욱 효율적이지 못하다. 이에 본 논문에서 많은 양의 생물학적 데이터 서열들로부터 빈번한 연속서열을 고정길이 확장 트리를 이용하여 효과적으로 찾아내는 방법을 제안한다. 그리고 다양한 환경에서 실험을 통해 제안하는 방식이 MacosVSpan알고리즘에 비해 검색 성능이 우수함을 증명한다.

  • PDF

문장패턴을 활용한 형태소 분석기의 설계 (The Design of morphological analyzer using a sentence-patterns)

  • 홍성웅;연제용;박찬곤
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2004년도 춘계학술발표대회
    • /
    • pp.681-684
    • /
    • 2004
  • 본 논문에서는 한국어의 문장패턴을 활용한 형태소 분석기를 설계하였다. 어절기반의 형태소 분석기들이 갖는 형태소 분석 정보는 어절의 품사 등의 기초적 정보만을 포함한다. 본 논문에서 제안하는 문장패턴을 활용한 형태소 분석기는 문장단위의 형태소 분석을 제안하였고 형태소 분석단계에서 구문분석과 문장패턴이 갖는 의미정보를 포함함으로서 분석결과의 활용도를 높이도록 하였다. 제안된 형태소 분석기의 결과를 활용하여 질의 응답시스템, 정보 검색 등의 분야에서 구문분석, 의미분석의 단계를 최소화 하여 결과를 얻을 수 있을 것으로 기대한다.

  • PDF