• Title/Summary/Keyword: 학술 논문 데이터베이스

Search Result 2,661, Processing Time 0.028 seconds

Illumination Invariant Image Retrieval using Eigenvector Analysis (고유벡터 분석을 이용한 조명 불변 영상 검색)

  • 김용훈;이태홍
    • Proceedings of the IEEK Conference
    • /
    • 2001.09a
    • /
    • pp.903-906
    • /
    • 2001
  • 본 논문에서는 조명의 변화에 의해 컬러 영상의 컬러 성분이 달라지더라도 영상 내 컬러간의 편차값을 나타내는 공분산 행렬(covariance matrix)의 고유벡터(eigenvector)와 영상 내 화소들의 컬러 성분과의 상관관계는 거의 변화하지 않는 특징을 이용한 조명 변화에 강인한 영상 검색 방법을 제안한다. 제안된 방법은 영상에서 컬러 성분들의 공분산 행렬과 공분산 행렬의 고유치(eigenvalue), 고유벡터를 계산한 후, 가장 큰 고유치에 관계된 고유벡터로 화소를 투영시키고, 투영된 벡터의 크기 성분으로 영상을 재구성한다. 재구성된 영상으로부터 7개의 불변 모멘트(moment)를 계산하고, 공분산의 가장 큰 고유치를 가중치로 부과하여 특징벡터를 추출한다. 7개의 불변 모멘트로부터 구한 특징벡터는 영상 내 물체의 이동, 영상의 회전, 크기 변화뿐만 아니라, 조명의 변화에 의해 컬러가 변화할 경우에도 유사한 영상을 잘 검색한다. 제안된 방법의 성능 확인을 위하여 5가지 조명에서 얻은 영상 데이터베이스를 이용하여 실험하였으며, 실험 결과 히스토그램 인터섹션에 비해 적은 특징량으로 검색이 가능하면서 조명 변화에도 대응할 수 있는 검색 결과를 얻을 수 있었다.

  • PDF

Implementation of Automatic Microphone Volume Controller and Recognition Rate Improvement (자동 입력레벨 조절기의 구현 및 인식 성능 향상)

  • 김상진;한민수
    • Proceedings of the IEEK Conference
    • /
    • 2001.09a
    • /
    • pp.503-506
    • /
    • 2001
  • In this paper, we describe the implementation of a microphone input level control algorithm and the speech improvement with this level controller in personal computer environment. The volume of speech obtained through a microphone affects the speech recognition rate directly. Therefore, proper input volume level control is desired fur better recognition. We considered some conditions for the successful volume controller implementation firstly, then checked its usefulness on our speech recognition system with common office environment speech database. Cepstral mean subtraction is also utilized far the channel-effect compensation of the database. Our implemented controller achieved approximately 50% reduction, i.e., improvement in speech recognition error rate.

  • PDF

Implementation of PDF417 2-dimensional Barcode Decoder (PDF417 이차원 바코드 디코딩 알고리즘의 구현)

  • 정정구;한희일
    • Proceedings of the IEEK Conference
    • /
    • 2001.09a
    • /
    • pp.289-292
    • /
    • 2001
  • 종래에 사용되어 왔던 1차원 바코드가 정보를 포함하고 있는 데이터베이스에 접근하는 데이터 키 역할을 주로 해온 것에 비해, 2차원 바코드는 다량의 데이터를 포함할 수 있고 고밀도의 데이터 표현이 가능하여, 호스트 컴퓨터의 데이터 베이스에 온라인 연결할 필요없이 확인하고자 하는 사람이나 대상물에 대한 정보를 얻을 수 있다. 본 논문에서는 가장 널리 사용되는 2차원 바코드 체계인 PDF417 을 중심으로 디지털 카메라를 통하여 입력한 영상을 이진화하여 시작 심볼 또는 정지 심볼을 검색함으로써 2차원 바코드 영역을 추출한 다음, 추출된 영역으로부터 바코드의 행과 열의 수, 오류수정 정도 등의 헤더정보를 검출하고 이를 바탕으로 코드워드를 추출하는 알고리즘을 제안한다. 얻어진 코드워드는 데이터를 효율적으로 저장하기위해 정보가 숫자인지, ASCII코드인지 혹은 바이트 정보인지에 따라 다른 방식으로 인코딩 되어 있는데, 그에 따른 디코딩 알고리즘을 제안한다.

  • PDF

Character image database retrieval using MPEG-7 Color Descriptors (MPEG-7 컬러 기술자를 활용한 캐릭터 이미지 데이터베이스 검색)

  • 유광석;김회율
    • Proceedings of the IEEK Conference
    • /
    • 2001.09a
    • /
    • pp.641-644
    • /
    • 2001
  • 멀티미디어 검색을 위한 MPEG-7 표준화 작업이 완료되어감에 따라, 멀티미디어 특징 기술자를 활용한 다양한 응용들이 나타나고 있다. 본 논문에서는 미키 마우스, 포켓 몬스터 또는 호돌이와 같은 지적 재산 정보인 동시에 고부가가치 대상인 캐릭터 이미지를 대상으로 하여, 캐릭터 이미지 특징을 분석하고, MPEG-7 에서 정의된 컬러 기술들간의 검색 효율을 비교하여, 캐릭터 이미지에 가장 적합한 기술자를 제안한다. 캐릭터 이미지는 자연 이미지와는 달리, 질감(Texture)이나 모양 (Shape)정보에 비해, 주로 컬러 정보에 의존하며,존재하는 컬러의 수가 3-6 개 범위 내에 주로 존재하고, 컬러의 분포가 고르며, 질감 성분이 많지 않은 특징을 갖고 있다. MPEG-7 에 정의된 Dominant Color, Scalable Color, Color Layout 및 Color Structure 4 종류의 기술자를 캐릭터 이미지 특징에 맞는 기술자를 유형별로 분류된 3,834개의 이미지 셋에 적용하여, 검색 성능 평가 지수인 ANMRR(Average Normalized Modified Retrieval Rank) 를 측정하여 가장 효율적인 기술자를 정의한다.

  • PDF

Fisherface 알고리즘과 Elastic Graph Matching을 이용한 얼굴 인식

  • 이형지;이완수;정재호
    • Proceedings of the IEEK Conference
    • /
    • 2000.09a
    • /
    • pp.869-872
    • /
    • 2000
  • 본 논문에서는 K-L 변환을 기반으로 한 Fisherface 알고리즘과 Elastic Graph Matching 방법을 사용하여 보다 효율적인 얼굴 인식 방법을 제안하고자 한다. 즉, 얼굴의 모양 정보뿐만 아니라, 영상 픽셀의 그레이 정보를 동시에 이용할 수 있는 Elastic Graph Matching 방법과 통계학적으로 신호의 차원을 줄일 뿐만 아니라 주위 환경의 변화에 강인한 Fisherface 알고리즘을 효율적으로 결합하고자 한다 본 연구에서는 얼굴을 인식하는 데에 있어서 주로 문제가 되는 광원의 위치에 따른 조도의 변화, 얼굴 표정 변화, 안경 착용 여부 등을 고려한 Yale대학 데이터베이스에 대해 기존의 여러 얼굴 인식알고리즘을 실험 및 비교하였다. 또한, 이들을 효율적으로 결합할 수 있는 인식 알고리즘을 제안함으로써 인식률 및 속도 면에서 비교적 만족할 만한 결과를 얻을 수 있었다.

  • PDF

A Study on the Acoustic Modeling of the Emotional Speech (감정 음성의 음향학적 모델링에 관한 연구)

  • 천희진;이양희
    • Proceedings of the IEEK Conference
    • /
    • 2000.09a
    • /
    • pp.815-818
    • /
    • 2000
  • 본 논문에서는 감정 표현 음성 합성 시스템을 구현하기 위해서, 감정 음성 데이터베이스의 음향학적 특징인 피치, 에너지, 지속시간, 스펙트럼 포락에 대해 분석한 결과와 문법적 요소인 품사에 따른 감정 음성 데이터의 피치 변화를 분석하였다. 분석 결과, 기본 주파수, 에너지, 지속시간, 스펙트럼 포락은 감정 표현에 중요한 영향을 미치는 것으로 나타났으며, 전반적으로 화남과 기쁨의 감정이 평상과 슬픔의 감정 보다 피치 및 에너지의 변화가 크게 나타났으며, 특히 기쁜 감정의 경우 부사, 관형사, 연결어미, 조사, 접미사에서 피치 변화가 많았으며, 화난 감정의 경우, 관형사, 명사, 용언, 접미사에서 피치 변화가 높게 나타났다. 이러한 분석 결과를 적용해 감정 음성을 합성하기 위하여, 평상 음성에 각 감정 음성의 운율 요소를 적용하여 감정 음성을 합성하여 평가한 결과, 기쁜 감정은 기본 주파수의 변화에 의해 86.7%, 화난 감정은 에너지의 변화에 의해 91%, 슬픈 감정은 음절지속시간의 변화에 의해 76.7%가 각각 올바른 감정으로 인지되었다.

  • PDF

A Study on the Segmentation and Labeling of telephone-based Speech (전화 음성의 Segmentation 및 Labeling에 관한 연구)

  • 어범석;최갑근;김학진;김순협
    • Proceedings of the IEEK Conference
    • /
    • 2000.09a
    • /
    • pp.803-806
    • /
    • 2000
  • 상용 가능한 대규모 음성인식 시스템의 개발을 위해서는 음성 데이터베이스 구축이 중요한 과제의 하나로써, 많은 시간과 노력이 요구되며 특히 세그멘테이션과 라벨링은 그 노력의 상당부분이 된다. 본 논문은 ARS 주식 거래 시스템에서 사용되는 대용량 음성 DB의 효과적 구축을 위해 세그멘테이션 및 라벨링의 자동화에 대한 연구를 하였다. 본 연구를 위해 20대 성인 남녀를 대상으로 증권거래와 관련한 15개의 문장을 발성하도록 하였으며 Dialogic사의 D/41ESC보드를 장착하고, Window NT4.0 플렛폼에서 음성을 수집하였다. 또한 자동 Segmentation과 labeling은 Aligner를 사용하였으며 수동과 비교하기 위해 CSLU speech Tool Kit을 사용하였고 수작업은 숙련도가 있는 전문가가 하도록 하였다.

  • PDF

방사성폐기물 통합관리 시스템의 구축과 활용

  • 이영희;조한석;손종식
    • Proceedings of the Korean Radioactive Waste Society Conference
    • /
    • 2004.06a
    • /
    • pp.241-241
    • /
    • 2004
  • 한국원자력연구소에서 발생되는 방사성폐기물은 다양한 형태, 다양한 핵종으로 구성되며 소량씩 불규칙한 시기에 발생하는 특성을 갖는다. 이러한 폐기물의 효율적인 관리와 처리를 위하여 체계적인 이력관리와 신속한 통계를 도출할 수 있는 데이터베이스 시스템 구축이 선행과제로 대두되었다. 이에 방사성폐기물 통합관리 시스템(Radioactive Waste Management Integration System ; RAWMIS)을 구축하였으며, 이 시스템은 방사성폐기물의 발생부터 수집, 이동, 처리, 저장 등 처분까지의 이력을 관리하고, 서류간소화 및 인적자원 절약 등의 관리효율성을 제고하여 구현되었다. 또한, 한국원자력안전기술원에서 추진하는 국가적 방사성폐기물 통합 안전관리 체계(Waste Comprehensive Information Database : WACID)와 연계를 할 수 있도록 연구개발의 착수 단계에서부터 공동으로 진행하였다. 본 논문에서는 구축된 시스템의 구현사항과 실제 방사성폐기물 관리에 활용하는 사항을 제시한다. 본 연구를 통하여 구축된 시스템은 방사성폐기물 발생기관의 관리와 처리에 있어서 투명성과 효율을 증가시키고, 정확하고 신속한 정보를 도출할 수 있으며, 방사성폐기물의 관리와 처리공정의 데이터를 확보하여 방사성폐기물 처리 분야 연구의 토대를 제공할 수 있다.

  • PDF

Handwritten Hangul Recognition using Extended Hierarchical Random Graph (확장된 계층적 랜덤 그래프를 이용한 필기 한글 인식)

  • Kim, Ho-Yon;Kim, Jin-Hyung
    • Annual Conference on Human and Language Technology
    • /
    • 1997.10a
    • /
    • pp.200-207
    • /
    • 1997
  • 본 논문에서는 계층적 랜덤 그래프를 이용한 필기 한글 인식 방법론을 제안한다. 한글은 다른 문자와 달리 기본 자소의 조합으로 이루어진 문자로서 2차원 평면상에 표현된다. 이러한 한글의 특성과 필기된 한글에서 나타나는 다양한 변형을 통계적으로 모델링하기 위해서 계층 그래프를 이용하였다. 특히, 계층 그래프의 최 하위 계층에서는 필기된 획의 변형을 흡수할 수 있도록 확장된 랜덤 그래프를 적용하였다. 제안된 모델은 통계적 모델이기 때문에 필기 데이터베이스로부터 모델의 파라미터를 구할 수 있다는 장점이 있다. 실험에서 제안된 모델을 필기 한글 인식 문제에 적용하여 자소간 접촉된 문자나 어느 정도의 흘려 쓴 문자도 잘 인식할 수 있음을 보였다.

  • PDF

Dynamic Facial Expression of Fuzzy Modeling Using Probability of Emotion (감정확률을 이용한 동적 얼굴표정의 퍼지 모델링)

  • Gang, Hyo-Seok;Baek, Jae-Ho;Kim, Eun-Tae;Park, Min-Yong
    • Proceedings of the Korean Institute of Intelligent Systems Conference
    • /
    • 2007.04a
    • /
    • pp.401-404
    • /
    • 2007
  • 본 논문은 거울 투영을 이용하여 2D의 감정인식 데이터베이스를 3D에 적용 가능하다는 것을 증명한다. 또한, 감정 확률을 이용하여 퍼지 모델링을 기반으로한 얼굴표정을 생성하고, 표정을 움직이는 3가지 기본 움직임에 대한 퍼지이론을 적용하여 얼굴표현함수를 제안한다. 제안된 방법은 거울 투영을 통한 다중 이미지를 이용하여 2D에서 사용되는 감정인식에 대한 특징벡터를 3D에 적용한다. 이로 인해, 2D의 모델링 대상이 되는 실제 모델의 기본감정에 대한 비선형적인 얼굴표정을 퍼지를 기반으로 모델링한다. 그리고 얼굴표정을 표현하는데 기본 감정 6가지인 행복, 슬픔, 혐오, 화남, 놀람, 무서움으로 표현되며 기본 감정의 확률에 대해서 각 감정의 평균값을 사용하고, 6가지 감정 확률을 이용하여 동적 얼굴표정을 생성한다. 제안된 방법을 3D 인간형 아바타에 적용하여 실제 모델의 표정 벡터와 비교 분석한다.

  • PDF