Search | Korea Science

Building Database using Character Recognition Technology (문자 인식 기술을 이용한 데이터베이스 구축)

Han, Seon-Hwa;Lee, Chung-Sik;Lee, Jun-Ho;Kim, Jin-Hyeong
- The Transactions of the Korea Information Processing Society
- /
- v.6 no.7
- /
- pp.1713-1723
- /
- 1999
Optical character recognition(OCR) might be the most plausible method in building database out of printed matters. This paper describes the points to be considered when one selects an OCR system in order to build database. Based on the considerations, we evaluated four commercial OCR systems, and chose one which shows the best recognition rate to build OCT-text database. The subject text, the KT-test collection, is a set of abstracts from proceedings of different printing quality, fonts, and formats. KT-test collection is also provided with typed text database. Recognition rate was calculated by comparing the recognition result with the typed text. No preprocessing such as learning and slant correction was applied to the recognition process in order to simulate a practical environment. The result shows 90.5% of character recognition rate over 970 abstracts. This recognition rate is still insufficient for practical use. The errors in OCR texts are different from those of manually typed texts. In this paper, we classify the errors in OCR texts for the further research.
PDF

Wavelet-Based FLD for Face Recognition (웨이블렛에 기반한 FLD를 사용한 얼굴인식)

이완수;이형지;정재호
- Proceedings of the IEEK Conference
- /
- 2000.09a
- /
- pp.435-438
- /
- 2000
본 논문에서는 웨이블렛에 기반한 FLD(Fisher Linear Discriminant) 방법을 제안한다. 본 논문은 얼굴인식에 대한 속도와 정확성을 다룬다. 128×128의 해상도를 가진 영상은 웨이블렛 변환을 통해 16×16의 부영상들로 분해된 후에, 저대역과 중대역에 해당하는 두 개의 부영상을 사용하여 학습과 인식을 한다. 실험 결과, 제안된 방법은 기존의 FLD 방법의 인식률을 유지하며, 보다 더 빠른 속도를 가진다. 우리의 실험에서는 약 6배의 속도 향상을 보인다.
PDF

Off-line Handwritten Digit Recognition Using Combination of stroke direction codes (획의 방향 코드 조합에 의한 오프라인 필기체 숫자 인식)

이찬희;이상훈;장수미;정순호
- Proceedings of the Korean Information Science Society Conference
- /
- 2002.04b
- /
- pp.610-612
- /
- 2002
본 논문은 오프라인 필기체 숫자 인식을 위하여 SOG* 세선화와 방향 코드 생성만으로 전처리를 단순화하여 효율을 높이는 새로운 방법을 제안한다. 본 실험의 객관적 검증을 위해 Concordia 대학교 등의 여러기관의 필기체 숫자 데이터베이스에 대하여 실험한 결과 98.85% 이상의 인식률을 나타내어 단순한 전처리로 높은 인식률을 얻음으로써 효율성이 높음을 알 수 있다.
PDF

Preprocessing technology on DNA genotyping for personal verification (개인인식을 위한 DNA Genotyping의 전처리 기법)

임효빈;오옥균;공은배
- Proceedings of the Korean Information Science Society Conference
- /
- 2004.04b
- /
- pp.586-588
- /
- 2004
최근 DNA 관련 기술의 개발이 활발하게 이루어지고 있고, 그에 따라 DNA를 개인인식에 사용마고자 하는 시도가 실시간 이용가능성이 높은 DNA 칩 기술과 합쳐져 매우 중요한 이슈로 떠오르고 있다. DNA를 분석하기 위해서는 생물학적 실험이 필수적으로 따르게 되는데 이러한 실험 결과를 인식에 적용하기 위해서는 적절한 전처리가 필요하다. 본 논문에서는 여러 장점들로 인해 최근 DNA분석 기술로 주목받고 있는 모세관 전기영동법을 사용하여 DNA를 분석하고, 그 분석물을 개인인식을 위해 genotyping하는 과정에서 전처리가 요구되는 각 경우들에 대해 논하고 적절한 필터링 기법들을 제시한다.
PDF

HMM-based Speech Recognition using FSVQ and Fuzzy Concept (FSVQ와 퍼지 개념을 이용한 HMM에 기초를 둔 음성 인식)

안태옥
- Journal of the Institute of Electronics Engineers of Korea SP
- /
- v.40 no.6
- /
- pp.90-97
- /
- 2003
This paper proposes a speech recognition based on HMM(Hidden Markov Model) using FSVQ(First Section Vector Quantization) and fuzzy concept. In the proposed paper, we generate codebook of First Section, and then obtain multi-observation sequences by order of large propabilistic values based on fuzzy rule from the codebook of the first section. Thereafter, this observation sequences of first section from codebooks is trained and in case of recognition, a word that has the most highest probability of first section is selected as a recognized word by same concept. Train station names are selected as the target recognition vocabulary and LPC cepstrum coefficients are used as the feature parameters. Besides the speech recognition experiments of proposed method, we experiment the other methods under same conditions and data. Through the experiment results, it is proved that the proposed method based on HMM using FSVQ and fuzzy concept is superior to tile others in recognition rate.
PDF KSCI

Korean Phonological Viseme for Lip Synch Based on Phoneme Recognition (음소인식 기반의 립싱크 구현을 위한 한국어 음운학적 Viseme의 제안)

Joo Heeyeol;Kang Sunmee;Ko Hanseok
- Proceedings of the Acoustical Society of Korea Conference
- /
- spring
- /
- pp.70-73
- /
- 1999
본 논문에서는 한국어에 대한 실시간 음소 인식을 통한 Lip Synch 구현에 필수요소인 Viseme(Visual Phoneme)을 한국어의 음운학적 접근 방법을 통해 제시하고, Lip Synch에서 입술의 모양에 결정적인 영향을 미치는 모음에 대한 모음 인식 실험 및 결과 분석을 한다.모음인식 실험에서는 한국어 음소 51개 각각에 대해 3개의 State로 이루어진 CHMM (Continilous Hidden Makov Model)으로 모델링하고, 각각의 음소가 병렬로 연결되어진 음소네트워크를 사용한다. 입력된 음성은 12차 MFCC로 특징을 추출하고, Viterbi 알고리즘을 인식 알고리즘으로 사용했으며, 인식과정에서 Bigrim 문법과 유사한 구조의 음소배열 규칙을 사용해서 인식률과 인식 속도를 향상시켰다.
PDF

A study on Image Recognition based on the Characteristics of Retinal Cells (망막 세포 특성에 의한 영상인식에 관한 연구)

Cho, Jae-Hyun;Kim, Do-Hyeon;Kim, Kwang-Baek
- Proceedings of the Korean Institute of Information and Commucation Sciences Conference
- /
- 2007.10a
- /
- pp.393-397
- /
- 2007
최근 시각 장애인을 위한 인공망막 모델 구현에 관한 연구 중 시피질 자극기 기술은 시각 자극 전달의 중간 단계를 생략하고 직접 뇌세포를 자극하는 것이다. 본 논문에서는 망막에서 시각 피질로 시각정보를 전달할 때 발생하는 시각 피질의 특성, 즉 방향성에 대한 반응 특성을 특징 데이터로 구성하여 인식함으로써 인간 시각 정보 처리와 유사한 영상 추출 및 인식 모델을 제안한다. 제안된 방법은 영상의 특징을 추출 한 후 Delta-bar-delta 기반 오류 역전파 알고리즘을 적용하여 영상의 특징들을 인식한다. 제시된 방법의 성능을 분석하기 위하여 다양한 숫자 패턴들을 대상으로 실험한 결과, 제안된 망막 세포로부터 전달된 정보를 방향성에 대한 민감성을 고려하여 영상의 특성을 추출하여 인식하는 모델이 기존의 영상 추출 및 인식 모델보다 인식률에 있어서는 별 차이가 없지만 다양한 실험에서 확인할 수 있듯이 인간 시각과 같이 인식 성능이 민감하지 않는 것을 알 수 있었다.
PDF

Face Recognition Using View-based EigenSpaces (시점 기반 고유공간을 이용한 얼굴 인식)

김일정;차의영
- Proceedings of the Korean Information Science Society Conference
- /
- 1998.10c
- /
- pp.458-460
- /
- 1998
본 논문은 주성분 분석으로 시점 기반 고유얼굴(view-based eigenface)을 생성하고, 그에 기반한 얼굴 인식을 수행하고자 한다. 주성분 분석을 통한 고유얼굴 생성은 얼굴 인식의 어려운 문제 중 하나인 특징 선택과 추출이라는 문제를 해결해 준다. 또한 얼굴 표정이나 방향의 변화에도 인식률이 저하되는 것을 방지할 수 있다. 얼굴 영상을 특징공간(고유공간)으로 변환할 때, 원 얼굴영상의 정보를 최대한으로 나타낼 수 있는 최적의 고유치 개수 선택은 얼굴 데이터베이스의 크기와 인식 속도에 영향을 끼친다. 따라서 본 논문에서는 고유치 개수를 고유치의 누적기여율을 이용해서 구한다. 이는 64$\times$64(=4096)차원의 원 얼굴 영상을 5~7차원으로 표현 가능하게 하였다. 그리고, 각 얼굴 방향에 따라 특징공간을 분리해서 생성함으로써 얼굴 방향의 변화에 따라 오인식률을 줄였다. 축소된 차원과 분리된 특징공간은 메모리 사용과 인식속도의 향상에 기여한다. 본 논문에서 얼굴의 인식은 Mahalanobis distance와 재구성 오차율을 고려해서 이루어졌다. 실험은 개인당 세가지 다른 방향을 가지는 얼굴 영상을 이용하여 이루어졌고, 실험결과, 약 93%의 인식률을 보여주었다.
PDF

Korean Continuous Speech Recognition using Phone Models for Function words (기능어용 음소 모델을 적용한 한국어 연속음성 인식)

명주현;정민화
- Proceedings of the Korean Information Science Society Conference
- /
- 2000.04b
- /
- pp.354-356
- /
- 2000
의사형태소를 디코딩 단위로 한국어 연속 음성 인식에서의 조사, 어미, 접사 및 짧은 용언의 어간등의 단어가 상당수의 인식 오류를 발생시킨다. 이러한 단어들은 발화 지속시간이 매우 짧고 생략이 빈번하며 결합되는 다른 형태소의 형태에 따라서 매우 심한 발음상의 변이를 보인다. 본 논문에서는 이러한 단어들은 한국어 기능어라 정의하고 실제 의사형태소 단위의 인식 실험을 통하여 기능어 집합 1, 2를 규정하였다. 그리고 한국어 기능어에 기능어용 음소를 독립적으로 적용하는 방법을 제안했다. 또한 기능어용 음소가 분리되어 생기는 음향학적 변이들을 처리하기 위해 Gaussian Mixture 수를 증가시켜 보다 견고한 학습을 수행했고, 기능어들의 음향 모델 스코어가 높아짐에 따른 인식에서의 삽입 오류 증가를 낮추기 위해 언어 모델에 fixed penalty를 부여하였다. 기능어 집합1에 대한 음소 모델을 적용한 경우 전체 문장 인식률은 0.8% 향상되었고 기능어 집합2에 대한 기능어 음소 모델을 적용하였을 때 전체 문장 인식률은 1.4% 증가하였다. 위의 실험 결과를 통하여 한국어 기능어에 대해 새로운 음소를 적용하여 독립적으로 학습하여 인식을 수행하는 것이 효과적임을 확인하였다.
PDF

A Study on the Korean Continuous Speech Recognition using Phonetic Decision Tree-based State Splitting (음소결정트리 상태분할을 이용한 한국어 연속음성인식에 관한 연구)

오세진;황철준;김범국;정호열;정현열
- Proceedings of the Korea Institute of Convergence Signal Processing
- /
- 2001.06a
- /
- pp.277-280
- /
- 2001
본 연구에서는 연속음성인식 시스템의 성능개선을 위한 기초 연구로서 음소결정트리 상태분할과 한국어 음성학적 지식을 이용하여 문맥의존 음향모델의 작성방법을 검토하고. 한국어 연속음성인식에 적용을 소개한다. 음소결정트리 상태분할 알고리즘은 각 노드에서 한국어 음성학적 지식으로 구성된 음소 질의어 집합에 따라 2진 트리로 SSS(Successive State Splitting) 알고리즘에 의해 상태분할 하는 방법으로서 상태분할 후 각 상태를 네트워크로 연결한 구조를 HM-Net(Hidden Markow Network)이라 하며 문맥의존 음향모델로 표현된다. 작성한 문맥의존 음향모델의 유효성을 확인하기 위해 본 연구실의 항공편 예약 문장(YNU200)에 대해 연속음성인식 실험을 수행하였다. 인식실험 결과, 문맥의존 음향모델에 대한 화자독립 연속음성인식률이 기존의 단일 HMM 모델보다 평균적으로 1-pass의 경우 9.9%, 2-pass의 경우 4.1% 향상된 인식률을 보였다. 따라서 문맥의존 음향모델을 작성하는데 음소결정트리 상태분할과 한국어 음성학적 지식이 유효함을 확인하였다.
PDF

Search Result 6,452, Processing Time 0.044 seconds

이메일무단수집거부

이용약관

제 1 장 총칙

제 2 장 이용계약의 체결

제 3 장 계약 당사자의 의무

제 4 장 서비스의 이용

제 5 장 계약 해지 및 이용 제한

제 6 장 손해배상 및 기타사항

Detail Search

Image Search (β)