• 제목/요약/키워드: 대상인식

검색결과 10,515건 처리시간 0.049초

비인식 대상 문장 거부 기능을 위한 음소 기반 인식 네트워크의 구성에 관한 연구 (Research on Recognition Network Structures for Non-recognition Sentence Rejection)

  • 이병혁;하진영
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2004년도 가을 학술발표논문집 Vol.31 No.2 (2)
    • /
    • pp.772-774
    • /
    • 2004
  • 음성인식 시스템에서 입력된 음성 데이터에 대해 비인식 대상에 대한 거부기능은 신뢰도 보장 측면에서 상당히 중요하다. 비인식 대상의 단어 거부는 지금까지 여러 연구가 이루어져 왔으나, 문장 거부에 대한 연구는 사실상 부족한 실정이다. 본 논문에서는 비인식 대상 문장 거부기능의 신뢰도를 한층 높일 수 있도록 음소 기반 네트워크에 유성자음(VC), 무성자음(C), 모음(V) 단위의 필러 음향 모델을 생성하여 다양한 음소기반 인식 네트워크의 구성방법을 적용하여 비인식 대상 문장에 대해 거부 기능을 구현하고, 그에 따라 인식률과 거부율이 달라질 수 있음을 보인다. 구현된 시스템에서 제안한 3가지 음소단위 인식 네트워크 중 문장의 각 단어별 필러 모델을 구성했을 때가 가장 좋은 구성임을 알 수 있었다.

  • PDF

문법적 제약을 이용한 연속음 인식의 성능 향상 (Improvement of Connected Word Recognition using Grammatical Constraint)

  • 함정표;양태영;신원호;이충용;차일환
    • 한국방송∙미디어공학회:학술대회논문집
    • /
    • 한국방송공학회 1998년도 학술대회
    • /
    • pp.107-110
    • /
    • 1998
  • 연속음 인식에서 인식 대상이 가지는 규칙을 적용했을 경우 성능 향상을 가져올 수 있다. 본 논문에서는 연속음 중에서 연결 숫자음을 인식 대상으로 하는 음성 인식 시스템의 성능 향상을 위하여 프레임 동기 네트워크(Frame Synchronous Network)을 이용하였다. 연결 숫자음이 가지는 반복적인 특성과 자릿수의 상하 관계가 인식 성능에 미치는 효과를 이용하여 다양한 수준에 제약을 갖는 FSN을 제안하였다. 본 논문에서는 연속 숫자음 중에서 금액을 대상으로 인식 결과 제안된 FSN을 이용하여 금액 어휘의 인식 성능을 향상시킬 수 있었다.

  • PDF

문법적 제약을 이용한 금액 문장 인식의 성능 향상 (Improvement of Price Sentence Recognition Using Grammatical Constraint)

  • 함정표;양태영;신원호;이충용;차일환
    • 방송공학회논문지
    • /
    • 제3권2호
    • /
    • pp.180-186
    • /
    • 1998
  • 연속음 인식에서의 인식 대상이 가지는 규칙을 적용했을 경우 성능 향상을 가져올 수 있다. 본 논문에서는 연속음 중에서 연결 숫자음을 인식 대상으로 하는 음성 인식 시스템의 성능 향상을 위하여 프레임 동기 네트워크(Frame Synchronous Network)을 이용하였다. 연결 숫자음이 가지는 반복적인 특성과 자릿수의 상하 관계가 인식 성능에 미치는 효과를 이용하여 다양한 수준의 제약을 갖는 FSN을 제안하였다. 본 논문에서는 연속 숫자음 중에서 금액을 대상으로 인식 결과 제안된 FSN을 이용하여 금액 어휘의 인식 성능을 향상시킬 수 있었다.

  • PDF

지도에서 도로와 블록 인식 (Recognition of Roads and Districts from Maps)

  • 장경식;김재희
    • 한국정보처리학회논문지
    • /
    • 제4권9호
    • /
    • pp.2289-2298
    • /
    • 1997
  • 이 논문에서는 지도 인식을 위한 새로운 접근 방법을 제안하였다. 한 대상체의 인식결과가 다른 대상체의 인식과정에 미치는 영향이 최소화되도록 대상체들간의 구조적 정보에 대한 계층적 모델을 정의하여 이를 기반으로 인식 및 인식결과의 검증을 수행하였으며, 선들간의 관계들을 정의하여 탐색공간을 줄이며 대상체와 연관된 선을 탐색하였다. 또한 대상체들간의 관계를 이용하여 각 대상체의 인식 결과를 판정하고, 오인식시에는 재인식하도록 하였으며 이 과정에서 인식 알고리듬의 매개변수를 변화시켜 수행함으로써 정확한 인식이 수행되도록 하였다. 결과적으로, 선을 찾는 과정에서 탐색공간을 효과적으로 줄이는 효과를 가져왔으며, 구획을 구성하는 선들이 끊어지는 경우에도 블록과 도로를 정확히 인식하는 결과를 얻을 수 있었다.

  • PDF

색상 정보를 포함하여 2차원 대상물 인식에 보다 적합한 일반화된 허프변환에 관한 연구 (A Study on Improving Generalized Rough Transform with Chromatic Informations, Suited for 2D Object Recognition)

  • 백기현;이행세
    • 대한전자공학회:학술대회논문집
    • /
    • 대한전자공학회 2003년도 하계종합학술대회 논문집 Ⅳ
    • /
    • pp.1984-1987
    • /
    • 2003
  • 본 논문에서는 모델에 기반한 2차원 영상인식 알고리즘 중에 하나인 일반화된 허프변환(Generalized Hough Transform)에 대하여 색상정보까지 포함할 수 있도록 기존의 알고리즘을 확장하는 방법을 제시하였고, 이에 의한 실험결과를 간단히 고찰하였다. 기존의 일반화된 허프변환은 대상물의 윤곽선 정보에 기반을 두었기 때문에, 윤곽선 정보가 일치하면 대상물의 색상이나 명암분포가 달라도 동일한 대상물로 인식할 가능성이 있다. 따라서, 일반화된 허프변환을 확장하여 대상물의 모델링과 인식과정에 색상정보(chromatic information)를 포함한다면 2D 영상인식시 컬러정보를 활용할 수 있는 장점이 있다. 여기에서는 실제로 모델링 과정과 인식과정에서 색상정보를 반영하기 위한 간략한 방법과, 이에 따른 실험결과를 제시하였다. 간단한 2D 위치변환이 존재하는 실험에서 윤곽선의 모양이 거의 일치하더라도 색상이 다른 대상물이 존재할 경우에 이를 올바로 구분할 수 있었다.

  • PDF

어휘독립 환경에서의 가변어휘 음성인식에 관한 연구 (A Study on the Variable Vocabulary Speech Recognition in the Vocabulary-Independent Environments)

  • 황병한
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1998년도 학술발표대회 논문집 제17권 2호
    • /
    • pp.369-372
    • /
    • 1998
  • 본 논문은 어휘독립(Vocabulary-Independent) 환경에서 별도의 훈련과정 없이 인식대상 어휘를 추가 및 변경할 수 있는 가변어휘(Variable Vocabulary) 음성인식에 관한 연구를 다룬다. 가변어휘 인식은 처음에 대용량 음성 데이터베이스(DB)로 음소모델을 훈련하고 인식대상 어휘가 결정되면 발음사전에 의거하여 음소모델을 연결함으로써 별도의 훈련과정 없이 인식대상 어휘를 변경 및 추가할 수 있다. 문맥 종속형(Context-Dependent) 음소 모델인 triphone을 사용하여 인식실험을 하였고, 인식성능의 비교를 위해 어휘종속 모델을 별도로 구성하여 인식실험을 하였다. Unseen triphone 문제와 훈련 DB의 부족으로 인한 모델 파라메터의 신뢰성 저하를 방지하기 위해 state-tying 방법 중 음성학적 지식에 기반을 둔 tree-based clustering(TBC) 기법[1]을 도입하였다. Mel Frequency Cepstrum Coefficient(MFCC)와 대수에너지에 기반을 둔 3 가지 음성특징 벡터를 사용하여 인식 실험을 병행하였고, 연속 확률분포를 가지는 Hidden Markov Model(HMM) 기반의 고립단어 인식시스템을 구현하였다. 인식 실험에는 22 개 부서명 DB[3]를 사용하였다. 실험결과 어휘독립 환경에서 최고 98.4%의 인식률이 얻어졌으며, 어휘종속 환경에서의 인식률 99.7%에 근접한 성능을 보였다.

  • PDF

유성/무성/묵음 정보론 이용한 동적 시간 정합 알고리즘 개선 (Improvement of Dynamic Time Warping Algorithm by Using Voice/Unvoiced/Silence Information)

  • 최민석;한현배;한민수
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1999년도 학술발표대회 논문집 제18권 1호
    • /
    • pp.40-43
    • /
    • 1999
  • 본 연구에서는 고립단어 인식시스템에 사용되고 있는 DTW(DynamicTimeWarping) 알고리즘의 계산량을 줄일 수 있는 방법을 제안한다. 일반적으로 고립단어 인식시 가장 인식률이 좋은 알고리즘은 DW라고 알려져 있으나, 인식대상어휘가 늘어나면 계산량이 비례해서 늘어나고 인식률이 저하되는 단점이 있으므로 일반적으로 200단어 이하의 어휘에만 사용되고 있다. 따라서 대상어휘를 감소시켜 계산량을 줄이기 위해 본 논문에서는 유성/무성/묵음 (V/U/S) 정보를 이용하여 코드워드를 구성하고 같은 코드워드에 해당되는 단어들을 추출해이들 만을 비교대상 어휘로 제한하므로서 DW 알고리즘을 적용할 대상 어휘수를 줄이는 방법을 사용하여 계산 속도를 향상시켰다 또한 입력 단어와 대상 단어와의 누적거리 계산 시 끝점 정보 뿐 만 아니라 유성/무성/묵음 경계 정보를 이용하여 piecewise DTW를 구현함으로서 탐색 영역을 축소함으로써 추가적인 계산량 감소가 가능하다. 따라서 상기 기법들을 이용하면 PC상에서도 DTW를 이용한 대어휘 고립단어 음성 인식기의 구현이 가능할 것이다.

  • PDF

RFID 기반 물류관리의 신뢰성 향상을 위한 상황인지 시스템 개발 (A Context-Aware System for Reliable RFID-based Logistics Management)

  • 진희주;김훈태;이용한
    • 한국전자거래학회지
    • /
    • 제18권2호
    • /
    • pp.223-240
    • /
    • 2013
  • RFID(Radio Frequency Identification)는 모니터링 하려는 인식대상물에 태그를 부착하여 무선주파수를 이용하여 인식대상물의 데이터를 인식하는 기술로서 최근 연구가 활발하게 이루어지고 있으며, 물류 및 제조에서 많은 도입이 시도되고 있다. 4RFID는 특정 인식지역 내의 모든 태그들을 인식한다. 이러한 점이 RFID가 갖는 장점 중 하나이다. RFID의 인식 메커니즘은 복수 태그들을 동시에 인식하는 것에 초점이 맞춰져 있다. 따라서 RFID 하드웨어만으로는 인식되는 태그의 이동방향, 순서, 적합성 등을 판단하기 어렵다. 이러한 문제점들은 실제 RFID 현장 적용 시에 예기치 못하는 문제점들을 발생시키는 원인이 되어왔다. 그 중 대표적인 문제점으로 단일 RFID 게이트에서의 입/출고 판단의 어려움과 서열화된 인식대상의 서열 판단의 어려움, 그리고 고스트 인식을 들 수 있다. 고스트 인식이란 협소한 장소에서 태그가 부착된 인식대상이 이동할 때 정해진 프로세스와는 무관한 RFID가 해당 인식대상을 인식하여, 혼란을 야기시키는 것을 말한다. RFID 개발자는 이러한 문제를 적용 사례마다 분석하여 해결해야 하며, 프로그램을 통해 해결하지 못하는 경우에 RFID 시스템을 다시 설치해야 하는 문제가 발생할 수 있다. 본 연구에서는 인식대상의 방향인지, 서열인지, 인지 적합성 검증과 관련하여 인식대상을 인식할 때 획득되는 기본 데이터들을 이용하여 문제를 해결할 수 있는 알고리즘과 이를 모듈화하여 현장 적용 시에 캡처링 애플리케이션의 개발 시간을 단축할 수 있는 시스템을 개발한다.

FSN을 이용한 금액 인식 시스템 (Price Recognition System using FSN)

  • 함정표
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1998년도 학술발표대회 논문집 제17권 2호
    • /
    • pp.331.1-334
    • /
    • 1998
  • 본 논문에서는 금액을 인식 대상으로 하는 음성 인식 시스템의 성능 향상을 위하여 프레임 동기 네트워크(Frame Synchronous Network)을 이용하였다. 연속음 인식에서 인식 대상이 가지는 규칙을 적용했을 경우 성능 향상을 가져올 수 있다. 금액이 가지는 반복적인 특성과 자릿수의 상하 관계가 인식 성능에 미치는 효과를 이용하여 다양한 수준의 제약을 갖는 FSN을 제안하였다. 제안된 FSN의 성능을 다양한 환경과 특징 벡터에 대하여 이산 hidden Markov model[5]을 이용하여 실험을 수행하였다. 인식 결과 제안된 FSN을 이용하여 금액 어휘의 인식 성능을 향상시킬 수 있었다.

  • PDF

유사지명 인식시의 성능 개선 연구 (A study on the improvement of speech recognition for similar place names)

  • 백승권;양희식;한민수
    • 한국방송∙미디어공학회:학술대회논문집
    • /
    • 한국방송공학회 2000년도 정기총회 및 학술대회
    • /
    • pp.49-53
    • /
    • 2000
  • 본 연구에서는 DAB(Digital Audio Broadcasting) 시스템의 교통정보 검색 서비스를 위하여 경부선 및 호남선의 톨게이트가 위치한 49 개의 지명을 대상으로 이를 인식하고자 할 때 인식 율을 개선하였다. 지명 어휘의 특성을 분석한 결과 전체 지명의 81.6%가 2 음절이었으며 동일한 음절을 포함하는 지명이 전체의 구성된 어휘가 61%로 조사되었다. 시스템에서 인식율을 개선하기 위하여 인식 대상어휘를 3개의 set로 재분류하고 인식 대상 어휘로 판정된 후보 어휘에 대하여 인식 성공여부에 핵심이 되는 음절의 위치에 따라 가중치 윈도우를 적용하였다. 그 결과 화자 독립의 인식율 테스트에서 남성의 경우 7.2%, 여성의 경우 5.1%의 인식율 향상을 보였다.

  • PDF