• Title/Summary/Keyword: 성대신호분석

Search Result 31, Processing Time 0.022 seconds

Vocal-cord Signal Study based on Phonological Feature for Vocal-cord Signal Isolated-Word recognizer (성대신호 명령어 인식기를 위한 음운자질에 기반한 성대신호 연구)

  • Jung, Young-Giu;Han, Mun-Sung;Cho, Kwan-Hyun
    • 한국HCI학회:학술대회논문집
    • /
    • 2006.02a
    • /
    • pp.565-570
    • /
    • 2006
  • 웨어러블 환경에서 가장 유용한 사용자 인터페이스는 음성이다. 그러나 현재 노이즈 제거 기술로는 웨어러블 환경과 같은 고소음 환경에서 음성 인식기의 실제적인 응용은 거의 불가능하다. 본 논문은 환경노이즈를 원천적으로 차단하는 성대 마이크를 이용한 명령어 인식기를 개발한다. 이를 위해 성대신호를 한국어 음운자질 이론을 기반으로 설명하고, 입력신호를 분석하여 이러한 접근방법의 타당성을 검증한다. 이러한 성대신호의 분석을 위해 스펙트럼과, FFT 결과를 사용하고, MFCC 알고리즘을 이용하여 주파수 영역내의 정보량이 인식에 미치는 영향을 분석한다. 그리고 분석결과를 바탕으로 성대신호 명령어 인식기를 위한 특징벡터로 유/무성음 분리에 사용되는 특징벡터가 유용함을 ZCPA 알고리즘을 이용한 성대신호 명령어 인식기를 개발하여 검증한다. 실험결과 ZCPA 를 사용한 것이 MFCC 에 비해 16%높은 인식률을 보인다.

  • PDF

Recognizer Optimization for a Isolated-word Recognition system using Throat Microphone (성대마이크를 이용한 ASR 시스템 개발을 위한 인식기 최적화)

  • Jung, Young-Giu;Han, Mun-Sung;Lee, Sang-Jo
    • 한국HCI학회:학술대회논문집
    • /
    • 2007.02a
    • /
    • pp.406-410
    • /
    • 2007
  • 성대마이크는 디바이스의 특성상 환경 잡음을 최소화하는 장점이 있다. 그러나 고주파정보의 손실과 부분적인 포먼트 정보의 손실 때문에, 성대마이크를 이용한 명령어 인식기는 표준마이크를 이용한 명령어 인식기보다 낮은 성능을 보인다. 본 논문은 한국어 음운자질의 특성을 적용한 특징추출 알고리즘과 최적화된 인식모델을 이용하여 높은 성능을 갖는 명령어 인식시스템을 제안한다. 성대 울림 특성이 한국어 내의 분포 분석하여 성대 울림 정보만으로 명령어 인식기 개발이 가능함을 보이고 음성인식에 높은 성능을 보이는 Time Delay Neural Network(TDNN)[1]을 성대신호 명령어 인식에 최적화한 구조를 제안한다. 실험을 통해 찾은 최적 TDNN 구조를 성대신호에 적용한 했을 때 약 87%의 높은 성능을 보였다.

  • PDF

Pitch Detection Using Wavelet Transform (웨이브렛 변환을 이용한 피치검출)

  • 손영호
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • 1997.06a
    • /
    • pp.5-8
    • /
    • 1997
  • 음성신호는 성대를 통과한 공기 흐름의 성질에 따라 유성음과 무성음으로 구분될 수 있다. 그 중 유성음에서는 성대의 규칙적인 지동이 존재하게 된는 데 이때 성대가 닫히는 순간을 GCI(Glotal Closure Instant)라 하며 성대 진동의 기본주기를 피치라고 한다. 이러한 피치는 음성합성, 음성인식, 피치동기 음성신호의 분석등에 중요한 파라미터 중의 하나이다. 본 논문에서는 가우시안 함수의 일차미분형태를 갖는 웨이브렛 함수를 사용할 경우 신호의 급격한 변화부분을 검출할 수 있다는 성질을 이용하여 음성 신호의 GCI를 찾아내고 이를 이용하여 피치를 검출하였다.

  • PDF

편측 성대마비와 성대폴립 환자의 수술 전후 음성검사와 이미지 화상분석의 상관관계에 대한 객관적 비교연구

  • 김시찬;최홍식;홍정표;오종석
    • Proceedings of the KSLP Conference
    • /
    • 1999.11a
    • /
    • pp.199-199
    • /
    • 1999
  • 각종 음성질환에 있어서 음성검사는 진단뿐 아니라 치료를 위한 중요한 방법으로 알려져 왔다. 특히 수술전후 음성질환의 평가에는 음성검사 뿐 아니라, 후두스트로보스코피를 이용하여 비교함으로써 가능하다. 이중 후두스트로보스코피는 방법이 간단하여 직접 수술전후의 변화를 알 수 있는 장점이 있으나, 객관적인 자료로는 이용하기가 어려운 문제점이 있다. 후두스트로보스코피의 영상자료를 컴퓨터에 연결, 영상신호를 디지털화하여 후두의 움직임을 객관적으로 관찰하려고 시도되어왔다 특히 편측 성대마비 환자에서는 성대의 위치가 외전 될뿐만 아니라 피열연골의 위치가 마비 후 시간이 경과됨에 따라 외회전 하고 성대가 전방으로 위축되어 성대 막성부의 길이가 짧아지는 틀의 후두스트로보스코피의 영상을 보이고, 성대폴립환자에서는 수술전후에 폴립의 크기와 성문면적에 변화를 보이게 된다. 본 연구의 목적은 편측 성대마비와 성대폴립과 같은 각기 다른 두 질병에서 음성경사와 후두스트로보스코피를 이용한 이미지 화상분석을 통해 각 성대의 길이, 각도, 성문틈의 면적과 폴립의 크기등을 측정함으로써 수술전후의 차이를 알아보고, 이미지 화상분석과 음성검사 사이에 어떠한 상관관계가 있는지를 알아보고자 하였다. (중략)

  • PDF

A Study on the Epoch Extraction of Voicd Speech (유성음 구간에서의 Epoch 추출에 관한 연구)

  • 강동규
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • 1995.06a
    • /
    • pp.216-220
    • /
    • 1995
  • 음성 신호처리분야의 기반을 이루고 잇는 선형예측기법으로 성대폐쇄구간 분석이 가능해질 경우 특히 음성합성가 부호화 시스템의 상당한 성능개선을 기대할 수 있기 때문에 최근 관련 분야에서 높은 신뢰도를 갖는 GCI 검출 알고리즘 개발에 많은 관심을 보이고 있다. 성대폐쇄구간 검출에서 가장 중요한 것은 성대폐쇄시점에 관한 정보이며, 본 논문에서는 이에 대응될 수 있는 정보인 epoch를 음성신호에서 직접 추출할 수 있는 기법을 제안하였다. 제안된 방법은 프레임 단위별 평균 피치를 참조하여 저역통과된 유성음 신호에서 3구간 영교차점별 평균진폭 변동율에 의해 pseudo-epoch를 검출한다. 대역 통과된 유성음 신호를 이용하여 pseudo-epoch 부근에 존재하는 보다 정밀한 실제 epoch을 최종적으로 결정하였다. 제안된 방법은 단계적으로 epoch가 존재할 수 있는 연역을 좁혀 나아가면서 처리하므로 검출오차를 줄일 수 있었고, 시간영역에서 처리되어 계산량이 적으므로 고속 처리가 가능하였다. 성능평가를 위해 처리결과를 EGG 신호와 비교한 결과 약 2샘플 정도의 오차만을 갖는 우수한 성능을 나타내었다.

  • PDF

Effective Feature Vector for Isolated-Word Recognizer using Vocal Cord Signal (성대신호 기반의 명령어인식기를 위한 특징벡터 연구)

  • Jung, Young-Giu;Han, Mun-Sung;Lee, Sang-Jo
    • Journal of KIISE:Software and Applications
    • /
    • v.34 no.3
    • /
    • pp.226-234
    • /
    • 2007
  • In this paper, we develop a speech recognition system using a throat microphone. The use of this kind of microphone minimizes the impact of environmental noise. However, because of the absence of high frequencies and the partially loss of formant frequencies, previous systems developed with those devices have shown a lower recognition rate than systems which use standard microphone signals. This problem has led to researchers using throat microphone signals as supplementary data sources supporting standard microphone signals. In this paper, we present a high performance ASR system which we developed using only a throat microphone by taking advantage of Korean Phonological Feature Theory and a detailed throat signal analysis. Analyzing the spectrum and the result of FFT of the throat microphone signal, we find that the conventional MFCC feature vector that uses a critical pass filter does not characterize the throat microphone signals well. We also describe the conditions of the feature extraction algorithm which make it best suited for throat microphone signal analysis. The conditions involve (1) a sensitive band-pass filter and (2) use of feature vector which is suitable for voice/non-voice classification. We experimentally show that the ZCPA algorithm designed to meet these conditions improves the recognizer's performance by approximately 16%. And we find that an additional noise-canceling algorithm such as RAST A results in 2% more performance improvement.

Implementation and Evaluation of Electroglottograph System (전기성문전도(EGG) 시스템의 개발 및 평가)

  • 김기련;김광년;왕수건;허승덕;이승훈;전계록;최병철;정동근
    • Journal of Biomedical Engineering Research
    • /
    • v.25 no.5
    • /
    • pp.343-349
    • /
    • 2004
  • Electroglottograph(EGG) is a signal recorded from the vocal cord vibration by measuring electrical impedance across the vocal folds through the neck skin. The purpose of this study was to develop EGG system and to evaluate possibility for the application on speech analysis and laryngeal disease diagnosis. EGG system was composed of two pairs of ring electrodes, tuned amplifier, phase sensitive detector, low pass filter, and auto-gain controller. It was designed to extract electric impedance after detecting by amplitude modulation method with 2.7MHz carrier signal. Extracted signals were transmitted through line-in of PC sound card, sampled and quantized. Closed Quotient(CQ), Speed Quotient(SQ), Speed Index(SI), fundamental frequency of vocal cord vibration(F0), pitch variability of vocal fold vibration (Jitter), and peak-to-peak amplitude variability of vocal fold vibration(Shimmer) were analyzed as EGG parameters. Experimental results were as follows: the faster vocal fold vibration, the higher values in CQ parameter and the lower values in SQ and SI parameters. EGG and speech signals had the same fundamental frequency. CQ, SQ, and SI were significantly different between normal subjects and patients with laryngeal cancer. These results suggest that it is possible to implement portable EGG system to monitor the function of vocal cord and to test functional changes of the glottis.

Analysis of Vocal Cord Function by Humidity Change Based on Voice Signal Analysis (음성신호 분석 기반의 습도 변화에 따른 성대 기능 분석)

  • Kim, Bong-Hyun;Cho, Dong-Uk
    • The Journal of Korean Institute of Communications and Information Sciences
    • /
    • v.37A no.9
    • /
    • pp.792-798
    • /
    • 2012
  • Network Quotient, an important figure in modern society, the intelligibility of speech as a conversation partner to maximize pulling up feeling of liking it as much as possible has become an important issue. The humidity of air in the intelligibility of speech have many influences. Therefore, in this paper, we carried out experiment to apply voice signal analysis techniques which to analyze influenced vocal cords in 30%, 50% and 80%, maintaining a constant humidity of the environment. With this in mind, we carried out experiments on intensity and pitch of voice signal on twenty male 20s in maintaining a constant humidity 30%, 50% and 80% of humidity. Finally, we carried out study to draw a significance through statistical analysis measuring characteristic parameter of vocal cord function to change of humidity.

LYRYNGEAL ADJUSTMENTS FOR KOREAN CONSONANTS (한국어 파열음에 대한 후두내근의 역할)

  • ;H. Hirose
    • Proceedings of the KOR-BRONCHOESO Conference
    • /
    • 1991.06a
    • /
    • pp.15-15
    • /
    • 1991
  • 한국어 자음에 대한 생리적인 분류는 조음점 및 조음발법에 따라 다시 세분화할 수 있는데 그중에서 조음발법에 따라 파열음, 마찰음, 파찰음 및 비음들 여러가지로 분류할 수 있다. 그중 특히 파열음은 그 개방하는 방법에 따라 연음(lenis), 경음(glottalized) 및 기식음(aspirated)등으로 구분하는데 이러한 각음을 육안으로 확인하면 모음이 발성되기 위한 성대진동이 있기전의 자음을 위한 성대의 운동의 현상을 보면 기식음에서는 성대열림이 가장 크고 연음에서도 열림이 크지만 기식음보다는 적고 경음에서는 성대의 열림이 가장 작았다. 이러한 현상은 후두내시경에 의해 쉽게 확인할 수 있었는데 이것을 과학적으로 규명하기 위해서는 여러연구에 의해 가능하나 흔히 후두근전도 검사에 의한 성대내전근과 외전근의 역할의 차이를 비교함으로서 가능해지리라 예상되어 본 연구를 시행하였다. 사용된 문형 또는 단어는 한가지를 제외하고는 모두 의미있는 단어를 사용하였으며 EMG recording을 위해 사용된 근육은 후두내전근인 Vocalis muscle과 후두외전근인 Posterior cricoarytenoid muscle이 사용되었고 전기신호는 computer data processing system에 의해 분석되어졌다. 결과는 내시경에 의한 성대열림의 거리측정 결과를 분석함과 동시에 후두내근에 대한 근전도검사에 의한 분석을 토대로 하였으며 이를 간단히 설명하면 이제까지 많은 사람들은 한국어 자음에 대한 각각의 특징적인 현상들을 주로 성대내전근의 역할에 의해 규명하였으나 본 결과로는 성대내전근의 역할도 중요하지만 성대외전근의 역할 또한 상호 연관성을 가지면서 매우 중요한 역할을 한다는 점이다.for the Isotropic plates can be used. Use of some coefficients can produce "exact" value for laminates with such configuration.trap with 2.88[eV] deep of injected space charge from the chathode in the crystaline regions. The origin of ${\alpha}$$_2$ peak was regarded as the detrapping process of ions trapped with 0.9[eV] deep originated from impurity-ion remained in the specimen during production process of the material, in the crystalline regions. The origin of ${\beta}$ peak was concluded to be due to the depolarization process of "C=0"dipole with the activation energy of 0.75[eV] in the amorphous regions. The origin of ${\gamma}$ peak was responsible to the process combined with the depolarization of "CH$_3$", chain segment, with the activation energy of carriers from the shallo

  • PDF

Correlation Analysis Between Vocal Fold Vibration and Voice Signal Analysis Parameter by Water Temperature (수온에 따른 성대 진동과 음성신호 분석 요소간의 상관성 분석)

  • Kim, Bong-Hyun;Cho, Dong-Uk
    • The Journal of Korean Institute of Communications and Information Sciences
    • /
    • v.37 no.4C
    • /
    • pp.347-353
    • /
    • 2012
  • In this paper, we carried out experiments to analyze influence of vocal cords according to changes of water temperature. We would like to particularly perform a study to design voice measurement system for significant extraction about vibration patterns of vocal cords according to temperature changes of water to drink. To this end, we measured elements value of voice analysis vibration of vocal cords to change, when drank, temperature difference of step 8 from $0^{\circ}C$ to $70^{\circ}C$ to $10^{\circ}C$ intervals. As a result of us experiment, when drank water of $30^{\circ}C{\sim}40^{\circ}C$, vibration of vocal cords stabilized and accuracy of pronunciation improved. We can analyzed that water of $30^{\circ}C{\sim}40^{\circ}C$ had a good effect in vocal cords.