• Title/Summary/Keyword: 청각특성

Search Result 331, Processing Time 0.025 seconds

Effects of reverberation time on binaural Korean monosyllabic word recognition in normal hearing subjects (잔향시간이 양이를 사용한 한국어 단음절 인지에 미치는 영향)

  • Lim, Dukhwan
    • The Journal of the Acoustical Society of Korea
    • /
    • v.40 no.6
    • /
    • pp.678-682
    • /
    • 2021
  • Reverberation Time (RT) with noise levels can affect speech recognition ability in a listening environment. The degree of influence may depend on reverberation times and modes of binaural hearing. In this study, Korean monosyllabic Word Recognition Scores (WRS) were investigated in 10 young normal hearing subjects under binaural conditions. The RT of 3.4 s and signal to noise ratio of 0 dB were used at 55 dB HL for diotic (noise with the same phase) and dichotic (noise with the fixed phase difference, π) conditions. The improvement in WRS was noted in dichotic hearing (p < 0.05) while the similar trend was not observed in diotic hearing. This data may be useful in analyzing psychoacoustic effects of RTs under noisy conditions.

Design and Development of Open-Source-Based Artificial Intelligence for Emotion Extraction from Voice

  • Seong-Gun Yun;Hyeok-Chan Kwon;Eunju Park;Young-Bok Cho
    • Journal of the Korea Society of Computer and Information
    • /
    • v.29 no.9
    • /
    • pp.79-87
    • /
    • 2024
  • This study aims to improve communication for people with hearing impairments by developing artificial intelligence models that recognize and classify emotions from voice data. To achieve this, we utilized three major AI models: CNN-Transformer, HuBERT-Transformer, and Wav2Vec 2.0, to analyze users' voices in real-time and classify their emotions. To effectively extract features from voice data, we applied transformation techniques such as Mel-Frequency Cepstral Coefficient (MFCC), aiming to accurately capture the complex characteristics and subtle changes in emotions within the voice. Experimental results showed that the HuBERT-Transformer model demonstrated the highest accuracy, proving the effectiveness of combining pre-trained models and complex learning structures in the field of voice-based emotion recognition. This research presents the potential for advancements in emotion recognition technology using voice data and seeks new ways to improve communication and interaction for individuals with hearing impairments, marking its significance.

The Analysis for the Distinctive Directing of Speech Balloons in Webtoon (웹툰에 나타난 특징적 말칸 연출에 대한 분석)

  • Jeung, Kiu-Ha;Yoon, Ki-Heon
    • Cartoon and Animation Studies
    • /
    • s.36
    • /
    • pp.393-416
    • /
    • 2014
  • Comics has three components: cuts, gap between cuts, speech balloons. Still, it is true that speech balloons are not commonly subject to the study for comics. A few preceding researches pinpoint exactly the morphological features and functions of speech balloons. In today when webtoon becomes generalized, these features and functions are continued as they are and are used in webtoon. We can catch that speech balloons are also affected since the environmental elements of web induce the change in the overall comics directing. There are two perspectives to sort out the features of speech balloons: first, the placement issue of speech balloons. The unlimited expansion of web space gives the environment for comicss to use the gap between cuts as wide as they can. It leads to turn out some of the ways to place the balloons, so we can sort them out general placement, exterior placement, the upper and lower placement, scroll-use type. Second, as the directing techniques for webtoon become digitalized by the morphological issue, speech balloon itself has been expanded its ways to express by various expression methods. Analyzing and classifying, recording the newly emerged conditions on the preceding study are worthy of trying and will become the cornerstone for the follow research.

A study on the estimation of auditory filter shape by notch noise masking (노치 잡음 마스킹 방법에 의한 청각 필터의 특성에 관한 연구)

  • Kim, Young-Hoon;Park, Kwang-Suk
    • Proceedings of the KOSOMBE Conference
    • /
    • v.1991 no.05
    • /
    • pp.43-46
    • /
    • 1991
  • In this study, peripheral auditory system has been modeled as a filter bank of overlaping bandpass filters, and auditory filter shape has been estimated by notch noise masking. The filter was centered at 1kHz, and noise level was set to 40dB SPL. Masker noise was generated by summing sinusoidal functions with random phase for very steep skirts. To estimate threshold we used two alternative forced choice with 500 msec of duration. We measured threshold with notch width at 0.05,0.1,0.2,0.3,0.4 and 0.5. The filter was asymmetric with steeper upper branch and its ERB was 168 - 192 Hz.

  • PDF

Multi-Channel Audio Coding Technologies (멀티채널 오디오 (MPEG-2) 부호화 기술)

  • Hong, J.W.
    • Electronics and Telecommunications Trends
    • /
    • v.10 no.3 s.37
    • /
    • pp.15-27
    • /
    • 1995
  • 멀티미디어에서 비디오의 품질이 향상되고, 디지털 텔레비젼 (ADTV)이나 고선명 텔레비젼(HDTV) 등의 개발에 의해 화면 크기가 증가하면서 이에 어울리는 실감있는 오디오의 전송 및 재생이 요구된다. 따라서 멀티채널 오디오의 도입과 더불어 효율적이고, 경제적인 방법으로 낮은 비트율로 고품질의 멀티채널 오디오를 제공하기 위한 부호화 기술이 필요하게 된다. 최근에 인간의 청각 특성을 고려한 심리음향 모델을 이용한 멀티채널 오디오의 압축 부호화 기술이 MPEG-2 오디오의 국제 표준으로 제정되었다. MPEG-2 오디오 표준은 MPEG-1 오디오 표준을 기초로 하여 현장감을 필요로 하는 오디오를 위해 기본 스테레오 채널외에 중앙채널, 서라운드 채널, 그리고 저주파 효과채널을 부가한 방식으로 다채널, 음성다중 등의 부가서비스를 제공하기에 적합하다. 본고에서는 MPEG-2 오디오 표준의 계층 II를 중심으로 한 표준의 특징, 알고리즘, 데이터 구조, 그리고 응용분야 등에 대해 기술한다.

An Acoustic study of Korean Lenis Stop Voicing -in relation to Prosodic Structures- (한국어 파열연자음 유성화에 관한 음향음성학적 고찰 -운율구조와 관련하여-)

  • Kim Hyo Sook;Kim Sun Ju;Kim Sunmi
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • autumn
    • /
    • pp.383-386
    • /
    • 1999
  • 이 논문은 한국어 파열연자음이 유성음 환경에서 유성음화하는 현상을 운율구조와 관련해서 음향음성학적으로 고찰하는 것을 목적으로 한다. 이 논문에서는 첫째, 음성적 자질로서나 청각적인 판단에 의해서나 무성음과 유성음의 이분법으로 나뉘는 것을 음향적 고찰을 통하여 각각을 하위의 범주로 나누었다. 문장 안에서 파열연자음이 음향적으로 실현될 때 각각의 범주가 어느 정도의 빈도수로 출현하는지를 살펴보았다. 둘째, 한국어 파열연자음은 어절 초에서는 무성음으로 실현되나 앞뒤에 유성음이 오는 경우에는 유성화되는 음운규칙이 있는데, 음향적인 분석을 통하여 앞뒤에 유성음이 온다는 조건만으로 설명할 수 없는 예들을 발견하였다. 그리하여 인접음절(특히 앞음절에 오는 분절음의 특성)과 운율구조(액센트구 내에서의 위치, 억양구경계의 유무)를 함께 고려하는 파열연자음 유성화규칙의 조건을 제안하였다.

  • PDF

Implementation of Transaural filter method for the location of listeners and loudspeakers (청취자 및 스피커의 위치에 따른 Transaural 필터 구현)

  • shin Hwang;Bhang Seungbeum;Kim Soonhyob;Cheung Wan-Sup
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • spring
    • /
    • pp.197-200
    • /
    • 2000
  • 본 논문에서는 공간에 위치한 음원으로부터 양 귀에 들리는 음향을 스피커를 이용하여 재현 하는 기술에 대한 문제점과 이를 효과적으로 구현할 수 있는 방법에 대해 소개한다. 좌우 대칭 위치의 스피커를 이용하여, 음상 정위를 실현할 때 직면한 문제점인 Cross-talk 제거와 스피커와 청취자 양 귀사이의 음향전달 모델 선정에 대한 문제점들을 본 논문에서 고찰한다. 이러한 고찰을 통하여 Transaural 필터의 모델 제시와 본 모델의 음향학적 특성을 소개한다. 인간 청각기관의 공간 감응 인자인 lID(Interaural Intensity Difference)와 ITD(Interaural Time Difference)의 개념을 이용한 Transaural 필터의 구현 방법을 제시한다. 제시한 구현방법과 영국 ISVR의 "Stereo Dipole"과의 비교와, 끝으로, 주파수에 따른 적합한 스피커간의 배치 문제에 관한 것도 언급한다.

  • PDF

Analysis and Computational Processing of Sentences in Korean for Automatic Sign Language Generation (수화 자동 생성을 위한 한국어 문장 분석과 처리)

  • Choi, Ji-Won;Park, Jong-Chul
    • Annual Conference on Human and Language Technology
    • /
    • 2003.10d
    • /
    • pp.219-226
    • /
    • 2003
  • 한국 수화는 한국어에 대한 기본적인 유사성을 가지고 있지만, 교착어이자 청각-음성 체계 언어인 한국어와는 달리 고립어이자 시각-운동 체계 언어로서의 특성을 동시에 나타내고 있다. 그러므로 텍스트 형태의 한국어 문장으로부터 수화를 자동 생성하기 위해서는 한국어를 위해 미리 정의된 문법에 수화 표현을 무리하게 연계시키려고 하기 보다, 수화 고유의 의미 전달 체계를 분석하고 활용하여야 할 필요가 있다. 본 논문에서는 수화 표현상의 언어학적 특징을 재현 생략 변형 이동의 네 가지로 구분하여 분석하고 결합범주문법을 이용한 이 같은 형상의 처리 방법 및 구현 방안에 대하여 논의한다.

  • PDF

Effects of Sounds on Human Sensibility (제품의 음향적용에 따른 인간감성의 변화)

  • 김병주;이구형;정일석
    • Proceedings of the Korean Society for Emotion and Sensibility Conference
    • /
    • 2001.05a
    • /
    • pp.92-96
    • /
    • 2001
  • 제품에 대한 소비자의 평가는 제품이 나타내는 전반적인 특성에 대하여 이루어지며, 이 과정에서 인간의 오감이 모두 작용한다. 최근 대두되기 시작하고 있는 다감각 디자인은 형태와 색상을 중심으로 한 시각 중심의 디자인에 시각분만 아니라 청각과 후각 등의 감각요소를 추가하려는 시도를 하고 있다. 제품 디자인에 다감각을 활용하기 위해서는 복합적인 감각자극과 인간의 감성 사이의 관계가 명확하게 이해되어야 하며, 복합자극 이전에 시각 이외의 단순 감각자극에 의한 감성 변화에 대한 이해가 선행되어야 한다. 본 연구는 음향자극에 대한 감성변화를 평가하는 것을 목적으로 하였으며, 선별된 30개 음향을 대상으로 6쌍의 감성어휘를 이용하여 평가한 결과, 음향이 피실험자의 감성에 변화를 발생시키는 것을 확인하였다. 감성의 변화는 음향의 물리적 속성 분만 아니라 사용자 자신의 개인적, 사회적, 문화적 요인에 의해 차이를 보였으며, 이 결과는 감성의 개인적 속성을 확인시켜 주었다.

  • PDF

Acoustic Qualities of Phonation in Hearing-impaired Male Adults (청각장애 성인 남성의 음성 특성)

  • Sehr, Kyoung-Hee
    • MALSORI
    • /
    • no.65
    • /
    • pp.37-49
    • /
    • 2008
  • The purposes of this experiment were to compare and analyze some voice parameters of the hearing impaired male adults and to suggest a basic data on the speech intervention for the hearing impaired. Voice analysis of four sustained vowels(/a/, /i/, /${\partial}$/, /u/, fundamental Sequency(F0), jitter percent, shimmer percent, and Noise to Harmonic Ratio(NHR) was conducted for the deaf young male adults using a sign laguage(N=5, aged 16-20) and the normal hearing young male adults(N=10, aged 18-20) by using MDVP(Multi-Dimensional Voice Program) in CSL. F0, jitter, and shimmer in the deaf group were significantly higher than those in the normal hearing group. The average of F0 was 151 Hz, which was lower than the results of the previous studies, and there were no significant differences among the sustained vowels. In both groups, the values of the voice parameters were stable on the /a/ or /${\partial}$/, those closed to the standard scores.

  • PDF