통합 검색 | Korea Science

HMM기반 자동음소분할기의 음소분할 오류 유형 분석 (The Error Pattern Analysis of the HMM-Based Automatic Phoneme Segmentation)

김민제;이정철;김종진
- 한국음향학회지
- /
- 제25권5호
- /
- pp.213-221
- /
- 2006
합성음의 음질을 향상시키기 위하여 분할된 corpora로부터 합성유닛을 선택하여 사용하는 연속음성합성에서 정확한 음소분할은 매우 중요하다. 일반적으로 음소분할은 사람에 의해 수행되지만 많은 작업량으로 인한 시간적 지연, 일관 성 유지 어려움 등 많은 문제가 발생한다. 이에 따라 음성인식에서 도입된 HMM 기반의 자동음소분할이 음성인식, 음성 합성에서 널리 사용되어지고 있지만 음성전문가의 수작업 결과와 비교할 때 HMM 기반 자동음소분할은 오류가 있고, 이는 합성음 품질의 열화의 주요 원인이 되고 있다. 본 논문에서는 HMM 기반의 자동음소분할기를 사용하여 나타난 자동음소분할 결과와 수작업에 의한 음소분할 결과를 비교하고 유형별로 분석함으로써 음성합성의 성능향상을 위해 개선해야 할 문제점들을 제시한다. 실험에서는 ETRI의 표준형 한국어 공통 음성 DB을 사용하였고, 오차의 범위가 20ms를 벗어난 경우를 분절 오류로 간주하였다. 실험 결과 여성화자의 경우 파열음 + 모음, 파찰음 + 모음, 모음 + 유음 음소쌍에서는 각각 약 99%, 99.5%, 99%의 높은 정확률을 보인 반면, 폐쇄음 + 비음, 폐쇄음 + 유음, 비음 + 유음 음소쌍에서는 44.89%, 50%, 55% 의 낮은 정확률을 보였으며, 남성화자에 대한 실험결과에서도 유사한 경향을 보였다.
https://doi.org/10.7776/ASK.2006.25.5.213 인용 PDF KSCI

경직형과 불수의운동형 뇌성마비아동의 /아/ 모음 음향학적 비교 (A comparative study of the acoustic characteristics of the vowel /a/ between children with spastic and dyskinetic cerebral palsy)

정필연;심현섭
- 말소리와 음성과학
- /
- 제12권1호
- /
- pp.65-74
- /
- 2020
본 연구의 목적은 경직형과 불수의운동형 뇌성마비 아동의 음향학적 특성에서 차이가 있는지 알아보는 것이다. 연구대상은 만 4~12세의 뇌성마비 아동 34명이 참여하였다(경직형 26명, 불수의운동형 8명). 연구과제는 모음 '아' 연장발성하기이고, Praat을 사용하여 MPT, F0, Jitter, Shimmer, NHR과 F1, F2를 측정하였다. 두 유형 간 음향학적 차이를 알아보기 위해 두 독립표본 t-검정과 등분산가정이 충족되지 않는 경우 Welch-Aspin 검정을 사용하여 통계분석을 실시하였다. 연구결과, 첫째, 경직형 뇌성마비아동에 비해 불수의운동형에서 유의하게 낮은 MPT를 나타내었다. 둘째, Shimmer에서 불수의운동형의 측정치가 유의하게 높았다. 셋째, F1과 F2에서는 두 유형 간에 유의한 차이를 보이지 않았다. 이러한 결과는 경직형에 비해 불수의운동형의 호흡능력과 호흡조절능력이 더 제한적이고, 음성의 불안정성과 불규칙성도 더 많이 나타난다는 것을 시사한다. 본 연구의 결과는 뇌성마비 유형 간 말운동통제능력의 차이를 확인하고, 유형에 따른 중재계획을 수립하는데 필요한 정보를 제공해 줄 수 있을 것이다.
https://doi.org/10.13064/KSSS.2020.12.1.065 인용 PDF KSCI

언어자료 검색을 위한 계층구조형 형태소 분석 프로그램 (The Layered Structural Tagging Program for Seaching)

강용희
- 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
- /
- 한국정보과학회언어공학연구회 2001년도 제13회 한글 및 한국어 정보처리 학술대회
- /
- pp.89-96
- /
- 2001
1999년 제1회 형태소 분석기 및 품사태거 평가 워크숍 이후 표준안에 대한 새로운 대안이나 문제제기등을 제시한 논문은 전무하다. 본 연구에서는 평가대회 참가 이후 표준안을 수정한 새로운 유형의 형태소 분석 프로그램을 제작하여 그 실용성과 앞으로의 발전 가능성과 문제점을 밝혀, 계층구조형의 형태소분석 시스템을 채택하고 있는 일본의 JUMAN을 참조 새로운 유형의 형태소 분석형식을 제시한다. 본 연구는 일본방송협회 방송기술연구소(이하 NHK기술 연구소)의 의뢰에 인한 것이며 어절단위의 표준안과 다른 형태소 단위를 기본요소로 삼고 있으며 활용형을 갖고 있는 용언에 대해서는 활용형의 전개를 하고 있다. 어절단위로 탈피한 이유는 형태소 분석의 기본요소로써 어절단위 보다는 형태소 단위를 기준으로 삼는 것이 생산성이 높다고 생각된다. 어절정보와 문장정보는 XML(extensible makrup language)등의 별도의 정보를 주는 방법을 채택했다. 음절말음이 자음인지 모음인지의 음운 정보에 따라 활용형을 차별했으며 표준안과 달리 명사의 종류와 개념을 세분화했다. 아울러 조사와 어미등의 검색어와 함께 음절을 형성하고 있는 비검색어 대상은 배제하는 프로그램과 표준안의 어절방식으로 출력하는 3가지 프로그램을 작성했다. 본 연구에서는 계층구조의 형태소분석 프로그램의 가능성과 한국어의 특성을 고려한 출력항목등을 고찰하는 것을 목적으로 한다.
PDF

감사데이터 분석을 위한 마이닝 시스템 설계 및 구현 (Design and Implementation of Mining System for Audit Data Analysis)

김은희;문호성;신문선;류근호;김기영
- 한국정보과학회:학술대회논문집
- /
- 한국정보과학회 2002년도 가을 학술발표논문집 Vol.29 No.2 (1)
- /
- pp.4-6
- /
- 2002
네트워크의 광역화와 새로운 공격 유형의 발생으로 침입 탐지 시스템에서 새로운 시퀀스의 추가나 침입탐지 모델 구축의 수동적인 접근부분이 문제가 되고 있다. 특히 기존의 침입탐지 시스템들은 대량의 네트워크 하부구조를 가진 네트워크 정보를 수집 및 분석하는데 있어 각각 전담 시스템들이 담당하고 있다. 따라서 침입탐지 시스템에서 증가하는 많은 양의 감사데이터를 분석하여 다양한 공격 유형들에 대해서 능동적으로 대처할 수 있도록 하는 것이 필요하다. 최근, 침입 탐지 시스템에 데이터 마이닝 기법을 적용하여 능동적인 침입탐지시스템을 구축하고자 하는 연구들이 활발히 이루어지고 있다. 이 논문에서는 대량의 감사 데이터를 정확하고 효율적으로 분석하기 위한 마이닝 시스템을 설계하고 구현한다. 감사데이터는 트랜잭션데이터베이스와는 다른 특성을 가지는 데이터이므로 이를 고려한 마이닝 시스템을 설계하였다. 구현된 마이닝 시스템은 연관규칙 기법을 이용하여 감사데이터 속성간의 연관성을 탐사하고, 빈발 에피소드 기법을 적용하여 주어진 시간 내에서 상호 연관성 있게 발생한 이벤트들을 모음으로써 연속적인 시간간격 내에서 빈번하게 발생하는 사건들의 발견과 알려진 사건에서 시퀀스의 행동을 예측하거나 기술할 수 있는 규칙을 생성한 수 있다. 감사데이터의 마이닝 결과 생성된 규칙들은 능동적인 보안정책을 구축하는데 활용필 수 있다. 또한 데이터양의 감소로 침입 탐지시간을 최소화하는데도 기여한 것이다.
PDF

한국어 자음군의 후행모음에 나타난 발성유형의 음향음성학적 연구 (An Acoustic Study of Phonation Types in Vowels Following Consonant Clusters in Korean)

박한상
- 대한음성학회지:말소리
- /
- 제64호
- /
- pp.53-76
- /
- 2007
This study investigates phonation types of Korean obstruents associated with the vowels immediately following singletons or geminates in intervocalic positions. F0, H1-H2, and spectral tilt were measured from the 20 ms segment at the onset of the vowels for the tokens of /paCa/ and /paCCa/, where Cs are of the same manner and place of articulation. The results showed a remarkable change in the values of F0, H1-H2, and spectral tilt as the preceding obstruents shifts from the lenis singletons to the lenis geminates, which suggests that the spectral characteristics of the vowels following the lenis geminates are not different from those of the vowels following fortis singletons or geminates. Significantly enough, this study adds data about the spectral characteristics of Korean phonation types.
PDF

셀들의 군집 정보를 이용한 한글 문자 인식률 향상 기법 연구 (Improving Korean Character Recognition Rate based on the Cell Clustering Information)

신우준;고윤식;임영택;윤영수;박희완
- 한국정보처리학회:학술대회논문집
- /
- 한국정보처리학회 2015년도 춘계학술발표대회
- /
- pp.810-812
- /
- 2015
문자인식 즉 OCR(Optical Character Recognition)기술은 광학적으로 인식할 수 있는 문자를 컴퓨터가 읽을 수 있도록 하는 기술을 뜻한다. 문자인식의 근간이 되는 방법은 스트링 매칭 기법이 사용되어 왔지만 한글의 경우 자음, 모음, 자음 조합으로 만 가지 유형이 넘고, 더욱이 상용한자와 영어를 섞어 쓰기 때문에 오인식되는 경우가 많다. 본 논문에서는 한글이 수직선, 수평선, 사선과 같이 방향성이 강한 선소들로 구성되어 있다는 점을 이용하여 한글의 인식률을 높이는 방법을 제안하였다.
https://doi.org/10.3745/PKIPS.y2015m04a.810 인용 PDF

한글 모음의 구조적 특징을 이용한 문자영역 검출 기법 (Character Region Detection Using Structural Features of Hangul Vowel)

박종천;이근왕;박형근
- 한국산학기술학회논문지
- /
- 제13권2호
- /
- pp.872-877
- /
- 2012
본 논문은 한글 모음의 구조적 특징을 이용하여 자연영상에 포함된 한글 문자영역을 검출하는 기법을 제안하였다. 자연 영상을 명도영상으로 변환하고 에지 및 연결요소 기반 방법으로 특징값을 추출하며, 추출된 특징값은 필터링을 수행하여 한글 문자의 특징에 맞지 않는 특징값을 제거하여 한글 문자영역 병합을 위한 후보를 선정한다. 선정된 후보 특징값은 한글 자소 병합 알고리즘으로 하나의 문자로 병합하여 후보 문자영역으로 검출하고, 한글 문자 유형 판별 알고리즘으로 한글 문자영역 여부를 판별함으로서 최종적인 한글 문자영역을 검출한다. 실험결과, 복잡한 배경을 갖고 다양한 환경에서 촬영된 영상에서 한글 문자영역을 효과적으로 검출하였고, 제안한 문자영역 검출 방법은 향상된 검출 결과를 보여 주었다.
https://doi.org/10.5762/KAIS.2012.13.2.872 인용 PDF KSCI

경계선 기울기 방법을 이용한 다양한 인쇄체 한글의 인식 (Recognition of Various Printed Hangul Images by using the Boundary Tracing Technique)

백승복;강순대;손영선
- 한국지능시스템학회논문지
- /
- 제13권1호
- /
- pp.1-5
- /
- 2003
본 논문에서는 CCD 흑백 카메라를 이용하여 입력되는 인쇄체 한글 이미지의 문자를 인식하여 편집 가능한 텍스트 문서로 변환하는 시스템을 구현하였다 문자 인식에 있어서 잡음에 강한 경계선 기울기 방법을 이용함으로써 문자의 구조적 특성에 근거한 윤곽선 정보를 추출할 수 있었다. 이를 이용하여 각 문자 이미지의 수평 및 수직 모음을 인지하고 6가지 유형으로 분류한 후, 자소 단위로 분리하고 최대 길이 투영을 사용하여 모음을 인식하였다. 분리된 자음은 경계선이 변화되는 위상의 형태를 미리 저장된 표준 패턴과 비교하여 인식하였다. 인식된 문자는 KS 한글 완성형 코드로 문서 편집기에 출력되어 사용자에게 제공되는 시스템을 구현하였다.
https://doi.org/10.5391/JKIIS.2003.13.1.001 인용 PDF KSCI

아랍어권 학습자들에 의한 프랑스어 발음 오류의 유형 분류와 개선 방안: Younes의 논문을 중심으로 (Analysis of the typology of errors in French's pronunciation by Arabs and proposition for the phonetic correction: Based on the Younes's research paper)

정일영
- 비교문화연구
- /
- 제27권
- /
- pp.7-29
- /
- 2012
This study was aimed to analyze - focusing on the thesis of Younes - the pronunciation error occuring mostly for Arabian speakers to learn French pronunciation for Arabians and to suggest the effective study plan to improve such errors and provide the effective studying method. The first part is on how the Arabic and French pronunciation system are distinguished, especially by comparing and analyzing the system of graphemes and phonemes, with which we focused on the fact that Arabian is a language centralized on consonants, while French is a verb-centered language. In the second part, we mainly discussed the cause and the types of errors occurring when Arabic speakers study French pronunciation. As of the category of mistakes, we separated them into consonants and verbs. We assumed the possible method which can be used in learning, focusing on /b/, /v/, /p/, /b/ - in case of non-verbs and consonants - and /y/, /ø/, - in case of verbs - which don't exist in Arabic pronunciation system. One of the troubles the professors in Arabian culture have in teaching French to native learners is how to solve the problem on a phonetic basis regarding speaking and reading ability, which belong to verbal skill, among the critical factors of foreign language education, which are listening, speaking, reading, and writing skills. In fact, the problems occuring in learning foreign language are had by not only Arabian learners but also general groups of people who learn the foreign language, the pronunciation system of which is distinctly distinguished from their mother tongue. The important fact professors should recognize regarding study of pronunciation is that they should encourage the learners to reach the acceptable level in proper communication rather than push them to have the same ability as the native speakers, Even though it cannot be said that the methods suggested in this study have absolute influence in reducing errors when learning French pronunciation system, I hope it can be at least a small help.

제 2언어 학습자의 한국어 리듬 실현양상 -중국인 한국어 학습자를 중심으로- (Aspects of Korean rhythm realization by second language learners: Focusing on Chinese learners of Korean)

윤영숙
- 말소리와 음성과학
- /
- 제15권3호
- /
- pp.27-35
- /
- 2023
본 연구에서는 중국인 한국어학습자들의 한국어 낭독발화에서 나타나는 리듬의 변화양상을 한국어 모국어화자와의 비교를 통해 분석하였다. 그리고 이를 통해 모국어화자와 구별되는 리듬의 물리적 속성을 고찰하여 목표어의 리듬 습득과정에서 나타나는 중국인학습자들의 발화 특성을 고찰하고자 하였다. 한국어와 중국어는 리듬 유형론적으로 다른 범주에 속한다. 일반적으로 한국어는 음절박자언어와 강세박자언어의 모습을 모두 보이는 것으로 알려져 있으며 중국어는 음절박자언어로 분류된다. 두 언어는 음절구조, 어휘강세나 모음약화 현상의 부재 등 음운론적으로 유사한 특성을 보이지만 세부적인 차이도 존재한다. 이런 맥락에서 본다면 한국어 리듬 실현에서 모국어인 중국어의 긍정적 전이와 부정적 전이가 모두 나타날 수 있을 것이다. 본 연구에서는 표준어를 구사하는 한국어 원어민화자 5명과 한국어 숙달도 고급 수준의 중국인한국어학습자 10명이 발화문을 녹음하여 분석하였다. 분석자료는 다섯 문장으로 구성된 한 단락의 담화이다. 중국인 한국어학습자들의 한국어 리듬구조를 파악하기 위해 %V, VarcoV, nPVI_V, nPVI_S값을 측정하였다. 측정결과 %V와 VarcoV의 값에서 두 그룹은 모두 음절박자언어의 특성을 보였다. 그러나 중국인학습자들은 한국화자와는 유의미한 차이로 낮은 %V와 높은 VarcoV를 보여 보다 강세박자언어에 가까운 리듬구조를 보였다. nPVI_S값에서는 유사한 면이 관찰되었으나 nPVI_V에서 두 그룹 간 유의미한 차이가 나타났다. 두 그룹에서 나타난 리듬구조의 차이는 무엇보다 모음 길이의 변동의 차이로 귀속될 수 있고 그 원인은 중국어에 존재하는 모음 위계의 차이에서 비롯되는 것으로 판단되었다. 이러한 모국어의 발화습관이 한국어 리듬구조에 영향을 미쳐 보다 강세박자언에 가까운 속성을 보이며 이로 인해 한국어 모국어 화자와 다른 청지각적 리듬 차이를 유발한다고 할 수 있다.
https://doi.org/10.13064/KSSS.2023.15.3.027 인용 PDF

검색결과 39건 처리시간 0.023초

이메일무단수집거부

이용약관

제 1 장 총칙

제 2 장 이용계약의 체결

제 3 장 계약 당사자의 의무

제 4 장 서비스의 이용

제 5 장 계약 해지 및 이용 제한

제 6 장 손해배상 및 기타사항

자세히 찾기

이미지 검색 (β)