통합 검색 | Korea Science

한글 TTS시스템에서 형태 음운론적 분석에 기반 한 발음열 생성 (Pronunciation Generation Based on Morphophonological Analysis in Korean TTS)

정경석;박혁로
- 한국정보처리학회:학술대회논문집
- /
- 한국정보처리학회 2001년도 추계학술발표논문집 (상)
- /
- pp.559-562
- /
- 2001
한국어 TTS시스템에서 한 가지 모듈로써의 발음열 생성기는 한국어의 특성상 음운적 조건과 형태론적 조건 등에 의해 다양한 방법과 예외처리를 요구하고 한국어의 음운현상에 대한 체계적인 분석과 처리가 필요하다. 그래서 이 논문은 형태 음운론적 분석을 통한 발음열 자동 생성기법을 소개한다. 이 시스템은 형태소 분석을 선행한 후, 특수문자나 숫자 등을 정규화하고 복합명사 분해 사전을 이용한 복합명사 분해와 추가 조건을 통해 ㄴ-첨가 규칙을 전 처리한다. 그리고 음운 변화 현상을 분석하여 선택적으로 규칙을 적용하여 발음열을 생성한다. 제안된 시스템은 기존의 형태소 분석되지 않은 시스템에 비해 더욱 효과적인 음운, 형태소 변화를 가져옴과 함께, 특히 ㄴ-첨가가 적용되는 텍스트는 7$\sim$8%정도의 나은 발음열을 생성찬 수 있었다. 그 결과, 발음열 생성기는 한국어 TTS 시스템의 한국어 처리라는 고질적인 문제 해결에 좋은 방향과 결과를 기여할 수 있다.
PDF

최소 형태소 정보를 이용한 자동 발음열 생성 시스템 (Automatic Pronunciation Generation System Using Minimum Morpheme Information)

김선희;안주은;김순협
- 한국멀티미디어학회:학술대회논문집
- /
- 한국멀티미디어학회 2003년도 추계학술발표대회(상)
- /
- pp.216-219
- /
- 2003
본 논문은 최소한의 형태소 정보를 이용한 자동 발음열 생성 시스템을 제안한다 일반적으로 발음열 생성 시스템은 입력된 문장에 대하여 형태소 단위로 분석한 다음, 각 형태소와 형태소의 결함 관계를 고려한 음운 규칙을 적용함으로써 상응하는 발음열을 생성한다. 지금까지의 연구는 이러한 발음열 생성시의 형태소 분석에 관하여 그 범위에 관한 연구 없이, 가능한 최대한의 분석을 상정하고 있다. 본 논문은 한국어 음운현상을 체계적인 텍스트 분석을 통하여 모든 형태론적 음운론적인 환경에서 가능한 모든 음운현상을 분류하여 발음열 생성시에 실제로 필요한 형태소 분석의 범위를 규명하는 것을 그 목적으로 한다. 음운 현상을 분석하기 위해 사용한 텍스트 자료로는 어휘가 중복되지 않으면서도 많은 종류의 어휘가 수록된 5만 여 어휘의 연세한국어사전과 2200 여 개의 어미와 조사를 수록한 어미조사사전을 이용하였다. 이와 같이 텍스트를 분석한 결과, 음운현상은 규칙적인 음운 현상과 불규칙적인 음운현상으로 나뉘는데, 이 가운데 형태소 정보가 필요한 형태음운규칙으로는 두 가지가 있으며, 이러한 형태음운규칙을 위한 형태소 분석의 범위로는 세세한 분류를 필요로 하지 않는 최소한의 정보로 가능함을 보인다. 이러한 체계적인 분석을 기반으로 제안하는 자동 발음열 생성 시스템은 형태음운규칙과 예외규칙, 그리고 일반음운 규칙으로 구성된다. 본 시스템에 대한 성능 실험은 PBS 1637 어절과 ETRI 텍스트 DB 19만 여 어절을 이용하여 99.9%의 성능결과를 얻었다.
PDF

한국어 연속음성인식을 위한 발음사전 구축 (Pronunciation Dictionary For Continuous Speech Recognition)

이경님;정민화
- 한국정보과학회:학술대회논문집
- /
- 한국정보과학회 2000년도 가을 학술발표논문집 Vol.27 No.2 (2)
- /
- pp.197-199
- /
- 2000
연속음성인식을 수행하기 위해서는 발음사전과 언어모델이 필요하다. 이 둘 사이에는 디코딩 단위가 일치하여야 하므로 발음사전 구축시 디코딩 단위로 표제어 단위를 선정하며 표제어 사이의 음운변화 현상을 반영한 발음사전을 구축하여야 한다. 한국어에 부합하는 음운변화현상을 분석하여 학습용 자동 발음열을 생성하고, 이를 통하여 발음사전을 구축한다. 전처리 단계로 기호, 단위, 숫자 등 전처리 과정 및 형태소 분석 과정을 수행하며, 디코딩 단위인 의사 형태소 단위를 생성하기 위해 규칙을 이용한 태깅 과정을 거친다. 이를 통해 나온 결과를 발음열 생성기 입력으로 하며, 결과는 학습용 발음열 또는 발음사전 구성을 위한 형태로 출력한다. 표제어간 음운변화 현상이 반영된 상태의 표제어 단위이므로 실제 음운변화가 반영되지 않은 상태의 표제어와는 그 형태가 상이하다. 이는 연속 발음시 생기는 현상으로 실제 인식에는 이 음운변화 현상이 반영된 사전이 필요하게 된다. 생성된 발음사전의 효용성을 확인하기 위해 다음과 같은 실험을 통해 성능을 평가하였다. 음향학습을 위하여 PBS(Phonetically Balanced Sentence) 낭독체 17200문장을 녹음하고 그 전사파일을 사용하여 학습을 수행하였고, 발음사전의 평가를 위하여 이 중 각각 3100문장을 사용하여 다음과 같은 실험을 수행하였다. 형태소 태그정보를 이용하여 표제어간 음운변화 현상을 반영한 최적의 발음사전과 다중 발음사전, 언어학적 기준에 의한 수작업으로 생성한 표준 발음사전, 그리고 표제어간의 음운변화 현상을 고려하지 않고 독립된 단어로 생성한 발음사전과의 비교 실험을 수행하였다. 실험결과 표제어간 음운변화 현상을 반영하지 않은 경우 단어 인식률이 43.21%인 반면 표제어간 음운변화 현상을 반영한 1-Best 사전의 경우 48.99%, Multi 사전의 경우 50.19%로 인식률이 5~6%정도 향상되었음을 볼 수 있었고, 수작업에 의한 표준발음사전의 단어 인식률 45.90% 보다도 약 3~4% 좋은 성능을 보였다.
PDF

일본인 화자의 한국어 모음 발음에 대한 음향음성학적인 연구

조성문;오오까와다이스께
- 대한음성언어의학회:학술대회논문집
- /
- 대한음성언어의학회 2003년도 제19회 학술대회
- /
- pp.141-141
- /
- 2003
발음 교육은 의사소통적 교수법을 중시하는 최근의 언어 교육에서 약간 소홀히 다루어져 왔다. 그러나 외국어로서의 한국어 교육에서 정확한 발음 교육은 의사소통을 위해서 매우 중요한 역할을 한다고 볼 수 있다. 아무리 한국어 어휘와 문법을 정확하게 표현한다고 해도 잘못된 발음을 한다면 가장 기본적인 것에서 오류를 범하게 되기 때문이다. 다만 지금까지 일본인의 한국어 발음 오류에 대해서 조음음성학적이나 음운론적으로 어느 정도 연구가 되어 있다. 그러나 그 연구 결과들은 추상적인 단계에 머물러 있어서 아직까지 일본인의 한국어 모음 발음 문제를 명확하게 분석해 내지 못하고 있다. (중략)
PDF

한국어 표준 발음 IPA 변환기 (IPA Converter of Korean Standard Pronunciation)

이은정;강미영;윤애선;권혁철
- 한국인지과학회:학술대회논문집
- /
- 한국인지과학회 2005년도 춘계학술대회
- /
- pp.206-211
- /
- 2005
한국어의 발음은 형태${\cdot}$음운론적 환경에 따라 다양하게 변화하므로 혼란을 일으키는 경우가 많다. 이에 표준발음법을 바탕으로 올바른 발음을 제시하는 한국어 표준 발음 변환기를 구현한다. 특히 본 논문에서는 세계적으로 널리 쓰이는 IPA를 활용하여 발음열을 생성해, 한국어 발음의 미세한 차이까지 표기하고, 모국어 화자뿐만 아니라 외국인 학습자들도 대상으로 하기에 적합하도록 하였다. 형태소 분석 정보, 어절 간 영향 정보 등을 활용하여 발음열 생성하였고. 발음열 생성 정확도는 98.09%였다.
PDF

한국어 통합 교재에 나타난 발음 내용의 비교 분석 (Comparative Analysis on Pronunciation Contents in Korean Integrated Textbooks)

박은하
- 한국콘텐츠학회논문지
- /
- 제18권4호
- /
- pp.268-278
- /
- 2018
본 연구는 한국어 통합 교재를 대상으로 발음 교육의 내용이라고 볼 수 있는 교재에 나오는 음운 체계, 음운 규칙, 발음 기술 및 표기, 그리고 발음 연습 등의 발음 항목들을 비교 분석하는 데에 그 목적이 있다. 또한 분석 결과를 통해 드러난 문제점을 지적하고 이를 위한 개선 방향을 제언하고자 한다. 분석 결과로 나온 발음 내용의 문제점과 개선 방향을 나타내보면, 음운 체계에서는 자음과 모음의 제시 순서가 교재마다 다르게 나타났다. 이를 위해서는 자모의 제시 순서에 대한 표준안이 마련되어야 하는데 교수 가능성 및 학습 용이성은 물론이고 교재 및 학습 목적을 고려해서 표준안을 구성해야 한다. 그리고 음운 체계의 제시방법에서 의사소통 관점과 한국어 억양의 기능을 고려했을 때 억양의 의미와 기능에 대한 기술을 제시할 필요가 있다. 두 번째, 음운 규칙에서도 음운 체계와 마찬가지로 제시 순서가 교재마다 다르게 나왔는데 제시 순서를 정해야 하며 어떤 음운 규칙을 교재에 제시할 것인지가 선행되어야 한다. 음운 규칙을 설명할 때 용어 사용은 가능한 한 하지 않고 필수적이고 공통적인 내용을 기술하도록 해야 한다. 마지막으로, 발음내용의 기타 사항에서는 발음을 위한 예를 단어로 제시하는 점과 다양한 연습문제가 없는 점 등을 문제점으로 지적하였다. 발음 교육을 위해서는 문장이나 대화문으로 제시하고 발음 연습을 위해 다양한 연습과 다른 언어 기능과 연계할 것을 제안하였다.
https://doi.org/10.5392/JKCA.2018.18.04.268 인용 PDF KSCI

구개열 환자 발음 판별을 위한 특징 추출 방법 분석 (Analysis of Feature Extraction Methods for Distinguishing the Speech of Cleft Palate Patients)

김성민;김우일;권택균;성명훈;성미영
- 정보과학회 논문지
- /
- 제42권11호
- /
- pp.1372-1379
- /
- 2015
본 논문에서는 구개열 환자의 장애 발음과 정상인의 발음을 자동으로 구분하여 판별하는데 사용될 수 있는 특징 추출 방법들의 성능을 분석하는 실험에 대하여 소개한다. 이 연구는 발성 장애인의 복지 향상을 추구하며 수행하고 있는 장애 음성 자동 인식 및 복원 소프트웨어 시스템 개발의 기초과정이다. 실험에 사용된 음성 데이터는 정상인의 발음, 구개열 환자의 발음, 그리고 모의 환자의 발음의 세 그룹으로부터 수집된 한국어 단음절로서 14개의 기본 자음과 5개의 복합 자음, 7개 모음이다. 발음의 특징 추출은 LPCC, MFCC, PLP의 세 가지 방법으로 각각 수행하였고, GMM 음향 모델로 인식 훈련을 한 후, 수집된 단음절 데이터를 대상으로 하여 인식 실험을 실시하였다. 실험 결과, 정상인과 구개열 환자의 장애 발음을 구별하기 위하여 특징을 추출함에 있어서 MFCC 방법이 전반적으로 가장 우수하였다. 본 연구의 결과는 구개열 환자의 부정확한 발음을 자동으로 인식하고 복원하는 연구와 구개열 장애 발음의 정도를 측정할 수 있는 도구에 대한 연구에 도움이 될 것으로 기대된다.
https://doi.org/10.5626/JOK.2015.42.11.1372 인용 KSCI

한국어 연속음성 인식을 위한 발음열 자동 생성 (Automatic Generation of Pronunciation Variants for Korean Continuous Speech Recognition)

이경님;전재훈;정민화
- 한국음향학회지
- /
- 제20권2호
- /
- pp.35-43
- /
- 2001
음성 인식이나 음성 합성시 필요한 발음열을 수작업으로 작성할 경우 작성자의 음운변화 현상에 대한 전문적 언어지식을 비롯하여 많은 시간과 노력이 요구되며 일관성을 유지하기도 쉽지 않다. 또한 한국어의 음운 변화 현상은 단일 형태소의 내부와 복합어에서 결합된 형태소의 경계점, 여러 형태소가 결합해서 한 어절을 이룰 경우 그 어절 내부의 형태소의 경계점, 여러 어절이 한 어절을 이룰 때 구성 어절의 경계점에서 서로 다른 적용 양상을 보인다. 본 논문에서는 이러한 문제를 해결하기 위해서 형태음운론적 분석에 기반하여 문자열을 자동으로 발음열로 변환하는 발음 생성 시스템을 제안하였다. 이 시스템은 한국어에서 빈번하게 발생하는 음운변화 현상의 분석을 통해 정의된 음소 변동 규칙과 변이음 규칙을 다단계로 적용하여 가능한 모든 발음열을 생성한다. 각 음운변화 규칙을 포함하는 대표적인 언절 리스트를 이용하여 구성된 시스템의 안정성을 검증하였고, 발음사전 구성과 학습용 발음열의 유용성을 인식 실험을 통해 평가하였다. 그 결과 표제어 사이의 음운변화 현상을 반영한 발음사전의 경우 5-6％ 정도 나은 단어 인식률을 얻었으며, 생성된 발음열을 학습에 사용한 경우에서도 향상된 결과를 얻을 수 있었다.
PDF

한국인과 일본인의 /l/과 /r/ 발음: 발음에 어떤 요소가 영향을 미치는가\ulcorner (/l/ and /r/ production by Korean and Japanese speakers of English : What factors are influential for the production\ulcorner)

박시균
- 대한음성학회지:말소리
- /
- 제37호
- /
- pp.87-118
- /
- 1999
본 논문은 한국인과 일본인이 영어 유음 /l/과 /r/을 발음하는데 있어서 어떤 요소들이 가장 큰 영향을 미치는가를 알아보는데 중점을 두고 있다. Park & Ingram (1995)에서는 한국인과 일본인의 영어 발음인지(perception) 실험을 통해 동 문제에 대해 분석을 해보았는데 본 논문에서는 같은 주제를 발음 실험을 통해 그 해답을 찾고 있다. 실험의 결과는 언어 의존적인 요소인 모국어 음운 체계의 영향뿐만 아니라 언어 독립적인 요소인 화자(speaker), 유음이 나타나는 위치(position), 유음의 유형(type) 그리고 영어 유음을 발음하는 각 개인 등의 요소들이 모두 한국인과 일본인의 영어 유음 /l/과 /r/ 발음에 영향을 미치고 있음을 보여 주고 있다. 이는 인지 실험에서도 드러난 바로 인지와 발음은 서로 밀접한 관계를 맺고 기제가 일어나고 있음을 보여 준다.
PDF

Sequence-to-Sequence Model을 이용한 영어 발음 기호 자동 변환 (Automatic Conversion of English Pronunciation Using Sequence-to-Sequence Model)

이공주;최용석
- 정보처리학회논문지:소프트웨어 및 데이터공학
- /
- 제6권5호
- /
- pp.267-278
- /
- 2017
영어는 동일 철자의 발음이 매우 다양한 언어이기 때문에 사전에 기술되어 있는 단어의 발음기호를 읽어야만 정확한 발음을 알 수 있다. 영어 사전마다 사용하는 발음기호(phonetic alphabet) 시스템이 다르며 같은 단어에 대해 기술하고 있는 발음 역시 다르다. 본 연구에서는 최근 딥 러닝 분야에서 널리 사용되고 있는 sequence-to-sequence (seq2seq) model을 이용하여 사전마다 다른 발음을 자동으로 변환해 보고자 한다. 4가지 다른 종류의 사전에서 추출한 발음 데이터를 이용하여 모두 12개의 seq2seq model을 구현하였으며, 발음 자동 변환 모듈의 정확 일치율은 74.5% ~ 89.6%의 성능을 보였다. 본 연구의 주요 목적은 다음의 두 가지이다. 첫째 영어 발음기호 시스템과 각 사전의 발음 데이터 특성을 살펴보는 것이고, 둘째, 발음 정보의 자동 변환과 오류 분석을 통해 seq2seq model의 특성을 살펴보는 것이다.
https://doi.org/10.3745/KTSDE.2017.6.5.267 인용 PDF KSCI

검색결과 253건 처리시간 0.02초

이메일무단수집거부

이용약관

제 1 장 총칙

제 2 장 이용계약의 체결

제 3 장 계약 당사자의 의무

제 4 장 서비스의 이용

제 5 장 계약 해지 및 이용 제한

제 6 장 손해배상 및 기타사항

자세히 찾기

이미지 검색 (β)