• Title/Summary/Keyword: 음성자료

Search Result 489, Processing Time 0.027 seconds

음질(Voice Quality)에 관한 청지각적 훈련자료개발을 위한 기초연구

  • 심현섭
    • Proceedings of the KSLP Conference
    • /
    • 2003.11a
    • /
    • pp.198-199
    • /
    • 2003
  • 최근에 음성언어장애에 대한 언어치료사의 평가 및 치료 활동이 활발히 이루어지고 있으나, 음성평가 기준 및 치료 자료가 충분치 않은 것이 현실이다. 음성 평가를 실시할 때에도 각 치료실마다 음성 평가에 사용하는 장비가 달라 결과물의 해석에 다소 차이가 있으며, 또한 같은 장비를 사용함에도 불구하고 음성 자료를 수집하는 방법에 있어서 표준화된 절차 및 자료에 따라 평가를 하지 못하고 있는 실정이다. 이러한 표준화된 측정절차에 대한 요구는 개인적인 기준으로 좌우될 수 있는 주관적인 평가에서는 더욱 절실하다. 음성의 지각적 평가에서 중요한 측면 중에 하나는 음성의 질에 정확한 판단 및 이에 대한 자료공유 및 정보교환이다. 현재 음성의 질에 대한 측정평가를 위해 제일 많이 사용되고 있는 방법 중 하나가 GRBAS 방법이 간편하여 임상적으로 많이 사용하나 음성의 질에 대한 세밀한 평가를 하는 데는 한계가 있다. 따라서 본 연구에서는 음질을 평가하는데 있어서 자주 사용되는 음질 용어에 대한 우리말 용어를 통일의 필요성의 시급한 실정에 기초하여 이를 대표할 수 있는 음성샘플 자료의 구축마련을 위한 일종의 발제이다. 이러한 작업을 통해 각 음성 및 언어치료실에서 음성의 질에 대한 청지각적 평가에 공통 기준을 마련하고, 임상교육 적인 목적으로 청지각적 훈련 자료로 이용이 가능할 수 있으리라 사료된다. (중략)

  • PDF

음성합성을 위한 분절음 길이예측 모델링

  • 정현성
    • Proceedings of the KSLP Conference
    • /
    • 2003.11a
    • /
    • pp.236-236
    • /
    • 2003
  • 음성합성을 위한 운율연구는 실험음성학과 음성공학 분야에서 활발히 이루어져 왔고, 가시적인 성과도 거두어 왔다. 최근 운율의 자연성을 향상시키기 위한 노력은 corpus-based unit selection에서와 같이, 대단위 음성자료에 의존하게 되면서 급격한 자연성의 향상을 가져온 것이 사실이지만, 여전히 새로 주어진 자료에 대해서 부자연스러운 운율을 극복해야 한다는 과제를 안고 있다. 이 논문은 길이, 억양, 에너지 등의 운율요소 가운데, 우선적으로 분절음의 길이에 초점을 두고, 대규모 음성자료를 바탕으로 한 자료기반형 길이예측모델을 지양하고 언어학적 지식과 언어자질을 이용한 지식기반형 길이예측모델을 제시하고자 한다. 모델링을 위한 방법으로는, 기본적으로 자료기반형 모델링 기법이지만 언어자질을 이용한 길이예측이 가능한 Classification and Regression Tree (CART) 모델링과 전통적인 지식기반형 모델링인 sequential rule systems을 확대시킨 Sums-of-Products 모델링을 사용한다. (중략)

  • PDF

A LECTURE SEARCH SYSTEM USING RELEVANT INFORMATION AND SPEECH TRANSCRIPTION (보조 자료와 음성 전사를 사용한 강의 검색 시스템)

  • Lee, Donghyeon;Lee, Gary Geunbae
    • Annual Conference on Human and Language Technology
    • /
    • 2008.10a
    • /
    • pp.140-144
    • /
    • 2008
  • 음성 오디오 검색 시스템을 구축하기 위해서는 몇 가지 과정이 필요하다. 첫 번째 과정이 음성 인식기를 이용하여 음성 오디오를 텍스트 형태로 표현하는 것이다. 하지만, 음성 인식기에서 수반되는 음성 인식 오류를 피할 수는 없다. 음성 인식 오류를 최소화하기 위해서 음성 인식 출력의 lattice를 색인(index)해야 하는데, 보다 효과적인 처리를 위하여 압축된 형태를 사용한다. 본 연구에서는 특별히 한국어 강의를 대상으로 검색 시스템을 구축했다. 강의에서는 특별히 관련된 자료를 쉽게 구할 수 있는 데, 이런 자료를 언어 모델에 이용하여 음성 인식 성능을 향상 시킬 수 있다. 또한, 강의 자료를 이용한 추가 색인 테이블(index table)을 생성하여 검색 성능 향상에 도움을 준다. 실험에서 고등학교 과정 수학 강의 동영상을 이용하여 자동화된 강의 검색 시스템을 구축하고, 보조 자료를 이용해 성능을 향상 시키는 것을 보인다.

  • PDF

Telephone Speech Recognition Using Laboratory Environment Speech Data (실험실 환경 음성을 이용한 전화음성 인식에 관한 연구)

  • 윤상호
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • 1994.06c
    • /
    • pp.391-394
    • /
    • 1994
  • 본 연구에서는 전화선을 통한 음성인식을 위해 저잡음의 실험실 환경에서 수집된 음성 자료를 이용하는 접근을 하였다. 전화 음성과 실험실 음성 간의 특성 차이를 보정하기 위해 선형 회귀 분석법을 이용한 SDCN을 제안하였다. 두 자료간의 보정은 동시 녹음된 실험실 환경의 음성과 전화음성의 SNRDP 따른 두 자료간의 차이를 최소화하는 변환행렬을 구해, 이를 학습자료의 변환에 이용한다. 제안된 방법의 타당성을 확인하기 위해 두가지 인식 알고리즘인 DTW와 이산 HMM 에 대해 실험하였다. DTW를 통한 인식에서개선된 SDCN 에 의한 특징벡터의 변환은 기존의 SDCNDP 따른 특징변환보다 8~17%의 인식률이 향상되었다. 이산 HMM으로 인식할 때는 개선된 SDCNDP 의한 전화음성과 실험실 음성과의 유사도를 보다 잘 나타내기 위해 개선된 SDCN을 적용하고, VQ 코드열 상에서이 코드 사상법을 사용하여 인식률의 향상시켰다.

  • PDF

음성연구와 음성데이타베이스

  • 이용주;김봉완
    • Proceedings of the KSPS conference
    • /
    • 1996.02a
    • /
    • pp.115-124
    • /
    • 1996
  • 우리말의 음성언어학적, 공학적, 의학적 연구를 위해서는 체계적으로 수집, 정리 된 다양한 음성자료가 필수적이다. 본고에서는 음성언어의 연구대상자료인 음성데이타베이스에 관하여 관련분야에서의 구축필요성, 체계적인 구축을 위한 기술적인 고려사항 등에 대하여 논한다. 또한 공학적인 응용을 위해 각 기관별로 구축된 음성DB의 현황을 정리하고, 특히 공동이용을 목적으로 하여 국어공학센터에서 추진중인 음성데이타베이스의 구축현황을 상세히 소개한다.

  • PDF

Design and implementation of workbench for spoken language data acquisition (음성 언어 자료 확보를 위한 Workbench의 설계 및 구현)

  • 김태환
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • 1998.08a
    • /
    • pp.375-379
    • /
    • 1998
  • 음성 언어 자료의 확보 및 활용을 위해서는 다양한 소프트웨어의 도움이 필요하다. 본 논문에서는 본 연구실에서 설계 및 개발한 PC용 Workbench에 대하여 기술한다. Workbench는 음성 언어 자료의 확보를 위한 텍스트 처리 모듈들과 음성 데이터의 처리를 위한 신호처리 모듈들로 구성되어 있다. Workbench에 포함된 모듈로는 텍스트를 자동 읽기 변환하는 철자 음운 변환기, 발성 목록 선정 모듈, 끝점 검출기를 이용한 음성 데이터 편집 모듈, 끝점 검출기를 이용한 음성 데이터 편집 모듈, 다단계 레이블링 시스템, 텍스트에서 원하는 음운 환경을 포함하고 있는 문자열을 다양한 조건으로 검색할 수 있는 음운 환경 검색기를 포함하고 있다.

  • PDF

A study on the vocal characteristics of spoken emotional expressions (구어체 정서표현에 있어서의 음성 특성 연구)

  • 이수정;김명재;김정수
    • Science of Emotion and Sensibility
    • /
    • v.2 no.2
    • /
    • pp.53-66
    • /
    • 1999
  • 현 연구에서는 음성합성의 기초자료 수집을 위하여 대화체 감정표현의 음성적인 패러미터를 찾아내려고 시도하였다. 이를 이하여 일단 가장 자주 사용되는 대화체 감정표현자료가 수집되었고 이들 표현을 발화할 때 가장 주의를 기울이는 발성의 특징들이 탐색되었다. 구어체적 감정표현의 타당한 데이터베이스를 작성하기 위하여 20대와 30대로 연령층을 구분하여 자료를 수집, 분석하였다. 그 결과 다양한 감정표현의 발화특성들은 음의 강도, 강도변화, 그리고 음색이 중요한 기준으로 작용하는 것으로 나타났다. 다차원분석 결과 산출된 20대와 30대의 음성표현이 도면은 개별정서들이 음성의 잠재차원 상에서 상당한 일관된 특징을 지님을 보여 주었다.

  • PDF

A study on the vocal characteristics of spoken emotional expressions (구어체 정서표현에 있어서의 음성 특성 연구)

  • 이수정
    • Proceedings of the Korean Society for Emotion and Sensibility Conference
    • /
    • 1999.11a
    • /
    • pp.277-291
    • /
    • 1999
  • 현 연구에서는 음성합성의 기초자료 수집을 위하여 대화체 감정표현의 음성적인 패러미터를 찾아내려고 시도하였다. 이를 위하여 일단 가장 자주 사용되는 대화체 감정 표현자료가 수집되었고 이들 표현을 발화할 때 가장 주의를 기울이는 발성의 특징들이 탐색되었다. 구어체적 감정표현의 타당한 데이타베이스를 작성하기 위하여 20대와 30로 연령층을 구분하여 자료를 수집, 분석하였다. 그 결과 다양한 감정표현의 발화특성들은 음의 강도, 강도변화, 그리고 음색이 중요한 기준으로 작용하는 것으로 나타났다. 다차원 분석 결과 산출된 20대와 30대의 음성표현의 도면은 개별정서들이 음성의 잠재차원 상에서 상당한 일관된 특징을 지님을 보여 주었다.

  • PDF

Current Status of Speech Database at ETRI (ETRI의 음성데이타베이스 구축현황)

  • 이영직
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • 1995.06a
    • /
    • pp.265-271
    • /
    • 1995
  • 한국전자통신연구소의 음성 데이터베이스 구축 현황을 기술한다. 현재 한국전자통신연구소에서는 음성인식 연구를 위해 단어음성, 정형 문장 음성 등의 데이터베이스를 구축, 보유하고 있다. 음성인식용 데이터베이스는 정해진 단어, 분장을 20명 내지 100명이 발성한 것으로, 일부는 음소 단위까지 레이블링이 되어 있다. 또 음성합성 연구를 위해 합성단위 및 운율데이타베이스를 가지고 있는데 이는 한 명 혹은 남녀 각각 3명이 발성한 것으로, 일부는 피치 등이 수록되어 있다. 문장 데이터베이스는 언어 정보처리를 위해 교재, 문학, 경제, 과학 분야의 문장을 총 480만 어절 가지고 있으며, 이 중 일부에 품사 정보를 추가하였다. 한국전자통신연구소는 국내 음성 연구의 발전에 기여하고자 음성 연구의 기반 자료가 되는 음성 데이터베이스를 국내 대학 및 산업체에 배포하고 있다 음성 데이터베이스는 음성 연구의 기반이 되는 자료임에도 불구하고 많은 비용과 노력이 들어 일반 대학에서는 쉽게 만들 수 없었다. 이에 ETRI는 한국통신이 출연한 "자동통역 요소기술개발" 과제으 LQNTKSANF인 여러 종류의 음성 데이터베이스와 관련 프로그램을 공급하여 국내 음성 연구의 기반 확립에 기여하고자 한다. 기여하고자 한다.

  • PDF

과학교육정보 DB 구축-Science Education Inventory System

  • Kim, Do-Han
    • Journal of Scientific & Technological Knowledge Infrastructure
    • /
    • s.5
    • /
    • pp.62-66
    • /
    • 2001
  • 대중을 대상으로 한 과학정보의 연계체계를 구축하면서 과학분야별, 기관단체별 보유 과학대중화 자료(문헌, 영상, 음성자료)를 조사 및 목록화하고 한국과학문화재단 보유 자료를 포함한 각 기관-단체 발간 문헌자료를 디지털화 시키면서, 기존의 TEXT 위주의 DB에서 사용자가 보다 쉽고 친숙하게 정보를 이용할 수 있도록 DB를 멀티미디어화하여 구축 하므로써 기존의 TEXT 위주의RDB를 택하지 않고, ORDB를 지원하는DBMS중 개발과 운영 및 타DB와 호환이 용이한 DBMS를 도입함으로써 과학분야별로 일반인이 이해하기 쉬운 형태의 자료(텍스트 및 디지털 영상, 음성, 애니메이션, 가상실험등)를 활용한 분야 소개 정보를 구축했다.

  • PDF