• 제목/요약/키워드: 데이터 모델 평가

검색결과 2,530건 처리시간 0.034초

음성 인식에서 훈련 및 인식 과정에 사용되는 대상 어휘의 차이에 대한 음향 모델의 성능 평가 (Performance Evaluation of Acoustic Models According to Differences between Vocabularies in Training and Test Phases of Speech Recognition)

  • 김회린;이항섭;권오욱
    • 한국음향학회지
    • /
    • 제17권7호
    • /
    • pp.22-27
    • /
    • 1998
  • 본 논문에서는 ETRI에서 개발한 가변 어휘 음성 인식기의 어휘 독립 음향 모델링 방법을 기술하고, 이 모델의 어휘 종속, 어휘 독립 및 어휘적응 성능을 평가하기 위하여 다 양한 고립단어 및 연속음성 DB에 대하여 실험한 결과를 분석하였다. 평가를 위하여 사용한 음성 DB로는 고립단어 음성으로 POW(Phonetically Optimized Words) 3848, PBW(Phonetically Balanced Words) 445, PBW 452, 호텔예약 244 단어, 게임 제어용 단어 등이며, 연속음성으로 일반 문장 음성 및 연속 숫자음을 이용하였다. 성능 분석 결과 40개 음소 모델만으로도 비교적 높은 인식률을 보여 주었지만, 어휘독립의 경우는 어휘종속에 비 하여 성능이 크게 낮았고, 특히 대상 어휘가 숫자음, 알파벳, 연속음 등의 경우에는 POW 데이터나 PBW 데이터만 가지고는 우수한 가변 어휘 음성 인식기를 구현하기에 한계가 있 음을 알 수 있다. 또한, 훈련 데이터의 어휘와 평가데이터의 어휘가 비슷할 경우에는 변이음 모델을 사용하면 음소 모델만을 사용할 경우에 비하여 그 성능이 우수하였지만, 일반적인 어휘독립의 상황에서는 효과가 별로 없음을 알 수 있었다.

  • PDF

데이터 품질 평가에 관한 연구 (A Study of the Data Qualituy Evaluation)

  • 정혜정
    • 인터넷정보학회논문지
    • /
    • 제8권4호
    • /
    • pp.119-128
    • /
    • 2007
  • 본 연구는 데이터 품질 평가란 관점에서 현재 진행되어지고 있는 국제 표준 ISO/IEC 25000시리즈인 SQuaRE(Software Quality Requirements and Evaluation) 프로젝트 중에서도 ISO/IEC 25012의 데이터 품질 평가 모델에 대한 연구이다. 데이터의 양이 많아지면서 사용자 관점에서는 정확한 데이터, 최신의 데이터, 사용하는 도구에 적합한 데이터, 보안성과 비 공개성을 준수할 수 있는 데이터를 원한다. 저 품질의 데이터가 비즈니스에 미치는 영향을 평가하여 실제적으로 적용할 수 있는 관점에서 데이터 품질 관리에 대한 것을 연구한다. 이러한 관점에서 데이터에 대한 품질을 평가할 수 있는 평가항목을 제시하고 제시된 평가항목의 평가 방안에 대해서 제시한다. 본 연구는 현재 진행되어지고 있는 ISO/IEC 25012의 표준문서와 소프트웨어 품질관리 표준문서 ISO/IEC 9126-2를 기초로 하여 연구되었으며 현재 진행되어지고 있는 소프트웨어 품질평가 모델 ISO/IEC 2500을 기반으로 하여 데이터 품질을 정량적으로 평가하는 방안을 제시한다.

  • PDF

Reconstructability criterion을 통한 granular-based RBF NN의 최적화 (Optimization of granular-based RBF NN with the aid of reconstructability criterion)

  • 박호성;오성권
    • 대한전기학회:학술대회논문집
    • /
    • 대한전기학회 2009년도 제40회 하계학술대회
    • /
    • pp.1899_1900
    • /
    • 2009
  • 본 논문에서는 주어진 데이터의 입자화 특성을 효과적으로 모델 구축에 반영하고자 재구성 평가 기준을 통한 새로운 형태의 입자화 기반 RBF 뉴럴 네트워크를 개발한다. 주어진 데이터들의 입자화 특성을 파악하기 위해서 새로운 형태의 FCM 클러스터링(-Context-based fuzzy clustering)을 이용한다. 즉, 출력 공간의 입자화 특성은 K-means clustering 방법을 사용한 것에 반해, 입력 공간에서의 정보들은 Context-based fuzzy clustering 방법을 이용하여 효율적으로 데이터의 특성을 파악하여 모델의 구축에 반영하였으며, 또한 모델의 최적화를 위하여 RBF 뉴럴 네트워크의 은닉층의 수를 재구성 평가 기준을 통하여 모델의 최적화를 꾀하였다. 제안된 모델의 효율적인 특성을 보여주기 위해 저차원 합성 데이터를 이용하여 모델을 평가한다.

  • PDF

활동능력수준 기반의 공공데이터 품질관리 성숙수준 평가 모델 (Activity Capability Level-based Maturity Evaluation Model for Public Data Quality Management)

  • 김선호;이진우;이창수
    • 정보화정책
    • /
    • 제24권1호
    • /
    • pp.30-47
    • /
    • 2017
  • 정부는 공공데이터의 품질관리 수준을 평가하기 위해 국제표준을 기반으로 공공데이터 품질관리 조직 성숙도 모델을 개발하였다. 그러나 현장에 적용하기에는 평가항목이 너무 많다는 지적에 따라 평가지표 수를 축소한 새로운 모델을 보완 개발하였다. 이를 위하여 프로세스를 통합 및 조정하여 프로세스 수를 축소하였으며 프로세스능력수준이 아닌 새로운 활동능력수준 기반의 평가 방식을 제안하였다. 또한, 공공데이터 품질관리 성숙수준을 다섯 개의 레벨로 표현하는 방식과 1~5 사이의 실수로 표현하는 방식을 제안하였다. 그리고 새로 제안한 모델의 특성을 기존의 조직 성숙도 모델과 비교 분석하였다.

KommonGen: 한국어 생성 모델의 상식 추론 평가 데이터셋 (KommonGen: A Dataset for Korean Generative Commonsense Reasoning Evaluation)

  • 서재형;박찬준;문현석;어수경;강명훈;이승훈;임희석
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2021년도 제33회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.55-60
    • /
    • 2021
  • 최근 한국어에 대한 자연어 처리 연구는 딥러닝 기반의 자연어 이해 모델을 중심으로 각 모델의 성능에 대한 비교 분석과 평가가 활발하게 이루어지고 있다. 그러나 한국어 생성 모델에 대해서도 자연어 이해 영역의 하위 과제(e.g. 감정 분류, 문장 유사도 측정 등)에 대한 수행 능력만을 정량적으로 평가하여, 생성 모델의 한국어 문장 구성 능력이나 상식 추론 과정을 충분히 평가하지 못하고 있다. 또한 대부분의 생성 모델은 여전히 간단하고 일반적인 상식에 부합하는 자연스러운 문장을 생성하는 것에도 큰 어려움을 겪고 있기에 이를 해결하기 위한 개선 연구가 필요한 상황이다. 따라서 본 논문은 이러한 문제를 해결하기 위해 한국어 생성 모델이 일반 상식 추론 능력을 바탕으로 문장을 생성하도록 KommonGen 데이터셋을 제안한다. 그리고 KommonGen을 통해 한국어 생성 모델의 성능을 정량적으로 비교 분석할 수 있도록 평가 기준을 구성하고, 한국어 기반 자연어 생성 모델의 개선 방향을 제시하고자 한다.

  • PDF

경쟁우위적 관점에서의 데이터 웨어하우징 평가 및 정당화 (Assessment & Justification of Data Warehousing from A Competitive Advantage Perspective)

  • 박용태
    • 한국정보시스템학회지:정보시스템연구
    • /
    • 제16권1호
    • /
    • pp.65-90
    • /
    • 2007
  • 전통적인 비용수익 분석법 (CBA approach) 과 활동기준원가계산 방법 (ABC approach)과 같은 지금까지의 방법으로는 전략적 정보시스템이나 정보 하부구조를 효과적으로 평가하고 정당화하는데 한계가 있다고 지적되어왔다. 따라서, 본 논문은 정보시스템의 하부구조를 이루고 있는 데이터 웨어하우징을 스물여섯 개의 데이터 웨어하우징 성공사례 분석을 통해서 데이터 웨어하우징이 가치사슬 모델의 각 활동에 어떻게 활용되고 있는지를 분석하고, 경쟁우위적 관점에서 이들 사례들의 공통점을 찾아내어, 데이터 웨어하우징을 경쟁우위적 관점에서 보다 효과적으로 정당화할 수 있는 모델을 제시하고 있다. 이 모델은 기존의 정보시스템 정당화에 사용되어왔던 방법들의 단점을 보완하여, 기업들이 데이터 웨어하우징이나 경쟁우위를 확보하기 위해서 구축하는 다른 정보시스템들을 경쟁우위적 관점에서 정당화하고자 할 때 유용한 도구로써, 기존의 방법들과 병행해서 사용하면 보다 효과적으로 정보시스템들을 평가하고 정당화할 수 있으리라 생각된다.

  • PDF

빅데이터 분산처리시스템의 품질평가모델 (A Quality Evaluation Model for Distributed Processing Systems of Big Data)

  • 최승준;박제원;김종배;최재현
    • 디지털콘텐츠학회 논문지
    • /
    • 제15권4호
    • /
    • pp.533-545
    • /
    • 2014
  • IT기술이 발전함에 따라, 우리가 접하는 데이터의 양은 기하급수적으로 늘어나고 있다. 이처럼 방대한 데이터들을 분석하고 관리하기 위한 기술로 등장한 것이 빅데이터 분산처리시스템이다. 기존 분산처리시스템에 대한 품질평가는 정형 데이터 중심의 환경을 바탕으로 이루어져 왔다. 그러므로, 이를 비정형 데이터 분석이 핵심인 빅데이터 분산처리시스템에 그대로 적용시킬 경우, 정확한 품질평가가 이루어질 수 없다. 따라서, 빅데이터 분석 환경을 고려한 분산처리시스템의 품질평가모델에 대한 연구가 필요하다. 본 논문에서는 소프트웨어 품질에 관한 국제 표준인 ISO/IEC9126에 근거하여 빅데이터 분산처리 시스템에서 요구되는 품질평가 요소를 도출하고, 이를 측정하기 위한 메트릭을 정의함으로써 새로이 품질평가모델을 제안한다.

로지트 모델 시물레이션에 의한 도시교통안전계획에 관한 연구

  • 김용수;이근철
    • 한국안전학회지
    • /
    • 제4권1호
    • /
    • pp.103-120
    • /
    • 1989
  • 최근 도시교통계획분야에 있어서 교통수요의 예측모델 또는 교통정책의 평가 모델로서 비집계(非集計) 모델에 관한 연구가 진행되고 있다. 이 비집계모델은 개개의 의사결정단위에 있어서 선택행동을 영역마다 집계하는 것이 아니고 의사결정레벨의 데이터률 그대로 모델로 구성할 경우 이 데이터를 이용함으로써 의사결정단위의 선택행동을 모델화 할 수 있다는 특징을 갖고 있다. 한편 비집계모델의 사용목적은 여러가지로 생각되나 이것을 교통수요의 목적이나 교통정잭의 평가를 위한 모델로 이용할 때는 파라미터의 추정값이나 선택비율의 추정값에 대한 안정성이 매우 중요한 문제가 되고 있다.

  • PDF

입력자료 판별에 의한 데이터 마이닝의 성능개선 (Performance Improvement of data Mining by Input Data Discrimination)

  • 이재식;이진천
    • 한국지능정보시스템학회:학술대회논문집
    • /
    • 한국지능정보시스템학회 2000년도 춘계정기학술대회 e-Business를 위한 지능형 정보기술 / 한국지능정보시스템학회
    • /
    • pp.293-303
    • /
    • 2000
  • 데이터 마이닝의 수행 예측 오차를 줄이기 위한 방법으로 하나의 문제를 여러 기법들을 결합하여 해결하고 있다. 본 연구에서는 새로운 결합 모델을 제시하고 이를 통해 예측 오차를 감소시킬 수 있는 가능성을 제시한다. 제시된 결합모델의 성능을 검증하기 위해서 국내 자동차보험 회사의 고객데이터를 바탕으로 고객이탈 예측문제를 다루었다. 결합모델의 예측결과를 의사결정나무, 사례기반추론 그리고 인공신경망 중 하나의 기법만을 사용하여 예측한 결과와 비교 평가하였다. 평가 결과, 결합 모델의 예측 적중률이 개별 기법의 예측 적중률보다 우수했다.

  • PDF

도서관의 오픈 데이터 품질측정모델 개발 (Developing an Assessment Model of Library Open Data Quality)

  • 박진호
    • 정보관리학회지
    • /
    • 제35권1호
    • /
    • pp.33-59
    • /
    • 2018
  • 본 연구는 최근 열린 정부 데이터에 대한 다차원 척도, 모델 개발 연구가 시작되고 있으나, 도서관에서는 관련 연구가 부족하다는 점을 고려하여 도서관에 적용할 수 있는 오픈 데이터 품질측정 모델개발을 목적으로 하였다. 본 연구는 모델개발과 모델평가 두 단계로 수행하였다. 모델개발은 델파이 기법을 적용하였으며, 모델평가는 도서관 오픈 데이터 이용자를 대상으로 설문조사를 실시하여 모델의 타당도와 신뢰도를 측정하였다. 모델개발은 델파이 기법을 적용하여 총 4차례 수행하여 3개 차원, 18개 요인, 133개 측정요소로 구성된 모델을 도출하였다. 모델평가는 델파이 기법으로 완성한 모델을 도서관 오픈 데이터 이용자인 국내 외 사서, 개발자, 오픈 데이터 활동가를 대상으로 적합성 설문조사를 실시하여 모델의 타당도와 신뢰도를 검증하였다. 그 결과 당초 18개 요인, 133개 측정요소는 15개 요인, 54개 측정요소가 타당성을 확보한 것으로 나타났다. 신뢰도는 차원별, 측정요인별로 모두 기준치인 0.6 이상의 결과를 보여주고 있어 높은 신뢰도를 확보한 것으로 나타났다. 모델평가를 통한 이용자 타당도, 신뢰도 분석으로 전문가가 구성한 평가모델은 현장에서 즉시 활용될 수 있을 정도로 정제되었다.