The Research of PPI Data Quality Improvement on Ontology

온톨로지 기반의 단백질 반응 데이터 품질향상 연구

  • 장희선 (충북대학교 경영정보학과) ;
  • 원민영 (충북대학교 경영정보학과) ;
  • 김태경 (충북대학교 정보산업공학과) ;
  • 조완섭 (충북대학교 경영정보학과)
  • Published : 2006.06.01

Abstract

단백질 상호작용(Protein-Protein interaction : PPI )은 생명체 내에서 생명현상을 유지하기 위한 단백질 간의 유기적인 반응이다. 생물학 실험 도구의 발달로 현재 대량의 PPI 데이터가 발생하고 있으며 이것을 활용하여 생명체를 시스템 관점에서 이해하기 위한 시도가 진행되고 있다. 하지만 현재 PPI 데이터는 중복의 문제, 생물학자들 간의 용어사용의 불일치성 문제로 인해 데이터의 질이 저하되어 분석결과에 부정적인 영향을 끼치고 있다. 본 논문에서는 현재 인간 PPI 데이터의 문제점을 분석하고 이것을 해결하기 위한 온톨로지 기반의 데이터 정제 방법론을 제시한다. 본 연구를 통해 HPRD내에 존재하고 있던 약 52%의 결함이 있는 데이터를 발견하고 인간 단백질 상호작용 데이터의 품질을 향상시켰다.

Keywords