• 제목/요약/키워드: 온톨로지 평가방법

검색결과 77건 처리시간 0.032초

개념간 관계의 추출과 명명을 위한 통계적 접근방법 (A Statistical Approach for Extracting and Miming Relation between Concepts)

  • 김희수;최익규;김민구
    • 정보처리학회논문지B
    • /
    • 제12B권4호
    • /
    • pp.479-486
    • /
    • 2005
  • 온톨로지는 차세대 시맨틱 웹을 위한 논리의 기반을 구성하기 위해 제안되었다. 이러한 온톨로지는 특정 분야에 대한 지식을 정형화된 형태로 표현함으로써 기계에 의한 지식의 이해를 가능하게 하고, 이를 사용하여 사용자의 요구에 알맞은 지능화된 서비스를 제공할 수 있게 한다. 하지만, 온톨로지의 구축과 유지는 많은 사람의 시간과 노력을 요구한다. 본 고에서는 온톨로지 구축 방법의 일환으로, 문서로부터 온톨로지를 구성하는 개념간의 관계를 정의하는 자동화된 방법을 제안한다. 본 고에서 제안된 방법은 특정 분야의 문서에 존재하는 개념을 기반으로 개념간의 연관 규칙을 형성하는 개념 쌍을 찾고, 두 개념 사이에 존재하는 내용의 군집화를 통해 두 개념간의 관계를 설명하는 패턴을 찾는다. 마지막으로 패턴간의 군집화를 사용하여 개념 사이의 일반화된 관계를 명시한다. 본 고에서는 제안된 방법을 검증하기 위한 방법으로 TREC(Text REtrieval Conference)에서 제공하는 문서집합을 사용하여 개념간의 관계를 추출, 평가하였으며, 그 결과 제안된 방법은 개념간의 관계를 설명하는 유용한 정보를 제공할 수 있음을 보여준다.

온톨로지와 UDDI를 이용한 시각 미디어 서비스 매치메이커의 설계 (Design of Visual Media Service Matchmaker using Ontology and UDDI)

  • 이성우;안철범;나연묵
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2005년도 춘계학술발표대회
    • /
    • pp.655-658
    • /
    • 2005
  • 웹 애플리케이션 개발 방법으로 XML 기반의 웹 서비스가 부각됨에 따라 인터넷 상에 많은 웹 서비스들이 생성되었고 향후 보다 많은 웹 서비스들이 개발될 것으로 예상되고 있다. 이처럼 급속히 증가하는 웹 서비스들 중에서 사용자나 개발자가 원하는 적절한 웹 서비스를 검색하는 매치메이킹의 중요성이 점차 부각되고 있다. 본 논문에서는 이미지나 비디오와 같은 시각 미디어 서비스를 제공하는 웹 서비스를 대상으로 온톨로지 및 UDDI를 이용하여 관련된 웹 서비스를 탐색하는 매치메이커 구조를 제안한다. 온톨로지를 시각 미디어 서비스의 카테고리로 사용하여 웹 서비스를 분류하고, 각 서비스의 세부 사항 및 서비스 평가 항목을 UDDI에 저장하고 최종적으로 이를 평가하여 최적의 서비스를 결정하는 방법을 기술한다.

  • PDF

향상된 콘텐츠 기반 이미지 검색을 이용한 온톨로지 기반 의미적 정보 추출 (Ontology-based Semantic Information Extraction Using An Advanced Content-based Image Retrieval)

  • 신동욱;전호철;정찬백;김태환;최중민
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2008년도 한국컴퓨터종합학술대회논문집 Vol.35 No.1 (C)
    • /
    • pp.348-353
    • /
    • 2008
  • 이미지의 사용이 증가함에 따라 이미지 중 사용자가 원하는 이미지를 효율적으로 검색하기 위한 방법들이 연구되어 왔다. 본 논문에서는 질의 이미지를 분석하여 이미지 특징(feature)을 추출한 후 이미지 특징에 대한 유사도 평가를 통한 이미지 검색 및 온톨로지를 기반으로 검색된 이미지들과 유사하다고 판단된 이미지와 그러한 이미지들의 의미적 정보를 추출하는 방법을 제안한다. 제안된 시스템은 질의 이미지에서 색상, 질감, 모양 등의 특징을 추출하여 유사도 평가를 통해 검색된 이미지를 제공하고, 내용기반 이미지 검색 방식을 통해 이미지를 검색하고, 온톨로지를 이용해 이미지의 의미적 정보를 추출하여 사용자에게 이미지와 관련된 의미적 정보를 제공한다.

  • PDF

태그 간 동의어 집합을 통한 XML 문서 유사도 측정 (Similarity Measurement for XML Documents Using Tag Synonyms)

  • 이강석;송인상;김응모
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2007년도 가을 학술발표논문집 Vol.34 No.2 (C)
    • /
    • pp.29-34
    • /
    • 2007
  • 월드와이드웹에서의 정보를 재사용, 공유할 수 있도록 기준을 제시한 XML은 많은 곳에서 사용 중에 있으며, 널리 확산되고 있다. 사용자 정의태그를 이용한 XML의 특징은, 같은 도메인의 문서라도 사랑의 인식이 아닌 컴퓨터와 같은 기계적으로는 다르게 인식될 수 있다는 문제점을 드러내기도 한다. 본 논문에서는 이러한 문제점을 해결하고자 시소러스와 온톨로지 등을 이용해 XML 문서간 유사도를 측정하는 방법을 제시하며 이를 바탕으로 제작한 프로그램인 #XML Similarity Calculation# 를 이용하여 제시한 방법이 타당하다는 것을 증명하게 된다. 또한 주어진 예시자료를 가지고 이 프로그램의 성능평가를 통해 정확성과 효율성을 평가하고 앞으로의 연구방향을 제시한다.

  • PDF

온톨로지 지식 기반 특성치를 활용한 Bidirectional LSTM-CRF 모델의 시퀀스 태깅 성능 향상에 관한 연구 (Improving Bidirectional LSTM-CRF model Of Sequence Tagging by using Ontology knowledge based feature)

  • 진승희;장희원;김우주
    • 지능정보연구
    • /
    • 제24권1호
    • /
    • pp.253-266
    • /
    • 2018
  • 본 연구는 질의 응답(QA) 시스템에서 사용하는 개체명 인식(NER)의 성능을 향상시키기 위하여 시퀀스 태깅 방법론을 적용한 새로운 방법론을 제안한다. 사용자의 질의를 입력 받아 데이터베이스에 저장된 정답을 추출하기 위해서는 사람의 언어를 컴퓨터가 알아들을 수 있도록 구조화 질의어(SQL)와 같은 데이터베이스의 언어로 전환하는 과정이 필요한데, 개체명 인식은 사용자의 질의에서 데이터베이스에 포함된 클래스나 데이터 명을 식별하는 과정이다. 기존의 데이터베이스에서 질의에 포함된 단어를 검색하여 개체명을 인식하는 방식은 동음이의어와 문장성분 구를 문맥을 고려하여 식별하지 못한다. 다수의 검색 결과가 존재하면 그들 모두를 결과로 반환하기 때문에 질의에 대한 해석이 여러 가지가 나올 수 있고, 계산을 위한 시간복잡도가 커진다. 본 연구에서는 이러한 단점을 극복하기 위해 신경망 기반의 방법론을 사용하여 질의가 가지는 문맥적 의미를 반영함으로써 이러한 문제를 해결하고자 했고 신경망 기반의 방법론의 문제점인 학습되지 않은 단어에 대해서도 문맥을 통해 식별을 하고자 하였다. Sequence Tagging 분야에서 최신 기술인 Bidirectional LSTM-CRF 모델을 도입함으로써 신경망 모델이 가진 단점을 해결하였고, 학습되지 않은 단어에 대해서는 온톨로지 기반 특성치를 활용하여 문맥을 반영한 추론을 사용하였다. 음악 도메인의 온톨로지(Ontology) 지식베이스를 대상으로 실험을 진행하고 그 성능을 평가하였다. 본 연구에서 제안한 방법론인 L-Bidirectional LSTM-CRF의 성능을 정확하게 평가하기 위하여 학습에 포함된 단어들뿐만 아니라 학습에 포함되지 않은 단어들도 포함한 질의를 평가에 사용하였다. 그 결과 L-Bidirectional LSTM-CRF 모형을 재학습 시키지 않아도 학습에 포함되지 않은 단어를 포함한 질의에 대한 개체명 인식이 가능함을 확인하였고, 전체적으로 개체명 인식의 성능이 향상됨을 확인할 수 있었다.

전통의학 문헌의 디지털 복원 및 검증에 관한 연구 (A study on a restoration and verification of traditional medical documents)

  • 이강현;지중구
    • 디지털융복합연구
    • /
    • 제10권5호
    • /
    • pp.315-320
    • /
    • 2012
  • 본 연구는 전통의학 분야의 지식자원을 보호 활용하기 위하여 고의학 서적의 필사본을 확보하여 손망실을 방지함과 동시에 서지학적, 어학적, 한의학적 접근을 통하여 고의학 서적의 관리 체계 수립 및 지원시스템을 구축하는데 목표를 두고 있으며 선택된 필사본을 위주로 국역화, DB화 및 전자문서화를 구축하여 향 후 다양한 활용 가치를 제고하고 필사본의 처방 지식의 온톨로지 구축 방법을 제시하여 전통의학문헌의 복원 및 형상화를 설계함과 아울러 다학제간의 연구 시스템을 통한 고의학 서적의 내용을 정리 분석하여 의학적 유용성을 평가하고 현대적인 재해석을 통해 기초 및 임상에서의 실용화 방안을 제시하고자 한다.

유비쿼터스 서비스 온톨로지를 위한 설계 품질 모델 (A Design-phase Quality Model for Ubiquitous Service Ontology)

  • 이미연;박승수;이정원
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제37권6호
    • /
    • pp.430-445
    • /
    • 2010
  • 유비쿼터스 컴퓨팅 환경에서 사용자에게 서비스를 자동으로 제공하기 위해 사용되는 동적 서비스 합성은 효과적인 서비스 기술 및 모델링 기법이 전제되어야 한다. 이를 위해 이전 연구에서는 유비쿼터스 환경 내의 기기의 기능을 추상화한 'u-서비스'라는 개념을 제안하였고, 온톨로지로 구조화하는 메커니즘과 u-서비스의 특성을 표현하기 위한 기술 규격을 정립한 바 있다. 하지만 u-서비스 온톨로지 설계시에 효율성을 검증하기 위한 체계나 기준을 제공하지는 못하고 있다. 또한 기존의 소프트웨어 제품이나 컴퓨팅 시스템의 품질 평가 모델은 유비쿼터스 서비스의 특성을 고려하지 못하므로 직접 적용하기에도 적합하지 않다. 따라서 본 연구에서는 이전 연구에서의 u-서비스 온톨로지 구축 방법론을 바탕으로 효과적인 유비쿼터스 서비스 온톨로지를 설계하기 위한 품질 평가 모델을 제안한다. 유비쿼터스 서비스 온톨로지의 특성을 반영하여 모델링 목표와 설계 단계에서의 평가 지표를 도출하고 각 품질 속성을 정량화하기 위한 메트릭을 정의한다. 이전 연구에서 구축한 u-서비스 온톨로지에 적용한 결과, 제안한 품질 평가 모델을 통해 유비쿼터스 서비스 온톨로지의 적합성을 다각도로 분석하고 설계 개선을 위한 모델링 원칙을 제시할 수 있음을 보였다.

신뢰값 기반 대용량 트리플 처리를 위한 스파크 환경에서의 RDFS 온톨로지 추론 (Spark based Scalable RDFS Ontology Reasoning over Big Triples with Confidence Values)

  • 박현규;이완곤;바트셀렘;박영택
    • 정보과학회 논문지
    • /
    • 제43권1호
    • /
    • pp.87-95
    • /
    • 2016
  • 최근 인터넷과 디바이스의 발전으로 지식 정보의 양이 방대해 지면서 대용량 온톨로지를 이용한 추론 연구가 활발히 진행되고 있다. 일반적으로 트리플로 표현되는 빅데이터는 기계학습 프로그램이나 지식 공학자가 각 트리플의 신뢰도를 측정하여 제공한다. 하지만 수집된 데이터는 불확실한 데이터를 포함하고 있으며, 이러한 데이터를 추론하는 것은 불확실성을 내포한 추론 결과를 초래할 수 있다. 본 논문에서는 불확실성 문제를 해결하기 위해 수집된 데이터에 대한 신뢰의 정도를 나타내는 신뢰값(Confidence Value)를 이용한 RDFS 규칙 추론 방법에 대하여 설명하고, 메모리 기반의 분산 클러스터 프레임워크인 스파크(Spark)를 기반으로 데이터의 불확실성에 대한 고려를 하지 않는 기존의 추론 방법과 달리 신뢰값 계산에 대한 방법을 응용하여 RDFS 규칙을 통해 추론되는 새로운 데이터의 신뢰값을 계산하며, 계산된 신뢰값은 추론된 데이터에 대한 불확실성을 나타낸다. 제안하는 추론 방법의 성능을 검증하기 위해 온톨로지 추론과 검색 속도를 평가할 때 활용되는 공식 데이터인 LUBM을 대상으로 신뢰값을 추가하여 실험을 수행하였으며, 가장 큰 데이터인 LUBM3000을 수행하였을 때 1179초의 추론시간이 소요되었고, 초당 350K 트리플을 처리할 수 있는 성능을 보였다.

온톨로지를 이용한 전문가지식 표현 메커니즘 설계 및 의사결정성과에 관한 실증연구 - 구매 전문가 지식 사례를 중심으로 -

  • 배영일
    • 한국경영정보학회:학술대회논문집
    • /
    • 한국경영정보학회 2008년도 춘계학술대회
    • /
    • pp.294-304
    • /
    • 2008
  • Verbal Protocol Analysis(이하 VPA)와 Repertory Grid(이하 RG)를 활용하여 구매 전문가의 지식을 온톨로지로 구축하여 활용할 수 있는 방법론 제시하였다. VPA를 활용하여 전문가의 생생한 지식을 실제와 거의 유사하게 구어체의 문서로 표현하고, 다시 RG를 이용하여 온톨로지로 표현하는 절차와 세부 방안을 구축하였다. 본 연구의 방법을 활용하여 지식 온톨로지를 구축하면 전문가의 암묵적 지식을 실제와 가깝게 상호운영이 가능한 구조화된 지식으로 표현 할 수 있고 나아가 표현된 지식의 다양한 활용이 가능해 진다. 이와 같이 전문가의 암묵지를 실제와 가깝게 표현하고 이를 재활용 가능한 형태로 구조화할 수 있다는 것은 지식의 표현, 축적 그리고 활용을 위해서 매우 중요한 의미가 있다고 할 수 있다. 한편, 본 연구의 방식대로 표현된 구매 전문가의 지식 온톨로지에 대해 현장 전문가가 이를 평가하여 본 연구에서 제안하는 내용의 의미적 가치와 우수성을 검증하였다.

  • PDF

사전을 기반으로 한 한국어 의미망 구축과 활용 (Construction and application of Korean Semantic-Network based on Korean Dictionary)

  • 최호섭;옥철영;장문수;장명길
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2002년도 봄 학술발표논문집 Vol.29 No.1 (B)
    • /
    • pp.448-450
    • /
    • 2002
  • 시소러스 의미망, 온톨로지 등과 같은 지식베이스는 자연언어처리와 관련된 여러 분야에서 중요한 언어자원의 역할을 담당하고 있다. 하지만 정보검색, 기계번역과 같은 특정 분야마다 다르게 구축되어 이러한 지식베이스는 실질적인 한국어 처리에는 크게 효과를 보지 못하고 있는 실정이다. 본 논문은 한국어를 대상으로 한 시소러스, 의미망의 등의 구축 방법론적 문제를 지적하고 말뭉치를 중심으로 한 텍스트 언어처리에 필요한 의미망의 구축 방법과 포괄적인 활용방안을 모색한다. 의미망 구축의 기반이 되는 지식은 각종 사전(dictionary)를 이용했으며, 구축하고 있는 의미망의 활용 가능성을 평가하기 위하여 ETRI의 의미기반 정보검색과 언어처리의 큰 문제 중 하나인 단어 중의성 해소(WSD)에서 어떻게 활용되는지를 살핀다. 그리하여 언어자인의 처리 방안 중의 하나인 의미망을 구축함으로써 언어를 효과적으로 처리하기 위한 기본적이면서 중요한 어휘 데이터베이스 마련과 동시에 언어자원 구축의 한 방향을 제시하고자 한다.

  • PDF