• 제목/요약/키워드: Web Search Engine

검색결과 247건 처리시간 0.029초

혼합형 질의 방법에 의한 온톨로지 기반 유물 검색 시스템 (Ontology based Retrieval System for Cultural Assets Using Hybrid Text-Sketch Queries)

  • 천현재;백승재;이홍철
    • 한국컴퓨터정보학회논문지
    • /
    • 제10권5호
    • /
    • pp.17-26
    • /
    • 2005
  • 최근 각종 정보가 증가함에 따라 효율적인 관리를 위해 정보 검색에 관한 연구가 더욱 활기를 띠고 있다. 현재 웹 환경에서 운영되고 있는 국내 유물 검색시스템의 경우 대부분이 키워드 기반의 텍스트 검색 방식을 채택하고 있다. 이러한 텍스트 검색 방식은 그 유물에 대한 정확한 이름이나 키워드를 질의자 (user)가 미리 알고 있어야 한다. 하지만 검색대상에 관한 정보가 부족하여 키워드가 모호하거나 단순히 형상에 관한 기억만 있을 경우에는 검색이 쉽지 않았다. 이 논문에서는 기존 유물 검색 시스템의 문제점을 해결하기 위해 온톨로지 기반의 택스트 질의와 사용자 스케치 이미지 질의를 사용하는 자바 기반의 혼합형 유물 검색시스템을 제안한다. 이 시스템은 국내 유물들을 대상으로 사용자가 기억하고 있는 유물에 관한 정보의 형태(택스트, 형상 등)에 따라 다양한 질의방법을 제공하며, 검색결과 내에서 온톨로지 의미관계를 이용한 추가검색이 가능하다.

  • PDF

인터넷의 정보의 탐색, 평가 및 활용:대학 이공계 연구자의 사례를 중심으로 (Information Seeking, Evaluation, and Use on the Internet: A Case Study of Science and Engineering Scholars)

  • 이해영;이수영
    • 정보관리학회지
    • /
    • 제18권4호
    • /
    • pp.163-181
    • /
    • 2001
  • 본 연구는 다양한 형태와 성격의 정보가 혼재해 있는 인터넷환경에서 이공계연구자들이 어떻게 정보를 탐색하고 평가하며, 이용하는지를 밝혀보고자 하였다. 이를 위해 연구를 위한 웹정보의 활용도 인터넷검색방법의 특수성, 검색엔진의 활용범위, 국내외자료의 병행여부, 그리고 인터넷정보의 신뢰도 및 학술적가치를 주요 연구문제로 다루었다. 명지대학교의 이공계 연구자 28명을 인터뷰한 결과에 따르면, 연구참가자들은 취미 여행등 개인적 관심사를 위한 정보검색에는 검색엔진을 많이 활용하지만, 연구를 위한 정보검색에는 본인이 이미 알고 있는 학회, 연구소, 대학 사이트 등을 선별적으로 이용하고 있다. 이는 검색엔진을 통해 검색된 일반 웹 사이트정보는 연구에 직접 사용하기에는 학술적 가치가 부족하다고 믿는것과 방대한 웹 전체를 대상으로는 원하는 정보를 찾기에 어려움이 많다는 것이 주 원인인 것으로 나타났다. 외국자료에 비해 국내자료는 신빙성, 전문성, 최신성 면에서 뒤떨어진다고 보고 있어, 연구를 위한 정보는 주로 외국자료에 의존하고 있는 것으로 밝혀졌다. 결론에서 검색엔진 개발자와 도서관 관계자 그리고 인터넷 정보의 이용자이자 생산자인 연구자를 위한 제안이 각각 제시되었다.

  • PDF

FCA 기반 계층적 구조를 이용한 문서 통합 기법 (Methods for Integration of Documents using Hierarchical Structure based on the Formal Concept Analysis)

  • 김태환;전호철;최종민
    • 지능정보연구
    • /
    • 제17권3호
    • /
    • pp.63-77
    • /
    • 2011
  • 월드와이드웹(World Wide Web)은 인터넷에 연결된 컴퓨터를 통해 사람들이 정보를 공유할 수 있는 매우 큰 분산된 정보 공간이다. 웹은 1991년에 시작되어 개인 홈페이지, 온라인 도서관, 가상 박물관 등 다양한 정보 자원들을 웹으로 표현하면서 성장하였다. 이러한 웹은 현재 5천억 페이지 이상 존재할 것이라고 추정한다. 대용량 정보에서 정보를 효과적이며 효율적으로 검색하는 기술을 적용할 수 있다. 현재 존재하는 몇몇 검색 도구들은 초 단위로 gigabyte 크기의 웹을 검사하여 사용자에게 검색 정보를 제공한다. 그러나 검색의 효율성은 검색 시간과는 다른 문제이다. 현재 검색 도구들은 사용자의 질의에 적합한 정보가 적음에도 불구하고 많은 문서들을 사용자에게 검색해준다. 그러므로 대부분의 적합한 문서들은 검색 상위에 존재하지 않는다. 또한 현재 검색 도구들은 사용자가 찾은 문서와 관련된 문서를 찾을 수 없다. 현재 많은 검색 시스템들의 가장 중요한 문제는 검색의 질을 증가 시키는 것이다. 그것은 검색된 결과로 관련 있는 문서를 증가시키고, 관련 없는 문서를 감소시켜 사용자에게 제공하는 것이다. 이러한 문제를 해결하기 위해 CiteSeer는 월드와이드웹에 존재하는 논문에 대해 한정하여 ACI(Autonomous Citation Indexing)기법을 제안하였다. "Citaion Index"는 연구자가 자신의 논문에 다른 논문을 인용한 정보를 기술하는데 이렇게 기술된 논문과 자신의 논문을 연결하여 색인한다. "Citation Index"는 논문 검색이나 논문 분석 등에 매우 유용하다. 그러나 "Citation Index"는 논문의 저자가 다른 논문을 인용한 논문에 대해서만 자신의 논문을 연결하여 색인했기 때문에 논문의 저자가 다른 논문을 인용하지 않은 논문에 대해서는 관련 있는 논문이라 할지 라도 저자의 논문과 연결하여 색인할 수 없다. 또한 인용되지 않은 다른 논문과 연결하여 색인할 수 없기 때문에 확장성이 용이하지 못하다. 이러한 문제를 해결하기 위해 본 논문에서는 검색된 문서에서 단락별 명사와 동사 및 목적어를 추출하여 해당 동사가 명사 및 목적어를 취할 수 있는 가능한 값을 고려하여 하나의 문서를 formal context 형태로 변환한다. 이 표를 이용하여 문서의 계층적 그래프를 구성하고, 문서의 그래프를 이용하여 문서 간 그래프를 통합한다. 이렇게 만들어진 문서의 그래프들은 그래프의 구조를 보고 각각의 문서의 영역을 구하고 그 영역에 포함관계를 계산하여 문서와 문서간의 관계를 표시할 수 있다. 또한 검색된 문서를 트리 형식으로 보여주어 사용자가 원하는 정보를 보다 쉽게 검색할 수 있는 문서의 구조적 통합 방법에 대해 제안한다. 제안한 방법은 루씬 검색엔진이 가지고 있는 순위 계산 공식을 이용하여 문서가 가지는 중요한 단어를 문서의 참조 관계에 적용하여 비교하였다. 제안한 방법이 루씬 검색엔진보다15% 정도 높은 성능을 나타내었다.

연관 피드백과 퍼지 함의 연산자를 이용한 스니핏 추출 방법 (Snippet Extraction Method using Fuzzy Implication Operator and Relevance Feedback)

  • 박선;심천식;이성로
    • 한국정보통신학회논문지
    • /
    • 제16권3호
    • /
    • pp.424-431
    • /
    • 2012
  • 정보 검색 시 검색엔진은 사용자에게 웹페이지 순위와 웹페이지의 요약정보를 제공한다. 이중 웹 페이지를 대표 할 수 있는 요약된 정보를 스니핏(snippet)이라한다. 스니핏은 사용자의 웹페이지 방문에 큰 영향을 준다. 정확한 방문 페이지의 정보를 모르고 단지 스니핏 만을 이용할 때에 가끔 사용자의 의도와는 다른 잘못된 웹 페이지를 방문할 수 있다. 이것은 검색엔진에서 지원하는 스니핏에 사용자의 의도를 정확하게 반영하는 것이 어렵기 때문이다. 본 논문은 이러한 문제를 해결하기 위해 연관 피드백과 퍼지 함의 연산자를 이용한 새로운 스니핏 추출 방법을 제안한다. 제안방법은 연관 피드백을 이용하여 사용자의 질의를 확장하고, 확장된 질의와 웹 페이지 사이에 퍼지 함의 연산자를 이용하여 질의와 확장된 질의의 포함관계가 반영된 스니핏을 추출함으로써 사용자의 의도를 스니핏에 더 잘 반영할 수 있다. 실험결과에서 제안방법이 다른 방법보다 스니핏 추출에 더 좋은 성능을 보인다.

VoiceXML을 이용한 VUI 지원 웹브라우저 개발 (Development of a Voice User Interface for Web Browser using VoiceXML)

  • 예상후;장민석
    • 한국정보과학회논문지:컴퓨팅의 실제 및 레터
    • /
    • 제11권2호
    • /
    • pp.101-111
    • /
    • 2005
  • 현재의 웹정보들은 주로 HTML로 기술되어 있으며, 이러한 정보를 얻기 위해 사용자들은 마우스와 키보드와 같은 입력장치를 사용한다. 이와 같이 기존의 GUI 환경은 인간의 가장 자연스러운 정보획득 수단의 하나인 음성을 지원하지 못하고 있다. 이러한 문제를 해결하기 위해 음성 인터페이스를 가진 여러 제품들이 개발되고 있다. 하지만 이들은 상호대화성이나 기존 웹환경을 수용한다는 측면에서 부족한 면을 가지고 있다. 본 논문에서는 현재 무르익어 가는 음성인식 기술과 XML의 파생언어인 VoiceXML을 이용하여, 기존의 인터페이스 환경을 XML 기반의 대화형 음성인터페이스 환경으로 대체하고자 한다. 이를 통해 기존의 인터페이스 환경을 수용한 VUI(Voice User Interface) 환경을 사용자에게 제공할 수 있다. 기존의 환경을 수용하기 위해 "XML Island" 기술을 이용하여 VoiceXML 문서를 HTML 문서에 포함시키며, 대표적인 정보획득화면인 메뉴, 게시판, 검색 엔진에 대한 대화형 음성 시나리오를 제안하고 있다.

여성학분야 인터넷 자원의 분류체계에 관한 연구 (A Study on the Classification Scheme of Internet Resource for Women's Studies)

  • 이란주;성기주;양정하
    • 한국도서관정보학회지
    • /
    • 제32권3호
    • /
    • pp.397-417
    • /
    • 2001
  • 인터넷에서 제공되고 있는 검색엔진들은 모든 분야의 정보를 수집하여 분류하기 때문에 전문적인 검색을 원하는 이용자에게 유용한 정보원의 역할을 수행하지 못하고 있다. 따라서 특정분야의 효율적인 정보검색을 위한 체계적인 디렉토리의 구성과 배열로 이용자 편이를 도모해야 할 필요성이 있다. 따라서 본 연구에서는 인터넷 검색엔진에서 사용하고 있는 여성학 분야 및 전문데이터베이스 분류체계의 특징 및 문제점을 분석하여 여성학분야의 효율적인 분류체계에 관한 지침을 제안하고자 한다. 이를 위하여 인터넷 검색엔진 5개와 여성학 전문데이터베이스 3개를 선정하여 항목상세비교방법과 포괄성과 논리성 측면으로 비교하였으며 여성학분야의 성격인 간학문적(interdisciplinary), 다학문적(multidisciplinary) 성격을 반영한 분류체계의 지침을 제시하였다.

  • PDF

복잡계 네트워크를 활용한 건설분야 미래 주요키워드 분석 (Analysis of foresight keywords in construction using complexity network method)

  • 정철우;김재준
    • 한국디지털건축인테리어학회논문집
    • /
    • 제12권2호
    • /
    • pp.15-23
    • /
    • 2012
  • Today, rapid changes in technologies and everyday lives due to the Internet make it is difficult to make predictions about the future. Generally, the best way to predict the future has been proposed by experts. Although expert opinions are very important, they are liable to produce incorrect results due to human error, insufficient information regarding future outcomes and a state of connectedness between people, among other reasons. One of the ways to reduce these mistakes is to provide objective information to the experts. There are many studies that focus on the collection of objective material from papers, patents, reports and the Internet, among other sources. This research paper seeks to develop a forecasting method using World Wide Web search results according to the Google search engine and a network analysis, which is generally used to analyze a social network analysis(SNA). In particular, this paper provides a method to analyze a complexity network and to discover important technologies in the construction field. This approach may make it possible to enhance the overall performance of forecasting method and help us understand the complex system.

Survey of Automatic Query Expansion for Arabic Text Retrieval

  • Farhan, Yasir Hadi;Noah, Shahrul Azman Mohd;Mohd, Masnizah
    • Journal of Information Science Theory and Practice
    • /
    • 제8권4호
    • /
    • pp.67-86
    • /
    • 2020
  • Information need has been one of the main motivations for a person using a search engine. Queries can represent very different information needs. Ironically, a query can be a poor representation of the information need because the user can find it difficult to express the information need. Query Expansion (QE) is being popularly used to address this limitation. While QE can be considered as a language-independent technique, recent findings have shown that in certain cases, language plays an important role. Arabic is a language with a particularly large vocabulary rich in words with synonymous shades of meaning and has high morphological complexity. This paper, therefore, provides a review on QE for Arabic information retrieval, the intention being to identify the recent state-of-the-art of this burgeoning area. In this review, we primarily discuss statistical QE approaches that include document analysis, search, browse log analyses, and web knowledge analyses, in addition to the semantic QE approaches, which use semantic knowledge structures to extract meaningful word relationships. Finally, our conclusion is that QE regarding the Arabic language is subjected to additional investigation and research due to the intricate nature of this language.

온톨로지 기반의 주제-객체관계를 이용한 국가 R&D 지식맵 구축 (Development of a National R&D Knowledge Map Using the Subject-Object Relation based on Ontology)

  • 양명석;강남규;김윤정;최광남;김영국
    • 정보관리학회지
    • /
    • 제29권4호
    • /
    • pp.123-142
    • /
    • 2012
  • 최근 효과적인 정보검색을 제공하기 위해 시맨틱 웹을 비롯한 다양한 검색기법들을 사용하고 있다. 이중에서 효과적인 방법은 온톨로지를 이용한 검색기술을 적용하는 것이라 할 수 있다. 본 논문에서는 국가과학기술지식정보서비스(NTIS)에서 구축한 국가R&D정보를 분석하여 온톨로지를 구축하고, 이용자가 관심있어 하는 주제분야(과제, 인물, 성과, 기관)를 중심으로 온톨로지의 객체관계를 표현하고 정보를 탐색하기 위한 국가R&D지식맵(knowledge map)을 구축하였다. 국가R&D지식맵은 사용자가 선택한 객체를 중심노드로 설정하여, 주제분야를 노드로 표현하고, 객체와 주제분야간의 관계를 분석하여 사용자가 관심 있어 하는 질의를 주제분야의 하위노드로 표현하였다. 사용자가 하위노드의 질의를 선택하면 시스템에서는 선택한 질의를 온톨로지로부터 추론할 수 있는 SPAQL 질의어를 생성하고 추론엔진으로부터 검색결과를 받아 사용자에게 제시하였다.

웹 기반의 도시철도 전문가시스템 개발에 관한 연구 (A Study on the Development of Web-based Expert System for Urban Transit)

  • 김현준;배철호;김성빈;이호용;김문현;서명원
    • 한국자동차공학회논문집
    • /
    • 제13권5호
    • /
    • pp.163-170
    • /
    • 2005
  • Urban transit is a complex system that is combined electrically and mechanically, it is necessary to construct maintenance system for securing safety accompanying high-speed driving and maintaining promptly. Expert system is a computer program which uses numerical or non-numerical domain-specific knowledge to solve problems. In this research, we intend to develop the expert system which diagnose failure causes quickly and display measures. For the development of expert system, standardization of failure code classification system and creation of BOM(Bill Of Materials) have been first performed. Through the analysis of failure history and maintenance manuals, knowledge base has been constructed. Also, for retrieving the procedure of failure diagnosis and repair linking with the knowledge base, we have built RBR(Rule Based Reasoning) engine by pattern matching technique and CBR(Case Based Reasoning) engine by similarity search method. This system has been developed based on web to maximize the accessibility.