• 제목/요약/키워드: Web Retrieval System

검색결과 395건 처리시간 0.023초

구조화된 비디오 문서의 데이터 모델 및 질의어와 색인 기법 (Data Model, Query Language, and Indexing Scheme for Structured Video Documents)

  • 류은숙;이규철
    • 한국멀티미디어학회논문지
    • /
    • 제1권1호
    • /
    • pp.1-17
    • /
    • 1998
  • 비디오 정보는 전자 도서관이나 WWW 및 주문형 비디오 (VOD) 시스템과 같은 다양한 응용분야에서 중요한 요소로 부각되고 있다. 비디오 정보는 특성상 계층적으로 구조화된 문서 형태를 가지기 때문에 본 논문에서는 이를 “구조화된 비디오 문서”라 부른다. 본 논문에서는 구조화된 비디오 문서를 데이터베이스에 효율적으로 저장하고, 검색하기 위한 데이터 모델과 질의어 및 색인 기법을 제안한다. 구조화된 비디오 문서는 논리적인 계층 구조 특성을 지니기 때문에, 본 논문에서는 객체 지향 데이터 모델을 이용하여 비디오 문서를 복합 객체로 모델링하고, 이를 저장하기 위한 객체 타입들을 정의한다. 또한 본 논문에서는 비디오 데이터의 캡션이나 주석을 기반으로 한 내용 기반 검색과 비디오 문서의 논리적 구조를 기반으로 한 구조 기반 검색을 제공하며, 비디오 문서의 시공간 관계 연산을 이용한 검색도 지원한다. 그리고, 구조화된 비디오 문서의 효율적인 질의와 색인 공간의 오버헤드를 줄이기 위해 최적화된 역 색인 기법을 제시한다.

  • PDF

XML을 기반으로 한 관계형 데이터베이스 메타데이터 리파지토리 설계 및 구현 (Design and Implementation of XML Based Relational Database Metadata Repository)

  • 권은정;용환승
    • 정보처리학회논문지D
    • /
    • 제9D권1호
    • /
    • pp.1-10
    • /
    • 2002
  • 메타데이터는 데이터에 관한 데이터로 데이터를 관리하기 위하여 사용된다. 데이터베이스를 기반으로 하는 응용프로그램이 증가하면서 메타데이터를 관리하기 위해 XML(eXtensible Markup Language)형식의 메타데이터 모델 및 메타데이터 교환모델이 제안되고 있지만 XML형식의 메타데이터를 관계형 데이터베이스에 저장하는 것이 일반적이다. 따라서 본 논문에서는 관계형 데이터베이스의 메타데이터를 객체지향 데이터베이스에 저장하기 위해 메타데이터 모델과 메타데이터 교환모델을 설계하여 메타데이터를 관리하는 새로운 리파지토리 시스템 구현을 목적으로 한다. 관계형 데이터베이스의 메타데이터를 XML문서로 변형 후 객체지향 데이터베이스의 XML 데이터 서버인 eXcelon에 저장하여 XQL (XML Query Language)에 의해 질의함으로써 관계형 데이터베이스 시스템들의 메타데이터의 검색, 편집을 가능하도록 하고 XSL(extensible StyleSheets Language)의 적용을 통하여 다양한 양식으로 웹 브라우져 상에 메타데이터를 출력함으로써 메타데이터의 속성을 면밀히 파악할 수 있다.

웹 정보 검색 이력을 이용한 사용자 의도 자동 추출 (Automatic Extract User Intention from Web Search Log)

  • 박기남;정순영;서태원;지혜성;이태민;임희석
    • 컴퓨터교육학회논문지
    • /
    • 제12권6호
    • /
    • pp.21-32
    • /
    • 2009
  • 본 논문은 사용자가 정보 욕구를 정확하게 질의어로 입력하고, 원하는 정보가 검색될 수 있도록 지원하기 위한 사용자 의도 자동추출과 이를 이용한 인텐션 맵 구축 방법을 제안한다. 제안하는 방법은 동일한 검색어를 입력한 사용자들의 검색 이력 데이터를 이용하여 사용자 의도 자질을 선정하고, 클러스터링 알고리즘과 사용자 의도 추출 알고리즘을 이용하여 사용자 의도를 추출하였다. 추출된 사용자 의도는 지식표상 이론에 근거한 인텐션 맵으로 표현하였다. 제안한 인텐션 맵의 효용성 분석을 위하여 현재 국내 상용 검색엔진에서 제공받은 2,600개의 사용자 검색 이력 데이터를 이용하였다. 실험결과 인텐션 맵을 이용한 정보검색이 일반 검색엔진을 이용 할 때 보다 통계적으로 유의미한 만족도를 나타내었다.

  • PDF

차량용 블랙박스를 활용한 교통위반신고 자동화 방법 (A Method for Automation of Traffic Violation Report Using Automobile Black Boxes)

  • 정민석;김성혁;염인호;김현규
    • 정보처리학회논문지:컴퓨터 및 통신 시스템
    • /
    • 제3권10호
    • /
    • pp.351-356
    • /
    • 2014
  • 최근 차량용 블랙박스는 무선 네트워크를 통해 블랙박스에 저장된 동영상을 휴대폰으로 전송하는 기능을 제공하여, 해당 동영상을 여러 용도로 활용할 수 있도록 지원한다. 본 논문에서는 블랙박스 촬영 동영상을 이용하여 교통법규 위반 신고를 자동화하는 방법에 대해 소개한다. 제안하는 방법에서는 교통법규 위반 사례가 포착되었을 때, 간단한 사용자 인터페이스 조작을 통해 촬영된 블랙박스 동영상을 휴대폰으로 전송시킨다. 해당 동영상은 촬영시간 및 위치 등의 관련정보와 함께 HTTP 요청의 형태로 생성되어, 신고센터에 자동으로 전송된다. 본 논문에서는 제안하는 방법을 구현한 프로토타입 시스템에 대해 소개하고, 실제 활용을 위해 필요한 부가적인 사항들에 대해 논의한다.

필터링에 기반한 고차원 색인구조의 동시성 제어기법의 설계 및 구현 (Design and Implementation of High-dimensional Index Structure for the support of Concurrency Control)

  • 이용주;장재우;김학영;김명준
    • 정보처리학회논문지D
    • /
    • 제10D권1호
    • /
    • pp.1-12
    • /
    • 2003
  • 최근 이미지, 비디오와 같은 멀티미디어 데이터에 대한 효율적인 검색을 위해 많은 다차원 및 고차원 색인 구조들에 대한 연구가 활발히 진행되고 있다. 하지만 기존의 색인 구조의 연구 방향은 검색의 효율을 극대화 하는데 초점을 맞추어 왔으며 최근의 멀티미디어 데이터베이스나 데이터 마이닝 분야와 같은 다수 사용자 환경을 요구하는 환경에서는 부적합한 실정이다. 이에 본 논문에서는 기존의 제시된 차원이 증가하면서 급속하게 성능이 저하되는 문제를 특징 벡터의 시그니쳐를 구성하여 완화시킨 필터링에 기반한 고차원 색인 구조에 동시성 제어기법을 설계 및 구현하여 위스콘신 대학에서 개발한 지속성 객체 저장 시스템인 SHORE 하부저장 시스템과 밀결합 방식으로 통합하였다. 확장된 SHORE 하부저장 시스템은 고차원 데이터에 대한 효율적인 검색 뿐만 아니라 레코드 레벨의 색인 데이터에 대한 동시성 제어를 지원하며 시그니쳐 파일을 모두 메모리에 로딩하는 구조를 개선하여 페이지 레벨의 관리가 가능하다. 아울러 본 논문에서 제시한 확장된 SHOE 하부저장 시스템을 실제 응용 시스템에 적용하기 위해 플랫폼 독립적인 환경을 지원하는 자바 언어를 사용하여 미들웨어 구축 방안을 제시한다. 또한 구축된 미들웨어를 통해 쓰레드 별로 대표적인 내용기반 질의 형태인 포인트질의, 범위질의, k-최근접 질의에 대한 다수 사용자 환경에서의 성능 평가를 수행하였다.

지질용어 시소러스 시스템의 설계 및 구축 (Design and Implementation of Thesaurus System for Geological Terms)

  • 황재홍;지광훈;한종규;연영광;류근호
    • 한국지리정보학회지
    • /
    • 제10권2호
    • /
    • pp.23-35
    • /
    • 2007
  • 최근 정보 검색 분야에서 시맨틱 웹 기술에 따른 인터넷 용어사전과 더불어 시소러스의 필요성이 더욱 중요시되고 있다. 시소러스는 분류와 사전의 결합으로 상위 및 하위개념 사이의 전후관계를 명확히 하기 위해서 공식적으로 조직, 통제된 색인어의 어휘로 인간의 학습, 탐구활동 등 제반 지식활동의 대상이 되는 개념(용어)간의 관계를 표현한 지식구조의 토픽 맵이다. 하지만 시소러스가 용어의 통제 및 표준화와 더불어 정보를 능률적으로 처리하고 검색하는데 필수적인 수단으로 평가되고 있음에도 불구하고 아직까지 지질분야에서 우리말 시소러스가 없는 실정이다. 시소러스를 구축하기 위해서는 표준화되고 잘 정의된 지침이 필요하다. 이러한 표준화된 지침은 보다 효율적인 정보 관리를 가능하게 할 것이며, 정보 이용자 또한 보다 정확한 정보를 쉽고 편리하게 이용할 수 있게 될 것이다. 본 연구는 지질정보 중 가장 기본이 되는 용어 시소러스 시스템 구축 연구이다. 이를 위해서 첫째, 국내외 지질용어 표준화 동향을 살펴보았다. 둘째, 15개 분야에 대한 지질학적 주제를 정하고 각 주제에 대한 분류체계(안)를 마련하였다. 셋째, 지질용어 시소러스 분류체계를 바탕으로 지질용어 시소러스 명세서를 작성하였다. 마지막으로 이 명세서를 이용하여 인터넷기반 지질용어 시소러스 시스템을 설계하고 구축하였다.

  • PDF

텍스트 마이닝을 이용한 2012년 한국대선 관련 트위터 분석 (Analysis of Twitter for 2012 South Korea Presidential Election by Text Mining Techniques)

  • 배정환;손지은;송민
    • 지능정보연구
    • /
    • 제19권3호
    • /
    • pp.141-156
    • /
    • 2013
  • 최근 소셜미디어는 전세계적 커뮤니케이션 도구로서 사용에 전문적인 지식이나 기술이 필요하지 않기 때문에 이용자들로 하여금 콘텐츠의 실시간 생산과 공유를 가능하게 하여 기존의 커뮤니케이션 양식을 새롭게 변화시키고 있다. 특히 새로운 소통매체로서 국내외의 사회적 이슈를 실시간으로 전파하면서 이용자들이 자신의 의견을 지인 및 대중과 소통하게 하여 크게는 사회적 변화의 가능성까지 야기하고 있다. 소셜미디어를 통한 정보주체의 변화로 인해 데이터는 더욱 방대해지고 '빅데이터'라 불리는 정보의 '초(超)범람'을 야기하였으며, 이러한 빅데이터는 사회적 실제를 이해하기 위한 새로운 기회이자 의미 있는 정보를 발굴해 내기 위한 새로운 연구분야로 각광받게 되었다. 빅데이터를 효율적으로 분석하기 위해 다양한 연구가 활발히 이루어지고 있다. 그러나 지금까지 소셜미디어를 대상으로 한 연구는 개괄적인 접근으로 제한된 분석에 국한되고 있다. 이를 적절히 해결하기 위해 본 연구에서는 트위터 상에서 실시간으로 방대하게 생성되는 빅스트림 데이터의 효율적 수집과 수집된 문헌의 다양한 분석을 통한 새로운 정보와 지식의 마이닝을 목표로 사회적 이슈를 포착하기 위한 실시간 트위터 트렌드 마이닝 시스템을 개발 하였다. 본 시스템은 단어의 동시출현 검색, 질의어에 의한 트위터 이용자 시각화, 두 이용자 사이의 유사도 계산, 트렌드 변화에 관한 토픽 모델링 그리고 멘션 기반 이용자 네트워크 분석의 기능들을 제공하고, 이를 통해 2012년 한국 대선을 대상으로 사례연구를 수행하였다. 본 연구를 위한 실험문헌은 2012년 10월 1일부터 2012년 10월 31일까지 약 3주간 1,737,969건의 트윗을 수집하여 구축되었다. 이 사례연구는 최신 기법을 사용하여 트위터에서 생성되는 사회적 트렌드를 마이닝 할 수 있게 했다는 점에서 주요한 의의가 있고, 이를 통해 트위터가 사회적 이슈의 변화를 효율적으로 추적하고 예측하기에 유용한 도구이며, 멘션 기반 네트워크는 트위터에서 발견할 수 있는 고유의 비가시적 네트워크로 이용자 네트워크의 또 다른 양상을 보여준다.

텍스트 마이닝 기법을 이용한 컴퓨터공학 및 정보학 분야 연구동향 조사: DBLP의 학술회의 데이터를 중심으로 (Investigation of Topic Trends in Computer and Information Science by Text Mining Techniques: From the Perspective of Conferences in DBLP)

  • 김수연;송성전;송민
    • 정보관리학회지
    • /
    • 제32권1호
    • /
    • pp.135-152
    • /
    • 2015
  • 이 논문의 연구목적은 컴퓨터공학 및 정보학 관련 연구동향을 분석하는 것이다. 이를 위해 텍스트마이닝 기법을 이용하여 DBLP(Digital Bibliography & Library Project)의 학술회의 데이터를 분석하였다. 대부분의 연구동향 분석 연구가 계량서지학적 연구방법을 사용한 것과 달리 이 논문에서는 LDA(Latent Dirichlet Allocation) 기반 다항분포 토픽모델링 기법을 이용하였다. 가능하면 컴퓨터공학 및 정보학과 관련된 광범위한 자료를 수집하기 위해서 DBLP에서 컴퓨터공학 및 정보학과 관련된 353개의 학술회의를 수집 대상으로 하였으며 2000년부터 2011년 기간 동안 출판된 236,170개의 문헌을 수집하였다. 토픽모델링 결과와 주제별 문헌 수, 주제별 학술회의 수를 조사하여 2000년부터 2011년 사이의 주제별 상위 저자와 주제별 상위 학술회의를 제시하였다. 주제동향 분석 결과 네트워크 관련 연구 주제 분야는 성장 패턴을 보였으며, 인공지능, 데이터마이닝 관련 연구 분야는 쇠퇴 패턴을 나타냈고, 지속 패턴을 보인 주제는 웹, 텍스트마이닝, 정보검색, 데이터베이스 관련 연구 주제이며, HCI, 정보시스템, 멀티미디어 시스템 관련 연구 주제 분야는 성장과 하락을 지속하는 변동 패턴을 나타냈다.

국내 정보학분야 연구동향 분석, 2000-2011 (Detecting Research Trends in Korean Information Science Research, 2000-2011)

  • 서은경;유소영
    • 정보관리학회지
    • /
    • 제30권4호
    • /
    • pp.215-239
    • /
    • 2013
  • 21세기에 들어서서 디지털 정보환경이 발빠르게 변화함에 따라 국내 정보학 연구 역시 많은 발전과 변화를 겪고 있는 것을 산학계 모두 인지하고 있지만 실제 2000년부터 현재까지 어느 정도로 변화되었는지를 분석한 논문은 많지 않다. 이에 따라 본 연구는 2000년에서부터 2011기간동안 연구재단에 등재된 문헌정보학 관련 학회지에 수록된 정보학분야 논문 1,007편의 논문을 대상으로 정보학분야의 연구동향을 분석하였다. 먼저 시간에 따른 연구주제의 변화를 살펴보기 위하여 논문 데이터를 주제 범주화 한 후, 각 주제 범주 내에서의 논문 및 주요 키워드의 성장률을 시계열적으로 분석하였다. 그리고 단어 동시출현 네트워크를 2000-2011년뿐 아니라 2000-2005년과 2006-2011년의 두 시기로 나누어 시각화하고 분석함으로써, 한국의 정보학 분야의 연구경향의 변화를 살펴보았다. 분석 결과, 지난 12년간의 한국의 정보학 연구는 정보시스템중심적 연구에서 이를 도서관에 적용하는 도서관응용적 연구로 나아가고 있는 것을 확인하였다. 특히 지식관리, 웹기반 시스템 평가, 정보검색 분야에서 두드러지게 변화가 나타났다. 다른 연구의 결과와 비교해 볼 때, 이 연구는 정보학 연구분야의 한국 로컬화의 변화를 찾아냈다는 점에서 의의가 있다고 할 수 있다.

컴퓨팅 리소스 관리를 위한 표준 메타데이터 스키마 설계 (Design of Standard Metadata Schema for Computing Resource Management)

  • 이미경;조민희;송사광;임형준
    • 한국정보통신학회:학술대회논문집
    • /
    • 한국정보통신학회 2022년도 추계학술대회
    • /
    • pp.433-435
    • /
    • 2022
  • 본 논문에서는 국가연구데이터커먼즈에서 연구데이터 분석·활용에 사용되는 컴퓨팅 리소스를 등록, 검색, 관리하기 위한 컴퓨팅 리소스 표준 메타데이터 스키마 설계 방안에 대해 소개한다. 국가연구데이터커먼즈는 연구데이터 공유·활용 극대화를 위한 연구데이터와 컴퓨팅 리소스 연합 활용 체계이다. 컴퓨팅 리소스는 연구 전 과정에서 사용하는 연구데이터를 분석·활용하는데 필요한 분석 인프라, 분석 소프트웨어 등 컴퓨팅 환경의 모든 리소스들을 말한다. KRDC 컴퓨팅 리소스 관리를 위한 표준 메타데이터 스키마는 컴퓨팅 리소스 관리를 위한 공통 필수 속성과 각 컴퓨팅 리소스 특징에 따른 속성을 고려하여 설계하였다. 컴퓨팅 리소스 관리를 위한 표준 메타데이터 스키마는 컴퓨팅 리소스 메타데이터 스키마와 컴퓨팅 리소스 제공자 메타데이터 스키마로 구성된다. 또한, 컴퓨팅 리소스와 제공자의 메타데이터 스키마는 성격에 따라 서비스 스키마와 시스템 스키마 그룹으로 구분하여 설계하였다. 표준 메타데이터 스키마는 KRDC 프레임워크를 통해 컴퓨팅 리소스 제공자와 컴퓨팅 리소스 사용자를 위한 컴퓨팅 리소스 등록, 카탈로그 검색, 컴퓨팅 리소스 관리, 워크플로우 서비스에 사용되며, 다양한 컴퓨팅 리소스 연계를 위해 확장 가능한 형태로 설계되었다.

  • PDF