• 제목/요약/키워드: 웹 서비스 추출

검색결과 271건 처리시간 0.035초

시맨틱 기술을 활용한 RESTful 웹서비스의 검색 기법 개발 (Development of Search Method using Semantic technologies about RESTful Web Services)

  • 차승준;최윤정;이규철
    • 한국공간정보시스템학회 논문지
    • /
    • 제12권1호
    • /
    • pp.100-104
    • /
    • 2010
  • 최근 웹 2.0의 등장과 함께 플랫폼으로의 웹이 강조되면서, SOAP 기반의 웹서비스에 비해 RESTful 웹서비스가 크게 증가하고 있다. 하지만 서비스들은 이미 많이 존재하며 빠르게 증가하기 때문에 키워드를 기반으로 사용자가 원하는 서비스를 정확하게 찾는 것은 어렵다. 본 논문에서는 이러한 문제를 해결하기 위해서 시맨틱을 활용한 RESTful 웹서비스 검색 기법을 개발하였다. 이를 위해 우선 OpenAPI 통합 검색 시스템을 바탕으로 시맨틱을 활용하기 위한 시스템 구조를 구성하고, 시맨틱 검색을 위한 기술 형식을 모델링하였다. 이를 바탕으로 의미 마크업(태깅, 시맨틱 어노테이션)을 수행하여, 추출된 결과인 RDF 문서를 서비스 저장소에 저장하여 이를 바탕으로 검색을 수행한다. 온톨로지를 활용하여 입력받은 키워드를 확장하고, 이를 바탕으로 검색을 수행하여 사용자에게 유사도 기반의 키워드 검색 기법에서의 검색 결과보다 확장 / 정제된 검색 결과를 제공한다.

온톨로지 기반 지식검색 시스템의 시맨틱 서비스 (Semantic Service in Ontology-based Knowledge Search System)

  • 홍광희;박제현;박주영;최중민
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2006년도 가을 학술발표논문집 Vol.33 No.2 (B)
    • /
    • pp.383-387
    • /
    • 2006
  • 본 논문은 시맨틱 웹의 온톨로지 기술을 이용하여 온톨로지 기반 시맨틱 검색 시스템과 서비스 시스템에 대한 구현을 위하여 문헌 정보를 대상으로 온톨로지를 OWL로 구성하였다. 여기에서 제안한 시스템은 효율적인 관리가 가능하도록 웹(Web) 환경에서 구현하였으며, 데이터의 의미와 구문 및 구조의 통일을 위해 메타데이터의 상호운용성을 고려하며 기술언어로는 XML를 사용한다. 웹 문서에서 특정정보를 추출하고 RDF 메타데이터를 생성하며, 웹 문서의 내용을 정확하게 분류하기 위해 온톨로지(Ontology)를 기반으로 한 지식검색 시스템의 시맨틱 서비스시스템을 제안한다.

  • PDF

사용자 프로파일 및 어노테이션을 이용한 XML 문서 트랜스코딩 (XML Document Transcoding using User Profile and Annotation)

  • 정쌍용;손원성;이진상;임순범;최윤철
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2003년도 가을 학술발표논문집 Vol.30 No.2 (2)
    • /
    • pp.469-471
    • /
    • 2003
  • 트랜스코딩이란 기존 유선 환경에서 제공되는 웹 컨텐츠를 특정 환경에 적합한 형태로 변환 하는 것을 의미한다. 그러나 이와 관련된 기존 연구에서는 사용자가 요구하는 사항만을 변환 하거나 서비스 제공자가 일방적으로 변환하여 웹 컨텐츠를 제공하고 있다. 따라서 이슈변화에 따른 사용자의 대처능력이 떨어지기 때문에 사용자의 사용성이 저하되며, 사용자에게 무의미한 정보 제공의 가능성이 있다. 이러한 문제점들을 해결하기 위해 본 논문에서는 사용자 프로파일에 의한 요구사항과 서비스 제공자의 의견을 함께 제공 할 수 있는 변환 기법을 제안 하고, 특히 멀티미디어 뉴스 제작을 위한 표준인 NewsML을 대상으로 적용하였다. 사용자 프로파일에 의한 요구 사항은 XML 문서의 구조정보를 이용하여 자동으로 추출하고, 서비스 제공자의 의견은 문서의 레이아웃(Layout) 정보를 가지고, 어노테이션(Annotation) 기법을 활용하여 수동으로 추출한다. 그 결과, 사용자 관점에 부합하는 변환이 이루어지고, 다양한 이슈변화에 대한 대처능력이 향상되어 사용자의 사용성이 증대 되었다

  • PDF

지능적 비즈니스를 위한 XML 기반 실시간 의미정보지향 서비스 시스템 설계 (XML based Real-Time Semantic Information Oriented Service System Design for Intelligent Business)

  • 홍성용;진혜진
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2007년도 춘계학술발표대회
    • /
    • pp.6-9
    • /
    • 2007
  • 최근 e-비즈니스나 인터넷 쇼핑몰 사이트에서는 많은 양의 상품 이미지 정보와 컨텐츠를 취급하고 있으며, 이로 인하여 효과적인 실시간 의미정보 검색의 필요성이 대두되고 있다. 본 논문에서는 XML 기술과 퍼지기술을 이용하여 웹상의 상품 정보를 의미적으로 검색할 수 있는 시스템에 대해 기술한다. 본 논문에서 제시한 시스템은 상품 이미지 XML 문서를 이용하여 메타데이타를 추출하고, 추출된 메타데이타를 의미정보로 자동 변환하여 실시간 서비스할 수 있는 방법을 제안한다. 따라서, 인터넷 비즈니스를 좀 더 지능화 할 수 있는 시맨틱 웹 환경이나 Web2.0 을 구현하는데 기여할 수 있을 것이라 기대한다. 또한 사용자의 입장에서는 실시간 의미정보를 서비스 받을 수 있는 장점을 가지게 될 것이다.

지능형 전자상거래를 위한 온톨로지의 효율적인 생성

  • 김태석;양진혁;이지홍;손종수;정인정
    • 한국지능정보시스템학회:학술대회논문집
    • /
    • 한국지능정보시스템학회 2005년도 공동추계학술대회
    • /
    • pp.273-279
    • /
    • 2005
  • 월드와이드웹 (WWW) 기반의 전자상거래는 주로 데이터베이스를 기반으로 서비스를 제공하고 있다. 그러나 월드와이드웹 기반의 전자상거래는 단순 키워드 검색에만 의존하고 있다. 이러한 검색은 데이터베이스 자체로는 의미적인 정보를 효과적으로 처리하기에는 많은 문제점이 있다. 1999년 말에 의미적인 정보를 효과적으로 처리하기 할 수 있는 시맨틱 웹 이 제안되었다. 시맨틱 웹은 의미적인 정보를 담고 있는 지식베이스(Knowledge Bases)인 온톨로지를 기반으로 하고 있다. 그러나 온툴로지의 생성은 많은 부분을 휴리스틱에 의존하고 있기 때문에 많은 시간과 비용이 소비된다. 따라서 우리는 이와 같은 문제를 해결하기 위하여 데이터베이스에서 온톨로지를 생성하는 방법을 제안한다. 데이터베이스는 도메인을 잘 나타내고 있는 정보의 저장소이므로 데이터베이스로부터의 온톨로지 생성은 분석, 설계 등의 사전 작업이 필요하지 않아 시간과 비용의 소비를 줄 일 수 있는 장점이 있다. 우리는 데이터베이스에서 스키마를 추출, 뼈대그래프$^{1}$ 를 생성하고 개념그래프로 확장하여 도메인을 잘 나타낼 수 있는 온톨로지를 생성하는 알고리즘을 제안하고 제안된 알고리즘을 통하여 온톨로지를 생성을 함으로서 제안된 생성 방법을 검증한다. 제안한 방법으로 생성된 온톨로지는 단순 키워드 검색에서 의미적인 검색을 할 수 있는 시맨틱 웹 서비스의 기반이 되므로 의미적 검색이 가능한 전자상거래 서비스를 구축하는데 시간과 비용의 소비를 줄임으로 차세대 전자상거래의 초석이 된다.

  • PDF

시맨틱 웹 환경에서 웹 서비스를 위한 RDF Triple 처리기법 (RDF Triple Processing Methodology for Web Service in Semantic Web Environment)

  • 정관호;김판구;김권천
    • 인터넷정보학회논문지
    • /
    • 제7권2호
    • /
    • pp.9-21
    • /
    • 2006
  • 온톨로지를 사용하여 웹 서비스 검색 기능을 향상시키려는 연구가 진행되고 있다. 그 중 DAML, DAML+OIL를 이용하여 UDDI를 검색하는 방안이 제안되었다. 하지만 이 방식은 UDDI 검색에 적합한 연산자들을 사용해야 하는 불편함과 그에 따른 온톨로지를 정의해 주어야 하는 번거로움이 존재한다. 이러한 문제점을 해결하기 위해 본 논문에서는 시맨틱 웹 환경에서 정보검색 및 의미적인 추천을 위한 N-Triple 처리, 핵심 Triple 추출을 위한 필터링, Triple 통합, Triple간 의미적 연결, Triple 탐색 기법을 제시하고 더 나아가 제시된 기법으로 시스템을 설계하고 구현한다. 끝으로 가상의 시맨틱 웹 환경에서 제안된 시스템을 실험하여 본 논문의 유용성을 입증한다.

  • PDF

WAP기반 무선 컨텐츠 변환기 System의 설계 및 구현 (A Design and Implementation of Wireless Contents Converting System based on Wireless Application Protocols)

  • 이정은;최철웅;장지산;김성찬;신동일;신동규
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2001년도 춘계학술발표논문집 (하)
    • /
    • pp.1145-1148
    • /
    • 2001
  • 본 논문에서는 기존의 HTML로 기술된 웹 페이지를 그대로 유지하면서 휴대 단말기를 이용하여 웹 페이지에 접근하려고 할 때, 휴대 단말기에서 웹 페이지를 기술하는 언어인 WML로 변환하여 사용자에게 서비스하는 시스템을 개발하며, 좀 더 고질의 서비스를 위해 웹 에이전트를 이용하여 사용자의 기호에 맞는 데이터를 웹 상에서 추출하여 WML 문서로 전환해주는 무선 컨텐츠 변화기 System을 설계 그리고 구현한다.

  • PDF

시맨틱 웹 응용 서비스에서의 텍스트 처리 기술 적용 (Use of Text Processing Technologies in a Semantic Web Application)

  • 정한민;강인수;구희관;이승우;김평;성원경
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2006년도 제18회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.189-196
    • /
    • 2006
  • 본 논문은 시맨틱 웹 응용 서비스를 구현함에 있어 필수적으로 요구되는 온톨로지 인스턴스 구축을 효율적으로 처리하는 데 있어 텍스트 처리 기술이 어떤 역할을 수행할 수 있는 가를 $OntoFrame-K^{(R)}$라는 시맨틱 웹 기반 정보 유통 체계에의 적용 사례를 통해 살펴본다. 본 논문에서 소개하는 텍스트 처리 기술은 개체 확인물 통한 개념 사례화, 주제 분야 할당을 통한 메타데이터 확장에, 그리고 인용 정보 추출 및 인용 관계 구축을 통한 객체 관계속성 구축에 적용된다. 개체 확인에서는 메타데이터 비교 잊 병합을 사용하였으며 이를 기반으로 한 수작업 구축을 통해 8,543명의 인력 URI를 확보하였다. 주제 및 분야 할당에서는 색인어와 분야분류명이 매핑된 시소러스 개념어의 매칭을 통해 색인어 별 TF (Term Frequency), 색인어와 매칭된 개념어 별 TF, 색인어와 매칭된 개념어 별 시소러스에서의 깊이, 색인어와 매칭된 개념어 별 개념 패싯, 색인어와 매칭된 각 개념어에 부착된 분야분류명 목록 등 할당을 위한 다양한 자질을 확보 적용하였다. 인용 정보 추출과 인용 관계 구축에서는 객체 URI와 인력 URI를 기반으로 하여 자동 추출된 인용 정보를 반영하는 방식으로 7,237개 문헌으로부터 총 135개의 인용 네트워크 그룹을 자동으로 확보하였다. 본 연구를 통해 제시된 텍스트 처리 기술의 활용 방안이 향후 시맨틱 웹 응용 서비스 및 인프라 구현에서 다각적으로 활용될 수 있기를 기대한다.

  • PDF

ScienceON 웹 로그에 대한 인간 및 웹 크롤러 행위 패턴 분석 (Analysis of Behavior Patterns from Human and Web Crawler Events Log on ScienceON)

  • ;정한민;박정훈
    • 한국정보통신학회:학술대회논문집
    • /
    • 한국정보통신학회 2022년도 춘계학술대회
    • /
    • pp.6-8
    • /
    • 2022
  • 웹 로그 분석은 서비스 개선에 있어 필수적인 절차 중 하나이다. ScienceON은 다양한 과학기술 문헌과 정보를 서비스하는 대표적인 정보 서비스이며, 우리는 지속적인 개선을 위해 웹 로그를 분석하고 있다. 본 연구는 2020년 5월과 2021년 5월 생성된 ScienceON 웹 로그에 대해 인간과 웹 크롤러로 구분하여 심층적인 분석을 하는 데 목표를 두고 있다. 먼저 S(검색), V(상세보기), D(다운로드) 타입에 해당하는 웹 로그만 추출하여 각 시기에 대해 658,407와 8,727,042 레코드로 정규화하였다. 그리고, 파이썬 'user_agents' 라이브러리를 이용하여 인간과 웹 크롤러로 로그를 분리하였으며, 각 로그에 대해 60초를 기준으로 세션 크기를 설정하고 분석하였다. 인간과 달리 웹 크롤러는 세션 당 평균 행위 패턴(Average Behaviors per Session)의 길이가 상대적으로 길고, 행위 패턴이 V 중심으로 이루어짐으로 확인하였다. 향후 웹 크롤러를 쉽게 탐지하고 대응하며, 인간 사용자의 행위 패턴에 대응할 수 있도록 서비스를 개선할 예정이다.

  • PDF

다차원 연관 분석을 이용한 인터넷 이용자의 특징 분석 (Analysis of Internet User Features using Multi-dimensional Association Analysis)

  • 이수은;정용규
    • 서비스연구
    • /
    • 제1권1호
    • /
    • pp.61-69
    • /
    • 2011
  • 데이터 마이닝은 대용량의 데이터베이스로부터 기존에 알려지지 않은, 즉 단순한 질의어로 추출할 수 없는 형태의 '유용한' 정보를 찾아내고 이를 바탕으로 데이터에 대한 통찰(insight)을 얻는 것으로 정의할 수 있다. 본 논문에서는 웹에서 발생하거나 웹 사이트에 저장한 데이터를 대상으로 유용한 패턴을 찾아내기 위하여 인터넷을 이용하는 이용자의 특징을 분석하기 위해 시도되었다. 즉 인터넷 사용자에 대한 일반적인 통계 정보 데이터에 연관성 분석을 적용하여 인터넷 사용 시간에 영향을 미치는 인터넷 이용자의 특징을 분석하였다. 실험을 통하여 데이터로부터의 연관 규칙을 추출 해내었으며, 최적의 결과를 도출하기위한 데이터 전처리 및 알고리즘을 적용하여 웹 마이닝을 위한 인터넷 사용자의 특징을 분석한 결과 그 유용성을 확인할 수 있었다.

  • PDF