• 제목/요약/키워드: 개념벡터

검색결과 188건 처리시간 0.032초

바이오 마커와 질병 용어의 단어 표현 분석 (Word Representation Analysis of Bio-marker and Disease Word)

  • 윤영신;남경민;김유섭
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2015년도 제27회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.165-168
    • /
    • 2015
  • 기계학습 기반의 자연어처리 모듈에서 중요한 단계 중 하나는 모듈의 입력으로 단어를 표현하는 것이다. 벡터의 사이즈가 크고, 단어 간의 유사성의 개념이 존재하지 않는 One-hot 형태와 대조적으로 유사성을 표현하기 위해서 단어를 벡터로 표현하는 단어 표현 (word representation/embedding) 생성 작업은 자연어 처리 작업의 기계학습 모델의 성능을 개선하고, 몇몇 자연어 처리 분야의 모델에서 성능 향상을 보여 주어 많은 관심을 받고 있다. 본 논문에서는 Word2Vec, CCA, 그리고 GloVe를 사용하여 106,552개의 PubMed의 바이오메디컬 논문의 요약으로 구축된 말뭉치 카테고리의 각 단어 표현 모델의 카테고리 분류 능력을 확인한다. 세부적으로 나눈 카테고리에는 질병의 이름, 질병 증상, 그리고 난소암 마커가 있다. 분류 능력을 확인하기 위해 t-SNE를 이용하여 2차원으로 단어 표현 결과를 맵핑하여 가시화 한다.

  • PDF

유사도 통합에 관한 연구 (A Study on Integrating Similarities)

  • 김선경;박지수;손진곤
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2020년도 추계학술발표대회
    • /
    • pp.53-56
    • /
    • 2020
  • 유사도는 두 객체의 비슷한 정도를 실수로 나타낸 것이며 반대 개념인 다른 정도를 나타내는 것을 거리라 한다. 실세계에서 정확히 같은 것은 존재하기 힘들기 때문에 많은 응용 분야에서 유사도나 거리를 이용한다. 거리 중 대표적인 것으로 유클리드 공간에서 두 점 사이의 직선거리이다. 이 거리를 유클리드 거리라고 한다. 코사인 유사도는 벡터 공간에서 두 벡터 사이각의 코사인 값이다. 이외에도 용도에 따라 다양한 거리 또는 유사도가 연구되고 있다. 수학적으로 유사도는 이변수 함수로 나타낸다. 앞선 연구에서 민코프스키는 맨하탄 거리, 유클리드 거리 등을 매개변수 p를 이용하여 하나의 식으로 통합하였다. 이러한 유사도 통합은 유사도에 대한 새로운 통찰력을 제공하고 또 다른 응용을 제공한다. 본 논문은 기존 유사도의 의미를 개관하고 추가적인 매개변수를 도입하여 민코프스키 거리와 코사인 유사도를 통합한 식을 제시한다.

수리계획법을 이용한 서포트 벡터 기계 방법에 관한 연구 (Study on Support Vector Machines Using Mathematical Programming)

  • 윤민;이학배
    • 응용통계연구
    • /
    • 제18권2호
    • /
    • pp.421-434
    • /
    • 2005
  • 기계학습은 패턴분류의 한 도구로써 광범위하게 연구되고 있다. 기계학습 방법들 중에서 서포트 벡터 기계(Support Vector Machines)는 많은 분야에서 연구되어지는 것으로 이진 패턴 분류문제에서 고차원의 특징공간에서 두 집합들 사이에 가장 큰 분리를 제공하는 최대 여유도(margin)를 가지는 분리 초평면을 찾는 것이다. 최대 여유도의 분리의 개념에 기초하여 Mangasarian(1968)은 다중-표면 방법(multi-surface method)을 제안하였고, 1980년대에 목적 계획법을 이용한 방법들이 광범위하게 개발되었다. 본 논문에서는 다목적 계획법과 목적 계획법을 이용한 수리계획법인 서포트 벡터 기계의 두가지 방법들을 제안하고 수치 예제들을 통하여 효용성에 대하여 논의하고자 한다.

대용량 데이터를 위한 효율적인 다차원 색인구조 (An Efficient Multi-Dimensional Index Structure for Large Data Set)

  • 이병엽;유재수
    • 한국지리정보학회지
    • /
    • 제5권2호
    • /
    • pp.54-68
    • /
    • 2002
  • 최근 지리정보시스템, 움직임 객체관리시스템, 동영상/이미지 내용기반 검색시스템, 시계열 데이터베이스시스템과 같이 다차원 데이터를 이용하는 응용에 대한 관심이 고조되고 있다. 이 논문은 다차원의 특징벡터를 벡터 근사치로 표현한 후 색인 트리를 구성하여 검색의 효율을 높이는 VA(vector approximate)-트리를 제안한다. 이 논문에서 제안하는 VA-트리는 전체적인 색인구조의 저장공간을 줄이기 위해서 VA-파일의 벡터 근사치 개념을 이용하여 데이터량이 증가해도 검색 성능이 저하되지 않도록 하는 트리 형태의 구조를 갖는다. VA-트리는 MBR 기반의 색인구조이지만 MBR 간에 겹침이 발생하지 않는 분할방법을 사용하여 검색 효율을 높인다. 제안하는 색인구조와 기존의 여러 다차원 색인구조와의 성능 평가를 통해 제안하는 방법의 우수함을 보인다.

  • PDF

MPEG-4 객체의 브라우징 및 학습에 의한 추출 기법 (MPEG-4 Object Browsing and Extraction by Learning)

  • 양만석;오상욱;설상훈
    • 한국방송∙미디어공학회:학술대회논문집
    • /
    • 한국방송공학회 1999년도 학술대회
    • /
    • pp.115-120
    • /
    • 1999
  • 본 논문은 MPEG-4 비디오 객체의 브라우징(browsing) 및 학습을 통한 객체 추출 기법을 제안한다. 제안된 학습에 의한 객체 추출 기법은, 객체 브라우징 시 임의 접근한 프레임에서 사용자가 내용 기반의 객체를 검색하기 위해 선택한 영역에 대한 인지적인 정보를 특징벡터(feature vector)로 history에 저장, 활용함으로써 프레임 내 객체의 계층적인 군집화(clustering)를 수행한다. 이러한 기법으로 인지적 개념과 근접하게 객체를 인식할 수 있음을 실험을 통해 확인하였다.

  • PDF

에이전트 기반 지리정보시스템 구조 설계 (Architecture Oesign for an Agent-based GIS)

  • 박경모
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2002년도 봄 학술발표논문집 Vol.29 No.1 (B)
    • /
    • pp.544-546
    • /
    • 2002
  • 본 논문에서는 에이전트 기반 지리정보시스템(Geographic Information System) 구조 설계 개념에 대해 기술한다. 본 구조의 본체론 관련 GIS 분야 에이전트들 사이에 정보 교환에 필요한 세 가지 구성요소가 있는데 첫째는, 벡터, 래스터, 이미지를 포함하는 데이터이며 둘째로, 이름, 입력, 출력 및 요구 파라미터를 포함하는 알고리즘 명세이고 셋째로, 질의 및 결과 정보가 그 마지막이다. 에이전트 통신 언어(Agent Communication Language)는 에이전트들 간의 통신의 기반으로 제공된 본체론을 사용한다. 본체론과 ACL은 분산 다중-에이전트 GIS 시스템의 에이전트 통신에 있어 중심적 역할을 하고 extensible Markup Language(XML)를 이용한 Resource Description Framiework(RDF)로 인코딩 되며 공동작업과 재사용을 지원할 수 있다

  • PDF

리니어모터를 적용한 엘리베이터 도어시스템 개발 (Development of Elevator Door System with Linear Induction Motor)

  • 김윤현
    • 한국산학기술학회:학술대회논문집
    • /
    • 한국산학기술학회 2011년도 춘계학술논문집 1부
    • /
    • pp.339-342
    • /
    • 2011
  • 본 논문은 기존의 복잡한 구조의 전통적인 엘리베이터 도어의 문제점을 개선한 리니어유도모터(LIM)를 적용한 단순 메커니즘 구조와 직접 구동의 신개념의 엘리베이터 도어시스템의 개발에 관한 것으로 최적의 도어 구조와 리니어모터의 설계, 벡터제어에 의한 고성능 구동제어기 및 최적 운전 패턴을 제안하였다. 또한 본 논문에서는 제안된 리니어도어시스템의 설계와 제작과정에 대해서 자세히 서슬하며 실제 제작되어 분석과 시험에 의해 성능을 검증하고자 한다.

  • PDF

언어장애인용 문장발생장치에 적용 가능한 동사예측 (An Applicable Verb Prediction in Augmentative Communication System for Korean Language Disorders)

  • 이은실;홍승홍;민홍기
    • 감성과학
    • /
    • 제3권1호
    • /
    • pp.25-32
    • /
    • 2000
  • 본 논문에서는 언어장애인용 문장발생장치의 통신율을 증진시키기 위한 처리방안으로 신경망을 이용하여 문장발생장치에 동사예측을 적용하는 방법을 제안하였다. 각 단어들은 구문론과 의미론에 따른 정보벡터로 표현되며, 언어처리는 전통적으로 사전을 포함하는 것과는 달리, 상태공간에서 다양한 영역으로 분류되어 개념적으로 유사한 단어는 상태공간에서의 위치를 통하여 알게 된다. 사용자가 심볼을 누르면 심볼에 해당하는 단어는 상태공간에서의 위치를 찾아가며, 신경망 학습을 통해 동사를 예측하였고 그 결과 제한된 공간 내에서 약 20% 통신율 증진을 가져올 수 있었다.

  • PDF

XML 필터링을 위한 WFilter(Weighted Filter) (WFilter (Weighted Filter) for XML filtering)

  • 최정필;최오훈;백두권
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2003년도 가을 학술발표논문집 Vol.30 No.2 (3)
    • /
    • pp.253-255
    • /
    • 2003
  • XML 문서를 비롯하여 인터넷을 통해 교환되는 문서의 비약적인 증가로 인하여, 불필요한 문서에 대한 필터링 및 문서 내의 데이터를 필터링하여 정보를 선택적으로 사용하고자 하는 사용자의 요구가 증대되었다. 기존 XML 필터링 방식은 질의 구조에 의존적이기 때문에, 질의 증가에 따른 필터링 인덱스 구성 및 유지의 문제점을 야기할 수 있다. 본 논문에서는 정보 추출 분야에서 널리 사용되는 단어 벡터의 개념을 사용하여 선택적으로 질의에 가중치를 주어 데이터를 효율적으로 추출할 수 있는 XML WFilter (Weighted Filtering) 기법을 제안한다.

  • PDF

벡터합을 이용한 위치 예측 기법 (Prediction Method Using Weighted Vector Addition)

  • 이현석;양성봉
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2000년도 가을 학술발표논문집 Vol.27 No.2 (2)
    • /
    • pp.529-531
    • /
    • 2000
  • 본 논문은 Geometry Compression 분야에서 다뤄지는 압축기법 중 delta encoding 과정을 보완하여 좀 더 높은 압축률을 얻고자 하는 vertex position prediction 과정에 대한 내용으로 구성되어 있다. 이것은 triangle strip 형태의 입력을 받아서 그 vertex data 중 position 정보들간의 delta encoding 과정을 예측 기법을 이용한 encoding 과정으로 대체하여 Huffman encoding 과정에서의 symbol 개수를 줄여 압축률을 향상시키자는 개념에서 출발한다. triangle strip 생성 기법 중 greedy algorithm을 적용한 후, 기존의 parallelogram 방식과 이 논문에서 새로이 제안하는 방식을 비교하여 보다 나은 압축 방식을 제시하는 것이 이 논문의 목적이다. 이 논문에서 제시하는 방식을 실험한 결과, 기존의 예측 기법에 비해 2.4% 정도의 향상을 보여주고 있다.

  • PDF