• 제목/요약/키워드: 유사도 조인

검색결과 1,173건 처리시간 0.024초

Top-${\kappa}$ 유사도 조인을 위한 샘플링 기반 알고리즘 (A Sampling-based Algorithm for Top-${\kappa}$ Similarity Joins)

  • 박종수
    • 한국정보과학회논문지:데이타베이스
    • /
    • 제41권4호
    • /
    • pp.256-261
    • /
    • 2014
  • Top-${\kappa}$ 유사도 조인 문제는 두 개의 입력 레코드 집합들에서 유사도를 기준한 상위 ${\kappa}$ 개의 레코드 쌍을 찾는 것이다. 샘플링 기법을 이용하여 상위 ${\kappa}$ 개의 유사도 조인 쌍을 반환하는 효율적인 알고리즘을 제안한다. 입력 레코드들의 표본에서 집합 유사도 조인들의 히스토그램을 구성하고, 상위 ${\kappa}$ 개의 조인 쌍을 위한 추정 유사도 한계치를 통계 추론으로 95% 신뢰 구간의 오차 한계 내에서 계산한다. 상위 ${\kappa}$ 개의 유사도 조인을 얻기 위하여 최소-히프 구조를 사용하는 일반 유사도 조인 알고리즘에 이 추정 한계치를 적용한다. 대 용량의 실제 데이터집합에서의 실험결과는 제안된 알고리즘의 좋은 성능을 보여준다.

중앙값을 필터로 이용한 유사도 조인 알고리즘 (A Similarity Join Algorithm Using a Median as a Filter)

  • 박종수
    • 정보처리학회논문지:소프트웨어 및 데이터공학
    • /
    • 제4권2호
    • /
    • pp.71-76
    • /
    • 2015
  • 유사도 조인 처리에서 일반적인 기법은 생성-검증 구조를 사용하여, 첫 번째 생성 단계는 레코드들의 집합에서 후보 쌍들의 집합을 생성하고 두 번째 단계는 실제 유사도를 계산하여 각 후보 쌍을 검증한다. 검증 단계에서 후보 쌍들의 개수를 줄이기 위하여 본 논문에서는 각 후보 쌍의 한 레코드의 중앙값을 다른 레코드와 공통되는 토큰들의 개수가 적절하게 가질 수 있는지를 검사하는 필터로 사용한다. 중앙값 필터를 가지는 유사도 조인 알고리즘을 제안하고 제안된 알고리즘이 실세계 데이터집합에서 여러 실험을 통해 중앙값 필터를 갖지 않는 최근의 알고리즘들에 비해 실행시간에서 더 좋은 성능을 가진다는 것을 보여준다.

맞춤 접두 필터링을 이용한 효율적인 유사도 조인 (Efficient Similarity Joins by Adaptive Prefix Filtering)

  • 박종수
    • 정보처리학회논문지:소프트웨어 및 데이터공학
    • /
    • 제2권4호
    • /
    • pp.267-272
    • /
    • 2013
  • 데이터 정제나 복사 탐지와 같은 많은 응용들을 가진 중요한 연산인 유사도 조인은 도전적인 주제로 데이터집합에서 주어진 한계치 이상의 유사도를 가지는 모든 쌍의 레코드들을 찾는 것이다. 우리는 빠른 유사도 조인을 위해 후보 쌍들의 생성 시에 접두 필터링 원리를 강한 제약 조건으로 사용하는 새 알고리즘을 제안한다. 그 원리에 의해 한정된 접두 토큰들내에서 탐색 레코드의 현재 접두 토큰이 인덱싱 레코드의 접두 토큰을 공유할 때에만 후보 쌍이 생성된다. 이 생성 방법은 두 레코드들 사이에 공통부분의 상한 값을 계산할 필요가 없어서 실행시간을 감소시킨다. 실제 데이터 집합에 적용된 실험 결과는 제안된 알고리즘이 이전의 접두 필터링 방법의 알고리즘들에 비해 상당히 우수함을 보여준다.

지진하중을 고려한 비보강 조적조의 재료특성 평가에 관한 실험연구 (Experimental Study on the Material Properties of Unreinforced Masonry Considering Earthquake Load)

  • 김희철;김관중;박진호;홍원기
    • 한국지진공학회논문집
    • /
    • 제5권2호
    • /
    • pp.93-101
    • /
    • 2001
  • 본 논문은 국내의 비보강 조적조에 대해 내진성능을 조사하기 위하여 재료측성 평가를 위한 실험연구를 수행하였다. 실험결과를 바탕으로 조적용 모르터의 압축강도식을 제안하였다. 또한 조적용 모르터의 배합비에 따른 조적조 프리즘의 압축강도 특성을 비교하였다. 조적조 프리즘의 압축강도로써 조적조의 탄성계수를 구할 수 있는 약산식을 제시하였으며, 약산식을 사인장 조적조 실험을 통하여 구한 전단탄성계수값과 비교하여 볼 때 타당성을 가지고 있다고 판단된다. 실험결과로써 나온 재료특성 값을 바탕으로 2층 조적조 다세대 주택에 대한 유사동적해석을 수행하였다. 해석결과로 얻은 전단응력과 전단파괴가 나타난 사인장 조적조의 허용전단응력은 유사한 것으로 확인되었다.

  • PDF

분산 컴퓨팅 환경에서 효율적인 유사 조인 질의 처리를 위한 행렬 기반 필터링 및 부하 분산 알고리즘 (Matrix-based Filtering and Load-balancing Algorithm for Efficient Similarity Join Query Processing in Distributed Computing Environment)

  • 양현식;장미영;장재우
    • 한국콘텐츠학회논문지
    • /
    • 제16권7호
    • /
    • pp.667-680
    • /
    • 2016
  • 하둡 맵리듀스와 같은 분산 컴퓨팅 플랫폼이 개발됨에 따라, 기존 단일 컴퓨터 상에서 수행되는 질의 처리 기법을 분산 컴퓨팅 환경에서 효율적으로 수행하는 것이 필요하다. 특히, 주어진 두 데이터 집합에서 유사도가 높은 모든 데이터 쌍을 탐색하는 유사 조인 질의를 분산 컴퓨팅 환경에서 수행하려는 연구가 있어 왔다. 그러나 분산 병렬 환경에서의 기존 유사 조인 질의처리 기법은 데이터 전송 비용만을 고려하기 때문에 클러스터 간에 비균등 연산 부하 분산의 문제점이 존재한다. 본 논문에서는 분산 컴퓨팅 환경에서 효율적인 유사 조인 처리를 위한 행렬 기반 부하 분산 알고리즘을 제안한다. 제안하는 알고리즘은 클러스터의 균등 부하 분산을 위해 행렬을 이용하여 예상되는 연산 부하를 측정하고 이에 따라 파티션을 생성한다. 아울러, 클러스터에서 질의 처리에 사용되지 않는 데이터를 필터링함으로서 연산 부하를 감소시킨다. 마지막으로 성능 평가를 통해 제안하는 알고리즘이 기존 기법에 비해 질의 처리 성능 측면에서 우수함을 보인다.

다중 문서에서 구조 정보를 이용한 XML 조인 질의 처리 (XML Join Query Processing using Structured Information from Multiple Documents)

  • 정성호;김병곤;정헌석;이재호;임해철
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2002년도 가을 학술발표논문집 Vol.29 No.2 (1)
    • /
    • pp.100-102
    • /
    • 2002
  • XML 문서에 대한 다양한 질의를 위해서 W3C에서는 XQL, XML-QL, XML-GL, XQUERY와 같은 질의어를 제안하였다. 이들 질의어는 다양한 질의 유형의 분류와 표현은 가능하나, 조인 질의의 경우 단순 조인 질의만을 지원할 뿐, XML 문서의 구조나 텍스트 정보의 유사성을 이용한 보다 다양한 조인 질의에 대한 연구가 미비하였다. 본 논문에서는 다중 문서에 대한 조인 질의를 체계적이고 효과적으로 표현하기 위해, 문서에 대한 조인 질의를 여러 타입으로 분류하였다. 또한 효율적인 질의처리를 위하여 다양한 일반 조인 질의 및 정보검색 기능을 지원하는 유사성 조인 연산자(similarity join operator), 순수 구조 기반 조인을 지원하는 구조 조인 연산자(structured join operator)를 지원하도록 XML 질의어인 QUILT를 확장하였다. 특히, 구조 정보만을 이용한 질의시 구조의 깊이(depth)정보를 이용하여 사용자의 요구에 맞게 질의 검색 범위를 설정하고, XML 문서에 대한 질의 문을 좀더 간결하게 표현할 수 있도록 설계하였다.

  • PDF

저조도 환경에서의 반복적 조도 향상을 이용한 얼굴 검증 (A Face Verification using Iterative Light Enhancement in Low Light Environment)

  • 이상훈
    • 한국방송∙미디어공학회:학술대회논문집
    • /
    • 한국방송∙미디어공학회 2022년도 하계학술대회
    • /
    • pp.1222-1225
    • /
    • 2022
  • 본 논문에서는 저조도 환경에서 촬영된 영상의 조도를 개선하여 얼굴 검증 정확도를 높이는 방법을 제안하였다. 입력 이미지의 조도 개선을 통해 얼굴 검출 정확도를 개선하며, 검출된 얼굴의 반복적인 조도 향상을 통해 생성된 다수의 특징 벡터를 이용하여 얼굴 검증에 이용하였다. 얼굴 검출 및 검증 정확도 측정을 위해 K-FACE 데이터셋을 이용하였다. 저조도 환경에서 촬영된 검증 이미지에 대하여, 제안하는 특징 벡터 합성 방법으로 인해, 동일인 쌍 및 타인 쌍의 유사도 점수 분포의 표준 편차가 줄어드는 경향을 확인했으며, 이로 인해 검증 성능이 높아지는 결과를 얻었다.

  • PDF

연밥 조추출물의 항산화 효능에 관한 융합 연구 (Convergence study on the antioxidant effect of crude extracts of Nelumbo nucifera Gaertner)

  • 김현진
    • 한국융합학회논문지
    • /
    • 제7권3호
    • /
    • pp.53-58
    • /
    • 2016
  • 본 연구의 목적은 glutamic acid, linoleic acid, 연밥의 ethyl acetate 조추출물 및 ethyl alcohol 조추출물의 항산화효과를 알아보고자 하였다. 항산화능을 알아보고자 DPPH 라디칼 소거능, 지질과산화능 및 슈퍼옥사이드 디스뮤타제 유사활성을 측정하였다. Glutamic acid, linoleic acid, 연밥의 ethyl acetate 조추출물 및 ethyl alcohol 조추출물은 농도 의존적으로 DPPH 라디칼 소거능과 슈퍼옥사이드 디스뮤타제 유사활성을 증가시켰다. Glutamic acid, linoleic acid, 연밥의 ethyl acetate 조추출물 및 ethyl alcohol 조추출물은 대조군의 지질과산화의 증가에 비하여 시간 경과에 따른 반비례 양상으로 지질과산화가 감소하였다. 이상의 결과에서 연밥의 조추출물은 우수한 항산화능 물질이 존재 할 가능성을 제시하며 융합 연구를 통한 노화 방지 관련 의약품 개발 등에 응용되어질 수 있다.

코사인 유사도를 이용한 원자력발전소 운전원 커뮤니케이션 품질 평가 프레임워크 (A Framework to Evaluate Communication Quality of Operators in Nuclear Power Plants Using Cosine Similarity)

  • 김승환;박진균;한상용
    • 한국컴퓨터정보학회논문지
    • /
    • 제15권9호
    • /
    • pp.165-172
    • /
    • 2010
  • 커뮤니케이션은 다양한 산업 분야에서 심각한 문제를 야기하는 주요 원인 중에 하나로 여기 지고 있다. 이런 이유로 인간 공학의 한 분야로서 커뮤니케이션에 대한 광범위한 연구가 진행되어왔다. 대형화 및 고도화된 산업 시스템의 안전성을 유지하기 위하여 운전원들의 양질의 커뮤니케이션 품질을 유지하는 것이 중요한 것으로 간주되고 있다. 비상 및 비정상 상황 등의 위급 상황 하에서의 운전원의 커뮤니케이션 품질은 상황 대처 성능을 결정짓는 주요 요인이라 할 수 있다. 양질의 커뮤니케이션은 대화자간의 대화 내용을 상호간에 올바르게 이해 및 숙지한 것이라고 규정할 때, 이는 대화 메시지의 충실도 및 유사도 등을 기반으로 판단할 수 있을 것이다. 본 연구에서는 이러한 필요성에 따라, 원자력발전소 주제어실 운전원들이 비상 및 비정상 상황 하에서의 대응 운전 직무를 수행하기 위해 발생하는 대화 내용의 유사성을 코사인 유사도를 이용하여 측정함으로써, 운전원 커뮤니케이션 품질을 평가할 수 있는 프레임워크를 제안하였다. 모의 훈련 실습에 대해 각 실습조별 수행도 정량 평가 결과와 본 시스템을 이용한 실습조 대화 품질 평가 결과를 비교한 결과 커뮤니케이션 품질이 좋은 실습조가 직무 수행도 평가에서도 높은 점수를 취득하고 있음을 확인하였다.