• 제목/요약/키워드: Saliency Region

검색결과 58건 처리시간 0.026초

차폐영역 정보와 그리드 메쉬 기반의 영상 워핑을 이용한 다시점 영상 생성 (Multi-view Image Generation using Grid-mesh based Image Domain Warping and Occlusion Region Information)

  • 임종명;엄기문;신홍창;이광순;허남호;유지상
    • 방송공학회논문지
    • /
    • 제18권6호
    • /
    • pp.859-871
    • /
    • 2013
  • 본 논문에서는 스테레오 영상에서 얻은 다양한 특징들과 차폐영역에 대한 정보들을 활용하여 그리드 메쉬(grid-mesh) 기반의 영상워핑 기법을 통해 다시점 영상을 생성하는 방법을 제안한다. 제안된 기법에서는 먼저 주어진 스테레오 영상에서 영상 특징 지도(image saliency map), 직선 성분(line segments) 그리고 변이 특징 지도(disparity saliency map)를 추출하고, 추출된 특징들에 대하여 품질을 향상시키는 과정을 거친다. 이 과정은 두 가지 단계로 나뉘는데, 먼저 차폐영역에 대한 정보를 활용하여 객체의 경계 부근에서 추출된 변이 특징 지도의 신뢰도를 향상시킨다. 다음으로 스테레오 영상에서의 시간적 일관성(temporal consistency)에 대한 정보를 활용하여 추출된 영상 특징들의 시간적 일관성을 높인다. 이렇게 품질이 향상된 특징 성분들을 활용하여 그리드 메쉬 기반의 영상 워핑 기법을 통해 다시점 영상을 생성한다. 실험 결과를 통해 제안된 기법으로 생성한 다시점 영상의 주관적 화질 측면에서 기존의 다시점 영상 생성 기법들보다 우수한 것을 확인할 수 있었다.

모션 기반 선택적 주의 시스템 (A Motion-driven Selective Visual Attention System)

  • 박민철;최경주
    • 한국콘텐츠학회논문지
    • /
    • 제5권6호
    • /
    • pp.87-96
    • /
    • 2005
  • 본 논문은 동영상에서 ROI(region of interest)나 FOA(focus of attention)를 탐지하기 위한 방법으로써 여러 시각자극(stimuli)중 모션(motion) 정보를 사용한 선택적 주의 시스템을 소개한다. 2개 이상의 연속적인 프레임으로 구성되는 모션은 시간정보가 포함된 현실세계의 시각장면에서 시간적으로 현저함(temporal saliency) 정도를 나타내는 특징이라 할 수 있으며, 본 연구에서는 이러한 모션을 인간 뇌의 대뇌 시각피질에 존재하는 MT(middle temporal cortex) 영역에 존재하는 "이중 대립 수용야(double opponent receptive fields)"의 특성과 "노이즈 여과(noise filtration)" 기능에 대한 기존의 심리학적 연구 결과를 바탕으로 분석하고, 이렇게 분석된 결과를 MT에서의 "모션통합" 이론을 기반하여 통합한다. 이러한 과정을 통해 동영상에서 다른 주변의 영역과 현저히 다른 돌출 영역으로 정의되는 ROI또는FOA를 탐지할 수 있다. 제안하는 시스템의 성능분석을 위해 인간을 대상으로 한 심리학적인 실험을 추가적으로 수행하여 제안된 시스템을 통해 얻어진 결과와 비교함으로써, 본 시스템이 얼마나 타당성이 있는지 검증하였다.

  • PDF

자연 영상에서의 정확한 문자 검출에 관한 연구 (A Study on Localization of Text in Natural Scene Images)

  • 최미영;김계영;최형일
    • 한국컴퓨터정보학회논문지
    • /
    • 제13권5호
    • /
    • pp.77-84
    • /
    • 2008
  • 본 논문에서는 자연영상에 존재하는 문자들을 효율적으로 검출하기 위한 새로운 접근 방법을 제안한다. 빛 또는 조명의 영향에 의해 획득된 영상 내에 존재하는 반사성분은 문자 또는 관심객체들의 경계가 모호해 지거나 관심객체와 배경이 서로 혼합되었을 경우, 문자추출 및 인식을 함에 있어서 오류를 포함시킬 수 있다. 따라서 영상 내에 존재하는 반사성분을 제거하기 위해 먼저, 영상으로부터 Red컬러 성분에 해당하는 히스토그램에서 두개의 피크 점을 검출한다. 검출된 두 개의 피크 점들 간의 분포를 사용하여 노말 또는 편광 영상에 해당하는지를 판별한다. 노말 영상의 경우 부가적인 처리를 거치지 않고 문자영역을 검출하며 편광 영상인 경우 조명성분을 제거하기 위해 호모모픽 필터링 방법을 적용하여 반사성분에 해당하는 영역을 제거한다. 그리고 문자영역을 검출하기 위해 색 병합과 세일런스 맵을 이용하여 각각의 문자 후보영역을 결정한다. 마지막으로 두 후보영역을 이용하여 최종 문자영역을 검출한다.

  • PDF

인공신경망을 이용한 샷 사이즈 분류를 위한 ROI 탐지 기반의 익스트림 클로즈업 샷 데이터 셋 생성 (Generating Extreme Close-up Shot Dataset Based On ROI Detection For Classifying Shots Using Artificial Neural Network)

  • 강동완;임양미
    • 방송공학회논문지
    • /
    • 제24권6호
    • /
    • pp.983-991
    • /
    • 2019
  • 본 연구는 영상 샷의 크기에 따라 다양한 스토리를 갖고 있는 영상들을 분석하는 것을 목표로 한다. 따라서 영상 분석에 앞서, 익스트림 클로즈업 샷, 클로즈업 샷, 미디엄 샷, 풀 샷, 롱 샷 등 샷 사이즈에 따라 데이터셋을 분류하는 것이 선행되어야 한다. 하지만 일반적인 비디오 스토리 내의 샷 분포는 클로즈업 샷, 미들 샷, 풀 샷, 롱 샷 위주로 구성되어 있기 때문에 충분한 양의 익스트림 클로즈업 샷 데이터를 얻는 것이 상대적으로 쉽지 않다. 이를 해결하기 위해 본 연구에서는 관심 영역 (Region Of Interest: ROI) 탐지 기반의 이미지 크롭핑을 통해 익스트림 클로즈업 샷을 생성함으로써 영상 분석을 위한 데이터셋을 확보 방법을 제안한다. 제안 방법은 얼굴 인식과 세일리언시(Saliency)를 활용하여 이미지로부터 얼굴 영역 위주의 관심 영역을 탐지한다. 이를 통해 확보된 데이터셋은 인공신경망의 학습 데이터로 사용되어 샷 분류 모델 구축에 활용된다. 이러한 연구는 비디오 스토리에서 캐릭터들의 감정적 변화를 분석하고 시간이 지남에 따라 이야기의 구성이 어떻게 변화하는지 예측 가능하도록 도움을 줄 수 있다. 향후의 엔터테인먼트 분야에 AI 활용이 적극적으로 활용되어질 때 캐릭터, 대화, 이미지 편집 등의 자동 조정, 생성 등에 영향을 줄 것이라 예상한다.

시각 주의와 영상 분할을 이용한 관심 객체 자동 검출 기법 (Automatic Detection of Objects-of-Interest using Visual Attention and Image Segmentation)

  • 신도경;문영식
    • 전자공학회논문지
    • /
    • 제51권5호
    • /
    • pp.137-151
    • /
    • 2014
  • 본 논문에서는 일반적인 자연 영상에서 관심 객체를 자동으로 검출하기 위한 방법을 제안한다. 영상에서의 관심 객체는 사람에 따라서 주관적으로 판단되며, 일반적으로 사람의 시각은 관심 객체에 초점이 맞춰지게 된다. 관심 객체의 자동 검출을 위한 첫 번째 단계로서 사람의 시각 인지기반의 돌출 맵을 이용하여 관심 객체의 후보 영역을 검출한다. 검출된 후보영역은 객체에 대한 대략적인 위치 정보를 가지고 있지만 관심 객체를 정확하게 분할하지 못하는 문제점이 존재한다. 따라서 두 번째 단계에서 영상의 색상과 에지를 고려한 그래프 기반의 영상 분할 기법과 객체 영역의 세선화(skeletonization)를 결합함으로써 정확한 객체 영역을 자동으로 검출한다. 본 논문에서는 제안하는 방법과 기존 방법들의 성능을 비교하기 위해서 정확률(precision), 재현율(recall) 그리고 정밀도(accuracy)를 계산하였다. 그 결과, 제안하는 방법은 미 검출(under detection) 및 과검출(over detection)에 대한 문제점을 줄임으로써 기존 방법보다 더 향상된 결과를 보인다.

Salient Object Detection via Adaptive Region Merging

  • Zhou, Jingbo;Zhai, Jiyou;Ren, Yongfeng
    • KSII Transactions on Internet and Information Systems (TIIS)
    • /
    • 제10권9호
    • /
    • pp.4386-4404
    • /
    • 2016
  • Most existing salient object detection algorithms commonly employed segmentation techniques to eliminate background noise and reduce computation by treating each segment as a processing unit. However, individual small segments provide little information about global contents. Such schemes have limited capability on modeling global perceptual phenomena. In this paper, a novel salient object detection algorithm is proposed based on region merging. An adaptive-based merging scheme is developed to reassemble regions based on their color dissimilarities. The merging strategy can be described as that a region R is merged with its adjacent region Q if Q has the lowest dissimilarity with Q among all Q's adjacent regions. To guide the merging process, superpixels that located at the boundary of the image are treated as the seeds. However, it is possible for a boundary in the input image to be occupied by the foreground object. To avoid this case, we optimize the boundary influences by locating and eliminating erroneous boundaries before the region merging. We show that even though three simple region saliency measurements are adopted for each region, encouraging performance can be obtained. Experiments on four benchmark datasets including MSRA-B, SOD, SED and iCoSeg show the proposed method results in uniform object enhancement and achieve state-of-the-art performance by comparing with nine existing methods.

해양환경에서 강건한 물표 추적 알고리즘 (Robust Object Extraction Algorithm in the Sea Environment)

  • 박지원;정종면
    • 한국지능시스템학회논문지
    • /
    • 제24권3호
    • /
    • pp.298-303
    • /
    • 2014
  • 본 논문에서는 해양환경에서 취득한 열상 영상에서 물표를 강건하게 탐지하고 추적하는 알고리즘을 제안한다. 먼저 2-D 이산 Harr 웨이블렛 변환(DHWT) 기법을 이용하여 수평, 수직에지를 얻은 다음 수직 및 수평 에지들을 서로 곱하여 하나의 영상으로 결합해 돌출지도를 생성한다. 그런 다음 돌출지도를 이진화하여 물표를 추출한다. 물표를 추적하기 위하여 인접한 프레임에 존재하는 물체간의 가중치가 부여된 유클리디언 거리를 정합척도로 사용하였으며, 정합결과에 대해 물체의 나타남, 사라짐, 잘못된 물체 추출 등을 고려한 궤적관리를 통하여 최종적인 물체 궤적을 얻는다. 실험결과는 제안하는 알고리즘이 물체를 강건하게 추적함을 보인다.

시선 응시 점 기반의 관심영역 확장을 통한 원 거리 얼굴 검출 (Far Distance Face Detection from The Interest Areas Expansion based on User Eye-tracking Information)

  • 박희선;홍장표;김상열;장영민;김철수;이민호
    • 전자공학회논문지
    • /
    • 제49권9호
    • /
    • pp.113-127
    • /
    • 2012
  • 영상처리 기법을 이용한 얼굴검출에 관한 많은 다양한 방법들이 제시되어 왔다. 일반적으로 가장 많이 쓰이는 얼굴 검출 방식은 Viola와 Jones이 제안한 Adaboost 방식이다. 이 방식은 Haar-like feature을 이용하여 얼굴영상을 선행 학습하고, 검출 성능은 학습된 DB에 의존한다. 이는 일정 거리 범위 안의 학습된 얼굴 크기에서는 얼굴 검출을 잘 수행하지만, 카메라에서 객체(얼굴)의 거리가 멀어지면 얼굴 크기가 작아져 기존에 학습한 Haar-like feature로 얼굴 검출을 하지 못하는 경우가 발생한다. 이에 본 논문에서는 생물학 기반의 선택적 주의집중 기반의 Haar-like feature 정보를 이용한 Adaboost 모델과 사용자의 시선 응시 점 정보를 이용하여, 사용자의 관심영역 확장을 통한 원거리 얼굴 검출 모델을 제안한다. 생물학적 기반의 선택적 주의 집중 모델인 돌출맵(Saliency map) 정보를 이용하여 입력 영상에 대하여 얼굴 후보 영역을 검출하고, 검출된 얼굴 후보 영역 중에서 선행 학습된 Haar-like feature 정보로 Adaboost 알고리즘을 이용하여 최종 얼굴 영상을 검출한다. 그리고 사용자의 시선 응시 점 정보는 관심영역을 선택 하는데 이용된다. 피 실험자가, 카메라로부터 멀리 거리 떨어져 얼굴의 크기가 얼굴검출이 힘들더라도 사용자 시선 응시 점 영역을 선형 보간법으로 확대하여 입력영상으로 재사용함으로써 얼굴 검출 성능을 높일 수 있다. 제안된 방법이 기존의 Adaboost 방법보다 얼굴 검출 성능과 수행시간 면에서 우수함을 실험을 통해 확인하였다.

영상의 주파수-명도 특성을 이용한 관심 영역 탐지에 관한 연구 (A Study on Detecting Salient Region using Frequency-Luminance of image)

  • 유태훈;이종용;김진수;이상훈
    • 한국산학기술학회:학술대회논문집
    • /
    • 한국산학기술학회 2012년도 춘계학술논문집 2부
    • /
    • pp.486-489
    • /
    • 2012
  • 본 논문에서는 인간의 주의시각(Human Visual Attention)에 기반하여 영상에서 가장 유용하다고 생각되는 관심 영역(Salient Region)을 새로운 방식으로 탐지해내고 관심-객체를 검출하는 방법을 제안한다. 제안하는 시스템은 인간의 주의시각 특성인 주파수와 명도, 색상 특징을 이용하는데, 먼저 주파수-명도 정보를 이용한 특징 지도(Feature map)와 색상 정보를 이용한 특징 지도를 각각 생성 한 후 영상의 특징 점(Saliency Point)을 추출한다. 이렇게 생성된 특징 지도와 특징 점을 이용하여 집중 윈도우의 위치와 크기를 결정하고 집중 윈도우 내에 특징 지도를 결합하여 관심 영역을 탐지하고 해당하는 영역에 대해 관심-객체를 추출한다.

  • PDF

Efficient Object-based Image Retrieval Method using Color Features from Salient Regions

  • An, Jaehyun;Lee, Sang Hwa;Cho, Nam Ik
    • IEIE Transactions on Smart Processing and Computing
    • /
    • 제6권4호
    • /
    • pp.229-236
    • /
    • 2017
  • This paper presents an efficient object-based color image-retrieval algorithm that is suitable for the classification and retrieval of images from small to mid-scale datasets, such as images in PCs, tablets, phones, and cameras. The proposed method first finds salient regions by using regional feature vectors, and also finds several dominant colors in each region. Then, each salient region is partitioned into small sub-blocks, which are assigned 1 or 0 with respect to the number of pixels corresponding to a dominant color in the sub-block. This gives a binary map for the dominant color, and this process is repeated for the predefined number of dominant colors. Finally, we have several binary maps, each of which corresponds to a dominant color in a salient region. Hence, the binary maps represent the spatial distribution of the dominant colors in the salient region, and the union (OR operation) of the maps can describe the approximate shapes of salient objects. Also proposed in this paper is a matching method that uses these binary maps and which needs very few computations, because most operations are binary. Experiments on widely used color image databases show that the proposed method performs better than state-of-the-art and previous color-based methods.