• 제목/요약/키워드: Document Image

검색결과 300건 처리시간 0.027초

에지 방향 히스토그램을 이용한 텍스트 문서 영상의 워터마킹 (A Watermarking for Text Document Images using Edge Direction Histograms)

  • 김영원;오일석
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제31권2호
    • /
    • pp.203-212
    • /
    • 2004
  • 워터마킹은 멀티미디어 컨텐츠의 저작권을 보호하기 위한 방법이다. 이러한 미디어 중에서 텍스트 문서는 블록/줄/단어의 계층 구조와 배경/전경의 확연한 구분 같은 고유한 특성을 나타내므로, 텍스트 문서를 위한 워터마킹 알고리즘은 이러한 특성을 잘 반영하여 설계하여야 한다. 본 논문은 명암을 갖는 텍스트 문서 영상을 위한 워터마킹 알고리즘을 제안한다. 워터마크 신호는 에지 방향 히스토그램을 통해서 삽입된다. 문서 영상의 부분 영상들은 모두 유사한 성질을 갖는다는 ‘부분 영상 일관성’을 제시한다. 한글 영상, 영문 영상, 한문 문서 영상을 대상으로 부분 영상 일관성을 조사하여, 부분 영상 일관성은 언어에 무관하며 다양한 문서 영상에 적용할 수 있음을 보인다. 워터마크 신호를 삽입하기 위하여 에지방향 히스토그램을 조작하였으며 다양한 실험을 통해 알고리즘의 비 인지성과 강인성을 분석하고 평가하였다.

Splitting and Merging Algorithm Based on Local Statistics of Sub-Regions in Document Image

  • Thapaliya, Kiran;Park, Il-Cheol;Kwon, Goo-Rak
    • Journal of information and communication convergence engineering
    • /
    • 제9권5호
    • /
    • pp.487-490
    • /
    • 2011
  • This paper presents splitting and merging algorithm based on adaptive thresholding. The algorithm first divides the image into blocks, and then compares each block using the calculated thresholding value. The blocks which are same are merged using the certain threshold value and different blocks are split unless it satisfies the threshold value. When the block has been merged, maximum and minimum block sizes are determined then the average block size is determined. After the average block size is determined the average intensity and standard deviation of average block is calculated. The process of thresholding is applied to binarize the image. Finally, the experimental results show that the proposed method distinguishes clearly the background with text in the document image.

쿼드트리로 표현된 한글 문서 영상에서의 문자 추출 (Character Extraction from the Hangeul Document Image Represented by a Quadtree)

  • 백은경;조동섭
    • 대한전기학회논문지
    • /
    • 제41권7호
    • /
    • pp.793-801
    • /
    • 1992
  • This paper proposes a method of extracting connected strokes and characters in a Hangeul document image represented by a quadtree. Connected strokes are extracted by examining adjacency for each node of a black region to the side of east and south. Then, each character is extracted by the sizes and the relations of connected strokes. This is done by iterative vertical and horizontal manipulation. The result shows all characters are extracted in the same sequence as that of context with space and time efficiency.

MathML 수식 구조 표현을 지향하는 XML 문서 편집 시스템의 설계 및 구현 (Design and implementation of XML document edit system that intend to MathML mathematical formula structure representation)

  • 김철순;정회경
    • 한국정보통신학회:학술대회논문집
    • /
    • 한국해양정보통신학회 2002년도 추계종합학술대회
    • /
    • pp.363-367
    • /
    • 2002
  • 컴퓨터를 이용한 전자문서처리에 이용되는 기존의 문서편집 시스템에서는 비구조적인 문서구조를 다루게 됨으로써 시스템 내에서 사용되는 수학식의 표현은 이미지나 텍스트 등의 비구조적인 방법에 의해 표현되거나 처리된다. 이렇게 사용된 수학식은 문서의 가독성과 재사용성 그리고 문서의 처리와 교환에 상대적인 불편을 초래하게 된다. 그러므로 이러한 단점을 극복하고 효율적으로 구조적인 문서상에 MathML(Mathematical Markup Language) 수식 구조를 적용시킬 수 있는 문서편집 시스템이 요구된다. 이에 본 논문에서는 MathML을 기반으로 한 수학식의 표현을 구조적으로 처리할 수 있는 MathML 수식 편집이 가능한 XML(eXtensible Markup Language) 기반의 구조적 문서생성을 위한 문서 편집 시스템을 설계 및 구현하였다.

  • PDF

1차원 메디안 필터 기반 문서영상 영역해석 (The Region Analysis of Document Images Based on One Dimensional Median Filter)

  • 박승호;장대근;황찬식
    • 대한전자공학회논문지SP
    • /
    • 제40권3호
    • /
    • pp.194-202
    • /
    • 2003
  • 인쇄문서를 전자문서로 자동변환하기 위해서는 문서영상 영역해석과 문자인식 기술이 필요하다. 이들 중 영역해석은 문서영상을 세부 영역으로 분할하고, 분할한 영역을 문자, 그림, 표 등의 형태로 분류한파. 그러나 문자와 그림의 일부는 크기, 밀도, 화소분포의 복잡도가 비슷하여 정확한 분류가 어렵다. 따라서 영역해석에서의 오 분류는 자동변환을 어렵게 만드는 주된 원인이 된다. 본 논문에서는 분서영상을 문자와 그림영역으로 분할하는 영역해석 방법을 제안한다. 문자와 그림의 분류는 1차원 메디안 필터링을 기반으로 한 방법을 이용하여 언급한 문제점을 해결한다. 또한 메디안 필터링에 의해 발생하는 볼드체 문자와 그래프나 표와 같은 그림영역의 오 분류 문제를 표피 제거 필터와 문자의 최대크기를 이용하여 해결한다. 따라서 상용제품을 포함한 기존의 영역해석 방법보다 그 성능이 우수하다.

공백행의 중심점 추출에 의한 고속 문서 기울기 검출 (Fast Skew Detection of Document Images by Extraction of Center Points of Blank Lines)

  • 정재영;김문현
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제26권11호
    • /
    • pp.1342-1349
    • /
    • 1999
  • 본 논문에서는 문서 내의 인접한 두 행 사이에는 일정한 두께의 공백 행이 존재하며 그 공백 행의 기울기는 실제 문서의 기울어진 정도를 반영한다는 사실에 기반하여, 선형적으로 기울어진 문서 영상의 기울기 추정을 위한 고속의 알고리즘을 제안한다. 먼저, 간단한 모폴로지 연산(dilation)을 이용하여 문자행 영역과 공백행 영역을 분리한 후, 이를 일정 간격으로 수직 샘플링하여 수직선 상에 있는 모든 공백행의 중심점(행간점)을 찾는다. 동일한 공백 행 상에 있는 인접한 두 행간점 간에 기울기를 계산하고, 전체 영상으로부터 이들의 분포를 조사하여 최대 빈도를 가지는 기울기를 입력 문서의 기울기로 추정한다. 실험에서는 제안한 알고리즘을 필기체 및 인쇄체를 포함하는 다양한 형태의 가로쓰기 문서에 적용한 결과를 보인다.Abstract In this paper, we propose a fast algorithm to estimate the skew angle of linearly skewed document images. This paper is based on the fact that there is a blank line with uniform thickness between two adjacent text lines and the slope of the line is the same as that of the document. Firstly, we apply a dilation operation to the image to separate blank lines from text lines, and we detect center points of blank lines along the vertically sampled lines. Then we calculate the slope between neighboring center points in the same blank line. Calculated slopes for the entire image are accumulated on the histogram to display the distribution of them. Finally, the peak in the histogram is detected and estimated as the slope of the document image. In the experiments, we adopted a lot of images of various format with hand-printed or machine-printed document to verify our algorithm.

지역적 엔트로피와 텍스처의 주성분 분석을 이용한 문서영상의 분할 및 구성요소 분류 (Segmentation and Contents Classification of Document Images Using Local Entropy and Texture-based PCA Algorithm)

  • 김보람;오준택;김욱현
    • 정보처리학회논문지B
    • /
    • 제16B권5호
    • /
    • pp.377-384
    • /
    • 2009
  • 본 논문은 지역적 엔트로피 기반의 히스토그램을 이용한 문서영상의 분할과 텍스처 기반의 주성분 분석을 이용한 구성요소인 글자, 그림, 그래프 등의 구성요소 분류방안을 제안한다. 지역적 엔트로피와 히스토그램을 이용함으로써 문서영상의 다양한 변형이나 잡음에 강건하며 빠르고 손쉬운 이진화가 가능하다. 그리고 문서영상 내 존재하는 구성요소들이 각기 다른 텍스처 정보를 가지고 있다는 것에 착안하여 각 분할 영역의 텍스처 정보를 기반으로 주성분분석을 수행하였으며 이를 통해 사전에 구성요소들에 대한 구조정보를 설정할 필요가 없다는 장점을 가진다. 실험결과에서 다양한 문서영상의 분할 및 분류결과를 보였으며, 기존 방법보다 우수한 성능을 가져 그 유효함을 보였다.

Water flow model에 기반한 문서영상 이진화 방법의 속도 개선 (Speed-up of Document Image Binarization Method Based on Water Flow Model)

  • 오현화;김도훈;이재용;김두식;임길택;진성일
    • 대한전자공학회논문지SP
    • /
    • 제41권4호
    • /
    • pp.75-86
    • /
    • 2004
  • 본 논문에서는 water flow model의 개념을 적용한 문서영상 이진화 방법의 속도를 개선하는 방법을 제안한다. 제안한 방법은 문서영상에서 문자 주위를 관심영역(region of interest: ROI)으로 추출하고 3차원 영상지형에서 물이 뿌려지는 영역을 관심영역 이내로 제한한다. 국부 계곡에 누적되는 물의 양은 계곡의 깊이와 경사를 이용하여 자동으로 결정된다. 그리고 계곡의 최저 지점뿐만 아니라 그 주위에도 가중치를 부여하여 물을 누적함으로써 관심영역에 해당하는 영상지형에 물을 붓는 과정을 한번만 수행하여 충분한 양의 물이 계곡에 채워지도록 한다. 계곡에 형성된 연못의 깊이는 배경과 문자의 밝기 차에 따라 다양하므로 연못의 깊이를 기준으로 문자 분리를 위한 임계치를 적응적으로 결정한다. 실제 문서영상에 대한 실험에서 제안한 방법의 수행속도가 water flow model에 기반 한 이진화 방법과 비교하여 월등히 향상되었으며 이진화 품질도 매우 우수함을 보였다.

A Text Detection Method Using Wavelet Packet Analysis and Unsupervised Classifier

  • Lee, Geum-Boon;Odoyo Wilfred O.;Kim, Kuk-Se;Cho, Beom-Joon
    • Journal of information and communication convergence engineering
    • /
    • 제4권4호
    • /
    • pp.174-179
    • /
    • 2006
  • In this paper we present a text detection method inspired by wavelet packet analysis and improved fuzzy clustering algorithm(IAFC).This approach assumes that the text and non-text regions are considered as two different texture regions. The text detection is achieved by using wavelet packet analysis as a feature analysis. The wavelet packet analysis is a method of wavelet decomposition that offers a richer range of possibilities for document image. From these multi scale features, we adapt the improved fuzzy clustering algorithm based on the unsupervised learning rule. The results show that our text detection method is effective for document images scanned from newspapers and journals.

문자 영역 검출과 다운샘플링을 이용한 잡음에 강인한 문서 영상 이진화 (Noise Robust Document Image Binarization using Text Region Detection and Down Sampli)

  • 정진욱;전경구
    • 한국멀티미디어학회논문지
    • /
    • 제18권7호
    • /
    • pp.843-852
    • /
    • 2015
  • Binarization of document images is a critical pre-processing step required for character recognition. Even though various research efforts have been devoted, the quality of binarization results largely depends on the noise amount and condition of images. We propose a new binarization method that combines Maximally Stable External Region(MSER) with down-sampling. Particularly, we propose to apply different threshold values for character regions, which turns out to be effective in reducing noise. Through a set of experiments on test images, we confirmed that the proposed method was superior to existing methods in reducing noise, while the increase of execution time is limited.