• 제목/요약/키워드: Character Extraction

검색결과 303건 처리시간 0.028초

모바일정보검색 서비스를 위한 문자 인식 (Image Processing for Mobile Information Retrieval Service)

  • 임명재;현성경;박지은;이기영
    • 한국인터넷방송통신학회논문지
    • /
    • 제11권1호
    • /
    • pp.103-108
    • /
    • 2011
  • 현대 사회는 정보화에 대한 인식이 크게 보편화되면서 정보 통신 기술에 대한 개발이 급속화 되고 있는 추세이다. 특히 모바일 기기에 대한 기술 또한 빠르게 진행됨에 따라 자신이 원하는 정보를 언제 어디서나 제공받기를 기대한다. 이에 따라 편리한 정보검색을 위한 이미지 검색이 보편화 되고 있다. 하지만 일반적인 이미지 검색은 이미지에서의 문자영역 추출의 부정확성과 추출된 문자로 상세한 정보를 얻는데 어려움이 따른다. 따라서 본 논문에서는 촬영한 영상에서 문자인식을 통해 관광지를 포함한 여러 상점들의 간판을 인식하여 사용자에게 편리한 정보제공을 목적으로 하고 있으며, Top-Hat이라는 문자추출 방법과 서버를 함께 연동시키므로 시킴으로써 보다 정확하고 상세한 정보를 얻을 수 있다.

Document Structure Understanding on Subjects Registration Table

  • Ito, Yuichi;Ohno, Masanaga;Tsuruoka, Shinji;Yoshikawa, Tomohiro;Tsuyoshi, Shinogi
    • 한국지능시스템학회:학술대회논문집
    • /
    • 한국퍼지및지능시스템학회 2003년도 ISIS 2003
    • /
    • pp.571-574
    • /
    • 2003
  • This research is aimed to automate the generating process of the database from paper based table forms like this work. The registration table has so complicate table structures, ana in this research we used the registration tables as an example of general table structure understanding. We propose a table structure understanding system for some table types, and it has some steps. The first step is that the document images on paper are read from the image scanner. The second step is that a document image segments into some tables. In the third step, the character strings is extracted using image processing technology and the property of the character strings is determined. And the structured database is generated automatically. The proposed system consists of two systems. "Master document generation system" is used for the table form definition, and it doesn′t include the handwritten characters. "Structure analysis system for complete d table" is used for the written form, and it analyzes the table form filled in the handwritten character. We implemented the system using MS Visual C++ on Windows, and it can get the correct extraction rate 98% among 51 registration tables written by the different students.

  • PDF

DCT와 LVQ를 이용한 차량번호판 인식 시스템 (Vehicle License Plate Recognition System using DCT and LVQ)

  • 한수환
    • 지능정보연구
    • /
    • 제8권1호
    • /
    • pp.15-25
    • /
    • 2002
  • 본 논문에서는 차량 번호판에서 추출된 문자영역의 DCT(Digital Cosine Transform) 계수와 LVQ(Learning Vector quantization) 신경회로망을 이용하여 상대적으로 간결한 구조로 잡음의 영향을 적게 받는 차량 번호판 인식 시스템을 제안하였다. 입력된 차량영상의 RGB칼라정보를 이용하여 번호판 영역을 추출하고 추출된 번호판의 히스토그램과 문자의 상대적 위치정보를 병합하여 문자영역을 추출하였다. 이렇게 추출된 문자영역의 명암도 영상에 DCT를 적용하여 얻은 특징 벡터를 LVQ신경회로망의 입력으로 사용하여 인식 과정을 수행한다. 본 논문의 실험과정에서는 다양한 환경에서 촬영된 109대의 자가용 차량영상에 대하여 제안된 시스템을 실험하였으며 상대적으로 높은 번호판 영역 추출율과 인식률을 보였다.

  • PDF

테라헤르츠 신호를 이용한 영상의 글자 추출을 위한 화질 개선처리에 대한 연구 (A Study of Image Enhancement Processing for Letter Extraction of Image Using Terahertz Signal)

  • 김성윤;최현근;박인호;김영섭;이용환
    • 반도체디스플레이기술학회지
    • /
    • 제16권3호
    • /
    • pp.111-115
    • /
    • 2017
  • Terahertz waves are superior to conventional X-ray or Magnetic Resonance Tomography(MRI), and the amount of information that can be transmitted is as large as thousands of times that conventional X-ray or MRI. In addition, Terahertz waves have great performance in analyzing an object which have some layered structure. By using this advantage, we can extract the letters of a page by analyzing information such as absorption amount and reflection amount by irradiating a closed book with pulses of various frequencies within gap of a terahertz wave. However, in the image of each page using the Terahertz wave might be obtained various kinds of noise and the different character occlusion region. So, to extract letters from the terahertz image, we must take the noise and occlusion region away. We have been working to enhancement the image quality in various ways, and keep on studying de-noising processing for enhancement about the image quality and high resolution. Finally, we also keep on studying about OCR(Optical Character Recognition) technology, which based on pattern matching technique, to read letters.

  • PDF

거리 정보를 활용한 문자 분할 (Character Segmentation Using Depth Information)

  • 장석우;박영재;김계영;최현준
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2013년도 제47차 동계학술대회논문집 21권1호
    • /
    • pp.229-230
    • /
    • 2013
  • 본 논문에서는 입체영상을 분석하여 3차원의 영상 내에 나타나는 문자 영역을 효과적으로 분리하는 알고리즘을 제안한다. 제안된 알고리즘은 먼저 입력된 영상에서 질감 특징을 이용해 문자영역이 존재하는 후보 영역을 분할하고, 후보 문자영역 중에서 문자열만을 형성하는 영역을 추출한다. 그런 다음, 지역화된 문자영역을 문자와 배경으로 분리하며, 거리 특징을 활용하여 추출된 문자영역이 비 문자영역을 포함하지 않고 문자영역만을 포함하고 있는지를 최종적으로 검증한다. 실험에서는 제안된 방법을 여러 가지 영상에 적용하여 테스트 해 보았으며, 제안된 방법이 기존의 방법에 비해 보다 정확하게 문자영역을 추출함을 확인하였다.

  • PDF

도로 노면 문자 도색을 위한 문자 요소 인식과 도색 실험 (Character Element Recognition and Painting Simulation for the Letters to Road Surface)

  • 이경호;성재준
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2016년도 제54차 하계학술대회논문집 24권2호
    • /
    • pp.113-116
    • /
    • 2016
  • 본 논문에서는 사람의 수작업을 통해서 작업을 하고 있는 도로 노면 문자 도색 작업을 자동화하기 위해 문자의 요소 인식과 인식한 결과로 문자 구성 정보를 전달하고, 이 정보를 이용하여 문자를 도색하는 프로그램을 구성하여 도로 노면 문자 도색 모의실험을 수행하였다. 정보처리기기에 프로그램을 구성하여 작업할 문자들을 입력 받아, 이미지 변환과 세선화와 역세선화를 거쳐 만들어진 영상에서 끝점, 2모음점, 3선 이상 모음점, 고립점 등 특징 점들을 추출하고 특징점들을 이용하여 글자를 인식하고, 특징점들을 이용하여 만든 정보를 도로 노면 문자 도색용 장비로 보낸다는 가정 하에 도색 프로그램을 수행 후, 나타난 결과를 피드백 하여 도색 프로그램을 수정하여 도로 노면 문자 도색 작업에 쓸 수 있는 성능의 결과를 구성하였다.

  • PDF

쿼드트리로 구성된 한글 문서 영상에서의 문자추출에 관한 연구 (EXTRACTION OF CHARACTERS FROM THE QUADTREE ENCODE DOCUMENT IMAGE OF HANGUL)

  • 백은경;조동섭
    • 대한전기학회:학술대회논문집
    • /
    • 대한전기학회 1991년도 추계학술대회 논문집 학회본부
    • /
    • pp.201-204
    • /
    • 1991
  • In this paper the method of representing the document image by the quadtree data structure, and extracting each character seperately from the constructed quadtree are described. The document image is represented by a binary encoded quadtree and the segmentation is performed according to the information of each leaf node of the quadtree. Then, each character is extracted by the relation of positions of segments. This method enables to extract characters without examining every pixel in the image and the required storage of document image is decreased.

  • PDF

초성자소분리 인식에 의한 필기 한글문자의 대분류에 관한 연구 (A Study on the Pre-Classification of Handwritten Hangeul Characters Using Partial Separation and Recognition of Initial Consonants)

  • 안석출;김명기
    • 한국인쇄학회지
    • /
    • 제6권1호
    • /
    • pp.41-57
    • /
    • 1988
  • Recently, it Is required to develop OCR(Optical Character Reader) along with the progress of the information processing system for Hangeul. Characters have to be recognized clearly so that OCR can be applied, Structure analysis method and lump method are used for the recognition of characters, and OCR is now available for the recognition of printed characters and handwritten alphanumeric characters having simple structure by them However, It is known that there should be much more study on the development of handwritten Hangout's OCR. This paper proposed a new method for the handwritten Hangout character recognition. The units of Initial consonant of Hangout are separated and then recognized from the utilization of the position- Information of Hangeul's units from the normalized patterns using the regression line theory. It is carried out for the extraction of the block which exists in the virtual Initial consonant region from the normalized input patterns and the calculation on maximum value (${\beta}$) of likelihood after comparing the features of separated subpattern with the initial consonant dictionary.

  • PDF

자동차 번호판 영역의 문자추출과 인식에 관한 연구 (A Study on Character Extraction in Vehicle Number Plate and Character Recognition)

  • 김도형;이선화;김미숙;차의영
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2000년도 가을 학술발표논문집 Vol.27 No.2 (2)
    • /
    • pp.338-340
    • /
    • 2000
  • 자동차 번호판 인식 시스템은 영상획득, 번호판 영역 추출, 추출된 번호판 영역의 전처리, 문자부분 영역화, 문자인식 등의 5가지 핵심부분으로 구성된다. 그 중에서도 번호판 영역 추출, 추출된 영역의 전처리, 문자부분 영역화의 정확성은 전체 시스템 인식률에 지대한 영향을 줄 수 있는 부분으로써 그 정확성이 요구된다. 이에 본 논문에서는 컴퓨터 비젼 분야 중의 하나인 영상처리 기법을 사용하여 명암의 변화에도 문자를 잘 추출할 수 있는 Dynamic Adaptive Threshold 방법을 사용하여 추출된 번호판 영역을 이진화하고, 정확하게 문자 부분을 영역화하기 위한 방법으로 누적분포와 번호판 문자배열 특성을 이용한 방법을 제안한다. 그리고 추출되어진 문자는 ART2 신경망을 이용하여 인식한다.

  • PDF

감정어 추출을 통한 등장인물 성향 가시화 연구 (Visualization Study of Character Type by Emotion Word Extraction)

  • 백영태;박승보
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2013년도 제48차 하계학술발표논문집 21권2호
    • /
    • pp.31-32
    • /
    • 2013
  • 본 논문에서는 영화의 등장인물의 성향을 파악하기 위해 시나리오의 대사로부터 감정어를 추출하고, 등장인물의 감정어들을 긍정, 부정, 중립의 3개로 단순화하여 등장인물의 성향을 가시화 시켜주는 방법을 제안한다. 대사로부터 감정어를 추출하기 위해 WordNet 기반의 감정어 추출 방법을 제안한다. WordNet은 단어 간에 상위어와 하위어, 유사어 등의 관계로 연결된 네트워크 구조의 사전이다. 이 네트워크 구조에서 최상위의 감정 항목과의 거리를 계산하여 단어별 감정량을 계산하여 대사를 30 차원의 감정 벡터로 표현한다. 등장인물별로 추출된 감정 벡터를 긍정, 부정, 중립의 3개의 차원으로 단순화 하여 등장인물의 성향을 표현한다.

  • PDF