• 제목/요약/키워드: 한글 처리

검색결과 2,649건 처리시간 0.029초

현행 KS 완성형 한글 코드의 문제점 (Issues in KS Complete Type Hangul Code)

  • 김충회
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1989년도 한글날기념 학술대회 발표논문집
    • /
    • pp.21-28
    • /
    • 1989
  • 국내에 컴퓨터가 처음 도입된 이후부터 컴퓨터의 한글 처리 문제는 '과연 컴퓨터에서 한글 처리가 가능할까?'하는 의구심에서부터 시작하여 그동안 한글 처리 방식이 각양각색으로 N 바이트나, 3 바이트, 7 비트 2 바이트 완성형, 8 비트 2 바이트 완성형, 8 비트 2 바이트 조합형이니 하여 난립하여 왔다. 이로 말미암아 소프트웨어의 호환은 물론 한글 문서의 호환마저 불가능하여 사용자가 겪는 불편이란 이루 말할 수 없을 뿐 아니라 정보화시대에 정보 교환을 가로막는 장애 요소로 등장하게 된 것이다. 이런 배경 속에서 자연스럽게 한글 코드의 표준화의 중요성을 인식하게 되어 정부에서는 1987년 3월 '정보 교환용 부호에 관한 한글 공업 규격' (KS C-5601-1987)을 새로 정하게 되었다. 그러나 한글의 가장 뛰어난 조합에 의한 확장성을 무시한 '2 바이트 완성형'을 채택 2,350 자의 한글로 제한을 해 놓았기 때문에 제 나라 국어도 재대로 표현할 수 없는 절름발이 한글이 되고 말았다. 이와 같은 결합이 있는 한글을 이제 교육용 컴퓨터에서까지 채택함에 이르러 우리의 지혜를 모아야 할 때라고 생각하면서 문제를 제기하고자 한다.

  • PDF

한국어정보처리를 위한 한글 부호계의 적합성 평가

  • 변정용
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1990년도 제2회 한글 및 한국어정보처리 학술대회
    • /
    • pp.81-88
    • /
    • 1990
  • 한글 부호계의 올바른 사용과 이들의 표준안 채택은 한국어정보처리 제분야에서의 적합성과 한글 문화창달에 기여성등을 먼저 검토해야 할 것이며, 그리고 한글 부호 제정사에서 갖는 위상과 정보교환 및 정보처리 기술에 어떤 영향을 끼칠 것인지에 관한 학문적 평가가 요구된다. 이러한 결과는 궁극적으로 한국어정보처리에 있어서 그 한계성의 제거와, 새로운 컴퓨터 기술의 개발에 원동력을 제공할 것이다.

  • PDF

은행 전표에서 한글 금액 인식기의 구현 (Korean Amount Recognizer in Bank Slips)

  • 지태창;김은진;이일병
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 1998년도 가을 학술발표논문집 Vol.25 No.2 (2)
    • /
    • pp.369-371
    • /
    • 1998
  • 본 논문에서는 은행 전표의 한글 금액열을 인식하는 시스템을 제안한다. 한글의 낱자를 인식하는 연구가 활발히 진해되고 있는데 반하여, 본 연구에서는 한글의 낱자 인식 결과를 가지고 후처리를 한 후, 그 결과를 금액 숫자의 인식결과와 통합하는 시스템을 구성하였다. 한글 낱자 인식기는 MDC(Minimum Distance Classifier) 기법을 응용한 방법을 사용하였고, 그 후처리는 금액의 구조적인 특징을 사용하였다. 마지막으로 숫자 인식기의 결과와 상호 참조하여 인식기를 완성하였다. 인식 결과를 보면 한글 금액 문자열의 낱자에 대해서는 후처리를 하기 전에는 96.29%, 후처리를 한 후에는 97.72%의 인식률을 보였고, 한글 금액 문자열에 대해서는 후처리를 하기 전에는 79.96%, 후처리를 한 후에는 98.24%의 신뢰도를 보였다.

  • PDF

한글 데이터베이스 시스템 개발 환경에 관한 연구

  • 왕숙희;조동영;백두권;황종선
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1990년도 제2회 한글 및 한국어정보처리 학술대회
    • /
    • pp.156-163
    • /
    • 1990
  • 한글 데이타베이스 시스템은 한글 사용자들이 한글을 비롯한 각종의 데이타들을 효율적으로 처리하고 관리할 수 있도록 지원하는 컴퓨터 기반의 정보 시스템이다. 본 논문에서는 이러한 한글 데이타베이스 시스템의 합리적인 개발환경을 도모하기 위하여, 먼저 한글 데이타베이스 시스템의 기본구조와 현행의 한글 데이타베이스 시스템의 개발 및 그 이용수준을 살펴보고, 이를 토대로 한글 데이타베이스 시스템의 추후 개발에 필요한 표준화 문제들을 고찰하였다.

  • PDF

한국어 정보처리에 관한 연구 (A Study on Korean Language Information Processing)

  • 박동순;맹승렬
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1989년도 한글날기념 학술대회 발표논문집
    • /
    • pp.161-167
    • /
    • 1989
  • 점차 언어정보 처리가 컴퓨터 응용에서 차지하는 비중이 커지고 컴퓨터 응용 확대 위해서는 효과적인 언어처리가 필수적 과제로 부각되고 있다. 한국어는 영어문화권 언어와는 다른 독특한 특성을 가지고 있기 때문에 이률 처리하기 독창적인 기술개발이 요구된다. 본 논문에서는 언어정보 처리의 개념과 모델을 소개하고, 보다 근원적으로 한국어 정보를 처리하기 위해 연구되어야 할 분야를 살펴보았다. 또한 한국어 정보처리를 위해서 선행되어야 하고 가장 기본적인 한국어 정보처리인 한글처리 방식에 대하여 논하였다. 본 논문에 포함된 한글, 한자코드, 한글, 한자 처리방식, O.S 한글화 지침은 언어정보처리의 시스템 요소와 입출력에 관한 연구과제이다.

  • PDF

문자의 구조적 제약과 동적 격자 탐색을 이용한 필기 한글 문자 인식 (Handwritten Hangul Recognition by Dynamic Lattice Search with Structural Constraints)

  • 강경원;김진형
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2001년도 제13회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.359-364
    • /
    • 2001
  • 필기 한글문자 인식은 다양한 필기 변형, 자모 간의 접촉과 같은 문제들을 내포하고 있다. 최근 이를 해결하기 위한 방법으로 랜덤 그래프를 이용한 필기 한글 모델링이 제안되었으나, 상향식 정보처리의 한계인 시간 복잡도 문제를 겪고 있다. 영어 단어인식에 관한 인지과학적 연구에서는 하향식 정보처리의 주요한 역할 중 하나로 인식 과정에서의 계산 중복을 없애는 필터링의 역할을 들고 있다. 본 논문에서는 랜덤 그래프를 이용한 필기 한글 모델링을 기반으로 하여 필기체에 나타나는 다양한 변형을 흡수하며, 시간 복잡도를 해결하기 위한 한글 문자의 구조에 바탕을 둔 하향식 정보처리 방법을 제안한다. 제안하는 방법은 모델 발화를 이용한 자모 후보 추출 DP 정합과 동적 격자 탐색을 이용한 문자 후보 탐색, 그리고 문자의 구조적 제약을 이용한 후보 제거 기법을 포함한다. 필기 한글 데이터베이스인 SERI-DB에 대한 예비 실험 결과, 제안한 방법은 인식률의 큰 저하 없이 상향식 정보 처리에 바탕을 둔 기존 방법에 비해 높은 속도 향상을 가져 왔다.

  • PDF

고속 한글 정보 검색을 위한 한글 MG 시스템 구현 (Implementation of Hangul MG System for Fast Hangul Information Retrieval)

  • 박미란;나연묵
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 1998년도 가을 학술발표논문집 Vol.25 No.2 (1)
    • /
    • pp.330-332
    • /
    • 1998
  • 정보의 양의 기하급수적인 증가에 따라 저장 용량과 검색 공간의 크기로 인한 문제를 효율적인 압축기법을 사용함으로써 해결하려는 노력이 계속되고 있다. 국내의 경우 한글 처리가 가능한 정보 검색 엔진에 대한 요구가 크게 증가하고 있다. 본 논문에서는 정보 검색 엔진에 고압축 기법을 적용한 MG(Managing Gigabytes) 1.2 시스템과 한글 형태소 분석기 HAM 4.0을 사용하여 고속 한글 정보 검색이 가능한 한글 MG 시스템을 구현하였다. 또한 인터프리터 방식의 질의 처리기를 수정하여 웹에서 한글 문서를 검색하는 한글 MG 테스트베드를 구축하였다.

한글 Common Lisp에서 한글 함수 기능

  • 이창열;오승준;임영환
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1990년도 제2회 한글 및 한국어정보처리 학술대회
    • /
    • pp.172-179
    • /
    • 1990
  • 본 논문에서는 한글(한국어) ascii 코드와 4가지 한글 표현 원리에 만들어지는 한글음절을 정의한다. Common Lisp(CL)의 확장된 버전으로 한글이 사용 가능한 한글 CL(HCL)의 소개하고 CL에 추가되는 새로운 한글 함수에 대하여 설명한다. HCL의 모든 함수는 한글을 다루는 방법에 따라 4가지 타입으로 나뉘어진다. 1) 타입 0 - 한글을 입출력 값으로 취하지 않는 전형적인 CL 함수, 2) 타입 1 - 원래 CL 함수정의의 변경없이 입력으로 한글을 받아들이는 함수, 3) 타입 2 - 한글을 사용하기 위하여 함수의 정의를 확장해야하는 CL 함수, 4) 타입 3 - 한글 처리를 하기 위하여 새로 설계한 새로운 함수. 위의 타입에 의해 분류되는 각 함수에 대한 정의를 제안하고 한글 편집기에 대하여 소개한다.

  • PDF

한글 프로그래밍 언어(한글 코볼)의 설계에 관한 연구 (The Design of Hangul Programing Language (Hangual Cobol))

  • 허용도;백두권
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1989년도 한글날기념 학술대회 발표논문집
    • /
    • pp.35-38
    • /
    • 1989
  • 컴퓨터의 소형화 추세와 더불어 퍼스널 컴퓨터가 직장과 학교는 물론 일반 가정에까지 널리 보급되기 시작하였다. 아울러 이들 퍼스널 컴퓨터 사용자들에게 편리를 제공하기 위한 응용 소프트웨어에 대한 연구가 활발히 이루어지고 있으며 특히 영어를 모르는 사용자들을 위한 컴퓨터의 한글화 문제가 매우 중요시하게 대두되었다. 더구나 오늘날 대중화되고 보편적인 이용 수단이 된 컴퓨터의 교육이나 프로그래밍 언어의 한글화는 상당히 낙후되었던 것이 사실이다. 이에 본 연구에서는 사무처리에 적합한 코볼 언어와 유사한 한글 코볼언어에 대한 설계를 하였다. 한글 코볼 언어의 설계의 궁극적인 목적은 한글의 음운체계에 맞는 좋은 프로그래밍 언어를 개발해서 프로그래머들이 프로그램 작성에 효율을 갖게 하려는데 있다. 이러한 좋은 프로그래밍 언어를 설계해서 구현하는 작업은 상당히 어려운 작업이므로 본 논문에서는 일차적으로 영문 명령어의 한글화와 조사처리에 대한 방법들을 연구하였다.

  • PDF

조합형 한글 정규식 Java 라이브러리 설계 (A Design of the Java Library for Combined Hangul Regular Expression)

  • 정재용;우균
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2015년도 춘계학술발표대회
    • /
    • pp.31-34
    • /
    • 2015
  • 현재의 한글 정규식은 완성형 한글에 맞춰 글자단위로 사용할 수밖에 없으므로 사용이 불편하다. 따라서 이러한 불편함을 해결하기 위해 자모단위로 처리 가능한 조합형 한글 정규식 Java 라이브러리를 설계하였다. 조합형 한글 정규식 Java 라이브러리를 통해서 단순히 '가'로 시작하는 글자가 아니라 'ㄱ'으로 시작하는 글자나, 종성이 없는 단어 등을 처리할 수 있으며 기존의 정규식 문법 또한 사용할 수 있다. 이를 위해서 초성, 중성, 종성 각각에 조건을 주는 규칙을 한글 정규식 문법에 추가하였으며, 기존의 Java 정규식 라이브러리와 해당 라이브러리에서 이용하는 유니코드 표현상에서의 한글 인코딩 특징을 이용하였다.