• 제목/요약/키워드: 구문 구조

검색결과 476건 처리시간 0.027초

내부 및 외부 확률을 이용한 의존문법의 비통제 학습 (An unsupervised learning of dependency grammar Using inside-outside probability)

  • 장두성;최기선
    • 한국인지과학회:학술대회논문집
    • /
    • 한국인지과학회 2000년도 한글 및 한국어 정보처리
    • /
    • pp.133-137
    • /
    • 2000
  • 구문태그가 부착되지 않은 코퍼스를 사용하여 문법규칙의 확률을 훈련하는 비통제 학습(unsupervised learning) 방법의 대표적인 것이 CNF(Chomsky Normal Form)의 CFG(Context Free Grammar)를 입력으로 하는 inside-outside 알고리즘이다. 본 연구에서는 의존문법을 CNF로 변환하는 기법에 대해 논하고 의존문법을 위해 변형된 inside-outside 알고리즘을 논한다. 또한 이 알고리즘을 사용하여 실제 훈련한 결과를 보이고, 의존규칙과 구문구조 확률을 같이 사용하는 hybrid방식 구문분석기에 적용한 결과를 보인다.

  • PDF

한국어 질의응답시스템에서 구문정보에 기반한 질의분석 (Question Analysis based Syntactic Information in Korean Question Answering System)

  • 신승은;서영훈
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2004년도 봄 학술발표논문집 Vol.31 No.1 (B)
    • /
    • pp.931-933
    • /
    • 2004
  • 본 논문에서는 한국어 질의응답시스템에서 정확한 정답추출을 위한 구문 정보에 기반한 질의분석을 제안한다. 질의분석은 세부 정답 유형 결정, 세분화된 키워드 추출을 통해 정확한 정답추출을 목적으로 한다. 술어 유형 정보를 이용하여 대분류 수준의 정답 유형으로 질의분석을 수행하고. 구문 구조 정보를 이용하여 중요 키워드와 일반 키워드를 추출한다 마지막으로 정답 유형 자질 명사를 이용하여 세부 정답 유형을 결정한다. 실험을 통해 세부 정답 유형 결정에서 정확률 59%, 세분화된 키워드 추출에서 정확을 66%를 보였다.

  • PDF

XML Schema 지원도구 설계 및 구현 (Design and Implementation of XML Schema Supporting Tool)

  • 나종연;오정진;최한석
    • 한국멀티미디어학회:학술대회논문집
    • /
    • 한국멀티미디어학회 2003년도 춘계학술발표대회논문집
    • /
    • pp.766-770
    • /
    • 2003
  • XML이 표준화 제정될 당시 XML문서의 구조를 정의하기 위해 DTD를 사용하였다 DTD는 XML의 전신인 SGML에서부터 사용되어 왔으며 여러 훌륭한 기능을 지원하고있다. 그러나 DTD는 그 고유의 형식으로 이루어져있어 XML 개발자는 XML구문분석기 이외에 DTD 구문분석기를 별도로 개발하여야하고, DTD는 지원하는 데이터 형식에 제한이 있으며, 데이터 값의 범위 등을 설정할 수 없어 XML 문서의 유효성 검사에 제한이 많다. 이러한 문제를 해결하기 위하여 W3C에서는 XMLSchema를 제정하였다. DTD의 구문을 XML Schema로 모델링하였고, XML 문서에서 XML스키마를 적용하기 위한 도구와 DTD의 XMLSchema변환을 효과적으로 생성할 수 있는 GUI기반 XMLSchema Tool을 설계, 구현하였다.

  • PDF

대물(de re) 문맥과 '-라고'의 몇 가지 의미론적 특성 (De re context and some semantic traits of 'rago')

  • 민찬홍
    • 논리연구
    • /
    • 제16권1호
    • /
    • pp.61-85
    • /
    • 2013
  • 대언 믿음과 대물 믿음의 구별을 소개하고, 믿음 문맥과 양상 문맥에서 대언(de dicto)/대물(de re) 애매성이 동일하게 나타나는데, 양상 구문의 경우 한국어는 영어와 차별화되는 특징을 갖지 않는다는 것을 지적한다. 부정문에서도 대언/대물 구문의 애매성이 나타나는 바, 이와 관련하여 한국어는 대물 부정문에 해당하는 통사 구조를 허용한다. 대물 구문은 지시적으로 투명한 구문이요 따라서 동일자 대입률을 허용하는 구문이며, 대언 구문은 지시적으로 불투명한 구문이요 동일자 대입률을 허용하지 않는 구문이다. 그런데, 인용 동사, 언어행위동사, 인지태도 동사들과 함께 사용되는 한국어의 인용 어미 '라고'는 특이하게도 영어와 평행하게 대언/대물 애매성을 갖는 문장 뿐 아니라 애매성 없는 대물 구문을 구성하는 문장도 제공한다. 또한, '라고' 구문은 내포절의 내용에 대한 화자의 공약에 있어서도 중립적이다. 한국어에서는 내포절의 내용에 대한 화자의 긍정적인 공약을 표시하고자 하는 경우 '음/임' 또는 '라는 것'이라는 어미를 사용한다. 이런 점 때문에 '앎이 진리를 전제한다'는 서구 인식론의 원칙은 인식 문장을 한국어 어미 '라고'를 사용하는 문장으로 표현하려고 할 때에는 어려움을 겪게 된다.

  • PDF

한국어 수사구조 분류체계 수립 및 주석 코퍼스 구축 (Building an RST-tagged Corpus and its Classification Scheme for Korean News Texts)

  • 노은정;이연수;김연우;이도길
    • 한국어정보학회:학술대회논문집
    • /
    • 한국어정보학회 2016년도 제28회 한글및한국어정보처리학술대회
    • /
    • pp.33-38
    • /
    • 2016
  • 수사구조는 텍스트의 각 구성 성분이 맺고 있는 관계를 의미하며, 필자의 의도는 논리적인 구조를 통해서 독자에게 더 잘 전달될 수 있다. 따라서 독자의 인지적 효과를 극대화할 수 있도록 수사구조를 고려하여 단락과 문장 구조를 구성하는 것이 필요하다. 그럼에도 불구하고 지금까지 수사구조에 기초한 한국어 분류체계를 만들거나 주석 코퍼스를 설계하려는 시도가 없었다. 본 연구에서는 기존 수사구조 이론을 기반으로, 한국어 보도문 형식에 적합한 30개 유형의 분류체계를 정제하고 최소 담화 단위별로 태깅한 코퍼스를 구축하였다. 또한 구축한 코퍼스를 토대로 중심문장을 비롯한 문장 구조의 특징과 분포 비율, 신문기사의 장르적 특성 등을 살펴봄으로써 텍스트에서 응집성의 실현 양상과 구문상의 특징을 확인하였다. 본 연구는 한국어 담화 구문에 적합한 수사구조 분류체계를 설계하고 이를 이용한 주석 코퍼스를 최초로 구축하였다는 점에서 의의를 갖는다.

  • PDF

한국어의 Machine translation을 위한 구문 구조 분석 (Syntactic Analysis of Korean Sentence for Machine Translation)

  • 이주근;한성국;전병대
    • 대한전자공학회논문지
    • /
    • 제18권5호
    • /
    • pp.15-21
    • /
    • 1981
  • 이 논문은 기계 번역을 위한 한국어의 구문분석 algorithm과 system구성에 관한 것이다. 종래의 언어학적 문장구조를 재검토하여 품사와 성분을 통일된 관점에서 형태론적으로 분석 다음, 효과적인 품사분류 algorithm을 제안하고, 역이동변형 algorithm을 적용한 성분구조를 attribute개념을 도입하여 phrase structure rule로 처리하였다. 또한 한국어 조합문자의 조직개념을 lexicon구성에 도입하고 breadth-first searching에 의하여 문장의 심층구조가 포함된 parsing tate을 생성하는 구문분석 system을 구성하였으며, system program에 의해 입력문장을 심층구조로 분석한 결과를 보였다.

  • PDF

전역 및 지역 정보를 이용한 SVM 기반 한국어 문장 구조 및 격 레이블 분석 (Labeled Statistical Korean Dependency Parsing with Global and Local Information)

  • 임수종;이창기;장명길;나동렬
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2009년도 제21회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.207-212
    • /
    • 2009
  • 한국어 문장의 구조 및 격 레이블 분석을 위해서 SVM 모델을 이용하여 얻어진 전역 및 지역 정보 통계 모델에 기반한 방법을 제안한다. 제안하는 방법은 후방 beam search 알고리즘을 이용하여 부분 구문 분석을 하는 과정에서 지역 의존 정보를 사용하였고 이렇게 구성된 문장의 후보 구조에 대해서는 전역 정보 모델를 사용하여 최적의 문장 구조 및 격 레이블을 분석하였다. 제안하는 방법은 지역이나 전역 중 한 개의 모델만을 사용할 때 발생할 수 있는 오류를 최소화하였다. 지식 DB 사업의 한국어 의존 구문 분석 말뭉치를 이용하여 실험한 결과 전역 정보나 지역 정보만을 사용한 결과보다 각각 1.2%, 3.3% 높은 79.1%의 문장 구조 및 격 레이블 분석 정확률을 나타냈고 전역 정보만을 사용할 때보다 약 76배 이상의 빠른 속도 향상을 보였다. 향후 연구로는 지배소 단위, 구 묶음 단위 등으로 통계 정보를 세분화하여 좀더 높은 성능 향상을 기대한다.

  • PDF

휘처 모델의 Z 정형 명세와 검사 기법 (A Formal Specification and Checking Technique of Feature model using Z language)

  • 송치양;조은숙;김철진
    • 한국컴퓨터정보학회논문지
    • /
    • 제18권1호
    • /
    • pp.123-136
    • /
    • 2013
  • 시각적이고 비정형적인 구조로 표현된 휘처 모델(Feature model)은 구문적 명확성을 보장할 수 없고, 자동화 툴(tool)에 의한 구문(syntax)의 검증이 어렵다. 따라서, 휘처 모델이 가진 구조물의 구문적 명확성을 입증하기 위한 정형적 명세와 모델 검사(model checking)가 필요하다. 본 논문은 Z 언어를 이용한 휘처 모델의 정형적 명세와 모델 검사를 통해서, 휘처 모델의 정확성을 검사하는 기법을 제시한다. 이를 위해, 휘처 모델과 Z간 변환 규칙을 정의하고, 이 규칙에 의거하여 휘처 모델의 구문에 대해 Z 스키마(schema)로 명세한다. 모델 검사는 Z 스키마 명세에 대해 Z/Eves 툴을 사용하여 구문, 타입 검사(type checking), 그리고 도메인 검사(domain checking)를 수행하여 모델의 모호성을 검사한다. 이로서, 휘처 모델의 구조물을 좀더 명확하게 표현할 수 있으며, 설계된 모델의 오류를 검사할 수 있다.

우리나라 기록관리학 분야의 연구영역 분석 - 논문제목의 구문 및 의미 구조를 중심으로 - (A Study on Intellectual Structure of Records Management and Archives in Korea: Based on Syntactic and Semantic Structure of Article Titles)

  • 김규환;장보성;이현정
    • 한국문헌정보학회지
    • /
    • 제43권3호
    • /
    • pp.417-439
    • /
    • 2009
  • 본 연구는 논문제목의 구문 및 의미구조를 기반으로 국내 기록관리학 분야의 연구영역의 특성을 분석하였다. 이를 위해 1999년부터 2008년까지 국내 기록관리학 분야 전문 학술지 3종으로부터 핵심 연구논문 344개를 선정하였다. 해당 연구논문의 제목을 대상으로 구문 및 의미 구조를 분석하여 논문제목에 포함된 키워드들의 역할개념으로 '연구도메인', '연구대상', '연구초점'을 추출하였다. 추출된 3개의 역할개념별로 키워드들을 배정하여 군집화 하였다. 군집화 결과를 통해 최종적으로 국내 기록관리학 분야에서 어떤 연구대상이 핵심 연구대상이며 핵심 연구대상은 어느 연구도메인에서 어떤 연구초점에 관심을 두고 있는지를 분석하였다.

복합명사의 의미적 구조분석에 관한 연구 (A study on the Semantic Structure Analysis of Korean Compound Nouns)

  • 남궁황;이태영
    • 한국정보관리학회:학술대회논문집
    • /
    • 한국정보관리학회 2001년도 제8회 학술대회 논문집
    • /
    • pp.177-180
    • /
    • 2001
  • 복합명사의 효율적인 분석은 정보검색 시스템의 성능 향상에 중요한 영향을 미친다. 한국어에서는 복합명사가 다양한 구문적 유형으로 표현된다. 표면적으로 동일하게 표현된 복합명사일지라도 의미적으로는 서로 다르게 나타내거나 여러 개의 단위명사로 분리될 수가 있다. 이러한 문제를 해결하기 위해서는 복합명사를 구성하는 단위명사간의 의미적 결합관계를 올바르게 파악하는 것이 무엇보다도 중요하다. 본 논문에서는 의미적 구문관점에서 복합명사의 표층구조와 심층구조간의 의미관계를 기반으로 복합명사 분석시 적용할 수 있는 의미규칙을 도출하는데 있다.

  • PDF