• 제목/요약/키워드: Language Translation

검색결과 561건 처리시간 0.024초

『상한론(傷寒論)』 영역본과 『동의보감(東醫寶鑑)』 영역본 잡병편 '한(寒)'문의 비교 연구 (A Study on the English Translations of Shanghanlun (Treatise on Cold Damage) and the Cold Pathogen Chapter of Donguibogam)

  • 김도훈;김동율;정지훈
    • 한국의사학회지
    • /
    • 제30권1호
    • /
    • pp.33-41
    • /
    • 2017
  • This study utilized Corpus-based Analysis process to compare the Cold Pathogen chapter in the 'English version of "Donguibogam"' to the 'English version of the "Shanghanlun"' translated by 罗希文 (Luo xi wen). Results of the linguistic analysis indicate that TTR, a ratio of number of types to number of tokens in the English version of "Shanghanlun" was 5.92% while TTR in the Cold pathogen chapter of English version of "Donguibogam" was 6.01%. It was also noted that the types of words frequently appearing in the two publications were the scientific name of medicinal herbs; the method of producing the herbal prescription (including terminology representing weights and measures); and Chinese descriptions of concepts considered important in both Korean and Chinese medicinal practices. Finally, it was possible to find points of comparison in naming of symptoms, diagnosis, prescriptions, and respective names of six meridians. Though the language difference is minimal, the vocabulary found in the Cold Pathogen chapter of "Donguibogam" was more diverse than Luo's translation of "Sanghanlun". In general, literal translation in keeping with the sense of original text was better performed in Luo's translation of the "Sanghanlun" whereas the English version of the Cold Pathogen chapter in the "Donguibogam" was more of a "free" translation.

병렬 말뭉치 필터링을 적용한 Filter-mBART기반 기계번역 연구 (Filter-mBART Based Neural Machine Translation Using Parallel Corpus Filtering)

  • 문현석;박찬준;어수경;박정배;임희석
    • 한국융합학회논문지
    • /
    • 제12권5호
    • /
    • pp.1-7
    • /
    • 2021
  • 최신 기계번역 연구 동향을 살펴보면 대용량의 단일말뭉치를 통해 모델의 사전학습을 거친 후 병렬 말뭉치로 미세조정을 진행한다. 많은 연구에서 사전학습 단계에 이용되는 데이터의 양을 늘리는 추세이나, 기계번역 성능 향상을 위해 반드시 데이터의 양을 늘려야 한다고는 보기 어렵다. 본 연구에서는 병렬 말뭉치 필터링을 활용한 mBART 모델 기반의 실험을 통해, 더 적은 양의 데이터라도 고품질의 데이터라면 더 좋은 기계번역 성능을 낼 수 있음을 보인다. 실험결과 병렬 말뭉치 필터링을 거친 사전학습모델이 그렇지 않은 모델보다 더 좋은 성능을 보였다. 본 실험결과를 통해 데이터의 양보다 데이터의 질을 고려하는 것이 중요함을 보이고, 해당 프로세스를 통해 추후 말뭉치 구축에 있어 하나의 가이드라인으로 활용될 수 있음을 보였다.

웹용 영한 기계번역을 위한 문서 전처리기의 설계 및 구현 (A Preprocessor for English-to-Korean Machine Translation of Web Pages)

  • 안동언;유홍진;서진원;이영우;정성종;여상화;김태완;박동인
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1997년도 제9회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.249-254
    • /
    • 1997
  • 영어 웹 문서를 한국어로 기계번역을 하기 위해서는 HTML 태그를 번역 대상 문장과 분리하는 처리가 필요하다. HTML 태그를 단순히 제거하는 것이 아니라 대상 문장의 기계번역이 종료된 후에 같은 형태의 한국어 웹 문서로 복원하기 위한 방안이 마련 되어야 한다. 또한 문서 전처리기에서는 영어 형태소해석기의 성능을 높이기 위하여 번역 단위가 되는 문장의 인식 및 분리, 타이틀의 처리, 나열된 단어의 처리, 하이픈 처리, 고유명사 인식, 특수 문자 처리, 대소문자 정규화, 날짜 인식 등을 처리하여 문서의 정규화를 수행한다.

  • PDF

기계번역 성능평가를 위한 핵심어 전달율 측정방안 (Evaluation Method of Machine Translation System)

  • 유초롱;이영직;박준
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2003년도 제15회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.241-245
    • /
    • 2003
  • 본 논문은 기계번역 시스템의 성능평가를 위한 '핵심어 전달율 측정' 방안에 대해서 기술한다. 기계번역 시스템의 성능평가는 두 가지 측면으로 고려될 수 있다. 첫 번째는 객관적인 평가로 IBM에서 주창한 BLEU score 측정이나 NIST의 NIST score 측정이 그 예이다. 객관적인 평가는 평가자의 주관적인 판단이나 언어적인 특성을 배제한 방법으로 프로그램을 통해 자동으로 fluency와 adequacy를 측정하여 성능을 평가한다. 다음은 주관적인 평가이다. 주관적인 평가는 평가자의 평가를 통해 번역의 품질을 평가하는 방법이다. 주관적 평가 방법의 대표적인 것으로는 NESPOLE이나 LDC가 있다. 주관적인 평가는 평가자의 정확한 판단으로 신뢰할만한 성능평가 결과를 도출하지만, 시간과 비용이 많이 들고, 재사용할 수 없다는 단점이 있다. 본 논문에서는 이러한 문제를 해결하기 위해, 번역대상 문장에서 핵심어를 추출하고, 그 핵심어가 기계번역 시스템의 수행결과에 전달된 정도를 자동으로 측정하는 새로운 평가방법인 '핵심어 전달율 측정' 방안을 제안한다. 이는 성능평가의 비용과 시간을 절약하고, 주관적 평가와 유사한 신뢰성 있는 평가결과를 얻을 수 있는 좋은 지표가 될 수 있을 것으로 기대한다.

  • PDF

Frequency Inheritance in the Production of Korean Homophones

  • Han, Jeong-Im
    • 음성과학
    • /
    • 제14권1호
    • /
    • pp.7-19
    • /
    • 2007
  • The present study investigates the so-called frequency inheritance effect in word production. According to some earlier studies (e.g. Jescheniak & Levelt, 1994), retrieval of a low-frequency homophone benefits from its high-frequency homophone twin, and more specifically word-retrieval RT is determined by the frequency of the phonological form of the word (sum of homophone frequencies) rather than the frequency of the specific word. This result, however, has been challenged by later studies (e.g. Caramazza et al., 2001) and one possible resolution is that languages differ in the extent to which the inheritance effect occurs. Two experiments are reported to test whether the frequency inheritance effect depends on the target language, namely, if a language such as Korean with relatively many homophones tend not to show frequency inheritance, which is compared with the language with fewer homophones such as Dutch and German (Jescheniak & Levelt, 1994; Jescheniak et al., 2003). Experiment 1 was picture naming, and Experiment 2 used an English-to-Korean translation task. In both experiments, the homophones were actually slower than the low-frequency controls, suggesting that there was no evidence for the inheritance effect. These results imply that the issue of whether specific word or homophone frequency determines production can be properly assessed by taking into account the language-specific nature of the lexicon such as the percentage of the homophone words in that language.

  • PDF

ETRI CHILL - 96 컴파일러의 설계와 구현 (Design and Implementation of the ETRI CHILL-96 Compiler)

  • 김상은;이준경;이동길
    • 한국정보과학회논문지:컴퓨팅의 실제 및 레터
    • /
    • 제6권3호
    • /
    • pp.329-338
    • /
    • 2000
  • CHILL 언어는 전전자 교환기 및 통신 시스템용 소프트웨어 개발에 사용되어왔다. ETRI CHILL-96 언어는 객체지향성, 병행성, 포괄적 타입과 같은 특성을 가지고 CHILL 언어를 확장한 것이다. 본 논문에서는 ETRI CHILL-96 컴파일러의 설계 및 구현과 관련된 몇 가지 기술적 주제들에 대해 다룬다. 재명명 변환 규칙들과 함수 재구성 기술들은 이름 충돌의 방지와 풍부한 디버깅 정보의 생성을 위해 사용되었다. 이러한 새로운 확장된 기능들은 확장된 CHILL 중간 코드로 컴파일 및 변환되는 단계에 전처리 되어진다. 이러한 컴파일 기술들은 ETRI CHILL-96언어가 기존의 CHILL 언어에 의해 개발된 소프트웨어들과 호환성을 유지할 수 있게 해 준다.

  • PDF

The Role of L1 and L2 in an L3-speaking Class

  • Kim, Sun-Young
    • 비교문화연구
    • /
    • 제24권
    • /
    • pp.170-183
    • /
    • 2011
  • This study explored how a Chinese college student who previously had not reached a threshold level of Korean proficiency used L1 (Chinese) and L2 (English) as a tool to socialize into Korean (L3) culture of learning over the course of study. From a perspective of language socialization, this study examined the cross-linguistic influence of L1 and L2 on the L3 acquisition process by tracing an approach to language learning and practices taken by the Chinese student as a case study. Data were collected through three methods; interview protocols, various types of written texts, and observations. The results showed that the student used English as a means to negotiate difficulties and expertise by empowering her L2 exposure during the classroom practices. Her ways of using L2 in oral practices could be characterized as the 'Inverse U-shape' pattern, under which she increased L2 exposure at the early stage of the study and shifted the intermediate language to L3 at the later stage of the study. When it comes to the language use in written practices, the sequence of "L2-L1-L3" use gradually changed to the "L2-L3" sequence over time, signifying the importance of interaction between L2 and L3. However, the use of her native language (L1) in a Korean-speaking classroom was limited to a certain aspect of literacy practices (i.e., vocabulary learning or translation). This study argues for L2 communication channel in cross-cultural classrooms as a key factor to determine sustainable learning growth.

도서관 서지정보의 한중일 로마자표기법에 대한 이용자 만족도 연구 (A Study on User Satisfaction with CJK Romanization in the OCLC WorldCat System)

  • 하유진
    • 정보관리학회지
    • /
    • 제27권2호
    • /
    • pp.95-115
    • /
    • 2010
  • 이 연구의 목적은 정보이용자가 한중일 언어의 음역 표기된 도서관 서지정보를 어떻게 이해하고 평가하는지를 알아보는 데 있다. 이용자조사와 실험이 각각 실행되었고, OCLC의 WorldCat시스템이 실험도구로 사용되었다. 조사결과 로마법표기에 여러 가지 문제가 있어 이용자가 음역화된 문장을 이해하기가 어려웠던 것으로 분석되었고, 심지어 음역서지목록에 익숙한 이용자도 자국어의 목록임에도 불구하고 이해하는 데 어려움을 나타냈다. 실험결과 또한 이러한 조사 결과를 입증했다. 이용자가 음역화된 자국언어로 된 자료를 찾을 경우보다 영어로 기술된 자료를 찾을 때 더 나은 검색 결과와 만족도를 보였다. 향후 번역된 서지정보와 음역화된 서지정보 중 이용자가 어느것을 더 선호하는지 비교하는 연구의 필요성을 제안하며, 한중일 로마법 표기의 서지정보에 영어번역을 병렬하는 것을 고려해야 함을 제시한다.

병렬 객체지향 시스템의 검증 (Model Checking of Concurrent Object-Oriented Systems)

  • 조승모;김영곤;배두환;변성원;김상택
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제27권1호
    • /
    • pp.1-12
    • /
    • 2000
  • 모델체킹은 검증하려는 대상 시스템의 동작 모델이, 그 시스템이 만족해야 할 성질을 만족시키는지를, 시스템의 상태공간을 검사해 봄으로써 알아보는 정형 검증 기법의 하나이다. 이러한 모델체킹 기법을 병렬 객체지향 시스템에 적용하기 위해 기존의 모델체커인 SPIN에서 지원하는 모델링 언어인 Promela를 병렬객체지향 개념을 추가하여 확장한 언어인 APromela를 제안하였다. 이는 Promela가 프로세스를 단위로 하는 병렬성만을 지원하는데 반해, 액터 모델에 기반한 객체지향 병렬성을 지원한다. 또한 우리는 이 언어로 작성된 모델을 자동으로 Promela로 변환하는 규칙을 제안하였다. 이를 통해, 기존의 모델체커를 이용해 병렬 객체지향 시스템의 검증을 수행할 수 있다. 이 언어의 응용으로 UML 로 기술된 명세의 검증을 수행하는 과정을 제시하였다.

  • PDF

한국문학의 영어권에 있어서의 수용 및 연구 현황 - 미국을 중심으로 (The Translation and Study of Korean Literature in English Speaking Countries)

  • 권석우
    • 인문언어
    • /
    • 제7집
    • /
    • pp.205-226
    • /
    • 2005
  • Up to January 2003, the amount of English translated works of Korean Literature are 399, among which 170 are translated abroad, 189, in Korea, and 40, abroad as well as in Korea at the same time. Like other language speaking countries, the 1980s and the 1990s are peak not only for the translation of Korean Literature but also for its scholarly attention. The statistic analysis of information, accumulated in various databases such as The Harvard Korean Studies Bibliography, Hawaii Korean Studies Bibliography, and MLA International Bibliography, shows that up to February 2004, 33 books, 16 dissertations and one thesis, 200 articles, and 84 reviews are wholly devoted to the study of Korean Literature in English speaking countries. However, why certain works of poets like Kim Sowol, Han Youngun, So Chungju, and novelists like Hwang Sunwon, Han Moosook, Kim Dongri are mostly translated in English speaking countries remain to be analysed in their socio-political details in breadth and depth. Likewise, why the works of So Chungju, Yi Kwangsoo, Kim Manjoong, Han Youngun, Kim Sowol, Chung Jiyoung are mostly taught and studied in English speaking countries are open to further scholarly discussion and debate.

  • PDF