• 제목/요약/키워드: 인용패턴

검색결과 48건 처리시간 0.024초

딥러닝 기반 특허의 종속 청구항 인식 개선 (Improving Recognition of Patent's Claims with Deep Neural Networks)

  • 박주연;신예지;김민수;김동호;김지희
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2020년도 춘계학술발표대회
    • /
    • pp.500-503
    • /
    • 2020
  • 특허를 통해 기술의 권리를 정의하고 보호하는 일이 매우 중요해짐에 따라 특허 문서를 분석하는 연구 또한 중요해지고 있다. 특히 특허의 청구항을 종속항과 독립항을 구분하고, 관련된 인용을 찾아내는 일은 관련 특허들을 분석하는데 매우 중요하다. 본 연구는 최근 텍스트 분석 분야에 획기적 성능 개선을 이끈 BERT(Bidirectional Encoder Representations From Transformers) 언어 모델을 사용하고 Neural Network 의 파인 튜닝 과정을 통해 청구항의 독립과 종속을 구분하였고, 인용하는 항의 번호와 인용 문구로 이루어진 인용 패턴을 통해 종속항의 인용 항을 찾아내었다. 이 방법을 2003 년 이후의 xml 형식의 미국 특허 데이터에 사용한 결과, 정확도 99% 의 성능을 확보하였다.

국내 과학기술 연구자의 한국 학술지 인용패턴 연구 (A Study of Citing Patterns of Korean Scientists on Korean Journals)

  • 최선희;김병규;강무영;류범종;이종욱;박재원
    • 정보관리학회지
    • /
    • 제28권2호
    • /
    • pp.97-115
    • /
    • 2011
  • 국내 과학기술 분야 연구자들의 인용행태를 종합적으로 파악하고 분석하기 위해서는 대규모의 신뢰할 수 있는 인용색인 데이터베이스가 필요하다. KISTI는 한국 과학기술 인용색인 데이터베이스인 KSCD를 구축하고 한국과학기술인용보고서(KJCR) 및 한국과학기술인용색인서비스(KSCI)를 제공하고 있다. 본 논문에서는 국내 핵심 학술지 459종의 학술지를 커버하는 KSCD를 활용하여 국내 과학기술분야 연구자들의 한국 학술지 인용행태를 분석 연구를 수행하였다. 연구 범위로는 첫째, 대상 DB 수록 학술지의 통계적 주요 수치정보를, 둘째, 인용문헌의 형태별 분석을, 셋째, 인용문헌의 국내와 해외비율 및 타분야 인용비율을, 넷째, 국내 인용문헌의 즉시인용, 인용절정기, 반감기를 마지막으로 KJCR 인용지표를 통한 학술지의 영향력 분석이다. 국내학술지 인용분석을 통한 연구의 주요 성과로는 국내 인용 학술지의 즉시인용률(평균 2.36%), 인용절정기(평균 1.7년), 반감기(평균 5.2년)의 규명과 모든 주제분야에서 자기학술지 인용률이 평균 50%를 넘는다는 것을 밝힌 것이다. 본 연구를 통해 국내 과학자들의 국내 학술지 인용행태를 과학기술 전분야에 걸쳐 종합적으로 파악할 수 있었다.

논문 영향력 예측을 위한 저자별 논문의 피인용 패턴 분석 (An Analysis on the Pattern of Citation in Articles for the Prediction of Article Impact)

  • 이혜진;이춘실
    • 한국정보관리학회:학술대회논문집
    • /
    • 한국정보관리학회 2013년도 제20회 학술대회 논문집
    • /
    • pp.15-18
    • /
    • 2013
  • 본 연구는 최근에 발표된 단위 논문별 영향력을 예측하기 위해 해당 저자가 이전에 발표했던 논문들의 년도별 피인용 추이를 분석하였다. 최근 IF가 가장 높은 "Cell & Tissue Engineering" 분야와 그 분야에서 IF가 가장 높은 저널 "Stem Cell"을 선정하여 최근에 실린 논문의 저자정보를 파악하고, 해당 저자의 이전에 발표한 논문들을 추출하였다. 분석 결과, 저자가 발표한 논문들이 최근에 인용이 많이 일어나면 이후 발표한 논문의 인용빈도가 높아지는 것으로 나타났으며, 특히 동일한 h-index를 가진 저자들 간의 비교에서 더욱 두드러지게 나타났다.

  • PDF

어휘 자질 기반 기계 학습을 사용한 한국어 암묵 인용문 인식 (Recognition of Korean Implicit Citation Sentences Using Machine Learning with Lexical Features)

  • 강인수
    • 한국산학기술학회논문지
    • /
    • 제16권8호
    • /
    • pp.5565-5570
    • /
    • 2015
  • 암묵인용문 인식은 학술문헌의 본문 텍스트 내에서 명시적 인용표지가 누락된 인용문장을 자동 인식하는 것으로 인용 기반 논문 검색 및 요약의 핵심 기술이다. 기존 암묵인용문 인식의 최신 연구들은 단어 ngram, 단서어구, 명시인용문과의 거리, 기존 연구자의 성, 기존 방법의 명칭 등 다양한 자질을 활용하여 50% 이상 인식 수준을 보고하고 있다. 그러나 대부분의 기존 연구들은 영어에 대해 수행되었으며 한국어의 경우 최근 긍정/부정 단서어구 패턴을 활용한 규칙 기반 시도에서 42% 성능 수준이 보고되어 있어 추가 성능 향상이 요구되는 상황이다. 이 연구에서는 한국어 어휘 자질을 사용하여 한국어 암묵인용문의 기계학습 기반 인식을 시도하였다. 이를 위해 어절, 형태소, 음절 단위에 기반한 다양한 크기의 어휘 ngram 자질들의 인식 성능을 비교 평가하고 한국어 암묵인용문 인식에 적합한 어휘 자질로 형태소 1gram 및 음절 2gram 단위를 결정하였다. 또한 이들 어휘 자질들을 전후 명시인용문들과의 인접성을 표현한 위치 자질들과 결합하여 한국어 암묵인용문 인식 성능을 50% 이상 수준으로 대폭 향상시켰다.

문헌 단위 인용 네트워크 내 인용과 중심성 지수 간 관계 추정에 관한 연구 (Curve Estimation among Citation and Centrality Measures in Article-level Citation Networks)

  • 유소영
    • 정보관리학회지
    • /
    • 제29권2호
    • /
    • pp.193-204
    • /
    • 2012
  • 이 연구에서는 인용 및 동시인용 문헌 네트워크에서의 중심성 지수를 사용한 추론 통계 적용의 첫 번째 단계로써 이들 간 관계의 선형성을 살펴보고자 하였다. 703개의 문헌 동시인용 네트워크를 활용하여 인용 빈도, 연결정도 중심성, 인접 중심성, 매개 중심성 간의 4가지 주요 관계의 패턴을 살펴본 결과, 모든 인용 및 중심성 간 관계가 선형모델보다는 비선형적 모델로 더 잘 설명될 수 있음을 통계적으로 확인되었다. 따라서 이들 간의 인과관계에 대한 다중회귀분석과 같은 추론 통계 분석의 기반이 되는 선형성을 확보하기 위해서는 논리적인 기준에 근거한 데이터 변환이나 실제값을 구간값으로 변환하는 과정이 필요하다고 할 수 있다.

과학 및 인문학 분야 출판 패턴의 비교 분석 : 한국학술지인용색인의 서지 데이터를 기반으로 (Comparative Analysis of Publication Patterns in Sciences and Humanities: Based on Bibliometric Data from Korea Citation Index)

  • Yang, Kiduk
    • 한국도서관정보학회지
    • /
    • 제50권3호
    • /
    • pp.23-47
    • /
    • 2019
  • 본 연구는 한국의 연구업적평가 개선에 도움이 될 수 있도록 학문분야별 출판 패턴의 차이를 조사하기 위해 한국학술지인용색인에서 수집한 6개 분야(문헌정보학, 사회학, 생물학, 역사학, 철학, 컴퓨터공학)의 서지데이터를 분석했다. 그 결과에 따르면 상기 6개 학문분야는 규모, 경쟁률, 생산성, 영향력 및 공동연구 관점에서 차이를 드러내었다. 우선, 저자수와 기관수 측면에서 연구 규모는 과학분야가 가장 컸으며, 인문학, 사회과학 순이었고, 저자별 출판율에서는 인문학분야가 가장 높았으며, 사회과학, 과학 순이었다. 또한 "사회학"의 경우, 논문 편당 인용수가 가장 높았으나, 인문학분야의 경우, 저자당 인용수가 가장 높은 것으로 나타나 이는 논문 편당 공동저자 수의 영향으로 보인다. 이처럼 본 연구는 논문 편당 저자수 분포에서도 학문분야별 차이를 발견할 수 있었는데, 인문학분야는 주로 단독 저자의 논문인 반면, 과학분야의 경우 대부분 공동 저술된 논문들이었다. 또한 본 연구는 학문분야별 인용시간의 차이와 핵심저자 및 기관의 분포, 이에 따른 영향의 차이도 제시하였다.

한국문헌정보학분야의 연구동향 분석: 1996${\sim}$2000 (An Analytical Study on Research Trends of Library and Information Science in Korea : 1996한국문헌정보학분야의 연구동향 분석: 1996${\sim}$2000)

  • 정진식
    • 한국문헌정보학회지
    • /
    • 제35권3호
    • /
    • pp.55-78
    • /
    • 2001
  • 본 연구는 한국문헌정보학분야의 연구동향을 규명하고 학문의 연구영역과 타 학문과의 주제 의존도 및 문헌정보학의 지적구조 변화를 조사하였다. 인용패턴을 이용한 계량적 방법을 이용, 연구의 동향과 변화를 대응분석 방법을 적용하였다. 조사결과 문헌정보학을 비롯한 정보학분야에 대한 의존도가 크게 나타났으며, 학문의 이론 및 응용기법의 활용도가 높은 컴퓨터 관련 전산학이 부상될 것으로 예상된다.

  • PDF

학술논문에서의 위키피디아 인용에 관한 연구 (Analysis of Wikipedia Citations in Peer-Reviewed Journal Articles)

  • 심원식;변제연;김민정
    • 한국문헌정보학회지
    • /
    • 제47권2호
    • /
    • pp.247-264
    • /
    • 2013
  • 익명의 인터넷 이용자가 백과사전의 내용을 쓰고, 수정하고, 편집을 한다는 점에서 위키피디아는 획기적인 발상이다. 위키피디아는 현재 인터넷에서 가장 빈번하게 이용되는 정보원이지만 학술연구자들은 정보의 신뢰성, 정확성의 문제 등으로 위키피디아를 학술연구에서 이용하거나 인용하는 것을 위험한 행동으로 평가하고 있다. 본 연구는 대표적인 인용색인 데이터베이스인 Thomson Reuters의 Web of Science(WoS)에서 2002년부터 2012년의 기간 동안 위키피디아를 인용하고 있는 논문 총 282개를 대상으로 특성 및 인용 패턴을 분석하였다. 위키피디아 인용논문은 비록 소수이기는 하지만 2011년을 기점으로 급격하게 증가하고 있는 추세를 보이고 있다. 가장 많은 논문이 분포한 분야는 문헌정보학, 경영학, 심리학, 교육학 및 커뮤니케이션 분야이다. 원문을 입수할 수 있는 267개 논문에 나타난 총 577개의 인용에 대한 내용분석을 통해 위키피디아에 대한 연구에서의 인용과 지식정보원으로써의 위키피디아 활용을 조사하였다. 조사 결과 총 577개의 분석 대상 인용 가운데 상당수의 인용은 위키피디아에 대한 소개, 설명(139건, 24.1%)이거나, 위키피디아의 글을 간단한 참고정보원으로 활용한 경우(331건, 57.4%)로 파악되었다. 하지만 기존에 여러 연구자들에 의해 위험한 행동으로 간주될 수 있는 위키피디아를 논문의 주요 근거 혹은 데이터 소스로 활용한 사례도 87건(15.1%)으로 조사되었다.

한국과학기술인용 DB를 반영한 JCR 분석연구 (Analysis of Korea Science Citation Database's effect on JCR)

  • 이종욱;양기덕;김병규;류범종
    • 정보관리연구
    • /
    • 제43권3호
    • /
    • pp.23-41
    • /
    • 2012
  • 전 세계적으로 이용되는 인용색인 서비스인 Web of Science(WoS)는 데이터 수록 범위에 한계가 있음이 인용색인 연구에서 지적되어 왔다. 또한 국내 학술논문이 인용하는 해외 문헌의 비율이 전체의 약 75%를 차지한다는 것이 인용패턴 분석연구에서 밝혀진 바 있다. 본 연구에서는 WoS DB의 데이터 수록 범위를 검증하기 위한 첫 번째 단계로써 WoS DB에 포함되어 있지 않은 국내 연구자의 인용문헌 즉, 한국과학기술인용 DB(Korea Science Citation Database: KSCD)에 수록된 참고문헌 데이터 일부를 JCR 학술지 영향력지수 산출과정에 포함시켜 학술지 영향력 지수(Impact Factor: IF)의 변화 및 그에 따른 학술지 순위변동 여부를 조사하였다. 구체적으로 국내 문헌정보학 분야 학술지에 수록된 참고문헌을 JCR 2009 문헌정보학 분야 학술지 IF 산출과정에 포함하였다. 하지만 학술지 IF의 변화와 그에 따른 순위 차이가 통계적으로 유의하지 않았고, 이에 데이터 범위를 넓혀 컴퓨터 공학 및 전자공학 분야 학술지 45종에 수록된 참고문헌을 추가로 분석하여 JCR 2010 전자공학 분야 학술지 IF 산출과정에 포함하였다. 그 결과, 부분적으로 통계적으로 유의한 학술지 순위 변화가 일어났다. 본 연구는 한정된 데이터를 사용하였음에도 불구하고 미미하지만 통계적으로 유의한 JCR 학술지 순위 변동을 보여줌으로써 WoS DB에 포함되지 않은 인용 데이터의 잠재적 가치를 제시하였다.

디지털 환경에서 학술지 인용의 분산화 현상에 관한 연구 (The Dispersion Phenomenon of Journal Citations in a Digital Environment)

  • 신은자
    • 정보관리학회지
    • /
    • 제26권2호
    • /
    • pp.211-222
    • /
    • 2009
  • 전자출판은 정보검색, 이용패턴, 인용행태 등 학술 커뮤니케이션 전반에 많은 영향을 주었고 변화를 초래하였다. 이 연구는 전자출판 특히 전자학술지의 보급이 학술 커뮤니케이션에 어떠한 영향을 미치고 있는지를 규명하기 위하여 학술지의 수명을 간접적으로 보여주는 지표라 할 수 있는 인용반감기 데이터를 JCR 사회과학 편으로부터 수집한 후 전자학술지 도입 이전과 이후를 비교하고 분석하였다. 모두 여덟 부문의 주제영역에 관하여 데이터를 분석한 결과 인구통계학을 제외한 일곱 부문에서 1994년에 비해 2007년의 인용반감기가 증가한 것으로 나타났다. 특히 경제학, 교육학, 재정학, 사회학 등의 네 주제영역에서는 인용반감기의 평균이 통계적으로 유의미하게 증가하였다. 이 결과는 과거와 같이 핵심 학술지 및 최신호에 이용이 집중되던 현상이 완화되고 비핵심 학술지 및 오래된 학술지의 이용이 상대적으로 증가하는 '학술지 인용의 분산화(탈집중화) 현상'이 나타나기 시작했다는 것을 보여주는 것으로 간주할 수 있을 것이다. 디지털 환경에서는 오래된 자료라도 여러 가지 미디어에 힘입어 원활하게 접근이 가능하기 때문에 이의 이용과 인용이 증가할 가능성이 있고, 따라서 인용반감기의 증가로 이어질 수 있는 가능성도 충분하기 때문이다. 그러나 이러한 현상이 일시적으로 나타난 것인지 아니면 매우 다양한 분야에서 지속적으로 나타날 것인지는 시간을 두고 더 관찰해야 할 것으로 보인다.