• 제목/요약/키워드: Test Validation

검색결과 1,808건 처리시간 0.029초

연관지식의 효율적인 표현 및 추론이 가능한 지식그래프 기반 지식지도 (Knowledge graph-based knowledge map for efficient expression and inference of associated knowledge)

  • 유기동
    • 지능정보연구
    • /
    • 제27권4호
    • /
    • pp.49-71
    • /
    • 2021
  • 문제해결을 위해 지식을 활용하는 사용자는 내용 면에서 관련된 또 다른 지식, 즉 연관지식에 대한 교차적이고 순차적인 탐색을 진행한다. 지식지도는 관리하는 지식의 현황을 보여주는 도식이자 지식저장소의 분류체계로서, 지식 간 연관성에 기반한 사용자의 지식 탐색을 지원하는 도구이다. 따라서 지식지도는 지식 간 연관성에 의한 네트워크 형식으로 표현되며, 이를 정의 및 추론하는 데에 최적화된 기술을 접목하여 구현되어야 한다. 이를 위해 본 연구는 관리하는 개체와 개체 간 관계를 표현 및 추론하는 데에 최적화된 기능성을 발휘하는 것으로 알려진 그래프DB를 이용하여 지식그래프 기반 지식지도를 개발하는 방법론을 제시한다. 제시된 방법론의 유효성을 확인하기 위하여, 선행 연구의 온톨로지 기반 지식지도 구축 사례 데이터를 그래프DB에 적용하여 지식그래프 기반 지식지도를 구현하고, 구현된 지식 네트워크의 유효성과 Class 자동 구성 능력을 선행 연구의 결과와 비교하는 성능 테스트를 진행한다. 성능 테스트 결과, 본 연구의 지식그래프 기반 지식지도는 선행 연구의 온톨로지 기반 지식지도와 동일한 수준의 성능을 나타냈으며, 지식 및 지식 간 관계 정의 및 추론을 더욱 효율적으로 진행할 수 있음을 확인하였다. 본 연구의 결과는 연관지식에 대한 사용자의 인지과정을 반영한 지식 탐색 기능의 구현에 활용될 수 있으며, 추론에 의한 새로운 연관지식의 발견을 통해 자율적으로 확장되는 지능적 지식베이스의 개발에 응용될 수 있다.

청소년이 지각한 가족친밀감이 노인부양의식에 미치는 영향: 노인인식과 치매에 대한 태도의 매개효과 검증 (The Effects of Family Friendship on the Elderly's Consciousness: A Study on the Effects of Mediation on the Recognition of the Elderly and the Attitude to Dementia)

  • 최윤지;오광수
    • 한국노년학
    • /
    • 제39권4호
    • /
    • pp.723-739
    • /
    • 2019
  • 본 연구는 개인주의화, 만혼현상, 이혼율 증대 등이 복합적으로 작용하여 가족구조와 기능이 빠른 속도로 변화되는 추세에 고령화가 심화되고 있는 현실 속에서 우리나라 청소년들의 가족친밀감이 노인부양의식의 영향관계에서 노인인식과 치매에 대한 태도의 매개효과를 검증하는 것이다. 이러한 연구목적을 수행하기 위하여 광주광역시 소재 초·중·고등학교 학생을 대상으로 자기기입식 설문지를 통해 자료를 수집하였다. 통계분석을 위해서는 SPSS 20.0과 AMOS 18.0프로그램을 이용하였고, 빈도, 백분율, 기술통계, 상관관계, 요인분석, 구조모형검증, Sobel-Test를 실시하였다. 본 연구를 통해 나타난 결과는 다음과 같다. 첫째, 가족친밀감, 노인인식, 노인부양의식은 초등학생이 가장 높고, 중학생, 고등학생 순으로 '연령'에서 유의미하게 나타났다(P<.001). 또 종교에서는 종교가 있는 청소년의 가족친밀감이 종교가 없는 청소년 보다 더 높았다(p<.001). 둘째, 가족친밀감은 노인인식과 치매에 대한 태도, 노인부양의식에 직접적으로 영향을 미쳤으며, 노인인식은 치매에 대한 태도에, 치매에 대한 태도는 노인부양의식에 직접적으로 영향을 미쳤다. 셋째, 가족친밀감(부모-자녀)은 노인인식에 7.8%, 가족친밀감과 노인인식이 치매에 대한 태도에 20.2%, 치매에 대한 태도와 가족친밀감이 노인부양의식에 34.1%의 영향력이 있는 것으로 나타났다(p<.001). 넷째, 가족친밀감과 노인부양 의식 간의 노인인식, 치매에 대한 태도의 절대 값이 1.96보다 높게 나와 매개역할을 하는 것으로 검증되었다. 이러한 연구결과는 청소년 초기에 가족친밀감과 노인인식, 치매에 대한 태도의 향상을 위한 교육프로그램의 개발과 청소년들의 치매에 대한 지식이나 태도가 올바른 지식을 전달과 긍정적인 부양의식 해결과 함께 세대 간의 갈등 해소를 통해, 노인의 삶의 질을 향상시키기 위한 노인교육복지에 기여하고자 한다.

유전자 알고리즘을 이용한 다분류 SVM의 최적화: 기업신용등급 예측에의 응용 (Optimization of Multiclass Support Vector Machine using Genetic Algorithm: Application to the Prediction of Corporate Credit Rating)

  • 안현철
    • 경영정보학연구
    • /
    • 제16권3호
    • /
    • pp.161-177
    • /
    • 2014
  • 기업신용등급은 금융시장의 신뢰를 구축하고 거래를 활성화하는데 있어 매우 중요한 요소로서, 오래 전부터 학계에서는 보다 정확한 기업신용등급 예측을 가능케 하는 다양한 모형들을 연구해 왔다. 구체적으로 다중판별분석(Multiple Discriminant Analysis, MDA)이나 다항 로지스틱 회귀분석(multinomial logistic regression analysis, MLOGIT)과 같은 통계기법을 비롯해, 인공신경망(Artificial Neural Networks, ANN), 사례기반추론(Case-based Reasoning, CBR), 그리고 다분류 문제해결을 위해 확장된 다분류 Support Vector Machines(Multiclass SVM)에 이르기까지 다양한 기법들이 학자들에 의해 적용되었는데, 최근의 연구결과들에 따르면 이 중에서도 다분류 SVM이 가장 우수한 예측성과를 보이고 있는 것으로 보고되고 있다. 본 연구에서는 이러한 다분류 SVM의 성능을 한 단계 더 개선하기 위한 대안으로 유전자 알고리즘(GA, Genetic Algorithm)을 활용한 최적화 모형을 제안한다. 구체적으로 본 연구의 제안모형은 유전자 알고리즘을 활용해 다분류 SVM에 적용되어야 할 최적의 커널 함수 파라미터값들과 최적의 입력변수 집합(feature subset)을 탐색하도록 설계되었다. 실제 데이터셋을 활용해 제안모형을 적용해 본 결과, MDA나 MLOGIT, CBR, ANN과 같은 기존 인공지능/데이터마이닝 기법들은 물론 지금까지 가장 우수한 예측성과를 보이는 것으로 알려져 있던 전통적인 다분류 SVM 보다도 제안모형이 더 우수한 예측성과를 보임을 확인할 수 있었다.

농산물 중 살균제 Fluoxastrobin의 시험법 개발 및 유효성 검증 (Development and Validation of an Analytical Method for Fungicide Fluoxastrobin Determination in Agricultural Products)

  • 이소은;이수정;구선영;박채영;신혜선;강성은;이정미;정윤미;장귀현;문귀임
    • 한국식품위생안전성학회지
    • /
    • 제37권6호
    • /
    • pp.373-384
    • /
    • 2022
  • 플루옥사스트로빈은 Strobilurus 속의 버섯에서 추출한 천연물을 기반으로 개발된 살균제로서 곰팡이성 질병 방제에 효과적이다. 잔류물의 정의는 유럽(EU), 미국(EPA), 일본(JFCRF)에서는 플루옥사스트로빈과 플루옥사스트로빈 Z 이성질체의 합으로 정의하고 있으며, 감자, 대두 등 90품목에 대하여 0.01-60 mg/kg으로 잔류허용기준이 설정되어 있다. 코덱스(CODEX)와 국내에는 잔류허용기준이 설정되어 있지 않음에 따라 본 연구에서는 추후 국내·외 수입 및 재배 농산물 중 플루옥사스트로빈에 대한 잔류허용기준 준수 여부 확인을 위한 시험법을 개발하고자 하였다. 전처리 과정은 플루옥사스트로빈의 물리·화학적 특성을 고려하여 QuEChERS법을 이용한 추출 및 정제방법으로 최적화하였으며, LC-MS/MS를 이용하여 시험법을 개발하였다. 추출 용매는 아세토니트릴로 하고, MgSO4 및 PSA를 이용하여 정제과정을 확립하였다. 대표 농산물 5종에 대해 0.01, 0.1 및 0.5 mg/kg의 처리농도로 실험을 진행한 결과, 플루옥사스트로빈 및 플루옥사스트로빈 Z 이성질체의 결정계수(R2)는 0.998 이상이고 플루옥사스트로빈의 평균 회수율(n=5)은 75.5-100.3%, 플루옥사스트로빈 Z 이성질체는 75.0-103.9%이었다. 상대표준편차는 플루옥사스트로빈이 5.5% 이하, 플루옥사스트로빈 Z 이성질체가 4.3% 이하로 확인되었다. 또한 시험법의 유효성을 확인하기 위해 외부 실험기관인 광주지방식품의약품안전청과의 실험실간 검증을 진행하였으며, 검증 결과 두 실험실간의 회수율은 플루옥사스트로빈의 경우 80.3-101.4%, 플루옥사스트로빈 Z 이성질체는 80.2-105.0%이었고, 상대표준편차는 모두 18.1% 이하로 정확성 및 재현성이 우수함을 확인할 수 있었다. 따라서 본 연구 결과는 CODEX 가이드라인(CAC/GL 40-1993, 2003) 및 식품의약품안전평가원의 가이드라인(MFDS, 2016)에 만족함에 따라 공정시험법으로 활용 가능할 것이다.

예측 불가능한 호흡 변화에 따른 사이버나이프 종양 추적 방사선 치료의 정확도 분석 (An accuracy analysis of Cyberknife tumor tracking radiotherapy according to unpredictable change of respiration)

  • 서정민;이창열;허현도;김완선
    • 대한방사선치료학회지
    • /
    • 제27권2호
    • /
    • pp.157-166
    • /
    • 2015
  • 목 적 : 사이버나이프 종양 추적 시스템(Cyber-knife tumor tracking system)은 환자 외부에 부착한 LED marker에서 얻어진 실시간 호흡 주기 신호와 호흡에 따라 움직이는 종양의 위치와의 상관관계를 바탕으로 종양의 위치를 미리 예측하고 종양의 움직임을 치료기와 동기화 (Synchronize) 시켜 실시간으로 종양을 추적하며 치료하는 시스템이다. 본 연구의 목적은 사이버나이프 종양 추적 방사선 치료 중 기침이나 수면 등으로 인해 예측 불가능한 갑작스러운 호흡 형태 변화에 따른 종양 추적 방사선 치료 시스템의 정확도를 평가하고자 한다. 대상 및 방법 : 연구에 사용된 호흡 Log 파일은 본원에서 호흡 동조 방사선치료(Respiratory gating radiotherapy)나 사이버나이프 호흡 추적 방사선수술(Cyber-knife tracking radiosurgery)을 받았던 환자의 호흡 Log 파일을 바탕으로, 정현곡선 형태(Sinusoidal pattern)와 갑작스런 변화 형태(Sudden change pattern)의 Log 파일을 이용하여 측정이 가능하도록 재구성하였다. 재구성 된 호흡 Log 파일을 사이버나이프 동적 흉부 팬텀에 입력하여 호흡에 따른 움직임을 구현할 수 있도록 기존 동적 흉부 팬텀의 구동장치를 추가 제작하였고, 호흡의 형태를 팬텀에 적용 시킬 수 있는 프로그램을 개발하였다. 팬텀 내부 표적(Ball cube target)의 움직임은 호흡의 크기에 따라 상하(Superior-Inferior)방향으로 5 mm, 10 mm, 20 mm 3가지 크기의 변위로 구동하게 하였다. 팬텀 내부 표적에 EBT3 필름 2장을 교차 삽입하여 표적 움직임의 변화에 따라 사이버나이프 제조사에서 제공된 End-to-End(E2E) test를 호흡의 형태에 따라 각각 5회씩 실시하고 측정하였다. 종양 추적 시스템의 정확도는 삽입된 필름을 분석하여 표적 오차(Targeting error)로 나타내었고, 추가로 E2E test가 진행되는 동안 상관관계 오차(Correlation error)를 측정하여 분석하였다. 결 과 : 표적 오차는 정현곡선 호흡 형태일 경우 표적 움직임의 크기가 5 mm, 10 mm, 20 mm 에 따라 각각 평균 $1.14{\pm}0.13mm$, $1.05{\pm}0.20mm$, $2.37{\pm}0.17mm$이고, 갑작스런 호흡 변화 형태일 경우 각각 평균 $1.87{\pm}0.19mm$, $2.15{\pm}0.21mm$, $2.44{\pm}0.26mm$으로 분석되었다. 표적 추적에 있어 변위 벡터의 길이로 정의할 수 있는 상관관계 오차는 정현곡선 호흡 형태일 경우 표적 움직임의 크기가 5 mm, 10 mm, 20 mm 에 따라 각각 평균 $0.84{\pm}0.01mm$, $0.70{\pm}0.13mm$, $1.63{\pm}0.10mm$이고, 갑작스런 호흡 변화 형태일 경우 각각 평균 $0.97{\pm}0.06mm$, $1.44{\pm}0.11mm$, $1.98{\pm}0.10mm$으로 분석되었다. 두 호흡 형태에서 모두 상관관계 오차 값이 클수록 표적 오차 값이 크게 나타났다. 정현곡선 호흡 형태의 표적 움직임 크기가 20 mm 이상일 경우, 두 오차 값 모두 사이버나이프 제조사의 권고치인 1.5 mm 이상으로 측정되었다. 결 론 : 표적 움직임의 크기가 클수록 표적 오차 값과 상관관계 오차 값이 증가하는 경향이 있었으며, 정현곡선 호흡 형태보다 갑작스런 호흡 변화 형태에서 오차 값이 크게 나타났다. 호흡의 형태가 규칙적인 정현 곡선 형태더라도 표적의 움직임이 클수록 종양 추적 시스템의 정확도가 감소하는 것으로 판단할 수 있다. 사이버나이프 종양 추적 시스템의 알고리즘을 이용하여 치료 시행 시 환자의 기침 등으로 인하여 갑작스럽게 예측 불가능한 호흡 변화가 있는 경우 치료를 멈추고 내부 표적 확인 과정을 재실시 하여야 하며 호흡 형태를 재조정해야 할 필요가 있다. 치료 중 환자가 본인의 호흡 형태를 관찰 할 수 있는 고글 모니터 등을 착용하여 규칙적인 호흡 형태를 유도하는 것이 치료의 정확도는 향상될 수 있다고 판단된다.

  • PDF

회사채 신용등급 예측을 위한 SVM 앙상블학습 (Ensemble Learning with Support Vector Machines for Bond Rating)

  • 김명종
    • 지능정보연구
    • /
    • 제18권2호
    • /
    • pp.29-45
    • /
    • 2012
  • 회사채 신용등급은 투자자의 입장에서는 수익률 결정의 중요한 요소이며 기업의 입장에서는 자본비용 및 기업 가치와 관련된 중요한 재무의사결정사항으로 정교한 신용등급 예측 모형의 개발은 재무 및 회계 분야에서 오랫동안 전통적인 연구 주제가 되어왔다. 그러나, 회사채 신용등급 예측 모형의 성과와 관련된 가장 중요한 문제는 등급별 데이터의 불균형 문제이다. 예측 문제에 있어서 데이터 불균형(Data imbalance) 은 사용되는 표본이 특정 범주에 편중되었을 때 나타난다. 데이터 불균형이 심화됨에 따라 범주 사이의 분류경계영역이 왜곡되므로 분류자의 학습성과가 저하되게 된다. 본 연구에서는 데이터 불균형 문제가 존재하는 다분류 문제를 효과적으로 해결하기 위한 다분류 기하평균 부스팅 기법 (Multiclass Geometric Mean-based Boosting MGM-Boost)을 제안하고자 한다. MGM-Boost 알고리즘은 부스팅 알고리즘에 기하평균 개념을 도입한 것으로 오분류된 표본에 대한 학습을 강화할 수 있으며 불균형 분포를 보이는 각 범주의 예측정확도를 동시에 고려한 학습이 가능하다는 장점이 있다. 회사채 신용등급 예측문제를 활용하여 MGM-Boost의 성과를 검증한 결과 SVM 및 AdaBoost 기법과 비교하여 통계적으로 유의적인 성과개선 효과를 보여주었으며 데이터 불균형 하에서도 벤치마킹 모형과 비교하여 견고한 학습성과를 나타냈다.

한국 NPL시장 수익률 예측에 관한 연구 (A study on the prediction of korean NPL market return)

  • 이현수;정승환;오경주
    • 지능정보연구
    • /
    • 제25권2호
    • /
    • pp.123-139
    • /
    • 2019
  • 국내 NPL (Non performing loan) 시장은 1998년에 형성되었지만, 본격적으로 활성화 된 시기는 2009년으로 역사가 짧은 시장이다. 이로 인해 NPL 시장에 대한 연구도 아직까지는 활발히 진행되지 않고 있는 상황이다. 본 연구는 NPL 시장의 각 물건 별 기준 수익률 달성 유무를 예측할 수 있는 모델을 제안한다. 모델 구축에 사용되는 종속변수는 물건 별 최종 수익률이 기준 수익률 수치 도달 여부를 나타내는 이항변수를 사용하였고, 독립변수로는 물건의 특성을 나타내는 11개의 변수를 대상으로 one to one t-test와 logistic regression stepwise, decision tree를 수행하여 의미있는 7개의 독립변수를 선별하였다. 그리고 통상적으로 사용되는 기준 수익률 수치(12%)가 의미있는 기준 수치인지 확인하기 위해 수치 값을 조절해가며 종속변수를 산출하여 예측모델을 구축해보았다. 그 결과 12%의 기준 수익률 수치로 산출한 종속변수를 이용하여 구축한 예측모델의 평균 Hit ratio가 64.60%로 가장 우수하다는 결과를 얻었다. 다음으로 선별된 7개의 독립변수들과 12%를 기준으로한 수익률 달성유무 종속변수를 이용하여 판별분석, 로지스틱 회귀분석, 의사결정나무, 인공신경망, 유전자알고리즘 선형 모델의 5가지 방법론을 적용해 예측모델을 구축해보았다. 5가지 방법론으로 도출한 예측 모델 간 Hit ratio를 비교한 결과 인공신경망을 이용하여 구축한 예측모델의 Hit ratio가 67.4%로 가장 우수한 결과를 도출해내었다. 본 연구를 통해 추후 NPL시장 신규 물건 매매에 있어서 7가지의 독립변수들과 인공신경망 예측 모델을 활용하는 것이 효과적임을 증명하였다. 물건의 12% 수익률 달성 여부를 사전에 예측해봄으로써 유동화회사가 투자 의사결정을 하는 데에 도움을 줄 것으로 예상하며, 나아가 NPL 시장의 거래가 적정한 가격 선에서 진행됨으로 인해 유동성이 더욱 높아질 것이라 기대한다.

평점과 리뷰 텍스트 감성분석을 결합한 추천시스템 향상 방안 연구 (How to improve the accuracy of recommendation systems: Combining ratings and review texts sentiment scores)

  • 현지연;유상이;이상용
    • 지능정보연구
    • /
    • 제25권1호
    • /
    • pp.219-239
    • /
    • 2019
  • 개인에게 맞춤형 서비스를 제공하는 것이 중요해지면서 개인화 추천 시스템 관련 연구들이 끊임없이 이루어지고 있다. 추천 시스템 중 협업 필터링은 학계 및 산업계에서 가장 많이 사용되고 있다. 다만 사용자들의 평점 혹은 사용 여부와 같은 정량적인 정보에 국한하여 추천이 이루어져 정확도가 떨어진다는 문제가 제기되고 있다. 이와 같은 문제를 해결하기 위해 현재까지 많은 연구에서 정량적 정보 외에 다른 정보들을 활용하여 추천 시스템의 성능을 개선하려는 시도가 활발하게 이루어지고 있다. 리뷰를 이용한 감성 분석이 대표적이지만, 기존의 연구에서는 감성 분석의 결과를 추천 시스템에 직접적으로 반영하지 못한다는 한계가 있다. 이에 본 연구는 리뷰에 나타난 감성을 수치화하여 평점에 반영하는 것을 목표로 한다. 즉, 사용자가 직접 작성한 리뷰를 감성 수치화하여 정량적인 정보로 변환해 추천 시스템에 직접 반영할 수 있는 새로운 알고리즘을 제안한다. 이를 위해서는 정성적인 정보인 사용자들의 리뷰를 정량화 시켜야 하므로, 본 연구에서는 텍스트 마이닝의 감성 분석 기법을 통해 감성 수치를 산출하였다. 데이터는 영화 리뷰를 대상으로 하여 도메인 맞춤형 감성 사전을 구축하고, 이를 기반으로 리뷰의 감성점수를 산출한다. 본 논문에서 사용자 리뷰의 감성 수치를 반영한 협업 필터링이 평점만을 고려하는 전통적인 방식의 협업 필터링과 비교하여 우수한 정확도를 나타내는 것을 확인하였다. 이후 제안된 모델이 더 개선된 방식이라고 할 근거를 확보하기 위해 paired t-test 검증을 시도했고, 제안된 모델이 더 우수하다는 결론을 도출하였다. 본 연구에서는 평점만으로 사용자의 감성을 판단한 기존의 선행연구들이 가지는 한계를 극복하고자 리뷰를 수치화하여 기존의 평점 시스템보다 사용자의 의견을 더 정교하게 추천 시스템에 반영시켜 정확도를 향상시켰다. 이를 기반으로 추가적으로 다양한 분석을 시행한다면 추천의 정확도가 더 높아질 것으로 기대된다.

비정형 텍스트 분석을 활용한 이슈의 동적 변이과정 고찰 (Investigating Dynamic Mutation Process of Issues Using Unstructured Text Analysis)

  • 임명수;김남규
    • 지능정보연구
    • /
    • 제22권1호
    • /
    • pp.1-18
    • /
    • 2016
  • 최근 가용한 텍스트 데이터 자원이 증가함에 따라 방대한 텍스트 분석을 통해 새로운 가치를 창출하고자 하는 수요가 증가하고 있다. 특히 뉴스, 민원, 블로그, SNS 등을 통해 유통되는 글로부터 다양한 이슈를 발굴해내고 이들 이슈의 추이를 분석하는 이슈 트래킹에 대한 연구가 활발하게 이루어지고 있다. 전통적인 이슈 트래킹은 토픽 모델링을 통해 오랜 기간에 걸쳐 지속된 주요 이슈를 발굴한 후, 각 이슈를 구성하는 문서 수의 세부 기간별 분포를 분석하는 방식으로 이루어진다. 하지만 전통적 이슈 트래킹은 각 이슈를 구성하는 내용이 전체 기간에 걸쳐 변화 없이 유지된다는 가정 하에 수행되기 때문에, 다양한 세부 이슈가 서로 영향을 주며 생성, 병합, 분화, 소멸하는 이슈의 동적 변이과정을 나타내지 못한다. 또한 전체 기간에 걸쳐 지속적으로 출현한 키워드만이 이슈 키워드로 도출되기 때문에, 핵실험, 이산가족 등 세부 기간의 분석에서는 매우 상이한 맥락으로 파악되는 구체적인 이슈가 오랜 기간의 분석에서는 북한이라는 큰 이슈에 함몰되어 가려지는 현상이 발생할 수 있다. 본 연구에서는 이러한 한계를 극복하기 위해 각 세부 기간의 문서에 대한 독립적인 분석을 통해 세부 기간별 주요 이슈를 도출한 후, 각 이슈의 유사도에 기반하여 이슈 흐름도를 도출하고자 한다. 또한 각 문서의 카테고리 정보를 활용하여 카테고리간의 이슈 전이 패턴을 분석하고자 한다. 본 논문에서는 총 53,739건의 신문 기사에 제안 방법론을 적용한 실험을 수행하였으며, 이를 통해 전통적인 이슈 트래킹을 통해 발굴한 주요 이슈의 세부 기간별 구성 내용을 살펴볼 수 있을 뿐 아니라, 특정 이슈의 선행 이슈와 후행 이슈를 파악할 수 있음을 확인하였다. 또한 카테고리간 분석을 통해 단방향 전이와 양방향 전이의 흥미로운 패턴을 발견하였다.

상처와 주름이 있는 지문 판별에 효율적인 심층 학습 비교연구 (A Comparative Study on the Effective Deep Learning for Fingerprint Recognition with Scar and Wrinkle)

  • 김준섭;림빈 보니카;성낙준;홍민
    • 인터넷정보학회논문지
    • /
    • 제21권4호
    • /
    • pp.17-23
    • /
    • 2020
  • 인간의 특성과 관련된 측정 항목을 나타내는 생체정보는 도난이나 분실의 염려가 없으므로 높은 신뢰성을 가진 보안 기술로서 큰 주목을 받고 있다. 이러한 생체정보 중 지문은 본인 인증, 신원 파악 등의 분야에 주로 사용된다. 신원을 파악할 때 지문 이미지에 인증을 수행하기 어려운 상처, 주름, 습기 등의 문제가 있을 경우, 지문 전문가가 전처리단계를 통해 직접 지문에 어떠한 문제가 있는지 파악하고 문제에 맞는 영상처리 알고리즘을 적용해 문제를 해결한다. 이때 지문에 상처와 주름이 있는 지문 영상을 판별해주는 인공지능 소프트웨어를 구현하면 손쉽게 상처나 주름의 여부를 확인할 수 있고, 알맞은 알고리즘을 선정해 쉽게 지문 이미지를 개선할 수 있다. 본 연구에서는 이러한 인공지능 소프트웨어의 개발을 위해 캄보디아 왕립대학교의 학생 1,010명, Sokoto 오픈 데이터셋 600명, 국내 학생 98명의 모든 손가락 지문을 취득해 총 17,080개의 지문 데이터베이스를 구축했다. 구축한 데이터베이스에서 상처나 주름이 있는 경우를 판별하기 위해 기준을 확립하고 전문가의 검증을 거쳐 데이터 어노테이션을 진행했다. 트레이닝 데이터셋과 테스트 데이터셋은 캄보디아의 데이터, Sokoto 데이터로 구성하였으며 비율을 8:2로 설정했다. 그리고 국내 학생 98명의 데이터를 검증 데이터 셋으로 설정했다, 구성된 데이터셋을 사용해 Classic CNN, AlexNet, VGG-16, Resnet50, Yolo v3 등의 다섯 가지 CNN 기반 아키텍처를 구현해 학습을 진행했으며 지문의 상처와 주름 판독에서 가장 좋은 성능을 보이는 모델을 찾는 연구를 수행했다. 다섯가지 아키텍처 중 지문 영상에서 상처와 주름 여부를 가장 잘 판별할 수 있는 아키텍처는 ResNet50으로 검증 결과 81.51%로 가장 좋은 성능을 보였다.