DOI QR코드

DOI QR Code

CTGAN기반 데이터 증강 비율 최적화 연구

A Study on the Optimization of Data Augmentation Ratio using CTGAN

  • 성다훈 (숙명여자대학교 IT공학과) ;
  • 임유진 (숙명여자대학교 인공지능공학부 )
  • Da-Hun Seong (Dept. of Information Technology Engineering, Sookmyung Women's University) ;
  • Yujin Lim (Div. of Artificial Intelligence Engineering, Sookmyung Women's University)
  • 발행 : 2023.11.02

초록

머신러닝과 딥러닝 모델의 사용이 급증함에 따라 충분한 데이터 확보의 중요성이 부각되고 있다. 이에 따라 생성 모델을 통한 데이터 증강 기술이 주목받고 있으나, 증강 데이터를 활용했을 때 학습의 성능 분석은 아직 부족하다. 따라서 본 연구에서는 데이터 증강 시나리오에 따라 증강 비율별 합성 데이터의 유용성을 조사하고자 한다. 본 연구에서는 테이블 데이터를 증강하는 것에 초점을 맞추었으며, 이를 위해 테이블 데이터를 합성할 때 유용한 성능을 보이는 딥러닝 모델 CTGAN을 활용하였다. 실험에서 데이터를 증강하는 두 가지 다른 시나리오를 고려한 결과, 두 시나리오에서 모두 실험에서 설정한 증강 비율까지의 합성 데이터가 유용한 결과를 보임을 확인할 수 있었다.

키워드

과제정보

이 성과는 정부(과학기술정보통신부)의 재원으로 한국연구재단의 지원을 받아 수행된 연구임 (No. 2021R1F1A1047113).