• 제목/요약/키워드: Classification society rule

검색결과 331건 처리시간 0.023초

A Classification Model for Illegal Debt Collection Using Rule and Machine Learning Based Methods

  • Kim, Tae-Ho;Lim, Jong-In
    • 한국컴퓨터정보학회논문지
    • /
    • 제26권4호
    • /
    • pp.93-103
    • /
    • 2021
  • 금융당국의 채권추심 가이드라인, 추심업자에 대한 직접적인 관리 감독 수행 등의 노력에도 불구하고 채무자에 대한 불법, 부당한 채권 추심은 지속되고 있다. 이러한 불법, 부당한 채권추심행위를 효과적으로 예방하기 위해서는 비정형데이터 기계학습 등 기술을 활용하여 적은 인력으로도 불법 추심행위에 대한 점검 등에 대한 모니터링을 강화 할 수 있는 방법이 필요하다. 본 연구에서는 대부업체의 추심 녹취 파일을 입수하여 이를 텍스트 데이터로 변환하고 위법, 위규 행위를 판별하는 규칙기반 검출과 SVM(Support Vector Machine) 등 기계학습을 결합한 불법채권추심 분류 모델을 제안하고 기계학습 알고리즘에 따라 얼마나 정확한 식별을 하였는지를 비교해 보았다. 본 연구는 규칙기반 불법 검출과 기계학습을 결합하여 분류에 활용할 경우 기존에 연구된 기계학습만을 적용한 분류모델 보다 정확도가 우수하다는 것을 보여 주었다. 본 연구는 규칙기반 불법검출과 기계학습을 결합하여 불법여부를 분류한 최초의 시도이며 후행연구를 진행하여 모델의 완성도를 높인다면 불법채권 추심행위에 대한 소비자 피해 예방에 크게 기여할 수 있을 것이다.

위성 영상 분류를 위한 규칙 기반 훈련 집합 선택에 관한 연구 (A Study on the Rule-Based Selection of Trainging Set for the Classification of Satellite Imagery)

  • 엄기문;이쾌희
    • 한국정보처리학회논문지
    • /
    • 제3권7호
    • /
    • pp.1763-1772
    • /
    • 1996
  • 기존의 위성 영상 분류를 위한 훈련 집합의 선택은 대부분 사용자가 직접 측량하 거나 지도로부터 얻어진 데이터를 이용하여 수작업을 통하여 얻는 것이 보통이다. 그러나 이러한 작업에는 시간과 비용이 많이 소요되며, 같은 지역 내에서도 사용하는 특징값의 변화가 다양하게 나타날 수 있다. 이러한 다양성은 신경망으로 하여금 분류 데이터에 대한 강인성은 줄 수 있으나, 학습 시간이 많이 소요되는 단점을 수반하게 된다. 본 논문에서는 이러한 문제점을 해결하기 위하여 훈련 집합의 선택시 먼저 분류 하고자 하는 지역의 대역별 밝기 분포를 조사하여 일정한 조건을 만족하는 화소들만을 훈련 집합으로 선택하는 알고리즘을 제안하였다. 이 알고리즘을 사용하여 SPOT의 위성 으로부터 얻은 다중 분광 영상에 대해 훈련 집합을 선택하고 역전과 신경망에 의해 학습한 후 분류한 결과, 기존의 사용자에 의해 선택된 훈련 집합보다 수렴속도가 빠르고, 분류 성능이 놓은 결과를 보였다. 또한 밝기 정보의에 NDVI( NormalizelD Vegetation Index)와 텍스쳐 특징을 이용 함으로써 분류 성능이 개선됨을 확인하였다.

  • PDF

변별적 가중치 학습을 이용한 3GPP2 SVM의 실시간 음성/음악 분류 성능 향상 (Enhancement of Speech/Music Classification for 3GPP2 SMV Codec Employing Discriminative Weight Training)

  • 강상익;장준혁;이성로
    • 한국음향학회지
    • /
    • 제27권6호
    • /
    • pp.319-324
    • /
    • 2008
  • 본 논문에서는 변별적 가중치 학습 (discriminative weight training) 기반의 3GPP2 Selectable Mode Vocoder (SMV) 실시간 음성/음악 분류 성능을 향상 시키는 방법을 제안한다. SMV의 음성/음악 실시간 분류 알고리즘에서 사용된 특징벡터와 분류방법을 분석하고, 이를 기반으로 분류성능향상을 위해 MCE (minimum classification error)방법을 도입하여, 각 특징 백터별로 다른 가중치를 적용하는 음성/음악 결정법 (decision rule)을 제시한다. 구체적으로 SMV의 음성/음악 분류알고리즘에서 사용되어진 특징벡터만을 선택적으로 사용하여 가중치를 적용한 값을 기하 평균한 값을 문턱값과 비교하는 실시간 분류기법이 제시되었다. SMV의 음성/음악 분류에 제안한 방법의 성능 평가를 위해 SMV 원래의 분류알고리즘과 비교하였으며, 다양한 음악장르에 대해 시스템의 성능을 평가한 결과 가중치를 적용하였을 때 기존의 SMV의 방법보다 우수한 음성/음악 분류 성능을 보였다.

순위 비교를 기반으로 하는 다양한 유전자 개수로 이루어진 암 분류 결정 규칙의 생성 (Generating Rank-Comparison Decision Rules with Variable Number of Genes for Cancer Classification)

  • 윤영미;변상재;박상현
    • 정보처리학회논문지D
    • /
    • 제15D권6호
    • /
    • pp.767-776
    • /
    • 2008
  • 마이크로어레이 기술은 최근 실험적 분자생물학 분야에서 활발히 사용되고 있는 기술이다. 마이크로어레이 데이터는 한 번의 실험으로 수 만개의 유전자에 대한 발현값을 얻을 수 있으므로, 여러 질병의 발현형질을 연구하는데 매우 유용하게 사용된다. 마이크로어레이 데이터의 문제점은 참여하는 유전자의 수에 비해 참여하는 샘플(생물조직샘플)의 수가 매우 적고, 분류분석 기법을 사용하여 얻어진 분류자의 해석이 어렵다는 점이다. 본 연구에서는 위의 문제점을 해결하고자, 샘플 내 순위를 이용하여 동일한 생물학적 목적으로 수행된 공개 마이크로어레이 데이터를 통합하고, 순위 비교를 기반으로 하는 다양한 유전자 개수로 이루어진 암 분류 결정 규칙들로 이루어진 분류자를 제안한다. 본 분류자는 k개의 규칙으로 이루어진 앙상블 방법을 기반으로 하며, 하나의 규칙은 최대N개의 유전자, 관련유전자간의 순위비교 관계식, 판별클래스로 이루어져 있다. 하나의 규칙에 참여하는 유전자의 수를 다양하게 함으로써 좀더 신뢰성 높은 분류자를 생성할 수 있다. 또한 본 분류자는 생물학적 해석이용이하며, 분류자를 구성하는 유전자를 명확히 식별할 수 있고, 총 개수가 많지 않으므로 임상환경에서의 사용가능성도 생각해 볼 수 있다.

추진축설계(推進軸設計)에 관(關)한 각선급협회규칙(各船級協會規則)의 비교연구(比較硏究) (A Comparative Study of the Rules of Ship Classification Societies on the Propeller Shaft Design.)

  • 김극천;이재욱
    • 대한조선학회지
    • /
    • 제4권1호
    • /
    • pp.59-65
    • /
    • 1967
  • Since the screw propellers were adopted as ship propulsion devices, the replacement of propeller shaft due to damage was mostly of fatigue failure due to the alternative stresses [1],[2]. To prevent such a failure, hence, it is suggested that careful attention should be paid to account of the alternative stresses on the design stage of the propeller shafts. In connection with this fact the Ship Classification Societies' Rules are regarded simply as guidance for preliminary determination of the shaft diameter. In this paper, limiting the topic to the small and medium-sized motor ships, an evaluation of the Rules formulae to a theoretical based on Soderberg's correlation [5] between the factor of safety and the resultant stresses obtained by application of the maximum shear theory is done. For this purpose eleven (11) ships built recently in Korea were taken as a species(refer to table 2. in text). In the end the following conclusions are made: (1) In general the Rules formulae give considerably larger size of the propeller shaft diameter than that derived from theoretical calculation, that is, about 7% more in AB and BV Rules, and about 20% more in LR and KR-NK Rules. (2) LR Rule gives the largest size of all, and AB Rule is mostly closed value to the theoretical. (3) The formular of the AB Rule is considered to be of the simplest in utilization and of the reasonable.

  • PDF

연관규칙 마이닝과 나이브베이즈 분류를 이용한 악성코드 탐지 (Detection of Malicious Code using Association Rule Mining and Naive Bayes classification)

  • 주영지;김병식;신주현
    • 한국멀티미디어학회논문지
    • /
    • 제20권11호
    • /
    • pp.1759-1767
    • /
    • 2017
  • Although Open API has been invigorated by advancements in the software industry, diverse types of malicious code have also increased. Thus, many studies have been carried out to discriminate the behaviors of malicious code based on API data, and to determine whether malicious code is included in a specific executable file. Existing methods detect malicious code by analyzing signature data, which requires a long time to detect mutated malicious code and has a high false detection rate. Accordingly, in this paper, we propose a method that analyzes and detects malicious code using association rule mining and an Naive Bayes classification. The proposed method reduces the false detection rate by mining the rules of malicious and normal code APIs in the PE file and grouping patterns using the DHP(Direct Hashing and Pruning) algorithm, and classifies malicious and normal files using the Naive Bayes.

패턴 분류 문제에 확장된 데이터 표현 기법을 적용한 응용 사례 (Application Examples Applying Extended Data Expression Technique to Classification Problems)

  • 이종찬
    • 한국융합학회논문지
    • /
    • 제9권12호
    • /
    • pp.9-15
    • /
    • 2018
  • 확장된 데이터 표현의 주요 목표는 유비쿼터스 환경에서 일반적인 문제에 적합한 데이터 구조를 개발하는 것이다. 이 방법의 가장 큰 특징은 속성 값을 확률로 표현할 수 있다는 것이다. 다음 특성은 훈련 데이터의 각 이벤트가 중요도를 나타내는 가중치 값을 갖도록 한다는 것이다. 데이터 구조가 개발된 후에 이를 학습할 수 있는 알고리즘이 고안된다. 그 동안 이 알고리즘은 여러 분야에서 여러 문제에 적용하여 좋은 결과를 산출해 왔다. 본 논문은 먼저 데이터 표현 기법인 UChoo를 소개하고 이론적인 배경이 되는 규칙 개선 문제를 소개한다. 그리고 규칙 개선, 손실 데이터 처리, BEWS 문제, 앙상블 시스템과 같은 응용 분야의 예를 소개한다.

Windows NT 기반의 회전 기계 진동 모니터링 시스템 개발 (Development of Rotating Machine Vibration Condition Monitoring System based upon Windows NT)

  • 김창구;홍성호;기석호;기창두
    • 한국정밀공학회지
    • /
    • 제17권7호
    • /
    • pp.98-105
    • /
    • 2000
  • In this study, we developed rotating machine vibration condition monitoring system based upon Windows NT and DSP Board. Developed system includes signal analysis module, trend monitoring and simple diagnosis using threshold value. Trend analysis and report generation are offered with database management tool which was developed in MS-ACCESS environment. Post-processor, based upon Matlab, is developed for vibration signal analysis and fault detection using statistical pattern recognition scheme based upon Bayes discrimination rule and neural networks. Concerning to Bayes discrimination rule, the developed system contains the linear discrimination rule with common covariance matrices and the quadratic discrimination rule under different covariance matrices. Also the system contains k-nearest neighbor method to directly estimate a posterior probability of each class. The result of case studies with the data acquired from Pyung-tak LNG pump and experimental setup show that the system developed in this research is very effective and useful.

  • PDF

Personalized Anti-spam Filter Considering Users' Different Preferences

  • Kim, Jong-Wan
    • 한국멀티미디어학회논문지
    • /
    • 제13권6호
    • /
    • pp.841-848
    • /
    • 2010
  • Conventional filters using email header and body information equally judge whether an incoming email is spam or not. However this is unrealistic in everyday life because each person has different criteria to judge what is spam or not. To resolve this problem, we consider user preference information as well as email category information derived from the email content. In this paper, we have developed a personalized anti-spam system using ontologies constructed from rules derived in a data mining process. The reason why traditional content-based filters are not applicable to the proposed experimental situation is described. In also, several experiments constructing classifiers to decide email category and comparing classification rule learners are performed. Especially, an ID3 decision tree algorithm improved the overall accuracy around 17% compared to a conventional SVM text miner on the decision of email category. Some discussions about the axioms generated from the experimental dataset are given too.

Discriminant Analysis under a Patterned Missing Values

  • Kim, Hea-Jung
    • Journal of the Korean Statistical Society
    • /
    • 제18권1호
    • /
    • pp.13-25
    • /
    • 1989
  • This paper suggests a classification rule with unequal covariance matrices when a patterned incomplete data are involved in the discriminant analysis. This is an extension of Geisser's (1966) result to the case of missing observations. For the calssificaiton rule, we introduce an algorithm which contains data augmentation step and Monte Carlo integration step and show that the algorithm yields a consistant estimator of true classification probability. The proposed method is compared to the complete observation vector method through a Monte Carlo study. The results show that the suggested method, in general, performs better than the complete observation vector method which ignores those vectors of observation with one or more missing values from the analysis. The results also verify the consistency of the algorithm.

  • PDF