• 제목/요약/키워드: Support Vector Model

검색결과 867건 처리시간 0.028초

서포트 벡터 머신을 이용한 NCAM-LAMP 고해상도 중기예측시스템 지점 시계열 자료의 통계적 보정 (A Statistical Correction of Point Time Series Data of the NCAM-LAMP Medium-range Prediction System Using Support Vector Machine)

  • 권수영;이승재;김만일
    • 한국농림기상학회지
    • /
    • 제23권4호
    • /
    • pp.415-423
    • /
    • 2021
  • NCAM-LAMP 중기예측 자료의 통계적 후처리와 개선을 위하여 R 기반의 지점 시계열 자료 검증 체계를 구축하였다. 이 시계열 검증체계를 이용하여 기상청 AWS 관측 자료와 NCAM-LAMP, KMA GDAPS 중기예측 모델 자료를 비교하였다. 이를 위해 관측 지점에 가장 근접한 모델 위도 및 경도 자료를 추출하여 총 9개 지점을 선정하였다. 각 지점에 대해 NCAM-LAMP, GDAPS 모델의 기온, 강수량, 풍속 일평균 예측 자료를 관측과 비교한 결과, 모델들은 풍속의 과대예측 경향을 뚜렷이 보였으며, 기온과 강수의 경우에는 두 모델의 예측력이 월별 및 변수별로 다르게 나타났다. 이를 바탕으로 본 연구에서는 통계적 기법을 개발하여 NCAM-LAMP가 가지고 있는 오차를 줄이고자 하였다. 모델 오차를 줄이기 위해 일반적으로 쓰이는 MOS(Model Output Statistics)기법 중에 인공지능 SVM(Support vector machine) 방식을 8~10월 기간에 적용한 결과, 8월에 비해서 10월이, 기온 변수에 비해서 바람과 강수 변수가 개선된 효과를 보여주었다. 이러한 결과는 풍속의 과대예측을 줄이고, 농림 가뭄지수와 산사태 예측 등을 개선시키며, 지역 수치예보 모델이 시간 적분됨에 따라 영역 내 예측가능성이 점점 저하되는 현상을 완화시키는데 SVM 방법이 일정 부분 기여할 수 있음을 가리키며, 현업 표출 중인 NCAM Agro-Meteogram 개선에도 도움을 줄 것으로 기대된다.

데이터마이닝을 이용한 박스오피스 예측 (Prediction of box office using data mining)

  • 전성현;손영숙
    • 응용통계연구
    • /
    • 제29권7호
    • /
    • pp.1257-1270
    • /
    • 2016
  • 본 연구는 영화 흥행의 척도로서 총 관객수의 예측을 다루었다. 의사결정나무, MLP 신경망모형, 다항로짓모형, support vector machine과 같은 데이터마이닝 분류 기법들을 사용하여 개봉 전, 개봉 일, 개봉 1주 후, 그리고 개봉 2주 후 시점 별로 예측이 이루어진다. 국적, 등급, 개봉 월, 개봉 계절, 감독, 배우, 배급사, 관객수, 그리고 스크린 수와 같은 영화의 내재적인 속성을 나타내는 변수 뿐만 아니라 포털의 평점과 평가자 수, 블로그 수, 뉴스 수와 같은 온라인 구전 변수들이 예측변수로 사용되었다. 10-중 교차 검증에서 신경망모형의 정확도는 개봉 전 시점에서도 90% 이상의 높은 예측력을 보였다. 또한 최종 온라인 구전 변수의 추정치를 예측변수로 추가함으로서 예측의 정확도가 더 높아짐을 볼 수 있다.

A New Support Vector Machine Model Based on Improved Imperialist Competitive Algorithm for Fault Diagnosis of Oil-immersed Transformers

  • Zhang, Yiyi;Wei, Hua;Liao, Ruijin;Wang, Youyuan;Yang, Lijun;Yan, Chunyu
    • Journal of Electrical Engineering and Technology
    • /
    • 제12권2호
    • /
    • pp.830-839
    • /
    • 2017
  • Support vector machine (SVM) is introduced as an effective fault diagnosis technique based on dissolved gases analysis (DGA) for oil-immersed transformers with maximum generalization ability; however, the applicability of the SVM is highly affected due to the difficulty of selecting the SVM parameters appropriately. Therefore, a novel approach combing SVM with improved imperialist competitive algorithm (IICA) for fault diagnosis of oil-immersed transformers was proposed in the paper. The improved ICA, which is proved to be an effective optimization approach, is employed to optimize the parameters of SVM. Cross validation and normalizations were applied in the training processes of SVM and the trained SVM model with the optimized parameters was established for fault diagnosis of oil-immersed transformers. Three classification benchmark sets were studied based on particle swarm optimization SVM (PSOSVM) and IICASVM with four multiple classification schemes to select the best scheme for transformer fault diagnosis. The results show that the proposed model can obtain higher diagnosis accuracy than other methods. The comparisons confirm that the proposed model is an effective approach for classification problems.

교차검증과 SVM을 이용한 도시침수 위험기준 추정 알고리즘 적용성 검토 (Applicability study on urban flooding risk criteria estimation algorithm using cross-validation and SVM)

  • 이한승;조재웅;강호선;황정근
    • 한국수자원학회논문집
    • /
    • 제52권12호
    • /
    • pp.963-973
    • /
    • 2019
  • 본 연구는 도시침수 위험기준이 산정되지 않은 지역의 예·경보 기준을 예측하기 위해 유역특성 자료와 피해이력 기반으로 산정된 한계강우량을 활용하여 도시침수 위험기준을 추정하는 모델을 검토하였다. 위험기준 추정모델은 머신러닝 알고리즘의 하나인 Support Vector Machine을 이용하여 설계하였으며, 학습자료는 지역별 한계강우량과 유역특성으로 구성하였다. 학습자료는 정규화 한 후 SVM 알고리즘에 적용하였으며, SVM에 적용시 Leave-One-Out과 K-fold 교차검증 알고리즘을 이용하여 절대평균오차와 표준편차를 계산한 후 모델의 성능을 평가하였다. Leave-One-Out의 경우 표준편차가 작은 모델이 최적모델로 선정되었으며, K-fold의 경우 fold의 개수가 적은 모델이 선정되었다. 선정된 모델의 지속시간별 평균 정확도는 80% 이상으로 나타나 침수 위험기준 추정을 위해 SVM을 활용가능 할 것으로 판단된다.

도시가스 배관압력 예측모델 (City Gas Pipeline Pressure Prediction Model)

  • 정원희;박길주;구영현;김성현;유성준;조영도
    • 한국전자거래학회지
    • /
    • 제23권2호
    • /
    • pp.33-47
    • /
    • 2018
  • 도시가스 배관은 지중에 매설되어 있기 때문에 세부 관리가 어렵고 다양한 위험에 노출되어 있다. 본 연구에서는 도시가스 배관압력 실시간 데이터를 분석해 배관압력 이상을 예측하고 전문가의 의사결정을 돕는 모델을 제안한다. 국내 도시가스 공급업체들 중 하나인 중부도시가스사의 정압기에서 수집하는 실시간 배관압력 데이터와 시간변수, 외부환경변수를 통합해 분석 데이터로 사용한다. 아산시와 천안시에 위치하는 11개 정압기를 분석 대상으로 하며 분 단위 배관압력 예측모델을 구현한다. Random forest, support vector regression(SVR), long-short term memory(LSTM) 알고리즘을 사용해 회귀모델을 구현한 결과 LSTM 모델에서 우수한 성능을 보인다. 아산시 배관압력 예측모델의 경우 LSTM 모델에서 RMSE가 0.011, MAPE가 0.494이며, 천안시 배관압력 예측모델의 경우 LSTM 모델에서 평균제곱근오차(root mean square error, RMSE)가 0.015, 절대평균백분율오차(mean absolute percentage error, MAPE)가 0.668로 가장 낮은 오류율을 보인다.

태양광 에너지 예측을 위한 SVM 및 ANN 모델의 성능 비교 (Performance comparison of SVM and ANN models for solar energy prediction)

  • 정원석;정영화;박문규;이창교;서정욱
    • 한국정보통신학회:학술대회논문집
    • /
    • 한국정보통신학회 2018년도 추계학술대회
    • /
    • pp.626-628
    • /
    • 2018
  • 본 논문에서 기상 데이터를 사용하여 태양광 에너지를 예측하기 위해 기계학습 모델인 SVM(Support Vector Machine)과 ANN(Artificial Neural Network)의 성능을 비교한다. 장 단파 복사선 평균, 강수량, 온도 등 15가지 종류의 기상 데이터를 사용하여 두 모델을 생성하고, 실험을 통해 최적의 SVM의 RBF(Radial Basis Function) 파라미터와 ANN의 은닉층과 노드 개수, 정규화 파라미터를 도출하였다. SVM과 ANN 모델의 성능을 비교하기 위한 지표로서 MAPE(Mean Absolute Percentage Error)와 MAE(Mean Absolute Error)를 사용하였다. 실험 결과 SVM 모델은 MAPE=21.11, MAE=2281417.65의 성능을 달성하였고 ANN은 MAPE=19.54, MAE=2155345.10776의 성능을 달성하였다.

  • PDF

음양오행설 상생상극론(相生相剋論)의 벡터 해석(解析) (Vector Analysis of the Xiangsheng Xiangke(相生相剋) of the Yinyang Wuxing(陰陽五行) Theory)

  • 허재수
    • 대한한의학원전학회지
    • /
    • 제37권1호
    • /
    • pp.41-56
    • /
    • 2024
  • Objectives : The purpose of this paper is to model each Xíng(行) of the Yīnyáng Wǔxíng(陰陽五行) theory as a vector, to interpret the Xiāngshēng Xiāngkè(相生相剋) theory as a vector sum, and argue the objectivity and universal applicability of the Xiāngshēng Xiāngkè(相生相剋) theory. Methods : The five xíngs of the Wǔxíng were modeled and expressed as vectors, and the Xiāngshēng Xiāngkè theories were quantitatively explained by vector summation. Results : We calculated the Wǔxíng vectors using the vector sum formula, and found that the Xíng vectors that received mutual support increased in size by about 62%, and the Xíng vectors that received opposition decreased in size by about 38%. Conclusions : This result could be considered as quantitative interpretation of the contents of the Xiāngshēng Xiāngkè(相生相剋) theory which has mostly been explained qualitatively. The results of this study could hopefully provide ideas to quantify various theories based on the Yinyangwuxing theory such as Korean Medicine and other traditional fields in East Asian culture.

Statistical Speech Feature Selection for Emotion Recognition

  • Kwon Oh-Wook;Chan Kwokleung;Lee Te-Won
    • The Journal of the Acoustical Society of Korea
    • /
    • 제24권4E호
    • /
    • pp.144-151
    • /
    • 2005
  • We evaluate the performance of emotion recognition via speech signals when a plain speaker talks to an entertainment robot. For each frame of a speech utterance, we extract the frame-based features: pitch, energy, formant, band energies, mel frequency cepstral coefficients (MFCCs), and velocity/acceleration of pitch and MFCCs. For discriminative classifiers, a fixed-length utterance-based feature vector is computed from the statistics of the frame-based features. Using a speaker-independent database, we evaluate the performance of two promising classifiers: support vector machine (SVM) and hidden Markov model (HMM). For angry/bored/happy/neutral/sad emotion classification, the SVM and HMM classifiers yield $42.3\%\;and\;40.8\%$ accuracy, respectively. We show that the accuracy is significant compared to the performance by foreign human listeners.

문서 분류 알고리즘을 이용한 한국어 스팸 문서 분류 성능 비교 (Comparing Korean Spam Document Classification Using Document Classification Algorithms)

  • 송철환;유성준
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2006년도 가을 학술발표논문집 Vol.33 No.2 (C)
    • /
    • pp.222-225
    • /
    • 2006
  • 한국은 다른 나라에 비해 많은 인터넷 사용자를 가지고 있다. 이에 비례해서 한국의 인터넷 유저들은 Spam Mail에 대해 많은 불편함을 호소하고 있다. 이러한 문제를 해결하기 위해 본 논문은 다양한 Feature Weighting, Feature Selection 그리고 문서 분류 알고리즘들을 이용한 한국어 스팸 문서 Filtering연구에 대해 기술한다. 그리고 한국어 문서(Spam/Non-Spam 문서)로부터 영사를 추출하고 이를 각 분류 알고리즘의 Input Feature로써 이용한다. 그리고 우리는 Feature weighting 에 대해 기존의 전통적인 방법이 아니라 각 Feature에 대해 Variance 값을 구하고 Global Feature를 선택하기 위해 Max Value Selection 방법에 적용 후에 전통적인 Feature Selection 방법인 MI, IG, CHI 들을 적용하여 Feature들을 추출한다. 이렇게 추출된 Feature들을 Naive Bayes, Support Vector Machine과 같은 분류 알고리즘에 적용한다. Vector Space Model의 경우에는 전통적인 방법 그대로 사용한다. 그 결과 우리는 Support Vector Machine Classifier, TF-IDF Variance Weighting(Combined Max Value Selection), CHI Feature Selection 방법을 사용할 경우 Recall(99.4%), Precision(97.4%), F-Measure(98.39%)의 성능을 보였다.

  • PDF

Correlation Analysis of Airline Customer Satisfaction using Random Forest with Deep Neural Network and Support Vector Machine Model

  • Hong, Sang Hoon;Kim, Bumsu;Jung, Yong Gyu
    • International Journal of Internet, Broadcasting and Communication
    • /
    • 제12권4호
    • /
    • pp.26-32
    • /
    • 2020
  • There are many airline customer evaluation data, but they are insufficient in terms of predicting customer satisfaction in practice. In particular, they are generally insufficient in case of verification of data value and development of a customer satisfaction prediction model based on customer evaluation data. In this paper, airline customer satisfaction analysis is conducted through an experiment of correlation analysis between customer evaluation data provided by Google's Kaggle. The difference in accuracy varied according to the three types, which are the overall variables, the top 4 and top 8 variables with the highest correlation. To build an airline customer satisfaction prediction model, they are applied to three classification algorithms of Random Forest, SVM, DNN and conduct a classification experiment. They are divided into training data and verification data by 7:3. As a result, the DNN model showed the lowest accuracy at 86.4%, while the SVM model at 89% and the Random Forest model at 95.7% showed the highest accuracy and performance.