• 제목/요약/키워드: k-means clustering algorithm

검색결과 545건 처리시간 0.03초

Improved Algorithm for Fully-automated Neural Spike Sorting based on Projection Pursuit and Gaussian Mixture Model

  • Kim, Kyung-Hwan
    • International Journal of Control, Automation, and Systems
    • /
    • 제4권6호
    • /
    • pp.705-713
    • /
    • 2006
  • For the analysis of multiunit extracellular neural signals as multiple spike trains, neural spike sorting is essential. Existing algorithms for the spike sorting have been unsatisfactory when the signal-to-noise ratio(SNR) is low, especially for implementation of fully-automated systems. We present a novel method that shows satisfactory performance even under low SNR, and compare its performance with a recent method based on principal component analysis(PCA) and fuzzy c-means(FCM) clustering algorithm. Our system consists of a spike detector that shows high performance under low SNR, a feature extractor that utilizes projection pursuit based on negentropy maximization, and an unsupervised classifier based on Gaussian mixture model. It is shown that the proposed feature extractor gives better performance compared to the PCA, and the proposed combination of spike detector, feature extraction, and unsupervised classification yields much better performance than the PCA-FCM, in that the realization of fully-automated unsupervised spike sorting becomes more feasible.

디지털보호계전시스템을 활용한 모터고장진단에 관한 연구 (A Study on the Motor Fault Diagnosis using a Digital Protective Relay System)

  • 이성환;김보연;이동영;장낙원
    • 대한전기학회:학술대회논문집
    • /
    • 대한전기학회 2006년도 추계학술대회 논문집 전기기기 및 에너지변환시스템부문
    • /
    • pp.34-36
    • /
    • 2006
  • In this paper, we will treat the diagnosis problem to accurately determine fault types. The judgement of fault types is accomplished by observing the cluster newly formed with faults and clustering the input current waveforms to intrinsically show the conditions with the dignet that is a clustering algorithm. The types of input current waveforms are, however, constrained during normal operation, though it considers the load character. In case of faults. new clusters are generated outside the clusters. which appear during normal operation, because the input current waveforms of the induction motor are generated by the type which is not observed in case of faults. The diagnosis about the types of faults is essential to building a fault tree about the induction motor, and it removes the causes of the faults using a fuzzy logic. We, first, constitute a fault tree, which connects with the parts and the entire system of the induction motor, and investigate fault modes which can be generated from the fault tree and the relationship of the cause and the effect of each part (of the motor). Also, we distinguish the faults of each part by means of inducing the said of fuzzy relation equations encapsulating the relationship of the fault modes and each part.

  • PDF

단어 군집 기반 모바일 애플리케이션 범주화 (Word Cluster-based Mobile Application Categorization)

  • 허정만;박소영
    • 한국컴퓨터정보학회논문지
    • /
    • 제19권3호
    • /
    • pp.17-24
    • /
    • 2014
  • 본 논문에서는 단어 군집 정보를 활용하여 모바일 애플리케이션의 범주를 분류하는 방법을 제안한다. 제안하는 방법은 모바일 애플리케이션 설명이 짧을 수 있다는 점을 고려하여, 모바일 애플리케이션 설명에 포함된 단어 정보 뿐만 아니라 각 단어의 단어 군집 대표 정보를 범주화 자질로 활용한다. 그리고, 모바일 애플리케이션의 카테고리가 세분화되어 있으므로, 제안하는 방법은 범주별 단어 발생 빈도를 K 평균 군집화 알고리즘에 적용하여 단어 군집을 생성한다. 모바일 애플리케이션 설명이 설치사양과 같이 범주와 관련없는 내용이 있을 수 있다는 점을 반영하여, 제안하는 방법은 단어 군집 중에서 범주화에 유용한 일부 단어 군집만을 선별하여 활용한다. 실험결과 제안하는 방법은 단어 군집 정보를 활용하여 모바일 애플리케이션 범주화 재현율을 5.65% 개선시켰다.

기계학습 알고리즘을 사용한 스포츠 경기장 방문객 마케팅 적용 방안 (A Study on Application of Machine Learning Algorithms to Visitor Marketing in Sports Stadium)

  • 박소현;임선영;박영호
    • 디지털콘텐츠학회 논문지
    • /
    • 제19권1호
    • /
    • pp.27-33
    • /
    • 2018
  • 본 연구에서는 마케팅 분야 중 스포츠 경기장을 찾는 관람객의 빅 데이터를 분석하여 소비자에게 맞춤형 마케팅 서비스를 제공하는 연구를 진행한다. 이를 위해 본 연구에서는 K-평균 군집화 방법을 사용하여 유사 관람객 그룹을 도출하고자 하며, K-근접 이웃 방법을 사용하여 새로운 방문객의 관심 매장을 예측하고자 한다. 실험 결과를 통해 상기 두 가지 알고리즘을 사용하는 것은 유사 관람객 그룹을 도출하며 신규 관람객 입장 시 신규 관람객의 특성에 맞는 적합한 마케팅 서비스를 제공 할 수 있게 하였다.

Multi-FNN Identification Based on HCM Clustering and Evolutionary Fuzzy Granulation

  • Park, Ho-Sung;Oh, Sung-Kwun
    • International Journal of Control, Automation, and Systems
    • /
    • 제1권2호
    • /
    • pp.194-202
    • /
    • 2003
  • In this paper, we introduce a category of Multi-FNN (Fuzzy-Neural Networks) models, analyze the underlying architectures and propose a comprehensive identification framework. The proposed Multi-FNNs dwell on a concept of fuzzy rule-based FNNs based on HCM clustering and evolutionary fuzzy granulation, and exploit linear inference being treated as a generic inference mechanism. By this nature, this FNN model is geared toward capturing relationships between information granules known as fuzzy sets. The form of the information granules themselves (in particular their distribution and a type of membership function) becomes an important design feature of the FNN model contributing to its structural as well as parametric optimization. The identification environment uses clustering techniques (Hard C - Means, HCM) and exploits genetic optimization as a vehicle of global optimization. The global optimization is augmented by more refined gradient-based learning mechanisms such as standard back-propagation. The HCM algorithm, whose role is to carry out preprocessing of the process data for system modeling, is utilized to determine the structure of Multi-FNNs. The detailed parameters of the Multi-FNN (such as apexes of membership functions, learning rates and momentum coefficients) are adjusted using genetic algorithms. An aggregate performance index with a weighting factor is proposed in order to achieve a sound balance between approximation and generalization (predictive) abilities of the model. To evaluate the performance of the proposed model, two numeric data sets are experimented with. One is the numerical data coming from a description of a certain nonlinear function and the other is NOx emission process data from a gas turbine power plant.

카드소팅을 활용한 디지털 신기술 과정 핵심역량 군집화에 관한 연구 (A Study on Clustering of Core Competencies to Deploy in and Develop Courseworks for New Digital Technology)

  • 이지운;이호;권정흠
    • 실천공학교육논문지
    • /
    • 제14권3호
    • /
    • pp.565-572
    • /
    • 2022
  • 카드소팅(Card sorting)은 항목 간의 관계에 대한 사용자의 인식을 이해하는 데 유용한 데이터 수집 방법으로서, 일반적으로 카드소팅은 사용자 조사 및 평가에 매우 유용한 직관적이고 비용 효율적인 기술이다. 본 연구에서는 각 분야 직업별 핵심역량들은 코스 개발을 위하여 다음 단계인 카드소팅 단계에서 활용되는 역량카드로 사용하고, 결과를 군집화 하기 위해 K-평균 알고리즘을 적용하여 군집화 결과를 도출하였다. 카드소팅 결과 각 분야 직업별 핵심역량들에 대한 역량 군집화는 Participant-Centric Analysis (PCA)를 바탕으로 검증하였고, 이를 바탕으로 역량에 따른 직업별 코스 및 역량 분류 결과와 클러스터링에 의한 카드 유사성 정도는 각 직업별 핵심 역량 카드수에 대해 소팅 참여자 수 대비 군집화에 적합하게 동의한 참여자의 수와 카드 유사성 정도를 도출하였다.

가속도센서와 각속도센서를 이용한 특정 비정상보행에 관한 연구 (A Study on Particular Abnormal Gait Using Accelerometer and Gyro Sensor)

  • 허근섭;양승한;이상룡;이종규;이춘영
    • 한국정밀공학회지
    • /
    • 제29권11호
    • /
    • pp.1199-1206
    • /
    • 2012
  • Recently, technologies to help the elderly or disabled people who have difficulty in walking are being developed. In order to develop these technologies, it is necessary to construct a system that gathers the gait data of people and analysis of these data is also important. In this research, we constructed the development of sensor system which consists of pressure sensor, three-axis accelerometer and two-axis gyro sensor. We used k-means clustering algorithm to classify the data for characterization, and then calculated the symmetry index with histogram which was produced from each cluster. We collected gait data from sensors attached on two subjects. The experiment was conducted for two kinds of gait status. One is walking with normal gait; the other is walking with abnormal gait (abnormal gait means that the subject walks by dragging the right leg intentionally). With the result from the analysis of acceleration component, we were able to confirm that the analysis technique of this data could be used to determine gait symmetry. In addition, by adding gyro components in the analysis, we could find that the symmetry index was appropriate to express symmetry better.

주성분 분석법과 선형판별 분석법을 이용한 최적화된 방사형 기저 함수 신경회로망 분류기의 설계 (Design of Optimized Radial Basis Function Neural Networks Classifier with the Aid of Principal Component Analysis and Linear Discriminant Analysis)

  • 김욱동;오성권
    • 한국지능시스템학회논문지
    • /
    • 제22권6호
    • /
    • pp.735-740
    • /
    • 2012
  • 본 연구에서는 주성분 분석법 및 선형 판별 분석법을 이용한 다항식 방사형 기저 함수 신경회로망 분류기의 설계 방법론을 소개한다. 주성분 분석법과 선형판별 분석법을 사용하여 주어진 데이터의 정보 손실을 최소화한 특징데이터를 생성하고 이를 다항식 방사형 기저함수 신경회로망의 입력데이터로 사용한다. 방사형 기저 함수 신경회로망의 은닉층은 FCM 클러스터링 알고리즘으로 구성되며 연결가중치는 1차 선형식을 사용하였다. 최적의 분류기 설계를 위해서 최근에 제안된 Artificial Bee Colony(ABC) 최적화 알고리즘을 사용하여 구조 및 파라미터를 동조하였다. ABC 알고리즘을 통해 주성분 분석법과 선형판별 분석법의 고유벡터의 수 및 FCM 클러스터링 알고리즘의 퍼지화 계수등의 파라미터를 동조한다. 제안된 분류기는 대표적인 Machine Learning(ML) 데이터를 사용하여 성능을 평가하며 기존 분류기와 성능을 비교한다.

신병 주특기교육 성취집단 예측모형 개발 (Development of newly recruited privates on-the-job Training Achievements Group Classification Model)

  • 곽기효;서용무
    • 한국국방경영분석학회지
    • /
    • 제33권2호
    • /
    • pp.101-113
    • /
    • 2007
  • 국방부에서 발표한 '국방개혁에 관한 법률'에 따라 2014년까지 현역병들에 대한 복무기간이 단계적으로 단축될 예정이다. 이에 따라 육군에서는 좀 더 효율적인 직무교육 방안의 일환으로 훈련병들에게 '차등제 교육'을 시행하고 있다. 이러한 차등제 교육의 효과를 향상시키기 위해서는 훈련병들의 예상 학업 성취도를 미리 예측하여 성취집단별로 차별화 된 교육과정을 거치게 하는 것이 매우 중요하다. 따라서 본 연구에서는 입교초기에 얻을 수 있는 신병들의 제한된 자료들만을 이용하여 그들의 예상 교육 성취집단을 예측하는 모형을 개발하였다. 본 모형의 목적 변수는 '성취집단'이며 '일반관리 인원' 및 '집중관리 인원'의 두 가지 값을 갖는다. 사용된 기법은 인공신경망(Neural Network) 모형, 의사결정나무(Decision Tree) 모형, SVM 모형, 그리고 Naive Bayesian모형 등 4가지 순수 모형과, 각각의 순수 모형을 k-means군집기법과 혼합한 4가지의 혼합모형 등 총 8개의 모형의 성능을 비교 분석하였다. 실험 결과 k-means군집기법과 인공신경망 기법을 혼합한 모형이 가장 좋은 예측력을 보이는 것으로 나타났다. 이러한 교육 성취집단 예측 모형은 향후 군에서 이루어지는 다양한 교육 프로그램에 효과적으로 이용될 수 있을 것으로 기대된다.

생물학적 후각 시스템을 모방한 대규모 가스 센서 어레이에서 코사인 유사도와 퍼지 클러스터링을 이용한 중복도 제거 방법 (The Redundancy Reduction Using Fuzzy C-means Clustering and Cosine Similarity on a Very Large Gas Sensor Array for Mimicking Biological Olfaction)

  • 김정도;김정주;박성대;변형기;;임승주
    • 센서학회지
    • /
    • 제21권1호
    • /
    • pp.59-67
    • /
    • 2012
  • It was reported that the latest sensor technology allow an 65536 conductive polymer sensor array to be made with broad but overlapping selectivity to different families of chemicals emulating the characteristics found in biological olfaction. However, the supernumerary redundancy always accompanies great error and risk as well as an inordinate amount of computation time and local minima in signal processing, e.g. neural networks. In this paper, we propose a new method to reduce the number of sensor for analysis by reducing redundancy between sensors and by removing unstable sensors using the cosine similarity method and to decide on representative sensor using FCM(Fuzzy C-Means) algorithm. The representative sensors can be just used in analyzing. And, we introduce DWT(Discrete Wavelet Transform) for data compression in the time domain as preprocessing. Throughout experimental trials, we have done a comparative analysis between gas sensor data with and without reduced redundancy. The possibility and superiority of the proposed methods are confirmed through experiments.