• 제목/요약/키워드: MCMC algorithm

검색결과 53건 처리시간 0.023초

선형판별분석에서 MCMC다중대체법의 효율에 관한 연구 (A Study on the efficiency of the MCMC multiple imputation In LDA)

  • 유희경;김명철
    • 대한안전경영과학회지
    • /
    • 제11권3호
    • /
    • pp.189-198
    • /
    • 2009
  • This thesis studies two imputation methods, the MCMC method and the EM algorithm, that take care of the problem. The performance of the two methods for the linear (or quadratic) discriminant analysis are evaluated under various types of incomplete observations. Based on simulated experiments, the effect of the imputation using the EM algorithm and the MCMC method are evaluated and compared in terms of the probability of misclassification and the RMSE. This is done for the various cases of incomplete observations. The cases are differentiated by missing rates, sample sizes, and distances between two classification groups. The studies show that the probability of misclassification and the RMSE of the EM algorithm method is lower than the MCMC method. Therefore the imputation using the EM algorithm is more efficient than the MCMC method. And the probability of misclassification of the method that all vectors of observations with missing values are omitted from analysis is lower than the EM algorithm and the MCMC method when the samples size is small and the rate of missing values is extremely big.

Horseshoe 사전분포에 대한 MCMC 알고리듬 비교 연구 (Comparing MCMC algorithms for the horseshoe prior)

  • 마미루;강민기;이경재
    • 응용통계연구
    • /
    • 제37권1호
    • /
    • pp.103-118
    • /
    • 2024
  • Horseshoe 사전분포는 희박 회귀 분석에서 가장 자주 사용되는 사전분포 중 하나이다. Horseshoe 사전분포는 탐험해야 할 모수공간이 spike and slab 사전분포보다 작다는 장점이 있으나 MCMC 단계 당 시간이 오래 걸린다는 단점이 있다. 이로 인해 horseshoe 사전분포를 고차원 데이터 분석으로 확장하는 것은 한계가 존재한다. 이러한 한계를 극복하기 위해 horseshoe 사전분포에 대한 MCMC 알고리듬들이 많이 제안되었으며, 특히 최근 Johndrow 등 (2020)은 빠른 계산을 위한 근사 알고리듬을 제안하였다. 본 논문에서는 horseshoe 사전분포에 대한 (1) 전통적인 MCMC 알고리듬, (2) 근사 알고리듬 그리고 (3) 근사 알고리듬의 변형 알고리듬의 성능을 다양한 모의실험을 통해 비교하려 한다. 성능은 계산 시간, 회귀계수 추정 및 변수선택을 중심으로 비교한다. 이때 변수선택을 위해 Li와 Pati (2017)에서 제안한 horseshoe 사전분포 기반 변수선택법을 고려한다.

Bayesian MCMC 및 Metropolis Hastings 알고리즘을 이용한 강우빈도분석에서 확률분포의 매개변수에 대한 불확실성 해석 (Uncertainty Analysis for Parameters of Probability Distribution in Rainfall Frequency Analysis by Bayesian MCMC and Metropolis Hastings Algorithm)

  • 서영민;박기범
    • 한국환경과학회지
    • /
    • 제20권3호
    • /
    • pp.329-340
    • /
    • 2011
  • The probability concepts mainly used for rainfall or flood frequency analysis in water resources planning are the frequentist viewpoint that defines the probability as the limit of relative frequency, and the unknown parameters in probability model are considered as fixed constant numbers. Thus the probability is objective and the parameters have fixed values so that it is very difficult to specify probabilistically the uncertianty of these parameters. This study constructs the uncertainty evaluation model using Bayesian MCMC and Metropolis -Hastings algorithm for the uncertainty quantification of parameters of probability distribution in rainfall frequency analysis, and then from the application of Bayesian MCMC and Metropolis- Hastings algorithm, the statistical properties and uncertainty intervals of parameters of probability distribution can be quantified in the estimation of probability rainfall so that the basis for the framework configuration can be provided that can specify the uncertainty and risk in flood risk assessment and decision-making process.

멀티콥터의 효율적 멀티미디어 전송을 위한 이미지 복원 기법의 성능 (Performance of Image Reconstruction Techniques for Efficient Multimedia Transmission of Multi-Copter)

  • 황유민;이선의;이상운;김진영
    • 한국위성정보통신학회논문지
    • /
    • 제9권4호
    • /
    • pp.104-110
    • /
    • 2014
  • 본 논문에서는 무인항공기인 방송용 멀티콥터를 이용한 Full-HD급 이상 화질의 이미지를 효율적으로 전송하기 위해 이미지 압축 센싱 기법을 적용하고, Sparse 신호의 효율적 복원을 위해 Turbo 알고리즘과 Markov chain Monte Carlo (MCMC) 알고리즘의 복원 성능을 모의실험을 통해 비교 분석하였다. 제안된 복원 기법은 압축 센싱에 기반하여 데이터 용량을 줄이고 빠르고 오류 없는 원신호 복원에 중점을 두었다. 다수의 이미지 파일로 모의실험을 진행한 결과 Loopy belief propagation(BP) 기반의 Turbo 복원 알고리즘이 Gibbs sampling기반 알고리즘을 수행하는 MCMC 알고리즘 보다 평균 복원 연산 시간, NMSE 값에서 우수하여 보다 효율적인 복원 방법으로 생각된다.

Bayesian MCMC를 이용한 저수량 점 빈도분석: I. 이론적 배경과 사전분포의 구축 (At-site Low Flow Frequency Analysis Using Bayesian MCMC: I. Theoretical Background and Construction of Prior Distribution)

  • 김상욱;이길성
    • 한국수자원학회논문집
    • /
    • 제41권1호
    • /
    • pp.35-47
    • /
    • 2008
  • 저수분석(low flow analysis)은 수자원공학에서 중요한 분야 중 하나이며, 특히 저수량 빈도분석(low flow frequency analysis)의 결과는 저수(貯水)용량의 설계, 물 수급계획, 오염원의 배치 및 관개와 생태계의 보존을 위한 수량과 수질의 관리에 중요하게 사용된다. 그러므로 본 연구에서는 저수량 빈도분석을 위한 점 빈도분석을 수행하였으며, 특히 빈도분석에 있어서의 불확실성을 탐색하기 위하여 Bayesian 방법을 적용하고 그 결과를 기존에 사용되던 불확실성 탐색방법과 비교하였다. 본 논문의Ⅰ편에서는 Bayesian 방법 중 사전분포(prior distribution)와 우도함수(likelihood function)의 복잡성에 상관없이 계산이 가능한 Bayesian MCMC(Bayesian Markov Chain Monte Carlo) 방법과 Metropolis-Hastings 알고리즘을 사용하기 위한 여러 과정의 이론적 배경과 Bayesian 방법에서 가장 중요한 요소인 사전분포를 구축하고 이를 비교 및 평가하였다. 고려된 사전분포는 자료에 기반하지 않은 사전분포와 자료에 기반한 사전분포로써 두 사전분포를 이용하여 Metropolis-Hastings 알고리즘을 수행하고 그 결과를 비교하여 저수량 빈도분석에 합리적인 사전분포를 선정하였다. 또한 알고리즘의 수행과정에서 필요한 제안분포(proposal distribution)를 적용하여 그에 따른 알고리즘의 효율성을 채택률(acceptance rate)을 산정하여 검증해 보았다. 사전분포의 분석 결과, 자료에 기반한 사전분포가 자료에 기반하지 않은 사전분포보다 정확성 및 불확실성의 표현에 있어서 우수한 결과를 제시하는 것을 확인할 수 있었고, 채택률을 이용한 알고리즘의 효용성 역시 기존 연구자들이 제시하였던 만족스러운 범위를 가지는 것을 알 수 있었다. 최종적으로 선정된 사전분포는 본 연구의 II편에서 Bayesian MCMC방법의 사전분포로 이용되었으며, 그 결과를 기존 불확실성의 추정방법의 하나인 2차 근사식을 이용한 최우추정(maximum likelihood estimation)방법의 결과와 비교하였다.

그리드 단체 위의 디리슐레 분포에서 마르코프 연쇄 몬테 칼로 표집 (MCMC Algorithm for Dirichlet Distribution over Gridded Simplex)

  • 신봉기
    • 정보과학회 컴퓨팅의 실제 논문지
    • /
    • 제21권1호
    • /
    • pp.94-99
    • /
    • 2015
  • 비모수 베이스 통계학, 확률적 표집에 기반한 추론 등이 기계학습의 주요 패러다임으로 등장하면서 디리슐레(Dirichlet) 분포는 최근 다양한 그래프 모형 곳곳에 등장하고 있다. 디리슐레 분포는 일변수 감마 분포를 벡터 분포로 확장한 형태의 하나이다. 본 논문에서는 감마 분포를 갖는 임의의 자연수 X를 K개의 자연수의 합으로 임의 분할 할 때 각 부분의 크기 비율을 디리슐레 분포에서 표집하는 방법을 제안한다. 일반적으로 디리슐레 분포는 연속적인 (K-1)-단체(simplex) 위에 정의 되지만 자연수로 분할하는 표본은 자연수라는 조건 때문에 단체 내부의 이산 그리드 점에만 정의된다. 본 논문에서는 단체 위의 그리드 상의 이웃 점들의 확률 분포로부터 마르코프연쇄 몬테 칼로(MCMC) 제안 분포를 정의하고 일련의 표본들의 마르코프 연쇄를 구현하는 알고리듬을 제안한다. 본 방법은 마르코프 모델, HMM 및 준-HMM 등에서 각 상태별 시간 지속 분포를 표현하는데 활용 가능하다. 나아가 최근 제안된 전역-지역(global-local) 상태지속 분포를 동시에 모형화하는 감마-디리슐레 HMM에도 응용가능하다.

강우빈도분석에서 확률분포의 매개변수에 대한 불확실성 해석: Bayesian MCMC 및 Metropolis-Hastings 알고리즘을 중심으로 (Uncertainty Analysis for Parameters of Probability Distribution in Rainfall Frequency Analysis: Bayesian MCMC and Metropolis-Hastings Algorithm)

  • 서영민;지홍기;이순탁
    • 한국수자원학회:학술대회논문집
    • /
    • 한국수자원학회 2010년도 학술발표회
    • /
    • pp.1385-1389
    • /
    • 2010
  • 수자원 계획에 있어서 강우 또는 홍수빈도분석시 주로 사용되는 확률의 개념은 상대빈도에 대한 극한으로 확률을 정의하는 빈도학파적 확률관점에 속하며, 확률모델에서 미지의 매개변수들은 고정된 상수로 간주된다. 따라서 확률은 객관적이고 매개변수들은 고정된 값을 가지기 때문에 이러한 매개변수들에 대한 확률론적 설명은 매우 어렵다. 본 연구에서는 강우빈도해석에서 확률분포의 매개변수에 대한 불확실성을 정량화하기 위하여 베이지안 MCMC 및 Metropolis-Hastings 알고리즘을 이용한 불확실성 평가모델을 구축하였다. 그리고 베이지안 MCMC 및 Metropolis-Hastings 알고리즘의 적용을 통하여 확률강우량 산정시 확률분포의 매개변수에 대한 통계학적 특성 및 불확실성 구간을 정량화하였으며, 이를 바탕으로 홍수위험평가 및 의사결정과정에서 불확실성 및 위험도를 충분히 설명할 수 있는 프레임워크 구성을 위한 기초를 마련할 수 있었다.

  • PDF

베이지안 통계 추론 (On the Bayesian Statistical Inference)

  • 이호석
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2007년도 한국컴퓨터종합학술대회논문집 Vol.34 No.1 (C)
    • /
    • pp.263-266
    • /
    • 2007
  • 본 논문은 베이지안 통계 추론에 대하여 논의한다. 논문은 베이지안 추론, Markov Chain과 Monte Carlo 적분, MCMC(Markov Chain Monte Carlo) 기법, Metropolis-Hastings 알고리즘, Gibbs 샘플링, Maximum Likelihood Estimation, EM 알고리즘, 상실된 데이터 보완 기법, BMA(Bayesian Model Averaging) 순서로 논의를 진행한다. 이러한 통계적 기법들은 대용량의 데이터를 처리하는 생물학, 의학, 생명 공학, 과학과 공학, 그리고 일반 데이터 조사와 처리 등에 사용되고 있으며, 최적의 추론 결과를 이끌어 내는데 중요한 방법을 제공하고 있다. 그리고 마지막으로 PC(Principal Component) 분석 기법에 대하여 논의한다. PC 분석 기법도 데이터 분석과 연구에 많이 활용된다.

  • PDF

카그라 마코브 체인 몬테칼로 모수 추정 파이프라인 분석 개발과 밀집 쌍성의 물리량 측정 (Development of a Markov Chain Monte Carlo parameter estimation pipeline for compact binary coalescences with KAGRA GW detector)

  • Kim, Chunglee;Jeon, Chaeyeon;Lee, Hyung Won;Kim, Jeongcho;Tagoshi, Hideyuki
    • 천문학회보
    • /
    • 제45권1호
    • /
    • pp.51.3-52
    • /
    • 2020
  • We present the status of the development of a Markov Chain Monte Carlo (MCMC) parameter estimation (PE) pipeline for compact binary coalescences (CBCs) with the Japanese KAGRA gravitational-wave (GW) detector. The pipeline is included in the KAGRA Algorithm Library (KAGALI). Basic functionalities are benchmarked from the LIGO Algorithm Library (LALSuite) but the KAGRA MCMC PE pipeline will provide a simpler, memory-efficient pipeline to estimate physical parameters from gravitational waves emitted from compact binaries consisting of black holes or neutron stars. Applying inspiral-merge-ringdown and inspiral waveforms, we performed simulations of various black hole binaries, we performed the code sanity check and performance test. In this talk, we present the situation of GW observation with the Covid-19 pandemic. In addition to preliminary PE results with the KAGALI MCMC PE pipeline, we discuss how we can optimize a CBC PE pipeline toward the next observation run.

  • PDF

Effects of ILFs on DRAM algorithm in SURR model uncertainty evaluation caused by interpolated rainfall using different methods

  • Nguyen, Thi Duyen;Nguyen, Duc Hai;Bae, Deg-Hyo
    • 한국수자원학회:학술대회논문집
    • /
    • 한국수자원학회 2022년도 학술발표회
    • /
    • pp.137-137
    • /
    • 2022
  • Evaluating interpolated rainfall uncertainty of hydrological models caused by different interpolation methods for basins where can not fully collect rainfall data are necessary. In this study, the adaptive MCMC method under effects of ILFs was used to analyze the interpolated rainfall uncertainty of the SURR model for Gunnam basin, Korea. Three events were used to calibrate and one event was used to validate the posterior distributions of unknown parameters. In this work, the performance of four ILFs on uncertainty of interpolated rainfall was assessed. The indicators of p_factor (percentage of observed streamflow included in the uncertainty interval) and r_factor (the average width of the uncertainty interval) were used to evaluate the uncertainty of the simulated streamflow. The results showed that the uncertainty bounds illustrated the slight differences from various ILFs. The study confirmed the importance of the likelihood function selection in the application the adaptive Bayesian MCMC method to the uncertainty assessment of the SURR model caused by interpolated rainfall.

  • PDF