• Title/Summary/Keyword: 회귀수

Search Result 7,995, Processing Time 0.036 seconds

Improving Polynomial Regression Using Principal Components Regression With the Example of the Numerical Inversion of Probability Generating Function (주성분회귀분석을 활용한 다항회귀분석 성능개선: PGF 수치역변환 사례를 중심으로)

  • Yang, Won Seok;Park, Hyun-Min
    • The Journal of the Korea Contents Association
    • /
    • v.15 no.1
    • /
    • pp.475-481
    • /
    • 2015
  • We use polynomial regression instead of linear regression if there is a nonlinear relation between a dependent variable and independent variables in a regression analysis. The performance of polynomial regression, however, may deteriorate because of the correlation caused by the power terms of independent variables. We present a polynomial regression model for the numerical inversion of PGF and show that polynomial regression results in the deterioration of the estimation of the coefficients. We apply principal components regression to the polynomial regression model and show that principal components regression dramatically improves the performance of the parameter estimation.

A study on Speech Recognition Using Recurrent Neural Predictive HMM (회귀신경망 예측 HMM을 이용한 음성 인식에 관한 연구)

  • 박경훈;한학용;김수훈;허강인
    • Proceedings of the Korea Institute of Convergence Signal Processing
    • /
    • 2000.08a
    • /
    • pp.153-156
    • /
    • 2000
  • 본문에서는 예측형 회귀신경망과 HMM의 하이브리드 네트워크인 회귀신경망 예측 HMM을 구성하였다. 회귀신경망 예측 HMM은 예측형 회귀신경망을 HMM의 각 상태마다 예측기로 정의하여 일정치인 평균벡터 대신에 과거의 특징벡터의 영향을 받아 동적으로 변화하는 신경망에 의한 예측치를 이용하므로 학습패턴 설정자체가 시변성을 반영하는 동적 네트워크의 특성을 가진다. 따라서 음성과 같은 시계열 패턴의 인식에 유리하다. 회귀신경망 예측 HMM은 예측형 회귀신경망의 구조에 따라 Elman망 예측 HMM과 Jordan망 예측 HMM으로 구분하였다. 실험에서는 회귀신경망 예측 HMM의 상태수를 4, 5, 6으로 증가시켜 각 상태 수별로 예측차수 및 중간층 유니트 수의 변화에 따른 인식성능을 조사하였다. 실험결과 평가용. 데이터에 대하여 Elman망예측 HMM은 상태수가 6이고, 예측차수가 3차, 중간층 유니트의 수가 15차원일 때, Jordan망 예측 HMM의 경우 상태수가 5이고, 예측차수가 3차, 중간층 유니트의 수가 10차원일 때 각각 99.5%로 우수한 결과를 얻었다.

  • PDF

Flood risk assessment by multiple regression using hourly precipitation (시강우량 자료 다중회귀분석에 의한 홍수위험 평가)

  • Park, Chang Eon;Kim, Chan Woo
    • Proceedings of the Korea Water Resources Association Conference
    • /
    • 2016.05a
    • /
    • pp.264-264
    • /
    • 2016
  • 홍수위험의 정도를 표시하기 위한 연구는 다양한 방법으로 진행되어 왔으나, 많은 지역에 수리 및 수문모형을 적용하여 홍수위험을 평가하기에는 매개변수 보정이나 모형의 검정에 한계가 있을 수밖에 없다. 특히, 많은 지역에 대하여 행정구역별로 홍수위험을 평가한다던지, 기후변화에 따른 홍수위험 변화양상을 평가하기 위하여는 더욱 그러하다. 이에 본 연구에서는 기존의 수위관측소에서 관측되어진 유량 자료를 적극 활용하여 시강우량과의 다중회귀분석을 통하여 첨두유량을 예측할 수 있는 회귀방정식을 구축하고 홍수위험을 평가할 수 있도록 시도하였다. 홍수피해는 하천의 유량 증가가 가장 직접적인 원인이 될 수 있으며, 비교적 하천정비가 잘 이루어진 우리나라의 경우는 하천정비 시 설정한 계획홍수량과 호우에 따라 발생되는 첨두유량을 비교하여 홍수피해 발생여부를 판단할 수 있을 것이다. 하천의 첨두유량 값은 복잡한 유역특성이나 수문특성에 의하여 결정되지만, 결국은 시간별 순간 최대강우량의 조합에 의하여 크게 좌우 되는 것으로 판단된다. 본 연구에서는 수도권의 일부 행정구역별 대표 수위관측소를 정하고, 각 지점의 최근 10년 동안의 하천유량 관측자료를 이용하여 단일 호우사상의 1시간, 2시간, 3시간, 5시간, 10시간, 1일, 2일, 3일, 5일, 10일 순간최대강우량과 첨두유량 사이의 다중회귀분석을 실시하여 유의한 통계값을 보이는 자료끼리 회귀방정식을 구성하도록 하였다. 다중회귀분석은 각 하천 지점별로 해당 하천의 수리특성이 일정하게 유지되어진 기간 동안만을 선정하여 분석하였으며, 유량자료 가운데 각 지점에서 관심수위 이상으로 유량이 크게 증가하였던 호우사상만을 사용하였다. 회귀분석 결과, 매우 의미 있는 회귀방정식의 도출이 가능하였는데, 의정부시 신곡교의 경우는 1시간, 10시간, 1일 강우량으로부터, 광주시 경안교 지점의 경우는 3시간, 1일, 10일 강우량으로부터, 양평군 흑천교 지점의 경우는 10시간, 3일 강우량으로부터 각각 첨두유량을 예측할 수 있는 회귀방정식이 높은 유의성을 보이는 것으로 나타나, 유역면적이나 도달시간 등의 유역특성을 어느 정도 반영하고 있는 회귀방정식이 도출된 것으로 판단되었다. 이와 같은 회귀방정식에 의하여 예상되어지는 시간별 강우량 자료를 적용하면 첨두유량을 예측할 수 있으며, 이를 기존 계획홍수량과 비교하여 홍수위험 정도를 적절하게 평가할 수 있을 것으로 판단된다.

  • PDF

Joint penalization of components and predictors in mixture of regressions (혼합회귀모형에서 콤포넌트 및 설명변수에 대한 벌점함수의 적용)

  • Park, Chongsun;Mo, Eun Bi
    • The Korean Journal of Applied Statistics
    • /
    • v.32 no.2
    • /
    • pp.199-211
    • /
    • 2019
  • This paper is concerned with issues in the finite mixture of regression modeling as well as the simultaneous selection of the number of mixing components and relevant predictors. We propose a penalized likelihood method for both mixture components and regression coefficients that enable the simultaneous identification of significant variables and the determination of important mixture components in mixture of regression models. To avoid over-fitting and bias problems, we applied smoothly clipped absolute deviation (SCAD) penalties on the logarithm of component probabilities suggested by Huang et al. (Statistical Sinica, 27, 147-169, 2013) as well as several well-known penalty functions for coefficients in regression models. Simulation studies reveal that our method is satisfactory with well-known penalties such as SCAD, MCP, and adaptive lasso.

A Study on Randomized Response Regression Estimate from Quantitative Data (양적 확률화응답을 이용한 회귀추정에 관한 연구)

  • 최경호
    • The Korean Journal of Applied Statistics
    • /
    • v.12 no.2
    • /
    • pp.527-535
    • /
    • 1999
  • 양적 확률응답을 이용한 민감사안에 대한 평균이나 분석의 추정시 보조정보를 활용한 회귀추정법에 대해서 언급하고, 유도된 회귀추정량과 Greenberg et al.의 추정량 그리고 비추정량과의 비교의 통하여 회귀추정량이 효율적일 수 있는 조건을 찾았다. 또한 각 질문에 대한 응답의 분포가 포아송 분포인 경우 회귀추정량의 효율이 증대될 수 있는 조건에 대해서도 논하였다.

  • PDF

Trend analysis of extream precipitation in Korea using Quantile Regression (Quantile Regression을 활용한 우리나라 극치강수량 경향성 분석)

  • So, Byung-Jin;Kwon, Hyun-Han;Park, Rae-Gun
    • Proceedings of the Korea Water Resources Association Conference
    • /
    • 2012.05a
    • /
    • pp.369-370
    • /
    • 2012
  • 일반적으로 회귀분석의 최적화는 평균적인 개념을 확장하여 사용되어지고 있다. 평균은 관찰값들에 관한 모든 정보와 관련된 통계량으로써 많은 연구에 이용되어지고 있다. 정규분포를 이루는 모집단의 경우 평균을 사용한 추정이 바람직하지만, 이상치로 인한 분포의 꼬리가 두꺼워지는 경우 중위수(median)를 사용하는 것이 바람직하다고 알려져 있다. 강수량의 분포형태는 꼬리(tail)가 두꺼운 왜곡된 형태를 갖고 있으므로 robust 통계량인 Quantile을 이용한 강수량의 분석 및 평가를 실시하였다. 본 연구에서는 Quantile에 따른 회귀선의 변화를 이용하여 강수량의 경향성을 평가하고, 극치강수량의 변화를 보여줄 수 있는 Quantle값을 추출해 보고자 한다. 또한 bootstrap 방법을 이용하여 Quantile에 따른 회귀계수의 신뢰구간을 분석하여 회귀인자의 신뢰성을 평가하였다. 본 연구에서 적용한 Quantile Regression 기법은 회귀계수의 추정에 있어서 회귀인자의 신뢰성을 Quantile-회귀계수 그래프를 통해 분석할 수 있으며, 이상값의 영향을 저감시키는 평균과 달리 이상값의 영향을 효과적으로 분리 및 재현시킬 수 있어 극치값에 따른 변화를 효과적으로 평가할 수 있으며, robust 통계량의 특징인 분산이 적은 안정적인 추정량을 확보할 수 있다.

  • PDF

Shrinkage Structure of Ridge Partial Least Squares Regression

  • Kim, Jong-Duk
    • Journal of the Korean Data and Information Science Society
    • /
    • v.18 no.2
    • /
    • pp.327-344
    • /
    • 2007
  • Ridge partial least squares regression (RPLS) is a regression method which can be obtained by combining ridge regression and partial least squares regression and is intended to provide better predictive ability and less sensitive to overfitting. In this paper, explicit expressions for the shrinkage factor of RPLS are developed. The structure of the shrinkage factor is explored and compared with those of other biased regression methods, such as ridge regression, principal component regression, ridge principal component regression, and partial least squares regression using a near infrared data set.

  • PDF

Estimation of Agricultural Water Return Flow Using a Network Model Based on Paddy Irrigation Areas (논배수로 네트워크 모형을 통한 농업용수 회귀수량 산정 방안)

  • Inkyo Choo;Junhwa Lee;Adigun Ismail Adebayo;Younghun Jung
    • Proceedings of the Korea Water Resources Association Conference
    • /
    • 2023.05a
    • /
    • pp.407-407
    • /
    • 2023
  • 최근 환경부에서 발표한 국가물관리기본계획에서 수자원 총량 중 생활·공업·농업·유지용수의 이용량은 365억m3/년으로 약 29.4%로 발표되었다. 유지용수를 제외한 농업용수 이용량의 비중은 약 60.5%이며, 이 중 약 80%가 논에서 활용되고 있다. 이러한 농업용수 이용량 중 사용되지 않고 하천으로의 방류량이 존재하는데 이를 관개회귀수량이라하며, 농업용수의 약 35%가 하천으로 회귀된다 발표하나 지역에 따른 편차가 존재하기에 정확한 회귀수량을 산정하기엔 미흡한 실정이다. 따라서 본 연구에서는 네트워크 모형을 통한 용배수로 구축 이후 회귀수 정량화를 하고자 하며, 정량화를 위한 네트워크 모형은 EPA-SWMM(Storm Water Management Model) 모형을 활용하였다. 해당 모형은 미국 환경 보호국(U.S. Environmental Protection Agency, EPA)에서 개발한 네트워크 물리모형으로 다양한 환경적 요소에 따른 수문 영향을 확인 가능한 모형이다. 해당 모형의 다양한 네트워크 기능을 통해 논배수로 네트워크를 구축하여 회귀수 정량화를 진행하고자 한다. 논배수로 네트워크를 구축하기 이전 현장조사를 진행하였다. 현장조사를 통한 용수계통도를 작성하였으며, 모형의 입력자료로 필요한 네트워크 용배수로관 표고값을 측량하였다. 이후 현장조사 및 측량 자료를 활용하여 네트워크 물리모형의 입력자료 구축을 진행하였으며, 해당 자료 구축은 지리 정보 시스템 중 ArcGIS와의 연계를 통해 구축하였다. 모형의 수리학적 입력자료는 해당지역의 계측자료를 활용하였으며, 필지 사이의 내리흐름 및 펌프를 통한 용수 또한 네트워크 물리모형의 기능을 활용하여 구축하였다. 이후 계측자료와의 비교를 통한 매개변수 보정을 진행하였으며, 전체 논배수로에 대한 농업용수의 흐름 및 회귀수량을 분석하였다. 해당 연구를 통해 농업용수의 회귀수 산정 및 지역 편차에 따른 회귀수 정량화 등의 연구에 활용될 것으로 기대한다.

  • PDF

The study of the characteristics of return flow in irrigation water (농업용수 회귀특성에 관한 연구)

  • Kim, Nam Won;Shin, Seong Cheol;Kim, Chul Gyum
    • Proceedings of the Korea Water Resources Association Conference
    • /
    • 2004.05b
    • /
    • pp.630-634
    • /
    • 2004
  • 현재까지 대부분의 유출 모형들은 우리나라 농업지역에 내한 적용에 있어 많은 수정이 요구되고, 그에 따른 모의 결과 또한 불확실성을 내포하고 있으며, 이의 원인중 상당수는 농업지역에서 발생하는 관개와 회귀에 따른 것이라 찰 수 있다. 특히 농업지역에서의 유출 및 물사용에 대한 정확한 계측이 제대로 이루어지고 있지 못하기 때문에, 그에 따른 정확한 수자원 평가가 어려운 현실이다. 이에 본 논문에서는 본 연구진에서 기 개발한 순물소모량 산정방법과 회귀 관계식으로 보청천 유역의 회귀특성을 규명하고자 하였으며, 본 연구에서 사용한 모형은 SWAT모형의 농업용수 관개 기능을 보완한 SWAT-AGRIMANAGEMENT모형을 개발 이용하였다. 유역규모에서의 농업용수 사용에 따른 하천유량의 변화 및 유역내 회귀관계를 파악할 수 있었으며, 기존에 주로 관개지구 단위에서의 회귀수량 조사 결과 및 가정에 의하여 사용되던 농업용수 회귀율에 대한 보다 의미있는 기준을 제시할 수 있을 것으로 기대된다.

  • PDF

로지스틱 회귀모형을 분석하기 위한 SPSS, SAS, STATA의 비교분석

  • Kim, Sun-Gwi;Jeong, Dong-Bin
    • Proceedings of the Korean Statistical Society Conference
    • /
    • 2002.11a
    • /
    • pp.287-292
    • /
    • 2002
  • 최근 여러 분야에서 로지스틱 회귀에 대한 필요성과 그 응용이 급증하면서 이를 분석하기 위한 통계패키지가 많이 개발되어 사용되고 있다. 이 논문에서는 자료의 유형에 따라 활용할 수 있는 여러 형태의 로지스틱 회귀모형을 간단히 살펴보고, SPSS, SAS, STATA, MINITAB과 같은 통계패키지를 사용하여 로지스틱 회귀모형에 적용할 때 각각 다룰 수 있는 범위와 그 특징에 대해 다룬다.

  • PDF