Communications for Statistical Applications and Methods
/
제22권5호
/
pp.435-443
/
2015
Two phase sampling design is useful to increase estimation efficiency using deep stratification, improved non-response adjustment and reduced coverage bias. The same sampling units are commonly used for the first and the second phases in complex two-phase sampling design. In this paper we consider a sampling scheme where the first phase sampling units are clusters and the second phase sampling units are list samples. Using selected clusters in first phase requires that we list up elements in the selected clusters from the first phase and then use the list as a secondary sampling frame for the second phase sampling design. Then we select second phase samples from the listed sampling frame. We suggest an estimator based on the complex two-phase sampling design with different sampling units of each phase. Also the estimated variances of the estimator obtained by using classic and replication variance methods are considered and compared using simulation studies. For real data analysis, 2010 Korea Farm Household Economy Survey (KFHES) and 2011 Korea Agriculture Survey (KAS) are used.
차세대 통신기술인 Software-Defined Radio (SDR)시스템은 단일 하드웨어 플랫폼에 소프트웨어 변경만으로 다양한 통신표준을 수용할 수 있는 시스템이다. 시스템의 융통성(flexibility)과 적응성(adaptability)을 위하여 RF와 관련된 하드웨어의 최소화가 필요하며, 이를 위해 ADC를 사용으로 기저대역(baseband) 또는 낮은 IF단으로 직접하향 변환(downconversion)을 할 수 있는 bandpass sampling 기법이 필수적이다. 이 논문에서는 complex bandpass sampling 방식을 이용하여 두 가지의 통신 표준이 한 시스템에서 동시에 직접 하향 변환하는 새로운 방법을 제안하였다. 이에 따른 sampling 가능 영역, 보호대역(guard-band)을 고려한 sampling 가능 최소 주파수 그리고 이동된 신호의 위치를 구하는 수식들을 유도한 뒤 그래프를 통해 비교 분석하였다. 또한 제안한 sampling방식이 모의실험을 통해 기존에 제안되었던 real bandpass sampling방식보다 SDR시스템에 더욱 적합하다는 것을 입증하였다.
본 연구는 신체활동수준, 주관적 건강상태, 코로나19 염려의 관계를 분석하는 것에 목적이 있다. 이를 위하여 2020년 지역사회건강조사를 바탕으로 전국 만 19세 이상 성인 229,269명의 설문데이터 자료를 분석하였다. 복합표본설계로 가중치, 층화변수, 집락변수를 지정하여 분석하였다. SPSS 통계분석 프로그램을 이용하여 복합표본 빈도분석, 복합표본 교차분석, 복합표본 회귀분석을 실시하고, 다음과 같은 결과를 얻었다. 첫째, 신체활동수준이 높은 그룹이 신체활동수준이 낮은 그룹에 비하여 주관적 건강상태가 높은 것으로 나타났다. 둘째, 신체활동수준이 높은 그룹이 신체활동수준이 낮은 그룹에 비하여 코로나19 염려가 낮은 것으로 나타났다. 셋째, 주관적 건강수준이 높은 그룹이 낮은 그룹에 비하여 코로나19 염려가 낮은 것으로 나타났다. 다만 본 연구에서는 실제 코로나19 감염여부는 분석에 포함하지 않았다는 제한점이 있다.
This paper represents the new techniques for optimal sampling plans of reliability applying the mathematical complex number(real and imaginary number) in the complex system of reliability. The research formulation represent a mathematical model Which preserves all essential aspects of the main and auxiliary factors of the research objectives. It is important to formule the problem in good agreement with the objective of the research considering the main and auxilary factors which affect the system performance. This model was repeatedly tested to determine the required statistical chatacteristics which in themselves determine the actual and standard distributions. The evaluation programs and techniques are developed for establishing criteria for sampling plans of reliability effectiveness, and the evaluation of system performance was based on the complex stochastic process(derived by the Runge-Kutta method. by kolmogorv's criterion and the transform of a solution to a Sturon-Liouville equation.) The special structure of this mathematical model is exploited to develop the optimal sampling plans of reliability in the complex system.
Balanced half sample method is a simple variance estimation method for complex sampling designs. Since it is simple and flexible, it has been widely used in large scale sample surveys. However, the usual BHS method overestimate the true variance in without replacement sampling and two-stage cluster sampling. Focusing on this point , we proposed an unbiased BHS variance estimator in a stratified two-stage cluster sampling and then described an implementation method of the proposed estimator. Finally, partially BHS design is explained as a tool of reducing the number of replications of the proposed estimator.
조사자료분석에 있어서 표본추정량에 대해 설계요소가 갖는 효율성은 단순확률추출과 비교한 복잡표본설계의 의한 표본추출이 주는 분산의 상대적 크기인 설계효과를 통해 평가할 수 있다. 설계효과의 유용성은 복잡설계요소의 함수형태로 표현될 수 있을때 극대화될 수 있다. 본 연구에서는 층화다단추출의 표본설계에서 적용될 수 있는 설계효과모형을 제시하였다. 제시된 설계효과모형은 기존 다단추출을 위한 Gabler 등 (1999, 2006)의 모형을 일반화한 것으로 층구조, 표본할당, 집락추출 및 불균등가중치 등의 설계요소들이 정도수준에 갖는 영향력을 함수식으로 명확히 나타내주고 있다. 이를 활용하면 사전에 기술된 추정정도를 얻기 위해 설정한 표본크기가 줄 수 있는 설계효과를 예측하는데 활용할 수 있다. 또한 사후적으로 표본설계의 개별 설계요소들이 표본추정량에 대해 갖는 효율성을 평가하는데 활용될 수 있다.
Categorical data collected based on complex sample design is not proper for the standard Pearson multinomial-based chi-squared test because the observations are not independent and identically distributed. This study investigates effects of bias of point estimator of population proportion and its variance estimator to the standard Pearson chi-squared test statistics when the sample is collected based on complex sampling scheme. This study examines the effect under two population homogeneity test. The standard Pearson test statistic can be partitioned into two parts; the first part is the weighted sum of ${\chi}^2_1$ with eigenvalues of design matrix as their weights, and the additional second part which is added due to the biases of the point estimator and its variance estimator. Our empirical analysis shows that even though the bias of point estimator is small, Pearson test statistic is very much inflated due to underestimate the variance of point estimator. In the connection of design-based variance estimator and its design matrix, the bigger the average of eigenvalues of design matrix is, the larger relative size of which the first component part to Pearson test statistic is taking.
Measurement error is one of main source of error in survey. It is generally defined as the difference between an observed value and an underlying true value. An observed value with error may be expressed as a function of the true value plus error term. In some cases, the measurement error variance may be also a function of the unknown true value. The error variance function can be rewritten as a function of true value multiplied by a scale factor. This research explore methods for estimation of the measurement error variance based on the data from complex sampling design. We consider the case in which the variance of mesurement error is a linear function of unknown true value, and the error variance scale factor is small. We applied our results to the U.S. Third National Health and Nutrition Examination Survey (the U.S. NHANES III) data for empirical analyses, which has replicate measurements for relatively small subset of initial respondents's group.
Journal of the Korean Data and Information Science Society
/
제25권5호
/
pp.1127-1135
/
2014
Genome-wide association studies (GWAS) are designed to discover genetic variants such as single nucleotide polymorphisms (SNPs) that are associated with human complex traits. Although there is an increasing interest in the application of GWAS methodologies to population-based cohorts, many published GWAS have adopted a case-control design, which raise an issue related to a sampling bias of both case and control samples. Because of unequal selection probabilities between cases and controls, the samples are not representative of the population that they are purported to represent. Therefore, non-random sampling in case-control study can potentially lead to inconsistent and biased estimates of SNP-trait associations. In this paper, we proposed inverse-probability of sampling weights based on disease prevalence to eliminate a case-control sampling bias in estimation and testing for association between SNPs and quantitative traits. We apply the proposed method to a data from the Korea Association Resource project and show that the standard estimators applied to the weighted data yield unbiased estimates.
National-wide and/or large scale sample surveys generally use complex sample design. Traditional Pearson chi-square test is not appropriate for the categorical complex sample data. Rao-Scott suggested an adjustment method for Pearson chi-square test, which uses the average of eigenvalues of design matrix of cell probabilities. This study is to compare the efficiency of Rao-Scott first order adjusted test to Wald test for homogeneity between two populations using 2009 Gyeongnam regional education offices's customer satisfaction survey (2009 GREOCSS) data. The 2009 GREOCSS data were collected based on stratified three-stage cluster sampling with probability proportional to size. The empirical results show that the Rao-Scott adjusted test statistic using only the variances of cell probabilities is very close to the Wald test statistic, which uses the covariance matrix of cell probabilities, under the 2009 GREOCSS data based. However it is necessary to be cautious to use the Rao-Scott first order adjusted test statistic in the place of Wald test because its efficiency is decreasing as the relative variance of eigenvalues of the design matrix of cell probabilities is increasing, specially more when the number of degrees of freedom is small.
본 웹사이트에 게시된 이메일 주소가 전자우편 수집 프로그램이나
그 밖의 기술적 장치를 이용하여 무단으로 수집되는 것을 거부하며,
이를 위반시 정보통신망법에 의해 형사 처벌됨을 유념하시기 바랍니다.
[게시일 2004년 10월 1일]
이용약관
제 1 장 총칙
제 1 조 (목적)
이 이용약관은 KoreaScience 홈페이지(이하 “당 사이트”)에서 제공하는 인터넷 서비스(이하 '서비스')의 가입조건 및 이용에 관한 제반 사항과 기타 필요한 사항을 구체적으로 규정함을 목적으로 합니다.
제 2 조 (용어의 정의)
① "이용자"라 함은 당 사이트에 접속하여 이 약관에 따라 당 사이트가 제공하는 서비스를 받는 회원 및 비회원을
말합니다.
② "회원"이라 함은 서비스를 이용하기 위하여 당 사이트에 개인정보를 제공하여 아이디(ID)와 비밀번호를 부여
받은 자를 말합니다.
③ "회원 아이디(ID)"라 함은 회원의 식별 및 서비스 이용을 위하여 자신이 선정한 문자 및 숫자의 조합을
말합니다.
④ "비밀번호(패스워드)"라 함은 회원이 자신의 비밀보호를 위하여 선정한 문자 및 숫자의 조합을 말합니다.
제 3 조 (이용약관의 효력 및 변경)
① 이 약관은 당 사이트에 게시하거나 기타의 방법으로 회원에게 공지함으로써 효력이 발생합니다.
② 당 사이트는 이 약관을 개정할 경우에 적용일자 및 개정사유를 명시하여 현행 약관과 함께 당 사이트의
초기화면에 그 적용일자 7일 이전부터 적용일자 전일까지 공지합니다. 다만, 회원에게 불리하게 약관내용을
변경하는 경우에는 최소한 30일 이상의 사전 유예기간을 두고 공지합니다. 이 경우 당 사이트는 개정 전
내용과 개정 후 내용을 명확하게 비교하여 이용자가 알기 쉽도록 표시합니다.
제 4 조(약관 외 준칙)
① 이 약관은 당 사이트가 제공하는 서비스에 관한 이용안내와 함께 적용됩니다.
② 이 약관에 명시되지 아니한 사항은 관계법령의 규정이 적용됩니다.
제 2 장 이용계약의 체결
제 5 조 (이용계약의 성립 등)
① 이용계약은 이용고객이 당 사이트가 정한 약관에 「동의합니다」를 선택하고, 당 사이트가 정한
온라인신청양식을 작성하여 서비스 이용을 신청한 후, 당 사이트가 이를 승낙함으로써 성립합니다.
② 제1항의 승낙은 당 사이트가 제공하는 과학기술정보검색, 맞춤정보, 서지정보 등 다른 서비스의 이용승낙을
포함합니다.
제 6 조 (회원가입)
서비스를 이용하고자 하는 고객은 당 사이트에서 정한 회원가입양식에 개인정보를 기재하여 가입을 하여야 합니다.
제 7 조 (개인정보의 보호 및 사용)
당 사이트는 관계법령이 정하는 바에 따라 회원 등록정보를 포함한 회원의 개인정보를 보호하기 위해 노력합니다. 회원 개인정보의 보호 및 사용에 대해서는 관련법령 및 당 사이트의 개인정보 보호정책이 적용됩니다.
제 8 조 (이용 신청의 승낙과 제한)
① 당 사이트는 제6조의 규정에 의한 이용신청고객에 대하여 서비스 이용을 승낙합니다.
② 당 사이트는 아래사항에 해당하는 경우에 대해서 승낙하지 아니 합니다.
- 이용계약 신청서의 내용을 허위로 기재한 경우
- 기타 규정한 제반사항을 위반하며 신청하는 경우
제 9 조 (회원 ID 부여 및 변경 등)
① 당 사이트는 이용고객에 대하여 약관에 정하는 바에 따라 자신이 선정한 회원 ID를 부여합니다.
② 회원 ID는 원칙적으로 변경이 불가하며 부득이한 사유로 인하여 변경 하고자 하는 경우에는 해당 ID를
해지하고 재가입해야 합니다.
③ 기타 회원 개인정보 관리 및 변경 등에 관한 사항은 서비스별 안내에 정하는 바에 의합니다.
제 3 장 계약 당사자의 의무
제 10 조 (KISTI의 의무)
① 당 사이트는 이용고객이 희망한 서비스 제공 개시일에 특별한 사정이 없는 한 서비스를 이용할 수 있도록
하여야 합니다.
② 당 사이트는 개인정보 보호를 위해 보안시스템을 구축하며 개인정보 보호정책을 공시하고 준수합니다.
③ 당 사이트는 회원으로부터 제기되는 의견이나 불만이 정당하다고 객관적으로 인정될 경우에는 적절한 절차를
거쳐 즉시 처리하여야 합니다. 다만, 즉시 처리가 곤란한 경우는 회원에게 그 사유와 처리일정을 통보하여야
합니다.
제 11 조 (회원의 의무)
① 이용자는 회원가입 신청 또는 회원정보 변경 시 실명으로 모든 사항을 사실에 근거하여 작성하여야 하며,
허위 또는 타인의 정보를 등록할 경우 일체의 권리를 주장할 수 없습니다.
② 당 사이트가 관계법령 및 개인정보 보호정책에 의거하여 그 책임을 지는 경우를 제외하고 회원에게 부여된
ID의 비밀번호 관리소홀, 부정사용에 의하여 발생하는 모든 결과에 대한 책임은 회원에게 있습니다.
③ 회원은 당 사이트 및 제 3자의 지적 재산권을 침해해서는 안 됩니다.
제 4 장 서비스의 이용
제 12 조 (서비스 이용 시간)
① 서비스 이용은 당 사이트의 업무상 또는 기술상 특별한 지장이 없는 한 연중무휴, 1일 24시간 운영을
원칙으로 합니다. 단, 당 사이트는 시스템 정기점검, 증설 및 교체를 위해 당 사이트가 정한 날이나 시간에
서비스를 일시 중단할 수 있으며, 예정되어 있는 작업으로 인한 서비스 일시중단은 당 사이트 홈페이지를
통해 사전에 공지합니다.
② 당 사이트는 서비스를 특정범위로 분할하여 각 범위별로 이용가능시간을 별도로 지정할 수 있습니다. 다만
이 경우 그 내용을 공지합니다.
제 13 조 (홈페이지 저작권)
① NDSL에서 제공하는 모든 저작물의 저작권은 원저작자에게 있으며, KISTI는 복제/배포/전송권을 확보하고
있습니다.
② NDSL에서 제공하는 콘텐츠를 상업적 및 기타 영리목적으로 복제/배포/전송할 경우 사전에 KISTI의 허락을
받아야 합니다.
③ NDSL에서 제공하는 콘텐츠를 보도, 비평, 교육, 연구 등을 위하여 정당한 범위 안에서 공정한 관행에
합치되게 인용할 수 있습니다.
④ NDSL에서 제공하는 콘텐츠를 무단 복제, 전송, 배포 기타 저작권법에 위반되는 방법으로 이용할 경우
저작권법 제136조에 따라 5년 이하의 징역 또는 5천만 원 이하의 벌금에 처해질 수 있습니다.
제 14 조 (유료서비스)
① 당 사이트 및 협력기관이 정한 유료서비스(원문복사 등)는 별도로 정해진 바에 따르며, 변경사항은 시행 전에
당 사이트 홈페이지를 통하여 회원에게 공지합니다.
② 유료서비스를 이용하려는 회원은 정해진 요금체계에 따라 요금을 납부해야 합니다.
제 5 장 계약 해지 및 이용 제한
제 15 조 (계약 해지)
회원이 이용계약을 해지하고자 하는 때에는 [가입해지] 메뉴를 이용해 직접 해지해야 합니다.
제 16 조 (서비스 이용제한)
① 당 사이트는 회원이 서비스 이용내용에 있어서 본 약관 제 11조 내용을 위반하거나, 다음 각 호에 해당하는
경우 서비스 이용을 제한할 수 있습니다.
- 2년 이상 서비스를 이용한 적이 없는 경우
- 기타 정상적인 서비스 운영에 방해가 될 경우
② 상기 이용제한 규정에 따라 서비스를 이용하는 회원에게 서비스 이용에 대하여 별도 공지 없이 서비스 이용의
일시정지, 이용계약 해지 할 수 있습니다.
제 17 조 (전자우편주소 수집 금지)
회원은 전자우편주소 추출기 등을 이용하여 전자우편주소를 수집 또는 제3자에게 제공할 수 없습니다.
제 6 장 손해배상 및 기타사항
제 18 조 (손해배상)
당 사이트는 무료로 제공되는 서비스와 관련하여 회원에게 어떠한 손해가 발생하더라도 당 사이트가 고의 또는 과실로 인한 손해발생을 제외하고는 이에 대하여 책임을 부담하지 아니합니다.
제 19 조 (관할 법원)
서비스 이용으로 발생한 분쟁에 대해 소송이 제기되는 경우 민사 소송법상의 관할 법원에 제기합니다.
[부 칙]
1. (시행일) 이 약관은 2016년 9월 5일부터 적용되며, 종전 약관은 본 약관으로 대체되며, 개정된 약관의 적용일 이전 가입자도 개정된 약관의 적용을 받습니다.