• 제목/요약/키워드: 표본 가중치

검색결과 153건 처리시간 0.019초

The Weighting Adjustment of Korea Welfare Panel Study

  • 손창균;류제복;홍기학;이기성
    • 한국조사연구학회:학술대회논문집
    • /
    • 한국조사연구학회 2006년도 추계학술대회 발표논문집
    • /
    • pp.11-40
    • /
    • 2006
  • 시간의 흐름에 따라 사회 구성원들에 대한 행태 연구나 사회의 변화가 개인의 행동양식에 미치는 영향 등에 대한 조사에서는 어느 한 시점에서의 구성원들에 대한 횡단면 조사와는 다르게 다년간 지속적으로 조사개체를 추적조사 해야 하는 종단면 조사 또는 패널조사를 수행해야 한다. 패널조사는 횡단면 조사와는 달리 최초 표본이 시간이 지남에 따라 조사 대상 표본으로부터 탈락함으로서 발생하는 표본의 마모와 그에 따른 대표성 상실의 문제이다. 그러므로 이러한 표본의 대표성 상실 문제를 적절히 해결하기 위해 적용 가능한 방법이 가중치 조정 방법이다 횡단면 조사에서는 (1)추출가중치의 조정, (2)무응답 가중치 조정, (3)사후층화 가중치 조정과 같이 3단계의 가중치 조정과정을 수행하지만, 패널 조사의 경우 이와 더불어 원 표본의 대표성을 유지하기 위해 종단면 가중치(longitudinal weight)를 함께 고려해야 한다. 이러한 관점에서 본 연구에서는 다양한 패널형태에 따른 가중치 조정 방법에 대해 고찰하고, 향후 수행될 한국복지패널(Korea Welfare Panel Study: KWPS)의 가중치 산정에 관한 이론적 근거를 마련함과 동시에 현재 국내에서 수행되고 있는 패널조사의 가중치 조정방법과 비교하고자 한다.

  • PDF

잠재적 위험요인의 탐색에 관한 단일표본분석과 복합표본분석의 비교 (Comparative Analysis of Unweighted Sample Design and Complex Sample Design Related to the Exploration of Potential Risk Factors of Dysphonia)

  • 변해원
    • 한국산학기술학회논문지
    • /
    • 제13권5호
    • /
    • pp.2251-2258
    • /
    • 2012
  • 본 연구는 잠재적 위험요인을 탐색하는 방법으로 단순임의추출분석(unweighted sample design), 빈도 가중치를 적용한 단일표본분석(frequency weighted sample design), 가중치를 층화하여 적용한 복합표본분석(complex sample design)을 비교하고, 도출된 결과에 통계적인 차이가 있는지를 파악하고자 수행되었다. 자료원은 2009 국민건강영양조사의 이비인후과 검진 자료를 이용하였다. 분석 방법은 피어슨의 교차검정(Pearson chi-square test)과 라오-스콧교차검정(Rao-scott chi-square test)을 이용하였다. 분석 결과, 빈도 가중치만을 적용한 단일표본분석의 경우에는 모든 변수가 유의한 위험요인으로 과대 예측 되었고, 가중치를 적용하지 않은 단순임의추출 분석과 복합표본분석은 유의수준 및 결과에 차이가 있었다. 국가통계자료를 이용할 때, 연구의 결과가 전체 인구집단을 대표할 수 있도록 의미를 부여하기 위해서는 층화변수와 집락변수를 사용하여 가중치를 적용하는 복합표본분석이 필요하다. 나아가, 빈도 가중치만을 적용하는 경우에는 연구 결과에 대한 과잉해석의 가능성이 높기 때문에 각별한 주의가 요구된다.

유한모집단에서 가중평균에 포함된 가중치의 효과 (Weighting Effect on the Weighted Mean in Finite Population)

  • 김규성
    • 한국조사연구학회지:조사연구
    • /
    • 제7권2호
    • /
    • pp.53-69
    • /
    • 2006
  • 표본조사에서 가중치는 설계 단계와 분석 단계에서 만들어지고 부여될 수 있다. 설계 단계의 가중치는 추출확률이나 응답률 등과 같은 표본 데이터 획득 지표에 관련되어 있고 분석 단계의 가중치는 모집단 수치나 다른 보조 변수정보 등과 같은 외적인 정보와 관련되어 있다. 그리고 최종가중치는 설계 단계의 가중치와 분석 단계의 가중치의 곱으로 만들어진다. 이 논문에서는 분석 단계에서 부여되는 가중치에 초점을 맞추어 가중평균으로 모평균을 추정할 때 가중평균에 포함된 가중치가 모평균 추론에 미치는 영향을 고찰하였다. 유한모집단에서 각 조사단위에 조사변수와 가중치가 쌍으로 있고 표본추출확률이 균등한 경우를 가정하였다. 이러한 조건에서 가중평균의 편향과 평균제곱오차를 구하여 가중평균은 모평균의 편향 추정량임을 보였고, 편향의 방향과 크기는 조사변수와 가중치의 상관관계로 설명할 수 있음을 보였다. 즉, 만일 가중치와 조사변수가 양의 상관관계가 있으면 가중평균은 모평균을 과대 추정하게 되고, 만일 음의 상관관계가 있으면 모평균을 과소 추정하게 된다. 그리고 두 변수의 상관계수가 크면 편향은 증가한다. 가중평균에 대한 이론적인 수식 유도와 함께 편향의 크기와 평균제곱오차의 크기를 수치적으로 검토하기 위하여 모의실험을 실시하였다. 모의실험에서는 상관계수가 -0.2과 0.6사이에 있는 9개의 가중치를 생성하였고, 표본수는 100부터 400까지 고려하여 편향의 크기와 평균제곱오차의 크기를 수치적으로 구하였다. 하나의 결과로써 상관계수가 0.55이고 표본수가 400인 경우에 가중평균의 편향의 제곱이 평균제곱오차에서 차지하는 비율은 무려 82%에 이르는 것으로 나타났는데, 이는 가중평균의 편향이 어떤 경우에는 매우 심각할 수도 있음을 보여주는 것이다.

  • PDF

표본조사에 따른 추정방법 비교: 가중치 조정기법을 중심으로 (Comparison of Estimation on Sample Survey: Focusing on Weight Adjustment)

  • 이상은
    • 응용통계연구
    • /
    • 제21권3호
    • /
    • pp.413-427
    • /
    • 2008
  • 표본설계는 대표성 있는 표본추출과 이에 따른 적절한 추정식을 산출해 주어야 한다. 이때 조사결과가 모집단의 대표성을 갖기 위해서는 적절한 가중치가 부여되어야 한다. 일반적으로 표본설계시 제시된 기본가중치는 추출확률에 의해 계산된다. 그러나 조사 후 무응답등과 같은 요인이 발생된 경우 모집단의 대표성을 유지하기 위해 기본가중치의 보정이 필요하다. 본 논문은 조사 후 가중치 보정방법으로 기존에 흔히 사용하고 있는 갈퀴법(Raking)과 현재 BLS에서 적용하고 있는 방법(BLS) 그리고 최근 표본조사의 추정식으로 관심을 끌고 있는 일반화회귀식(GREG)에 의한 방법을 비교하였다. 자료분석은 산업단지공단내의 산업분류별 총 종사자수가 사용되었으며 MSE, Coverage, CV, Large Error(LE), NOn-Centrality(NC) 등의 비교통계량을 이용하여 그 결과를 비교하였다.

순환표본의 결합을 위한 가중치 산출에 대한 연구 (A Study on the Construction of Weights for Combined Rolling Samples)

  • 송종호;박진우;변종석;박민규
    • 한국조사연구학회지:조사연구
    • /
    • 제11권1호
    • /
    • pp.19-41
    • /
    • 2010
  • 순환표본조사를 시행할 경우 매 순환주기별로 적절한 통계적 신뢰도를 가진 전체 모집단 특성이 추정될 수 있는 반면에, 작은 표본크기로 인하여 통계적 신뢰도가 높은 소지역 추정량의 산출은 어렵다. 따라서 소지역 추정량은 일반적으로 일정 주기 후 혹은 전체조사가 마무리된 후 독립적인 순환표본들을 결합하여 얻어진 최종표본을 통해 산출된다. 본 연구에서 는 순환표본을 결합하여 추정량을 만들 때 필요한 가중치 산출의 문제를 고려하였다. 기존의 연구들이 각 조사에 따른 경험을 바탕으로 조사별로 가능한 순환표본 결합 가중치를 정의하였으나, 본 연구에서는 모든 가능한 관심변수에 적용 가능하도록 표본설계변수에만 의존하는 모형을 설정하고 주어진 모형하에서의 최량선형불편예측치(Best Linear Unbiased Predictor: BLUP)를 고려하였다. 모의실험을 통하여 각 모형 하에서 정의되는 여러 BLUP을 비교하여 모형변화에 강건한 추정량을 제안하고 그 결과를 제4기 국민건강영양조사에 적용하였다.

  • PDF

변량가중치를 이용한 EWMA 관리도

  • 이재헌;한정희
    • 한국통계학회:학술대회논문집
    • /
    • 한국통계학회 2005년도 추계 학술발표회 논문집
    • /
    • pp.67-72
    • /
    • 2005
  • 이 논문은 표본크기와 표본추출간격 이외의 관리모수인 EWMA 관리도의 가중치를 이전 시점의 관리통계량 값에 기초하여 변화시키는 VW(variable weight) 방법에 대한 것이다. 이 방법을 VSR(variable sampling rate)과 병행하는 절차를 제안하고, 절차의 효율에 대하여 알아보았다.

  • PDF

응답률이 관심변수의 지수함수를 따를 경우 정보적 표본설계 기법을 이용한 모수추정 (Estimation using informative sampling technique when response rate follows exponential function of variable of interest)

  • 정희영;신기일
    • 응용통계연구
    • /
    • 제30권6호
    • /
    • pp.993-1004
    • /
    • 2017
  • 표본조사에서는 추정의 정확성 및 정밀성 향상을 위해 흔히 층화추출법을 사용하며 층 내에서는 동일한 표본 가중치를 이용하여 표본을 추출한다. 그러나 실제 응답률은 관심변수 값에 영향을 받을 수 있기 때문에 주어진 동일한 가중치는 응답률을 반영하여 보정되어야 한다. 또한 관심변수가 연속형 보조변수와 선형 관계가 있고 보조변수를 기준으로 층이 나누어진 경우에는 층 내에서 동일한 가중치를 사용하는 것 보다 층을 세분화한 후 얻어진 가중치를 사용하는 것이 효과적일 수 있다. 본 연구에서는 응답률이 관심변수 자료 값의 지수함수이고, 관심변수가 보조변수와 선형 관계가 있을 때 정보적 표본설계 기법을 이용하여 추정의 정확성과 정밀성을 높이는 방법을 제안하였다. 또한 모의실험을 통하여 제안된 방법의 우수성을 확인하였다.

사회조사에서 표본의 왜곡과 가중치 보정의 결과: 18개 사례연구 (Sample Distortion in Social Surveys and Effects of Weighting Adjustment: A Study of 18 Cases)

  • 허명회;윤영아;이용구
    • 한국조사연구학회지:조사연구
    • /
    • 제5권2호
    • /
    • pp.31-48
    • /
    • 2004
  • 우리나라에서 수행되는 사회조사들은 대부분 지역, 성과 나이대를 고려한 할당추출법(quota sampling)을 사용하며 전화번호부를 표집틀로 한 전화조사가 주류를 이룬다. 이러한 표본들이 지역, 성, 나이대 외의 인구사회적 속성 측면에서 모집단을 잘 대표하는지, 아니면 일정 방향으로 기울어져 있는지를 검토할 필요가 있다. 또한 표본 편향을 줄이기 위하여 가중법을 적용하는 경우 조사 결과에 어떤 영향을 주는가를 살펴볼 필요가 있다. 이 연구는 2000년부터 2003년 사이에 전화조사로 수행된 18례의 사회조사에서 표본의 모집단 대표성을 지역, 성. 나이대, 학력과 직업 측면에서 살펴본 것이다. 사례들을 종합한 결과, 지역, 성과 나이대를 보정한다고 하더라도 표본들에서 고학력자와 가정주부가 과다하고 반면 저학력자와 자영업/블루칼러, 화이트칼러가 과소한 것으로 나타났다. 학력과 직업에서의 왜곡은 많은 사회조사에서 본조사 항목의 편향을 초래할 가능성이 있다. 반복비례가중법으로 이러한 표본왜곡을 시정하여 보았더니 본조사 항목에서 원조사 결과와 상당한 차이가 나타났다. 가중치 보정을 하면 유효표본크기가 감소하는 결과가 초래되는데, 각 조사가 명목적으로 제시하는 일정 수준의 오차한계를 지키기 위해서는 현재보다 20~4-% 정도 표본을 크게 해야 한다는 결론을 얻었다.

  • PDF

지역교육청 수요자 만족도조사를 위한 표본설계에 관한 연구 (A sample survey design for service satisfaction evaluation of regional education offices)

  • 허순영;장덕준
    • Journal of the Korean Data and Information Science Society
    • /
    • 제21권4호
    • /
    • pp.669-679
    • /
    • 2010
  • 지역교육청 수요자 만족도조사를 위한 표본설계는 경상남도의 2009년 경남지역교육청 고객만족도 조사의 표본크기에 기초하여 시 군별 지역교육청평가에 맞추어 설계하였다. 대도시의 구단위 지역 교육청과 달리 지방의 시 군 교육청은 학생수와 학교수, 학급당 학생수 등의 변동이 크다. 시간 비용 등을 고려하여 전체 표본크기를 작게 하면서도 각 시 군 교육청 평가에 필요한 최소표본수를 확보하도록 설계하였다. 경상남도는 10개의 시지역과 10개의 군지역을 가지고 있고, 학생수가 상대적으로 작은 군지역교육청 평가에 필요한 최소표본수를 확보하기위해 지역별 평가에 필요한 최소표본을 우선배분한 후, 나머지는 지역별 학급수에 비례배분하였고, 표본학교는 지역과 학교설립유형별로 층화하여 학급수에 비례하여 추출하였다. 표본학교 내에서 조사대상 학생은 2단집락추출하였다. 지역별 추출율의 상이함을 보정하기 위해 가중치를 산정하였다. 조사자료의 분석은 가중치를 적용하여 가중평균, 가중총합 등을 이용하며, 분산의 추정은 통계소프트웨어에서 제공하는 균형반복복제, 잭나이프, 선형화방법 등을 사용할 수 있다.

표본의 대표성, 비편향성 그리고 효율성

  • 김규성
    • 한국통계학회:학술대회논문집
    • /
    • 한국통계학회 2004년도 학술발표논문집
    • /
    • pp.149-154
    • /
    • 2004
  • 이 논문에서는 표본조사에서 자주 사용되는 표본의 대표성, 비편향성, 그리고 효율성에 개넘에 대하여 고찰하였다. 표본의 대표성은 조사단위의 포함확률로 표현되며 조사모집단의 포함범위와 연관이 있는 반면, 비편향성과 효율성은 표집설계와 추정량에 관련된 개념이다. 비편향성과 효율성은 표본의 대표성을 전제로 하며 가중치 부여로 나타난다

  • PDF