목록확률표집 (2)
생활속 기초 통계 이해
표본오차와 비표본오차는 어디서 갈리는가조사 결과에서 오차를 읽을 때는 숫자의 크기보다 발생 지점을 먼저 구분해야 한다. 표본오차는 모집단 전체가 아니라 일부를 확률적으로 뽑아 조사하기 때문에 생기는 우연한 차이다. 같은 모집단에서 같은 절차로 표본을 반복해 뽑으면 연령 구성이나 찬성 비율이 조금씩 달라지는 현상이 여기에 해당한다. 표집 방법이 적절하다는 전제 아래 표본 수를 늘리면 이런 변동은 대체로 줄어든다.비표본오차는 조사 명단 작성, 응답, 질문, 기록, 자료 처리 등 표집 이외의 과정에서 발생한다. 연락처가 없는 사람이 처음부터 빠지거나, 특정 집단이 유독 응답하지 않거나, 질문 표현이 답을 유도하거나, 입력 과정에서 값이 바뀌는 경우다. 표본 수를 늘려도 동일한 누락과 잘못된 측정이 반복되면 결..
설문 전에 어떤 조건을 정해야 할까요?필요한 응답자 수는 조사 목적에서 출발합니다. 전체 찬성 비율을 한 번 추정하려는 조사와 연령대별 차이를 비교하려는 조사는 같은 300명을 모아도 충분성의 기준이 다릅니다. 표본 수 계산은 정답을 자동으로 내는 절차가 아니라, 어느 정도의 불확실성을 감수하고 누구의 의견을 추정할지 기록하는 과정입니다.단일 비율을 추정한다면 신뢰수준, 허용 오차, 예상 비율을 정해야 합니다. 95% 신뢰수준은 같은 표집 절차를 반복했을 때 그렇게 만든 신뢰구간의 약 95%가 모집단의 참값을 포함한다는 뜻입니다. 이번 표본에서 참값이 들어 있을 확률이 95%라는 의미로 해석해서는 안 됩니다.허용 오차는 결과를 어느 폭으로 제시할지 정하는 값입니다. ±5%포인트와 ±3%포인트는 숫자만 보..