목록무응답편향 (2)
생활속 기초 통계 이해
표본오차와 비표본오차는 어디서 갈리는가조사 결과에서 오차를 읽을 때는 숫자의 크기보다 발생 지점을 먼저 구분해야 한다. 표본오차는 모집단 전체가 아니라 일부를 확률적으로 뽑아 조사하기 때문에 생기는 우연한 차이다. 같은 모집단에서 같은 절차로 표본을 반복해 뽑으면 연령 구성이나 찬성 비율이 조금씩 달라지는 현상이 여기에 해당한다. 표집 방법이 적절하다는 전제 아래 표본 수를 늘리면 이런 변동은 대체로 줄어든다.비표본오차는 조사 명단 작성, 응답, 질문, 기록, 자료 처리 등 표집 이외의 과정에서 발생한다. 연락처가 없는 사람이 처음부터 빠지거나, 특정 집단이 유독 응답하지 않거나, 질문 표현이 답을 유도하거나, 입력 과정에서 값이 바뀌는 경우다. 표본 수를 늘려도 동일한 누락과 잘못된 측정이 반복되면 결..
무작위로 뽑는다는 말은 무엇일까요?설문 결과를 읽을 때 응답자 수만큼 중요한 질문은 ‘누가 어떤 절차로 조사 대상이 되었는가’입니다. 많은 사람에게 물었더라도 조사원이 만나기 쉬운 사람만 골랐다면 모집단 전체의 생각을 반영하기 어렵습니다. 반대로 대상별 선택 기회를 분명히 하고 정해진 규칙으로 뽑았다면, 표본에서 모집단을 추론할 근거가 생깁니다.단순무작위추출은 모집단의 각 대상이 표본으로 선택될 확률이 같도록 설계하는 확률표본추출입니다. 조사자의 판단이나 접근 편의가 선정 여부를 좌우해서는 안 됩니다. 사람을 아무렇게나 고르는 일상어의 ‘임의 선택’과 통계에서 말하는 ‘무작위’가 다른 이유입니다. 캐나다 통계청의 확률표본추출 안내도 단순무작위추출에서는 모집단의 각 단위가 동일한 선택 기회를 갖는다고 설명..
