설문조사와 통계 글을 제대로 읽는 법: 표본, 평균, 인과관계
"10명 중 7명이 찬성", "평균 소득 증가", "A를 하는 사람이 더 건강" 같은 문장은 설득력이 있어 보입니다. 하지만 숫자는 어떻게 모으고 어떻게 말하느냐에 따라 전혀 다른 인상을 줍니다. 통계 전문가가 아니어도 몇 가지 질문만 던지면 숫자에 속는 일을 크게 줄일 수 있습니다. 이 글에서는 표본, 비율과 실제 숫자, 평균, 상관과 인과를 차례로 살펴봅니다.
먼저 핵심만
- 누구에게 몇 명에게 어떻게 물었는지가 결과보다 먼저입니다.
- 비율만 보지 말고 실제 인원이나 원래 숫자가 얼마인지 확인하세요.
- 함께 움직인다고 해서 하나가 다른 하나의 원인이라는 뜻은 아닙니다.
먼저 확인할 것: 누구에게, 몇 명에게, 어떻게 물었나
설문 결과를 읽을 때 가장 먼저 볼 것은 조사 대상(표본)입니다. 전체 집단을 골고루 대표하는 사람들에게 물었는지, 특정한 사람들만 응답했는지에 따라 결과의 의미가 완전히 달라집니다.
예를 들어 특정 온라인 커뮤니티 회원만 참여한 투표에서 나온 "80% 찬성"은 전체 국민의 생각이 아니라 그 커뮤니티 회원 중 참여한 사람들의 생각입니다. 스스로 참여한 사람들은 그 주제에 관심이 크거나 의견이 강한 경향이 있어서, 전체 평균과 다를 수 있습니다.
- 조사 대상은 누구인가. 연령, 지역, 직업 등이 전체를 대표하는가
- 응답자는 몇 명인가. 수가 적으면 우연의 영향이 커집니다
- 어떻게 모았는가. 무작위로 연락했는지, 스스로 참여했는지
- 언제 조사했는가. 큰 사건 직후라면 여론이 일시적으로 쏠렸을 수 있습니다
- 조사 주체는 누구인가. 결과로 이익을 얻는 쪽이 직접 한 조사라면 질문 방식을 더 신중하게 봅니다
질문 문장과 보기가 답을 이끌지 않았는지 보기
같은 주제라도 질문 방식에 따라 답이 달라집니다. "안전을 위해 이 제도를 도입하는 데 동의하십니까"와 "이 제도로 불편이 생기는 것에 동의하십니까"는 같은 제도를 다루지만 응답이 다르게 나올 수 있습니다.
보기의 구성도 중요합니다. 긍정 보기가 세 개이고 부정 보기가 한 개라면 긍정 응답이 많아지기 쉽습니다. 기사에 질문 원문이 없다면 결과를 한 단계 낮춰서 받아들이는 편이 안전합니다.
비율과 실제 숫자를 함께 보기
"두 배로 늘었다"는 말은 1명이 2명이 된 경우에도, 1만 명이 2만 명이 된 경우에도 쓸 수 있습니다. 비율만 강조된 기사를 읽을 때는 원래 숫자가 얼마였는지 확인하세요.
또한 어떤 기간을 비교했는지도 봐야 합니다. 유난히 낮았던 시기와 비교하면 증가율이 커 보이고, 유난히 높았던 시기와 비교하면 감소율이 커 보입니다. 비교 기준을 바꾸면 같은 데이터로 반대 이야기를 만들 수 있습니다.
- 퍼센트나 배수가 나오면 '무엇의 몇 퍼센트인가'를 찾습니다.
- 원래 숫자(인원, 금액, 건수)가 기사에 나와 있는지 봅니다.
- 비교하는 기간이나 대상이 공정한지 확인합니다.
- 그래프라면 세로축이 0에서 시작하는지 살펴봅니다. 일부분만 확대하면 작은 차이도 크게 보입니다.
평균의 함정: 평균, 중앙값, 분포
평균은 모든 값을 더해 개수로 나눈 값이라 극단적으로 큰 값 하나에도 크게 움직입니다. 열 명 중 아홉 명이 비슷한 금액을 벌고 한 명이 아주 많이 번다면 평균은 대부분의 사람이 실제로 버는 금액보다 훨씬 높게 나옵니다.
그래서 중앙값(순서대로 세웠을 때 가운데 값)이 함께 제시되는지 보면 좋습니다. 평균과 중앙값의 차이가 크다면 일부 극단값이 평균을 끌어올리거나 끌어내리고 있다는 신호입니다. 평균만 나온 글이라면 '대부분의 사람이 이 정도다'라고 읽지 말고, 값이 얼마나 흩어져 있는지도 생각해 보세요.
상관과 인과를 구분하기
두 가지가 함께 늘거나 줄어든다고 해서 하나가 다른 하나를 일으킨다고 말할 수는 없습니다. 이를 상관관계와 인과관계의 차이라고 합니다. "운동하는 사람이 더 건강하다"는 운동이 건강을 만들었을 수도 있지만, 원래 건강한 사람이 운동을 더 많이 하는 것일 수도 있습니다.
또 눈에 보이지 않는 제3의 요인이 두 현상을 모두 움직일 수도 있습니다. 기사가 "~때문에", "~가 원인"이라고 쓴다면 그 근거가 단순 비교인지, 다른 조건을 통제한 연구인지 확인해 보세요.
기사 한 편을 읽는 연습: 점검 순서
"직장인 10명 중 7명, 이직 고민"이라는 제목을 만났다고 가정해 보겠습니다. 이 한 문장에서도 확인할 것이 여러 가지 있습니다. 직장인 전체를 대표하는 조사인지, 특정 앱이나 사이트 이용자만 응답한 것인지, '고민해 본 적 있다'와 '곧 이직할 계획'은 전혀 다른 질문인데 어느 쪽을 물었는지 알아야 합니다.
또 퍼센트의 분모도 중요합니다. 응답자 전체의 70%인지, 특정 질문에 답한 사람 중의 70%인지에 따라 의미가 달라집니다. 여러 보기를 중복 선택할 수 있었다면 합계가 100%를 넘기도 합니다. 이런 세부 정보는 기사 끝이나 조사 개요에 작게 적혀 있는 경우가 많으니 마지막 문단까지 읽어 보세요.
- 조사 개요(대상, 인원, 방법, 시기)가 기사에 있는가
- 질문 원문과 보기가 공개되어 있는가
- 결과를 해석한 문장이 숫자보다 앞서가고 있지는 않은가
- 조사 결과가 하나의 조사인가, 여러 조사에서 비슷하게 나온 것인가
통계는 거짓말을 하지 않지만, 말하는 방식에 따라 사람을 오해하게 만들 수는 있습니다. 숫자를 만나면 누구에게, 몇 명에게, 비교 기준은 무엇인지, 평균 말고 다른 정보는 없는지 네 가지만 물어보세요. 그것만으로도 기사 한 편을 훨씬 차분하게 읽을 수 있습니다.
함께 읽으면 좋은 글
이 글은 일반적인 정보 제공을 목적으로 하며, 개별 상황에 대한 법률·금융·의료 자문이 아닙니다. 제도와 서비스 화면은 바뀔 수 있으니 중요한 결정 전에는 해당 기관과 서비스의 최신 안내를 확인해 주세요. 잘못된 내용을 발견하시면 문의로 알려 주세요.