PassLab사회조사분석사 2급과목별 문제통계분석과 활용

사회조사분석사 2급 통계분석과 활용 기출변형문제 50제

사회조사분석사 2급 통계분석과 활용 과목 문항입니다. 각 문항의 정답과 해설이 바로 아래에 함께 있습니다.

통계분석과 활용 · 이 페이지 50문항 · 과목 전체 80문항 · 합격 기준 60점

이 과목에서 나오는 것

기술통계(평균·중앙값·최빈값·분산·표준편차·표준오차)와 정규분포·표준정규분포·Z점수가 기초를 이루고, 상관계수의 부호와 크기 해석, 단순·다중회귀분석의 회귀계수 의미와 결정계수 해석, 다중공선성이 이어집니다. 가설검정은 유의수준과 p값 비교로 기각·채택을 판정하는 문항, 제1종 오류와 제2종 오류의 구분이 정석입니다. 검정법 선택 문항이 특히 많은데 독립표본 t검정·대응표본 t검정·분산분석과 사후검정·카이제곱 적합도검정과 독립성검정·비모수검정을 상황별로 골라야 합니다. 계산은 회귀식 대입, Z점수, 68·95퍼센트 규칙 정도로 사칙연산 범위입니다.

먼저 어떤 상황에 어떤 검정을 쓰는지 결정하는 흐름도를 손으로 그려보세요. 두 집단이면 t검정, 셋 이상이면 분산분석, 범주형이면 카이제곱으로 갈라지는 골격만 잡으면 판단형 문항이 빠르게 풀립니다.

문제와 해설

  1. 1자료값을 모두 더한 뒤 자료의 개수로 나눈 값을 무엇이라 하는가? 기본
    1. 평균(mean)
    2. 중앙값
    3. 최빈값
    4. 표준편차

    정답 1번 · 평균(mean)

    해설 평균은 모든 자료값을 더한 뒤 자료 개수로 나눈 값이다.

  2. 2자료를 크기순으로 배열했을 때 가장 중앙에 위치하는 값을 무엇이라 하는가? 기본
    1. 평균
    2. 중앙값(median)
    3. 최빈값
    4. 분산

    정답 2번 · 중앙값(median)

    해설 중앙값은 자료를 크기순으로 배열했을 때 가장 중앙에 위치하는 값이다.

  3. 3자료에서 가장 많이 나타나는(빈도가 가장 높은) 값을 무엇이라 하는가? 기본
    1. 평균
    2. 중앙값
    3. 최빈값(mode)
    4. 표준오차

    정답 3번 · 최빈값(mode)

    해설 최빈값은 자료에서 빈도가 가장 높게 나타나는 값이다.

  4. 4각 자료값이 평균으로부터 떨어진 정도를 제곱하여 평균한 값을 무엇이라 하는가? 기본
    1. 표준편차
    2. 표준오차
    3. 중앙값
    4. 분산(variance)

    정답 4번 · 분산(variance)

    해설 분산은 각 자료값이 평균에서 떨어진 정도를 제곱하여 평균한 값이다.

  5. 5분산의 제곱근으로, 자료의 흩어진 정도를 원래 단위로 나타낸 값은? 기본
    1. 표준편차(standard deviation)
    2. 분산
    3. 평균
    4. 상관계수

    정답 1번 · 표준편차(standard deviation)

    해설 표준편차는 분산의 제곱근으로, 원래 단위로 흩어진 정도를 나타낸다.

  6. 6표본평균이 모집단 평균으로부터 벗어난 정도를 나타내는 값으로, 표본크기가 커질수록 작아지는 것은? 기본
    1. 표준편차
    2. 표준오차(standard error)
    3. 분산
    4. 사분위수

    정답 2번 · 표준오차(standard error)

    해설 표준오차는 표본평균의 변동성을 나타내며, 표본크기가 커질수록 작아진다.

  7. 7정규분포의 특징으로 옳은 것은? 기본
    1. 항상 좌우 비대칭이다
    2. 평균, 중앙값, 최빈값이 모두 다르다
    3. 좌우대칭이며 평균, 중앙값, 최빈값이 모두 일치한다
    4. 항상 0과 1 사이의 값만 가진다

    정답 3번 · 좌우대칭이며 평균, 중앙값, 최빈값이 모두 일치한다

    해설 정규분포는 좌우대칭이며 평균, 중앙값, 최빈값이 모두 일치하는 특징을 가진다.

  8. 8평균이 0, 표준편차가 1인 정규분포를 무엇이라 하는가? 기본
    1. 이산분포
    2. 이항분포
    3. 카이제곱분포
    4. 표준정규분포

    정답 4번 · 표준정규분포

    해설 표준정규분포는 평균 0, 표준편차 1인 정규분포이다.

  9. 9관측값이 평균으로부터 표준편차의 몇 배만큼 떨어져 있는지를 나타내는 표준화된 점수를 무엇이라 하는가? 기본
    1. Z값(표준점수)
    2. p값
    3. R²값
    4. F값

    정답 1번 · Z값(표준점수)

    해설 Z값은 관측값이 평균에서 표준편차의 몇 배만큼 떨어져 있는지를 나타내는 표준화된 점수이다.

  10. 10두 변수 간 선형관계의 방향과 강도를 -1에서 +1 사이의 값으로 나타내는 통계량은? 기본
    1. 회귀계수
    2. 상관계수
    3. 결정계수
    4. 분산

    정답 2번 · 상관계수

    해설 상관계수는 두 변수 간 선형관계의 방향과 강도를 -1~+1 사이 값으로 나타낸다.

  11. 11상관계수가 +1에 가까울수록 어떤 의미인가? 기본
    1. 두 변수 간 상관이 전혀 없다
    2. 강한 음의 상관관계를 가진다
    3. 강한 양의 상관관계를 가진다
    4. 인과관계가 확실히 존재한다

    정답 3번 · 강한 양의 상관관계를 가진다

    해설 상관계수가 +1에 가까울수록 두 변수 간 강한 양의 상관관계를 의미한다.

  12. 12독립변수를 이용해 종속변수의 값을 예측하기 위한 통계기법은? 기본
    1. 상관분석
    2. 기술통계
    3. 빈도분석
    4. 회귀분석

    정답 4번 · 회귀분석

    해설 회귀분석은 독립변수를 이용해 종속변수 값을 예측하는 통계기법이다.

  13. 13하나의 독립변수로 종속변수를 예측하는 회귀분석을 무엇이라 하는가? 기본
    1. 단순회귀분석
    2. 다중회귀분석
    3. 로지스틱회귀분석
    4. 분산분석

    정답 1번 · 단순회귀분석

    해설 단순회귀분석은 하나의 독립변수로 종속변수를 예측하는 회귀분석이다.

  14. 14두 개 이상의 독립변수로 종속변수를 예측하는 회귀분석을 무엇이라 하는가? 기본
    1. 단순회귀분석
    2. 다중회귀분석
    3. 상관분석
    4. 카이제곱분석

    정답 2번 · 다중회귀분석

    해설 다중회귀분석은 두 개 이상의 독립변수로 종속변수를 예측하는 회귀분석이다.

  15. 15회귀모형이 종속변수의 변동을 얼마나 잘 설명하는지를 나타내는 지표는? 기본
    1. 상관계수
    2. 표준오차
    3. 결정계수(R²)
    4. 유의수준

    정답 3번 · 결정계수(R²)

    해설 결정계수(R²)는 회귀모형이 종속변수의 변동을 설명하는 정도를 나타내는 지표이다.

  16. 16연구자가 부정하고자 하는, '차이나 관계가 없다'는 가설을 무엇이라 하는가? 기본
    1. 대립가설
    2. 연구가설
    3. 작업가설
    4. 귀무가설

    정답 4번 · 귀무가설

    해설 귀무가설은 연구자가 부정하고자 하는, 차이나 관계가 없다는 가설이다.

  17. 17연구자가 실제로 입증하고자 하는, 귀무가설과 반대되는 가설을 무엇이라 하는가? 기본
    1. 대립가설
    2. 귀무가설
    3. 영가설
    4. 통계가설

    정답 1번 · 대립가설

    해설 대립가설은 연구자가 실제로 입증하고자 하는, 귀무가설과 반대되는 가설이다.

  18. 18귀무가설이 참인데도 이를 기각할 확률의 최대 허용 기준을 무엇이라 하는가? 기본
    1. 신뢰수준
    2. 유의수준(α)
    3. 결정계수
    4. 표준오차

    정답 2번 · 유의수준(α)

    해설 유의수준(α)은 귀무가설이 참인데도 기각할 확률의 최대 허용 기준이다.

  19. 19귀무가설이 참이라는 가정 하에 관측된 통계치 이상의 극단적 결과가 나타날 확률을 무엇이라 하는가? 기본
    1. 신뢰수준
    2. 검정력
    3. p값(유의확률)
    4. 결정계수

    정답 3번 · p값(유의확률)

    해설 p값은 귀무가설이 참이라는 가정 하에 관측된 결과 이상의 극단적 결과가 나타날 확률이다.

  20. 20참인 귀무가설을 잘못 기각하는 오류를 무엇이라 하는가? 기본
    1. 2종오류
    2. 표집오차
    3. 비표집오차
    4. 1종오류

    정답 4번 · 1종오류

    해설 1종오류는 참인 귀무가설을 잘못 기각하는 오류이다.

  21. 21거짓인 귀무가설을 잘못 채택하는 오류를 무엇이라 하는가? 기본
    1. 2종오류
    2. 1종오류
    3. 표집오차
    4. 측정오차

    정답 1번 · 2종오류

    해설 2종오류는 거짓인 귀무가설을 잘못 채택하는 오류이다.

  22. 22두 집단의 평균을 비교할 때 사용하는 대표적인 통계검정법은? 기본
    1. 카이제곱검정
    2. t검정
    3. 회귀분석
    4. 요인분석

    정답 2번 · t검정

    해설 t검정은 두 집단의 평균을 비교할 때 사용하는 대표적인 검정법이다.

  23. 23동일한 대상에 대해 처치 전-후로 측정한 두 값을 비교할 때 사용하는 검정법은? 기본
    1. 독립표본t검정
    2. 카이제곱검정
    3. 대응표본t검정
    4. 분산분석

    정답 3번 · 대응표본t검정

    해설 대응표본t검정은 동일 대상의 처치 전-후 값을 비교할 때 사용하는 검정법이다.

  24. 24서로 독립적인 두 집단의 평균을 비교할 때 사용하는 검정법은? 기본
    1. 대응표본t검정
    2. 카이제곱검정
    3. 단순회귀분석
    4. 독립표본t검정

    정답 4번 · 독립표본t검정

    해설 독립표본t검정은 서로 독립적인 두 집단의 평균을 비교할 때 사용하는 검정법이다.

  25. 25세 개 이상의 집단 평균을 동시에 비교할 때 사용하는 통계기법은? 기본
    1. 분산분석(ANOVA)
    2. t검정
    3. 상관분석
    4. 카이제곱검정

    정답 1번 · 분산분석(ANOVA)

    해설 분산분석(ANOVA)은 세 개 이상의 집단 평균을 동시에 비교할 때 사용하는 통계기법이다.

  26. 26자료 2, 4, 6, 8, 10의 평균은? 심화
    1. 6
    2. 5
    3. 7
    4. 8

    정답 1번 · 6

    해설 (2+4+6+8+10)÷5=30÷5=6이다.

  27. 27자료 1, 2, 2, 3, 4의 최빈값은? 심화
    1. 1
    2. 2
    3. 3
    4. 4

    정답 2번 · 2

    해설 2가 두 번 나타나 가장 빈도가 높으므로 최빈값은 2이다.

  28. 28자료 3, 7, 7, 19를 크기순으로 배열했을 때 중앙값은? 심화
    1. 3
    2. 19
    3. 7
    4. 13

    정답 3번 · 7

    해설 자료 개수가 4개(짝수)이므로 중앙에 위치한 두 값(2번째, 3번째)인 7과 7의 평균 (7+7)÷2=7이 중앙값이다.

  29. 29표준편차와 분산의 관계를 옳게 설명한 것은? 심화
    1. 표준편차는 분산을 자료개수로 나눈 값이다
    2. 분산은 표준편차의 제곱근이다
    3. 표준편차와 분산은 항상 같은 값이다
    4. 표준편차는 분산의 제곱근이다

    정답 4번 · 표준편차는 분산의 제곱근이다

    해설 표준편차는 분산의 제곱근이며, 분산은 표준편차를 제곱한 값이다.

  30. 30두 변수의 상관계수가 r=0.85로 나타났다면 이에 대한 해석으로 가장 적절한 것은? 심화
    1. 두 변수 사이에 강한 양의 상관관계가 있다
    2. 두 변수 사이에 강한 음의 상관관계가 있다
    3. 두 변수 사이에 상관관계가 거의 없다
    4. 한 변수가 다른 변수의 원인이라고 확정할 수 있다

    정답 1번 · 두 변수 사이에 강한 양의 상관관계가 있다

    해설 r=0.85는 +1에 가까운 값으로 두 변수 사이에 강한 양의 상관관계가 있음을 의미한다.

  31. 31두 변수의 상관계수가 r=-0.9로 나타났다면 이에 대한 해석으로 가장 적절한 것은? 심화
    1. 상관관계가 거의 없다
    2. 한 변수가 증가할 때 다른 변수는 강하게 감소하는 관계이다
    3. 두 변수는 서로 무관하다
    4. 두 변수는 같은 방향으로 강하게 증가한다

    정답 2번 · 한 변수가 증가할 때 다른 변수는 강하게 감소하는 관계이다

    해설 r=-0.9는 -1에 가까운 값으로 한 변수가 증가할 때 다른 변수가 강하게 감소하는 음의 상관관계를 의미한다.

  32. 32회귀식이 Y=2+3X로 추정되었을 때, X=5일 때 예측되는 Y값은? 심화
    1. 15
    2. 13
    3. 17
    4. 10

    정답 3번 · 17

    해설 Y=2+3×5=2+15=17이다.

  33. 33단순회귀분석에서 회귀계수(기울기)가 의미하는 것은? 심화
    1. 종속변수가 1단위 증가할 때 독립변수의 평균 변화량
    2. 독립변수와 종속변수 간 상관계수의 크기
    3. 모형이 설명하는 분산의 비율
    4. 독립변수가 1단위 증가할 때 종속변수의 평균 변화량

    정답 4번 · 독립변수가 1단위 증가할 때 종속변수의 평균 변화량

    해설 회귀계수(기울기)는 독립변수가 1단위 증가할 때 종속변수의 평균 변화량을 의미한다.

  34. 34회귀분석 결과 결정계수 R²=0.64로 나타났다면 이에 대한 해석으로 가장 적절한 것은? 심화
    1. 독립변수가 종속변수 분산의 64%를 설명한다
    2. 독립변수와 종속변수의 상관계수가 0.64이다
    3. 회귀식의 오차가 64%이다
    4. 표본의 64%가 정규분포를 따른다

    정답 1번 · 독립변수가 종속변수 분산의 64%를 설명한다

    해설 결정계수 R²=0.64는 독립변수가 종속변수 분산의 64%를 설명한다는 의미이다.

  35. 35유의수준 0.05로 검정한 결과 p값이 0.03으로 나타났다면 내려야 할 결론으로 가장 적절한 것은? 심화
    1. 귀무가설을 채택한다
    2. 귀무가설을 기각하고 대립가설을 지지한다
    3. 검정을 다시 수행할 필요가 없다는 것 외에는 결론을 내릴 수 없다
    4. 표본크기가 부족하다고 판단한다

    정답 2번 · 귀무가설을 기각하고 대립가설을 지지한다

    해설 p값(0.03)이 유의수준(0.05)보다 작으므로 귀무가설을 기각하고 대립가설을 지지한다.

  36. 36유의수준 0.05로 검정한 결과 p값이 0.08로 나타났다면 내려야 할 결론으로 가장 적절한 것은? 심화
    1. 귀무가설을 기각한다
    2. 대립가설이 확실히 참이다
    3. 귀무가설을 기각할 만한 충분한 근거가 없다(채택)
    4. 1종오류가 발생했음이 확인되었다

    정답 3번 · 귀무가설을 기각할 만한 충분한 근거가 없다(채택)

    해설 p값(0.08)이 유의수준(0.05)보다 크므로 귀무가설을 기각할 근거가 부족하다.

  37. 37실제로는 참인 귀무가설을 검정 결과 기각해버렸다면 이는 어떤 오류에 해당하는가? 심화
    1. 2종오류
    2. 표집오차
    3. 비표집오차
    4. 1종오류

    정답 4번 · 1종오류

    해설 참인 귀무가설을 잘못 기각하는 것은 1종오류이다.

  38. 38실제로는 거짓인 귀무가설을 검정 결과 채택해버렸다면 이는 어떤 오류에 해당하는가? 심화
    1. 2종오류
    2. 1종오류
    3. 표집오차
    4. 측정오차

    정답 1번 · 2종오류

    해설 거짓인 귀무가설을 잘못 채택하는 것은 2종오류이다.

  39. 39표본크기가 커질수록 표준오차는 일반적으로 어떻게 변하는가? 심화
    1. 커진다
    2. 작아진다
    3. 변하지 않는다
    4. 항상 0이 된다

    정답 2번 · 작아진다

    해설 표준오차=표준편차÷√n 이므로 표본크기(n)가 커질수록 표준오차는 작아진다.

  40. 40중심극한정리에 대한 설명으로 가장 정확한 것은? 심화
    1. 모집단이 반드시 정규분포를 따라야만 적용된다
    2. 표본크기가 작을수록 표본평균의 분포가 정규분포에 가까워진다
    3. 표본크기가 충분히 크면 모집단의 분포와 무관하게 표본평균의 분포가 정규분포에 근사한다
    4. 표본의 분산은 항상 모집단의 분산보다 크다

    정답 3번 · 표본크기가 충분히 크면 모집단의 분포와 무관하게 표본평균의 분포가 정규분포에 근사한다

    해설 중심극한정리는 표본크기가 충분히 크면 모집단의 분포 형태와 무관하게 표본평균의 분포가 정규분포에 근사한다는 정리이다.

  41. 41정규분포에서 평균을 중심으로 ±1표준편차 구간에 포함되는 자료의 비율은 약 얼마인가? 심화
    1. 50%
    2. 95%
    3. 99%
    4. 68%

    정답 4번 · 68%

    해설 정규분포에서 평균±1표준편차 구간에는 약 68%의 자료가 포함된다.

  42. 42정규분포에서 평균을 중심으로 ±2표준편차 구간에 포함되는 자료의 비율은 약 얼마인가? 심화
    1. 95%
    2. 68%
    3. 50%
    4. 99.7%

    정답 1번 · 95%

    해설 정규분포에서 평균±2표준편차 구간에는 약 95%의 자료가 포함된다.

  43. 43어떤 자료값이 70이고, 평균이 60, 표준편차가 5일 때 이 값의 Z점수는? 심화
    1. 1
    2. 2
    3. 3
    4. 0.5

    정답 2번 · 2

    해설 Z=(70-60)÷5=10÷5=2이다.

  44. 44서로 독립적인 두 집단(예: 남/여)의 평균 차이를 검정하기에 가장 적합한 방법은? 심화
    1. 대응표본t검정
    2. 카이제곱검정
    3. 독립표본t검정
    4. 단순회귀분석

    정답 3번 · 독립표본t검정

    해설 서로 독립적인 두 집단의 평균 차이 검정에는 독립표본t검정이 적합하다.

  45. 45다이어트 프로그램 시행 전과 후, 동일한 사람들의 체중을 비교할 때 가장 적합한 검정법은? 심화
    1. 독립표본t검정
    2. 카이제곱검정
    3. 분산분석
    4. 대응표본t검정

    정답 4번 · 대응표본t검정

    해설 동일한 대상의 처치 전후 비교에는 대응표본t검정이 적합하다.

  46. 46세 가지 교육방법(A, B, C)에 따른 시험점수 평균을 동시에 비교하려면 가장 적합한 방법은? 심화
    1. 분산분석(ANOVA)
    2. 독립표본t검정
    3. 카이제곱검정
    4. 상관분석

    정답 1번 · 분산분석(ANOVA)

    해설 세 집단 이상의 평균을 동시에 비교하려면 분산분석(ANOVA)이 적합하다.

  47. 47성별(남/여)과 지지정당(A/B/C) 두 범주형 변수 사이에 관련성이 있는지를 검정하기에 적합한 방법은? 심화
    1. t검정
    2. 카이제곱 독립성검정
    3. 회귀분석
    4. 분산분석

    정답 2번 · 카이제곱 독립성검정

    해설 두 범주형 변수 간 관련성 검정에는 카이제곱 독립성검정이 적합하다.

  48. 48카이제곱검정은 어떤 값들의 차이를 이용하여 통계량을 계산하는가? 심화
    1. 두 집단의 평균값
    2. 두 변수의 상관계수
    3. 관측빈도와 기대빈도
    4. 회귀계수와 절편

    정답 3번 · 관측빈도와 기대빈도

    해설 카이제곱검정 통계량은 관측빈도와 기대빈도의 차이를 이용해 계산한다.

  49. 49자료가 정규분포를 따르지 않고 표본크기도 작을 때, t검정 대신 사용할 수 있는 검정방식은? 심화
    1. 분산분석
    2. 회귀분석
    3. 카이제곱 적합도검정
    4. 비모수검정(예: 만-휘트니 U검정)

    정답 4번 · 비모수검정(예: 만-휘트니 U검정)

    해설 정규성 가정이 위반되고 표본크기가 작을 때는 비모수검정(예: 만-휘트니 U검정)을 사용한다.

  50. 50자료의 분포가 오른쪽으로 긴 꼬리를 가질 때(왜도>0), 평균과 중앙값의 관계로 가장 적절한 것은? 심화
    1. 평균이 중앙값보다 크다
    2. 평균이 중앙값보다 작다
    3. 평균과 중앙값이 항상 같다
    4. 최빈값이 평균보다 항상 크다

    정답 1번 · 평균이 중앙값보다 크다

    해설 오른쪽으로 긴 꼬리(양의 왜도)를 가지면 극단적으로 큰 값들이 평균을 끌어올려 평균이 중앙값보다 크다.

일정·응시자격 등 제도 정보는 한국산업인력공단 큐넷에서 확인하세요. 이 페이지에는 50문항을 실었습니다. 통계분석과 활용 과목 전체 80문항과 사회조사분석사 2급 전체 240문항은 무료 학습 페이지에서 난이도별 문제풀이·실전 모의고사·암기카드로 풀 수 있습니다. 모든 문항은 PassLab이 출제 기준을 분석해 직접 만든 자작 문항이며, 실제 기출문제를 복제하지 않습니다.