인구통계와 교육수준 카이제곱 검정 (고급 SPSS)

고급 정량 분석 social spss
예상 소요 시간 25분 (심화)
사전 지식 중급 이상. 기초 통계
표본 크기 기준 최소 50개 관측치 (강력 권장)
통계 가정 독립성, 기대빈도 5 이상
난이도: 고급 — 심화 내용을 포함합니다. 사전 지식이 필요할 수 있습니다.

개요

지역(도시/농촌)과 교육수준(고졸/대졸/대학원) 간의 연관성을 카이제곱 검정(Chi-square test)으로 분석한다. SPSS의 CROSSTABS 명령어를 사용한다.

분석 절차

1단계: 교차표 생성

지역을 행, 교육수준을 열로 하는 교차표를 생성한다. 관측빈도와 기대빈도를 함께 출력한다.

2단계: 카이제곱 검정

Pearson 카이제곱 통계량의 유의확률이 0.05 미만이면 두 변수 간 유의미한 연관성이 존재한다.

3단계: 효과 크기

Phi 계수와 Cramer’s V로 연관성의 강도를 확인한다. 0.1 이하면 약한 연관, 0.3 이상이면 중간 연관, 0.5 이상이면 강한 연관이다.

주의사항

  • 셀당 기대빈도가 5 미만인 셀이 20% 이상이면 Fisher’s exact test를 사용해야 한다
  • 카이제곱 검정은 연관성을 보여줄 뿐 인과관계를 의미하지 않는다
  • 코드 예제

    CROSSTABS
      /TABLES=region BY education_level
      /FORMAT=AVALUE TABLES
      /STATISTICS=CHISQ PHI
      /CELLS=COUNT EXPECTED ROW COLUMN
      /COUNT ROUND CELL.

    참고문헌

    Agresti, A. (2013). Categorical Data Analysis (3rd ed.). Wiley.

    심화 내용

    고급 분석에서는 다음을 추가로 고려해야 합니다:

    • 부트스트래핑(Bootstrapping)을 통한 강건성 검증
    • 교차 검증(Cross-validation)으로 모형 일반화 성능 평가
    • 민감도 분석(Sensitivity Analysis)으로 가정 위반 시 영향 평가

    코드 예제

    SPSS
    CROSSTABS /TABLES=region BY education_level /FORMAT=AVALUE TABLES /STATISTICS=CHISQ PHI /CELLS=COUNT EXPECTED ROW COLUMN /COUNT ROUND CELL.

    참고문헌

    Agresti, A. (2013). Categorical Data Analysis (3rd ed.). Wiley.

    이 방법론과 연결된 콘텐츠