공간군집분석 (Spatial Clustering Analysis)
쉽게 풀면
지도에 점을 찍어 놓고 "이 점들이 우연히 이렇게 모였을까, 아니면 어떤 이유로 뭉쳤을까"를 확인하는 작업이라고 생각하면 됩니다. 예를 들어 특정 동네에 범죄가 유독 많이 발생한다면, 그것이 단순한 우연인지 아니면 실제로 그 지역에 원인이 있는지를 통계적으로 검증하는 것입니다. 사람이 눈으로 지도를 보고 "여기 뭔가 모여 있는 것 같다"고 느끼는 감각을 숫자와 검정 절차로 뒷받침해주는 도구입니다. 결과적으로 어디가 실제로 유의미하게 뭉쳐 있는지 짚어낼 수 있습니다.
왜 중요한가
지도학 및 공간분석 연구에서는 질병 발생, 범죄, 소득 수준 등 다양한 현상이 지역별로 균등하지 않게 나타납니다. 공간군집분석은 이러한 불균형이 우연인지 통계적으로 의미 있는 패턴인지 구분해주기 때문에 정책 수립이나 자원 배분의 근거로 자주 활용됩니다. 지도 시각화만으로는 놓치기 쉬운 유의미한 밀집 지역을 객관적으로 찾아낼 수 있습니다.
논문에서는 이렇게 쓰입니다
지도 위 특정 지역이 단순 우연이 아니라 통계적으로 의미 있는 밀집 지역임을 보여주는 예문입니다.
공간군집분석이 보건 분야 데이터에서 지역적 발생 패턴을 찾는 데 쓰인 사례입니다.
조금 더 깊게 보면
대표적인 기법으로는 전역적 군집 여부를 판단하는 Moran's I, 국지적으로 어느 지점이 군집을 이루는지 보여주는 LISA(Local Indicators of Spatial Association), 그리고 핫스팟을 탐지하는 Getis-Ord Gi* 등이 있습니다. 이러한 방법들은 공간적 자기상관(spatial autocorrelation) 개념에 기반하며, 인접한 지역일수록 값이 비슷할 가능성이 높다는 전제를 통계적으로 검증합니다.
주의할 점
군집이 탐지되었다고 해서 그 원인까지 밝혀지는 것은 아니며, 인접성 정의 방식이나 분석 단위(행정구역 크기 등)에 따라 결과가 달라질 수 있다는 점에 유의해야 합니다.