계열 분석 (Sequence Analysis)

연구방법론
한 줄 정의: 사람이나 조직이 거쳐 가는 상태의 순서 전체를 하나의 자료로 보고 비교·유형화하는 분석 방법입니다.

쉽게 풀면

예를 들어 한 사람의 20대를 '학생-구직-정규직-휴직-정규직'처럼 해마다 상태를 이어 붙이면 하나의 계열이 됩니다. 계열 분석은 이런 계열들이 서로 얼마나 비슷한지 거리를 계산하고, 비슷한 사람끼리 묶어 전형적인 경로 유형을 찾아냅니다. 한 시점의 상태가 아니라 궤적 전체를 비교한다는 점이 핵심입니다.

왜 중요한가

취업·가족 형성·은퇴 같은 생애경로 연구에서 '어떤 경로를 거쳤는가'를 직접 다룰 수 있어 사회학, 인구학, 노동경제학에서 많이 쓰입니다. 발견된 경로 유형을 다시 회귀분석의 결과나 설명변수로 활용하기도 합니다.

논문에서는 이렇게 쓰입니다

"15세부터 35세까지의 월별 교육·고용 상태 계열에 최적정합(optimal matching) 거리를 적용하고 군집분석을 통해 6개의 이행 경로 유형을 도출하였다."

청년들의 학교-일 이행 궤적을 거리로 비교해 대표적인 경로 여섯 가지로 묶었다는 뜻입니다.

조금 더 깊게 보면

사회과학의 계열 분석은 사회학자 Andrew Abbott이 1980년대에 생물정보학의 서열 정렬 기법을 도입하면서 확산되었습니다. 대표적 거리 척도인 최적정합은 한 계열을 다른 계열로 바꾸는 데 필요한 삽입·삭제·대체 비용의 최소 합으로 정의되며, 비용 설정에 따라 결과가 달라집니다. 여러 영역의 계열을 동시에 다루는 다채널 계열 분석, 상태 전이와 지속 기간을 강조하는 대안 척도들도 개발되었습니다.

주의할 점

대체·삽입 비용 설정과 군집 수 결정이 결과에 큰 영향을 주므로 민감도 분석이 필요합니다. 기존 항목 잠재성장곡선모형이 연속 변수의 변화율을 모형화한다면, 계열 분석은 범주형 상태의 순서와 지속 전체를 비교한다는 점이 다릅니다.

관련 용어