일배체형 분석 (Haplotype analysis)
쉽게 풀면
일배체형 분석은 한 염색체 위에 나란히 놓인 여러 유전 표지들이 어떤 조합으로 함께 유전되는지를 살펴보는 방법입니다. 같은 염색체 가닥 위에 있는 표지들은 재조합이 일어나지 않는 한 세트로 함께 자손에게 전달되기 때문에, 이 조합 패턴을 비교하면 집안 간 혈연관계나 질병 원인 영역을 추적할 수 있습니다. 조상 추적이나 법유전학에서도 활용됩니다.
왜 중요한가
일배체형 분석은 개별 유전 변이 하나만 보는 것보다 염색체 위에서 함께 유전되는 변이들의 조합을 살펴볼 수 있어, 질병과 관련된 유전 영역을 더 정밀하게 좁혀내는 데 도움이 됩니다. 이 때문에 유전역학, 집단유전학, 조상 및 혈연관계 추적, 법유전학 등 폭넓은 분야에서 활용되며, 특히 대규모 유전체 연관 연구에서는 일배체형 정보를 이용해 통계적 검정력을 높이거나 원인이 되는 변이의 위치를 좁혀나가는 데 쓰입니다.
논문에서는 이렇게 쓰입니다
질병군과 대조군 사이에서 특정 대립유전자 조합의 빈도 차이를 비교한 연구 결과 예문이다.
집단유전학 연구에서는 일배체형 분석을 이용해 인구 집단의 이주 역사나 조상 계통을 추적하는 데 활용합니다.
법유전학 분야에서는 일배체형 정보를 이용해 혈연관계나 신원 확인에 참고할 단서를 제공하는 방식으로 이 기법이 쓰입니다.
조금 더 깊게 보면
일배체형을 정확히 결정하려면 어느 변이들이 같은 염색체 가닥(즉 같은 부모로부터 온 사본) 위에 놓여 있는지를 알아야 하는데, 이를 위상(phasing)이라 부르며 가족 구성원의 유전자형을 함께 이용하거나 통계적 알고리즘으로 추정하는 방식이 흔히 쓰입니다. 서로 가까이 있는 변이들은 세대를 거치며 재조합이 잘 일어나지 않아 함께 유전되는 경향(연관불평형)이 강한데, 이 성질을 이용하면 실제로 측정하지 않은 변이의 정보를 주변 변이로부터 추정하는 유전체 임퓨테이션도 가능해집니다. 다만 재조합이 얼마나 자주 일어나는지는 염색체 위치와 집단에 따라 달라, 일배체형 블록의 크기와 신뢰도는 연구마다 차이가 날 수 있습니다.
주의할 점
일배체형은 개별 SNP보다 정보량이 많지만, 정확한 위상 결정을 위해서는 가족 데이터나 통계적 위상 추정 알고리즘이 필요하다.