연관분석 (Linkage analysis)
쉽게 풀면
연관분석은 한 가족 안에서 병에 걸린 사람과 걸리지 않은 사람들의 유전자 표지를 비교해서, 병을 일으키는 유전자가 염색체 어디쯤에 있는지 좁혀나가는 방법입니다. 감수분열 과정에서 가까이 있는 유전자들은 함께 전달되는 경향이 있다는 원리를 이용합니다. 단일 유전자 질환을 일으키는 희귀 가계 연구에서 특히 강력한 도구로 쓰입니다.
왜 중요한가
연관분석은 원인을 알 수 없는 유전질환의 책임 유전자를 찾아가는 초기 단계에서 대상 범위를 넓은 염색체 전체에서 좁은 후보 구간으로 줄여주기 때문에, 이후의 정밀한 유전자 검사나 시퀀싱 작업을 훨씬 효율적으로 만들어줍니다. 특히 특정 가계에서만 관찰되는 희귀 유전질환의 경우 다른 방법으로는 원인 유전자를 좁히기 어려운 경우가 많아, 유전학·의학 연구에서 새로운 질환 유전자를 발견하는 전통적이고 핵심적인 방법으로 자리 잡아 왔습니다.
논문에서는 이렇게 쓰입니다
가계 데이터를 이용해 원인 유전자 위치를 특정 염색체 구간으로 좁힌 결과를 보고하는 예문이다.
신경유전학 연구에서는 여러 세대의 가계도를 확보할 수 있는 유전성 질환에서 원인 유전자좌를 찾는 데 이 방법이 널리 쓰입니다.
식물육종학 분야에서는 사람이 아닌 작물이나 가축의 교배 집단에서도 특정 형질을 결정하는 유전자좌를 찾는 데 동일한 원리의 연관분석이 활용됩니다.
조금 더 깊게 보면
연관분석의 핵심 지표는 LOD 점수(logarithm of odds)로, 두 유전자좌가 실제로 연관되어 있을 가능성이 우연히 그런 결과가 나올 가능성보다 얼마나 더 높은지를 로그 형태로 나타냅니다. 일반적으로 LOD 점수가 특정 임계값을 넘으면 유의미한 연관으로 판단하며, 이 값은 감수분열 과정에서 두 유전자좌가 재조합 없이 함께 전달된 빈도(재조합 빈도)로부터 계산됩니다. 흔한 복합질환처럼 여러 유전자가 작은 효과를 나누어 갖는 경우에는 가계 기반 연관분석보다 훨씬 많은 무관한 개인들을 비교하는 전장유전체 연관분석(GWAS)이 더 적합한 것으로 알려져 있습니다.
주의할 점
연관분석은 대개 큰 다세대 가계가 필요하며, 산발적으로 발생하는 흔한 복합 질환에는 GWAS보다 효율이 떨어진다.