확률적 유전형분석 (Probabilistic Genotyping)
쉽게 풀면
범죄 현장에서 나온 DNA는 종종 한 사람이 아니라 여러 사람의 것이 뒤섞여 있거나, 양이 너무 적어서 신호가 흐릿하게 나옵니다. 예전 방식은 사람이 눈으로 피크를 보고 "이 사람 것이 맞다/아니다"를 판단했지만, 혼합 시료가 복잡해지면 사람의 눈만으로는 한계가 있습니다. 확률적 유전형분석은 이런 애매한 신호를 컴퓨터 통계 모델에 넣어, "이 시료에 특정 용의자가 기여했을 확률이 얼마나 되는가"를 숫자로 계산해 줍니다. 마치 흐릿한 사진 여러 장을 겹쳐놓고 특정 인물이 그 안에 있을 확률을 통계적으로 추정하는 것과 비슷합니다.
왜 중요한가
기존의 수동 해석 방식은 분석자마다 판단이 달라질 수 있어 객관성 문제가 제기되어 왔습니다. 확률적 유전형분석은 동일한 데이터에 동일한 모델을 적용하면 일관된 결과를 낼 수 있어 법정에서의 신뢰성과 재현성을 높이는 방법으로 논의됩니다. 또한 복잡한 혼합 시료나 미량 DNA처럼 과거에는 결론을 내리기 어려웠던 증거도 통계적으로 평가할 수 있게 해 줍니다.
논문에서는 이렇게 쓰입니다
혼합 시료에서 여러 사람의 유전형 조합 후보를 통계적으로 평가하는 데 이 방법이 쓰였다는 뜻입니다.
새로운 통계적 방법과 기존 수동 해석 방법의 결과를 비교 검증하는 연구 맥락에서 사용된 예입니다.
조금 더 깊게 보면
확률적 유전형분석은 크게 정성적 모델과 완전연속모델(fully continuous model)로 나뉘며, 최신 방법은 대립유전자 신호의 세기, 스터터(stutter) 현상, 시료의 열화 정도 등을 함께 고려해 확률을 계산합니다. 결과는 보통 특정 가설(용의자가 기여자다 vs. 무관한 사람이다)을 비교하는 우도비(likelihood ratio) 형태로 제시됩니다. 이 계산은 몬테카를로 시뮬레이션 등 반복적인 통계 기법을 활용하는 경우가 많아 상당한 연산량을 필요로 합니다.
주의할 점
확률적 유전형분석은 "범인이다/아니다"를 단정하는 것이 아니라 통계적 가능성을 제시하는 도구이며, 소프트웨어와 모델 설정에 따라 결과가 달라질 수 있어 검증과 표준화가 계속 논의되고 있습니다.