고유전체학 연구에서 확보되는 매우 오래되고 열악한 샘플로부터 추출된 고유전체 데이터는 과거 생물 다양성 복원에 필수적이지만, 높은 수준의 DNA 단편화와 낮은 커버리지라는 근본적인 난제를 안고 있다.
해석상의 주요 난제
- 불완전한 재조합 및 누락: 심각한 DNA 손상은 유전자 조각의 완전한 재조합을 어렵게 하여, 일부 유전적 변이 정보가 완전히 누락될 위험이 크다.
- 데이터 편향성 문제: 기존의 차세대 염기서열 분석 파이프라인은 현대 게놈 구조에 최적화되어 있어, 극도의 퇴행적 게놈을 가진 화석 샘플에 적용 시 치명적인 데이터 편향을 유발할 수 있다.
접근법 비교 및 전망
현재는 단순 염기서열 재구성을 넘어, 시스템 생물학적 접근을 통해 부분적인 정보를 바탕으로 해당 시기의 생태적 압력이나 진화생물학적 사건을 추론하려는 시도가 이루어지고 있으나, 이는 필연적으로 해석의 폭을 넓히는 방식으로 진행된다. 향후에는 더 정교한 생물정보학 기반의 희소 데이터 복원 모델 개발이 요구된다.
댓글 0