여기에 제시된 프로토콜은 딱정벌레에서 생성된 시토크롬 c 산화효소 소단위 I(COI) 유전자 염기서열의 컴퓨터 기반 처리에 대해 사용자를 안내하는 것을 목표로 하며, 이를 통해 분자 연산 분류학 단위(MOTU)라고 하는 종 클러스터링 가설이 DNA에서 생성될 수 있습니다.
이 콘텐츠를 보려면 JoVE 구독이 필요합니다. 로그인하거나 오늘 무료 평가판을 시작하세요.
방법 논문
여기에 제시된 프로토콜은 딱정벌레에서 생성된 시토크롬 c 산화효소 소단위 I(COI) 유전자 염기서열의 컴퓨터 기반 처리에 대해 사용자를 안내하는 것을 목표로 하며, 이를 통해 분자 연산 분류학 단위(MOTU)라고 하는 종 클러스터링 가설이 DNA에서 생성될 수 있습니다.
생물다양성 감소는 상상할 수 없는 속도로 진행되고 있지만, 생물다양성 모니터링은 기준선 다양성의 불완전한 목록과 숙련된 분류학자의 인구 감소를 포함한 다양한 요인으로 인해 방해를 받고 있습니다. "암흑 분류군(dark taxa)" 또는 분류학에서 종종 연구되지 않은 초다양성 그룹의 종 목록에서 이러한 장애물을 해소하는 것은 극복할 수 없는 환경 압력에 직면한 열대 지방에서 특히 중요합니다. 형태학 기반 알파 분류법은 종 식별의 황금 표준으로 남아 있지만, DNA 기반 방법은 종 묘사 및 발견을 가속화하는 데 엄청난 잠재력을 보여주고 있습니다. 여기에서는 눈에 잘 띄지 않는 두 개의 딱정벌레 속, 즉 Limnichidae 계통의 Byrrhinus Motschulsky(1858년)와 필리핀의 Hydrophilidae 계통의 Anacaena Thomson(1859년)에 대해 구현된 6개의 분자 종 구분 접근 방식을 포함하는 분자 연산 분류 단위(MOTU)를 생성하기 위한 혼합물 파이프라인을 설명합니다. 이 프로토콜은 DNA 바코드 처리에 중점을 두고 있으며 이러한 유전자 데이터는 염기서열분석 또는 온라인 데이터베이스에서 다운로드하여 얻을 수 있다는 점을 감안할 때 여기에 설명된 프로토콜의 시작점은 DNA 염기서열입니다. COI 바코드를 감안할 때 파이프라인은 서열 정렬을 입력 데이터로 사용하는 TaxonDNA, K2P 및 ASAP의 세 가지 임계값 기반 분자 종 구분 접근 방식의 조합을 활용합니다. 또한 파이프라인은 입력 데이터로 트리 파일이 필요한 PTP-ML, PTP-BI 및 mPTP의 세 가지 통합 기반 접근 방식으로 진행됩니다. 일부 접근 방식은 웹 서버 사용을 수반하는 반면 다른 접근 방식은 로컬 소프트웨어를 사용합니다. 제시된 알고리즘 방법의 선택으로 MOTU는 합의 또는 다수결에 의해 식별될 수 있습니다. 놀랍게도, 이 파이프라인은 필리핀에서 거의 눈에 띄는 딱정벌레 종을 묘사했으며, 심지어 동일하거나 인접한 지역에서 기록된 종도 표시했습니다.
다양한 분류군 1,2,3,4에 걸쳐 전 세계 종이 전례 없는 감소율로 인해 이전에 발견되지 않고 설명되지 않은 종을 포함하는 포괄적인 생물 다양성 목록을 작성하려는 추진력은 시간과의 경쟁이 되고 있습니다 2,5. 우선, 생물다양성 보전은 적절한 분류학적 지식에 비추어야만 의미가 있다 6,7. 그러므로, 종 수준에서 생물다양성을 규명하는 것은 밀접하게 관련되어 있지만 서로 다른 종들이 독특한 근본적인 틈새를 가질 수 있다는 점을 감안할 때 필요하다8.
딱정벌레 계통학에서 알파 분류학(alpha-taxonomy) 또는 전통적인 분류학(traditional taxonomy)은 전부는 아니더라도 대부분의 동물 그룹9과 유사한 종 식별의 황금 표준입니다. 이 접근 방식은 형태학적 특성에 의존하여 더 높은 분류법에서 유기체를 분류하고 종 수준10,11에서 식별을 제공합니다. 많은 경우에서, 과(family)12 또는 심지어 속(genus) 수준 식별13은 신체 형태 및 특화된 적응(specialized adaptations)과 같은 외적 형태학적 특징만을 사용하여 수행될 수 있다. 한편, 딱정벌레의 종 수준 식별은 일반적으로 aedeagus 또는 남성 생식기의 구조적 세부 사항의 비교를 통해 수행됩니다 14,15,16.
이러한 형태학 기반 알파 분류학이 널리 받아들여지고 있음에도 불구하고, 종 발견에 대한 이러한 접근 방식은 특히 무척추 동물19에서 수많은 '분류학적 장애물'6,17,18에 의해 방해를 받고 있습니다. 딱정벌레 계통학에서 알파 분류학을 사용한 종 식별 및/또는 발견은 제한된 수의 숙련된 분류학자20,21, 간략하고 거의 유익하지 않은 초기 설명22, 문헌 및 유형 표본23에 대한 접근과 관련된 물류 문제에 직면해 있습니다.
이것은 문제의 분류군이 비밀스럽거나 매우 눈에 띄지 않을 때 더욱 악화됩니다. 수수께끼 종(Cryptic species)은 같은 속(genus) 또는 심지어 다른 속(genera)의 종들의 집합을 말하며, 미묘한 종간 표현형의 차이를 감안할 때 비교 형태학으로 쉽게 설명할 수 없다24. '어두운 분류군'25,26,27으로 간주되는 일부 수수께끼 분류군은 또한 매우 다양하지만 연구가 많이 부족합니다. 불행히도, 이것은 강기슭 및 수생 딱정벌레에서 드문 일이 아닙니다 8,28. 수수께끼 같은 어두운 분류군 사이의 종 묘사를 해결하지 못하면 잠재적으로 다른 틈새와 생태학적 요구 사항을 가진 유기체에 대해 획일적인 보존 조치가 제공되기 때문에 생물 다양성을 위협합니다 8,29.
이러한 도전을 감안할 때, '통합적 분류학'23 또는 알파 분류학을 다른 증거와 결합하는 접근 방식은 지난 20년 동안 새로운 종을 세우는 수단으로 견인력을 얻었습니다 30,31,32. 딱정벌레 33,34,35,36,37,38,39 및 기타 곤충 목 40,41,42,43,44,45에 대한 통합 분류 학적 연구에 사용되는 증거 중 하나는 DNA 염기서열입니다. 특히, 미토콘드리아 시토크롬 c 산화효소 소단위 I(COI) 유전자는 적당히 보수적인 특성으로 인해 다양한 동물 세트를 바코드로 만드는 데 사용되고 있습니다 46,47,48. '바코드 단편' 또는 '폴머 단편'으로도 알려진 658bp 길이의 5'말단(COI-5')이 '진단' 서열49로 제안되었지만, 3'말단50,51,52를 위한 견고한 프라이머 세트로 인해 723bp 길이의 COI-3'도 사용되고 있습니다.
COI를 이용한 DNA 바코딩은 종 수준 동정을 위해 고안되었지만, GenBank54 및 BOLD55와 같은 선험적 서열 저장소(53)에 의해 제한되며, 분자 종 구분 접근법은 전제 조건 저장소56 없이 제공된 DNA 염기서열만을 사용하여 종 한계를 설정한다. 입력 파일을 기반으로 하는 분자 종 구분 접근 방식에는 두 가지 클래스가 있습니다. 첫째, 염기서열 정렬을 입력으로 사용하는 임계값 기반 접근 방식은 컷오프 값을 사용하여 종 48,57,58 사이의 발산을 결정합니다. 거리 기반 방법으로서 이러한 접근 방식은 곤충에 대해 관찰된 최대 종내 거리 3%에 의존하며, 이를 '바코드 갭'이라고 합니다51,59. 임계값 기반 접근 방식 중 일부는 TaxonDNA60에서 구현된 SpeciesIdentifier, Kimura 2-parameter(K2P)61을 통한 유전적 거리, ASAP(Assemble Species by Automatic Partitioning)62입니다.
둘째, 트리를 입력 파일로 사용하여 병합 기반 접근 방식은 계통 분기 속도 63,64,66의 변화를 결정하여 종 경계를 식별하고 독립적인 계통을 정렬합니다. 종종 계통발생학적 종 개념67에 의존하는 유착 기반 접근 방식에는 Poisson tree processes (PTP)68 및 그 변형, 다중 속도 PTP69가 포함됩니다. 어쨌든, 분자 종 구분 접근법에 의해 형성된 클러스터는 집합적으로 분자 조작 분류 단위(MOTU)라고 합니다.
여기에서는 세 가지 임계값 기반 접근 방식과 세 가지 유착 기반 접근 방식을 포함하는 MOTU를 생성하기 위한 혼합물 파이프라인 방법을 제시합니다(그림 1). 파이프라인은 두 개의 데이터 세트, 즉 (1) 통합 분류학을 사용하여 이전에 세워진 두 개의 발표된 종 35 딱 정벌레35 딱정벌레의 COI-3' 염기서열과 (2) 1859년 딱정벌레 Anacaena Thomson의 COI-5' 염기서열은 두 개의 발표된 종70 의 염기서열로 구성되어 있습니다 이전에는 알파 분류법과 설명되지 않은 종의 추가 염기서열을 사용하여 세워졌습니다.

그림 1: MOTU를 생성하기 위한 혼합물 파이프라인의 순서도. 이 그림의 더 큰 버전을 보려면 여기를 클릭하십시오.
액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.
이 혼합물 파이프라인의 시작 물질은 온라인 저장소(예: BOLD, GenBank)에서 다운로드하거나 Sanger 염기서열분석71에서 생성할 수 있는 DNA 염기서열분석입니다. 표 1 과 표 2 에는 이 논문에 대표적인 결과가 제시된 데이터 세트의 등록 번호가 나열되어 있습니다.
1. 임계값 기반 접근법을 위한 준비 단계: 염기서열 정렬

그림 2: MEGA X의 시퀀스 정렬. (A) 수동으로 세척된 최종 DNA 염기서열 정렬 및 (B) 삽입, 결실 및 갭이 없는 Byrrhinus 데이터 세트의 번역된 단백질 염기서열 정렬. 이 그림의 더 큰 버전을 보려면 여기를 클릭하십시오.
2. Species Identifier 1.8의 Taxon DNA 모듈에 의한 구분
참고: 종 식별자는 https://taxondna.sourceforge.net/ 에서 다운로드할 수 있습니다.

그림 3: Species Identifier 1.8 창의 TaxonDNA는 3%의 사용자 식별 한계 임계값을 보여줍니다. 이 그림의 더 큰 버전을 보려면 여기를 클릭하십시오.
3. MEGA X에서 Kimura 2-parameter (K2P)에 의한 구분

그림 4: Kimura-2-parameter의 결과를 보여주는 MEGA X의 결과 창. 이 그림의 더 큰 버전을 보려면 여기를 클릭하십시오.
4. 자동 분할에 의한 어셈블 종에 의한 구분 (ASAP)

그림 5: 가능한 구분을 보여주는 ASAP의 결과 창. 첫 번째 결과(파란색 상자)는 가장 낮은 ASAP 점수(빨간색 상자)와 가장 높은 P-val 순위(노란색 상자)로 인해 허용됩니다. 이 그림의 더 큰 버전을 보려면 여기를 클릭하십시오.
5. coalescent-based approaches를 위한 준비 단계: Tree estimation

그림 6: coalescent 기반 접근 방식을 위한 준비 단계로서의 MEGA X의 트리 추정. (A) 최적 뉴클레오티드 치환 모델을 결정하기 위한 설정. (B) Byrrhinus 데이터 세트의 경우 BIC 및 AICc 값이 가장 낮기 때문에 가장 적합한 모델은 GTR + I입니다(빨간색 상자). (C) 최대우도 트리를 실행할 때 GTR(노란색 상자) + I(파란색 상자)를 매개변수로 설정했습니다. (D) 후속 분석에 사용할 결과 원시 ML 트리. 이 그림의 더 큰 버전을 보려면 여기를 클릭하십시오.
6. PTP(Poisson Tree Processes)에 의한 구분
참고: 아래 단계를 통해 PTP-ML 및 PTP-BI의 결과를 얻을 수 있습니다.

그림 7: 푸아송 트리 프로세스에 의한 분자 종 구분. (A) 입력 매개변수를 보여주는 창. (B) 구분 결과(빨간색 상자)가 포함된 링크가 있는 PTP 웹 서버의 결과 창. 이 그림의 더 큰 버전을 보려면 여기를 클릭하십시오.
7. mPTP(Multi-rate Poisson Tree Processes)에 의한 구분

그림 8: 다중 속도 푸아송 트리 프로세스에 의한 분자 종 구분. (A) 업로드된 트리에 대한 mPTP 읽기 정보를 표시하는 창. (B) 구분 결과가 포함된 링크가 있는 mPTP 웹 서버의 결과 창(빨간색 상자). 이 그림의 더 큰 버전을 보려면 여기를 클릭하십시오.
8. MOTU 생성
액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.
이 기사에서는 TaxonDNA, K2P, ASAP, PTP의 두 가지 변형 및 mPTP를 포함하는 분자 종 구분 혼합물 파이프라인을 수생 및 강기슭 딱정벌레에 구현했습니다. 6가지 접근 방식 각각의 결과를 '분자 클러스터'라고 하며, 요약을 '분자 조작 분류 단위' 또는 MOTU75라고 합니다.
혼합물 파이프라인은 두 개의 데이터 세트에서 테스트되었습니다. 첫 번째 데이터셋(표 1, 그림 9)은 필리핀에서 수집된 1858마리의 딱정벌레인 Byrrhinus Motschulsky의 COI-3' 염기서열 24개로 구성되어 있으며, 2개의 미확인 Limnichus Latreille, 1829종76 종이 외집단으로 구성되어 있습니다. Byrrhinus 염기서열에는 K2P 구...
액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.
DNA 염기서열, 특히 COI49는 생물 식별 시스템(46)을 위해 온라인 공개 저장소(54,55,79,80)의 참조 서열(reference sequences) 22,53,78과 비교될 수 있지만, 이러한 접근법은 이용 가능한 증착된 서열에 의해 제한된다. 반대로, 분자 종 구분(molecular species delimitation)을 사용하면 종 한계를 설정하고 서열 저장소(sequenc...
액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.
우리는 공개 할 것이 없습니다.
우리는 생물다양성 표본 채취를 수행할 수 있도록 사전 사전 동의를 해준 수산 및 수산 자원국(BFAR)과 관련 지방 정부 기관에 감사드립니다. 분류학 작업에 대한 지침을 제공해 주신 Hendrik Freitag 박사에게 감사드립니다. 또한 도움이 되고 건설적인 의견을 제시해 주신 검토자와 편집자분께도 감사드립니다. 마지막으로, 이 연구에 자금을 지원해 주신 University Research Council Big Project Grant(URC 2022-09)와 Ateneo de Manila University의 Open Access Publication Grant, Ateneo Research Institute of Science and Engineering의 환경 리더십을 위한 SC Johnson Student Research and Development Fund, 그리고 이 연구에 자금을 지원해 주신 LinneSys : Systematics Research Fund of the Linnean Society of London과 Systematics Association에 깊은 감사를 표합니다.
액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.
| 이름 | 회사 | 카탈로그 번호 | 댓글 |
|---|---|---|---|
| 최대한 빨리 | 스파르트 탐험가 | https://bioinfo.mnhn.fr/abi/public/asap/asapweb.html | |
| 컴퓨터 | 모든 처리 장치 | ||
| 메가 X | MEGA 소프트웨어 | https://www.megasoftware.net/ | |
| mPTP 웹 서버 | https://mptp.h-its.org/#/tree | ||
| PTP 웹 서버 | 하이델베르크 이론 연구소(HITS) | https://species.h-its.org/ptp/ | |
| 종 식별자 | https://taxondna.sourceforge.net/ |
액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.