업데이트된 식물 miRNA 기준과 철저한 알고리즘을 갖춘 생물정보학 파이프라인, 즉 miRDeep-P2(짧은 경우 miRDP2)는 식물의 microRNA 전사체, 특히 복잡하고 큰 게놈이 있는 종의 경우 정확하고 효율적으로 분석할 수 있습니다.
이 콘텐츠를 보려면 JoVE 구독이 필요합니다. 로그인하거나 오늘 무료 평가판을 시작하세요.
방법 논문
* These authors contributed equally
업데이트된 식물 miRNA 기준과 철저한 알고리즘을 갖춘 생물정보학 파이프라인, 즉 miRDeep-P2(짧은 경우 miRDP2)는 식물의 microRNA 전사체, 특히 복잡하고 큰 게놈이 있는 종의 경우 정확하고 효율적으로 분석할 수 있습니다.
MicroRNAs (miRNAs)는 20- 24-뉴클레오티드 (nt) 내인성 작은 RNA (sRNA)는 전사 후 수준에서 유전자 발현조절에 강력한 역할을 하는 식물 및 동물에서 광범위하게 존재합니다. 차세대 염기서열 분석(NGS) 방법에 의한 sRNA 라이브러리 시퀀싱은 지난 10년간 miRNA 전사체를 식별하고 분석하는 데 널리 사용되어 왔으며, 그 결과 miRNA 발견이 급격히 증가했습니다. 그러나, 식물 miRNA 기고에서 2개의 중요한 도전은 식물 게놈의 크기 그리고 복잡성 뿐만 아니라 서열화된 sRNA 라이브러리의 증가 깊이 때문에 생겨났습니다. 첫째, sRNA의 많은 다른 모형, 특히, sRNA 라이브러리에서 짧은 간섭 RNA (siRNAs)는, 많은 계산 공구에 의해 miRNAs로 잘못 부고됩니다. 둘째, 크고 복잡한 게놈을 가진 식물 종에서 miRNA 전사체를 분석하는 데 매우 시간이 많이 걸리는 과정이 됩니다. 이러한 과제를 극복하기 위해 최근 새로운 필터링 전략을 채택하고 점수 매기기 알고리즘을 정비하고 새로 업데이트된 식물 miRNA를 통합하여 miRDeep-P2(miRNA 전사체 분석을 위한 인기 도구)를 miRDeep-P2(짧은 경우 miRDP2)로 업그레이드했습니다. 조건. 우리는 애기장대, 쌀, 토마토, 옥수수 및 밀을 포함하여 게놈 복잡성이 증가하는 5개의 대표적인 식물에 있는 연속된 sRNA 인구에 대하여 miRDP2를 시험했습니다. 결과는 miRDP2가 매우 높은 효율로 이러한 작업을 처리했음을 나타냅니다. 또한 miRDP2는 감도 및 정확도에 관한 다른 예측 도구를 능가했습니다. 종합하면, 우리의 결과는 식물 miRNA 전사체를 분석하기위한 빠르고 정확한 도구로 miRDP2를 보여 주므로 지역 사회가 식물에서 miRNAs에 더 잘 추가하는 데 도움이되는 유용한 도구입니다.
생물학에 있는 마지막 2 십년간에 있는 가장 흥미로운 발견의 한개는 게놈1의다양한 기능을 통제에 있는 sRNA 종의 증식하는 역할입니다. 특히, miRNAs는 진핵생물에서 20-24-nt sRNAs의 중요한 클래스를 구성하고, 주로 생애 주기 발달 단계에 걸쳐 눈에 띄는 유전자 조절자로서 전사 후 수준에서 기능뿐만 아니라 자극 및 스트레스 반응2,3. 식물에서, miRNAs는 pri-miRNAs에게 불린 1 차적인 전사자에서, 일반적으로 개별 전사 단위로 RNA 중합효소 II에 의해 전사되는4,5. 진화적으로 보존된 세포 기계(동물의 Drosha RNase III, 식물의 DICER와 유사)에 의해 처리되는 pri-miRNAs는 즉각적인 miRNA 전구체, 프리 miRNA로 절제되며, 이는 분자 내 줄기 루프 구조를 형성하는 서열을 포함하는6,7. pre-miRNA는 기능적 가닥, 성숙한 miRNA 및 덜 빈번한 기능 파트너인 miRNA*2,8로구성된 이중 가닥 중간체, 즉 miRNA 이중으로 처리됩니다. RNA 유도 침묵 복합체 (RISC)로 로드 한 후, 성숙한 miRNAs는 서열 상보성에 기초하여 그들의 mRNA 표적을 인식할 수 있었다, 부정적인 조절 기능의 결과2,8. miRNA는 대상 성적 표를 불안정하게 하거나 표적 번역을 방지할 수 있지만 이전 방식은 식물8,9에서지배됩니다.
선충 제10, 11에서 첫 번째 miRNA가 발견된 이후,11,많은 연구가 miRNA 식별 및 기능분석에 전념하고 있으며, 특히 NGS 방법의 가용성 이후에. NGS 방법의 광범위한 응용 프로그램은 전구체의 줄기 루프 구조와 성숙한 miRNA 및 miRNA *에 대한 서열 읽기의 우선 적 축적과 같은 miRNA의 고유 한 기능을 캡처하도록 설계된 계산 도구의 활용을 크게 촉진했습니다. 그 결과, 연구자들은 다양한 종에서 miRNAs를 식별하는 데 놀라운 성공을 거두었습니다. 앞서 설명한 확률 모델12를기반으로, 우리는 NGS 데이터에서 식물 miRNA를 발견하기위한 최초의 계산 도구인 miRDeep-P13을개발했습니다. miRDeep-P는 특히 더 많은 가변 전구체 길이및 큰 paralogous 패밀리13,14,15를특징으로 하는 식물 miRNAs를 디코딩하는 도전을 정복하기 위한 것이었습니다. 그것의 방출 후에, 이 프로그램은 수천 번 다운로드되고 40 개 이상의 식물 종16에서miRNA 전사체에 추가하는 데 사용되었습니다. miRDeep-P와 같은 NGS 기반 도구에 의해 추진, 공공 miRNA 저장소 miRBase17에등록 된 miRNA의 수가 극적으로 증가하고있다, 여기서 이상 38,000 miRNA 항목은 현재 호스팅 (릴리스 22.1) 단지에 비해 ~500 miRNA 항목 (릴리스 2.0) 200818.
그러나 식물 miRNA 항에서 두 가지 새로운 문제가 발생했습니다. 첫째, 거짓 양성의 높은 비율은 식물 miRNA 주석의 품질에 크게 영향을 미쳤다16,19 다음과 같은 이유로: 1) NGS sRNA 라이브러리에서 내인성 짧은 간섭 RNA (siRNAs)의 홍수는 엄격한 miRNA 주석 기준의 부족으로 인해 miRNAs로 잘못 주석하였다; 2) 선행 miRNA 정보가 없는 종의 경우, NGS 데이터를 기반으로 예측된 거짓 긍정은 제거하기 어렵다. 예를 들어 miRBase를 사용하여, 테일러 등20 공공 저장소에서 식물 miRNA 항목의 1/3을 발견21 (릴리스 21) 설득력 있는 증거 부족 하 고 식물 miRNA 가족의 심지어 3/4 는 의심 했다. 둘째, 크고 복잡한 게놈16을가진 식물 miRNAs를 예측하기 위한 매우 시간이 많이 소요되는 과정이 된다. 이러한 문제를 극복하기 위해 새로운 필터링 전략을 추가하고, 점수 매기기 알고리즘을 정비하고, 식물 miRNA 어노미에 대한 새로운 기준을 통합하여 miRDeep-P를 업데이트하고, 새 버전 miRDP2를 출시했습니다. 또한, 우리는 NGOs sRNA 데이터 세트를 사용하여 애기장대, 쌀, 토마토, 옥수수 및 밀과 같은 게놈 크기를 점진적으로 증가시키는 miRDP2를 테스트했습니다. 다른 5개의 널리 사용되는 공구 및 그것의 이전 버전에 비해, miRDP2는 향상된 정확도 및 감도로 이 sRNA 데이터를 구문 분석하고 miRNA 전사체를 더 빨리 분석했습니다.
miRDP2 패키지의 내용
miRDP2 패키지는 준비된 bash 스크립트에서 순차적으로 실행해야 하는 6개의 문서화된 Perl 스크립트로 구성됩니다. 6개의 스크립트 중3개(convert_bowtie_to_blast.pl, filter_alignments.pl, excise_candidate.pl)는miRDeep-P에서 상속됩니다. 다른 스크립트는 원래 버전에서 수정됩니다. 여섯 스크립트의 함수는 다음에 설명되어 있습니다.
preprocess_reads.pl 필터 입력 읽기(너무 길거나 너무 짧은 읽기(<19 nt 또는 >25 nt)를 포함하여, Rfam ncRNA 서열과 상관관계가 있는 읽기뿐만 아니라 RPM(백만 개당 읽기) 미만의 읽기를 읽습니다. 그런 다음 스크립트는 알려진 miRNA 성숙 시퀀스와 상관 관계가 있는 읽기를 검색합니다. 입력 파일은 FASTA / FASTQ 형식으로 원래 읽기 및 miRNA 및 ncRNA 서열에 매핑 읽기의 bowtie2 출력입니다.
RPM 계산 공식은 다음과 같이 표시됩니다.

convert_bowtie_to_blast.pl은 나비 넥타이 형식을 BLAST 구문 분석 형식으로 변경합니다. BLAST 구문 분석 형식은 표준 NCBI BLASToutput 형식에서 파생된 사용자 지정 테이블 형식 분리 형식입니다.
filter_alignments.pl은 게놈에 읽는 깊은 시퀀싱의 정렬을 필터링합니다. 부분 정렬뿐만 아니라 다중 정렬 읽기(사용자가 지정한 주파수 차단)를 필터링합니다. 기본 입력은 BLAST 구문 분석 형식의 파일입니다.
excise_candidate.pl은 지침으로 정렬된 읽기를 사용하여 참조 시퀀스에서 잠재적인 전구체 시퀀스를 잘라내있습니다. 기본 입력은 BLAST 구문 분석 형식의 파일과 FASTA 파일입니다. 출력은 FASTA 형식의 모든 잠재적전위서서열이다.
mod-miRDP.pl 두 개의 입력 파일, 서명 파일 및 구조 파일, 공장 특정 매개 변수로 채점 시스템을 변경 하 여 코어 miRDeep-P 알고리즘에서 수정 됩니다. 입력 파일은 도트 브래킷 전구체 구조 파일이며 배포 서명 파일을 읽습니다.
mod-rm_redundant_meet_plant.pl에는 mod-miRDP.pl 의해 생성된 chromosome_length, 전구체 및 original_prediction 세 가지 입력 파일이 필요합니다. 새로 업데이트된 plant miRNA 기준에 의해 필터링된 두 개의 출력 파일, 중복되지 않은 예측 파일 및 예측 된 파일을 생성합니다. 출력 파일의 형식에 대한 자세한 내용은 섹션 1.4에 설명되어 있습니다.
액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.
1. 설치 및 테스트
2. 소설 miRNAs 식별
3. miRDP2를 사용한 수정 및 주의 사항
액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.
본 원에 기재된 miRNA 부호, miRDP2는 애기장대, 오리자 사티(쌀), 솔라눔 리코퍼시쿰(tomato), 제아메이즈(maize) 및 트리티쿰 에스티움(밀)을 포함하여 점차 적으로 증가하는 게놈 길이를 가진 5종의식물종으로부터 10개의 공공 sRNA-seq 라이브러리에 적용된다. 전반적으로, 각 종에 대해, 상이한 조직으로부터의 2개의 대표적인 sRNA 라이브러리(고유 판독으로 붕괴, 프로토콜 섹션의 세부 사항)와 그들의 색인된 게놈 서열은 2개의 입력으로 처리된다(표1). 5개의 miRNA 전산 예측 도구(miRDeep-P13,miRPlant25,miR-PREFeR26,miRA
액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.
NGS의 출현과 함께, 다양한 종29,30에서sRNA 염기서열 분석 데이터의 양이 계속 증가함에 따라 많은 수의 miRNA 층이 확인되었다. 중앙 집중식 커뮤니티 데이터베이스 miRBase21에서,퇴적된 miRNA 항목은 지난 10년간 거의 100배 증가했습니다. 그러나, 동물의 miRNAs에 비해, 식물 miRNA는 식별 / 어노미를 더 복잡하게 많은 독특한 기능을 가지고13,14.
첫째, 식물 miRNAs의 전구체는 길이와 구조(보충 파일 2)16에서더 가변적이다. 동물 miRNA 전구체의 비교적 균일한 길이가 70-90 nt, 식물 전구체의 길이는 여러...
액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.
저자는 공개 할 것이 없다.
이 작품은 베이징 농업 임업 과학 아카데미 (KJCX201917, KJCX20180425, KJCX20180204)와 중국의 국립 자연 과학 재단 (31621001)에서 LL에 지원되었습니다.
액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.
| 이름 | 회사 | 카탈로그 번호 | 댓글 |
|---|---|---|---|
| 컴퓨터/컴퓨팅 노드 | N/A | Perl이 필요합니다. 최소 8GB RAM 및 100GB 스토리지가 권장됩니다. |
액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.