이 콘텐츠를 보려면 JoVE 구독이 필요합니다. 로그인하거나 오늘 무료 평가판을 시작하세요.

방법 논문

식물의 MicroRNA 전사체를 정확하고 효율적으로 분석하는 생물정보학 파이프라인

7.9K 조회수

DOI:

10.3791/59864

2020년 1월 21일

* These authors contributed equally

이 논문에서

요약

업데이트된 식물 miRNA 기준과 철저한 알고리즘을 갖춘 생물정보학 파이프라인, 즉 miRDeep-P2(짧은 경우 miRDP2)는 식물의 microRNA 전사체, 특히 복잡하고 큰 게놈이 있는 종의 경우 정확하고 효율적으로 분석할 수 있습니다.

초록

MicroRNAs (miRNAs)는 20- 24-뉴클레오티드 (nt) 내인성 작은 RNA (sRNA)는 전사 후 수준에서 유전자 발현조절에 강력한 역할을 하는 식물 및 동물에서 광범위하게 존재합니다. 차세대 염기서열 분석(NGS) 방법에 의한 sRNA 라이브러리 시퀀싱은 지난 10년간 miRNA 전사체를 식별하고 분석하는 데 널리 사용되어 왔으며, 그 결과 miRNA 발견이 급격히 증가했습니다. 그러나, 식물 miRNA 기고에서 2개의 중요한 도전은 식물 게놈의 크기 그리고 복잡성 뿐만 아니라 서열화된 sRNA 라이브러리의 증가 깊이 때문에 생겨났습니다. 첫째, sRNA의 많은 다른 모형, 특히, sRNA 라이브러리에서 짧은 간섭 RNA (siRNAs)는, 많은 계산 공구에 의해 miRNAs로 잘못 부고됩니다. 둘째, 크고 복잡한 게놈을 가진 식물 종에서 miRNA 전사체를 분석하는 데 매우 시간이 많이 걸리는 과정이 됩니다. 이러한 과제를 극복하기 위해 최근 새로운 필터링 전략을 채택하고 점수 매기기 알고리즘을 정비하고 새로 업데이트된 식물 miRNA를 통합하여 miRDeep-P2(miRNA 전사체 분석을 위한 인기 도구)를 miRDeep-P2(짧은 경우 miRDP2)로 업그레이드했습니다. 조건. 우리는 애기장대, 쌀, 토마토, 옥수수 및 밀을 포함하여 게놈 복잡성이 증가하는 5개의 대표적인 식물에 있는 연속된 sRNA 인구에 대하여 miRDP2를 시험했습니다. 결과는 miRDP2가 매우 높은 효율로 이러한 작업을 처리했음을 나타냅니다. 또한 miRDP2는 감도 및 정확도에 관한 다른 예측 도구를 능가했습니다. 종합하면, 우리의 결과는 식물 miRNA 전사체를 분석하기위한 빠르고 정확한 도구로 miRDP2를 보여 주므로 지역 사회가 식물에서 miRNAs에 더 잘 추가하는 데 도움이되는 유용한 도구입니다.

서론

생물학에 있는 마지막 2 십년간에 있는 가장 흥미로운 발견의 한개는 게놈1의다양한 기능을 통제에 있는 sRNA 종의 증식하는 역할입니다. 특히, miRNAs는 진핵생물에서 20-24-nt sRNAs의 중요한 클래스를 구성하고, 주로 생애 주기 발달 단계에 걸쳐 눈에 띄는 유전자 조절자로서 전사 후 수준에서 기능뿐만 아니라 자극 및 스트레스 반응2,3. 식물에서, miRNAs는 pri-miRNAs에게 불린 1 차적인 전사자에서, 일반적으로 개별 전사 단위로 RNA 중합효소 II에 의해 전사되는4,5. 진화적으로 보존된 세포 기계(동물의 Drosha RNase III, 식물의 DICER와 유사)에 의해 처리되는 pri-miRNAs는 즉각적인 miRNA 전구체, 프리 miRNA로 절제되며, 이는 분자 내 줄기 루프 구조를 형성하는 서열을 포함하는6,7. pre-miRNA는 기능적 가닥, 성숙한 miRNA 및 덜 빈번한 기능 파트너인 miRNA*2,8로구성된 이중 가닥 중간체, 즉 miRNA 이중으로 처리됩니다. RNA 유도 침묵 복합체 (RISC)로 로드 한 후, 성숙한 miRNAs는 서열 상보성에 기초하여 그들의 mRNA 표적을 인식할 수 있었다, 부정적인 조절 기능의 결과2,8. miRNA는 대상 성적 표를 불안정하게 하거나 표적 번역을 방지할 수 있지만 이전 방식은 식물8,9에서지배됩니다.

선충 제10, 11에서 첫 번째 miRNA가 발견된 이후,11,많은 연구가 miRNA 식별 및 기능분석에 전념하고 있으며, 특히 NGS 방법의 가용성 이후에. NGS 방법의 광범위한 응용 프로그램은 전구체의 줄기 루프 구조와 성숙한 miRNA 및 miRNA *에 대한 서열 읽기의 우선 적 축적과 같은 miRNA의 고유 한 기능을 캡처하도록 설계된 계산 도구의 활용을 크게 촉진했습니다. 그 결과, 연구자들은 다양한 종에서 miRNAs를 식별하는 데 놀라운 성공을 거두었습니다. 앞서 설명한 확률 모델12를기반으로, 우리는 NGS 데이터에서 식물 miRNA를 발견하기위한 최초의 계산 도구인 miRDeep-P13을개발했습니다. miRDeep-P는 특히 더 많은 가변 전구체 길이및 큰 paralogous 패밀리13,14,15를특징으로 하는 식물 miRNAs를 디코딩하는 도전을 정복하기 위한 것이었습니다. 그것의 방출 후에, 이 프로그램은 수천 번 다운로드되고 40 개 이상의 식물 종16에서miRNA 전사체에 추가하는 데 사용되었습니다. miRDeep-P와 같은 NGS 기반 도구에 의해 추진, 공공 miRNA 저장소 miRBase17에등록 된 miRNA의 수가 극적으로 증가하고있다, 여기서 이상 38,000 miRNA 항목은 현재 호스팅 (릴리스 22.1) 단지에 비해 ~500 miRNA 항목 (릴리스 2.0) 200818.

그러나 식물 miRNA 항에서 두 가지 새로운 문제가 발생했습니다. 첫째, 거짓 양성의 높은 비율은 식물 miRNA 주석의 품질에 크게 영향을 미쳤다16,19 다음과 같은 이유로: 1) NGS sRNA 라이브러리에서 내인성 짧은 간섭 RNA (siRNAs)의 홍수는 엄격한 miRNA 주석 기준의 부족으로 인해 miRNAs로 잘못 주석하였다; 2) 선행 miRNA 정보가 없는 종의 경우, NGS 데이터를 기반으로 예측된 거짓 긍정은 제거하기 어렵다. 예를 들어 miRBase를 사용하여, 테일러 등20 공공 저장소에서 식물 miRNA 항목의 1/3을 발견21 (릴리스 21) 설득력 있는 증거 부족 하 고 식물 miRNA 가족의 심지어 3/4 는 의심 했다. 둘째, 크고 복잡한 게놈16을가진 식물 miRNAs를 예측하기 위한 매우 시간이 많이 소요되는 과정이 된다. 이러한 문제를 극복하기 위해 새로운 필터링 전략을 추가하고, 점수 매기기 알고리즘을 정비하고, 식물 miRNA 어노미에 대한 새로운 기준을 통합하여 miRDeep-P를 업데이트하고, 새 버전 miRDP2를 출시했습니다. 또한, 우리는 NGOs sRNA 데이터 세트를 사용하여 애기장대, 쌀, 토마토, 옥수수 및 밀과 같은 게놈 크기를 점진적으로 증가시키는 miRDP2를 테스트했습니다. 다른 5개의 널리 사용되는 공구 및 그것의 이전 버전에 비해, miRDP2는 향상된 정확도 및 감도로 이 sRNA 데이터를 구문 분석하고 miRNA 전사체를 더 빨리 분석했습니다.

miRDP2 패키지의 내용
miRDP2 패키지는 준비된 bash 스크립트에서 순차적으로 실행해야 하는 6개의 문서화된 Perl 스크립트로 구성됩니다. 6개의 스크립트 중3개(convert_bowtie_to_blast.pl, filter_alignments.pl, excise_candidate.pl)는miRDeep-P에서 상속됩니다. 다른 스크립트는 원래 버전에서 수정됩니다. 여섯 스크립트의 함수는 다음에 설명되어 있습니다.

preprocess_reads.pl 필터 입력 읽기(너무 길거나 너무 짧은 읽기(<19 nt 또는 >25 nt)를 포함하여, Rfam ncRNA 서열과 상관관계가 있는 읽기뿐만 아니라 RPM(백만 개당 읽기) 미만의 읽기를 읽습니다. 그런 다음 스크립트는 알려진 miRNA 성숙 시퀀스와 상관 관계가 있는 읽기를 검색합니다. 입력 파일은 FASTA / FASTQ 형식으로 원래 읽기 및 miRNA 및 ncRNA 서열에 매핑 읽기의 bowtie2 출력입니다.

RPM 계산 공식은 다음과 같이 표시됩니다.

figure-introduction-1

convert_bowtie_to_blast.pl은 나비 넥타이 형식을 BLAST 구문 분석 형식으로 변경합니다. BLAST 구문 분석 형식은 표준 NCBI BLASToutput 형식에서 파생된 사용자 지정 테이블 형식 분리 형식입니다.

filter_alignments.pl은 게놈에 읽는 깊은 시퀀싱의 정렬을 필터링합니다. 부분 정렬뿐만 아니라 다중 정렬 읽기(사용자가 지정한 주파수 차단)를 필터링합니다. 기본 입력은 BLAST 구문 분석 형식의 파일입니다.

excise_candidate.pl은 지침으로 정렬된 읽기를 사용하여 참조 시퀀스에서 잠재적인 전구체 시퀀스를 잘라내있습니다. 기본 입력은 BLAST 구문 분석 형식의 파일과 FASTA 파일입니다. 출력은 FASTA 형식의 모든 잠재적전위서서열이다.

mod-miRDP.pl 두 개의 입력 파일, 서명 파일 및 구조 파일, 공장 특정 매개 변수로 채점 시스템을 변경 하 여 코어 miRDeep-P 알고리즘에서 수정 됩니다. 입력 파일은 도트 브래킷 전구체 구조 파일이며 배포 서명 파일을 읽습니다.

mod-rm_redundant_meet_plant.pl에는 mod-miRDP.pl 의해 생성된 chromosome_length, 전구체 및 original_prediction 세 가지 입력 파일이 필요합니다. 새로 업데이트된 plant miRNA 기준에 의해 필터링된 두 개의 출력 파일, 중복되지 않은 예측 파일 및 예측 된 파일을 생성합니다. 출력 파일의 형식에 대한 자세한 내용은 섹션 1.4에 설명되어 있습니다.

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

프로토콜

1. 설치 및 테스트

  1. 필요한 종속성을 다운로드 : Bowtie222 및 RNAfold23. 컴파일된 패키지를 권장합니다.
    1. 홈 사이트(http://bowtie-bio.sourceforge.net/bowtie2/index.shtml)에서읽기 매핑 도구인 Bowtie2를 다운로드합니다.
    2. RNA 보조 구조를 예측하는 데 사용되는 비엔나 패키지 도구인 RNAfold를 다운로드하여 http://www.tbi.univie.ac.at/~ivo/RNA/.
    3. miRDP2를 설치하기 전에 이러한 두 종속성이 올바르게 설치되었는지 확인하고 bash 환경 파일(예: .bashrc)을 사용자 지정하여 이러한 두 종속성에 대한 올바른 PATH를 설정합니다.
      참고: Bowtie24와 같은 다른 매핑 도구도 miRDP2에 적합합니다. 보이 또는 보우타이2 버전 1.1.3 이후에 사용할 수 있습니다.
  2. miRDP2 패키지를 다운로드하려면 https://sourceforge.net/projects/mirdp2/files/latest_version/ 가서 타르볼 파일을 가져옵니다.
  3. miRDP2를 설치하기 전에 Perl이 PATH에 있는지 확인합니다. miRDP2를 설치하려면 다운로드한 타볼 파일의 모든 내용을 하나의 폴더(1.4.2와 같이 명령줄)로 추출한 다음 폴더 경로를 PATH로 설정합니다.
    참고: miRDP2를 실행하려면 8GB RAM과 100GB 스토리지가 있는 컴퓨터 또는 컴퓨팅 노드를 실행하는 것이 좋습니다.
  4. MiRDP2 파이프라인을 테스트합니다.
    1. miRDP2가 올바르게 설치되었는지 테스트하려면 테스트 데이터와 https://sourceforge.net/projects/mirdp2/files/TestData/있는 예상 출력을 사용합니다. 테스트 데이터에는 포맷된 GSM 시퀀싱 파일 1개와 애기장대 게놈 파일 1개가 포함되어 있습니다.
    2. 다운로드한 모든 파일을 현재 작업 디렉토리로 이동합니다.
      mv miRDP2-v*.tar.gz TestData.tar.gz ncRNA_rfam.tar.gz & lt&user_selected_folder>
      cd&user_selected_folder>
    3. 압축된 타볼 파일 추출:
      타르 -xvzf miRDP2-v*.tar.gz
      타르 -xvzf 테스트데이터.tar.gz
      타르 -xvzf ncRNA_rfam.tar.gz
    4. 애기검집 게놈 참조 지수 구축:
      bowtie2-빌드 -f ./TestData/TAIR10_genome.fa ./testData/TAIR10_genome
    5. ncRNA 참조 인덱스를 작성합니다.
      bowtie2-build -f ./ncRNA_rfam.fa ./1.1.3/스크립트/인덱스/rfam_index
    6. miRDP2 파이프라인 실행:
      bash ./1.1.3/miRDP2-v1.1.3_pipeline.bash -g ./TestData/TAIR10_genome.fa -i ./ TestData/TAIR 10_genome -f./TestData/GSM2094927.fa -o .
      참고: 사용되는 Linux 명령은 굵게 및 기울임꼴 글꼴로 되어 있으며 기울임꼴의 명령줄 옵션이 있습니다. *miRDP2 의 버전을 나타냅니다(현재 버전은 1.1.3). bowtie2 빌드 명령은 약 10분이 소요되며 miRDP2 파이프라인은 몇 분 이내에 완료되어야 합니다.
  5. 테스트 출력을 확인합니다.
    1. 'GSM2094927-15-0-10'이라는 폴더는 모든 중간 파일과 결과를 포함하는 에서자동으로 생성됩니다.
    2. 탭 분리 된 출력 파일 GSM2094927-15-10_filter_P_prediction, 예측 miRNAs의 최종 출력은 염색체 ID, 가닥 방향, 대표 읽기 ID, 전구체 ID, 성숙한 miRNA 위치, 전구체를 나타내는 열이 포함되어 있는지 확인하십시오. 위치, 성숙한 시퀀스 및 전구체 시퀀스를 제공합니다. 추가 분석을 용이하게 하기 위해 이 파일에서 파생된 추가 베드 파일을 기록합니다.
    3. 완료된 단계에 대한 정보를 제공하는 파일 "progress_log"과 프로그램 출력 및 경고가 포함된 "script_log" 및 "script_err"파일을 확인합니다.
      참고 : 현재, 우리는 두 개의 리눅스 플랫폼에서 miRDP2를 테스트했습니다, 센트OS 릴리스를 포함 6.5 클러스터 서버, 그리고 Cygwin 2.6.0 PC 윈도우 시스템에, miRDP2 펄을 지원하는 유사한 시스템에서 작동해야합니다.

2. 소설 miRNAs 식별

  1. 파이프라인을 실행하기 전에 입력 읽기가 적절한 형식으로 사전 처리되었는지 확인합니다.
    참고 : miRDP2의 새 버전 1.1.3은 이전 버전에서와 같이 읽기 를 서식화하는 과정이 수행되지만 원래 FASTQ 형식 파일을 입력으로 받아 들일 수 있습니다.
    1. 먼저 깊은 시퀀싱 읽기의 5' 및 3' 끝에서 어댑터를 제거합니다(있는 경우).
    2. 둘째, FASTA 형식으로 깊은 시퀀싱 읽기를 구문 분석합니다.
    3. 셋째, 동일한 시퀀스로 읽는 중복성을 제거하면 단일 고유FASTA 항목으로 표시됩니다.
    4. 마지막으로 모든 FASTA 식별자가 고유해야 합니다. 각 시퀀스 식별자는 심층 시퀀싱 데이터 집합에서 검색된 정확한 시퀀스의 복사 수를 나타내는 '_x'과 정수로 끝나야 합니다. 고유한 FASTA 식별자를 보장하는 한 가지 방법은 ID에 실행 번호를 포함하는 것입니다. 참조를 위해 테스트데이터(https://sourceforge.net/projects/mirdp2/files/TestData/)에서GSM2094927.fa 파일을 참조하십시오.
    5. 올바르게 서식이 지정된 읽기의 예는 다음과 같습니다.

      >read0_x29909
      TTTGGATTGAAGGGAGCTCtA
      >read1_x36974
      TTCCACAGCTTGAACTG
      >read2_x32635
      TTCCACAGCTTGAACTT
  2. 참조 인덱스를 작성합니다.
    1. 게놈 참조를 위해, 시간을 절약하기 위해, 관심 종의 게놈 서열이 인덱싱된 경우 iGenomes 웹사이트(https://support.illumina.com/sequencing/sequencing_software/igenome.html)에서Bowtie2 인덱스 파일을 다운로드한다. 그렇지 않으면 유전체 서열을 다시 인덱싱해야 할 수 있기 때문에 사용자가 참조 시퀀스를 색인하고 프로젝트가 완료될 때까지 인덱스 파일을 잠시 동안 유지합니다. 게놈 참조를 인덱싱하는 방법에 대한 자세한내용은 bowtie2 설명서(http://bowtie-bio.sourceforge.net/bowtie2/manual.shtml)에 포함되어 있습니다.
    2. 또 다른 비miRNA ncRNA 인덱스는 또한 다른 비코딩 RNA 단편으로부터 시끄러운 서열을 걸것을 걸것을 필요로 한다. 파일은 rRNA, tRNA, snRNA 및 snoRNA를 포함하는 Rfam에서 주요 ncRNA 서열의 집합입니다. 이 인덱스를 작성하려면 인덱스를 올바르게 배치하고 명명해야 하므로 1.4부(예: miRDP2_version>스크립트/인덱스/rfam_index 참조하십시오.
  3. miRDP2를 실행합니다.
    1. miRDP2를 사용하여 심층 시퀀싱 데이터에서 새 miRNA를 검색하려면 패키지에서 bash 스크립트를 실행하여 분석 파이프라인을 시작합니다(예제는 1.4단계에서 찾을 수 있음).
      / miRDP2-v*._pipeline.bash-g&genome_file&genome_file&i&path_to_index/index_prefix> -f&seq_file > -o&output_folder>
      여기서 * 파이프라인 bash 스크립트의 버전을 나타냅니다. 수정할 수 있는 세 가지 매개 변수가 있습니다: 1) 읽기가 매핑될 수 있는 다른 위치의 수, 2) bowtie2 를 실행하는 불일치 번호 및 3) RPM 임계값(백만 개당 읽기). 각각 –L, -M 및 -R 옵션을 사용하여 수정합니다. 자세한 설명은 섹션 3.1에 있습니다.
  4. miRDP2 출력을 확인합니다.
    1. 출력 폴더는 에서 자동으로 생성되며 '15-0-10'이라는 이름이 붙습니다. 마지막 3개의 숫자는 각각 매개변수 1, 2 및 3의 값(이 경우 기본값)을 나타냅니다. 파일 _filter_P_prediction 새로 업데이트된 식물 miRNA 어노미 기준을 충족하는 최종 예측 miRNAs의 정보가 포함되어 있습니다. 출력 파일의 형식에 대한 자세한 내용은 1.4부에 설명되어 있습니다.

3. miRDP2를 사용한 수정 및 주의 사항

  1. 수정할 수 있는 매개 변수
    1. '-L' 옵션을 사용하여 읽기를 매핑할 수 있는 위치 수(매개 변수 1)의 제한을 설정합니다. 너무 많은 사이트에 대한 읽기 매핑은 반복 시퀀스와 연관될 수 있으며 miRNA가 아닐 수 있습니다. 기본 설정은 15입니다. 특정 종의 경우, 많은 멤버를 가진 miRNA 패밀리가 있는 경우, 제1 파라미터는 게놈 경관에 적응하기 위해 수동으로 증가할 수 있다.
    2. '-M' 옵션을 사용하여 bowtie에 대해 허용되는 불일치를 설정합니다(매개 변수 2). 기본 설정은 0입니다.
    3. '-R' 옵션을 사용하여 성숙한 miRNAs(매개 변수 3)에 잠재적으로 해당하는 읽기에 대한 임계값을 설정합니다. 시간 소비와 거짓 긍정을 줄이기 위해 RPM으로 필터를 읽습니다. 특정 RPM 임계값을 초과하는 읽기만 배경 노이즈가 아닌 miRNA의 성숙한 시퀀스를 나타낼 수 있으며 추가 분석을 위해 유지됩니다. 기본 설정은 10RPM입니다.
    4. 이러한 매개 변수를 변경하면 성능 및 시간 소비에 영향을 줄 수 있습니다. 일반적으로 매개 변수 1과 2가 증가하고 매개 변수 3이 감소하면 덜 엄격한 결과가 발생하고 실행 시간이 길어지고 그 반대의 경우도 마찬가지입니다.
  2. 이중화 및 miRNA*
    1. miRDP2의 출력 miRNA는 알려진 miRNA와 다를 수 있습니다. 우리는 이것이 성숙한 miRNAs의 이질성 또는 miRNA와 miRNA*의 상대적 풍부성이라는 두 가지 이유 중 하나에 주로 기인한다는 것을 발견했습니다. 우리는 이것이 전구체의 최적 길이 선택 및 알려진 miRNA 유전자의 프로파일링에 영향을 미치지 않는다는 것을 것을을 발견했습니다.

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

결과

본 원에 기재된 miRNA 부호, miRDP2는 애기장대, 오리자 사티(쌀), 솔라눔 리코퍼시쿰(tomato), 제아메이즈(maize)트리티쿰 에스티움(밀)을 포함하여 점차 적으로 증가하는 게놈 길이를 가진 5종의식물종으로부터 10개의 공공 sRNA-seq 라이브러리에 적용된다. 전반적으로, 각 종에 대해, 상이한 조직으로부터의 2개의 대표적인 sRNA 라이브러리(고유 판독으로 붕괴, 프로토콜 섹션의 세부 사항)와 그들의 색인된 게놈 서열은 2개의 입력으로 처리된다(표1). 5개의 miRNA 전산 예측 도구(miRDeep-P13,miRPlant25,miR-PREFeR26,miRA

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

토론

NGS의 출현과 함께, 다양한 종29,30에서sRNA 염기서열 분석 데이터의 양이 계속 증가함에 따라 많은 수의 miRNA 층이 확인되었다. 중앙 집중식 커뮤니티 데이터베이스 miRBase21에서,퇴적된 miRNA 항목은 지난 10년간 거의 100배 증가했습니다. 그러나, 동물의 miRNAs에 비해, 식물 miRNA는 식별 / 어노미를 더 복잡하게 많은 독특한 기능을 가지고13,14.

첫째, 식물 miRNAs의 전구체는 길이와 구조(보충 파일 2)16에서더 가변적이다. 동물 miRNA 전구체의 비교적 균일한 길이가 70-90 nt, 식물 전구체의 길이는 여러...

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

공개 사항

저자는 공개 할 것이 없다.

감사의 글

이 작품은 베이징 농업 임업 과학 아카데미 (KJCX201917, KJCX20180425, KJCX20180204)와 중국의 국립 자연 과학 재단 (31621001)에서 LL에 지원되었습니다.

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

재료

이 논문에 사용된 재료 목록
이름회사카탈로그 번호댓글
컴퓨터/컴퓨팅 노드N/APerl이 필요합니다. 최소 8GB RAM 및 100GB 스토리지가 권장됩니다.

참고문헌

  1. Ghildiyal, M., Zamore, P. D. Small silencing RNAs: an expanding universe. Nature Reviews Genetics. 10 (2), 94-108 (2009).
  2. Bartel, D. P. MicroRNAs: target recognition and regulatory functions. Cell. 136 (2), 215-233 (2009).
  3. Moran, Y., Agron, M., Praher, D., Technau, U. The evolutionary origin of plant and animal microRNAs. Nature Ecology Evolution. 1 (3), 27(2017).
  4. Xie, Z., et al. Expression of Arabidopsis MIRNA genes. Plant Physiology. 138 (4), 2145-2154 (2005).
  5. Zhao, X., Zhang, H., Li, L. Identification and analysis of the proximal promoters of microRNA genes in Arabidopsis. Genomics. 101 (3), 187-194 (2013).
  6. Bologna, N. G., Mateos, J. L., Bresso, E. G., Palatnik, J. F. A loop-to-base processing mechanism underlies the biogenesis of plant microRNAs miR319 and miR159. EMBO JOURNAL. 28 (23), 3646-3656 (2009).
  7. Rogers, K., Chen, X. Biogenesis, turnover, and mode of action of plant microRNAs. Plant Cell. 25 (7), 2383-2399 (2013).
  8. Voinnet, O. Origin, biogenesis, and activity of plant microRNAs. Cell. 136 (4), 669-687 (2009).
  9. Iwakawa, H. O., Tomari, Y. The Functions of MicroRNAs: mRNA Decay and Translational Repression. Trends in Cell Biology. 25 (11), 651-665 (2015).
  10. Lee, R. C., Feinbaum, R. L., Ambros, V. The C. elegans heterochronic gene lin-4 encodes small RNAs with antisense complementarity to lin-14. Cell. 75 (5), 843-854 (1993).
  11. Wightman, B., Ha, I., Ruvkun, G. Posttranscriptional regulation of the heterochronic gene lin-14 by lin-4 mediates temporal pattern formation in C. elegans. Cell. 75 (5), 855-862 (1993).
  12. Friedlander, M. R., et al. Discovering microRNAs from deep sequencing data using miRDeep. Nature Biotechnology. 26 (4), 407-415 (2008).
  13. Yang, X., Li, L. miRDeep-P: a computational tool for analyzing the microRNA transcriptome in plants. Bioinformatics. 27 (18), 2614-2615 (2011).
  14. Meyers, B. C., et al. Criteria for annotation of plant MicroRNAs. Plant Cell. 20 (12), 3186-3190 (2008).
  15. Yang, X., Zhang, H., Li, L. Global analysis of gene-level microRNA expression in Arabidopsis using deep sequencing data. Genomics. 98 (1), 40-46 (2011).
  16. Kuang, Z., Wang, Y., Li, L., Yang, X. miRDeep-P2: accurate and fast analysis of the microRNA transcriptome in plants. Bioinformatics. , (2018).
  17. Kozomara, A., Birgaoanu, M., Griffiths-Jones, S. miRBase: from microRNA sequences to function. Nucleic Acids Research. 47 (1), 155-162 (2019).
  18. Griffiths-Jones, S., Saini, H. K., van Dongen, S., Enright, A. J. miRBase: tools for microRNA genomics. Nucleic Acids Research. 36, Database issue 154-158 (2008).
  19. Axtell, M. J., Meyers, B. C. Revisiting Criteria for Plant MicroRNA Annotation in the Era of Big Data. Plant Cell. 30 (2), 272-284 (2018).
  20. Taylor, R. S., Tarver, J. E., Hiscock, S. J., Donoghue, P. C. Evolutionary history of plant microRNAs. Trends in Plant Science. 19 (3), 175-182 (2014).
  21. Kozomara, A., Griffiths-Jones, S. miRBase: annotating high confidence microRNAs using deep sequencing data. Nucleic Acids Research. 42, Database issue 68-73 (2014).
  22. Langmead, B., Salzberg, S. L. Fast gapped-read alignment with Bowtie 2. Nature Methods. 9 (4), 357-359 (2012).
  23. Lorenz, R., et al. ViennaRNA Package 2.0. Algorithms for Molecular Biology. 6, 26(2011).
  24. Langmead, B., Trapnell, C., Pop, M., Salzberg, S. L. Ultrafast and memory-efficient alignment of short DNA sequences to the human genome. Genome Biology. 10 (3), 25(2009).
  25. An, J., Lai, J., Sajjanhar, A., Lehman, M. L., Nelson, C. C. miRPlant: an integrated tool for identification of plant miRNA from RNA sequencing data. BMC Bioinformatics. 15, 275(2014).
  26. Lei, J., Sun, Y. miR-PREFeR: an accurate, fast and easy-to-use plant miRNA prediction tool using small RNA-Seq data. Bioinformatics. 30 (19), 2837-2839 (2014).
  27. Evers, M., Huttner, M., Dueck, A., Meister, G., Engelmann, J. C. miRA: adaptable novel miRNA identification in plants using small RNA sequencing data. BMC Bioinformatics. 16, 370(2015).
  28. Mathelier, A., Carbone, A. MIReNA: finding microRNAs with high accuracy and no learning at genome scale and from deep sequencing data. Bioinformatics. 26 (18), 2226-2234 (2010).
  29. Zhu, Q. H., et al. A diverse set of microRNAs and microRNA-like small RNAs in developing rice grains. Genome Research. 18 (9), 1456-1465 (2008).
  30. Fahlgren, N., et al. MicroRNA gene evolution in Arabidopsis lyrata and Arabidopsis thaliana. Plant Cell. 22 (4), 1074-1089 (2010).
  31. Fromm, B., et al. A Uniform System for the Annotation of Vertebrate microRNA Genes and the Evolution of the Human microRNAome. Annual Review of Genetics. 49, 213-242 (2015).
  32. Blevins, T., et al. Identification of Pol IV and RDR2-dependent precursors of 24 nt siRNAs guiding de novo DNA methylation in Arabidopsis. Elife. 4, 09591(2015).
  33. Zhai, J., et al. A One Precursor One siRNA Model for Pol IV-Dependent siRNA Biogenesis. Cell. 163 (2), 445-455 (2015).
  34. Werner, S., Wollmann, H., Schneeberger, K., Weigel, D. Structure determinants for accurate processing of miR172a in Arabidopsis thaliana. Current Biology. 20 (1), 42-48 (2010).
  35. Mateos, J. L., Bologna, N. G., Chorostecki, U., Palatnik, J. F. Identification of microRNA processing determinants by random mutagenesis of Arabidopsis MIR172a precursor. Current Biology. 20 (1), 49-54 (2010).
  36. Vitsios, D. M., et al. Mirnovo: genome-free prediction of microRNAs from small RNA sequencing data and single-cells using decision forests. Nucleic Acids Research. 45 (21), 177(2017).

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

재인쇄 및 허가

태그

RNARNAmiRDeep2RNABowtie 2