방법 논문

일괄 처리 효 모 2 잡종 스크린에서 시퀀스 데이터의 informatic 분석

6.8K 조회수

DOI:

10.3791/57802

2018년 6월 28일

이 논문에서

요약

효 모 인구 잠재적으로 긍정적인 효 모 2 잡종 상호 작용에 대 한 선택의 깊은 시퀀싱 풍부한 파트너 단백질 상호 작용에 대 한 정보를 생성 합니다. 여기, 우리가 특정 생물 정보학 도구와 같은 화면에서 시퀀스 데이터 분석 사용자 지정 된 업데이트 소프트웨어의 동작을 설명 합니다.

초록

우리는 동시에 높은 처리량 짧은 읽기 DNA 시퀀싱을 활용 한 화면 내에서 임시 및 정적 단백질 상호 작용의 수십을 밝히기 위해 효 모 2 잡종 분석 결과 적응 했습니다. 결과 시퀀스 데이터 집합 수 뿐만 아니라 인구에 긍정적인 효 모 2 잡종 상호 작용을 위해 선택 하는 동안 풍성 하 게 하는 어떤 유전자를 추적 하지만 또한 상호 작용에 대 한 충분 한 단백질의 관련 하위 도메인에 대 한 자세한 정보를 제공. 여기, 우리는 비-전문가 모든 생물 정보학 및 통계 단계를 처리 하 고 일괄 처리 효 모 2 잡종 분석 결과에서 DNA 시퀀스 fastq 파일을 분석을 수행할 수 있는 독립 실행형 소프트웨어 프로그램의 전체 제품군을 설명 합니다. 이러한 소프트웨어에 의해 보호 처리 단계를 포함: 해당 각 후보 단백질 효 모 2 잡종 먹이 라이브러리;에서 인코딩 하 1) 매핑 및 계산 순서 읽기 2) 통계 분석 프로그램을 평가 하는 농축 프로 파일; 그리고 3) 변환 프레임 및 관심사의 상호 작용 단백질 인코딩합니다 각 농축된 플라스 미드의 코딩 영역 내에서 위치를 검사 하는 도구.

서론

단백질 상호 작용을 발견 하는 한 가지 방법은 효 모 2 잡종 (Y2H) 분석 결과, 어떤 악용 설계 관심사의 단백질의 상호 작용 파트너1조각에 묶을 때에 자라는 효 모 세포 이다. 여러 Y2H 상호 작용의 탐지는 지금 대규모 병렬 높은 처리량 시퀀싱의 도움으로 할 수 있습니다. 여러 가지 형식 되었습니다 설명2,3,,45 포함 한 우리가 개발 인구 일괄 생성 하 플라스 미드를 포함 하는 효 모에 대 한 선택 하는 조건 하에서 재배 되는 긍정적인 Y2H 상호 작용6. 워크플로 우리 개발, 되 나 DEEPN (동적 농축 단백질 네트워크의 평가 위한), 하나의 단백질 (또는 도메인) 와 상호 작용 하는 단백질을 식별 하기 위해 같은 먹이 라이브러리에서 차동 interactomes 식별. 다른 단백질 또는 conformationally 별개의 돌연변이 도메인입니다. 이 워크플로의 주요 단계 중 하나는 적절 한 처리 및 DNA 시퀀싱 데이터의 분석 이다. 유사한 RNA-seq 실험의 Y2H 상호 작용 방식에서 선택 전후에 둘 다 각 유전자에 대 한 읽기 수 계산 하 여 몇 가지 정보를 얻을 수 있습니다. 그러나, Y2H 상호 작용을 만들 수 있는 특정된 단백질의 하위 도메인에 대 한 정보를 포함 하 여이 데이터 집합에서 훨씬 더 자세한 정보를 추출할 수 있습니다. 또한, 반면 DEEPN 방식은 귀중 한 많은 샘플 복제 분석 수 복잡 하 고 비싼입니다. 이 문제는 복제의 수는 제한6DEEPN 데이터 집합을 위해 특별히 개발 된 통계 모델 사용 하 여 완화 됩니다. 있도록 처리 및 DNA 시퀀싱 데이터 집합의 분석, 완전 한, 강력한, 안정적이 고 접근 없이 생물 정보학 전문 수 사관에 대 한, 우리는 분석의 모든 단계를 커버 하는 소프트웨어 프로그램의 한 벌을 개발 했다.

데스크톱 컴퓨터에서 실행 되는 독립 실행형 소프트웨어 프로그램의이 제품군 MAPster, DEEPN, 및 Stat_Maker 포함 되어 있습니다. MAPster 다운스트림 응용 프로그램에 사용 하기 위해 표준.sam 파일을 만드는 각 fastq 파일 대기7HISAT2 프로그램 사용 하 여 게놈에 매핑할 수 있는 그래픽 사용자 인터페이스입니다. DEEPN 여러 모듈 있다. 그것은 할당 하 고 해당 특정 유전자 유사한 ' 유전자 개수 ' 모듈을 사용 하는 RNA-seq 형식 정량화 하는 읽기를 계산. 그것은 또한 Gal4 transcriptional 도메인 및 먹이 시퀀스 사이의 교차점에 해당 하는 시퀀스를 추출 하 고 대조 비교 테이블 및 그래프 (를 사용 하 여 모듈 'Junction_Make')에 의해 그들의 검사를 허용 하도록 이러한 연결의 위치 모듈 'Blast_Query' 쉬운 검사와 정량, 접합 Gal4 접점 시퀀스의 비교를 허용 한다. Stat_Maker는 통계적으로 확률이 Y2H 안타에 우선 순위를 지정 하는 방법으로 유전자 농축 데이터 당 읽기 평가 합니다. 여기, 우리는 이러한 소프트웨어 프로그램을 사용 하 고 완전히 DEEPN Y2H에서 데이터 실험 DNA 시퀀스를 분석 하는 방법을 설명 합니다. 버전 DEEPN의 PC, 맥, 그리고 리눅스 시스템에서 실행할 수 있습니다. MAPster 매핑 프로그램 같은 다른 프로그램 및 DEEPN 통계 모듈 Stat_Maker 서브루틴 유닉스에서 실행 하 고 Mac 및 linux 시스템에만 사용할 수 있습니다에 의존.

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

프로토콜

1. 매핑 Fastq 파일

참고: DEEPN 소프트웨어 뿐만 아니라 많은 생물 정보학 프로그램 참조 DNA에에서 그것의 위치에 대 한 각각의 시퀀스를 읽고 매핑된 점에서 DNA 시퀀스 데이터를 사용 합니다. 다양 한 매핑 프로그램이.sam 파일 이후 단계에서 사용을 생산 하기 위해 HISTAT2 프로그램을 사용 하 여 여기 MAPster 인터페이스를 포함 한 사용할 수 있습니다.

  1. 게놈의 올바른 버전을 시퀀스 데이터를 매핑하십시오. 마우스 유래의 Y2H 라이브러리 사용 UCSC mm10 게놈; 인간의 유전자를 사용 하 여, UCSC hg38 참조 게놈 유전자를 Saccharomyces cerevisiae 사용, UCSC SacCer3 참조 게놈을 사용 하 여.
  2. MAPster를 설치 합니다.
    1. MAPster 소프트웨어 다운로드 및 설치. 다음에 웹 브라우저를 사용 하 여 소프트웨어를 찾을 수 있습니다: https://github.com/emptyewer/MAPster/releases. HISAT2는 애플 매킨토시와 같은 유닉스 기반 시스템에서 실행 됩니다. 이 때문에, MAPster 프로그램 애플 매킨토시와 리눅스와 같은 호환 되는 시스템에만 실행 됩니다.
      참고: 애플 맥에 대 한 시스템 요구 사항은: OSX 10.10 + > 4 기가바이트 RAM, > 500 기가바이트 디스크 공간, 및 참조 게놈을 다운로드 하기 위한 인터넷 액세스. 사용자와 상담 하는 기관 그것은 사람이 그들의 엔터프라이즈 관리자 권한 및 사용 권한을 제한 하는 보안 프로토콜 경우 해야 합니다.
  3. 필요한 파일 및 "기본" 탭 (그림 1)을 통해 매개 변수를 입력 합니다. 적절 한 "Pairwise" 버튼을 파일을 입력으로 쌍 또는 기본 파일 형식으로 FASTQ와 홀 중 하나를 선택 합니다.
    1. DEEPN 분석에 대 한 단일 읽기 형식에서 실행 하는 "Off"로 "Pairwise" 옵션을 설정 합니다.
    2. 드래그-앤-드롭 적절 한 창에 의해 단순히 MAPster 파일 로드.
    3. Y2H 먹이 라이브러리 삽입의 소스에 해당 하는 DNA/게놈 소스 참조를 선택 합니다. 여러 모델 생물에서 인덱싱된 게놈 "게놈" 상자에 나열 되 고 다운로드 될 수 있다 자동으로 존스 홉킨스 대학 센터에서 전산 생물학에 대 한. 참조 게놈은 나중에 사용 하기 위해 로컬로 저장 됩니다.
    4. HISAT2 지원 멀티 스레딩 이후 "스레드" 상자에서 매핑 프로그램에 헌신 하 게 될 컴퓨터 프로세스의 수를 나타냅니다. MAPster는 컴퓨터를 검색 하 고 기본적으로 사용할 수 있는 프로세서의 최대 수는 것이 좋습니다.
    5. 출력 파일 이름을 지정 합니다. 이 파일 이름은 공백이 나 특수 문자 없이 짧은 아직 설명 이름 좋습니다 그래서 DEEPN 과정 전반에 걸쳐 사용 됩니다. "오픈 출력 디렉터리" 단추를 사용 하 여 매핑된 파일을 출력 폴더를 지정 합니다.
    6. 일단 적절 한 파일 및 매개 변수를 선택 "대기열에 추가" 버튼을 사용 하 여 작업 큐를 매핑 작업을 추가 합니다. 주 창에서 파일 이름을 수 삭제 하 고 파일에 해당 하는 새 예제로 교체 하 고 해당 출력 파일 이름이 제공 된 후 큐에 추가할 수 있습니다.
    7. 모든 작업은 작업 큐에 입력 되 면 "실행 큐" 버튼을 클릭 합니다.
      참고: 매핑 작업 큐에 배치 되었습니다, 일단 "작업 매개 변수" 창에 "작업 명령" 창에 표시 될 모든 인수 사용 하 여 명령줄 문을 표시할 매개 변수 설정을 그 일을 선택 하면 됩니다. 출력 옵션 정렬에 실패 계속 읽기 여부 감독 등 각 읽기에 대해 허용 하는 기본 정렬 수 지정. 기본 출력 파일 MAPster에서 샘 형식 (예: '.sam' 파일)입니다. 그것은 모든 fastq 파일에서 시퀀스 읽기 (매핑된) 했다를 포함 하 여 그 샘플에 대 한 지정 되지 않았습니다 포함 됩니다 (매핑하지) 지정 된 geome를 성공적으로 매핑된.

2. Bioinformatic 처리를 사용 하 여 DEEPN 소프트웨어

참고: DEEPN 소프트웨어는 현재 컴파일 사용 마우스 cDNA 시퀀스, 인간 cDNA 시퀀스, 또는 S. cerevisiae genomic DNA 순서를 포함 하는 먹이 라이브러리와. DEEPN 표준.sam 파일 포맷을 수락 하 고 매핑되지 않은 매핑된 읽기 각 매핑된 및 매핑되지 않은 읽기 또는 별도 파일을 포함 하는 샘 (.sam) 파일을 받아들일 수 있다.

  1. DEEPN 소프트웨어 다운로드 및 설치. 다음에 웹 브라우저를 사용 하 여 소프트웨어를 찾을 수 있습니다: https://github.com/emptyewer/DEEPN/releases. 컴퓨팅 플랫폼 및 다운로드 버전 일치를 선택 합니다. 를 설치 하려면 다운로드 한 설치 패키지를 엽니다.
    참고: 버전 DEEPN의 PC, 맥, 그리고 리눅스 sysrems 사용할 수 있습니다. Mac과 PC 시스템 있어야 > 500 Gb 하드 디스크 공간 및 > 4gb의 RAM.
  2. DEEPN 소프트웨어를 엽니다. 주 창 (그림 2)에서 위쪽 선택 상자에서 해당 먹이 라이브러리 정보를 선택 합니다. 처리 된 파일 폴더/디렉터리를 "작업 폴더" 버튼을 클릭 하 여 이동 갈 수 있는 폴더를 선택 합니다. 하나는 필요한 경우 새로운 폴더/디렉터리를 만들 수 있습니다. "작업 폴더"를 선택 DEEPN unmapped_sam_files, mapped_sam_files, 및 sam_files는 3 개의 하위 폴더를 만듭니다.
    1. 경우.sam 파일 포함 된 매핑된 및 매핑되지 않은 읽기 등을 사용 하 여 MAPster 프로그램의 기본 설정으로, 'sam_files' 폴더에 넣어. 그렇지 않으면 장소.sam 파일 unmapped_sam_files와 mapped_sam_files에 따라.
  3. "유전자 수 + 접합" 확인 버튼을 클릭 하 여 처리를 시작 합니다.
    참고: 처리는 각 유전자에 해당 하는 얼마나 많은 읽기를 매핑 위치를 사용 하는 유전자 수 모듈 함께 시작 됩니다. 접합 확인 다음 추출 접점 시퀀스 (시퀀스 직접 융합 Gal4 활성화 도메인에서 다운스트림) 읽기에서 폭발 알고리즘을 사용 하 여 그들을 식별 하 고. 이것은 그림 3에 표시 하는 폴더의 전체 집합을 만듭니다. 처리 시간 크기와 시퀀스 데이터 파일의 수 및 사용 하는 컴퓨터의 처리 속도에 따라 달라 집니다. 전형적인 시간 범위 12-30 h ~ 250 백만의 실험 데이터 집합에서 읽습니다. 유전자 수 절차 및 Junction_Make 절차는 "유전자 개수" 단추 또는 "접합" 확인 버튼을 클릭 하 여 개별적으로 시작할 수 있습니다.
  4. 다운로드 및 설치 Stat_Maker (https://github.com/emptyewer/DEEPN/releases). 현재 유닉스 맥 시스템 에서만 작동 DEEPN 데이터 집합을 위한 통계 분석 패키지입니다.
    1. Stat_Maker을 "설치 확인" (그림 4) 버튼을 클릭 합니다. 처음으로 실행 하는 경우 Stat_Maker 자동으로 설치 합니다 R, JAGS, 및 Bioconductor는 인터넷에서 이러한 리소스를 당겨. 일단 R, JAGS, 및 Bioconductor를 감지 Stat_Maker 활성화 하 고 추가 사용자 입력을 허용.
    2. DEEPN 처리 작업 폴더 탐색 "폴더 선택" 버튼을 클릭 합니다. Stat_Maker 자동 발견 하 고 창에서 통계 분석을 위해 파일을 나열 합니다.
    3. 적절 한 파일에서에서 끌어서 위의 파일 목록 창 각 벡터 및 미끼 데이터 집합에 대 한 및 각 성장 조건에 대 한 아래 파일 창으로: 선택 되지 않은 (그의 + 미디어) (그의-미디어)을 선택. 중요 한 것은, Stat_Maker의 두 샘플 선택 및 빈에 대 한 중복 데이터 집합 벡터 혼자, 선택 되지 않은 인구의 두 샘플 필요 합니다. 이 실험에서 가변성의 견적을 제공합니다.
    4. "실행" 버튼을 클릭 합니다. 컴퓨터의 속도 따라 계산 5-15 분 사이 걸릴 것입니다.
  5. "Stat_Maker" 결과 주요 작업 폴더 내에서 새로운 하위 폴더에 배치 되는 Stat_Maker 출력 결과 검토 합니다.
    참고: 결과 CSV (쉼표로 구분 된 값) 파일을 열 수 있는 일반적인 스프레드시트 프로그램에서 발견 된다. Stat_Maker 차동 미끼와 함께 관심을 선택 빈 pTEF GBD (그림 5)에 농축 될 가능성이 높은 유전자 안타를 평가할 것 이다. 또한 표로 어디 유전자 삽입 발견 업스트림, 다운스트림, 또는 열려있는 독서 프레임 및 올바른 변환 독서 내 유전자도 발견 여부 내 각 데이터 집합에 대 한 읽기 비율이입니다. 종종 DEEPN 해당 단백질의 적절 한 독서 프레임에서 또는 해당 오픈-독서 프레임의 하류는 cDNA의 부분에는 주어진된 cDNA의 일부와 미끼의 강력한 Y2H 상호 작용을 사로잡을 것입니다. Stat_Maker에서 결합 된 출력 스캔 탐지 및 제거가 없는 안타의 합리화.
  6. 각 잠재적인 후보에 대 한 데이터를 검토 하려면 DEEPN 소프트웨어를 열고, 해당 먹이 라이브러리 정보 및 다음 "작업 폴더"를 사용 하 여 올바른 작업 폴더를 선택 합니다.
    1. "폭발 쿼리" 버튼을 클릭 합니다. 이 새로운 창 (그림 6)를 로드합니다. 위쪽 텍스트 상자에서 유전자 이름 또는 관심사의 후보 유전자 선택 은행 NM 번호를 입력 합니다. 이러한 유전자 이름 StatMaker 출력 파일에 나열 된 이름에 해당 합니다. 유형 입력 하거나 반환,이 관심사의 유전자의 검색을 시작 합니다.
    2. 어떤 데이터 집합 "데이터 집합 선택" 메뉴를 사용 하 여 분석을 위해 사용 됩니다를 선택 합니다. 일반적으로, 이러한 벡터만 포함 하 고 선택적 비 조건에서 성장 하는 샘플 및 선택 조건 하에서 성장 하는 미끼 샘플 미끼. 그러나 처음, 데이터를 로드 하는 데 몇 분 걸릴 것입니다, 그리고, 다른 유전자와 같은 데이터 집합의 후속 쿼리 빠르게 갈 것입니다. Blast_Query는 관심과 각 융해 점은 어떻게 풍부한의 순서에 따라서 퓨전 포인트 표시 됩니다. 이 모두 "결과" 탭을 사용 하 여 테이블 형식 또는 "플롯" 탭을 사용 하 여 그래픽 형식에 표시 될 수 있습니다. 이러한 결과 오른쪽 상단에 있는 ".csv 저장" 버튼을 클릭 하 여.csv 파일로 내보낼 수 있습니다.

3입니다. 후보자 DEEPN 식별 확인

참고: DEEPN 및 Stat_Maker의 목적은 긍정적인 Y2H 상호 작용을 주는 후보 유전자를 식별 하는. 같은 Y2H 상호 작용을 확인 수 수 관심의 미끼 플라스 미드를 사용 하 여 전통적인 이진 Y2H 형식을 사용 하 여 할 빈 Gal4 활성화 도메인 '먹이' 플라스 미드와 결합 뿐 아니라 먹이 플라스 미드의 유전자 또는 cDNA 조각 들고와. 그것은 효 모 인구 Y2H 선택 대상에서 분리 된 DNA의 혼합물에서 관심사의 실제 플라스 미드 분리 가능. 그러나, 하나의 수 계산 유전자 또는 cDNA 조각 Y2H 상호 작용을 생성 하는 재구성, 5'과 3' 그 파편의 끝에 대 한 프라이 머 디자인과 효 모 인구에서 고립 된 DNA에서 그 단편을 증폭. 후보 먹이 조각의 5'과 3' 끝을 찾는 방법에 설명 합니다.

  1. DEEPN 소프트웨어 열고 매개 변수 "선택 매개 변수" 및 "작업 폴더 선택"에 해당 하는 프로젝트의 작업 폴더를 선택 합니다. "폭발 쿼리" 버튼을 클릭 하 여 Blast_Query 모듈을 실행 합니다.
  2. 관심이 나 그것의 은행 "NM"의 유전자의 이름을 입력 합니다 위쪽 텍스트 상자에 숫자. 풀 다운 메뉴에서 해당 하는 선택 된 효 모 인구 미끼에 대 한 관심의 접합 위치 '결과' 탭의 테이블을 검색 하는 데이터 집합을 선택 합니다. 기본적으로 Blast_Query 그들의 풍부한 데이터베이스 내 연결의 총 수의 ppm으로 정량 데이터 집합에 따라 다른 위치를 주문할 것 이다.
    1. 가장 풍부한 위치는 "ORF에" 와 "프레임에". 위치에 대 한 값은 상위 텍스트 상자에 NCBI 참고 순서 ('NM' 번호) 유전자의 염기 위치에 해당 합니다. 이 시퀀스는 은행 (https://www.ncbi.nlm.nih.gov/nuccore/)에서 검색 하거나 Blast_Query 창에서 아래쪽 텍스트 상자에서 복사 될 수 있습니다.
      참고: 예를 들어 그림 6, 중간 패널에서에서 찾을 수 있습니다. 센터에는 '결과' 가장 풍부한 교차점으로 표시: '위치': 867; '#Junctions': 20033.821; '쿼리 시작', 1; CD: ORF;에 그리고 '프레임': 프레임에. 은행 NCBI 참고 순서 NM_019648의 뉴클레오티드 867 먹이 파편의 시작 이다.
  3. 쿼리를 시작 하는 것이 1, 뇌관 포함 위치 번호에 해당 하는 뉴클레오티드의 5' 끝을 디자인 하 고 그 위치 (그림 7)에서 다운스트림 25 뉴클레오티드를 연장. 쿼리 시작은 이상의 1, 관심사의 먹이 순서 Gal4 활성화 도메인 사이의 여분의 뉴클레오티드는 고 그 뇌관 시작 한다 더 하류 쿼리 시작 값에 따라 것을 나타냅니다.
  4. DEEPN 창에서 "데이터 분석" 아래 "깊이 읽기" 버튼을 클릭 합니다. 일단 읽기 깊이 창이 열리면, 상단 텍스트 상자에 NCBI 참조 시퀀스 (NM) 번호 또는 유전자 이름을 입력 합니다. 풀 다운 메뉴를 사용 하 여 관심의 풍부한 유전자를 포함 하는 관련 데이터 집합을 선택 합니다. 왼쪽에 테이블을 사용 하 고 그래픽 얼마나 많은 읽기의 관심 (그림 7B) 유전자에 해당 하는 데이터에서 발견 된 확인 하려면 오른쪽에 표시.
  5. 3' 끝 뇌관 읽기 깊이 계산 유전자 조각의 시퀀스 캡처 것입니다 디자인. ORF 넘어 읽기의 풍부한 경우 codon 중지, 정지 코 돈과 정지 codon의 상류 그냥 지역 포함 되도록 뇌관 디자인. 유전자에 대 한 시퀀스 정지 codon 과거를 확장 하지 않습니다, 경우 결과 표를 사용 하는 가장 먼 3' 영역을 검색 하는 멀리 3'로이 위치를 사용 하 여 뇌관을 배치 하는 위치.
    참고: 읽기 깊이 프로그램 관심의 지정 된 유전자 또는 cDNA를 일치 하는 시퀀스를 찾을 수 간격으로 검색 합니다. 이 샘플에서 해당 유전자에 대 한 가장 풍부한 먹이 조각의 5'과 3' 끝이 예측할 수 있습니다. 시퀀스의 길이 따라 읽기 깊이에서 동요는 정상, 그림 7에서 볼 수 있습니다. 이면 읽기 깊이 명확 하 게 정지 codon 과거 먹이 조각 정지 codon를 지 나 확장 하 고 따라서 3' 뇌관 단순히 정지 codon 주변 지역 대응 될 수 있습니다 나타냅니다.
  6. 유전자 당 50 µ L PCR 반응을 수행 합니다. 각 반응 포함 각 정방향 및 역방향 뇌관 먹이 도서관 플라스 미드를 일치의 25 pmol (재료의 표 참조). 반응 또한 높은-충실도 2 x PCR 마스터 믹스의 25 µ L, 5 µ g의 DNA 샘플, 그리고 50 µ L까지 물을 포함합니다.
    1. 72 ° C, 어 닐 링 30 55 ° C의 온도에서 3 분의 확장 시간 25 사이클에 대 한 반응을 증폭 s, 98 ° C 10에서 변성 시키기 사이클링 98 ° C에 30 s 변성에 의해 선행 s. 고 따라 72 ° c.에서 5 분 부 화와

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

결과

Fastq 데이터 매핑: 첫 번째 단계
실질적으로 모든 NGS 응용 프로그램 DEEPN 초기 출력은 짧은 시퀀스 읽기 게놈에 정렬 하 여 매핑할 수 합니다 파일을 포함 하 여, transcriptomic, 또는 다른 DNA8참조. 최근, HISAT2 맞춤 프로그램 최신의 색인 생성 알고리즘을 사용 하 여 매핑 속도7,9를 극적으로 증가 하는 개발 되었다. HISAT2 데스크톱 컴퓨터에서 효율적으로 실행 하 고 지도 일반적으로 크기의 분에 파일을 읽을 수 있습니다. 이 수 있었습니다 HISAT2 라는 MAPster 로컬로, fastq 파일을 매핑할 수 있는 그래픽 사용자 인터페이스로 포장 명령줄 언어 (그림 1) 일반적으로 작동 하는 원격...

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

토론

여기에 설명 된 소프트웨어 제품군 완전히 처리 하 고 높은 처리량 DEEPN 실험에서 DNA 시퀀싱 데이터를 분석 한 수 있습니다. 사용 하는 첫 번째 프로그램은 MAPster 표준 fastq 파일에서 DNA 순서 읽기 하 고 다운스트림 처리 DEEPN 소프트웨어를 포함 한 정보 프로그램의 전체 호스트에 대 한 참조 DNA에 그들의 위치를 지도. MAPster 인터페이스와 결합 입력된 파일, 여러 작업을 대기열에 능력의 유틸리티 coveniently 이름 출력 파일, 프로그램7 제어의 다양 한 사용 하기 쉬운 도구 매핑 제공 하는 기본 HISAT2의 속도와 결합 DEEPN 넘어 응용 프로그램입니다. MAPster는 DEEPN 외 데이터 분석의 다른 유형을 위해 적응 되는 HISAT2 프로그램의 몇 가지 매개 변수를 액세스할 수 있습니다. 이러한 기능 중 일부는 RNA-seq와 전체 게놈 매핑 실험에 대 한 미리 설정 된 매개 변수를 포함 하 고 쉽게 조정 가능한 HISAT2 매개 변수 ...

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

공개 사항

저자 공개할 게 없다

감사의 글

이 작품은 건강의 국가 학회에 의해 지원 되었다: NIH R21 EB021870-01A1 NSF 연구 프로젝트 그랜트에 의해: 1517110.

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

재료

이 논문에 사용된 재료 목록
이름회사카탈로그 번호댓글
Mapsterhttps://github.com/emptyewer/MAPster/releases
DEEPN 소프트웨어https://github.com/emptyewer/DEEPN/releases
Statmakerhttps://github.com/emptyewer/DEEPN/releases
최소 컴퓨터 시스템AppleMac Intel Core i5 이상
-4Gb RAM 또는
Gb Disk spce 이상
OS 10.10 이상
DellIntel i5-7400 이상
RAM 또는
better-500 4Gb better-500 Gb Disk spce 이상 Windows 7 이상

참고문헌

  1. Fields, S., Song, O. A novel genetic system to detect protein-protein interactions. Nature. 340 (6230), 245-246 (1989).
  2. Rajagopala, S. V. Mapping the Protein-Protein Interactome Networks Using Yeast Two-Hybrid Screens. Advances in Experimental Medicine and Biology. 883, 187-214 (2015).
  3. Weimann, M., et al. A Y2H-seq approach defines the human protein methyltransferase interactome. Nature Methods. 10 (4), 339-342 (2013).
  4. Yachie, N., et al. Pooled-matrix protein interaction screens using Barcode Fusion Genetics. Molecular Systems Biology. 12 (4), 863(2016).
  5. Trigg, S. A., et al. CrY2H-seq: a massively multiplexed assay for deep-coverage interactome mapping. Nature Methods. , (2017).
  6. Pashkova, N., et al. DEEPN as an Approach for Batch Processing of Yeast 2-Hybrid Interactions. Cell Reports. 17 (1), 303-315 (2016).
  7. Kim, D., Langmead, B., Salzberg, S. L. HISAT: a fast spliced aligner with low memory requirements. Nature Methods. 12 (4), 357-360 (2015).
  8. Reinert, K., Langmead, B., Weese, D., Evers, D. J. Alignment of Next-Generation Sequencing Reads. Annual Review of Genomics and Human Genetics. 16, 133-151 (2015).
  9. Pertea, M., Kim, D., Pertea, G. M., Leek, J. T., Salzberg, S. L. Transcript-level expression analysis of RNA-seq experiments with HISAT, StringTie and Ballgown. Nature Protocols. 11 (9), 1650-1667 (2016).
  10. Conesa, A., et al. A survey of best practices for RNA-seq data analysis. Genome Biology. 17, 13(2016).

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

재인쇄 및 허가

이 JoVE 논문의 텍스트 또는 그림 재사용 허가 요청

허가 요청

태그

hybridMAPsterDEEPNStat Maker

관련 논문