이 콘텐츠를 보려면 JoVE 구독이 필요합니다. 로그인하거나 오늘 무료 평가판을 시작하세요.

방법 논문

일괄 처리 효 모 2 잡종 스크린에서 시퀀스 데이터의 informatic 분석

6.9K 조회수

⸱

DOI:

10.3791/57802

⸱

2018년 6월 28일

이 논문에서

요약

효 모 인구 잠재적으로 긍정적인 효 모 2 잡종 상호 작용에 대 한 선택의 깊은 시퀀싱 풍부한 파트너 단백질 상호 작용에 대 한 정보를 생성 합니다. 여기, 우리가 특정 생물 정보학 도구와 같은 화면에서 시퀀스 데이터 분석 사용자 지정 된 업데이트 소프트웨어의 동작을 설명 합니다.

초록

우리는 동시에 높은 처리량 짧은 읽기 DNA 시퀀싱을 활용 한 화면 내에서 임시 및 정적 단백질 상호 작용의 수십을 밝히기 위해 효 모 2 잡종 분석 결과 적응 했습니다. 결과 시퀀스 데이터 집합 수 뿐만 아니라 인구에 긍정적인 효 모 2 잡종 상호 작용을 위해 선택 하는 동안 풍성 하 게 하는 어떤 유전자를 추적 하지만 또한 상호 작용에 대 한 충분 한 단백질의 관련 하위 도메인에 대 한 자세한 정보를 제공. 여기, 우리는 비-전문가 모든 생물 정보학 및 통계 단계를 처리 하 고 일괄 처리 효 모 2 잡종 분석 결과에서 DNA 시퀀스 fastq 파일을 분석을 수행할 수 있는 독립 실행형 소프트웨어 프로그램의 전체 제품군을 설명 합니다. 이러한 소프트웨어에 의해 보호 처리 단계를 포함: 해당 각 후보 단백질 효 모 2 잡종 먹이 라이브러리;에서 인코딩 하 1) 매핑 및 계산 순서 읽기 2) 통계 분석 프로그램을 평가 하는 농축 프로 파일; 그리고 3) 변환 프레임 및 관심사의 상호 작용 단백질 인코딩합니다 각 농축된 플라스 미드의 코딩 영역 내에서 위치를 검사 하는 도구.

서론

단백질 상호 작용을 발견 하는 한 가지 방법은 효 모 2 잡종 (Y2H) 분석 결과, 어떤 악용 설계 관심사의 단백질의 상호 작용 파트너1조각에 묶을 때에 자라는 효 모 세포 이다. 여러 Y2H 상호 작용의 탐지는 지금 대규모 병렬 높은 처리량 시퀀싱의 도움으로 할 수 있습니다. 여러 가지 형식 되었습니다 설명2,3,,45 포함 한 우리가 개발 인구 일괄 생성 하 플라스 미드를 포함 하는 효 모에 대 한 선택 하는 조건 하에서 재배 되는 긍정적인 Y2H 상호 작용6. 워크플로 우리 개발, 되 나 DEEPN (동적 농축 단백질 네트워크의 평가 위한), 하나의 단백질 (또는 도메인) 대와 상호 작용 하는 단백질을 식별 하기 위해 같은 먹이 라이브러리에서 차동 interactomes 식별. 다른 단백질 또는 conformationally 별개의 돌연변이 도메인입니다. 이 워크플로의 주요 단계 중 하나는 적절 한 처리 및 DNA 시퀀싱 데이터의 분석 이다. 유사한 RNA-seq 실험의 Y2H 상호 작용 방식에서 선택 전후에 둘 다 각 유전자에 대 한 읽기 수 계산 하 여 몇 가지 정보를 얻을 수 있습니다. 그러나, Y2H 상호 작용을 만들 수 있는 특정된 단백질의 하위 도메인에 대 한 정보를 포함 하 여이 데이터 집합에서 훨씬 더 자세한 정보를 추출할 수 있습니다. 또한, 반면 DEEPN 방식은 귀중 한 많은 샘플 복제 분석 수 복잡 하 고 비싼입니다. 이 문제는 복제의 수는 제한6DEEPN 데이터 집합을 위해 특별히 개발 된 통계 모델 사용 하 여 완화 됩니다. 있도록 처리 및 DNA 시퀀싱 데이터 집합의 분석, 완전 한, 강력한, 안정적이 고 접근 없이 생물 정보학 전문 수 사관에 대 한, 우리는 분석의 모든 단계를 커버 하는 소프트웨어 프로그램의 한 벌을 개발 했다.

데스크톱 컴퓨터에서 실행 되는 독립 실행형 소프트웨어 프로그램의이 제품군 MAPster, DEEPN, 및 Stat_Maker 포함 되어 있습니다. MAPster 다운스트림 응용 프로그램에 사용 하기 위해 표준.sam 파일을 만드는 각 fastq 파일 대기7HISAT2 프로그램 사용 하 여 게놈에 매핑할 수 있는 그래픽 사용자 인터페이스입니다. DEEPN 여러 모듈 있다. 그것은 할당 하 고 해당 특정 유전자 유사한 ' 유전자 개수 ' 모듈을 사용 하는 RNA-seq 형식 정량화 하는 읽기를 계산. 그것은 또한 Gal4 transcriptional 도메인 및 먹이 시퀀스 사이의 교차점에 해당 하는 시퀀스를 추출 하 고 대조 비교 테이블 및 그래프 (를 사용 하 여 모듈 'Junction_Make')에 의해 그들의 검사를 허용 하도록 이러한 연결의 위치 모듈 'Blast_Query' 쉬운 검사와 정량, 접합 Gal4 접점 시퀀스의 비교를 허용 한다. Stat_Maker는 통계적으로 확률이 Y2H 안타에 우선 순위를 지정 하는 방법으로 유전자 농축 데이터 당 읽기 평가 합니다. 여기, 우리는 이러한 소프트웨어 프로그램을 사용 하 고 완전히 DEEPN Y2H에서 데이터 실험 DNA 시퀀스를 분석 하는 방법을 설명 합니다. 버전 DEEPN의 PC, 맥, 그리고 리눅스 시스템에서 실행할 수 있습니다. MAPster 매핑 프로그램 같은 다른 프로그램 및 DEEPN 통계 모듈 Stat_Maker 서브루틴 유닉스에서 실행 하 고 Mac 및 linux 시스템에만 사용할 수 있습니다에 의존.

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

프로토콜

1. 매핑 Fastq 파일

참고: DEEPN 소프트웨어 뿐만 아니라 많은 생물 정보학 프로그램 참조 DNA에에서 그것의 위치에 대 한 각각의 시퀀스를 읽고 매핑된 점에서 DNA 시퀀스 데이터를 사용 합니다. 다양 한 매핑 프로그램이.sam 파일 이후 단계에서 사용을 생산 하기 위해 HISTAT2 프로그램을 사용 하 여 여기 MAPster 인터페이스를 포함 한 사용할 수 있습니다.

  1. 게놈의 올바른 버전을 시퀀스 데이터를 매핑하십시오. 마우스 유래의 Y2H 라이브러리 사용 UCSC mm10 게놈; 인간의 유전자를 사용 하 여, UCSC hg38 참조 게놈 유전자를 Saccharomyces cerevisiae 사용, UCSC SacCer3 참조 게놈을 사용 하 여.
  2. MAPster를 설치 합니다.
    1. MAPster 소프트웨어 다운로드 및 설치. 다음에 웹 브라우저를 사용 하 여 소프트웨어를 찾을 수 있습니다: https://github.com/emptyewer/MAPster/releases. HISAT2는 애플 매킨토시와 같은 유닉스 기반 시스템에서 실행 됩니다. 이 때문에, MAPster 프로그램 애플 매킨토시와 리눅스와 같은 호환 되는 시스템에만 실행 됩니다.
      참고: 애플 맥에 대 한 시스템 요구 사항은: OSX 10.10 + > 4 기가바이트 RAM, > 500 기가바이트 디스크 공간, 및 참조 게놈을 다운로드 하기 위한 인터넷 액세스. 사용자와 상담 하는 기관 그것은 사람이 그들의 엔터프라이즈 관리자 권한 및 사용 권한을 제한 하는 보안 프로토콜 경우 해야 합니다.
  3. 필요한 파일 및 "기본" 탭 (그림 1)을 통해 매개 변수를 입력 합니다. 적절 한 "Pairwise" 버튼을 파일을 입력으로 쌍 또는 기본 파일 형식으로 FASTQ와 홀 중 하나를 선택 합니다.
    1. DEEPN 분석에 대 한 단일 읽기 형식에서 실행 하는 "Off"로 "Pairwise" 옵션을 설정 합니다.
    2. 드래그-앤-드롭 적절 한 창에 의해 단순히 MAPster 파일 로드.
    3. Y2H 먹이 라이브러리 삽입의 소스에 해당 하는 DNA/게놈 소스 참조를 선택 합니다. 여러 모델 생물에서 인덱싱된 게놈 "게놈" 상자에 나열 되 고 다운로드 될 수 있다 자동으로 존스 홉킨스 대학 센터에서 전산 생물학에 대 한. 참조 게놈은 나중에 사용 하기 위해 로컬로 저장 됩니다.
    4. HISAT2 지원 멀티 스레딩 이후 "스레드" 상자에서 매핑 프로그램에 헌신 하 게 될 컴퓨터 프로세스의 수를 나타냅니다. MAPster는 컴퓨터를 검색 하 고 기본적으로 사용할 수 있는 프로세서의 최대 수는 것이 좋습니다.
    5. 출력 파일 이름을 지정 합니다. 이 파일 이름은 공백이 나 특수 문자 없이 짧은 아직 설명 이름 좋습니다 그래서 DEEPN 과정 전반에 걸쳐 사용 됩니다. "오픈 출력 디렉터리" 단추를 사용 하 여 매핑된 파일을 출력 폴더를 지정 합니다.
    6. 일단 적절 한 파일 및 매개 변수를 선택 "대기열에 추가" 버튼을 사용 하 여 작업 큐를 매핑 작업을 추가 합니다. 주 창에서 파일 이름을 수 삭제 하 고 파일에 해당 하는 새 예제로 교체 하 고 해당 출력 파일 이름이 제공 된 후 큐에 추가할 수 있습니다.
    7. 모든 작업은 작업 큐에 입력 되 면 "실행 큐" 버튼을 클릭 합니다.
      참고: 매핑 작업 큐에 배치 되었습니다, 일단 "작업 매개 변수" 창에 "작업 명령" 창에 표시 될 모든 인수 사용 하 여 명령줄 문을 표시할 매개 변수 설정을 그 일을 선택 하면 됩니다. 출력 옵션 정렬에 실패 계속 읽기 여부 감독 등 각 읽기에 대해 허용 하는 기본 정렬 수 지정. 기본 출력 파일 MAPster에서 샘 형식 (예: '.sam' 파일)입니다. 그것은 모든 fastq 파일에서 시퀀스 읽기 (매핑된) 했다를 포함 하 여 그 샘플에 대 한 지정 되지 않았습니다 포함 됩니다 (매핑하지) 지정 된 geome를 성공적으로 매핑된.

2. Bioinformatic 처리를 사용 하 여 DEEPN 소프트웨어

참고: DEEPN 소프트웨어는 현재 컴파일 사용 마우스 cDNA 시퀀스, 인간 cDNA 시퀀스, 또는 S. cerevisiae genomic DNA 순서를 포함 하는 먹이 라이브러리와. DEEPN 표준.sam 파일 포맷을 수락 하 고 매핑되지 않은 매핑된 읽기 각 매핑된 및 매핑되지 않은 읽기 또는 별도 파일을 포함 하는 샘 (.sam) 파일을 받아들일 수 있다.

  1. DEEPN 소프트웨어 다운로드 및 설치. 다음에 웹 브라우저를 사용 하 여 소프트웨어를 찾을 수 있습니다: https://github.com/emptyewer/DEEPN/releases. 컴퓨팅 플랫폼 및 다운로드 버전 일치를 선택 합니다. 를 설치 하려면 다운로드 한 설치 패키지를 엽니다.
    참고: 버전 DEEPN의 PC, 맥, 그리고 리눅스 sysrems 사용할 수 있습니다. Mac과 PC 시스템 있어야 > 500 Gb 하드 디스크 공간 및 > 4gb의 RAM.
  2. DEEPN 소프트웨어를 엽니다. 주 창 (그림 2)에서 위쪽 선택 상자에서 해당 먹이 라이브러리 정보를 선택 합니다. 처리 된 파일 폴더/디렉터리를 "작업 폴더" 버튼을 클릭 하 여 이동 갈 수 있는 폴더를 선택 합니다. 하나는 필요한 경우 새로운 폴더/디렉터리를 만들 수 있습니다. "작업 폴더"를 선택 DEEPN unmapped_sam_files, mapped_sam_files, 및 sam_files는 3 개의 하위 폴더를 만듭니다.
    1. 경우.sam 파일 포함 된 매핑된 및 매핑되지 않은 읽기 등을 사용 하 여 MAPster 프로그램의 기본 설정으로, 'sam_files' 폴더에 넣어. 그렇지 않으면 장소.sam 파일 unmapped_sam_files와 mapped_sam_files에 따라.
  3. "유전자 수 + 접합" 확인 버튼을 클릭 하 여 처리를 시작 합니다.
    참고: 처리는 각 유전자에 해당 하는 얼마나 많은 읽기를 매핑 위치를 사용 하는 유전자 수 모듈 함께 시작 됩니다. 접합 확인 다음 추출 접점 시퀀스 (시퀀스 직접 융합 Gal4 활성화 도메인에서 다운스트림) 읽기에서 폭발 알고리즘을 사용 하 여 그들을 식별 하 고. 이것은 그림 3에 표시 하는 폴더의 전체 집합을 만듭니다. 처리 시간 크기와 시퀀스 데이터 파일의 수 및 사용 하는 컴퓨터의 처리 속도에 따라 달라 집니다. 전형적인 시간 범위 12-30 h ~ 250 백만의 실험 데이터 집합에서 읽습니다. 유전자 수 절차 및 Junction_Make 절차는 "유전자 개수" 단추 또는 "접합" 확인 버튼을 클릭 하 여 개별적으로 시작할 수 있습니다.
  4. 다운로드 및 설치 Stat_Maker (https://github.com/emptyewer/DEEPN/releases). 현재 유닉스 맥 시스템 에서만 작동 DEEPN 데이터 집합을 위한 통계 분석 패키지입니다.
    1. Stat_Maker을 "설치 확인" (그림 4) 버튼을 클릭 합니다. 처음으로 실행 하는 경우 Stat_Maker 자동으로 설치 합니다 R, JAGS, 및 Bioconductor는 인터넷에서 이러한 리소스를 당겨. 일단 R, JAGS, 및 Bioconductor를 감지 Stat_Maker 활성화 하 고 추가 사용자 입력을 허용.
    2. DEEPN 처리 작업 폴더 탐색 "폴더 선택" 버튼을 클릭 합니다. Stat_Maker 자동 발견 하 고 창에서 통계 분석을 위해 파일을 나열 합니다.
    3. 적절 한 파일에서에서 끌어서 위의 파일 목록 창 각 벡터 및 미끼 데이터 집합에 대 한 및 각 성장 조건에 대 한 아래 파일 창으로: 선택 되지 않은 (그의 + 미디어) (그의-미디어)을 선택. 중요 한 것은, Stat_Maker의 두 샘플 선택 및 빈에 대 한 중복 데이터 집합 벡터 혼자, 선택 되지 않은 인구의 두 샘플 필요 합니다. 이 실험에서 가변성의 견적을 제공합니다.
    4. "실행" 버튼을 클릭 합니다. 컴퓨터의 속도 따라 계산 5-15 분 사이 걸릴 것입니다.
  5. "Stat_Maker" 결과 주요 작업 폴더 내에서 새로운 하위 폴더에 배치 되는 Stat_Maker 출력 결과 검토 합니다.
    참고: 결과 CSV (쉼표로 구분 된 값) 파일을 열 수 있는 일반적인 스프레드시트 프로그램에서 발견 된다. Stat_Maker 차동 미끼와 함께 관심을 선택 빈 pTEF GBD (그림 5)에 농축 될 가능성이 높은 유전자 안타를 평가할 것 이다. 또한 표로 어디 유전자 삽입 발견 업스트림, 다운스트림, 또는 열려있는 독서 프레임 및 올바른 변환 독서 내 유전자도 발견 여부 내 각 데이터 집합에 대 한 읽기 비율이입니다. 종종 DEEPN 해당 단백질의 적절 한 독서 프레임에서 또는 해당 오픈-독서 프레임의 하류는 cDNA의 부분에는 주어진된 cDNA의 일부와 미끼의 강력한 Y2H 상호 작용을 사로잡을 것입니다. Stat_Maker에서 결합 된 출력 스캔 탐지 및 제거가 없는 안타의 합리화.
  6. 각 잠재적인 후보에 대 한 데이터를 검토 하려면 DEEPN 소프트웨어를 열고, 해당 먹이 라이브러리 정보 및 다음 "작업 폴더"를 사용 하 여 올바른 작업 폴더를 선택 합니다.
    1. "폭발 쿼리" 버튼을 클릭 합니다. 이 새로운 창 (그림 6)를 로드합니다. 위쪽 텍스트 상자에서 유전자 이름 또는 관심사의 후보 유전자 선택 은행 NM 번호를 입력 합니다. 이러한 유전자 이름 StatMaker 출력 파일에 나열 된 이름에 해당 합니다. 유형 입력 하거나 반환,이 관심사의 유전자의 검색을 시작 합니다.
    2. 어떤 데이터 집합 "데이터 집합 선택" 메뉴를 사용 하 여 분석을 위해 사용 됩니다를 선택 합니다. 일반적으로, 이러한 벡터만 포함 하 고 선택적 비 조건에서 성장 하는 샘플 및 선택 조건 하에서 성장 하는 미끼 샘플 미끼. 그러나 처음, 데이터를 로드 하는 데 몇 분 걸릴 것입니다, 그리고, 다른 유전자와 같은 데이터 집합의 후속 쿼리 빠르게 갈 것입니다. Blast_Query는 관심과 각 융해 점은 어떻게 풍부한의 순서에 따라서 퓨전 포인트 표시 됩니다. 이 모두 "결과" 탭을 사용 하 여 테이블 형식 또는 "플롯" 탭을 사용 하 여 그래픽 형식에 표시 될 수 있습니다. 이러한 결과 오른쪽 상단에 있는 ".csv 저장" 버튼을 클릭 하 여.csv 파일로 내보낼 수 있습니다.

3입니다. 후보자 DEEPN 식별 확인

참고: DEEPN 및 Stat_Maker의 목적은 긍정적인 Y2H 상호 작용을 주는 후보 유전자를 식별 하는. 같은 Y2H 상호 작용을 확인 수 수 관심의 미끼 플라스 미드를 사용 하 여 전통적인 이진 Y2H 형식을 사용 하 여 할 빈 Gal4 활성화 도메인 '먹이' 플라스 미드와 결합 뿐 아니라 먹이 플라스 미드의 유전자 또는 cDNA 조각 들고와. 그것은 효 모 인구 Y2H 선택 대상에서 분리 된 DNA의 혼합물에서 관심사의 실제 플라스 미드 분리 가능. 그러나, 하나의 수 계산 유전자 또는 cDNA 조각 Y2H 상호 작용을 생성 하는 재구성, 5'과 3' 그 파편의 끝에 대 한 프라이 머 디자인과 효 모 인구에서 고립 된 DNA에서 그 단편을 증폭. 후보 먹이 조각의 5'과 3' 끝을 찾는 방법에 설명 합니다.

  1. DEEPN 소프트웨어 열고 매개 변수 "선택 매개 변수" 및 "작업 폴더 선택"에 해당 하는 프로젝트의 작업 폴더를 선택 합니다. "폭발 쿼리" 버튼을 클릭 하 여 Blast_Query 모듈을 실행 합니다.
  2. 관심이 나 그것의 은행 "NM"의 유전자의 이름을 입력 합니다 위쪽 텍스트 상자에 숫자. 풀 다운 메뉴에서 해당 하는 선택 된 효 모 인구 미끼에 대 한 관심의 접합 위치 '결과' 탭의 테이블을 검색 하는 데이터 집합을 선택 합니다. 기본적으로 Blast_Query 그들의 풍부한 데이터베이스 내 연결의 총 수의 ppm으로 정량 데이터 집합에 따라 다른 위치를 주문할 것 이다.
    1. 가장 풍부한 위치는 "ORF에" 와 "프레임에". 위치에 대 한 값은 상위 텍스트 상자에 NCBI 참고 순서 ('NM' 번호) 유전자의 염기 위치에 해당 합니다. 이 시퀀스는 은행 (https://www.ncbi.nlm.nih.gov/nuccore/)에서 검색 하거나 Blast_Query 창에서 아래쪽 텍스트 상자에서 복사 될 수 있습니다.
      참고: 예를 들어 그림 6, 중간 패널에서에서 찾을 수 있습니다. 센터에는 '결과' 가장 풍부한 교차점으로 표시: '위치': 867; '#Junctions': 20033.821; '쿼리 시작', 1; CD: ORF;에 그리고 '프레임': 프레임에. 은행 NCBI 참고 순서 NM_019648의 뉴클레오티드 867 먹이 파편의 시작 이다.
  3. 쿼리를 시작 하는 것이 1, 뇌관 포함 위치 번호에 해당 하는 뉴클레오티드의 5' 끝을 디자인 하 고 그 위치 (그림 7)에서 다운스트림 25 뉴클레오티드를 연장. 쿼리 시작은 이상의 1, 관심사의 먹이 순서 Gal4 활성화 도메인 사이의 여분의 뉴클레오티드는 고 그 뇌관 시작 한다 더 하류 쿼리 시작 값에 따라 것을 나타냅니다.
  4. DEEPN 창에서 "데이터 분석" 아래 "깊이 읽기" 버튼을 클릭 합니다. 일단 읽기 깊이 창이 열리면, 상단 텍스트 상자에 NCBI 참조 시퀀스 (NM) 번호 또는 유전자 이름을 입력 합니다. 풀 다운 메뉴를 사용 하 여 관심의 풍부한 유전자를 포함 하는 관련 데이터 집합을 선택 합니다. 왼쪽에 테이블을 사용 하 고 그래픽 얼마나 많은 읽기의 관심 (그림 7B) 유전자에 해당 하는 데이터에서 발견 된 확인 하려면 오른쪽에 표시.
  5. 3' 끝 뇌관 읽기 깊이 계산 유전자 조각의 시퀀스 캡처 것입니다 디자인. ORF 넘어 읽기의 풍부한 경우 codon 중지, 정지 코 돈과 정지 codon의 상류 그냥 지역 포함 되도록 뇌관 디자인. 유전자에 대 한 시퀀스 정지 codon 과거를 확장 하지 않습니다, 경우 결과 표를 사용 하는 가장 먼 3' 영역을 검색 하는 멀리 3'로이 위치를 사용 하 여 뇌관을 배치 하는 위치.
    참고: 읽기 깊이 프로그램 관심의 지정 된 유전자 또는 cDNA를 일치 하는 시퀀스를 찾을 수 간격으로 검색 합니다. 이 샘플에서 해당 유전자에 대 한 가장 풍부한 먹이 조각의 5'과 3' 끝이 예측할 수 있습니다. 시퀀스의 길이 따라 읽기 깊이에서 동요는 정상, 그림 7에서 볼 수 있습니다. 이면 읽기 깊이 명확 하 게 정지 codon 과거 먹이 조각 정지 codon를 지 나 확장 하 고 따라서 3' 뇌관 단순히 정지 codon 주변 지역 대응 될 수 있습니다 나타냅니다.
  6. 유전자 당 50 µ L PCR 반응을 수행 합니다. 각 반응 포함 각 정방향 및 역방향 뇌관 먹이 도서관 플라스 미드를 일치의 25 pmol (재료의 표 참조). 반응 또한 높은-충실도 2 x PCR 마스터 믹스의 25 µ L, 5 µ g의 DNA 샘플, 그리고 50 µ L까지 물을 포함합니다.
    1. 72 ° C, 어 닐 링 30 55 ° C의 온도에서 3 분의 확장 시간 25 사이클에 대 한 반응을 증폭 s, 98 ° C 10에서 변성 시키기 사이클링 98 ° C에 30 s 변성에 의해 선행 s. 고 따라 72 ° c.에서 5 분 부 화와

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

결과

Fastq 데이터 매핑: 첫 번째 단계
실질적으로 모든 NGS 응용 프로그램 DEEPN 초기 출력은 짧은 시퀀스 읽기 게놈에 정렬 하 여 매핑할 수 합니다 파일을 포함 하 여, transcriptomic, 또는 다른 DNA8참조. 최근, HISAT2 맞춤 프로그램 최신의 색인 생성 알고리즘을 사용 하 여 매핑 속도7,9를 극적으로 증가 하는 개발 되었다. HISAT2 데스크톱 컴퓨터에서 효율적으로 실행 하 고 지도 일반적으로 크기의 분에 파일을 읽을 수 있습니다. 이 수 있었습니다 HISAT2 라는 MAPster 로컬로, fastq 파일을 매핑할 수 있는 그래픽 사용자 인터페이스로 포장 명령줄 언어 (그림 1) 일반적으로 작동 하는 원격...

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

토론

여기에 설명 된 소프트웨어 제품군 완전히 처리 하 고 높은 처리량 DEEPN 실험에서 DNA 시퀀싱 데이터를 분석 한 수 있습니다. 사용 하는 첫 번째 프로그램은 MAPster 표준 fastq 파일에서 DNA 순서 읽기 하 고 다운스트림 처리 DEEPN 소프트웨어를 포함 한 정보 프로그램의 전체 호스트에 대 한 참조 DNA에 그들의 위치를 지도. MAPster 인터페이스와 결합 입력된 파일, 여러 작업을 대기열에 능력의 유틸리티 coveniently 이름 출력 파일, 프로그램7 제어의 다양 한 사용 하기 쉬운 도구 매핑 제공 하는 기본 HISAT2의 속도와 결합 DEEPN 넘어 응용 프로그램입니다. MAPster는 DEEPN 외 데이터 분석의 다른 유형을 위해 적응 되는 HISAT2 프로그램의 몇 가지 매개 변수를 액세스할 수 있습니다. 이러한 기능 중 일부는 RNA-seq와 전체 게놈 매핑 실험에 대 한 미리 설정 된 매개 변수를 포함 하 고 쉽게 조정 가능한 HISAT2 매개 변수 ...

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

공개 사항

저자 공개할 게 없다

감사의 글

이 작품은 건강의 국가 학회에 의해 지원 되었다: NIH R21 EB021870-01A1 NSF 연구 프로젝트 그랜트에 의해: 1517110.

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

재료

이 논문에 사용된 재료 목록
이름회사카탈로그 번호댓글
Mapsterhttps://github.com/emptyewer/MAPster/releases
DEEPN 소프트웨어https://github.com/emptyewer/DEEPN/releases
Statmakerhttps://github.com/emptyewer/DEEPN/releases
최소 컴퓨터 시스템AppleMac Intel Core i5 이상
-4Gb RAM 또는
Gb Disk spce 이상
OS 10.10 이상
DellIntel i5-7400 이상
RAM 또는
better-500 4Gb better-500 Gb Disk spce 이상 Windows 7 이상

참고문헌

  1. Fields, S., Song, O. A novel genetic system to detect protein-protein interactions. Nature. 340 (6230), 245-246 (1989).
  2. Rajagopala, S. V. Mapping the Protein-Protein Interactome Networks Using Yeast Two-Hybrid Screens. Advances in Experimental Medicine and Biology. 883, 187-214 (2015).
  3. Weimann, M., et al. A Y2H-seq approach defines the human protein methyltransferase interactome. Nature Methods. 10 (4), 339-342 (2013).
  4. Yachie, N., et al. Pooled-matrix protein interaction screens using Barcode Fusion Genetics. Molecular Systems Biology. 12 (4), 863(2016).
  5. Trigg, S. A., et al. CrY2H-seq: a massively multiplexed assay for deep-coverage interactome mapping. Nature Methods. , (2017).
  6. Pashkova, N., et al. DEEPN as an Approach for Batch Processing of Yeast 2-Hybrid Interactions. Cell Reports. 17 (1), 303-315 (2016).
  7. Kim, D., Langmead, B., Salzberg, S. L. HISAT: a fast spliced aligner with low memory requirements. Nature Methods. 12 (4), 357-360 (2015).
  8. Reinert, K., Langmead, B., Weese, D., Evers, D. J. Alignment of Next-Generation Sequencing Reads. Annual Review of Genomics and Human Genetics. 16, 133-151 (2015).
  9. Pertea, M., Kim, D., Pertea, G. M., Leek, J. T., Salzberg, S. L. Transcript-level expression analysis of RNA-seq experiments with HISAT, StringTie and Ballgown. Nature Protocols. 11 (9), 1650-1667 (2016).
  10. Conesa, A., et al. A survey of best practices for RNA-seq data analysis. Genome Biology. 17, 13(2016).

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

재인쇄 및 허가

태그

효모 이중 hybrid법서열 데이터 분석MAPster 소프트웨어DEEPN 분석Stat Maker 프로그램단백질 상호작용 네트워크생물정보학 처리고속 대량 스크리닝유전자 농축 프로파일링번역 프레임 분석