$$\rightleftharpoonup{xx}$$
$$\longleftharp{xx}$$,
$$\longrightharp{xx}$$,
1. Сформировать запасов вируса
Примечание: Блок - схема мокрого стендовых аспекту данного протокола показан на рисунке 1 Детали вирусной животноводческой продукции и последующей инфекции культуры ткани клеток, как правило , относятся к различным видам ретровирусов.. Для некоторых экспериментов, клетка - мишень не может выразить эндогенный вирусный рецептор (ы), и в таких случаях строительство pseudotyped ретровирусных частиц , несущих гетерологичные вирусный гликопротеин оболочки, например, G гликопротеин от вируса везикулярного стоматита (VSV-G), будет требуется для инфекции 44,45.
Примечание: предосторожность следует соблюдать осторожность при работе с ВИЧ-1. Хотя конкретные рекомендации будут варьироваться от одного учреждения к другому, все вирусы на основе работа должна проводиться в специальном, оператор ограничен шкаф биологической безопасности (обычно упоминается как капот культуре ткани). Правильное средства индивидуальной защитыкоторая включает в себя защиту лица, бахилы, двойной слой перчаток и комбинезона костюм всего тела следует носить в любое время. Все жидкие отходы в результате связанных с вирусом экспериментов должны быть инактивированной с отбеливателем (конечная концентрация 10%), и все отходы, включая твердые материалы следует автоклавировать перед утилизацией.
- За один день до трансфекции, пластины 3,3 х 10 6 клетки HEK293T в 10 мл Дульбекко в модификации Дульбекко (DMEM) , дополненной 10% (об / об) фетальной бычьей сыворотки и 1% (об / об) пенициллин / стрептомицин (10000 Ед / мл акций) в каждой из пяти 100-мм чашках.
Примечание: Дополненный-DMEM, упоминается как DMEM-FPS с этого момента. - На последующий день, трансфекции клеток с 10 мкг плазмиды, несущей полнометражных ретровирусные молекулярные клоны или 9 мкг конвертов с делецией однообходных векторов 1 мкг в конструкции экспрессии VSV-G с использованием коммерчески доступных реагентов трансфекции или фосфата кальция.
- Выдержите гргезов при 37 ° С в увлажненной культивирования клеток инкубаторе с 5% CO 2 (это условие в дальнейшем именуемые как "тканевой культуры инкубатор»). Примерно через 48 ч, урожай вируссодержащих клеточную среду, используя мерную пипетку и передать его через фильтр с размером пор 0,45 мкм самотеком.
- Концентрат вируса с помощью ультрацентрифугирования при 200000 х г в течение 1 ч при 4 ° С. Ресуспендируют вирус осадок в 500 мкл DMEM-FPS, содержащий 20 U ДНКазы, и инкубировали в течение 1 часа при 37 ° С.
Примечание: Ступень ДНКазы помогает уменьшить восстановление нежелательных плазмидных последовательностей за счет устранения тяжесть плазмидной ДНК, которая сохраняется от процедуры трансфекции.
- Определить концентрацию p24 46 с использованием ВИЧ-1 р24 антигена комплект захвата в соответствии с инструкциями изготовителя.
Примечание: концентрация Вирус также может быть определена с помощью анализа 47,48 активности обратной транскриптазы. В качестве альтернативы, уровень функционального вируса можетопределяется путем измерения Mol. Это наиболее легко сделать с помощью флуоресценции Активированный сортировки клеток с вирусами, которые экспрессируют флуоресцентные репортерные гены, такие как усиленный зеленый флуоресцентный белок. определение MOI может быть особенно полезно при работе с первичными клетками, которые могут не поддерживать такой же уровень инфекции, оптимизированных клеточных линий.
2. инфицировать клетки с вирусом
- Пластина 3,0 х 10 5 HEK293T клеток на лунку в 6-луночный планшет в 2,5 мл DMEM-FPS и инкубировать в течение ночи в инкубаторе тканевых культур.
Примечание: Число уникальных сайтов интеграции извлекаемых с этим протоколом, прямо пропорционально числу клеток и количества активного вируса, используемых в инфекции. - Инфицировать клетки при конечной концентрации вируса р24 500 нг / мл в конечном объеме 500 мкл свежей DMEM-FPS в течение 2 ч в инкубаторе тканевых культур, а затем добавляют 2 мл DMEM-ФПС предварительно нагретый до 37 ° С на лунку и продолжают инкубацию.
- В48 ч после заражения, носитель извлечь и промыть клетки с 2 мл фосфатно-буферном солевом растворе (PBS). Добавить 0,5 мл трипсин-ЭДТА предварительно нагревают до 37 ° С, и через несколько секунд визуально осмотреть лунки для клеток смещение.
- Добавьте 2 мл подогретого DMEM-FPS и ресуспендирования клеток путем осторожного вверх / вниз пипеткой с объемным пипеткой ~ 10 раз. Переносят раствор до 75 см 2 для культуры ткани колбу , содержащую 18 мл подогретого DMEM-ФПС, и инкубировать клетки в инкубаторе тканевых культур.
- После того, как минимально пять дней после начала инфекции, сбора клеток путем удаления носителя, промывают 5 мл PBS, добавляют 2 мл подогретого трипсин-ЭДТА, и вновь суспендируют с 5 мл предварительно подогретой среде DMEM-FPS пипетированием. Центрифуга раствор в течение 5 мин при комнатной температуре при 2500 х г, и отбросить супернатант.
Примечание: Несмотря на то, интеграция в этих условиях плато при температуре около 48 ч после заражения 49,50, дополнительные 3 дня культуры обязаны sufficientlY разбавить концентрацию неинтегрированных молекул ДНК, которые являются результатом клеточной ДНК-рекомбинации или вирусно-опосредованного Автоинтеграция. - Извлечение геномной ДНК из осадка клеток с использованием коммерчески доступного набора (например, см 51). Элюции ДНК с прилагаемого ионообменную колонку с 200 мкл 10 мМ Трис-HCl, рН 8,5.
Примечание: аликвоту клеток должны быть распределены на 48 ч после заражения (этап 2.3) для анализа инфекционности обеспечения надлежащей вирусной инфекции до NGS.
ДНК 3. Фрагмент геномную путем обработки ультразвуком или рестрикционным Digest
Примечание: Ультразвуком фрагментов геномной ДНК в последовательности практически-независимым способом , и, таким образом , предпочтительный способ фрагментации , когда секвенирования образцов с низкой скоростью восстановления ожидаемой (например, инфицированные клетки пациента или инфекции , инициированные при относительно низком MOI). Кроме того, обработка ультразвуком позволяет различать ПЦР дубликаты в Partiлярных последовательность интеграции сайта с уникальной интеграции в том же месте, что очень важно , чтобы отличить клональной экспансии провирусом клеток , содержащих у инфицированных пациентов (см Шаг 11 ниже) 39,52-54.
Примечание: ДНК должна быть расщеплены непосредственно ниже по потоку от верхней по потоку LTR, чтобы уменьшить усиление внутренних вирусных последовательностей во время LM-PCR. Рестриктаза BglII , который лежит 43 пар оснований ниже по потоку от верхней по потоку последовательности U5 и что несовместима для последующего лигирования с MseI-генерируемой концов ДНК , хорошо работает со многими штаммов ВИЧ-1 (Фигура 1В). При получении ДНК , с помощью обработки ультразвуком, рестриктазы внутренний расщепляющие следует применять после линкера лигирования (см фиг.1С - E и шаге 4.3 ниже).
- Для обработки ультразвуком, смесь 10 мкг геномной ДНК в нуклеазы без воды до конечного объема 120 мкл. Разрушать ультразвуком с использованием параметров для среднего размера разрыва 500 б.п. (два раунда следующего пунктаметров: рабочий цикл: 5%; Интенсивность: 3; циклов в порыве: 200; Время: 80 сек).
- Очищают обрабатывают ультразвуком ДНК с использованием набора для очистки ПЦР. Устранить концов ДНК с использованием набора конечных репарации ДНК и очищают ДНК с использованием набора для очистки ПЦР. A-хвост ДНК с помощью Кленова экзо - фермент и очищают ДНК А-белохвост с использованием набора для очистки ПЦР. Обратитесь к 51,52 дополнительных деталей использования комплекта.
- Для рестрикционной эндонуклеазой, вырезать 10 мкг геномной ДНК в течение ночи при 37 ° С в объеме 100 мкл с помощью буфера, поставляемых производителем и смеси ферментов (100 ед каждого), которые генерируют 5'-TA свесов, а также несовместимыми фермент, такой как BglII, который расщепляет вниз по течению от входного вирусного LTR. Очищают ДНК на следующий день с использованием набора для очистки ПЦР.
Примечание: Ни один из ферментов рестрикции не должны разрезать в терминале ~ 30 п.н. вирусного конца ДНК, который амплифицируют с помощью протокола LM-PCR. Этот протокол специально усиливает U5конец ДНК ВИЧ-1.
4. отжечь Linker олигонуклеотиды и лигируют к фрагментированным геномной ДНК
Примечание: Подготовить асимметричный линкер , содержащий выступ , который совместим с указанными выше фрагментами ДНК (см таблицу 1 для последовательностей олигонуклеотидов , используемых в данном протоколе). Линкер должен использоваться с ДНК облучали ультразвуком должна содержать совместимый "свес Т-3, в то время как линкер для MseI-расщепленной ДНК должна содержать совместимые 5'-TA свеса (рисунок 1). Короткий компоновщик прядь должна дополнительно содержать непродолжаемой химической модификации, такие как 3'-амин, чтобы ограничить последующие реакции амплификации в направлении ДНК, представляющей интерес.
Примечание: При подготовке нескольких различных библиотек интеграции узлов параллельно и / или при мультиплексировании уникальных образцов на том же секвенирования перспективе, рекомендуется использовать уникальные линкеров для каждого образца, чтобы ограничить потенциал для образца перекрестного contaminAtion во время ПЦР. Это дополнительно предполагает использование уникальных компоновщика праймеров для каждого образца в течение полу-гнездовой ПЦР (как описано ниже). Уникальные прядей линкера и компоновщика праймеры могут быть сконструированы путем скремблирования олигонуклеотидных последовательностей компоновщика , перечисленные в таблице 1 , при сохранении в целом сходно% содержание GC и применимые позиции сверхмандатов.
- Прокалить короткие и длинные нити компоновщика в 35 мкл 10 мМ Трис-HCl, рН 8.0-0.1 мМ ЭДТА (конечная концентрация 10 мкМ каждого нуклеотида) при нагревании до 90 ° С и медленно охлаждают до комнатной температуры с шагом 1 ° C в минуту.
- Приготовьте по меньшей мере, четыре параллельных реакций лигирования за геномной ДНК образца, которые содержат 1,5 мкМ лигирован компоновщик, 1 мкг фрагментированной ДНК и 800 U ДНК-лигазы Т4 в 50 мкл. Лигирования в течение ночи при 12 ° С. Очищают на следующий день с использованием набора для очистки ПЦР.
- Для образцов, полученных с помощью ультразвука, переваривать очищают реакцию лигирования с 100 ед в ОГРАНИЧЕНИЯМИции фермента , который расщепляет вниз по течению от верхнего LTR (например, BglII для ВИЧ-1) в соответствии с рекомендациями завода - изготовителя условия в течение ночи. Очищают ДНК с использованием набора для очистки ПЦР.
5. AMPLIFY Вирусные LTR-Host геномную ДНК Развязки по Semi-гнездовой ПЦР
Примечание: Для обеспечения оптимального разнообразия библиотеки, по крайней мере, 4-8 параллельных МКП, в зависимости от концентрации ДНК извлеченной реакции лигирования, должны быть подготовлены для каждого образца для обоих раундах ПЦР. концентрации ДНК-матрицы должна быть определена количественно с помощью спектрофотометрии. В этом протоколе первый и второй раунды ПЦР используют вложенными ДКП-специфических праймеров, но тот же линкер-специфического праймера используется для обоих раундов (таблица 1). Второй раунд LTR-специфического праймера и компоновщик-специфического праймера кодируют последовательности адаптеров для кластеризации ДНК, а также сайты связывания праймеров для секвенирования. Вложенный LTR-специфического праймера также кодирует последовательность индексов 6 нт, ВГIch можно варьировать среди различных праймеров для мультиплексирования библиотек в пределах того же секвенирования перспективе.
- Подготовка первого раунда МКП , содержащие ингредиенты , на пробирку, которые перечислены в таблице 2.
Примечание: Линкер-специфического праймера укрывает 22 нт комплементарности к линкеру, температура плавления 53 ° С, GC-содержанием 45%, а его 3'-конце расположен 15-16 пар оснований в обратном направлении от 3'-концу Различные линкерные длинные нити (таблица 1). Первый раунд 27 нт ДКП праймер имеет температуру плавления 59 ° С, GC-содержанием 48%, а его 3 'конец находится 34 пар оснований в обратном направлении от U5-конца ВИЧ-1. Область второго раунда праймера 26 нт LTR, который является дополнением к ВИЧ-1 LTR имеет температуру плавления 60 ° С, GC-содержание 50%, а его 3 'конце находится 18 пар оснований выше по течению от вирусного U5 конечная остановка. Рекомендуется, чтобы температура плавления олигонуклеотида и GC-содержание должно имитировать эти параметры, если пользователидизайн ПЦР - праймеры с измененными последовательностями ( в том числе для использования с другими ретровирусов) 21. - Запуск первого раунда ПЦР при следующих параметрах амплификатора: один цикл: 94 ° С в течение 2 мин; 30 циклов: 94 ° C в течение 15 сек, 55 ° С в течение 30 сек, 68 ° C в течение 45 сек; один цикл: 68 ° С в течение 10 мин.
- Бассейн реакции и очищают с использованием набора для очистки ПЦР. Подготовка второго раунда , содержащие МКП ингредиенты на пробирку в соответствии с таблицей 3. Запуск второго раунда ПЦР с использованием параметров Термоциклеры , описанных в шаге 5.2. Объединяют реакции и очищают ДНК с использованием коммерческого набора для очистки ПЦР в соответствии с инструкциями изготовителя.
Примечание: Разнообразие рекомендуемых индексов последовательностей ДНК , совместимых с кластерными NGS доступны 71.
6. Выполните QC и NGS (Обычно это с помощью секвенирования фонда)
- (КК тест # 1) Подтвердить Шаг 5.3 Библиотека концентрация ДНК с использованием фтораметр 55. В кратком изложении, подготовить стандарты и экспериментальных образцов в конечном объеме 200 мкл нуклеазы без воды. Вихревые трубки в течение 2-3 сек, инкубировать при комнатной температуре в течение 2 мин, а затем прочитать образцы в флуорометре.
Примечание: Образцы должны содержать минимальную концентрацию 2 ДНК библиотеки ЯМ в минимальном объеме 15 мкл. - (КК тест # 2) Подтвердить распределение размера фрагмента ДНК с использованием анализа ленты на основе 56.
Примечание: идеальное распределение является относительно широкий пик ДНК центрирующий около 500 пар оснований в длину. Если значительное количество материала больше, чем 1 кб, то рекомендуется включить процедуру выбора размера для устранения более длинных видов ДНК, которые будут затруднять моста усиление во время кластеризации. В противоположность этому, если значительный пик очевидно, около 100 до 200 пар оснований, праймера димер может быть сформирована в процессе ПЦР. В этом случае процедура должна быть оптимизирована, чтобы свести к минимуму образование димеров праймеров. - (КК тест # 3) Confirm надлежащее включение адаптеров в библиотеку ДНК с помощью количественной ПЦР 57.
- Выполните следующие приложения NGS документации изготовителя. Использование спайка-в 10% (вес / вес) ΦX174 ДНК, которая позволит оптимизировать метрики качества в режиме реального времени, обеспечивая сбалансированную базовую композицию для секвенирования перспективе.
Примечание: эксперименты Интеграция сайта секвенирования обычно подвергают однократному конец 150 пар оснований (SE150) или парноконцевое 150 пар оснований (PE150) секвенирования. PE150 особенно полезно , чтобы захватить точку присоединения линкера на каждой молекуле ДНК (например, при интеграции сайтов рассматривая на наличие клеток - хозяев клональной экспансии).
7. Используйте настроенную Python или PERL скрипт для синтаксического анализа секвенирования данных для LTR-содержащих нуклеотидные последовательности, кадрирование прочь LTR и компоновщик последовательностях, и Карта Reference Геном с Блат
- Сканировать файлы FASTA для LTR-содержащих последовательность чтения, растениеводстве LTR и компоновщика последовательностей от хозяина геномной ДНК-последовательности, иэкспортировать эти последовательности в новый файл FASTA. Карта обрезается читает как эталонного генома (например , версии генома человека hg19 или GRCh38) и вирусный геном с использованием BLAT 58 с выходным сигналом интеграции сайта координаты экспортируются в отдельный текстовый файл, используя следующие параметры:
размера шага = 6, minIdentity = 97, и maxIntron = 0 - Проанализировать выход Блат .txt файл, удалить autointegrations (то есть доказательства того, что конец LTR была интегрирована во внутреннюю область вирусного генома ДНК) и отображения других последовательностей к ВИЧ-1 генома, а также создать отдельный выход .txt файл , в котором все сайты дублирующие интеграции были сжаты в отдельные, уникальные хиты координат.
8. Создание .bed файлов, содержащих интервалы 15-нть Ближ.населенные интеграций, конвертировать эти файлы в FASTA и Построить Sequence логотипы для отображения базовых настроек Ближайшие интеграции Сайтов
- Создание .bed файлов со списком интервал оснований длякаждая интеграция сайта. По крайней мере 15 оснований (5 вверх и 10 вниз по течению) предлагаются для генерации последовательности логотипа. Сформировать FASTA файл из этих .bed файлов с помощью функции fastaFromBed из BEDTools 59 и эту команду:
fastaFromBed -fi / Каталог / к / ссылка / геном / -name -s 15_base_pair_file.bed -fo Постельное output_file.fasta
Примечание: Инвариант вирусный 5'-СА-3 'динуклеотид присоединяется к ДНК хозяина в процессе интеграции, а также проверки стык конечной остановки LTR к клеточной ДНК является важным первичный фильтр для идентификации добросовестных сайтов интеграции. Мы дополнительно компилировать логотипы последовательность из этой популяции хозяина ДНК-последовательности, чтобы проверить результаты эксперимента. Как ретровирусы отображать базовые настройки подписи окружающих их интеграции сайтов 14,15, логотипы последовательности служат для подтверждения того, что возникла отображенные геномные сайты через IN-опосредованной интеграции по сравнению с другими механизмами рекомбинации , такие как негомологичной ДНКконец присоединения 60,61. - Используйте WebLogo 3 (http://weblogo.threeplusone.com/create.cgi) для создания логотипов последовательности из FASTA файлов. Нажмите на кнопку "Выбрать файл", чтобы загрузить файл FASTA, и используйте следующие настройки: Output Format, PDF (вектор); размер логотипа, большой; Первый номер позиции, -5; Диапазон логотипа, от -5 до 5; Y-ось шкалы, 0,1, Y-ось крестики расстояние, 0,5, Цветовая схема, классический (NA).
9. Создание центральной базы пара .bed файлы, проверить наличие образца перекрестного загрязнения и карты распределения уникальная интеграция Сайты по сравнению с геномных Особенности Соответствующая
- Поскольку ретровирусная интеграция происходит в шахматном порядке через пряди tDNA, настроить точные координаты интеграции сайтов, чтобы отразить центральную п.н. дублирования целевого сайта для корректного отображения геномной распределения по отношению к геномных особенностей.
- Таким образом, для 5 пар оснований дублируя вирусы, как ВИЧ-1, создают .bed файл с центральным п.н., смещенной от Integration сайт двумя основаниями вниз по течению для картирования интеграций до + цепи и двумя основаниями вверх по течению для интеграций отображения на минус нити.
- Для проверки образца перекрестного загрязнения, рассчитать количество интеграционных сайтов распространенных среди различных библиотек при помощи функции BEDTools пересекаются функции пересекаются центральная п.н. .bed файлы для двух различных образцов и следуя этой команды:
bedtools -a пересекаются central_basepair_1.bed -b central_basepair_2.bed -f 1,00 -r -s> overlap1v2.txt - Подсчитать количество строк в файле вывода overlap1v2.txt для того, чтобы количественно оценить точное количество сайтов распространенных среди двух библиотек, используя следующую команду:
туалет -l overlap1v2.txt - Скачать файл .bed RefSeq аннотаций для версии референсного генома , который был использован для отображения интеграции сайта из базы данных УСК Геном аннотации (например , http://hgdownload.cse.ucsc.edu/goldenPath/hg38/database) 62.
- Подсчитать количество сайтов интеграции генов , входящих в RefSeq при помощи функции BEDTools пересекаются функцию , чтобы пересекать .bed файл центральной пары оснований , который был создан для образца с RefSeq .bed файл следующие команды:
bedtools -a пересекаются central_basepair_1.bed -b RefSeq_hg38.bed -u> RefSeq_sample1.bed
- Подсчитать количество строк в файле вывода RefSeq_sample1.bed для того, чтобы количественно оценить точное количество сайтов, попадающих в генах RefSeq с помощью следующей команды:
туалет -l RefSeq_sample1.bed - Повторите шаги 9.3 и 9.4 для интеграции отображения сайтов на любую другую пометку интерес, для которых интервал .bed файл доступен. Скачать самую последнюю CpG острова аннотаций файл .bed для референсного генома интереса из базы данных УСК Геном аннотации, как указано в пункте 9.4.
- Подсчитайте число интеграции сайтов, попадающий в определенном диПозиция (показано в данном примере представляет собой окно 5 т.п.н.) CpG островков с помощью функции окна BEDTools и после этой команды:
Окно bedtools -w 2500 central_basepair_1.bed -b CpG_hg38.bed -u> CpG_sample1.bed
- Подсчитать количество строк в файле вывода CpG_sample1.bed для того, чтобы количественно оценить точное количество сайтов, попадающих в 2,5 кб выше или ниже по потоку от CpG островков с помощью следующей команды:
туалет -l CpG_sample1.bed - Повторите шаги 9.6 и 9.7 для сайтов интеграции отображения поблизости TSSS. Сформировать альтернативную версию файла RefSeq.bed, где геномная координаты отображения более чем одного гена, были скорректированы с учетом только одного гена, присутствующего в этой позиции. Это предотвращает завышение плотности генов окружающей интеграции сайтов. Вычислить плотность генов в 1 Мб области вокруг каждого интеграции сайта с помощью оконной функции BEDTools и после этой команды:
Окно bedtools -w +500000 central_basepair_1.bed -b RefSeq_hg38_NonRedundant.bed -u> GeneDensity_sample1.bed - Вычислить среднюю плотность генов для всех интеграций в наборе данных, выполнив следующую команду:
AWK '(сумма + = $ 7) END (печать "Average =", сумма / NR)' GeneDensity_sample1.bed
10. Статистически Сравнить Интеграция сайта Распределения среди образцов с использованием двух хвостами точный критерий Фишера и двухвостый Wilcoxon Rank Sum Test в R
Примечание: точный критерий Фишера Используйте для сравнения доли интеграции сайтов в пределах генов RefSeq или в пределах окна CpG островков или TSSS, но использовать тест Вилкоксона суммы ранга для сравнения распределения плотности генов, окружающих сайтов интеграции. Программа R доступна на http://www.r-project.org/.
Два хвостами точного критерия Фишера:
- Используя числа, рассчитанные в соответствии с инструкциями на этапах 9.4 и 9.7, крЭАТС матриц для каждого сравнения в R наблюдаемых явлений (интеграций внутри аннотацию или внутри окна , окружающего аннотацию) в зависимости от оставшихся сайтов, выполнив следующую команду:
(Annotation_of_interest <- матрица (с (SampleA # в, SampleA # остальные, SampleB # в, SampleB # остальные), nrow = 2, dimnames = список (с ( 'Центр', 'Remainder'), с ( 'SampleA', 'SampleB')))) - Вычислить значение P для сравнения двумя хвостами точный критерий Фишера с помощью следующей команды:
fisher.test (annotation_of_interest, альтернативная = 'two.sided') $ p.value
Два хвостами Вилкоксона ранговой суммы: - Создайте файл с разделителями табуляции .txt, в котором каждый столбец содержит имя образца в верхней ячейке, а затем ниже значениями плотности генов для всех сайтов интеграции в этой библиотеке (полученной из .bed файла, созданного на шаге 9.9). Импорт этой табуляции .txt файл в R , используя следующую команду и наvigating в правильный каталог файла:
FILENAME <- as.data.frame (read.delim (file.choose (), заголовок = T, check.names = FALSE, заполнить = TRUE, SEP = ' т')) - Вычислить значение P для сравнения двумя хвостами Вилкоксона критерий суммы рангов с помощью следующей команды:
wilcox.test (Filename $ SampleA, FILENAME $ SampleB, альтернативных = 'two.sided', в паре = F, точный = T) $ p.value
Примечание: Значения P могут быть рассчитаны только до определенного (очень низкая) предел в R, после чего ноль будет возвращен программой. Для массово различных образцов , которые дают P = 0 в R, оценить величину Р , как <2,2 · 10 -308.
11. Изучение Raw секвенирования данных для доказательства клональной экспансии клеток, содержащих интегрированную ДНК Вирусный
Примечание: Небольшой потенциал существует более одной интеграции в том же нт референсный геном. В качестве альтернативы, один вtegration событие может стать избыточно присутствует в последовательности данных в связи с использованием ПЦР в процессе подготовки библиотеки и / или путем дублирования клеток перед препарата ДНК. Недавно проведенный анализ геномной ДНК из ВИЧ-инфицированных пациентов отличились эти возможности путем выявления уникальных точек точки Озвучивание сдвига / крепления (линкер , которые могут возникнуть только перед ПЦР) в пределах ДНК - последовательностей , содержащих идентичные сайты интеграции 52-54. Существует в настоящее время дебаты относительно того, является ли вклад провирусы укрывал в клонированных расширенных клеток в латентной вирусной резервуара, и, таким образом, представляет особый интерес, чтобы охарактеризовать уровень их расширения при изучении сайтов интеграции у больных людей.
- По аналогии с процедурой, указанной в пункте 8.1, генерируют .bed также файлы интервал баз расширяясь, в данном случае, 25 нт вниз по течению от каждого уникального сайта интеграции (вверх по течению базы не нужны здесь). Создает FASTA файл из этих .bed файлов (как указано вШаг 8.1) с помощью функции fastaFromBed из BEDTools и после этой команды:
fastaFromBed -fi / Каталог / к / ссылка / геном / -name -s 25_base_pair_file.bed -fo Постельное output_file.fasta
Примечание: Для повышения специфичности каждого поиска рекомендуется извлечь по меньшей мере, 25 нт вниз по течению от каждой интеграции сайта для клоновая расширения анализа. - Предпочтительно с помощью пользовательского сценария, поиск файла FASTA необработанные данные о последовательности для всех строк, содержащих точное совпадение с 25 нт вниз по течению от каждого уникального сайта интеграции, и внести эти последовательности в новый файл. Обрежьте LTR и компоновщика последовательности из исходных строк. Слияние последовательность PE читает путем преобразования читает в обратном дополнения, зачистка LTR и линкерные последовательности, а затем назначив read2 строк в их READ1 пары, если строки разделяют по меньшей мере 20 перекрывающихся нт.
- Сканирование точек крепления линкер каждого блока интеграции сайта. Классифицировать каждую интеграцию как "клонированных расширен &# 34; если точки крепления линкер являются ≥3 п.н. друг от друга.
Примечание: Протокол для клонального анализа расширения без слияния последовательности чтений было описано 52.
Примечание: Фрагментация генома в то же самое место с помощью ультразвуковой обработки приводит к недооценке степени клональной экспансии, а также методы для коррекции полученного экспериментального смещения были описаны 63,64.