1. Przygotuj listę nazw genów, które w Twojej ocenie podlegają współregulacji, w celu przeprowadzenia analizy za pomocą programu SCOPE.
Zapisz listę jako plik tekstowy lub skopiuj ją do schowka, aby wkleić ją do SCOPE w kroku 3. Plik powinien zawierać jedną nazwę genu w każdej linii, bez żadnych dodatkowych informacji. Alternatywnie można przygotować listę w formacie pliku FASTA zawierającego sekwencje do analizy.
2. Uruchom przeglądarkę internetową i przejdź pod adres URL: http://genie.dartmouth.edu/SCOPE/
3. Wprowadź informacje niezbędne do przeprowadzenia analizy przez program SCOPE.
Początkowa strona SCOPE została przedstawiona na Rysunku 1. W tym kroku omówiono poszczególne sekcje.
- Użyj menu rozwijanego „Species”, aby wybrać gatunek, który będziesz badać. Wybór właściwego gatunku jest istotny, ponieważ program SCOPE odwołuje się do genomu w celu obliczenia częstotliwości tła występowania każdego badanego motywu kandydującego.
- Użyj przycisków opcji „upstream sequence”, aby wybrać sekwencję międzygenową (intergenic) lub o stałej długości (fixed length). Opcja międzygenowa przeanalizuje całą sekwencję między badanym genem a poprzednim (powyżej) genem. Oznacza to, że dla każdego genu zostaną użyte różne długości sekwencji upstream. Wybranie stałej długości spowoduje analizę dokładnie określonej liczby nukleotydów powyżej początku bieżącego genu. W tym przypadku SCOPE zbada tę samą długość sekwencji upstream dla każdego genu, nawet jeśli rozciąga się ona na poprzedni gen (lub nie). Zazwyczaj najlepszą długością do wyboru jest 800 nts, ale może się to różnić w zależności od gatunku.
- Następnie wskaż programowi SCOPE, jaki zestaw genów ma przeanalizować, wklejając listę genów do pola tekstowego listy genów lub naciskając przycisk „choose file”, aby wybrać plik zawierający wcześniej utworzoną listę genów. Możesz również wkleić plik sekwencji FASTA do tego samego pola tekstowego.
- Kolejna sekcja strony zawiera pole wyboru „Examine genome for other genes containing found motif(s)?”. Ta opcja może znacznie wydłużyć czas analizy, ponieważ SCOPE musi ocenić każdy inny gen w genomie. Może to być jednak bardzo przydatne w identyfikacji innych genów, które są dobrymi kandydatami do współregulacji z genami z początkowego zestawu. Ponieważ analizy SCOPE są stosunkowo szybkie, zaleca się pozostawienie tej opcji wyłączonej w początkowej analizie. Można ją zawsze włączyć na stronie wyników, aby ponownie uruchomić analizę, jak wyjaśniono w sekcji wyników.
- Sekcję „Results must include” można wykorzystać do wpisania motywu, który ma zostać uwzględniony przez SCOPE w analizie. Może to być przydatne, jeśli szukasz konkretnego motywu.
- Ostatnią sekcję na stronie można wykorzystać do wpisania adresu e-mail oraz komentarza, który zostanie zapisany wraz z analizą. Jeśli te dane zostaną uzupełnione, SCOPE wyśle wiadomość e-mail z linkiem powrotnym do strony internetowej zawierającej wyniki, a także dwa załączniki. Pierwszym jest plik tekstowy zawierający wszystkie wyniki analizy w formacie czytelnym dla człowieka. Drugi załącznik zawiera plik XML z każdym wynikiem znalezionym przez SCOPE w formacie czytelnym dla komputera. Plik XML jest bardzo przydatny, jeśli chcesz przeprowadzić dodatkową analizę wyników. Oba pliki są kompresowane w formacie „zip” przed wysłaniem w wiadomości e-mail.
- W tym pokazie zaczniemy od tych samych informacji. Można to łatwo osiągnąć, naciskając przycisk „Sample Search”, który uzupełni niezbędne dane. Naciśnij ten przycisk teraz. Zostaną wprowadzone trzy geny, a dla pozostałych pól zostaną dokonane odpowiednie wybory. Pozostaw je w takim ustawieniu. Te trzy geny biorą udział w utrzymaniu telomerów u Saccharomyces cerevisiae. Uzupełniony formularz przedstawiono na Rysunku 2. Naciśnij przycisk „Run SCOPE” na dole strony, aby rozpocząć analizę.
4. Reprezentatywne wyniki:
Główne wyniki analizy przedstawiono na Rysunku 3. W górnej części strony znajduje się tabela z informacjami o motywach wykrytych przez SCOPE. Pierwsza kolumna zawiera listę znalezionych motywów, a małe kolorowe kwadraty służą jako legenda dla przedstawionej poniżej graficznej mapy motywów. Wyświetlanie dowolnego motywu można włączyć lub wyłączyć, klikając w kolorowe pole (lub w miejsce, w którym powinno się ono znajdować). Może to być bardzo przydatne w celu ukrycia motywów występujących bardzo często, co mogłoby utrudnić dostrzeżenie rzadszych wzorców motywów.
Pozostałe kolumny danych to Count (liczba wystąpień danego motywu w całym zbiorze genów), Sig value (wskaźnik istotności tego motywu), Coverage (procent przesłanych genów zawierających co najmniej jedną instancję tego motywu) oraz Algorithm (informacja o tym, który z trzech algorytmów składowych został użyty do wykrycia motywu).
Kliknięcie dowolnego z wymienionych motywów przeniesie użytkownika na stronę zawierającą szczegółowe informacje na temat tego motywu. Szczegóły wyników dla motywu cyjanowego (atgnnnnttg) przedstawiono na Rysunku 4. Na tej stronie motyw jest reprezentowany na trzy sposoby: jako logo sekwencji, macierz wag pozycyjnych (position weight matrix) oraz lista wszystkich wystąpień motywu wraz z ich pozycjami, nićmi i genami.
Nieco niżej na stronie znajdują się dodatkowe szczegóły dotyczące wyników poszukiwań innych genów zawierających ten motyw. Jak widać, w tym przypadku znaleziono 1344 inne geny zawierające ten motyw, z których każdy w rzeczywistości poprawił wartość Sig po dodaniu do pierwotnego zestawu genów. Kliknięcie przycisku „Add checked genes to search” spowoduje powrót do strony konfiguracji SCOPE z tymi genami dodanymi do pierwotnego zestawu genów i parametrami ustawionymi tak, jak wcześniej. W tym przypadku do pierwotnych trzech genów dodano 10 dodatkowych genów.
Rysunek 5 przedstawia wyniki analizy uwzględniającej dodatkowe geny dla tego motywu. Trzy oryginalne geny znajdują się na dole wyników (zapisane małymi literami). Analiza wzorca motywów w regionie upstream tych dodatkowych genów wyraźnie pokazuje, że są one podobne. W rzeczywistości wiele z tych genów, podobnie jak trzy pierwotne geny, bierze udział w utrzymaniu telomerów. Należy również zauważyć, że oryginalny motyw jest obecnie motywem o najwyższej punktacji w tym zbiorze.
Kolejny zestaw wyników SCOPE przedstawiono na rysunku 6. W tym przypadku zestaw genów obejmuje te, które biorą udział w biogenezie rybosomów u Saccharomyces cerevisiae. Geny te nie są właściwie częścią rybosomu, lecz odpowiadają za montaż rybosomów i obejmują szereg enzymów modyfikujących. Z rysunku jasno wynika, że motywy czerwone i zielone tworzą wiarygodny wzorzec, który prawdopodobnie bierze udział w regulacji genów z tego zestawu. Badamy ten wzorzec „modułów” bardziej szczegółowo i przedstawimy wyniki w późniejszej publikacji.

Rysunek 1. Główna strona wejściowa SCOPE. Strona ta służy do wprowadzania genów do analizy oraz do zdefiniowania gatunku i długości badanego regionu powyżej miejsca startu transkrypcji. Opcjonalnie użytkownik może poprosić o przesłanie wyników pocztą elektroniczną lub ograniczyć wyszukiwanie do określonego motywu. Dostępna jest również pomoc w formie wideo.

Rycina 2. Główna strona wejściowa SCOPE z uzupełnionymi wartościami do przeprowadzenia wyszukiwania. Parametry te są wynikiem naciśnięcia przycisku „Sample Search”. W tym przypadku zaznaczone jest pole wyboru służące do znalezienia innych genów zawierających motywy znalezione przez SCOPE. Ta opcja wymaga dłuższego czasu obliczeń (konieczne jest zbadanie każdego genu w genomie), ale może dostarczyć interesujących informacji.

Rysunek 3. Główna strona wyników SCOPE. Strona ta podsumowuje wyniki wyszukiwania w programie SCOPE. Przedstawiona jest lista wszystkich motywów o wysokich wynikach, a kolorowa mapa motywów pokazuje położenie zidentyfikowanych motywów w analizowanym zestawie genów. Kliknięcie w kolorowy kwadrat obok motywu przełącza wyświetlanie tego motywu na mapie. Oprócz wyniku istotności (wartość Sig) podano również ułamek genów zawierających dany motyw (pokrycie) oraz algorytm użyty do znalezienia tego motywu.


Rycina 4. Ta strona szczegółów wyników wyświetla się po kliknięciu konkretnego motywu na głównej stronie wyników. Przedstawia ona szczegóły poszczególnego motywu. Logo sekwencji, macierz wag pozycji (PWM) oraz sekwencja konsensusowa stanowią różne rodzaje podsumowania listy instancji motywu, która również znajduje się na stronie. Ponieważ w oryginalnych ustawieniach wyszukiwania zaznaczono opcję „find extra genes”, na stronie znajdują się również informacje o innych genach w genomie, które zawierają ten motyw. Z tej strony można również uruchomić kolejną analizę SCOPE, uwzględniając dodatkowe geny zidentyfikowane na tej stronie.

Rysunek 5. Na tym rysunku przedstawiono wyniki wyszukiwania dodatkowych genów dla motywu „atgnnnnttg” pokazanego na Rysunku 4. Trzy pierwotne geny zapisano małymi literami na dole mapy motywów. Dodatkowe geny przedstawiono wielkimi literami. W regionach upstream tych genów widoczny jest wyraźny wzorzec motywów. Należy również zauważyć, że dla określonego motywu algorytm jest wskazany jako „LOOKUP”, ponieważ w ten sposób został on zidentyfikowany. W rzeczywistości odpowiada on 5temu motywowi znalezionemu przez SPACER w tej analizie.

Rycina 6. Wyniki SCOPE dla genów zaangażowanych w biogenezę rybosomów u Saccharomyces cerevisiae. Zwróć uwagę na konserwowany wzór modułów składających się z motywów 'aaawtttbh' (czerwony) i 'abctcatcd' (zielony), oddzielonych od siebie o około 10-30 nts i występujących 100-200 nukleotydów powyżej miejsca startu transkrypcji danego genu.