$$\rightleftharpoonup{xx}$$
$$\longleftharp{xx}$$,
$$\longrightharp{xx}$$,
Une compréhension approfondie de l’épigénome est nécessaire pour réaliser le plein potentiel du séquençage du génome humain en offrant de nouvelles perspectives biologique8. Actuellement, il y a seulement des méthodes de recherche en ligne épigénomique datasets par leur description des données et leur titre (p. ex., métadonnées)1. Cela limite fortement le type de recherche, on peut faire avec les données de l’épigénomique. Des outils de recherche axée sur le modèle de données épigénomique sont essentiels pour explorer la relation entre les marques épigénomique différents, ce qui peuvent conduire à nouvelles connaissances biologiques. Gilbert, qui recherche par le contenu des données et pas de métadonnées, est le premier service du genre à comparer des modèles épigénomique données publiées dépositaires tels que la base de données de coder avec un généré par l’utilisateur ou téléchargé dataset5. Cela marque le début de la disponibilité d’un outil de recherche épigénomique qui est largement accessible aux chercheurs partout dans le monde just comme outil de recherche textuelle séquence est devenu largement disponible dans les années 1990. Actuellement, il n’y a aucune solution de rechange pour outils de recherche en ligne axée sur le modèle pour épigénomique données autre que Gilbert.
Un exemple possible d’utiliser Gilbert est de rechercher les modifications d’histone co comparantes et autres marques épigénétiques avec le facteur de transcription E2F6 dans des cellules souches embryonnaires humaines (un fichier de signal de liaison exemple E2F6 est disponible sur le portail de données ENCODE ou au https://sysbio.ucsd.edu/public/xcao3/ENCODESample/ENCFF001UBC.Bed). En utilisant ce fichier en tant que requête de recherche contre tous les datasets ENCODE en H1-CSEh, Gilbert va montrer que E2F6 signal de liaison est fortement enrichie en H3K4me1, H3K4me2, H3K4me3 et H3K27me3, qui est d’accord avec les recherches montrant que E2F6 réglemente certains gènes via méthylation de H3K279. En revanche, il semble y être co-localisation des sites de liaison E2F6 et CtBP2, qui est connue pour interagir avec un facteur dans la même famille, de E2F710. Ces résultats pour le génome entier contre un grand nombre de marques épigénétiques, facteur de transcription liaison signaux et autres signaux inclus dans Encoder peuvent être assez facilement obtenus avec Gilbert, qui peut fournir toutes les cibles potentielles pour une analyse ultérieure.
Depuis la première publication5 de Gilbert comme un outil de recherche de données épigénomique basé sur le web, la section résultats de Gilbert has been updated to ont un aspect correspondant à la page de couverture de Gilbert. L’ancienne section résultats étroitement en sens inverse de la section des résultats UCSC genome browser et dépendait en grande partie sur le serveur distant de UCSC pour l’affichage. Avec la nouvelle interface, Gilbert est plus facile à utiliser et n’est plus dépendant sur le serveur de génome UCSC (même si les données sont récupérées toujours à distance). Cela rend Gilbert plus robustes et moins sensibles aux problèmes dus aux modifications de code au niveau du serveur UCSC. En outre, l’interface de polymère nouvelle et plus rapide de Gilbert donne à l’utilisateur plus d’outils pour visualiser et analyser les tendances dans les données.
Étapes critiques incluent fournissant le fichier d’entrée approprié et choisir les pistes de données à rechercher contre. Les utilisateurs sont vivement encouragés à expérimenter avec différentes fonctions de sélection de piste afin de vous familiariser avec le processus de sélection et comment les différentes commandes peuvent être combinées pour atteindre le résultat visé. En particulier, Notez que la fonction « Ajouter » est nécessaire pour ajouter des pistes désirées, sélectionnés à la requête, « Filtre » ou « Exclude » peut être utilisés comme des commandes de porte logique « AND » et « Ou », respectivement. La fonction « Update » est tenue d’affecter toutes les sélections avant d’implémenter la recherche. Lorsque aucun résultats ne sont retournés, un utilisateur peut vérifier le fichier de données d’entrée, plusieurs pistes de recherche ou augmenter la portée de la recherche. Chaque fois qu’il y a une erreur, il y aura une fenêtre surgissent de définir ce qu’est exactement l’erreur. Il y a quelques erreurs ambiguës, cependant. Par exemple, quand la fenêtre dit que « aucun fichier a été téléchargé », soit aucun fichier a été téléchargé, ou le fichier uploadé n’était pas un format acceptable et, par conséquent, le programme n’était pas capable de le lire correctement. Formats de fichiers acceptables pour l’upload de fichier comprennent lit et pics fichier de format pour les méthodes de téléchargement et gros bonnet pour le téléchargement de lien en ligne seulement. Les versions zippées de ces formats de fichier sont également acceptables.
Les limites actuelles de cette approche incluent les fonctions employées dans Gilbert et encore-à-être-optimisée des algorithmes. Gilbert ne peut fournir encore aucune indication sur l’interprétation de tout jeux de données retournées. Cette tâche agit les utilisateurs, ce qui nécessite des connaissances et l’expertise dans la biologie du génome et épigénome. En outre, une autre limitation de courant est que les utilisateurs ne peuvent pas modifier le niveau de sensibilité et le bruit des recherches. Nous nous attendons à continuer d’améliorer et d’élargir les Gilbert sur son modèle, la recherche de capacités et collecte de données à l’avenir.