$$\rightleftharpoonup{xx}$$
$$\longleftharp{xx}$$,
$$\longrightharp{xx}$$,
Hier beschrijven we een hoge-doorvoer-methode voor de bouw en de selectie van bibliotheken van gevouwen en oplosbaar eiwit domeinen van elke genenreservoir/genomic startende bron. De aanpak combineert drie verschillende technologieën: faag display, het gebruik van een opvouwbare verslaggever en de volgende generatie sequencing (NGS) met een specifieke web-tool voor data-analyse. De methoden kunnen worden gebruikt in vele verschillende contexten van onderzoek op basis van eiwitten, voor identificatie en annotatie van nieuwe eiwitten/proteïne domeinen, karakterisering van structurele en functionele eigenschappen van bekende eiwitten, alsmede definitie van eiwit-interactie netwerk.
Veel open vragen zijn nog steeds aanwezig in onderzoek op basis van eiwitten en de ontwikkeling van methoden voor de eiwitproductie van de optimale is een belangrijke behoefte voor verschillende velden van onderzoek. Bijvoorbeeld, ondanks de beschikbaarheid van duizenden prokaryote en eukaryote genomen1ontbreekt een bijbehorende kaart van de relatieve proteomes met een directe annotatie van de gecodeerde eiwitten en peptiden nog steeds voor de overgrote meerderheid van organismen. De catalogus van volledige proteomes is in opkomst als een uitdagend doel vereist een enorme inspanning in termen van tijd en middelen. De gouden standaard voor experimentele aantekening blijft het klonen van alle Open lezing Frames (ORFs) van een genoom, bouw van de zogenaamde "ORFeome". Meestal genfuncties is toegewezen op basis van homologie aan verwante genen van bekende activiteit maar deze aanpak is slecht juist als gevolg van de aanwezigheid van veel incorrect aantekeningen in de verwijzing databases2,3,,4, 5. Bovendien, zelfs voor eiwitten die zijn geïdentificeerd en geannoteerd, aanvullend onderzoek moeten bereiken van karakterisering in termen van overvloed, expressiepatronen in verschillende contexten, met inbegrip van structurele en functionele eigenschappen, evenals interactienetwerken.
Bovendien, omdat eiwitten zijn samengesteld uit verschillende domeinen, elk van hen specifieke kenmerken tonen en anders bijdragen aan eiwitfuncties, de studie en de exacte definitie van deze domeinen kunt u een meer gedetailleerd beeld, zowel op de single gen en op het niveau van het volledige genoom. Al deze noodzakelijke informatie maakt op basis van eiwitten onderzoek een breed en uitdagend veld.
In dit perspectief, kan een belangrijke bijdrage worden gegeven door onbevooroordeelde en high-throughput methoden voor de productie van eiwitten. Het succes van dergelijke benaderingen, naast de aanzienlijke investeringen nodig zijn, is echter afhankelijk van het vermogen te produceren van oplosbare/stabiele eiwit constructies. Dit is een belangrijke beperking van factor omdat men schat dat slechts ongeveer 30% van de eiwitten met succes kan worden uitgedrukt en geproduceerd op voldoende niveau experimenteel nuttig6,7,8. Een aanpak te overwinnen van deze beperking is gebaseerd op het gebruik van willekeurig gefragmenteerde DNA te produceren verschillende polypeptiden, waarmee elkaar overlappende fragment vertegenwoordiging van afzonderlijke genen. Slechts een klein percentage van de willekeurig gegenereerde DNA-fragmenten zijn functionele ORFs terwijl de overgrote meerderheid van hen zijn niet-functionele (als gevolg van de aanwezigheid van stop codonen binnen hun sequenties) of coderen voor niet-natuurlijke (ORF in een frame dan het origineel) polypeptiden met geen biologische betekenis.
Om al deze kwesties, heeft onze fractie een high-throughput eiwit expressie en interactie analyse platform ontwikkeld die kan worden gebruikt op een genomic schaal9,10,11,12. Dit platform integreert de volgende technieken: 1) een methode te selecteren van collecties van correct gevouwen proteïne domeinen uit het codering gedeelte van DNA van een organisme; 2) de bacteriofaag display technologie voor het selecteren van de partners van interacties; 3) de NGS volledig karakteriseren de hele interactome bestudeerde en identificeren van de klonen van belang; en 4) een webtool voor data-analyse voor gebruikers zonder bioinformatics of programmeringsvaardigheden Interactome-Seq analyses uit te voeren op een eenvoudige en gebruiksvriendelijke manier.
Het gebruik van dit platform biedt belangrijke voordelen ten opzichte van alternatieve strategieën van onderzoek; de methode is vooral volledig onpartijdige, high-throughput en modulaire voor studie, variërend van een enkel gen tot een hele genoom. De eerste stap van de pijpleiding is de oprichting van een bibliotheek van willekeurig gefragmenteerde DNA bestudeerd, die vervolgens diep door NGS wordt gekenmerkt. Deze bibliotheek is gegenereerd met behulp van een gemanipuleerde vector waar genen/fragmenten van belang zijn gekloond tussen een signaal volgorde voor eiwit secretie in de periplasmatische ruimte (dat wil zeggen, een leider van de Sec) en het TEM1 β-lactamase gen. De fusieproteïne zal verlenen de ampicilline-resistentie en de mogelijkheid om te overleven onder ampicilline druk alleen als gekloonde fragmenten in-frame is met deze elementen zowel de resulterende fusieproteïne correct gevouwen10,13 ,14. Alle klonen gered na antibiotica selectie, de zogenaamde "gefilterd klonen", ORFs en een grote meerderheid van hen (meer dan 80%), zijn afgeleid van echte genen9. Bovendien ligt de kracht van deze strategie in de bevindingen dat alle klonen van de ORF gefilterd voor correct gevouwen/oplosbare eiwitten en/of domeinen15 codeert. Zoals veel klonen, aanwezig in de bibliotheek en de toewijzing in de zelfde regio/domein, hebben verschillende begin- en einddatum van de punten, hierdoor onbevooroordeelde, -voor-stapmodus identificatie van de minimale fragmenten die zouden kunnen resulteren in oplosbare producten.
Een verdere verbetering van de technologie wordt gegeven door het gebruik van NGS te karakteriseren van de bibliotheek. De combinatie van dit platform en van een specifieke web-tool voor data-analyse geeft belangrijke onbevooroordeelde informatie over de exacte nucleotidesequenties en over de locatie van geselecteerde ORFs op de verwijzing DNA bestudeerde zonder de behoefte aan verdere uitgebreide analyses of experimentele inspanning.
Domainome bibliotheken kunnen worden omgezet in een selectie-context en gebruikt als een universele instrument functionele studies te verrichten. De high-throughput eiwit expressie en interactie analyse platform dat we geïntegreerde en dat we Interactome-Seq noemden gebruik van de bacteriofaag display technologie maakt door overdracht van de gefilterde ORF in een vector van phagemid en het creëren van een bacteriofaag-ORF bibliotheek. Eenmaal opnieuw gekloond in een faag display context, eiwit domeinen worden weergegeven op het oppervlak van M13 deeltjes; op deze manier kunnen domainome bibliotheken direct worden geselecteerd voor gene fragmenten codering van domeinen met specifieke enzymatische activiteiten of bindende eigenschappen, waardoor interactome netwerken profilering. Deze aanpak werd voor het eerst beschreven door Zacchi et al. 16 en later gebruikt in verschillende andere context13,17,18.
Vergeleken met andere technologieën gebruikt bij het bestuderen van de eiwit-eiwit interactie (inclusief Gist twee hybridesysteem en massaspectrometrie19,20), is een groot voordeel de versterking van de binding-partner die tijdens de bacteriofaag optreedt weergeven meerdere rondes van de selectie. Dit verhoogt de gevoeligheid van de selectie waardoor de identificatie van lage overvloedige bindende proteïnen domeinen aanwezig in de bibliotheek. De efficiëntie van de selectie uitgevoerd met ORF-gefilterd bibliotheek is verder toegenomen als gevolg van het ontbreken van niet-functionele klonen. Ten slotte, de technologie staat de selectie moet worden uitgevoerd tegen zowel eiwitten als niet-proteïne lokaas21,22,23,24,25.
Phage selecties met behulp van de bibliotheek domainome-bacteriofaag kunnen worden uitgevoerd met behulp van antilichamen vanuit sera van patiënten met verschillende pathologische condities, zoals auto-immune ziekten13, kanker of een infectie ziekten als aas. Deze aanpak wordt gebruikt voor het verkrijgen van de zogenaamde "antilichaam handtekening" van de ziekte onder studie waardoor massaal identificeren en typeren de antigenen/epitopes specifiek erkend door de patiënten antilichamen op hetzelfde moment. Vergeleken met andere methoden het gebruik van bacteriofaag display kan de identificatie van zowel lineaire als conformationele antigene epitopes. De identificatie van een bepaalde handtekening kon potentieel belangrijke gevolgen voor begrip pathogenese, nieuwe vaccin design, identificatie van nieuwe therapeutische doelen en ontwikkelen van nieuwe en specifieke diagnostische en prognostische hulpmiddelen hebben. Bovendien, wanneer het onderzoek is gericht op besmettelijke ziekten, een groot voordeel is dat de ontdekking van immunogene eiwitten onafhankelijk van pathogen teelt is.
Onze aanpak bevestigt dat de opvouwbare verslaggevers op een genomic schaal kunnen worden gebruikt om te selecteren van de "domainome": een verzameling correct gevouwen, goed uitgedrukt, oplosbaar eiwit domeinen uit het codering gedeelte van het DNA en/of cDNA van elk organisme. Eenmaal geïsoleerd de eiwit-fragmenten zijn bruikbaar voor vele doeleinden, essentiële experimentele voorlichting voor gene aantekening alsmede wat betreft structurele studies, antilichaam epitoop toewijzing, antigeen identificatie, enz. De volledigheid van hoge-doorvoer door NGS verstrekte gegevens maakt de analyse van de zeer complexe monsters, zoals faag display bibliotheken, en heeft het potentieel om de traditionele moeizame plukken en testen van individuele faag gered klonen te omzeilen.
Op hetzelfde moment dankzij de functies van de gefilterde bibliotheek en de extreme gevoeligheid en de kracht van het NGS-analyse is het mogelijk om te identificeren van het eiwit domein verantwoordelijk voor elke interactie rechtstreeks in een eerste scherm, zonder de noodzaak te creëren extra bibliotheken voor elk gebonden eiwit. NGS kan verkrijgen van een uitgebreide definitie van het hele domainome van elke genenreservoir/genomic startende bron en de data analyse webtool kan de aanschaf van een zeer specifieke karakterisering van een kwalitatieve en kwantitatieve oogpunt van de interactome eiwitten domeinen.