$$\rightleftharpoonup{xx}$$
$$\longleftharp{xx}$$,
$$\longrightharp{xx}$$,
I metaboliti svolgono un ruolo importante nei processi biologici. I metaboliti sono spesso regolatori di vari processi come il trasferimento di energia, la regolazione ormonale, la regolazione dei neurotrasmettitori, le comunicazioni cellulari e le modifiche proteiche post-traduzionali, ecc. 1,2,3,4. La metabolomica non mirata fornisce una visione globale di numerosi metaboliti 5,6. Con i progressi nella spettrometria di massa e nelle tecnologie di cromatografia, il throughput degli spettri MS/MS del metaboloma è in rapido aumento negli ultimi anni 7,8,9,10,11. Per identificare i metaboliti da questi enormi set di dati, sono stati sviluppati vari software di annotazione11, come MZmine12, MS-FINDER13, CFM-ID14, MetFrag15 e SLAW16. Tuttavia, queste identificazioni spesso contengono molti falsi positivi. I motivi includono: (1) Gli spettri MS/MS contengono rumore casuale, che può fuorviare la corrispondenza dei picchi. (2) Gli isomeri e le differenze nelle energie di frammentazione causano impronte digitali multiple degli spettri e quindi aumentano il volume della libreria di riferimento. (3) La qualità delle librerie di riferimento varia. È necessario uno standard adeguato per costruire una buona libreria spettrale di riferimento. Pertanto, un controllo sistematico del tasso di falsa scoperta (FDR) per la metabolomica non mirata è essenziale per la ricerca sul metaboloma funzionale 7,8,9,17.
Sia l'approccio Empiric Bayes che la strategia Target-Decoy hanno affrontato il problema del controllo FDR in generale. Kerstin Scheubert et al. hanno dimostrato che la strategia Target-Decoy sul database esca generato dal metodo basato sulla frammentazione ad albero è il metodo migliore per il controllo FDR9. Xusheng Wang et al. hanno progettato un metodo per la generazione di esca basato sulla regola dell'ottetto in chimica e hanno migliorato la precisione della stima FDR17. La libreria spettrale per la generazione del database esca è stata dimostrata per prestazioni migliori18. Qui, abbiamo migliorato il metodo basato su libreria spettrale e sviluppato un software chiamato XY-Meta19 che può migliorare ulteriormente la precisione della stima FDR. Utilizza la libreria spettrale di riferimento esistente per generare una libreria esca per il controllo FDR nello schema Target-Decoy. XY-Meta supporta i propri algoritmi di corrispondenza degli spettri e di somiglianza del coseno. Consente la ricerca convenzionale e le modalità di ricerca iterativa. Nella fase di valutazione FDR, supporta la modalità concatenata Target-Decoy e la modalità separata. Per una maggiore flessibilità, XY-Meta accetta librerie di esca esterne.
Il rilevamento dei picchi e la quantificazione dei metaboliti è anche un passo importante dell'analisi del metaboloma non mirato. Il rilevamento dei picchi è il metodo principale per l'identificazione del metaboloma. In generale, l'accuratezza del rilevamento dei picchi dei metaboliti è stata influenzata da molteplici fattori, come i segnali di rumore della spettrometria di massa, la bassa abbondanza di metaboliti, contaminanti e prodotti di degradazione dei metaboliti20. Quando il numero di campioni di è troppo grande o la colonna di cromatografia liquida è stata sostituita in esperimenti di metaboloma non mirato, possono apparire notevoli effetti batch, che è una grande sfida per la quantificazione del metaboloma 21,22,23. Attualmente, software come XCMS24, Workflow4Metabolomic25, iMet-Q26 e metaX19 possono eseguire il rilevamento dei picchi e la quantificazione del metaboloma non mirato, ma suggeriamo che la pipeline di metaX sia più completa e più facile da usare. Qui, dimostriamo il processo di identificazione e controllo FDR per un set di dati pubblicamente disponibile msv000084112 utilizzando XY-Meta e il rilevamento e la quantificazione dei picchi dei metaboliti utilizzando metaX. Questo flusso di lavoro richiede solo due gruppi e ogni gruppo richiede almeno due esempi. I dati degli spettri MS/MS sono necessari, indipendentemente dalla piattaforma dello spettrometro di massa, dalla modalità di ionizzazione, dalla modalità di carica e dal tipo di campione, e possono supportare la normalizzazione basata su campioni e la normalizzazione basata su picchi. Seguendo questo esempio, i ricercatori possono eseguire l'identificazione e la quantificazione della metabolomica in modo facile da gestire. L'utilizzo di questa pipeline richiede funzionalità di programmazione R. Per aiutare il ricercatore senza alcuna conoscenza di programmazione, abbiamo anche sviluppato una piattaforma di analisi cloud per l'analisi metabolomica. Abbiamo dimostrato questa piattaforma di analisi cloud nel Materiale supplementare 5.