Research Article

Identificatie van hubgenen, single-nucleotide polymorfismen en potentiële geneesmiddeldoelen bij borstkanker met behulp van transcriptomische analyse

DOI:

10.3791/70964

June 9th, 2026

In This Article

Summary

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Deze studie onderzocht mitochondriale genen gerelateerd aan oxidatieve stress die geassocieerd zijn met therapeutische resistentie bij HER2-positieve borstkanker. Met behulp van transcriptomische datasets, geïntegreerde bio-informatica en klinische gegevens (n = 4.929) identificeerden de auteurs MTHFD2 en PRDX3 als belangrijke differentieel tot expressie gebrachte genen met potentiële prognostische waarde. In silico. Analyses suggereren functionele effecten van genetische varianten.

Abstract

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

HER2-positieve (HER2+) borstkanker ontwikkelt vaak resistentie tegen therapieën zoals Lapatinib, wat mogelijk mitochondriale metabole en redoxe herprogrammering met zich meebrengt. Deze studie had als doel mitochondriale genen met oxidatieve stress (MOS-DEGs) als biomarkers van resistentie te identificeren en hun functionele nsSNP's en structurele effecten te karakteriseren. RNA-seq datasets (GSE231524, GSE231525) werden geanalyseerd met DESeq2 om LEG's te identificeren, die werden gekruist met mitochondriale oxidatieve stressgenen om MOS-DEG's te verkrijgen. Functionele verrijking, PPI-analyse, ROC-analyse, expressieprofilering en overlevingsanalyse werden uitgevoerd. nsSNP's werden geëvalueerd met meerdere voorspellende instrumenten, en structurele effecten werden beoordeeld via secundaire en 3D-modellering. Geïntegreerde transcriptomische en klinische analyse identificeerde MTHFD2 en PRDX3 als centrale MOS-DEG's met tegengestelde regulerende rollen in het mitochondriale redoxmetabolisme. MTHFD2 was significant opgereguleerd en geassocieerd met een slechte prognose (HR = 1,53, p = 1,1 × 10⁻16), terwijl PRDX3 beschermende expressiepatronen vertoonde (HR = 0,73, p = 7,7×10⁻10). ROC-analyse suggereerde hun potentieel als voorspellers van therapeutische respons. nsSNP-analyse toonde vijf schadelijke varianten in MTHFD2 en vier schadelijke varianten in PRDX3, waarbij rs1471336772 (MTHFD2) en rs747786383 (PRDX3.) als de meest pathogene werden geïdentificeerd. Deze varianten werden voorspeld schadelijk te zijn op basis van meerdere computationele scoresystemen, waaronder SIFT ≤ 0,05, PolyPhen-2 ≥ 0,85, schadelijke CADD-scores en hoge REVEL-scores, en bevonden zich binnen katalytische of redox-actieve domeinen. Structurele modellering suggereerde dat deze substituties de conformatie kunnen destabiliseren, metaal- en cofactorbindingsplaatsen kunnen verstoren en de NADPH-regeneratie of thioredoxine-afhankelijke peroxidaseactiviteit kunnen beïnvloeden. Moleculaire dynamica-voorspellingen wezen op mogelijk verlies van structurele stabiliteit en veranderde flexibiliteit, wat wijst op mogelijke functionele beperking van de mitochondriale redoxcontrole. Deze studie identificeert MTHFD2 en PRDX3 als regulatoren van mitochondriale oxidatieve stress bij HER2+ borstkanker. Schadelijke nsSNP's in deze genen kunnen bijdragen aan een veranderde redoxbalans, wat mogelijk invloed heeft op metabole adaptatie (MTHFD2) en antioxidantenverdediging (PRDX3).

Introduction

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Borstkanker is de meest gediagnosticeerde kanker bij vrouwen wereldwijd en een belangrijke oorzaak van kankergerelateerde sterfte, ondanks aanzienlijke vooruitgang in vroege opsporing en gerichte therapieën 1,2,3. Moleculaire heterogeniteit binnen borsttumoren ligt ten grondslag aan diverse klinische uitkomsten en behandelingsreacties, wat aanhoudende uitdagingen vormt voor precisie-oncologie 4,5. Onder de erkende moleculaire subtypes is de humane epidermale groeifactor receptor 2 (HER2)-positieve borstkanker verantwoordelijk voor ongeveer 15–20% van alle borstkankers en wordt gekenmerkt door HER2-genamplificatie en overexpressie van de HER2-receptor tyrosine kinase 6,7. Hoewel HER2-gerichte therapieën, zoals trastuzumab en lapatinib, de patiëntprognose aanzienlijk hebben verbeterd, ontstaat er vaak primaire en verworven resistentie tegen deze middelen, wat leidt tot tumorterugval en ziekteprogressie 8,9. Het begrijpen van de moleculaire mechanismen die HER2-therapieresistentie aansturen, blijft daarom een grote onvervulde behoefte in de klinische oncologie.

Opkomend bewijs suggereert dat mitochondriale disfunctie en oxidatieve stress een cruciale rol spelen bij het mediëren van medicijnresistentie bij borstkanker. Mitochondriën zijn, naast hun canonieke rol in ATP-productie, belangrijke regulatoren van apoptose, redoxsignaaloverdracht en metabole plasticiteit—allemaal processen die kankercellen benutten om therapeutische druk te overleven. In het bijzonder tonen resistente HER2+- kankercellen een metabole verschuiving naar oxidatieve fosforylering (OXPHOS), versterkte buffering van reactieve zuurstofsoorten (ROS) en veranderde mitochondriale biogenese. Deze aanpassingen stellen cellen in staat om overlevingssignalering te behouden en apoptose te vermijden ondanks aanhoudende remming van HER2-signaalpaden. Genen die mitochondriale complex-subeenheden en redoxregulerende enzymen coderen, zijn daarom potentiële biomarkers en therapeutische doelwitten om resistentie te overwinnen.

Parallel kunnen niet-synoniemige enkel-nucleotide polymorfismen (nsSNP's) in mitochondriale of oxidatieve stressgerelateerde genen de eiwitstructuur en -functie wijzigen, wat enzymactiviteit, medicijnrespons en ziektevatbaarheid beïnvloedt10. Computationele voorspelling van de schadelijke effecten van nsSNP's met behulp van in silico.instrumenten zoals SIFT, PolyPhen-2 en CADD bieden een snelle manier om functionele varianten te identificeren die kunnen bijdragen aan kankerheterogeniteit en therapeutische resistentie. Het integreren van transcriptomische en mutatiegegevens biedt zo een multidimensionaal beeld van gendysregulatie en structurele veranderingen op zowel transcriptie- als genomisch niveau.

Recente ontwikkelingen in bio-informatica en systeembiologie hebben de high-throughput identificatie van potentiële drijvende genen mogelijk gemaakt via grootschalige expressieprofilering en netwerkgebaseerde analyse. Openbare archieven zoals de Gene Expression Omnibus (GEO) bieden waardevolle RNA-sequencing datasets die moleculaire veranderingen vastleggen tussen experimentele modellen en patiëntencohorten. In combinatie met analytische tools zoals DESeq2, clusterProfiler en STRING–Cytoscape-netwerkanalyse maken deze bronnen een uitgebreide karakterisering van differentieel tot expressie gebrachte genen (DEGs), verrijking van routes en ontdekking van hubgenen mogelijk. Belangrijk is dat het integreren van mitochondriale oxidatieve stressgensignaturen met DEG's nieuwe moleculaire mechanismen achter HER2-gerichte therapieresistentie kan verhelderen en kandidaatbiomarkers voor therapeutische interventie kan identificeren.

De door HER3 aangedreven weerstandsas heeft recentelijk aandacht gekregen als een belangrijk compensatorisch pad na de remming van HER2. HER3-activatie herstelt downstream PI3K/AKT-signalering, bevordert de celoverleving en medicijntolerantie (Figuur 1). De DUSP6 (Dual Specificity Phosphatase 6), een negatieve regulator van ERK-signalering, is betrokken bij het moduleren van deze adaptieve respons. Remming van DUSP6 reactiveert ERK-signalering en kan HER3-gemedieerde resistentie tegengaan, maar de wisselwerking met mitochondriale oxidatieve stress en metabole aanpassing is nog onvoldoende begrepen. Daarom bieden vergelijkende transcriptomische analyses van HER2+- cellijnen (BT474 en MDA-MB-453) onder DUSP6-remming en chronische blootstelling aan Lapatinib een ideaal model om de moleculaire determinanten van geneesmiddelresistentie te ontleden.

Figuur 1
Figuur 1. Schematische weergave van het moleculaire landschap dat mitochondriale disfunctie, oxidatieve stress en borstkankerprogressie verbindt. Deze geïntegreerden moleculaire mechanismen die ten grondslag liggen aan mitochondriale oxidatieve stress-gemedieerde oncogenese bij borstkanker. Gestoorde mitochondriale elektronentransportketencomplexen, met name met betrekking tot DUFS3, UQCRC1, COX4I1, SDHA en ATP5PO, leiden tot overmatige aanmaak van reactieve zuurstofsoorten (ROS), wat leidt tot oxidatieve DNA-schade, lipidperoxidatie en een verminderd mitochondriale membraanpotentiaal. Deze oxidatieve verstoringen activeren oncogene signaalroutes zoals PI3K/AKT, MAPK en NF-κB, terwijl apoptotische regulatoren zoals p53 en BAX worden onderdrukt, waardoor tumorceloverleving, proliferatie en immuunomleiding worden bevorderd. Het diagram benadrukt ook de dubbele impact van mitochondriale oxidatieve stress op het kankermetabolisme en de tumormicro-omgeving, waarbij de bijdrage aan therapieresistentie en immuunmodulatie onder HER2+ borstkankeraandoeningen wordt benadrukt. Dit integratieve model vormt de mechanistische basis voor latere transcriptomische en SNP-gebaseerde analyses die gericht zijn op het identificeren van mitochondriale drijfvergenen en potentiële therapeutische doelwitten. Klik hier om een grotere versie van deze figuur te bekijken.

De huidige studie is ontworpen om systematisch hubgenen, functionele nsSNP's en potentiële geneesmiddeldoelen te identificeren die geassocieerd zijn met mitochondriale oxidatieve stress bij HER2+ borstkanker. Door transcriptomische gegevens van GSE231524 en GSE231525 te integreren met gecureerde mitochondriale en oxidatieve stressgerelateerde genensets, was de huidige studie gericht op het definiëren van mitochondriale oxidatieve stressgerelateerde differentieel expressieve genen (MOS-DEG's) die bijdragen aan therapieresistentie. Downstream-analyses omvatten genontologie (GO) en KEGG-routeverrijking, het opbouwen van eiwit-eiwitinteractie (PPI) netwerken, prioritering van hubgenen en overlevingscorrelatieanalyse met behulp van de Kaplan–Meier Immunotherapy Database. Bovendien werden belangrijke genen verder onderzocht op nsSNP-variatie en mogelijke structurele impact om mutatiegedreven functionele gevolgen te achterhalen.

Door transcriptomische profilering, netwerkbiologie en in silico. mutatieanalyse te combineren, biedt deze studie een geïntegreerd kader voor het ontdekken van potentiële mitochondriale biomarkers en therapeutische doelen in HER2+ borstkanker. De identificatie van oxidatieve fosforyleringsgekoppelde hubgenen en hun functionele SNP's kan de weg vrijmaken voor de ontwikkeling van precisietherapeutische strategieën om HER2-gerichte geneesmiddelresistentie te overwinnen en de patiëntuitkomsten te verbeteren.

Access restricted. Please log in or start a trial to view this content.

Protocol

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Dataopvraging en voorverwerking

Deze studie werd uitgevoerd met behulp van openbaar beschikbare transcriptomische en genetische gegevens; er waren geen menselijke of dierlijke proefpersonen direct betrokken. Transcriptomische datasets die relevant zijn voor HER2+ borstkankertherapieresistentie zijn opgehaald uit de NCBI Gene Expression Omnibus (GEO) database (https://www.ncbi.nlm.nih.gov/geo/)11. Twee RNA-seq datasets, GSE231524 en GSE231525, werden geselecteerd vanwege hun specifieke focus op HER3-gedreven resistentie en DUSP6-inhibitie in HER2+ borstkankercellijnen (BT474 en MDA-MB-453). Deze datasets omvatten ouderlijke, medicijntolerante en medicijnresistente fenotypes afgeleid van blootstelling aan Lapatinib (1 μM) en DUSP6 knockdown. Ruwe telmatrices en bijbehorende metadatabestanden werden benaderd met de GEOquery (v2.70.0) en Biobase (v2.62.0) pakketten in RStudio (v4.3.2)12. De metadata werden samengesteld om twee hoofdcontrasten voor elke dataset te definiëren: GSE231524 vergeleek de controle (BT474 ouderlijk, Dag 0) met medicijntolerante en medicijnresistente monsters (Dag 9–Maand 9), terwijl GSE231525 de controle (Scrambled siRNA) vergeleken met DUSP6 knockdown (DUSP6-KD). Kwaliteitscontrole en datanormalisatie werden uitgevoerd met het DESeq2 (v1.42.0) framework, dat een variantie-stabiliserende transformatie (VST) toepast om heteroscedasticiteit te verminderen en vergelijkbaarheid tussen steekproeven te waarborgen. Datadistributie en clusteringpatronen werden visueel beoordeeld met ggplot2 (v3.5.0) en pheatmap (v1.0.12) om de uniformiteit van de data te bevestigen en potentiële uitschieters te identificeren voorafgaand aan differentiële expressieanalyse13,14.

In deze studie werd een duidelijk onderscheid gemaakt tussen bevindingen afkomstig uit cellijntranscriptomische datasets en die verkregen uit patiëntafgeleide klinische datasets. Cellijngegevens werden voornamelijk gebruikt voor verkennende analyses, waaronder de identificatie van differentieel tot expressie gebrachte genen en het genereren van voorlopige mechanistische inzichten in gecontroleerde experimentele modellen. Daarentegen werden patiëntafgeleide datasets gebruikt voor externe validatie van genexpressiepatronen en beoordeling van klinische relevantie, inclusief prognostische evaluatie. Daarom worden resultaten van cellijnmodellen en klinische cohorten afzonderlijk geïnterpreteerd om overgeneralisatie te voorkomen en een passende translationele context voor alle bevindingen te waarborgen.

Analyse van differentiële genexpressie

Differentiële expressieanalyse werd uitgevoerd om genen te identificeren die significant gemoduleerd waren tussen de controle- en behandelingscondities. Genormaliseerde tellingen werden verwerkt met behulp van het aangepaste regressiemodel (ARM) geïntegreerd in DESeq2 om log₂ fold-veranderingen en statistische significantie nauwkeurig te schatten. De ontwerpformule werd gedefinieerd als ~conditie, die de controle- versus behandelde groepen vertegenwoordigt. Genen met een aangepaste p-waarde (FDR) < 0,05 en absolute log₂-voudige verandering ≥ 1 werden als significant differentieel tot expressie gebracht. Log₂ fold change shrinkage werd uitgevoerd met behulp van de apeglm-methode om de robuustheid in effectgrootteschatting te vergroten. De resultaten van de analyse werden gevisualiseerd met behulp van EnhancedVolcano (v1.22.0)15 en ggplot216, die vulkaangrafieken en MA-grafieken genereerden die de relatie tussen expressiegrootte en statistische zekerheid tonen. Verspreidingsschattingen werden ook beoordeeld binnen DESeq2 om nauwkeurige variantiemodellering en consistente normalisatie over biologische replicatente waarborgen 17.

Terugvinden en identificeren van mitochondriale oxidatieve, stressgerelateerde differentieel expressieve genen (MOS-DEG's)

Om het verband tussen energiemetabolisme, oxidatieve stress en geneesmiddelresistentie te onderzoeken, werd een uitgebreide lijst samengesteld van mitochondriale en oxidatieve stress-geassocieerde genen uit meerdere databases, waaronder Human MitoCarta3.018 (https://personal.broadinstitute.org/scalvo/MitoCarta3.0/human.mitocarta3.0.html), Gene Ontology (GO:0006979, response to oxidative stress) (http://geneontology.org/), de Kyoto Encyclopedia of Genes and Genomes (KEGG) oxidatieve fosforyleringsroute (https://www.genome.jp/kegg/), en de Human Oxidative Stress Gene Database (HOSGDB) (http://hosgdb.com/). Alle teruggevonden genen werden gestandaardiseerd volgens HGNC-goedgekeurde gensymbolen met org. Hs.eg.db (v3.18.0) en AnnotationDbi (v1.64.0), terwijl dubbele vermeldingen, pseudogenen en niet-coderende RNA's werden verwijderd om de nauwkeurigheid van de annotatie te waarborgen. Het resulterende gecureerde mitochondriale oxidatieve stressgenpanel (MOS-genen) werd vervolgens gebruikt als referentieset voor integratie met de differentieel tot expressie gebrachte genen die uit beide transcriptomische datasets werden geïdentificeerd.

De snijpunt van de gecureerde MOS-genenlijst met de DEG's verkregen uit GSE231524 en GSE231525 werd uitgevoerd in R met behulp van dplyr (v1.1.3)19 en base R intersect()-functies. Deze integratieve benadering maakte het mogelijk MOS-DEG's te identificeren, die genen vertegenwoordigen die functioneel gekoppeld zijn aan mitochondriaal metabolisme, redoxregulatie en aanpassing van oxidatieve stress. De overlap tussen datasets werd gevisualiseerd met het VennDiagram (v1.7.3) pakket in R om gedeelde en unieke genen over de experimentele modellen20 te illustreren. De verfijnde lijst van MOS-DEG's werd gebruikt voor downstream analyses en bood mechanistisch inzicht in de transcriptionele en metabole herprogrammering die ten grondslag ligt aan de HER2-gerichte therapieresistentie.

Expressieprofilering en visualisatie van MOS-DEG's

Expressieprofilering van de geïdentificeerde MOS-DEG's werd uitgevoerd met behulp van ComplexHeatmap (v2.18.0)21 en pheatmap (v1.0.12) pakketten in RStudio om globale expressiepatronen te visualiseren over ouderlijke, geneesmiddeltolerante en resistente condities. Genormaliseerde telgegevens werden getransformeerd met z-score scaling om de genexpressiematrix over de monsters te standaardiseren. Clustering werd uitgevoerd met behulp van Euclidische afstands- en volledige koppelingsmethoden om co-expressiepatronen te detecteren en conditiespecifieke transcriptieprofielen te onderscheiden. Heatmaps en clusteringplots werden gegenereerd met ggplot2 om duidelijke visuele differentiatie tussen omstandigheden te waarborgen. Deze visualisatiebenadering vergemakkelijkte de identificatie van gengroepen die geassocieerd zijn met mitochondriale activiteit, modulatie van oxidatieve stress en metabole herprogrammering onder medicijnresistente toestanden.

Functionele verrijking en padannotatie

Om de biologische betekenis en regulerende mechanismen van de geïdentificeerde MOS-DEG's te onderzoeken, werden verrijkingsanalyses uitgevoerd in Gene Ontology (GO) en de Kyoto Encyclopedia of Genes and Genomes (KEGG) verrijkingsanalyses met behulp van R Studio (versie 4.3.1). De analyses werden uitgevoerd in de tidyverse-omgeving met behulp van meerdere Bioconductor-pakketten voor reproduceerbare berekeningen en visualisatie. Genannotatie en identificatiemapping werden uitgevoerd met behulp van de organisatie. Hs.eg.db database (https://bioconductor.org/packages/org.Hs.eg.db/) gebaseerd op het Homo sapiens-referentiegenoom (GRCh38). GO-verrijkingsanalyse werd uitgevoerd met het clusterProfiler-pakket (versie 4.8.1; https://bioconductor.org/packages/clusterProfiler/), dat genen categoriseert in drie hoofdontologieën—Biologisch Proces (BP), Cellulaire Component (CC) en Moleculaire Functie (MF). De enrichGO22-functie werd gebruikt met parameters ingesteld op p-waarde < 0,05 en aangepaste p-waarde. (FDR) < 0,05, waarbij de Benjamini–Hochberg-correctiemethode werd toegepast. Visualisaties, waaronder balkgrafieken, puntdiagrammen en akkoorddiagrammen, werden gegenereerd met behulp van enrichplot (https://bioconductor.org/packages/enrichplot/), ggplot213 (https://cran.r-project.org/web/packages/ggplot2/) en GOplot (https://cran.r-project.org/web/packages/GOplot/). Deze tools boden een gestructureerd beeld van de verrijkte GO-termen en hun genassociaties.

De verrijking van de KEGG-route werd uitgevoerd met behulp van de enrichKEGG()-functie binnen het clusterProfiler-pakket, waarbij verwezen werd naar de menselijke KEGG-database (https://www.genome.jp/kegg/). Het KEGGREST-pakket (https://bioconductor.org/packages/KEGGREST/) werd gebruikt voor het ophalen en annoteren van pathwaygegevens. Routes met een aangepaste p-waarde. (q-waarde) < 0,05 werden als significant beschouwd. Visualisatie en padmapping werden uitgevoerd met pathview (https://bioconductor.org/packages/pathview/), ggplot2 en enrichplot, terwijl igraph en ggraph werden gebruikt voor netwerkrepresentatie23. Alle verrijkingsanalyses en visualisaties zijn geïmplementeerd in R Studio (v4.3.1) met reproduceerbare code en gestandaardiseerde Bioconductor-workflows, wat zorgt voor betrouwbare identificatie van verrijkte functionele categorieën en biologische routes die horen bij de MOS-DEG's.

ROC-gebaseerde validatie van voorspellende biomarkers bij borstkanker

Om de klinische voorspellende kracht van de MOS-DEGs te valideren, werd een analyse van de receiver operating characteristic (ROC) curve uitgevoerd met behulp van de ROCplotter online tool (https://www.rocplot.org/)24. ROCplotter is een geïntegreerd webgebaseerd platform dat genexpressiegegevens combineert met klinisch geannoteerde behandelresponsdatasets van 3.104 borstkankerpatiënten, waaronder degenen die behandeld zijn met chemotherapie, hormonale therapie of anti-HER2-middelen.

De analyse werd uitgevoerd met de parameters "pathologische volledige respons" als uitkomstvariabele en "elke chemotherapie" als behandelcategorie. Genexpressiewaarden afgeleid van Affymetrix-microarray-datasets werden automatisch gestratificeerd in responder- en non-respondergroepen op basis van klinische annotaties binnen het platform.

De receiver operating characteristic (ROC) curve (AUC), de Mann–Whitney U-test, vouwverandering en chi-kwadraattest werden toegepast om het vermogen van elk gen te beoordelen om responders van niet-responders te onderscheiden. Het oppervlak onder de curve (AUC) werd gebruikt als primaire maatstaf om discriminatieprestaties te evalueren. AUC-waarden hoger dan 0,55 met ROC-p-waarden < 0,05 werden als significant beschouwd, wat een matige voorspellende prestatie vertegenwoordigt die typisch is voor transcriptomische biomarkers, terwijl correctie voor false discovery rate (FDR) werd toegepast om analytische strengheid te behouden.

Alle geselecteerde MOS-DEG's werden bevraagd met hun bijbehorende Affymetrix-probe-ID's. Het discriminatiepotentieel van elk gen werd geëvalueerd in klinische borstkankercohorten, waarbij expressiegegevens werden gestratificeerd in responder- en non-respondergroepen. ROC-curves, boxplots en bijbehorende statistische outputs werden direct door het ROC-plotterplatform gegenereerd en geëxporteerd voor downstream visualisatie en vergelijking. De analyse kwantificeerde de voorspellende waarde van redox- en metabole regulatoren die betrokken zijn bij mitochondriale oxidatieve stress. Genen die consistente voorspellende significantie vertoonden over klinische monsters werden behouden voor opname in het definitieve voorspellende panel.

Differentiële expressieanalyse in tumor-, normale en metastatische weefsels (TNMplot-analyse)

De expressiepatronen van de top MOS-DEG's werden geanalyseerd over normale, tumor- en uitgezaaide borstweefsels met behulp van de TNMplot webtool v2 (https://tnmplot.com/analysis/)25. Zowel RNA-Seq (TCGA + GTEx + MET500) als genchipdatasets werden onderzocht om cross-platform validatie te waarborgen. De module "Multiple Gene Analysis" werd gebruikt met Breast Invasive Carcinoma als geselecteerd weefseltype26. Expressiewaarden werden log₂-getransformeerd en vergeleken tussen Tumor vs. Normaal (TvsN), Metastasisch vs. Tumor (MvsT) en Metastasisch vs. Normaal (MvsN) groepen. TNMplot berekende automatisch fold-change (FC) en p-waarden met behulp van de Mann–Whitney U-test om de statistische significantie te beoordelen. Expressieverdelingen werden weergegeven als boxplots en dichtheidsplots die direct werden gegenereerd vanuit de TNMplot-interface, waarbij groen, rood en grijs respectievelijk normale, tumor- en metastatische weefsels vertegenwoordigden. Alle figuren werden in hoge resolutie geëxporteerd voor integratie in de resultatensectie. Deze dual-platform analyse maakte robuuste identificatie en validatie mogelijk van belangrijke mitochondriale redox-metabole regulatoren die geassocieerd zijn met borstkankerprogressie27.

Overlevings- en prognostische analyse met behulp van de Kaplan–Meier-plotter

Om de prognostische relevantie van MOS-DEG's bij borstkanker te evalueren, werd een overlevingsanalyse uitgevoerd met behulp van de Kaplan–Meier Plotter online tool (https://kmplot.com/analysis/)28. Deze database integreert genexpressie- en overlevingsgegevens van meer dan 4.900 borstkankerpatiënten, afkomstig van meerdere GEO-, EGA- en TCGA-datasets. De analyse werd uitgevoerd voor recurrence-free survival (RFS) met behulp van individuele Affymetrix-probe-ID's die overeenkomen met de geprioritiseerde genen: 225609_at (GSR), 201761_at (MTHFD2), 201619_at (PRDX3/AOP1) en 201128_s_at (ACLY). Patiënten werden verdeeld in groepen met hoge en lage expressie op basis van de mediane expressiegrens, en de overlevingskansen werden geschat met behulp van de Kaplan–Meier-methode. De log-rank test werd gebruikt om de statistische significantie tussen overlevingscurves te beoordelen, en hazard ratio's (HR's) met 95% betrouwbaarheidsintervallen (BI's) werden automatisch door het instrument berekend. Alle analyses werden uitgevoerd met het RFS-eindpunt, zonder restrictie op basis van hormoonreceptor of HER2-status (ER, PR, HER2 = alles). Redundante steekproeven werden verwijderd en aannames over proportionele gevaren werden geverifieerd om statistische robuustheid te waarborgen. Kwaliteitscontrolefilters sloten gebiaseerde microarrays uit. Er werd geen handmatige probeselectie of p-waarde correctie toegepast voor meerdere tests, in overeenstemming met de standaardinstellingen van de KM Plotter. Statistische significantie werd gedefinieerd als p. < 0,05. Overlevingsgrafieken werden gevisualiseerd en in hoge resolutie gedownload voor verdere interpretatie, waarbij uitkomsten tussen hoge en lage expressers van elk kandidaat MOS-gen 29,30 werden vergeleken.

De huidige analyse is gestart met behulp van datasets die uitsluitend bestaan uit HER2+ borstkankermonsters voor de identificatie van differentieel tot expressie gedrukte genen (DEGs) en hubgenen. Vervolgens werd overlevingsanalyse uitgevoerd zonder beperking tot HER2-status (ER, PR, HER2 = alles) om de bredere prognostische relevantie en generaliseerbaarheid van de geïdentificeerde genen te beoordelen. Deze benadering werd gebruikt als een secundaire validatiestap in plaats van om de studiefocus te herdefiniëren. Daarom worden de prognostische implicaties van de geïdentificeerde hubgenen voorzichtig geïnterpreteerd, waarbij de primaire conclusies specifiek blijven voor HER2+ borstkanker.

De canonieke transcriptsequenties van MTHFD2-201 (ENST00000394053.7) en PRDX3-201 (ENST00000298510.4) werden opgehaald uit de Ensembl Genome Browser (https://www.ensembl.org)31,32. Variantannotatie en classificatie werden uitgevoerd met behulp van de Ensembl Variant Effect Predictor (VEP) (https://www.ensembl.org/vep), die gedetailleerde genomische context, codonveranderingen en aminozuursubstituties voor elke geïdentificeerde variant bood. Alleen missense-varianten (niet-synoniem SNP's) werden geselecteerd voor downstream-analyse.

Voorspelling van pathogeniciteit en variantprioritisatie

De functionele gevolgen van elke nsSNP werden geëvalueerd met behulp van een combinatie van computationele voorspellingstools. SIFT (https://sift.bii.a-star.edu.sg) werd toegepast om aminozuurbehoud te beoordelen, waarbij varianten met een score ≤ 0,05 als schadelijk33 werden geclassificeerd. PolyPhen-2 (http://genetics.bwh.harvard.edu/pph2) schatte de structurele en evolutionaire impact van substituties, waarbij scores ≥ 0,85 waarschijnlijke schade34 aangaven. CADD (https://cadd.gs.washington.edu) leverde een samengestelde schadelijke score die meerdere annotaties integreert, met waarden ≥ 20 die een hoog pathogene potentiaal35 aanduiden. Complementaire metrics van MetaLR36, Mutation Assessor en REVEL werden geïntegreerd vanuit de VEP-interface voor verbeterde voorspellingsbetrouwbaarheid37. Varianten die de drempels MetaLR ≥ 0,70, Mutation Assessor ≥ 3,5 en REVEL ≥ 0,75 haalden, werden als waarschijnlijk pathogene geprioriteerd.

Structurele en mechanistische impactvoorspelling

Om te evalueren hoe aminozuursubstituties de structurele integriteit en biochemische functie beïnvloeden, werd elke hooggeplaatste nsSNP verder geanalyseerd met behulp van MutPred2 (http://mutpred.mutdb.org)38 en DynaMut (http://biosig.unimelb.edu.au/dynamut)39. MutPred2 schatte de kans op functionele verstoring, waaronder veranderde katalytische activiteit, toename of verlies van metaalbindende residuen, veranderingen in de toegankelijkheid van oplosmiddelen en allosterische modulatie, waarbij scores ≥ 0,80 als zeer pathogene werden geclassificeerd. DynaMut berekende de Gibbs vrije energieverandering (ΔΔG) tussen wildtype- en mutanteiwitten, beoordeelde de richting en omvang van de stabiliteitsverandering en genereerde visualisaties van atomaire verplaatsingen en waterstofbindingsherschikkingen.

Secundaire en 3D-structurele modellering en profilering van solventtoegankelijkheid

De experimenteel opgeloste kristalstructuren van MTHFD2 en PRDX3 werden verkregen uit de Protein Data Bank (PDB) en verwerkt met PyMOL V:3.1 (https://pymol.org)40 om de ruimtelijke verdeling van schadelijke residuen te visualiseren. Mutantmodellen werden gemaakt door de bijbehorende aminozuursubstituties te introduceren, gevolgd door structurele verfijning en energieminimalisatie. Vergelijkende 3D-inspectie benadrukte verschuivingen in secundaire elementen, veranderde interatomaire contacten en de ruimtelijke nabijheid van nsSNP's tot katalytische en cofactorbindende domeinen, wat potentiële verstoringen in redox- en metabole functies aan het licht bracht.

Secundaire structuur- en oplosmiddelblootstellingsanalyses werden uitgevoerd met PSIPRED V: 3.2 (http://bioinf.cs.ucl.ac.uk/psipred)41,42 en NetSurfP 3.0 (https://services.healthtech.dtu.dk/service.php?NetSurfP-2.0)43. Deze tools voorspelden α-helixen, β-strengen, spiralen en ongeordende gebieden, samen met de score van relatieve oplosmiddeltoegankelijkheid (RSA). Residuen met matige tot hoge RSA-waarden en structurele orde werden in kaart gebracht om oplosmiddel-blootgestelde en functioneel kritische posities te identificeren. De getroffen locaties werden gevisualiseerd in 2D-topologiediagrammen om te bepalen of schadelijke mutaties plaatsvonden in rigide katalytische kernen of flexibele lusregio's, waarmee hun waarschijnlijke effecten op eiwitvouwingsdynamiek en enzymatische efficiëntie werden voorspeld.

Database-kruisvalidatie, functionele integratie en stabiliteitsvalidatie

Elke geprioriteerde nsSNP werd gekruist met populatieniveau-genomische databases, waaronder dbSNP, 1000 Genomes, ExAC en gnomAD om variantfrequentie, wereldwijde allelische distributie en eerder gerapporteerde klinische verbanden te bevestigen. De integratie van evolutionaire conservatie, structurele modellering en op machine learning gebaseerde functionele voorspelling maakte het mogelijk om schadelijke varianten met hoge betrouwbaarheid in MTHFD2 en PRDX3 te identificeren. Deze krachtige mutaties werden vervolgens in kaart gebracht naar functionele domeinen om hun potentiële rol bij mitochondriale oxidatieve stressdisbalans, veranderde metabole signalering en therapeutische resistentie bij borstkanker te verduidelijken. Om de thermodynamische gevolgen van elke schadelijke substitutie verder te bevestigen, werd iMutant 3.0 (https://folding.biofold.org/i-mutant/i-mutant3.0.html)44 gebruikt om de effecten van mutaties op eiwitstabiliteit te voorspellen met behulp van sequentie- en structurele gegevens. De analyse berekende ΔΔG-waarden (kcal/mol) die de verandering in vrije energie tussen wildtype- en mutanteiwitten vertegenwoordigen. Varianten met negatieve ΔΔG-waarden werden geclassificeerd als destabiliserende mutaties, wat wijst op verminderde eiwitstabiliteit en verhoogde kans op uitvouwen. Integratie van iMutant-voorspellingen met DynaMut- en MutPred2-resultaten leverde kruisvalidatie op voor het identificeren van structureel kritische residuen die waarschijnlijk de redoxfunctie, katalytische integriteit en algehele eiwitconformationele stabiliteit beïnvloeden.

Geïntegreerde functionele interpretatie en therapeutische relevantie

Alle geïdentificeerde schadelijke nsSNP's werden gevalideerd door kruisverwijzingen met dbSNP-, gnomAD- en ExAC-populatiedatabases om de frequenties van kleine allels en eerder gerapporteerde associaties met kankerfenotypes te verifiëren. Integratieve interpretatie van evolutionaire conservatie-, structurele modellerings- en stabiliteitsgegevens toonde aan dat de hoog-impact mutaties rs1471336772 (MTHFD2) en rs747786383 (PRDX3) de sterkste schadelijke effecten uitoefenen op eiwitconformatie en katalytische efficiëntie. De computationele resultaten suggereren gezamenlijk dat mutaties in MTHFD2 het NADPH-afhankelijke redoxmetabolisme destabiliseren, terwijl mutaties in PRDX3 de door peroxidase-gemedieerde oxidatieve stressverdediging aantasten, wat bijdraagt aan mitochondriale disfunctie en tumoragressiviteit. Deze op nsSNP gebaseerde structurele en functionele analyse biedt een computationele basis voor toekomstige therapeutische screening en mutatievalidatie, waarbij MTHFD2 en PRDX3 worden benadrukt als precisiebiomarkers voor op redox gerichte borstkankertherapie. Om de duidelijkheid te verbeteren en een uitgebreid overzicht van de analytische strategie te geven, wordt in Figuur 2 een schematische workflow weergegeven die de belangrijkste stappen van de studie samenvat. De workflow integreert differentiële genexpressie-analyse, mitochondriale genfiltering, het opbouwen van eiwit-eiwitinteractienetwerken, klinische validatie met ROC-analyse en nsSNP-gebaseerde structurele karakterisering. Dit stapsgewijze kader benadrukt de logische ontwikkeling van transcriptomische gegevensverwerking naar biomarkeridentificatie en functionele interpretatie.

Figuur 2
Figuur 2. Integratieve meerstapsworkflow voor identificatie en validatie van mitochondriale biomarkers gerelateerd aan oxidatieve stress in HER2+ borstkanker. Dit schema vat de analytische pijplijn samen die in de studie is gebruikt. Eerst werd differentiële genexpressie (DEG)-analyse uitgevoerd op RNA-seq datasets (GSE231524 en GSE231525) om significant veranderde genen te identificeren. Deze DEG's werden gekruist met gecureerde mitochondriale oxidatieve stressgerelateerde genen om MOS-DEGs te verkrijgen. Vervolgens werd eiwit-eiwitinteractie (PPI) netwerkanalyse uitgevoerd met STRING en Cytoscape om hubgenen en functionele modules te identificeren. Vervolgens werd de analyse van de receiver operating characteristic (ROC) curve toegepast met behulp van het ROCplotter-platform om de voorspellende prestaties van geselecteerde genen in klinische cohorten te evalueren. Ten slotte werden niet-synoniem SNP (nsSNP) analyse en structurele modellering uitgevoerd om de potentiële functionele en structurele impact van sleutelvarianten in geprioritiseerde genen (MTHFD2 en PRDX3) te beoordelen. Deze integratieve workflow verbindt transcriptomische, netwerk-, klinische en structurele analyses om potentiële biomarkers en therapeutische doelen te identificeren. Klik hier om een grotere versie van deze figuur te bekijken.

Access restricted. Please log in or start a trial to view this content.

Results

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Analyse van differentiële genexpressie

Differentiële expressieprofilering werd uitgevoerd om transcriptieveranderingen te onderzoeken die geassocieerd zijn met HER2+ borstkankerprogressie en therapieresistentie met behulp van twee onafhankelijke RNA-seq datasets, GSE231524 en GSE231525. In de eerste dataset (GSE231524) werden aanvankelijk in totaal 19.727 genen gekwantificeerd. Na normalisatie, filtering en toepassing van het aangepaste regressiemodel (ARM) voor dif...

Access restricted. Please log in or start a trial to view this content.

Discussion

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Mitochondriale oxidatieve stress is een bepalend kenmerk van tumoradaptatie, die de celoverleving, metabole plasticiteit en therapieresistentie bepaalt. De huidige studie onderzocht systematisch mitochondriale oxidatieve stressgerelateerde differentieel tot expressie gedrukte genen (MOS-DEGs) in HER2+ borstkanker door transcriptomische gegevens, functionele verrijking, klinische validatie en gedetailleerde in silico mutatie- en structurele analyses te integreren. De i...

Access restricted. Please log in or start a trial to view this content.

Disclosures

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

De auteurs hoeven geen belangenconflicten aan te geven. Kunstmatige intelligentie-tools, waaronder OpenAI's ChatGPT (GPT-5), werden gebruikt om de grammatica, duidelijkheid en wetenschappelijke formulering van het manuscript te verbeteren. Alle analyses, interpretaties en conclusies zijn bedacht en geverifieerd door de auteurs.

Bijdragen van de auteur:

Xiaobo Jia bedacht en superviseerde de studie, droeg bij aan het ontwerp van de studie, data-interpretatie, het opstellen van manuscripten en bood het algehele projectleiderschap. Hui Su droeg bij aan dataverwerving, bio-informatica-analyse en interpretatie van transcriptomische resultaten. Jiaxin Zhang assisteerde bij dataverwerking, nsSNP-analyse, structurele modellering en het maken van figuren. Zhao Liu droeg bij aan statistische analyse, validatie van resultaten en revisie van manuscripten. Alle auteurs beoordeelden en keurden de definitieve versie van het manuscript goed.

Acknowledgements

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Geen enkele

Access restricted. Please log in or start a trial to view this content.

Materials

List of materials used in this article
NameCompanyCatalog NumberComments
AnnotationDbiBioconductorv1.64.0R-pakket voor annotatie, gebruikt voor standaardisatie en annotatie van HGNC-gensymbolen.
apeglmBioconductormethode in DESeq2Methode gebruikt voor log2 fold-change inkrimping in differentiële expressieanalyse.
BiobaseBioconductorv2.62.0R-pakket gebruikt om GEO-afgeleide expressie- en metadata-objecten te openen en te beheren.
CADDUniversity of Washington / Kircher LabwebtoolCombineerde Annotation Dependent Depletion-score, gebruikt voor nsSNP-pathogeniciteitsvoorspelling.
clusterProfilerBioconductorv4.8.1R-pakket gebruikt voor GO- en KEGG-verrijkingsanalyse.
ComplexHeatmapBioconductorv2.18.0R-pakket gebruikt voor het genereren van heatmaps en expressieclustering.
CytoscapeCytoscape ConsortiumsoftwareNetwerkvisualisatieplatform gebruikt met STRING-afgeleide PPI-netwerken en CytoHubba-prioritering.
dbSNPNCBIdatabasePopulatievariantendatabase, gebruikt voor kruisvalidatie van geprioriteerd nsSNPs.
DESeq2Bioconductorv1.42.0R-pakket gebruikt voor normalisatie, variantiemodellering en differentiële expressieanalyse.
dplyrCRAN / tidyversev1.1.3R-pakket gebruikt voor gegevensmanipulatie en intersectie van gensets.
DynaMutUniversity of Melbourne / BioSigwebserverTool gebruikt om mutatie-geassocieerde stabiliteits- en flexibiliteitsveranderingen in eiwitten te schatten.
EnhancedVolcanoBioconductorv1.22.0R-pakket gebruikt om differentiële expressieresultaten te visualiseren als vulkaanplots.
Ensembl Genome BrowserEMBL-EBI / EnsembldatabaseBron van canonieke transcriptsequenties voor MTHFD2 en PRDX3.
Ensembl Variant Effect Predictor (VEP)EMBL-EBI / EnsemblwebtoolTool gebruikt om missensevarianten te annoteren en voorspellende scores te integreren.
ExACBroad InstitutedatabasePopulatie-exoomdatabase op niveau gebruikt voor nsSNP-kruisvalidatie.
Gene Expression Omnibus (GEO)NCBIdatabaseRepository gebruikt om transcriptomische datasets op te halen voor HER2-positieve borstkankeranalyse.
Gene OntologyGene Ontology ConsortiumGO:0006979Ontologiebron gebruikt om oxidatieve stressgerelateerde genen op te halen en voor verrijkingsanalyse.
GEOqueryBioconductorv2.70.0R-pakket gebruikt om GEO-tellingsmatrices en metadata te openen.
ggplot2CRAN / tidyversev3.5.0R-pakket gebruikt voor gegevensvisualisatie, clusteringplots en grafische uitvoer.
ggraphCRANR-pakketR-pakket gebruikt voor graaf- en netwerkvisualisatie tijdens verrijking en padweergave.
gnomADBroad InstitutedatabasePopulatievariantendatabase, gebruikt om de frequentie en verdeling van geprioriteerd nsSNPs te controleren.
GOplotCRANR-pakketR-pakket gebruikt voor GO-verrijkingsvisualisatie inclusief koord- en samenvattingsplots.
GSE231524NCBI GEOtoegangRNA-seq-dataset gebruikt voor analyse van parentale, drugstolerante en resistente BT474-fenotypen.
GSE231525NCBI GEOtoegangRNA-seq-dataset gebruikt voor analyse van DUSP6 knockdown in HER2-positieve borstkankercellen.
Human MitoCarta3.0Broad InstitutedatabaseGecureerd mitochondriale genresource, gebruikt om mitochondriale gensets te definiëren.
Human Oxidative Stress Gene Database (HOSGDB)HOSGDBdatabaseDatabase gebruikt om oxidatieve stressgerelateerde genen op te halen.
igraphCRANR-pakketR-pakket gebruikt voor netwerkrepresentatie en padvisualisatie.
iMutant 3.0University of Bologna / BiofoldwebserverTool gebruikt om mutatieeffecten op eiwitstabiliteit te voorspellen.
Kaplan–Meier PlotterKMplotwebtoolOnline platform gebruikt voor recidief-vrije overlevingsanalyse in borstkankercohorten.
KEGGKyoto UniversitydatabasePaddatabase gebruikt voor oxidatieve fosforylering en padverrijkingsanalyse.
KEGGRESTBioconductorR-pakketPakket gebruikt om KEGG-padinformatie op te halen en te annoteren.
LapatinibNiet gespecificeerd in het manuscript1 μM behandelingsconditieHER2-gerichte remmer gebruikt in de brongegevenssets om drugstolerante/resistente fenotipen af te leiden.
MetaLRGeïntegreerd via Ensembl VEPscoreComputationele pathogeniciteitsmetrische gebruikt voor variantenprioritering.
MutPred2MutPredwebserverTool gebruikt om functionele gevolgen van aminozuursubstituties te voorspellen.
NetSurfP 3.0Technical University of DenmarkwebserverTool gebruikt voor voorspelling van secundaire structuur en oplosbaarheid.
org.Hs.eg.dbBioconductorv3.18.0Menselijk genoom-annotatiepakket gebruikt voor genidentificator-mapping.
pathviewBioconductorR-pakketPakket gebruikt om verrijkte genen op KEGG-paden te plaatsen.
pheatmapCRANv1.0.12R-pakket gebruikt voor heatmapplotten en clusteringvisualisatie.
PolyPhen-2Harvard / Brigham and Women's HospitalwebtoolComputationele voorspeller gebruikt om structurele/functionele impact van aminozuursubstituties te schatten.
Protein Data Bank (PDB)RCSB PDBdatabaseBron van experimenteel opgeloste eiwitstructuren voor MTHFD2 en PRDX3.
PSIPREDUniversity College Londonv3.2Eiwitsecundaire structuurvoorspellingsserver gebruikt voor 2D-topologieanalyse.
PyMOLSchrödinger / PyMOLv3.1Molecuulgrafieksoftware gebruikt om eiwitstructuren en mutatieplaatsen te visualiseren.
REVELGeïntegreerd via Ensembl VEPscoreEnsemble-pathogeniciteitsscore gebruikt voor missensevariantenprioritering.
ROCplotterROCplot.orgwebtoolOnline platform gebruikt voor ROC-gebaseerde validatie van genregulatie in borstkankerresponscohorten.
RStudioPosit

Reprints and Permissions

Request permission to reuse the text or figures of this JoVE article

Request Permission

Tags

Breast CancerHER2 PositiveMitochondrial Oxidative StressTranscriptomic AnalysisHub GenesSingle Nucleotide PolymorphismsDrug TargetsMTHFD2PRDX3RNA Sequencing

Related Articles