Se requiere una suscripción a JoVE para ver este contenido. Inicie sesión o comience su prueba gratuita.

Artículo de investigación

Firma inmunitaria relacionada con el estrés del retículo endoplásmico en la fibrilación auricular: aprendizaje automático y transcriptómica de células individuales

146 visualizaciones

DOI:

10.3791/71532

7 de agosto de 2026

* These authors contributed equally

En este artículo

Resumen

Aquí presentamos un protocolo para identificar firmas inmunitarias relacionadas con el estrés del retículo endoplásmico en la fibrilación auricular integrando transcriptómica pública a granel, aprendizaje automático, análisis de infiltración inmunitaria y transcriptómica unicelular para la priorización de biomarcadores reproducibles y la localización por tipo celular.

Resumen

Este estudio describe un flujo de trabajo computacional reproducible para identificar firmas génicas relacionadas con el estrés del retículo endoplasmático (ERS) en la fibrilación auricular (FA) mediante la integración de transcriptómica masiva, aprendizaje automático, análisis de infiltración inmune y transcriptómica de células individuales. Se obtuvieron conjuntos de datos transcriptómicos públicos en masa del Gene Expression Omnibus (GEO), seguidos de armonización fenotípica, normalización, corrección por lotes y análisis de expresión diferencial. El análisis ponderado de la red de coexpresión génica (WGCNA) se combinó con conjuntos génicos relacionados con el ERS para identificar genes candidatos asociados al ERS. Posteriormente se utilizó un marco de aprendizaje automático multi-algoritmo para comparar estrategias de selección de características y ajuste de modelos. El modelo seleccionado fue evaluado en una cohorte externa independiente de validación (GSE115574) y posteriormente evaluado en una cohorte adicional (GSE14975), cuantificando el rendimiento discriminatorio mediante análisis de características operativas del receptor (ROC) y el área bajo la curva (AUC). Utilizando este flujo de trabajo, se identificaron 22 genes centrales relacionados con el ERS, y un modelo Elastic Net (Enet) de 18 genes mostró el mayor rendimiento discriminatorio global entre las cohortes de entrenamiento y validación. El análisis SHapley Aditivive ExPlanations (SHAP) destacó la principal contribución de genes como RPS11, NCF2 y S100A4 a la predicción del modelo. La deconvolución inmune y el análisis transcriptómico unicelular mapearon aún más la firma relacionada con el ERS predominantemente en la línea monocito-macrófago, lo que sugiere su posible implicación en la remodelación inmunitaria asociada a la FA. Este flujo de trabajo proporciona una estrategia reproducible para vincular firmas transcriptómicas asociadas a enfermedades con poblaciones específicas de células inmunitarias y puede adaptarse a otros contextos de enfermedad con conjuntos de datos adecuados en volumen y unicelular.

Introducción

La fibrilación auricular (FA) es la arritmia sostenida más común en la práctica clínica, caracterizada por una actividad eléctrica desordenada en las aurículas y pérdida de función mecánica. Aumenta significativamente los riesgos de ictus, insuficiencia cardíaca y mortalidad por cualquier causa, convirtiéndose en una gran carga global para la saludpública 1. El manejo clínico actual de la FA presenta desafíos significativos: los fármacos antiarrítmicos tradicionales tienen una eficacia limitada a largo plazo para mantener el ritmo sinusal, y sus efectos adversos, como arritmias y cardiotoxicidad, limitan su usocontinuo 2,3. La ablación por catéter también sigue siendo un reto para mantener el ritmo sinusal a largo plazo en caso deFA4 persistente. Actualmente, las nuevas estrategias de tratamiento están limitadas por la falta de un entendimiento sistemático del panorama molecular de los mecanismos aguas arriba de la FA, lo que dificulta la identificación y traducción de objetivos precisos. Las investigaciones han demostrado que la progresión patológica de la FA implica interacciones complejas a lo largo de múltiples dimensiones, incluyendo la remodelación eléctrica, estructural y del sistema nervioso autónomo. Entre ellas, la remodelación estructural auricular, centrada en la fibrosis miocárdica, es un mecanismo clave para el mantenimiento de laFA 5,6,7.

Por lo tanto, elucidar las vías de estrés aguas arriba que impulsan la fibrosis es una de las claves para superar el cuello de botella terapéutico en la FA persistente. Estudios recientes sugieren que el estrés del retículo endoplásmico (ERS), un núcleo regulador clave que permite a las células hacer frente a perturbaciones intra y extracelulares, es una respuesta adaptativa altamente conservada que se desencadena cuando la homeostasis del RE se interrumpe, lo que conduce a una acumulación excesiva de proteínas no plegadas o mal plegadas dentro del lumen del RE. El ERS puede participar en la remodelación auricular regulando la proteostasis, el ciclo del calcio, las respuestas inflamatorias y la apoptosis 8,9. Sin embargo, los disparadores aguas arriba, las moléculas efectoras clave y las vías descendentes del ERS en la FA aún no han sido caracterizados sistemáticamente, lo que dificulta definir sus nodos críticos y puntos de intervención accionables en la remodelación auricular.

En comparación con los estudios transcriptómicos tradicionales en masa, la integración multi-ómica puede generar señales asociadas a la enfermedad a nivel poblacional más robustas. Además, incorporar transcriptómica unicelular permite diseccionar la heterogeneidad celular y identificar las fuentes celulares de estas señales, mapeando así los resultados de asociación a tipos celulares específicos y sus posibles vías de interacción. Esto proporciona una base para investigaciones mecanicistas posteriores y la priorización de objetivos. En el presente estudio, se recuperaron conjuntos de datos transcriptómicos a granel y transcriptómicos de célula única relacionados con la FA, de la base de datos Gene Expression Omnibus (GEO). Los módulos centrales relacionados con el ERS se identificaron mediante análisis de expresión diferencial y análisis ponderado de la red de coexpresión génica (WGCNA). Al integrar análisis de célula única, las moléculas clave se localizaron aún más a tipos celulares específicos y sus redes de interacción. En conjunto, este estudio pretende delimitar las redes clave relacionadas con el ERS en la FA y sus asociaciones con la remodelación estructural, proporcionando así una justificación para el descubrimiento de objetivos y estrategias terapéuticas estratificadas impulsadas por mecanismos.

En comparación con el análisis de expresión diferencial de un solo conjunto de datos o el cribado de biomarcadores con un solo algoritmo, este flujo de trabajo mejora la robustez y la interpretabilidad integrando validación entre cohortes, selección de características biológicamente restringidas, comparación de modelos multi-algoritmo, deconvolución inmune y transcriptómica de célula única. Estos pasos ayudan a priorizar las firmas reproducibles relacionadas con el ERS y a localizar señales derivadas de la masa a poblaciones celulares inmunitarias específicas y redes de interacción. Este flujo de trabajo es adecuado para estudios que utilizan conjuntos de datos transcriptómicos públicos o internos con grupos bien definidos de enfermedades y control, fuentes tejidulares comparables, tamaño adecuado de muestra y anotaciones fenotípicas disponibles. Es especialmente útil para la generación de hipótesis, priorización de biomarcadores y localización por tipo celular de programas moleculares asociados a enfermedades. Sin embargo, su rendimiento depende de la calidad del conjunto de datos, la consistencia fenotípica y la corrección efectiva por efectos de lotes; Por lo tanto, las firmas candidatas identificadas por este flujo de trabajo requieren validación en cohortes independientes y modelos experimentales antes de la traducción clínica. El flujo de trabajo general del estudio se muestra en la Figura 1.

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Protocolo

De acuerdo con las Medidas para la Revisión Ética de la Investigación en Ciencias de la Vida y Medicina que Involucran a Sujetos Humanos promulgadas en China el 18 de febrero de 2023, la investigación que utilice datos públicos puede cumplir los criterios para la exención de la revisión ética. Este estudio utilizó únicamente datos transcriptómicos secundarios públicos y desidentificados y no implicó el reclutamiento de nuevos participantes humanos, la recogida de muestras humanas ni experimentos con animales. Por lo tanto, no se requirió una aprobación ética institucional adicional. No se realizaron experimentos con animales en este estudio. Por lo tanto, la aprobación del comité institucional de cuidado y uso animal no era aplicable.

Fuentes de datos para genes relacionados con el estrés del retículo endoplásmico en la fibrilación auricular
En este estudio, se recuperaron conjuntos de datos transcriptómicos relacionados con la FA, disponibles públicamente de la base de datos GEO, incluyendo GSE41177, GSE79768, GSE115574, GSE14975 y GSE165838. La información detallada sobre los conjuntos de datos GSE se proporciona en el Archivo Suplementario 1—Tabla Suplementaria S1. GSE41177 y GSE79768 se utilizaron para construir la cohorte integrada de entrenamiento transcriptómico en masa, mientras que GSE115574 y GSE14975 se emplearon como dos cohortes independientes de validación externa. GSE165838 se utilizó para el análisis transcriptómico de células individuales. Dado que estos conjuntos de datos se generaron en diferentes plataformas y pueden diferir en origen de tejido, antecedentes clínicos y composición de la muestra, cada conjunto de datos fue preprocesado por separado según las características de su plataforma antes de su integración o validación. Posteriormente, se realizó corrección por lotes utilizando el paquete sva R para la cohorte de formación fusionada. El conjunto de genes relacionados con el estrés del retículo endoplasmático fue recuperado de la base de datos GeneCards con una puntuación de relevancia ≥ 3 y, tras la deduplicación, formó la lista de genes objetivo utilizada en este estudio.

Análisis de genes expresados diferencialmente
Tras la estandarización y normalización de los datos, se utilizó el limma del paquete R para identificar genes expresados diferencialmente (DEGs) en el conjunto de entrenamiento integrado. Los DEGs se definieron utilizando los siguientes criterios de significación: valor P ajustado por tasa de descubrimiento falso (adj. P.Val) < 0,05 y |log2FC| > 0,58510. Para visualizar los patrones de expresión de los DEGs, se generaron gráficos volcánicos y mapas de calor utilizando los paquetes ggplot2 y pheatmap, respectivamente.

Análisis de WGCNA
Para dilucidar los posibles mecanismos de regulación génica coordinada, definir los patrones de asociación entre los módulos de coexpresión y las variables clínicas de rasgo, e identificar biomarcadores centrales o dianas terapéuticas con potencial traslacional, se aplicóWGCNA 11.

Se construyó una red ponderada de coexpresiones utilizando el paquete WGCNA en R. La potencia de umbral suave (β) se seleccionó según el criterio de topología libre de escala; el valor de β correspondiente se eligió para análisis posteriores cuando el índice de ajuste de topología libre de escala (R2) alcanzó y se mantuvo por encima de 0,8512. Durante la identificación del módulo, se optimizaron parámetros relacionados con el corte dinámico de árboles y la sensibilidad a la detección de módulos para mejorar la resolución y estabilidad de los límites del módulo. Finalmente, se extrajeron módulos significativamente asociados con el rasgo objetivo y se identificaron genes hub intramodulares como conjuntos de genes candidatos para análisis posteriores.

Análisis de enriquecimiento de DEGs relacionados con la FA
Para identificar con precisión los genes centrales, los DEG se intersectaron primero con genes de los módulos clave de WGCNA para definir un conjunto de genes implicados en la patogénesis de la FA. A continuación, este conjunto de genes AF se intersectó aún más con genes relacionados con el ERS, y los genes superpuestos resultantes se mantuvieron para análisis posteriores.

El enriquecimiento funcional de los genes evaluados fue evaluado utilizando análisis de Gene Ontology (GO) y la Kyoto Encyclopedia of Genes and Genomes (KEGG). Los términos GO se analizaron con el R package clusterProfiler para resumir el enriquecimiento en las categorías13 de procesos biológicos (BP), componentes celulares (CC) y función molecular (MF). Posteriormente, se utilizó el análisis KEGG para identificar vías enriquecidas asociadas a los genesobjetivo 14. Los resultados de enriquecimiento con un valor P ajustado < 0,05 se consideraron estadísticamente significativos. Los términos principales de GO y las rutas KEGG se mostraban como diagramas de barras y diagramas de burbujas usando ggplot2.

Análisis de interacción proteína-proteína (IBP)
El análisis de IBP se realizó subiendo el conjunto génico intersectado a la base de datos STRING, restringiendo el organismo a Homo sapiens. Se eliminaron los nodos desconectados y se recuperaron las interacciones utilizando un umbral de puntuación de confianza medio (puntuación combinada ≥ 0,4). La red PPI resultante se importó entonces a una herramienta de visualización y análisis de red para el análisis topológico y así identificar nodos clave.

Construcción de un modelo candidato de clasificación AF-ERS basado en 12 algoritmos de aprendizaje automático
En este estudio, se desarrolló un marco de clasificación de conjuntos basado en doce algoritmos convencionales de aprendizaje automático para detectar genes de firma candidatos relacionados con ERS asociados con la FA y optimizar el rendimiento en la clasificación. Para la partición de datos, tras la estandarización y normalización, GSE41177 y GSE79768 se fusionaron para generar la matriz de expresión de cohortes de entrenamiento. GSE115574 se utilizó como una cohorte de validación externa independiente para evaluar la generalizabilidad del modelo. Específicamente, los DEGs se identificaron por primera vez en la cohorte de entrenamiento (|log2FC| >0,585, ajustado p < 0,05). Estos DEGs se intersectaron entonces con genes de los módulos clave de WGCNA y genes relacionados con el ERS, y el conjunto de genes resultante se utilizó como características de entrada para la construcción del modelo.

Para vincular genes relacionados con ERS con el fenotipo AF, se desarrolló un modelo de clasificación candidato utilizando 12 enfoques de aprendizaje automático: Lasso, Ridge, modelo lineal generalizado escalonado (Stepglm), aumento extremo de gradiente (XGBoost), bosque aleatorio (RF), red elástica (Enet), regresión parcial de mínimos cuadrados para modelos lineales generalizados (plsRglm), modelado de regresión generalizada potenciada (GBM), Bayes naïve, análisis discriminante lineal (LDA), glmBoost, y máquina de vectores de soporte (SVM). Se adoptó una estrategia sistemática de modelado combinatorio añadiendo un segundo algoritmo al primero e integrándolos mediante el parámetro de ajuste α, lo que permitió 113 combinaciones de selección de características y ajuste de modelos que se evaluaron de forma exhaustiva. La discriminación del modelo se evaluó calculando el área bajo la curva característica de funcionamiento del receptor (AUC). Según criterios de selección de modelos previamente reportados, el marco final del candidato se definió como el modelo con mejor rendimiento global, evaluado por la media de la AUC entre las cohortes de formación y validación.

Esta estrategia de modelado combinatorio se basó en estudios previos en aprendizaje automáticobiomédico 15,16,17. En conjunto, estos estudios indican que ningún algoritmo supera consistentemente a otros en conjuntos de datos y tareas analíticas. Partiendo de esta premisa, adoptar un marco de aprendizaje en conjunto y modelado combinatorio puede aumentar la probabilidad de obtener un modelo candidato de alto rendimiento con una generalizabilidad más estable y mejorar la robustez de la selección del modelo.

Posteriormente, se aplicaron los valores SHapley Aditivas (SHAP) para interpretar el modelo de aprendizaje automático visualizando las características clave que impulsan la clasificación AF, cuantificando así la contribución de cada característica al resultado previsto e ilustrando cómo los genes de firma individuales influyen en la salida finaldel modelo 18.

Evaluación del rendimiento del modelo y validación externa del modelo óptimo
El rendimiento del modelo óptimo se evaluó en la cohorte de entrenamiento y en la cohorte independiente de validación externa (GSE115574). A nivel de modelo, se construyó una matriz de confusión basada en las etiquetas de clase predichas y se reportaron las métricas de clasificación correspondientes. Las curvas de característica de funcionamiento del receptor (ROC) se generaban usando el paquete R pROC, y el AUC se calculaba para cuantificar el rendimiento discriminativo.

A nivel de biomarcadores, se graficaron curvas ROC de un solo gen para cada gen clave en el modelo óptimo, y se calcularon los AUC correspondientes para evaluar su capacidad discriminatoria individual. Además, la expresión diferencial de los genes clave se resumió mediante un gráfico volcánico, y se emplearon diagramas de caja para representar sus distribuciones de expresión en muestras de enfermedad frente a muestras sanas. Para evaluar aún más la generalizabilidad de la firma génica óptima previamente definida por el modelo, se realizó una validación externa independiente adicional utilizando GSE14975. GSE14975 contiene datos transcriptómicos de muestras del apéndice auricular izquierdo, incluyendo cinco muestras de fibrilación auricular y cinco muestras de ritmo/control sinusal. Todos los genes incluidos en la firma bloqueada estaban disponibles en este conjunto de datos. Para mantener la coherencia con el flujo de trabajo analítico original entre cohortes, la cohorte de desarrollo y GSE14975 se armonizaron usando ComBat con la fuente del conjunto de datos como variable por lotes. Esta armonización se realizó de manera no supervisada. Es importante destacar que las etiquetas de enfermedad/control de GSE14975 no se utilizaron para la selección de características, estimación de coeficientes, determinación de umbrales ni ajuste de hiperparámetros.

El modelo óptimo de puntuación derivado del modelo se ajustó usando solo la cohorte de desarrollo y luego se aplicó a GSE14975 para validación externa. El rendimiento del modelo en GSE14975 se evaluó utilizando análisis de la curva característica de funcionamiento del receptor, área bajo la curva, intervalo de confianza (IC) del 95%, sensibilidad, especificidad, precisión, valores predictivos positivos y negativos, y puntuación Brier. Además, se generaron curvas ROC de un solo gen para todos los genes óptimos derivados de modelos en GSE14975 para ilustrar su capacidad discriminatoria individual. Para evaluar aún más el posible sobreajuste en la cohorte de desarrollo, se realizaron validaciones cruzadas repetidas de 10 veces y corrección de optimismo bootstrap utilizando la firma génica derivada del modelo óptimo bloqueado. Para la validación cruzada repetida, la cohorte de desarrollo se particionó repetidamente en 10 dobleces, y la discriminación del modelo se resumió en todas las iteraciones. Para la validación bootstrap, se generaron 1.000 remuestreos bootstrap para estimar el optimismo del rendimiento aparente del conjunto de desarrollo y calcular el AUC corregido por optimismo. Dado que la firma final se derivó del modelo óptimo, la contribución de cada gen se interpretó principalmente según la magnitud absoluta y la dirección de los coeficientes del modelo. Además, se realizaron análisis ROC de un solo gen en GSE14975 para ilustrar la capacidad discriminatoria individual de cada gen componente. Para fines de visualización, las curvas ROC de un solo gen se orientaron para reflejar la capacidad discriminatoria independientemente de si una expresión más alta o baja se asociaba con FA.

Análisis de enriquecimiento de conjuntos génicos (GSEA)
Para explorar las implicaciones funcionales de los genes clave, se realizó GSEA utilizando muestras del grupo de enfermedad19. Para cada gen clave, las muestras se estratificaron en subgrupos de alta y baja expresión utilizando el valor mediano de expresión en el grupo de la enfermedad como punto de corte. Se calculó la diferencia de expresión media entre los dos subgrupos para cada gen y se generó una lista de genes ordenados en orden descendente como entrada para el análisis de enriquecimiento. GSEA se realizó utilizando el paquete R clusterProfiler, con conjuntos de genes obtenidos de la colección MSigDB c2.cp.kegg.Hs.symbols.gmt. La significación estadística se definió como p < 0,05. La dirección del enriquecimiento se determinó mediante el signo de la puntuación de enriquecimiento normalizado (NES), y se generaron gráficos de enriquecimiento para las vías representativas.

Evaluación de la abundancia de subtipos de células inmunitarias y expresión diferencial
El algoritmo de deconvolución CIBERSORT se aplicó para estimar la abundancia relativa de subconjuntos de células inmunitarias infiltrantes y sus interrelaciones entre muestras. A partir de la matriz de firma leucocitaria LM22, la composición de las células inmunitarias se infirió cuantitativamente a partir de perfiles de expresión génica utilizando el paquete R CIBERSORT20. Se utilizó un umbral de p < 0,05 para filtrar los resultados, y solo se conservaron muestras que cumplían este criterio para análisis posteriores. Se generaron diagramas de caja para comparar las fracciones relativas estimadas de subconjuntos de células inmunitarias entre los grupos FA y control. Además, se realizó el análisis de correlación de Spearman para evaluar las asociaciones entre los niveles de infiltración de células inmunitarias y la expresión génica central.

Análisis de celda única
Se realizó un análisis transcriptómico de célula única utilizando el conjunto de datos GEO GSE165838. Las matrices de recuento gen-celular en bruto se importaron a R y se procesaron usando Seurat v4.4.0. Para cada muestra, se generó un objeto Seurat usando CreateSeuratObject con min.cells = 5 y min.features = 300. Se calcularon métricas de control de calidad, incluyendo el número de genes detectados, el recuento total de identificadores moleculares únicos (UMI), el porcentaje de genes mitocondriales, el porcentaje de genes ribosómicos y el porcentaje de genes de hemoglobina, para cada célula. Las células se retuvieron si tenían más de 500 genes detectados, menos de 5.000 recuentos de UMI, porcentaje de genes mitocondriales < 25%, porcentaje de genes ribosómicos > 3% y porcentaje de genes de hemoglobina < 1%. Se eliminaron genes detectados en menos de tres células. MALAT1 y los genes mitocondriales también fueron excluidos antes del análisis posterior. DoubletFinder se utilizaba para detectar y excluir posibles dobletes. En resumen, las células se dividieron por identidad de muestra y la detección de dobletos se realizó por separado para cada muestra usando componentes principales 1–30.

El parámetro pN se estableció en 0,25 y el valor óptimo de pK se seleccionó según la métrica máxima de BC obtenida mediante el barrido de parámetros. La tasa esperada de dobles se estimó según el número de células recuperadas en cada muestra, con tasas del 2,5%, 5% y 6,5% utilizadas en muestras con números celulares relativamente bajos, intermedios y altos, respectivamente. Solo se conservaban las células clasificadas como singlets. La contaminación por ARN ambiental se estimó aún más utilizando DecontX, y se excluyeron células con una puntuación de contaminación ≥ 0,2. Tras el control de calidad, la eliminación de dobles y el filtrado de ARN ambiental, se retuvieron 40.886 células y 23.947 genes para análisis posteriores. El conjunto de datos filtrado de células individuales se normalizó con el método LogNormalize usando un factor de escala de 10.000, seguido de la identificación de genes altamente variables. Los datos se escalaron después antes del análisis de componentes principales.

Para reducir los efectos por lotes específicos de la muestra, Harmony se aplicó usando orig.ident como variable por lotes. La visualización de Aproximación y Proyección de Variedad Uniforme (UMAP) y la construcción del grafo del vecino más cercano se realizaron utilizando las primeras 15 dimensiones corregidaspor Armonía 21. El agrupamiento se realizó utilizando el algoritmo de Lovaina, y se evaluaron múltiples resoluciones de agrupamiento. La última anotación principal de tipo de celda se basó en el resultado de agrupamiento a resolución 0,05. Los grupos celulares se anotaban manualmente según la expresión canónica del gen marcador. Esta estrategia de anotación basada en marcadores es coherente con estudios previos de perfilado inmunitario unicelular22. Las células T fueron identificadas por CD3D, CD3E y TRAC; células natural killer (NK) por NKG7, GNLY, NCAM1 y KLRG1; células monocito-macrófago por LYZ, CD14, FCGR3A, CD68, CD163, FCN1, TYROBP, S100A8 y S100A9; células B por MS4A1 y CD79A; células plasmáticas por MZB1 y XBP1; células endoteliales por PECAM1, VWF y CDH5; células musculares lisas vasculares por ACTA2, TAGLN, MYH11 y MYL9; fibroblastos por DCN, LUM, COL1A1, COL1A2 y PDGFRA; células similares a neutrófilos por FCGR3B, CXCR2, S100A8 y MPO; los mastocitos por TPSB2; y células dendríticas por LILRA4, CD1C y XCR1. La expresión de marcadores y genes entre los grupos se visualizó mediante gráficos de puntos, y la distribución de expresión de los genes centrales finales relacionados con el ERS se visualizó en incrustaciones de UMAP.

Para cuantificar la actividad transcripcional relacionada con el ERS a nivel de célula única, se utilizó el conjunto final de genes hub para calcular las puntuaciones de firma célula por célula utilizando AUCell, análisis de enriquecimiento de conjuntos génicos de muestra única y Seurat AddModuleScore. Para AUCell, las clasificaciones celulares se construyeron a partir de la matriz de expresión de ARN normalizada, y las puntuaciones AUC se calcularon utilizando el conjunto de genes hub, con el 10% superior de genes clasificados como umbral máximo de clasificación. Para ssGSEA, las puntuaciones de enriquecimiento se calcularon utilizando el paquete GSVA. Las tres salidas de puntuación se centraron y escalaron, luego se normalizaron al máximo y finalmente se sumaron para generar una puntuación compuesta integrada relacionada con ERS para cada celda. La distribución de la puntuación compuesta se comparó entre poblaciones celulares anotadas para evaluar la heterogeneidad por tipo celular del programa relacionado con el ERS. Dado que la línea monocito-macrófago mostró un enriquecimiento destacado de la firma relacionada con el ERS y estuvo estrechamente asociada con la remodelación inmunoinflamatoria, fue seleccionada para análisis posteriores dentro de la línea de linaje. Las células monocito-macrófago se dividieron en grupos de puntuación alta y baja según la mediana de la puntuación compuesta relacionada con el ERS. Posteriormente se realizó un análisis de trayectoria pseudotemporal en células monocito-macrófago utilizando monóculo.

Para el análisis de pseudotiempo, se creó un objeto CellDataSet a partir de la matriz de conteo en bruto utilizando un modelo de expresión binomial negativa. Luego se estimaron los factores de tamaño y las dispersiones. Los genes de ordenación se seleccionaron utilizando un umbral de expresión media de ≥ 0,1 y una dispersión empírica mayor que la dispersión ajustada. La dimensionalidad se redujo con el algoritmo DDRTree y las celdas se ordenaron a lo largo de la trayectoria inferida. Se visualizaron los patrones dinámicos de expresión de los genes hub relacionados con el ERS a lo largo del seudotiempo. Se realizó un análisis de comunicación célula-célula utilizando CellChat para explorar posibles interacciones ligando-receptor entre células monocito-macrófago con diferentes puntuaciones relacionadas con el ERS. Para este análisis, las células monocito-macrófago se etiquetaron como de alta o baja según la mediana de la puntuación compuesta, mientras que otras células conservaron sus etiquetas originales de tipo celular. La matriz de expresión de ARN normalizada y las correspondientes anotaciones de grupos celulares se utilizaron para crear el objeto CellChat. Para el análisis de comunicación célula-célula, se seleccionó la base de datos humana CellChatDB, y solo se evaluaron las interacciones de señalización secretadas. Se detectaron genes sobreexpresados y pares ligando-receptor antes de calcular las probabilidades de comunicación. Los grupos celulares que contenían menos de 10 células fueron excluidos del análisis de interacción. Posteriormente se estimaron y agregaron probabilidades de comunicación a nivel de vía para comparar el número y la intensidad de las interacciones entre poblaciones celulares. Para facilitar la reproducibilidad, a continuación se proporciona una tabla de puntos de control que enlaza cada paso del protocolo con su correspondiente cifra o tabla de salida esperada (Archivo Suplementario 1—Tabla Suplementaria S2).

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Resultados

Identificación de genes expresados diferencialmente en la FA
Para mejorar la comparabilidad entre cohortes, se integraron dos conjuntos de datos transcriptómicos relacionados con la FA (GSE41177 y GSE79768), y se corrigieron los efectos en lote en la matriz de expresión fusionada. La Figura 2A,B muestra diagramas de cajas de distribuciones globales de expresión antes y después de la corrección por efecto de lotes, que se ...

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Discusión

Este estudio integró transcriptomas de célula única y a granel para investigar el papel del ERS en la FA. Se derivó una firma génica relacionada con ERS con discriminación favorable entre cohortes cruzadas, y estas señales se mapearon predominantemente a la línea monocito-macrófago y se asociaron con una comunicación intercelular extensa. En conjunto, los hallazgos sugieren que los programas asociados al ERS están acoplados a la remodelación centrada en células inmunitarias en la FA. En ...

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Divulgaciones

Los autores no reportan conflictos de interés en esta obra. Durante la revisión de este manuscrito, ChatGPT de OpenAI se utilizó únicamente para ayudar con el pulido en inglés. Los autores revisaron, verificaron y editaron todo el texto asistido por IA y asumen toda la responsabilidad de la exactitud e integridad del manuscrito final. No se utilizaron herramientas asistidas por IA para generar ideas de investigación, realizar análisis de datos, interpretar resultados, crear figuras o tablas, o sacar conclusiones científicas. El trabajo reportado en el artículo ha sido realizado por los autores. F.T., PR. W: Redacción: borrador original, software, metodología, visualización, validación y curación de datos. SY. T: Investigación y metodología. FF. B: Supervisión. QR. L: Supervisión, Metodología, Conservación de datos. XY. J, YX. X: Recuperación de literatura e interpretación de datos.

Materiales

Lista de materiales utilizados en este artículo
NombreEmpresaNúmero de catálogoComentarios
AddModuleScorefunción Seuratversión 4.4.0NA
AUCellBioconductorversión 1.32.0RRID:SCR_021327
caretCRANversión 7.0.1RRID:SCR_022524
celda / decontXBioconductorversión 1.24.0NA
CellChatGitHub / CellChatversión 2.2.0RRID:SCR_021946
CIBERSORT / LM22 signature matrixCIBERSORTLM22NA
clusterProfilerBioconductorversión 4.12.6RRID:SCR_016884
CytoscapeConsorcio Cytoscapeversión 3.10RRID:SCR_003032
DoubletFinderGitHub / McGinnis Labversión 2.0.4NA
e1071CRANversión 1.7.16NA
gbmCRANversión 2.2.2NA
Gene Expression Omnibus (GEO) databaseNational Center for Biotechnology Information (NCBI)GSE41177NA
Gene Expression Omnibus (GEO) databaseNCBIGSE79768NA
Gene Expression Omnibus (GEO) databaseNCBIGSE115574NA
Gene Expression Omnibus (GEO) databaseNCBIGSE14975NA
Gene Expression Omnibus (GEO) databaseNCBIGSE165838NA
glmnetCRANversión 4.1.8NA
HarmonyCRANversión 1.2.4NA
limmaBioconductorversión 3.60.6RRID:SCR_010943
MASSCRANversión 7.3.61NA
mboostCRANversión 2.9.11NA
MonocleBioconductorversión 2.38.0RRID:SCR_016339
org.Hs.eg.dbBioconductorversión 3.19.1NA
plsRglmCRANversión 1.5.1NA
pROCCRANversión 1.18.5RRID:SCR_024286
R statistical softwareR Foundation for Statistical Computingversión 4.4.2RRID:SCR_001905
randomForestCRANversión 4.7.1.2RRID:SCR_015718
RStudioPosit Software, PBCversión 2024.4.1.748RRID:SCR_000432
SeuratCRAN / Satija Labversión 4.4.0RRID:SCR_016341
shapvizCRANversión 0.10.2NA
svaBioconductorversión 3.52.0NA
WGCNACRANversión 1.73RRID:SCR_003302
xgboostCRANversión 1.7.8.1NA

Referencias

  1. Saleh K, Haldar S. Atrial fibrillation: a contemporary update. Clin Med (Lond). 2023;23(5):437-41.
  2. Lemme M, et al. Atrial-like engineered heart tissue: an in vitro model of the human atrium. Stem Cell Reports. 2018;11(6):1378-90.
  3. van Gorp PRR, Trines SA, Pijnappels DA, de Vries AAF. Multicellular in vitro models of cardiac arrhythmias: focus on atrial fibrillation. Front Cardiovasc Med. 2020;7:43.
  4. Scherr D, et al. Five-year outcome of catheter ablation of persistent atrial fibrillation using termination of atrial fibrillation as a procedural endpoint. Circ Arrhythm Electrophysiol. 2015;8(1):18-24.
  5. Staerk L, et al. Atrial fibrillation: epidemiology, pathophysiology, and clinical outcomes. Circ Res. 2017;120(9):1501-17.
  6. Schotten U, Verheule S, Kirchhof P, Goette A. Pathophysiological mechanisms of atrial fibrillation: a translational appraisal. Physiol Rev. 2011;91(1):265-325.
  7. Van Wagoner DR, Chung MK. Inflammation, inflammasome activation, and atrial fibrillation. Circulation. 2018;138(20):2243-6.
  8. Yuan M, et al. IP3R1/GRP75/VDAC1 complex mediates endoplasmic reticulum stress-mitochondrial oxidative stress in diabetic atrial remodeling. Redox Biol. 2022;52:102289.
  9. Wang M, Kaufman RJ. Protein misfolding in the endoplasmic reticulum as a conduit to human disease. Nature. 2016;529(7586):326-35.
  10. Ritchie ME, et al. limma powers differential expression analyses for RNA-sequencing and microarray studies. Nucleic Acids Res. 2015;43(7):e47.
  11. Langfelder P, Horvath S. WGCNA: an R package for weighted correlation network analysis. BMC Bioinformatics. 2008;9:559.
  12. Hu H, et al. Dissection of metabolome and transcriptome: insights into capsaicin and flavonoid accumulation in two typical Yunnan Xiaomila fruits. Int J Mol Sci. 2024;25(14):7761.
  13. Chen GY, et al. Integrating network pharmacology and experimental validation to explore the key mechanism of Gubitong Recipe in the treatment of osteoarthritis. Comput Math Methods Med. 2022;2022:7858925.
  14. Chen GY, et al. Prediction of Rhizoma Drynariae targets in the treatment of osteoarthritis based on network pharmacology and experimental verification. Evid Based Complement Alternat Med. 2021;2021:5233462.
  15. Díaz-Uriarte R, Alvarez de Andrés S. Gene selection and classification of microarray data using random forest. BMC Bioinformatics. 2006;7:3.
  16. Saeys Y, Inza I, Larrañaga P. A review of feature selection techniques in bioinformatics. Bioinformatics. 2007;23(19):2507-17.
  17. Statnikov A, Wang L, Aliferis CF. A comprehensive comparison of random forests and support vector machines for microarray-based cancer classification. BMC Bioinformatics. 2008;9:319.
  18. Liu H, et al. Unraveling diethyl phthalate-induced prostate carcinogenesis: core targets revealed by integrated network toxicology, machine learning, and structural validation. Hum Genomics. 2025;19(1):149.
  19. Subramanian A, et al. Gene set enrichment analysis: a knowledge-based approach for interpreting genome-wide expression profiles. Proc Natl Acad Sci U S A. 2005;102(43):15545-50.
  20. Newman AM, et al. Robust enumeration of cell subsets from tissue expression profiles. Nat Methods. 2015;12(5):453-7.
  21. Xu H, et al. Single-cell transcriptomics reveals CCL3+ classical monocyte subset linked to autoimmune pathogenesis. J Inflamm Res. 2025;18:16273-91.
  22. Wang Y, et al. Immunological profiling of rheumatoid factor-positive primary Sjögren’s syndrome by single-cell RNA sequencing. Front Immunol. 2026;17:1822615.
  23. Wiersma M, et al. Endoplasmic reticulum stress is associated with autophagy and cardiomyocyte remodeling in experimental and human atrial fibrillation. J Am Heart Assoc. 2017;6(10):e006458.
  24. Hu HJ, et al. Hydrogen sulfide ameliorates angiotensin II-induced atrial fibrosis progression to atrial fibrillation through inhibition of the Warburg effect and endoplasmic reticulum stress. Front Pharmacol. 2021;12:690371.
  25. Liu Y, et al. Integrative transcriptomic, proteomic, and machine learning approach to identifying feature genes of atrial fibrillation using atrial samples from patients with valvular heart disease. BMC Cardiovasc Disord. 2021;21(1):52.
  26. Fu S, et al. Using integrative bioinformatics approaches and machine-learning strategies to identify potential signatures for atrial fibrillation. Int J Cardiol Heart Vasc. 2025;56:101592.
  27. Wu S, et al. Multiplex proteomics identifies inflammation-related plasma biomarkers for aging and cardio-metabolic disorders. Clin Proteomics. 2024;21(1):30.
  28. Xie Z, et al. Identification and verification of biomarkers and immune infiltration in obesity-related atrial fibrillation. Biology (Basel). 2023;12(1):121.
  29. Huo TM, Wang ZW. Comprehensive analysis to identify key genes involved in advanced atherosclerosis. Dis Markers. 2021;2021:4026604.
  30. Chen M, et al. Weighted gene co-expression network analysis identifies crucial genes mediating progression of carotid plaque. Front Physiol. 2021;12:601952.
  31. Wang S, et al. S100A8/A9 in inflammation. Front Immunol. 2018;9:1298.
  32. Wang Q, et al. Myeloid-specific S100A8/A9 deficiency attenuates atrial fibrillation through prevention of TLR4/NF-κB-mediated immune cell recruitment and inflammation. Front Immunol. 2025;16:1623486.
  33. Wu CL, Yin R, Wang SN, Ying R. A review of CXCL1 in cardiac fibrosis. Front Cardiovasc Med. 2021;8:674498.
  34. Zhang YF, et al. CXCR4 and TYROBP mediate the development of atrial fibrillation via inflammation. J Cell Mol Med. 2022;26(12):3557-67.
  35. Hulsmans M, et al. Recruited macrophages elicit atrial fibrillation. Science. 2023;381(6654):231-9.
  36. van der Net JB, et al. Arachidonate 5-lipoxygenase-activating protein gene and coronary heart disease risk in familial hypercholesterolemia. Atherosclerosis. 2009;203(2):472-8.
  37. Ye X, et al. ALOX5AP predicts poor prognosis by enhancing M2 macrophage polarization and immunosuppression in serous ovarian cancer microenvironment. Front Oncol. 2021;11:675104.
  38. Song P, Deng H, Liu Y, Zhang M. Integrated bioinformatics analysis and experimental validation reveal the relationship between ALOX5AP and the prognosis and immune microenvironment in glioma. BMC Med Genomics. 2024;17(1):218.
  39. Chen S, Tang L, Guillot A, Liu H. Bariatric surgery associates with nonalcoholic steatohepatitis/hepatocellular carcinoma amelioration via SPP1 suppression. Metabolites. 2023;13(1):11.
  40. Ji H, et al. Integrated genomic, transcriptomic, and epigenetic analyses identify a leukotriene synthesis-related M2 macrophage gene signature that predicts prognosis and treatment vulnerability in gliomas. Front Immunol. 2022;13:970702.
  41. Sirish P, et al. The critical roles of proteostasis and endoplasmic reticulum stress in atrial fibrillation. Front Physiol. 2021;12:793171.
  42. Sun Z, et al. Cross-talk between macrophages and atrial myocytes in atrial fibrillation. Basic Res Cardiol. 2016;111(6):63.
  43. Schall TJ, Proudfoot AEI. Overcoming hurdles in developing successful drugs targeting chemokine receptors. Nat Rev Immunol. 2011;11(5):355-63.

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Reimpresiones y permisos

Etiquetas

MedicinaNúmero 234Número 234Valor vacíoNúmeroAnálisis de célula únicaAnálisis SHAP