Este estudio retrospectivo fue revisado y aprobado por el Comité de Ética Médica del Hospital Baoquanling del Grupo Beidahuang el 9 de mayo de 2025 (Aprobación nº BQH-BDHG-EC-2025-056), y se renunció al consentimiento informado. El estudio se realizó de acuerdo con la Declaración de Helsinki y la política de gestión de privacidad de datos del hospital, y toda la información personal identificable fue desidentificada antes del análisis. Las herramientas de investigación utilizadas en este estudio se enumeran en la Tabla de Materiales.
1. Diseño del estudio
Se trató de un estudio retrospectivo transversal de un solo centro realizado en el Departamento de Endocrinología y Metabolismo del Hospital Baoquanling del Grupo Beidahuang, que incluyó a 126 pacientes elegibles con diabetes tipo 2 que acudieron al hospital entre el 1 de enero de 2022 y el 31 de diciembre de 2024. La fecha de la visita ambulatoria o del ingreso hospitalario se definió como la fecha índice, y los resultados de las pruebas de laboratorio obtenidos en esa fecha se utilizaron como línea base. Las mediciones de exposición y resultados se obtuvieron en el mismo momento o dentro de 7 días antes o después de la fecha del índice. Todos los datos se derivaron de registros médicos históricos sin ninguna intervención.
El informe fue elaborado de acuerdo con la declaración Strengthening the Reporting of Observational Studies in Epidemiology (STROBE)11 para estudios transversales, y se especificaron la pregunta de investigación, variables, métodos estadísticos y estrategias de análisis de sensibilidad, con resultados presentados según el plan preespecificado.
2. Población de estudio
La población del estudio fue evaluada consecutivamente desde el sistema de historiales médicos electrónicos según los criterios preespecificados de inclusión y exclusión. Los criterios de inclusión fueron entre los 18 y 80 años, un diagnóstico documentado de diabetes tipo 2 en el historial médico, resultados disponibles para glucosa plasmática en ayunas, insulina en ayunas, hs-CRP, albúmina urinaria, creatinina urinaria y creatinina sérica dentro de 7 días antes o después de la fecha índice, eGFR ≥ 60 mL/min/1,73m2 (ERC-EPI 2021), una muestra de orina recién recogida procesada según el procedimiento estándar de pruebas. y datos clínicos completos y covariables clave o una proporción faltante que cumpliera con los criterios de manejo predefinidos.
Los criterios de exclusión incluyeron evidencia de inflamación o infección aguda, hs-CRP > 10 mg/L, infección urinaria, hematuria o piuria, embarazo o lactancia, antecedentes claros de enfermedad renal no diabética o evidencia por imagen de enfermedad renal estructural, UACR ≥ 300 mg/g, terapia sistémica con glucocorticoides en los 3 meses anteriores, eventos cardiovasculares o cerebrovasculares agudos o cirugía mayor en los 3 meses anteriores. y malignidad que recibe quimioterapia o inmunoterapia.
Tras la exclusión de los registros que no cumplían los criterios, se obtuvo la muestra final. Bajo una α bilateral = 0,05 y una potencia del 80%, el tamaño final de la muestra de 126 en este estudio correspondió a un coeficiente de correlación absoluta detectable de aproximadamente 0,25. Esta afirmación era solo una descripción post hoc del rango de efectos detectables y no constituía una estimación a priori del tamaño de la muestra. Los análisis que involucraron cálculos de HOMA-IR se restringieron a participantes que no recibían terapia con insulina exógena, y el tamaño de la muestra de este subgrupo se informó según lo observado.
3. Fuentes de datos y procedimientos de recopilación
Según un diccionario de datos unificado, los investigadores extrajeron información demográfica (edad, sexo), duración de la diabetes, altura, peso, estado de tabaquismo, consumo de alcohol, presión arterial sistólica (SBP) y presión arterial diastólica (DBP) (la segunda lectura tras dos mediciones en la fecha del índice), registros de comorbilidades e información sobre medicación de los registros médicos electrónicos.
Las variables de medicación incluían inhibidores del sistema renina-angiotensina (RASi), inhibidores del cotransportador sodio-glucosa 2 (SGLT2i), agonistas del receptor del péptido-1 similar al glucagón (GLP-1RA) y estatinas; Uso continuo durante ≥ 3 meses antes de que se registrara la fecha del índice como "uso". La duración de la diabetes se definió como el número de años transcurridos desde el diagnóstico hasta la fecha índice. El índice de masa corporal (IMC) se calculó como peso (kg)/altura2 (m2).
Las pruebas en laboratorio se realizaban sobre una plataforma unificada y estaban sujetas a control interno de calidad y evaluación externa de calidad. la hs-CRP se midió mediante inmunoturbidimetría de alta sensibilidad, con un límite de detección de ≤ 0,1 mg/L; FINS se medía mediante quimioluminiscencia con calibración dentro del lote usando calibradores; La FPG se medía mediante el método de la hexoquinasa; la hemoglobina glicada (HbA1c) se midió mediante cromatografía líquida de alto efecto; la alpómina en la orina se midió mediante inmunoturbidimetría, la creatinina en la orina mediante el método enzimático y la proporción se expresó en mg/g; La creatinina sérica se midió mediante el método enzimático con calibración trazable por IDMS.
Todas las muestras se analizaron en un plazo de 2 horas tras la recogida o tras un almacenamiento a corto plazo a 4 °C. Si había varios resultados disponibles para la misma visita, se priorizaban los resultados obtenidos el mismo día que la fecha del índice.
4. Definiciones y medición de variables
Las variables de exposición incluyeron hs-CRP y HOMA-IR. Hs-CRP se expresó en mg/L, se introdujo en los análisis primarios como una variable continua y se categorizó en tertiles muestrales para análisis de tendencias. FINS se expresó en μU/mL, FPG en mmol/L, y la fórmula de cálculo para HOMA-IR fue lasiguiente 6:
HOMA - IR = (FINS FPG)/22,5
Los análisis que involucraron HOMA-IR se restringieron a participantes que no usaban insulina exógena y que presentaran resultados de FPG y FINS el mismo día. En este subgrupo, HOMA-IR y hs-CRP se introdujeron juntos en el modelo multivariable. El UACR se calculó utilizando albúmina urinaria y creatinina en orina medidas en la misma muestra y se expresó como mg/g 12. La creatinina en orina se armonizó en gramos para el cálculo de la razón cuando fue necesario. En este conjunto de datos, ningún valor de UACR era cero. Para valores de albúmina en orina por debajo del límite inferior de detección (<2,0 mg/L), el laboratorio informó del resultado como <2,0 mg/L, y estos valores por debajo de la detección se reemplazaron por la mitad del límite inferior de detección (1,0 mg/L) antes del análisis de datos. Para reducir la influencia de la asimetría derecha, se aplicó una transformación natural logarítmica y se utilizó LN(UACR) como resultado principal.
Si había múltiples pruebas de orina disponibles para el mismo participante dentro de 7 días antes o después de la fecha índice, solo se retenía la muestra más cercana a la fecha índice, etiquetada como orina matutina o orina de primera orina. Si solo se disponía de una muestra aleatoria de orina, se registraba el tipo de muestra y los análisis de sensibilidad se restringían al subconjunto de orina matutina. La microalbuminuria se definió como UACR ≥ 30 mg/g y se utilizó como resultado sustituto binario en la regresión logística.
El eGFR se calculó utilizando la ecuación13 de la creatinina CKD-EPI 2021. Cuando se informó creatinina sérica en μmol/L, se convirtió en mg/dL (μmol/L ÷ 88,4) antes del cálculo. La eGFR se expresó como mL/min/1,73m2 y se utilizó como resultado secundario continuo en análisis de sensibilidad. Se examinó la consistencia de los resultados en el subgrupo eGFR 60–89 mL/min/1,73m2 . El modelo principal estaba preespecificado para ajustar por edad, sexo, duración de la diabetes, SBP y HbA1c, y los modelos de sensibilidad incluían además IMC, estado de tabaquismo, consumo de alcohol, uso de RASi, uso de SGLT2i, uso de GLP-1RA y uso de estatinas.
5. Gestión de datos y preprocesamiento
Tras la desidentificación, los datos se exportaron como conjunto de datos analíticos, y en la Tabla Suplementaria 1 se proporcionó un breve diccionario de datos que resumía nombres de variables, definiciones, unidades y reglas de codificación para las variables analíticas. Los registros duplicados se fusionaban por fecha de índice y se comprobaban variables clave para comprobar la consistencia lógica.
Cuando tanto las marcas de tiempo EMR como LIS estaban disponibles, el tiempo de recogida de la muestra LIS se utilizaba como la marca de tiempo principal para la alineación temporal; si no estaba disponible, se utilizaba el informe LIS/tiempo de verificación, mientras que la fecha de la visita del EMR se usaba solo para definir la fecha del índice. Cuando había múltiples resultados elegibles disponibles dentro del periodo preestablecido, se conservaba el resultado más cercano a la fecha del índice; Si dos resultados estaban igual de cerca, se priorizaba el resultado del mismo día, seleccionando las muestras de orina según la regla preestablecida del tipo de muestra.
Los valores faltantes se manejaron según la estrategia jerárquica predefinida: si la proporción faltante de cualquier covariable individual era ≤ 10%, los análisis primarios usaron un enfoque de caso completo; Si superaba el 10%, se realizaba imputación múltiple mediante ecuaciones encadenadas con 20 imputaciones, incluyendo el modelo de imputación las exposiciones, el resultado y todas las covariables, y los resultados imputados se comparaban con los resultados del caso completo.
Los participantes con HS-CRP > 10 mg/L o evidencia de inflamación aguda fueron excluidos de los análisis primarios. Se evaluaron variables continuas para su distribución utilizando la prueba de Shapiro-Wilk y los gráficos Q-Q, y el UACR fue transformado logarítmicamente natural. Si hs-CRP o HOMA-IR mostraron asimetría marcada, se realizaron transformaciones de rango o logarítmic en los análisis de sensibilidad. Las variables categóricas se codificaban como variables binarias u ordinales según reglas predefinidas. Las observaciones influyentes se identificaron por los residuos estudiantizados absolutos > 3 o la distancia de Cook > 4/n, y los modelos primarios se repitieron tras excluir estas observaciones en los análisis de sensibilidad.
Los análisis preespecificados de subgrupos incluían subgrupos sexuales y subgrupos basados en HbA1c < 7% y ≥ 7%. Los análisis de sensibilidad preespecificados incluyeron restricción a muestras de orina matutina, adición de variables de medicación a los modelos primarios, exclusión de observaciones influyentes, uso de errores estándar robustos en lugar de errores estándar convencionales y restricción a participantes con eGFR 60–89 mL/min/1,73m2.
6. Análisis estadístico
Todos los análisis estadísticos se realizaron en la versión 4.3.2 de R. Se evaluaron variables continuas para su distribución utilizando la prueba de Shapiro-Wilk y los gráficos Q-Q. Los datos normalmente distribuidos se expresaron como media ± desviación estándar, los datos no normalmente distribuidos como mediana (rango intercuartílico) y las variables categóricas como frecuencia y porcentaje.
Las características de la línea base se describieron según si se alcanzó el umbral de microalbuminuria, y se realizaron comparaciones entre grupos utilizando la prueba t de muestras independientes, la prueba U de Mann-Whitney, la prueba del qui-cuadrado o la prueba exacta de Fisher, según el tipo y distribución de la variable. Se realizó un análisis de correlación de rango Spearman entre ln-UACR y hs-CRP y entre ln-UACR y HOMA-IR, y se calcularon coeficientes de correlación y sus intervalos de confianza del 95%, estimando intervalos de confianza mediante la transformación z de Fisher. Los gráficos de correlación se presentaron como diagramas de dispersión superpuestos con líneas ajustadas a regresión ponderada localmente para mostrar la tendencia.
Se construyeron modelos de regresión lineal multivariable con LN-UACR como variable dependiente. En el subgrupo que no utilizó insulina exógena, se introdujeron hs-CRP y HOMA-IR en el modelo, con ajuste por edad, sexo, duración de la diabetes, SBP y HbA1c; en la muestra general, se instaló un modelo separado que incluía solo HS-CRP para examinar la correlación global. Se reportaron coeficientes de regresión estandarizados, intervalos de confianza del 95% y valores p, y se reportó el cambio en el coeficiente de determinación antes y después de la inclusión de las variables de exposición. La colinealidad se evaluó utilizando factores de inflación de la varianza, con un umbral de 5.
Después de que hs-CRP y HOMA-IR se categorizaran en tertiles muestrales, definidos por los percentiles empíricos 33,3 y 66,7 de la muestra analítica correspondiente (hs-CRP: la muestra global para análisis generales y el subgrupo no insulinico para análisis subgrupales/conjuntos; HOMA-IR: solo el subgrupo no insulino), con T1 ≤ corte inferior, T2 > corte inferior para ≤ el corte superior, y T3 > corte superior, se introdujo el valor mediano de cada tertil como variable continua para comprobar la tendencia lineal, y se reportaron las medias marginales ajustadas de ln-UACR entre tertiles y el valor p para la tendencia.
En el análisis exploratorio, se definieron los altos hs-CRP y altos HOMA-IR mediante los cortes del tertil superior, derivados del subgrupo no insulinico para el análisis articular 2 × 2, y se construyó un agrupamiento 2 × 2 para comparar las medias marginales ajustadas de ln-UACR entre grupos. Se añadió un término de interacción para probar la interacción estadística, y se reportó la diferencia media ajustada entre los grupos "alto × alto" y "bajo × bajo"; este análisis no se interpretó de forma causal.
Para el análisis de resultados sustitutos, se construyó una regresión logística multivariable alcanzando el umbral de microalbuminuria como variable dependiente, y se informaron la razón de probabilidades y el intervalo de confianza del 95% correspondiente a cada aumento de 1 desviación estándar en hs-CRP o HOMA-IR.
Se construyó una regresión lineal multivariable con la eGFR como variable dependiente para examinar la dirección de la asociación entre las exposiciones y la tasa de filtración glomerular.
Los análisis de sensibilidad incluyeron la restricción a muestras de orina matutinas, ajustes adicionales por IMC, estado de tabaquismo, consumo de alcohol y las cuatro categorías de medicamentos en los modelos primarios, exclusión de observaciones influyentes, uso de errores estándar robustos de Huber-White y repetición de los modelos primarios en la población restringida con UACR < 300 mg/g y eGFR ≥ 60 mL/min/1,73m2. El diagnóstico del modelo utilizó gráficos residual versus ajustados, gráficos Q-Q y la prueba de Shapiro-Wilk para evaluar la normalidad y linealidad residuales, y la prueba de Breusch-Pagan para evaluar la homocedasticidad. Si había heteroscedasticidad, se reportaron errores estándar robustos; Si se encontró una clara no linealidad, se utilizaron variables indicadoras de tertiles en lugar de variables continuas en los análisis de sensibilidad.
Se realizaron análisis de correlación y regresión utilizando el paquete estadístico, se evaluó la colinealidad usando el paquete de coches, se obtuvieron errores estándar robustos usando los paquetes sandwich y lmtest, se realizaron imputaciones múltiples usando el paquete de ratones y se generaron cifras usando el paquete ggplot2. Todas las pruebas fueron bilaterales, el umbral de significación se estableció en α = 0,05 y se reportaron intervalos de confianza del 95%.