$$\rightleftharpoonup{xx}$$
$$\longleftharp{xx}$$,
$$\longrightharp{xx}$$,
Esta sección describe la cadena completa de aprendizaje profundo con constrenciones físicas para la evaluación de condiciones térmicas utilizando imágenes termográficas infrarrojas. El marco integra (i) extracción de campos por temperatura, (ii) regresión CNN de línea base, (iii) regularización física basada en difusión, (iv) aprendizaje adaptativo de parámetros y (v) cuantificación de incertidumbre. Todas las herramientas utilizadas en este estudio se describen en la Tabla de Materiales.
Adquisición de imagen térmica y construcción de campos de temperatura
Se adquirieron imágenes infrarrojas (IR) de equipos de alta tensión utilizando una cámara termográfica calibrada. Cada imagen se convertía en una matriz de temperatura espacial T(x, y) ∈R H×W mapeando las intensidades de píxeles a valores físicos de temperatura (°C) mediante parámetros de calibración radiométrica de la cámara. La figura 1A–C muestra la visualización de la temperatura. La imagen IR original se convierte en un mapa de temperatura físicamente significativo. El histograma muestra una distribución de temperatura sesgada con una concentración entre 50 y 90 °C. Las zonas localizadas de alta temperatura (puntos calientes) son claramente visibles. La Figura 2 muestra una representación 3D de elevación térmica de la superficie del campo de temperatura. El gráfico de elevación de la superficie en 3D revela pendientes pronunciadas alrededor de las regiones de puntos calientes. Los picos de temperatura se acercan a los ~120 °C. El campo térmico es espacialmente suave, excepto cerca de conductores y juntas de conexión que están encendidas. Estas características justifican el uso de un término de regularización basada en difusión para reforzar la suavidad física mientras se preservan fenómenos localizados de alto gradiente.

Figura 1: Visualización de temperatura. (A) Imagen termográfica original infrarroja (IR) del equipo de alta tensión inspeccionado mostrando el patrón térmico observado. (B) Mapa de temperatura extraído obtenido de la imagen termográfica, que ilustra la distribución espacial de las temperaturas superficiales y los gradientes térmicos asociados. (C) Histograma de distribución de temperatura que muestra la distribución de frecuencia de los valores de temperatura dentro del campo de temperatura extraído. Esta figura demuestra la conversión de una imagen termográfica en una representación cuantitativa de la temperatura y resume la distribución subyacente de temperatura utilizada para el desarrollo y análisis del modelo posterior. Abreviaturas; IR = infrarrojo. Por favor, haz clic aquí para ver una versión ampliada de esta figura.

Figura 2: Representación 3D térmica de elevación de la superficie del campo de temperatura. Visualización tridimensional de la distribución de temperatura, donde la elevación de la superficie corresponde a la magnitud de la temperatura y resalta puntos calientes térmicos localizados. Por favor, haz clic aquí para ver una versión ampliada de esta figura.
Formulación del problema
Sea

denotan la imagen termográfica infrarroja RGB, donde H y W representan las dimensiones espaciales y C = 3 corresponde a los canales de color asociados a la paleta térmica arcoíris. Aunque la imagen infrarroja representa visualmente información térmica, no es una matriz numérica directa de temperatura porque los colores mostrados dependen del mapeo de paletas, el escalado, la interpolación y las condiciones de imagen.
Sea

denotar el campo de temperatura de precisión en tierra correspondiente obtenido mediante calibración radiométrica y extracción de temperatura del sistema de imagen infrarroja.
El objetivo de aprendizaje es aproximar el mapeo

donde θ denota los parámetros entrenables del CNN y T̂ representa el campo de temperatura previsto. El propósito de este mapeo supervisado no es simplemente reproducir la conversión radiométrica directa, sino aprender un modelo de regresión de temperatura espacialmente consistente a partir de imágenes termográficas renderizadas. A diferencia de la extracción directa color a temperatura píxel por píxel, la CNN puede aprovechar la estructura térmica contextual en regiones vecinas, reducir la sensibilidad al ruido, preservar las características de los puntos calientes y generar campos de temperatura físicamente plausibles más suaves bajo las restricciones de difusión impuestas. La función objetivo de referencia minimiza el error de regresión píxel a píxel entre los campos de temperatura predichos y calibrados:

donde Tij y T̂ij denotan la verdad de base y las temperaturas predichas en la ubicación del píxel (i, j), respectivamente. Por tanto, el marco debe interpretarse como un modelo de regresión termográfica regularizado en física en lugar de un reemplazo de la calibración radiométrica directa.
Condiciones de adquisición de imagen infrarroja
Las imágenes termográficas infrarrojas se adquirieron utilizando una cámara térmica FLIR bajo condiciones de funcionamiento exterior de la subestación. El conjunto de datos consistía en imágenes termográficas RGB con una resolución espacial de 640 × 480 píxeles, registradas usando la paleta de colores FLIR rainbow. Cada imagen incluía una barra de escala térmica incrustada que indicaba el rango de temperatura asociado al fotograma de adquisición. La inspección termográfica abarcó múltiples categorías de equipos de alta tensión, incluyendo transformadores, bujes, aisladores, conectores y estructuras de terminales. Las imágenes se capturaron durante condiciones normales de funcionamiento para incluir tanto el comportamiento térmico estándar como patrones localizados de puntos calientes relevantes para aplicaciones de monitorización de condiciones. La adquisición de imágenes se realizó desde puntos de vista prácticos de inspección que se utilizan típicamente en la termografía de campo. La orientación de la cámara y el ángulo de visión variaban según el equipamiento, accesibilidad y la disposición de la subestación. Las imágenes térmicas se filtraron visualmente para asegurar que el equipo objetivo permaneciera claramente observable y que las regiones de puntos calientes fueran distinguibles del fondo. El conjunto de datos se organizó en carpetas etiquetadas según la categoría del equipo y la condición térmica. Antes del desarrollo del modelo, las imágenes se segmentaron y redimensionaron en un formato espacial consistente para la extracción de campos de temperatura y el entrenamiento CNN. Las imágenes termográficas contienen distribuciones térmicas adecuadas para estudios de visión por ordenador y aprendizaje profundo que involucran detección de puntos calientes, identificación de fallas, localización de anomalías y predicción de campo de temperatura. En el trabajo actual, los perfiles térmicos extraídos de las imágenes infrarrojas se utilizaron para estimar temperaturas con constrenciones físicas y evaluar térmicas conscientes de la incertidumbre.
Conjunto de datos termográficos y partición de datos
El conjunto de datos utilizado en este estudio consistió en 174 imágenes termográficas infrarrojas obtenidas de equipos de subestación de alta tensión utilizando un sistema de imagen térmicaFLIR 15. El conjunto de datos incluía múltiples tipos de componentes del sistema eléctrico, como transformadores, casquillos, aisladores, conectores y estructuras terminales de alta tensión que operan en condiciones prácticas al aire libre. Cada imagen termográfica se convertía en un campo de temperatura espacial utilizando la información radiométrica proporcionada por la cámara infrarroja. El conjunto de datos contiene variaciones térmicas que van desde condiciones normales de funcionamiento hasta regiones localizadas de puntos calientes asociadas con un estrés térmico elevado. Los datos se dividieron en subconjuntos de entrenamiento, validación y prueba con una división 70:15:15, que arrojó 121, 26 y 27 imágenes, respectivamente. La partición se realizó a nivel de imagen porque el conjunto de datos consistía en escenas termográficas capturadas de forma independiente y recogidas bajo condiciones y puntos de vista variables. Se tuvo cuidado para evitar tramas casi duplicadas entre subconjuntos para reducir el riesgo de fuga de datos y mejorar la equidad de la evaluación. Todas las imágenes se redimensionaron a una resolución espacial uniforme antes del entrenamiento. Se aplicó la normalización de temperatura para estabilizar la optimización, preservando los gradientes térmicos relativos y las características de los puntos calientes importantes para la evaluación de la condición.
Arquitectura CNN base
Se adoptó una arquitectura de regresión codificador-decodificador totalmente convolucional para preservar la resolución espacial durante la predicción temperatura-campo a partir de imágenes termográficas infrarrojas. Todas las imágenes infrarrojas de entrada se redimensionaron a una resolución uniforme de 256 × 256 × 3 antes del entrenamiento. La sección del codificador constaba de cuatro bloques convolucionales con profundidad de características que aumentaba progresivamente. Cada bloque contenía una capa de convolución 3 × 3 seguida de normalización por lotes y activación ReLU. El muestreo espacial se realizó mediante convoluciones strided en lugar de max pooling para preservar mejor las estructuras térmicas localizadas y la información de puntos calientes. La progresión del canal del codificador fue:
32 → 64 → 128 → 256
La sección del decodificador reconstruyó el campo de temperatura espacial usando capas de convolución transpuestas para el muestreo ascendente con la progresión inversa de características:
256 → 128 → 64 → 32
Cada bloque decodificador empleaba de forma similar convolución transpuesta, normalización por lotes y activación de ReLU. Una capa final de convolución 1 × 1 generó el mapa de temperatura de canal único previsto:
T̂ ∈ R256×256
Por tanto, la red emite un campo de temperatura espacial de resolución completa correspondiente a la imagen de entrada infrarroja. Para apoyar la cuantificación de incertidumbre, se insertaron capas de dropout con probabilidad p = 0,2 cerca de las etapas de cuello de botella y decodificador. Durante la inferencia, el dropout permaneció activo para permitir el muestreo de Monte Carlo para la estimación predictiva de la incertidumbre. Todos los pesos convolucionales se inicializaron usando inicialización He-normal, mientras que los términos de sesgo se inicializaron a cero. El modelo fue entrenado usando el optimizador Adam con una tasa de aprendizaje inicial de 1 × 10−3, tamaño de lote de 8 y decaimiento de peso de 1 × 10−5. El entrenamiento se realizó durante 100 épocas utilizando la decadencia de la tasa de aprendizaje del coseno y la parada temprana basada en la RMSE de validación.
La función objetivo base se define como:

donde los datos L denotan el error cuadrático medio píxel por píxel entre los campos de temperatura predichos y los de verdad en el suelo.
El rendimiento se evaluó utilizando: R2, RMSE y MAE.
Aunque la CNN base capturó con éxito la estructura térmica general y la distribución de puntos calientes, ocasionalmente produjo artefactos no físicos en regiones de bajo gradiente y un ligero sobresuavizado cerca de límites térmicos nítidos. Estas limitaciones motivaron la introducción de la regularización de la física basada en difusión en la formulación posterior del modelo.
Aprendizaje limitado por la física mediante difusión
Ecuación de calor que rige
Para asegurar la consistencia térmica en el campo de temperatura previsto, se incorporó un prior de física basada en difusión en la ecuación del calor. Bajo condiciones cuasi-estacionarias, la temperatura superficial satisface aproximadamente

donde T denota temperatura, α es la difusividad térmica y S representa la generación local de calor. Dado que las muestras termográficas disponibles son instantáneas de inspección individuales en lugar de secuencias resueltas en el tiempo, la derivada temporal no puede evaluarse directamente. En consecuencia, el modelo asume una conducción local cuasi-estacionaria y impone

alejándose de zonas de calefacción activa.
El Laplaciano 2D se discretizó usando la plantilla estándar de diferencias finitas:

El residual físico se calculó entonces sobre el mapa de temperatura previsto como

Para evitar ambigüedades en los límites de la imagen, el residuo laplaciano se evaluó solo en píxeles interiores válidos, donde todos los valores vecinos requeridos por la plantilla están disponibles. No se aplicó enmascaramiento explícito a las regiones de puntos calientes, ya que el objetivo del término físico era regularizar todo el campo espacial en lugar de suprimir zonas térmicamente activas. Por tanto, la estructura de los puntos calientes se aprendió a través del término de datos, mientras que la penalización laplaciana fomentaba una suavidad consistente en la difusión a lo largo del mapa predicho.
La función objetivo final combinaba la pérdida de datos y la pérdida física como

donde λphys controla la intensidad de la regularización física. En el estudio de ablación, se examinó λ phys ∈ {0, 10−4, 10−3, 10−2, 10−1} para evaluar el efecto del aumento de la resistencia física a las constrenciones. Valores moderados mejoraron la generalización, mientras que un ponderado excesivamente fuerte tendió a gradientes de punto caliente demasiado suaves y abruptos. Este comportamiento es coherente con las estructuras térmicas observadas en las imágenes infrarrojas, donde las regiones físicamente lisas coexisten con concentraciones localizadas de alta temperatura.
Cabe destacar que la formulación de difusión en estado estacionario utilizada en este trabajo no pretende representar el mecanismo completo de transferencia de calor que rige la formación de puntos calientes en equipos de alta tensión. En la práctica, el sobrecalentamiento localizado surge de procesos internos de generación de calor como el calentamiento de julios, la resistencia de contacto y la degradación del aislamiento. Dado que el conjunto de datos disponible consiste en imágenes termográficas instantáneas sin información temporal ni mediciones de fuente, la restricción de difusión se emplea como un término de regularización espacial inspirado en la física. Su función es fomentar campos de temperatura localmente suaves y físicamente plausibles, permitiendo que las características del punto caliente se aprendan a partir de los datos. Por lo tanto, la difusión previa debe interpretarse como una restricción de suavidad espacial en lugar de un modelo completo de la física térmica subyacente.
Difusividad térmica aprendible y aumento por términos fuente
Para mejorar la interpretabilidad física, la difusividad térmica efectiva se trató como un parámetro escalar entrenól. Sea T̂(x, y) el campo de temperatura previsto y α > 0 la difusividad térmica aprendible. Para reforzar la positividad, α se parametrizó mediante una variable sin restricciones β como

En esta formulación, el prior físico se escribió en términos de un campo de forzamiento residual efectivo R(x, y), donde R(x, y) representa la desviación local de la difusión pura inducida por efectos de calentamiento no modelados. Por tanto, la relación adaptativo-difusividad se expresa como

Aquí, ∇2T̂(x, y) es el laplaciano del campo de temperatura predicho, y R(x, y) es el término fuente residual efectiva inferido implícitamente a partir de los datos termográficos. Dado que las muestras disponibles son imágenes instantáneas en lugar de secuencias térmicas resueltas en el tiempo, R(x, y) no está supervisada por separado y solo sirve como una magnitud física latente durante la optimización. La pérdida física correspondiente se definió como

Para el experimento aumentado por término fuente, se añadió un cabezal CNN auxiliar para estimar un mapa fuente espacial Ŝ(x, y). En este caso, Ŝ(x, y) representa el campo local de generación de calor previsto, y la relación de gobierno se convierte en

La cabeza fuente estaba acoplada al cuello de botella del codificador y consistía en una pequeña rama convolucional que mapeaba características latentes compartidas a un mapa de salida de canal único Ŝ(x, y). No existían etiquetas de origen fiables; por lo tanto, Ŝ(x, y) solo se aprendía a través del objetivo conjunto

donde Ldatos es la pérdida por regresión de temperatura, λphys controla la restricción de difusión y λs regulariza la predicción de la fuente para desincentivar mapas de fuente triviales de alta magnitud. En el contexto basado en instantáneas considerado aquí, la formulación del término fuente permaneció subdeterminada y no mejoró la precisión de la predicción.
Abandono de Monte Carlo para cuantificación de incertidumbre
Para estimar la incertidumbre epistémica en el campo de temperatura previsto, se aplicó el dropout de Monte Carlo durante la inferencia. Las capas de dropout con una tasa de 0,2 se colocaban después del bloque de cuello de botella y dentro de las etapas del decodificador del CNN. Durante las pruebas, estas capas de dropout se mantuvieron activas y se realizaron 30 pasadas estocásticas hacia adelante para cada imagen infrarroja. Para el k-ésimo paso estocástico, el campo de temperatura previsto se denota por

donde X es la imagen infrarroja de entrada y θk representa los parámetros de red muestreados inducidos por el dropout. La media predictiva se calculó como

y la varianza predictiva píxel a píxel se obtuvo como

con K = 30. El mapa de varianza resultante se utilizó para identificar regiones espaciales con menor confianza predictiva. Como no existen etiquetas de incertidumbre basadas en la realidad para la regresión termográfica, la incertidumbre se evaluó utilizando mapas de varianza píxel por píxel y estadísticas resumidas calculadas sobre regiones de punto caliente y de fondo, en lugar de métricas basadas en calibración. El análisis cuantitativo mostró que la desviación estándar predictiva media era de 13,046 °C, mientras que la región de los puntos calientes mostró una desviación estándar mayor de 15,934 °C en comparación con 12,743 °C en la región de fondo. Esto corresponde a un aumento de aproximadamente un 25% en la incertidumbre dentro de las zonas calientes en relación con el fondo. Estos resultados indican que el modelo expresa una mayor incertidumbre cerca de regiones térmicamente complejas, especialmente en torno a los límites de los puntos calientes y los gradientes de temperatura pronunciados, lo cual es coherente con la estructura observada en las visualizaciones de la superficie térmica. El flujo de trabajo se resume en las Figuras 3 y 4 que muestran la cadena general de procesamiento basada en CNN.

Figura 3: Flujo de trabajo. Visión general de la metodología propuesta, incluyendo adquisición de imágenes termográficas, preprocesamiento, extracción de campo de temperatura, entrenamiento CNN, aprendizaje con restricciones físicas y cuantificación de incertidumbre. Abreviaturas; CNN = red neuronal convolucional. Por favor, haz clic aquí para ver una versión ampliada de esta figura.

Figura 4: Pipeline global de procesamiento basado en CNN. Arquitectura del marco CNN propuesto que muestra la transformación de imágenes termográficas infrarrojas en predicciones espaciales de campo de temperatura. Abreviaturas; CNN = red neuronal convolucional. Por favor, haz clic aquí para ver una versión ampliada de esta figura.