Artículo de investigación

Conjunto de ponderación temporal, inferencia causal y atribución jerárquica hacia la optimización de SHAP

DOI:

10.3791/69125

18 de noviembre de 2025

En este artículo

Resumen

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Este artículo pretende evaluar el impacto de la ponderación temporal, la inferencia causal y la atribución jerárquica en la optimización de la interpretabilidad.

Resumen

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

En los últimos años, la necesidad de transparencia e interpretabilidad se ha intensificado debido a los avances significativos en modelos basados en datos, lo que ha llevado a la aparición de la Inteligencia Artificial Explicable (XAI). Existen varios enfoques tradicionales de XAI; sin embargo, estos tienen competencia limitada en la interpretación de relaciones dinámicas. La investigación actual pretende abordar esta limitación proponiendo un nuevo marco de Ensemble SHapley Additive ExPlanations (SHAP) que se centra en la ponderación temporal, la inferencia causal, la atribución jerárquica y la optimización de la interpretabilidad, conocido como TCHSHAP. TCHSHAP prioriza la información actual sobre la histórica mediante ponderación temporal a través de la decaimiento exponencial. Además, la inferencia causal separa la correlación de la causalidad para obtener conocimientos prácticos. Además, la atribución jerárquica permite obtener conocimientos a nivel granular (a nivel regional) y agregado (impactos en grupos de características). Estos enfoques se integran para lograr un modelo más interpretable y explicable. Para validar la eficacia del modelo propuesto, realizamos un experimento con el conjunto de datos de rendimiento de cultivos recogido de Kaggle. Antes de la evaluación experimental, el preprocesamiento de datos se realiza mediante codificación one-hot. La normalización de datos se realiza mediante escalado min-max, y los valores atípicos se eliminan a través del rango Intercuartiles. Para fines de evaluación experimental, los autores utilizaron el modelo SHAP XAI para Random Forest. Al evaluar la eficacia del modelo TCHSHAP propuesto, se observa que, aunque la predicción media para el SHAP tradicional es de 161,137, esta escala a 161,506 tras incorporar ponderación temporal e inferencia causal, defendiendo la eficacia de emplear significación temporal y causal. Además, durante la atribución jerárquica, se observa que las características agrícolas tienen la mayor dominancia sobre la variable objetivo. A este dominio le siguen factores geográficos y ambientales. Así, los resultados obtenidos autorizan la eficacia del enfoque propuesto para mejorar la interpretabilidad global y local, fortaleciendo la confianza del usuario en las predicciones del modelo. El trabajo actual ofrece formas de mejorar la transparencia y la interpretabilidad sin afectar al rendimiento del modelo. El modelo sugerido también permite un modelado de regresión interpretable y eficiente en aplicaciones complejas basadas en datos, facilitando su aplicación generalizada en entornos reales.

Introducción

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

La regresión desempeña un papel fundamental en la analítica predictiva, abarcando varios ámbitos como la modelización climática, la previsión financiera, el diagnóstico sanitario y la estimación del rendimientoagrícola 1,2. Sin embargo, los resultados inexplicables de los modelos de regresión, especialmente los modelos no lineales y de alta capacidad como las Máquinas de Aumento de Gradiente (GBM), los Bosques Aleatorios y las Redes Neuronales Profundas (DNNs), plantean desafíos significativos, especialmente para aplicaciones que requieren transparencia e información accionable. Esta brecha de interpretabilidad puede salvarse empleando la Inteligencia Artificial Explicable (XAI), una técnica que aún está en pañales. Actualmente, los frameworks XAI convencionales como SHAP y Local Interpretable Model Agnostic Explanation (LIME) solo ofrecen explicaciones estáticasde características 3. Estas técnicas XAI actualmente no explican las complejidades de las tareas de regresión que involucran dependencias temporales, estructuras jerárquicas de características y causalidades, creando una vía de investigación 4,5. Debido a la falta de consideración de estos factores, XAI puede a veces derivar conclusiones incorrectas. Por ejemplo, el SHAP tradicional solo considera la correlación de atributos con la variable objetivo sin considerar la causalidad. Consideremos un conjunto de datos con dos características binarias de entrada, a saber, el consumo de tabaco y los dientes teñidos. La variable objetivo en este conjunto de datos es la probabilidad de cáncer. En tal escenario, si se obtiene correlación entre las características de entrada y la variable objetivo, el cáncer estará altamente correlacionado con ambas características (consumo de tabaco y dientes manchados). Ahora bien, es bastante engañoso concluir que los dientes manchados causan cáncer, ya que se produce por el consumo regular de tabaco. Por tanto, se puede resumir que, a pesar de los avances significativos en el dominio de XAI, los principales problemas que deben abordarse en contextos de regresión incluyen:

La incapacidad para considerar dependencias temporales solo conduce a explicaciones estáticas que pueden no funcionar en contextos con datos dinámicos.

La no inclusión de inferencias causales en las adaptaciones tradicionales de SHAP provoca correlaciones falsas en lugar de valiosas ideas causales.

La falta de atención a la interpretación jerárquica conduce a explicaciones agregadas de nivel superior insuficientes.

Para abordar estos problemas, el trabajo de investigación actual pretende proponer un nuevo marco XAI, TCHSHAP, que abarque ponderación temporal, inferencia causal y atribución jerárquica, con el objetivo de mejorar la interpretabilidad y eficiencia computacional de los modelos XAI actuales. Para ello, el marco propuesto considera un factor de ponderación temporal wt que asigna pesos mayores a la contribución reciente de las características en comparación con valores pasados. Este factor de ponderación pretende asegurar que la interpretabilidad se alinee con la importancia temporal de características cruciales en problemas de regresión dinámica, como la previsión de rendimientos y la predicción de ventas. Además, los modelos tradicionales de regresión no presentan relaciones causales, lo que conduce a atribucionesambiguas 6. Para abordar este desafío, el marco propuesto adopta Modelos Causales Estructurales (SCM) para evaluar el impacto causal de una característica Fi en la salida. Además, los conjuntos de datos en tiempo real a menudo muestran relaciones jerárquicas (espaciales o categóricas) entre características, que rara vez se muestran en los marcos XAI existentes 4,5,6. Por el contrario, el marco XAI sugerido agrega características individuales (Fi) para obtener características de nivel superior (Hj), logrando la granularidad de las explicaciones.

Además de incorporar significados temporales, causales y jerárquicos, el conjunto propuesto también busca mejorar la interpretabilidad y la explicabilidad. Dicho objetivo es un esfuerzo por establecer el equilibrio entre interpretabilidad y precisión, asegurando que las explicaciones obtenidas de TCHSHAP sean precisas einterpretables 4. El marco XAI sugerido puede describirse matemáticamente de la siguiente manera, mientras que la descripción de las variables utilizadas se da en la Tabla 1. El valor tradicional de SHAP para la característica se calcula como la ecuación (1)5,6.

figure-introduction-1(1)

Esta formulación tradicional de SHAP suma las contribuciones sin considerar ajustes temporales, causales o jerárquicos.

VariableDefinición
FiCaracterística cuyo valor de Shap se está calculando
ShapiValor de Shap de la Característica
SConjunto de características totales
MSubconjunto de todas las características
FTNúmero total de características
P(M)Predicción del modelo cuando solo se usan características en M
λ > 0Tasa de decaimiento
TTiempo de predicción de referencia
YSalida

Tabla 1: Descripción de las variables utilizadas. Esta tabla describe la importancia de las distintas variables utilizadas.

Esta formulación tradicional de SHAP se modifica para manejar dependencias dinámicas incluyendo ponderación temporal. Esta ponderación temporal se incorpora introduciendo el coeficiente de ponderación wt = e-λ |t - t| donde λ representa el factor de decaimiento (λ > 0). Como se ha comentado antes, esta ponderación exponencial da más peso a los valores recientes en comparación con valores pasados. Esta decadencia exponencial se incluye con la comprensión de que los valores recientes de las características tienen mayor significación que los valores pasados. El valor modificado de SHAP (tras incorporar la significación temporal) se da en la ecuación (2).

figure-introduction-2(2)

Esta información temporal es importante para tareas de regresión dinámica como predecir rendimientos o acciones.

Además, para hacer las explicaciones más sólidas, se aplica la SCM para evaluar el impacto causal de la característica Fi en la salida Y. La formulación matemática para SHAP causal se da en la ecuación (3)

figure-introduction-3(3)

Aquí do(F i) representa la característica que ha contribuido al cambio. Al usar esto, el modelo alcanza la competencia para explicar la causalidad en lugar de la correlación. Cabe destacar que el cálculo basado en SCM de efectos causales garantiza que solo se reconozcan características con influencia causal directa, eliminando falsas correlaciones.

Además, la jerarquía se propone en el modelo sugerido para agregar atributos en varios niveles. La formulación matemática para el SHAP jerárquico se da en la ecuación (4).

figure-introduction-4(4)

La incorporación de la jerarquía en el modelo sugerido garantiza la obtención de la granularidad de las explicaciones. El marco sugerido se muestra en la Figura 1.

figure-introduction-5
Figura 1: Ilustración pictórica de varios elementos del marco propuesto. Esta figura ofrece una ilustración pictórica de varios elementos del marco propuesto TCHSHAP que incluyen ponderación temporal, inferencia causal y atribución jerárquica. Por favor, haz clic aquí para ver una versión ampliada de esta figura.

La novedad del modelo propuesto TCHSHAP radica en manejar estas tres inconsistencias empleando ponderación temporal (para dar más peso a la información actual), Modelos Causales Estructurales (SCM; para evaluar efectos causales) y agregación jerárquica de valores SHAP (para obtener conocimientos multinivel). Así, el conjunto propuesto amplía SHAP más allá de sus limitaciones estáticas, proporcionando un marco explicativo optimizado para regresión.

El TCHSHAP propuesto tiene el potencial de alcanzar gran importancia para aplicaciones en tiempo real en escenarios que requieren una mejor toma de decisiones, ya que identifica las explicaciones detalladas de la salida en los modelos de regresión, conectando de forma fluida la modelización con la toma de decisiones. En resumen, la principal contribución de este manuscrito es diseñar un marco novedoso que combina ponderación temporal, inferencia causal y relaciones jerárquicas para mejorar las explicaciones accionables del modelo tradicional SHAP.

Trabajo relacionado

XAI incorpora diferentes metodologías especialmente diseñadas para mejorar la transparencia e interpretabilidad de distintos modelos de aprendizaje automático. Estas estrategias XAI establecen confianza en los resultados proporcionando los conocimientos necesarios a partir de los mismos. Por ejemplo, metodologías XAI destacadas como LIME y SHAP mejoran la interpretabilidad y transparencia de modelos de caja negra en diversos ámbitos, concretamente finanzas, educación y el sectorsanitario 7. Además, las técnicas XAI se aplican en tareas relacionadas con el análisis de software, la detección de clones y la predicción de defectos Just-in-Time8. Además, Awal y Roy también destacaron las discrepancias y demostraron menor fiabilidad en la generación de lasexplicaciones 8. Aquí, los autores aplicaron Métricas de Evaluación a Nivel Granular para reducir la consistencia en la evaluación. XAI también se ha utilizado ampliamente en el ámbito médico para comprender los factores más destacados que afectan a los resultados de la tarea de clasificación y, por tanto, fomentar la confianza entre los profesionales sanitarios en el uso de diagnósticos basados enIA 9,10,11,12. Además, en sectores como la predicción de alquileres residenciales belgas, los enfoques XAI facilitan la interpretación de modelos complejos, mejorando así el control de calidad y minimizando los erroresde producción. Bommer et al. demostraron que la integración de los métodos XAI con gradientes mejora el rendimiento de los métodos XAI en términos de robustez, fidelidad, complejidad y aleatorización en la ciencia climática14. Muchos investigadores han intentado crear técnicas de ensamble e híbridas. Además de proponer técnicas de conjunto, los investigadores también demostraron la eficacia de estas técnicas híbridas para proporcionar una visión integral de modeloscomplejos 15,16. Una revisión detallada de las técnicas, optimizaciones y diversas aplicaciones se tabula en la Tabla 2, lo que indica claramente que las técnicas más aplicadas son LIME y SHAP. La dirección futura de la investigación apunta a explorar la optimización en estos métodos para mejorar la interpretabilidad de estos modelos. Continuando con la línea de investigación, los autores en trabajos actuales se centran en la optimización de SHAP añadiendo inferencia causal, atribución jerárquica y ponderación temporal.

CitaTécnicas XAIOptimizaciónIdeasAplicacionesDirectrices de investigación futuras
(Anushree et al., 2024)LIMANo proporcionadoMejora de la interpretabilidad y transparencia de modelos de caja negra en diversas aplicaciones en el sector de finanzas, educación y sanidad.· Compromiso entre precisión e interpretabilidad en los sectores de finanzas, educación y sanidad· Es necesario desarrollar una lista de métricas detalladas para evaluar varios modelos XAI
SHAP
Mecanismos de perturbación
Mecanismos basados en la atención
(Awal & Roy, 2024)PyExplainerMétricas de evaluación a nivel granular para reducir la consistencia en la evaluación.Resalta las discrepancias y demuestra menor fiabilidad a la hora de generar las explicaciones.· Tareas relacionadas con el análisis de software· Se requieren métodos avanzados de investigación para mejorar la fiabilidad de los modelos XAI en tareas relacionadas con la analítica de software
LIMA· Detección de clones
· Predicción de defectos justo a tiempo
(Bommer et al., 2024)Gradientes integradosIntegración de métodos XAI con gradientesLa integración de los métodos XAI con gradientes mejora el rendimiento en términos de robustez, fidelidad, complejidad y aleatorización en la ciencia climática.· Predicción de la ciencia del clima· Céntrate en la evaluación específica de la ciencia climática.
Propagación de relevancia por capa· Predicción anual de mapas de temperatura media
Gradientes de tiempo de entrada
métodos de sensibilidad como gradiente, SmoothGrad, NoiseGrad y FusionGrad
(Bhatnagar & Agrawal, 2024)LIMAConjunto de Técnicas XAIEnsemble ofrece una visión completa y mejora la interpretabilidad y explicabilidad de modelos complejos.· Aplicado en el conjunto de datos Moral para mejorar la interpretabilidad de los resultados· Explora métodos híbridos XAI combinando múltiples técnicas
SHAP· Personalización de varios algoritmos XAI para modelos específicos que se adapten a diferentes necesidades de los usuarios
(Dias, 2024)LIMAIntegración de las técnicas XAIMejorada de la interpretabilidad y precisión· Clasificación de comentarios tóxicos· Mejorar la resistencia con fines de clasificación.
Explícamelo como si tuviera 5 años
(Hajare et al., 2024)SHAPNo proporcionadoSHAP ofrece información detallada sobre los factores de riesgo en la predicción del Síndrome Coronario Agudo.· Síndrome Coronario Agudo (SCA)· Para descubrir los factores de riesgo novedosos en la predicción de la SCA.
(Hamida et al., 2024)Revisión exhaustiva de diversas técnicas XAINo proporcionadoOfrece información sobre las aplicaciones XAI en el sector sanitario, subrayando la importancia de la explicabilidad de las decisiones de IA para comprender los resultados que ofrece la IA.· Perspectivas accionables en el sector sanitario· Mejora de los componentes XAI, a saber, comprensibilidad, transparencia, interpretabilidad y explicabilidad.
· Técnicas XAI personalizadas para el sector sanitario para obtener información detallada en el ámbito sanitario
(Ihongbe et al., 2024)Grad-CAM (Mapeo de Activación de Clases ponderado por gradiente)Mapeo de activación de clases ponderado por gradienteMejor precisión para el diagnóstico de neumonía y COVID-19.· Mejora de la precisión para el diagnóstico médicoAumentar la conciencia sobre la usabilidad de las técnicas XAI para aplicaciones reales
(Lenaers, & De Moor, 2023).6 Técnicas XAIConjunto de 6 técnicas XAI en el modelo CatBoostMúltiples técnicas mejoran la interpretabilidad de XAI para la predicción de alquileres.· Predicción de alquileres residenciales en BélgicaXAI puede utilizarse para la toma de decisiones
(Makumbura et al., 2024)SHAPConjunto de RF, LightGBM, XGBoost con SHAPSHAP revela los diversos factores responsables de evaluar y predecir la calidad del agua.· Evaluación y predicción de la calidad del aguaPuede emplearse para la toma de decisiones
(Schlegel & Keim, 2023).Técnicas XAI con análisis de perturbacionesAnálisis de perturbacionesPuede emplearse eficazmente para tareas de clasificación de datos de series temporales· Datos de series temporales de Finanzas, Sanidad, Ciencia del ClimaCombinar múltiples técnicas XAI para mejorar la interpretabilidad.
(Silva & Keller, 2023)XAINo proporcionadoLos modelos XAI tienen una limitación para explicar los resultados en caso de características correlacionadas. Puede emplearse en ciencias de la Tierra y atmosféricas.· Ciencias atmosféricasXAI debe optimizarse para características correlacionadas y evitar explicaciones erróneas.
Velocidad de reacción biomolecular· Química atmosférica
(Y, S., & Challa, M. 2023)SHAPNo proporcionadoAquí, los modelos XAI se comparan en cuanto a interpretabilidad y comprensión de características importantes, y concluyen que SHAP y LIME son los más efectivos.· Aplicaciones médicasMejorar la interpretabilidad para aplicaciones médicas avanzadas
LIMA
PDP
GAM

Tabla 2: Revisión exhaustiva de diversas optimizaciones realizadas en técnicas XAI. Esta tabla presenta una revisión exhaustiva de las diferentes técnicas de optimización sugeridas por diversos investigadores.

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Protocolo

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

NOTA: Esta sección analiza el método de conjunto propuesto, incluyendo todas las enmiendas propuestas como se ilustra en la Figura 1.

Preparación de datos

Para validar la eficacia del marco propuesto, los autores realizaron un experimento con el conjunto de datos de rendimiento de cultivos recogido de Kaggle17. Este conjunto de datos consiste en datos agrícolas indios de varios cultivos desde 1997 hasta 2020 y fue consultado en marzo de 2025. Este conjunto de datos comprende numerosas características, como la temporada, crop_year, fertilizante, pesticida, cultivo y rendimiento (variable objetivo), etc. El conjunto de datos considerado se preprocesa para mejorar la eficiencia utilizando la codificación one-hot para manejar valores categóricos. Las características categóricas como estación, cultivo y estado están codificadas en un solo hot. La escalada MinMax también se emplea para escalar características numéricas como área, producción, annual_rainfall, fertilizante y pesticida al rango [0,1]. Para manejar los valores atípicos, utilizamos la regla del rango intercuartílico con un umbralQ 1 - 1,5 • IQR17. Se aplicó una semilla aleatoria de 42 en todos los pasos de preprocesamiento para obtener la reproducibilidad de los resultados. Además, el conjunto de datos se dividió en un conjunto de datos de entrenamiento (80%) y uno de prueba (20%) tras el preprocesamiento.

Montaje experimental

El experimento se llevó a cabo usando Python 3.10 en un servidor GPU A100 con CPU: Dual AMD Rome 7742, 128 núcleos, 1TB de RAM. Las bibliotecas importadas para simulación son scikit-learn 1.3.0, XGBoost 1.7.6, TensorFlow 2.13, SHAP 0.41.0, LIME 0.2.0.1 y ELI5 0.13.0.

Evaluación de modelos de aprendizaje automático

Aquí, los autores han utilizado varios modelos de regresión, concretamente LinearRegression(), Ridge(alpha=1,random_state=42), Lasso(alpha=0,1,randomstate = 42), Decision TreeRegressor(max_depth = 10, random_state = 42), RandomForestRegressor(max_depth = 15random_state = 42), GradientBoostingRegressor(n_estimators = 200, learning_rate = 0,1, random_state = 42), XGBoost y CNN para determinar el impacto de varias variables en la variable objetivo obtiene18. XGBoost utiliza 300 estimadores y una tasa de aprendizaje de 0,05. En el modelo CNN, se utilizan dos capas ocultas, activaciones ReLU y optimizador Adam con una tasa de aprendizaje de 0,001. La eficiencia de estos modelos se compara utilizando diferentes métricas de rendimiento. Estos modelos también realizan ajustes de hiperparámetros. Por ejemplo, la regresión de cresta y la regresión de lazo se entrenan con alfa igual a 1,0 y alfa igual a 0,1, respectivamente. En el Árbol de Decisión y el Bosque Aleatorio, la profundidad máxima se estableció en 10 y 15, respectivamente. El gradient Boosting utiliza 200 estimadores y una tasa de aprendizaje de 0,1. El rendimiento de estos modelos se evaluó mediante una validación cruzada de 5 veces en términos de Error Cuadrático Medio (MSE) y R2 al cuadrado.

Evaluación de modelos XAI

Como se ha comentado, el trabajo actual utiliza varios modelos XAI para comparar los resultados. Aquí, los autores usan shap. TreeExplainer(model,data = crop_yield) para modelos basados en árboles (Random Forest, Gradient Boosting y XGBoost). Se eligió un conjunto de datos de fondo con 100 casos seleccionados aleatoriamente del conjunto de datos de entrenamiento para estabilizar las atribuciones. Además, Shap. KernelExplainer() se utilizó para modelos no arborícoles (Lineal, Ridge, Lazo y CNN) con 1000 perturbaciones para acercarse a los valores SHAP. Explicador tabular (lime.lime_tabular. LimeTabularExplainer) se utilizó con 5000 perturbaciones por instancia para ejecutar LIME en el mismo conjunto de datos de fondo y asegurar que las explicaciones locales sean estables. El ancho del núcleo se estableció en función de las características, y se utilizó la función de predicción del modelo para inferir explicaciones. Las explicaciones locales se generaban llamando a explainer.explain_instance(x,model.predict). ELI5 se utilizó como importancia de permutación con 10 repeticiones en la división de validación para evitar el sobreajuste de los datos de la prueba, y se simuló usando eli5.sklearn.PermutationImportance(estimator,random_state = 42). Durante el experimento se demostró la importancia de la media y la varianza entre repeticiones. Finalmente, el modelo ajustado se utilizó para la división de validación para obtener Parcelas de Dependencia Parcial (PDPs), que se implementaron usando PartialDependencyDisplay.from_estimator (modelo,X_val,características = [característica]),

Configuración del marco TCHSHAP

Posteriormente, TCHSHAP se implementó aplicando varios pasos en secuencia. El primer paso en la secuencia fue la ponderación temporal que utiliza una función de decaimiento exponencial con una tasa de decaimiento de λ = 0,85, seleccionada en base a un estudio de ablación en λ figure-protocol-1 [0,7.0.95]. El tiempo de referencia (T_current) se seleccionó como el año de cultivo más reciente en el conjunto de datos. Esto garantiza que las explicaciones del modelo tengan en cuenta la dinámica de la previsión de producción agrícola, donde las características recientes (precipitaciones, uso de fertilizantes o pesticidas) tienen mayor importancia a la hora de tomar decisiones. La ponderación temporal fue seguida por la MCS para adoptar inferencias causales. La metodología sugerida utiliza el operador punto para simular intervenciones y calcular el Efecto Causal Medio. La inferencia causal se aplicó usando la biblioteca python doWhy 0.13. Esto ayuda a eliminar conexiones engañosas debido a insumos correlacionados como la producción y el área, logrando vínculos reales de causa y efecto. El paso final en la cadena fue la atribución jerárquica, donde las características se organizaban en dominios de nivel superior. Para el conjunto de datos actual, existen 3 características jerárquicas: insumos agrícolas (fertilizantes, pesticidas), factores geográficos (Estado, área, Crop_Year) y factores medioambientales (Annual_Rainfall, temporada). Mediante el uso de la suma normalizada para agrupar los datos SHAP, se pueden obtener explicaciones en ambos niveles (detalladas y generales).

En resumen, la pipeline TCHSHAP combina tres pasos: ajuste temporal, atribución causal y agrupación jerárquica en un solo proceso. Aquí, el SHAP de referencia hace primero explicaciones, seguido de la adición de tres mejoras. Esta tubería estructurada garantiza que los resultados de TCHSHAP sean consistentes, puedan reproducirse y proporcionen explicaciones tanto locales como globales. La descripción paso a paso del marco propuesto se presenta en el pseudocódigo que aparece a continuación.

Entrada:
X: Conjunto de datos con característicasX 1,X 2,X 3,........,X n.
T: Variable temporal en el conjunto de datos
T corriente: Tiempo de referencia
λ: Tasa de decaimiento
G: Grupos de Características
Calcular pesos temporales
Para cada instancia, ifigure-protocol-2 X, evalúa wt = e-λ|t-T|,
Calcular los valores Shapi
Calcular Shap Tempral = Shapi *w t
Calcular la inferencia causal
Para cada Característica, Xi figure-protocol-3 X
Calcular ShapCausal = Shapi * Efecto Causal(X j →Y)
Atribución jerárquica
Para cada Característica, Xi figure-protocol-4 X
Calcular los valores Shapi
Para cada Gi figure-protocol-5 G
figure-protocol-6

Salida: Conjunto de valores SHAP agregados jerárquicamente

El punto de control cuantitativo para facilitar la resolución de problemas se muestra a continuación: Random Forest que produce el MSE más bajo y el mayor R2 en todos los modelos de ML. La importancia destacada obtenida fue Área > Pesticidas > Fertilizantes, con la temporada y la Crop_Year como mínimas. La predicción global de referencia de SHAP fue de 161,137. Además, tras aplicar λ = 0,85, la contribución de Crop_year y Estación aumenta. Las contribuciones a nivel de grupo siguen el orden Insumos Agrícolas>Factores Geográficos> Factores Ambientales.

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Resultados

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Esta sección analiza los resultados obtenidos aplicando diversos métodos utilizados durante el estudio experimental, que comprende varias subsecciones de la siguiente manera:

Recogida y preprocesamiento de datos

Para realizar una evaluación experimental del marco propuesto, se recopiló un conjunto de datos sobre el ren...

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Discusión

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

El objetivo principal del estudio actual es incorporar ponderación temporal, inferencia causal y significado jerárquico en el modelo SHAP tradicional, dando lugar al modelo TCHSHAP. El motivo de incluir estos componentes en las técnicas XAI es mejorar la interpretabilidad de los resultados. Para la ponderación temporal, hemos considerado una técnica de decaimiento exponencial, que da más peso a los valores recientes en comparación con valores antiguos. En cuanto a la significancia causal...

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Divulgaciones

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Los autores declaran que no existen conflictos de interés.

Agradecimientos

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Este trabajo está financiado por fondos nacionales a través de FCT – Fundação para a Ciência e a Tecnologia, I.P., bajo el Contrato de Programa UID/05105/2025.

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Materiales

Lista de materiales utilizados en este artículo
NombreEmpresaNúmero de catálogoComentarios
ELI50.13.0PyPI
LIMA0.2.0.1PyPI
Servidor GPU Nvidia DGX A100CPU Dual AMD Rome 7742, 128 núcleos en totalNvidia
Memoria del sistema 1TB
Pitón3.1Pitón
SHAP0.41.0PyPI
scikit-learn1.3.0PyPI
TensorFlow2.13Flujo tensorial
XGBoost1.7.6PyPI

Referencias

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,
  1. Kaur, B., et al. N-Beats architecture for explainable forecasting of multi-dimensional poultry data. PloS One. 20 (4), e0320979(2025).
  2. Sharma, N., Mangla, M., Iqbal, M. M., Mohanty, S. N. Deep Learning Framework for Identification of Skin Lesions. EAI Endorsed Trans Perv Health Tech. 9, (2023).
  3. Sharma, N., Mohanty, S. N., Mahato, S., Pattanaik, C. R. A novel dataset and local interpretable model-agnostic explanations (LIME) for monkeypox prediction. Intell Decision Technol. 17 (4), 1297-1308 (2023).
  4. Makumbura, R. K., et al. Advancing Water Quality Assessment and Prediction Using Machine Learning Models, Coupled with Explainable Artificial Intelligence (XAI) Techniques Like Shapley Additive Explanations (SHAP) For Interpreting the Black-Box Nature. Results Eng. 23, 102831(2024).
  5. Schlegel, U., Keim, D. A. A Deep Dive into Perturbations as Evaluation Technique for Time Series XAI. Communic Comp Informat Sci. 1903, (2023).
  6. Silva, S. J., Keller, C. A. Limitations of XAI methods for process-level understanding in the atmospheric sciences. Artificial Intell Earth Syst. 3 (1), e230045(2024).
  7. Anushree, G., Madagaonkar, S. B., Ravili, C. H. Unveiling the Black Box: A Comprehensive Review of Explainable AI Techniques. Int J Sci Res Eng Manag. 8 (9), 1-11 (2024).
  8. Awal, M. A., Roy, C. K. EvaluateXAI: A framework to evaluate the reliability and consistency of rule-based XAI techniques for software analytics tasks. J Syst Software. 217, 112159(2024).
  9. Hajare, S. W., Rewatkar, R., Reddy, K. Design of an iterative method for enhanced early prediction of acute coronary syndrome using XAI analysis. AIMS Bioeng. 11 (3), 301-322 (2024).
  10. Hamida, S. U., Chowdhury, M. J. M., Chakraborty, N. R., Biswas, K., Sami, S. K. Exploring the landscape of explainable artificial intelligence (XAI): A systematic review of techniques and applications. Big Data Cognit Comput. 8 (11), 149(2024).
  11. Ihongbe, I. E., Fouad, S. F., Mahmoud, T., Rajasekaran, A., Bhatia, B. Evaluating Explainable Artificial Intelligence (XAI) techniques in chest radiology imaging through a human-centered Lens. PloS One. 19 (10), e0308758(2024).
  12. A Comparative Analysis of Explainable AI Techniques for Enhanced Model Interpretability. Swathi, Y., Challa, M. 3rd Int Conf Pervasive Comput Social Netw, , 229-234 (2023).
  13. Lenaers, I., De Moor, L. Exploring XAI techniques for enhancing model transparency and interpretability in real estate rent prediction: a comparative study. Finance Res Lett. 58 (Part A), 104306(2023).
  14. Bommer, P. L., Kretschmer, M., Hedström, A. K., Bareeva, D., Höhne, M. Finding the right XAI Method - A Guide for the Evaluation and Ranking of Explainable AI Methods in Climate Science. Artif Intell Earth Syst. 3, e230074(2024).
  15. Bhatnagar, S., Agrawal, R. Understanding explainable artificial intelligence techniques: a comparative analysis for practical application. Bullet Elect Eng Info. 13 (6), 4451-4455 (2024).
  16. Ennab, M., Mcheick, H. Enhancing interpretability and accuracy of AI models in healthcare: a comprehensive review on challenges and future directions. Front Robot AI. 11, 1444763(2024).
  17. Wan, X., Wang, W., Liu, J., Tong, T. Estimating the sample mean and standard deviation from the sample size, median, range and/or interquartile range. BMC Med Res Methodol. 14 (1), 135(2014).
  18. Mangla, M., Shinde, S. K., Mehta, V., Sharma, N., Mohanty, S. N. Handbook of Research on Machine Learning: Foundations and Applications. , CRC Press. (2022).
  19. Gupta, A. Agricultural Crop Yield in Indian States Dataset [Data set]. , Kaggle. https://www.kaggle.com/datasets/akshatgupta7/crop-yield-in-indian-states-dataset (2025).
  20. Shin, J., Miah, A. S. M., Konnai, S., Hoshitaka, S., Kim, P. Electromyography-Based Gesture Recognition with Explainable AI (XAI): Hierarchical Feature Extraction for Enhanced Spatial-Temporal Dynamics. IEEE Access. 13, 88930-88951 (2025).
  21. Das, A., Rad, P. Opportunities and challenges in explainable artificial intelligence (xai): A survey. arXiv. , (2020).
  22. Srinivasu, P. N., Sandhya, N., Jhaveri, R. H., Raut, R. From blackbox to explainable AI in healthcare: existing tools and case studies. Mobile Info Syst. 2022 (1), 8167821(2022).
  23. Fiok, K., Farahani, F. V., Karwowski, W., Ahram, T. Explainable artificial intelligence for education and training. J Defense Model Simulat. 19 (2), 133-144 (2022).

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Reimpresiones y permisos

Solicitar permiso para reutilizar el texto o las figuras de este artículo de JoVE

Solicitar permiso

Etiquetas

IA explicableinterpretabilidad del modeloatribuci n de caracter sticasRandom Forestmodelado de regresi nnormalizaci n de datos

Artículos relacionados