Se requiere una suscripción a JoVE para ver este contenido. Inicie sesión o comience su prueba gratuita.

Artículo de investigación

Conjunto de ponderación temporal, inferencia causal y atribución jerárquica hacia la optimización de SHAP

498 vistas

DOI:

10.3791/69125

18 de noviembre de 2025

En este artículo

Resumen

Este artículo pretende evaluar el impacto de la ponderación temporal, la inferencia causal y la atribución jerárquica en la optimización de la interpretabilidad.

Resumen

En los últimos años, la necesidad de transparencia e interpretabilidad se ha intensificado debido a los avances significativos en modelos basados en datos, lo que ha llevado a la aparición de la Inteligencia Artificial Explicable (XAI). Existen varios enfoques tradicionales de XAI; sin embargo, estos tienen competencia limitada en la interpretación de relaciones dinámicas. La investigación actual pretende abordar esta limitación proponiendo un nuevo marco de Ensemble SHapley Additive ExPlanations (SHAP) que se centra en la ponderación temporal, la inferencia causal, la atribución jerárquica y la optimización de la interpretabilidad, conocido como TCHSHAP. TCHSHAP prioriza la información actual sobre la histórica mediante ponderación temporal a través de la decaimiento exponencial. Además, la inferencia causal separa la correlación de la causalidad para obtener conocimientos prácticos. Además, la atribución jerárquica permite obtener conocimientos a nivel granular (a nivel regional) y agregado (impactos en grupos de características). Estos enfoques se integran para lograr un modelo más interpretable y explicable. Para validar la eficacia del modelo propuesto, realizamos un experimento con el conjunto de datos de rendimiento de cultivos recogido de Kaggle. Antes de la evaluación experimental, el preprocesamiento de datos se realiza mediante codificación one-hot. La normalización de datos se realiza mediante escalado min-max, y los valores atípicos se eliminan a través del rango Intercuartiles. Para fines de evaluación experimental, los autores utilizaron el modelo SHAP XAI para Random Forest. Al evaluar la eficacia del modelo TCHSHAP propuesto, se observa que, aunque la predicción media para el SHAP tradicional es de 161,137, esta escala a 161,506 tras incorporar ponderación temporal e inferencia causal, defendiendo la eficacia de emplear significación temporal y causal. Además, durante la atribución jerárquica, se observa que las características agrícolas tienen la mayor dominancia sobre la variable objetivo. A este dominio le siguen factores geográficos y ambientales. Así, los resultados obtenidos autorizan la eficacia del enfoque propuesto para mejorar la interpretabilidad global y local, fortaleciendo la confianza del usuario en las predicciones del modelo. El trabajo actual ofrece formas de mejorar la transparencia y la interpretabilidad sin afectar al rendimiento del modelo. El modelo sugerido también permite un modelado de regresión interpretable y eficiente en aplicaciones complejas basadas en datos, facilitando su aplicación generalizada en entornos reales.

Introducción

La regresión desempeña un papel fundamental en la analítica predictiva, abarcando varios ámbitos como la modelización climática, la previsión financiera, el diagnóstico sanitario y la estimación del rendimientoagrícola 1,2. Sin embargo, los resultados inexplicables de los modelos de regresión, especialmente los modelos no lineales y de alta capacidad como las Máquinas de Aumento de Gradiente (GBM), los Bosques Aleatorios y las Redes Neuronales Profundas (DNNs), plantean desafíos significativos, especialmente para aplicaciones que requieren transparencia e información accionabl....

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Protocolo

NOTA: Esta sección analiza el método de conjunto propuesto, incluyendo todas las enmiendas propuestas como se ilustra en la Figura 1.

Preparación de datos

Para validar la eficacia del marco propuesto, los autores realizaron un experimento con el conjunto de datos de rendimiento de cultivos recogido de Kaggle17. Este conjunto de datos consiste en datos agrícolas indios de varios cultivos desde 1997 hasta 2020 y fue consultado en marzo de 2025. Este conjunto de datos comprende numerosas características, como la ....

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Resultados

Esta sección analiza los resultados obtenidos aplicando diversos métodos utilizados durante el estudio experimental, que comprende varias subsecciones de la siguiente manera:

Recogida y preprocesamiento de datos

Para realizar una evaluación experimental del marco propuesto, se recopiló un conjunto de datos sobre el ren.......

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Discusión

El objetivo principal del estudio actual es incorporar ponderación temporal, inferencia causal y significado jerárquico en el modelo SHAP tradicional, dando lugar al modelo TCHSHAP. El motivo de incluir estos componentes en las técnicas XAI es mejorar la interpretabilidad de los resultados. Para la ponderación temporal, hemos considerado una técnica de decaimiento exponencial, que da más peso a los valores recientes en comparación con valores antiguos. En cuanto a la significancia causal.......

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Divulgaciones

Los autores declaran que no existen conflictos de interés.

Agradecimientos

Este trabajo está financiado por fondos nacionales a través de FCT – Fundação para a Ciência e a Tecnologia, I.P., bajo el Contrato de Programa UID/05105/2025.

....

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Materiales

Lista de materiales utilizados en este artículo
NombreEmpresaNúmero de catálogoComentarios
ELI50.13.0PyPI
LIMA0.2.0.1PyPI
Servidor GPU Nvidia DGX A100CPU Dual AMD Rome 7742, 128 núcleos en totalNvidia
Memoria del sistema 1TB
Pitón3.1Pitón
SHAP0.41.0PyPI
scikit-learn1.3.0PyPI
TensorFlow2.13Flujo tensorial
XGBoost1.7.6PyPI

Referencias

  1. Kaur, B., et al. N-Beats architecture for explainable forecasting of multi-dimensional poultry data. PloS One. 20 (4), e0320979(2025).
  2. Sharma, N., Mangla, M., Iqbal, M. M., Mohanty, S. N. Deep Learning Framework for Identification of Skin Lesions.

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Reimpresiones y permisos

Etiquetas

IA explicableinterpretabilidad del modeloatribuci n de caracter sticasRandom Forestmodelado de regresi nnormalizaci n de datos