Las experiencias adversas en la infancia (ACE, por sus siglas en inglés), que incluyen abuso, negligencia y disfunción en el hogar, son altamente prevalentes en todo el mundo, con tasas que superan el 60 % en muchas poblaciones1. Las síntesis de investigaciones indican que la mayoría de los niños están expuestos a al menos un evento adverso durante su desarrollo2. Se ha establecido bien que las ACE son factores de riesgo transdiagnósticos para la psicopatología adulta3, contribuyendo a aproximadamente el 30 % de los trastornos de ansiedad y el 40 % de los casos de depresión1. A pesar de esta fuerte asociación, las evaluaciones clínicas comúnmente utilizadas se basan en diagnósticos categóricos y autoinformes retrospectivos, que son vulnerables al sesgo de recuerdo y no capturan los procesos neurocognitivos en tiempo real4.
Para superar estas limitaciones, existe un énfasis creciente en enfoques transdiagnósticos que se centran en mecanismos subyacentes, particularmente en el aprendizaje asociativo. El aprendizaje asociativo, que incluye tanto el condicionamiento clásico como el operante, proporciona un marco para comprender cómo las personas codifican las relaciones entre señales ambientales, comportamientos y resultados, con el fin de orientar la toma de decisiones4,5. Dentro de este marco, la teoría de vulnerabilidad latente postula que las adversidades tempranas inducen adaptaciones neurobiológicas, como una mayor vigilancia, que inicialmente son adaptativas en entornos impredecibles, pero que pueden volverse desadaptativas en contextos posteriores más seguros6,7.
Existen evidencias de que las experiencias adversas en la infancia (ACE) influyen tanto en los procesos de aprendizaje relacionados con la amenaza como con la recompensa. Las personas con antecedentes de adversidad suelen mostrar una menor capacidad de discriminación entre las señales condicionadas de peligro (CS+) y de seguridad (CS−), lo que indica una alteración en el aprendizaje de la amenaza8. Paralelamente, se ha asociado la adversidad temprana con una sensibilidad reducida a la recompensa, evidenciada en una menor precisión y una adquisición más lenta de las contingencias de recompensa8. En condiciones de incertidumbre, estas personas también pueden presentar una mayor variabilidad en la toma de decisiones y una tendencia a asumir que la recompensa se entrega de forma aleatoria, lo cual es coherente con una exposición temprana a entornos volátiles5,9.
Estos patrones de aprendizaje están además moldeados por factores protectores y dependientes del estado. Las Experiencias Positivas en la Infancia (BCE, por sus siglas en inglés) pueden atenuar los efectos de la adversidad sobre los sistemas de aprendizaje10, mientras que los estados afectivos actuales, como la ansiedad, pueden modular los procesos de condicionamiento11. Las medidas fisiológicas del arousal autonómico, incluyendo la Respuesta de Conductancia de la Piel (SCR, por sus siglas en inglés), proporcionan índices objetivos de estos procesos y se utilizan ampliamente en paradigmas de condicionamiento12.
Una limitación importante en la literatura actual es el uso de tareas aisladas que evalúan por separado el aprendizaje ante amenazas o recompensas, lo que limita la capacidad de captar el funcionamiento neurocognitivo integrado1. El presente protocolo aborda esta brecha al proporcionar un marco estandarizado que combina medidas conductuales y fisiológicas en múltiples dominios de aprendizaje. Específicamente, el protocolo incluye tres componentes experimentales: (1) un paradigma que evalúa las transiciones del condicionamiento pavloviano al operante, (2) una tarea de extinción del miedo social y (3) una tarea de aprendizaje probabilístico de recompensa8.
La justificación para esta combinación particular de paradigmas no radica en que alguna de estas tres tareas, aislada por sí misma, sea más sensible a la adversidad temprana que los muchos otros paradigmas de aprendizaje establecidos disponibles; se trata de una justificación de medición. En su revisión sistemática de 81 estudios (38 sobre amenaza, 43 sobre recompensa), Ruge et al.1 demostraron que la literatura que vincula los ACEs con el aprendizaje asociativo sigue siendo heterogénea y, en aspectos clave, inconcluyente precisamente porque los estudios típicamente emplean una sola tarea, registran un único canal de respuesta y operacionalizan la adversidad de formas no armonizadas. A modo ilustrativo, la mitad de los estudios conductuales sobre aprendizaje por recompensa informaron un aprendizaje atenuado, mientras que la otra mitad reportó resultados nulos; la escasa literatura sobre extinción está dominada por hallazgos nulos y por informes que omiten la fase previa de adquisición; y ninguna medida de resultado ha surgido como universalmente más confiable, por lo que los diferentes canales de respuesta no son intercambiables como indicadores equivalentes. Su recomendación explícita es avanzar hacia protocolos intra-sujeto, multi-dominio y multi-canal que produzcan índices a nivel individual. La presente tríada sigue dicha recomendación porque sus tres tareas abarcan tres demandas computacionalmente disociables que ningún paradigma único cubre, y que la teoría de la vulnerabilidad latente7 predice que la adversidad debería moldear de formas diferentes: (i) discriminación entre amenaza y seguridad combinada con la controlabilidad instrumental, con el alivio como refuerzo putativo de la evitación13; (ii) aprendizaje inhibitorio (de seguridad) y retorno del miedo, evaluado mediante estímulos de rostros sociales11, el dominio de estímulos ecológicamente relevante para el maltrato interpersonal; y (iii) aprendizaje por refuerzo bajo incertidumbre probabilística, que produce parámetros computacionales individuales (tasa de aprendizaje alfa, temperatura inversa beta)8. Dado que las tres tareas se administran en el mismo participante, el diseño permite preguntar si las alteraciones relacionadas con los ACE son de carácter generalizado —una reconfiguración global del aprendizaje asociativo, como proponen Hanson et al.8 y como predeciría un modelo neurocomputacional de vulnerabilidad latente6— o específicas de valencia, limitadas a la amenaza. Un estudio con una sola tarea no puede, por diseño, decidir entre estas hipótesis en competencia.
La batería está diseñada para probar un conjunto de predicciones explícitas y direccionales, que la muestra actual no tiene potencia estadística suficiente para evaluar y que se presentan aquí como objetivos para estudios con potencia adecuada. De acuerdo con el patrón de aprendizaje atenuado descrito por Ruge et al.1, se predice que una mayor carga de ACE se asocie con (i) una menor discriminación entre CS+/CS− en el Experimento 1, provocada por una respuesta atenuada al CS+ y que se espera que sea más pronunciada en el canal autonómico (SCR) que en la expectativa declarativa, que podría mantenerse intacta; (ii) una mayor respuesta de evitación y una mayor sensación subjetiva de alivio ante el CS+ evitable, lo cual es consistente con la evitación reforzada por alivio13; (iii) una extinción más lenta y un retorno más rápido y mayor del miedo durante la reacquisición en el Experimento 2, un efecto que se predice que se amplificará con los estímulos sociales (rostros) que tienen relevancia ecológica para la adversidad interpersonal11; y (iv) una menor precisión en la elección, una tasa de aprendizaje más baja (alfa) y una mayor variabilidad en la elección (beta más bajo) en el Experimento 38. Es fundamental que las tres tareas aporten conjuntamente información sobre una quinta predicción diferencial: si la alteración relacionada con ACE es general en todos los dominios, la atenuación debería observarse en las tres tareas; si es específica de la valencia, debería limitarse a los dos paradigmas de amenaza y estar ausente en el aprendizaje probabilístico de recompensa. Dado que los canales de respuesta se registran simultáneamente, es posible evaluar una predicción adicional: que los efectos del ACE dependan del canal y no sean uniformes, de modo que las conclusiones derivadas de cualquier canal individual no se generalicen a los demás.
El experimento 1 adapta el paradigma de condicionamiento de miedo de tipo pavloviano a operante con evitación y calificaciones de alivio ensayo por ensayo desarrollado por San Martín et al.13, en el que se utilizan dos señales CS+ (una evitable y otra inevitable) y una CS− para disociar la discriminación pavloviana del control instrumental sobre el resultado aversivo. En el paradigma original, las calificaciones de expectativa del estímulo incondicionado (US) durante la fase de adquisición pavloviana se evaluaban retrospectivamente al final de la fase por parte del experimentador, en lugar de hacerlo ensayo por ensayo. En la adaptación actual, se recopilaron simultáneamente durante toda la tarea, fase por fase, calificaciones subjetivas de expectativa, amenaza y alivio mediante escalas análogas visuales, lo que permite un seguimiento continuo de la dinámica del aprendizaje a través de las fases.
El experimento 2 adapta el protocolo de adquisición–extinción del miedo con estímulos sociales (rostros) de Dibbets y Evers9, ampliándolo con una breve prueba de reacquisición para evaluar la reaparición rápida de la respuesta condicionada (efecto de ahorro).
El experimento 3 adapta la tarea de aprendizaje probabilístico de recompensa introducida por Hanson et al.8 para el estudio de diferencias en el aprendizaje relacionadas con adversidades tempranas, con dos contingencias de recompensa (80/20 y 70/30) que permiten la estimación de parámetros individuales de aprendizaje por refuerzo (Alpha y Beta del Q-learning). Al integrar estos tres paradigmas en una única sesión de laboratorio, el presente protocolo posibilita la comparación directa intra-sujeto de los procesos de aprendizaje ante amenazas y recompensas, que normalmente se estudian de forma aislada. Además de la precisión por ensayo y los parámetros de Q-learning, la canalización de análisis también produce pendientes individuales de la trayectoria de aprendizaje derivadas de un modelo mixto lineal ajustado, disponibles para su uso en muestras más grandes.
Aquí deben distinguirse dos objetivos diferentes, ya que no son equivalentes. El primero consiste en demostrar que una batería de este tipo puede realizarse como una sesión única e integrada de 60 minutos y que cada uno de sus componentes provoca el efecto canónico para el que fue diseñado; la reproducción de efectos canónicos constituye evidencia suficiente para este primer objetivo. El segundo consiste en demostrar que los índices resultantes son sensibles y específicos respecto a las consecuencias de la adversidad en la infancia; la reproducción de efectos canónicos no es evidencia suficiente para ello, y la muestra actual no tiene potencia estadística para proporcionarla. El objetivo principal de este informe es, por tanto, la viabilidad técnica y metodológica de la batería integrada: si la adquisición de amenaza, la evitación instrumental con alivio, la extinción y el retorno del miedo con estímulos sociales, y el aprendizaje probabilístico de recompensas pueden obtenerse simultáneamente a través de canales autonómicos, conductuales y de autoinforme dentro de una única sesión, y si el procedimiento produce índices estables y reutilizables por participante (contrastes diferenciales de SCR, contraste operante de alivio, parámetros alfa y beta del aprendizaje por refuerzo tipo Q, y pendientes individuales de las trayectorias de aprendizaje). La evaluación de alteraciones relacionadas con experiencias adversas en la infancia (ACE) en el aprendizaje constituye un objetivo secundario, exploratorio e ilustrativo: los análisis de diferencias individuales presentados aquí tienen como finalidad demostrar la capacidad de medición del protocolo y poner a disposición sus índices candidatos para trabajos futuros, sin pretender probar específicamente las vías entre trauma y aprendizaje. Así, el protocolo proporciona índices candidatos; si poseen la sensibilidad y especificidad necesarias para caracterizar las consecuencias neurocognitivas de la adversidad en la infancia deberá establecerse en muestras más grandes, idealmente enriquecidas con grupos extremos y previamente registradas1,14.