Experiências Adversas na Infância (EAI), que englobam abuso, negligência e disfunção no ambiente doméstico, são altamente prevalentes em todo o mundo, com taxas superiores a 60% em muitas populações1. Sínteses de pesquisas indicam que a maioria das crianças é exposta a pelo menos um evento adverso durante o desenvolvimento2. As EAI são fatores de risco transdiagnósticos bem estabelecidos para psicopatologia na vida adulta3, contribuindo para cerca de 30% dos casos de transtornos de ansiedade e 40% dos casos de depressão1. Apesar dessa forte associação, as avaliações clínicas comumente utilizadas baseiam-se em diagnósticos categóricos e relatos autorreferidos retrospectivos, que são suscetíveis a vieses de memória e não capturam processos neurocognitivos em tempo real4.
Para superar essas limitações, tem havido uma ênfase crescente em abordagens transdiagnósticas que visam mecanismos subjacentes, particularmente a aprendizagem associativa. A aprendizagem associativa, que engloba tanto o condicionamento clássico quanto o operante, fornece uma estrutura para compreender como os indivíduos codificam relações entre estímulos ambientais, comportamentos e resultados para orientar a tomada de decisões4,5. Nesse contexto, a teoria da vulnerabilidade latente propõe que adversidades precoces induzem adaptações neurobiológicas, como hipervigilância, que inicialmente são adaptativas em ambientes imprevisíveis, mas podem tornar-se desadaptativas em contextos posteriores e mais seguros6,7.
Há evidências de que experiências adversas na infância (ACEs) influenciam processos de aprendizagem relacionados tanto à ameaça quanto à recompensa. Indivíduos com histórico de adversidade frequentemente apresentam reduzida capacidade de discriminação entre estímulos condicionados de perigo (CS+) e de segurança (CS−), o que indica uma alteração na aprendizagem da ameaça8. Paralelamente, a adversidade precoce tem sido associada à diminuição da sensibilidade à recompensa, refletida em menor precisão e aquisição mais lenta das contingências de recompensa8. Em condições de incerteza, esses indivíduos também podem exibir maior variabilidade nas escolhas e uma tendência a presumir que a entrega da recompensa é aleatória, o que está de acordo com a exposição precoce a ambientes voláteis5,9.
Esses padrões de aprendizagem são ainda moldados por fatores protetores e dependentes do estado. As Experiências Infantis Benevolentes (BCEs) podem atenuar os efeitos da adversidade sobre os sistemas de aprendizagem10, enquanto estados afetivos atuais, como a ansiedade, podem modular os processos de condicionamento11. Medidas fisiológicas do arousal autonômico, incluindo a Resposta de Condutância da Pele (SCR), fornecem índices objetivos desses processos e são amplamente utilizadas em paradigmas de condicionamento12.
Uma limitação importante na literatura atual é o uso de tarefas isoladas que avaliam independentemente a aprendizagem de ameaça ou recompensa, limitando a capacidade de capturar o funcionamento neurocognitivo integrado1. O presente protocolo aborda essa lacuna ao fornecer uma estrutura padronizada que combina medidas comportamentais e fisiológicas em múltiplos domínios de aprendizagem. Especificamente, o protocolo inclui três componentes experimentais: (1) um paradigma que avalia a transição do condicionamento pavloviano para o condicionamento operante, (2) uma tarefa de extinção do medo social e (3) uma tarefa de aprendizagem de recompensa probabilística8.
A justificativa para essa combinação específica de paradigmas não reside no fato de que qualquer uma dessas três tarefas, isoladamente, seja mais sensível à adversidade precoce do que os muitos outros paradigmas de aprendizagem já estabelecidos; trata-se de uma justificativa de mensuração. Em sua revisão sistemática de 81 estudos (38 sobre ameaça, 43 sobre recompensa), Ruge et al.1 demonstraram que a literatura que vincula experiências adversas na infância (ACEs) ao aprendizado associativo permanece heterogênea e, em aspectos fundamentais, inconclusiva precisamente porque os estudos normalmente empregam uma única tarefa, registram um único canal de resposta e operacionalizam a adversidade de maneiras não harmonizadas. Ilustrativamente, metade dos estudos comportamentais sobre aprendizagem por recompensa relatou aprendizagem atenuada, enquanto a outra metade relatou resultados nulos; a escassa literatura sobre extinção é dominada por achados nulos e por relatos que omitem a fase anterior de aquisição; e nenhuma medida de desfecho emergiu como universalmente mais confiável, de modo que diferentes canais de resposta não são substitutos intercambiáveis uns dos outros. A recomendação explícita deles é avançar rumo a protocolos intra-sujeito, multidomínio e multicanal, que gerem índices em nível individual. A presente tríade segue essa recomendação porque suas três tarefas abrangem três demandas computacionalmente dissociáveis que nenhum único paradigma cobre, e que a teoria da vulnerabilidade latente7 prevê que a adversidade deveria moldar de formas distintas: (i) discriminação entre ameaça e segurança combinada com controlabilidade instrumental, com o alívio como reforçador putativo da evitação13; (ii) aprendizagem inibitória (de segurança) e retorno do medo, avaliados com estímulos de rostos sociais11, o domínio de estímulos ecologicamente relevante para maus-tratos interpessoais; e (iii) aprendizagem por reforço sob incerteza probabilística, que gera parâmetros computacionais por participante (taxa de aprendizagem alfa, temperatura inversa beta)8. Como as três tarefas são aplicadas no mesmo participante, o delineamento é construído para investigar se as alterações relacionadas às ACEs são generalizadas a todos os domínios — uma reconfiguração global do aprendizado associativo, como propõem Hanson et al.8 e como preveria uma abordagem neurocomputacional da vulnerabilidade latente6 — ou específicas à valência, restritas à ameaça. Um estudo com uma única tarefa não pode, por construção, decidir entre essas hipóteses concorrentes.
A bateria foi projetada para testar um conjunto de previsões explícitas e direcionais, que a amostra atual não tem poder estatístico para avaliar e que são apresentadas aqui como objetivos para estudos adequadamente poderosos. Em consonância com o padrão de aprendizagem atenuada descrito por Ruge et al.1, prevê-se que uma maior carga de ACE esteja associada a: (i) menor discriminação entre CS+/CS− no Experimento 1, decorrente de uma resposta atenuada ao CS+ e esperada ser mais acentuada na via autonômica (SCR) do que na expectativa declarativa, que pode permanecer intacta; (ii) maior resposta de evitação e maior alívio subjetivo diante do CS+ evitável, compatível com a evitação reforçada por alívio13; (iii) extinção mais lenta e retorno mais rápido e acentuado do medo durante a reaquisição no Experimento 2, um efeito previsto ser amplificado pelos estímulos sociais (rostos), que possuem relevância ecológica para adversidades interpessoais11; e (iv) menor precisão nas escolhas, menor taxa de aprendizagem (alfa) e maior variabilidade nas escolhas (menor beta) no Experimento 38. Crucialmente, as três tarefas são conjuntamente informativas sobre uma quinta previsão discriminatória: se a alteração relacionada ao ACE for geral, a atenuação deverá aparecer em todas as três tarefas; se for específica à valência, deverá restringir-se aos dois paradigmas de ameaça e ausente no aprendizado probabilístico de recompensa. Como os canais de resposta são registrados simultaneamente, uma previsão adicional pode ser testada — de que os efeitos do ACE serão dependentes do canal e não uniformes, de modo que conclusões baseadas em qualquer canal isolado não possam ser generalizadas para os demais.
O Experimento 1 adapta o paradigma de condicionamento pavloviano-operante de medo com avaliação de alívio em cada tentativa e evitação desenvolvido por San Martín et al.13, no qual dois estímulos condicionados positivos (CS+, um evitável e outro inevitável) e um estímulo condicionado negativo (CS−) são utilizados para dissociar a discriminação pavloviana do controle instrumental sobre o resultado aversivo. No paradigma original, as avaliações subjetivas de expectativa do estímulo não condicionado (US) durante a fase de aquisição pavloviana eram obtidas retrospectivamente ao final da fase pelo experimentador, e não em cada tentativa. Na presente adaptação, avaliações subjetivas de expectativa, ameaça e alívio foram coletadas simultaneamente ao longo da tarefa, fase por fase, utilizando escalas analógicas visuais, permitindo o acompanhamento contínuo da dinâmica de aprendizagem ao longo das fases.
O Experimento 2 adapta o protocolo de aquisição–extinção do medo com estímulos sociais (rostos) de Dibbets e Evers9, ampliando-o com um breve teste de reaquisição para avaliar o ressurgimento rápido da resposta condicionada (efeito de economia).
O experimento 3 adapta a tarefa de aprendizagem probabilística por recompensa introduzida por Hanson et al.8 para o estudo de diferenças no aprendizado relacionadas à adversidade precoce, com duas contingências de recompensa (80/20 e 70/30) que permitem a estimativa dos parâmetros de aprendizagem por reforço por participante (Alfa e Beta do Q-learning). Ao integrar esses três paradigmas em uma única sessão laboratorial, o presente protocolo permite a comparação direta, intra-participante, dos processos de aprendizagem por ameaça e recompensa, que normalmente são estudados de forma isolada. Além da precisão por tentativa e dos parâmetros de Q-learning, o pipeline de análise também produz as inclinações individuais das trajetórias de aprendizagem a partir de um modelo linear misto ajustado, disponíveis para uso em amostras maiores.
Dois objetivos distintos devem ser mantidos separados aqui, pois não são equivalentes. O primeiro é estabelecer que uma bateria desse tipo pode ser conduzida como uma única sessão integrada de 60 minutos e que cada um de seus componentes provoca o efeito canônico para o qual foi projetado; a reprodução de efeitos canônicos é evidência suficiente para esse primeiro objetivo. O segundo é estabelecer que os índices resultantes são sensíveis e específicos às consequências da adversidade na infância; a reprodução de efeitos canônicos não é evidência suficiente para isso, e a presente amostra não possui poder estatístico para fornecê-la. O objetivo primário deste relatório é, portanto, a viabilidade técnica e metodológica da bateria integrada: se a aquisição de ameaça, a evitação instrumental com alívio, a extinção e o retorno do medo com estímulos sociais, e a aprendizagem probabilística de recompensa podem ser adquiridas simultaneamente por meio de canais autonômicos, comportamentais e de autorrelato dentro de uma única sessão, e se o protocolo gera índices estáveis e reutilizáveis por participante (contrastes diferenciais de SCR, contraste operante de alívio, parâmetros alfa e beta do Q-learning e inclinações individuais das trajetórias de aprendizagem). A avaliação de alterações relacionadas à ECAs na aprendizagem constitui um objetivo secundário, exploratório e ilustrativo: as análises de diferenças individuais aqui relatadas têm como finalidade demonstrar a capacidade de medição do protocolo e disponibilizar seus índices candidatos para trabalhos futuros, sem o propósito específico de testar caminhos entre trauma e aprendizagem. O protocolo fornece, assim, índices candidatos; se eles possuem a sensibilidade e especificidade necessárias para caracterizar as consequências neurocognitivas da adversidade na infância permanece a ser estabelecido em amostras maiores, idealmente enriquecidas com grupos extremos e pré-registradas1,14.