Niekorzystne doświadczenia z dzieciństwa (ACEs), obejmujące znęcanie się, zaniedbanie oraz dysfunkcje w obrębie gospodarstwa domowego, występują na całym świecie z wysoką częstotliwością, przekraczając 60% w wielu populacjach1. Syntezy badań wskazują, że większość dzieci jest narażona na co najmniej jedno niekorzystne zdarzenie w okresie rozwoju2. ACEs są uznanymi transdiagnostycznymi czynnikami ryzyka psychopatologii u dorosłych3, przyczyniając się do szacunkowo 30% zaburzeń lękowych i 40% przypadków depresji1. Pomimo tej silnej korelacji, powszechnie stosowane oceny kliniczne opierają się na diagnozach kategorycznych i retrospektywnych samoopisach, które są podatne na błąd wspomnienia i nie oddają neuropoznawczych procesów zachodzących w czasie rzeczywistym4.
Aby przezwyciężyć te ograniczenia, coraz większy nacisk kładzie się na podejścia transdiagnostyczne ukierunkowane na mechanizmy podstawowe, w szczególności na uczenie się asocjacyjne. Uczenie się asocjacyjne, obejmujące zarówno warunkowanie pawłowowskie, jak i instrumentalne, stanowi ramy dla zrozumienia, w jaki sposób jednostki kodują relacje między sygnałami środowiskowymi, zachowaniami a wynikami, aby kierować procesem podejmowania decyzji4,5. W ramach tego modelu teoria utajonej podatności zakłada, że wczesne niekorzystne doświadczenia indukują adaptacje neurobiologiczne, takie jak zwiększona czujność, które są początkowo adaptacyjne w nieprzewidywalnych środowiskach, lecz mogą stać się nieadaptacyjne w późniejszych, bezpieczniejszych kontekstach6,7.
Dowody wskazują na to, że ACE wpływają zarówno na procesy uczenia się związane z zagrożeniem, jak i z nagrodą. Osoby z historią niekorzystnych doświadczeń często wykazują ograniczoną zdolność rozróżniania uwarunkowanych sygnałów niebezpieczeństwa (CS+) i bezpieczeństwa (CS−), co świadczy o zaburzeniach uczenia się zagrożeń8. Równocześnie wczesne niekorzystne doświadczenia wiązano z obniżoną wrażliwością na nagrody, co przejawia się niższą dokładnością i wolniejszym przyswajaniem zależności związanych z nagrodą8. W warunkach niepewności osoby te mogą również wykazywać zwiększoną zmienność wyborów oraz tendencję do zakładania losowości dostarczania nagród, co jest zgodne z wczesną ekspozycją na niestabilne środowiska5,9.
Wzorce uczenia się te są dodatkowo kształtowane przez czynniki ochronne oraz zależne od stanu organizmu. Pozytywne Doświadczenia Dziecięce (BCEs) mogą łagodzić wpływ niekorzystnych zdarzeń na systemy uczenia się10, podczas gdy aktualne stany afektywne, takie jak lęk, mogą modulować procesy warunkowania11. Fizjologiczne miary pobudzenia autonomicznego, w tym reakcja przewodnictwa skóry (SCR), dostarczają obiektywnych wskaźników tych procesów i są szeroko stosowane w paradygmatach warunkowania12.
Głównym ograniczeniem w aktualnej literaturze jest stosowanie wyizolowanych zadań, które oceniają uczenie się zagrożenia lub nagrody niezależnie, co ogranicza możliwość uchwycenia zintegrowanego funkcjonowania neuropoznawczego1. Niniejszy protokół wypełnia tę lukę, zapewniając zestandaryzowane ramy łączące pomiary behawioralne i fizjologiczne w wielu domenach uczenia się. W szczególności protokół obejmuje trzy komponenty eksperymentalne: (1) paradygmat oceniający przejścia z warunkowania pawłowowskiego do instrumentalnego, (2) zadanie wygaszania lęku społecznego oraz (3) zadanie probabilistycznego uczenia się nagrody8.
Uzasadnienie dla tej konkretnej kombinacji paradygmatów nie wynika z tego, że którekolwiek z tych trzech zadań jest, w izolacji, bardziej czułe na wczesne niekorzystne doświadczenia niż wiele innych dostępnych, ugruntowanych paradygmatów uczenia się; jest to uzasadnienie pomiarowe. W swoim systematycznym przeglądzie 81 badań (38 dotyczących zagrożenia, 43 dotyczących nagrody), Ruge i wsp.1 wykazali, że literatura łącząca ACE z uczeniem się asocjacyjnym pozostaje niejednorodna i w kluczowych aspektach niekonkluzywna właśnie dlatego, że badania zazwyczaj wykorzystują pojedyncze zadanie, rejestrują jeden kanał odpowiedzi i operacjonalizują niekorzystne doświadczenia w niespójny sposób. Przykładowo, połowa behawioralnych badań nad uczeniem się z nagrodą zgłaszała osłabione uczenie się, podczas gdy druga połowa nie wykazała żadnych efektów; skromna literatura dotycząca wygaszania jest zdominowana przez wyniki zerowe oraz raporty pomijające poprzedzającą fazę nabywania; ponadto żadna miara wyniku nie okazała się uniwersalnie bardziej niezawodna, zatem różne kanały odpowiedzi nie są wzajemnie zamiennymi substytutami. Ich wyraźną rekomendacją jest przejście w stronę protokołów wewnątrzpodmiotowych, wielodomenowych i wielokanałowych, dostarczających wskaźników na poziomie indywidualnym. Niniejsza triada realizuje tę rekomendację, ponieważ jej trzy zadania obejmują trzy obliczeniowo rozróżnialne wymagania, których nie pokrywa żaden pojedynczy paradygmat i które według teorii utajonej podatności7 powinny być w różny sposób kształtowane przez niekorzystne doświadczenia: (i) rozróżnianie zagrożenia i bezpieczeństwa połączone z kontrolowalnością instrumentalną, gdzie ulga służy jako domniemany wzmacniacz unikania13; (ii) uczenie hamujące (bezpieczeństwo) i powrót lęku, badane za pomocą społecznych bodźców twarzowych11, będących ekologicznie istotną domeną bodźców dla maltretowania interpersonalnego; oraz (iii) uczenie się przez wzmacnianie w warunkach niepewności probabilistycznej, co pozwala uzyskać parametry obliczeniowe dla każdego uczestnika (tempo uczenia się alpha, odwrotna temperatura beta)8. Ponieważ wszystkie trzy zadania są przeprowadzane u tego samego uczestnika, projekt został skonstruowany tak, aby odpowiedzieć na pytanie, czy zmiany związane z ACE są ogólne dla wszystkich domen — co oznaczałoby globalną rekalibrację uczenia się asocjacyjnego, jak proponują Hanson i wsp.8 i jak przewidywałoby to neuroobliczeniowe ujęcie utajonej podatności6 — czy też są specyficzne dla walencji i ograniczone do zagrożenia. Badanie oparte na pojedynczym zadaniu, ze względu na swoją konstrukcję, nie może rozstrzygnąć między tymi konkurencyjnymi hipotezami.
Bateria ta została zaprojektowana w celu przetestowania zestawu wyraźnych, ukierunkowanych przewidywań, których obecna próba nie posiada wystarczającej mocy statystycznej, aby je rozstrzygnąć, a które sformułowano tutaj jako cele dla odpowiednio zasilonych badań. Zgodnie z wzorcem stępionego uczenia się opisanym przez Ruge et al.1, przewiduje się, że wyższe obciążenie ACE będzie wiązać się z: (i) zmniejszoną dyskryminacją CS+/CS− w Eksperymencie 1, napędzaną osłabioną reakcją na CS+ i spodziewaną w sposób bardziej wyraźny w kanale autonomicznym (SCR) niż w deklaratywnym oczekiwaniu, które może pozostać nienaruszone; (ii) silniejszą reakcją unikania i wyższą subiektywną ulgą w odpowiedzi na unikalne CS+, zgodnie z unikaniem wzmocnionym ulgą13; (iii) wolniejszym wygaszaniem oraz szybszym i silniejszym powrotem lęku podczas ponownego nabywania w Eksperymencie 2, przy czym efekt ten ma być wzmocniony przez społeczne bodźce (twarz), które niosą ekologiczną istotność dla niekorzystnych doświadczeń interpersonalnych11; oraz (iv) niższą dokładnością wyboru, niższą szybkością uczenia się (alpha) i większą zmiennością wyborów (niższe beta) w Eksperymencie 38. Kluczowe jest to, że trzy zadania są wspólnie informatywne w kontekście piątego, różnicującego przewidywania: jeśli zaburzenia związane z ACE mają charakter ogólnodomenowy, osłabienie powinno wystąpić we wszystkich trzech zadaniach; jeśli są one specyficzne dla walencji, powinno ono ograniczać się do dwóch paradygmatów zagrożenia i być nieobecne w probabilistycznym uczeniu się nagrody. Ponieważ kanały odpowiedzi są rejestrowane jednocześnie, można sprawdzić kolejne przewidywanie — że efekty ACE będą zależne od kanału, a nie jednolite, tak że wnioski wyciągnięte z dowolnego pojedynczego kanału nie będą można uogólnić na pozostałe.
Eksperyment 1 adaptuje paradygmat warunkowania lękowego z przejścia pawłowowskiego na operacyjne z unikaniem i ocenami ulgi dla każdej próby, opracowany przez San Martína i współpracowników13, w którym wykorzystano dwa sygnały CS+ (jeden możliwy do uniknięcia, jeden nieunikniony) oraz jeden sygnał CS−, aby rozdzielić dyskryminację pawłowowską od instrumentalnej kontroli nad awersyjnym wynikiem. W oryginalnym paradygmacie oceny oczekiwania na US podczas fazy nabywania pawłowowskiego były przeprowadzane retrospektywnie na koniec fazy przez eksperymentatora, a nie w każdej próbie. W niniejszej adaptacji subiektywne oceny oczekiwania, zagrożenia i ulgi były zbierane równolegle w trakcie całego zadania w każdej fazie przy użyciu wizualnych skal analogowych, co pozwoliło na ciągłe śledzenie dynamiki uczenia się w poszczególnych fazach.
Eksperyment 2 adaptuje protokół nabywania i wygaszania lęku z wykorzystaniem bodźców społecznych (twarzy) według Dibbets i Eversa9, rozszerzając go o krótki test ponownego nabywania w celu oceny szybkiego powrotu reakcji warunkowej (efekt oszczędności).
Eksperyment 3 adaptuje zadanie probabilistycznej nauki nagrody wprowadzone przez Hansona i współpracowników8 do badania różnic w uczeniu się związanych z wczesnymi niekorzystnymi doświadczeniami, z dwiema zależnościami nagród (80/20 i 70/30), które umożliwiają oszacowanie parametrów uczenia się przez wzmocnienie dla każdego uczestnika (Alpha i Beta w modelu Q-learning). Poprzez zintegrowanie tych trzech paradygmatów w ramach jednej sesji laboratoryjnej, niniejszy protokół umożliwia bezpośrednie porównanie wewnątrzparticipantowe procesów uczenia się zagrożenia i nagrody, które zazwyczaj bada się w izolacji. Poza dokładnością poszczególnych prób i parametrami Q-learning, potok analizy generuje również indywidualne nachylenia trajektorii uczenia się z dopasowanego liniowego modelu mieszanego, które mogą być wykorzystane w większych próbach.
Należy tutaj rozróżnić dwa odrębne cele, ponieważ nie są one równoważne. Pierwszym jest wykazanie, że zestaw testów tego rodzaju może być przeprowadzony jako jedna, zintegrowana 60-minutowa sesja i że każdy z jego komponentów wywołuje kanoniczny efekt, do którego został zaprojektowany; odtworzenie efektów kanonicznych jest wystarczającym dowodem dla tego pierwszego celu. Drugim jest wykazanie, że wynikowe wskaźniki są wrażliwe i specyficzne dla skutków niekorzystnych doświadczeń z dzieciństwa; odtworzenie efektów kanonicznych nie stanowi wystarczającego dowodu w tym przypadku, a obecna próba nie posiada odpowiedniej mocy statystycznej, aby go dostarczyć. Głównym celem niniejszego raportu jest zatem techniczna i metodologiczna wykonalność zintegrowanego zestawu testów: sprawdzenie, czy nabywanie lęku (threat acquisition), instrumentalne unikanie z ulgą (instrumental avoidance with relief), wygaszanie i powrót lęku w odpowiedzi na bodźce społeczne oraz probabilistyczne uczenie się nagrody mogą być nabywane równocześnie za pośrednictwem kanałów autonomicznych, behawioralnych i samoopisowych w ramach jednej sesji, oraz czy proces ten dostarcza stabilnych, reużywalnych wskaźników dla każdego uczestnika (kontrasty różnicowe SCR, kontrast operacyjnej ulgi, parametry alfa i beta Q-learningu oraz indywidualne nachylenia trajektorii uczenia się). Ocena zmian w uczeniu się związanych z ACE stanowi wtórny, eksploracyjny i ilustracyjny cel: przedstawione tutaj analizy różnic indywidualnych mają na celu zademonstrowanie zdolności pomiarowych protokołu i udostępnienie jego potencjalnych wskaźników do przyszłych prac, a nie specyficzne testowanie ścieżek powiązania traumy z uczeniem się. Protokół dostarcza zatem potencjalnych wskaźników; kwestia tego, czy posiadają one wrażliwość i specyficzność wymaganą do charakterystyki neuropoznawczych skutków niekorzystnych doświadczeń z dzieciństwa, pozostaje do ustalenia w większych, idealnie wzbogaconych o grupy ekstremalne i zarejestrowanych wcześniej próbach1,14.