Неблагоприятный детский опыт (ACEs), включающий жестокое обращение, пренебрежение нуждами ребенка и дисфункцию в семье, широко распространен во всем мире, и в многих популяциях его показатели превышают 60%1. Синтез исследовательских данных указывает на то, что большинство детей в процессе развития сталкиваются как минимум с одним неблагоприятным событием2. ACEs являются общепризнанными трансдиагностическими факторами риска развития психопатологии у взрослых3, способствуя возникновению примерно 30% тревожных расстройств и 40% случаев депрессии1. Несмотря на эту сильную связь, общепринятые методы клинической оценки опираются на категориальные диагнозы и ретроспективные самоотчеты, которые подвержены систематической ошибке воспоминаний и не позволяют зафиксировать нейрокогнитивные процессы в режиме реального времени4.
Для преодоления этих ограничений растет внимание к трансдиагностическим подходам, направленным на фундаментальные механизмы, в частности на ассоциативное обучение. Ассоциативное обучение, охватывающее как павловское, так и оперантное обусловливание, создает основу для понимания того, как индивидуумы кодируют взаимосвязи между сигналами окружающей среды, поведением и результатами для принятия решений4,5. В рамках этого подхода теория латентной уязвимости постулирует, что неблагоприятный ранний опыт вызывает нейробиологические адаптации, такие как повышенная бдительность, которые изначально являются адаптивными в непредсказуемой среде, но могут стать дезадаптивными в последующих, более безопасных контекстах6,7.
Данные свидетельствуют о том, что неблагоприятный детский опыт (ACEs) влияет как на процессы обучения, связанные с угрозой, так и на процессы, связанные с вознаграждением. У лиц с перенесенными трудностями часто наблюдается снижение способности различать обусловленные сигналы опасности (CS+) и безопасности (CS−), что указывает на изменение механизмов обучения угрозам8. Параллельно с этим, ранний неблагоприятный опыт связывают со сниженной чувствительностью к вознаграждению, что проявляется в более низкой точности и замедленном формировании связей с вознаграждением8. В условиях неопределенности такие люди могут также демонстрировать повышенную вариабельность выбора и склонность предполагать случайное получение вознаграждения, что согласуется с ранним воздействием нестабильной среды5,9.
Эти паттерны обучения дополнительно формируются под влиянием протективных факторов и факторов, зависящих от состояния. Благополучный детский опыт (BCE) может смягчать воздействие неблагоприятных факторов на системы обучения.10в то время как текущие аффективные состояния, такие как тревога, могут модулировать процессы обусловливания11Физиологические показатели вегетативного возбуждения, включая реакцию проводимости кожи (РПК), предоставляют объективные индексы этих процессов и широко используются в парадигмах обусловливания.12.
Серьезным ограничением в текущей литературе является использование изолированных задач, которые оценивают обучение сигналам угрозы или вознаграждения независимо друг от друга, что ограничивает возможность анализа интегрированного нейрокогнитивного функционирования1. Настоящий протокол восполняет этот пробел, предоставляя стандартизированную основу, объединяющую поведенческие и физиологические показатели в нескольких областях обучения. В частности, протокол включает три экспериментальных компонента: (1) парадигму оценки переходов от Павловского к оперантному обусловливанию, (2) задачу на угасание социального страха и (3) задачу на вероятностное обучение вознаграждению8.
Обоснованием выбора именно этой комбинации парадигм является не то, что любая из этих трех задач сама по себе более чувствительна к ранним неблагоприятным факторам, чем многие другие существующие установленные парадигмы обучения; это обоснование основано на принципах измерения. В своем систематическом обзоре 81 исследования (38 по угрозе, 43 по вознаграждению) Ruge et al.1 показали, что литература, связывающая ACE с ассоциативным обучением, остается неоднородной и, в ключевых аспектах, неубедительной именно потому, что в исследованиях обычно используется одна задача, регистрируется один канал отклика, а определение неблагоприятных факторов операционализируется несогласованно. Для иллюстрации: половина поведенческих исследований обучения с вознаграждением сообщала о притупленном обучении, в то время как вторая половина — о нулевых результатах; в немногочисленной литературе по угашению доминируют нулевые результаты и отчеты, в которых опускается предшествующая фаза приобретения; при этом ни один показатель исхода не оказался универсально более надежным, поэтому различные каналы отклика не являются взаимозаменяемыми суррогатами друг друга. Их явная рекомендация заключается в переходе к внутрисубъектным, многодоменным и многоканальным протоколам, позволяющим получать индексы на индивидуальном уровне. Данная триада следует этой рекомендации, поскольку ее три задачи охватывают три вычислительно разделимых требования, которые не покрываются ни одной отдельной парадигмой и которые, согласно теории латентной уязвимости7, должны по-разному формироваться под воздействием неблагоприятных факторов: (i) различение угрозы и безопасности в сочетании с инструментальной контролируемостью, где облегчение выступает в качестве предполагаемого подкрепления избегания13; (ii) тормозное (безопасное) обучение и возвращение страха, исследуемые с помощью стимулов в виде лиц11, что является экологически релевантной областью стимулов для межличностного жестокого обращения; и (iii) обучение с подкреплением в условиях вероятностной неопределенности, которое позволяет получить вычислительные параметры для каждого участника (скорость обучения alpha, обратная температура beta)8. Поскольку все три задачи выполняются одним и тем же участником, дизайн исследования построен таким образом, чтобы выяснить, являются ли изменения, связанные с ACE, доменно-общими — глобальной перенастройкой ассоциативного обучения, как предлагают Hanson et al.8 и как предсказывает нейровычислительная модель латентной уязвимости6, — или же они специфичны для определенной валентности и ограничены только угрозой. Исследование с использованием одной задачи по определению не может разрешить спор между этими конкурирующими гипотезами.
Данная батарея тестов предназначена для проверки ряда четких направленных прогнозов, которые текущая выборка не позволяет подтвердить или опровергнуть, и которые представлены здесь в качестве целей для исследований с достаточной статистической мощностью. В соответствии с паттерном ослабленного обучения, описанным Ruge et al.1, прогнозируется, что более высокая нагрузка ACE будет связана с (i) снижением дискриминации CS+/CS− в Эксперименте 1, обусловленным ослабленным ответом на CS+ и, как ожидается, более выраженным в автономном канале (КГР), чем в декларативном ожидании, которое может остаться неизменным; (ii) более выраженным избегающим поведением и более высоким уровнем субъективного облегчения при воздействии избегаемого CS+, что согласуется с концепцией избегания, подкрепляемого облегчением13; (iii) более медленным угасанием и более быстрым и выраженным возвращением страха при повторном приобретении в Эксперименте 2 — эффектом, который, как ожидается, будет усилен социальными (лицевыми) стимулами, имеющими экологическую значимость для межличностных невзгод11; и (iv) более низкой точностью выбора, более низкой скоростью обучения (alpha) и большей вариабельностью выбора (более низким beta) в Эксперименте 38. Принципиально важно, что три задачи в совокупности дают информацию для проверки пятого, дифференцирующего прогноза: если изменения, связанные с ACE, носят доменно-общий характер, то ослабление должно проявляться во всех трех задачах; если же они специфичны для валентности, то должны ограничиваться двумя парадигмами угрозы и отсутствовать при вероятностном обучении вознаграждению. Поскольку данные по каналам ответов регистрируются одновременно, можно проверить еще один прогноз — что эффекты ACE будут зависеть от канала, а не будут единообразными, таким образом, выводы, сделанные на основе любого одного канала, не будут распространяться на другие.
В эксперименте 1 адаптирована парадигма перехода от павловского к оперантному обусловливанию страха с использованием процедур избегания и поочередной оценки облегчения, разработанная San Martín et al.13. В данной парадигме используются два сигнала CS+ (один, которого можно избежать, и один, которого нельзя избежать) и один сигнал CS− для разграничения павловской дискриминации и инструментального контроля над аверсивным исходом. В оригинальной парадигме оценки ожидания US во время фазы павловского приобретения оценивались экспериментатором ретроспективно в конце фазы, а не после каждого испытания. В настоящей адаптации субъективные оценки ожидания, угрозы и облегчения собирались одновременно на протяжении всего задания пофазово с помощью визуально-аналоговых шкал, что позволило непрерывно отслеживать динамику обучения между фазами.
В эксперименте 2 протокол приобретения и угашения страха с использованием социальных стимулов (лиц) из работы Dibbets и Evers9 был модифицирован путем добавления краткого теста на повторное приобретение для оценки быстрого восстановления обусловленной реакции (эффект сбережения).
В эксперименте 3 используется модифицированная задача вероятностного обучения вознаграждению, предложенная Hanson et al.8 для изучения различий в обучении, связанных с ранним неблагоприятным опытом; в ней применяются две зависимости вознаграждения (80/20 и 70/30), что позволяет оценить индивидуальные параметры обучения с подкреплением (Alpha и Beta в Q-обучении). Интеграция этих трех парадигм в рамках одного лабораторного сеанса в настоящем протоколе позволяет проводить прямое внутрисубъектное сравнение процессов обучения угрозе и вознаграждению, которые обычно изучаются изолированно. Помимо точности ответов в каждом испытании и параметров Q-обучения, аналитический конвейер также позволяет рассчитать индивидуальные наклоны траекторий обучения на основе линейной смешанной модели, что может быть использовано при работе с более крупными выборками.
Здесь необходимо разделять две разные цели, поскольку они не являются эквивалентными. Первая заключается в том, чтобы подтвердить, что батарея тестов такого рода может быть проведена как единый интегрированный 60-минутный сеанс и что каждый из её компонентов вызывает канонический эффект, для которого он был разработан; воспроизведения канонических эффектов достаточно для достижения этой первой цели. Вторая цель — установить, что полученные индексы являются чувствительными и специфичными по отношению к последствиям неблагоприятного детского опыта; воспроизведения канонических эффектов для этого недостаточно, и текущая выборка не обладает достаточной статистической мощностью для такого подтверждения. Таким образом, основной целью данного отчета является техническая и методологическая осуществимость интегрированной батареи тестов: могут ли приобретение угрозы, инструментальное избегание с облегчением, угасание и возвращение страха при воздействии социальных стимулов, а также вероятностное обучение вознаграждению быть освоены одновременно через вегетативные, поведенческие каналы и самоотчеты в рамках одного сеанса, и обеспечивает ли этот процесс получение стабильных, пригодных для повторного использования индивидуальных индексов (дифференциальные контрасты SCR, контраст оперантного облегчения, параметры альфа и бета Q-обучения, а также наклоны индивидуальных траекторий обучения). Оценка изменений в обучении, связанных с ACE, представляет собой вторичную, эксплораторную и иллюстративную цель: описанный здесь анализ индивидуальных различий предназначен для демонстрации измерительных возможностей протокола и предоставления его потенциальных индексов для будущих работ, а не для специфического тестирования путей связи между травмой и обучением. Таким образом, протокол предлагает потенциальные индексы; вопрос о том, обладают ли они чувствительностью и специфичностью, необходимыми для характеристики нейрокогнитивных последствий неблагоприятного детского опыта, должен быть решен на более крупных выборках, в идеале обогащенных представителями крайних групп и предварительно зарегистрированных1,14.