Положительное подкрепление является важным фактором, влияющим на поведение человека и животных. Ученые изучают этот феномен с помощью типа обучения, называемого «оперантным обусловливанием». Проще говоря, оперантное обусловливание формирует поведение, связывая его с конкретным следствием. Для положительного подкрепления последствием является вознаграждение за выполнение действия. Это повышает вероятность того, что подобное поведение повторится в будущем.
В этом видео рассказывается о принципах положительного подкрепления, обобщенном эксперименте и некоторых связанных с этим приложениях.
Давайте начнем с обсуждения того, как работает положительное подкрепление. Мы сделаем это на примере человека, который пытается приучить собаку сидеть. Вначале, когда мужчина говорит собаке сесть, собаке требуется много времени, но когда она садится, мужчина предлагает ей кость. В данном случае сидение – это поведение, поощряемое вознаграждением, которое является положительным подкреплением. Теперь собака учится ассоциировать положительное подкрепление с командой и учится поведению. В следующий раз, когда человек скажет «сидеть», собаке потребуется меньше времени, чтобы сделать это, так как она знает, что награда — это кость. Это отличается от негативного подкрепления, при котором поведение усиливается за счет устранения негативного стимула, такого как давление поводка, которое действует как негативное подкрепление. В этом случае собака учится ассоциировать негативное подкрепление с командой, и учится поведению. Теперь собака будет знать, что нужно быстро сидеть, чтобы избежать давления со стороны поводка.
Подкрепление не ограничивается только животными; Для нас существует множество типов положительных подкреплений, которые влияют на наше поведение. Некоторые из наиболее ощутимых подкреплений – это еда, деньги, наркотики или алкоголь. Существуют также естественные подкрепления, такие как получение хорошей оценки на тесте. Кроме того, существуют социальные стимулы, примером которых является то, как учитель говорит ученику «Хорошая работа» перед классом.
Нейрофизиология положительного подкрепления основана на дофаминовых центрах мозга. Дофамин — это нейромедиатор, связанный с поведением, связанным с поиском вознаграждения. Когда вознаграждение больше, чем ожидалось, возбуждение дофаминовых нейронов усиливается, что, следовательно, увеличивает желание получить вознаграждение.
Теперь, когда у вас есть представление о принципах, лежащих в основе положительного подкрепления, давайте рассмотрим, как провести эксперимент, изучающий этот феномен.
Цель таких экспериментов состоит в том, чтобы научить животное ассоциировать произвольное поведение с последствием, например, ассоциировать нажатие рычага с наградой. Для изучения этого явления можно использовать множество различных животных, таких как мыши, крысы или даже голуби.
В этом эксперименте используется оперантная камера, которая представляет собой звуконепроницаемый бокс с вентиляторами. Здесь камера оснащена двумя рычагами - одним активным и одним неактивным, которые расположены по обе стороны от центрального диспенсера для еды. Стимульный свет расположен над каждым рычагом, а дозатор пищевых гранул расположен снаружи камеры.
Животное должно выполнить поведенческую реакцию в камере, чтобы получить вознаграждение. Сначала животное помещают в камеру, чтобы привыкнуть к новой среде. Для того, чтобы закрепить поведение при нажатии на рычаг, важно иметь один активный рычаг, который будет выдавать награду при нажатии, и неактивный рычаг, который не принесет никакой награды при нажатии. Животное научится чаще нажимать на активный рычаг, чтобы получать больше наград. Количество нажатий на рычаг для каждого вознаграждения также можно регулировать.
Теперь, когда вы знаете, как провести эксперимент с положительным подкреплением, давайте рассмотрим некоторые приложения, в которых ученые используют эту парадигму для получения ценной информации о неврологических функциях.
Исследователи могут протестировать различные концентрации подкрепления, чтобы определить взаимосвязь между концентрацией и силой подкрепления поведения. В этом эксперименте ученые позволяют крысам привыкнуть к оперантной камере, где животные учатся нажимать на рычаг для того, чтобы получить дозу раствора сахара. Используются различные концентрации сахара, и для каждого из них регистрируется количество рычажных нажатий, чтобы определить влияние концентрации на армирование. Это показывает, что более высокие концентрации сахара обладают большей способностью усиливать рычажное нажатие.
Еще одно применение положительного подкрепления включает в себя проверку внимания. Здесь, поместив крысу в камеру с пятью отверстиями, исследователи бихевиоризма изучают внимание и контроль импульсов с помощью положительного подкрепления. Эксперимент устроен таким образом, что при зажигании света крыса должна просунуть свой нос в отверстие, чтобы достать пищевую гранулу, расположенную на противоположной стороне камеры. Чем больше внимания крыса уделит освещенному отверстию, тем больше гранул пищи она получит.
Наконец, эксперименты с положительным подкреплением используются для определения нейронной активности во время обучения. В этом исследовании голубей сначала обучают правильно различать два стимула и узнают, на какой экран нажимать, чтобы получить подкрепляющую пищу. Далее для измерения нейронной активности к голове голубя прикрепляются электроды, и выполняется поведенческая задача. Положительное подкрепление помогает вызвать необходимое поведение, позволяя ученым изучать возбуждение нейронов во время выученной реакции.
Вы только что посмотрели введение JoVE в положительное подкрепление. В этом видео были рассмотрены принципы положительного подкрепления, объяснен обобщенный эксперимент и рассмотрены некоторые современные приложения. Понимание психологии и нейробиологии, лежащих в основе положительного подкрепления, может помочь ученым выяснить факторы, влияющие на принятие решений человеком. Как всегда, спасибо за просмотр!
Исследователи изучают обучение поведению с помощью оперантного обусловливания. Этот тип обучения предполагает ассоциацию поведения с последствием, кот…
Главы в этом видео
0:00
Overview
0:46
Principles Behind Positive Reinforcement
2:50
Generalized Procedure
4:25
Applications
6:31
Summary
Авторские права © 2026 MyJoVE Corporation. Все права защищены.