正向强化是影响人类和动物行为的重要因素。科学家通过一种称为“操作性条件反射”的学习方式来研究这一现象。简而言之,操作性条件反射通过将某种行为与特定结果相关联,从而塑造该行为。在正向强化中,当个体表现出某种行为时会获得奖励,从而增加该行为在未来再次发生的可能性。
本视频将介绍正向强化的基本原理、一个通用的实验范例以及相关的一些应用。
让我们从讨论正向强化如何起效开始。我们以一个人训练狗坐下为例来说明。最初,当这个人发出“坐下”指令时,狗需要很长时间才坐下;但当狗终于坐下后,人会给予它一根骨头作为奖励。在这里,坐下是受到奖励所鼓励的行为,而这个奖励就是正向强化物。狗随后学会将正向强化物与指令联系起来,并由此学会该行为。下一次当人说“坐下”时,狗会更快地执行,因为它知道奖励是一根骨头。这与负向强化不同,负向强化是指通过移除某种厌恶刺激来增强行为,例如解除项圈带来的压力,这种压力即为负向强化物。在这种情况下,狗学会将负向强化物与指令关联,并学会该行为。于是,狗会知道必须迅速坐下以避免项圈带来的压力。
强化不仅限于动物;对我们人类而言,存在多种类型的正向强化物,能够影响我们的行为。一些更具体的强化物包括食物、金钱以及药物或酒精。此外还有自然强化物,例如在考试中取得好成绩。还有社会性强化物,例如老师在全班面前对某位学生说“做得好”。
正向强化背后的神经生理学机制与大脑中的多巴胺中枢有关。多巴胺是一种与寻求奖励行为相关的神经递质。当实际获得的奖励超出预期时,多巴胺神经元的放电活动会增加,从而增强对奖励的渴望。
了解了正强化背后的原理后,接下来让我们看看如何开展一项研究这一现象的实验。
此类实验的目标是训练动物将一种自主行为与某种结果联系起来,例如将按压杠杆与获得奖励联系起来。许多不同的动物,如小鼠、大鼠甚至鸽子,均可用于研究这一现象。
本实验使用操作性条件反射箱,这是一种带有通风风扇的隔音箱。在此,箱体内配备两个杠杆——一个有效杠杆和一个无效杠杆,分别位于中央食物分发器的两侧。每个杠杆上方设有刺激指示灯,食物颗粒分发器则位于箱体外部。
动物必须在箱内执行某种行为反应才能获得奖励。首先,将动物放入箱内,使其适应新环境。为了强化按压杠杆的行为,必须设置一个有效杠杆:按压后可获得奖励;另设一个无效杠杆:按压后不会获得任何奖励。动物将学会更频繁地按压有效杠杆,以获得更多奖励。每次获得奖励所需的按压次数也可进行调整。
现在您已经了解了如何进行正强化实验,接下来我们来看一些应用实例,其中科学家们利用这种范式来获取有关神经功能的宝贵信息。
研究人员可以测试不同浓度的强化物,以确定浓度与行为强化强度之间的关系。在此实验中,科学家让大鼠适应操作式条件反射箱,在箱内动物学会按压杠杆以获得一定剂量的糖溶液。实验中使用不同浓度的糖溶液,分别记录每种浓度下杠杆按压的次数,以确定浓度对强化效果的影响。结果表明,较高的糖浓度对按压杠杆行为具有更强的强化能力。
正强化的另一个应用是测试注意力。在此实验中,研究人员将大鼠置于一个具有五个孔洞的实验箱中,通过正强化研究其注意力和冲动控制能力。实验设计为:当某一孔洞的灯光亮起时,大鼠必须将鼻部伸入该孔洞,才能在箱体另一侧获得食物颗粒奖励。大鼠对亮灯孔洞的注意力越集中,获得的食物颗粒就越多。
最后,正强化实验也被用于测定学习过程中的神经活动。在本项研究中,首先训练鸽子正确区分两种不同的刺激,并学会点击正确的屏幕以获得作为强化物的食物奖励。随后,为了测量神经活动,在鸽子头部安装电极并执行行为任务。正强化有助于诱发所需的行为反应,从而使科学家能够研究学习反应过程中神经元的放电活动。
您刚刚观看了 JoVE 关于正向强化的简介视频。本视频介绍了正向强化的基本原理,讲解了一个通用的实验范式,并回顾了一些当前的应用。理解正向强化背后的心理学与神经科学机制,有助于科学家揭示影响人类决策的各种因素。一如既往,感谢您的观看!
研究人员通过操作性条件反射来研究行为的学习过程。这种学习方式涉及将某种行为与后果(奖励或惩罚)相关联。如果该后果为奖励,则会强化期望的行为。其中一种强化方式是正强化,即通过人为、自然或社会性强化物对行为进行奖励。采用正强化作为工具的研究有助于揭示与不同行为相关的神经功能的重要细节。
本视频通过一个人…
本视频中的章节
0:00
Overview
0:46
Principles Behind Positive Reinforcement
2:50
Generalized Procedure
4:25
Applications
6:31
Summary