饭饭TXT > 学习管理 > 《说服人要懂心理学》作者:[美]苏珊·魏因申克【完结】 > 说服人要懂心理学.txt

第 5 章 胡萝卜与棍棒

作者:美-苏珊·魏因申克 当前章节:12438 字 更新时间:2026-6-22 20:41

我们先从狗的唾液讲起。

1849年,伊万·巴甫洛夫在俄国一个小乡村出生。他的父亲是一位牧师,而伊万起初也就读于神学院,后考入大学学习自然科学。随后,他开始使用动物进行消化系统研究。巴甫洛夫是一位研究成果丰富、学术态度严谨的科学家。照片里的他总是蓄着浓密的大胡子,表情凝重。1904 年,巴甫洛夫获得诺贝尔医学奖。

巴甫洛夫在研究消化系统的过程中,发现了一个令人惊讶的现象。当时,他正在测量狗在消化过程中分泌的唾液量。他注意到狗在吃饭前就开始分泌唾液。实际上,在看到食物的一刹那,狗就开始分泌唾液了。

后来,他又发现,在食物送到之前,狗只要听到送食物的研究员推开实验室大门发出的铃铛声就会分泌唾液,听到来喂它的研究员的脚步声也会分泌唾液。食物已经和其他事物配成了对,如脚步声或铃铛声。巴甫洛夫围绕对刺激的自然反应进行了一系列实验。他把这种自然反应称作“古典限制”,即经典条件反射,其工作原理如下。

首先,将两个事物配对,一个是刺激(食物),一个是反应(分泌唾液):

刺激(食物) → 反应(分泌唾液)

接下来,加入另一个刺激:

刺激 1(食物) + 刺激 2(铃铛声) → 反应(分泌唾液)

渐渐地,就可以去掉最初的刺激,由后加的刺激引发反应:

刺激 2(铃铛声) → 反应(分泌唾液)

你肯定会疑惑,这些内容跟说服别人有什么关系?毕竟,你的目的肯定不是让别人分泌唾液呀!

说服别人自发做事

经典条件反射是理解自发行为的起点。要想说服别人做一件事,其中一个方法就是把这件事变成一个自然而然的行为。

如果人们可以自然而然地做一件事,那么这件事做起来就容易多了。实际上,很多行为都和巴甫洛夫的经典条件反射一样。

我把经典条件反射原理应用到了教学中。我给美国 1000 强公司的员工以及一些非盈利组织的工作人员授课,也在大学里授课。我喜欢给自己的课多几次课间休息。

学生通常会利用课间休息在走廊里聊天或在教室里查收邮件、发短信。课间休息结束后,我希望他们能回到教室并迅速进入听课状态。这里,我就利用了经典条件反射原理。一到课间休息,我就会播放音乐,并打开教室的门。

课间休息结束后,我会关掉音乐,并走到门口准备关门。

刺激 1(教师说:“好,下面我们继续。”) → 反应(学生回到座位并安静下来)

然后,加入刺激 2:

刺激 1(教师说“好,下面我们继续。”) → 刺激 2(音乐停止,且/或教师走到门口关门) → 反应(学生回到座位并安静下来)

最后,得到如下结果:

刺激 2(音乐停止,且/或教师走到门口关门) → 反应(学生回到座位并安静下来)

另一个利用经典条件反射原理的实例是:我希望学生在我走向活动挂图或白板并提问时就开始讨论:

刺激 1(教师问:“你们怎么认为?有没有人愿意说说?”) → 反应(学生各抒己见)

然后,加入刺激 2:

刺激 1(教师问:“你们怎么认为?有没有人愿意说说?”) → 刺激 2(教师走向活动挂图或白板,摘下笔帽,挑起眉毛看着学生) → 反应(学生各抒己见)

最后,得到如下结果:

刺激 2(教师走向活动挂图或白板,摘下笔帽,挑起眉毛看着学生) → 反应(学生各抒己见)

这下你应该知道我进行课程管理的两个机密了!

策略 39

一旦人们习惯了做一件事,你就可以以此为基础配对一个新的刺激,使他们对新的刺激产生自然反应。

赌场的运作秘诀

我们来思考下面这些人的共同点:

考试每得一个 A 就能获得金钱奖励的高中学生;

每年都有加薪的职员;

每购买 10 杯咖啡就能免费得一杯的顾客;

将赌币一枚接一枚投进老虎机的拉斯维加斯游客。

根据 B.F. 斯金纳的原理,上述几种人的行为都是被塑造出来的。

每当我看到人们坐在老虎机前重复投币、按下按钮的动作时,脑海里浮现的只有斯金纳的实验。我知道有些读者喜欢赌场,喜欢赌博,喜欢拉斯维加斯,而且会反驳:“拉斯维加斯又不是只有老虎机。”我尽量让这部分内容不冒犯这些读者。

但是,我仍想谈一谈起源于 20 世纪 50 年代的强大的行为分析学理论,以及为什么必须理解行为分析学的工作原理才能更好地说服别人。

20 世纪 50 年代,斯金纳在巴甫洛夫条件反射的基础上引进了一个新概念。斯金纳的研究重点不再是刺激和反应,而是用老鼠和鸽子做实验来研究奖励如何影响行为,他称为“操作”条件(与巴甫洛夫的“经典”条件相反)。

斯金纳并不常用“奖励”这个说法,他更倾向于把奖励称作“强化”。这是有原因的,稍后我会解释。

斯金纳的理论是这样的:如果你希望增加某种行为出现的频率,那就强化(奖励)这个行为。如果你希望减少某种行为出现的频率,那就不要强化这个行为。这听起来像是常识,但斯金纳并未止步于此,而是研究发现了背后的科学道理。斯金纳的基本理念如下:

行为 → 强化 → 重复该行为

比如:

学校成绩单上有一个 A → 得到 5 美元 → 得更多的 A

再比如:

按下按钮 → 机器奖励钱 → 继续按下按钮

再比如:

按时交报告 → 获得表扬:“按时完成作业,做得好!” → 继续按时交报告

不仅如此,斯金纳还研究了其他问题,比如应该给予哪种奖励、什么时候给、奖励的频率和数量等。要想说服别人,你就要了解人类行为中一些细微却十分关键的细节。

可以设想这样的场景:你想让一个人去扔垃圾、写报告或参与投票选举,于是绞尽脑汁地想办法说服他:“也许我应该付他(她)点报酬。给现金好呢还是给礼物好?”

就在这时,成千上万的人坐在赌场里,却没有人花钱请他们来赌博(按下老虎机的按钮)。实际上,他们是在花钱按这个按钮(大多数情况下,他们都会输钱)。听我这么一说,你是否也对赌场的运作秘诀感到好奇了呢?你是否觉得自己也应该了解这些秘诀呢?

在讨论赌场的运作秘诀之前,我们先来谈谈老鼠。

五项基本强化机制

假设你把老鼠关在一个带有操纵杆的笼子里。只要老鼠按下操纵杆,就会得到一个丸子。丸子就是奖励:

行为 → 强化 → 重复该行为

在老鼠这个实验中,具体行为机制如下:

按下按钮 → 得到丸子 → 重复按下按钮

如果你更改实验设定,不让老鼠每按一次操纵杆就得到一个丸子,结果会怎样呢?

斯金纳测试了无数组不同场景,发现他可以预测并控制老鼠按下操纵杆、得到丸子的频率和速度。丸子发放的频率不同,老鼠按下操纵杆的次数和速率也有所不同。同样,基于时间间隔长短发放丸子或基于操纵杆被按下的次数发放丸子对老鼠按操纵杆的次数和速率产生的影响也不同。

斯金纳将这些不同的情形称为“机制”,并确定了 5 种基本机制。

连续强化  老鼠每按一次操纵杆,就发放一个丸子。

固定间隔  固定发放丸子的时间间隔,如间隔 5 分钟。5 分钟间隔过后,老鼠在首次按下操纵杆时会得到一个丸子。

变化间隔  每隔一段时间发一次丸子,但时间间隔不固定。有时间隔 1 分钟,有时间隔 5 分钟,有时则间隔 3 分钟等。

固定比率  不根据时间来进行强化,以操纵杆被按下的次数为强化依据。比如,操纵杆每被按下 10 次或 5 次,老鼠就会得到一个丸子。根据操纵杆被按下的次数来进行强化,而这个次数是固定的。

变化比率  根据操纵杆被按下的次数进行强化,至于按多少次能够得到丸子则是不固定的。有时按 5 次就能得到一个丸子,有时则需要 10 次、3 次,等等。

实验证明,老鼠(以及人)的行为基于你所使用的强化机制,且这些行为是可预见的。下文将继续介绍如何利用强化机制来影响人的行为。

策略 40

仅仅给予奖励是不够的。要想让你提供的奖励发挥效用,应先选择正确的强化机制。

连续强化:说服他人尝试新事物

每次女儿期末考试成绩被评为“优”,你都会奖励她零花钱,这就是连续强化机制。只要成绩被评为“优”(做出目标行为),她就能得到零花钱(钱就是强化)。

每当员工按时交报告时,你就会提出表扬,这也是持续奖励机制。每次报告按时完成(目标行为),你就提出表扬(表扬就是强化)。

当你需要形成一个新的行为习惯时,持续奖励是最有效的。但是,一旦该行为习惯稳定下来,就要启用其他强化机制。

使用连续强化机制时,目标行为会在初始阶段频繁出现,因为这个人(老鼠或狗)在学习该行为。但是,随着时间推移,该行为开始断断续续地出现。连续强化的缺点在于目标行为很可能随着强化的停止(即取消零花钱的奖励,或不是每次表现好都能得到表扬)而停止。

策略 41

尝试建立新的行为习惯时,只要对方做出目标行为就给予奖励(连续强化)。

策略 42

一旦目标行为在连续强化机制下形成,就要改用其他奖励机制,保证该行为得以继续。

变化比率:说服他人持续做出某一行为

员工有时会得到表扬,有时却不会,这就是变化比率机制。

玩家在老虎机上玩了 56 轮之后赢钱了,这也是变化比率机制。大多数赌博游戏都以变化比率机制为基础。拉下老虎机的操纵杆 10 次之后,玩家能赢得一次奖励,而下一次奖励到来之前,玩家需要再玩 52 轮。

站在员工或玩家的角度,这个变化比率机制是不可预测的。强化的依据是目标行为出现的次数,但这个依据总是在变化。员工或玩家不知道奖励会在何时到来,是再次作出目标行为之后,还是重复目标行为 30 次、5 次,抑或 100 次之后?

正因为不知道下一次强化何时到来,员工或玩家才会一次又一次地重复该行为。

这就意味着变化比率机制能够带来持久效果。即使停止了强化,已经形成的行为习惯仍会持续很长一段时间。按照心理学家的说法,变化比率机制下的行为“抵制消亡”。

策略 43

要想确保一个行为习惯持久,就要按照变化比率机制进行强化。

变化间隔:打造稳定的行为习惯

乔治负责管理一家实验室,并需要定期接受政府的检查。他知道检查员会来,但不知道准确的时间。也许是这个月,也许是 3 个月之后,又或许是半年后。检查员总是喜欢给人“惊喜”。

因此,乔治认为最好让实验室时时刻刻都处于达标状态,这样,遇上检查员的随机检查时,实验室才能被评为“优秀”。在这个案例中,遵循所有规章制度与要求是目标行为,被评为“优秀”则是强化。

检查员会时不时过来检查,但周期不固定,也无法预测。因此,这是一个变化间隔机制。可以想见,大多数情况下,乔治的实验室都能达到检查员的要求,因为他处于变化间隔机制之下,而且他还会在很长一段时间里继续重复目标行为。(因为,变化间隔机制下的行为“抵制消亡”。)

如果你的目标是说服他人定期做一件事,但工作量不大,那么变化间隔机制就非常适合。

乔治很可能会每月对自己的实验室做一次检查,确保检查员来时一切处于最佳状态,但又不会每天进行检查。长期来看,频繁自查并不能给自己带来更多奖励(这是变化比率机制的奖励方式)。因此,我们期待的目标行为不会被大量重复,但会定期且稳定地进行。

但是,如果要形成新的行为习惯,变化间隔机制则不是一个好选择,因为奖励不够频繁,不足以稳定目标行为与奖励之间的关系。应先使用连续强化机制确立目标行为,然后再改用变化间隔机制。

策略 44

希望对方定期、稳定地做出目标行为但又不需要大量重复时,可以选择变化间隔机制。

固定比例:使目标行为频繁发生

假设你经营一家咖啡店,并向顾客发放优惠卡。每购买 10 杯咖啡,就能获赠一杯免费咖啡。每购买一杯咖啡,店员就会在顾客的优惠卡上盖一个图章。这就是固定比例机制。

研究表明,这种机制会带来大量目标行为(顾客为了买够 10 杯咖啡会在短时间内频繁光顾),但在顾客得到她那杯免费咖啡之后,会进入一段间歇期,目标行为发生的次数会减少(顾客会减少光顾咖啡店的次数)。

离目标越近动力越大

人们在完成目标之后会进入间歇期,这是无法避免的。你可以让他们从头再来(再给他们一张新的优惠卡,重新累计购买的咖啡数量),或者重新设定一个奖励更高的目标。不过,也可以采取一些办法提高目标行为的出现频率。

兰·凯威茨拿咖啡店的优惠卡做过一项实验。他设计了两种优惠卡,分别发给两组实验对象。

优惠卡 A  有 10 个方格可以盖图章,实验对象拿到优惠卡时,每个方格都是空白。

优惠卡 B  有 12 个方格可以盖图章,实验对象拿到优惠卡时,前两个方格已经盖好图章。

优惠卡盖满图章需要多长时间呢?两种优惠卡需要的时间是否一样呢?不论拿到的是哪种优惠卡,每位参与者都要买够 10 杯咖啡才能得到一杯免费咖啡。那么,不同的卡会引发不同的行为吗?

答案明显是肯定的。尽管完成目标都需要购买 10 杯咖啡,但优惠卡 B 的持有者比优惠卡 A 的持有者更快完成了目标。

这就是目标梯度效应 (goal-gradient effect)的结果。首次研究目标梯度效应的科学家是克拉克·赫尔,他于 1934 年用白鼠做了相关实验。在他的实验里,在通道中奔跑以获得实物的老鼠越接近终点奔跑的速度就越快。

目标梯度效应表明,随着人们越来越接近目标,他们的行动速度也会加快。因此,当顾客看到自己的优惠卡上已经有两个图章、已经向最终目标迈出了第一步时,即便前两杯咖啡并不是自己喝的,他们也加快了购买咖啡的速度。

凯威茨还发现人们喜欢参与奖励计划。与未参与奖励计划的顾客相比,持有优惠卡的人更喜欢笑,与店员交谈的时间更长,说“谢谢”和给小费的频率也更高。

与已经完成的相比,人们更关注未完成的

这个提示虽小,却对用好固定比例机制很重要。具敏贞针对以下哪一项更能激励人们完成目标做了一项实验(2010):

a. 关注已经完成的;

b. 关注尚未完成的。

答案是 b,当人们将注意力放在尚未完成的任务上时会更有动力继续下去。

这个实验告诉我们,使用固定比例机制时,要时刻提醒人们距离目标完成还有多远,这一点十分重要。

策略 45

使用固定比例机制会使目标行为大量发生,但得到奖励之后,频率会有所降低。

策略 46

使用固定比例机制时,告诉人们距离目标完成还有多远将极大地激励他们,不要只告诉他们目标完成了多少。

固定间隔机制的效果略逊一筹

当你每年给员工加一次薪水时,使用的就是固定间隔机制。在这种机制下,人们只有在强化即将到来之际才会付出更多努力。比如,你会每年对员工进行一次工作评估,届时双方会就工作中需要改善的地方达成一致意见。

但事实可能是这样:一开始员工会作出一些改变,可惜不久就会故态复萌;11个月之后,员工会开始改进自己的工作,因为一年一度的评估已经临近,加薪也将随之而来。你所制定的固定间隔机制不能很好地保持行为的连贯性。

要想达到更好的效果,应该先利用连续强化机制让员工做出目标行为,随后改用变化比率机制或变化间隔机制使员工持续地改进自己的工作表现。

策略 47

避免将奖励发放的时间间隔固定下来,这种强化机制的效果逊于其他强化机制。

老虎机:巴甫洛夫与斯金纳

让我们再回到老虎机这个话题,这个赌博机器实际上综合了巴甫洛夫的经典条件理论和斯金纳的操作条件理论。

刺激(明亮的灯光与噪音) → 行为(投进钱币并按下按钮) → 有时获得 A 强化(金钱)

刺激(明亮的灯光与噪音) → 行为(投进钱币并按下按钮) → 总能获得 B 强化(明亮的灯光与噪音)

赌场既把明亮的灯光与噪音用作强化,又把它当做刺激,形成了一个令人欲罢不能的循环。

刺激(明亮的灯光与噪音) → 行为(投进钱币并按下按钮) → 总能获得 B 强化(明亮的灯光与噪音此时已成为下一个刺激) → 行为(投进钱币并按下按钮) → 有时获得 A 强化(金钱),同时总能获得 B 强化(明亮的灯光与噪音),如此循环往复。

赌场老板十分聪明,这个办法十分奏效。

逐步强化

心理学学生之间流传着这样一个故事,某个大学心理学系的一个班级利用“行为塑造法”这个操作理念让教授在讲课途中离开了教室。这个班级的学生在上课前提前安排好了一切。

他们计划给这位教授一系列的强化。起初,当教授走进教室时,所有学生都不理他(无强化),直到他朝门口看去。讲课过程中,教授时不时会看向门口。当他这么做时,学生的注意力就会暂时集中起来。

每当他看向门口,学生就会聚精会神地看着他。聚精会神听讲就是强化。老师都喜欢学生对自己所讲的内容表现出兴趣并认真听讲。

不久,这位教授就开始频繁看向门口。在班里一位学生发出秘密信号之后,整个班级都不再强化看向门口这个动作。他们换了一个动作来强化,每当教授向门口跨出一步,所有学生就会聚精会神听讲。

学生继续塑造教授的行为(向门口移动、手臂伸向门口的方向、触摸门、转动门把等),直至他离开教室为止。

我很肯定这只是一则都市传说,是一位心理学教授为了解释“行为塑造”这个概念而编造出来的。但是,现实中确实可能发生这样的事情。

“行为塑造”的官方定义是:对连续接近的辨别强化。根据操作条件的原则,任何得到强化的行为都会增加。但是,如果你的目的是确立新的行为习惯,那么是没有办法强化这个行为的,只能选择一个能够引发目标行为的旧习惯来强化。

一旦旧习惯稳定下来,就可以停止对它的强化,另选一个与目标行为更接近的行为来强化。

案例:塑造“洗手”的习惯

凯蒂负责管理医院的护士。她希望其中一个名叫乔安妮的护士经常洗手。洗手对于照顾病人来说十分重要,但并非所有医护人员都能慎重地对待这件事。

凯蒂也曾跟乔安妮讨论过这件事,但没能改变她不经常洗手的习惯。事实上,凯蒂觉得她越是要求乔安妮洗手,乔安妮就洗得越少。凯蒂决定试试行为塑造法。

为了帮乔安妮塑造新行为,凯蒂制订了一份计划。

凯蒂先从寻找让乔安妮洗手的机会开始。

等乔安妮走向洗手池时,凯蒂就开始行动。只要乔安妮向洗手池跨出一步,凯蒂就开始微笑着和她聊天。一开始乔安妮只是无意地走向洗手池,不过没关系。

只要乔安妮走向洗手池,凯蒂就会笑着称赞她。比如,称赞她对上一个病人照顾得很好。凯蒂知道乔安妮喜欢听到别人夸她、喜欢跟人聊天,因此这两件事对乔安妮来说就是有效的强化。坚持几天之后,乔安妮走向洗手池的习惯就稳定下来了。

接下来,凯蒂开始寻找下一个需要塑造的行为。走向洗手池不是凯蒂的最终目标,让乔安妮触摸洗手池是她的下一个目标。

新计划实施的第一天,凯蒂看到乔安妮走向洗手池时什么话都没说。但是,在乔安妮碰到洗手池的一刹那,凯蒂就开始微笑着称赞她。一连几天凯蒂都对乔安妮触摸洗手池的动作作出了回应。

行为塑造计划的最后一步是让乔安妮洗手。于是,凯蒂不再因乔安妮触摸洗手池而称赞她或跟她聊天。

她耐心等待,直到乔安妮打开水龙头洗手时才采取行动。乔安妮的手上一出现肥皂泡沫,凯蒂就会微笑着跟她聊天,聊天内容当然少不了对她的夸赞。随后几天凯蒂会继续这么做,直到洗手这个新的行为习惯确立为止。

看到这里,你可能会感叹:“哇!塑造一个这么小的行为却要花费这么多心思。”行为塑造确实需要花费很多心思。要想成功,还必须做到以下几个关键点。

注意观察 。你必须提高警惕,才能及时发现对方作出接近目标行为的动作。

选对强化方式 。每次强化都应该在行为开始时进行。适合乔安妮的强化方式是称赞与聊天。不论是什么操作条件(行为塑造是操作条件的一种形式),都必须小心选择强化方式。若选择的强化方式不被对方认可,行为塑造就不会成功。比如,你选择聊天作为强化,而对方根本不喜欢你,与你聊天当然无法强化目标行为。

及时强化 。如果行为与强化之间间隔时间过长,那你很可能强化了其他行为。人们对强化的反应是下意识的。如果凯蒂等乔安妮洗完手两个小时之后才找她聊天,那么乔安妮就不会把强化与目标行为联系起来。

付出努力,耐心等待 。行为塑造会消耗很多时间。它不仅需要你在场,还要求你细心寻找适合的行为来塑造。

如果目标行为基本上是无意识的,或至少能够成为下意识行为,那么行为塑造法是最有效的。行为塑造对于有生理基础、简短、幅度小的行为最有效。

策略 48

当某种行为不存在而无法对其强化时,可以先通过行为塑造法引导对方做出这个行为。

选择正确的奖励方式

斯金纳操作条件的关键在于选择正确的强化(奖励)方式。如果斯金纳选择用硬币来奖励按下操纵杆的老鼠,恐怕就看不到老鼠频繁按下操纵杆了。对于老鼠来说,钱不是正确的强化方式。

同样,老鼠喜欢的丸子对于人类来说恐怕也不是有效的强化方式。你必须根据不同对象选择适合的强化方式。有时要想选对强化方式还需要一点技巧。

比如,为了鼓励销售团队使用新购买的客户关系管理软件(CRM),你决定奖励下个月使用 CRM 软件满 30 次的销售人员一次拉斯维加斯免费游。

这个办法有什么问题呢?它可能奏效,也可能失败。可能的失败原因如下。

在这个案例中,你采用的方法与固定比率机制(使用 CRM 软件满 30 次就能得到奖励)类似。我说“类似”是因为你加上了 30 天这个条件。但是,你还没有做任何事来确立这个行为。我的建议是,销售人员每使用一次 CRM 软件,就给他们一点小小的鼓励,然后再用你计划好的固定比率机制。这个小小的鼓励可以是公开每个人每周使用 CRM 软件的次数(公开认可就是强化),也可以是在销售人员使用 CRM 软件时给予表扬。

对于某些人来说,拉斯维加斯免费游也许不算奖励。也许有人不喜欢拉斯维加斯,又或许他们觉得花费太多时间去旅行导致陪家人的时间太少。对于这些人来说,拉斯维加斯免费游就不是一个有效的强化。

很多东西都可以作为强化方式。下面,我列举几个例子(不一定都适用于工作场合):

金钱;

食物;

演唱会或体育赛事的门票;

珠宝;

衣服;

表扬;

欣赏;

自主权;

性。

只要对方想要,就可以作为强化方式。

给予奖金的承诺会刺激人体释放多巴胺

布莱恩·克努森对公司的薪水和奖金计划进行了研究,发现若公司向员工作出发奖金的承诺,就会提高员工大脑中伏隔核的活跃程度。当人们想念可卡因、烟草或任何使人上瘾的物质时,大脑同一个部位也会表现出相同的活跃性。这是因为人体释放了多巴胺。另外,人体分泌多巴胺导致伏隔核活跃程度提高之后,作出冒险行为的概率也会提高(人们想念令人上瘾的物质时的反应也是如此)。

策略 49

要选择能够打动人的奖励,否则不会实现奖励效果。

奖励的时机

一旦选定了奖励与强化机制(连续的、变化的,等等),就要及时把奖励交到对方手里。要想发挥这个奖励的最大效果,一定要让人们把奖励与他们当下的行为联系起来。

举例说明,假设你使用的是连续强化机制来帮助一位团队成员确立某个新的行为习惯。每次只要他准时出席会议,就会得到如下表扬:“谢谢你,吉姆,来这么早。”

这句话一定要在他走进会议室的一刹那就说出来。如果你等到几天之后再表扬他:“周一的会你能准时参加真是太好了。”这份表扬的效果就会减弱不少。

当然,也不要在你期待的行为发生前就给予表扬(“我会对你提出表扬,但我希望你先遵守当前这个截止日期”)。只有在目标行为发生之后再给出奖励,才能发挥奖励的最大效用。

策略 50

既然准备了奖励,就要在目标行为发生后立即把奖励交到对方手里(根据你所使用的强化机制)。

策略 51

既然准备了奖励,一定要在目标行为发生后给予奖励,在目标行为发生前给予奖励是没有效果的。

负强化

到目前为止,我列举的都是正强化的案例。这些案例中,我们都给予对方想要的东西,也获得了我们想要的行为。

  行为 →    强化      → 重复该行为

按时递交报告 → 获得表扬:“做得好! → 继续按时递交报告没有超过截止日期。”

 得到 A →  得到 5 美元    → 得到更多 A

我们还未讨论过负强化这个话题。人们通常会混淆负强化与惩罚,其实两者并不完全一样。负强化会对人的行为产生很大影响,而惩罚的效果则略逊一筹。

同样,我们先看白鼠的实验,然后再讨论人的情况。把白鼠关进笼子里,然后对其进行电击。你教白鼠按下操纵杆来停止电击。这个电击就是负强化。

负强化也是强化,因为它的使用增加了目标行为出现的频率。但它又是消极的,因为白鼠按下操纵杆(作出目标行为)是为了让电击消失。

 行为   → 强化  → 重复该行为

按下操纵杆 → 电击消失→ 重复按下操纵杆

现在我们看一个人的案例。乔希望一位名叫凯文的员工保持工作区域的整洁。

      行为 → 强化  → 重复该行为

清理工作区域 → 强化  → 继续清理工作区域

乔首先尝试正强化。他决定,每次只要看到凯文清理工作区域就表扬他,比如:“凯文,看到你这儿这么整洁,我真是高兴啊!”

清理工作区域 → 得到表扬 → 继续清理工作区域

但这个方法不起作用。凯文依然不爱清理自己的工作区域。乔认为问题在于表扬对于凯文来说并非一个有效的强化。凯文不在乎是否得到表扬,至少他不在乎是否能得到乔的表扬。

乔决定不再另找正强化,而要试试负强化。乔知道凯文受不了自己在他身边晃悠、不信任他、并以命令的口吻吩咐他做这做那。如果乔时常来凯文的身旁晃悠,并催促他清理工作区域,这一定能成为负强化。

乔认为使用负强化能让凯文更有规律地清理工作区域。

      行为 → 强化 → 重复该行为

清理工作区域 → 强化(乔不再查岗、不再唠叨) → 继续清理工作区域

使用负强化时,因为作出某个行为能够停止或避免一个人不喜欢的事情,所以该行为出现的频率得以提高。和正强化一样,你必须找出这个人不希望看到的事情是什么。

正是因为负强化的存在,斯金纳才不喜欢用“奖励”这个词。奖励暗示着你给对方的东西是他们想要的。若使用“强化”这个词,斯金纳讨论的范畴就不仅仅是奖励,而是任何能够使目标行为频繁出现的事物。强化这个词更加中性,包含了负强化的可能性。

策略 52

可以利用负强化来说服他人做某件事。找出人们不希望看到的事情,如果能帮他们避开这件事,也算一种“奖励”。

惩罚

什么是惩罚?它跟负强化是一回事吗?或者,两者有所区别?它的效果与负强化相比孰优孰劣?

到目前为止,我们已经讨论过两种方式:一种是给对方想要的(正强化),另一种是拿走对方不想要的(负强化)。惩罚与上述两种强化都不同,因为惩罚是为了让他人减少某种行为发生的频率。

你的目的不再是增加某种行为发生的频率(正强化和负强化都是为了达到增强的效果)。相反,你要用一个人不希望看到的事情来让他减少某个行为发生的频率。

惩罚的结果可能适得其反

实施惩罚的结果甚至会适得其反。丹尼尔·平克在自己 2009 年出版的《动力》(Drive )一书中介绍了格尼茨的研究(2000)。格尼茨的研究表明,实施惩罚会招致更多你不愿见到的行为。

一家托儿所决定对放学时所有接孩子迟到的家长实施罚款,罚款金额按分钟计算。托儿所的初衷是通过惩罚让所有家长都准时来接孩子放学。

但现实却事与愿违。实施罚款后,接孩子迟到的家长数量却明显增长了。原因在于双方关系发生了变化。在实施罚款前,迟到的家长会担心给托儿所的职员造成不便:“如果我去晚了,托儿所职员就不能按时回家了。”但是,当这变成金钱交易后(迟到=多付钱),家长对于迟到的内疚感就不复存在了。他们乐意多付钱。

惩罚也能起作用,但效果远不如正强化和负强化。让人们停止做一件事会花费很多精力,相比之下,寻找一个替代行为并让人们习惯这个替代行为更简单。

在影响行为方面,强化的效果明显而持久,而惩罚却只在实施惩罚过程中有效。一旦停止惩罚,你不想看到的行为就立刻回来了。

策略 53

奖励你希望看到的行为,忽略你不希望看到的行为。惩罚不如奖励有效。

目录
设置
设置
阅读主题
字体风格
雅黑 宋体 楷书 卡通
字体大小
适中 偏大 超大
保存设置
恢复默认
手机
手机阅读
扫码获取链接,使用浏览器打开
书架同步,随时随地,手机阅读
首 页 < 上一章 章节列表 下一章 > 尾 页