行为心理学入门 目录 · 学习指南

图文教程 · 全 9 章 · 9 幅插图

行为心理学入门
写给高中生的图文教程

不猜心思,只看行为——一门研究「人做了什么」的科学,也是一门能马上用在自己身上的科学。全书例子都来自你熟悉的教室:同学、老师、考试和手机。

0 / 9 章已完成(进度自动保存在本机浏览器)

怎么用这本教程

  • 一次只看一章。打开后默认只显示一章(约 5–8 分钟),读完点「下一章」,随时关掉,下次从目录接着看。
  • 先看图,再读字。每个知识点都配了一幅插图,画面比文字好记。
  • 章末 3 道快问快答。点开自查,答不上来就翻回对应小节再看一眼。
  • 读完点「记录进度」。目录里的 ✓ 和进度条会自动更新,数据保存在这台设备的浏览器里。

开篇 · 一场科学革命

行为心理学是什么

一百多年前,一群心理学家做了一个大胆决定:先别猜人心里在想什么,先看人做了什么。

教室场景插画:一名学生举手发言,老师和同学看着他
图 1 · 教室是行为发生最密集的地方:举手、提问、走神、点头——都是可以被观察和记录的行为。

心理学的一次「转向」

20 世纪初,心理学家主要靠一种叫「内省法」的办法做研究:请受过训练的人报告自己此刻的感受和想法。问题是——同一杯温水,有人说「微甜」,有人说「没味道」,谁也验证不了谁。你没法打开别人的脑子检查他报告得对不对。

1913 年,美国心理学家约翰·华生发表了一篇宣言式的论文《行为主义者眼中的心理学》,公开主张:心理学要想成为一门真正的科学,就该像物理学研究看得见的运动那样,只研究可观察、可测量的行为,把「意识」「感受」这些没法验证的东西请出实验室。

核心概念

行为主义的三个基本主张

  • 只研究看得见的行为:关注「刺激(S)→ 反应(R)」,不研究猜不透的「意识」。
  • 学习 = 建立联结:一切本领都是后天通过刺激与反应的配对「学」出来的。
  • 人与动物同源:人和动物的学习遵循相同的基本规律,所以可以用动物做实验、再把结论推到人身上。

四位关键人物

后面几章的故事,都围绕这四个人展开。先混个脸熟:

  • 伊万·巴甫洛夫(1849–1936)俄国生理学家。本来研究消化,却意外发现了「经典条件反射」——第 2 章的主角。
  • 约翰·华生(1878–1958)行为主义创始人。发表宣言、设计了著名又充满争议的「小艾伯特实验」——第 3 章的主角。
  • B.F.斯金纳(1904–1990)操作性条件反射大师。研究「行为的结果」如何反过来塑造行为,发明斯金纳箱——第 4、5、6 章的主角。
  • 阿尔伯特·班杜拉(1925–2021)社会学习理论创始人。证明人不用亲身体验,看别人也能学会——第 7 章的主角。

行为主义怎么看你身边的教室

🏫 教室里看行为
  • 老师永远无法直接看见你在想什么,但能看见:你的眼神有没有跟着他走、笔记停在哪一行、笔转得有多快。
  • 行为主义者的做法是:不说「这个学生注意力不集中」这种没法验证的话,而是记录「10 分钟内低头了 4 次」——把模糊的印象变成可观察、可计数的指标。
  • 你每天用的背单词 App 打卡、番茄钟计时,全都是行为主义的思路:先记录和改变行为,结果自然会来。
一句话记住行为主义:别问「他怎么想的」,先问「他在什么情况下会做什么」。接下来两章,我们看行为是怎么被「装进」身体里的。

快问快答

1. 行为主义为什么反对内省法?
答案:因为内省报告无法被他人验证。同一个刺激,不同人报告的感受可能完全不同,而研究者没有任何办法核实——这不符合科学「可重复、可检验」的标准。
2. 「S—R」是什么意思?
答案:S 是刺激(Stimulus),R 是反应(Response)。行为主义认为心理学的任务就是弄清什么刺激引发什么反应,以及刺激和反应之间的联结是如何建立的。
3. 为什么行为主义者支持用动物做实验?
答案:因为他们主张人与动物的学习遵循相同的基本规律。动物实验更好控制变量(如食物、铃声的次数),得出的联结规律可以推广到人类学习。

想深入了解

🎬 视频拓展(20 分钟内)

学习的起点 · 被动的联结

经典条件反射

铃声本来只是声音,上课铃却让人心头一紧——这种「条件反应」是怎么被装进身体里的?

插画:一只狗坐在铃铛旁,铃铛发出声波,旁边有食物碗和箭头示意
图 2 · 巴甫洛夫的经典设置:铃声(中性刺激)与食物反复配对,最终只凭铃声也能引发狗的分泌反应。

一次意外的发现

伊万·巴甫洛夫原本研究的是狗的消化系统。他注意到一个奇怪现象:狗还没吃到食物,光是看见喂食的人或听见脚步声,就开始分泌唾液。换作别人可能当成「狗太馋了」,巴甫洛夫却把它做成了严谨的实验。

他每次喂食前先摇铃。铃声和食物反复配对几次之后,神奇的事情发生了:只摇铃、不给食物,狗也开始流口水。铃声本身对狗毫无意义,却因为总是「跟着食物出现」,变成了食物的信号。

核心概念

实验里的四个角色

  • 无条件刺激(UCS):食物——天生就能引发反应,不用学。
  • 无条件反应(UCR):见到食物流口水——天生的反应。
  • 条件刺激(CS):铃声——原本是中性刺激,反复配对后获得了「信号」身份。
  • 条件反应(CR):只听铃声就流口水——学来的反应。

关键机制一句话:中性刺激 + 无条件刺激,反复配对 → 中性刺激变成条件刺激。前提是配对次数足够多、时间上足够靠近。

教室里的「铃声效应」

🏫 教室里看行为
  • 班主任的脚步声。脚步声(中性刺激)总是和「班主任出现在后门」(让人一惊的事件)配对。一学期后,光是走廊里那串脚步声,就能让全班瞬间安静——安静就是条件反应。
  • 随堂测预警。如果数学老师每次进门都说「把练习册拿出来」接着就小测,一学期后他一推门、还没开口,你就心一紧。让你紧张的从来不是「推门」这个动作,而是推门后面跟着的事。
  • 铃声本身不紧张。上课铃、预备铃都是普通声音,让人起反应的是它长期搭配的东西:被点名、交作业、考试开始。
同样的机制也发生在校外:牙医的钻头声让人头皮发麻,外卖提示音让人莫名饿,手机在口袋里震一下你会「幻听」到它的震动——这些全是被反复配对出来的条件反应。

快问快答

1. 实验前,铃声对狗来说是哪种刺激?
答案:中性刺激。它本来不会引发分泌唾液的反应,只有与食物(无条件刺激)反复配对后,才变成条件刺激。
2. 「只听铃声就流口水」属于 UCR 还是 CR?
答案:CR(条件反应)。UCR 是食物直接引发的天生反应;CR 是条件刺激(铃声)引发的学来的反应。区分关键:由谁引发。
3. 用四概念拆解「听到班主任脚步声就安静」。
答案:UCS=班主任出现并管纪律;UCR=被管时的紧张、收敛;CS=脚步声;CR=一听到脚步声就安静下来。

想深入了解

🎬 视频拓展(20 分钟内)

经典条件反射 · 下篇

恐惧是怎么学会的

「一朝被蛇咬,十年怕井绳」不是修辞——它是一条心理学规律,出自一个著名的、也有争议的实验。

温和的插画:小孩安静地坐在地板上,身边有一只小白鼠和一只白兔
图 3 · 实验中的小艾伯特原本并不害怕小白鼠——恐惧是后来被「配对」出来的。

小艾伯特实验(1920)

华生想验证一件事:恐惧这种情绪,能不能像巴甫洛夫的铃声一样被人为制造出来?他和助手罗莎莉·雷纳找来一名 9 个月大的婴儿「小艾伯特」。

  1. 起点:小艾伯特不怕小白鼠,还会好奇地伸手去摸。
  2. 配对:每次他一摸白鼠,华生就在他身后猛敲铁棒制造刺耳巨响。孩子被吓哭。
  3. 结果:仅仅 7 次配对之后,白鼠一出现,艾伯特就大哭着往后躲——白鼠从「玩具」变成了「恐惧信号」。
核心概念 · 刺激泛化

更惊人的在后面:艾伯特开始害怕一切白色毛茸茸的东西——白兔、海豹皮大衣、圣诞老人面具的白胡子。对白鼠的恐惧「扩散」到了相似的刺激上,这叫泛化(Generalization):和条件刺激长得越像的东西,越容易触发同样的反应。

⚠️ 必须知道的伦理争议

这个实验在今天不可能被批准重做:让孩子受惊吓且没有后续心理疏导,严重违反研究伦理。它提醒我们——心理学既有照亮人性的发现,也有需要被规则约束的过去。学它的结论,不学它的做法。

教室里的恐惧链

🏫 教室里看行为
  • 一次批评的泛化。某次数学课上答错题被当众批评(巨响时刻)→ 开始害怕数学课 → 害怕举手发言 → 甚至路过办公室都绕着走。恐惧不是天生的,是学来的,而且会顺着「相似性」一路扩散。
  • 为什么怕错题本却不怕错题?如果每次订正错题都伴随着被数落,错题本就成了条件刺激——怕的其实不是「订正」这件事本身。
  • 恐惧不会自动消失。巴甫洛夫发现:铃声之后不再给食物,狗的反应会慢慢减弱,这叫消退;但隔段时间又可能出现(自发恢复)。所以躲着不怕的东西只会让恐惧保鲜——越回避,越牢固。
行为主义给出的解药思路叫系统脱敏:把害怕的东西拆成台阶,从最不怕的一级开始,在放松的状态下一点点靠近。比如怕举手发言:先在心里默答一遍 → 课后单独答老师 → 上课答一道最有把握的题。每一步都「安全完成」,恐惧就一层层松开。

快问快答

1. 小艾伯特实验里,无条件刺激是什么?
答案:铁棒巨响。它天生引发恐惧;小白鼠原本是中性刺激,配对后成为条件刺激。
2. 「怕白鼠 → 怕兔子 → 怕白胡子」体现了什么?
答案:刺激泛化——与条件刺激相似的事物也会触发同样的条件反应。相似度越高,泛化越容易。
3. 为什么说「越躲越怕」?
答案:恐惧要靠「安全地反复接触」才能消退;回避让条件刺激从不单独出现、永远带着恐惧的配对,反应得不到消退的机会,反而被保护下来。

想深入了解

🎬 视频拓展(20 分钟内)

主动的学习 · 结果的力量

操作性条件反射

经典条件反射解释了「被动反应」,但解释不了另一件事:为什么学生会主动举手、主动刷题?

插画:透明实验箱里的小白鼠压下杠杆,一粒食物掉进碗里
图 4 · 斯金纳箱:压杠杆(行为)→ 掉食物(结果)→ 压得更勤。行为的结果反过来塑造行为。

斯金纳箱:一只改变心理学的老鼠

把一只饿老鼠放进特制的箱子:里面有一个杠杆,压下它就会掉出一粒食物。老鼠起初乱抓乱撞,某次偶然压到杠杆——食物来了。几轮之后,它学会了直奔杠杆、熟练按压。

B.F.斯金纳由此提出操作性条件反射:行为的结果会反过来改变这种行为再次出现的概率。跟着好结果的行为会被保留和加强,跟着坏结果的行为会被削弱。动物和人都在不断「试错」,用结果给自己的行为投票。

核心概念

行为(按杠杆)→ 结果(食物)→ 行为概率变化(更常按)。注意顺序和经典条件反射相反:那里是「刺激在前,反应在后」,这里是「行为在前,结果在后」——是你自己发出的行为决定了你会得到什么。

两种条件反射,别搞混

经典条件反射与操作性条件反射对比
对比维度经典条件反射操作性条件反射
谁先发生刺激在前(铃声先响)行为在前(先按杠杆)
反应性质被动引发(狗被动听铃)主动发出(老鼠主动探索)
学习内容学习「信号」:什么预示着什么学习「后果」:做什么会有什么结果
代表人物巴甫洛夫、华生桑代克、斯金纳
教室例子听到班主任脚步声就安静举手被表扬后更爱举手
🏫 教室里看行为
  • 举手的正循环。主动举手(行为)→ 答对被老师点头肯定(好结果)→ 以后更爱举手。反过来,如果每次举手都被泼冷水,「举手」这个行为会悄悄消失——很多同学「不爱发言」,其实是被结果训练出来的。
  • 帮忙也是练出来的。主动帮课代表发作业本 → 同学说「多谢,太靠谱了」→ 更愿意帮忙。好行为的「存活」,靠的是环境中真实的正反馈。
  • 拖延同理。刷手机(行为)带来即时快乐(结果)→ 刷得更凶;写作业的奖励却要等几周后的考试才兑现——结果离行为越远,塑造力越弱。这个规律第 6、9 章会反复用到。

快问快答

1. 斯金纳箱里,「行为」和「结果」分别是什么?
答案:行为是压杠杆,结果是掉出食物。食物紧跟着按压出现,使按压行为的频率上升——这就是强化。
2. 经典和操作性条件反射最核心的区别是什么?
答案:顺序与主动性。经典条件反射是刺激在前、机体被动引发反应;操作性条件反射是行为在前、机体主动发出行为,由结果决定行为频率。
3. 为什么说「不爱发言可能是被训练出来的」?
答案:如果举手总伴随尴尬、被否定等坏结果,举手行为的概率就会下降——行为被环境结果塑造,而不是因为「性格天生内向」这么简单。

想深入了解

🎬 视频拓展(20 分钟内)

操作性条件反射 · 核心

强化与惩罚

表扬、扣分、没收手机、取消禁令……教室里每天都在上演的四个开关,你分得清吗?

插画:老师把星星贴纸贴在学生的作业本上,学生很开心
图 5 · 一枚星星贴纸就是最经典的正强化:跟着好行为出现的好东西,让好行为更常出现。

两个维度,四种操作

判断任何一个教育操作,先问两个问题:①行为变多了还是变少了?(强化=变多,惩罚=变少)②是给了东西还是拿走了东西?(正=给予,负=移除)两个问题一交叉,就得到四个开关:

强化与惩罚四象限
类型操作效果教室例子
正强化给出好东西行为↑答对题被老师当众表扬 → 更爱举手
负强化拿走坏东西行为↑全周按时交作业,就免去抄写检查 → 为了免抄写而按时交作业
正惩罚给出坏东西行为↓上课讲话被点名批评 → 讲话变少
负惩罚拿走好东西行为↓自习玩手机被暂时收走 → 玩手机变少
⚠️ 全书最高频误区

「负强化」不是惩罚!很多同学(包括不少大人)一听「负」就以为是坏事。记住口诀:「强化/惩罚」定方向(行为变多还是变少),「正/负」定操作(加东西还是减东西)。负强化是「拿走讨厌的东西」→ 行为变多,它和正强化一样,都是让行为增强的手段。

教室里的开关实录

🏫 教室里看行为
  • 表扬要「具体」。「你真聪明」表扬的是人,行为主义更推荐表扬行为:「你这个解题步骤写得很完整」——被强化的行为才明确知道下一步重复什么。
  • 惩罚的局限。正惩罚(点名批评)往往只能压住行为,不能教出正确行为:讲话被记名字的同学,需求还在,可能改成传纸条。行为主义的主张是:与其只惩罚坏行为,不如强化替代的好行为——认真自习被表扬的人多了,讲话的「观众」就少了。
  • 取消禁令也是负强化。老师说「这周作业全交齐,周五就不用订正错题」——用「拿走讨厌的事」激励行为,比单纯罚款更有效,因为它给了行为一个明确的「出口」。
注意:强化和惩罚的效果取决于当事人觉得什么是好/坏,不取决于老师觉得。你觉得是奖励(周末加练一套卷子),学生可能觉得是惩罚——判断标准永远看行为频率有没有变化。

真实案例:教室里的代币经济

真实案例 · 强化原理正在校园里运行

斯金纳的四象限不是纸上谈兵——中国的学校里就有一批正在运行的「代币经济」:

  • 湖南宁乡虎山特殊教育学校:学校发行 1 元到 50 元五种面额的「德育代币」,文明礼仪、课堂纪律、帮助同学都能挣到代币,攒够了去校园里的「鹿娃爱心超市」兑换文具和玩具。学校的总结里有一条完整的强化闭环:「行为—奖励—实践—强化」。
  • 四川荣县特殊教育学校:「心星超市」用同一套原理(专业名称叫应用行为分析,ABA)——课堂认真听讲、自己穿衣吃饭、主动问好,每个微小的好行为都可能换来一枚代币。老师们的观察是:孩子们在一次次正向反馈里,把「他律」慢慢变成了「自律」。

为什么发代币,不直接发零食?因为代币是次级强化物:它本身不解决任何生理需求,但和「可以换的好东西」反复配对之后,它自己也变成了好东西。而且代币能攒、能换、能延迟满足——攒币换大奖的过程,正好是「为了更大的奖励忍住现在」的练习。

来源:华声在线:宁乡虎山特校德育代币制(2026) · 教育导报:荣县特校「心星超市」实践

快问快答

1. 「按时交作业就免抄写」属于哪种?
答案:负强化。移除厌恶刺激(抄写)来增加目标行为(按时交作业)的频率。方向是行为变多,操作是拿走东西。
2. 「上课玩手机被没收」属于哪种?
答案:负惩罚。拿走好东西(手机/玩手机的自由),让玩手机的行为减少。方向是行为变少,操作是拿走东西。
3. 为什么说表扬「行为」比表扬「聪明」更符合行为主义?
答案:强化必须指向具体行为,行为才知道该重复什么。「聪明」是笼统的、无法复现的;「步骤写完整」「主动帮同学讲题」是具体行为,被强化后能稳定再现。

想深入了解

🎬 视频拓展(20 分钟内)

操作性条件反射 · 进阶

强化的节奏

同样是给奖励,「每次都给」和「有时才给」塑造出的行为,上瘾程度完全不同——短视频就是吃透了这一条。

插画:少年坐在沙发上刷手机,屏幕里飘出星星和礼盒等发光图形
图 6 · 「下一条可能更精彩」——不确定的奖励,比确定的奖励更让人停不下来。

连续强化 vs 间歇强化

斯金纳发现,奖励出现的节奏本身就是一门学问:

核心概念
  • 连续强化:每次做对都给奖励。学得快,但奖励一停,行为消退得也快——因为「没有奖励」很快就成了明确信号。
  • 间歇强化:有时给、有时不给。学习建立得慢一些,但行为极其抗消退——因为没拿到奖励的每一次,都可以被解释成「下次就中了」。

间歇强化里最厉害的一种叫变比率强化:平均每 N 次给一次奖励,但具体是哪一次完全随机。老虎机、抽卡、开盲盒、刷短视频,用的全是它。

教室里的「节奏实验」

🏫 教室里看行为
  • 随机点名为什么可怕。老师「随机抽人回答」比「固定点学号 3 号」高效得多——固定目标会让其他人放心走神,随机目标让每个人都保持在「下一秒可能是我」的轻度紧张里。这就是变比率强化的反面应用:人人都可能被抽中,谁都不敢松懈。
  • 随机抽背的哲学。如果每次都抽你背单词(连续强化),哪天没抽你,你立刻松懈;随机抽背让所有人长期保持复习习惯,因为「这次没抽到」不等于「下次安全」。
  • 短视频是设计出来的。下一条视频大概率平平无奇、偶尔极其精彩——变比率奖励 + 无限下滑的「杠杆」。停不下来不是你意志力差,是产品团队精确利用了斯金纳的发现。
  • 攒券是固定比率。「集齐 5 次小测优秀换免作业券一次」是固定比率强化:目标清晰、干劲稳定,但没有惊喜,动力天花板也可预期。
核心概念 · 消退与自发恢复

奖励彻底停止后,行为会逐渐减少,这叫消退;消退后隔一段时间,行为可能又冒出来一次,叫自发恢复。规律是:间歇强化养出来的行为最难消退——这也是为什么偶尔赢过的游戏最难戒。

快问快答

1. 为什么间歇强化的行为比连续强化的更抗消退?
答案:因为「没有奖励」不能提供明确信号。连续强化下,奖励一停就能察觉变化;间歇强化下,每次落空都和过去的落空一样,个体会继续期待「下一次也许有」。
2. 老虎机用的是哪种强化?
答案:变比率强化——平均每若干次给一次奖励,但哪次给完全随机。它产生的行为频率最高、最难消退。
3. 「随机点名」和「固定点 3 号」效果为何差很多?
答案:固定目标让非目标者进入「与我无关」的间歇真空,走神安全;随机目标把被抽中的可能性均匀摊给每个人,制造全员持续的警觉状态。

想深入了解

🎬 视频拓展(20 分钟内)

行为主义的更新

观察学习

行为主义说「学习要靠亲身试错」,班杜拉回答:不必——看着别人挨表扬、挨批评,你就已经学会了。

插画:教室里孩子们观察一名同学被老师表扬,旁观者若有所思
图 7 · 别人的奖励和惩罚,都是你的教材——这就是班杜拉说的替代强化与替代惩罚。

波波玩偶实验(1961)

斯坦福大学的阿尔伯特·班杜拉做了一个后来极其有名的实验。他让一组儿童观看一位大人殴打、辱骂一个充气玩偶「波波」,另一组儿童看到的是安静玩耍的大人。随后把孩子们单独放进有同样玩偶的房间:

  • 看过攻击示范的孩子,大量复刻了大人的攻击动作,甚至自创了新的「打法」;
  • 看安静示范的孩子几乎没有攻击行为。

孩子们没有亲自打过任何人,也没有得到任何奖励——仅仅通过观察就完成了学习。这对「必须亲身试错才能学」的传统行为主义是一次重大更新。

核心概念
  • 观察学习:通过观察他人的行为及其结果来学习,不需要亲身经历。
  • 替代强化:看到别人因某行为被奖励,自己做出该行为的倾向也会上升。
  • 替代惩罚:看到别人因某行为被惩罚,自己就不太敢做——不用亲身挨罚。
  • 学习 ≠ 表现:观察者可能已经「学会了」但暂时不表现出来;有没有榜样、榜样结果如何,决定什么时候表现出来。

教室里,你每天都在被「示范」

🏫 教室里看行为
  • 优秀作业展的涟漪。同桌因为字迹工整被贴上「优秀作业展」,你回家不知不觉也开始把字写工整——没人要求你,是替代强化在起作用。
  • 「杀鸡儆猴」的原理。老师当着全班批评一个上课玩手机的同学,之后一整天没人玩手机——大家受到的是替代惩罚。它有效的代价是:需要当众惩罚一个人。
  • 风气的传染。「抄作业没被发现还很轻松」被越来越多同学观察到,抄作业就会像涟漪一样扩散;反过来,一个班里如果「认真整理错题的人被普遍认可」,好习惯也会传染。你身边的行为和它们的结果,就是你的隐形教材。
由此能推出一条很实用的结论:选环境就是选榜样。同桌、朋友圈、关注列表里的人天天在给你「示范什么行为值得做」。想改变自己,最省力的办法之一,是先挪到一个有更好榜样的位置。

快问快答

1. 「替代强化」是什么意思?
答案:看到他人因某行为获得奖励,观察者做出同样行为的倾向增强。奖励给了别人,效果落在观察者身上。
2. 波波玩偶实验最重要的结论是什么?
答案:人可以通过纯观察完成学习,不必亲身经历行为与结果的配对;攻击行为可以被示范「教」出来。
3. 「学习≠表现」在教室里如何体现?
答案:学生可能早已通过观察「学会」了某种做法,但只有当环境给出相应预期(如榜样被奖励、无人监管)时才表现出来。所以「没做过」不代表「没学到」。

想深入了解

🎬 视频拓展(20 分钟内)

拓展 · 行为主义的边界

认知的反击

只谈刺激与反应,真的够吗?几个「叛逆者」用实验证明:不打开「脑子里的黑箱」,有些行为根本解释不通。

插画:迷宫俯视图,一条发光的路径从入口通向中心,起点有一只小白鼠
图 8 · 托尔曼的发现:老鼠在迷宫里建的不只是习惯,还有一张「认知地图」。

潜伏学习与认知地图(托尔曼)

爱德华·托尔曼做了两组老鼠走迷宫的实验:A 组每次走到终点都有食物,越走越快;B 组一直没有奖励,成绩平平。第 11 天,托尔曼突然开始给 B 组发奖励——结果 B 组的成绩几乎立刻追平甚至反超 A 组。

这说明 B 组早就在那些「白走」的日子里学会了迷宫——只是没有奖励就不表现出来。托尔曼称之为潜伏学习:学习一直在悄悄发生,没有强化它也在发生。他进一步发现,老鼠抄近路、绕开新障碍的本领,说明它们脑子里形成的是一张认知地图——对整体空间关系的表征,而不是「左转右转」的死记硬背。

核心概念
  • 潜伏学习:没有明显强化时也在发生的学习,等环境给出理由时才显现。
  • 认知地图:个体对环境整体布局形成的心理表征,能灵活指导新路线。

习得性无助(塞利格曼)

1967 年,马丁·塞利格曼做了另一个沉重实验:狗被反复电击又无法逃脱之后,即使后来箱门敞开、轻脚一跳就能逃出去,大多数狗也只是趴在原地忍受——它们已经「学会了」:怎么做都没用。这就是习得性无助。

🏫 教室里看行为
  • 「我这科天生不行」的剧本。某次没考好 → 补了还是没考好 → 第三次连复习都省了。行为主义只看到「复习行为消退了」,习得性无助补上了关键一环:是「努力与结果无关」的预期,关掉了尝试的开关。
  • 破解思路是组合拳。把大目标切成小台阶(行为主义:让每次努力都有看得见的正反馈),同时修正「怎么都没用」的预期(认知层面:用小成功证明努力有用)。第 9 章的目标拆分,同时服务于这两层。
  • 潜伏学习每天都在发生。你没刻意背过教学楼到操场的路,却闭着眼都能走;某天突然听懂了半年前跳过的知识点——都是潜伏学习在兑现。没立竿见影不等于没学到,学习常常在你看不见的地方积累。
认知革命没有推翻行为主义,而是补上了它跳过的「黑箱」:刺激和反应之间,还站着一个会预期、会表征、会解释的大脑。今天主流的学习科学,是两者的合流——用行为主义设计反馈,用认知科学理解过程。

快问快答

1. B 组老鼠成绩「突然反超」说明了什么?
答案:潜伏学习——它们在没有奖励的日子里已经学会了迷宫,只是缺少表现学习的动机;奖励一旦出现,隐藏的学习立刻显现。这挑战了「无强化即无学习」的行为主义信条。
2. 「认知地图」和「背路线」有什么区别?
答案:背路线是固定的刺激—反应序列,遇到封路就失效;认知地图是环境的整体心理表征,能灵活推出新路线(如抄近路、绕障碍)。
3. 习得性无助的三个关键步骤是什么?
答案:①反复经历不可控的失败(怎么努力都逃不掉);②形成「结果与行为无关」的预期;③把这种预期泛化到新情境,连本可以成功的任务也放弃尝试。

想深入了解

🎬 视频拓展(20 分钟内)

毕业章 · 学以致用

用在自己身上

前面八章你一直旁观别人的实验——最后一章,把自己当成实验对象。

插画:洒满晨光的书桌,放着番茄钟、勾选完成的笔记和飘起的小星星
图 9 · 好的学习行为不靠意志硬扛,靠的是一套自己设计出来的「提示—行为—奖励」系统。

习惯回路:给自己装一个斯金纳箱

核心概念 · 习惯回路

提示(Cue)→ 行为(Routine)→ 奖励(Reward)。想让一个学习行为自动发生,三件套缺一不可:明确的启动信号、具体到能直接做的行为、紧跟着的即时奖励。回忆第 4 章的规律:结果离行为越近,塑造力越强。

🏫 教室里看行为
  • 把口号翻译成回路。「我要学好英语」是愿望,不是设计。翻译成行为主义方案:提示=早读铃结束;行为=背 10 个单词;奖励=在日历上打一个大大的勾,攒满 5 个勾,周五给自己一杯奶茶。提示、行为、即时正强化,一个不少。
  • 行为契约。和同桌签一份口头契约:互相当监督人,每天早读互查单词打卡;打卡成功当场互道一句表扬(即时正强化),一周全勤互相请一瓶饮料。公开承诺 + 同伴在场,让「结果」离行为更近。
  • 番茄钟。25 分钟专注 + 5 分钟自由活动,本质是把「远期回报的大任务」切成「即时回报的小单元」——每完成一个单元都有明确的「完工奖励」。

拆掉短视频的「变比率机关」

第 6 章说过,刷不停不是因为意志力差,是因为你在和一个精心设计的变比率强化机对抗。行为主义的打法不是硬扛,而是改造环境:

  • 拆掉提示:关闭 App 的红点和推送,学习时把手机放到另一个房间——没有提示,回路就启动不了。
  • 增加行为成本:想刷就得起身走过去拿,多出来的 20 秒足够让冲动冷掉一半。
  • 用确定的奖励对冲不确定的诱惑:做完一组题积 1 分、攒满换真实奖励——你给自己造的这套「连续强化」,正好对抗那个「偶尔精彩」的变比率机器。
⚠️ 两个常见翻车点
  • 目标太大。「每天背 100 个词」坚持三天就崩,然后触发第 8 章的习得性无助剧本。起步阶段宁可小到可笑:每天 10 个,先让「完成」成为习惯。
  • 奖励太远。「考上大学再奖励自己」没用——结果离行为隔着半年,塑造力趋近于零。奖励要当天兑现,哪怕只是一首歌、一次勾。
像科学家一样迭代:每周花 5 分钟复盘——行为频率变了吗?没变,就改设计(换提示、换奖励、降低难度),而不是骂自己没毅力。行为主义的态度是:行为没变,说明方案没设计好,不是人不行。

快问快答

1. 习惯回路的三要素是什么?
答案:提示(触发行为的信号)、行为(具体可执行的动作)、奖励(紧随其后的即时正强化)。三者齐备,行为才容易自动化。
2. 为什么「把手机放另一个房间」比「忍住不刷」更符合行为主义?
答案:行为主义改造的是环境与提示,不赌意志力。移除提示、提高行为成本,直接降低了刷手机行为的发生概率,从源头瓦解回路。
3. 复盘时发现计划没执行,行为主义视角怎么归因?
答案:行为频率没变=强化方案失效,应修改设计(换提示、缩短奖励距离、降低行为门槛),而不是归因于「我意志力差」这种无法操作的标签。

想深入了解

🎬 视频拓展(20 分钟内)