定义

由于经验和实践所带来的相对永久性的行为改变
  • 相对永久性:有些脑区会发生改变,形成记忆
  • 经验或实践
    • negative,儿童不会触碰滚烫的炉子
    • positive,debug之后的成就感
  • 不是所有改变都是学习——有些是身体上的成熟;成熟之后,经验和实践发挥更重要的作用

分类

经典条件反射(Classical Conditioning)
  • 关键要素:
    • 无条件刺激:原始、自然发生的
    • 无条件反应:对无条件刺激的反应
    • 中性刺激 + 无条件刺激 发生了学习 成了条件刺激
  • 产生的原则:
    • 条件刺激必须出现在中性刺激前
    • 条件刺激和中性刺激时间上相接近
    • 必须配对出现多次
    • 条件刺激要显著区别于其他刺激
  • 刺激泛化:对与原始刺激相似的刺激做出反应
  • 刺激分化:机体学会对不同刺激做不同反应
  • 消退、自然恢复:
    • 消退后的几周,条件反应短暂恢复 → 认为学习相对完整
  • 高级条件反射(Higher-Order):已经形成的条件反射可以作为条件刺激
  • 条件刺激必须预测无条件刺激的到来
e.g.
行为主义:华生, Phobias 一种特定类型的经典条件反射——条件性情绪反应(Conditional emotional response, CER) → 产品代言人
替代性条件反射(Vicarious Conditioning):观看他人的反应形成经典条件反射 → 代言人对产品的宣传语
条件性味觉厌恶(Conditioning taste aversion)
厌恶疗法 → 雷电法王,磁暴步兵,杨永信
药物依赖:阿片类兴奋剂、酒精等镇静剂 与 个人原来环境间有某种联系 从而使得戒毒者在旧有环境中容易复吸
生理准备:某些刺激和反应之间的联系更容易形成
操作性条件反射(Operant Conditioning)
  • 通过反应所引发的愉快或者不愉快后果的自主行为(Voluntary behavior)
  • 效果律(Law of effect):带来愉悦的行为倾向于重复
  • 强化reinforcement:伴随某反应的任何事物都有可能造成该反应更有可能出现
    • 初级强化物:满足基本需求的强化物
    • 次级强化物,需要与过去的初级强化物相联系
    • 方法:
      • 正强化(Positive Reinforcement):增加或体验愉悦的结果
      • 负强化(Negative Reinforcement):移除或摆脱不愉悦的事情
    • 强化程序
      • 部分强化效应
      • 固定间隔强化
      • 变化间隔强化
      • 固定比率强化
      • 变化比率强化
notion image
  • 学习的神经基础
    • notion image
      notion image
  • 强化程序
    • notion image
      notion image
  • 惩罚
    • notion image
      notion image
  • 操作性反射的相关概念
    • notion image
  • 应用:塑造与行为修饰
    • notion image
      notion image
    • 应⽤⾏为分析(applied behavior analysis,ABA)
      • 通过当前⾏为分析和⾏为技术来解决与社会相关的问题
      • 如⽤糖果作为强化物,教孤独症⼉童社交技能和语⾔
    • ⽣物反馈(biofeedback)
      • 通过⽣理信息(如⼼率)反馈来创造放松的状态
    • 神经反馈(neurofeedback)
      • 个⼈可以通过程序学习如何产⽣与特定认知或⾏为相关的脑电波或特定类型的⼤脑活动,如提⾼注意⼒、保持专注、放松意识等
      • 治疗注意缺陷多动障碍、控制慢性疼痛、治疗癫痫
认知学习理论 (Cognitive Learning Theory)
  • 潜伏学习(latent learning)——爱德华·托尔曼(Edward Tolman)
    • 不需要强化就能发⽣
      • 第⼀组⽼⿏每天得到奖赏(强化) 第⼆组在第10天⾸次得到奖赏——认知地图cognitive map 第三组⼀直得不到奖赏
        notion image
        📌
        证明没有强化的过程也在学习,潜伏学习
  • 顿悟学习(insight learning)——沃尔夫冈·苛勒(Wolfgang Köhler)
    • 在灵光⼀闪的时刻将问题的所有元素突然集合到⼀起
    • notion image
    • 暖和感(Metcalfe, 1986;Metcalfe & Wiebe, 1987)
      • 每隔15s快速报告自己觉得离答案有多近(“暖”)或多远(“冷”)
      • 顿悟问题:“囚徒出塔”,囚徒在自己的囚室里发现了一根绳子, 但其长度只够他下到塔的一半;他将绳子一分为二,接在一起, 成功逃脱了,请问他是怎么做到的?
      • notion image
  • 习得性无助(learned helplessness)——马丁·塞利格曼(Martin Seligman)
    • 由于过去屡次失败⽽⽆法采取⾏动来摆脱困境的倾向
      • 向⼀组狗呈现⼀个⾳调,之后伴随⽆害但会引起疼痛的 电击,狗由于被束缚住,因此⽆法逃脱电击
      • 不再束缚狗,但先前已经学习到“⽆法躲避电击”的狗不会 尝试跳过障碍
      • notion image
      生理机制
    • 中缝背核(the dorsal raphe nucleus) 释放5-羟⾊胺,激活杏仁核(产⽣害怕与焦虑),且降低负责“战或逃” 反应脑区的活跃性(不逃脱或呆滞) 较为古⽼的脑区,⽆法确定哪种应激是可控的
    • 腹内侧前额叶⽪层(ventromedial prefrontal cortex, vmPFC) 能够帮助确定哪些应激是可控的,可抑制脑⼲区域,平复杏仁核反应 从⽽使动物能够有效地应对应激源并表现出控制能⼒
      • notion image
    • 抑郁⾏为 抑郁的⼈看起来缺乏正常情绪,变得有些冷漠,常常待在令⼈ 不愉快的⼯作情境、婚姻或关系中,但⼜不尝试着逃脱或选 择更好的环境 抑郁的⼈过去已经学习到,他们可能⽆法控制⾃⾝所发⽣的 事(Alloy & Clements,1998)
    • 由于过去在数学⽅⾯存在问题,许多学⽣感觉⾃⼰数学能⼒很差
观察学习 (observational learning)
  • 通过观察⾏为模型即他⼈正在做的⾏为,来学习新的⾏为——阿尔伯特·班杜拉(Albert Bandura)
  • 学习/表现差异(learning/performance distinction):学习可以在没有实际执⾏所学⾏为的情况下发⽣
notion image
notion image
  • 观察学习的4种要素AMID
    • 注意(attention)
      • ⼈们可能更容易观察那些看上去与⾃⼰类似的⼈和更有吸引⼒的⼈。
    • 记忆(memory)
      • 学习者必须能够保留已形成的记忆
    • 模仿(imitation)
      • 学习者必须能够再现和模仿榜样的⾏为。
      • 眼睛:“看懂了,会了会了!”⼿:“不,你不会……”
    • 渴望(desire)
      • 学习者必须有执⾏某种⾏为的渴望或动机
      • 成功的榜样是⼈们模仿的绝佳对象,⽽对于失败或受惩罚的⼈,⼈们很少去模仿他们
Loading...
目录
0%
wyaaaattwho
wyaaaattwho
wyaaaattwho
公告

News

  • Our paper Multi-view Consistent Latent Action Learning for World Modeling and Control got accepted by ICML 2026!
  • Our paper TACO: Temporal Consensus Optimization for Continual Neural Mapping got accepted by RSS 2026!
  • Our paper UDON: Uncertainty-weighted Graph-based Optimization for Multi-robot Neural Implicit Mapping got accepted by ICRA 2026!
  • Our paper Leveraging Conditional Dependence for Efficient World Model Denoising got accepted by NeurIPS 2025!
 
目录
0%