峰终定律:用户只记得峰值和结尾
诺奖得主卡尼曼发现:人对一段体验的记忆评分,几乎只由最强烈的那一刻(峰)和最后一刻(终)决定,和平均水平、持续时长关系不大。这条定律直接回答一个预算问题:最贵的模型、最多的优化精力,该花在会话的哪个位置。这一课五个实验,逐个上手。
一次 10 轮的 AI 会话,每轮体验打 0 到 10 分。四个剧本轮流点开,看平均分(工程仪表盘量的)和记忆分(用户脑子里存的,近似算法:峰值与结尾的平均,出自卡尼曼)怎么背离。重点看剧本③:平均分四个里最高,记忆分垫底。
峰终定律的原始证据来自一篇标题就很挑衅的论文:Kahneman、Fredrickson、Schreiber 与 Redelmeier 1993 年发在《Psychological Science》的 When More Pain Is Preferred to Less: Adding a Better End(偏爱更多的痛苦,只因结尾好了一点)。被试要经历两场泡冷水试验,之后回答一个问题:如果必须再来一次,你选哪场。先猜猜多数人怎么选。
一只手泡进 14°C 的冷水里整整 60 秒,然后结束,拿毛巾擦手。
同样 60 秒 14°C,接着再泡 30 秒,水温悄悄升到 15°C:依旧难受,只是没那么刺骨。
这背后是卡尼曼在《思考,快与慢》里反复讲的分工:经验自我承受了每一秒(B 客观上多受 30 秒罪),记忆自我只拿峰值和结尾两帧存档打分。投票时到场的只有后者。1996 年 Redelmeier 与卡尼曼又在真实肠镜病人身上重复了结论:术程从 4 分钟到 69 分钟,事后痛苦评分和时长几乎无关,和峰值疼痛、最后三分钟的疼痛高度相关。这个现象有个专名:时长忽视(duration neglect)。
光看现成剧本还差口气,自己造一条才算懂。下面是一次会话的 10 个节点,点节点在 好(+2)/ 中(0)/ 差(−2) 之间循环切换,右侧两个分数实时算。挑战目标:造一条平均分低于 0、记忆分拉满 +2.0 的曲线。达成的那一刻,徽章会亮。
既然记忆分只认峰和终,推理预算就该按记忆权重发钱。假设一次会话有 100 元推理预算,拖动三个滑块分给 首次交互 / 中段 / 收尾(合计锁死 100),看记忆分和判词怎么变。有一条暗规则先交代:中段挂着语义缓存,质量有 5.0 分兜底,这正是它能省的原因,成本篇讲分层路由时铺过这一段。
预算说完说流程。同一个 Agent 任务「生成季度报告并对外发布」,两种收官编排:A 把外部发布留到第十步压轴;B 把校验挪到第一步,中间产物随做随落盘,第十步只做打包交付加摘要。点你认为记忆分更高的那版。
✅ 这一课想和你分享的
- 记忆分 ≠ 平均分:用户存档的只有峰值和结尾两帧,平均水平没人记得
- 造峰:旗舰模型花在新手期和高价值时刻,缓存秒回也算一个峰
- 护终:校验前置、中间产物落盘,最后一步永远别做全链路里最容易失败的动作
- 中段放心省:便宜模型加语义缓存兜底,省下的钱挪去两头买记忆分