峯終定律:用戶只記得峯值和結尾
諾獎得主卡尼曼發現:人對一段體驗的記憶評分,幾乎只由最強烈的那一刻(峯)和最後一刻(終)決定,和平均水平、持續時長關係不大。這條定律直接回答一個預算問題:最貴的模型、最多的優化精力,該花在會話的哪個位置。這一課五個實驗,逐個上手。
一次 10 輪的 AI 會話,每輪體驗打 0 到 10 分。四個劇本輪流點開,看平均分(工程儀表盤量的)和記憶分(用戶腦子裏存的,近似算法:峯值與結尾的平均,出自卡尼曼)怎麼背離。重點看劇本③:平均分四個裏最高,記憶分墊底。
峯終定律的原始證據來自一篇標題就很挑釁的論文:Kahneman、Fredrickson、Schreiber 與 Redelmeier 1993 年發在《Psychological Science》的 When More Pain Is Preferred to Less: Adding a Better End(偏愛更多的痛苦,只因結尾好了一點)。被試要經歷兩場泡冷水試驗,之後回答一個問題:如果必須再來一次,你選哪場。先猜猜多數人怎麼選。
一隻手泡進 14°C 的冷水裏整整 60 秒,然後結束,拿毛巾擦手。
同樣 60 秒 14°C,接着再泡 30 秒,水温悄悄升到 15°C:依舊難受,只是沒那麼刺骨。
這背後是卡尼曼在《思考,快與慢》裏反覆講的分工:經驗自我承受了每一秒(B 客觀上多受 30 秒罪),記憶自我只拿峯值和結尾兩幀存檔打分。投票時到場的只有後者。1996 年 Redelmeier 與卡尼曼又在真實腸鏡病人身上重複了結論:術程從 4 分鐘到 69 分鐘,事後痛苦評分和時長几乎無關,和峯值疼痛、最後三分鐘的疼痛高度相關。這個現象有個專名:時長忽視(duration neglect)。
光看現成劇本還差口氣,自己造一條才算懂。下面是一次會話的 10 個節點,點節點在 好(+2)/ 中(0)/ 差(−2) 之間循環切換,右側兩個分數即時算。挑戰目標:造一條平均分低於 0、記憶分拉滿 +2.0 的曲綫。達成的那一刻,徽章會亮。
既然記憶分只認峯和終,推理預算就該按記憶權重發錢。假設一次會話有 100 元推理預算,拖動三個滑塊分給 首次交互 / 中段 / 收尾(合計鎖死 100),看記憶分和判詞怎麼變。有一條暗規則先交代:中段掛着語義緩存,質素有 5.0 分兜底,這正是它能省的原因,成本篇講分層路由時鋪過這一段。
預算説完説流程。同一個 Agent 任務「生成季度報告並對外發布」,兩種收官編排:A 把外部發布留到第十步壓軸;B 把校驗挪到第一步,中間產物隨做隨落盤,第十步只做打包交付加摘要。點你認為記憶分更高的那版。
✅ 這一課想和你分享的
- 記憶分 ≠ 平均分:用戶存檔的只有峯值和結尾兩幀,平均水平沒人記得
- 造峯:旗艦模型花在新手期和高價值時刻,緩存秒回也算一個峯
- 護終:校驗前置、中間產物落盤,最後一步永遠別做全鏈路裏最容易失敗的動作
- 中段放心省:便宜模型加語義緩存兜底,省下的錢挪去兩頭買記憶分