专题篇章 · AI 产品心理学
劳动错觉:让 AI 把努力演出来
第 2 课说等待要有反馈,这一课的结论更反直觉:有些等待根本没必要消灭。展示工作过程的产品,让用户多等几秒,满意度和信任反而更高。这个效应叫劳动错觉(Labor Illusion)。先做实验,再看研究,最后把边界画清。
先做实验 · 两个机器人,你信哪个
同一个问题同时发给两个客服机器人,答案一字不差,区别只在拿到答案的方式。A 秒回,B 花 3 秒把工作日志逐条亮出来再作答。跑完凭直觉投票。
秒回 vs 过程外显
先跑再投
点「同时提问」,两边一起盯着看,留意自己的直觉往哪边偏。
机器人 A · 秒回
0.3 秒直接给答案
「这份合同里的竞业限制条款有什么风险?」
点下方「同时提问」开始机器人 B · 展示过程
3.5 秒,工作日志逐条亮起
「这份合同里的竞业限制条款有什么风险?」
点下方「同时提问」开始
两边答案一字不差
研究出处 · 让用户多等 60 秒的网站赢了
这个效应出自哈佛商学院 Buell 和 Norton 2011 年的实验。被试在模拟的机票搜索网站上查航班:一组秒出结果,另一组要等 30 到 60 秒,但屏幕上滚动着「正在检查 Delta 航空…正在检查 United…」。结果展示劳动的那组满意度反超,部分条件下被试宁愿选等 60 秒但看得见工作的网站。下面把实验搬给你亲手跑。
复刻 Buell & Norton 的机票实验
0 / 2 版已试
两个版本各搜一次。真实实验里劳动版要等 30 到 60 秒,这里压缩成几秒,意思到位就行。
FlightSeek上海 PVG → 西雅图 SEA · 10 月 14 日
选好版本,点「搜索航班」
该版满意度
--
机制一句话:人用看得见的努力,推断看不见的质量。搜索到底查得细还是查得糙,用户没法直接看见,于是拿「屏幕上的工作量」当质量的代理指标。咨询师当场给方案显得不值钱,说「容我回去分析三天」反而显得专业,同一回事。
动手装配 · 把 AI 的努力摆上台面
工程上你有三根现成的杠杆:推理模型的思考过程、RAG 的检索来源、Agent 的工具调用日志。它们原本是调试信息,摆上台面就成了体验资产。三个开关逐个拨开,看右边的聊天界面多出什么、体感可信度涨多少。
过程外显装配器
可信度 42
思考过程外显
把思维链摊开:分了几种情况、在哪换过思路,让用户看见推理的骨架。
检索来源逐条亮出
「已检索 3 个来源」加上可点开的条目,答案挂上可查验的出处。
工具调用日志
查了什么、读了什么、比对了什么,一步一行摊在屏幕上。
体感可信度
42
「答得挺快,但这话我敢直接转给 HR 吗…还是再问问别人。」
帮我查一下:员工试用期被辞退,赔偿怎么算?
思考了 4 秒 ⌄
用户问的是试用期解除的赔偿…得分两种情况:公司拿得出「录用条件不符」的证据,和拿不出的…先查劳动合同法原文再作答,避免凭印象给数字。
用户问的是试用期解除的赔偿…得分两种情况:公司拿得出「录用条件不符」的证据,和拿不出的…先查劳动合同法原文再作答,避免凭印象给数字。
已检索 3 个来源《劳动合同法》第 21 条《劳动合同法》第 39 条劳动争议司法解释(一)
✓ search_law("试用期 解除 赔偿") · 3 条结果✓ read_doc(劳动合同法 §21, §39)✓ cross_check(司法解释一 §44)
分两种情况:公司能证明你「与录用条件不符」的,可以解除且无需赔偿;拿不出证明的属于违法解除,按 2N 标准赔偿。注意举证责任在公司一侧,你只需保留录用通知和考核记录。
全开之后清点一下,你收获的可远超一个错觉:① 看得见的努力制造了劳动错觉,这是本课;② 来源和日志给了用户可核验的抓手,这是第 5 课信任校准的主角;③ 用户顺带看懂了系统的工作方式,心智模型自己长出来了,这是第 8 课的主题。一鱼三吃,头部产品把调试信息搬上台面,图的就是这三层。
火眼金睛 · 揪出假劳动
过程展示有真有假。下面三个界面都在「展示努力」,逐个判断:真劳动,还是假表演?拆穿的代价,三题做完揭晓。
假进度找茬
0 / 3
样例 ② 和 ③ 是活的,多盯几秒再下判断。
样例 ① · 检索日志
✓ 检索「二手房 定金 退还」· 4 篇
✓ 读取《民法典》第 587 条
✓ 比对 2 个近似判例
✓ 读取《民法典》第 587 条
✓ 比对 2 个近似判例
定金能退的前提是对方违约或双方协商解除 [民法典 §587],你这种情况属于卖方违约,可主张双倍返还。
样例 ② · 深度思考中
正在深度思考…
已思考 0 秒
样例 ③ · 进度条
4%
为什么假劳动是信任炸弹:被拆穿一次,用户会把这套把戏泛化到你产品的每个角落,之后真实的检索日志、真实的思考过程,都会先被当成表演审视一遍。劳动错觉的红利建立在「劳动真实发生」上,造一次假,真的也跟着贬值。
边界三问 · 演之前先过三关
劳动错觉好用,但有边界。三道题,每道对应一条实践红线,做完这一课的杠杆就能放心用了。
第一问 · 什么时候该收着演
选一个
下面三个场景,哪个该收起过程展示、直奔结果?
A用户第一次用你的产品,生成一份年度经营分析
B翻译按钮,用户每天要点几十次
C法律条款审查,结果对错用户自己难验证
第二问 · 演多久算过头
选一个
过程展示的时长,红线画在哪?
A用户能忍多久,就演多久
B真实劳动花了多久,就最多演多久
C比竞品略长一点,显得更下功夫
第三问 · 能不能故意拖慢
选一个
后端 0.4 秒算完了,产品经理提议硬加 3 秒延迟、播一段「努力动画」,接吗?
A接,反正实验证明慢一点用户更满意
B驳回,实验的前提是劳动真实发生,硬加的 3 秒是造假
C折中,加 1.5 秒,用户察觉的概率低
出处与延伸:劳动错觉主实验见 Buell & Norton (2011), The Labor Illusion: How Operational Transparency Increases Perceived Value, Management Science;后续研究把话题扩展为运营透明度(Operational Transparency),Buell, Kim & Tsay (2017) 在餐厅场景验证了双向透明还能同时提升顾客满意与员工表现。原始论文里常被漏读的一条前提:劳动错觉只在结果合格时生效,答案砸了,用户看过的努力过程只会变成新的槽点:查了 12 篇文档还答成这样?
✅ 这一课想和你分享的
- 把真实的劳动亮出来:思考过程、检索来源、工具日志,调试信息搬上台面就是体验资产
- 用可核对的细节演:日志条目要能和答案里的引用对上,可验证的过程越看越可信
- 展示时长锁在真实耗时之内:呈现节奏可以放慢,超出真实劳动时长就是造假
- 高频任务收着演:第一次展示过程建立信任,之后直奔结果,别拿用户的耐心铺排面