专题篇章 · AI 产品心理学

劳动错觉:让 AI 把努力演出来

第 2 课说等待要有反馈,这一课的结论更反直觉:有些等待根本没必要消灭。展示工作过程的产品,让用户多等几秒,满意度和信任反而更高。这个效应叫劳动错觉(Labor Illusion)。先做实验,再看研究,最后把边界画清。

先做实验 · 两个机器人,你信哪个

同一个问题同时发给两个客服机器人,答案一字不差,区别只在拿到答案的方式。A 秒回,B 花 3 秒把工作日志逐条亮出来再作答。跑完凭直觉投票。

秒回 vs 过程外显 先跑再投
点「同时提问」,两边一起盯着看,留意自己的直觉往哪边偏。

机器人 A · 秒回

0.3 秒直接给答案

「这份合同里的竞业限制条款有什么风险?」
点下方「同时提问」开始

机器人 B · 展示过程

3.5 秒,工作日志逐条亮起

「这份合同里的竞业限制条款有什么风险?」
点下方「同时提问」开始
两边答案一字不差
研究出处 · 让用户多等 60 秒的网站赢了

这个效应出自哈佛商学院 Buell 和 Norton 2011 年的实验。被试在模拟的机票搜索网站上查航班:一组秒出结果,另一组要等 30 到 60 秒,但屏幕上滚动着「正在检查 Delta 航空…正在检查 United…」。结果展示劳动的那组满意度反超,部分条件下被试宁愿选等 60 秒但看得见工作的网站。下面把实验搬给你亲手跑。

复刻 Buell & Norton 的机票实验 0 / 2 版已试
两个版本各搜一次。真实实验里劳动版要等 30 到 60 秒,这里压缩成几秒,意思到位就行。
上海 PVG → 西雅图 SEA · 10 月 14 日
选好版本,点「搜索航班」
该版满意度
--
机制一句话:人用看得见的努力,推断看不见的质量。搜索到底查得细还是查得糙,用户没法直接看见,于是拿「屏幕上的工作量」当质量的代理指标。咨询师当场给方案显得不值钱,说「容我回去分析三天」反而显得专业,同一回事。
动手装配 · 把 AI 的努力摆上台面

工程上你有三根现成的杠杆:推理模型的思考过程、RAG 的检索来源、Agent 的工具调用日志。它们原本是调试信息,摆上台面就成了体验资产。三个开关逐个拨开,看右边的聊天界面多出什么、体感可信度涨多少。

过程外显装配器 可信度 42
思考过程外显

把思维链摊开:分了几种情况、在哪换过思路,让用户看见推理的骨架。

检索来源逐条亮出

「已检索 3 个来源」加上可点开的条目,答案挂上可查验的出处。

工具调用日志

查了什么、读了什么、比对了什么,一步一行摊在屏幕上。

体感可信度
42
「答得挺快,但这话我敢直接转给 HR 吗…还是再问问别人。」
帮我查一下:员工试用期被辞退,赔偿怎么算?
思考了 4 秒 ⌄
用户问的是试用期解除的赔偿…得分两种情况:公司拿得出「录用条件不符」的证据,和拿不出的…先查劳动合同法原文再作答,避免凭印象给数字。
已检索 3 个来源《劳动合同法》第 21 条《劳动合同法》第 39 条劳动争议司法解释(一)
search_law("试用期 解除 赔偿") · 3 条结果 read_doc(劳动合同法 §21, §39) cross_check(司法解释一 §44)
分两种情况:公司能证明你「与录用条件不符」的,可以解除且无需赔偿;拿不出证明的属于违法解除,按 2N 标准赔偿。注意举证责任在公司一侧,你只需保留录用通知和考核记录。
全开之后清点一下,你收获的可远超一个错觉:① 看得见的努力制造了劳动错觉,这是本课;② 来源和日志给了用户可核验的抓手,这是第 5 课信任校准的主角;③ 用户顺带看懂了系统的工作方式,心智模型自己长出来了,这是第 8 课的主题。一鱼三吃,头部产品把调试信息搬上台面,图的就是这三层。
火眼金睛 · 揪出假劳动

过程展示有真有假。下面三个界面都在「展示努力」,逐个判断:真劳动,还是假表演?拆穿的代价,三题做完揭晓。

假进度找茬 0 / 3
样例 ② 和 ③ 是活的,多盯几秒再下判断。
样例 ① · 检索日志
检索「二手房 定金 退还」· 4 篇
读取《民法典》第 587 条
比对 2 个近似判例
定金能退的前提是对方违约或双方协商解除 [民法典 §587],你这种情况属于卖方违约,可主张双倍返还。
样例 ② · 深度思考中
正在深度思考…
已思考 0 秒
样例 ③ · 进度条
4%
为什么假劳动是信任炸弹:被拆穿一次,用户会把这套把戏泛化到你产品的每个角落,之后真实的检索日志、真实的思考过程,都会先被当成表演审视一遍。劳动错觉的红利建立在「劳动真实发生」上,造一次假,真的也跟着贬值。
边界三问 · 演之前先过三关

劳动错觉好用,但有边界。三道题,每道对应一条实践红线,做完这一课的杠杆就能放心用了。

第一问 · 什么时候该收着演 选一个
下面三个场景,哪个该收起过程展示、直奔结果?
A用户第一次用你的产品,生成一份年度经营分析
B翻译按钮,用户每天要点几十次
C法律条款审查,结果对错用户自己难验证
第二问 · 演多久算过头 选一个
过程展示的时长,红线画在哪?
A用户能忍多久,就演多久
B真实劳动花了多久,就最多演多久
C比竞品略长一点,显得更下功夫
第三问 · 能不能故意拖慢 选一个
后端 0.4 秒算完了,产品经理提议硬加 3 秒延迟、播一段「努力动画」,接吗?
A接,反正实验证明慢一点用户更满意
B驳回,实验的前提是劳动真实发生,硬加的 3 秒是造假
C折中,加 1.5 秒,用户察觉的概率低
出处与延伸:劳动错觉主实验见 Buell & Norton (2011), The Labor Illusion: How Operational Transparency Increases Perceived Value, Management Science;后续研究把话题扩展为运营透明度(Operational Transparency),Buell, Kim & Tsay (2017) 在餐厅场景验证了双向透明还能同时提升顾客满意与员工表现。原始论文里常被漏读的一条前提:劳动错觉只在结果合格时生效,答案砸了,用户看过的努力过程只会变成新的槽点:查了 12 篇文档还答成这样?

✅ 这一课想和你分享的