CHAPTER 6 · EP 40

感知性能 · 等待与过程设计

第 6 章 · 第 40 讲 · 16:10

时长 16:10音色 云健 · 男声章节 6

同步字幕

章节导航(点击跳转)

0:00开场 · 这一集解决什么问题1:28
1:28第一块表 · 为什么用户会高估等待1:57
3:25第二块表 · 首字时间是最长的那根杠杆1:42
5:07第三块表 · 三条定律中的前两条1:41
6:49第四块表 · 空手的等待与四个动作1:57
8:46第五块表 · 三道时间线决定产品形态1:39
10:26第六块表 · 两个教科书案例1:55
12:21第七块表 · 劳动错觉与它的三条红线2:16
14:37收尾 · 可带走的判断清单1:31
解读全文

pm40-m6 · 感知性能 · 等待与过程设计

模块:M6 产品手感 | 课节:3 节(工程指标及格了,用户为什么还骂慢 / 等待心理学:难受的从来不是那 5 秒 / 劳动错觉:让 AI 把努力演出来)
来源:xueai.miyang.cn(小山学堂 · 洛小山《学 AI 产品,从入门到精通》),本页为二次演绎的解读与音频稿件

一、本集要解决什么

监控面板上接口响应四秒多,P99 压在及格线以内,工程团队该做的优化都做了,用户还是在评论区骂慢。这一集的答案只有一句:你和用户在看两块不同的秒表。

服务器那块表记物理事实,从请求发出到完整答案落地,五秒就是五秒。用户那块表记心理事件,从按下发送开始走,看见第一个字就停,中间没有刻度、没有解释、没有东西看,于是被估长了。打分、续费、卸载全都发生在用户那块表上。

AI 产品有三个天生毛病:慢(推理要时间)、会错(幻觉压不净)、不透明(用户看不见它在干嘛)。工程手段短期内只能缓解,但感知是可以设计的。


二、能力地图:这一集给你五件武器

能力解决什么成本落地动作
首字时间(TTFT)治理用户秒表只记到首字中(需接流式)接流式、先出提纲、分段返回
前瞻计时管理无反馈等待被高估两三成极低超 1 秒给反馈,超 3 秒给进展
排队三定律不确定 / 没解释 / 空着手极低给预估、给阶段汇报、给中间产物
三档定档策略形态选错才是事故低1 秒直接出 / 1–10 秒流式 / 超 10 秒转异步
劳动错觉过程展示提升可信度低(调试信息上移)思考过程、检索来源、工具日志外显

三、原理拆解

3.1 首字时间是最长的那根杠杆

总时长锁死 5 秒,只动 TTFT:首字从 5 秒压到 0.5 秒,总时长一秒没省,体感分翻两三倍;反过来 TTFT 不动、总时长 5 秒压到 4 秒,体感几乎不动。

原因:用户的开表点是按下发送,收表点是看见第一个字。首字之后注意力交给阅读,边读边到的内容几乎不记进等待的账本。

3.2 前瞻计时与高估误差

Zakay 与 Block 的注意闸门模型(1990 年代起):注意力押在时间本身上越多,主观时长越膨胀,紧张情绪再拉长一截。无反馈等待的高估误差,实验里两三成很常见。服务器记 5 秒,用户记 6 秒半。

3.3 排队三定律(Maister, 1985)

  1. 不确定的等待更长 —— 没有刻度,大脑按最坏情况焦虑,第 10 秒开始怀疑它挂了。
  2. 没解释的等待更长 —— 裸转圈只回答「死没死」,回答不了「在干嘛」,大脑自动脑补最坏剧本。
  3. 空手的等待更长 —— 白屏 3 秒体感顶别人 10 秒;提纲先出,手里不空,秒表就停了。

3.4 三档定档(Nielsen, 1993;上溯 Miller 1968)

  • 0.1 秒:感觉是瞬间。
  • 1 秒:思路不被打断。
  • 10 秒:专注等待的极限。

对应:1 秒内直接出(不加过渡动画);1–10 秒必须流式 + 进度/阶段说明;超 10 秒转后台任务 + 完成通知。

3.5 劳动错觉(Buell & Norton, 2011)

哈佛商学院实验:机票搜索网站秒出结果 vs 等 30–60 秒但屏幕滚动「正在检查 Delta…正在检查 United…」,展示劳动的那组满意度反超,部分条件下被试宁愿选等 60 秒但看得见工作的网站。

机制:人用看得见的努力,推断看不见的质量。搜索查得细还是糙用户看不见,于是拿「屏幕上的工作量」当质量的代理指标。


四、案例:两个教科书级样本

案例一 · 迪士尼排队牌

入口牌子写「从此处起 40 分钟」,实际多数时候 30 分钟排到。游客非但不恼,反而觉得赚了 10 分钟。

队伍本身也被设计过:蛇形折返让你每隔几十秒往前挪一步,沿途布景和预演短片让手里有东西看。同样的物理时长,被拆成「一直在前进、一直有事干」。

案例二 · 休斯顿机场行李

加人提效把平均等待压到 8 分钟,投诉照旧。细看数据:下机走到转盘只要 1 分钟,剩下 7 分钟全程干站着。
后来方案一秒没提速:到达口改远、行李分到最远转盘,乘客多走 6 倍的路,走到时行李刚好出来。总时长没变,投诉几乎清零。

共同结论:走路的人觉得自己在推进,干站的人才觉得自己在等。难受的从来不是时长本身,是不确定、没解释、空着手。


五、实操:把一个 25 秒的任务改到可交代

场景:用户让 Agent 审一份 50 页采购合同,全程约 25 秒,原始界面只有「分析中…」,焦虑值 92。

动作界面长出的东西对应定律
给预估时长且报偏高「预计 30 秒左右」(按历史耗时偏高值)定律 ①
阶段性汇报进展读取合同 12/50 页 → 提取付款与违约条款 → 交叉核对双方义务定律 ②
先流式出提纲① 付款条款账期 90 天偏长 ② 违约金上限缺失 ③ 知识产权归属含糊定律 ③
转后台 + 完成通知「🔔 转入后台,完成后通知我」形态切换

任务一毫秒没变快,用户从「干等」变成「盯着它干活」:知道要等多久、知道它在干嘛、手里有东西读、握着随时能走的出口。


六、实践提示

提示一 · 考核表里给 TTFT 单开一行

只盯总时长的 P99,等于没在考核用户真正在意的东西。把首字时间写进报表、写进告警、写进验收标准,让它和总时长平起平坐。

提示二 · 先修呈现,再修延迟

四个等待设计动作(给预估、阶段汇报、先出提纲、转后台)一个都不需要换更快的模型。先修呈现再修延迟,账单便宜一个量级。

提示三 · 预估宁高勿低

报 40 分钟实际 30 分钟是惊喜,反过来是背叛。按历史耗时的 偏高值 报,等待从无底洞变成倒计时。

提示四 · 假劳动是信任炸弹

被拆穿一次,用户会把这套把戏泛化到产品的每个角落,之后真实的检索日志、真实的思考过程都会先被当成表演审视。劳动错觉的红利建立在「劳动真实发生」上。

提示五 · 高频任务收着演

翻译按钮每天点几十次,第一次展示过程建立信任,之后直奔结果。别拿用户的耐心铺排面。


七、审查清单

上线前逐条过:

  • 首字时间是否已进报表与告警,是否设了目标值
  • 1 秒以上的等待是否都有反馈,3 秒以上是否都有进展
  • 超过 10 秒的任务是否已转异步 + 完成通知
  • 预估时长是否按偏高值报,有无「报低被打脸」的历史
  • 阶段汇报的条目是否真实、能否与最终答案的引用对上
  • 是否存在假进度、硬加延迟等装饰性表演
  • 高频路径上的过程展示是否已收敛为「首次展示、之后直奔结果」
  • 错误兜底是否到位(答非所问会把慢一起写进差评)

八、约束说明

本集所有手段都有明确约束边界,越界即反效果:

  1. 只在结果合格时成立:劳动错觉只在答案合格时生效。答案砸了,看过的努力会变成新槽点——「查了 12 篇文档还答成这样?」
  2. 展示时长锁在真实耗时之内:呈现节奏可以放慢,超出真实劳动时长就是造假。后端 0.4 秒算完却硬加 3 秒「努力动画」,是造假不是设计。
  3. 不能替代真实性能:感知性能不等于真实性能。呈现手段把 5 秒变得可交代,但不能把 60 秒变没。真实延迟突破形态阈值时,仍需工程投入。
  4. 假劳动会连坐:一次造假,之后所有真实过程展示都会被先当表演审视。
  5. 题库内容不入音频:本集涉及的测验类页面仅作集页自测卡渲染,不进音频。

八之二、常见误区

误区为什么错正确做法
把加载动画做得更精致来代替提速动画只回答「死没死」,不回答「在干嘛」,也不给刻度给预估时长 + 阶段汇报,动画只是最后一层装饰
拿后台日志和用户对质「明明只有 5 秒」用户那块表确实走了更久,不是撒谎承认体感,改界面,而不是改用户的认知
先花两个季度压延迟,再回头看差评呈现改动几乎零成本,压延迟每一秒都要真金白银先修呈现,再谈是否值得为那几秒花钱
把调试信息全量倒给用户高频路径上过程展示是负担首次展示建立信任,之后直奔结果
在结果还没达标时开过程展示答案砸了,努力过程会变成新的槽点先把结果质量拉到及格线,再谈劳动错觉
用弹窗解释「模型正在深度思考」解释不等于进展,用户要的是可核对的细节展示真实发生的检索条目、工具调用、阶段切换

八之三、落地节奏(建议四个迭代)

  • 第一迭代 · 度量:把首字时间接入报表与告警,与总时长并列;拉一份「用户抱怨慢」的工单,逐条对应到后台真实耗时,摸清体感与物理的差值分布。
  • 第二迭代 · 消除空白:全量扫描所有超过 1 秒的等待态,先保证「有反馈」;超过 3 秒的位置补上进展或阶段说明。这一步几乎不改后端。
  • 第三迭代 · 流式与提纲:在 1–10 秒区间的主路径上接流式,先出提纲再出正文;给关键任务补「预估时长(偏高值)」。
  • 第四迭代 · 形态切换:梳理所有超过 10 秒的任务,改为后台任务 + 完成通知;同步设计通知中心的召回路径,避免任务做完没人看。
  • 第五迭代 · 过程外显:在用户难自行验证的场景(法务、合规、数据核对)开放检索来源与工具日志,高频场景保持收敛。

八之四、判断清单(可直接进评审会)

  1. 这个功能的用户秒表从哪一刻开始走、到哪一刻停?我们的考核指标覆盖到了吗?
  2. 首字时间和总时长,这一版先动哪一个?为什么?
  3. 这个等待有没有刻度?报的是偏高值还是偏乐观值?
  4. 用户在这一段等待里手里有没有东西?是先出提纲还是先出正文?
  5. 这个任务的真实耗时落在哪一档?形态选对了吗?有没有该异步却还在同步干等的?
  6. 我们要外显的过程,是不是真实发生的劳动?展示时长有没有超过真实耗时?
  7. 如果这个任务是高频的,过程展示在第几次之后应该收起来?
  8. 万一答案质量不达标,这些外显的努力会不会变成新的槽点?

八之五、指标怎么定:把体感写进验收标准

工程侧的三个指标(P50 / P95 / P99 总时长)不能丢,但要补两行,否则你永远测不到用户那块表:

  • 首字时间(TTFT):从用户按下发送到屏幕上出现第一个字。按功能分档设目标,对话类建议压到 1 秒内,复杂生成类不超过 2 秒。
  • 感知完成时间:用户主观认为「出来了」的时刻,通常用首字时间加一个阅读缓冲来近似。它和总时长的差值,就是界面欠的债。
  • 空白时长:从请求发出到界面第一次给出反馈的那段。硬要求是 1 秒内必须破零,3 秒内必须出现进展。这一项最容易被漏,也最便宜。
  • 预估命中率:报出的预估时长与实际耗时的偏差分布。要求宁高勿低,目标是 80% 以上的请求在预估时间内完成。
  • 异步转办率:超过 10 秒的任务里,有多少被用户主动转后台。这个数字长期偏低,往往说明用户不知道还有这条路。

把这五项放进周报,和转化率、留存放在一起看。你会发现一件有意思的事:总时长没变的那几周,投诉先掉了。

八之六、给 PM 的一句话

延迟是工程问题,等待是产品问题。工程团队对物理时长负责,你要对那块开在用户心里的表负责。两者不冲突,但顺序不能反:先用几乎零成本的呈现改动把等待变得可交代,再用省下来的说服力去争取真正需要花钱的那部分优化。用户不会为你的 P99 鼓掌,只会为「我知道它在干嘛」留下来。

九、出处与延伸

  • 感知时间的注意闸门模型:Zakay & Block 系列研究(1990 年代起)
  • 排队心理定律:Maister, D. H. (1985) *The Psychology of Waiting Lines*
  • 响应时间三档:Nielsen, J. (1993) *Usability Engineering*(阈值上溯 Miller 1968)
  • 休斯顿机场案例:Alex Stone, *Why Waiting Is Torture*, 纽约时报(2012)
  • 劳动错觉:Buell & Norton (2011), *The Labor Illusion: How Operational Transparency Increases Perceived Value*, Management Science
  • 运营透明度扩展:Buell, Kim & Tsay (2017) 餐厅场景下的双向透明

十、本集要点速记

  • 两块秒表:服务器计物理时长,用户从发送计到首字
  • 别让界面空白:无反馈等待被放大两三成
  • 预算先压首字:接流式、先出提纲、分段返回
  • 错误当场兜住:时间记忆跟着情绪走,答非所问会把慢一起写进差评
  • 三档定档:1 秒直接出 / 1–10 秒流式 / 超 10 秒异步
  • 先修呈现再修延迟:大部分「太慢」差评,模型一行不用动

十一、收尾:本集与前后课程的接缝

  • 往前接:流式输出、模型路由、语义缓存、Agent 进度汇报,在前面章节里是工程手段,在这一集里全部多了一重身份——心理学开关。判断什么时候该为心理效果去拨它,是本集的主题。
  • 往后接:时间记忆会被情绪改写,这条机制的完整展开在峰终定律那一课;中间态与信任的关系在信任校准一课细讲;过程展示让用户心智模型自己长出来,则是后面心智模型一课的主角。
  • 横向看:劳动错觉一鱼三吃——错觉本身、可核验的抓手、心智模型的建立,头部产品把调试信息搬上台面,图的就是这三层。
来源:xueai.miyang.cn(小山学堂 · 洛小山《学 AI 产品,从入门到精通》)
本页为二次演绎的解读与音频稿件,配套音频见本集 MP3。