第 6 章 · 第 40 讲 · 16:10
模块:M6 产品手感 | 课节:3 节(工程指标及格了,用户为什么还骂慢 / 等待心理学:难受的从来不是那 5 秒 / 劳动错觉:让 AI 把努力演出来)
来源:xueai.miyang.cn(小山学堂 · 洛小山《学 AI 产品,从入门到精通》),本页为二次演绎的解读与音频稿件
监控面板上接口响应四秒多,P99 压在及格线以内,工程团队该做的优化都做了,用户还是在评论区骂慢。这一集的答案只有一句:你和用户在看两块不同的秒表。
服务器那块表记物理事实,从请求发出到完整答案落地,五秒就是五秒。用户那块表记心理事件,从按下发送开始走,看见第一个字就停,中间没有刻度、没有解释、没有东西看,于是被估长了。打分、续费、卸载全都发生在用户那块表上。
AI 产品有三个天生毛病:慢(推理要时间)、会错(幻觉压不净)、不透明(用户看不见它在干嘛)。工程手段短期内只能缓解,但感知是可以设计的。
| 能力 | 解决什么 | 成本 | 落地动作 |
|---|---|---|---|
| 首字时间(TTFT)治理 | 用户秒表只记到首字 | 中(需接流式) | 接流式、先出提纲、分段返回 |
| 前瞻计时管理 | 无反馈等待被高估两三成 | 极低 | 超 1 秒给反馈,超 3 秒给进展 |
| 排队三定律 | 不确定 / 没解释 / 空着手 | 极低 | 给预估、给阶段汇报、给中间产物 |
| 三档定档策略 | 形态选错才是事故 | 低 | 1 秒直接出 / 1–10 秒流式 / 超 10 秒转异步 |
| 劳动错觉 | 过程展示提升可信度 | 低(调试信息上移) | 思考过程、检索来源、工具日志外显 |
总时长锁死 5 秒,只动 TTFT:首字从 5 秒压到 0.5 秒,总时长一秒没省,体感分翻两三倍;反过来 TTFT 不动、总时长 5 秒压到 4 秒,体感几乎不动。
原因:用户的开表点是按下发送,收表点是看见第一个字。首字之后注意力交给阅读,边读边到的内容几乎不记进等待的账本。
Zakay 与 Block 的注意闸门模型(1990 年代起):注意力押在时间本身上越多,主观时长越膨胀,紧张情绪再拉长一截。无反馈等待的高估误差,实验里两三成很常见。服务器记 5 秒,用户记 6 秒半。
对应:1 秒内直接出(不加过渡动画);1–10 秒必须流式 + 进度/阶段说明;超 10 秒转后台任务 + 完成通知。
哈佛商学院实验:机票搜索网站秒出结果 vs 等 30–60 秒但屏幕滚动「正在检查 Delta…正在检查 United…」,展示劳动的那组满意度反超,部分条件下被试宁愿选等 60 秒但看得见工作的网站。
机制:人用看得见的努力,推断看不见的质量。搜索查得细还是糙用户看不见,于是拿「屏幕上的工作量」当质量的代理指标。
入口牌子写「从此处起 40 分钟」,实际多数时候 30 分钟排到。游客非但不恼,反而觉得赚了 10 分钟。
队伍本身也被设计过:蛇形折返让你每隔几十秒往前挪一步,沿途布景和预演短片让手里有东西看。同样的物理时长,被拆成「一直在前进、一直有事干」。
加人提效把平均等待压到 8 分钟,投诉照旧。细看数据:下机走到转盘只要 1 分钟,剩下 7 分钟全程干站着。
后来方案一秒没提速:到达口改远、行李分到最远转盘,乘客多走 6 倍的路,走到时行李刚好出来。总时长没变,投诉几乎清零。
共同结论:走路的人觉得自己在推进,干站的人才觉得自己在等。难受的从来不是时长本身,是不确定、没解释、空着手。
场景:用户让 Agent 审一份 50 页采购合同,全程约 25 秒,原始界面只有「分析中…」,焦虑值 92。
| 动作 | 界面长出的东西 | 对应定律 |
|---|---|---|
| 给预估时长且报偏高 | 「预计 30 秒左右」(按历史耗时偏高值) | 定律 ① |
| 阶段性汇报进展 | 读取合同 12/50 页 → 提取付款与违约条款 → 交叉核对双方义务 | 定律 ② |
| 先流式出提纲 | ① 付款条款账期 90 天偏长 ② 违约金上限缺失 ③ 知识产权归属含糊 | 定律 ③ |
| 转后台 + 完成通知 | 「🔔 转入后台,完成后通知我」 | 形态切换 |
任务一毫秒没变快,用户从「干等」变成「盯着它干活」:知道要等多久、知道它在干嘛、手里有东西读、握着随时能走的出口。
只盯总时长的 P99,等于没在考核用户真正在意的东西。把首字时间写进报表、写进告警、写进验收标准,让它和总时长平起平坐。
四个等待设计动作(给预估、阶段汇报、先出提纲、转后台)一个都不需要换更快的模型。先修呈现再修延迟,账单便宜一个量级。
报 40 分钟实际 30 分钟是惊喜,反过来是背叛。按历史耗时的 偏高值 报,等待从无底洞变成倒计时。
被拆穿一次,用户会把这套把戏泛化到产品的每个角落,之后真实的检索日志、真实的思考过程都会先被当成表演审视。劳动错觉的红利建立在「劳动真实发生」上。
翻译按钮每天点几十次,第一次展示过程建立信任,之后直奔结果。别拿用户的耐心铺排面。
上线前逐条过:
本集所有手段都有明确约束边界,越界即反效果:
| 误区 | 为什么错 | 正确做法 |
|---|---|---|
| 把加载动画做得更精致来代替提速 | 动画只回答「死没死」,不回答「在干嘛」,也不给刻度 | 给预估时长 + 阶段汇报,动画只是最后一层装饰 |
| 拿后台日志和用户对质「明明只有 5 秒」 | 用户那块表确实走了更久,不是撒谎 | 承认体感,改界面,而不是改用户的认知 |
| 先花两个季度压延迟,再回头看差评 | 呈现改动几乎零成本,压延迟每一秒都要真金白银 | 先修呈现,再谈是否值得为那几秒花钱 |
| 把调试信息全量倒给用户 | 高频路径上过程展示是负担 | 首次展示建立信任,之后直奔结果 |
| 在结果还没达标时开过程展示 | 答案砸了,努力过程会变成新的槽点 | 先把结果质量拉到及格线,再谈劳动错觉 |
| 用弹窗解释「模型正在深度思考」 | 解释不等于进展,用户要的是可核对的细节 | 展示真实发生的检索条目、工具调用、阶段切换 |
工程侧的三个指标(P50 / P95 / P99 总时长)不能丢,但要补两行,否则你永远测不到用户那块表:
把这五项放进周报,和转化率、留存放在一起看。你会发现一件有意思的事:总时长没变的那几周,投诉先掉了。
延迟是工程问题,等待是产品问题。工程团队对物理时长负责,你要对那块开在用户心里的表负责。两者不冲突,但顺序不能反:先用几乎零成本的呈现改动把等待变得可交代,再用省下来的说服力去争取真正需要花钱的那部分优化。用户不会为你的 P99 鼓掌,只会为「我知道它在干嘛」留下来。
来源:xueai.miyang.cn(小山学堂 · 洛小山《学 AI 产品,从入门到精通》)
本页为二次演绎的解读与音频稿件,配套音频见本集 MP3。