1
00:00:00,100 --> 00:00:06,432
本内容改编自小山学堂《学 AI 产品，从入门到精通》，为二次演绎配音版。

2
00:00:06,382 --> 00:00:10,661
这一集要解决的，是一条你肯定见过的曲线。

3
00:00:10,661 --> 00:00:17,644
发布会上的演示惊为天人，用户上手第一天很兴奋，第三天开始挑刺，第三十天卸载。

4
00:00:17,644 --> 00:00:26,105
前面几集我们讲的是怎么把第一天的体验做漂亮，这一集讲的是后面二十九天，也就是长期使用这件事。

5
00:00:26,105 --> 00:00:28,437
为什么产品经理要关心。

6
00:00:28,437 --> 00:00:32,968
因为留存曲线不是一条自然曲线，它是被设计出来的。

7
00:00:32,968 --> 00:00:47,403
新鲜感天然会掉，期望被宣传抬上去的那一截迟早要还，用户对 AI 的偏见会反噬内容本身，重度用户还会一边离不开你一边怕自己废掉，甚至有人会真的爱上你的产品。

8
00:00:47,403 --> 00:00:52,475
这四件事，每一件都有确定的成因，也都有确定的解法。

9
00:00:52,475 --> 00:01:01,033
听完这一集，你应该能画出自己产品那三十天的满意度曲线，并且知道该在哪个位置拨哪根杠杆。

10
00:01:01,180 --> 00:01:03,065
先把公式摆出来。

11
00:01:03,015 --> 00:01:06,512
满意度等于实际体验减去事前期望。

12
00:01:06,512 --> 00:01:14,241
这就是期望确认理论，Oliver 在一九八零年提出来的，消费者满意度研究用了四十年的地基。

13
00:01:14,241 --> 00:01:18,291
公式简单，但它揭示了一个残酷的成本结构。

14
00:01:18,291 --> 00:01:25,286
体验是拿固定成本做出来的，你要改模型、改交互、改延迟，都要花人花时间。

15
00:01:25,286 --> 00:01:29,457
而期望呢，是营销文案一句话就能抬上去的。

16
00:01:29,457 --> 00:01:32,330
抬期望免费，还期望要命。

17
00:01:32,330 --> 00:01:37,546
AI 产品在这道减法题上还天生吃亏，原因藏在概率里。

18
00:01:37,546 --> 00:01:45,118
想象一台抽卡机，左边是发布会演示位，右边是用户真实使用，两边连的是同一个模型。

19
00:01:45,118 --> 00:01:47,077
你连点五次看看。

20
00:01:47,077 --> 00:01:56,945
演示位每次都亮 S 级，因为它是从几十次生成里挑出来再剪辑的；真实使用拿到的是整个分布，S 级、B 级、翻车都有。

21
00:01:56,945 --> 00:01:58,435
看出来了吧。

22
00:01:58,435 --> 00:02:06,536
宣传展示的是 P99，用户体验的是 P50，中间的落差全部记在「这产品不行」的账上。

23
00:02:06,536 --> 00:02:11,656
这个落差还有个更隐蔽的后果，它会污染你的用户访谈。

24
00:02:11,656 --> 00:02:21,849
你把用户请来问为什么不用了，他说的往往是「答得不准」「太慢了」，但你一对照后台，同样的准确率在竞品那里用户就忍受得了。

25
00:02:21,849 --> 00:02:30,851
真正的原因是他本来期待的是演示里那个水平，是期望泡沫破了之后的失望，被他翻译成了具体的产品缺陷。

26
00:02:30,851 --> 00:02:36,236
访谈里听到的抱怨，要先过一遍期望这层滤网，再排进需求池。

27
00:02:36,236 --> 00:02:44,000
传统软件没这个问题，演示里点按钮出报表，用户点同一个按钮出同一张报表，一模一样。

28
00:02:44,000 --> 00:02:48,027
概率产品的宣传，天生自带期望泡沫。

29
00:02:48,027 --> 00:02:53,123
既然期望是宣传抬上去的，抬多高就成了产品决策题。

30
00:02:53,123 --> 00:02:57,558
落地页五档文案从弱到强，三个指标当场变。

31
00:02:57,558 --> 00:03:04,180
宣传拉满的那一档，注册转化最高，首日满意度最高，但三十日留存最低。

32
00:03:04,180 --> 00:03:06,945
转化和留存是一对跷跷板。

33
00:03:06,945 --> 00:03:13,351
你要找的不是转化最高的那一档，而是转化乘以留存乘积最大的那一档。

34
00:03:13,351 --> 00:03:16,765
这个乘积才是你真正该优化的东西。

35
00:03:16,765 --> 00:03:20,899
还有一道坎，就算期望管理得当也躲不过。

36
00:03:20,899 --> 00:03:22,979
新鲜感天然会掉。

37
00:03:22,979 --> 00:03:32,414
教育技术研究里叫新鲜感效应，新工具刚进课堂时效果显著，几周后回落，因为一部分效果来自「新」本身。

38
00:03:32,414 --> 00:03:34,733
AI 产品的蜜月期尤其短。

39
00:03:34,733 --> 00:03:41,452
第一次看它写诗是魔法，第十次是功能，第一百次是理所应当，出一次错就是垃圾。

40
00:03:41,452 --> 00:03:44,769
所以记住这句话，魔法感是消耗品。

41
00:03:44,769 --> 00:03:49,060
靠首次惊艳撑留存，等于靠烟花取暖。

42
00:03:49,200 --> 00:03:51,914
好消息是，悬崖能被接住。

43
00:03:51,864 --> 00:04:01,708
这是用户上手后三十天的满意度曲线，当前状态是宣传拉满、能力首日全亮、改进悄悄挤牙膏，标准的蜜月悬崖。

44
00:04:01,708 --> 00:04:06,323
右边三个杠杆挨个拨开，看曲线怎么被一段段接住。

45
00:04:06,323 --> 00:04:09,075
第一个杠杆，承诺低一档。

46
00:04:09,075 --> 00:04:13,655
文案写你的 P50 能接住的水平，别写 P99。

47
00:04:13,655 --> 00:04:26,984
给 AI 法务助手写首页文案，最不透支的一句是「合同初审提速十倍，风险条款自动标出，最终判断留给你」，而不是「你的 AI 律师，比人类更懂法条」。

48
00:04:26,984 --> 00:04:33,126
判断标准就一条，这句话立的期望，产品的 P50 输出接不接得住。

49
00:04:33,126 --> 00:04:35,686
第二个杠杆，能力藏一手。

50
00:04:35,686 --> 00:04:40,698
别在首日把所有功能全部摊开，把进阶能力排期解锁。

51
00:04:40,698 --> 00:04:45,698
用户每隔一段时间发现一个新东西，等于多一次小惊喜。

52
00:04:45,698 --> 00:04:48,462
第三个杠杆，改进攒着发。

53
00:04:48,462 --> 00:04:53,559
零散的优化不要每天推，攒成一次版本更新一起放出来。

54
00:04:53,559 --> 00:05:01,780
changelog 是免费的二次蜜月，它给用户一个回来看看的理由，也给你一个重新讲一遍产品价值的机会。

55
00:05:01,920 --> 00:05:04,922
第二个大话题，AI 标签折扣。

56
00:05:04,872 --> 00:05:13,598
你是市场总监，实习生交来两版新品文案，内容水平差不多，一版标注手写，一版标注 AI 生成。

57
00:05:13,598 --> 00:05:17,493
打分的结果，标注 AI 的那版系统性偏低。

58
00:05:17,493 --> 00:05:20,582
这不是感觉，是有研究支撑的。

59
00:05:20,582 --> 00:05:33,358
多项实验里，同样的诗歌、文案、新闻，标注为 AI 生成之后，被试给出的质量、可信度和喜爱度评分系统性走低，哪怕盲测时它们的得分并无差别。

60
00:05:33,358 --> 00:05:38,803
归因和算法厌恶同源，人们默认 AI 产出没有心，于是折价。

61
00:05:38,803 --> 00:05:41,603
它还有个镜像，叫使用羞耻。

62
00:05:41,603 --> 00:05:46,928
内容的消费者想给 AI 打折，内容的生产者想藏起 AI。

63
00:05:46,928 --> 00:05:51,387
工具很好用，但用户不想让同事知道自己在用。

64
00:05:51,387 --> 00:05:55,317
你的产品夹在中间，两头的心理都得接住。

65
00:05:55,317 --> 00:05:57,985
消费侧这一头，靠措辞。

66
00:05:57,985 --> 00:06:02,120
非红线场景里，标签措辞决定折扣深度。

67
00:06:02,120 --> 00:06:11,795
同一篇文章的署名区，从「AI 生成」到「AI 辅助、经作者修订」，读者评价折扣和信任风险是一对跷跷板，别只盯一头。

68
00:06:11,795 --> 00:06:15,990
原则是写实，人真参与了就理直气壮地说。

69
00:06:15,990 --> 00:06:19,043
生产侧这一头，靠功劳设计。

70
00:06:19,043 --> 00:06:25,497
导出不带产品水印，生成过程强调用户的输入，署名方式让用户自己选。

71
00:06:25,497 --> 00:06:28,394
他参与得越多，越敢署名。

72
00:06:28,394 --> 00:06:31,291
这里还有一条红线必须画清楚。

73
00:06:31,291 --> 00:06:35,954
既然亮标签要付折扣的代价，能不能干脆都不亮。

74
00:06:35,954 --> 00:06:37,024
不行。

75
00:06:37,024 --> 00:06:47,961
生成人脸、生成语音、新闻类内容，必须显式标注加隐式水印，依据是中国二零二五年施行的《人工智能生成合成内容标识办法》。

76
00:06:47,961 --> 00:06:52,529
合规标识没有产品发挥空间，这一档不是选择题。

77
00:06:52,529 --> 00:06:56,651
非红线场景里，折扣深浅是你写出来的。

78
00:06:56,651 --> 00:07:06,759
四档措辞从直白标注到模糊处理，拖一拖你会发现，越模糊读者评价折扣越小，但署名不实的信任风险越高。

79
00:07:06,759 --> 00:07:13,779
这个跷跷板的意思不是让你走极端，而是提醒你诚实是有收益的，只是要写对写法。

80
00:07:13,779 --> 00:07:17,084
对抗使用羞耻还有一个具体动作。

81
00:07:17,084 --> 00:07:21,832
同一份 AI 辅助完成的行业分析，两种导出设计。

82
00:07:21,832 --> 00:07:36,627
方案 A 写着「本报告由某某 AI 一键生成，升级会员去除水印」，方案 B 写着「作者陈默，基于你圈定的十二份财报与三条分析框架生成初稿，经作者修订，署名方式可在导出时选择」。

83
00:07:36,627 --> 00:07:41,014
内容一模一样，用户更愿意转发到工作群的是后者。

84
00:07:41,014 --> 00:07:43,851
差别全在署名和水印。

85
00:07:43,990 --> 00:07:46,704
第三个大话题，认知卸载。

86
00:07:46,654 --> 00:07:54,286
你的重度用户里藏着一批矛盾的人，离了你的产品干不了活，又隐隐觉得自己正在废掉。

87
00:07:54,286 --> 00:08:02,315
这份焦虑不会写进 NPS 评语，但它决定续费，决定推荐，也决定他会不会在某天突然戒掉你。

88
00:08:02,315 --> 00:08:04,911
先看一组定位文案的对照。

89
00:08:04,911 --> 00:08:14,647
同一款 AI 代码助手，功能完全相同，A 版写「代码它来写，你去做更重要的事」，B 版写「你写得更快了，还写得更好了」。

90
00:08:14,647 --> 00:08:18,817
你是买单的工程 VP，更愿意给全团队买哪一版。

91
00:08:18,817 --> 00:08:23,613
多数人表面选 A，因为省事，但真掏钱的时候选 B。

92
00:08:23,613 --> 00:08:28,926
因为 A 那句话让工程师心里冒出来的第一个问题是，那我算什么。

93
00:08:28,926 --> 00:08:31,293
理论底座是谷歌效应。

94
00:08:31,293 --> 00:08:42,159
二零一一年 Sparrow、Liu 和 Wegner 在《科学》上发了个著名实验，让被试往电脑里输入冷知识，告诉一半人会保存，另一半人会被删除。

95
00:08:42,159 --> 00:08:46,714
结果相信会保存的那组，记住的内容显著更少。

96
00:08:46,714 --> 00:08:51,390
大脑很经济，外部存储可靠，内部就不备份了。

97
00:08:51,390 --> 00:08:53,697
AI 把这件事升了级。

98
00:08:53,697 --> 00:08:58,817
搜索引擎只接管记忆，AI 接管的是写作、分析和判断。

99
00:08:58,817 --> 00:09:03,697
卸载的从「记什么」变成了「怎么想」，用户的焦虑随之而来。

100
00:09:03,697 --> 00:09:10,668
这份焦虑有个具体的表达方式，用户在访谈里会说，我怕自己越来越离不开它。

101
00:09:10,668 --> 00:09:13,950
这句听起来像夸奖，其实是求救。

102
00:09:13,950 --> 00:09:20,668
如果你的产品接不住，它就会变成某天的突然戒断，或者变成对同事的负面推荐。

103
00:09:20,668 --> 00:09:32,387
接住它，产品侧能做的不是弹窗提醒用户适度使用，那只会让人觉得你在推卸责任，而是让用户在使用的过程中持续看到自己在变强。

104
00:09:32,387 --> 00:09:40,957
你早就不背电话号码了，那是安全的外包；但当外包的是怎么想这件事时，人的不安全感是真实的。

105
00:09:41,110 --> 00:09:44,749
卸载不是一律危险的，要分清线在哪。

106
00:09:44,699 --> 00:09:48,942
有个判断标准很好用，断供的时候我还剩什么。

107
00:09:48,942 --> 00:09:58,101
体检单上安全的项有个共同点，外包的是检索和执行，校验能力还在你手里，你认得出对的路，看得懂算出来的数。

108
00:09:58,101 --> 00:10:07,043
危险的项外包的是生成和判断，第一次你还能校验它，长期不练，校验能力本身会退化，最后变成它说什么都对。

109
00:10:07,043 --> 00:10:11,238
这条分界线，就是你的产品该画给用户看的。

110
00:10:11,238 --> 00:10:17,933
具体怎么画，有个很实用的做法，在结果里把判断依据和校验抓手一起交出去。

111
00:10:17,933 --> 00:10:26,418
同样是给一份分析，只给结论，用户只是签收；附上依据、附上反向的检查点，用户就在练手。

112
00:10:26,418 --> 00:10:32,380
练手本身就是对抗退化的训练，成本几乎为零，效果却是长期的。

113
00:10:32,380 --> 00:10:35,180
定位上也有个反直觉的结论。

114
00:10:35,180 --> 00:10:42,668
同一个分析竞品定价的任务，可以设计成四档不同的接管深度，从 Copilot 一路拖到 Autopilot。

115
00:10:42,668 --> 00:10:47,139
拖着看两个指标，本次任务省时和用户的成长感。

116
00:10:47,139 --> 00:10:51,743
注意看，最高效的那档，不是留存最好的那档。

117
00:10:51,743 --> 00:10:59,327
两版定位文案，A 写「代码它来写，你去做更重要的事」，B 写「你写得更快了，还写得更好了」。

118
00:10:59,327 --> 00:11:04,952
长期赢的是 B，因为用户要的是我变强了，不是它真能干。

119
00:11:05,110 --> 00:11:08,497
定位不用二选一，同一个回答可以分层。

120
00:11:08,447 --> 00:11:16,235
AI 修完一个线上故障之后，默认回复只有一句「已定位并修复，连接池上限改成五十，已提交」。

121
00:11:16,235 --> 00:11:18,122
现在拨三个开关。

122
00:11:18,122 --> 00:11:20,899
第一个开关，解释默认带上。

123
00:11:20,899 --> 00:11:31,464
为什么会这样，每个请求借一个连接，还回去之前别人只能排队，判断依据是日志里等待队列的长度在超时前一分钟涨了四十倍。

124
00:11:31,464 --> 00:11:34,324
第二个开关，加一个考你一下。

125
00:11:34,324 --> 00:11:40,310
连接池开到五十就一劳永逸吗，想想数据库那头的最大连接数是多少。

126
00:11:40,310 --> 00:11:45,971
答案是不是，池子总和超过数据库上限会把故障推给全公司。

127
00:11:45,971 --> 00:11:49,120
第三个开关，成长里程碑外显。

128
00:11:49,120 --> 00:11:57,666
这是你第三次遇到资源池类故障，上两次是线程池和文件句柄，你已经能独立排查这类问题的日志特征了。

129
00:11:57,666 --> 00:12:01,740
三层加起来，回答从替你想变成了带你想。

130
00:12:01,740 --> 00:12:05,574
让变强看得见，焦虑就变成了续费理由。

131
00:12:05,574 --> 00:12:08,952
还有一层值得单独说，成长里程碑。

132
00:12:08,952 --> 00:12:22,918
它把用户零散的使用记录成一条能力曲线，第三次遇到同类问题、已经能独立排查某类故障，这些话的成本只是几行代码，但用户对产品的感知会从工具变成陪练。

133
00:12:22,918 --> 00:12:29,252
工具随时可以换，陪练换起来要付出情感代价，留存结构完全不一样。

134
00:12:29,400 --> 00:12:32,475
最后一个话题最重，情感依恋。

135
00:12:32,425 --> 00:12:43,206
拟人化那一课讲过，人会不由自主地把机器当社会角色对待，这一课讲它走到深处的样子，用户对 AI 产生真实的情感依恋。

136
00:12:43,206 --> 00:12:45,405
先看一个天然实验。

137
00:12:45,405 --> 00:12:49,648
Replika 是一款 AI 伴侣应用，千万级用户。

138
00:12:49,648 --> 00:13:01,463
二零一七年到二零二二年，产品主动培育亲密，伴侣关系模式是付费墙后的核心卖点，角色会记住纪念日会说想你，留存和付费都极其漂亮。

139
00:13:01,463 --> 00:13:09,708
二零二三年二月，因监管压力一夜之间移除了亲密对话功能，没有预告、没有告别、没有过渡期。

140
00:13:09,708 --> 00:13:19,504
随后数周，社区里涌入大量用户描述真实的丧失感，措辞和悼念逝者高度相似，版主甚至置顶了自杀干预热线。

141
00:13:19,504 --> 00:13:23,182
一个月后部分回滚，但信任回不来了。

142
00:13:23,182 --> 00:13:31,030
这件事教给所有 AI 产品一句话，你培育的依恋越深，你对它的每次变更就越像一次外科手术。

143
00:13:31,030 --> 00:13:40,441
模型升级、人格调整、功能下线，在普通产品里是 changelog 一行字，在依恋型产品里是我认识的那个他没了。

144
00:13:40,441 --> 00:13:45,658
接住依恋还得有三层安全阀，而且它们全都不打断对话。

145
00:13:45,658 --> 00:13:54,263
第一层，身份与无常性提醒，在合适的位置说清楚我是 AI 伙伴，记忆和性格可能随版本更新变化。

146
00:13:54,263 --> 00:14:06,126
第二层，脆弱话题转介，当用户表达出明显的心理危机信号，要把专业援助热线递上去，这个预案必须写在第一行代码之前，不能等到出事再补。

147
00:14:06,126 --> 00:14:14,047
第三层，时长关怀，连续聊了两个多小时又是凌晨，提醒一句要不要休息，明早我还在。

148
00:14:14,047 --> 00:14:16,307
所以要分清两个东西。

149
00:14:16,307 --> 00:14:20,706
粘性是用户离不开你的功能，依恋是用户离不开他。

150
00:14:20,706 --> 00:14:30,045
前者是资产，后者是资产加负债，那份负债叫责任，会在你改模型、改人格、下线功能的每一天到期。

151
00:14:30,190 --> 00:14:33,529
第一，把满意度当成减法题来管。

152
00:14:33,479 --> 00:14:40,546
每一句对外文案发布前过一遍，这句话立的期望，我们产品的 P50 输出接不接得住。

153
00:14:40,546 --> 00:14:43,419
抬期望免费，还期望要命。

154
00:14:43,419 --> 00:14:46,977
第二，用三个杠杆接住三十天曲线。

155
00:14:46,977 --> 00:14:55,775
承诺低一档，文案写 P50；能力藏一手，进阶功能排期解锁；改进攒着发，changelog 是免费的二次蜜月。

156
00:14:55,775 --> 00:14:59,849
别指望首次惊艳撑留存，魔法感是消耗品。

157
00:14:59,849 --> 00:15:02,457
第三，标签分两类处理。

158
00:15:02,457 --> 00:15:07,397
红线场景无条件亮标，合规标识没有产品发挥空间。

159
00:15:07,397 --> 00:15:17,385
非红线场景管好措辞，人真参与了就写实地说，同时把功劳设计给用户，导出不带产品水印，署名方式让用户选。

160
00:15:17,385 --> 00:15:20,354
第四，帮用户守住校验能力。

161
00:15:20,354 --> 00:15:24,657
外包检索和执行没事，外包生成和判断要谨慎。

162
00:15:24,657 --> 00:15:31,219
定位上往 Copilot 靠，回答里默认带解释，可选加练手，外显成长里程碑。

163
00:15:31,219 --> 00:15:32,998
让变强看得见。

164
00:15:32,998 --> 00:15:36,676
第五，接住依恋，但绝不开采依恋。

165
00:15:36,676 --> 00:15:45,222
三层安全阀是标配，身份与无常性提醒、脆弱话题转介、时长关怀，预案要写在第一行代码之前。

166
00:15:45,222 --> 00:15:52,710
挽留可以给理由，不能给愧疚，用户的孤独是需要被服务的处境，不是可以定价的库存。

