1
00:00:00,100 --> 00:00:06,432
本内容改编自小山学堂《学 AI 产品，从入门到精通》，为二次演绎配音版。

2
00:00:06,382 --> 00:00:09,603
这一集要解决一个特别具体的麻烦。

3
00:00:09,603 --> 00:00:18,125
你让人工智能帮忙查资料、做方案、算一笔账，它回答得又顺又完整，你看不出毛病，就照着用了。

4
00:00:18,125 --> 00:00:26,562
到了现场才发现，里面那个数字找不到出处，那个功能根本没有上线，那条规则和合同原文正好相反。

5
00:00:26,562 --> 00:00:28,581
麻烦出在两个地方。

6
00:00:28,581 --> 00:00:35,240
一个是它开口之前，你没有把自己的情况交代清楚，它只能按通用讲义讲一遍。

7
00:00:35,240 --> 00:00:40,468
另一个是它开口之后，你没有判断哪句话必须回去查原文。

8
00:00:40,468 --> 00:00:43,209
为什么产品经理要关心这件事。

9
00:00:43,209 --> 00:00:50,024
因为在一条决策链上，产品经理往往就是那个把人工智能的输出变成行动的人。

10
00:00:50,024 --> 00:00:55,612
这段话进了汇报，那个数字进了预算，这条规则按了确认按钮。

11
00:00:55,612 --> 00:01:03,437
工程师可以只关心系统跑不跑得起来，产品经理要关心的是，这句话错了以后，代价由谁承担。

12
00:01:03,437 --> 00:01:05,817
还有一层更隐蔽的风险。

13
00:01:05,817 --> 00:01:09,903
人工智能的回答越流畅，你越容易跳过核对。

14
00:01:09,903 --> 00:01:19,362
它把标题、项目符号、结论排得整整齐齐，读起来像一份已经查完资料的备忘录，这种完整感本身就是一种干扰。

15
00:01:19,362 --> 00:01:22,896
它骗过的不是你的知识，是你的注意力。

16
00:01:22,896 --> 00:01:25,432
所以这一集给你两套东西。

17
00:01:25,432 --> 00:01:34,026
一套是提问的结构，让它从一开始就对准你的起点和用途，也就是把它从通用讲义拉回你的具体问题。

18
00:01:34,026 --> 00:01:43,004
另一套是核验的结构，让你用很小的动作，把最值得怀疑的位置挑出来，把有限的精力花在最贵的几处。

19
00:01:43,004 --> 00:01:49,062
我们先从提问说起，一共三步，把问题问对、把比方问准、把节奏问顺。

20
00:01:49,204 --> 00:01:50,968
先看一个场景。

21
00:01:50,918 --> 00:01:55,930
咖啡店同时推出两个活动，第二杯半价，和全单八折。

22
00:01:55,930 --> 00:02:01,279
你想用百分数算清哪种更省，于是请人工智能系统讲解折扣。

23
00:02:01,279 --> 00:02:06,387
它从定义讲到换算，还列出完整步骤，你一路都看懂了。

24
00:02:06,387 --> 00:02:11,820
可真到结账时，你把半价当成了两杯都打五折，差点选错。

25
00:02:11,820 --> 00:02:13,479
问题不在公式。

26
00:02:13,479 --> 00:02:19,308
问题在那次讲解没有碰到你手上的那两杯咖啡，也没有让你独立算一次。

27
00:02:19,308 --> 00:02:23,094
听懂一篇讲义，不等于会处理自己的题。

28
00:02:23,094 --> 00:02:25,979
缺掉的，是你的具体情况。

29
00:02:25,979 --> 00:02:27,168
怎么补。

30
00:02:27,168 --> 00:02:31,231
在提问里空出四个部件，一个一个填进去。

31
00:02:31,231 --> 00:02:34,284
第一个是锚点，我已经会到哪里。

32
00:02:34,284 --> 00:02:38,454
你得告诉它你的起点，它才知道从哪里开始讲。

33
00:02:38,454 --> 00:02:43,731
不说，它就从最基础的定义讲起，你听了一堆已经会的东西。

34
00:02:43,731 --> 00:02:46,820
第二个是场景，我要解决哪件事。

35
00:02:46,820 --> 00:02:51,495
你要的是算清这单咖啡怎么买，不是考一张百分数的卷子。

36
00:02:51,495 --> 00:02:54,584
场景决定它讲到哪一步就该停。

37
00:02:54,584 --> 00:02:57,565
第三个是出题，讲完让我亲手做。

38
00:02:57,565 --> 00:03:00,522
让它讲完给你一道题，你算一遍。

39
00:03:00,522 --> 00:03:03,394
这一步是把听懂变成会做。

40
00:03:03,394 --> 00:03:06,555
第四个是预警，提前拦住易错点。

41
00:03:06,555 --> 00:03:13,118
让它先说清这里最容易错在哪里，比如半价是只打第二杯，不是两杯都打。

42
00:03:13,118 --> 00:03:15,197
四个部件各管一段。

43
00:03:15,197 --> 00:03:21,255
锚点决定从哪讲，场景决定讲到哪，出题验证真会，预警拦住翻车。

44
00:03:21,255 --> 00:03:24,308
少任何一个，回答就少一块。

45
00:03:24,308 --> 00:03:28,731
这四句可以直接抄走，换成你自己的内容就行。

46
00:03:28,876 --> 00:03:30,652
再看一个例子。

47
00:03:30,602 --> 00:03:34,316
有人买了一门线上课，花了八百九十九元。

48
00:03:34,316 --> 00:03:39,425
听了三节，发现内容和宣传不符，却舍不得已经付掉的钱。

49
00:03:39,425 --> 00:03:43,114
朋友提醒她，这笔钱可能是沉没成本。

50
00:03:43,114 --> 00:03:47,069
她第一次听见这个词，就请人工智能打个比方。

51
00:03:47,069 --> 00:03:53,691
人工智能说，像牌局里已经押进底池的筹码，接下来只看继续下注值不值得。

52
00:03:53,691 --> 00:03:55,098
句子很顺。

53
00:03:55,098 --> 00:04:02,045
可这个人从不打牌，她不知道底池是什么，也不知道什么时候该跟注，只能凭字面猜。

54
00:04:02,045 --> 00:04:09,100
第二天她反而得出更错的结论，既然已经花了八百九十九元，就更应该继续投入时间。

55
00:04:09,100 --> 00:04:15,542
一个陌生概念套上另一个陌生经验，解释看起来完成了，理解却偏得更远。

56
00:04:15,542 --> 00:04:17,742
问题不只是比方准不准。

57
00:04:17,742 --> 00:04:25,110
人工智能不知道你熟悉网购退货、做饭还是项目排期，只能替你抽一个常见参照物。

58
00:04:25,110 --> 00:04:29,136
常见不等于你熟悉，听得顺也不等于能验证。

59
00:04:29,136 --> 00:04:33,175
正确的做法是，把源领域的选择权拿回来。

60
00:04:33,175 --> 00:04:38,126
这个人经常整理冰箱，就可以要求用坏掉的食材来讲。

61
00:04:38,126 --> 00:04:41,215
买菜的钱已经花掉，回不来了。

62
00:04:41,215 --> 00:04:47,357
今晚吃什么，只该看食材还能不能吃，以及重新做饭要花多少时间。

63
00:04:47,357 --> 00:04:49,521
具体要写清三件事。

64
00:04:49,521 --> 00:04:56,816
先指定已知源领域，写出你亲手经历过、能判断后果的一件事，别只说用生活例子。

65
00:04:56,816 --> 00:05:03,788
再列出映射对应关系，要求它说明源领域里的每个动作，分别对应目标概念里的什么。

66
00:05:03,788 --> 00:05:07,838
最后标明类比边界，追问哪些细节不能照搬。

67
00:05:07,838 --> 00:05:11,035
边界这件事要跟对应关系一起问。

68
00:05:11,035 --> 00:05:13,379
冰箱这个类比也有边界。

69
00:05:13,379 --> 00:05:20,530
课程也许还能退款、转让，或者只挑部分章节听，坏食材通常没有这些选项。

70
00:05:20,530 --> 00:05:25,098
类比只搬运当前要理解的结构，不负责覆盖所有细节。

71
00:05:25,098 --> 00:05:33,655
让它在最后单列一段边界，说明哪些细节不能照搬，你就不会把该停止继续投入，误解成立刻放弃一切。

72
00:05:33,655 --> 00:05:37,754
一个比方有没有用，看你能不能检查它的每一步。

73
00:05:37,754 --> 00:05:42,754
源领域由你指定，映射逐项核对，边界主动说破。

74
00:05:42,892 --> 00:05:45,101
第三个场景更常见。

75
00:05:45,051 --> 00:05:50,724
你想用三个月完成转行，既要补技能、做作品集，又要安排面试。

76
00:05:50,724 --> 00:05:57,395
这个任务确实需要补充很多信息，于是你对人工智能说，先问清楚再帮我规划。

77
00:05:57,395 --> 00:05:59,318
它马上发来一长串。

78
00:05:59,318 --> 00:06:08,597
当前职业、目标岗位、每周能投入多少时间、预算、基础、作品经历、城市、薪资期待、离职期限。

79
00:06:08,597 --> 00:06:12,948
每一个都合理，合在一起却像一份入职问卷。

80
00:06:12,948 --> 00:06:17,299
你填到第四项就开始随便写，最后关掉了对话。

81
00:06:17,299 --> 00:06:20,929
麻烦不在问题多，而在问题同时到达。

82
00:06:20,929 --> 00:06:25,292
上一题的答案本来会让后面一半问题失去必要。

83
00:06:25,292 --> 00:06:30,219
你回答了预算有限，它就不该再问你愿不愿意上两万块的课。

84
00:06:30,219 --> 00:06:35,159
解决办法是把对话节奏写成三条规则，一起发过去。

85
00:06:35,159 --> 00:06:41,001
第一条，一次只问一个，当前屏幕只出现一问，先降低回答负担。

86
00:06:41,001 --> 00:06:47,635
第二条，上一答决定下一问，追问、换方向还是结束，都由刚才那个答案触发。

87
00:06:47,635 --> 00:06:55,111
第三条，进度可见，也能跳过，让你知道还剩多少，不愿回答的时候对话也不会卡死。

88
00:06:55,111 --> 00:07:00,904
你可以直接这样说，请每次只问我一个问题，根据我的上一答决定下一问。

89
00:07:00,904 --> 00:07:06,193
显示当前进度，我可以回复跳过，你再换一个问法或者继续。

90
00:07:06,193 --> 00:07:11,133
这三条规则的价值在于，它把往下想的活儿留在了你这边。

91
00:07:11,133 --> 00:07:18,969
一次只问一个，是把下一步推理变成一个问句交还给你，让你的上一答真正决定它的下一问。

92
00:07:18,969 --> 00:07:22,527
问题列得越全，越可能一题都答不好。

93
00:07:22,527 --> 00:07:28,573
真正有用的节奏，是先接住眼前这一问，再让答案把后面的路铺出来。

94
00:07:28,573 --> 00:07:33,272
好问题排成队，一个一个来，你的答案负责改变队伍。

95
00:07:33,412 --> 00:07:36,787
讲完提问，我们转到另一半，核验。

96
00:07:36,737 --> 00:07:38,840
先看一个翻车现场。

97
00:07:38,840 --> 00:07:44,177
周五下午，有人要把一份人工智能整理的活动方案交给同事。

98
00:07:44,177 --> 00:07:45,992
答案读起来很顺。

99
00:07:45,992 --> 00:07:55,619
参与率预计百分之四十七，新流程从六月一日启用，数据可以通过一个接口导出，旧版附录还写了跨设备自动恢复。

100
00:07:55,619 --> 00:08:04,225
标题、项目符号、结论都排得很完整，她没有看到语病，也没发现前后矛盾，就直接搬进了汇报。

101
00:08:04,225 --> 00:08:12,218
现场打开原始公告和帮助文档，数字、日期、接口名都找不到，所谓自动恢复也没有上线。

102
00:08:12,218 --> 00:08:16,449
几句具体细节，把整份方案一起拖进了返工。

103
00:08:16,449 --> 00:08:19,033
问题不在答案像不像真的。

104
00:08:19,033 --> 00:08:23,636
真正省时间的动作，是先定位最值得核对的位置。

105
00:08:23,636 --> 00:08:26,304
有五类信息默认该当可疑。

106
00:08:26,304 --> 00:08:33,119
第一类是数字，包括金额、比例、阈值、版本号，以及精确到小数的参数。

107
00:08:33,119 --> 00:08:39,057
第二类是时间线，包括发布时间、启用日期、先后顺序和更新节点。

108
00:08:39,057 --> 00:08:47,987
第三类是设置项或者接口名，它们的名字很像产品原文，仍然要回到真实界面或者官方文档去看。

109
00:08:47,987 --> 00:08:55,126
第四类是冷门细节，旧手册、附件、会议纪要里的一句话，外部很难交叉验证。

110
00:08:55,126 --> 00:09:03,961
第五类是功能声明，声称支持、能够、自动完成某件事，这一类尤其要防止用常见经验去填空。

111
00:09:03,961 --> 00:09:08,961
要特别注意一点，可疑只表示需要证据，不表示已经写错。

112
00:09:08,961 --> 00:09:11,028
五类只是风险标签。

113
00:09:11,028 --> 00:09:15,150
原始统计表能对上百分之四十七，这条就成立。

114
00:09:15,150 --> 00:09:20,090
帮助页没有自动恢复，那条功能声明才算被证据否定。

115
00:09:20,090 --> 00:09:23,312
标可疑负责排队，查原文负责定案。

116
00:09:23,312 --> 00:09:27,458
把这件事交代给人工智能的时候，可以这样说。

117
00:09:27,458 --> 00:09:34,405
请从下面这段回答里原样摘出这五类信息，不要改写，也不要判断整段是否可靠。

118
00:09:34,405 --> 00:09:40,307
然后按原句、类别、应该查的原始材料、当前状态这四栏输出。

119
00:09:40,307 --> 00:09:44,862
没有直接依据就写待核对，不要补页码或者来源。

120
00:09:44,862 --> 00:09:51,088
最后指出哪一处写错会直接改变决定，先给它最短的核对动作。

121
00:09:51,244 --> 00:09:53,970
五类可疑帮你排出核对顺序。

122
00:09:53,920 --> 00:10:00,398
接下来这一步，是把核验本身也交给它做一遍，但要分成三道不同的任务。

123
00:10:00,398 --> 00:10:01,973
先看例子。

124
00:10:01,973 --> 00:10:08,103
周一早会前，有人请人工智能判断一项新政策会不会影响团队。

125
00:10:08,103 --> 00:10:13,920
它给出清楚结论，还列了行业协会报告、研究机构简报和三个链接。

126
00:10:13,920 --> 00:10:17,345
页面排得像一份已经查完资料的备忘录。

127
00:10:17,345 --> 00:10:20,747
来不及逐个打开，结论就被贴进了汇报。

128
00:10:20,747 --> 00:10:30,218
经理追问证据时，第一个链接显示打不开，第二个链接回到网站首页，第三条虽然能打开，内容却来自同一份协会报告。

129
00:10:30,218 --> 00:10:33,247
三个链接，实际只有一份证据。

130
00:10:33,247 --> 00:10:35,687
这次翻车的关键很具体。

131
00:10:35,687 --> 00:10:39,557
人工智能同时承担了回答者和核验者。

132
00:10:39,557 --> 00:10:46,769
它能把自己刚写的内容整理得更像证据，却不能靠重复解释完成外部验证。

133
00:10:46,769 --> 00:10:49,521
所以要给它设三道不同的闸。

134
00:10:49,521 --> 00:10:51,252
第一道是要出处。

135
00:10:51,252 --> 00:10:56,564
让每条结论都指回可以打开的原文，拦住凭空补出来的内容。

136
00:10:56,564 --> 00:10:58,668
第二道是交叉验证。

137
00:10:58,668 --> 00:11:03,115
找独立来源互相核对，拦住单一证据带来的偏差。

138
00:11:03,115 --> 00:11:05,314
第三道是标注不确定。

139
00:11:05,314 --> 00:11:11,624
分开已确认、属于推断、以及信息缺失这三类，拦住把未知写成肯定。

140
00:11:11,624 --> 00:11:15,555
三道闸各自拦不同的问题，缺一道就漏一类。

141
00:11:15,555 --> 00:11:20,879
还有一件事要记住，即使三道都过了，也要打开最关键的原文。

142
00:11:20,879 --> 00:11:26,913
交叉验证可以缩小错误范围，但不能替你确认网页上究竟写了什么。

143
00:11:26,913 --> 00:11:31,853
模型负责把待核对的范围缩小，人负责让关键证据落地。

144
00:11:31,853 --> 00:11:35,927
核验完成之后，结果不要只写可信或者不可信。

145
00:11:35,927 --> 00:11:40,314
一份能拿去行动的结果，至少要同时留下四块。

146
00:11:40,314 --> 00:11:45,999
判断是什么，依据有哪些，下一步该做什么，还有哪些问题待追问。

147
00:11:45,999 --> 00:11:51,144
这样后来接手的人才知道，哪些能用，哪些只是线索。

148
00:11:51,292 --> 00:11:54,835
最后一层，也是最能省力气的一层。

149
00:11:54,785 --> 00:11:59,881
不是每个回答都值得你去查原文，也不是每个回答都可以直接信。

150
00:11:59,881 --> 00:12:02,417
判断标准只有两件事。

151
00:12:02,417 --> 00:12:08,535
这句话错了会造成多大后果，以及发现错了之后，能不能轻松撤回。

152
00:12:08,535 --> 00:12:10,675
看一个真实的代价。

153
00:12:10,675 --> 00:12:14,593
确认页写着每期手续费率百分之零点六。

154
00:12:14,593 --> 00:12:23,163
有人准备把一台一万二千元的电脑分十二期，便问人工智能，提前结清以后，剩余手续费还收不收。

155
00:12:23,163 --> 00:12:26,937
它回答不再收取，还算出每期七十二元。

156
00:12:26,937 --> 00:12:30,639
七十二元的乘法能对上，就顺手按了确认。

157
00:12:30,639 --> 00:12:36,841
三个月后提前结清，页面又收了剩余九期的手续费，一共六百四十八元。

158
00:12:36,841 --> 00:12:42,982
而当前协议原文写的是，未收取的剩余手续费于结清日一次性收取。

159
00:12:42,982 --> 00:12:47,622
同一句回答，有时可以先听，有时必须停下来找原文。

160
00:12:47,622 --> 00:12:50,266
差别就在后果和可逆性。

161
00:12:50,266 --> 00:12:51,853
据此分三档。

162
00:12:51,853 --> 00:12:53,559
第一档是必须查。

163
00:12:53,559 --> 00:13:05,182
回答会推动付款、签字、用药、提交正式材料这类高后果动作，而且一旦做错很难撤回，就先找到当前有效的原始材料，再行动。

164
00:13:05,182 --> 00:13:06,817
第二档是抽查。

165
00:13:06,817 --> 00:13:17,237
后果中等，或者错误还有补救空间，只核对最能改变行动的那一条数字、条件或者规则，不必逐句查完整段回答。

166
00:13:17,237 --> 00:13:19,244
第三档是可暂不查。

167
00:13:19,244 --> 00:13:29,016
只用于了解、头脑风暴或者低成本尝试，错了也能立即改回，可以先继续对话，真正要行动时再重新判断。

168
00:13:29,016 --> 00:13:33,103
在分期这个例子里，需要核对的不是所有计算。

169
00:13:33,103 --> 00:13:40,771
打开当前版本的协议，搜索提前结清和剩余手续费两个词，读命中条款的上下文就够了。

170
00:13:40,771 --> 00:13:45,675
原文没有支持，就暂停确认，把这句话保留成待核对。

171
00:13:45,675 --> 00:13:49,304
最后可以要求它把核验单压成六层回复。

172
00:13:49,304 --> 00:13:51,288
判断给核验档位。

173
00:13:51,288 --> 00:13:53,800
依据只列后果和可逆性。

174
00:13:53,800 --> 00:13:57,357
下一步指出该打开什么、搜索什么。

175
00:13:57,357 --> 00:14:00,687
有效信息保留会改变档位的事实。

176
00:14:00,687 --> 00:14:06,312
无效信息剔除回答很长、术语很多、它很自信这类表面信号。

177
00:14:06,312 --> 00:14:09,437
缺失信息提醒还要补哪一项。

178
00:14:09,580 --> 00:14:11,597
这一集讲了两件事。

179
00:14:11,547 --> 00:14:14,672
提问的时候，让它对准你的情况。

180
00:14:14,672 --> 00:14:18,506
核验的时候，让你自己掌握判断的尺度。

181
00:14:18,506 --> 00:14:25,393
下面这份清单可以直接带走，下次用人工智能做正经事之前，花两分钟过一遍。

182
00:14:25,393 --> 00:14:28,109
第一，提问先补四个部件。

183
00:14:28,109 --> 00:14:38,842
锚点说清你已经会到哪里，场景说清你要解决哪件事，出题要求讲完让你亲手做一遍，预警要求它提前点出最容易错的地方。

184
00:14:38,842 --> 00:14:41,775
四句缺一句，回答就少一块。

185
00:14:41,775 --> 00:14:46,306
第二，要求打比方的时候，把源领域的选择权拿回来。

186
00:14:46,306 --> 00:14:54,552
写出你亲手经历过、能判断后果的那件事，要求它逐项说明映射关系，最后单列一段类比边界。

187
00:14:54,552 --> 00:14:58,650
一个比方有没有用，看你能不能检查它的每一步。

188
00:14:58,650 --> 00:15:03,266
第三，需要补充信息的时候，规定一次只问一个问题。

189
00:15:03,266 --> 00:15:07,869
让上一答决定下一问，显示进度，允许你跳过。

190
00:15:07,869 --> 00:15:12,436
问卷式的一次性提问，只会让你从第四题开始敷衍。

191
00:15:12,436 --> 00:15:15,874
第四，拿到回答先扫五个位置。

192
00:15:15,874 --> 00:15:22,124
数字、时间线、设置项或者接口名、冷门细节、功能声明。

193
00:15:22,124 --> 00:15:25,886
可疑只代表优先检查，不代表已经判错。

194
00:15:25,886 --> 00:15:29,564
标完可疑，再按后果决定先查哪一处。

195
00:15:29,564 --> 00:15:32,208
第五，核验分三道闸。

196
00:15:32,208 --> 00:15:35,465
要出处，让它指回可以打开的原文。

197
00:15:35,465 --> 00:15:38,842
交叉验证，找独立来源互相核对。

198
00:15:38,842 --> 00:15:42,869
标注不确定，把已确认、推断和缺失分开写。

199
00:15:42,869 --> 00:15:47,256
三道都过，也要亲手打开最关键的那一份原文。

200
00:15:47,256 --> 00:15:50,778
第六，决定查到多深，只看两件事。

201
00:15:50,778 --> 00:15:55,032
错了会造成多大后果，以及能不能轻松撤回。

202
00:15:55,032 --> 00:15:58,710
后果高又难撤回，先找原文再行动。

203
00:15:58,710 --> 00:16:04,299
后果中等或者还有补救空间，抽查最能改变行动的那一条。

204
00:16:04,299 --> 00:16:08,133
后果低又能立刻改回，可以先继续对话。

205
00:16:08,133 --> 00:16:11,559
把这份清单用在你的下一份汇报上。

206
00:16:11,559 --> 00:16:20,946
你会发现，真正省时间的不是让模型答得更多，而是让它在开口之前对准你，在开口之后让你知道该查哪里。

