CHAPTER 2 · EP 2

提问:把讲义变成考卷 · 防幻觉:三道防线

第 2 章 · 第 2 讲 · 16:21

时长 16:21音色 云健 · 男声章节 2

同步字幕

章节导航(点击跳转)

0:00开场1:49
1:49把问题问对,只差四个部件1:39
3:28用我熟悉的东西打比方,要能自己验证2:14
5:42让对话一次只问一个问题1:50
7:33回答里这五个位置,先当可疑2:17
9:51让它自己的回答先过三道闸2:00
11:51这次要不要查原文,看两件事2:18
14:09可带走的判断清单2:11
解读全文

pm02-m2 · 提问:把讲义变成考卷 · 防幻觉:三道防线

  • 集号:第 2 集
  • 模块:M2 学会学习
  • 对应课节:6 节(让 AI 按我的情况讲清楚 / 让 AI 用我熟悉的东西打比方 / 让 AI 一次只问我一个问题 / 让 AI 标出最可能编错的五类信息 / 让 AI 的回答先过三道检查 / 这次回答,我要不要去查原文)
  • 口播稿:script.txt(8 段,正文 4833 字)
  • 音频:pm02-m2-播客.mp3 | 字幕:pm02-m2-播客.srt
  • 素材来源:xueai.miyang.cn(小山学堂 · 洛小山《学 AI 产品,从入门到精通》)

一、本集能力地图

这一集的能力可以拆成两半,一半发生在人工智能开口之前,一半发生在它开口之后。两半之间有一道明确的界线,界线左边叫提问,界线右边叫核验。

上半区 · 提问(让它对准你)

能力点一句话定义关键动作本集对应课节
锚点告诉它你已经会到哪里写出你的起点,别让它从定义讲起让 AI 按我的情况讲清楚
场景告诉它你要解决哪件事说出真实用途,决定它讲到哪一步停让 AI 按我的情况讲清楚
出题讲完让你亲手做一遍要求它出一道题,把听懂变成会做让 AI 按我的情况讲清楚
预警提前拦住易错点要求它先说最容易错在哪里让 AI 按我的情况讲清楚
指定源领域比方借用的东西必须你已经熟悉写出你亲手做过、能判断后果的一件事让 AI 用我熟悉的东西打比方
逐项映射两个领域的角色动作一一对应要求它逐项说明谁对应谁让 AI 用我熟悉的东西打比方
类比边界明确哪里不能照搬要求它单列一段边界说明让 AI 用我熟悉的东西打比方
一次一问当前屏幕只出现一个问题规定一次只问一个,上一答决定下一问让 AI 一次只问我一个问题

下半区 · 核验(让你掌握尺度)

能力点一句话定义关键动作本集对应课节
五类可疑回答里默认该当可疑的五个位置数字、时间线、设置项或接口名、冷门细节、功能声明让 AI 标出最可能编错的五类信息
要出处每条结论指回可打开的原文拦住凭空补出来的内容让 AI 的回答先过三道检查
交叉验证找独立来源互相核对拦住单一证据带来的偏差让 AI 的回答先过三道检查
标注不确定分开已确认、推断与缺失拦住把未知写成肯定让 AI 的回答先过三道检查
三档核验强度必须查、抽查、可暂不查只看错误后果与可逆性两个变量这次回答,我要不要去查原文

这张能力地图有一个贯穿性的设计意图。上半区解决的是「输入质量」,下半区解决的是「输出质量」。很多人只优化其中一个,结果两头都不稳。提问问得再准,输出照样可能编;核验做得再严,如果一开始就没说清用途,你核对的可能是一份根本不需要的回答。


二、口播稿分段导览

段段名解决什么核心案例
1开场本集解决什么问题、PM 为什么关心流畅度本身是一种干扰
2把问题问对,只差四个部件锚点、场景、出题、预警咖啡店第二杯半价与全单八折
3用我熟悉的东西打比方,要能自己验证指定源领域、逐项映射、声明边界八百九十九元线上课与冰箱坏食材
4让对话一次只问一个问题三条节奏规则三个月转行的问卷式提问
5回答里这五个位置,先当可疑五类高风险信息与四栏核对表活动方案里的数字、日期、接口与功能声明
6让它自己的回答先过三道闸要出处、交叉验证、标注不确定三个链接实为一份协会报告
7这次要不要查原文,看两件事后果大小与可逆性、三档强度分期手续费六百四十八元
8可带走的判断清单六条可执行规则全篇收束

三、审查清单(可直接勾选)

这份清单的用法是,在你把人工智能的输出交给别人之前,逐条过一遍。任何一条打不上勾,就说明还有一处风险敞口。

提问阶段

  • 我写清了自己的起点,它没有从最基础的定义开始讲。
  • 我说清了这次的真实用途,回答停在解决问题需要的位置。
  • 我要求了出题,并且自己独立做过一遍。
  • 我要求了预警,知道这里最容易错在哪里。
  • 打比方时,源领域是我亲手经历过、能判断后果的那件事。
  • 我要求了逐项映射,知道源领域的每个动作对应什么。
  • 我要求了类比边界,知道哪些细节不能照搬。
  • 需要补充信息时,我规定了一次只问一个,并允许自己跳过。

核验阶段

  • 我把回答里的数字、时间线、设置项或接口名、冷门细节、功能声明原样摘了出来。
  • 我对每一处都写明了应该查的原始材料,没有直接依据的就标了待核对。
  • 我指出了哪一处写错会直接改变决定,并先给它最短的核对动作。
  • 我区分了可疑、已证实、已否定三种状态,没有把可疑当成已判错。
  • 我让每条结论都指回了可以打开的原文。
  • 我找了独立来源做交叉验证,确认不是同一份证据换三个链接。
  • 我把已确认、属于推断、信息缺失三类分开写了。
  • 我打开了最关键的原文,没有只依赖它的转述。
  • 我给出了判断、依据、下一步、待追问项这四块。

交付阶段

  • 我判断过这句话错了会造成多大后果。
  • 我判断过发现错误后能不能轻松撤回。
  • 高后果且难撤回的内容,我找到了当前有效的原始材料才行动。
  • 我明确写出了哪些结论还是待核对状态,没有替它兜底。

四、约束说明

素材约束。 本集口播稿的全部案例、数字与结论,均取自本集绑定的六节课素材(learn-3.html 至 learn-8.html),未跨集取材,未引入源文档之外的数据、案例或引文。素材中出现的具体数字,包括线上课八百九十九元、参与率百分之四十七、启用日期六月一日、申报成本下降百分之三十、手续费率百分之零点六、电脑一万二千元、分十二期、每期七十二元、结清补收六百四十八元,均在源素材中有明确出处。

题库隔离约束。 本集 quizFiles 为空,不含题库页,因此不存在题库内容混入口播的风险。若后续集次存在 content-slices/<slug>.quiz.md,其中「三十道灵魂拷问」类题目一律不得写进口播稿,也不得念出题目,只能作为集页下方的文字自测卡渲染。口播稿中已由 lint 脚本按特征词做了兜底拦截。

格式约束。 口播稿不含 emoji,不含半角冒号、半角括号、星号、井号、引号等会干扰语音合成的符号;数字一律写成中文读法,例如二零二五、百分之四十七、十二期;英文缩写不直接口播,遇到接口名一类内容改用中文描述。全文为单人口播,段名仅供分章,不朗读。

技术约束。 音频为三十二千比特每秒、两万四千赫兹采样率、单声道;字幕时间戳单调不倒退,末条字幕与音频结束时间的偏差控制在两秒以内;正文净字数四千六百至五千三百字,对应时长十二至二十分钟。

取材取舍说明。 本集素材净字数约五千七百字,落在容量区间内,未做压缩。素材中的交互式练习部分(提问练习、类比练习、对话节奏练习、风险核对练习、核验判断练习)属于页面交互组件,已转写为口播可讲的动作规则与四栏、六层输出格式,不虚构未在素材中出现的交互细节。


五、实践提示

提示1 · 把四个部件做成一张固定模板

提问四要素最容易出问题的地方不是不知道,而是每次都想不起来。建议把锚点、场景、出题、预警这四句做成一张固定模板,存在常用位置。真正有效的模板不是写得多漂亮,而是每次只需要替换方括号里的内容。你可以观察一个现象:同一句提问,补上这四项之后,回答的长度往往变短,但可用度明显变高。这是因为你替它砍掉了大量与你无关的分支。

提示2 · 类比提问的三件事要一起问,不要分三次问

指定源领域、逐项映射、声明边界这三件事,如果分三次追问,模型在第二次回答时往往已经忘了第一次的约束。正确做法是一次说全。尤其要注意边界这一段,很多人会漏掉。边界的作用是防止你把局部相似当成处处相同。素材里的冰箱类比就有明确边界,课程也许还能退款、转让或者只挑部分章节听,坏食材通常没有这些选项。让模型主动指出失效处,你才不会把该停止继续投入,误解成立刻放弃一切。

提示3 · 核对顺序按后果排,不按可疑程度排

五类可疑信息是风险标签,不是优先级排序。真正决定先查哪一处的,是写错之后对决定的影响大小。一份活动方案里,参与率预计百分之四十七可能只影响一句描述,而跨设备自动恢复这类功能声明,如果没上线就直接改变了方案的可行性。所以摘出五类信息之后,一定要多做一步,指出哪一处写错会直接改变决定,先给它最短的核对动作。

提示4 · 三个链接不等于三份证据

交叉验证最容易失效的方式,是看起来找了多个来源,实际指向同一份原始材料。素材里的例子很典型,第一个链接打不开,第二个链接回到网站首页,第三个虽然能打开,内容却来自同一份协会报告。判断是否真的独立,可以问三个问题:它们是不是同一作者或同一机构,它们的原始数据是不是同一个出处,它们之间有没有相互引用。三个问题里只要有一个答案是肯定的,这次交叉验证就不成立。

提示5 · 六层核验单可以直接复用

核验结果不要只写可信或者不可信。可以直接要求模型按六层回复:判断给核验档位,依据只列后果和可逆性,下一步指出该打开什么、搜索什么,有效信息保留会改变档位的事实,无效信息剔除回答很长、术语很多、它很自信这类表面信号,缺失信息提醒还要补哪一项。这份格式的好处是,它把判断权和证据链分开了,你能一眼看出哪一层是模型的推测,哪一层有材料支撑。

提示6 · 三档强度要写进团队规范

后果与可逆性这两个变量,最好提前写进团队规范,而不是每次临时判断。可以约定三类场景:涉及付款、签字、用药、提交正式材料的高后果动作,一律先找当前有效的原始材料;后果中等或者错误仍有补救空间的,只核对最能改变行动的那一条数字、条件或规则;只用于了解、头脑风暴或者低成本尝试的,可以先继续对话。提前约定能避免一种常见争议,就是有人用回答很长、语气很稳来给核验强度加码,而这两件事其实都不影响判断。

提示7 · 回答者和核验者要分开

素材里有一句很关键的话,模型同时承担了回答者和核验者,它能把自己刚写的内容整理得更像证据,却不能靠重复解释完成外部验证。实践中的做法是,把核验拆成三道不同任务分别发问,而不是在原对话里追问一句你确定吗。追问确定与否,得到的往往是同一套说辞换一种更肯定的语气;而要求它指回可打开的原文、找独立来源、标注不确定,才是在换任务。


六、案例复盘:六个现场的共同结构

本集讲了六个具体案例,它们的翻车路径高度一致,可以归纳成同一个结构。

案例一,咖啡店折扣。 表面症状是记错了半价的适用范围。真实原因是那次讲解没有碰到她手上的那两杯咖啡,也没有让她独立算一次。缺的部件是场景和出题。

案例二,八百九十九元线上课。 表面症状是把沉没成本理解成花得越多越要继续。真实原因是比方借用了她不熟悉的牌局经验。缺的部件是源领域的选择权。

案例三,三个月转行规划。 表面症状是填到第四题就开始敷衍。真实原因是问题同时到达,上一题的答案无法改变后面的问题。缺的部件是对话节奏。

案例四,活动方案。 表面症状是数字、日期、接口名都找不到出处。真实原因是回答的流畅度掩盖了细节的具体性,而具体细节最容易让人放弃核对。缺的部件是五类可疑的定位。

案例五,新政策影响判断。 表面症状是三个链接实为一份证据。真实原因是回答者和核验者是同一个角色,重复解释被误当成外部验证。缺的部件是三道闸的分工。

案例六,分期手续费。 表面症状是六百四十八元的账单。真实原因是核验强度按语言流畅度决定,而不是按后果与可逆性决定。缺的部件是三档强度的判断标准。

把六个案例并排放,会看到一条共同的线。它们都不是模型答得不好,而是提问和核验的结构有缺口。模型在缺口处不会停下来问你,它会用最常见的方式把缺口填上,然后用很流畅的语气讲给你听。这就是为什么本集把能力分成上下两半,上半区负责减少缺口,下半区负责在缺口处设防。

还有一个值得单独记住的规律。六个案例里,代价最大的两个都发生在高后果场景,一个是汇报材料,一个是付款确认。而这两个场景恰好也是最容易因为时间紧而跳过核验的场景。时间越紧,越要先把核验强度定下来,因为那时候你最容易用流畅度代替证据。

七、常见误区对照

常见做法问题在哪换成什么
用生活例子打比方源领域的选择权交给了模型用我每周清理坏食材的经历
一次性问清所有信息上一答无法改变后面的问题一次只问一个,上一答决定下一问
追问你确定吗得到的往往是更肯定的同一套说辞要求指回可打开的原文
找多个链接做交叉验证可能是同一份证据换三个链接确认作者、数据出处、是否互相引用
按回答长度判断可信度流畅度和具体细节都可能是编的按错误后果与可逆性定核验强度
把可疑当成已判错会浪费精力去否定本来正确的细节可疑负责排队,查原文负责定案
要求它标注来源有出处感不等于有证据要求它给出可以打开的原文
让它在原对话里自查回答者与核验者无法分开换任务,分三道闸分别发问

八、延伸与来源

本集可继续往下学的方向有三条。一是把提问四要素与后续的上下文工程内容接起来,理解为什么同样的结构在长对话里会失效。二是把五类可疑信息扩展成一份属于你自己业务的核对清单,不同领域的高风险位置并不相同。三是把三档核验强度与本系列后面关于评测与成本的内容对照看,核验强度本质上也是一种资源分配。

本集内容改编自小山学堂《学 AI 产品,从入门到精通》,为二次演绎配音版。原始课程与完整素材见 xueai.miyang.cn,作者洛小山。

来源:xueai.miyang.cn(小山学堂 · 洛小山)