第 2 章 · 第 2 讲 · 16:21
script.txt(8 段,正文 4833 字)pm02-m2-播客.mp3 | 字幕:pm02-m2-播客.srt这一集的能力可以拆成两半,一半发生在人工智能开口之前,一半发生在它开口之后。两半之间有一道明确的界线,界线左边叫提问,界线右边叫核验。
上半区 · 提问(让它对准你)
| 能力点 | 一句话定义 | 关键动作 | 本集对应课节 |
|---|---|---|---|
| 锚点 | 告诉它你已经会到哪里 | 写出你的起点,别让它从定义讲起 | 让 AI 按我的情况讲清楚 |
| 场景 | 告诉它你要解决哪件事 | 说出真实用途,决定它讲到哪一步停 | 让 AI 按我的情况讲清楚 |
| 出题 | 讲完让你亲手做一遍 | 要求它出一道题,把听懂变成会做 | 让 AI 按我的情况讲清楚 |
| 预警 | 提前拦住易错点 | 要求它先说最容易错在哪里 | 让 AI 按我的情况讲清楚 |
| 指定源领域 | 比方借用的东西必须你已经熟悉 | 写出你亲手做过、能判断后果的一件事 | 让 AI 用我熟悉的东西打比方 |
| 逐项映射 | 两个领域的角色动作一一对应 | 要求它逐项说明谁对应谁 | 让 AI 用我熟悉的东西打比方 |
| 类比边界 | 明确哪里不能照搬 | 要求它单列一段边界说明 | 让 AI 用我熟悉的东西打比方 |
| 一次一问 | 当前屏幕只出现一个问题 | 规定一次只问一个,上一答决定下一问 | 让 AI 一次只问我一个问题 |
下半区 · 核验(让你掌握尺度)
| 能力点 | 一句话定义 | 关键动作 | 本集对应课节 |
|---|---|---|---|
| 五类可疑 | 回答里默认该当可疑的五个位置 | 数字、时间线、设置项或接口名、冷门细节、功能声明 | 让 AI 标出最可能编错的五类信息 |
| 要出处 | 每条结论指回可打开的原文 | 拦住凭空补出来的内容 | 让 AI 的回答先过三道检查 |
| 交叉验证 | 找独立来源互相核对 | 拦住单一证据带来的偏差 | 让 AI 的回答先过三道检查 |
| 标注不确定 | 分开已确认、推断与缺失 | 拦住把未知写成肯定 | 让 AI 的回答先过三道检查 |
| 三档核验强度 | 必须查、抽查、可暂不查 | 只看错误后果与可逆性两个变量 | 这次回答,我要不要去查原文 |
这张能力地图有一个贯穿性的设计意图。上半区解决的是「输入质量」,下半区解决的是「输出质量」。很多人只优化其中一个,结果两头都不稳。提问问得再准,输出照样可能编;核验做得再严,如果一开始就没说清用途,你核对的可能是一份根本不需要的回答。
| 段 | 段名 | 解决什么 | 核心案例 |
|---|---|---|---|
| 1 | 开场 | 本集解决什么问题、PM 为什么关心 | 流畅度本身是一种干扰 |
| 2 | 把问题问对,只差四个部件 | 锚点、场景、出题、预警 | 咖啡店第二杯半价与全单八折 |
| 3 | 用我熟悉的东西打比方,要能自己验证 | 指定源领域、逐项映射、声明边界 | 八百九十九元线上课与冰箱坏食材 |
| 4 | 让对话一次只问一个问题 | 三条节奏规则 | 三个月转行的问卷式提问 |
| 5 | 回答里这五个位置,先当可疑 | 五类高风险信息与四栏核对表 | 活动方案里的数字、日期、接口与功能声明 |
| 6 | 让它自己的回答先过三道闸 | 要出处、交叉验证、标注不确定 | 三个链接实为一份协会报告 |
| 7 | 这次要不要查原文,看两件事 | 后果大小与可逆性、三档强度 | 分期手续费六百四十八元 |
| 8 | 可带走的判断清单 | 六条可执行规则 | 全篇收束 |
这份清单的用法是,在你把人工智能的输出交给别人之前,逐条过一遍。任何一条打不上勾,就说明还有一处风险敞口。
提问阶段
核验阶段
交付阶段
素材约束。 本集口播稿的全部案例、数字与结论,均取自本集绑定的六节课素材(learn-3.html 至 learn-8.html),未跨集取材,未引入源文档之外的数据、案例或引文。素材中出现的具体数字,包括线上课八百九十九元、参与率百分之四十七、启用日期六月一日、申报成本下降百分之三十、手续费率百分之零点六、电脑一万二千元、分十二期、每期七十二元、结清补收六百四十八元,均在源素材中有明确出处。
题库隔离约束。 本集 quizFiles 为空,不含题库页,因此不存在题库内容混入口播的风险。若后续集次存在 content-slices/<slug>.quiz.md,其中「三十道灵魂拷问」类题目一律不得写进口播稿,也不得念出题目,只能作为集页下方的文字自测卡渲染。口播稿中已由 lint 脚本按特征词做了兜底拦截。
格式约束。 口播稿不含 emoji,不含半角冒号、半角括号、星号、井号、引号等会干扰语音合成的符号;数字一律写成中文读法,例如二零二五、百分之四十七、十二期;英文缩写不直接口播,遇到接口名一类内容改用中文描述。全文为单人口播,段名仅供分章,不朗读。
技术约束。 音频为三十二千比特每秒、两万四千赫兹采样率、单声道;字幕时间戳单调不倒退,末条字幕与音频结束时间的偏差控制在两秒以内;正文净字数四千六百至五千三百字,对应时长十二至二十分钟。
取材取舍说明。 本集素材净字数约五千七百字,落在容量区间内,未做压缩。素材中的交互式练习部分(提问练习、类比练习、对话节奏练习、风险核对练习、核验判断练习)属于页面交互组件,已转写为口播可讲的动作规则与四栏、六层输出格式,不虚构未在素材中出现的交互细节。
提问四要素最容易出问题的地方不是不知道,而是每次都想不起来。建议把锚点、场景、出题、预警这四句做成一张固定模板,存在常用位置。真正有效的模板不是写得多漂亮,而是每次只需要替换方括号里的内容。你可以观察一个现象:同一句提问,补上这四项之后,回答的长度往往变短,但可用度明显变高。这是因为你替它砍掉了大量与你无关的分支。
指定源领域、逐项映射、声明边界这三件事,如果分三次追问,模型在第二次回答时往往已经忘了第一次的约束。正确做法是一次说全。尤其要注意边界这一段,很多人会漏掉。边界的作用是防止你把局部相似当成处处相同。素材里的冰箱类比就有明确边界,课程也许还能退款、转让或者只挑部分章节听,坏食材通常没有这些选项。让模型主动指出失效处,你才不会把该停止继续投入,误解成立刻放弃一切。
五类可疑信息是风险标签,不是优先级排序。真正决定先查哪一处的,是写错之后对决定的影响大小。一份活动方案里,参与率预计百分之四十七可能只影响一句描述,而跨设备自动恢复这类功能声明,如果没上线就直接改变了方案的可行性。所以摘出五类信息之后,一定要多做一步,指出哪一处写错会直接改变决定,先给它最短的核对动作。
交叉验证最容易失效的方式,是看起来找了多个来源,实际指向同一份原始材料。素材里的例子很典型,第一个链接打不开,第二个链接回到网站首页,第三个虽然能打开,内容却来自同一份协会报告。判断是否真的独立,可以问三个问题:它们是不是同一作者或同一机构,它们的原始数据是不是同一个出处,它们之间有没有相互引用。三个问题里只要有一个答案是肯定的,这次交叉验证就不成立。
核验结果不要只写可信或者不可信。可以直接要求模型按六层回复:判断给核验档位,依据只列后果和可逆性,下一步指出该打开什么、搜索什么,有效信息保留会改变档位的事实,无效信息剔除回答很长、术语很多、它很自信这类表面信号,缺失信息提醒还要补哪一项。这份格式的好处是,它把判断权和证据链分开了,你能一眼看出哪一层是模型的推测,哪一层有材料支撑。
后果与可逆性这两个变量,最好提前写进团队规范,而不是每次临时判断。可以约定三类场景:涉及付款、签字、用药、提交正式材料的高后果动作,一律先找当前有效的原始材料;后果中等或者错误仍有补救空间的,只核对最能改变行动的那一条数字、条件或规则;只用于了解、头脑风暴或者低成本尝试的,可以先继续对话。提前约定能避免一种常见争议,就是有人用回答很长、语气很稳来给核验强度加码,而这两件事其实都不影响判断。
素材里有一句很关键的话,模型同时承担了回答者和核验者,它能把自己刚写的内容整理得更像证据,却不能靠重复解释完成外部验证。实践中的做法是,把核验拆成三道不同任务分别发问,而不是在原对话里追问一句你确定吗。追问确定与否,得到的往往是同一套说辞换一种更肯定的语气;而要求它指回可打开的原文、找独立来源、标注不确定,才是在换任务。
本集讲了六个具体案例,它们的翻车路径高度一致,可以归纳成同一个结构。
案例一,咖啡店折扣。 表面症状是记错了半价的适用范围。真实原因是那次讲解没有碰到她手上的那两杯咖啡,也没有让她独立算一次。缺的部件是场景和出题。
案例二,八百九十九元线上课。 表面症状是把沉没成本理解成花得越多越要继续。真实原因是比方借用了她不熟悉的牌局经验。缺的部件是源领域的选择权。
案例三,三个月转行规划。 表面症状是填到第四题就开始敷衍。真实原因是问题同时到达,上一题的答案无法改变后面的问题。缺的部件是对话节奏。
案例四,活动方案。 表面症状是数字、日期、接口名都找不到出处。真实原因是回答的流畅度掩盖了细节的具体性,而具体细节最容易让人放弃核对。缺的部件是五类可疑的定位。
案例五,新政策影响判断。 表面症状是三个链接实为一份证据。真实原因是回答者和核验者是同一个角色,重复解释被误当成外部验证。缺的部件是三道闸的分工。
案例六,分期手续费。 表面症状是六百四十八元的账单。真实原因是核验强度按语言流畅度决定,而不是按后果与可逆性决定。缺的部件是三档强度的判断标准。
把六个案例并排放,会看到一条共同的线。它们都不是模型答得不好,而是提问和核验的结构有缺口。模型在缺口处不会停下来问你,它会用最常见的方式把缺口填上,然后用很流畅的语气讲给你听。这就是为什么本集把能力分成上下两半,上半区负责减少缺口,下半区负责在缺口处设防。
还有一个值得单独记住的规律。六个案例里,代价最大的两个都发生在高后果场景,一个是汇报材料,一个是付款确认。而这两个场景恰好也是最容易因为时间紧而跳过核验的场景。时间越紧,越要先把核验强度定下来,因为那时候你最容易用流畅度代替证据。
| 常见做法 | 问题在哪 | 换成什么 |
|---|---|---|
| 用生活例子打比方 | 源领域的选择权交给了模型 | 用我每周清理坏食材的经历 |
| 一次性问清所有信息 | 上一答无法改变后面的问题 | 一次只问一个,上一答决定下一问 |
| 追问你确定吗 | 得到的往往是更肯定的同一套说辞 | 要求指回可打开的原文 |
| 找多个链接做交叉验证 | 可能是同一份证据换三个链接 | 确认作者、数据出处、是否互相引用 |
| 按回答长度判断可信度 | 流畅度和具体细节都可能是编的 | 按错误后果与可逆性定核验强度 |
| 把可疑当成已判错 | 会浪费精力去否定本来正确的细节 | 可疑负责排队,查原文负责定案 |
| 要求它标注来源 | 有出处感不等于有证据 | 要求它给出可以打开的原文 |
| 让它在原对话里自查 | 回答者与核验者无法分开 | 换任务,分三道闸分别发问 |
本集可继续往下学的方向有三条。一是把提问四要素与后续的上下文工程内容接起来,理解为什么同样的结构在长对话里会失效。二是把五类可疑信息扩展成一份属于你自己业务的核对清单,不同领域的高风险位置并不相同。三是把三档核验强度与本系列后面关于评测与成本的内容对照看,核验强度本质上也是一种资源分配。
本集内容改编自小山学堂《学 AI 产品,从入门到精通》,为二次演绎配音版。原始课程与完整素材见 xueai.miyang.cn,作者洛小山。
来源:xueai.miyang.cn(小山学堂 · 洛小山)