1
00:00:00,100 --> 00:00:06,432
本内容改编自小山学堂《学 AI 产品，从入门到精通》，为二次演绎配音版。

2
00:00:06,382 --> 00:00:18,461
这一集我们来收拾一堆你可能天天听到、却没认真拆过的词，提示词、提示词工程、模型、智能体、技能小抄、氛围编程、国产大模型。

3
00:00:18,461 --> 00:00:26,959
本集解决的问题是，这些词分别落在哪一层，哪些跟你日常干活有关，哪些是你做产品决策时必须懂的。

4
00:00:26,959 --> 00:00:34,747
很多人把这些词当成同一件事的不同说法，结果在评审会上争了半天，其实争的不是一层东西。

5
00:00:34,747 --> 00:00:37,079
为什么产品经理要关心。

6
00:00:37,079 --> 00:00:45,637
第一，你必须能判断一个需求到底该改提示词、换模型，还是重构流程，选错层就会白忙一轮。

7
00:00:45,637 --> 00:00:53,040
第二，你要能跟研发和业务方说清楚，为什么同一个模型，装进不同产品里体验差那么远。

8
00:00:53,040 --> 00:00:54,723
第三，成本。

9
00:00:54,723 --> 00:01:03,509
系统提示词的每个词元都会在每一次调用里重复计费，你对这几个词的理解，最后会直接变成账单上的数字。

10
00:01:03,509 --> 00:01:11,093
理解到这一层还有个附带好处，你会明白为什么同一个人工智能，不同产品用起来差别那么大。

11
00:01:11,093 --> 00:01:20,504
这七节内容分两条线，前三条是人人都能用的手上功夫，后四条是真正做人工智能产品时必须想清楚的层次。

12
00:01:20,504 --> 00:01:25,192
下面我们从最贴近日常的一层开始，往上拆。

13
00:01:25,350 --> 00:01:29,939
网上流传着各种神级提示词模板，动辄几百字。

14
00:01:29,889 --> 00:01:35,009
其实真正管用的骨架只有三块，背景、要求、限制。

15
00:01:35,009 --> 00:01:38,375
第一块是背景，我是谁，情况是什么。

16
00:01:38,375 --> 00:01:44,420
它不认识你，你的行业、对象、场合，说了它才知道往哪个方向答。

17
00:01:44,420 --> 00:01:50,766
比如我在一家二十人的装修公司做行政，要给全体同事发一个调休通知。

18
00:01:50,766 --> 00:01:54,949
这一句就把行业、规模、场景全交代了。

19
00:01:54,949 --> 00:01:57,497
第二块是要求，我要什么。

20
00:01:57,497 --> 00:02:01,091
要一段文字，一个清单，还是一个方案。

21
00:02:01,091 --> 00:02:03,903
动词越具体，结果越对路。

22
00:02:03,903 --> 00:02:10,322
接着刚才那句，帮我写这个通知，说明十月一日至八日放假、九日补班。

23
00:02:10,322 --> 00:02:13,471
第三块是限制，什么样算合格。

24
00:02:13,471 --> 00:02:16,728
语气、长度、格式、不要什么。

25
00:02:16,728 --> 00:02:19,961
这是你的验收标准，给了就少返工。

26
00:02:19,961 --> 00:02:25,766
还是接上去，语气轻松点，二百字以内，最后提醒大家提前订票。

27
00:02:25,766 --> 00:02:29,805
三块拼起来，你的提问就已经超过九成的人。

28
00:02:29,805 --> 00:02:33,579
提示词不是咒语，就是一次说清楚的交代。

29
00:02:33,579 --> 00:02:35,682
你可以亲自试一次。

30
00:02:35,682 --> 00:02:46,487
同一个任务，比如让人工智能帮你写一条面包店开业的朋友圈文案，先只给要求，再把背景和限制一块块加上去，看回答的档次怎么变。

31
00:02:46,487 --> 00:02:51,584
同一个人工智能，回答的档次完全取决于你给的拼图块。

32
00:02:51,584 --> 00:02:55,706
换个说法更好记，把它当成不了解你的新同事。

33
00:02:55,706 --> 00:03:03,639
你不会对一个刚入职的同事说帮我写个通知就完事，你会交代公司做什么、发给谁、要什么语气。

34
00:03:03,639 --> 00:03:05,514
对它也是一样。

35
00:03:05,650 --> 00:03:09,362
骨架之外，还有三个用过就回不去的技巧。

36
00:03:09,312 --> 00:03:12,965
技巧一，给一个例子，胜过十句形容。

37
00:03:12,965 --> 00:03:17,893
你说写得活泼一点，它对活泼的理解可能和你差很远。

38
00:03:17,893 --> 00:03:22,533
贴一段你喜欢的范文，说照这个感觉写，风格立刻对齐。

39
00:03:22,533 --> 00:03:29,588
比如帮我写产品介绍，参考这条的风格，这把伞最大的本事，是装得下两个人的肩膀。

40
00:03:29,588 --> 00:03:32,340
技巧二，说不清就让它先问你。

41
00:03:32,340 --> 00:03:38,374
不知道该交代什么，就加一句，开始前，先问我几个问题，让它来采访你。

42
00:03:38,374 --> 00:03:42,184
它问的每个问题，都在替你排除不合适的答案。

43
00:03:42,184 --> 00:03:47,845
比如我想给孩子做暑假计划，开始前先问我几个你需要知道的问题。

44
00:03:47,845 --> 00:03:50,958
技巧三，不满意就说哪里不满意。

45
00:03:50,958 --> 00:03:56,006
第一版不好很正常，别整个推翻重来，指着具体的地方改。

46
00:03:56,006 --> 00:04:00,225
第二段太正式了，改口语些；开头别用问句。

47
00:04:00,225 --> 00:04:02,605
两三轮就能逼近你要的。

48
00:04:02,605 --> 00:04:09,504
再比如，整体不错，但尊敬的各位同仁太严肃了，我们公司都喊花名，改一下。

49
00:04:09,504 --> 00:04:13,795
改比重写快，这是我自己最常用的一个习惯。

50
00:04:13,930 --> 00:04:19,084
你可能听过提示词工程师这个职业，甚至听说过很高的薪水。

51
00:04:19,034 --> 00:04:22,736
一个说话技巧，凭什么配得上工程两个字。

52
00:04:22,736 --> 00:04:25,632
答案是同一个词，两种用法。

53
00:04:25,632 --> 00:04:31,414
对普通人，它是把话说清楚的功夫，上一节那三块十分钟就能学会。

54
00:04:31,414 --> 00:04:41,077
你在聊天框里写帮我把这段话改客气点，用一次就扔，写得好省几分钟，写得差重问一次就行，试错成本几乎为零。

55
00:04:41,077 --> 00:04:47,279
对做人工智能产品的人，它是写进系统、被调用几百万次的岗位说明书。

56
00:04:47,279 --> 00:04:56,822
你用的每个应用，客服也好、写作工具也好，背后都藏着一份几千字的提示词，规定它的身份、边界、语气和禁区。

57
00:04:56,822 --> 00:05:03,842
这份说明每天被执行几十万到几百万次，差一个字，几十万用户同时受影响。

58
00:05:03,842 --> 00:05:07,015
工程这三个字体现在三件事上。

59
00:05:07,015 --> 00:05:10,717
第一，效果是调出来的，不是写出来的。

60
00:05:10,717 --> 00:05:21,906
专业团队会准备几百个测试问题，改一版提示词就全量跑一遍看效果，这套写、测、改的循环，和调试代码没有本质区别。

61
00:05:21,906 --> 00:05:24,635
第二，每个字都在花钱。

62
00:05:24,635 --> 00:05:37,267
它按词元计费，系统提示词的每个词元都会在每一次调用里重复计费，把三千字精简到两千字而效果不降，对一个日活百万的产品就是真金白银。

63
00:05:37,267 --> 00:05:39,527
第三，还要防坏人。

64
00:05:39,527 --> 00:05:48,541
有用户会故意诱导它说不该说的话，业内叫提示词注入，怎么在说明书里筑好防线，也是这门手艺的一部分。

65
00:05:48,541 --> 00:05:52,039
关于成本，可以做个简单的心算练习。

66
00:05:52,039 --> 00:06:02,616
假设系统提示词里多写了一段可有可无的废话，大约五百字，产品每天被使用十万次，那么这段废话每天就要白白发送五千万字。

67
00:06:02,616 --> 00:06:13,241
按二零二六年八月主流模型接口的定价量级估算，每一百万词元输入大约一到三元，取中间值粗算，一年下来是一笔不小的开销。

68
00:06:13,241 --> 00:06:19,046
反过来也成立，精简掉这段废话而效果不降，这些钱就省下来了。

69
00:06:19,046 --> 00:06:22,159
这就是工程这两个字的实际价值。

70
00:06:22,159 --> 00:06:33,914
所以下次听到提示词工程师，可以这样理解，他们不是会聊天的人，而是给人工智能写岗位说明书、并用几百个测试用例反复验收的人。

71
00:06:34,070 --> 00:06:40,943
新闻里一会儿说某家发布新模型，一会儿说智能体元年，一会儿又是各种人工智能应用。

72
00:06:40,893 --> 00:06:43,200
这三个词到底谁是谁。

73
00:06:43,200 --> 00:06:45,472
拿汽车打比方最清楚。

74
00:06:45,472 --> 00:06:49,138
模型是发动机，提供智能这个原材料。

75
00:06:49,138 --> 00:06:55,857
通义千问、Kimi、豆包这些名字里的核心就是模型，国外那几家知名模型也一样。

76
00:06:55,857 --> 00:06:59,955
它只做一件事，你给它文字，它接出文字。

77
00:06:59,955 --> 00:07:05,496
发动机很强大，但单独一台发动机放在地上，普通人用不了。

78
00:07:05,496 --> 00:07:12,539
智能体是装上轮子、方向盘、油箱的整车，让模型能动手，而不只是动嘴。

79
00:07:12,539 --> 00:07:21,277
给模型接上工具，能查资料、读文件、执行操作、检查结果不对就重来，这一整套装置叫智能体。

80
00:07:21,277 --> 00:07:26,554
区别在于，模型只能告诉你怎么做，智能体能直接做完。

81
00:07:26,554 --> 00:07:32,070
应用是你手机里叫到的那辆网约车，是普通人直接用的成品。

82
00:07:32,070 --> 00:07:39,835
豆包、Kimi 这些应用，以及各种人工智能客服、修图、做演示文稿的工具，都是应用层。

83
00:07:39,835 --> 00:07:46,001
它们把模型或智能体包装好，有界面、有账号、有客服，打开就能用。

84
00:07:46,001 --> 00:07:53,693
同一台发动机可以造出轿车、货车、跑车，同一个模型也支撑着成百上千个不同的应用。

85
00:07:53,693 --> 00:07:57,780
看懂这三层有一个实际好处，评价要对层。

86
00:07:57,780 --> 00:08:02,984
觉得某个应用不好用，未必是模型不行，可能是车没造好。

87
00:08:03,130 --> 00:08:08,993
上一节说智能体是装上轮子的整车，这一节看它实际跑起来什么样。

88
00:08:08,943 --> 00:08:13,787
任务是把我这个月的二十三张发票整理成一张报销单。

89
00:08:13,787 --> 00:08:16,635
聊天式人工智能会怎么说。

90
00:08:16,635 --> 00:08:25,662
它回你，好的，建议你这样做，第一步把发票按日期排序，第二步逐张录入金额和类目，第三步按类目汇总。

91
00:08:25,662 --> 00:08:31,683
它很有帮助，但给你的是一份攻略，活儿还是你干，你照着做了一个小时。

92
00:08:31,683 --> 00:08:33,366
智能体怎么干。

93
00:08:33,366 --> 00:08:38,667
第一步读取，逐张识别二十三张发票的金额、日期、类目。

94
00:08:38,667 --> 00:08:46,431
第二步拿不准就问，第七张照片有点糊，金额是三百八十还是八百八十，你回一句，它继续。

95
00:08:46,431 --> 00:08:50,253
第三步汇总，按类目整理成报销表格。

96
00:08:50,253 --> 00:08:55,938
第四步自查，合计和逐项相加不一致，发现漏了一张，回去补上。

97
00:08:55,938 --> 00:09:01,359
最后交付一份能直接提交的报销单，你全程只回答了一个问题。

98
00:09:01,359 --> 00:09:03,991
它比会聊天多了四样东西。

99
00:09:03,991 --> 00:09:10,890
会拆任务，接到大目标自己拆成小步骤，先干什么后干什么，哪一步要先确认。

100
00:09:10,890 --> 00:09:18,979
会用工具，能查资料、读文件、算数字、操作软件，接话茬的大脑配上了能干活的手。

101
00:09:18,979 --> 00:09:24,219
会自查，做完一步回头看结果对不对，合计不平就重新算。

102
00:09:24,219 --> 00:09:33,150
会坚持，一条路走不通就换条路，直到把事办成或者明确告诉你卡在哪，而不是给一版答案就下班。

103
00:09:33,150 --> 00:09:35,638
这里要给一个诚实的提醒。

104
00:09:35,638 --> 00:09:41,599
智能体不是魔法，步骤越多越自主，中间某一步出错的机会也越多。

105
00:09:41,599 --> 00:09:50,818
重要的活儿交给它之前，先用小任务试试手感，关键结果，数字、日期、要发出去的东西，依然值得你过目一遍。

106
00:09:50,818 --> 00:09:56,912
你的角色从执行者变成了验收的人，但验收这件事不能交出去。

107
00:09:57,060 --> 00:10:04,197
最近很火的技能小抄，原理其实简单到有点意外，就是一张写给人工智能的经验小抄。

108
00:10:04,147 --> 00:10:11,767
一个普通的文本文件，用大白话告诉它，遇到这类任务时先做什么、再做什么、注意什么。

109
00:10:11,767 --> 00:10:18,270
它不是什么新技术，但能让人工智能从来回问你四趟，变成一趟全搞完。

110
00:10:18,270 --> 00:10:21,611
举个例子，任务是去阳台把衣服收了。

111
00:10:21,611 --> 00:10:28,522
小抄里写着，什么时候用这张小抄，当主人提到收衣服、阳台、晾晒的时候。

112
00:10:28,522 --> 00:10:44,271
怎么做，第一步出门前先想好阳台上可能有什么，衣服、裤子、袜子、玩具；第二步能收的一次性全收回来，别一件一件跑；第三步看到植物顺手检查要不要浇水；第四步回来汇报一句都好了。

113
00:10:44,271 --> 00:10:49,187
最重要的原则，一趟搞完，别每做一步就回来问一次。

114
00:10:49,187 --> 00:10:52,805
你看，没有一行代码，全是大白话。

115
00:10:52,805 --> 00:11:11,751
它最近火起来有三个原因，主流工具先后支持了同一种简单格式，写一张到处都能用；人人都能写，你怎么教新同事做一件事就怎么写；还有最关键的，老师傅的经验第一次能装进系统里，以前只能口口相传，现在写成小抄它读了就会。

116
00:11:11,751 --> 00:11:18,878
再说氛围编程，就是用大白话指挥人工智能写代码，你负责提需求和试用反馈。

117
00:11:18,878 --> 00:11:22,568
不会编程的人真能做出能用的小工具。

118
00:11:22,568 --> 00:11:36,318
放在几年前，不会编程做软件确实是句空话，变化发生在人工智能学会了写代码，而且写得相当熟练，于是分工变了，代码由它来写，你的工作变成说清楚要什么。

119
00:11:36,318 --> 00:11:47,544
这不是退而求其次，说清楚需求本来就是普通人天天在做的事，你天天都在跟人描述需求，帮我把这个表格按月份分一下，这张图帮我调亮一点。

120
00:11:47,544 --> 00:11:55,056
以前是人学软件，现在是软件听人话，把需求说清楚这件事本身就是一种新的编程。

121
00:11:55,056 --> 00:12:02,027
传统路径报班学编程三个月起步，氛围编程做一个自用小工具，当天晚上就能搞定。

122
00:12:02,027 --> 00:12:11,859
上手门槛低得出乎意料，打开你常用的人工智能对话工具，用大白话描述一个你真想要的小东西，让它做成一个网页给你。

123
00:12:11,859 --> 00:12:18,650
比如帮我做一个网页，全屏显示距离我女儿高考还有多少天，字要大，背景要好看。

124
00:12:18,650 --> 00:12:22,160
做出来不满意就接着说，改到满意为止。

125
00:12:22,160 --> 00:12:27,724
从记账表、抽签器、倒计时页这种小东西开始练手感最合适。

126
00:12:27,724 --> 00:12:34,035
但边界要说清楚，有三类软件出了问题后果不一样，需要专业开发者把关。

127
00:12:34,035 --> 00:12:46,162
碰钱的，收款、转账、算工资，出一个问题损失是真金白银，专业团队会做大量测试和防错设计，这些活目前替代不了有人负责这四个字。

128
00:12:46,162 --> 00:12:56,787
存隐私的，存了别人的手机号、住址、健康记录，就有了保护数据的责任，数据怎么加密、泄露了怎么办，需要懂安全的人来兜底。

129
00:12:56,787 --> 00:13:08,133
很多人同时用的，自己用的工具卡一下无所谓，几千人同时用的服务一崩就是事故，扛住人多是一门专门的手艺，得让专业的人来。

130
00:13:08,270 --> 00:13:17,462
先说一个可能让你意外的事实，在全球用户盲测的排行榜上，国产模型早就不是追赶者了，好几家排在世界前列。

131
00:13:17,412 --> 00:13:22,412
真正的问题不是哪家最强，而是你的场景适合哪家。

132
00:13:22,412 --> 00:13:24,936
主力玩家各有拿手科目。

133
00:13:24,936 --> 00:13:37,112
通义千问是综合实力代表，旗舰版在全球文本盲测榜排进前五，图片生成也在全球前列，开源版本发得多，是全球开发者用得最多的开源系列之一。

134
00:13:37,112 --> 00:13:45,129
Kimi 是智能体干活的好手，旗舰版在全球智能体榜排进前五，处理长文档也是它的传统强项。

135
00:13:45,129 --> 00:13:54,876
深度求索的性价比突出，官方接口每百万字输入只要一两块钱，价格是同档模型的零头，编程和推理能力扎实。

136
00:13:54,876 --> 00:14:05,573
豆包是全家桶体验好，应用是国内用户量最大的之一，上手零门槛，生图和生视频都在全球榜前列，视频生成排到了全球第二。

137
00:14:05,573 --> 00:14:11,895
智谱是技术流，编程和工具调用是强项，开源社区口碑好，企业客户多。

138
00:14:11,895 --> 00:14:19,960
此外百度的文心搜索整合深，腾讯的混元背靠微信生态，还有几家在语音和视频上出彩。

139
00:14:19,960 --> 00:14:29,420
排名数据来自二零二六年八月的全球用户盲测榜，榜单每周都在变，具体名次别背，记住各有拿手科目这个结构就好。

140
00:14:29,420 --> 00:14:33,999
对普通用户，几个应用都免费，挑顺手的用就好。

141
00:14:33,999 --> 00:14:39,804
选择的心法只有一句，先想清楚你要干什么，再看谁这门课分高。

142
00:14:39,950 --> 00:14:44,226
最后给你一份可以马上用的判断清单，一共五条。

143
00:14:44,176 --> 00:14:49,429
第一条，写提示词先补齐三块，背景、要求、限制。

144
00:14:49,429 --> 00:14:55,126
背景说你是谁和什么场合，要求用具体动词，限制写清验收标准。

145
00:14:55,126 --> 00:14:58,912
写不好就加一句，开始前先问我几个问题。

146
00:14:58,912 --> 00:15:03,684
改稿时指着具体的地方提意见，别整段推翻重来。

147
00:15:03,684 --> 00:15:07,037
第二条，分清你在写哪一层提示词。

148
00:15:07,037 --> 00:15:21,580
聊天框里那是一次性交代，试错成本几乎为零；写进产品的那是岗位说明书，一个字的措辞差异会被放大百万倍，必须走写、测、改的循环，还要考虑成本和防诱导。

149
00:15:21,580 --> 00:15:24,068
第三条，评价要对层。

150
00:15:24,068 --> 00:15:29,333
应用不好用，先别怪模型，看看是车没造好还是发动机不行。

151
00:15:29,333 --> 00:15:33,263
这个判断能帮你省下一大笔换模型的成本。

152
00:15:33,263 --> 00:15:41,148
第四条，用智能体之前先做两件事，先用小任务试手感，再对关键结果亲自过目。

153
00:15:41,148 --> 00:15:50,583
它的价值是把事做完，代价是步骤越多出错机会越多，你的角色从执行者变成验收的人，验收不能外包。

154
00:15:50,583 --> 00:15:54,020
第五条，做软件时先分清边界。

155
00:15:54,020 --> 00:16:01,556
自用小工具随手做，碰钱的、存隐私的、很多人同时用的，交给专业开发者把关。

156
00:16:01,556 --> 00:16:07,482
选模型时先想清楚你要干什么，再看谁这门课分高，不要问谁第一。

157
00:16:07,482 --> 00:16:11,520
这五条的共同点是，先分清层次，再动手。

158
00:16:11,520 --> 00:16:15,294
层次分清了，大部分争论会自己消失。

