CHAPTER 6 · EP 35

把审美翻译给 AI 听 · 建立自己的参考库

第 6 章 · 第 35 讲 · 16:27

时长 16:27音色 云健 · 男声章节 6

同步字幕

章节导航(点击跳转)

0:00开场1:42
1:42出图质量,卡在你的词汇量上1:33
3:15构图、光影、色彩,每样记三个词2:08
5:24并排看,别一张张翻1:25
6:50收藏一百个,等于没收藏2:02
8:52拆解五步,从眯眼开始1:59
10:51把参考喂进去的三种姿势3:49
14:40收尾 · 可带走的判断清单1:46
解读全文

pm35-m6 解读与音频稿件 · 把审美翻译给 AI 听 · 建立自己的参考库

  • 模块:M6 产品手感
  • 课节:生图三件套 / 拆解五步 / 三种喂参考的姿势
  • 配套音频:pm35-m6-播客.mp3
  • 配套字幕:pm35-m6-播客.srt

一、本集解决什么问题

很多产品经理心里清楚什么样算好看,可一旦要把这个「好看」交给人工智能去执行,说出口的就只剩「温馨一点、再高级一点」。模型按训练数据的平均值给一版,你明知不对,却说不清该改哪里。

根源不在模型的审美,而在输入。形容词要经过两次翻译:你把感觉压缩成词,模型再把词展开成画面,两头都有损耗。把参考直接塞进对话,损耗最小,一次到位。

在人工智能产品里,界面与配图不再是设计师交付完就结束的静态产物,而是模型每次生成的动态输出。你不再是在验收一张图,而是在验收一条生成链路。链路的输入是你写的,输入含糊,产出必然平庸,而且你连返工的理由都提不出来。

本集给出一条完整链路:先补词汇量(审美三件套),再练拆解顺序(看进去的五步),最后把看出来的东西喂给模型(三种姿势)。


二、能力地图

本集覆盖三项能力,从眼力到生产力逐级递进。

层级能力具体表现验证方式
L1 词汇审美三件套构图、光影、色彩各记三个词,生图时三行写全说出「三分法 / 侧逆光 / 低饱和」并解释各自管什么
L2 眼力拆解五步眯眼 → 层级 → 间距 → 颜色 → 细节,每层只答一问现场拆一个好设计,报出原子网格单位
L3 传递三种喂法垫图管气质、风格描述管规则、设计变量管代码面对一个需求能选出正确喂法并说明理由
L4 标准判例库每张参考图配一句判词,沉淀为变量清单同一需求改十稿不漂移

四项能力的依赖关系是单向的:没有 L1 的词汇,L2 拆出来的东西说不出来;拆不出来,L3 就只能垫图碰运气;没有 L4,每次生成都从零开始漂。

提示1 · 先补词汇再谈审美

不要一上来就训练「审美感觉」。审美感觉无法传递、无法验收、无法教给模型。先花一小时把构图、光影、色彩各三个词背下来,这是投入产出比最高的一步。九个词,一张纸写得下。


三、审美三件套:构图、光影、色彩

出图质量的上限卡在词汇量上。说「一张好看的咖啡海报」,模型给的是训练数据的平均值;说「三分法构图、黄金时刻侧逆光、低饱和莫兰迪色调」,模型立刻拿到施工图。前者是许愿,后者是下单。

摄影师和画家练了一百年的语言是现成的,直接拿来就能用,不需要重新发明。

构图(管主体站位)

  • 三分法:画面横竖各切三份,主体放在交点上,比居中耐看
  • 留白:空出来的地方给主体让位,画面不用填满
  • 视线引导:用海岸线、道路这类线条,把视线牵到主体上

光影(管立体感)

  • 侧光:光从侧面来,立体感靠影子撑起来
  • 黄金时刻:日出日落前后一小时,光又软又有方向
  • 明暗对比:亮部和暗部拉开,主体从背景里跳出来

色彩(管情绪)

  • 色调统一:全图一个色系,杂色越少越耐看
  • 低饱和:把颜色的音量调低,质感立刻上来
  • 点缀色:留一处高饱和当视觉焦点,多了就打架

提示2 · 出图不对时按三行逐项排查

不要重抽十次碰运气。把构图、光影、色彩三行写全再发;结果不对时,按这三行逐项检查是哪一行没说清,只改那一行。许愿改成下单,运气改成排查。

四选一验收:并排摆开再挑

信息设计领域的老前辈爱德华·塔夫特(Edward Tufte)在《The Visual Display of Quantitative Information》里留了七条原则,《About Face 4:交互设计精髓》第 17 章把它们搬进了界面设计。其中两条正好解释并排为什么更灵:

  1. 加强视觉对比,对比产生情境。 单独看一张灯塔照说不准构图好坏,两张并排立刻分出高下。眼睛天生是一台对比机器,缺的只是并排的机会。
  2. 在相邻空间上并排显示,优于按时间堆积。 一张张翻着看,比较靠短时记忆;并排摆开,比较靠眼睛。

因此正确姿势是:一次要四张,攒齐了并排摆开再挑,别看一张删一张。四选一时你能指着其中一张说「这张用了三分法,主体落在交点上,其余三张居中」,交稿不靠运气。


四、拆解五步:怎么看设计才算看进去了

收藏夹里躺着一百个灵感网站,真要动手还是找不到方向,这种收藏等于没收藏。打开一个好设计,扫一眼说「真好看」,截图,关掉,这是游客行为——什么都没带走。

第 0 步 · 眯眼

闭上一只眼,眯起另一只看屏幕。细节糊掉之后,剩下的只有块面、明暗和分组,哪些元素跳得出来、哪些看上去是一伙的,一眼就有答案。《About Face 4》第 17 章把它列为检验层级和关系的首选工具。

眯眼在验什么?书里给了答案:人看到一屏东西,下意识会连问两个问题——这里什么重要?这些东西有什么关联?好设计抢在你问出口之前就答完了。翻成白话就是拆解口诀:

这个界面想让我先看什么?哪些东西被摆成了一伙?

眯眼答第一遍,睁眼验第二遍。答案一致,层级过硬;眯眼时找不到落点、分组糊成一片,睁眼看再精致也白搭。

第 1 步 · 层级:谁是这一屏的唯一主角。

第 2 步 · 间距:内边距有没有规律。

第 3 步 · 颜色:几种、怎么分工。数得过来,说明当初定过预算。

第 4 步 · 细节:圆角、阴影、字重各有几档。

顺序从大到小,先抓骨架,再抠皮肤。

提示3 · 间距要拿尺子量,别靠手感

《About Face 4》第 17 章管这把尺子叫原子网格单位:先定一个最小间距(如 8px),元素与元素、组与组的距离一律取它的倍数。书里给网格记了三笔账:位置有规律,用户找东西更快(可用性);区域比例妥帖,看着舒服(美感);布局决策提前做完,改版省力(效率)。

反过来就是鉴定好设计的硬指标:拿工具量三五个间距,看能不能除尽同一个数。除得尽,说明背地里有一套网格系统在管;除不尽,多半是手摆的。这一步不需要你会设计,只需要你会量。

注意一个常见陷阱:验收题里「看着舒服就行」是错误选项。看着舒服不等于没有单位,恰恰相反,通常是有人替你把单位定好了。

拆解的本质:把别人的思考倒放一遍

塔夫特给优秀视觉设计下过一个定义,《About Face 4》第 17 章原样转述:

「优秀的视觉设计,是把清晰的思考视觉化。」

顺着这个定义看,你找的主角、量的间距、数的颜色,都是设计者想清楚之后落在页面上的痕迹。拆一张好设计,等于把别人的思考过程倒放一遍。反过来,一张拆不出所以然的页面,多半当初就没想清楚。

存参考图之前,先配一句判词——它好在哪个变量。收藏夹就从图堆变成了判例库。


五、三种喂参考的姿势

喂法给什么适合场景短板
垫图一到三张参考图整体气质、构图、风格迁移容易连版式一起抄走
风格描述一段规格文字:密度、主色、圆角能用规则讲清楚的风格讲不清的气质写不出来
设计变量token 清单:主色 / 圆角 / 字体 / 间距让 AI 写 UI 代码管得住样式,管不住布局与文案

场景配对练习(三个需求,三种答案)

  1. 重画活动海报、要保住品牌气质 → 垫图,附过往海报让它学气质
  2. 让代码工具生成的管理后台像某款以简洁著称的产品 → 设计变量,给主色、圆角、字体、间距的 token 清单
  3. 详情页要告别「AI 味」,但你说不清要什么风格 → 垫图 + 风格描述,图定气质,文字圈住规则

风格描述有方法论:体验属性

《About Face 4》第 17 章记录了 Cooper 公司的做法,叫体验属性:动手设计之前,先和客户一起挑出 3~5 个形容词,描述产品的气质与品牌承诺,比如「干净、克制、可信」。词一旦定下来,就成了后续所有视觉决策的裁判——方案拿不准,回头问这几个词答应不答应。

书里还说形容词之间允许打架:「安全」和「灵活」可以同时在场,这种张力值得保留,两个词冲突的地方正是早期风格稿要优先回答的问题。

搬到喂 AI 上严丝合缝:先用形容词把气质钉住,再把每个形容词翻译成具体规格。光给形容词,模型会按平均值理解;翻译这一步做完,风格描述才算写好。词是裁判,规格是执行。

提示4 · token 清单是给 AI 立标准

把参考图拆成 design token,主色、圆角、字体、间距各落成一个变量,你交出去的已经超出一份参考,那是一套界面标准。

标准的价值在可预见性:《About Face 4》第 17 章引尼尔森的账——统一的界面标准让用户学得更快、错得更少,因为在一处攒下的经验能预见另一处的行为;对开发团队,现成决策省掉一轮轮争论。搬到 AI 身上同样成立:token 清单一给,每次生成都落在同一套标准上,改十次稿也不漂移,验收时手里有了对照物。

同一章也把丑话说在前头:遵守标准,除非有极好的其他选择。打破可以,理由要硬,这条对你和对 AI 一样适用。


六、审查清单

产出前逐项过一遍,任何一项答不上来就停在那一步。

  • 生图提示词里,构图、光影、色彩三行是否都写全了?
  • 出图不对时,能否定位到具体是哪一行没说清?(而不是「感觉不对」)
  • 候选图是否一次性要够四张,并排摆开再挑?
  • 看一个好设计时,是否先眯眼答了口诀两问?
  • 间距是否拿工具量过三五个,能否除尽同一个数?
  • 存参考图之前,是否配了一句判词,写清它好在哪个变量?
  • 选喂法时,是否分清了「气质 / 规则 / 代码」各归谁管?
  • 风格描述是否先钉了 3~5 个形容词,再逐词翻译成规格?
  • 给 AI 写代码时,是否交了 token 清单而不是形容词?

七、约束说明

本集方法有其适用边界,越界使用会失效。

约束一:三件套管的是「描述」,不保证「生成」。 词汇量决定你能不能把需求说清楚,不代表模型一定能执行到位。模型能力不足时,换模型比改提示词更有效。

约束二:垫图会连版式一起抄走。 只要气质不要布局时,必须用风格描述圈住边界,否则会得到一个气质对、结构也照搬的产物。

约束三:token 清单管不住布局与文案。 样式可以标准化,信息架构和内容策略不行,那部分仍需人来定。

约束四:拆解五步适用于「好设计」,不适用于「好产品」。 一个页面拆得再漂亮,也不等于它解决了用户问题。视觉拆解是手段,不是目的。

约束五:形容词翻译有损耗。 体验属性法降低损耗,但不消除损耗。最终仍需并排对比来验收,不能只靠文字规格下判断。

约束六:参考库的价值取决于判词,不取决于数量。 收藏一百张不写判词的图,等于没收藏。判例库的复利来自每一张图背后那句「它好在哪个变量」。

提示5 · 参考库是判例库,不是收藏夹

从今天起改一条习惯:存图之前先写一句它好在哪。三个月后,你手上会有一批带判词的判例,而不是一堆叫不出好处的截图。这才是能拿去喂 AI、能拿去验收的资产。


七之二、常见误区与判词模板

四个高频误区

误区一:把「好看」当成不可拆的整体。 一提到审美就觉得是天赋,于是放弃拆解,只能靠感觉投票。实际上审美可以拆成构图、光影、色彩三组变量,每组三个词,共九个可命名的变量。能命名就能传递,能传递就能让模型执行。

误区二:收藏等于掌握。 收藏夹的膨胀速度和眼力的增长速度不成正比,因为截图这个动作不带走任何信息。真正带走信息的是判词——那句「它好在哪个变量」。没有判词的图,在你需要的时候检索不出来。

误区三:一次只看一张候选图。 单张评估没有参照系,判断靠记忆和感觉,改到第四版已经忘了第一版什么样。并排评估把比较交给眼睛,四张铺开时差异会被放大,判据会自动浮现。

误区四:把形容词当规格发给模型。 「温馨一点、再高级一点」在模型那里会被展开成训练数据的平均值。正确顺序是先钉 3~5 个形容词做裁判,再逐词翻译成密度、主色、圆角这类可执行规格,两样一起给。

判词模板:三档写法

判词写得好不好,取决于它是否指向一个可复用的变量。对照下面三档,看自己停在哪一档。

档位示例判词问题
差「这个好看,存一下」无变量,不可检索、不可传递
中「配色舒服、留白多」有模糊方向,模型无法执行
好「主体三分法落点,低饱和单一色系,间距全部是八像素的倍数」指向可命名变量,可直接转提示词或 token

只有第三档的判词能同时喂给人和模型。写不出来的时候,回到拆解五步,通常卡在「间距」或「颜色」这两步没量。

从判词到资产的转换路径

判例库不是存完就结束,它有一条明确的升值路径:

  1. 收集:看到一个好设计,先眯眼拆五步,写下判词(它好在哪个变量)
  2. 归类:按三件套归档——这条判词属于构图、光影还是色彩
  3. 量化:把「低饱和」「间距规律」这类描述换算成具体数值,如主色色值、圆角档位、间距基数
  4. 沉淀:把量化结果落成 token 清单,成为可复用标准
  5. 复用:下次生成直接给 token 清单 + 一两张垫图,改稿不漂移

走完这五步,你手上的不再是灵感收藏夹,而是一套团队共用的界面标准。这也是本模块「产品手感」真正想交付的东西——手感不是玄学,是可命名、可传递、可验收的变量集合。


八、可带走的判断清单

  1. 产出平庸先查输入。 输入只有形容词,产出只能落在平均值上,这是模型机制决定的,不是模型不行。换成参考和变量,同一个模型立刻换脸。下次觉得模型审美差,先别换模型,先看自己给了它什么。
  2. 九个词落到纸面上。 构图记三分法、留白、视线引导;光影记侧光、黄金时刻、明暗对比;色彩记色调统一、低饱和、点缀色。生图三行写全再发,出图不对按三行排查。
  3. 看设计按五步走,别截图就走。 第 0 步眯眼,然后层级、间距、颜色、细节,每层只回答一个问题。间距拿尺子量三五个,能除尽同一个数的背地里有网格。
  4. 给 AI 立一套标准。 把参考图拆成主色、圆角、字体、间距的变量清单,交出去的就是一套界面标准。标准值钱在可预见,改稿不漂移,验收有对照物。

参考库不是收藏夹,是判例库。它的复利来自每一张图背后那句判词。


来源:xueai.miyang.cn(小山学堂 · 洛小山)

本页内容改编自小山学堂《学 AI 产品,从入门到精通》,为二次演绎配音版。部分设计原则整理自《About Face 4:交互设计精髓》第 17 章(Alan Cooper 等著),Tufte 视觉设计原则与定位句转引自同章。