CHAPTER 7 · EP 56

拆一个真实案例 · 优先级与收官

第 7 章 · 第 56 讲 · 15:29

时长 15:29音色 云健 · 男声章节 7

同步字幕

章节导航(点击跳转)

0:00开场 · 这一集解决什么问题1:16
1:16第一幕 · 清单过了不代表没病1:25
2:41第二幕 · 五个缺口逐个拆2:32
5:13第三幕 · 软墙与它的那条合规线1:16
6:29第四幕 · 效果按周计,排期按文件分1:08
7:38第五幕 · 先写问题,再堆功能3:24
11:02第七幕 · 用真实经历换可信度1:31
12:34第八幕 · AI 站在哪个位置1:20
13:55收尾 · 可带走的判断清单1:33
解读全文

pm56-m7 · 拆一个真实案例 · 优先级与收官

模块:M7 商业与合规 | 课节:2 节(拆本站:Google 收录 693 页,Bing 只有 50 页 / 一个人的优先级:先写能被搜到的问题)
来源:xueai.miyang.cn(小山学堂 · 洛小山《学 AI 产品,从入门到精通》),本页为二次演绎的解读与音频稿件

一、本集要解决什么

一个人既做产品又做内容,力气该往哪花?

  • 前半:一份真实审计复盘(小山学堂本站,2026-08-10),把十个缺口里最有代表性的五个讲清楚——每个都按「怎么发现 / 改了什么 / 拿什么验收」三段拆,动作可原样照抄。
  • 后半:内容优先级——没有词库工具预算时靠什么排序,以及哪些歪路碰了就是团灭。

为什么产品经理要关心:流量结构变了,用户的第一站越来越不是你的首页,而是搜索框和 AI 对话框。内容能不能在那一站被翻出来,决定了后面所有转化有没有入口。


二、能力地图

能力解决什么关键动作成本
收录实测「清单过了不代表没病」两个引擎各跑一次 site 查询,数字进台账30 秒
站点地图自查页面根本没被提交打开 sitemap 数条目,与实际页面数对账极低
结构化数据标注看到了但不被引用问答页注入 FAQPage;JSON-LD 补日期低(脚本化)
爬虫可观测GEO 效果盲飞bot 请求从「过滤」改「归档」,建 AI 抓取表低
软墙付费内容不可见全文进 HTML + 声明受限范围中
选题排序写没人搜的东西意图强度 × 竞争度两条仪表零
功能→问句翻译功能视角写作一个功能翻译五句用户原话零
真实经历「凭什么是你」账单、报错、谈判记录、被拒经历零

三、真实案例:2026-08-10 审计复盘

3.1 病人的底子

项数字(2026-08-10 实测)
页面总数759(中英韩三语)
有 description743 页
有 JSON-LD741 页
Google 收录约 693 页
Bing 收录约 50 页
按很多教程的标准,这已经算「SEO 做得不错的站」了。但一做实测就露馅——清单过了不代表没病,数字才是诊断书。

3.2 最要命的那个数字

同一个站、同一天:Google 约 693 页,Bing 约 50 页,差将近 14 倍。

关键背景:ChatGPT 的联网搜索大量依赖 Bing 索引。Bing 只认识你 50 页 → 不管另外 640 页写得多好,AI 替用户搜的时候都翻不到。

诊断结论:本站在 Google 眼里是个内容站,在 AI 眼里接近不存在。

成因:站长平台只注册了 Google,Bing 全靠自然爬。不是内容有差别,是你根本没跟它打过招呼。

3.3 五个缺口(可照抄)

#怎么发现改了什么拿什么验收
1两引擎各跑一次 site 查询,肉眼对比(成本 30 秒)注册 Bing 站长平台、提交 sitemap;接 IndexNow,发版脚本自动推送变更页。首次推送吃 403,原因是 key 文件未先放站点根目录两周内 Bing 收录 50 → 300+,每周在站长后台记一次
2打开 sitemap.xml 数条目:约 330 条全是中文页,.en / .ko 全靠外链随缘改生成脚本:每页输出中英韩三条 <url>,条目内用 hreflang 互指三个语言版本条目 330 → 约 800,站长工具无格式报错
337 个天然问答页只标了 Article,FAQPage 杠杆一个没用上构建脚本对这批页面自动注入 FAQPage:标题当 Question,页首答案块当 acceptedAnswer富媒体测试通过;每月拿这批问题问一遍 Perplexity,记录被引用次数
4抽查 JSON-LD,datePublished / dateModified 都没有日期不手填:脚本从 git 提交记录取首次提交与最近内容提交,写进 JSON-LD抽查十页 schema 校验通过,日期与 git 记录一致
5统计脚本为数字干净把 bot 请求全过滤,GPTBot 来没来一概不知过滤改归档:按 UA 统计各家 AI 爬虫日抓取量与热门路径,后台加一张「AI 抓取」表后台能看到各 AI 爬虫近 7 天抓取曲线
共性:每条修法都进了脚本和流程,没有一条靠手工。一个人维护几百个页面,手工必漏。

3.4 缺口的三层归类

层缺口顺序含义
引擎根本看不到收录差、sitemap 漏语言先修,不修后面做什么都白做
看到了但不引用问答页没标 FAQPage、没日期次之
没有度量仪表爬虫流量被丢弃监控面板要早于内容动作上线,否则效果没仪表可看

3.5 软墙:付费内容怎么既让爬虫看见又不白送

硬墙(改造前)软墙(改造后)
未登录用户只有登录框看到前 40%
爬虫抓到的源码空全文
受限页索引531 页完全不可见531 页全文可抓,可索引页 28 → 186

合规线:软墙与 cloaking 只隔一层纸,隔开它们的是 isAccessibleForFree: false 这行声明——在 JSON-LD 里明说「这页有付费部分,受限范围在哪」,这是 Google 官方认可的做法(Flexible Sampling)。

判断标准:你给引擎看的内容,和用户看到的是不是同一份。 删掉声明、给引擎全文却给用户空页,就从优化滑进了作弊。

3.6 效果按周计

  • Bing 收录数在改造当天一页都不会多。动作是当天做完的,效果按周计。
  • 验收标准因此可以全部写成「两周内」「每周记一次」这类带时间的目标。当天出效果的承诺,多半是骗子。
  • 工作量:审计半天,改造集中在一周内完成,绝大部分是改一个构建脚本。一个人、一周、几乎零现金成本。

四、内容优先级:一个人的 SEO 团队

4.1 先写问题,再堆功能

通病是「功能视角」:更新日志、功能介绍、版本对比,写得勤快,全是没人搜的东西。

用户不搜「XX 工具 v2.3 更新了什么」,他搜的是自己的麻烦。

两条仪表:

  • 意图强度:搜这句话的人离用你的产品有多近
  • 竞争度:这个问题已经有多少人答得不错

意图强、竞争弱 = 金矿。一人公司专挖这种,大词让大厂去卷。

4.2 四个候选选题体检(开票工具案例)

选题意图竞争结论
自由职业者给公司开票要交多少税强弱金矿,先写它
什么是发票弱高不碰(给巨头陪跑)
税务代开被拒的常见原因强弱稀缺供给,先写
发票工具 v2.3 更新日志零(搜索量也是零)零保持但零期待
这两条仪表还能救你于自我感动——每次列选题都问「谁会搜这句、搜的人离付费多近」,能把一半自我感动选题当场筛掉。

4.3 功能 → 问句翻译机

功能:上传合同 PDF,自动识别金额、税号和开票类型。翻译出的五句用户原话:

  1. 合同金额含税不含税怎么看
  2. 扫码识别出来的税号错了怎么办
  3. 个人能不能给公司开发票
  4. 合同里没写税号能开票吗
  5. 跨月的合同还能补开吗

五句话里没有一句提你的产品,全是用户自己的麻烦。 他为麻烦而来,因为你答得好而留下,顺手发现你的工具正好能解决。

副产品:这也是需求验证。绞尽脑汁翻译不出五句 → 通常不是文笔问题,是需求太窄或根本不存在。

4.4 用真实经历换可信度

引擎与 AI 都在收紧同一个阀门:偏爱有第一手经验的内容(Google 把 Experience 写进内容评估标准;AI 挑引用时偏向带具体数字与亲历细节的段落)。

你可能已经有的素材:

素材为什么值钱
云服务的真实账单「一个 XX 类产品每月到底花多少钱」永远有人搜
一次线上事故的完整时间线报错截图 + 定位过程 + 那行罪魁祸首
脱敏的谈判记录价格类问题搜索意图极强
被拒的经历(商标、上架、贷款)愿意写「失败」的人少,搜的人多
做错的决策与返工记录「早知道就…」天然可信

脱敏分寸:金额、日期、过程保留(可信度的来源);对手方名称、文书文号、个人信息一律隐去。

4.5 新写还是翻修旧文

情况动作理由
旧文有排名但数据旧了优先更新投入产出比最高:地基现成,只添一层
旧文没排名也没点击先诊断再决定查漏斗漏在哪层;选题没人搜的放弃不心疼,title 拖后腿的改两行
台账里有强意图弱竞争候选新写金矿有时效性

大致节奏:每写两三篇新的,回头翻修一篇旧的(记得连带更新 dateModified)。

4.6 AI 在内容生产里的位置

环节让 AI 干(助手位)别让 AI 干(印刷机位)
选题把一个功能翻译成 20 个候选问句,你来挑让它决定写什么,它只会挑大词
初稿把口述、日志、账单整理成结构化初稿没有输入材料硬编一篇「深度好文」
事实列出需要核对的数字和出处清单直接填数字,它会一本正经地编
批量批量起草几百页一句话摘要,人工过一遍批量生成几百个没人核过的独立页面

分界线只有一条:页面里有没有只有你能提供的东西。 有,AI 参与再多也是你的内容;没有,你亲手打字它也是灌水。


五、实践提示

提示一 · 照抄清单:一个下午跑完自己站的审计

  1. Google 和 Bing 各跑一次 site 查询,两个数记进台账,差距大就知道先补哪家
  2. 打开自己的 sitemap.xml 数条目,与实际页面数对一对
  3. 随机抽五页看源码:正文在不在、description 有没有、canonical 对不对、JSON-LD 带不带日期
  4. 找出所有一问一答形态的页面,查它们标没标 FAQPage
  5. 翻请求日志搜 GPTBot,搜不到就查是不是被统计脚本或防火墙丢弃了
  6. 有付费内容的话,用爬虫视角看受限页,确认引擎抓到的和用户看到的是同一份

每查一项记一行:现状、影响、修法。查完你手里就是自己站的审计报告。

提示二 · 每个缺口配三件事

发现要可复制、修法要进脚本、验收要带时间和数字。当天见效的承诺别信。

提示三 · 按「改哪个文件」分组排期

第一周三件事挤在一起,是因为它们改的是同一个构建脚本,一次发版全上。一个人做优化,按改哪个文件分组排期,比按哪个更重要排期省一半力气。

提示四 · 三层优先级不能跳

「引擎根本看不到」→「看到了但不引用」→「放大与防守」。看不到的时候谈引用是白谈,没有仪表的时候谈优化是盲飞。

提示五 · 黑帽的判断标准一句话

骗引擎的都是坑,帮引擎读懂真实内容的都是稳。

手段结论
花五百块买一批「高权重外链」坑
给问答页批量加 FAQPage 结构化数据稳
让 AI 按城市名批量生成五百个落地页坑
页脚放白底白字的关键词坑
把两年前旧文补上新数据重发,更新 dateModified稳
签「保证三个月上首页」的服务商坑(听到「内部渠道」「保证排名」「不做就被对手超了」任意一句,对话可以结束)

六、审查清单

上线 / 发版前逐条过:

  • 两个引擎的收录数是否已记进台账?差距是否仍异常?
  • sitemap 条目数与实际页面数是否对得上?多语言页是否都在?
  • 问答形态页面是否已标 FAQPage?
  • JSON-LD 是否带 datePublished / dateModified?日期来源是否自动?
  • AI 爬虫抓取数据是否可观测(不是被过滤掉)?
  • 付费页是否软墙?isAccessibleForFree 声明是否还在?引擎抓到的与用户看到的是否同一份?
  • 本周选题是否过了意图强度与竞争度两条仪表?
  • 是否有「只有你能提供」的第一手素材?
  • 内容台账是否已更新状态与发布满一个月后的真实数据?

七、约束说明

  1. 数字有口径、会过期:本集所有数字均为 2026-08-10 实测口径(693 / 50 / 759 / 743 / 330 → 800 / 531 / 37 等),收录数随时间变化,方法不会。
  2. 效果按周计:收录数与引用率需要引擎消化,验收必须写成带日期的目标。
  3. 软墙不能越线:删掉受限声明即构成 cloaking,一人公司输不起整站惩罚。
  4. AI 不能替代第一手经验:批量生成未核验页面属于灌水,与「AI 加速你的真实经验」是两回事。
  5. 题库内容不入音频:本集涉及的测验类页面仅作集页自测卡渲染,不进音频。

八、落地节奏

  • 第 1 周:sitemap 补多语言、llms-full.txt、补齐缺失 description、注册站长平台并提交(全是「看不到」级别的病)
  • 第 2 周:FAQPage 结构化数据、JSON-LD 日期、爬虫监控面板(「看到了但不引用」层)
  • 第 3–4 周:全站一句话答案块(唯一以周计的内容工作量,AI 批量起草 + 人工过一遍)
  • 每周例行:记录收录数、看爬虫曲线、看 AI 来源 referrer。改造是一次性的,度量是长期的

九、最小可行的内容台账(四列)

选题(用户的原话)意图竞争状态
自由职业者给公司开票要交多少税强弱已发布 08-02
税务代开被拒的常见原因强中写作中
合同金额含税不含税怎么看中弱排期
发票红冲是什么意思中中候选

规矩两条:新选题先进「候选」,每周只从上往下拿一到两个;发布满一个月回台账补一列真实数据(搜索展示、AI 引用与否),让下一轮排序踩着上一轮的事实。坚持一个季度,这张表比任何关键词工具都懂你的用户。


十、判断清单(可直接进评审会)

  1. 我们的站,在两个引擎里的收录数各是多少?上一次记录是什么时候?
  2. 有没有页面「存在但引擎不知道」?
  3. 我们的问答型内容,有没有被 AI 引用过?有没有在记录?
  4. 付费内容对引擎可见吗?声明还在吗?
  5. 我们最近三篇内容,是功能视角还是问题视角?
  6. 每个选题,谁会搜这句?他离付费有多近?
  7. 这个页面里,有没有只有我们能提供的东西?
  8. AI 在我们内容流程里站的是助手位还是印刷机位?
  9. 我们做过的事里,哪一件可以写成别人抄不走的素材?

十一、要点速记

  • 清单过了不代表没病,数字才是诊断书
  • 收录差 14 倍的根因:没跟那个引擎打过招呼
  • 每个缺口配三件事:怎么发现、改了什么、拿什么验收
  • 修法进脚本,不靠手工
  • 软墙靠声明合规;删了声明就是作弊
  • 效果按周计,当天见效的承诺别信
  • 按「改哪个文件」分组排期
  • 先写问题,再堆功能;意图强 × 竞争弱 = 金矿
  • 一个功能翻译不出五句用户原话 → 怀疑是伪需求
  • 真实经历是抄不走的指纹
  • 骗引擎的都是坑,帮引擎读懂真实内容的都是稳

十二、出处与延伸

  • 本站 2026 年 8 月 10 日 SEO / GEO 审计与当周改造的第一手记录
  • 「经验」进入内容评估标准:Google 搜索质量评估指南(E-E-A-T)
  • 批量灌水打击:Google 2024 年 3 月核心更新的公开公告
  • 软墙做法:Google 官方 Flexible Sampling
  • 选题体检的仪表为教学示意值,方法是真的

来源:xueai.miyang.cn(小山学堂 · 洛小山《学 AI 产品,从入门到精通》)
本页为二次演绎的解读与音频稿件,配套音频见本集 MP3。