💡 核心摘要:传统搜索的检索单位是页面——它把整页作为一个候选去排序。AI 搜索的检索单位是片段——它取走能独立成立的那几句话,拼进自己的答案。这一个改变决定了整个系列的立论:能被单独取走的东西,才是需要被单独登记的东西。 关键词注册表的原子是页面,它在结构上无法表达「这句断言归谁」,加多少列都改不了这一点。所以 GEO 需要的不是扩展,是一张以答案块为原子的新表;而这两张表分立之后,才有第六篇的关联可谈。
一、一个解释不了的现象
Staricell 有一篇《工业锂电池模组 UL 1973 认证指南》,做得相当扎实。半年后的数据是这样的:
Google 搜 "ul 1973 certification battery module" → 稳定第 3
GSC 显示:曝光稳定,点击率正常,没有任何异常
但在 ChatGPT / AI 概览里问同一个问题 →
答案讲得很准确,引用了三个来源,Staricell 不在其中
按传统 SEO 的逻辑,这不该发生。排第 3 意味着 Google 认为这一页是这个查询最好的答案之一,凭什么 AI 不引用?
更让人困惑的是反向的例子。同一个站的产品页在 Google 只排第 11,却经常被 AI 引用——而且引用的不是整页,是页面中段那张参数表里的两行。
这两个现象放在一起,指向同一个结论:AI 和 Google 挑的不是同一种东西。 Google 在挑页面,AI 在挑片段。
二、检索单位:排序整页 vs 拼装片段
把两种机制并排放,差别就清楚了。
传统搜索的产出是一份排序的候选清单。它的每一个候选是一个完整的页面,用户点进去自己读。页面是不可分割的原子——Google 不会把 A 页面的第三段和 B 页面的第五段拼起来给你。
AI 搜索的产出是一段合成的答案。为了写出这段答案,它需要若干条能独立成立的事实,这些事实来自不同来源的不同位置。页面在这里不是原子,而是仓库——它进去取货,取走的是货,不是仓库。
搜索:查询 → 候选页面集合 → 排序 → 返回十个链接
↑ 竞争发生在「页面 vs 页面」
AI: 提问 → 拆成若干需要被回答的点
→ 为每个点找一段能独立成立的表述
→ 合成答案 → 标注它取用了谁
↑ 竞争发生在「片段 vs 片段」
回到第一节的现象,两个都能解释了。
那篇 UL 1973 指南排第 3 却不被引用,通常是因为它的答案不能被单独取走:结论散落在三个段落里,关键判断依赖前文的铺垫,取走任何一段都不成立。作为页面它很优秀——一个人从头读到尾能学到东西;作为片段它不可用。
产品页排第 11 却被反复引用,是因为那张参数表里的两行恰好满足了片段的要求:自带主体、自带条件、不依赖上下文。「48V 模组在 25°C、0.5C 放电下循环寿命约 6000 次」这句话拿到任何地方都成立。
💡 判断一段内容是不是「片段」的标准:把它单独复制出来,粘贴到一个空白文档里,一个不了解你公司的人读完能不能获得一个准确、完整、有条件限定的事实?能,它是片段;需要回头看上文才能懂,它只是页面的一部分。
这个标准也解释了为什么答案块工程那一篇要强调「问题做标题、首句直答」——那不是写作风格偏好,是让内容具备可被单独取走的资格。
三、从检索单位推到登记单位
现在把这个观察推到注册表上。这一步是整个系列的立论,值得慢一点。
注册表的作用是声明归属:某件需要被承接的事,由谁承接。那么「谁」这个位置上填什么,取决于承接这件事的最小实体是什么。
在 SEO 里,承接一个搜索意图的最小实体是页面。因为竞争发生在页面之间,Google 要么选中这一页要么不选,不存在「选中这一页的第三段」。所以关键词注册表填 URL,完全正确。
在 GEO 里,承接一个提问的最小实体是块。AI 可以只取你页面里的一段,也可以从同一页取两段回答两个不同的问题。这时候「这个提问归哪个页面」这句话本身就不够精确了——它归的是那一页里的某一块。
⚠️ 这是一个结构问题,不是字段问题。 想给关键词注册表加一列「答案位置」来解决,会立刻遇到障碍:一个页面可能承载五个提问的答案块,一行记录里塞不下五个不同的归属。要塞得下,你就得为每个块单独开一行——而那时候你已经在建第二张表了,只是没承认。
所以结论是结构性的:
检索单位 = 页面 → 归属单位 = 页面 → 一行 = 一个意图×一个 URL
检索单位 = 片段 → 归属单位 = 块 → 一行 = 一个提问×一个块
两张表的原子不同,就不可能是同一张表。这不是「要不要拆开」的偏好问题,是粒度决定的。
四、两张表的性质对比
粒度只是第一个差异。顺着它往下看,两张表在几乎每个维度上都不一样——这张表是上面那段论证的结论,不是一份设计稿:
| 维度 | SEO 注册表 | GEO 注册表 |
|---|---|---|
| 最小单位 | 页面(URL) | 答案块(URL + 位置) |
| 登记对象 | 查询组(字符串) | 规范化提问(自然语言) |
| 对象的来源 | 可观测——工具里能查到搜索量 | 需推断——从询盘、PAA、销售记录反推 |
| 唯一性约束 | 一个意图一个 Primary URL | 一个提问一个答案主人 |
| 成功信号 | 排名、点击、转化 | 被引用、AI 引荐流量 |
| 冲突形态 | 关键词自相残杀(争排名) | 答案归属分散、事实互相矛盾 |
| 失败表现 | 排不进前十 | 排得进,但答案里没有你 |
有三行值得特别注意,因为它们各自引出后面一篇:
「对象的来源」这一行,是第三篇的主题。关键词是可观测的事实,提问是一种推断出来的信念。登记信念和登记事实,要求完全不同——你必须记住它从哪来,必须允许它被推翻。
「唯一性约束」这一行,是第五篇的主题。注意两条约束不冲突却容易被混淆:SEO 说一个页面只该有一个主意图,GEO 说一个页面可以承载多个答案块。它们约束的是不同层次的东西。
「冲突形态」这一行,是第四篇的主题。SEO 的冲突是竞争问题(两页争一个词,损失是效率),GEO 多出一种 SEO 里不存在的故障——两个页面对同一个参数给出不同数字,损失是信任。
五、为什么 SEO 注册表不会被取代
看完上面的对比,很容易走到另一个极端:既然 AI 检索片段,那是不是该把重心全挪到 GEO 表上?
不能。原因是片段的可见性依然由页面提供。
AI 要取走你的片段,前提是这个片段所在的页面已经进入了它的候选来源。而进入候选的机制,绝大部分仍然依赖传统索引信号——页面被抓取、被收录、有一定的权重和相关性。一个没被收录的页面里的完美答案块,不会被任何 AI 取走。
页面层(SEO 注册表管):决定你的内容进不进候选池
块层(GEO 注册表管): 决定进了候选池之后,取不取你这一块
两层是串联的,前一层是后一层的必要条件
这也是实体金字塔那篇讲过的「实体层是加盖,不是另起炉灶」在注册表层面的对应。两张表不是替代关系,是叠加关系:SEO 表管「这一页凭什么被检索到」,GEO 表管「这一页里的哪一块负责哪个提问」。
⚠️ 不要为 AI 单独造页面。 一个只为被引用而存在、没有真实读者价值和索引地位的页面,两头都拿不到——它的答案块进不了候选池,它的页面也没有排名。这条在第六篇会作为一条硬约束再讲一次。
六、分立两张表带来的实际好处
理论论证之外,分立的直接收益是三件在合并时做不到的事。
第一,能表达“一页多块”。 Staricell 的工业电池产品页实际上同时承接了四个提问:这个模组多少容量档位、能不能定制、有哪些认证、能并联几台。合并成一张表时,这一页只能有一行,四个提问要么挤在一格里,要么丢掉三个。分开之后,四个提问各自一行,各自指向页面里的不同位置,各自有自己的状态和责任人。
第二,能表达“跨页同问”。 反过来,同一个提问的答案有时会被多个页面提及——产品页提一句,认证指南详细讲,博客对比时又带一次。GEO 表能记下「这个提问的主人是认证指南里的那一块,其余两处是复述」。这种关系在页面粒度的表里根本没有位置可写。
第三,改动的影响面能被查到。 当 UL 1973 的认证范围更新时,你需要知道哪些块引用了这个事实。块粒度的表能直接列出来;页面粒度的表只能告诉你「认证指南这一页相关」,剩下的靠人回忆。
这三件事恰好对应第五、四、七篇要展开的内容。它们的共同前提,就是本篇论证的那一句:登记单位必须和检索单位对齐。
七、落地形态:一份补充说明
按这个系列的取舍,形态问题是次要的,但为了不让你从原理到动手之间断档,这里给一个最小说明。
一条 GEO 注册表记录至少要能表达四件事:
这是哪个提问 → 规范化后的问句
谁是它的主人 → 页面 + 页面内的位置(锚点或小节标题)
这个答案的事实从哪来 → datasheet / 测试报告 / 认证编号
它现在什么状态 → 待写 / 已发布 / 已被引用 / 需更新
四件事之外的字段都是可选的,等你真的需要时再加。第八篇会给一份完整字段清单和落地格式的取舍(Markdown 表格适合人读和评审,结构化格式适合被脚本和 AI 消费),但不要在字段还没被用起来之前就先把表设计到完备——第一篇讲过,字段的正确数量由填不填得起决定。
📌 核心收获
- ✓ 搜索排序整页,AI 拼装片段:两者挑的不是同一种东西。
- ✓ 能被单独取走的东西,才是需要被单独登记的东西——这是本系列的立论。
- ✓ 关键词注册表的原子是页面,结构上无法表达「这句断言归谁」,加列解决不了。
- ✓ 判断片段的标准:单独复制出来,陌生人读完能否获得一个完整、有条件的事实。
- ✓ 两张表是叠加不是替代——页面层决定进不进候选池,块层决定取不取这一块。
- ✓ 分立之后才能表达一页多块、跨页同问,以及查到一次改动的影响面。
🚀 立刻行动
- 挑一个你排名不错但从未被 AI 引用的页面,检查它的结论能否被单独取走。
- 把这一页实际承接的提问逐条列出来,看是不是超过一个——这就是你需要块粒度的证据。
- 对照第四节的对比表,判断你现在的注册表是在管页面还是在管块。
- 挑一个提问,写清它的主人是哪一页的哪一块,以及事实来自哪份文件。
- 找出一处「同一个参数在两个页面里数字不同」的地方,留到第四篇处理。
来源:系列原创整理 | 本文为「SEO-GEO 注册表体系」系列第 2 篇,下一篇讲提问为什么是推断出来的,以及规范化为什么是杠杆最大的一步
RELATED / 相关推荐
接着读这些
按同一分类、系列与标签为你挑选。
答案块工程:写出能被 AI 抽出来引用的内容
排得进前十,AI 答案里却没有你,往往是内容结构问题。本文用电池外贸案例,拆解答案块的标准结构:问题做标题、首句直答、数据支撑、Schema 标注,把高优先级问题写成 AI 能整段抽走的可引用单元。
AI 搜索时代的关键词:从关键词到实体与被引用
AI Overview、ChatGPT 和 Perplexity 正在改变搜索。本文拆解关键词体系如何叠加实体、问题和被引用信号,让外贸 B 端内容不只排名,还能被 AI 搜索引用。
GEO 技术底层:AI 如何生成答案
从 LLM、RAG、知识图谱到 AI 答案生成流程,拆解 GEO 为什么能影响 AI 输出,以及内容团队需要如何调整策略。