跳到主要内容
IM智引科技

研究 / GEO

检索的单位变了:为什么 GEO 需要另一张注册表

搜索检索并排序页面,AI 检索并拼装片段。本文论证一个结构性结论:检索单位一旦改变,归属单位必须跟着改变——所以 GEO 不是给关键词注册表加几列能解决的,它需要一张以答案块为原子的新表。

智引科技增长实验室2026年8月8日12 分钟难度 高级

💡 核心摘要:传统搜索的检索单位是页面——它把整页作为一个候选去排序。AI 搜索的检索单位是片段——它取走能独立成立的那几句话,拼进自己的答案。这一个改变决定了整个系列的立论:能被单独取走的东西,才是需要被单独登记的东西。 关键词注册表的原子是页面,它在结构上无法表达「这句断言归谁」,加多少列都改不了这一点。所以 GEO 需要的不是扩展,是一张以答案块为原子的新表;而这两张表分立之后,才有第六篇的关联可谈。


一、一个解释不了的现象

Staricell 有一篇《工业锂电池模组 UL 1973 认证指南》,做得相当扎实。半年后的数据是这样的:

Google 搜 "ul 1973 certification battery module" → 稳定第 3
GSC 显示:曝光稳定,点击率正常,没有任何异常

但在 ChatGPT / AI 概览里问同一个问题 →
答案讲得很准确,引用了三个来源,Staricell 不在其中

按传统 SEO 的逻辑,这不该发生。排第 3 意味着 Google 认为这一页是这个查询最好的答案之一,凭什么 AI 不引用?

更让人困惑的是反向的例子。同一个站的产品页在 Google 只排第 11,却经常被 AI 引用——而且引用的不是整页,是页面中段那张参数表里的两行。

这两个现象放在一起,指向同一个结论:AI 和 Google 挑的不是同一种东西。 Google 在挑页面,AI 在挑片段。

二、检索单位:排序整页 vs 拼装片段

把两种机制并排放,差别就清楚了。

传统搜索的产出是一份排序的候选清单。它的每一个候选是一个完整的页面,用户点进去自己读。页面是不可分割的原子——Google 不会把 A 页面的第三段和 B 页面的第五段拼起来给你。

AI 搜索的产出是一段合成的答案。为了写出这段答案,它需要若干条能独立成立的事实,这些事实来自不同来源的不同位置。页面在这里不是原子,而是仓库——它进去取货,取走的是货,不是仓库。

搜索:查询 → 候选页面集合 → 排序 → 返回十个链接
             ↑ 竞争发生在「页面 vs 页面」

AI:  提问 → 拆成若干需要被回答的点
           → 为每个点找一段能独立成立的表述
           → 合成答案 → 标注它取用了谁
             ↑ 竞争发生在「片段 vs 片段」

回到第一节的现象,两个都能解释了。

那篇 UL 1973 指南排第 3 却不被引用,通常是因为它的答案不能被单独取走:结论散落在三个段落里,关键判断依赖前文的铺垫,取走任何一段都不成立。作为页面它很优秀——一个人从头读到尾能学到东西;作为片段它不可用。

产品页排第 11 却被反复引用,是因为那张参数表里的两行恰好满足了片段的要求:自带主体、自带条件、不依赖上下文。「48V 模组在 25°C、0.5C 放电下循环寿命约 6000 次」这句话拿到任何地方都成立。

💡 判断一段内容是不是「片段」的标准:把它单独复制出来,粘贴到一个空白文档里,一个不了解你公司的人读完能不能获得一个准确、完整、有条件限定的事实?能,它是片段;需要回头看上文才能懂,它只是页面的一部分。

这个标准也解释了为什么答案块工程那一篇要强调「问题做标题、首句直答」——那不是写作风格偏好,是让内容具备可被单独取走的资格。

三、从检索单位推到登记单位

现在把这个观察推到注册表上。这一步是整个系列的立论,值得慢一点。

注册表的作用是声明归属:某件需要被承接的事,由谁承接。那么「谁」这个位置上填什么,取决于承接这件事的最小实体是什么。

在 SEO 里,承接一个搜索意图的最小实体是页面。因为竞争发生在页面之间,Google 要么选中这一页要么不选,不存在「选中这一页的第三段」。所以关键词注册表填 URL,完全正确。

在 GEO 里,承接一个提问的最小实体是块。AI 可以只取你页面里的一段,也可以从同一页取两段回答两个不同的问题。这时候「这个提问归哪个页面」这句话本身就不够精确了——它归的是那一页里的某一块。

⚠️ 这是一个结构问题,不是字段问题。 想给关键词注册表加一列「答案位置」来解决,会立刻遇到障碍:一个页面可能承载五个提问的答案块,一行记录里塞不下五个不同的归属。要塞得下,你就得为每个块单独开一行——而那时候你已经在建第二张表了,只是没承认。

所以结论是结构性的:

检索单位 = 页面  →  归属单位 = 页面  →  一行 = 一个意图×一个 URL
检索单位 = 片段  →  归属单位 = 块    →  一行 = 一个提问×一个块

两张表的原子不同,就不可能是同一张表。这不是「要不要拆开」的偏好问题,是粒度决定的。

四、两张表的性质对比

粒度只是第一个差异。顺着它往下看,两张表在几乎每个维度上都不一样——这张表是上面那段论证的结论,不是一份设计稿:

维度 SEO 注册表 GEO 注册表
最小单位 页面(URL) 答案块(URL + 位置)
登记对象 查询组(字符串) 规范化提问(自然语言)
对象的来源 可观测——工具里能查到搜索量 需推断——从询盘、PAA、销售记录反推
唯一性约束 一个意图一个 Primary URL 一个提问一个答案主人
成功信号 排名、点击、转化 被引用、AI 引荐流量
冲突形态 关键词自相残杀(争排名) 答案归属分散、事实互相矛盾
失败表现 排不进前十 排得进,但答案里没有你

有三行值得特别注意,因为它们各自引出后面一篇:

「对象的来源」这一行,是第三篇的主题。关键词是可观测的事实,提问是一种推断出来的信念。登记信念和登记事实,要求完全不同——你必须记住它从哪来,必须允许它被推翻。

「唯一性约束」这一行,是第五篇的主题。注意两条约束不冲突却容易被混淆:SEO 说一个页面只该有一个主意图,GEO 说一个页面可以承载多个答案块。它们约束的是不同层次的东西。

「冲突形态」这一行,是第四篇的主题。SEO 的冲突是竞争问题(两页争一个词,损失是效率),GEO 多出一种 SEO 里不存在的故障——两个页面对同一个参数给出不同数字,损失是信任。

五、为什么 SEO 注册表不会被取代

看完上面的对比,很容易走到另一个极端:既然 AI 检索片段,那是不是该把重心全挪到 GEO 表上?

不能。原因是片段的可见性依然由页面提供

AI 要取走你的片段,前提是这个片段所在的页面已经进入了它的候选来源。而进入候选的机制,绝大部分仍然依赖传统索引信号——页面被抓取、被收录、有一定的权重和相关性。一个没被收录的页面里的完美答案块,不会被任何 AI 取走。

页面层(SEO 注册表管):决定你的内容进不进候选池
块层(GEO 注册表管):  决定进了候选池之后,取不取你这一块

两层是串联的,前一层是后一层的必要条件

这也是实体金字塔那篇讲过的「实体层是加盖,不是另起炉灶」在注册表层面的对应。两张表不是替代关系,是叠加关系:SEO 表管「这一页凭什么被检索到」,GEO 表管「这一页里的哪一块负责哪个提问」。

⚠️ 不要为 AI 单独造页面。 一个只为被引用而存在、没有真实读者价值和索引地位的页面,两头都拿不到——它的答案块进不了候选池,它的页面也没有排名。这条在第六篇会作为一条硬约束再讲一次。

六、分立两张表带来的实际好处

理论论证之外,分立的直接收益是三件在合并时做不到的事。

第一,能表达“一页多块”。 Staricell 的工业电池产品页实际上同时承接了四个提问:这个模组多少容量档位、能不能定制、有哪些认证、能并联几台。合并成一张表时,这一页只能有一行,四个提问要么挤在一格里,要么丢掉三个。分开之后,四个提问各自一行,各自指向页面里的不同位置,各自有自己的状态和责任人。

第二,能表达“跨页同问”。 反过来,同一个提问的答案有时会被多个页面提及——产品页提一句,认证指南详细讲,博客对比时又带一次。GEO 表能记下「这个提问的主人是认证指南里的那一块,其余两处是复述」。这种关系在页面粒度的表里根本没有位置可写。

第三,改动的影响面能被查到。 当 UL 1973 的认证范围更新时,你需要知道哪些块引用了这个事实。块粒度的表能直接列出来;页面粒度的表只能告诉你「认证指南这一页相关」,剩下的靠人回忆。

这三件事恰好对应第五、四、七篇要展开的内容。它们的共同前提,就是本篇论证的那一句:登记单位必须和检索单位对齐。

七、落地形态:一份补充说明

按这个系列的取舍,形态问题是次要的,但为了不让你从原理到动手之间断档,这里给一个最小说明。

一条 GEO 注册表记录至少要能表达四件事:

这是哪个提问        → 规范化后的问句
谁是它的主人        → 页面 + 页面内的位置(锚点或小节标题)
这个答案的事实从哪来 → datasheet / 测试报告 / 认证编号
它现在什么状态      → 待写 / 已发布 / 已被引用 / 需更新

四件事之外的字段都是可选的,等你真的需要时再加。第八篇会给一份完整字段清单和落地格式的取舍(Markdown 表格适合人读和评审,结构化格式适合被脚本和 AI 消费),但不要在字段还没被用起来之前就先把表设计到完备——第一篇讲过,字段的正确数量由填不填得起决定。


📌 核心收获

  • ✓ 搜索排序整页,AI 拼装片段:两者挑的不是同一种东西。
  • ✓ 能被单独取走的东西,才是需要被单独登记的东西——这是本系列的立论。
  • ✓ 关键词注册表的原子是页面,结构上无法表达「这句断言归谁」,加列解决不了。
  • ✓ 判断片段的标准:单独复制出来,陌生人读完能否获得一个完整、有条件的事实。
  • ✓ 两张表是叠加不是替代——页面层决定进不进候选池,块层决定取不取这一块。
  • ✓ 分立之后才能表达一页多块、跨页同问,以及查到一次改动的影响面。

🚀 立刻行动

  1. 挑一个你排名不错但从未被 AI 引用的页面,检查它的结论能否被单独取走。
  2. 把这一页实际承接的提问逐条列出来,看是不是超过一个——这就是你需要块粒度的证据。
  3. 对照第四节的对比表,判断你现在的注册表是在管页面还是在管块。
  4. 挑一个提问,写清它的主人是哪一页的哪一块,以及事实来自哪份文件。
  5. 找出一处「同一个参数在两个页面里数字不同」的地方,留到第四篇处理。

来源:系列原创整理 | 本文为「SEO-GEO 注册表体系」系列第 2 篇,下一篇讲提问为什么是推断出来的,以及规范化为什么是杠杆最大的一步

NEXT ACTION / 下一步

继续系列:SEO-GEO 注册表体系

把读到的方法变成一个小行动,完成后再回来迭代。

继续

RELATED / 相关推荐

接着读这些

按同一分类、系列与标签为你挑选。