实体SEO的出发点是一个大多数优化建议至今仍然忽略的事实:搜索引擎早就不再匹配字符串了。它们匹配的是事物。一个页面得到什么分数,并不取决于它是否包含某个词组,而取决于系统是否相信这个页面讲的是词组背后的那个概念,以及系统对这个概念到底是什么有多大把握。
这个区别决定了重复关键词究竟对你有帮助,还是完全不起作用。在匹配字符串的系统里,重复是一种信号。在匹配实体的系统里,重复只是噪声,真正能推动结果的,是机器能不能识别出你是什么。
判断你是否作为实体存在的测试: 搜索你的公司名称,看看在没有人追问的情况下,搜索引擎主动给出了关于你的哪些信息。如果它只返回首页,别的什么都没有,那么你只是一串它能找到的字符。如果它返回了描述、所在地、类别以及相关的组织,那么你就是一个它理解的实体,而正是这种理解,才让你有机会进入一条生成的答案。
实体到底是什么
实体是一个具有属性和关系、与其他事物相互区分的对象:一家公司、一个人、一件产品、一个地点、一个概念。谷歌通过知识图谱 把这件事正式化,而当年那份公告里的表述今天依然准确地描述了这次转变:索引不再关于文本,而是关于事物。
由此带来的实际后果是,实体拥有属性。它不是一袋词,而是一条记录:这家机构,位于这个国家,属于这个行业,成立于这个日期,与这些人以及那些其他机构相连。当检索系统有把握地持有这条记录时,它就能回答一些你网站上任何一个页面都没有明说的问题,因为它可以在属性之上做推理。
举个具体的例子:只要国家、行业和成立年份都确定下来,你就能进入“位于伦敦的中型软件开发公司”这类条件的候选集合,哪怕这句话在你的网站上一个字都没有写过,因为它可以从属性推导出来。
而当系统手里没有这样一条记录时,每一次关于你的查询都会退回成一次全新的文本匹配练习,没有任何积累下来的把握,你只能靠措辞去和所有做着同样事情的同行竞争。
实体SEO奖励的是一致性,不是密度
建立把握的机制叫作交叉印证。系统在某个地方看到一条关于你的说法,接着在别的地方又看到同样的说法,每一次独立的重复都会提高它的确定程度。
正因如此,不一致的代价高得不寻常。同一个公司名称在网站、目录收录和社交资料里写成三种写法,产生的不是一个强实体,而是三个系统必须自行调和的弱候选。地址差了一行,或者一处描述称你是软件公司、另一处称你是数字咨询公司,情况完全一样。
工商登记名与常用简称混用、迁址后没有更新的旧地址、早已离职却仍挂在页面上的联系人,这些在人眼里都是小事,对机器来说却是彼此冲突的主张,需要它自己判断该相信哪一个。
所有这些都与一个词组在页面上出现多少次无关。真正相关的是:在机器看得到的每一个地方,同样的事实是否以同样的形式出现。密度是在为一个早已停止运行的评分模型做优化;一致性才是在为真正运行的那个模型做优化。
由此可以推出,站外的工作比大多数技术改动更有分量。你自己的网站只是一个来源,交叉印证需要其他来源。
让你的实体可被机器读取
把机构声明一次,并且做对。 一个包含法定名称、网址、标志、地址和联系方式的Organization区块,发布在一个稳定的标识符下,能让系统拿到一条可以据以定锚的结构化陈述,而不是一段需要它去揣摩的文字。如果这个标识符每年都在变,声明本身也会被当成互不相干的几份。
用sameAs把你的各个资料页连起来。 sameAs这个属性存在的意义,恰恰就是声明“这家机构”和“那个资料页”是同一个东西。工商登记信息、LinkedIn、GitHub,以及在有的情况下的Wikidata条目。每一条链接都是系统可以跨过去、把印证属性收集回来的桥,而每一条只花你一行。
让标记和可见页面对得上。 结构化数据如果声称了页面并没有说的内容,那就是矛盾,而矛盾只会降低把握,不会提高把握。我们关于AI搜索引擎如何读取schema标记 的指南,讲的正是这些系统实际会解析什么。
把事物明确地叫出名字。 通篇只写“我们的平台”,对机器来说等于什么也没说,它无从知道是哪个平台。把你使用的技术、遵循的标准、合作的机构一一点名,系统才能把你的实体和它已经认识的实体连起来,而正是这些连接把你放进了某个类别。
关系才是重点
一个没有连接的实体几乎算不上实体。它的价值来自它与什么相连,因为系统正是据此判断你适合成为哪些问题的候选答案。
具体来说,值得建立的关联是机器看得见的那些关联:被和你所使用的技术并列描述;出现在你所服务的行业出现的同一批语境里;有可被识别的人员与机构相连,而且这些人在各个资料页上的信息保持一致。
这也是对主题权威度最诚实的解释。把一个主题领域覆盖得足够厚之所以有效,并不是因为数量本身受到奖励,而是因为一组彼此内部链接的相关页面,让你的实体与那个主题之间的关系变得可读。一个主题上的一篇文章是一个数据点。十五篇相互链接的文章,则是一个系统可以拿来与自身互相验证的主张。
我们的生成式引擎优化指南 讲了这如何转化为引用,而为什么内容有排名却从不被引用 讲的是相关性存在而权威缺席时会发生什么。
这解决不了什么
实体方面的工作让你变得可识别,但不会让你变得更受偏爱。
如果两家机构都被清楚地描述过,而其中一家拥有明显更多的独立印证,那么印证更充分的那一家会赢,再多的标记也补不上这道差距。结构化数据是把事实说清楚的方式,不是让事实变得更真的方式。
所以顺序很重要。先把实体理干净,因为它便宜,而且是前提条件。然后把真正的力气花在能产生印证的事情上:被引用、被收录、被别人写到。Mecanik在SEO审计 工作中负责技术的那一半,而说实话,技术的这一半才是更小的那一半。
延伸阅读: 程序化SEO:什么时候有效,什么时候是垃圾内容 、多语言SEO:十二种语言教会我们的事 、内容修剪:删掉页面反而带来流量的时候 、llms.txt 现在有用了吗?看证据 。
常见问题
什么是实体SEO? 它指的是这样一种优化:让搜索引擎能够把你的企业识别为一个具有属性和关系、与其他事物相互区分的对象,而不是一个包含某些词的页面。检索系统匹配的是概念而不是字符串,所以目标是让机器有把握地持有一条记录,说明你是什么、你在哪里、你与什么相连。
在基于实体的搜索里,关键词密度还重要吗? 不重要。重复在匹配字符串的系统里是信号,在匹配实体的系统里是噪声。真正推动结果的,是同样的事实是否在机器看得到的每一个地方一致地出现,这属于交叉印证,而不是密度。
sameAs属性有什么用? 它声明你页面上描述的机构与别处的某个资料页是同一个东西。链接到工商登记信息、LinkedIn、GitHub或者Wikidata条目,就等于给检索系统提供了可以跨越的桥,让它收集印证属性,从而提高它对你这条实体记录的把握。
我怎么知道我的企业有没有作为实体存在? 搜索你的公司名称,看看在没有人追问的情况下搜索引擎主动给出了什么。只有首页,说明你是一串能被找到的字符。出现描述、所在地、类别和相关机构,说明存在一条实体记录,而正是这条记录让你能出现在生成的答案里。
主题权威度和实体SEO是一回事吗? 两者是相连的。用彼此内部链接的页面把一个主题覆盖得足够厚,会让你的实体与那个主题之间的关系对机器变得可读。一篇文章是一个数据点;一组相互链接的文章则是系统可以与自身互相验证的主张。如果实体本身不可识别,单纯堆数量的效果要小得多。
评论