實體SEO的起點,是一個大多數最佳化建議至今仍然略過的事實:搜尋引擎早就不再比對字串了。它們比對的是事物。一個頁面拿到什麼分數,並不取決於它是否含有某個詞組,而取決於系統是否相信這個頁面談的是詞組背後的那個概念,以及系統對於那個概念究竟是什麼有多少把握。

這個區別決定了重複關鍵字究竟對你有幫助,還是完全沒有作用。在比對字串的系統裡,重複是一種訊號。在比對實體的系統裡,重複只是雜訊,真正會推動結果的,是機器能不能辨識出你是什麼。

判斷你是否以實體身分存在的測試: 搜尋你的公司名稱,看看在沒有人追問的情況下,搜尋引擎主動端出了關於你的哪些資訊。如果它只回傳首頁,其他什麼都沒有,那麼你只是一串它找得到的字元。如果它回傳了描述、所在地、類別以及相關的組織,那麼你就是一個它理解的實體,而正是這份理解,才讓你有機會進入一段生成的答案。


實體究竟是什麼

實體是一個具有屬性與關係、與其他事物彼此區隔的對象:一家公司、一個人、一項產品、一個地點、一個概念。Google 透過知識圖譜 把這件事正式化,而當年那份公告裡的說法,到今天仍然準確地描述了那次轉變:索引不再是關於文字,而是關於事物。

由此帶來的實際後果是,實體擁有屬性。它不是一袋詞,而是一筆紀錄:這家機構,位於這個國家,屬於這個產業,成立於這個日期,與這些人以及那些其他機構相連。當檢索系統有把握地持有這筆紀錄時,它就能回答一些你網站上任何單一頁面都沒有明講的問題,因為它可以在屬性之上進行推理。

舉個具體的例子:只要國別、產業與成立年份都確定下來,你就能進入「位於倫敦的中型軟體開發公司」這類條件的候選集合,即使這句話在你的網站上一個字都沒寫過,因為它可以從屬性推導出來。

反過來說,當系統手上沒有這樣一筆紀錄時,每一次關於你的查詢都會退回成一次全新的文字比對練習,沒有任何累積下來的把握,你只能靠用字遣詞去和所有做著同樣事情的同業競爭。

實體SEO獎勵的是一致性,不是密度

建立把握的機制叫作交叉佐證。系統在某個地方看到一項關於你的說法,接著在另一個地方又看到同樣的說法,每一次獨立的重複都會提高它的確定程度。

正因如此,不一致的代價高得不尋常。同一個公司名稱在網站、目錄收錄與社群檔案裡寫成三種寫法,產生的不是一個強實體,而是三個系統必須自行調和的弱候選。地址差了一行,或是某一處描述稱你是軟體公司、另一處稱你是數位顧問公司,情況完全一樣。

登記名稱與慣用簡稱混用、搬遷後沒有更新的舊地址、早已離職卻仍掛在頁面上的聯絡人,這些在人眼裡都是小事,對機器來說卻是彼此衝突的主張,逼它自己判斷該相信哪一個。

這些全都與一個詞組在頁面上出現幾次無關。真正相關的是:在機器看得到的每一個地方,同樣的事實是否以同樣的形式出現。密度是在為一個早就停止運作的評分模型做最佳化;一致性才是在為真正運作中的那個模型做最佳化。

由此可以推出,站外的工作比大多數技術調整更有分量。你自己的網站只是一個來源,交叉佐證需要其他來源。

讓你的實體可被機器讀取

把機構宣告一次,而且要做對。 一個包含法定名稱、網址、標誌、地址與聯絡管道的Organization區塊,發布在一個穩定的識別碼之下,能讓系統拿到一段可以據以定錨的結構化陳述,而不是一段需要它去揣摩的文字。如果那個識別碼每年都在變,宣告本身也會被當成互不相干的好幾份。

用sameAs把你的各個檔案頁串起來。 sameAs這個屬性存在的意義,正是要宣告「這家機構」和「那個檔案頁」是同一個東西。公司登記資料、LinkedIn、GitHub,以及在有的情況下的Wikidata條目。每一條連結都是系統可以跨過去、把佐證屬性蒐集回來的橋,而每一條只花你一行。

讓標記與可見的頁面對得上。 結構化資料若宣稱了頁面根本沒說的內容,那就是矛盾,而矛盾只會降低把握,不會提高把握。我們關於AI搜尋引擎如何讀取schema標記 的指南,談的正是這些系統實際上會解析什麼。

把事物明確地叫出名字。 通篇只寫「我們的平台」,對機器來說等於什麼都沒說,它無從知道那是哪一個平台。把你使用的技術、遵循的標準、往來的機構一一點名,系統才能把你的實體和它已經認識的實體連起來,而正是這些連結把你放進了某個類別。

關係才是重點

一個沒有連結的實體幾乎稱不上實體。它的價值來自它與什麼相連,因為系統正是據此判斷你適合成為哪些問題的候選答案。

具體來說,值得建立的關聯是機器看得見的那些關聯:被和你所使用的技術並列描述;出現在你所服務的產業所出現的同一批脈絡裡;有可被辨識的人員與機構相連,而且這些人在各個檔案頁上的資料保持一致。

這也是對主題權威最誠實的解釋。把一個主題領域覆蓋得夠厚之所以有效,並不是因為數量本身受到獎勵,而是因為一組彼此內部連結的相關頁面,讓你的實體與那個主題之間的關係變得可讀。一個主題上的一篇文章是一個資料點。十五篇相互連結的文章,則是一項系統可以拿來與自身互相驗證的主張。

我們的生成式引擎最佳化指南 談了這如何轉化為引用,而為什麼內容有排名卻從不被引用 談的是相關性存在而權威缺席時會發生什麼事。

這解決不了什麼

實體方面的工作讓你變得可辨識,但不會讓你變得更受偏愛。

如果兩家機構都被清楚地描述過,而其中一家擁有明顯更多的獨立佐證,那麼佐證更充分的那一家會贏,再多的標記也補不上這道差距。結構化資料是把事實說清楚的方式,不是讓事實變得更真的方式。

所以順序很重要。先把實體整理乾淨,因為它便宜,而且是前提條件。然後把真正的力氣花在能產生佐證的事情上:被引用、被收錄、被別人寫到。Mecanik在SEO稽核 工作中負責技術的那一半,而說老實話,技術的這一半才是比較小的那一半。


延伸閱讀: 程式化SEO:什麼時候有效,什麼時候是垃圾內容多語言SEO:十二種語言教會我們的事內容修剪:刪掉頁面反而帶來流量的時候llms.txt 現在有用了嗎?看證據


常見問題

什麼是實體SEO? 它指的是這樣一種最佳化:讓搜尋引擎能夠把你的企業辨識為一個具有屬性與關係、與其他事物彼此區隔的對象,而不是一個含有某些字詞的頁面。檢索系統比對的是概念而不是字串,所以目標是讓機器有把握地持有一筆紀錄,說明你是什麼、你在哪裡、你與什麼相連。

在以實體為基礎的搜尋裡,關鍵字密度還重要嗎? 不重要。重複在比對字串的系統裡是訊號,在比對實體的系統裡是雜訊。真正推動結果的,是同樣的事實是否在機器看得到的每一個地方一致地出現,這屬於交叉佐證,而不是密度。

sameAs屬性有什麼用? 它宣告你頁面上描述的機構與別處的某個檔案頁是同一個東西。連到公司登記資料、LinkedIn、GitHub或Wikidata條目,就等於給檢索系統提供了可以跨越的橋,讓它蒐集佐證屬性,從而提高它對你這筆實體紀錄的把握。

我怎麼知道我的企業有沒有以實體身分存在? 搜尋你的公司名稱,看看在沒有人追問的情況下搜尋引擎主動端出了什麼。只有首頁,代表你是一串找得到的字元。出現描述、所在地、類別與相關機構,代表存在一筆實體紀錄,而正是這筆紀錄讓你能出現在生成的答案裡。

主題權威和實體SEO是同一回事嗎? 兩者是相連的。用彼此內部連結的頁面把一個主題覆蓋得夠厚,會讓你的實體與那個主題之間的關係對機器變得可讀。一篇文章是一個資料點;一組相互連結的文章則是系統可以與自身互相驗證的主張。如果實體本身不可辨識,單純堆數量的效果要小得多。