llms.txt 現在到底有沒有用?誠實的答案是:在可測量的範圍內幾乎沒有用,而那些告訴你這個檔案對 AI 能見度至關重要的人,通常是在向你推銷東西。一邊這樣說,一邊又建議你發布一份,這個立場並不舒服。所以這篇文章先把數字攤開來,之後再解釋這項建議本身。
檔案本身是個合理的想法。它是放在網站根目錄下的一份 markdown 索引,告訴語言模型你發布了什麼、內容在哪裡,就像 robots.txt 告訴爬蟲哪些內容可以抓取一樣。想法沒有問題。問題出在它原本要服務的那些公司身上,它們幾乎沒有採用。提出一份規範,和真的出現讀取它的一方,完全是兩回事。
伺服器日誌真正顯示的情況: Ahrefs 對 137,000 個網域的分析發現,2026 年 5 月,97% 的 llms.txt 檔案收到的請求是零。不是很少,是零。與此同時,採用量在一年內成長了 8.8 倍,這代表這個檔案被發布的速度,遠遠快於它被讀取的速度。
數字,以及它們的來源
有兩份資料值得了解,因為絕大多數談這個題目的文章一份都沒有引用。
Originality.ai 在 2025 年 6 月到 2026 年 5 月之間持續追蹤了超過 300 萬個網站。llms.txt 的出現數量從 4,088 個增加到 36,120 個,也就是 8.8 倍的成長;到 2026 年 5 月,大約有 38,980 個網站發布了相關格式之一。成長是真的,但起點非常低。相對於數百萬量級的樣本,幾萬這個數字仍然只是很小的一部分。
接著 Ahrefs 分析了 137,000 個網域的伺服器日誌,確認在 2026 年 5 月,其中 97% 的檔案沒有收到任何請求 。這一點很關鍵:它不是推測,而是真實的存取紀錄。檔案就擺在那裡可以被取走,卻沒有人來取。在確實抵達的請求裡,AI 檢索機器人只佔 1.1%。拆開來看,GPTBot 佔了對這些檔案請求的 4.51%,ClaudeBot 佔 0.80%,DeepseekBot 佔 0.02%。
把兩份研究放在一起,浮現出來的是這樣一個標準:發布方熱情採用,消費方全面忽視。只看其中一邊,成長率會被讀成成功的證據。
AI 公司實際上是怎麼說的
這部分基本上可以為爭論定論,以下只看各家公開表述過的內容。
Google 不支援。它在 2025 年 7 月公開這樣說過,並表示沒有支援計畫。OpenAI 在爬蟲文件中完全沒有提到 llms.txt,而是要網站擁有者去看 robots.txt。Anthropic 發布了自己的 llms.txt,也參與過這項提案的討論,但從未表示 Claude 的檢索會解析第三方的檔案。
Perplexity 是值得注意的例外,它表示會抓取這個檔案,用來協助決定頁面的優先順序。
資料裡藏著一層有意思的諷刺:Google、OpenAI 和 Anthropic 都為自家文件發布了 llms.txt,同時又建議網站擁有者不要指望靠它取得搜尋能見度。自家文件可被機器讀取當然有用。但這和它們的爬蟲會讀你的檔案,是兩件不同的事。目前市面上不少推銷說法,正是建立在混淆這兩件事之上。
今天真正的消費方是編碼代理,而不是搜尋引擎。Cursor、Claude Code、Continue 和 Cline 會在使用者把它們指向某個網域時讀取 llms.txt。如果你的產品有開發者文件,那就是一群真實存在、意圖明確的讀者,這也許是擁有這個檔案最有力的理由。
那為什麼還要發布
四個理由,沒有一個是「它會提升你的排名」。
成本幾乎是零。 從自己的內容產生一份索引大約是半天的工作量,如果網站本來就清楚自己的結構,還會更快。
現有的消費方意圖很強。 把 Cursor 指向你文件的開發者,比大部分搜尋流量更接近真正使用你的產品。Perplexity 優先處理你的頁面,影響不大,但確實存在。
標準的普及像棘輪一樣只往一個方向走。 如果檢索系統真的開始讀取它,擁有一份正確且最新檔案的網站已經準備好了,沒有的則沒有。早做的代價是半天,晚做的代價是你意識到這件事所花的全部時間。
寫它這件事本身會強迫你做一次稽核。 要做出準確的索引,就得把發布過的所有東西清點一遍。沒有人連結的頁面、你已經忘記還存在的欄目,正是在這個過程中被找出來的。
最後一點不是理論。這個月稽核我們自己的檔案時,翻出了一個比檔案本身更值錢的問題。
過期的 llms.txt 比沒有更糟
我們的 llms.txt 列出了 29 篇文章,網站上實際有 166 篇。更糟的是,裡面每一個 URL 都漏掉了語言前綴,於是 mecanik.dev/posts/<slug>/ 回傳 404,而真正的頁面在 mecanik.dev/en/posts/<slug>/。檔案裡共有 243 個站內網址,其中能夠正常開啟的只有 7 個。
任何真的去讀它的東西,拿到的都是一張不存在的網站地圖。這比什麼都不發布嚴格來說更糟,因為什麼都不發布至少是誠實地失敗。一份錯誤的索引會讓讀取方得出「查過了,這裡什麼都沒有」的結論。
這個教訓不只適用於這一個檔案。索引是你對自己網站做出的承諾,而沒人維護的承諾會悄悄變成謊言。如果你要發布,就把它放進和網站地圖相同的發布流程,並且逐一測試網址是否真的能開啟,而不是假定產生器一定做對了。內容裡存在一個 slug,和伺服器上那個 URL 能夠回應,並不是同一件事。
怎樣把它發布好
請遵循 llmstxt.org 的規範
,不要自己發明格式。唯一必需的元素是寫著網站名稱的 H1;引用區塊形式的摘要,以及由帶註解連結組成的 H2 區段,屬於慣例。慣例中還有一個 Optional 區段,用來放上下文吃緊時代理可以跳過的連結。
規範之外還有三條實務規則。第一,從內容產生檔案,不要手工維護,手工維護的索引兩個月內就會過期。第二,用真實請求測試每一個 URL,能產生出來和能被開啟是兩回事。第三,如果網站是多語言的,把語言規則寫一次,而不是把每個語言版本都列出來,這樣讀者可以依規則自行拼出任何網址。
我們的生成式引擎最佳化指南 談的是 AI 能見度裡那些可測量有效的部分,而AI 搜尋引擎如何讀取結構化資料 談的是 schema 標記。和 llms.txt 不同,schema 確實被那些公開寫明自己會讀取它的系統所使用。
結論與建議
發布一份。保持它準確。今年不要對它抱任何期待,也不要讓任何人把它當作 AI 能見度服務向你收費。
如果你想要的是真正能推動 AI 引用的東西,那不是網域根目錄下的一個檔案。而是把一個問題回答得足夠完整、值得被引用的內容,加上足以讓檢索系統信任這個答案的權威度。Mecanik 在技術 SEO 稽核 中同時涵蓋這兩個面向,也包括檢查你那些機器可讀的索引,是否說出了關於網站的實話。
延伸閱讀: 為什麼你的內容有排名卻從不被引用 、封鎖還是放行 AI 爬蟲:一個商業決策 、Google AI Mode 對你的網站流量代表什麼 、律師事務所 SEO 公司:法遵、內容與成本 。
常見問題
llms.txt 在 2026 年真的有用嗎? 幾乎沒有。Ahrefs 對 137,000 個網域的分析發現,2026 年 5 月有 97% 的 llms.txt 檔案沒有收到任何請求,而在確實抵達的請求中,AI 檢索機器人只佔 1.1%。採用量一年內成長了 8.8 倍,也就是說這個檔案被發布的速度,遠遠快於任何東西讀取它的速度。
Google、OpenAI 和 Anthropic 支援 llms.txt 嗎? 不支援。Google 在 2025 年 7 月公開表示不支援 llms.txt,也沒有支援計畫。OpenAI 在爬蟲文件中沒有提到它,而是要網站擁有者去看 robots.txt。Anthropic 發布了自己的檔案,但沒有說過 Claude 的檢索會解析第三方檔案。Perplexity 是例外,它表示會抓取這個檔案來決定頁面優先順序。
llms.txt 和 robots.txt 是同一回事嗎? 不是。robots.txt 告訴爬蟲哪些內容可以抓取,行為規矩的機器人普遍遵守它。llms.txt 是一份內容索引,告訴語言模型你發布了什麼、放在哪裡,而遵守它的系統非常少。如果你想控制 AI 爬蟲的存取,真正有效的機制是 robots.txt 以及你的 CDN 提供的爬蟲控制功能。
今天到底是誰在讀 llms.txt? 主要是編碼代理,而不是搜尋引擎。Cursor、Claude Code、Continue 和 Cline 會在使用者指向某個網域時讀取這個檔案,Perplexity 也表示會用它來決定頁面優先順序。如果你發布開發者文件,那是一群規模不大但意圖確實很強的讀者。
我應該發布 llms.txt 檔案嗎? 應該,但要出於正確的理由。它只花半天時間,現有的消費方意圖很強,而且一旦採用情況改善你已經準備好了。不要指望排名紅利。最重要的是保持它準確:一份列著已經無法開啟網址的過期檔案,比什麼都不發布更糟,因為它遞給每一個讀者一張不存在的網站地圖。
評論