Table of Contents
llms.txt 值得做,但它不是任何平台的正式標準——這兩句話要一起講,才不會被話術帶著走。
這一年只要談到 AI 搜尋優化,幾乎每份提案裡都會出現 llms.txt。有些廠商把它講得像是「AI 官方指定檔案」,做了就會被 ChatGPT 讀到。這篇把它到底是什麼、為什麼我們還是會做、格式怎麼寫、以及五個常見錯誤,一次講清楚。
一句話先回答
llms.txt 是一份放在網站根目錄(yoursite.com/llms.txt)的純文字檔,用 Markdown 格式列出「這個網站最重要的內容在哪幾頁」。🔴 它不是任何主要 AI 平台的正式標準,也沒有平台公開承諾會讀它。我們仍然會做,理由是成本極低、萬一哪天平台開始讀你已經在了,而且寫它會逼你盤點自己網站上真正重要的頁面。但如果有人拿它當主要賣點或收一筆可觀的費用,那是話術。

先講清楚它不是什麼
它不是 robots.txt 的 AI 版
robots.txt 是擋,而且主流爬蟲確實會遵守——設錯會直接讓你從 AI 的視野裡消失。llms.txt 是推薦,沒有人保證會照做。兩者的優先序差很多:先確認 robots.txt 是對的,再來管 llms.txt。我們看過不少網站 llms.txt 做得很漂亮,robots.txt 卻把訓練型爬蟲整批擋掉了,站主自己不知道。
它不是 sitemap
sitemap 是「這個網站有哪些頁」,給搜尋引擎用來完整收錄,通常是全部頁面。llms.txt 是「這個網站最重要的是哪幾頁」,重點在取捨。把整份 sitemap 貼成 llms.txt 是常見錯誤,那等於沒有取捨,也就沒有意義。
它不是官方標準
這是 2024 年由社群提出的一個提案格式,沒有寫進任何規範,也沒有任何一家主要 AI 平台公開承諾會讀。任何把它講成「AI 官方指定檔案」的說法,都不正確。
那為什麼我們還是會做?

兩個理由,第二個比第一個實在:
理由一
成本極低,下注很便宜
寫一份大概一兩個小時,之後幾乎不用維護。如果哪天平台開始讀它,你已經在了;如果永遠沒有,你損失的是一個下午。這種賠率的東西沒有不做的理由——但也不值得為它付一筆可觀的費用。
理由二
寫它會逼你盤點「我最重要的是哪幾頁」
這是實際做過才會發現的價值。llms.txt 的格式要求你挑出重點、每一頁寫一句說明——這個動作會讓很多老闆第一次認真看自己的網站架構。我們實際帶客戶做的時候,最常出現的一句話是:「原來我最想被推薦的那個服務,站上根本沒有一頁在講它。」那個發現的價值,遠大於這個檔案本身。
格式怎麼寫
格式是 Markdown,結構只有四層:一個 H1 標題、一段引言摘要、幾個 H2 分區、每區底下的連結清單。每個連結後面接一句說明——那句說明才是重點,因為它是唯一告訴機器「這頁在講什麼」的地方。
第一行寫 H1:你的公司名稱
用你希望被稱呼的正式名稱,跟官網、商家檔案上的寫法完全一致。這一點跟前面講的「實體一致性」是同一件事。
接一段引言:一到三句話講清楚你是誰、做什麼、服務範圍
這段是整份檔案最重要的地方。假設對方只讀這三句,你希望他知道什麼?🔴 不要寫行銷語言(「致力於打造」「領導品牌」),機器不吃這套,寫具體的事實。
分區列出重要頁面,每一區用 H2
常見分法:服務項目/案例作品/專業內容/關於我們與聯絡方式。每個連結寫成「標題加網址加一句說明」,說明要講這頁能回答什麼問題。
控制篇幅,寧可少不要多
重點是取捨。列 20 頁跟列 200 頁,前者傳達的資訊更清楚。如果你覺得每一頁都很重要,那就是還沒做取捨。
⭐ 一個實用的自我檢查:把你的 llms.txt 拿給一個完全不認識你公司的人看,問他「這家公司做什麼、什麼狀況下該找他們」。如果他答不出來,那份檔案對機器也沒有用。
五個常見錯誤
| 錯誤 | 為什麼是問題 | 怎麼做才對 |
|---|---|---|
| 放錯位置 | 放在子目錄或媒體庫裡,等於不存在——這種需要放網站根目錄的檔案,用上傳媒體庫的方式一定會失敗(我們在其他根目錄驗證檔上實際踩過) | 確認 yoursite.com/llms.txt 打得開 |
| 把整份 sitemap 貼上去 | 沒有取捨就沒有資訊量 | 挑出真正重要的,寧可少不要多 |
| 只有網址、沒有說明 | 機器不知道那頁在講什麼 | 每個連結都要接一句「這頁能回答什麼」 |
| 寫滿行銷語言 | 「致力於打造」「業界領導」對機器是雜訊 | 寫具體的事實:做什麼、服務哪裡、有什麼 |
| 列的網址失效了沒改 | 🔴 指向 404 的清單比沒有清單更糟 | 網站改版後回頭檢查一次 |
怎麼知道有沒有效?(誠實的答案)

這一段是多數提案不會告訴你的:llms.txt 的效果幾乎驗證不了。
GSC 看不到(它不是搜尋結果)、GA4 也看不到(GA4 靠 JavaScript,純文字檔不會觸發)。唯一可靠的方法是翻伺服器的存取日誌,找 /llms.txt 這個路徑有沒有被請求、請求的 User-Agent 是誰。
老實說,多數網站看下來這個檔案被抓的次數不多。這正是我們把它歸在「啟動時做一次的基本工序」、而不是「賣點」的原因。做,但不要為它付大錢,也不要期待它單獨產生效果。
常見問題
llms.txt 是官方標準嗎?
不是。它是 2024 年由社群提出的一個提案格式,沒有任何一家主要 AI 平台公開承諾會讀它,也沒有像 robots.txt 那樣寫進任何規範。任何把它講成「AI 官方指定檔案」的說法都不正確。
那為什麼還要做?
因為成本極低、下注很便宜。寫一份大概一兩個小時,之後幾乎不用維護,如果哪天平台開始讀它,你已經在了。另外一個常被忽略的好處是:寫它會逼你盤點自己網站上到底哪幾頁最重要,這件事本身就有價值——很多老闆列到一半才發現自己最想被推薦的服務根本沒有專頁。
llms.txt 跟 robots.txt 差在哪?
方向相反。robots.txt 是擋——告訴爬蟲哪裡不能去,而且主流爬蟲確實會遵守。llms.txt 是推薦——告訴 AI 哪幾頁最值得看,但沒有人保證它會照做。兩個檔案都放在網站根目錄,但重要性差很多:robots.txt 設錯會直接讓你消失,llms.txt 沒做只是少了一個機會。先確認 robots.txt 是對的,再來管 llms.txt。
llms.txt 和 llms-full.txt 有什麼不同?
llms.txt 是索引——列出重要頁面的標題、網址與一句說明。llms-full.txt 是把內容本身也放進去的完整版。對絕大多數中小企業網站,做索引版就夠了;完整版檔案會很大,維護成本也高,而且既然沒有平台承諾會讀,投入產出不成比例。
怎麼知道有沒有 AI 真的來讀?
唯一可靠的方法是看伺服器的存取日誌,找 `/llms.txt` 這個路徑有沒有被請求、以及請求的 User-Agent 是誰。GSC、GA4 都看不到這件事(GA4 靠 JavaScript,純文字檔不會觸發)。老實說,多數網站看下來這個檔案被抓的次數不多——這也是我們不把它當賣點的原因。
放了之後要多久更新一次?
網站架構有變動、或新增了重要的服務頁時更新就好,不需要定期維護。🔴 但要避免一種情況:列在裡面的網址失效了卻沒改。一份指向 404 的清單,比沒有這份清單更糟。
想知道自己網站的這些基礎項目過了沒?
我們有一份免費的自助掃描,共 31 項、分成 SEO/AEO/GEO/E-E-A-T 四組,llms.txt、robots.txt 對 AI 爬蟲的設定、結構化資料都在裡面,輸入網址就逐項告訴你哪一項沒過。需要人幫你看的話,網站、內容到成效追蹤,單一窗口一站式完成。
延伸閱讀
- 結構化資料是什麼?為什麼它從加分變成基本盤:比 llms.txt 重要得多的那一份標記
- AI 搜尋名詞對照表:18 個你會在提案裡看到的詞:檢索型與訓練型爬蟲、RAG、Entity 分別在講什麼
- GEO 公司怎麼選?5 個驗證問題與四種公司類型的差別:拿 llms.txt 當主要賣點的,就是這篇要你刷掉的那種


