你的網站,AI 找得到嗎?
輸入網址,一分鐘檢測 25 項 GEO 要素——AI 爬蟲開放度、llms.txt、結構化資料到 Common Crawl 收錄狀態。
什麼是 GEO(生成式引擎最佳化)?
GEO(Generative Engine Optimization)是讓網站內容能被 ChatGPT、Perplexity、Gemini 等 AI 搜尋與問答引擎讀取、理解並引用的一套做法。消費者找答案的方式正在轉移:越來越多人直接問 AI,而不是打開搜尋結果頁一個一個點。AI 回答問題時,只會引用它「讀得到、看得懂、信得過」的網站——這正是 GEO 要解決的三件事。robots.txt 若封鎖了 AI 爬蟲,內容再好 AI 也讀不到;沒有結構化資料與清楚的段落結構,AI 難以理解與擷取;缺乏作者、日期與來源透明度,AI 不敢引用。
六大檢測類別在看什麼
- AI 爬蟲開放度(權重最高)——逐一解析 robots.txt 對 GPTBot、OAI-SearchBot、ClaudeBot、PerplexityBot、Google-Extended、Applebot-Extended、CCBot 與 Meta 等八大 AI 爬蟲的實際規則。任何一隻被 Disallow,你的內容就從那個 AI 的世界消失。
- AI 索引檔案——llms.txt 是給 AI 讀的網站地圖(新興標準),加上 sitemap.xml 與 RSS,讓 AI 能快速發現並持續追蹤你的內容。
- 結構化資料——JSON-LD 讓 AI 用機器語言理解頁面:你是誰(Organization)、這頁講什麼(Article/Service)、有哪些問答(FAQPage)、內容多新(datePublished/dateModified)。FAQPage 是最容易被 AI 直接引用的格式。
- 內容結構(AEO)——AI 依標題理解段落,問句式標題(什麼是…、如何…)最容易對應使用者的提問;清單與表格是 AI 最好擷取的結構;內容要有足夠份量才有被引用的價值。
- E-E-A-T 訊號——作者、日期、關於與聯絡頁,是 AI 判斷「這個來源可不可信」的依據。匿名、無日期的內容,AI 引用意願低。
- AI 收錄訊號——實際查詢 Common Crawl 開放語料庫(多數 AI 模型的訓練資料來源),確認你的網域是否已被收進最新一期抓取,這是目前少數可以被驗證的 AI 收錄證據。
檢測完之後,怎麼改善?
建議照這個優先順序補:第一,先解封 AI 爬蟲——robots.txt 一行 Disallow 就能讓所有努力歸零,這是成本最低、影響最大的修正。第二,補齊 sitemap 與 llms.txt,讓 AI 有完整的內容地圖。第三,加上結構化資料,從 Organization 與 FAQPage 開始,工程量小、效果直接。第四,調整內容結構——把重點段落改成問句式標題、把可以條列的內容改成清單。最後補上作者與日期等 E-E-A-T 訊號。改完之後回來重測一次,分數會誠實告訴你進步了多少。
另外提醒:ChatGPT 搜尋主要吃 Bing 索引、Gemini 吃 Google 索引,所以傳統 SEO 的收錄基本功(GSC 提交 sitemap、Bing 用 IndexNow)依然是 GEO 的地基,兩者是相乘而不是取代。
想從觀念到落地完整學會?我們把 12 篇 GEO 指南收在 GEO 資源中心,含入門、實戰與美妝、食品、保健品類攻略。
常見問題
什麼是 GEO(生成式引擎最佳化)?+
GEO(Generative Engine Optimization)是讓網站內容能被 ChatGPT、Perplexity、Gemini 等 AI 搜尋與問答引擎讀取、理解並引用的一套做法。當越來越多人直接問 AI 而不是查 Google,品牌若沒被 AI 收錄,等於在新的入口缺席。
GEO 健檢會檢查哪些項目?+
共六大類約 25 項:AI 爬蟲開放度(robots.txt 是否允許 GPTBot、ClaudeBot、PerplexityBot 等八大 AI 爬蟲)、AI 索引檔案(llms.txt、sitemap、RSS)、結構化資料(JSON-LD、FAQPage、日期標記)、內容結構(問句式標題、清單表格、內容份量)、E-E-A-T 訊號(作者、日期、關於頁),以及 AI 收錄訊號(是否已進入 Common Crawl 語料庫)。
怎麼知道我的網站有沒有被 AI 收錄?+
AI 引擎不公開索引庫,無法直接查詢;但本工具會查 Common Crawl——多數 AI 模型的訓練資料來源——確認你的網域是否已被收進語料庫,這是目前最可靠的可驗證訊號。同時,ChatGPT 搜尋主要吃 Bing 索引、Gemini 吃 Google 索引,把兩大搜尋引擎的收錄做好,就等於把 AI 收錄的地基打好。
GEO 和 SEO 有什麼不同?+
SEO 的目標是在搜尋結果頁排名靠前、被人點擊;GEO 的目標是被 AI 直接引用進答案裡。兩者基礎相通(可爬取、結構清楚、內容有料),但 GEO 更重視問答式結構、結構化資料與 AI 爬蟲的開放度。做好 SEO 的網站通常離 GEO 不遠,補上幾個關鍵項目即可。
檢測會留下我的網站資料嗎?+
健檢只在當下抓取一次公開頁面做分析,不會儲存你的網站內容。除非你主動填寫聯絡表單索取完整建議,否則不會留下任何資料。
常見 AI 爬蟲清單:誰在讀你的網站
| 爬蟲 | 來自 | 擋掉的後果 |
|---|---|---|
| GPTBot / OAI-SearchBot | OpenAI(ChatGPT) | ChatGPT 查不到你,推薦裡沒有你 |
| ClaudeBot | Anthropic(Claude) | Claude 的回答引用不到你的內容 |
| PerplexityBot | Perplexity | AI 搜尋引擎的答案來源少了你 |
| Google-Extended | Google AI 模型 | 影響 AI 功能引用(不影響傳統搜尋收錄) |
| Bingbot | 微軟(也餵 Copilot) | Bing 與 Copilot 都看不到你 |
重點檢查:robots.txt 有沒有誤擋這些爬蟲、主機或 CDN 的防火牆有沒有把 AI 爬蟲當攻擊擋掉——很多網站的 GEO 問題不是內容不好,是門根本沒開。想被 AI 引用卻全面封鎖 AI 爬蟲,是最常見的自相矛盾設定。
提升 AI 能見度的三層工程
第一層是可讀性:AI 爬蟲能進來、內容是真文字不是圖片文字、頁面結構清晰(標題階層、清單、表格),加上 llms.txt 這類新標準幫 AI 快速理解站點。第二層是可信度:品牌與公司資訊完整、內容有具體數據與來源、頁面有作者與日期——AI 引用前會評估這是不是可靠來源。第三層是可引用性:把常見問題寫成一問一答、關鍵數字做成表格、定義寫成一句話能截取的格式——AI 組答案時,最容易被摘走的就是這種結構。完整的做法看 GEO 攻略中心 的二十一篇系列,或直接了解 AI 能見度佈局服務。