跳到主要內容
上線工作室 OnLaunch Studio 找我們聊

AI 不推薦你的網站?六個原因自查與 GEO 執行清單

發布 ・更新 ・作者

「我們也做了 SEO,為什麼問 ChatGPT 它都不提我們?」

這個問題最常見的回答是「要做 GEO」,但那通常太快了。 在談要做什麼之前,先把根本讀不到的情況排掉—— 這一類原因幾乎都是設定問題,自己十分鐘內查得出來, 而且修起來比任何內容策略都便宜。

這篇文章前半做診斷與排除;後半是排除之後的執行清單,依投入成本分三級, 每項附做法與驗證方式,從上往下做即可。為什麼要這樣做, GEO 是什麼?完整指南已經寫完,本文不重寫。

① robots.txt 把 AI 爬蟲擋掉了

最常見、也最容易被忽略的一項。許多網站在某次「防止內容被抓」的討論之後 加了 AI 爬蟲的封鎖規則,然後忘了它還在。

自查:打開 你的網域/robots.txt,找有沒有針對 AI 爬蟲 User-Agent 的 Disallow: /。什麼是這個檔案、它怎麼運作,見 robots.txt。

注意:擋不擋是商業決定,和技術無關。有些內容本來就不該被拿去訓練。 重點是知道自己擋了。

② 內容要跑 JavaScript 才出得來

多數生成式引擎的抓取端不執行 JavaScript,或執行得不完整。 如果你的產品說明、價格、FAQ 是前端渲染出來的, 抓取端看到的可能是一個幾乎空白的骨架。

自查:在瀏覽器停用 JavaScript 重新載入,或直接看網頁原始碼 (開發者工具的 Elements 面板顯示的是渲染後的結果,不能拿來判斷)。 看不到主要內容,就是這一項。

③ 沒有結構化資料,實體對不起來

引擎要能確定「這個網站在講的公司」就是「使用者問的那家公司」。 沒有結構化資料時, 它只能從純文字猜,而同名、近名的實體會互相稀釋。

自查:用搜尋引擎官方的結構化資料測試工具跑一次首頁, 看有沒有 Organization 或對應的實體型別,欄位是否完整。

④ 沒有一段話可以被整段引用

這一項是 SEO 與 GEO 分岔的地方。搜尋引擎排的是「哪一頁該排前面」; 生成式引擎挑的是「哪一段話可以直接拿去回答」。 通篇形容詞、資訊散在各處的頁面,排名可以很好,但沒有一段能被取用。

自查:挑一個你希望被問到的問題,在自己網站上找一段 不需要前後文就能獨立回答它的文字。找不到,就是這一項。

兩者的取捨與預算怎麼分,寫在 SEO vs GEO:預算有限先做哪個?。

⑤ 資訊過期或自相矛盾

價格在 A 頁是一個數字、B 頁是另一個;服務項目改了但舊頁沒動。 引擎遇到互相矛盾的資訊時,最安全的做法是兩個都不引用。

自查:把價格、服務名稱、聯絡方式在全站搜一遍,看有沒有兩種寫法。 這也是我們自己在站上用自動檢查盯住的其中一件事—— 數字只有一個來源,改一處全站跟著走。

⑥ 網站慢到抓取被放棄

抓取端有時間預算。首頁要好幾秒才給得出內容的網站, 會被降低抓取頻率,嚴重時直接放棄。

自查:用任一效能測試工具看 LCP(最大內容繪製), 或直接在 4G 環境用手機開一次自己的網站。

排除之後:依成本分三級的執行清單

六項自查回答的是「AI 讀不讀得到你」;接下來這份清單回答「讀到之後,怎麼讓它願意引用你」。 清單依投入成本分三級,每項附做法與驗證方式,從上往下做即可。

第一級:今天能做(設定與檢查,不用寫程式)

1. 檢查 AI 爬蟲有沒有被擋

做法:開你網站的 /robots.txt,找出所有 Disallow 規則,核對是否擋到這些 User-agent:GPTBot、OAI-SearchBot、ChatGPT-User、ClaudeBot、PerplexityBot、Google-Extended、CCBot。再到主機或 CDN 後台(如 Cloudflare 的防火牆事件記錄)確認這些爬蟲的請求沒有被當成攻擊流量擋掉——不少資安規則預設封鎖非主流爬蟲,這是隱形的 GEO 殺手。

驗證:robots.txt 直接目視;防火牆看事件記錄裡有沒有上述 User-agent 被 block 的紀錄。

2. 檢查品牌名稱的一致性

做法:把你在官網、Google 商家檔案、社群帳號、目錄網站上的自稱列出來對照。全名、簡稱、英文名混用會讓 AI 引擎把同一家公司當成多個實體。選定一個主要名稱,其餘寫法在官網上以「X(又稱 Y)」的形式明確連結起來。

驗證:拿每一種寫法去問 AI 引擎「X 是什麼公司」,看回答是否指向同一個實體。

3. 直接問 AI 引擎,建立基準線

做法:列 5 到 10 個你希望被推薦的問題(「新竹 WordPress 開發推薦」「台灣 GEO 顧問有哪些」),分別問 ChatGPT、Perplexity、Google AI Overviews,把回答截圖存檔、記錄日期。

驗證:這一步本身就是驗證——之後每季重問一次,對照基準線看變化。沒有基準線,做了什麼都說不出成效。

第二級:本月能做(內容改寫,編輯工作)

4. 為核心頁面寫實體定義句

做法:首頁與關於頁的第一段,用一句完整的話說清楚「你是誰、在哪裡、做什麼、服務誰」。句子要能被單獨抽走仍然成立——主詞用全名,不用「我們」開頭。

驗證:把那句話單獨貼給別人看,問他能不能說出你是做什麼的。

5. 把高頻問題改寫成 FAQ

做法:整理客戶最常問的 10 個問題(價格、時程、範圍),用客戶原話當標題(「架一個網站要多少錢?」),答案第一句直接給結論——數字、是否、名詞,鋪陳放後面。

驗證:AI 引擎摘取答案時通常只取前一兩句;自己讀答案的第一句,看資訊夠不夠成立。

6. 給每篇文章加 TL;DR 摘要塊

做法:文章開頭放 3 到 5 句重點摘要,每句自足(含主詞與具體資訊)。這是 AI 引擎最容易整段搬走的區塊,也是你最能控制「被引用時說什麼」的地方。

驗證:單獨讀摘要,資訊是否完整不失真。

7. 標示日期與資料性質

做法:文章標示發布與更新日期;行情類數字標明「某年某月概估」;查證過的數字附來源。AI 引擎在挑選引用來源時,會把時效與可查證性納入權重。

驗證:檢查每個數字旁邊有沒有「它是什麼性質的數字」的說明。

第三級:需要改版才能做(工程項目)

8. JSON-LD 結構化資料

做法:全站掛 Organization(或 ProfessionalService)+Person;服務頁掛 Service 與 Offer(含價格);FAQ 掛 FAQPage;文章掛 Article。規格見 Google 結構化資料文件。

驗證:每頁網址貼進 Rich Results Test。

9. llms.txt 與 llms-full.txt

做法:站根目錄提供給 AI 的站台索引(llms.txt)與全文純文字版(llms-full.txt),用程式從網站內容自動產生,確保永遠同步。本站兩檔都有,可直接開 /llms.txt 當範本。

驗證:瀏覽器直接開,內容與站上一致即通過。

10. IndexNow 與 sitemap

做法:sitemap 讓引擎知道你有哪些頁;IndexNow 讓參與引擎在你更新時即時來抓。

這裡有個常被寫錯的重點:IndexNow 的參與引擎是 Bing、Yandex、Naver、Seznam、Yep,Google 不參與。想讓 Google 早點知道你更新了,管道是 sitemap(在 Search Console 提交)、外部連結,以及 Search Console 的「要求建立索引」。兩套機制要分開做,不要以為送了 IndexNow 就等於通知了 Google。

驗證:sitemap 網址提交到 Search Console/Bing Webmaster Tools 看回報;IndexNow 提交後看回應碼 200。

執行時最常踩的五個陷阱

清單好抄,執行會歪。以下五個陷阱來自實際健檢時反覆看到的狀況:

  1. robots.txt 改了,CDN 防火牆沒改。robots.txt 是君子協定,防火牆是物理牆;Cloudflare 一類服務的「Bot 對策」預設值可能直接把 AI 爬蟲擋在 TLS 層,robots.txt 寫得再歡迎也沒用。兩邊都要檢查,以防火牆的事件記錄為準。
  2. llms.txt 手寫一次就不管。三個月後網站改版、文章增刪,llms.txt 還停在上線那天——過期的地圖比沒有地圖更糟,AI 會照著抓到一堆 404。解法只有一個:用程式從網站內容自動產生。
  3. FAQ 答案把結論埋在第三句。「這個問題要看情況,首先我們要考慮⋯」——AI 摘取答案通常只取前一兩句,你的結論根本沒被搬走。第一句給結論,是寫給人也是寫給機器的紀律。
  4. 結構化資料抄範本不改內容。從網路範例複製的 JSON-LD,名稱、網址、電話還是範例值,等於用別人的名片自我介紹。掛上去之前逐欄核對,掛完用 Rich Results Test 驗證。
  5. 只做一次基準線,沒有下文。第 3 項的基準線價值在對比;只截一次圖,三個月後你既不知道有沒有進步,也不知道哪個動作有效。行事曆直接排每季重測。

內容改寫的實際範例

抽象原則不如一組對照。以「實體定義句」為例:

  • 改寫前:「我們是一群充滿熱情的專業團隊,致力於提供最好的服務。」——沒有主詞全名、沒有地點、沒有服務內容,AI 無從引用,人也讀不出資訊。
  • 改寫後:「甲乙科技是位於台中的網站開發公司,提供電商網站建置與維護,服務台灣中小企業。」——誰、哪裡、做什麼、服務誰,四個要素齊備,這句被單獨抽走仍然成立。

FAQ 答案同理:

  • 改寫前:「關於價格,由於每個專案的需求不同,我們需要進一步了解您的狀況才能報價。」
  • 改寫後:「基本方案 NT$30,000 起,實際金額依需求評估後提供固定報價。每個專案需求不同,初談後三個營業日內給正式報價。」——第一句就有數字,後面才是補充。

兩組對照的共同點:改寫後的版本沒有變長,變的是資訊密度。GEO 的內容工作大部分是這種編輯,不是擴寫。

快速對照表

級別項目成本驗證方式
今天AI 爬蟲放行檢查10 分鐘robots.txt 目視+防火牆記錄
今天名稱一致性1 小時問 AI「X 是什麼」
今天建立基準線1 小時截圖存檔比對
本月實體定義句編輯工作單句自足測試
本月FAQ 改寫編輯工作答案第一句成立
本月TL;DR 區塊編輯工作摘要獨立可讀
本月日期與資料標示編輯工作逐數字檢查
改版JSON-LD工程Rich Results Test
改版llms.txt 兩檔工程瀏覽器直開
改版IndexNow+sitemap工程提交回應碼

三種角色的分工建議

清單的另一種切法是按人分工,小公司照這個分派就能開工:

  • 負責人/老闆:第 2 項(名稱一致性——只有你能拍板統一自稱)、第 3 項(基準線——目標問題只有你說得出哪些詢問值錢)、每季驗收。合計每季半天。
  • 行銷/內容編輯:第二級全部(實體定義句、FAQ 改寫、TL;DR、日期標示)。這是編輯工作不是工程,寫作紀律比技術背景重要;產出節奏排進每月內容排程。
  • 工程師/外包開發:第 1 項(爬蟲與防火牆檢查)與第三級全部(JSON-LD、llms.txt、IndexNow)。一次性工程為主,改版時一併做成本最低;驗收標準就用本文各項的驗證方式,寫進委外合約裡。

沒有行銷人力的一人公司:第二級的四項各挑最重要的一頁做(首頁定義句、價格 FAQ),其餘隨內容更新逐步補——完成度七成的十頁,勝過完成度百分之百的一頁。

最後提醒節奏感:這份清單是一次爬坡加上長期巡航——第一、三級做完就不太會動,第二級跟著內容更新走,基準線每季重測一次。把每季重測排進行事曆的那個動作,比清單上任何一項都更能決定一年後的成績,因為做完全部十項之後,第 3 項的基準線對比才是唯一算數的成績單。

六項都排除了,還是沒曝光?

那才輪到內容與可信度的問題,方向是 E-E-A-T: 你的內容有沒有可查證的來源、作者是誰、憑什麼是你講這件事。 這一層沒有捷徑,也不是設定改得出來的。

需要有人幫忙把六項一次看完的話, SEO 與 GEO 優化服務的網站健檢報告就是做這件事的; 第三級的工程項目如果沒有人手,健檢報告也會告訴你現況缺哪幾項、修復的優先順序。 各級費用列在費用頁;預算怎麼在 SEO 與 GEO 之間分配,見 SEO 與 GEO 的差異與取捨。

不過先說清楚:上面六項你自己就查得完,而且查完通常會發現 真正卡住的只有一兩項。先自己查,再決定要不要找人。

本文常見問題

我做了 SEO,AI 應該就會推薦我吧?
不一定。SEO 與 GEO 約八成基礎工程重疊,但剩下兩成不同:搜尋引擎排的是「哪一頁該排前面」,生成式引擎挑的是「哪一段話可以直接拿來回答」。頁面排得上去但沒有一段可以被整段引用的內容,AI 仍然不會用它。
要不要專門為 AI 寫一份內容?
先不要。多數網站卡住的地方是讀不到或讀不完整,那是設定問題,成本遠低於重寫內容。技術面排除乾淨之前,額外的內容投資很可能被同一個瓶頸擋住。
怎麼知道 AI 到底有沒有讀到我的網站?
最直接的方式是看伺服器日誌裡有沒有 AI 爬蟲的 User-Agent 造訪紀錄,其次是直接問那些引擎關於你品牌的問題、看它回答的內容是否來自你的網站。兩者都做不到時,先從本文的六項自查開始。
執行清單要全部做完才有效嗎?
不用。第一級(今天能做)就能解決「AI 根本抓不到你」的問題,這是最大的失分點;第二、三級決定的是被引用的品質與頻率。按順序做,每一級都有獨立效果。
沒有工程師可以做到哪一級?
第一級與第二級大部分不需要寫程式:robots.txt 是文字檔、內容改寫是編輯工作。第三級的結構化資料與 llms.txt 端點需要動到網站程式,可以委託開發者或在改版時一併處理。
做完多久會看到效果?
技術修正後,AI 爬蟲重新抓取通常以週為單位;回答中開始出現你的名字,實際的觀察週期是以季為單位。任何承諾幾週內被 ChatGPT 推薦的服務,都超出了服務商能控制的範圍。

想知道你的網站卡在哪一項

把網址和你最想被搜到的一兩個詞寄來。初談時先看網站現在卡在哪裡,再決定要不要做健檢。