GEO 生成式引擎優化:讓 ChatGPT、Perplexity 引用你

作者 ·發佈

一句話答案

GEO 是讓生成式 AI(ChatGPT、Perplexity、Gemini、Claude)在回答時引用你的優化方法。前提是 AI 爬蟲讀得到你的內容(robots.txt 不擋、內容不靠 JavaScript 產生),再來是內容值得被引用:具體數據、權威來源、清楚的作者與更新日期。

GEO 是什麼?

GEO(Generative Engine Optimization,生成式引擎優化)一詞來自 2023 年普林斯頓大學等研究者的論文〈GEO: Generative Engine Optimization〉。研究發現,在內容中加入引用來源、引述與統計數據,能明顯提高被生成式引擎引用的機會,作者報告的提升幅度最高約 40%。

簡單說:SEO 爭取的是排名,GEO 爭取的是 AI 回答裡的那個引用連結。

AI 是怎麼找到並引用內容的?

多數 AI 助理回答需要即時資訊的問題時,流程大致是:

  1. 把使用者的問題改寫成搜尋查詢。
  2. 透過搜尋索引(自家的或 Bing、Google 等)找出候選網頁。
  3. 抓取網頁內容,挑出能回答問題的段落。
  4. 生成回答,並附上來源連結。

這代表兩件事:傳統 SEO 仍然是基礎(第 2 步),而內容要能被 AI 爬蟲讀到並拆成可引用的段落(第 3 步)。

AI 爬蟲有哪些?該擋還是該放?

各家通常把「訓練用」和「搜尋用」的爬蟲分開:

爬蟲 公司 用途
OAI-SearchBot OpenAI ChatGPT 搜尋
ChatGPT-User OpenAI 使用者在對話中要求讀取網頁
GPTBot OpenAI 模型訓練
Claude-SearchBot Anthropic Claude 搜尋
Claude-User Anthropic 使用者要求讀取網頁
ClaudeBot Anthropic 模型訓練
PerplexityBot Perplexity Perplexity 搜尋索引
Google-Extended Google 控制內容是否用於 Gemini 訓練(不影響 Google 搜尋)

資料來源:OpenAI 爬蟲說明、Google 爬蟲清單。

策略建議:

為什麼伺服器端渲染對 GEO 很重要?

Googlebot 會執行 JavaScript,但多數 AI 爬蟲不會。如果你的網站是純前端渲染(例如只有一個空的 <div id="root">,內容靠 JavaScript 產生),AI 爬蟲看到的就是一片空白。

檢查方法很簡單:在瀏覽器按「檢視原始碼」(不是開發者工具的 Elements),看文章內容在不在 HTML 裡。本站的健康檢查工具也會計算原始 HTML 中的可見字數。

怎麼寫出 AI 願意引用的內容?

  1. 給具體數據:「LCP 應低於 2.5 秒」比「網站要快」更容易被引用。
  2. 引用權威來源並附連結,讓 AI 能交叉驗證。
  3. 清楚的作者與日期:標示作者、背景與最後更新日期,並用結構化資料標記。
  4. 一段一個重點:AI 是以段落為單位擷取,每段都應能獨立被理解。
  5. 提供獨家資訊:第一手經驗、實測數據、原創研究,是 AI 無法從別處取得的東西。

llms.txt 值得做嗎?

llms.txt 是 2024 年提出的格式:在網站根目錄放一份 Markdown,列出網站最重要的內容,方便大型語言模型閱讀。

誠實的現況是:它是社群提案,主要 AI 搜尋引擎並未公開承諾會讀取它,Google 也表示不需要它。本站有做,是因為成本很低(建置時自動產生),但不要期待它帶來流量。

怎麼測量 GEO 成效?

更多量測方法請看〈上線後怎麼量測成效〉。

常見問題

擋掉 GPTBot 會讓 ChatGPT 無法引用我嗎?

不一定。OpenAI 把爬蟲分開:GPTBot 用於模型訓練,OAI-SearchBot 用於 ChatGPT 搜尋。只擋 GPTBot 仍可以出現在 ChatGPT 的搜尋結果中。

做了 llms.txt 就會被 AI 引用嗎?

不會。llms.txt 目前是社群提案,主要 AI 搜尋引擎並未公開承諾會使用它。它的成本很低可以做,但不應期待它帶來流量。

GEO 需要跟 SEO 分開做嗎?

大部分不需要。Google 表示在 AI Overviews 中出現不需要額外的優化,一般的 SEO 最佳實務就適用;而多數 AI 搜尋也會參考傳統搜尋引擎的結果。

→ 多語系 SEO 與 hreflang:同一篇文章的中英文版本怎麼共存