SEO 基礎:搜尋引擎怎麼讀懂一個網頁

作者 ·發佈

一句話答案

SEO 是讓搜尋引擎「爬得到、看得懂、願意排前面」。最基本的功課是每頁有獨特的 title 與 description、一個 H1、正確的 canonical,並用內部連結把頁面串起來;其餘的一切都建立在「內容真的有用」之上。

搜尋引擎是怎麼運作的?

Google 官方把流程分成三個階段(Google 搜尋運作方式):

  1. 爬取(Crawling):Googlebot 順著連結與 sitemap 找到網址,下載頁面。
  2. 收錄(Indexing):分析頁面文字、標籤、圖片,判斷主題,決定要不要存進索引。
  3. 提供搜尋結果(Serving):使用者搜尋時,從索引中挑出最相關、品質最好的頁面排序。

所以 SEO 的問題也可以照這三層來診斷:爬不到(被 robots.txt 擋、沒有連結指向)、不收錄(noindex、重複內容、品質太低)、排不前面(內容不如競爭對手)。

哪五個頁面元素最重要?

元素 作用 常見錯誤
<title> 搜尋結果的藍色標題,最重要的單一 SEO 元素 整站都用同一個 title
meta description 搜尋結果的摘要文字,影響點擊率 空白或與內容無關
<h1> 與小標題 告訴搜尋引擎頁面主題與段落結構 用 CSS 做大字卻沒用標題標籤
canonical 同一內容多個網址時,指定哪個是正本 所有頁面都指向首頁
內部連結 讓爬蟲發現頁面、傳遞權重 重要頁面沒有任何連結指向(孤兒頁)

title 要怎麼寫?

meta description 會影響排名嗎?

不直接影響。但它是搜尋結果裡的「廣告文案」,寫得好會提高點擊率。Google 也可能不用你寫的,而是從內文挑一段更符合搜尋字詞的文字。

canonical 是什麼?

同一篇內容可能有好幾個網址:?utm_source= 參數版、有沒有結尾斜線、http 與 https。<link rel="canonical"> 告訴搜尋引擎「這幾個是同一頁,請以這個網址為準」。每頁都加一個指向自己的 canonical 是最保險的做法。要注意 canonical 對 Google 來說是「建議」而非命令。

robots.txt 和 noindex 差在哪?

這是最常搞混的一組:

致命組合是兩個一起用:robots.txt 擋住了,爬蟲就看不到頁面上的 noindex,結果反而移除不掉。要從搜尋結果移除頁面,應該只用 noindex,讓爬蟲可以進來讀到它。

怎麼檢查自己的網站?

  1. 用本站的 SEO 健康檢查一次看完上面所有元素。
  2. 在瀏覽器按「檢視原始碼」,確認 title、description、canonical 真的在 HTML 裡。
  3. 上線後到 Google Search Console 用「網址審查」看 Google 實際看到的版本。

官方的完整入門教材是 Google 搜尋引擎最佳化(SEO)入門指南,建議整份讀一次。

常見問題

meta keywords 還有用嗎?

沒有。Google 早在 2009 年就公開表示不使用 meta keywords 作為排名依據,現在寫了也不會有任何效果。

新網站多久會被 Google 收錄?

沒有固定時間,從幾天到幾週都有可能。把網站提交到 Google Search Console 並送出 sitemap,可以加快被發現的速度,但不保證收錄。

SEO 做完就會排第一嗎?

不會。技術面 SEO 只是讓搜尋引擎能正確理解你的網頁,排名主要取決於內容是否比其他頁面更能滿足搜尋者的需求。

→ 結構化資料 JSON-LD:讓機器確定你在說什麼