robots meta 怎麼設定:index、noindex 實操(2026)
robots meta 解決的是索引控制,不是抓取控制。本文講清 index、noindex、follow 的常見用法與誤區。
robots meta 解決的是索引控制,不是抓取控制。本文講清 index、noindex、follow 的常見用法與誤區。
`robots meta` 是頁面級別的抓取與索引提示。它最常見的用途,不是“做一個 SEO 標籤”,而是明確告訴搜尋引擎:這頁該不該進索引、頁內連結要不要繼續跟蹤、搜尋結果裡是否允許展示摘要或快取。
很多網站把 `robots meta` 和 `robots.txt` 混在一起理解,最後經常出現兩類問題:該保留的頁面被誤設成 `noindex`,該清理的頁面卻一直留在索引裡。頁面級規則一旦寫錯,影響往往比標題寫錯還大。
`robots meta` 是放在 HTML `
` 裡的 `` 標籤,用來給搜尋引擎傳遞頁面級指令。最常見的寫法如下:<meta name="robots" content="index, follow">這表示頁面允許被索引,頁面上的連結也允許繼續跟蹤。
這兩個概念很容易混,但職責並不一樣:
如果一個頁面已經被 `robots.txt` 完全攔住,搜尋引擎可能都抓不到頁面內容,自然也就未必能讀取到裡面的 `robots meta`。所以這兩層規則必須配合,不能互相沖突。
決定頁面是否允許進入搜尋引擎索引。
告訴搜尋引擎是否繼續跟蹤頁面上的連結。
不希望搜尋引擎展示快取版本時使用。
限制搜尋結果中的摘要展示。
阻止頁面上的圖片進入圖片索引。
對於大多數企業站,真正高頻會用到的還是 `index`、`noindex`,有時加上 `follow`。其他指令通常只在特定場景下才值得單獨考慮。
常見包括:
但是否 `noindex`,不能只看“這頁流量少”,而要看它有沒有獨立承接搜尋需求的可能。如果某個篩選頁本身就是有效落地頁,就不能機械處理。
以下頁面最容易被誤殺:
很多站點上線或改版後排名下滑,最後查出來不是內容質量突然變差,而是模板、SEO 外掛設定或環境遷移時把整類頁面誤設成了 `noindex`。
<meta name="robots" content="index, follow"><meta name="robots" content="noindex, follow">這類寫法常見於一些不想進入結果頁、但又不想切斷內部連結發現路徑的頁面。
<meta name="robots" content="noindex, nofollow">適合一些純功能性、也不希望參與站內傳遞的頁面,但要慎用,不要把本來承擔內部導航作用的頁面也關掉。
<meta name="robots" content="index, follow, noarchive"><meta name="robots" content="index, follow, nosnippet">這類更偏特殊需求,不屬於常規企業站的高頻設定。
這是最危險的一種。很多時候不是編輯手動改錯,而是主題模板、外掛預設項或遷移後配置錯誤導致的。
這些頁面裡有些確實應該清理,但有些本身承擔主題聚合和內鏈分發作用。該不該進索引,要看頁面質量與搜尋價值,而不是頁面型別名字。
如果一個頁面長期被導航、聚合頁和文章正文反覆指向,但你又不希望它收錄,這種策略本身就要重新看。
比如頁面一邊 `noindex`,一邊又把自己作為 canonical 主頁,或者多個重複頁互相給出混亂訊號。頁面規範化和索引策略應該一起看。
後臺選項勾了不代表前臺原始碼真的輸出對了。上線環境、快取層、主題邏輯都有可能影響最終結果。
對大多數正常內部連結頁面來說,沒有必要大量使用 `nofollow`。頁面層面的 `nofollow` 更適合特定場景,而不是預設配置。
如果你用 WordPress,通常會透過 Rank Math、Yoast 或其他 SEO 外掛來設定。最穩的做法不是隻看後臺,而是同時檢查這三層:
如果網站近期做過模板切換、伺服器遷移或快取調整,這一步尤其要複核。因為問題很可能不是內容編輯造成的,而是環境層把模板輸出改掉了。
簡單理解可以這樣分工:
如果你站內已經有大量重複頁、引數頁或歷史殘留頁,單獨改一個 `robots meta` 往往不夠,還要結合canonical 設定、站內連結和抓取規則一起處理。
不要只問“有沒有這個標籤”,而要問:
`robots meta` 的價值在於精細,而不是複雜。企業站只要先把關鍵頁面的索引邊界管清楚,很多抓取和收錄問題就會比一味發新內容更容易看出改善。
官方說明見 Google — robots meta tag。