Google 根本沒讀完你的網站:企業官網最常見的索引誤區與抓取診斷

Google 根本沒讀完你的網站:企業官網最常見的索引誤區與抓取診斷

如果你手邊有 Google Search Console 的權限,建議先做一件只要三十秒的事:左側選單點開「建立索引」,進入「網頁」報表,看最上方那兩個數字,一個是「已建立索引」,一個是「未建立索引」。

多數企業第一次看到這兩個數字,反應都很類似。網站上線三年、部落格寫了兩百篇、產品頁鋪了六百頁,實際被 Google 收錄的可能連三分之一都不到,而那些沒被收錄的頁面不是排名不好,是根本沒有進入排名這場競爭,對 Google 來說等同不存在。

先把結論放在前面:企業長期困惑的「文章寫了那麼多卻沒有成效」,有相當高的比例根本不是內容品質或關鍵字選擇的問題,而是內容從來沒有進場;你花錢請人寫的一百篇文章,如果有六十篇卡在索引前,那六十篇的預算等於直接蒸發,而且沒有任何報表會主動跳出來提醒你。

這件事在 2026 年變得比過去幾年都值得認真處理,原因有三個:

  1. Google 的索引篩選比以往嚴格,被收錄不再是預設值,而是需要爭取的結果
  2. 伺服器資源正在被大量 AI 爬蟲稀釋,間接壓縮 Googlebot 能分給你的抓取量
  3. 進不了 Google 索引的內容,同時也拿不到 AI 摘要與生成式搜尋的引用資格,損失是雙份的

接下來的內容會從診斷邏輯開始,一路走到可以照著做的健檢流程,全文都可以邊看邊在自己的 Search Console 裡驗證,不需要額外工具。

先講結論:關於索引,企業最需要先知道的四件事

企業官網最常見的索引誤區與抓取診斷

這篇文章很長,如果你今天只有五分鐘,先把這四件事記住就夠了。

第一,抓取、索引、排名是三道獨立的關卡,卡在哪一關的解法完全不同。
抓取是 Google 有沒有來過,索引是來過之後願不願意收錄,排名則是收錄之後排在哪裡;多數企業把三件事混為一談,於是拿排名的手法去解索引的問題,怎麼做都沒有反應。

第二,頁面沒被收錄,多數時候不是技術故障,是品質與重複性的判斷結果。
Google 的 John Mueller 在 2026 年 7 月 16 日那集 Search Off the Record(How to read the Indexing Report)節目中直接說明,當系統對一個網站的整體品質有疑慮時,會同時減少抓取與索引的數量,他也提醒這種情況不該當成技術問題去修,因為根本沒有技術故障可以修。

第三,Search Console 的報表是索引狀態的讀數,不是索引本身。
這兩件事的差別在 2026 年 6 月被完整示範過一次,下一節會說明。

第四,對多數企業官網來說,刪頁面比新增頁面更能改善整體表現。
這聽起來反直覺,但背後的邏輯很清楚,文章後段會完整拆解。

排名優化處理的是「排第幾」,索引診斷處理的是「有沒有資格排」,後者沒解決,前者做再多都是空轉。

2026 年 6 月那次報表延遲,暴露了一個長期誤解

2026 年 6 月中旬開始,全球的 SEO 從業者陸續發現 Search Console 的「網頁索引」報表停在 6 月 11 日不動,一停就是三個星期。這份報表原本用來顯示 Google 在你的網站上找到並收錄了哪些頁面,也會告訴你抓取過程中遇到哪些索引問題,直到 7 月初才終於更新,數據一口氣跳到 6 月 29 日。

真正值得記住的是 Google 當時的說明。Google Search Central 明確表示,延遲只影響 Search Console 的報表呈現,不影響實際的抓取、索引與排名運作,John Mueller 也在社群平台上補充,這類狀況通常只是報表問題,與真實的索引狀態無關。

換句話說,那三個星期裡,你的新文章該被收錄的照樣被收錄,該有的曝光照樣有,只是報表沒有把它畫出來。

這件事把一個長期誤解攤開來了。很多企業主與行銷人員把 Search Console 當成 Google 的索引資料庫本身,其實它只是一份定期更新的讀數,讀數會延遲、會批次更新、會在某些狀態上做簡化歸類,把它當成唯一真相就會做出錯誤判斷。

實務上,這個誤解會導致三種常見的錯誤行動:

一、看到「已建立索引」數字下降就恐慌,緊急下架內容或大改網站結構,結果只是報表尚未更新

二、修好一個技術問題後,兩天內反覆查看報表沒變化,於是認定修改無效,又改回原本設定

三、把報表數字直接當成月報 KPI 交給老闆,數字一波動就要花整個會議解釋一個不存在的問題

正確的做法是三方交叉驗證,而且要有明確的優先順序。

驗證方式 資料新鮮度 適合用途 限制
網址審查工具
最即時,可即時測試線上網址
單一頁面的確認與提交
一次只能查一個網址
網頁索引報表
通常落後 2 至 4 天,異常時可能更久
掌握整站的分布與趨勢
狀態分類有簡化,會誤導
site: 指令
即時但不完整
快速確認頁面是否存在於索引
結果數量僅為估計,不可當統計用

判斷單一頁面用網址審查工具,判斷整站趨勢用網頁索引報表,site: 指令只當成粗略的第二意見;三者結論不一致時,以網址審查工具為準

抓取、索引、排名:三個斷點,三種完全不同的處理方式

抓取、索引、排名:三個斷點,三種完全不同的處理方式

這一段是全文的骨架,後面所有的操作都建立在這個判斷邏輯上。

Google 處理一個頁面的順序是固定的:先要知道這個網址存在,接著實際發出請求把內容抓下來,然後判斷這份內容值不值得放進索引,最後才是在使用者搜尋時決定要不要拿出來、排在第幾位,任何一關沒過,後面的關卡就不存在。

Search Console 的網頁索引報表其實已經把斷點標示得很清楚,只是多數人沒有讀懂兩個名字很像、意思完全不同的狀態。

Google 的 Martin Splitt 在前面提到的那集節目裡說明得很直接:「找到 – 目前尚未建立索引」代表 Google 知道這些頁面存在,但還沒有實際去訪問過,既然沒有訪問,自然無法放進索引;「已檢索 – 目前尚未建立索引」則代表 Google 去過了,看過內容之後決定不收錄。

這兩個狀態的處理方向完全相反:

  • 出現大量「找到 – 目前尚未建立索引」,代表問題在抓取端,要檢查伺服器回應速度、內部連結結構、網站地圖是否確實提交,以及有沒有把 Google 導向大量無意義的網址
  • 出現大量「已檢索 – 目前尚未建立索引」,代表問題在內容端,Google 已經看過了,判斷這一頁沒有進入索引的必要,這時候再怎麼調整伺服器都不會有反應

我們在協助客戶做技術診斷時,看到最多的誤判就是把第二種當成第一種處理:網站被搬到更貴的主機、CDN 加上去了、圖片全部壓縮過一輪,速度分數確實漂亮了,但那六百頁該不被收錄的還是不被收錄,因為它們從來就不是速度問題。

2026 年的新變數:你的伺服器正在被爬蟲吃掉

過去談抓取問題,主要看的是自家網站的技術體質,2026 年多了一個外部變數,而且成長速度非常快。

根據 Cloudflare 2025 年度網路回顧報告,Googlebot 單獨就佔了全球 HTML 請求流量的 4.5%,其餘所有 AI 爬蟲加總約為 4.2%,另外根據 Cloudflare 2025 年 7 月發布的報告,比較 2024 年 5 月到 2025 年 5 月,AI 與搜尋爬蟲整體流量成長 18%,其中 Googlebot 請求量成長 96%,OpenAI 的 GPTBot 更成長了 305%。

這串數字對企業官網的實際意義,是一條很少被講清楚的因果鏈:

  • 你的主機每天要應付的機器人請求數量,在兩年內大幅增加,而多數企業的主機規格沒有跟著調整
  • 主機回應變慢或開始出現逾時,Google 官方文件明確說明會據此下修抓取頻率
  • 抓取頻率下修之後,新發布的內容更晚被發現,更新過的內容更晚被重新評估
  • 對內容更新頻繁的品牌或電商來說,這一段延遲直接反映在新品頁與檔期頁的曝光時間上

要確認自己有沒有中招,路徑在 Search Console 的「設定」裡,點開「抓取統計資料」,看三個地方:

  1. 平均回應時間的趨勢線,如果過去半年明顯往上爬,主機負荷已經是問題
  2. 依回應分類的比例,5xx 伺服器錯誤與逾時如果佔比超過個位數百分比,優先處理
  3. 依用途分類的比例,如果幾乎全部都是「重新整理」而「探索」極少,代表 Google 沒有在積極尋找你的新內容

至於要不要封鎖 AI 爬蟲,這件事沒有標準答案,要看品牌的取向。內容以品牌能見度為主、希望被 AI 摘要引用的企業,封鎖等於自斷生路,這部分的完整判斷邏輯我們在如何佈局 AEO 和 GEO那篇裡談過;若是主機資源真的吃緊,比較務實的折衷是開放重要內容區、限制歸檔頁與媒體檔案目錄,而不是一刀切全部擋掉。

提醒一件容易被忽略的事:robots.txt 只是禮貌性的規範,遵不遵守取決於爬蟲自己,真正的惡意爬蟲不會理會這份檔案,那屬於伺服器層級的防護議題,不在 SEO 的處理範圍內。

Google 怎麼找到你的頁面:網站地圖與點擊深度

前面談的是 Google 願不願意來,這一節談的是它有沒有辦法找到路,這一層出問題時,症狀通常是「找到 – 目前尚未建立索引」長期居高不下,或是某些頁面根本連被找到都沒有。

網站地圖的定位常被誤解

很多企業以為提交網站地圖等於保證收錄,實務上它比較接近一份推薦清單,作用是幫助 Google 更快發現網址,收不收錄仍然是另一回事。

理解這一點之後,三種常見錯誤就會變得很明顯:

(1)把設了 noindex 的頁面放進網站地圖,等於一邊推薦一邊拒絕,指令互相矛盾

(2)網站地圖裡混著已經 301 導向或已經 404 的舊網址,長期沒有清理,Google 對這份清單的信任度會下降

(3)lastmod 欄位全部自動填成當天日期,看起來全站每天都在更新,但實際內容沒動,這個信號很快就會被忽略

網站地圖應該只放你希望被收錄、而且回傳 200 狀態碼的正式網址,清單越乾淨,它的參考價值越高。

點擊深度是最容易被忽略的抓取信號

內部連結結構決定了 Google 抵達一個頁面的難度,從首頁出發,需要點三下以內能到達的頁面,抓取優先度明顯高於需要點五下、六下才找得到的頁面。

企業官網常見的兩種深度問題:

  • 部落格文章只能透過分頁列表往回翻找,第三頁之後的舊文章實際點擊深度可能超過八層
  • 商品頁只掛在單一分類底下,沒有任何相關商品、主題頁或內容文章連過去,形成只靠網站地圖存在的孤兒頁面

孤兒頁面是最容易被忽視的一類,它們在網站地圖裡,Google 也知道它們存在,但整個網站沒有任何一個頁面連過去,這在 Google 眼中就是一個訊號:連你自己都不覺得這一頁重要

改善方向不需要大改架構,通常從三件事開始就會有變化:

一、在主力文章與相關文章之間補上主題性的內部連結,讓舊內容重新被連上

二、為重要商品或服務建立主題彙整頁,把分散的頁面收攏在一個入口底下

三、定期用爬蟲工具比對網站地圖與實際可抓取的網址清單,找出孤兒頁面

網頁設計公司最常誤設的四種索引封鎖

接下來這一個章節,是我們接手新客戶網站時幾乎都會先檢查的項目。這四種狀況在台灣網站交付流程中相當常見,多數時候不是故意,而是開發與行銷交接時容易被忽略。

第一種:WordPress 的「阻擋搜尋引擎索引」沒有取消

網站在開發階段勾選這個選項是正確做法,避免測試內容被收錄,問題出在交付流程:設計公司交件、行銷公司接手、老闆驗收,中間沒有人負責取消這個勾選。

檢查方式很簡單,後台「設定」進入「閱讀」,看「搜尋引擎可見度」那一列有沒有被勾起來;這個勾選會同時產生兩種封鎖,效果非常徹底,網站可以整整半年一個字都排不上去。

第二種:測試站的設定隨著上線一起搬過去

比第一種更難發現,因為它藏在檔案裡而不是後台選項。開發階段的 robots.txt 通常寫著全站禁止抓取,或是佈景主題的設定裡加了全站 noindex,搬站時整包複製過去,沒有人回頭檢查。

這種狀況在網站改版後特別常見,也是我們在品牌網站的 SEO 結構規劃裡一再強調上線檢查清單的原因。

第三種:robots.txt 與 noindex 同時使用

這是四種裡面技術含量最高,也最致命的一種,因為它看起來很合理,實際上邏輯自相矛盾。

想讓一個頁面不被收錄,正確做法是允許 Google 抓取,讓它讀到頁面裡的 noindex 指令;如果同時在 robots.txt 封鎖這個網址,Google 就不會發出抓取請求,自然也讀不到那行 noindex,結果是這個頁面可能以「已建立索引,但遭到 robots.txt 封鎖」的狀態留在搜尋結果裡,只是沒有摘要文字。

想要移除一個頁面,你必須先讓 Google 進得去,正確的順序是先開放抓取並保留 noindex,等頁面確實掉出索引之後,再視需要考慮封鎖。

第四種:附件頁、標籤頁與作者頁大量進入索引

WordPress 預設會為每張上傳的圖片產生一個獨立的附件頁面,內容通常只有一張圖,一個放了三百張圖的網站,就多出三百個近乎空白的頁面。標籤頁與作者頁的狀況類似,一篇文章掛五個標籤,五十篇文章就可能產生兩百多個內容高度重疊的彙整頁。

這些頁面不會被懲罰,但它們會稀釋整站在 Google 眼中的平均內容品質,也會消耗抓取資源。

封鎖類型 檢查位置 判斷依據 處理方式
後台可見度勾選
後台設定的閱讀頁面
「搜尋引擎可見度」是否勾選
直接取消勾選
測試站設定殘留
網域根目錄的 robots.txt
是否有全站 Disallow 規則
改寫規則,僅封鎖後台與參數網址
矛盾指令
網址審查工具的檢索資訊
狀態顯示已建立索引但遭封鎖
先解除封鎖,保留 noindex
附件與彙整頁
網頁索引報表的已建立索引清單
是否出現大量圖片或標籤網址
附件頁重新導向至文章,標籤頁選擇性 noindex
後台「設定」中「閱讀」頁面的截圖,畫面需清楚呈現「搜尋引擎可見度」欄位以及「阻擋搜尋引擎索引這個網站」的勾選框

重複內容黑洞:分頁、篩選參數與標籤頁

前一節談的是被動封鎖,這一節談的是主動製造出來的黑洞,也是電商與大型型錄網站最常見的索引問題來源。

篩選參數的組合爆炸

假設一個電商分類頁提供四個篩選維度,每個維度五個選項,再加上四種排序方式,使用者感覺只是點幾下,但系統實際上可以產生兩千個以上的不同網址,而背後對應的商品可能只有三百件。

Googlebot 沿著這些篩選連結一路爬下去,抓取資源全部消耗在幾乎相同的頁面上,真正重要的商品頁反而排在後面等。

處理方式依情境而定:

  • 對 SEO 有價值、有實際搜尋需求的組合,例如「品牌加尺寸」,保留為可索引的正式頁面,並給予獨立的標題與描述
  • 純粹的排序參數與追蹤參數,設定標準網址指向乾淨版本
  • 無限組合的篩選路徑,在txt 封鎖參數形式,避免抓取資源被吃光

分頁的處理原則

分頁曾經有專屬的標記語法,但 Google 早在 2019 年就公開說明已經多年不再將它作為索引信號,現在的正確做法是把每一個分頁當成獨立頁面處理,讓它們各自的標準網址指向自己,而不是統統指回第一頁。

把第二頁之後全部指回第一頁,會直接導致第一頁以外的商品或文章從索引中消失,這是我們在電商網站上看過最多次的自傷式設定。

標籤頁該不該保留

判斷標準只有一個:這個彙整頁有沒有獨立的搜尋需求。

  • 底下有十篇以上相關文章,而且標籤名稱本身有人在搜尋,保留並補上分類說明文字
  • 底下只有一兩篇文章,或標籤是隨手打的自由詞,設定 noindex
  • 同一批文章被三個名稱近似的標籤重複彙整,合併成一個

標準網址的四種常見錯誤

標準網址標籤是告訴 Google「這幾個網址裡,請以這一個為準」的指令,設錯的代價往往比不設更大。

錯誤設定 實際後果 修正方向
全站指向首頁
除首頁外全部消失於索引
每頁指向自己的網址
分頁全部指向第一頁
第二頁之後的內容不被收錄
各分頁指向自身
指向已設 noindex 的頁面
指令衝突,Google 自行判斷
移除其中一項設定
指向會重新導向的舊網址
信號被稀釋,收錄不穩定
一律指向最終網址

一個實務上的自我檢查:如果你的網站有兩個網址呈現的內容有九成相同,卻沒有任何一方設定標準網址,Google 會自己選一個,而它選中的未必是你希望被看見的那一個。

標準網址的四種常見錯誤

Search Console 網頁索引報表逐項判讀

看懂這份報表,是企業行銷人員最值得投資的一項技能,因為它不需要任何額外預算,判讀能力提升之後,你跟外部團隊溝通的效率會完全不同。

進入報表後往下捲,會看到「網頁未建立索引的原因」列表,以下把常見狀態依照處理優先度整理成三個層級。

必須立刻處理的狀態

狀態名稱 代表的意思 處理方式
伺服器錯誤(5xx)
抓取當下主機沒有正常回應
檢查主機負荷與錯誤紀錄,修正後要求驗證
已建立索引,但遭到 robots.txt 封鎖
指令衝突,Google 讀不到你的意圖
解除封鎖,改用 noindex 或允許收錄
使用 noindex 標記排除(但該頁應該被收錄)
頁面被誤設為不收錄
移除 noindex,透過網址審查工具重新提交
軟性 404
頁面有回應但內容近乎空白
補足內容,或改為正確的 404 與 301

需要判斷的狀態

「已檢索 – 目前尚未建立索引」屬於這一類,而且是企業官網最常見的大宗,它不是錯誤,是 Google 看過之後的判斷結果,處理方向在內容而不在技術。

「找到 – 目前尚未建立索引」如果只有少量且集中在剛發布的頁面,屬於正常排隊,等待即可;若數量長期居高不下,回頭檢查抓取端。

「重複網頁,Google 選擇的標準網頁和使用者指定的不同」代表你的標準網址設定沒有被採納,先確認自己指定的那一頁是不是真的比較完整,如果是,加強它的內部連結與內容差異度,如果不是,就接受 Google 的判斷。

可以合理忽略的狀態

這一區的存在是為了讓你不要浪費時間,很多企業把力氣花在這裡,收益是零。

  • 替代網頁(有適當的標準網頁):正確設定下的正常結果,數字大不代表有問題
  • 網頁會重新導向:301 正常運作的表現
  • 使用 noindex 標記排除(且該頁本來就不該被收錄):例如購物車、會員中心、感謝頁,這才是正確狀態
  • 找不到(404):舊頁面自然淘汰的正常現象,除非那是有外部連結指入的重要網址

一份健康的網頁索引報表不會是零未建立索引,而是未建立索引的頁面都出現在正確的分類裡,追求全站百分之百收錄,方向從一開始就錯了。

一份健康的網頁索引報表不會是零未建立索引,而是未建立索引的頁面都出現在正確的分類裡

最反直覺的一段:被收錄過的頁面,正在被下架

這一節是全文最少被討論、但影響最大的部分。

多數人對索引的理解是一次性判決,頁面寫好、提交、被收錄,然後就永久留在裡面,實際情況比較接近租約,Google 會持續評估這個位置值不值得繼續給你。

Indexing Insight 針對 18 個網站、170 萬個頁面所做的索引研究指出,未被索引的頁面中有 88% 與品質因素有關,而且最大的原因並不是從未被收錄,是曾經被收錄之後又被 Google 從搜尋結果中移除。另一份由 IndexCheckr 進行、涵蓋超過 1,600 萬個頁面的分析也顯示,約 21% 已被索引的頁面最終會從 Google 搜尋結果中消失。

頁面能拿到曝光,前提是它曾經出現在搜尋結果中,曝光紀錄本身就是它曾被索引的證據,這是報表上唯一無法被簡化掉的線索。

這個發現直接改變了診斷的順序,因為 Search Console 把兩種本質完全不同的情況,放進了同一個標籤裡:

  • 從未進過索引:Google 看過一次,判斷沒有收錄價值,這是內容品質與獨特性的問題
  • 曾經進過索引又被移除:這一頁曾經有過曝光,甚至可能帶進過詢問單,後來被判定不再值得留下

兩者在報表上都顯示為「已檢索 – 目前尚未建立索引」,但處理的急迫性天差地遠,第二種代表你正在流失既有資產,而且流失的通常是三年前寫的、當時表現不錯的舊文章。

分辨方法不需要工具,用 Search Console 的成效報表就可以:

  1. 把時間範圍拉到最長的十六個月,用「網頁」維度篩選出那個網址
  2. 曝光次數曲線一路都是零,屬於從未進過索引
  3. 曾經有曝光,某個時間點之後歸零,屬於被移除 

一個頁面能拿到曝光,前提是它曾經出現在搜尋結果中,曝光紀錄本身就是它曾被索引的證據,這是報表上唯一無法被簡化掉的線索。

發現大量舊文章屬於第二種情況時,優先處理它們的效益通常遠高於再寫十篇新文章,因為這些頁面已經累積過內部連結,主題也已經被驗證有搜尋需求,把內容補到符合現在的標準,回收速度比從零開始快得多。

品質不只是文字:Google 在 2026 年講得更明白了

回到那集2026 年 7 月 16 日那集 Search Off the Record(How to read the Indexing Report),除了確認品質與索引的關聯,Mueller 還補了一段很多人沒有注意到的說明。

他提到,網站經營者常說自己的文字是原創的、文章寫得很好,但這些文字被包裝在一個難以閱讀的頁面裡,內容被廣告擋住、被插頁式訊息蓋掉、被會移動的元素干擾,或是被埋在一長串沒人想看的鋪陳底下;他的結論是,Google 幾乎必須把頁面上的完整體驗納入考量,因為那才是使用者真正看到的東西。

Splitt 在同一段對話裡提出了一個更尖銳的問題:當市面上已經有很多一樣好的內容時,Google 為什麼要把你這一份也加進索引。

這兩句話合起來,就是索引篩選的真實標準,它問的不是「這一頁寫得好不好」,而是「索引裡少了這一頁,會不會缺什麼」,一篇工整、正確、但網路上已經有三十個近似版本的文章,答不出這個問題。

對企業內容團隊來說,這代表三個具體的調整方向:

一、把驗證重心從「這篇寫得對不對」移到「這篇有沒有別人給不出的東西」,例如自家的實測數據、實際操作流程、產業內的判斷依據

二、把頁面體驗當成內容品質的一部分檢查,包含廣告密度、彈出視窗、載入表現與資訊出現的先後順序

三、停止用同一個主題產出多篇角度雷同的文章,那不會增加曝光,只會讓 Google 更難決定要收錄哪一篇

這個判準跟我們在Google 為什麼越來越重視真人內容裡談的方向是同一件事,只是這次它直接反映在收不收錄的門檻上,而不只是排名的高低。

刪頁面比新增頁面更有用:內容資產的減法

這是本文開頭承諾要拆解的反直覺結論,邏輯其實很直白。

Google 對一個網站的評估包含整體的內容水準,當一個網站有八百頁,其中五百頁是無流量、無轉換、彼此高度重疊的頁面,那五百頁不會安靜地待在角落,它們會拉低整站的平均值,同時持續消耗抓取資源。

這也是 Mueller 前面那段話的延伸:系統對整體品質有疑慮時,會同時減少抓取與索引的數量,減法的目的不是清理環境,是把 Google 願意分配給你的資源集中到真正有價值的頁面上

執行時建議依照這個順序判斷:

  1. 拉出十六個月內曝光次數為零、也沒有任何轉換紀錄的頁面清單
  2. 逐一確認它有沒有非搜尋的存在理由,例如業務會直接傳給客戶、法規要求公開、有外部網站連結指入
  3. 沒有存在理由的,依內容狀態決定處置方式
頁面狀態 建議處置 說明
內容單薄但主題有價值
合併進主力文章並設 301
累積的連結權重可以保留
內容重複、主題已被其他頁面涵蓋
301 導向主要版本
避免產生新的 404
功能性頁面,本來就不需被搜尋
設定 noindex 保留頁面
例如感謝頁、內部工具頁
完全過期、無保留價值、無外部連結
直接移除並回傳 410
讓 Google 明確知道是主動下架

有幾種情況不該刪,這點同樣重要:

(1)頁面有外部網站連結指入,即使自己沒有流量,權重仍有傳遞價值

(2)屬於品牌背景資訊的頁面,例如公司沿革、認證資訊、團隊介紹,這些是信任訊號而不是流量頁

(3)季節性內容,一年只有兩個月有搜尋量,年度統計看起來像零流量

減法做完之後,短期內 Search Console 的「已建立索引」數字會下降,這是預期中的結果,不是問題,要看的是同期間自然搜尋的曝光與點擊有沒有維持或上升。

一份可以照著做的索引健檢流程

把前面所有內容整理成一份順序固定的檢查流程,每一季執行一次,網站有較大改版時額外執行一次。

  1. 確認基礎設定沒有被封鎖。
    檢查txt 內容、後台可見度勾選、佈景主題的全站 noindex 設定,這三項只要有一項出錯,後面全部免談。
  2. 抓取端健檢。
    進入抓取統計資料,看平均回應時間趨勢、5xx 比例、探索與重新整理的分配比例,判斷 Googlebot 有沒有在正常運作。
  3. 盤點索引分布。
    匯出網頁索引報表,把未建立索引的頁面依照前面的三層優先度分類,先處理紅色那一層。
  4. 辨識資產流失。
    針對「已檢索 – 目前尚未建立索引」的網址,用成效報表的十六個月曝光曲線區分「從未收錄」與「曾收錄後被移除」,後者優先處理。
  5. 檢查重複內容來源。
    確認篩選參數、分頁、標籤頁與附件頁的處理方式,修正標準網址設定錯誤。
  6. 執行內容減法。
    依照前一節的處置表格,逐批合併、導向或移除低價值頁面,每批之間留一到兩週觀察期。
  7. 驗證與追蹤。
    修正完成後在報表中點選「驗證修正」,並在四到六週後回頭確認實際收錄變化,不要在第三天就下結論。

自己做到哪裡,什麼時候該找外部團隊

這篇文章談的內容,有相當大的比例是企業內部行銷人員自己就能完成的。

自己做得到的部分包括 Search Console 的報表判讀、後台可見度與 robots.txt 的基礎確認、標籤頁與附件頁的處理,以及依照曝光紀錄做內容盤點;這些工作不需要工程背景,需要的是有人固定負責、看得懂報表,而且願意花時間。

需要外部支援的通常是三類情況:

  • 網站規模超過數千頁,需要伺服器記錄檔分析才能看清 Googlebot 實際的抓取路徑
  • 索引問題與網站架構綁在一起,例如網址結構、多語系設定或商品分類邏輯本身就有問題,改動牽涉工程排程與風險評估
  • 網站曾經歷改版或搬遷,索引狀況大幅波動且原因不明,需要回溯比對歷史設定

評估 SEO 服務時,索引診斷的處理方式其實是一個很好的判斷點,願意先做完整索引盤點、把診斷結果與優先順序講清楚的 SEO 公司,跟開口就報一份關鍵字排名方案的業者,做事方法完全不同。這也會直接反映在 SEO 費用的結構上,前者的報價裡看得到診斷與技術修正的工時,後者通常只有內容產出的數量,關於這部分的判斷方法,我們在網站安全與搜尋風險管理那篇也整理過類似的檢查邏輯。

讓 Google 讀得到,才輪得到排名

索引是 SEO 裡最不吸引人的一段,它沒有排名上升的成就感,沒有可以放在簡報上的漂亮曲線,做得好的時候看起來就像什麼事都沒發生。

但它是所有後續投入的前提,你付出的內容預算、你請的文案、你買的網站設計,全部都建立在「Google 讀得到、也願意收錄」這件事上,這一層沒過,後面的努力都會停在同一道看不見的牆前面。

如果讀完之後只想做一件事,回到文章開頭那個動作:打開 Search Console 的網頁索引報表,看那兩個數字,然後把「未建立索引」的清單匯出來,隨機挑十個網址,用網址審查工具一個一個查。

十個裡面通常會出現一到兩個你完全沒預料到的狀況,那就是這篇文章對你最實際的價值。

如果你檢查後發現問題比預期多,或想請專業團隊一起盤點,歡迎直接與我們聯繫,我們可以協助你釐清卡在哪一道關卡。

關於本文

本文由加乘數位行銷內容企劃顧問Tina撰寫,內容涵蓋 Google 抓取與索引運作原理、Search Console 網頁索引報表判讀、網站常見的索引封鎖與重複內容問題,以及企業官網的內容減法與索引健檢流程。

文中引用的資料來源包含 Google Search Central 官方說明、Google 於 2026 年 7 月釋出的 Search Off the Record 節目內容、Cloudflare 2025 年度網路回顧報告,以及 Indexing Insight 與 IndexCheckr 所發布的索引狀態研究,所有數據皆已標註出處,讀者可自行查證。

如需轉載,請註明出處並附上原文連結;若你的網站正面臨收錄不完整、內容長期無曝光的狀況,歡迎與我們聯繫,由加乘的顧問團隊協助你釐清問題出在哪一道關卡。

👇【Google 沒讀完你的網站?一起找出索引盲點!👇

文章內容目錄