一個實驗,揭開AI搜尋引擎的技術盲點
2026年8月19日,Search Engine Land 發表了一篇震撼SEO業界的文章,來自巴西SEO代理商 LOCOMOTIVE 的副總監 Vinicius Stanula,以一場長達41日的實地實驗,首次量化證實了大多數人一直懷疑但沒有確鑿數據的事:
AI爬蟲(GPTBot、ClaudeBot、Bingbot、PerplexityBot 等)完全不執行JavaScript——如果你的網站內部連結依賴JS載入,AI搜尋引擎根本看不到那些頁面。
這不是理論推測,這是2,400頁網站、41天、來自真實伺服器日誌的硬數據。對於香港眾多以現代JavaScript框架(React、Vue、Next.js)建構的網站來說,這個發現極為重要。
實驗是怎樣做的?
Stanula 在一個他擁有的巴西商業分類目錄網站(約2,400頁)上進行了對照實驗:
實驗設計
網站有21個頂層分類,他將這些分類分成兩組:
| 組別 | 頁數 | 連結方式 |
|---|---|---|
| HTML組(11個分類) | 約500+頁 | 所有連結直接以 <a href="..."> 寫在原始HTML中 |
| JS組(10個分類) | 約500+頁 | 所有連結透過JavaScript在頁面載入後才注入,原始HTML中沒有任何連結 |
然後他在41日內記錄了所有爬蟲對這兩組頁面的請求。
結果——比預期更極端
Googlebot 只到達 JS 組的 2% 頁面。GPTBot、ClaudeBot、Bingbot、PerplexityBot、Meta的爬蟲、Amazon的爬蟲——全部找到零個 JS 連結頁面。
詳細數據如下:
Google 爬蟲群組:
- Googlebot(建立搜尋索引的爬蟲):只到達 JS 組的 2% 頁面
- Google 的其他渲染爬蟲(非索引用):有執行 JS,但其實它們的工作不是建立索引
- 結論:實際上 Google 索引中 JS 頁面的比例接近零
其他所有 AI 爬蟲:
- GPTBot(OpenAI/ChatGPT):0%
- ClaudeBot(Anthropic):0%
- Bingbot(Microsoft Bing):0%
- PerplexityBot(Perplexity):0%
- Meta’s crawler(Facebook/Instagram):0%
- Amazon’s crawler:0%
為什麼會這樣?——兩個根本原因
原因一:AI爬蟲的設計目標不同
Googlebot 之所以能渲染 JavaScript,是因為 Google 投入了巨大資源讓它搭載一個完整的 Chromium 瀏覽器引擎。但其他爬蟲的設計目標完全不同:
- GPTBot 的目標是搜集文本內容來訓練模型,不是建立搜尋索引
- ClaudeBot 和 PerplexityBot 同樣以文本擷取為主
- 執行 JavaScript 需要大量的計算資源和時間,對這些爬蟲來說成本效益太低
原因二:「Google 渲染 JS」的迷思已經過時
多年來,SEO 業界的標準答案是「Google 會渲染 JavaScript」,但這個說法有兩個關鍵漏洞:
- Googlebot 不等於 Google 的所有爬蟲——Google 實際上有多種爬蟲,只有 Googlebot(用於建立搜尋索引的那個)會執行 JS,而實驗顯示即使是 Googlebot,也只到達了 JS 頁面的 2%
- AI 時代的爬蟲生態完全不同——今天的搜尋流量越來越多來自 ChatGPT、Claude、Perplexity、Copilot 等 AI 平台,它們的爬蟲完全不渲染 JS
對香港企業的具體影響
香港網站的JS使用情況
香港的網站開發生態中,JavaScript框架的使用率非常高:
- 許多企業網站使用 React / Next.js 建構
- Vue.js / Nuxt.js 在香港開發社群中也非常流行
- 不少香港網站使用 SPA(單頁應用程式) 架構
- 部分網站依賴 JavaScript 載入導航菜單、產品列表、分類頁面連結
如果你的網站有任何一種以下情況,就處於高風險之中:
🚨 高風險指標
| 風險等級 | 特徵 | 影響 |
|---|---|---|
| 🔴 極高 | 導航菜單完全由JS生成,HTML中沒有 <a> 連結 | AI爬蟲完全無法發現導航下的任何頁面 |
| 🟠 高 | 產品列表/分類頁使用JS分頁或按鈕載入 | 深層產品頁完全消失 |
| 🟡 中 | 部分內部連結使用JS事件監聽器(onclick)而非標準 <a> | 部分頁面遺失 |
| 🟢 低 | HTML中有完整的 <a>,但個別互動元素使用JS | 影響有限,仍建議修復 |
香港常見的受影響網站類型
- 餐飲業網站:JS載入菜單分類和分店列表
- 電子商務網站:JS載入產品篩選結果和分頁連結
- 地產網站:JS載入樓盤列表和搜尋結果
- 旅行社網站:JS載入行程選擇和價格比較
- 服務平台:JS載入服務目錄和團隊介紹
立即可以做的技術檢查
第一步:檢查你的網站是否存在JS連結問題
用這個簡單的方法檢查你的網站:
- 在Chrome瀏覽器中打開你的網站
- 右鍵 > 「檢視網頁原始碼」(View Page Source)——不是「檢查元素」(Inspect Element)
- 搜尋
href="——看看你的內部連結是否存在於原始HTML中 - 如果原始HTML中只有一個
<div id="root"></div>或類似的空容器,然後所有內容都是透過JS載入的——你就有嚴重的可抓取問題
更徹底的方法:
# 用 curl 檢查網頁原始碼是否包含連結
curl -s https://你的網站.com | grep -c 'href="'
如果返回的數字遠低於你預期的頁面數,就代表很多連結被藏在了JS中。
第二步:使用「curl測試」檢查AI爬蟲能看到什麼
AI爬蟲的行為本質上類似 curl——它們讀取原始HTML,不執行JavaScript。所以這個測試非常準確:
curl -s -A "GPTBot/1.0" https://你的網站.com | grep -i 'href='
或者使用 Google Search Console 的「檢查網址」工具,查看 Googlebot 看到的頁面內容。
第三步:修復方案
短期修復(本週內可完成):
- ✅ 將關鍵導航連結改成伺服器端渲染(SSR):確保所有主要內部連結在原始HTML中以標準
<a href="...">存在 - ✅ 使用靜態生成(SSG):Next.js 和 Nuxt.js 都支援靜態生成,在構建時就生成完整的 HTML
- ✅ 添加HTML版的網站地圖:在 footer 中加入純 HTML 的網站地圖連結
長期架構調整:
- 🔧 採用混合渲染策略:關鍵導航和內容使用伺服器端渲染,互動功能保留JS
- 🔧 確保
<a>元素永遠有真實的href屬性:即使需要JS增強功能,也應該保留標準的連結作為基礎 - 🔧 使用
rel="prefetch"或<link rel="preload">:幫助爬蟲發現那些被JS隱藏的頁面
第四步:驗證修復效果
修復完成後,重複第一步的測試:
- 用 curl 或 View Page Source 檢查原始HTML中是否有了完整的連結結構
- 使用 Google Search Console 的「網址檢查」確認 Googlebot 可以看到所有頁面
- 考慮使用 Screaming Frog 等工具爬取你的網站,確保所有頁面都可被發現
不只是Google:AI搜尋生態的多元化挑戰
這場實驗最令人警醒的地方,在於它揭示了AI搜尋生態的技術碎片化。
當你的SEO策略只關注Google時,你可能忽略了一個正在快速增長的事實:越來越多搜尋流量來自不使用Googlebot的AI平台。
以下是主要AI平台及其使用的爬蟲:
| AI平台 | 使用的爬蟲 | 執行JS? |
|---|---|---|
| Google Search(傳統) | Googlebot | ✅ 會 |
| Google AI Mode / AI Overviews | Googlebot + 其他Google爬蟲 | ⚠️ 部分會 |
| ChatGPT Search | GPTBot | ❌ 不會 |
| Claude / Anthropic | ClaudeBot | ❌ 不會 |
| Perplexity | PerplexityBot | ❌ 不會 |
| Microsoft Copilot / Bing AI | Bingbot | ❌ 不會 |
| Meta AI | Meta’s crawler | ❌ 不會 |
這意味著:即使你的網站在Google搜尋中排名良好,在ChatGPT、Claude或Perplexity的搜尋回應中,你的頁面可能完全不存在。
香港企業的行動清單
以下是你可以立即採取的具體行動:
🏃 緊急(本週內)
- 執行 curl 測試:用上面的指令檢查你的網站原始HTML中是否有完整連結
- 檢查關鍵頁面:你的首頁、服務頁、產品頁的內部連結是否在原始HTML中?
- 修復導航菜單:如果導航菜單由JS生成,立即改成伺服器端渲染
📋 短期(兩週內)
- 對所有模板進行審計:檢查網站每個頁面模板的原始HTML輸出
- 為所有分頁連結添加HTML基礎:即使使用JS分頁,也確保有
<a href="...">作為基礎 - 建立一份可抓取性報告:標記所有需要修復的頁面和元件
🔭 長期(季度檢討)
- 將可抓取性納入開發流程:每次網站更新前,檢查原始HTML中的連結結構
- 監控AI平台引薦流量:在Google Analytics中追蹤來自ChatGPT、Perplexity等平台的流量變化
- 定期使用 Search Console 檢查索引覆蓋率:如果索引頁面數量突然下降,技術SEO問題可能是原因
總結
Vinicius Stanula 的41日實驗提供了一個我們無法忽視的技術警示:AI搜尋生態正在從「Google一家獨大」走向「多家AI平台並存」,而這些平台的爬蟲能力遠不如Googlebot。
對於香港企業來說,這意味著一個簡單但重要的技術SEO原則需要被重新強調:確保你的網站內容在「零JavaScript」的環境下仍然可存取、可連結、可導航。
這不是要你放棄JavaScript帶來的互動體驗,而是要建立一個「漸進增強」的網站架構——基本內容使用標準HTML,互動功能在HTML基礎上透過JS增強。這樣做不僅讓AI爬蟲可以發現你的所有頁面,也讓網站的可存取性和整體用戶體驗變得更好。
在AI搜尋時代,技術SEO的基本功比以往任何時候都更加重要。如果你的網站因為JS連結問題而被AI爬蟲完全忽略,再好的內容策略也無法發揮作用。
參考來源:
- Search Engine Land — JavaScript links can make your pages invisible to AI search(2026年8月19日),作者 Vinicius Stanula
- Search Engine Journal — How Google AIOs Use Facebook, Instagram & TikTok(2026年8月18日)