技術 SEO

JavaScript 連結令頁面喺 AI 搜尋中消失:41 日實驗揭示嘅技術 SEO 真相

Search Engine Land 喺 8 月 19 日發表咗一篇由 Vinicius Stanula 撰寫嘅重要研究報告,經過一個 41 日嘅受控實驗,揭示咗一個對技術 SEO 從業員嚟講相當震撼嘅事實:除咗 Googlebot 之外,幾乎所有 AI 爬蟲都無法追蹤 JavaScript 生成嘅連結。

呢個發現對香港企業嘅 SEO 策略有直接影響,尤其係如果網站依賴 JavaScript(例如 React、Vue、Next.js、Nuxt.js)嚟處理內部連結導航。

實驗係點樣做嘅?

研究者設置咗一個約 2,400 頁嘅真實網站,將內部連結分為兩組:

  • HTML 組(11 個部分):所有內部連結直接寫喺原始 HTML 入面,任何爬蟲都可以直接讀取同追蹤
  • JS 組(10 個部分):所有內部連結透過 JavaScript 喺頁面載入後先注入,原始 HTML 入面完全冇連結

為確保實驗純淨,研究員關閉咗 Sitemap、Breadcrumbs 同內部導航面板,令 JS 組嘅頁面唯一嘅發現路徑就係執行 JavaScript。

結果:AI 爬蟲幾乎全部失敗

41 日嘅記錄顯示咗一個非常懸殊嘅結果:

  • Googlebot(Google 搜尋索引爬蟲):只爬到 JS 組中約 2% 嘅頁面——即使係 Google,JavaScript 渲染嘅效率都唔高
  • GoogleOther(Google 內部爬蟲):能夠執行 JavaScript 並追蹤注入嘅連結,但 GoogleOther 唔會影響搜尋排名
  • GPTBot(OpenAI 爬蟲):完全無法到達 JS 組任何一個深層頁面,喺第一天爬完 HTML 組所有 759 頁後,喺 JS 組嘅 section 頁面就停咗落嚟
  • ClaudeBot(Anthropic 爬蟲):同 GPTBot 一模一樣嘅模式——深度 HTML 爬取,然後喺 JavaScript 邊界完全停止
  • PerplexityBot、Bingbot、Meta 同 Amazon 爬蟲:全部 0 個 JavaScript 頁面被發現

🔑 核心結論:「Google renders JavaScript」呢個講法喺 AI 搜尋時代已經唔再夠用。你嘅網站需要俾 Googlebot 以外嘅 AI 爬蟲都讀得到——而呢啲爬蟲完全唔識執行 JavaScript。

對香港企業嘅實際影響

呢個發現對以下幾類香港企業特別重要:

1. 用 React / Next.js / Nuxt.js 整嘅網站

如果你嘅網站係用現代 JavaScript 框架開發,尤其係客戶端渲染(CSR)或靜態生成(SSG)但依賴 JavaScript 處理內部連結,AI 爬蟲可能只見到你嘅首頁同部分頂層頁面,完全睇唔到你嘅深層內容。

2. 內容豐富嘅網站(新聞、Blog、教學)

如果你嘅網站有大量文章頁面,而導航至呢啲頁面嘅連結係透過 JavaScript 生成(例如「相關文章」區塊、分類頁嘅分頁按鈕),AI 爬蟲可能永遠唔會發現你嘅優質內容。

3. 依賴 AI 引用做曝光嘅企業

如果企業嘅 GEO(生成式引擎優化)策略依賴被 ChatGPT、Perplexity 等 AI 搜尋引擎引用,但 AI 爬蟲根本發現唔到你嘅深層內容,咁你嘅 GEO 努力就會大打折扣。

解決方案:確保所有內部連結都係 HTML

根據研究報告嘅建議,香港企業需要做以下檢查:

  1. 審計內部連結方式——使用 Screaming Frog 或 Ahrefs Site Audit 掃描網站,檢查有幾多內部連結係透過 JavaScript 注入而非直接寫喺 HTML
  2. 提供 HTML fallback——如果必要使用 JavaScript 生成連結,確保原始 HTML 入面有 <a href> 作為 fallback,即使係 hidden 狀態
  3. 使用 HTML Sitemap——建立一個純 HTML 嘅網站地圖頁,列出所有重要頁面嘅直接連結,幫助所有爬蟲發現內容
  4. 確保 Sitemap.xml 完整——Sitemap.xml 係 AI 爬蟲發現內容嘅重要途徑,確保入面包含所有重要頁面
  5. 測試 AI 爬蟲可讀性——使用工具測試 GPTBot 同 ClaudeBot 能否正常讀取你嘅關鍵頁面(可以參考 robots.txt 嘅 allow/disallow 設定)
  6. 考慮 Static Rendering——對關鍵內容頁面使用靜態渲染(Static Rendering)或服務端渲染(SSR),確保 HTML 入面有完整嘅連結結構

一段話總結

Search Engine Land 嘅 41 日實驗清楚證明:除咗 Google 嘅部分爬蟲之外,GPTBot、ClaudeBot、PerplexityBot 等 AI 爬蟲完全無法執行 JavaScript 嚟發現連結。對香港企業嚟講,如果你嘅網站使用 JavaScript 框架,你需要確保所有重要嘅內部連結都喺原始 HTML 中存在——否則你嘅內容喺 AI 搜尋生態中形同「隱形」。今日就開始審計網站嘅內部連結方式,確保 AI 爬蟲可以順利發現你嘅每一個頁面。

相關文章

深入了解 技術 SEO

Search Engine Land 最新研究發現:GPTBot、ClaudeBot、PerplexityBot 等 AI 爬蟲完全無法追蹤 JavaScript 生成嘅連結。本文分析對香港企業技術 SEO 嘅影響及解決方案。

SEO Company Hong Kong 提供專業的 SEO 服務,幫助香港企業在搜尋結果與 AI 平台中脫穎而出。如需客製化的優化建議,歡迎聯絡我們的 SEO 專家團隊。

JavaScript SEOAI 爬蟲GPTBotClaudeBotAI 搜尋技術 SEO香港 SEOJavaScript 連結AI 內容發現生成式引擎優化