繁體中文
citeglass · AI 可見性檢查

檢查於 2026/9/23 · https://rehau-termopane.ro/

對 AI 可發現性存在 1 個嚴重障礙 — 請先修正它們。

C
69 / 100
1 項嚴重 · 0 項待檢查

AI 爬蟲矩陣

對每個機器人:你的 robots.txt 允許什麼 — 以及你的伺服器實際向該機器人的使用者代理回傳什麼。以紅色標出的列:robots 允許,但伺服器封鎖(通常是 WAF 或防機器人規則)。

機器人營運方robots.txt伺服器回應
GPTBotOpenAI未提及封鎖(403 / WAF)
OAI-SearchBotOpenAI未提及200 + 內容
ChatGPT-UserOpenAI未提及200 + 內容
ClaudeBotAnthropic未提及200 + 內容
Claude-SearchBotAnthropic未提及錯誤 / 逾時
Claude-UserAnthropic未提及200 + 內容
PerplexityBotPerplexity未提及錯誤 / 逾時
Perplexity-UserPerplexity未提及錯誤 / 逾時
Google-ExtendedGoogle (Gemini-Training)未提及
GooglebotGoogle (KI-Übersichten)未提及200 + 內容
CCBotCommon Crawl (Trainingsdaten vieler LLMs)未提及200 + 內容
BytespiderByteDance (Doubao)未提及200 + 內容
AmazonbotAmazon (Alexa/Rufus)未提及200 + 內容
Applebot-ExtendedApple (Intelligence-Training)未提及
Meta-ExternalAgentMeta (Llama/Meta AI)未提及封鎖(403 / WAF)
分數是如何得出的?
儘管 robots.txt 允許,伺服器仍封鎖機器人-12
沒有 llms.txt-5
未找到 sitemap.xml-4
標題層級被跳過-3
沒有 sameAs 關聯-3
未找到 robots.txt-2
沒有 FAQ 或 HowTo 標記-2
結果69 / 100

AI 爬蟲的存取

嚴重

儘管 robots.txt 允許,伺服器仍封鎖機器人

對來自 OpenAI, Meta (Llama/Meta AI) 的 2 個機器人,robots.txt 說「允許」,但伺服器以 403 或防機器人頁面回應。通常是 WAF、防火牆或 CDN 規則繞過 robots.txt 將爬蟲擋在外面。

你應當做的: 把所需 AI 爬蟲的使用者代理和/或 IP 段加入你的 WAF / Cloudflare / 防火牆的允許清單。透過反向 DNS 驗證,而不僅依據使用者代理字串。

提示

未找到 robots.txt

在 /robots.txt 處沒有可存取的有效檔案。爬蟲於是假定「全部允許」— 可以運作,但你沒有控制,也沒有網站地圖訊號。

你應當做的: 在根目錄建立 robots.txt,至少包含網站地圖引用與你所需的 allow/disallow 規則。

User-agent: *
Allow: /

Sitemap: https://你的網域.tw/sitemap.xml

結構與機器可理解性

提示

沒有 llms.txt

/llms.txt 處沒有檔案。llms.txt 是你核心內容的一份簡短 Markdown 概覽,一些 AI 系統用它來定位。

你應當做的: 建立 /llms.txt:一個含名稱的 H1、一段關於產品的簡短說明,以及指向核心頁面的連結清單。

# 你的公司

> 一句話描述。

## 重要頁面
- [產品](https://你的網域.tw/product):…
- [價格](https://你的網域.tw/pricing):…
- [關於我們](https://你的網域.tw/about):…
提示

標題層級被跳過

標題順序至少跳過一個層級(例如從 H2 直接到 H4)。這使得自動重建內容結構更困難。

你應當做的: 無間斷且依順序使用標題層級(H1 → H2 → H3 …)。

提示

沒有 FAQ 或 HowTo 標記

沒有 FAQPage 或 HowTo 標記時,問答式與逐步式內容對 AI 系統而言更難被辨識為可直接引用的答案。

你應當做的: 在頁面回答真實問題或給出操作說明的地方,將其標記為 FAQPage 或 HowTo(沒有可見對應內容則不要加標記)。

信任與實體訊號(E-E-A-T)

提示

沒有 sameAs 關聯

JSON-LD 中缺少「sameAs」。藉助它,AI 系統能明確地把你的品牌或人物對應到已知實體(Wikidata、LinkedIn、產業目錄)。

你應當做的: 在 Organization 或 Person 中新增「sameAs」,填入你官方資料頁與目錄條目的 URL。

技術基礎

提示

未找到 sitemap.xml

在 /sitemap.xml 處沒有可存取的有效 XML 網站地圖,robots.txt 也沒有指名任何一個。網站地圖幫助爬蟲找到所有相關 URL。

你應當做的: 產生一個包含所有可索引 URL 的 sitemap.xml,並在 robots.txt 中引用它。

正常(8)
  • 主要內容在不含 JavaScript 的 HTML 中。
  • 存在結構化資料(JSON-LD)。 — HomeAndConstructionBusiness, Organization, WebSite, ImageObject, WebPage, Person, Article, VideoObject
  • 組織已標註為 JSON-LD。
  • 恰好一個 H1 標題。
  • 已設定 canonical URL。
  • 頁面標題長度合理。
  • 存在作者訊號。
  • 伺服器回應時間快。

下一步

  1. 儘管 robots.txt 允許,伺服器仍封鎖機器人. 把所需 AI 爬蟲的使用者代理和/或 IP 段加入你的 WAF / Cloudflare / 防火牆的允許清單。透過反向 DNS 驗證,而不僅依據使用者代理字串。
  2. 沒有 llms.txt. 建立 /llms.txt:一個含名稱的 H1、一段關於產品的簡短說明,以及指向核心頁面的連結清單。
  3. 未找到 sitemap.xml. 產生一個包含所有可索引 URL 的 sitemap.xml,並在 robots.txt 中引用它。
監測該頁面

每次變更都帶電子郵件提醒的每週重掃。籌備中 — 請輸入你的地址。

方法與限制

檢查於 2026/9/23。citeglass 透過 HTTP 抓取 rehau-termopane.ro 及其相關檔案(robots.txt、llms.txt、sitemap.xml)— 一次作為一般瀏覽器,一次針對每個 AI 爬蟲使用者代理。不執行 JavaScript。 首位元組時間:774 毫秒。

它不是什麼: 不追蹤排名或引用,不就模型是否真的點名你作出任何聲明,也不檢查透過 JavaScript 載入的內容。這是從單一伺服器 IP 視角的一次快照。

檢查其他網站