简体中文
citeglass · AI 可见性检查

检查于 2026/9/16 · https://www.eureko.sk/

AI 可发现性的技术前提已满足。

C
70 / 100
0 项严重 · 0 项待检查
自上次扫描以来: 分数 +46 · 修复 7 项 · 新增 3 项

AI 爬虫矩阵

对每个机器人:你的 robots.txt 允许什么 — 以及你的服务器实际向该机器人的用户代理返回什么。以红色标出的行:robots 允许,但服务器拦截(通常是 WAF 或防机器人规则)。

机器人运营方robots.txt服务器响应
GPTBotOpenAI未提及200 + 内容
OAI-SearchBotOpenAI未提及200 + 内容
ChatGPT-UserOpenAI未提及200 + 内容
ClaudeBotAnthropic未提及200 + 内容
Claude-SearchBotAnthropic未提及200 + 内容
Claude-UserAnthropic未提及200 + 内容
PerplexityBotPerplexity未提及200 + 内容
Perplexity-UserPerplexity未提及200 + 内容
Google-ExtendedGoogle (Gemini-Training)未提及
GooglebotGoogle (KI-Übersichten)未提及200 + 内容
CCBotCommon Crawl (Trainingsdaten vieler LLMs)未提及200 + 内容
BytespiderByteDance (Doubao)未提及200 + 内容
AmazonbotAmazon (Alexa/Rufus)未提及200 + 内容
Applebot-ExtendedApple (Intelligence-Training)未提及
Meta-ExternalAgentMeta (Llama/Meta AI)未提及200 + 内容
分数是如何得出的?
没有 llms.txt-5
没有作者或署名信号-4
未找到 sitemap.xml-4
服务器响应时间偏高-4
标题层级被跳过-3
没有可见或已标记的日期-3
没有 canonical URL-3
未找到 robots.txt-2
没有 FAQ 或 HowTo 标记-2
结果70 / 100

AI 爬虫的访问

提示

未找到 robots.txt

在 /robots.txt 处没有可访问的有效文件。爬虫于是假定「全部允许」— 可以工作,但你没有控制,也没有站点地图信号。

你应当做的: 在根目录创建 robots.txt,至少包含站点地图引用和你所需的 allow/disallow 规则。

User-agent: *
Allow: /

Sitemap: https://你的域名.cn/sitemap.xml

结构与机器可理解性

提示

没有 llms.txt

/llms.txt 处没有文件。llms.txt 是你核心内容的一份简短 Markdown 概览,一些 AI 系统用它来定位。

你应当做的: 创建 /llms.txt:一个含名称的 H1、一段关于产品的简短说明,以及指向核心页面的链接列表。

# 你的公司

> 一句话描述。

## 重要页面
- [产品](https://你的域名.cn/product):…
- [价格](https://你的域名.cn/pricing):…
- [关于我们](https://你的域名.cn/about):…
提示

标题层级被跳过

标题顺序至少跳过一个层级(例如从 H2 直接到 H4)。这使得自动重建内容结构更困难。

你应当做的: 无间断且按顺序使用标题层级(H1 → H2 → H3 …)。

提示

没有 FAQ 或 HowTo 标记

没有 FAQPage 或 HowTo 标记时,问答式和分步式内容对 AI 系统而言更难被识别为可直接引用的答案。

你应当做的: 在页面回答真实问题或给出操作说明的地方,将其标记为 FAQPage 或 HowTo(没有可见对应内容则不要加标记)。

信任与实体信号(E-E-A-T)

提示

没有作者或署名信号

无法识别作者(既无 meta 标签,也无 rel=author,也无 JSON-LD Person)。在 E-E-A-T 意义上的「经验」和「专业」需要具名且可追溯的署名。

你应当做的: 对编辑类内容,具名标注作者并链接作者页面;同时将其标记为 JSON-LD「Person」。

提示

没有可见或已标记的日期

无法识别发布或修改日期(既无 <time>,也无 article:published_time,也无 JSON-LD 中的 datePublished)。对许多问题,AI 系统偏好较新的来源。

你应当做的: 对与时间相关的内容,醒目地显示日期,并在 JSON-LD 中标记 datePublished / dateModified。

技术基础

提示

未找到 sitemap.xml

在 /sitemap.xml 处没有可访问的有效 XML 站点地图,robots.txt 也没有指名任何一个。站点地图帮助爬虫找到所有相关 URL。

你应当做的: 生成一个包含所有可索引 URL 的 sitemap.xml,并在 robots.txt 中引用它。

提示

服务器响应时间偏高

首字节时间约为 1751 毫秒 — 可感知,但尚不严重。

你应当做的: 关注响应时间,如果继续上升,检查缓存或 CDN。

提示

没有 canonical URL

页面没有设置 <link rel="canonical">。没有 canonical,当存在多个 URL 变体时,哪个版本是权威可能仍不清楚。

你应当做的: 在每个页面上设置一个自引用的 <link rel="canonical">,指向首选 URL。

正常(5)
  • 主要内容在不含 JavaScript 的 HTML 中。
  • 存在结构化数据(JSON-LD)。 — WebSite, Organization, LocalBusiness
  • 组织已标注为 JSON-LD。
  • 恰好一个 H1 标题。
  • 页面标题长度合理。

下一步

  1. 没有 llms.txt. 创建 /llms.txt:一个含名称的 H1、一段关于产品的简短说明,以及指向核心页面的链接列表。
  2. 没有作者或署名信号. 对编辑类内容,具名标注作者并链接作者页面;同时将其标记为 JSON-LD「Person」。
  3. 未找到 sitemap.xml. 生成一个包含所有可索引 URL 的 sitemap.xml,并在 robots.txt 中引用它。
监测该页面

每次变更都带电子邮件提醒的每周重扫。筹备中 — 请输入你的地址。

方法与局限

检查于 2026/9/16。citeglass 通过 HTTP 抓取 eureko.sk 及其相关文件(robots.txt、llms.txt、sitemap.xml)— 一次作为普通浏览器,一次针对每个 AI 爬虫用户代理。不执行 JavaScript。 首字节时间:1751 毫秒。

它不是什么: 不追踪排名或引用,不就模型是否真的点名你作出任何声明,也不检查通过 JavaScript 加载的内容。这是从单个服务器 IP 视角的一次快照。

检查其他网站