2026/9/23 にチェック · https://rehau-termopane.ro/
AI での発見可能性に対して重大な障害が 1 件あります — まずこれらを修正してください。
AI クローラーマトリクス
各ボットについて: あなたの robots.txt が何を許可するか — そしてサーバーがボットのユーザーエージェントに実際に何を返すか。赤で強調された行: robots は許可しているのにサーバーがブロックしています(通常は WAF やボット保護のルール)。
| ボット | 運営者 | robots.txt | サーバー応答 |
|---|---|---|---|
| GPTBot | OpenAI | 記載なし | ブロック(403 / WAF) |
| OAI-SearchBot | OpenAI | 記載なし | 200 + コンテンツ |
| ChatGPT-User | OpenAI | 記載なし | 200 + コンテンツ |
| ClaudeBot | Anthropic | 記載なし | 200 + コンテンツ |
| Claude-SearchBot | Anthropic | 記載なし | エラー / タイムアウト |
| Claude-User | Anthropic | 記載なし | 200 + コンテンツ |
| PerplexityBot | Perplexity | 記載なし | エラー / タイムアウト |
| Perplexity-User | Perplexity | 記載なし | エラー / タイムアウト |
| Google-Extended | Google (Gemini-Training) | 記載なし | — |
| Googlebot | Google (KI-Übersichten) | 記載なし | 200 + コンテンツ |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | 記載なし | 200 + コンテンツ |
| Bytespider | ByteDance (Doubao) | 記載なし | 200 + コンテンツ |
| Amazonbot | Amazon (Alexa/Rufus) | 記載なし | 200 + コンテンツ |
| Applebot-Extended | Apple (Intelligence-Training) | 記載なし | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | 記載なし | ブロック(403 / WAF) |
スコアはどのように算出されますか?
| robots.txt が許可しているのにサーバーがボットをブロックしています | -12 |
| llms.txt がありません | -5 |
| sitemap.xml が見つかりません | -4 |
| 見出しレベルがスキップされています | -3 |
| sameAs のリンクがありません | -3 |
| robots.txt が見つかりません | -2 |
| FAQ または HowTo マークアップがありません | -2 |
| 結果 | 69 / 100 |
AI クローラーのアクセス
robots.txt が許可しているのにサーバーがボットをブロックしています
OpenAI, Meta (Llama/Meta AI) の 2 個のボットについて、robots.txt は「許可」と言っていますが、サーバーは 403 かボット保護ページで応答します。通常は WAF、ファイアウォール、CDN のルールが robots.txt をすり抜けてクローラーを締め出しています。
対応すべきこと: 目的の AI クローラーのユーザーエージェントや IP 範囲を、WAF / Cloudflare / ファイアウォールの許可リストに追加してください。ユーザーエージェント文字列だけでなく、逆引き DNS で検証します。
robots.txt が見つかりません
/robots.txt に有効なファイルが見つかりませんでした。その場合クローラーは「すべて許可」とみなします — 動作はしますが、制御もサイトマップシグナルもありません。
対応すべきこと: ルートディレクトリに robots.txt を作成してください。少なくともサイトマップ参照と目的の allow/disallow ルールを含めます。
User-agent: * Allow: / Sitemap: https://あなたのドメイン.jp/sitemap.xml
構造と機械可読性
llms.txt がありません
/llms.txt にファイルがありません。llms.txt は主要コンテンツの短い Markdown 概要で、一部の AI システムが方向付けに使用します。
対応すべきこと: /llms.txt を作成してください: 名前を含む H1、提供内容についての短い段落、中心的なページへのリンク一覧。
# あなたの会社 > 1 文での説明。 ## 重要なページ - [製品](https://あなたのドメイン.jp/product): … - [料金](https://あなたのドメイン.jp/pricing): … - [会社概要](https://あなたのドメイン.jp/about): …
見出しレベルがスキップされています
見出しの並びが少なくとも 1 レベルをスキップしています(例: H2 から直接 H4)。コンテンツ構造を自動的に再構築するのが難しくなります。
対応すべきこと: 見出しレベルを飛ばさず順番どおりに使用してください(H1 → H2 → H3 …)。
FAQ または HowTo マークアップがありません
質問と回答形式やステップバイステップのコンテンツは、FAQPage や HowTo のマークアップがないと、AI システムが直接引用可能な回答として認識しにくくなります。
対応すべきこと: ページが実際の質問に答えたり手順を示したりしている場合は、FAQPage または HowTo としてマークアップしてください(対応する可視コンテンツがない状態でのマークアップは不可)。
信頼およびエンティティシグナル(E-E-A-T)
sameAs のリンクがありません
JSON-LD に「sameAs」がありません。これにより AI システムは、あなたのブランドや人物を既知のエンティティ(Wikidata、LinkedIn、業界ディレクトリ)に明確に対応付けます。
対応すべきこと: Organization または Person に、あなたの公式プロフィールやディレクトリ登録の URL を含む「sameAs」を追加してください。
技術的基盤
sitemap.xml が見つかりません
/sitemap.xml に有効な XML サイトマップが見つからず、robots.txt もどれも指定していません。サイトマップはクローラーが関連するすべての URL を見つけるのに役立ちます。
対応すべきこと: インデックス可能なすべての URL を含む sitemap.xml を生成し、robots.txt で参照してください。
問題なし(8)
- 主要コンテンツが JavaScript なしで HTML に含まれています。
- 構造化データ(JSON-LD)が存在します。 — HomeAndConstructionBusiness, Organization, WebSite, ImageObject, WebPage, Person, Article, VideoObject
- 組織が JSON-LD としてマークアップされています。
- H1 見出しがちょうど 1 つです。
- canonical URL が設定されています。
- ページタイトルの長さが妥当です。
- 著者シグナルが存在します。
- サーバーの応答時間が速いです。
次のステップ
- robots.txt が許可しているのにサーバーがボットをブロックしています. 目的の AI クローラーのユーザーエージェントや IP 範囲を、WAF / Cloudflare / ファイアウォールの許可リストに追加してください。ユーザーエージェント文字列だけでなく、逆引き DNS で検証します。
- llms.txt がありません. /llms.txt を作成してください: 名前を含む H1、提供内容についての短い段落、中心的なページへのリンク一覧。
- sitemap.xml が見つかりません. インデックス可能なすべての URL を含む sitemap.xml を生成し、robots.txt で参照してください。
変更のたびにメール通知付きの週次再スキャン。準備中 — アドレスを入力してください。
手法と限界
2026/9/23 にチェックしました。citeglass は rehau-termopane.ro と関連ファイル(robots.txt、llms.txt、sitemap.xml)を HTTP で取得します — 一度は通常のブラウザーとして、一度は各 AI クローラーのユーザーエージェントとして。JavaScript は実行されません。 最初のバイトまでの時間: 774 ms。
これに含まれないもの: 順位や引用のトラッキングはなく、モデルが実際にあなたを名指しするかについての言明もなく、JavaScript で読み込まれるコンテンツのチェックもありません。1 つのサーバー IP の視点からのスナップショットです。