2026/9/4 にチェック · https://example.com/
厳しい障害はありませんが、4 件の項目が AI での発見可能性を弱めています。
AI クローラーマトリクス
各ボットについて: あなたの robots.txt が何を許可するか — そしてサーバーがボットのユーザーエージェントに実際に何を返すか。赤で強調された行: robots は許可しているのにサーバーがブロックしています(通常は WAF やボット保護のルール)。
| ボット | 運営者 | robots.txt | サーバー応答 |
|---|---|---|---|
| GPTBot | OpenAI | 記載なし | 200 + コンテンツ |
| OAI-SearchBot | OpenAI | 記載なし | 200 + コンテンツ |
| ChatGPT-User | OpenAI | 記載なし | 200 + コンテンツ |
| ClaudeBot | Anthropic | 記載なし | 200 + コンテンツ |
| Claude-SearchBot | Anthropic | 記載なし | 200 + コンテンツ |
| Claude-User | Anthropic | 記載なし | 200 + コンテンツ |
| PerplexityBot | Perplexity | 記載なし | 200 + コンテンツ |
| Perplexity-User | Perplexity | 記載なし | 200 + コンテンツ |
| Google-Extended | Google (Gemini-Training) | 記載なし | — |
| Googlebot | Google (KI-Übersichten) | 記載なし | 200 + コンテンツ |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | 記載なし | 200 + コンテンツ |
| Bytespider | ByteDance (Doubao) | 記載なし | 200 + コンテンツ |
| Amazonbot | Amazon (Alexa/Rufus) | 記載なし | 200 + コンテンツ |
| Applebot-Extended | Apple (Intelligence-Training) | 記載なし | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | 記載なし | 200 + コンテンツ |
スコアはどのように算出されますか?
| HTML 内のテキストが非常に少ないです | -10 |
| 構造化データ(JSON-LD)がありません | -8 |
| ページタイトルが短すぎるか長すぎます | -6 |
| メタディスクリプションがないか不適切です | -5 |
| llms.txt がありません | -5 |
| 著者または著作者シグナルがありません | -4 |
| sitemap.xml が見つかりません | -4 |
| sameAs のリンクがありません | -3 |
| 法的情報 / 会社概要 / お問い合わせへのリンクがありません | -3 |
| 可視またはマークアップされた日付がありません | -3 |
| canonical URL がありません | -3 |
| robots.txt が見つかりません | -2 |
| 結果 | 44 / 100 |
AI クローラーのアクセス
robots.txt が見つかりません
/robots.txt に有効なファイルが見つかりませんでした。その場合クローラーは「すべて許可」とみなします — 動作はしますが、制御もサイトマップシグナルもありません。
対応すべきこと: ルートディレクトリに robots.txt を作成してください。少なくともサイトマップ参照と目的の allow/disallow ルールを含めます。
User-agent: * Allow: / Sitemap: https://あなたのドメイン.jp/sitemap.xml
JavaScript なしのコンテンツ
HTML 内のテキストが非常に少ないです
初期 HTML には可視テキストが約 142 文字しか含まれていません。AI システムがページのテーマを確実に把握するにはほとんど足りません。
対応すべきこと: 実際のコンテンツが画像、iframe、JavaScript で読み込まれるブロックではなく、完全に HTML に含まれていることを確認してください。
構造と機械可読性
構造化データ(JSON-LD)がありません
ページに JSON-LD が含まれていません。構造化データは、エンティティ、著者、組織、日付、ページタイプを AI システムが明確に認識するのに役立ちます — それがなければ、すべて本文から推測する必要があります。
対応すべきこと: 少なくとも「Organization」スキーマと、ページタイプに合ったスキーマ(Article、Product、FAQPage など)を JSON-LD として <head> に追加してください。
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"あなたの会社","url":"https://あなたのドメイン.jp",
"sameAs":["https://www.linkedin.com/company/…"]}
</script>ページタイトルが短すぎるか長すぎます
<title> は 14 文字です。おおむね 30〜60 文字が妥当です: テーマを表すのに十分説明的で、途中で切れないほど短く。
対応すべきこと: テーマと、必要に応じてブランドを含む簡潔なタイトルを書いてください。
メタディスクリプションがないか不適切です
メタディスクリプションは 0 文字です。これは AI システムや検索エンジンがページの要約として最初に読むことが多いものです。
対応すべきこと: キーワードの羅列ではなく、ページの独立した要約を 1〜2 文(おおむね 120〜200 文字)で書いてください。
llms.txt がありません
/llms.txt にファイルがありません。llms.txt は主要コンテンツの短い Markdown 概要で、一部の AI システムが方向付けに使用します。
対応すべきこと: /llms.txt を作成してください: 名前を含む H1、提供内容についての短い段落、中心的なページへのリンク一覧。
# あなたの会社 > 1 文での説明。 ## 重要なページ - [製品](https://あなたのドメイン.jp/product): … - [料金](https://あなたのドメイン.jp/pricing): … - [会社概要](https://あなたのドメイン.jp/about): …
信頼およびエンティティシグナル(E-E-A-T)
著者または著作者シグナルがありません
著者を認識できません(メタタグ、rel=author、JSON-LD Person のいずれもありません)。E-E-A-T の意味での「経験」と「専門性」には、名前が明示され追跡可能な著作者が重要です。
対応すべきこと: 編集コンテンツでは著者名を明示し、著者ページをリンクしてください。JSON-LD の「Person」としてもマークアップします。
sameAs のリンクがありません
JSON-LD に「sameAs」がありません。これにより AI システムは、あなたのブランドや人物を既知のエンティティ(Wikidata、LinkedIn、業界ディレクトリ)に明確に対応付けます。
対応すべきこと: Organization または Person に、あなたの公式プロフィールやディレクトリ登録の URL を含む「sameAs」を追加してください。
法的情報 / 会社概要 / お問い合わせへのリンクがありません
チェックしたページに、法的情報、「会社概要」ページ、お問い合わせへのリンクが認識できません。こうしたページは強い信頼シグナルであり、エンティティの対応付けにも役立ちます。
対応すべきこと: 法的情報または「会社概要」とお問い合わせを、通常は各ページのフッターに、目立つ形でリンクしてください。
可視またはマークアップされた日付がありません
公開日や更新日を認識できません(<time>、article:published_time、JSON-LD の datePublished のいずれもありません)。多くの質問で AI システムは新しいソースを優先します。
対応すべきこと: 時間に関連するコンテンツでは日付を可視で表示し、JSON-LD で datePublished / dateModified をマークアップしてください。
技術的基盤
sitemap.xml が見つかりません
/sitemap.xml に有効な XML サイトマップが見つからず、robots.txt もどれも指定していません。サイトマップはクローラーが関連するすべての URL を見つけるのに役立ちます。
対応すべきこと: インデックス可能なすべての URL を含む sitemap.xml を生成し、robots.txt で参照してください。
canonical URL がありません
ページが <link rel="canonical"> を設定していません。canonical がないと、複数の URL バリアントがある場合にどのバージョンが正規かが不明確なままになることがあります。
対応すべきこと: 各ページに、優先 URL を指す自己参照の <link rel="canonical"> を設定してください。
問題なし(2)
- H1 見出しがちょうど 1 つです。
- サーバーの応答時間が速いです。
次のステップ
- HTML 内のテキストが非常に少ないです. 実際のコンテンツが画像、iframe、JavaScript で読み込まれるブロックではなく、完全に HTML に含まれていることを確認してください。
- 構造化データ(JSON-LD)がありません. 少なくとも「Organization」スキーマと、ページタイプに合ったスキーマ(Article、Product、FAQPage など)を JSON-LD として <head> に追加してください。
- ページタイトルが短すぎるか長すぎます. テーマと、必要に応じてブランドを含む簡潔なタイトルを書いてください。
変更のたびにメール通知付きの週次再スキャン。準備中 — アドレスを入力してください。
手法と限界
2026/9/4 にチェックしました。citeglass は example.com と関連ファイル(robots.txt、llms.txt、sitemap.xml)を HTTP で取得します — 一度は通常のブラウザーとして、一度は各 AI クローラーのユーザーエージェントとして。JavaScript は実行されません。 最初のバイトまでの時間: 12 ms。
これに含まれないもの: 順位や引用のトラッキングはなく、モデルが実際にあなたを名指しするかについての言明もなく、JavaScript で読み込まれるコンテンツのチェックもありません。1 つのサーバー IP の視点からのスナップショットです。