2026/9/24 にチェック · https://www.heise.de/
厳しい障害はありませんが、2 件の項目が AI での発見可能性を弱めています。
AI クローラーマトリクス
各ボットについて: あなたの robots.txt が何を許可するか — そしてサーバーがボットのユーザーエージェントに実際に何を返すか。赤で強調された行: robots は許可しているのにサーバーがブロックしています(通常は WAF やボット保護のルール)。
| ボット | 運営者 | robots.txt | サーバー応答 |
|---|---|---|---|
| GPTBot | OpenAI | 許可 | 200 + コンテンツ |
| OAI-SearchBot | OpenAI | 許可 | 200 + コンテンツ |
| ChatGPT-User | OpenAI | 許可 | 200 + コンテンツ |
| ClaudeBot | Anthropic | 許可 | 200 + コンテンツ |
| Claude-SearchBot | Anthropic | 許可 | 200 + コンテンツ |
| Claude-User | Anthropic | 許可 | 200 + コンテンツ |
| PerplexityBot | Perplexity | 許可 | 200 + コンテンツ |
| Perplexity-User | Perplexity | 許可 | 200 + コンテンツ |
| Google-Extended | Google (Gemini-Training) | ブロック | — |
| Googlebot | Google (KI-Übersichten) | 許可 (User-agent: * 経由) | 200 + コンテンツ |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | ブロック | 200 + コンテンツ |
| Bytespider | ByteDance (Doubao) | ブロック | 200 + コンテンツ |
| Amazonbot | Amazon (Alexa/Rufus) | ブロック | 200 + コンテンツ |
| Applebot-Extended | Apple (Intelligence-Training) | ブロック | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | ブロック | 200 + コンテンツ |
スコアはどのように算出されますか?
| ページタイトルが短すぎるか長すぎます | -6 |
| H1 見出しがちょうど 1 つではありません | -5 |
| llms.txt がありません | -5 |
| Organization スキーマがありません | -4 |
| 著者または著作者シグナルがありません | -4 |
| sameAs のリンクがありません | -3 |
| FAQ または HowTo マークアップがありません | -2 |
| 結果 | 71 / 100 |
AI クローラーのアクセス
AI 学習を拒否しています
robots.txt が、言語モデルの学習用にコンテンツを収集するクローラーをブロックしています: Google-Extended, CCBot, Applebot-Extended。これは引用を妨げません。OAI-SearchBot、PerplexityBot、AI による概要のための Googlebot などの検索・取得ボットは別物です。
対応すべきこと: 拒否が意図的なら対応は不要です。検索ボットが許可されたままであることだけ確認してください。
構造と機械可読性
ページタイトルが短すぎるか長すぎます
<title> は 67 文字です。おおむね 30〜60 文字が妥当です: テーマを表すのに十分説明的で、途中で切れないほど短く。
対応すべきこと: テーマと、必要に応じてブランドを含む簡潔なタイトルを書いてください。
H1 見出しがちょうど 1 つではありません
ページに H1 見出しが 0 個あります。明確な H1 が 1 つあると、ページが主に何についてのものかを人間にも機械にも伝えられます。
対応すべきこと: ページの主テーマを表す H1 をちょうど 1 つ設定してください。その下はすべて H2 から始めます。
llms.txt がありません
/llms.txt にファイルがありません。llms.txt は主要コンテンツの短い Markdown 概要で、一部の AI システムが方向付けに使用します。
対応すべきこと: /llms.txt を作成してください: 名前を含む H1、提供内容についての短い段落、中心的なページへのリンク一覧。
# あなたの会社 > 1 文での説明。 ## 重要なページ - [製品](https://あなたのドメイン.jp/product): … - [料金](https://あなたのドメイン.jp/pricing): … - [会社概要](https://あなたのドメイン.jp/about): …
Organization スキーマがありません
JSON-LD はありますが「Organization」のエントリがありません。AI システムはその場合、あなたのブランドを独立したエンティティとして分類しにくくなり、外部ソースとの関連付けも弱くなります。
対応すべきこと: name、url、logo、sameAs(あなたの公式プロフィールへのリンク)を含む「Organization」スキーマを追加してください。
FAQ または HowTo マークアップがありません
質問と回答形式やステップバイステップのコンテンツは、FAQPage や HowTo のマークアップがないと、AI システムが直接引用可能な回答として認識しにくくなります。
対応すべきこと: ページが実際の質問に答えたり手順を示したりしている場合は、FAQPage または HowTo としてマークアップしてください(対応する可視コンテンツがない状態でのマークアップは不可)。
信頼およびエンティティシグナル(E-E-A-T)
著者または著作者シグナルがありません
著者を認識できません(メタタグ、rel=author、JSON-LD Person のいずれもありません)。E-E-A-T の意味での「経験」と「専門性」には、名前が明示され追跡可能な著作者が重要です。
対応すべきこと: 編集コンテンツでは著者名を明示し、著者ページをリンクしてください。JSON-LD の「Person」としてもマークアップします。
sameAs のリンクがありません
JSON-LD に「sameAs」がありません。これにより AI システムは、あなたのブランドや人物を既知のエンティティ(Wikidata、LinkedIn、業界ディレクトリ)に明確に対応付けます。
対応すべきこと: Organization または Person に、あなたの公式プロフィールやディレクトリ登録の URL を含む「sameAs」を追加してください。
問題なし(6)
- 主要コンテンツが JavaScript なしで HTML に含まれています。
- 構造化データ(JSON-LD)が存在します。 — ItemList, Thing
- canonical URL が設定されています。
- サイトマップに到達できます。
- サーバーの応答時間が速いです。
- noindex なし — ページはインデックス可能です。
次のステップ
- ページタイトルが短すぎるか長すぎます. テーマと、必要に応じてブランドを含む簡潔なタイトルを書いてください。
- H1 見出しがちょうど 1 つではありません. ページの主テーマを表す H1 をちょうど 1 つ設定してください。その下はすべて H2 から始めます。
- llms.txt がありません. /llms.txt を作成してください: 名前を含む H1、提供内容についての短い段落、中心的なページへのリンク一覧。
変更のたびにメール通知付きの週次再スキャン。準備中 — アドレスを入力してください。
手法と限界
2026/9/24 にチェックしました。citeglass は heise.de と関連ファイル(robots.txt、llms.txt、sitemap.xml)を HTTP で取得します — 一度は通常のブラウザーとして、一度は各 AI クローラーのユーザーエージェントとして。JavaScript は実行されません。 最初のバイトまでの時間: 67 ms。
これに含まれないもの: 順位や引用のトラッキングはなく、モデルが実際にあなたを名指しするかについての言明もなく、JavaScript で読み込まれるコンテンツのチェックもありません。1 つのサーバー IP の視点からのスナップショットです。