日本語
citeglass · AI 可視性チェック

2026/9/24 にチェック · https://www.nytimes.com/

AI での発見可能性に対して重大な障害が 2 件あります — まずこれらを修正してください。

F
1 / 100
重大 2 件 · 要確認 5 件
前回のスキャン以降: スコア -37 · 2 件修正 · 8 件新規

AI クローラーマトリクス

各ボットについて: あなたの robots.txt が何を許可するか — そしてサーバーがボットのユーザーエージェントに実際に何を返すか。赤で強調された行: robots は許可しているのにサーバーがブロックしています(通常は WAF やボット保護のルール)。

ボット運営者robots.txtサーバー応答
GPTBotOpenAIブロックブロック(403 / WAF)
OAI-SearchBotOpenAIブロックブロック(403 / WAF)
ChatGPT-UserOpenAIブロックブロック(403 / WAF)
ClaudeBotAnthropicブロックブロック(403 / WAF)
Claude-SearchBotAnthropicブロックブロック(403 / WAF)
Claude-UserAnthropicブロックブロック(403 / WAF)
PerplexityBotPerplexityブロックブロック(403 / WAF)
Perplexity-UserPerplexityブロックブロック(403 / WAF)
Google-ExtendedGoogle (Gemini-Training)ブロック—
GooglebotGoogle (KI-Übersichten)許可ブロック(403 / WAF)
CCBotCommon Crawl (Trainingsdaten vieler LLMs)ブロックブロック(403 / WAF)
BytespiderByteDance (Doubao)ブロックブロック(403 / WAF)
AmazonbotAmazon (Alexa/Rufus)許可ブロック(403 / WAF)
Applebot-ExtendedApple (Intelligence-Training)ブロック—
Meta-ExternalAgentMeta (Llama/Meta AI)ブロックブロック(403 / WAF)
スコアはどのように算出されますか?
AI 検索ボットが robots.txt でブロックされています-32
robots.txt が許可しているのにサーバーがボットをブロックしています-12
HTML 内のテキストが非常に少ないです-10
構造化データ(JSON-LD)がありません-8
ページタイトルが短すぎるか長すぎます-6
H1 見出しがちょうど 1 つではありません-5
メタディスクリプションがないか不適切です-5
llms.txt がありません-5
著者または著作者シグナルがありません-4
sameAs のリンクがありません-3
法的情報 / 会社概要 / お問い合わせへのリンクがありません-3
可視またはマークアップされた日付がありません-3
canonical URL がありません-3
結果1 / 100

AI クローラーのアクセス

重大

AI 検索ボットが robots.txt でブロックされています

robots.txt が、AI アシスタントや検索エンジンの回答用にコンテンツを取得する 6 個のボットをブロックしています: OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User。ブロックされている間、あなたのサイトはそこで出典として表示されません。

対応すべきこと: ボットごとにブロックが意図的か確認してください。AI の学習だけを拒否したい場合は、学習用ボット(GPTBot、ClaudeBot、Google-Extended)をブロックし、検索ボットは許可します。

User-agent: OAI-SearchBot
Allow: /

User-agent: ChatGPT-User
Allow: /

User-agent: Claude-SearchBot
Allow: /

User-agent: Claude-User
Allow: /

User-agent: PerplexityBot
Allow: /

User-agent: Perplexity-User
Allow: /
重大

robots.txt が許可しているのにサーバーがボットをブロックしています

Google (KI-Übersichten), Amazon (Alexa/Rufus) の 2 個のボットについて、robots.txt は「許可」と言っていますが、サーバーは 403 かボット保護ページで応答します。通常は WAF、ファイアウォール、CDN のルールが robots.txt をすり抜けてクローラーを締め出しています。

対応すべきこと: 目的の AI クローラーのユーザーエージェントや IP 範囲を、WAF / Cloudflare / ファイアウォールの許可リストに追加してください。ユーザーエージェント文字列だけでなく、逆引き DNS で検証します。

ヒント

AI 学習を拒否しています

robots.txt が、言語モデルの学習用にコンテンツを収集するクローラーをブロックしています: GPTBot, ClaudeBot, Google-Extended, CCBot, Applebot-Extended。これは引用を妨げません。OAI-SearchBot、PerplexityBot、AI による概要のための Googlebot などの検索・取得ボットは別物です。

対応すべきこと: 拒否が意図的なら対応は不要です。検索ボットが許可されたままであることだけ確認してください。

JavaScript なしのコンテンツ

要確認

HTML 内のテキストが非常に少ないです

初期 HTML には可視テキストが約 55 文字しか含まれていません。AI システムがページのテーマを確実に把握するにはほとんど足りません。

対応すべきこと: 実際のコンテンツが画像、iframe、JavaScript で読み込まれるブロックではなく、完全に HTML に含まれていることを確認してください。

構造と機械可読性

要確認

構造化データ(JSON-LD)がありません

ページに JSON-LD が含まれていません。構造化データは、エンティティ、著者、組織、日付、ページタイプを AI システムが明確に認識するのに役立ちます — それがなければ、すべて本文から推測する必要があります。

対応すべきこと: 少なくとも「Organization」スキーマと、ページタイプに合ったスキーマ(Article、Product、FAQPage など)を JSON-LD として <head> に追加してください。

<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
 "name":"あなたの会社","url":"https://あなたのドメイン.jp",
 "sameAs":["https://www.linkedin.com/company/…"]}
</script>
要確認

ページタイトルが短すぎるか長すぎます

<title> は 11 文字です。おおむね 30〜60 文字が妥当です: テーマを表すのに十分説明的で、途中で切れないほど短く。

対応すべきこと: テーマと、必要に応じてブランドを含む簡潔なタイトルを書いてください。

要確認

H1 見出しがちょうど 1 つではありません

ページに H1 見出しが 0 個あります。明確な H1 が 1 つあると、ページが主に何についてのものかを人間にも機械にも伝えられます。

対応すべきこと: ページの主テーマを表す H1 をちょうど 1 つ設定してください。その下はすべて H2 から始めます。

要確認

メタディスクリプションがないか不適切です

メタディスクリプションは 0 文字です。これは AI システムや検索エンジンがページの要約として最初に読むことが多いものです。

対応すべきこと: キーワードの羅列ではなく、ページの独立した要約を 1〜2 文(おおむね 120〜200 文字)で書いてください。

ヒント

llms.txt がありません

/llms.txt にファイルがありません。llms.txt は主要コンテンツの短い Markdown 概要で、一部の AI システムが方向付けに使用します。

対応すべきこと: /llms.txt を作成してください: 名前を含む H1、提供内容についての短い段落、中心的なページへのリンク一覧。

# あなたの会社

> 1 文での説明。

## 重要なページ
- [製品](https://あなたのドメイン.jp/product): …
- [料金](https://あなたのドメイン.jp/pricing): …
- [会社概要](https://あなたのドメイン.jp/about): …

信頼およびエンティティシグナル(E-E-A-T)

ヒント

著者または著作者シグナルがありません

著者を認識できません(メタタグ、rel=author、JSON-LD Person のいずれもありません)。E-E-A-T の意味での「経験」と「専門性」には、名前が明示され追跡可能な著作者が重要です。

対応すべきこと: 編集コンテンツでは著者名を明示し、著者ページをリンクしてください。JSON-LD の「Person」としてもマークアップします。

ヒント

sameAs のリンクがありません

JSON-LD に「sameAs」がありません。これにより AI システムは、あなたのブランドや人物を既知のエンティティ(Wikidata、LinkedIn、業界ディレクトリ)に明確に対応付けます。

対応すべきこと: Organization または Person に、あなたの公式プロフィールやディレクトリ登録の URL を含む「sameAs」を追加してください。

ヒント

法的情報 / 会社概要 / お問い合わせへのリンクがありません

チェックしたページに、法的情報、「会社概要」ページ、お問い合わせへのリンクが認識できません。こうしたページは強い信頼シグナルであり、エンティティの対応付けにも役立ちます。

対応すべきこと: 法的情報または「会社概要」とお問い合わせを、通常は各ページのフッターに、目立つ形でリンクしてください。

ヒント

可視またはマークアップされた日付がありません

公開日や更新日を認識できません(<time>、article:published_time、JSON-LD の datePublished のいずれもありません)。多くの質問で AI システムは新しいソースを優先します。

対応すべきこと: 時間に関連するコンテンツでは日付を可視で表示し、JSON-LD で datePublished / dateModified をマークアップしてください。

技術的基盤

ヒント

canonical URL がありません

ページが <link rel="canonical"> を設定していません。canonical がないと、複数の URL バリアントがある場合にどのバージョンが正規かが不明確なままになることがあります。

対応すべきこと: 各ページに、優先 URL を指す自己参照の <link rel="canonical"> を設定してください。

問題なし(3)
  • サイトマップに到達できます。
  • サーバーの応答時間が速いです。
  • noindex なし — ページはインデックス可能です。

次のステップ

  1. AI 検索ボットが robots.txt でブロックされています. ボットごとにブロックが意図的か確認してください。AI の学習だけを拒否したい場合は、学習用ボット(GPTBot、ClaudeBot、Google-Extended)をブロックし、検索ボットは許可します。
  2. robots.txt が許可しているのにサーバーがボットをブロックしています. 目的の AI クローラーのユーザーエージェントや IP 範囲を、WAF / Cloudflare / ファイアウォールの許可リストに追加してください。ユーザーエージェント文字列だけでなく、逆引き DNS で検証します。
  3. HTML 内のテキストが非常に少ないです. 実際のコンテンツが画像、iframe、JavaScript で読み込まれるブロックではなく、完全に HTML に含まれていることを確認してください。
このページをモニタリング

変更のたびにメール通知付きの週次再スキャン。準備中 — アドレスを入力してください。

手法と限界

2026/9/24 にチェックしました。citeglass は nytimes.com と関連ファイル(robots.txt、llms.txt、sitemap.xml)を HTTP で取得します — 一度は通常のブラウザーとして、一度は各 AI クローラーのユーザーエージェントとして。JavaScript は実行されません。 最初のバイトまでの時間: 99 ms。

これに含まれないもの: 順位や引用のトラッキングはなく、モデルが実際にあなたを名指しするかについての言明もなく、JavaScript で読み込まれるコンテンツのチェックもありません。1 つのサーバー IP の視点からのスナップショットです。

別のサイトをチェック