Русский
citeglass · Проверка ИИ-видимости

Проверено 23.09.2026 · https://rehau-termopane.ro/

Для обнаруживаемости ИИ есть 1 критических препятствий — устраните их в первую очередь.

C
69 / 100
1 критических · 0 для проверки

Матрица ИИ-краулеров

Для каждого бота: что разрешает ваш robots.txt — и что сервер на самом деле возвращает user-agent'у бота. Строки, выделенные красным: robots разрешает, но сервер блокирует (обычно правило WAF или защиты от ботов).

БотОператорrobots.txtОтвет сервера
GPTBotOpenAIне указанзаблокировано (403 / WAF)
OAI-SearchBotOpenAIне указан200 + содержимое
ChatGPT-UserOpenAIне указан200 + содержимое
ClaudeBotAnthropicне указан200 + содержимое
Claude-SearchBotAnthropicне указаношибка / тайм-аут
Claude-UserAnthropicне указан200 + содержимое
PerplexityBotPerplexityне указаношибка / тайм-аут
Perplexity-UserPerplexityне указаношибка / тайм-аут
Google-ExtendedGoogle (Gemini-Training)не указан
GooglebotGoogle (KI-Übersichten)не указан200 + содержимое
CCBotCommon Crawl (Trainingsdaten vieler LLMs)не указан200 + содержимое
BytespiderByteDance (Doubao)не указан200 + содержимое
AmazonbotAmazon (Alexa/Rufus)не указан200 + содержимое
Applebot-ExtendedApple (Intelligence-Training)не указан
Meta-ExternalAgentMeta (Llama/Meta AI)не указанзаблокировано (403 / WAF)
Как складывается оценка?
Сервер блокирует ботов, хотя robots.txt их разрешает-12
Нет llms.txt-5
sitemap.xml не найден-4
Уровни заголовков пропускаются-3
Нет связей sameAs-3
robots.txt не найден-2
Нет разметки FAQ или HowTo-2
Результат69 / 100

Доступ для ИИ-краулеров

критично

Сервер блокирует ботов, хотя robots.txt их разрешает

Для 2 бота(ов) от OpenAI, Meta (Llama/Meta AI) robots.txt говорит «разрешено», но сервер отвечает 403 или страницей защиты от ботов. Обычно правило WAF, брандмауэра или CDN закрывает доступ краулеру в обход robots.txt.

Что вам следует сделать: Добавьте user-agent'ы и/или диапазоны IP нужных ИИ-краулеров в список разрешённых в вашем WAF / Cloudflare / брандмауэре. Проверяйте их по обратному DNS, а не только по строке user-agent.

примечание

robots.txt не найден

По адресу /robots.txt не был доступен ни один действительный файл. Краулеры тогда исходят из «всё разрешено» — работает, но у вас нет управления и нет сигнала sitemap.

Что вам следует сделать: Создайте robots.txt в корневом каталоге, как минимум со ссылкой на sitemap и нужными правилами allow/disallow.

User-agent: *
Allow: /

Sitemap: https://ваш-домен.ru/sitemap.xml

Структура и машинная понятность

примечание

Нет llms.txt

По адресу /llms.txt нет файла. llms.txt — это краткий обзор вашего ключевого содержимого в Markdown, который некоторые ИИ-системы используют для ориентации.

Что вам следует сделать: Создайте /llms.txt: H1 с названием, короткий абзац о предложении и список ссылок на центральные страницы.

# Ваша компания

> Описание в одном предложении.

## Важные страницы
- [Продукт](https://ваш-домен.ru/product): …
- [Цены](https://ваш-домен.ru/pricing): …
- [О нас](https://ваш-домен.ru/about): …
примечание

Уровни заголовков пропускаются

Последовательность заголовков пропускает хотя бы один уровень (например, с H2 сразу на H4). Это затрудняет автоматическое восстановление структуры содержимого.

Что вам следует сделать: Используйте уровни заголовков без пропусков и по порядку (H1 → H2 → H3 …).

примечание

Нет разметки FAQ или HowTo

Содержимое в формате «вопрос — ответ» и пошаговые инструкции без разметки FAQPage или HowTo сложнее распознать ИИ-системам как напрямую цитируемый ответ.

Что вам следует сделать: Там, где страница отвечает на реальные вопросы или даёт инструкции, разметьте её как FAQPage или HowTo (никакой разметки без видимого соответствующего содержимого).

Сигналы доверия и сущности (E-E-A-T)

примечание

Нет связей sameAs

В JSON-LD отсутствует «sameAs». С ним ИИ-системы чётко сопоставляют ваш бренд или человека с известными сущностями (Wikidata, LinkedIn, отраслевые каталоги).

Что вам следует сделать: Добавьте «sameAs» в Organization или Person с URL ваших официальных профилей и записей в каталогах.

Техническая основа

примечание

sitemap.xml не найден

По адресу /sitemap.xml не был доступен действительный XML-sitemap, и robots.txt не называет ни одного. Sitemap помогает краулерам найти все релевантные URL.

Что вам следует сделать: Сгенерируйте sitemap.xml со всеми индексируемыми URL и сошлитесь на него в robots.txt.

В порядке (8)
  • Основное содержимое в HTML без JavaScript.
  • Структурированные данные (JSON-LD) присутствуют. — HomeAndConstructionBusiness, Organization, WebSite, ImageObject, WebPage, Person, Article, VideoObject
  • Организация размечена как JSON-LD.
  • Ровно один заголовок H1.
  • Установлен canonical URL.
  • Заголовок страницы имеет разумную длину.
  • Сигнал авторства присутствует.
  • Быстрое время ответа сервера.

Следующие шаги

  1. Сервер блокирует ботов, хотя robots.txt их разрешает. Добавьте user-agent'ы и/или диапазоны IP нужных ИИ-краулеров в список разрешённых в вашем WAF / Cloudflare / брандмауэре. Проверяйте их по обратному DNS, а не только по строке user-agent.
  2. Нет llms.txt. Создайте /llms.txt: H1 с названием, короткий абзац о предложении и список ссылок на центральные страницы.
  3. sitemap.xml не найден. Сгенерируйте sitemap.xml со всеми индексируемыми URL и сошлитесь на него в robots.txt.
Мониторить эту страницу

Еженедельное повторное сканирование с уведомлением по e-mail при каждом изменении. В подготовке — введите свой адрес.

Метод и границы

Проверено 23.09.2026. citeglass забирает rehau-termopane.ro и связанные файлы (robots.txt, llms.txt, sitemap.xml) через HTTP — один раз как обычный браузер, один раз для каждого user-agent'а ИИ-краулера. JavaScript не выполняется. Время до первого байта: 774 мс.

Чем это не является: Никакого отслеживания позиций или цитирований, никакого утверждения о том, называет ли модель вас на самом деле, и никакой проверки содержимого, загружаемого через JavaScript. Снимок с точки зрения одного серверного IP.

Проверить другой сайт