Проверено 15.09.2026 · https://www.alza.sk/
Жёстких препятствий нет, но 1 пунктов ослабляют обнаруживаемость ИИ.
Матрица ИИ-краулеров
Для каждого бота: что разрешает ваш robots.txt — и что сервер на самом деле возвращает user-agent'у бота. Строки, выделенные красным: robots разрешает, но сервер блокирует (обычно правило WAF или защиты от ботов).
| Бот | Оператор | robots.txt | Ответ сервера |
|---|---|---|---|
| GPTBot | OpenAI | разрешено | 200 + содержимое |
| OAI-SearchBot | OpenAI | разрешено | 200 + содержимое |
| ChatGPT-User | OpenAI | разрешено (через User-agent: *) | 200 + содержимое |
| ClaudeBot | Anthropic | разрешено | 200 + содержимое |
| Claude-SearchBot | Anthropic | разрешено (через User-agent: *) | 200 + содержимое |
| Claude-User | Anthropic | разрешено (через User-agent: *) | 200 + содержимое |
| PerplexityBot | Perplexity | разрешено | 200 + содержимое |
| Perplexity-User | Perplexity | разрешено (через User-agent: *) | 200 + содержимое |
| Google-Extended | Google (Gemini-Training) | разрешено (через User-agent: *) | — |
| Googlebot | Google (KI-Übersichten) | разрешено | 200 + содержимое |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | разрешено (через User-agent: *) | 200 + содержимое |
| Bytespider | ByteDance (Doubao) | разрешено (через User-agent: *) | 200 + содержимое |
| Amazonbot | Amazon (Alexa/Rufus) | разрешено (через User-agent: *) | 200 + содержимое |
| Applebot-Extended | Apple (Intelligence-Training) | разрешено (через User-agent: *) | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | разрешено (через User-agent: *) | 200 + содержимое |
Как складывается оценка?
| Нет структурированных данных (JSON-LD) | -8 |
| Нет связей sameAs | -3 |
| Нет ссылки на правовую информацию / о нас / контакты | -3 |
| Нет видимой или размеченной даты | -3 |
| Результат | 83 / 100 |
Структура и машинная понятность
Нет структурированных данных (JSON-LD)
Страница не содержит JSON-LD. Структурированные данные помогают ИИ-системам однозначно распознавать сущности, автора, организацию, дату и тип страницы — без них всё приходится угадывать из текста.
Что вам следует сделать: Добавьте как минимум схему «Organization» и схему, подходящую к типу страницы (Article, Product, FAQPage …), как JSON-LD в <head>.
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"Ваша компания","url":"https://ваш-домен.ru",
"sameAs":["https://www.linkedin.com/company/…"]}
</script>Сигналы доверия и сущности (E-E-A-T)
Нет связей sameAs
В JSON-LD отсутствует «sameAs». С ним ИИ-системы чётко сопоставляют ваш бренд или человека с известными сущностями (Wikidata, LinkedIn, отраслевые каталоги).
Что вам следует сделать: Добавьте «sameAs» в Organization или Person с URL ваших официальных профилей и записей в каталогах.
Нет ссылки на правовую информацию / о нас / контакты
На проверенной странице не распознаётся ссылка на правовую информацию, страницу «О нас» или контакты. Такие страницы — сильный сигнал доверия и помогают сопоставлению сущностей.
Что вам следует сделать: Свяжите правовую информацию или «О нас» и контакты заметно, обычно в подвале каждой страницы.
Нет видимой или размеченной даты
Не распознаётся дата публикации или изменения (ни <time>, ни article:published_time, ни datePublished в JSON-LD). Для многих вопросов ИИ-системы предпочитают актуальные источники.
Что вам следует сделать: Для содержимого, привязанного ко времени, показывайте дату заметно и размечайте datePublished / dateModified в JSON-LD.
В порядке (9)
- llms.txt присутствует и правдоподобно построен.
- Основное содержимое в HTML без JavaScript.
- Ровно один заголовок H1.
- Установлен canonical URL.
- Sitemap доступен.
- Заголовок страницы имеет разумную длину.
- Сигнал авторства присутствует.
- Быстрое время ответа сервера.
- Нет noindex — страницу можно индексировать.
Следующие шаги
- Нет структурированных данных (JSON-LD). Добавьте как минимум схему «Organization» и схему, подходящую к типу страницы (Article, Product, FAQPage …), как JSON-LD в <head>.
- Нет связей sameAs. Добавьте «sameAs» в Organization или Person с URL ваших официальных профилей и записей в каталогах.
- Нет ссылки на правовую информацию / о нас / контакты. Свяжите правовую информацию или «О нас» и контакты заметно, обычно в подвале каждой страницы.
Еженедельное повторное сканирование с уведомлением по e-mail при каждом изменении. В подготовке — введите свой адрес.
Метод и границы
Проверено 15.09.2026. citeglass забирает alza.sk и связанные файлы (robots.txt, llms.txt, sitemap.xml) через HTTP — один раз как обычный браузер, один раз для каждого user-agent'а ИИ-краулера. JavaScript не выполняется. Время до первого байта: 146 мс.
Чем это не является: Никакого отслеживания позиций или цитирований, никакого утверждения о том, называет ли модель вас на самом деле, и никакой проверки содержимого, загружаемого через JavaScript. Снимок с точки зрения одного серверного IP.