Перевірено 04.09.2026 · https://example.com/
Жорстких перешкод немає, але 4 пунктів послаблюють виявлюваність ШІ.
Матриця ШІ-краулерів
Для кожного бота: що дозволяє ваш robots.txt — і що сервер насправді повертає user-agent’у бота. Рядки, виділені червоним: robots дозволяє, але сервер блокує (зазвичай правило WAF або захисту від ботів).
| Бот | Оператор | robots.txt | Відповідь сервера |
|---|---|---|---|
| GPTBot | OpenAI | не вказано | 200 + вміст |
| OAI-SearchBot | OpenAI | не вказано | 200 + вміст |
| ChatGPT-User | OpenAI | не вказано | 200 + вміст |
| ClaudeBot | Anthropic | не вказано | 200 + вміст |
| Claude-SearchBot | Anthropic | не вказано | 200 + вміст |
| Claude-User | Anthropic | не вказано | 200 + вміст |
| PerplexityBot | Perplexity | не вказано | 200 + вміст |
| Perplexity-User | Perplexity | не вказано | 200 + вміст |
| Google-Extended | Google (Gemini-Training) | не вказано | — |
| Googlebot | Google (KI-Übersichten) | не вказано | 200 + вміст |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | не вказано | 200 + вміст |
| Bytespider | ByteDance (Doubao) | не вказано | 200 + вміст |
| Amazonbot | Amazon (Alexa/Rufus) | не вказано | 200 + вміст |
| Applebot-Extended | Apple (Intelligence-Training) | не вказано | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | не вказано | 200 + вміст |
Як складається оцінка?
| Дуже мало тексту в HTML | -10 |
| Немає структурованих даних (JSON-LD) | -8 |
| Заголовок сторінки надто короткий або надто довгий | -6 |
| Meta description відсутній або не підходить | -5 |
| Немає llms.txt | -5 |
| Немає сигналу автора чи авторства | -4 |
| sitemap.xml не знайдено | -4 |
| Немає зв’язків sameAs | -3 |
| Немає посилання на правову інформацію / про нас / контакти | -3 |
| Немає видимої або розміченої дати | -3 |
| Немає canonical URL | -3 |
| robots.txt не знайдено | -2 |
| Результат | 44 / 100 |
Доступ для ШІ-краулерів
robots.txt не знайдено
За адресою /robots.txt не був доступний жоден дійсний файл. Краулери тоді виходять із «усе дозволено» — працює, але у вас немає керування й немає сигналу sitemap.
Що вам слід зробити: Створіть robots.txt у кореневому каталозі, щонайменше з посиланням на sitemap і потрібними правилами allow/disallow.
User-agent: * Allow: / Sitemap: https://ваш-домен.ua/sitemap.xml
Вміст без JavaScript
Дуже мало тексту в HTML
Початковий HTML містить лише близько 142 символів видимого тексту. Цього ледве вистачає, щоб ШІ-системи впевнено вловили тему сторінки.
Що вам слід зробити: Переконайтеся, що фактичний вміст повністю в HTML, а не в зображеннях, iframe чи блоках, що завантажуються через JavaScript.
Структура і машинна зрозумілість
Немає структурованих даних (JSON-LD)
Сторінка не містить JSON-LD. Структуровані дані допомагають ШІ-системам однозначно розпізнавати сутності, автора, організацію, дату й тип сторінки — без них усе доводиться вгадувати з тексту.
Що вам слід зробити: Додайте щонайменше схему «Organization» і схему, що відповідає типу сторінки (Article, Product, FAQPage …), як JSON-LD у <head>.
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"Ваша компанія","url":"https://ваш-домен.ua",
"sameAs":["https://www.linkedin.com/company/…"]}
</script>Заголовок сторінки надто короткий або надто довгий
<title> має довжину 14 символів. Розумно близько 30–60 символів: достатньо описово, щоб назвати тему, достатньо коротко, щоб не обрізатися.
Що вам слід зробити: Напишіть стислий заголовок, що містить тему й за потреби бренд.
Meta description відсутній або не підходить
Meta description має довжину 0 символів. Часто це перше, що ШІ-системи й пошуковики читають як короткий опис сторінки.
Що вам слід зробити: Напишіть самостійний короткий опис сторінки в одне-два речення (близько 120–200 символів), а не набір ключових слів.
Немає llms.txt
За адресою /llms.txt немає файлу. llms.txt — це короткий огляд вашого ключового вмісту в Markdown, який деякі ШІ-системи використовують для орієнтації.
Що вам слід зробити: Створіть /llms.txt: H1 з назвою, короткий абзац про пропозицію й список посилань на центральні сторінки.
# Ваша компанія > Опис в одному реченні. ## Важливі сторінки - [Продукт](https://ваш-домен.ua/product): … - [Ціни](https://ваш-домен.ua/pricing): … - [Про нас](https://ваш-домен.ua/about): …
Сигнали довіри та сутності (E-E-A-T)
Немає сигналу автора чи авторства
Автор не розпізнається (ні meta-тег, ні rel=author, ні JSON-LD Person). Для «досвіду» та «експертизи» в сенсі E-E-A-T важливе назване, простежуване авторство.
Що вам слід зробити: Для редакційного вмісту називайте автора на ім’я й пов’язуйте сторінку автора; розмічайте його також як JSON-LD «Person».
Немає зв’язків sameAs
У JSON-LD відсутнє «sameAs». З ним ШІ-системи чітко зіставляють ваш бренд або особу з відомими сутностями (Wikidata, LinkedIn, галузеві каталоги).
Що вам слід зробити: Додайте «sameAs» в Organization або Person з URL ваших офіційних профілів і записів у каталогах.
Немає посилання на правову інформацію / про нас / контакти
На перевіреній сторінці не розпізнається посилання на правову інформацію, сторінку «Про нас» чи контакти. Такі сторінки — сильний сигнал довіри й допомагають зіставленню сутностей.
Що вам слід зробити: Пов’яжіть правову інформацію або «Про нас» і контакти помітно, зазвичай у підвалі кожної сторінки.
Немає видимої або розміченої дати
Не розпізнається дата публікації чи зміни (ні <time>, ні article:published_time, ні datePublished у JSON-LD). Для багатьох запитань ШІ-системи віддають перевагу актуальним джерелам.
Що вам слід зробити: Для вмісту, прив’язаного до часу, показуйте дату помітно й розмічайте datePublished / dateModified у JSON-LD.
Технічна основа
sitemap.xml не знайдено
За адресою /sitemap.xml не був доступний дійсний XML-sitemap, і robots.txt не називає жодного. Sitemap допомагає краулерам знайти всі релевантні URL.
Що вам слід зробити: Згенеруйте sitemap.xml з усіма індексованими URL і пошліться на нього в robots.txt.
Немає canonical URL
Сторінка не задає <link rel="canonical">. Без canonical може лишатися незрозумілим, яка версія визначальна, коли існує кілька варіантів URL.
Що вам слід зробити: Задавайте на кожній сторінці самопосилальний <link rel="canonical"> із бажаним URL.
У порядку (2)
- Рівно один заголовок H1.
- Швидкий час відповіді сервера.
Наступні кроки
- Дуже мало тексту в HTML. Переконайтеся, що фактичний вміст повністю в HTML, а не в зображеннях, iframe чи блоках, що завантажуються через JavaScript.
- Немає структурованих даних (JSON-LD). Додайте щонайменше схему «Organization» і схему, що відповідає типу сторінки (Article, Product, FAQPage …), як JSON-LD у <head>.
- Заголовок сторінки надто короткий або надто довгий. Напишіть стислий заголовок, що містить тему й за потреби бренд.
Щотижневе повторне сканування зі сповіщенням електронною поштою за кожної зміни. У підготовці — введіть свою адресу.
Метод і межі
Перевірено 04.09.2026. citeglass забирає example.com і пов’язані файли (robots.txt, llms.txt, sitemap.xml) через HTTP — один раз як звичайний браузер, один раз для кожного user-agent’а ШІ-краулера. JavaScript не виконується. Час до першого байта: 12 мс.
Чим це не є: Жодного відстеження позицій чи цитувань, жодного твердження про те, чи називає модель вас насправді, і жодної перевірки вмісту, що завантажується через JavaScript. Знімок з погляду одного серверного IP.