Українська
citeglass · Перевірка видимості для ШІ

Перевірено 14.09.2026 · https://www.eureko.sk/

Для виявлюваності ШІ є 1 критичних перешкод — усуньте їх насамперед.

F
24 / 100
1 критичних · 4 для перевірки

Матриця ШІ-краулерів

Для кожного бота: що дозволяє ваш robots.txt — і що сервер насправді повертає user-agent’у бота. Рядки, виділені червоним: robots дозволяє, але сервер блокує (зазвичай правило WAF або захисту від ботів).

БотОператорrobots.txtВідповідь сервера
GPTBotOpenAIне вказанозаблоковано (403 / WAF)
OAI-SearchBotOpenAIне вказанозаблоковано (403 / WAF)
ChatGPT-UserOpenAIне вказанозаблоковано (403 / WAF)
ClaudeBotAnthropicне вказанозаблоковано (403 / WAF)
Claude-SearchBotAnthropicне вказанозаблоковано (403 / WAF)
Claude-UserAnthropicне вказанозаблоковано (403 / WAF)
PerplexityBotPerplexityне вказанозаблоковано (403 / WAF)
Perplexity-UserPerplexityне вказанозаблоковано (403 / WAF)
Google-ExtendedGoogle (Gemini-Training)не вказано
GooglebotGoogle (KI-Übersichten)не вказанозаблоковано (403 / WAF)
CCBotCommon Crawl (Trainingsdaten vieler LLMs)не вказанозаблоковано (403 / WAF)
BytespiderByteDance (Doubao)не вказанозаблоковано (403 / WAF)
AmazonbotAmazon (Alexa/Rufus)не вказанозаблоковано (403 / WAF)
Applebot-ExtendedApple (Intelligence-Training)не вказано
Meta-ExternalAgentMeta (Llama/Meta AI)не вказанозаблоковано (403 / WAF)
Як складається оцінка?
Сервер блокує ботів, хоча robots.txt їх дозволяє-20
Дуже мало тексту в HTML-10
Немає структурованих даних (JSON-LD)-8
Заголовок сторінки надто короткий або надто довгий-6
Meta description відсутній або не підходить-5
Немає llms.txt-5
Немає сигналу автора чи авторства-4
sitemap.xml не знайдено-4
Немає зв’язків sameAs-3
Немає посилання на правову інформацію / про нас / контакти-3
Немає видимої або розміченої дати-3
Немає canonical URL-3
robots.txt не знайдено-2
Результат24 / 100

Доступ для ШІ-краулерів

критично

Сервер блокує ботів, хоча robots.txt їх дозволяє

Для 13 бота(ів) від OpenAI, Anthropic, Perplexity, Google (KI-Übersichten), Common Crawl (Trainingsdaten vieler LLMs), ByteDance (Doubao), Amazon (Alexa/Rufus), Meta (Llama/Meta AI) robots.txt каже «дозволено», але сервер відповідає 403 або сторінкою захисту від ботів. Зазвичай правило WAF, брандмауера або CDN закриває доступ краулеру в обхід robots.txt.

Що вам слід зробити: Додайте user-agent’и та/або діапазони IP потрібних ШІ-краулерів до списку дозволених у вашому WAF / Cloudflare / брандмауері. Перевіряйте їх за зворотним DNS, а не лише за рядком user-agent.

примітка

robots.txt не знайдено

За адресою /robots.txt не був доступний жоден дійсний файл. Краулери тоді виходять із «усе дозволено» — працює, але у вас немає керування й немає сигналу sitemap.

Що вам слід зробити: Створіть robots.txt у кореневому каталозі, щонайменше з посиланням на sitemap і потрібними правилами allow/disallow.

User-agent: *
Allow: /

Sitemap: https://ваш-домен.ua/sitemap.xml

Вміст без JavaScript

перевірити

Дуже мало тексту в HTML

Початковий HTML містить лише близько 40 символів видимого тексту. Цього ледве вистачає, щоб ШІ-системи впевнено вловили тему сторінки.

Що вам слід зробити: Переконайтеся, що фактичний вміст повністю в HTML, а не в зображеннях, iframe чи блоках, що завантажуються через JavaScript.

Структура і машинна зрозумілість

перевірити

Немає структурованих даних (JSON-LD)

Сторінка не містить JSON-LD. Структуровані дані допомагають ШІ-системам однозначно розпізнавати сутності, автора, організацію, дату й тип сторінки — без них усе доводиться вгадувати з тексту.

Що вам слід зробити: Додайте щонайменше схему «Organization» і схему, що відповідає типу сторінки (Article, Product, FAQPage …), як JSON-LD у <head>.

<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
 "name":"Ваша компанія","url":"https://ваш-домен.ua",
 "sameAs":["https://www.linkedin.com/company/…"]}
</script>
перевірити

Заголовок сторінки надто короткий або надто довгий

<title> має довжину 13 символів. Розумно близько 30–60 символів: достатньо описово, щоб назвати тему, достатньо коротко, щоб не обрізатися.

Що вам слід зробити: Напишіть стислий заголовок, що містить тему й за потреби бренд.

перевірити

Meta description відсутній або не підходить

Meta description має довжину 0 символів. Часто це перше, що ШІ-системи й пошуковики читають як короткий опис сторінки.

Що вам слід зробити: Напишіть самостійний короткий опис сторінки в одне-два речення (близько 120–200 символів), а не набір ключових слів.

примітка

Немає llms.txt

За адресою /llms.txt немає файлу. llms.txt — це короткий огляд вашого ключового вмісту в Markdown, який деякі ШІ-системи використовують для орієнтації.

Що вам слід зробити: Створіть /llms.txt: H1 з назвою, короткий абзац про пропозицію й список посилань на центральні сторінки.

# Ваша компанія

> Опис в одному реченні.

## Важливі сторінки
- [Продукт](https://ваш-домен.ua/product): …
- [Ціни](https://ваш-домен.ua/pricing): …
- [Про нас](https://ваш-домен.ua/about): …

Сигнали довіри та сутності (E-E-A-T)

примітка

Немає сигналу автора чи авторства

Автор не розпізнається (ні meta-тег, ні rel=author, ні JSON-LD Person). Для «досвіду» та «експертизи» в сенсі E-E-A-T важливе назване, простежуване авторство.

Що вам слід зробити: Для редакційного вмісту називайте автора на ім’я й пов’язуйте сторінку автора; розмічайте його також як JSON-LD «Person».

примітка

Немає зв’язків sameAs

У JSON-LD відсутнє «sameAs». З ним ШІ-системи чітко зіставляють ваш бренд або особу з відомими сутностями (Wikidata, LinkedIn, галузеві каталоги).

Що вам слід зробити: Додайте «sameAs» в Organization або Person з URL ваших офіційних профілів і записів у каталогах.

примітка

Немає посилання на правову інформацію / про нас / контакти

На перевіреній сторінці не розпізнається посилання на правову інформацію, сторінку «Про нас» чи контакти. Такі сторінки — сильний сигнал довіри й допомагають зіставленню сутностей.

Що вам слід зробити: Пов’яжіть правову інформацію або «Про нас» і контакти помітно, зазвичай у підвалі кожної сторінки.

примітка

Немає видимої або розміченої дати

Не розпізнається дата публікації чи зміни (ні <time>, ні article:published_time, ні datePublished у JSON-LD). Для багатьох запитань ШІ-системи віддають перевагу актуальним джерелам.

Що вам слід зробити: Для вмісту, прив’язаного до часу, показуйте дату помітно й розмічайте datePublished / dateModified у JSON-LD.

Технічна основа

примітка

sitemap.xml не знайдено

За адресою /sitemap.xml не був доступний дійсний XML-sitemap, і robots.txt не називає жодного. Sitemap допомагає краулерам знайти всі релевантні URL.

Що вам слід зробити: Згенеруйте sitemap.xml з усіма індексованими URL і пошліться на нього в robots.txt.

примітка

Немає canonical URL

Сторінка не задає <link rel="canonical">. Без canonical може лишатися незрозумілим, яка версія визначальна, коли існує кілька варіантів URL.

Що вам слід зробити: Задавайте на кожній сторінці самопосилальний <link rel="canonical"> із бажаним URL.

У порядку (2)
  • Рівно один заголовок H1.
  • Швидкий час відповіді сервера.

Наступні кроки

  1. Сервер блокує ботів, хоча robots.txt їх дозволяє. Додайте user-agent’и та/або діапазони IP потрібних ШІ-краулерів до списку дозволених у вашому WAF / Cloudflare / брандмауері. Перевіряйте їх за зворотним DNS, а не лише за рядком user-agent.
  2. Дуже мало тексту в HTML. Переконайтеся, що фактичний вміст повністю в HTML, а не в зображеннях, iframe чи блоках, що завантажуються через JavaScript.
  3. Немає структурованих даних (JSON-LD). Додайте щонайменше схему «Organization» і схему, що відповідає типу сторінки (Article, Product, FAQPage …), як JSON-LD у <head>.
Моніторити цю сторінку

Щотижневе повторне сканування зі сповіщенням електронною поштою за кожної зміни. У підготовці — введіть свою адресу.

Метод і межі

Перевірено 14.09.2026. citeglass забирає eureko.sk і пов’язані файли (robots.txt, llms.txt, sitemap.xml) через HTTP — один раз як звичайний браузер, один раз для кожного user-agent’а ШІ-краулера. JavaScript не виконується. Час до першого байта: 270 мс.

Чим це не є: Жодного відстеження позицій чи цитувань, жодного твердження про те, чи називає модель вас насправді, і жодної перевірки вмісту, що завантажується через JavaScript. Знімок з погляду одного серверного IP.

Перевірити інший сайт