Проверено на 23.09.2026 г. · https://rehau-termopane.ro/
Има 1 критични блокировки за откриваемостта чрез ИИ — отстранете ги първо.
Матрица на ИИ роботите
За всеки робот: какво разрешава вашият robots.txt — и какво реално връща вашият сървър на потребителския агент на робота. Редове, маркирани в червено: robots го разрешава, но сървърът го блокира (обикновено правило на WAF или защита срещу ботове).
| Робот | Оператор | robots.txt | Отговор на сървъра |
|---|---|---|---|
| GPTBot | OpenAI | не е посочено | блокирано (403 / WAF) |
| OAI-SearchBot | OpenAI | не е посочено | 200 + съдържание |
| ChatGPT-User | OpenAI | не е посочено | 200 + съдържание |
| ClaudeBot | Anthropic | не е посочено | 200 + съдържание |
| Claude-SearchBot | Anthropic | не е посочено | грешка / изтичане на времето |
| Claude-User | Anthropic | не е посочено | 200 + съдържание |
| PerplexityBot | Perplexity | не е посочено | грешка / изтичане на времето |
| Perplexity-User | Perplexity | не е посочено | грешка / изтичане на времето |
| Google-Extended | Google (Gemini-Training) | не е посочено | — |
| Googlebot | Google (KI-Übersichten) | не е посочено | 200 + съдържание |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | не е посочено | 200 + съдържание |
| Bytespider | ByteDance (Doubao) | не е посочено | 200 + съдържание |
| Amazonbot | Amazon (Alexa/Rufus) | не е посочено | 200 + съдържание |
| Applebot-Extended | Apple (Intelligence-Training) | не е посочено | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | не е посочено | блокирано (403 / WAF) |
Как се формира оценката?
| Сървърът блокира роботи, макар че robots.txt ги разрешава | -12 |
| Няма llms.txt | -5 |
| Не е намерен sitemap.xml | -4 |
| Пропускат се нива на заглавия | -3 |
| Няма връзки sameAs | -3 |
| Не е намерен robots.txt | -2 |
| Няма маркиране FAQ или HowTo | -2 |
| Резултат | 69 / 100 |
Достъп за ИИ роботи
Сървърът блокира роботи, макар че robots.txt ги разрешава
За 2 робота от OpenAI, Meta (Llama/Meta AI) robots.txt казва „разрешено“, но сървърът отговаря с 403 или страница за защита срещу ботове. Обикновено правило на WAF, защитна стена или CDN, което изключва робота, заобикаляйки robots.txt.
Ето какво трябва да направите: Добавете потребителските агенти и/или IP диапазоните на желаните ИИ роботи към списък с разрешени във вашия WAF / Cloudflare / защитна стена. Проверете ги чрез обратен DNS, а не само по низа на потребителския агент.
Не е намерен robots.txt
На /robots.txt не беше достъпен валиден файл. Тогава роботите предполагат „всичко разрешено“ — работи, но нямате управление, нито сигнал за sitemap.
Ето какво трябва да направите: Създайте robots.txt в главната директория, поне с препратка към sitemap и желаните правила allow/disallow.
User-agent: * Allow: / Sitemap: https://vashiyat-domеyn.bg/sitemap.xml
Структура и машинно разбиране
Няма llms.txt
На /llms.txt няма файл. llms.txt е кратък преглед на ключовото ви съдържание в Markdown, който някои ИИ системи използват за ориентация.
Ето какво трябва да направите: Създайте /llms.txt: H1 с името, кратък абзац за офертата и списък с връзки към централните страници.
# Вашата фирма > Описание в едно изречение. ## Важни страници - [Продукт](https://vashiyat-domеyn.bg/produkt): … - [Цени](https://vashiyat-domеyn.bg/tseni): … - [За нас](https://vashiyat-domеyn.bg/za-nas): …
Пропускат се нива на заглавия
Последователността на заглавията пропуска поне едно ниво (напр. H2 директно на H4). Това затруднява автоматичното възстановяване на структурата на съдържанието.
Ето какво трябва да направите: Използвайте нивата на заглавията без пропуски и по ред (H1 → H2 → H3 …).
Няма маркиране FAQ или HowTo
Съдържание тип въпрос-отговор и стъпка по стъпка е по-трудно за ИИ системите да разпознаят като пряко цитируем отговор без маркиране FAQPage или HowTo.
Ето какво трябва да направите: Където страницата отговаря на реални въпроси или дава инструкции, маркирайте я като FAQPage или HowTo (без маркиране без видимо съответстващо съдържание).
Сигнали за доверие и същност (E-E-A-T)
Няма връзки sameAs
В JSON-LD липсва „sameAs“. С него ИИ системите ясно свързват марката или личността ви с известни същности (Wikidata, LinkedIn, отраслови указатели).
Ето какво трябва да направите: Добавете „sameAs“ в Organization или Person с URL адресите на официалните ви профили и записи в указатели.
Техническа основа
Не е намерен sitemap.xml
На /sitemap.xml не беше достъпен валиден XML sitemap и robots.txt не назовава нито един. Sitemap помага на роботите да намерят всички релевантни URL адреси.
Ето какво трябва да направите: Генерирайте sitemap.xml с всички индексируеми URL адреси и се позовете на него в robots.txt.
Наред (8)
- Основното съдържание е в HTML без JavaScript.
- Налични са структурирани данни (JSON-LD). — HomeAndConstructionBusiness, Organization, WebSite, ImageObject, WebPage, Person, Article, VideoObject
- Организацията е маркирана като JSON-LD.
- Точно едно заглавие H1.
- Зададен е canonical URL.
- Заглавието на страницата е с разумна дължина.
- Наличен е сигнал за авторство.
- Бързо време за отговор на сървъра.
Следващи стъпки
- Сървърът блокира роботи, макар че robots.txt ги разрешава. Добавете потребителските агенти и/или IP диапазоните на желаните ИИ роботи към списък с разрешени във вашия WAF / Cloudflare / защитна стена. Проверете ги чрез обратен DNS, а не само по низа на потребителския агент.
- Няма llms.txt. Създайте /llms.txt: H1 с името, кратък абзац за офертата и списък с връзки към централните страници.
- Не е намерен sitemap.xml. Генерирайте sitemap.xml с всички индексируеми URL адреси и се позовете на него в robots.txt.
Седмично повторно сканиране с известие по имейл при всяка промяна. В подготовка — въведете адреса си.
Метод и граници
Проверено на 23.09.2026 г.. citeglass изтегля rehau-termopane.ro и свързаните файлове (robots.txt, llms.txt, sitemap.xml) чрез HTTP — веднъж като обикновен браузър, веднъж за всеки потребителски агент на ИИ робот. Не се изпълнява JavaScript. Време до първия байт: 774 ms.
Какво не е това: Без проследяване на позиции или цитирания, без твърдение дали един модел действително ви назовава, и без проверка на съдържание, заредено чрез JavaScript. Моментна снимка от гледна точка на един сървърен IP.