Polski
citeglass · Kontrola widoczności w AI

Sprawdzono 23.09.2026 · https://rehau-termopane.ro/

Istnieje 1 krytycznych blokad dla wykrywalności przez AI — usuń je najpierw.

C
69 / 100
1 krytyczne · 0 do sprawdzenia

Macierz robotów AI

Dla każdego bota: co pozwala Twój robots.txt — i co Twój serwer faktycznie zwraca do user agenta bota. Wiersze zaznaczone na czerwono: robots pozwala, ale serwer blokuje (zwykle reguła WAF lub ochrony przed botami).

BotOperatorrobots.txtOdpowiedź serwera
GPTBotOpenAInie wymienionozablokowane (403 / WAF)
OAI-SearchBotOpenAInie wymieniono200 + treść
ChatGPT-UserOpenAInie wymieniono200 + treść
ClaudeBotAnthropicnie wymieniono200 + treść
Claude-SearchBotAnthropicnie wymienionobłąd / przekroczenie czasu
Claude-UserAnthropicnie wymieniono200 + treść
PerplexityBotPerplexitynie wymienionobłąd / przekroczenie czasu
Perplexity-UserPerplexitynie wymienionobłąd / przekroczenie czasu
Google-ExtendedGoogle (Gemini-Training)nie wymieniono
GooglebotGoogle (KI-Übersichten)nie wymieniono200 + treść
CCBotCommon Crawl (Trainingsdaten vieler LLMs)nie wymieniono200 + treść
BytespiderByteDance (Doubao)nie wymieniono200 + treść
AmazonbotAmazon (Alexa/Rufus)nie wymieniono200 + treść
Applebot-ExtendedApple (Intelligence-Training)nie wymieniono
Meta-ExternalAgentMeta (Llama/Meta AI)nie wymienionozablokowane (403 / WAF)
Jak powstaje wynik?
Serwer blokuje boty, mimo że robots.txt je dopuszcza-12
Brak llms.txt-5
Nie znaleziono sitemap.xml-4
Poziomy nagłówków są pomijane-3
Brak powiązań sameAs-3
Nie znaleziono robots.txt-2
Brak znaczników FAQ lub HowTo-2
Wynik69 / 100

Dostęp dla robotów AI

krytyczne

Serwer blokuje boty, mimo że robots.txt je dopuszcza

Dla 2 bot(ów) z OpenAI, Meta (Llama/Meta AI) robots.txt mówi „dozwolone”, ale serwer odpowiada kodem 403 lub stroną ochrony przed botami. Zwykle reguła WAF, zapory lub CDN, która wyklucza robota z pominięciem robots.txt.

Oto co należy zrobić: Dodaj user agenty i/lub zakresy IP pożądanych robotów AI do listy dozwolonych w swoim WAF / Cloudflare / zaporze. Weryfikuj je przez odwrotny DNS, nie tylko przez ciąg user agenta.

wskazówka

Nie znaleziono robots.txt

Pod /robots.txt nie był dostępny żaden prawidłowy plik. Roboty zakładają wtedy „wszystko dozwolone” — działa, ale nie masz sterowania ani sygnału sitemap.

Oto co należy zrobić: Utwórz robots.txt w katalogu głównym, co najmniej z odniesieniem do sitemap i pożądanymi regułami allow/disallow.

User-agent: *
Allow: /

Sitemap: https://twoja-domena.pl/sitemap.xml

Struktura i zrozumienie maszynowe

wskazówka

Brak llms.txt

Pod /llms.txt nie ma żadnego pliku. llms.txt to krótki przegląd w Markdown Twoich kluczowych treści, którego niektóre systemy AI używają do orientacji.

Oto co należy zrobić: Utwórz /llms.txt: H1 z nazwą, krótki akapit o ofercie i listę linków do centralnych stron.

# Twoja firma

> Opis w jednym zdaniu.

## Ważne strony
- [Produkt](https://twoja-domena.pl/produkt): …
- [Cennik](https://twoja-domena.pl/cennik): …
- [O nas](https://twoja-domena.pl/o-nas): …
wskazówka

Poziomy nagłówków są pomijane

Kolejność nagłówków pomija co najmniej jeden poziom (np. H2 bezpośrednio do H4). Utrudnia to automatyczne odtworzenie struktury treści.

Oto co należy zrobić: Używaj poziomów nagłówków bez luk i po kolei (H1 → H2 → H3 …).

wskazówka

Brak znaczników FAQ lub HowTo

Treści typu pytanie-odpowiedź i krok po kroku są dla systemów AI trudniejsze do rozpoznania jako bezpośrednio cytowalna odpowiedź bez znaczników FAQPage lub HowTo.

Oto co należy zrobić: Tam, gdzie strona odpowiada na prawdziwe pytania lub podaje instrukcje, oznacz ją jako FAQPage lub HowTo (bez znaczników bez widocznie odpowiadającej treści).

Sygnały zaufania i encji (E-E-A-T)

wskazówka

Brak powiązań sameAs

W JSON-LD brakuje „sameAs”. Pozwala on systemom AI jednoznacznie powiązać Twoją markę lub osobę ze znanymi encjami (Wikidata, LinkedIn, katalogi branżowe).

Oto co należy zrobić: Dodaj „sameAs” w Organization lub Person z adresami URL Twoich oficjalnych profili i wpisów katalogowych.

Podstawa techniczna

wskazówka

Nie znaleziono sitemap.xml

Pod /sitemap.xml nie była dostępna żadna prawidłowa mapa XML, a robots.txt żadnej nie wymienia. Sitemap pomaga robotom znaleźć wszystkie istotne adresy URL.

Oto co należy zrobić: Wygeneruj sitemap.xml ze wszystkimi indeksowalnymi adresami URL i odwołaj się do niej w robots.txt.

W porządku (8)
  • Główna treść jest w HTML bez JavaScriptu.
  • Są dane strukturalne (JSON-LD). — HomeAndConstructionBusiness, Organization, WebSite, ImageObject, WebPage, Person, Article, VideoObject
  • Organizacja jest oznaczona jako JSON-LD.
  • Dokładnie jeden nagłówek H1.
  • Ustawiono adres URL canonical.
  • Tytuł strony ma sensowną długość.
  • Obecny jest sygnał autorstwa.
  • Szybki czas odpowiedzi serwera.

Następne kroki

  1. Serwer blokuje boty, mimo że robots.txt je dopuszcza. Dodaj user agenty i/lub zakresy IP pożądanych robotów AI do listy dozwolonych w swoim WAF / Cloudflare / zaporze. Weryfikuj je przez odwrotny DNS, nie tylko przez ciąg user agenta.
  2. Brak llms.txt. Utwórz /llms.txt: H1 z nazwą, krótki akapit o ofercie i listę linków do centralnych stron.
  3. Nie znaleziono sitemap.xml. Wygeneruj sitemap.xml ze wszystkimi indeksowalnymi adresami URL i odwołaj się do niej w robots.txt.
Monitoruj tę stronę

Cotygodniowe ponowne skanowanie z alertem e-mail przy każdej zmianie. W przygotowaniu — podaj swój adres.

Metoda i granice

Sprawdzono 23.09.2026. citeglass pobiera rehau-termopane.ro i powiązane pliki (robots.txt, llms.txt, sitemap.xml) przez HTTP — raz jako zwykła przeglądarka, raz na każdy user agent robota AI. Nie jest wykonywany JavaScript. Czas do pierwszego bajtu: 774 ms.

Czym to nie jest: Brak śledzenia pozycji ani cytowań, brak stwierdzenia, czy model faktycznie Cię wymienia, i brak kontroli treści ładowanej przez JavaScript. Migawka z perspektywy jednego IP serwera.

Sprawdź inną stronę