Sprawdzono 23.09.2026 · https://rehau-termopane.ro/
Istnieje 1 krytycznych blokad dla wykrywalności przez AI — usuń je najpierw.
Macierz robotów AI
Dla każdego bota: co pozwala Twój robots.txt — i co Twój serwer faktycznie zwraca do user agenta bota. Wiersze zaznaczone na czerwono: robots pozwala, ale serwer blokuje (zwykle reguła WAF lub ochrony przed botami).
| Bot | Operator | robots.txt | Odpowiedź serwera |
|---|---|---|---|
| GPTBot | OpenAI | nie wymieniono | zablokowane (403 / WAF) |
| OAI-SearchBot | OpenAI | nie wymieniono | 200 + treść |
| ChatGPT-User | OpenAI | nie wymieniono | 200 + treść |
| ClaudeBot | Anthropic | nie wymieniono | 200 + treść |
| Claude-SearchBot | Anthropic | nie wymieniono | błąd / przekroczenie czasu |
| Claude-User | Anthropic | nie wymieniono | 200 + treść |
| PerplexityBot | Perplexity | nie wymieniono | błąd / przekroczenie czasu |
| Perplexity-User | Perplexity | nie wymieniono | błąd / przekroczenie czasu |
| Google-Extended | Google (Gemini-Training) | nie wymieniono | — |
| Googlebot | Google (KI-Übersichten) | nie wymieniono | 200 + treść |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | nie wymieniono | 200 + treść |
| Bytespider | ByteDance (Doubao) | nie wymieniono | 200 + treść |
| Amazonbot | Amazon (Alexa/Rufus) | nie wymieniono | 200 + treść |
| Applebot-Extended | Apple (Intelligence-Training) | nie wymieniono | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | nie wymieniono | zablokowane (403 / WAF) |
Jak powstaje wynik?
| Serwer blokuje boty, mimo że robots.txt je dopuszcza | -12 |
| Brak llms.txt | -5 |
| Nie znaleziono sitemap.xml | -4 |
| Poziomy nagłówków są pomijane | -3 |
| Brak powiązań sameAs | -3 |
| Nie znaleziono robots.txt | -2 |
| Brak znaczników FAQ lub HowTo | -2 |
| Wynik | 69 / 100 |
Dostęp dla robotów AI
Serwer blokuje boty, mimo że robots.txt je dopuszcza
Dla 2 bot(ów) z OpenAI, Meta (Llama/Meta AI) robots.txt mówi „dozwolone”, ale serwer odpowiada kodem 403 lub stroną ochrony przed botami. Zwykle reguła WAF, zapory lub CDN, która wyklucza robota z pominięciem robots.txt.
Oto co należy zrobić: Dodaj user agenty i/lub zakresy IP pożądanych robotów AI do listy dozwolonych w swoim WAF / Cloudflare / zaporze. Weryfikuj je przez odwrotny DNS, nie tylko przez ciąg user agenta.
Nie znaleziono robots.txt
Pod /robots.txt nie był dostępny żaden prawidłowy plik. Roboty zakładają wtedy „wszystko dozwolone” — działa, ale nie masz sterowania ani sygnału sitemap.
Oto co należy zrobić: Utwórz robots.txt w katalogu głównym, co najmniej z odniesieniem do sitemap i pożądanymi regułami allow/disallow.
User-agent: * Allow: / Sitemap: https://twoja-domena.pl/sitemap.xml
Struktura i zrozumienie maszynowe
Brak llms.txt
Pod /llms.txt nie ma żadnego pliku. llms.txt to krótki przegląd w Markdown Twoich kluczowych treści, którego niektóre systemy AI używają do orientacji.
Oto co należy zrobić: Utwórz /llms.txt: H1 z nazwą, krótki akapit o ofercie i listę linków do centralnych stron.
# Twoja firma > Opis w jednym zdaniu. ## Ważne strony - [Produkt](https://twoja-domena.pl/produkt): … - [Cennik](https://twoja-domena.pl/cennik): … - [O nas](https://twoja-domena.pl/o-nas): …
Poziomy nagłówków są pomijane
Kolejność nagłówków pomija co najmniej jeden poziom (np. H2 bezpośrednio do H4). Utrudnia to automatyczne odtworzenie struktury treści.
Oto co należy zrobić: Używaj poziomów nagłówków bez luk i po kolei (H1 → H2 → H3 …).
Brak znaczników FAQ lub HowTo
Treści typu pytanie-odpowiedź i krok po kroku są dla systemów AI trudniejsze do rozpoznania jako bezpośrednio cytowalna odpowiedź bez znaczników FAQPage lub HowTo.
Oto co należy zrobić: Tam, gdzie strona odpowiada na prawdziwe pytania lub podaje instrukcje, oznacz ją jako FAQPage lub HowTo (bez znaczników bez widocznie odpowiadającej treści).
Sygnały zaufania i encji (E-E-A-T)
Brak powiązań sameAs
W JSON-LD brakuje „sameAs”. Pozwala on systemom AI jednoznacznie powiązać Twoją markę lub osobę ze znanymi encjami (Wikidata, LinkedIn, katalogi branżowe).
Oto co należy zrobić: Dodaj „sameAs” w Organization lub Person z adresami URL Twoich oficjalnych profili i wpisów katalogowych.
Podstawa techniczna
Nie znaleziono sitemap.xml
Pod /sitemap.xml nie była dostępna żadna prawidłowa mapa XML, a robots.txt żadnej nie wymienia. Sitemap pomaga robotom znaleźć wszystkie istotne adresy URL.
Oto co należy zrobić: Wygeneruj sitemap.xml ze wszystkimi indeksowalnymi adresami URL i odwołaj się do niej w robots.txt.
W porządku (8)
- Główna treść jest w HTML bez JavaScriptu.
- Są dane strukturalne (JSON-LD). — HomeAndConstructionBusiness, Organization, WebSite, ImageObject, WebPage, Person, Article, VideoObject
- Organizacja jest oznaczona jako JSON-LD.
- Dokładnie jeden nagłówek H1.
- Ustawiono adres URL canonical.
- Tytuł strony ma sensowną długość.
- Obecny jest sygnał autorstwa.
- Szybki czas odpowiedzi serwera.
Następne kroki
- Serwer blokuje boty, mimo że robots.txt je dopuszcza. Dodaj user agenty i/lub zakresy IP pożądanych robotów AI do listy dozwolonych w swoim WAF / Cloudflare / zaporze. Weryfikuj je przez odwrotny DNS, nie tylko przez ciąg user agenta.
- Brak llms.txt. Utwórz /llms.txt: H1 z nazwą, krótki akapit o ofercie i listę linków do centralnych stron.
- Nie znaleziono sitemap.xml. Wygeneruj sitemap.xml ze wszystkimi indeksowalnymi adresami URL i odwołaj się do niej w robots.txt.
Cotygodniowe ponowne skanowanie z alertem e-mail przy każdej zmianie. W przygotowaniu — podaj swój adres.
Metoda i granice
Sprawdzono 23.09.2026. citeglass pobiera rehau-termopane.ro i powiązane pliki (robots.txt, llms.txt, sitemap.xml) przez HTTP — raz jako zwykła przeglądarka, raz na każdy user agent robota AI. Nie jest wykonywany JavaScript. Czas do pierwszego bajtu: 774 ms.
Czym to nie jest: Brak śledzenia pozycji ani cytowań, brak stwierdzenia, czy model faktycznie Cię wymienia, i brak kontroli treści ładowanej przez JavaScript. Migawka z perspektywy jednego IP serwera.