Sprawdzono 4.09.2026 · https://example.com/
Brak twardych blokad, ale 4 punktów osłabia wykrywalność przez AI.
Macierz robotów AI
Dla każdego bota: co pozwala Twój robots.txt — i co Twój serwer faktycznie zwraca do user agenta bota. Wiersze zaznaczone na czerwono: robots pozwala, ale serwer blokuje (zwykle reguła WAF lub ochrony przed botami).
| Bot | Operator | robots.txt | Odpowiedź serwera |
|---|---|---|---|
| GPTBot | OpenAI | nie wymieniono | 200 + treść |
| OAI-SearchBot | OpenAI | nie wymieniono | 200 + treść |
| ChatGPT-User | OpenAI | nie wymieniono | 200 + treść |
| ClaudeBot | Anthropic | nie wymieniono | 200 + treść |
| Claude-SearchBot | Anthropic | nie wymieniono | 200 + treść |
| Claude-User | Anthropic | nie wymieniono | 200 + treść |
| PerplexityBot | Perplexity | nie wymieniono | 200 + treść |
| Perplexity-User | Perplexity | nie wymieniono | 200 + treść |
| Google-Extended | Google (Gemini-Training) | nie wymieniono | — |
| Googlebot | Google (KI-Übersichten) | nie wymieniono | 200 + treść |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | nie wymieniono | 200 + treść |
| Bytespider | ByteDance (Doubao) | nie wymieniono | 200 + treść |
| Amazonbot | Amazon (Alexa/Rufus) | nie wymieniono | 200 + treść |
| Applebot-Extended | Apple (Intelligence-Training) | nie wymieniono | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | nie wymieniono | 200 + treść |
Jak powstaje wynik?
| Bardzo mało tekstu w HTML | -10 |
| Brak danych strukturalnych (JSON-LD) | -8 |
| Tytuł strony za krótki lub za długi | -6 |
| Brak meta description lub jest nieodpowiedni | -5 |
| Brak llms.txt | -5 |
| Brak sygnału autora lub autorstwa | -4 |
| Nie znaleziono sitemap.xml | -4 |
| Brak powiązań sameAs | -3 |
| Brak linku do noty prawnej / o nas / kontaktu | -3 |
| Brak widocznej lub oznaczonej daty | -3 |
| Brak adresu URL canonical | -3 |
| Nie znaleziono robots.txt | -2 |
| Wynik | 44 / 100 |
Dostęp dla robotów AI
Nie znaleziono robots.txt
Pod /robots.txt nie był dostępny żaden prawidłowy plik. Roboty zakładają wtedy „wszystko dozwolone” — działa, ale nie masz sterowania ani sygnału sitemap.
Oto co należy zrobić: Utwórz robots.txt w katalogu głównym, co najmniej z odniesieniem do sitemap i pożądanymi regułami allow/disallow.
User-agent: * Allow: / Sitemap: https://twoja-domena.pl/sitemap.xml
Treść bez JavaScriptu
Bardzo mało tekstu w HTML
Początkowy HTML zawiera tylko około 142 znaków widocznego tekstu. To ledwie wystarcza, aby systemy AI pewnie uchwyciły temat strony.
Oto co należy zrobić: Upewnij się, że właściwa treść jest w całości w HTML, a nie w obrazach, ramkach iframe czy blokach ładowanych przez JavaScript.
Struktura i zrozumienie maszynowe
Brak danych strukturalnych (JSON-LD)
Strona nie zawiera JSON-LD. Dane strukturalne pomagają systemom AI jednoznacznie rozpoznać encje, autora, organizację, datę i typ strony — bez nich wszystko trzeba zgadywać z tekstu głównego.
Oto co należy zrobić: Dodaj co najmniej schemat „Organization” oraz pasujący do typu strony (Article, Product, FAQPage …) jako JSON-LD w <head>.
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"Twoja firma","url":"https://twoja-domena.pl",
"sameAs":["https://www.linkedin.com/company/…"]}
</script>Tytuł strony za krótki lub za długi
<title> ma 14 znaków. Sensowne jest około 30–60 znaków: dość opisowy, by nazwać temat, dość krótki, by nie został ucięty.
Oto co należy zrobić: Napisz zwięzły tytuł zawierający temat i, jeśli trzeba, markę.
Brak meta description lub jest nieodpowiedni
Meta description ma 0 znaków. To często pierwsza rzecz, którą systemy AI i wyszukiwarki czytają jako streszczenie strony.
Oto co należy zrobić: Napisz samodzielne streszczenie strony w jednym lub dwóch zdaniach (około 120–200 znaków), a nie ciąg słów kluczowych.
Brak llms.txt
Pod /llms.txt nie ma żadnego pliku. llms.txt to krótki przegląd w Markdown Twoich kluczowych treści, którego niektóre systemy AI używają do orientacji.
Oto co należy zrobić: Utwórz /llms.txt: H1 z nazwą, krótki akapit o ofercie i listę linków do centralnych stron.
# Twoja firma > Opis w jednym zdaniu. ## Ważne strony - [Produkt](https://twoja-domena.pl/produkt): … - [Cennik](https://twoja-domena.pl/cennik): … - [O nas](https://twoja-domena.pl/o-nas): …
Sygnały zaufania i encji (E-E-A-T)
Brak sygnału autora lub autorstwa
Nie da się rozpoznać autora (ani metatagu, ani rel=author, ani JSON-LD Person). Dla „doświadczenia” i „wiedzy” w sensie E-E-A-T liczy się nazwane, weryfikowalne autorstwo.
Oto co należy zrobić: Przy treściach redakcyjnych podaj autora z imienia i nazwiska oraz link do strony autora; oznacz go też jako JSON-LD „Person”.
Brak powiązań sameAs
W JSON-LD brakuje „sameAs”. Pozwala on systemom AI jednoznacznie powiązać Twoją markę lub osobę ze znanymi encjami (Wikidata, LinkedIn, katalogi branżowe).
Oto co należy zrobić: Dodaj „sameAs” w Organization lub Person z adresami URL Twoich oficjalnych profili i wpisów katalogowych.
Brak linku do noty prawnej / o nas / kontaktu
Na sprawdzanej stronie nie da się rozpoznać linku do noty prawnej, strony „O nas” ani kontaktu. Takie strony to silny sygnał zaufania i pomagają w przypisaniu encji.
Oto co należy zrobić: Podlinkuj notę prawną lub „O nas” i kontakt w widocznym miejscu, zwykle w stopce każdej strony.
Brak widocznej lub oznaczonej daty
Nie da się rozpoznać daty publikacji ani modyfikacji (ani <time>, ani article:published_time, ani datePublished w JSON-LD). Przy wielu pytaniach systemy AI preferują aktualne źródła.
Oto co należy zrobić: Przy treściach powiązanych z czasem pokazuj datę w widoczny sposób i oznacz datePublished / dateModified w JSON-LD.
Podstawa techniczna
Nie znaleziono sitemap.xml
Pod /sitemap.xml nie była dostępna żadna prawidłowa mapa XML, a robots.txt żadnej nie wymienia. Sitemap pomaga robotom znaleźć wszystkie istotne adresy URL.
Oto co należy zrobić: Wygeneruj sitemap.xml ze wszystkimi indeksowalnymi adresami URL i odwołaj się do niej w robots.txt.
Brak adresu URL canonical
Strona nie ustawia <link rel="canonical">. Bez canonical może pozostać niejasne, która wersja jest wiążąca, gdy istnieje kilka wariantów adresu URL.
Oto co należy zrobić: Ustaw na każdej stronie samoodwołujący się <link rel="canonical"> z preferowanym adresem URL.
W porządku (2)
- Dokładnie jeden nagłówek H1.
- Szybki czas odpowiedzi serwera.
Następne kroki
- Bardzo mało tekstu w HTML. Upewnij się, że właściwa treść jest w całości w HTML, a nie w obrazach, ramkach iframe czy blokach ładowanych przez JavaScript.
- Brak danych strukturalnych (JSON-LD). Dodaj co najmniej schemat „Organization” oraz pasujący do typu strony (Article, Product, FAQPage …) jako JSON-LD w <head>.
- Tytuł strony za krótki lub za długi. Napisz zwięzły tytuł zawierający temat i, jeśli trzeba, markę.
Cotygodniowe ponowne skanowanie z alertem e-mail przy każdej zmianie. W przygotowaniu — podaj swój adres.
Metoda i granice
Sprawdzono 4.09.2026. citeglass pobiera example.com i powiązane pliki (robots.txt, llms.txt, sitemap.xml) przez HTTP — raz jako zwykła przeglądarka, raz na każdy user agent robota AI. Nie jest wykonywany JavaScript. Czas do pierwszego bajtu: 12 ms.
Czym to nie jest: Brak śledzenia pozycji ani cytowań, brak stwierdzenia, czy model faktycznie Cię wymienia, i brak kontroli treści ładowanej przez JavaScript. Migawka z perspektywy jednego IP serwera.