Polski
citeglass · Kontrola widoczności w AI

Sprawdzono 24.09.2026 · https://www.nytimes.com/

Istnieje 2 krytycznych blokad dla wykrywalności przez AI — usuń je najpierw.

F
1 / 100
2 krytyczne · 5 do sprawdzenia
Pracujesz nad swoją stroną — sprawdzać ją co tydzień?

3 skanów tej witryny, wynik -37 od pierwszego skanu. Z monitoringiem citeglass sprawdza stronę automatycznie co tydzień i ostrzega, gdy coś się pogorszy — zapisz się, by dostać powiadomienie o starcie.

Od ostatniego skanowania: 1 naprawionych

Macierz robotów AI

Dla każdego bota: co pozwala Twój robots.txt — i co Twój serwer faktycznie zwraca do user agenta bota. Wiersze zaznaczone na czerwono: robots pozwala, ale serwer blokuje (zwykle reguła WAF lub ochrony przed botami).

BotOperatorrobots.txtOdpowiedź serwera
GPTBotOpenAIzablokowanezablokowane (403 / WAF)
OAI-SearchBotOpenAIzablokowanezablokowane (403 / WAF)
ChatGPT-UserOpenAIzablokowanezablokowane (403 / WAF)
ClaudeBotAnthropiczablokowanezablokowane (403 / WAF)
Claude-SearchBotAnthropiczablokowanezablokowane (403 / WAF)
Claude-UserAnthropiczablokowanezablokowane (403 / WAF)
PerplexityBotPerplexityzablokowanezablokowane (403 / WAF)
Perplexity-UserPerplexityzablokowanezablokowane (403 / WAF)
Google-ExtendedGoogle (Gemini-Training)zablokowane—
GooglebotGoogle (KI-Übersichten)dozwolonezablokowane (403 / WAF)
CCBotCommon Crawl (Trainingsdaten vieler LLMs)zablokowanezablokowane (403 / WAF)
BytespiderByteDance (Doubao)zablokowanezablokowane (403 / WAF)
AmazonbotAmazon (Alexa/Rufus)dozwolonezablokowane (403 / WAF)
Applebot-ExtendedApple (Intelligence-Training)zablokowane—
Meta-ExternalAgentMeta (Llama/Meta AI)zablokowanezablokowane (403 / WAF)
Jak powstaje wynik?
Boty wyszukiwania AI są zablokowane w robots.txt-32
Serwer blokuje boty, mimo że robots.txt je dopuszcza-12
Bardzo mało tekstu w HTML-10
Brak danych strukturalnych (JSON-LD)-8
Tytuł strony za krótki lub za długi-6
Nie dokładnie jeden nagłówek H1-5
Brak meta description lub jest nieodpowiedni-5
Brak llms.txt-5
Brak sygnału autora lub autorstwa-4
Brak powiązań sameAs-3
Brak linku do noty prawnej / o nas / kontaktu-3
Brak widocznej lub oznaczonej daty-3
Brak adresu URL canonical-3
Wynik1 / 100

Dostęp dla robotów AI

krytyczne

Boty wyszukiwania AI są zablokowane w robots.txt

Twój robots.txt blokuje 6 botów, które pobierają treści do odpowiedzi asystentów AI i wyszukiwarek: OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User. Dopóki są zablokowane, Twoja strona nie może się tam pojawić jako źródło.

Oto co należy zrobić: Sprawdź dla każdego bota, czy blokada jest zamierzona. Jeśli chcesz wykluczyć tylko trenowanie AI, zablokuj boty treningowe (GPTBot, ClaudeBot, Google-Extended) i dopuść boty wyszukiwania.

User-agent: OAI-SearchBot
Allow: /

User-agent: ChatGPT-User
Allow: /

User-agent: Claude-SearchBot
Allow: /

User-agent: Claude-User
Allow: /

User-agent: PerplexityBot
Allow: /

User-agent: Perplexity-User
Allow: /
krytyczne

Serwer blokuje boty, mimo że robots.txt je dopuszcza

Dla 2 bot(ów) z Google (KI-Übersichten), Amazon (Alexa/Rufus) robots.txt mówi „dozwolone”, ale serwer odpowiada kodem 403 lub stroną ochrony przed botami. Zwykle reguła WAF, zapory lub CDN, która wyklucza robota z pominięciem robots.txt.

Oto co należy zrobić: Dodaj user agenty i/lub zakresy IP pożądanych robotów AI do listy dozwolonych w swoim WAF / Cloudflare / zaporze. Weryfikuj je przez odwrotny DNS, nie tylko przez ciąg user agenta.

Treść bez JavaScriptu

do sprawdzenia

Bardzo mało tekstu w HTML

Początkowy HTML zawiera tylko około 55 znaków widocznego tekstu. To ledwie wystarcza, aby systemy AI pewnie uchwyciły temat strony.

Oto co należy zrobić: Upewnij się, że właściwa treść jest w całości w HTML, a nie w obrazach, ramkach iframe czy blokach ładowanych przez JavaScript.

Struktura i zrozumienie maszynowe

do sprawdzenia

Brak danych strukturalnych (JSON-LD)

Strona nie zawiera JSON-LD. Dane strukturalne pomagają systemom AI jednoznacznie rozpoznać encje, autora, organizację, datę i typ strony — bez nich wszystko trzeba zgadywać z tekstu głównego.

Oto co należy zrobić: Dodaj co najmniej schemat „Organization” oraz pasujący do typu strony (Article, Product, FAQPage …) jako JSON-LD w <head>.

<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
 "name":"Twoja firma","url":"https://twoja-domena.pl",
 "sameAs":["https://www.linkedin.com/company/…"]}
</script>
do sprawdzenia

Tytuł strony za krótki lub za długi

<title> ma 11 znaków. Sensowne jest około 30–60 znaków: dość opisowy, by nazwać temat, dość krótki, by nie został ucięty.

Oto co należy zrobić: Napisz zwięzły tytuł zawierający temat i, jeśli trzeba, markę.

do sprawdzenia

Nie dokładnie jeden nagłówek H1

Strona ma 0 nagłówków H1. Jeden jednoznaczny H1 mówi ludziom i maszynom, o czym strona przede wszystkim jest.

Oto co należy zrobić: Ustaw dokładnie jeden H1 nazywający główny temat strony. Wszystko poniżej zaczyna się od H2.

do sprawdzenia

Brak meta description lub jest nieodpowiedni

Meta description ma 0 znaków. To często pierwsza rzecz, którą systemy AI i wyszukiwarki czytają jako streszczenie strony.

Oto co należy zrobić: Napisz samodzielne streszczenie strony w jednym lub dwóch zdaniach (około 120–200 znaków), a nie ciąg słów kluczowych.

wskazówka

Brak llms.txt

Pod /llms.txt nie ma żadnego pliku. llms.txt to krótki przegląd w Markdown Twoich kluczowych treści, którego niektóre systemy AI używają do orientacji.

Oto co należy zrobić: Utwórz /llms.txt: H1 z nazwą, krótki akapit o ofercie i listę linków do centralnych stron.

# Twoja firma

> Opis w jednym zdaniu.

## Ważne strony
- [Produkt](https://twoja-domena.pl/produkt): …
- [Cennik](https://twoja-domena.pl/cennik): …
- [O nas](https://twoja-domena.pl/o-nas): …

Sygnały zaufania i encji (E-E-A-T)

wskazówka

Brak sygnału autora lub autorstwa

Nie da się rozpoznać autora (ani metatagu, ani rel=author, ani JSON-LD Person). Dla „doświadczenia” i „wiedzy” w sensie E-E-A-T liczy się nazwane, weryfikowalne autorstwo.

Oto co należy zrobić: Przy treściach redakcyjnych podaj autora z imienia i nazwiska oraz link do strony autora; oznacz go też jako JSON-LD „Person”.

wskazówka

Brak powiązań sameAs

W JSON-LD brakuje „sameAs”. Pozwala on systemom AI jednoznacznie powiązać Twoją markę lub osobę ze znanymi encjami (Wikidata, LinkedIn, katalogi branżowe).

Oto co należy zrobić: Dodaj „sameAs” w Organization lub Person z adresami URL Twoich oficjalnych profili i wpisów katalogowych.

wskazówka

Brak linku do noty prawnej / o nas / kontaktu

Na sprawdzanej stronie nie da się rozpoznać linku do noty prawnej, strony „O nas” ani kontaktu. Takie strony to silny sygnał zaufania i pomagają w przypisaniu encji.

Oto co należy zrobić: Podlinkuj notę prawną lub „O nas” i kontakt w widocznym miejscu, zwykle w stopce każdej strony.

wskazówka

Brak widocznej lub oznaczonej daty

Nie da się rozpoznać daty publikacji ani modyfikacji (ani <time>, ani article:published_time, ani datePublished w JSON-LD). Przy wielu pytaniach systemy AI preferują aktualne źródła.

Oto co należy zrobić: Przy treściach powiązanych z czasem pokazuj datę w widoczny sposób i oznacz datePublished / dateModified w JSON-LD.

Podstawa techniczna

wskazówka

Brak adresu URL canonical

Strona nie ustawia <link rel="canonical">. Bez canonical może pozostać niejasne, która wersja jest wiążąca, gdy istnieje kilka wariantów adresu URL.

Oto co należy zrobić: Ustaw na każdej stronie samoodwołujący się <link rel="canonical"> z preferowanym adresem URL.

W porządku (3)
  • Sitemap jest dostępny.
  • Szybki czas odpowiedzi serwera.
  • Brak noindex — strona może być indeksowana.

Następne kroki

  1. Boty wyszukiwania AI są zablokowane w robots.txt. Sprawdź dla każdego bota, czy blokada jest zamierzona. Jeśli chcesz wykluczyć tylko trenowanie AI, zablokuj boty treningowe (GPTBot, ClaudeBot, Google-Extended) i dopuść boty wyszukiwania.
  2. Serwer blokuje boty, mimo że robots.txt je dopuszcza. Dodaj user agenty i/lub zakresy IP pożądanych robotów AI do listy dozwolonych w swoim WAF / Cloudflare / zaporze. Weryfikuj je przez odwrotny DNS, nie tylko przez ciąg user agenta.
  3. Bardzo mało tekstu w HTML. Upewnij się, że właściwa treść jest w całości w HTML, a nie w obrazach, ramkach iframe czy blokach ładowanych przez JavaScript.

Metoda i granice

Sprawdzono 24.09.2026. citeglass pobiera nytimes.com i powiązane pliki (robots.txt, llms.txt, sitemap.xml) przez HTTP — raz jako zwykła przeglądarka, raz na każdy user agent robota AI. Nie jest wykonywany JavaScript. Czas do pierwszego bajtu: 123 ms.

Czym to nie jest: Brak śledzenia pozycji ani cytowań, brak stwierdzenia, czy model faktycznie Cię wymienia, i brak kontroli treści ładowanej przez JavaScript. Migawka z perspektywy jednego IP serwera.

Sprawdź inną stronę