Slovenčina
citeglass · Kontrola viditeľnosti pre AI

Skontrolované 24. 9. 2026 · https://www.nytimes.com/

Existuje 2 kritických blokácií pre dohľadateľnosť AI — vyriešte ich najskôr.

F
1 / 100
2 kritických · 5 na kontrolu
Od posledného skenovania: Skóre -37 · 2 opravených · 8 nových

Matica AI robotov

Pre každého robota: čo povoľuje váš robots.txt — a čo váš server skutočne vracia user agentovi robota. Riadky zvýraznené červeno: robots to povoľuje, ale server to blokuje (zvyčajne pravidlo WAF alebo ochrany proti robotom).

RobotPrevádzkovateľrobots.txtOdpoveď servera
GPTBotOpenAIblokovanéblokované (403 / WAF)
OAI-SearchBotOpenAIblokovanéblokované (403 / WAF)
ChatGPT-UserOpenAIblokovanéblokované (403 / WAF)
ClaudeBotAnthropicblokovanéblokované (403 / WAF)
Claude-SearchBotAnthropicblokovanéblokované (403 / WAF)
Claude-UserAnthropicblokovanéblokované (403 / WAF)
PerplexityBotPerplexityblokovanéblokované (403 / WAF)
Perplexity-UserPerplexityblokovanéblokované (403 / WAF)
Google-ExtendedGoogle (Gemini-Training)blokované—
GooglebotGoogle (KI-Übersichten)povolenéblokované (403 / WAF)
CCBotCommon Crawl (Trainingsdaten vieler LLMs)blokovanéblokované (403 / WAF)
BytespiderByteDance (Doubao)blokovanéblokované (403 / WAF)
AmazonbotAmazon (Alexa/Rufus)povolenéblokované (403 / WAF)
Applebot-ExtendedApple (Intelligence-Training)blokované—
Meta-ExternalAgentMeta (Llama/Meta AI)blokovanéblokované (403 / WAF)
Ako vzniká skóre?
Vyhľadávacie AI boty sú v robots.txt zablokované-32
Server blokuje roboty, hoci ich robots.txt povoľuje-12
Veľmi málo textu v HTML-10
Žiadne štruktúrované dáta (JSON-LD)-8
Titulok stránky príliš krátky alebo dlhý-6
Nie presne jeden nadpis H1-5
Meta popis chýba alebo nesedí-5
Žiadny llms.txt-5
Žiadny signál autora ani autorstva-4
Žiadne prepojenia sameAs-3
Žiadny odkaz na právne údaje / o nás / kontakt-3
Žiadny viditeľný ani označený dátum-3
Žiadna canonical URL-3
Výsledok1 / 100

Prístup pre AI roboty

kritické

Vyhľadávacie AI boty sú v robots.txt zablokované

Váš robots.txt blokuje 6 botov, ktoré načítavajú obsah pre odpovede AI asistentov a vyhľadávačov: OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User. Kým sú zablokované, váš web sa tam nemôže objaviť ako zdroj.

Toto by ste mali urobiť: Pri každom bote overte, či je blokovanie zámerné. Ak chcete vylúčiť len trénovanie AI, zablokujte trénovacie boty (GPTBot, ClaudeBot, Google-Extended) a vyhľadávacie boty povoľte.

User-agent: OAI-SearchBot
Allow: /

User-agent: ChatGPT-User
Allow: /

User-agent: Claude-SearchBot
Allow: /

User-agent: Claude-User
Allow: /

User-agent: PerplexityBot
Allow: /

User-agent: Perplexity-User
Allow: /
kritické

Server blokuje roboty, hoci ich robots.txt povoľuje

Pre 2 robota/ov z Google (KI-Übersichten), Amazon (Alexa/Rufus) hovorí robots.txt „povolené“, ale server odpovedá kódom 403 alebo stránkou ochrany proti robotom. Zvyčajne pravidlo WAF, firewallu alebo CDN, ktoré robota vylučuje mimo robots.txt.

Toto by ste mali urobiť: Pridajte user agentov a/alebo rozsahy IP požadovaných AI robotov na zoznam povolených vo svojom WAF / Cloudflare / firewalle. Overte ich cez spätný DNS, nielen podľa reťazca user agenta.

poznámka

Trénovanie AI vylúčené

Váš robots.txt blokuje crawlery, ktoré zbierajú obsah na trénovanie jazykových modelov: GPTBot, ClaudeBot, Google-Extended, CCBot, Applebot-Extended. Citáciám to nebráni — vyhľadávacie a načítavacie boty ako OAI-SearchBot, PerplexityBot a Googlebot pre AI prehľady sú oddelené.

Toto by ste mali urobiť: Netreba nič robiť, ak je vylúčenie zámerné. Len dbajte, aby vyhľadávacie boty zostali povolené.

Obsah bez JavaScriptu

na kontrolu

Veľmi málo textu v HTML

Počiatočné HTML obsahuje len asi 55 znakov viditeľného textu. To sotva stačí, aby AI systémy s istotou pochopili tému stránky.

Toto by ste mali urobiť: Zaistite, aby bol skutočný obsah celý v HTML a nie v obrázkoch, iframoch alebo blokoch načítaných cez JavaScript.

Štruktúra a strojová zrozumiteľnosť

na kontrolu

Žiadne štruktúrované dáta (JSON-LD)

Stránka neobsahuje žiadne JSON-LD. Štruktúrované dáta pomáhajú AI systémom jednoznačne rozpoznať entity, autora, organizáciu, dátum a typ stránky — bez nich sa všetko musí odhadovať z textu.

Toto by ste mali urobiť: Pridajte aspoň schému „Organization“ a jednu zodpovedajúcu typu stránky (Article, Product, FAQPage …) ako JSON-LD v <head>.

<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
 "name":"Vaša firma","url":"https://vasa-domena.sk",
 "sameAs":["https://www.linkedin.com/company/…"]}
</script>
na kontrolu

Titulok stránky príliš krátky alebo dlhý

<title> má 11 znakov. Rozumné je asi 30–60 znakov: dosť opisný, aby pomenoval tému, dosť krátky, aby nebol orezaný.

Toto by ste mali urobiť: Napíšte výstižný titulok obsahujúci tému a prípadne značku.

na kontrolu

Nie presne jeden nadpis H1

Stránka má 0 nadpisov H1. Jeden jednoznačný H1 hovorí ľuďom aj strojom, o čom stránka primárne je.

Toto by ste mali urobiť: Nastavte presne jeden H1, ktorý pomenuje hlavnú tému stránky. Všetko pod tým začína od H2.

na kontrolu

Meta popis chýba alebo nesedí

Meta popis má 0 znakov. Je to často prvá vec, ktorú AI systémy a vyhľadávače čítajú ako zhrnutie stránky.

Toto by ste mali urobiť: Napíšte samostatné zhrnutie stránky v jednej alebo dvoch vetách (asi 120–200 znakov), nie rad kľúčových slov.

poznámka

Žiadny llms.txt

Na /llms.txt nie je žiadny súbor. llms.txt je krátky prehľad vášho kľúčového obsahu v Markdowne, ktorý niektoré AI systémy používajú na orientáciu.

Toto by ste mali urobiť: Vytvorte /llms.txt: H1 s názvom, krátky odsek o ponuke a zoznam odkazov na hlavné stránky.

# Vaša firma

> Popis v jednej vete.

## Dôležité stránky
- [Produkt](https://vasa-domena.sk/produkt): …
- [Cenník](https://vasa-domena.sk/cennik): …
- [O nás](https://vasa-domena.sk/o-nas): …

Signály dôvery a entity (E-E-A-T)

poznámka

Žiadny signál autora ani autorstva

Nedá sa rozpoznať žiadny autor (ani meta tag, ani rel=author, ani JSON-LD Person). Pre „skúsenosť“ a „odbornosť“ v zmysle E-E-A-T sa počíta menované, dohľadateľné autorstvo.

Toto by ste mali urobiť: Pri redakčnom obsahu menujte autora menom a odkážte na stránku autora; označte ho aj ako JSON-LD „Person“.

poznámka

Žiadne prepojenia sameAs

V JSON-LD chýba „sameAs“. Umožňuje AI systémom jasne priradiť vašu značku alebo osobu k známym entitám (Wikidata, LinkedIn, odvetvové katalógy).

Toto by ste mali urobiť: Pridajte „sameAs“ v Organization alebo Person s URL vašich oficiálnych profilov a katalógových záznamov.

poznámka

Žiadny odkaz na právne údaje / o nás / kontakt

Na kontrolovanej stránke sa nedá rozpoznať žiadny odkaz na právne údaje, stránku „O nás“ ani kontakt. Také stránky sú silný signál dôvery a pomáhajú s priradením entity.

Toto by ste mali urobiť: Odkážte právne údaje alebo „O nás“ a kontakt viditeľne, zvyčajne v pätičke každej stránky.

poznámka

Žiadny viditeľný ani označený dátum

Nedá sa rozpoznať dátum publikácie ani úpravy (ani <time>, ani article:published_time, ani datePublished v JSON-LD). Pri mnohých otázkach dávajú AI systémy prednosť aktuálnym zdrojom.

Toto by ste mali urobiť: Pri obsahu s časovou väzbou zobrazujte dátum viditeľne a označte datePublished / dateModified v JSON-LD.

Technický základ

poznámka

Žiadna canonical URL

Stránka nenastavuje <link rel="canonical">. Bez canonical môže zostať nejasné, ktorá verzia je záväzná, keď existuje viac variantov URL.

Toto by ste mali urobiť: Nastavte na každej stránke seba-odkazujúci <link rel="canonical"> s preferovanou URL.

V poriadku (3)
  • Sitemap je dostupný.
  • Rýchly čas odozvy servera.
  • Žiadny noindex — stránka môže byť indexovaná.

Ďalšie kroky

  1. Vyhľadávacie AI boty sú v robots.txt zablokované. Pri každom bote overte, či je blokovanie zámerné. Ak chcete vylúčiť len trénovanie AI, zablokujte trénovacie boty (GPTBot, ClaudeBot, Google-Extended) a vyhľadávacie boty povoľte.
  2. Server blokuje roboty, hoci ich robots.txt povoľuje. Pridajte user agentov a/alebo rozsahy IP požadovaných AI robotov na zoznam povolených vo svojom WAF / Cloudflare / firewalle. Overte ich cez spätný DNS, nielen podľa reťazca user agenta.
  3. Veľmi málo textu v HTML. Zaistite, aby bol skutočný obsah celý v HTML a nie v obrázkoch, iframoch alebo blokoch načítaných cez JavaScript.
Sledovať túto stránku

Týždenné opätovné skenovanie s e-mailovým upozornením pri každej zmene. V príprave — zadajte svoju adresu.

Metóda a hranice

Skontrolované 24. 9. 2026. citeglass načíta nytimes.com a súvisiace súbory (robots.txt, llms.txt, sitemap.xml) cez HTTP — raz ako bežný prehliadač, raz za každý user agent AI robota. Nespúšťa sa JavaScript. Čas do prvého bajtu: 99 ms.

Čo to nie je: Žiadne sledovanie pozícií ani citácií, žiadne tvrdenie o tom, či vás model skutočne pomenuje, a žiadna kontrola obsahu načítaného cez JavaScript. Momentka z pohľadu jednej serverovej IP.

Skontrolovať iný web