Skontrolované 4. 9. 2026 · https://www.nytimes.com/
Existuje 2 kritických blokácií pre dohľadateľnosť AI — vyriešte ich najskôr.
Matica AI robotov
Pre každého robota: čo povoľuje váš robots.txt — a čo váš server skutočne vracia user agentovi robota. Riadky zvýraznené červeno: robots to povoľuje, ale server to blokuje (zvyčajne pravidlo WAF alebo ochrany proti robotom).
| Robot | Prevádzkovateľ | robots.txt | Odpoveď servera |
|---|---|---|---|
| GPTBot | OpenAI | blokované | blokované (403 / WAF) |
| OAI-SearchBot | OpenAI | blokované | blokované (403 / WAF) |
| ChatGPT-User | OpenAI | blokované | blokované (403 / WAF) |
| ClaudeBot | Anthropic | blokované | blokované (403 / WAF) |
| Claude-SearchBot | Anthropic | blokované | blokované (403 / WAF) |
| Claude-User | Anthropic | blokované | blokované (403 / WAF) |
| PerplexityBot | Perplexity | blokované | blokované (403 / WAF) |
| Perplexity-User | Perplexity | blokované | blokované (403 / WAF) |
| Google-Extended | Google (Gemini-Training) | blokované | — |
| Googlebot | Google (KI-Übersichten) | povolené | 200 + obsah |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | blokované | blokované (403 / WAF) |
| Bytespider | ByteDance (Doubao) | blokované | blokované (403 / WAF) |
| Amazonbot | Amazon (Alexa/Rufus) | povolené | blokované (403 / WAF) |
| Applebot-Extended | Apple (Intelligence-Training) | blokované | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | blokované | blokované (403 / WAF) |
Ako vzniká skóre?
| Dôležité AI roboty sú v robots.txt blokované | -32 |
| Server blokuje roboty, hoci ich robots.txt povoľuje | -6 |
| Titulok stránky príliš krátky alebo dlhý | -6 |
| Žiadny llms.txt | -5 |
| Žiadna schéma Organization | -4 |
| Žiadny signál autora ani autorstva | -4 |
| Žiadny viditeľný ani označený dátum | -3 |
| Žiadne značkovanie FAQ alebo HowTo | -2 |
| Výsledok | 38 / 100 |
Prístup pre AI roboty
Dôležité AI roboty sú v robots.txt blokované
Váš robots.txt zakazuje prístup 5 kľúčovým AI robotom: GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended. Tieto systémy potom nemôžu váš obsah načítať ani ho použiť ako zdroj.
Toto by ste mali urobiť: Skontrolujte pri každom robotovi, či je blokácia zámerná. Pre viditeľnosť pre AI by mali byť povolené aspoň GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot a Google-Extended.
User-agent: GPTBot Allow: / User-agent: PerplexityBot Allow: /
Server blokuje roboty, hoci ich robots.txt povoľuje
Pre 1 robota/ov z Amazon (Alexa/Rufus) hovorí robots.txt „povolené“, ale server odpovedá kódom 403 alebo stránkou ochrany proti robotom. Zvyčajne pravidlo WAF, firewallu alebo CDN, ktoré robota vylučuje mimo robots.txt.
Toto by ste mali urobiť: Pridajte user agentov a/alebo rozsahy IP požadovaných AI robotov na zoznam povolených vo svojom WAF / Cloudflare / firewalle. Overte ich cez spätný DNS, nielen podľa reťazca user agenta.
Štruktúra a strojová zrozumiteľnosť
Titulok stránky príliš krátky alebo dlhý
<title> má 66 znakov. Rozumné je asi 30–60 znakov: dosť opisný, aby pomenoval tému, dosť krátky, aby nebol orezaný.
Toto by ste mali urobiť: Napíšte výstižný titulok obsahujúci tému a prípadne značku.
Žiadny llms.txt
Na /llms.txt nie je žiadny súbor. llms.txt je krátky prehľad vášho kľúčového obsahu v Markdowne, ktorý niektoré AI systémy používajú na orientáciu.
Toto by ste mali urobiť: Vytvorte /llms.txt: H1 s názvom, krátky odsek o ponuke a zoznam odkazov na hlavné stránky.
# Vaša firma > Popis v jednej vete. ## Dôležité stránky - [Produkt](https://vasa-domena.sk/produkt): … - [Cenník](https://vasa-domena.sk/cennik): … - [O nás](https://vasa-domena.sk/o-nas): …
Žiadna schéma Organization
JSON-LD je, ale žiadny záznam „Organization“. AI systémy potom horšie zaradia vašu značku ako samostatnú entitu a horšie ju prepoja s externými zdrojmi.
Toto by ste mali urobiť: Pridajte schému „Organization“ s name, url, logo a sameAs (odkazy na vaše oficiálne profily).
Žiadne značkovanie FAQ alebo HowTo
Obsah typu otázka-odpoveď a krok za krokom je pre AI systémy bez značkovania FAQPage alebo HowTo horšie rozpoznateľný ako priamo citovateľná odpoveď.
Toto by ste mali urobiť: Tam, kde stránka odpovedá na skutočné otázky alebo dáva návody, ju označte ako FAQPage alebo HowTo (žiadne značkovanie bez viditeľne zodpovedajúceho obsahu).
Signály dôvery a entity (E-E-A-T)
Žiadny signál autora ani autorstva
Nedá sa rozpoznať žiadny autor (ani meta tag, ani rel=author, ani JSON-LD Person). Pre „skúsenosť“ a „odbornosť“ v zmysle E-E-A-T sa počíta menované, dohľadateľné autorstvo.
Toto by ste mali urobiť: Pri redakčnom obsahu menujte autora menom a odkážte na stránku autora; označte ho aj ako JSON-LD „Person“.
Žiadny viditeľný ani označený dátum
Nedá sa rozpoznať dátum publikácie ani úpravy (ani <time>, ani article:published_time, ani datePublished v JSON-LD). Pri mnohých otázkach dávajú AI systémy prednosť aktuálnym zdrojom.
Toto by ste mali urobiť: Pri obsahu s časovou väzbou zobrazujte dátum viditeľne a označte datePublished / dateModified v JSON-LD.
V poriadku (7)
- Hlavný obsah je v HTML bez JavaScriptu.
- Štruktúrované dáta (JSON-LD) sú prítomné. — WebSite, NewsMediaOrganization
- Presne jeden nadpis H1.
- Je nastavená canonical URL.
- Sitemap je dostupný.
- Rýchly čas odozvy servera.
- Žiadny noindex — stránka môže byť indexovaná.
Ďalšie kroky
- Dôležité AI roboty sú v robots.txt blokované. Skontrolujte pri každom robotovi, či je blokácia zámerná. Pre viditeľnosť pre AI by mali byť povolené aspoň GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot a Google-Extended.
- Server blokuje roboty, hoci ich robots.txt povoľuje. Pridajte user agentov a/alebo rozsahy IP požadovaných AI robotov na zoznam povolených vo svojom WAF / Cloudflare / firewalle. Overte ich cez spätný DNS, nielen podľa reťazca user agenta.
- Titulok stránky príliš krátky alebo dlhý. Napíšte výstižný titulok obsahujúci tému a prípadne značku.
Týždenné opätovné skenovanie s e-mailovým upozornením pri každej zmene. V príprave — zadajte svoju adresu.
Metóda a hranice
Skontrolované 4. 9. 2026. citeglass načíta nytimes.com a súvisiace súbory (robots.txt, llms.txt, sitemap.xml) cez HTTP — raz ako bežný prehliadač, raz za každý user agent AI robota. Nespúšťa sa JavaScript. Čas do prvého bajtu: 235 ms.
Čo to nie je: Žiadne sledovanie pozícií ani citácií, žiadne tvrdenie o tom, či vás model skutočne pomenuje, a žiadna kontrola obsahu načítaného cez JavaScript. Momentka z pohľadu jednej serverovej IP.