Zkontrolováno 24. 9. 2026 · https://www.heise.de/
Existuje 1 kritických blokací pro dohledatelnost AI — vyřešte je nejdřív.
Matice AI robotů
Pro každého robota: co povoluje váš robots.txt — a co váš server skutečně vrací user agentovi robota. Řádky zvýrazněné červeně: robots to povoluje, ale server to blokuje (obvykle pravidlo WAF nebo ochrany proti robotům).
| Robot | Provozovatel | robots.txt | Odpověď serveru |
|---|---|---|---|
| GPTBot | OpenAI | povoleno | 200 + obsah |
| OAI-SearchBot | OpenAI | povoleno | 200 + obsah |
| ChatGPT-User | OpenAI | povoleno | 200 + obsah |
| ClaudeBot | Anthropic | povoleno | 200 + obsah |
| Claude-SearchBot | Anthropic | povoleno | 200 + obsah |
| Claude-User | Anthropic | povoleno | 200 + obsah |
| PerplexityBot | Perplexity | povoleno | 200 + obsah |
| Perplexity-User | Perplexity | povoleno | 200 + obsah |
| Google-Extended | Google (Gemini-Training) | blokováno | — |
| Googlebot | Google (KI-Übersichten) | povoleno (přes User-agent: *) | 200 + obsah |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | blokováno | 200 + obsah |
| Bytespider | ByteDance (Doubao) | blokováno | 200 + obsah |
| Amazonbot | Amazon (Alexa/Rufus) | blokováno | 200 + obsah |
| Applebot-Extended | Apple (Intelligence-Training) | blokováno | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | blokováno | 200 + obsah |
Jak vzniká skóre?
| Vyhledávací AI boti jsou v robots.txt zablokováni | -8 |
| Titulek stránky příliš krátký nebo dlouhý | -6 |
| Ne přesně jeden nadpis H1 | -5 |
| Žádný llms.txt | -5 |
| Žádné schéma Organization | -4 |
| Žádný signál autora ani autorství | -4 |
| Žádná propojení sameAs | -3 |
| Žádné značkování FAQ nebo HowTo | -2 |
| Výsledek | 63 / 100 |
Přístup pro AI roboty
Vyhledávací AI boti jsou v robots.txt zablokováni
Váš robots.txt blokuje 1 botů, kteří načítají obsah pro odpovědi AI asistentů a vyhledávačů: Google-Extended. Dokud jsou zablokováni, váš web se tam nemůže objevit jako zdroj.
Toto byste měli udělat: U každého bota ověřte, zda je blokace záměrná. Pokud chcete vyloučit jen trénování AI, zablokujte trénovací boty (GPTBot, ClaudeBot, Google-Extended) a vyhledávací boty povolte.
Struktura a strojová srozumitelnost
Titulek stránky příliš krátký nebo dlouhý
<title> má 67 znaků. Rozumné je asi 30–60 znaků: dost popisný, aby pojmenoval téma, dost krátký, aby nebyl oříznut.
Toto byste měli udělat: Napište výstižný titulek obsahující téma a případně značku.
Ne přesně jeden nadpis H1
Stránka má 0 nadpisů H1. Jeden jednoznačný H1 říká lidem i strojům, o čem stránka primárně je.
Toto byste měli udělat: Nastavte přesně jeden H1, který pojmenuje hlavní téma stránky. Vše pod tím začíná od H2.
Žádný llms.txt
Na /llms.txt není žádný soubor. llms.txt je krátký přehled vašeho klíčového obsahu v Markdownu, který některé AI systémy používají k orientaci.
Toto byste měli udělat: Vytvořte /llms.txt: H1 s názvem, krátký odstavec o nabídce a seznam odkazů na hlavní stránky.
# Vaše firma > Popis v jedné větě. ## Důležité stránky - [Produkt](https://vase-domena.cz/produkt): … - [Ceník](https://vase-domena.cz/cenik): … - [O nás](https://vase-domena.cz/o-nas): …
Žádné schéma Organization
JSON-LD je, ale žádný záznam „Organization“. AI systémy pak hůře zařadí vaši značku jako samostatnou entitu a hůře ji propojí s externími zdroji.
Toto byste měli udělat: Přidejte schéma „Organization“ s name, url, logo a sameAs (odkazy na vaše oficiální profily).
Žádné značkování FAQ nebo HowTo
Obsah typu otázka-odpověď a krok za krokem je pro AI systémy bez značkování FAQPage nebo HowTo hůře rozpoznatelný jako přímo citovatelná odpověď.
Toto byste měli udělat: Tam, kde stránka odpovídá na skutečné otázky nebo dává návody, ji označte jako FAQPage nebo HowTo (žádné značkování bez viditelně odpovídajícího obsahu).
Signály důvěry a entity (E-E-A-T)
Žádný signál autora ani autorství
Nelze rozpoznat žádného autora (ani meta tag, ani rel=author, ani JSON-LD Person). Pro „zkušenost“ a „odbornost“ ve smyslu E-E-A-T se počítá jmenované, dohledatelné autorství.
Toto byste měli udělat: U redakčního obsahu jmenujte autora jménem a odkažte na stránku autora; označte ho také jako JSON-LD „Person“.
Žádná propojení sameAs
V JSON-LD chybí „sameAs“. Umožňuje AI systémům jasně přiřadit vaši značku nebo osobu ke známým entitám (Wikidata, LinkedIn, oborové katalogy).
Toto byste měli udělat: Přidejte „sameAs“ v Organization nebo Person s URL vašich oficiálních profilů a katalogových záznamů.
V pořádku (6)
- Hlavní obsah je v HTML bez JavaScriptu.
- Strukturovaná data (JSON-LD) jsou přítomna. — ItemList, Thing
- Je nastavena canonical URL.
- Sitemap je dostupný.
- Rychlá doba odezvy serveru.
- Žádný noindex — stránka může být indexována.
Další kroky
- Vyhledávací AI boti jsou v robots.txt zablokováni. U každého bota ověřte, zda je blokace záměrná. Pokud chcete vyloučit jen trénování AI, zablokujte trénovací boty (GPTBot, ClaudeBot, Google-Extended) a vyhledávací boty povolte.
- Titulek stránky příliš krátký nebo dlouhý. Napište výstižný titulek obsahující téma a případně značku.
- Ne přesně jeden nadpis H1. Nastavte přesně jeden H1, který pojmenuje hlavní téma stránky. Vše pod tím začíná od H2.
Týdenní opětovné skenování s e-mailovým upozorněním při každé změně. V přípravě — zadejte svou adresu.
Metoda a hranice
Zkontrolováno 24. 9. 2026. citeglass načítá heise.de a související soubory (robots.txt, llms.txt, sitemap.xml) přes HTTP — jednou jako běžný prohlížeč, jednou za každý user agent AI robota. Nespouští se JavaScript. Doba do prvního bytu: 65 ms.
Co to není: Žádné sledování pozic ani citací, žádné tvrzení o tom, zda vás model skutečně jmenuje, a žádná kontrola obsahu načítaného přes JavaScript. Momentka z pohledu jedné serverové IP.