Gecontroleerd op 24-9-2026 · https://www.heise.de/
Geen harde blokkades, maar 2 punten verzwakken de AI-vindbaarheid.
AI-crawlermatrix
Per bot: wat je robots.txt toestaat — en wat je server daadwerkelijk teruggeeft aan de user agent van de bot. Rood gemarkeerde rijen: robots staat het toe, maar de server blokkeert het (meestal een WAF- of botbeschermingsregel).
| Bot | Beheerder | robots.txt | Serverreactie |
|---|---|---|---|
| GPTBot | OpenAI | toegestaan | 200 + inhoud |
| OAI-SearchBot | OpenAI | toegestaan | 200 + inhoud |
| ChatGPT-User | OpenAI | toegestaan | 200 + inhoud |
| ClaudeBot | Anthropic | toegestaan | 200 + inhoud |
| Claude-SearchBot | Anthropic | toegestaan | 200 + inhoud |
| Claude-User | Anthropic | toegestaan | 200 + inhoud |
| PerplexityBot | Perplexity | toegestaan | 200 + inhoud |
| Perplexity-User | Perplexity | toegestaan | 200 + inhoud |
| Google-Extended | Google (Gemini-Training) | geblokkeerd | — |
| Googlebot | Google (KI-Übersichten) | toegestaan (via User-agent: *) | 200 + inhoud |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | geblokkeerd | 200 + inhoud |
| Bytespider | ByteDance (Doubao) | geblokkeerd | 200 + inhoud |
| Amazonbot | Amazon (Alexa/Rufus) | geblokkeerd | 200 + inhoud |
| Applebot-Extended | Apple (Intelligence-Training) | geblokkeerd | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | geblokkeerd | 200 + inhoud |
Hoe komt de score tot stand?
| Paginatitel te kort of te lang | -6 |
| Niet precies één H1-kop | -5 |
| Geen llms.txt | -5 |
| Geen Organization-schema | -4 |
| Geen auteurs- of auteurschapssignaal | -4 |
| Geen sameAs-koppelingen | -3 |
| Geen FAQ- of HowTo-markup | -2 |
| Resultaat | 71 / 100 |
Toegang voor AI-crawlers
AI-training uitgesloten
Je robots.txt blokkeert crawlers die content verzamelen voor het trainen van taalmodellen: Google-Extended, CCBot, Applebot-Extended. Dat voorkomt geen citaties — zoek- en ophaalbots zoals OAI-SearchBot, PerplexityBot en Googlebot voor AI-overzichten staan daar los van.
Dit zou je moeten doen: Niets te doen als de uitsluiting bedoeld is. Let er alleen op dat de zoekbots toegestaan blijven.
Structuur en machinaal begrip
Paginatitel te kort of te lang
De <title> is 67 tekens lang. Ongeveer 30–60 tekens is zinvol: beschrijvend genoeg om het onderwerp te benoemen, kort genoeg om niet afgekapt te worden.
Dit zou je moeten doen: Schrijf een bondige titel met het onderwerp en, indien relevant, het merk.
Niet precies één H1-kop
De pagina heeft 0 H1-koppen. Eén eenduidige H1 vertelt mens en machine waar de pagina primair over gaat.
Dit zou je moeten doen: Stel precies één H1 in die het hoofdonderwerp van de pagina benoemt. Alles daaronder begint bij H2.
Geen llms.txt
Er staat geen bestand op /llms.txt. llms.txt is een kort Markdown-overzicht van je belangrijkste inhoud dat sommige AI-systemen gebruiken om zich te oriënteren.
Dit zou je moeten doen: Maak een /llms.txt: een H1 met de naam, een korte alinea over het aanbod en een lijst met links naar de centrale pagina's.
# Jouw bedrijf > Beschrijving in één zin. ## Belangrijke pagina's - [Product](https://jouw-domein.nl/product): … - [Prijzen](https://jouw-domein.nl/prijzen): … - [Over ons](https://jouw-domein.nl/over-ons): …
Geen Organization-schema
Er is JSON-LD, maar geen 'Organization'-vermelding. AI-systemen plaatsen je merk dan minder goed als eigen entiteit en koppelen het minder goed aan externe bronnen.
Dit zou je moeten doen: Voeg een 'Organization'-schema toe met name, url, logo en sameAs (links naar je officiële profielen).
Geen FAQ- of HowTo-markup
Vraag-antwoord- en stapsgewijze inhoud is voor AI-systemen zonder FAQPage- of HowTo-markup lastiger te herkennen als direct citeerbaar antwoord.
Dit zou je moeten doen: Waar de pagina echte vragen beantwoordt of instructies geeft, markeer die als FAQPage of HowTo (geen markup zonder zichtbaar passende inhoud).
Vertrouwens- en entiteitssignalen (E-E-A-T)
Geen auteurs- of auteurschapssignaal
Er is geen auteur herkenbaar (geen metatag, geen rel=author, geen JSON-LD Person). Voor 'ervaring' en 'expertise' in E-E-A-T-zin telt een genoemd, navolgbaar auteurschap.
Dit zou je moeten doen: Noem bij redactionele inhoud een auteur met naam en link een auteurspagina; markeer die ook als JSON-LD 'Person'.
Geen sameAs-koppelingen
In de JSON-LD ontbreekt 'sameAs'. Daarmee koppelen AI-systemen je merk of persoon duidelijk aan bekende entiteiten (Wikidata, LinkedIn, branchegidsen).
Dit zou je moeten doen: Voeg in Organization of Person een 'sameAs' toe met de URL's van je officiële profielen en gidsvermeldingen.
In orde (6)
- De hoofdinhoud staat in de HTML zonder JavaScript.
- Er is gestructureerde data (JSON-LD). — ItemList, Thing
- Er is een canonieke URL ingesteld.
- De sitemap is bereikbaar.
- Snelle reactietijd van de server.
- Geen noindex — de pagina mag geïndexeerd worden.
Volgende stappen
- Paginatitel te kort of te lang. Schrijf een bondige titel met het onderwerp en, indien relevant, het merk.
- Niet precies één H1-kop. Stel precies één H1 in die het hoofdonderwerp van de pagina benoemt. Alles daaronder begint bij H2.
- Geen llms.txt. Maak een /llms.txt: een H1 met de naam, een korte alinea over het aanbod en een lijst met links naar de centrale pagina's.
Wekelijkse herscan met e-mailwaarschuwing bij elke wijziging. In voorbereiding — vul je adres in.
Methode en grenzen
Gecontroleerd op 24-9-2026. citeglass haalt heise.de en de bijbehorende bestanden (robots.txt, llms.txt, sitemap.xml) via HTTP op — één keer als gewone browser, één keer per user agent van een AI-crawler. Er wordt geen JavaScript uitgevoerd. Tijd tot eerste byte: 67 ms.
Wat dit niet is: Geen positie- of citatiemonitoring, geen uitspraak of een model je daadwerkelijk noemt, en geen controle van inhoud die via JavaScript wordt geladen. Een momentopname vanuit het perspectief van één server-IP.