Gecontroleerd op 4-9-2026 · https://example.com/
Geen harde blokkades, maar 4 punten verzwakken de AI-vindbaarheid.
AI-crawlermatrix
Per bot: wat je robots.txt toestaat — en wat je server daadwerkelijk teruggeeft aan de user agent van de bot. Rood gemarkeerde rijen: robots staat het toe, maar de server blokkeert het (meestal een WAF- of botbeschermingsregel).
| Bot | Beheerder | robots.txt | Serverreactie |
|---|---|---|---|
| GPTBot | OpenAI | niet genoemd | 200 + inhoud |
| OAI-SearchBot | OpenAI | niet genoemd | 200 + inhoud |
| ChatGPT-User | OpenAI | niet genoemd | 200 + inhoud |
| ClaudeBot | Anthropic | niet genoemd | 200 + inhoud |
| Claude-SearchBot | Anthropic | niet genoemd | 200 + inhoud |
| Claude-User | Anthropic | niet genoemd | 200 + inhoud |
| PerplexityBot | Perplexity | niet genoemd | 200 + inhoud |
| Perplexity-User | Perplexity | niet genoemd | 200 + inhoud |
| Google-Extended | Google (Gemini-Training) | niet genoemd | — |
| Googlebot | Google (KI-Übersichten) | niet genoemd | 200 + inhoud |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | niet genoemd | 200 + inhoud |
| Bytespider | ByteDance (Doubao) | niet genoemd | 200 + inhoud |
| Amazonbot | Amazon (Alexa/Rufus) | niet genoemd | 200 + inhoud |
| Applebot-Extended | Apple (Intelligence-Training) | niet genoemd | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | niet genoemd | 200 + inhoud |
Hoe komt de score tot stand?
| Zeer weinig tekst in de HTML | -10 |
| Geen gestructureerde data (JSON-LD) | -8 |
| Paginatitel te kort of te lang | -6 |
| Metabeschrijving ontbreekt of past niet | -5 |
| Geen llms.txt | -5 |
| Geen auteurs- of auteurschapssignaal | -4 |
| Geen sitemap.xml gevonden | -4 |
| Geen sameAs-koppelingen | -3 |
| Geen link naar colofon / over ons / contact | -3 |
| Geen zichtbare of gemarkeerde datum | -3 |
| Geen canonieke URL | -3 |
| Geen robots.txt gevonden | -2 |
| Resultaat | 44 / 100 |
Toegang voor AI-crawlers
Geen robots.txt gevonden
Er was geen geldig bestand bereikbaar op /robots.txt. Crawlers gaan dan uit van 'alles toegestaan' — dat werkt, maar je hebt geen sturing en geen sitemapsignaal.
Dit zou je moeten doen: Maak een robots.txt in de rootmap, minimaal met een sitemapverwijzing en je gewenste allow-/disallowregels.
User-agent: * Allow: / Sitemap: https://jouw-domein.nl/sitemap.xml
Inhoud zonder JavaScript
Zeer weinig tekst in de HTML
De initiële HTML bevat maar ongeveer 142 tekens zichtbare tekst. Dat is nauwelijks genoeg voor AI-systemen om het onderwerp van de pagina met zekerheid te vatten.
Dit zou je moeten doen: Zorg dat de eigenlijke inhoud volledig in de HTML staat en niet in afbeeldingen, iframes of via JavaScript geladen blokken.
Structuur en machinaal begrip
Geen gestructureerde data (JSON-LD)
De pagina bevat geen JSON-LD. Gestructureerde data helpt AI-systemen om entiteiten, auteur, organisatie, datum en paginatype eenduidig te herkennen — zonder moet alles uit de lopende tekst worden geraden.
Dit zou je moeten doen: Voeg minstens een 'Organization'-schema toe en een schema dat bij het paginatype past (Article, Product, FAQPage …) als JSON-LD in de <head>.
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"Jouw bedrijf","url":"https://jouw-domein.nl",
"sameAs":["https://www.linkedin.com/company/…"]}
</script>Paginatitel te kort of te lang
De <title> is 14 tekens lang. Ongeveer 30–60 tekens is zinvol: beschrijvend genoeg om het onderwerp te benoemen, kort genoeg om niet afgekapt te worden.
Dit zou je moeten doen: Schrijf een bondige titel met het onderwerp en, indien relevant, het merk.
Metabeschrijving ontbreekt of past niet
De metabeschrijving is 0 tekens lang. Het is vaak het eerste dat AI-systemen en zoekmachines lezen als samenvatting van de pagina.
Dit zou je moeten doen: Schrijf een op zichzelf staande samenvatting van de pagina in een of twee zinnen (ongeveer 120–200 tekens), geen rij trefwoorden.
Geen llms.txt
Er staat geen bestand op /llms.txt. llms.txt is een kort Markdown-overzicht van je belangrijkste inhoud dat sommige AI-systemen gebruiken om zich te oriënteren.
Dit zou je moeten doen: Maak een /llms.txt: een H1 met de naam, een korte alinea over het aanbod en een lijst met links naar de centrale pagina's.
# Jouw bedrijf > Beschrijving in één zin. ## Belangrijke pagina's - [Product](https://jouw-domein.nl/product): … - [Prijzen](https://jouw-domein.nl/prijzen): … - [Over ons](https://jouw-domein.nl/over-ons): …
Vertrouwens- en entiteitssignalen (E-E-A-T)
Geen auteurs- of auteurschapssignaal
Er is geen auteur herkenbaar (geen metatag, geen rel=author, geen JSON-LD Person). Voor 'ervaring' en 'expertise' in E-E-A-T-zin telt een genoemd, navolgbaar auteurschap.
Dit zou je moeten doen: Noem bij redactionele inhoud een auteur met naam en link een auteurspagina; markeer die ook als JSON-LD 'Person'.
Geen sameAs-koppelingen
In de JSON-LD ontbreekt 'sameAs'. Daarmee koppelen AI-systemen je merk of persoon duidelijk aan bekende entiteiten (Wikidata, LinkedIn, branchegidsen).
Dit zou je moeten doen: Voeg in Organization of Person een 'sameAs' toe met de URL's van je officiële profielen en gidsvermeldingen.
Geen link naar colofon / over ons / contact
Op de gecontroleerde pagina is geen link naar een colofon, 'Over ons' of contact herkenbaar. Zulke pagina's zijn een sterk vertrouwenssignaal en helpen bij entiteitskoppeling.
Dit zou je moeten doen: Link het colofon of 'Over ons' en contact goed zichtbaar, meestal in de voettekst van elke pagina.
Geen zichtbare of gemarkeerde datum
Er is geen publicatie- of wijzigingsdatum herkenbaar (geen <time>, geen article:published_time, geen datePublished in de JSON-LD). Bij veel vragen geven AI-systemen de voorkeur aan actuele bronnen.
Dit zou je moeten doen: Toon bij inhoud met een tijdsaspect een datum zichtbaar en markeer datePublished / dateModified in de JSON-LD.
Technische basis
Geen sitemap.xml gevonden
Er was geen geldige XML-sitemap bereikbaar op /sitemap.xml en robots.txt noemt er geen. Een sitemap helpt crawlers alle relevante URL's te vinden.
Dit zou je moeten doen: Genereer een sitemap.xml met alle indexeerbare URL's en verwijs ernaar in robots.txt.
Geen canonieke URL
De pagina stelt geen <link rel="canonical"> in. Zonder canonical kan onduidelijk blijven welke versie leidend is als er meerdere URL-varianten bestaan.
Dit zou je moeten doen: Stel op elke pagina een zelfverwijzende <link rel="canonical"> in met de voorkeurs-URL.
In orde (2)
- Precies één H1-kop.
- Snelle reactietijd van de server.
Volgende stappen
- Zeer weinig tekst in de HTML. Zorg dat de eigenlijke inhoud volledig in de HTML staat en niet in afbeeldingen, iframes of via JavaScript geladen blokken.
- Geen gestructureerde data (JSON-LD). Voeg minstens een 'Organization'-schema toe en een schema dat bij het paginatype past (Article, Product, FAQPage …) als JSON-LD in de <head>.
- Paginatitel te kort of te lang. Schrijf een bondige titel met het onderwerp en, indien relevant, het merk.
Wekelijkse herscan met e-mailwaarschuwing bij elke wijziging. In voorbereiding — vul je adres in.
Methode en grenzen
Gecontroleerd op 4-9-2026. citeglass haalt example.com en de bijbehorende bestanden (robots.txt, llms.txt, sitemap.xml) via HTTP op — één keer als gewone browser, één keer per user agent van een AI-crawler. Er wordt geen JavaScript uitgevoerd. Tijd tot eerste byte: 12 ms.
Wat dit niet is: Geen positie- of citatiemonitoring, geen uitspraak of een model je daadwerkelijk noemt, en geen controle van inhoud die via JavaScript wordt geladen. Een momentopname vanuit het perspectief van één server-IP.