Gecontroleerd op 23-9-2026 · https://rehau-termopane.ro/
Er zijn 1 kritieke blokkades voor AI-vindbaarheid — los die eerst op.
AI-crawlermatrix
Per bot: wat je robots.txt toestaat — en wat je server daadwerkelijk teruggeeft aan de user agent van de bot. Rood gemarkeerde rijen: robots staat het toe, maar de server blokkeert het (meestal een WAF- of botbeschermingsregel).
| Bot | Beheerder | robots.txt | Serverreactie |
|---|---|---|---|
| GPTBot | OpenAI | niet genoemd | geblokkeerd (403 / WAF) |
| OAI-SearchBot | OpenAI | niet genoemd | 200 + inhoud |
| ChatGPT-User | OpenAI | niet genoemd | 200 + inhoud |
| ClaudeBot | Anthropic | niet genoemd | 200 + inhoud |
| Claude-SearchBot | Anthropic | niet genoemd | fout / time-out |
| Claude-User | Anthropic | niet genoemd | 200 + inhoud |
| PerplexityBot | Perplexity | niet genoemd | fout / time-out |
| Perplexity-User | Perplexity | niet genoemd | fout / time-out |
| Google-Extended | Google (Gemini-Training) | niet genoemd | — |
| Googlebot | Google (KI-Übersichten) | niet genoemd | 200 + inhoud |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | niet genoemd | 200 + inhoud |
| Bytespider | ByteDance (Doubao) | niet genoemd | 200 + inhoud |
| Amazonbot | Amazon (Alexa/Rufus) | niet genoemd | 200 + inhoud |
| Applebot-Extended | Apple (Intelligence-Training) | niet genoemd | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | niet genoemd | geblokkeerd (403 / WAF) |
Hoe komt de score tot stand?
| Server blokkeert bots hoewel robots.txt ze toestaat | -12 |
| Geen llms.txt | -5 |
| Geen sitemap.xml gevonden | -4 |
| Kopniveaus worden overgeslagen | -3 |
| Geen sameAs-koppelingen | -3 |
| Geen robots.txt gevonden | -2 |
| Geen FAQ- of HowTo-markup | -2 |
| Resultaat | 69 / 100 |
Toegang voor AI-crawlers
Server blokkeert bots hoewel robots.txt ze toestaat
Voor 2 bot(s) van OpenAI, Meta (Llama/Meta AI) zegt robots.txt 'toegestaan', maar de server antwoordt met een 403 of een botbeschermingspagina. Meestal een WAF-, firewall- of CDN-regel die de crawler buiten robots.txt om buitensluit.
Dit zou je moeten doen: Zet de user agents en/of IP-bereiken van de gewenste AI-crawlers op een toelatingslijst in je WAF / Cloudflare / firewall. Verifieer ze via reverse-DNS, niet alleen via de user-agentstring.
Geen robots.txt gevonden
Er was geen geldig bestand bereikbaar op /robots.txt. Crawlers gaan dan uit van 'alles toegestaan' — dat werkt, maar je hebt geen sturing en geen sitemapsignaal.
Dit zou je moeten doen: Maak een robots.txt in de rootmap, minimaal met een sitemapverwijzing en je gewenste allow-/disallowregels.
User-agent: * Allow: / Sitemap: https://jouw-domein.nl/sitemap.xml
Structuur en machinaal begrip
Geen llms.txt
Er staat geen bestand op /llms.txt. llms.txt is een kort Markdown-overzicht van je belangrijkste inhoud dat sommige AI-systemen gebruiken om zich te oriënteren.
Dit zou je moeten doen: Maak een /llms.txt: een H1 met de naam, een korte alinea over het aanbod en een lijst met links naar de centrale pagina's.
# Jouw bedrijf > Beschrijving in één zin. ## Belangrijke pagina's - [Product](https://jouw-domein.nl/product): … - [Prijzen](https://jouw-domein.nl/prijzen): … - [Over ons](https://jouw-domein.nl/over-ons): …
Kopniveaus worden overgeslagen
De koppenreeks slaat minstens één niveau over (bv. H2 direct naar H4). Dat maakt het lastiger de inhoudsstructuur automatisch te reconstrueren.
Dit zou je moeten doen: Gebruik de kopniveaus zonder gaten en op volgorde (H1 → H2 → H3 …).
Geen FAQ- of HowTo-markup
Vraag-antwoord- en stapsgewijze inhoud is voor AI-systemen zonder FAQPage- of HowTo-markup lastiger te herkennen als direct citeerbaar antwoord.
Dit zou je moeten doen: Waar de pagina echte vragen beantwoordt of instructies geeft, markeer die als FAQPage of HowTo (geen markup zonder zichtbaar passende inhoud).
Vertrouwens- en entiteitssignalen (E-E-A-T)
Geen sameAs-koppelingen
In de JSON-LD ontbreekt 'sameAs'. Daarmee koppelen AI-systemen je merk of persoon duidelijk aan bekende entiteiten (Wikidata, LinkedIn, branchegidsen).
Dit zou je moeten doen: Voeg in Organization of Person een 'sameAs' toe met de URL's van je officiële profielen en gidsvermeldingen.
Technische basis
Geen sitemap.xml gevonden
Er was geen geldige XML-sitemap bereikbaar op /sitemap.xml en robots.txt noemt er geen. Een sitemap helpt crawlers alle relevante URL's te vinden.
Dit zou je moeten doen: Genereer een sitemap.xml met alle indexeerbare URL's en verwijs ernaar in robots.txt.
In orde (8)
- De hoofdinhoud staat in de HTML zonder JavaScript.
- Er is gestructureerde data (JSON-LD). — HomeAndConstructionBusiness, Organization, WebSite, ImageObject, WebPage, Person, Article, VideoObject
- De organisatie is als JSON-LD gemarkeerd.
- Precies één H1-kop.
- Er is een canonieke URL ingesteld.
- De paginatitel heeft een zinvolle lengte.
- Er is een auteurssignaal aanwezig.
- Snelle reactietijd van de server.
Volgende stappen
- Server blokkeert bots hoewel robots.txt ze toestaat. Zet de user agents en/of IP-bereiken van de gewenste AI-crawlers op een toelatingslijst in je WAF / Cloudflare / firewall. Verifieer ze via reverse-DNS, niet alleen via de user-agentstring.
- Geen llms.txt. Maak een /llms.txt: een H1 met de naam, een korte alinea over het aanbod en een lijst met links naar de centrale pagina's.
- Geen sitemap.xml gevonden. Genereer een sitemap.xml met alle indexeerbare URL's en verwijs ernaar in robots.txt.
Wekelijkse herscan met e-mailwaarschuwing bij elke wijziging. In voorbereiding — vul je adres in.
Methode en grenzen
Gecontroleerd op 23-9-2026. citeglass haalt rehau-termopane.ro en de bijbehorende bestanden (robots.txt, llms.txt, sitemap.xml) via HTTP op — één keer als gewone browser, één keer per user agent van een AI-crawler. Er wordt geen JavaScript uitgevoerd. Tijd tot eerste byte: 774 ms.
Wat dit niet is: Geen positie- of citatiemonitoring, geen uitspraak of een model je daadwerkelijk noemt, en geen controle van inhoud die via JavaScript wordt geladen. Een momentopname vanuit het perspectief van één server-IP.