Geprüft am 16.9.2026 · https://www.i-puzzle.ro/
Keine harten Blocker, aber 1 Punkte schwächen die KI-Auffindbarkeit.
KI-Crawler-Matrix
Je Bot: was deine robots.txt erlaubt — und was dein Server dem Bot-User-Agent wirklich zurückgibt. Rot hinterlegte Zeilen: robots erlaubt, aber der Server blockt (meist eine WAF- oder Bot-Schutz-Regel).
| Bot | Betreiber | robots.txt | Server-Antwort |
|---|---|---|---|
| GPTBot | OpenAI | erlaubt (über User-agent: *) | 200 + Inhalt |
| OAI-SearchBot | OpenAI | erlaubt (über User-agent: *) | 200 + Inhalt |
| ChatGPT-User | OpenAI | erlaubt (über User-agent: *) | 200 + Inhalt |
| ClaudeBot | Anthropic | erlaubt (über User-agent: *) | 200 + Inhalt |
| Claude-SearchBot | Anthropic | erlaubt (über User-agent: *) | 200 + Inhalt |
| Claude-User | Anthropic | erlaubt (über User-agent: *) | 200 + Inhalt |
| PerplexityBot | Perplexity | erlaubt (über User-agent: *) | 200 + Inhalt |
| Perplexity-User | Perplexity | erlaubt (über User-agent: *) | 200 + Inhalt |
| Google-Extended | Google (Gemini-Training) | erlaubt (über User-agent: *) | — |
| Googlebot | Google (KI-Übersichten) | erlaubt (über User-agent: *) | 200 + Inhalt |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | erlaubt (über User-agent: *) | 200 + Inhalt |
| Bytespider | ByteDance (Doubao) | erlaubt (über User-agent: *) | 200 + Inhalt |
| Amazonbot | Amazon (Alexa/Rufus) | erlaubt (über User-agent: *) | 200 + Inhalt |
| Applebot-Extended | Apple (Intelligence-Training) | erlaubt (über User-agent: *) | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | erlaubt (über User-agent: *) | 200 + Inhalt |
Wie kommt der Score zustande?
| Seitentitel zu kurz oder zu lang | -6 |
| Keine llms.txt | -5 |
| Kein Autoren- oder Urhebersignal | -4 |
| Keine sitemap.xml gefunden | -4 |
| Überschriften-Ebenen werden übersprungen | -3 |
| Kein Link zu Impressum / Über uns / Kontakt | -3 |
| Kein sichtbares oder ausgezeichnetes Datum | -3 |
| Kein FAQ- oder HowTo-Markup | -2 |
| Ergebnis | 70 / 100 |
Struktur & maschinelles Verständnis
Seitentitel zu kurz oder zu lang
Der <title> ist 87 Zeichen lang. Sinnvoll sind rund 30–60 Zeichen: aussagekräftig genug, um das Thema zu benennen, kurz genug, um nicht abgeschnitten zu werden.
Das solltest du tun: Formuliere einen prägnanten Titel, der Thema und ggf. Marke enthält.
Keine llms.txt
Unter /llms.txt liegt keine Datei. llms.txt ist eine kurze, in Markdown gehaltene Übersicht deiner wichtigsten Inhalte, die einige KI-Systeme zur Orientierung nutzen.
Das solltest du tun: Lege eine /llms.txt an: eine H1 mit dem Namen, ein kurzer Absatz zum Angebot und eine Linkliste zu den zentralen Seiten.
# Deine Firma > Kurzbeschreibung in einem Satz. ## Wichtige Seiten - [Produkt](https://deine-domain.de/produkt): … - [Preise](https://deine-domain.de/preise): … - [Über uns](https://deine-domain.de/ueber-uns): …
Überschriften-Ebenen werden übersprungen
In der Überschriften-Folge fehlt mindestens eine Ebene (z. B. H2 direkt auf H4). Das erschwert es, die inhaltliche Gliederung maschinell zu rekonstruieren.
Das solltest du tun: Nutze die Überschriften-Ebenen lückenlos und in Reihenfolge (H1 → H2 → H3 …).
Kein FAQ- oder HowTo-Markup
Frage-Antwort- und Schritt-für-Schritt-Inhalte sind ohne FAQPage- oder HowTo-Markup für KI-Systeme schwerer als direkt zitierfähige Antwort zu erkennen.
Das solltest du tun: Wo die Seite echte Fragen beantwortet oder Anleitungen gibt, zeichne sie als FAQPage bzw. HowTo aus (kein Markup ohne sichtbar passenden Inhalt).
Vertrauens- und Entitätssignale (E-E-A-T)
Kein Autoren- oder Urhebersignal
Es ist kein Autor erkennbar (weder Meta-Tag, rel=author noch JSON-LD Person). Für „Experience“ und „Expertise“ im E-E-A-T-Sinn ist eine benannte, nachvollziehbare Urheberschaft wichtig.
Das solltest du tun: Nenne bei redaktionellen Inhalten einen Autor mit Namen und verlinke eine Autorenseite; zeichne ihn zusätzlich als JSON-LD „Person“ aus.
Kein Link zu Impressum / Über uns / Kontakt
Auf der geprüften Seite ist kein Link zu Impressum, „Über uns“ oder Kontakt erkennbar. Solche Seiten sind ein starkes Vertrauenssignal (Trust) und helfen bei der Entitäts-Zuordnung.
Das solltest du tun: Verlinke Impressum bzw. „Über uns“ und Kontakt gut sichtbar, üblicherweise im Footer jeder Seite.
Kein sichtbares oder ausgezeichnetes Datum
Es ist kein Veröffentlichungs- oder Änderungsdatum erkennbar (weder <time>, article:published_time noch datePublished im JSON-LD). KI-Systeme bevorzugen bei vielen Fragen aktuelle Quellen.
Das solltest du tun: Zeige bei Inhalten mit zeitlichem Bezug ein Datum sichtbar an und zeichne datePublished / dateModified im JSON-LD aus.
Technische Basis
Keine sitemap.xml gefunden
Unter /sitemap.xml war keine gültige XML-Sitemap erreichbar und die robots.txt nennt keine. Eine Sitemap hilft Crawlern, alle relevanten URLs zu finden.
Das solltest du tun: Erzeuge eine sitemap.xml mit allen indexierbaren URLs und verweise in der robots.txt darauf.
In Ordnung (6)
- Der Hauptinhalt steht ohne JavaScript im HTML.
- Strukturierte Daten (JSON-LD) sind vorhanden. — Organization, WebSite, Store
- Organisation ist als JSON-LD ausgezeichnet.
- Genau eine H1-Überschrift.
- Canonical-URL ist gesetzt.
- Kein noindex — die Seite darf indexiert werden.
Nächste Schritte
- Seitentitel zu kurz oder zu lang. Formuliere einen prägnanten Titel, der Thema und ggf. Marke enthält.
- Keine llms.txt. Lege eine /llms.txt an: eine H1 mit dem Namen, ein kurzer Absatz zum Angebot und eine Linkliste zu den zentralen Seiten.
- Kein Autoren- oder Urhebersignal. Nenne bei redaktionellen Inhalten einen Autor mit Namen und verlinke eine Autorenseite; zeichne ihn zusätzlich als JSON-LD „Person“ aus.
Wöchentlicher Re-Scan mit E-Mail-Alarm bei jeder Änderung. In Vorbereitung — trag deine Adresse ein.
Methodik & Grenzen
Geprüft am 16.9.2026. citeglass ruft i-puzzle.ro und die zugehörigen Dateien (robots.txt, llms.txt, sitemap.xml) per HTTP ab — einmal als normaler Browser, einmal je KI-Crawler-User-Agent. Es wird kein JavaScript ausgeführt. Zeit bis zum ersten Byte: 1456 ms.
Was das nicht ist: Kein Rank- oder Zitat-Tracking, keine Aussage darüber, ob ein Modell dich tatsächlich nennt, und keine Prüfung von Inhalten, die erst per JavaScript nachgeladen werden. Eine Momentaufnahme aus Sicht einer Server-IP.