Vérifié le 16/09/2026 · https://www.i-puzzle.ro/
Aucun blocage dur, mais 1 points affaiblissent la découvrabilité IA.
Matrice des robots IA
Pour chaque robot : ce que votre robots.txt autorise — et ce que votre serveur renvoie réellement à l'agent utilisateur du robot. Lignes en rouge : robots l'autorise, mais le serveur le bloque (généralement une règle de WAF ou de protection anti-robots).
| Robot | Opérateur | robots.txt | Réponse du serveur |
|---|---|---|---|
| GPTBot | OpenAI | autorisé (via User-agent: *) | 200 + contenu |
| OAI-SearchBot | OpenAI | autorisé (via User-agent: *) | 200 + contenu |
| ChatGPT-User | OpenAI | autorisé (via User-agent: *) | 200 + contenu |
| ClaudeBot | Anthropic | autorisé (via User-agent: *) | 200 + contenu |
| Claude-SearchBot | Anthropic | autorisé (via User-agent: *) | 200 + contenu |
| Claude-User | Anthropic | autorisé (via User-agent: *) | 200 + contenu |
| PerplexityBot | Perplexity | autorisé (via User-agent: *) | 200 + contenu |
| Perplexity-User | Perplexity | autorisé (via User-agent: *) | 200 + contenu |
| Google-Extended | Google (Gemini-Training) | autorisé (via User-agent: *) | — |
| Googlebot | Google (KI-Übersichten) | autorisé (via User-agent: *) | 200 + contenu |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | autorisé (via User-agent: *) | 200 + contenu |
| Bytespider | ByteDance (Doubao) | autorisé (via User-agent: *) | 200 + contenu |
| Amazonbot | Amazon (Alexa/Rufus) | autorisé (via User-agent: *) | 200 + contenu |
| Applebot-Extended | Apple (Intelligence-Training) | autorisé (via User-agent: *) | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | autorisé (via User-agent: *) | 200 + contenu |
Comment la note est-elle calculée ?
| Titre de page trop court ou trop long | -6 |
| Aucun llms.txt | -5 |
| Aucun signal d'auteur | -4 |
| Aucun sitemap.xml trouvé | -4 |
| Des niveaux de titres sont sautés | -3 |
| Aucun lien vers mentions légales / à propos / contact | -3 |
| Aucune date visible ou balisée | -3 |
| Aucun balisage FAQ ou HowTo | -2 |
| Résultat | 70 / 100 |
Structure et compréhension machine
Titre de page trop court ou trop long
Le <title> fait 87 caractères. Environ 30 à 60 caractères sont raisonnables : assez descriptif pour nommer le sujet, assez court pour ne pas être tronqué.
Voici ce que vous devriez faire : Rédigez un titre concis contenant le sujet et, le cas échéant, la marque.
Aucun llms.txt
Il n'y a aucun fichier à /llms.txt. llms.txt est un court aperçu Markdown de vos contenus clés que certains systèmes IA utilisent pour s'orienter.
Voici ce que vous devriez faire : Créez un /llms.txt : un H1 avec le nom, un court paragraphe sur l'offre et une liste de liens vers les pages centrales.
# Votre entreprise > Description en une phrase. ## Pages clés - [Produit](https://votre-domaine.fr/produit) : … - [Tarifs](https://votre-domaine.fr/tarifs) : … - [À propos](https://votre-domaine.fr/a-propos) : …
Des niveaux de titres sont sautés
La suite des titres saute au moins un niveau (p. ex. H2 directement à H4). Cela complique la reconstruction automatique de la structure du contenu.
Voici ce que vous devriez faire : Utilisez les niveaux de titres sans lacune et dans l'ordre (H1 → H2 → H3 …).
Aucun balisage FAQ ou HowTo
Les contenus de type question-réponse et pas-à-pas sont plus difficiles à reconnaître comme réponses directement citables pour les systèmes IA sans balisage FAQPage ou HowTo.
Voici ce que vous devriez faire : Là où la page répond à de vraies questions ou donne des instructions, balisez-la en FAQPage ou HowTo (pas de balisage sans contenu visiblement correspondant).
Signaux de confiance et d'entité (E-E-A-T)
Aucun signal d'auteur
Aucun auteur n'est identifiable (ni méta-balise, ni rel=author, ni JSON-LD Person). Pour l'« expérience » et l'« expertise » au sens E-E-A-T, une paternité nommée et vérifiable compte.
Voici ce que vous devriez faire : Pour les contenus éditoriaux, nommez un auteur et liez une page auteur ; balisez-le aussi en JSON-LD « Person ».
Aucun lien vers mentions légales / à propos / contact
Aucun lien vers des mentions légales, une page « À propos » ou un contact n'est identifiable sur la page contrôlée. Ces pages sont un fort signal de confiance et aident au rattachement d'entité.
Voici ce que vous devriez faire : Liez les mentions légales ou « À propos » et le contact de façon visible, généralement dans le pied de page de chaque page.
Aucune date visible ou balisée
Aucune date de publication ou de modification n'est identifiable (ni <time>, ni article:published_time, ni datePublished dans le JSON-LD). Pour de nombreuses questions, les systèmes IA privilégient les sources récentes.
Voici ce que vous devriez faire : Pour les contenus datés, affichez une date visiblement et balisez datePublished / dateModified dans le JSON-LD.
Base technique
Aucun sitemap.xml trouvé
Aucun sitemap XML valide n'était accessible à /sitemap.xml et robots.txt n'en nomme aucun. Un sitemap aide les robots à trouver toutes les URL pertinentes.
Voici ce que vous devriez faire : Générez un sitemap.xml avec toutes les URL indexables et référencez-le dans robots.txt.
Conforme (6)
- Le contenu principal est dans le HTML sans JavaScript.
- Des données structurées (JSON-LD) sont présentes. — Organization, WebSite, Store
- L'organisation est balisée en JSON-LD.
- Exactement un titre H1.
- Une URL canonique est définie.
- Pas de noindex — la page peut être indexée.
Prochaines étapes
- Titre de page trop court ou trop long. Rédigez un titre concis contenant le sujet et, le cas échéant, la marque.
- Aucun llms.txt. Créez un /llms.txt : un H1 avec le nom, un court paragraphe sur l'offre et une liste de liens vers les pages centrales.
- Aucun signal d'auteur. Pour les contenus éditoriaux, nommez un auteur et liez une page auteur ; balisez-le aussi en JSON-LD « Person ».
Nouvelle analyse hebdomadaire avec alerte e-mail à chaque changement. En préparation — inscrivez votre adresse.
Méthode et limites
Vérifié le 16/09/2026. citeglass récupère i-puzzle.ro et ses fichiers associés (robots.txt, llms.txt, sitemap.xml) via HTTP — une fois comme navigateur normal, une fois par agent utilisateur de robot IA. Aucun JavaScript n'est exécuté. Temps jusqu'au premier octet : 1456 ms.
Ce que ce n'est pas : Pas de suivi de position ni de citation, aucune affirmation sur le fait qu'un modèle vous nomme réellement, et aucun contrôle du contenu chargé via JavaScript. Un instantané du point de vue d'une seule IP serveur.