Vérifié le 04/09/2026 · https://example.com/
Aucun blocage dur, mais 4 points affaiblissent la découvrabilité IA.
Matrice des robots IA
Pour chaque robot : ce que votre robots.txt autorise — et ce que votre serveur renvoie réellement à l'agent utilisateur du robot. Lignes en rouge : robots l'autorise, mais le serveur le bloque (généralement une règle de WAF ou de protection anti-robots).
| Robot | Opérateur | robots.txt | Réponse du serveur |
|---|---|---|---|
| GPTBot | OpenAI | non nommé | 200 + contenu |
| OAI-SearchBot | OpenAI | non nommé | 200 + contenu |
| ChatGPT-User | OpenAI | non nommé | 200 + contenu |
| ClaudeBot | Anthropic | non nommé | 200 + contenu |
| Claude-SearchBot | Anthropic | non nommé | 200 + contenu |
| Claude-User | Anthropic | non nommé | 200 + contenu |
| PerplexityBot | Perplexity | non nommé | 200 + contenu |
| Perplexity-User | Perplexity | non nommé | 200 + contenu |
| Google-Extended | Google (Gemini-Training) | non nommé | — |
| Googlebot | Google (KI-Übersichten) | non nommé | 200 + contenu |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | non nommé | 200 + contenu |
| Bytespider | ByteDance (Doubao) | non nommé | 200 + contenu |
| Amazonbot | Amazon (Alexa/Rufus) | non nommé | 200 + contenu |
| Applebot-Extended | Apple (Intelligence-Training) | non nommé | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | non nommé | 200 + contenu |
Comment la note est-elle calculée ?
| Très peu de texte dans le HTML | -10 |
| Aucune donnée structurée (JSON-LD) | -8 |
| Titre de page trop court ou trop long | -6 |
| Méta-description absente ou inadaptée | -5 |
| Aucun llms.txt | -5 |
| Aucun signal d'auteur | -4 |
| Aucun sitemap.xml trouvé | -4 |
| Aucun lien sameAs | -3 |
| Aucun lien vers mentions légales / à propos / contact | -3 |
| Aucune date visible ou balisée | -3 |
| Aucune URL canonique | -3 |
| Aucun robots.txt trouvé | -2 |
| Résultat | 44 / 100 |
Accès pour les robots IA
Aucun robots.txt trouvé
Aucun fichier valide n'était accessible à /robots.txt. Les robots supposent alors « tout autorisé » — cela fonctionne, mais vous n'avez aucun contrôle ni signal de sitemap.
Voici ce que vous devriez faire : Créez un robots.txt à la racine, au minimum avec une référence de sitemap et vos règles allow/disallow souhaitées.
User-agent: * Allow: / Sitemap: https://votre-domaine.fr/sitemap.xml
Contenu sans JavaScript
Très peu de texte dans le HTML
Le HTML initial ne contient qu'environ 142 caractères de texte visible. C'est à peine suffisant pour que les systèmes IA saisissent le sujet de la page avec certitude.
Voici ce que vous devriez faire : Assurez-vous que le contenu réel figure entièrement dans le HTML et non dans des images, des iframes ou des blocs chargés via JavaScript.
Structure et compréhension machine
Aucune donnée structurée (JSON-LD)
La page ne contient aucun JSON-LD. Les données structurées aident les systèmes IA à reconnaître sans ambiguïté les entités, l'auteur, l'organisation, la date et le type de page — sans elles, tout doit être deviné à partir du texte.
Voici ce que vous devriez faire : Ajoutez au moins un schéma « Organization » et un schéma adapté au type de page (Article, Product, FAQPage …) en JSON-LD dans le <head>.
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"Votre entreprise","url":"https://votre-domaine.fr",
"sameAs":["https://www.linkedin.com/company/…"]}
</script>Titre de page trop court ou trop long
Le <title> fait 14 caractères. Environ 30 à 60 caractères sont raisonnables : assez descriptif pour nommer le sujet, assez court pour ne pas être tronqué.
Voici ce que vous devriez faire : Rédigez un titre concis contenant le sujet et, le cas échéant, la marque.
Méta-description absente ou inadaptée
La méta-description fait 0 caractères. C'est souvent la première chose que les systèmes IA et les moteurs de recherche lisent comme résumé de la page.
Voici ce que vous devriez faire : Rédigez un résumé autonome de la page en une ou deux phrases (environ 120 à 200 caractères), pas une suite de mots-clés.
Aucun llms.txt
Il n'y a aucun fichier à /llms.txt. llms.txt est un court aperçu Markdown de vos contenus clés que certains systèmes IA utilisent pour s'orienter.
Voici ce que vous devriez faire : Créez un /llms.txt : un H1 avec le nom, un court paragraphe sur l'offre et une liste de liens vers les pages centrales.
# Votre entreprise > Description en une phrase. ## Pages clés - [Produit](https://votre-domaine.fr/produit) : … - [Tarifs](https://votre-domaine.fr/tarifs) : … - [À propos](https://votre-domaine.fr/a-propos) : …
Signaux de confiance et d'entité (E-E-A-T)
Aucun signal d'auteur
Aucun auteur n'est identifiable (ni méta-balise, ni rel=author, ni JSON-LD Person). Pour l'« expérience » et l'« expertise » au sens E-E-A-T, une paternité nommée et vérifiable compte.
Voici ce que vous devriez faire : Pour les contenus éditoriaux, nommez un auteur et liez une page auteur ; balisez-le aussi en JSON-LD « Person ».
Aucun lien sameAs
Le JSON-LD ne comporte pas de « sameAs ». Il permet aux systèmes IA de rattacher clairement votre marque ou personne à des entités connues (Wikidata, LinkedIn, annuaires professionnels).
Voici ce que vous devriez faire : Ajoutez un « sameAs » dans Organization ou Person avec les URL de vos profils officiels et fiches d'annuaire.
Aucun lien vers mentions légales / à propos / contact
Aucun lien vers des mentions légales, une page « À propos » ou un contact n'est identifiable sur la page contrôlée. Ces pages sont un fort signal de confiance et aident au rattachement d'entité.
Voici ce que vous devriez faire : Liez les mentions légales ou « À propos » et le contact de façon visible, généralement dans le pied de page de chaque page.
Aucune date visible ou balisée
Aucune date de publication ou de modification n'est identifiable (ni <time>, ni article:published_time, ni datePublished dans le JSON-LD). Pour de nombreuses questions, les systèmes IA privilégient les sources récentes.
Voici ce que vous devriez faire : Pour les contenus datés, affichez une date visiblement et balisez datePublished / dateModified dans le JSON-LD.
Base technique
Aucun sitemap.xml trouvé
Aucun sitemap XML valide n'était accessible à /sitemap.xml et robots.txt n'en nomme aucun. Un sitemap aide les robots à trouver toutes les URL pertinentes.
Voici ce que vous devriez faire : Générez un sitemap.xml avec toutes les URL indexables et référencez-le dans robots.txt.
Aucune URL canonique
La page ne définit pas de <link rel="canonical">. Sans canonical, il peut rester ambigu de savoir quelle version fait autorité lorsque plusieurs variantes d'URL existent.
Voici ce que vous devriez faire : Définissez un <link rel="canonical"> autoréférent avec l'URL préférée sur chaque page.
Conforme (2)
- Exactement un titre H1.
- Temps de réponse du serveur rapide.
Prochaines étapes
- Très peu de texte dans le HTML. Assurez-vous que le contenu réel figure entièrement dans le HTML et non dans des images, des iframes ou des blocs chargés via JavaScript.
- Aucune donnée structurée (JSON-LD). Ajoutez au moins un schéma « Organization » et un schéma adapté au type de page (Article, Product, FAQPage …) en JSON-LD dans le <head>.
- Titre de page trop court ou trop long. Rédigez un titre concis contenant le sujet et, le cas échéant, la marque.
Nouvelle analyse hebdomadaire avec alerte e-mail à chaque changement. En préparation — inscrivez votre adresse.
Méthode et limites
Vérifié le 04/09/2026. citeglass récupère example.com et ses fichiers associés (robots.txt, llms.txt, sitemap.xml) via HTTP — une fois comme navigateur normal, une fois par agent utilisateur de robot IA. Aucun JavaScript n'est exécuté. Temps jusqu'au premier octet : 12 ms.
Ce que ce n'est pas : Pas de suivi de position ni de citation, aucune affirmation sur le fait qu'un modèle vous nomme réellement, et aucun contrôle du contenu chargé via JavaScript. Un instantané du point de vue d'une seule IP serveur.