Français
citeglass · Contrôle de visibilité IA

Vérifié le 23/09/2026 · https://rehau-termopane.ro/

Il y a 1 blocages critiques pour la découvrabilité IA — corrigez-les en premier.

C
69 / 100
1 critiques · 0 à vérifier

Matrice des robots IA

Pour chaque robot : ce que votre robots.txt autorise — et ce que votre serveur renvoie réellement à l'agent utilisateur du robot. Lignes en rouge : robots l'autorise, mais le serveur le bloque (généralement une règle de WAF ou de protection anti-robots).

RobotOpérateurrobots.txtRéponse du serveur
GPTBotOpenAInon nommébloqué (403 / WAF)
OAI-SearchBotOpenAInon nommé200 + contenu
ChatGPT-UserOpenAInon nommé200 + contenu
ClaudeBotAnthropicnon nommé200 + contenu
Claude-SearchBotAnthropicnon nomméerreur / délai dépassé
Claude-UserAnthropicnon nommé200 + contenu
PerplexityBotPerplexitynon nomméerreur / délai dépassé
Perplexity-UserPerplexitynon nomméerreur / délai dépassé
Google-ExtendedGoogle (Gemini-Training)non nommé
GooglebotGoogle (KI-Übersichten)non nommé200 + contenu
CCBotCommon Crawl (Trainingsdaten vieler LLMs)non nommé200 + contenu
BytespiderByteDance (Doubao)non nommé200 + contenu
AmazonbotAmazon (Alexa/Rufus)non nommé200 + contenu
Applebot-ExtendedApple (Intelligence-Training)non nommé
Meta-ExternalAgentMeta (Llama/Meta AI)non nommébloqué (403 / WAF)
Comment la note est-elle calculée ?
Le serveur bloque des robots que robots.txt autorise-12
Aucun llms.txt-5
Aucun sitemap.xml trouvé-4
Des niveaux de titres sont sautés-3
Aucun lien sameAs-3
Aucun robots.txt trouvé-2
Aucun balisage FAQ ou HowTo-2
Résultat69 / 100

Accès pour les robots IA

critique

Le serveur bloque des robots que robots.txt autorise

Pour 2 robot(s) de OpenAI, Meta (Llama/Meta AI), robots.txt dit « autorisé », mais le serveur répond par un 403 ou une page de protection anti-robots. Généralement une règle de WAF, de pare-feu ou de CDN qui exclut le robot en contournant robots.txt.

Voici ce que vous devriez faire : Ajoutez les agents utilisateurs et/ou plages IP des robots IA souhaités à une liste d'autorisation dans votre WAF / Cloudflare / pare-feu. Vérifiez-les par résolution DNS inverse, pas seulement par la chaîne d'agent utilisateur.

remarque

Aucun robots.txt trouvé

Aucun fichier valide n'était accessible à /robots.txt. Les robots supposent alors « tout autorisé » — cela fonctionne, mais vous n'avez aucun contrôle ni signal de sitemap.

Voici ce que vous devriez faire : Créez un robots.txt à la racine, au minimum avec une référence de sitemap et vos règles allow/disallow souhaitées.

User-agent: *
Allow: /

Sitemap: https://votre-domaine.fr/sitemap.xml

Structure et compréhension machine

remarque

Aucun llms.txt

Il n'y a aucun fichier à /llms.txt. llms.txt est un court aperçu Markdown de vos contenus clés que certains systèmes IA utilisent pour s'orienter.

Voici ce que vous devriez faire : Créez un /llms.txt : un H1 avec le nom, un court paragraphe sur l'offre et une liste de liens vers les pages centrales.

# Votre entreprise

> Description en une phrase.

## Pages clés
- [Produit](https://votre-domaine.fr/produit) : …
- [Tarifs](https://votre-domaine.fr/tarifs) : …
- [À propos](https://votre-domaine.fr/a-propos) : …
remarque

Des niveaux de titres sont sautés

La suite des titres saute au moins un niveau (p. ex. H2 directement à H4). Cela complique la reconstruction automatique de la structure du contenu.

Voici ce que vous devriez faire : Utilisez les niveaux de titres sans lacune et dans l'ordre (H1 → H2 → H3 …).

remarque

Aucun balisage FAQ ou HowTo

Les contenus de type question-réponse et pas-à-pas sont plus difficiles à reconnaître comme réponses directement citables pour les systèmes IA sans balisage FAQPage ou HowTo.

Voici ce que vous devriez faire : Là où la page répond à de vraies questions ou donne des instructions, balisez-la en FAQPage ou HowTo (pas de balisage sans contenu visiblement correspondant).

Signaux de confiance et d'entité (E-E-A-T)

remarque

Aucun lien sameAs

Le JSON-LD ne comporte pas de « sameAs ». Il permet aux systèmes IA de rattacher clairement votre marque ou personne à des entités connues (Wikidata, LinkedIn, annuaires professionnels).

Voici ce que vous devriez faire : Ajoutez un « sameAs » dans Organization ou Person avec les URL de vos profils officiels et fiches d'annuaire.

Base technique

remarque

Aucun sitemap.xml trouvé

Aucun sitemap XML valide n'était accessible à /sitemap.xml et robots.txt n'en nomme aucun. Un sitemap aide les robots à trouver toutes les URL pertinentes.

Voici ce que vous devriez faire : Générez un sitemap.xml avec toutes les URL indexables et référencez-le dans robots.txt.

Conforme (8)
  • Le contenu principal est dans le HTML sans JavaScript.
  • Des données structurées (JSON-LD) sont présentes. — HomeAndConstructionBusiness, Organization, WebSite, ImageObject, WebPage, Person, Article, VideoObject
  • L'organisation est balisée en JSON-LD.
  • Exactement un titre H1.
  • Une URL canonique est définie.
  • Le titre de la page a une longueur raisonnable.
  • Un signal d'auteur est présent.
  • Temps de réponse du serveur rapide.

Prochaines étapes

  1. Le serveur bloque des robots que robots.txt autorise. Ajoutez les agents utilisateurs et/ou plages IP des robots IA souhaités à une liste d'autorisation dans votre WAF / Cloudflare / pare-feu. Vérifiez-les par résolution DNS inverse, pas seulement par la chaîne d'agent utilisateur.
  2. Aucun llms.txt. Créez un /llms.txt : un H1 avec le nom, un court paragraphe sur l'offre et une liste de liens vers les pages centrales.
  3. Aucun sitemap.xml trouvé. Générez un sitemap.xml avec toutes les URL indexables et référencez-le dans robots.txt.
Surveiller cette page

Nouvelle analyse hebdomadaire avec alerte e-mail à chaque changement. En préparation — inscrivez votre adresse.

Méthode et limites

Vérifié le 23/09/2026. citeglass récupère rehau-termopane.ro et ses fichiers associés (robots.txt, llms.txt, sitemap.xml) via HTTP — une fois comme navigateur normal, une fois par agent utilisateur de robot IA. Aucun JavaScript n'est exécuté. Temps jusqu'au premier octet : 774 ms.

Ce que ce n'est pas : Pas de suivi de position ni de citation, aucune affirmation sur le fait qu'un modèle vous nomme réellement, et aucun contrôle du contenu chargé via JavaScript. Un instantané du point de vue d'une seule IP serveur.

Vérifier un autre site