Português
citeglass · Verificação de visibilidade em IA

Verificado em 23/09/2026 · https://rehau-termopane.ro/

Há 1 bloqueios críticos para a descoberta por IA — corrija-os primeiro.

C
69 / 100
1 críticos · 0 a verificar

Matriz de rastreadores de IA

Por cada bot: o que o seu robots.txt permite — e o que o seu servidor devolve realmente ao agente de utilizador do bot. Linhas destacadas a vermelho: o robots permite, mas o servidor bloqueia (normalmente uma regra de WAF ou de proteção anti-bots).

BotOperadorrobots.txtResposta do servidor
GPTBotOpenAInão mencionadobloqueado (403 / WAF)
OAI-SearchBotOpenAInão mencionado200 + conteúdo
ChatGPT-UserOpenAInão mencionado200 + conteúdo
ClaudeBotAnthropicnão mencionado200 + conteúdo
Claude-SearchBotAnthropicnão mencionadoerro / tempo esgotado
Claude-UserAnthropicnão mencionado200 + conteúdo
PerplexityBotPerplexitynão mencionadoerro / tempo esgotado
Perplexity-UserPerplexitynão mencionadoerro / tempo esgotado
Google-ExtendedGoogle (Gemini-Training)não mencionado
GooglebotGoogle (KI-Übersichten)não mencionado200 + conteúdo
CCBotCommon Crawl (Trainingsdaten vieler LLMs)não mencionado200 + conteúdo
BytespiderByteDance (Doubao)não mencionado200 + conteúdo
AmazonbotAmazon (Alexa/Rufus)não mencionado200 + conteúdo
Applebot-ExtendedApple (Intelligence-Training)não mencionado
Meta-ExternalAgentMeta (Llama/Meta AI)não mencionadobloqueado (403 / WAF)
Como é calculada a pontuação?
O servidor bloqueia bots que o robots.txt permite-12
Sem llms.txt-5
Nenhum sitemap.xml encontrado-4
São saltados níveis de título-3
Sem ligações sameAs-3
Nenhum robots.txt encontrado-2
Sem marcação FAQ ou HowTo-2
Resultado69 / 100

Acesso para rastreadores de IA

crítico

O servidor bloqueia bots que o robots.txt permite

Para 2 bot(s) de OpenAI, Meta (Llama/Meta AI), o robots.txt diz «permitido», mas o servidor responde com um 403 ou uma página de proteção anti-bots. Normalmente uma regra de WAF, firewall ou CDN que exclui o rastreador contornando o robots.txt.

Isto é o que deve fazer: Adicione os agentes de utilizador e/ou intervalos de IP dos rastreadores de IA pretendidos a uma lista de permitidos no seu WAF / Cloudflare / firewall. Verifique-os por DNS inverso, não apenas pela cadeia de agente de utilizador.

nota

Nenhum robots.txt encontrado

Nenhum ficheiro válido estava acessível em /robots.txt. Os rastreadores assumem então «tudo permitido» — funciona, mas não tem controlo nem sinal de sitemap.

Isto é o que deve fazer: Crie um robots.txt na raiz, pelo menos com uma referência de sitemap e as suas regras allow/disallow pretendidas.

User-agent: *
Allow: /

Sitemap: https://o-seu-dominio.pt/sitemap.xml

Estrutura e compreensão pela máquina

nota

Sem llms.txt

Não há qualquer ficheiro em /llms.txt. O llms.txt é uma breve visão geral em Markdown dos seus conteúdos-chave que alguns sistemas de IA usam para se orientarem.

Isto é o que deve fazer: Crie um /llms.txt: um H1 com o nome, um parágrafo curto sobre a oferta e uma lista de ligações às páginas centrais.

# A sua empresa

> Descrição numa frase.

## Páginas-chave
- [Produto](https://o-seu-dominio.pt/produto): …
- [Preços](https://o-seu-dominio.pt/precos): …
- [Sobre](https://o-seu-dominio.pt/sobre): …
nota

São saltados níveis de título

A sequência de títulos salta pelo menos um nível (p. ex. H2 diretamente para H4). Isto dificulta a reconstrução automática da estrutura do conteúdo.

Isto é o que deve fazer: Use os níveis de título sem lacunas e por ordem (H1 → H2 → H3 …).

nota

Sem marcação FAQ ou HowTo

O conteúdo de pergunta-resposta e passo a passo é mais difícil de reconhecer como resposta diretamente citável para os sistemas de IA sem marcação FAQPage ou HowTo.

Isto é o que deve fazer: Onde a página responde a perguntas reais ou dá instruções, marque-a como FAQPage ou HowTo (sem marcação sem conteúdo visivelmente correspondente).

Sinais de confiança e de entidade (E-E-A-T)

nota

Sem ligações sameAs

No JSON-LD falta «sameAs». Permite aos sistemas de IA associar claramente a sua marca ou pessoa a entidades conhecidas (Wikidata, LinkedIn, diretórios do setor).

Isto é o que deve fazer: Adicione um «sameAs» em Organization ou Person com as URLs dos seus perfis oficiais e registos em diretórios.

Base técnica

nota

Nenhum sitemap.xml encontrado

Nenhum sitemap XML válido estava acessível em /sitemap.xml e o robots.txt não nomeia nenhum. Um sitemap ajuda os rastreadores a encontrar todas as URLs relevantes.

Isto é o que deve fazer: Gere um sitemap.xml com todas as URLs indexáveis e refira-o no robots.txt.

Conforme (8)
  • O conteúdo principal está no HTML sem JavaScript.
  • Existem dados estruturados (JSON-LD). — HomeAndConstructionBusiness, Organization, WebSite, ImageObject, WebPage, Person, Article, VideoObject
  • A organização está marcada como JSON-LD.
  • Exatamente um título H1.
  • Está definida uma URL canónica.
  • O título da página tem um comprimento razoável.
  • Existe um sinal de autoria.
  • Tempo de resposta do servidor rápido.

Próximos passos

  1. O servidor bloqueia bots que o robots.txt permite. Adicione os agentes de utilizador e/ou intervalos de IP dos rastreadores de IA pretendidos a uma lista de permitidos no seu WAF / Cloudflare / firewall. Verifique-os por DNS inverso, não apenas pela cadeia de agente de utilizador.
  2. Sem llms.txt. Crie um /llms.txt: um H1 com o nome, um parágrafo curto sobre a oferta e uma lista de ligações às páginas centrais.
  3. Nenhum sitemap.xml encontrado. Gere um sitemap.xml com todas as URLs indexáveis e refira-o no robots.txt.
Monitorizar esta página

Nova análise semanal com alerta por e-mail a cada alteração. Em preparação — introduza o seu endereço.

Método e limites

Verificado em 23/09/2026. O citeglass obtém rehau-termopane.ro e os ficheiros associados (robots.txt, llms.txt, sitemap.xml) via HTTP — uma vez como navegador normal, uma vez por cada agente de utilizador de rastreador de IA. Não é executado JavaScript. Tempo até ao primeiro byte: 774 ms.

O que isto não é: Nenhum acompanhamento de posições ou citações, nenhuma afirmação sobre se um modelo o nomeia realmente, e nenhuma verificação de conteúdo carregado via JavaScript. Um instantâneo do ponto de vista de um IP de servidor.

Verificar outro site