Verificado em 24/09/2026 · https://www.heise.de/
Há 1 bloqueios críticos para a descoberta por IA — corrija-os primeiro.
Matriz de rastreadores de IA
Por cada bot: o que o seu robots.txt permite — e o que o seu servidor devolve realmente ao agente de utilizador do bot. Linhas destacadas a vermelho: o robots permite, mas o servidor bloqueia (normalmente uma regra de WAF ou de proteção anti-bots).
| Bot | Operador | robots.txt | Resposta do servidor |
|---|---|---|---|
| GPTBot | OpenAI | permitido | 200 + conteúdo |
| OAI-SearchBot | OpenAI | permitido | 200 + conteúdo |
| ChatGPT-User | OpenAI | permitido | 200 + conteúdo |
| ClaudeBot | Anthropic | permitido | 200 + conteúdo |
| Claude-SearchBot | Anthropic | permitido | 200 + conteúdo |
| Claude-User | Anthropic | permitido | 200 + conteúdo |
| PerplexityBot | Perplexity | permitido | 200 + conteúdo |
| Perplexity-User | Perplexity | permitido | 200 + conteúdo |
| Google-Extended | Google (Gemini-Training) | bloqueado | — |
| Googlebot | Google (KI-Übersichten) | permitido (via User-agent: *) | 200 + conteúdo |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | bloqueado | 200 + conteúdo |
| Bytespider | ByteDance (Doubao) | bloqueado | 200 + conteúdo |
| Amazonbot | Amazon (Alexa/Rufus) | bloqueado | 200 + conteúdo |
| Applebot-Extended | Apple (Intelligence-Training) | bloqueado | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | bloqueado | 200 + conteúdo |
Como é calculada a pontuação?
| Bots de pesquisa de IA bloqueados no robots.txt | -8 |
| Título da página demasiado curto ou demasiado longo | -6 |
| Não exatamente um título H1 | -5 |
| Sem llms.txt | -5 |
| Sem esquema Organization | -4 |
| Sem sinal de autor ou autoria | -4 |
| Sem ligações sameAs | -3 |
| Sem marcação FAQ ou HowTo | -2 |
| Resultado | 63 / 100 |
Acesso para rastreadores de IA
Bots de pesquisa de IA bloqueados no robots.txt
O seu robots.txt bloqueia 1 bots que obtêm conteúdo para respostas de assistentes de IA e motores de pesquisa: Google-Extended. Enquanto estiverem bloqueados, o seu site não pode aparecer lá como fonte.
Isto é o que deve fazer: Verifique para cada bot se o bloqueio é intencional. Se quiser excluir apenas o treino de IA, bloqueie os bots de treino (GPTBot, ClaudeBot, Google-Extended) e permita os bots de pesquisa.
Estrutura e compreensão pela máquina
Título da página demasiado curto ou demasiado longo
O <title> tem 67 caracteres. Cerca de 30 a 60 caracteres são razoáveis: descritivo o suficiente para nomear o tema, curto o suficiente para não ser cortado.
Isto é o que deve fazer: Escreva um título conciso que contenha o tema e, se pertinente, a marca.
Não exatamente um título H1
A página tem 0 títulos H1. Um H1 único e inequívoco indica a pessoas e máquinas o tema principal da página.
Isto é o que deve fazer: Defina exatamente um H1 que nomeie o tema principal da página. Tudo o resto começa em H2.
Sem llms.txt
Não há qualquer ficheiro em /llms.txt. O llms.txt é uma breve visão geral em Markdown dos seus conteúdos-chave que alguns sistemas de IA usam para se orientarem.
Isto é o que deve fazer: Crie um /llms.txt: um H1 com o nome, um parágrafo curto sobre a oferta e uma lista de ligações às páginas centrais.
# A sua empresa > Descrição numa frase. ## Páginas-chave - [Produto](https://o-seu-dominio.pt/produto): … - [Preços](https://o-seu-dominio.pt/precos): … - [Sobre](https://o-seu-dominio.pt/sobre): …
Sem esquema Organization
Há JSON-LD, mas nenhuma entrada «Organization». Os sistemas de IA situam então pior a sua marca como entidade distinta e ligam-na pior a fontes externas.
Isto é o que deve fazer: Adicione um esquema «Organization» com name, url, logo e sameAs (ligações aos seus perfis oficiais).
Sem marcação FAQ ou HowTo
O conteúdo de pergunta-resposta e passo a passo é mais difícil de reconhecer como resposta diretamente citável para os sistemas de IA sem marcação FAQPage ou HowTo.
Isto é o que deve fazer: Onde a página responde a perguntas reais ou dá instruções, marque-a como FAQPage ou HowTo (sem marcação sem conteúdo visivelmente correspondente).
Sinais de confiança e de entidade (E-E-A-T)
Sem sinal de autor ou autoria
Nenhum autor é reconhecível (nem meta tag, nem rel=author, nem JSON-LD Person). Para «experiência» e «perícia» no sentido E-E-A-T importa uma autoria nomeada e verificável.
Isto é o que deve fazer: Em conteúdos editoriais, nomeie um autor e ligue uma página de autor; marque-o também como JSON-LD «Person».
Sem ligações sameAs
No JSON-LD falta «sameAs». Permite aos sistemas de IA associar claramente a sua marca ou pessoa a entidades conhecidas (Wikidata, LinkedIn, diretórios do setor).
Isto é o que deve fazer: Adicione um «sameAs» em Organization ou Person com as URLs dos seus perfis oficiais e registos em diretórios.
Conforme (6)
- O conteúdo principal está no HTML sem JavaScript.
- Existem dados estruturados (JSON-LD). — ItemList, Thing
- Está definida uma URL canónica.
- O sitemap está acessível.
- Tempo de resposta do servidor rápido.
- Sem noindex — a página pode ser indexada.
Próximos passos
- Bots de pesquisa de IA bloqueados no robots.txt. Verifique para cada bot se o bloqueio é intencional. Se quiser excluir apenas o treino de IA, bloqueie os bots de treino (GPTBot, ClaudeBot, Google-Extended) e permita os bots de pesquisa.
- Título da página demasiado curto ou demasiado longo. Escreva um título conciso que contenha o tema e, se pertinente, a marca.
- Não exatamente um título H1. Defina exatamente um H1 que nomeie o tema principal da página. Tudo o resto começa em H2.
Nova análise semanal com alerta por e-mail a cada alteração. Em preparação — introduza o seu endereço.
Método e limites
Verificado em 24/09/2026. O citeglass obtém heise.de e os ficheiros associados (robots.txt, llms.txt, sitemap.xml) via HTTP — uma vez como navegador normal, uma vez por cada agente de utilizador de rastreador de IA. Não é executado JavaScript. Tempo até ao primeiro byte: 65 ms.
O que isto não é: Nenhum acompanhamento de posições ou citações, nenhuma afirmação sobre se um modelo o nomeia realmente, e nenhuma verificação de conteúdo carregado via JavaScript. Um instantâneo do ponto de vista de um IP de servidor.