Español
citeglass · Comprobación de visibilidad en IA

Comprobado el 14/9/2026 · https://www.eureko.sk/

Hay 1 bloqueos críticos para la localización por IA — corrígelos primero.

F
24 / 100
1 críticos · 4 por revisar

Nada ha cambiado desde el último análisis de esta URL.

Matriz de rastreadores de IA

Por cada bot: qué permite tu robots.txt — y qué devuelve realmente tu servidor al agente de usuario del bot. Filas resaltadas en rojo: robots lo permite, pero el servidor lo bloquea (normalmente una regla de WAF o de protección anti-bots).

BotOperadorrobots.txtRespuesta del servidor
GPTBotOpenAIno mencionadobloqueado (403 / WAF)
OAI-SearchBotOpenAIno mencionadobloqueado (403 / WAF)
ChatGPT-UserOpenAIno mencionadobloqueado (403 / WAF)
ClaudeBotAnthropicno mencionadobloqueado (403 / WAF)
Claude-SearchBotAnthropicno mencionadobloqueado (403 / WAF)
Claude-UserAnthropicno mencionadobloqueado (403 / WAF)
PerplexityBotPerplexityno mencionadobloqueado (403 / WAF)
Perplexity-UserPerplexityno mencionadobloqueado (403 / WAF)
Google-ExtendedGoogle (Gemini-Training)no mencionado
GooglebotGoogle (KI-Übersichten)no mencionadobloqueado (403 / WAF)
CCBotCommon Crawl (Trainingsdaten vieler LLMs)no mencionadobloqueado (403 / WAF)
BytespiderByteDance (Doubao)no mencionadobloqueado (403 / WAF)
AmazonbotAmazon (Alexa/Rufus)no mencionadobloqueado (403 / WAF)
Applebot-ExtendedApple (Intelligence-Training)no mencionado
Meta-ExternalAgentMeta (Llama/Meta AI)no mencionadobloqueado (403 / WAF)
¿Cómo se calcula la puntuación?
El servidor bloquea bots aunque robots.txt los permite-20
Muy poco texto en el HTML-10
Sin datos estructurados (JSON-LD)-8
Título de página demasiado corto o largo-6
Meta descripción ausente o inadecuada-5
Sin llms.txt-5
Sin señal de autor o autoría-4
No se encontró sitemap.xml-4
Sin enlaces sameAs-3
Sin enlace a aviso legal / quiénes somos / contacto-3
Sin fecha visible ni marcada-3
Sin URL canónica-3
No se encontró robots.txt-2
Resultado24 / 100

Acceso para rastreadores de IA

crítico

El servidor bloquea bots aunque robots.txt los permite

Para 13 bot(s) de OpenAI, Anthropic, Perplexity, Google (KI-Übersichten), Common Crawl (Trainingsdaten vieler LLMs), ByteDance (Doubao), Amazon (Alexa/Rufus), Meta (Llama/Meta AI), robots.txt dice «permitido», pero el servidor responde con un 403 o una página de protección anti-bots. Suele ser una regla de WAF, cortafuegos o CDN que excluye al rastreador saltándose robots.txt.

Esto es lo que deberías hacer: Añade los agentes de usuario o rangos de IP de los rastreadores de IA deseados a una lista de permitidos en tu WAF / Cloudflare / cortafuegos. Verifícalos por DNS inverso, no solo por la cadena de agente de usuario.

aviso

No se encontró robots.txt

No había ningún archivo válido accesible en /robots.txt. Los rastreadores asumen entonces «todo permitido» — funciona, pero no tienes control ni señal de sitemap.

Esto es lo que deberías hacer: Crea un robots.txt en la raíz, al menos con una referencia de sitemap y tus reglas allow/disallow deseadas.

User-agent: *
Allow: /

Sitemap: https://tu-dominio.es/sitemap.xml

Contenido sin JavaScript

por revisar

Muy poco texto en el HTML

El HTML inicial solo contiene unos 40 caracteres de texto visible. Es apenas suficiente para que los sistemas de IA capten el tema de la página con seguridad.

Esto es lo que deberías hacer: Asegúrate de que el contenido real esté completo en el HTML y no en imágenes, iframes o bloques cargados mediante JavaScript.

Estructura y comprensión por la máquina

por revisar

Sin datos estructurados (JSON-LD)

La página no contiene JSON-LD. Los datos estructurados ayudan a los sistemas de IA a reconocer sin ambigüedad entidades, autor, organización, fecha y tipo de página — sin ellos, todo debe deducirse del texto.

Esto es lo que deberías hacer: Añade al menos un esquema «Organization» y uno acorde al tipo de página (Article, Product, FAQPage …) como JSON-LD en el <head>.

<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
 "name":"Tu empresa","url":"https://tu-dominio.es",
 "sameAs":["https://www.linkedin.com/company/…"]}
</script>
por revisar

Título de página demasiado corto o largo

El <title> tiene 13 caracteres. Unos 30 a 60 caracteres son razonables: lo bastante descriptivo para nombrar el tema, lo bastante corto para no cortarse.

Esto es lo que deberías hacer: Redacta un título conciso que contenga el tema y, si procede, la marca.

por revisar

Meta descripción ausente o inadecuada

La meta descripción tiene 0 caracteres. Suele ser lo primero que los sistemas de IA y los buscadores leen como resumen de la página.

Esto es lo que deberías hacer: Redacta un resumen autónomo de la página en una o dos frases (unos 120 a 200 caracteres), no una lista de palabras clave.

aviso

Sin llms.txt

No hay ningún archivo en /llms.txt. llms.txt es un breve resumen en Markdown de tus contenidos clave que algunos sistemas de IA usan para orientarse.

Esto es lo que deberías hacer: Crea un /llms.txt: un H1 con el nombre, un párrafo corto sobre la oferta y una lista de enlaces a las páginas centrales.

# Tu empresa

> Descripción en una frase.

## Páginas clave
- [Producto](https://tu-dominio.es/producto): …
- [Precios](https://tu-dominio.es/precios): …
- [Quiénes somos](https://tu-dominio.es/quienes-somos): …

Señales de confianza y de entidad (E-E-A-T)

aviso

Sin señal de autor o autoría

No hay autor reconocible (ni meta etiqueta, ni rel=author, ni JSON-LD Person). Para la «experiencia» y la «pericia» en el sentido E-E-A-T importa una autoría nombrada y verificable.

Esto es lo que deberías hacer: En contenidos editoriales, nombra a un autor y enlaza una página de autor; márcalo también como JSON-LD «Person».

aviso

Sin enlaces sameAs

En el JSON-LD falta «sameAs». Permite a los sistemas de IA asignar claramente tu marca o persona a entidades conocidas (Wikidata, LinkedIn, directorios sectoriales).

Esto es lo que deberías hacer: Añade un «sameAs» en Organization o Person con las URL de tus perfiles oficiales y fichas de directorio.

aviso

Sin enlace a aviso legal / quiénes somos / contacto

No se reconoce ningún enlace a un aviso legal, una página «Quiénes somos» o un contacto en la página comprobada. Esas páginas son una fuerte señal de confianza y ayudan a la asignación de entidad.

Esto es lo que deberías hacer: Enlaza el aviso legal o «Quiénes somos» y el contacto de forma visible, normalmente en el pie de cada página.

aviso

Sin fecha visible ni marcada

No hay fecha de publicación ni de modificación reconocible (ni <time>, ni article:published_time, ni datePublished en el JSON-LD). Para muchas preguntas, los sistemas de IA prefieren fuentes actuales.

Esto es lo que deberías hacer: En contenidos con referencia temporal, muestra una fecha visiblemente y marca datePublished / dateModified en el JSON-LD.

Base técnica

aviso

No se encontró sitemap.xml

No había ningún sitemap XML válido accesible en /sitemap.xml y robots.txt no menciona ninguno. Un sitemap ayuda a los rastreadores a encontrar todas las URL relevantes.

Esto es lo que deberías hacer: Genera un sitemap.xml con todas las URL indexables y refiérelo en robots.txt.

aviso

Sin URL canónica

La página no define un <link rel="canonical">. Sin canonical puede quedar poco claro qué versión es la de referencia cuando existen varias variantes de URL.

Esto es lo que deberías hacer: Define un <link rel="canonical"> autorreferente con la URL preferida en cada página.

Correcto (2)
  • Exactamente un encabezado H1.
  • Tiempo de respuesta del servidor rápido.

Próximos pasos

  1. El servidor bloquea bots aunque robots.txt los permite. Añade los agentes de usuario o rangos de IP de los rastreadores de IA deseados a una lista de permitidos en tu WAF / Cloudflare / cortafuegos. Verifícalos por DNS inverso, no solo por la cadena de agente de usuario.
  2. Muy poco texto en el HTML. Asegúrate de que el contenido real esté completo en el HTML y no en imágenes, iframes o bloques cargados mediante JavaScript.
  3. Sin datos estructurados (JSON-LD). Añade al menos un esquema «Organization» y uno acorde al tipo de página (Article, Product, FAQPage …) como JSON-LD en el <head>.
Supervisar esta página

Reanálisis semanal con aviso por correo ante cada cambio. En preparación — apunta tu dirección.

Método y límites

Comprobado el 14/9/2026. citeglass obtiene eureko.sk y sus archivos asociados (robots.txt, llms.txt, sitemap.xml) por HTTP — una vez como navegador normal, una vez por cada agente de usuario de rastreador de IA. No se ejecuta JavaScript. Tiempo hasta el primer byte: 257 ms.

Lo que esto no es: Ningún seguimiento de posiciones ni de citas, ninguna afirmación sobre si un modelo te nombra realmente, y ninguna comprobación de contenido cargado mediante JavaScript. Una instantánea desde la perspectiva de una IP de servidor.

Comprobar otra web