Comprobado el 16/9/2026 · https://www.i-puzzle.ro/
Sin bloqueos duros, pero 1 puntos debilitan la localización por IA.
Matriz de rastreadores de IA
Por cada bot: qué permite tu robots.txt — y qué devuelve realmente tu servidor al agente de usuario del bot. Filas resaltadas en rojo: robots lo permite, pero el servidor lo bloquea (normalmente una regla de WAF o de protección anti-bots).
| Bot | Operador | robots.txt | Respuesta del servidor |
|---|---|---|---|
| GPTBot | OpenAI | permitido (vía User-agent: *) | 200 + contenido |
| OAI-SearchBot | OpenAI | permitido (vía User-agent: *) | 200 + contenido |
| ChatGPT-User | OpenAI | permitido (vía User-agent: *) | 200 + contenido |
| ClaudeBot | Anthropic | permitido (vía User-agent: *) | 200 + contenido |
| Claude-SearchBot | Anthropic | permitido (vía User-agent: *) | 200 + contenido |
| Claude-User | Anthropic | permitido (vía User-agent: *) | 200 + contenido |
| PerplexityBot | Perplexity | permitido (vía User-agent: *) | 200 + contenido |
| Perplexity-User | Perplexity | permitido (vía User-agent: *) | 200 + contenido |
| Google-Extended | Google (Gemini-Training) | permitido (vía User-agent: *) | — |
| Googlebot | Google (KI-Übersichten) | permitido (vía User-agent: *) | 200 + contenido |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | permitido (vía User-agent: *) | 200 + contenido |
| Bytespider | ByteDance (Doubao) | permitido (vía User-agent: *) | 200 + contenido |
| Amazonbot | Amazon (Alexa/Rufus) | permitido (vía User-agent: *) | 200 + contenido |
| Applebot-Extended | Apple (Intelligence-Training) | permitido (vía User-agent: *) | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | permitido (vía User-agent: *) | 200 + contenido |
¿Cómo se calcula la puntuación?
| Título de página demasiado corto o largo | -6 |
| Sin llms.txt | -5 |
| Sin señal de autor o autoría | -4 |
| No se encontró sitemap.xml | -4 |
| Se saltan niveles de encabezado | -3 |
| Sin enlace a aviso legal / quiénes somos / contacto | -3 |
| Sin fecha visible ni marcada | -3 |
| Sin marcado FAQ o HowTo | -2 |
| Resultado | 70 / 100 |
Estructura y comprensión por la máquina
Título de página demasiado corto o largo
El <title> tiene 87 caracteres. Unos 30 a 60 caracteres son razonables: lo bastante descriptivo para nombrar el tema, lo bastante corto para no cortarse.
Esto es lo que deberías hacer: Redacta un título conciso que contenga el tema y, si procede, la marca.
Sin llms.txt
No hay ningún archivo en /llms.txt. llms.txt es un breve resumen en Markdown de tus contenidos clave que algunos sistemas de IA usan para orientarse.
Esto es lo que deberías hacer: Crea un /llms.txt: un H1 con el nombre, un párrafo corto sobre la oferta y una lista de enlaces a las páginas centrales.
# Tu empresa > Descripción en una frase. ## Páginas clave - [Producto](https://tu-dominio.es/producto): … - [Precios](https://tu-dominio.es/precios): … - [Quiénes somos](https://tu-dominio.es/quienes-somos): …
Se saltan niveles de encabezado
La secuencia de encabezados salta al menos un nivel (p. ej. H2 directamente a H4). Esto dificulta reconstruir automáticamente la estructura del contenido.
Esto es lo que deberías hacer: Usa los niveles de encabezado sin huecos y en orden (H1 → H2 → H3 …).
Sin marcado FAQ o HowTo
El contenido de preguntas y respuestas y de paso a paso es más difícil de reconocer como respuesta directamente citable para los sistemas de IA sin marcado FAQPage o HowTo.
Esto es lo que deberías hacer: Donde la página responda preguntas reales o dé instrucciones, márcala como FAQPage o HowTo (sin marcado sin contenido visiblemente correspondiente).
Señales de confianza y de entidad (E-E-A-T)
Sin señal de autor o autoría
No hay autor reconocible (ni meta etiqueta, ni rel=author, ni JSON-LD Person). Para la «experiencia» y la «pericia» en el sentido E-E-A-T importa una autoría nombrada y verificable.
Esto es lo que deberías hacer: En contenidos editoriales, nombra a un autor y enlaza una página de autor; márcalo también como JSON-LD «Person».
Sin enlace a aviso legal / quiénes somos / contacto
No se reconoce ningún enlace a un aviso legal, una página «Quiénes somos» o un contacto en la página comprobada. Esas páginas son una fuerte señal de confianza y ayudan a la asignación de entidad.
Esto es lo que deberías hacer: Enlaza el aviso legal o «Quiénes somos» y el contacto de forma visible, normalmente en el pie de cada página.
Sin fecha visible ni marcada
No hay fecha de publicación ni de modificación reconocible (ni <time>, ni article:published_time, ni datePublished en el JSON-LD). Para muchas preguntas, los sistemas de IA prefieren fuentes actuales.
Esto es lo que deberías hacer: En contenidos con referencia temporal, muestra una fecha visiblemente y marca datePublished / dateModified en el JSON-LD.
Base técnica
No se encontró sitemap.xml
No había ningún sitemap XML válido accesible en /sitemap.xml y robots.txt no menciona ninguno. Un sitemap ayuda a los rastreadores a encontrar todas las URL relevantes.
Esto es lo que deberías hacer: Genera un sitemap.xml con todas las URL indexables y refiérelo en robots.txt.
Correcto (6)
- El contenido principal está en el HTML sin JavaScript.
- Hay datos estructurados (JSON-LD). — Organization, WebSite, Store
- La organización está marcada como JSON-LD.
- Exactamente un encabezado H1.
- Hay una URL canónica definida.
- Sin noindex — la página puede indexarse.
Próximos pasos
- Título de página demasiado corto o largo. Redacta un título conciso que contenga el tema y, si procede, la marca.
- Sin llms.txt. Crea un /llms.txt: un H1 con el nombre, un párrafo corto sobre la oferta y una lista de enlaces a las páginas centrales.
- Sin señal de autor o autoría. En contenidos editoriales, nombra a un autor y enlaza una página de autor; márcalo también como JSON-LD «Person».
Reanálisis semanal con aviso por correo ante cada cambio. En preparación — apunta tu dirección.
Método y límites
Comprobado el 16/9/2026. citeglass obtiene i-puzzle.ro y sus archivos asociados (robots.txt, llms.txt, sitemap.xml) por HTTP — una vez como navegador normal, una vez por cada agente de usuario de rastreador de IA. No se ejecuta JavaScript. Tiempo hasta el primer byte: 1456 ms.
Lo que esto no es: Ningún seguimiento de posiciones ni de citas, ninguna afirmación sobre si un modelo te nombra realmente, y ninguna comprobación de contenido cargado mediante JavaScript. Una instantánea desde la perspectiva de una IP de servidor.