Italiano
citeglass · Controllo di visibilità IA

Controllato il 23/09/2026 · https://rehau-termopane.ro/

Ci sono 1 blocchi critici per la reperibilità da parte dell'IA — risolvili per primi.

C
69 / 100
1 critici · 0 da verificare

Matrice dei crawler IA

Per ogni bot: cosa consente il tuo robots.txt — e cosa il tuo server restituisce davvero allo user agent del bot. Righe evidenziate in rosso: robots lo consente, ma il server lo blocca (di solito una regola di WAF o di protezione anti-bot).

BotGestorerobots.txtRisposta del server
GPTBotOpenAInon nominatobloccato (403 / WAF)
OAI-SearchBotOpenAInon nominato200 + contenuto
ChatGPT-UserOpenAInon nominato200 + contenuto
ClaudeBotAnthropicnon nominato200 + contenuto
Claude-SearchBotAnthropicnon nominatoerrore / timeout
Claude-UserAnthropicnon nominato200 + contenuto
PerplexityBotPerplexitynon nominatoerrore / timeout
Perplexity-UserPerplexitynon nominatoerrore / timeout
Google-ExtendedGoogle (Gemini-Training)non nominato
GooglebotGoogle (KI-Übersichten)non nominato200 + contenuto
CCBotCommon Crawl (Trainingsdaten vieler LLMs)non nominato200 + contenuto
BytespiderByteDance (Doubao)non nominato200 + contenuto
AmazonbotAmazon (Alexa/Rufus)non nominato200 + contenuto
Applebot-ExtendedApple (Intelligence-Training)non nominato
Meta-ExternalAgentMeta (Llama/Meta AI)non nominatobloccato (403 / WAF)
Come si calcola il punteggio?
Il server blocca bot che robots.txt consente-12
Nessun llms.txt-5
Nessun sitemap.xml trovato-4
Livelli di titolo saltati-3
Nessun collegamento sameAs-3
Nessun robots.txt trovato-2
Nessun markup FAQ o HowTo-2
Risultato69 / 100

Accesso per i crawler IA

critico

Il server blocca bot che robots.txt consente

Per 2 bot di OpenAI, Meta (Llama/Meta AI), robots.txt dice «consentito», ma il server risponde con un 403 o una pagina di protezione anti-bot. Di solito una regola di WAF, firewall o CDN che esclude il crawler aggirando robots.txt.

Ecco cosa dovresti fare: Aggiungi gli user agent e/o gli intervalli IP dei crawler IA desiderati a una lista di consentiti nel tuo WAF / Cloudflare / firewall. Verificali tramite DNS inverso, non solo tramite la stringa user agent.

nota

Nessun robots.txt trovato

Nessun file valido era raggiungibile a /robots.txt. I crawler assumono allora «tutto consentito» — funziona, ma non hai controllo né segnale di sitemap.

Ecco cosa dovresti fare: Crea un robots.txt nella radice, almeno con un riferimento alla sitemap e le regole allow/disallow desiderate.

User-agent: *
Allow: /

Sitemap: https://il-tuo-dominio.it/sitemap.xml

Struttura e comprensione automatica

nota

Nessun llms.txt

Non c'è alcun file a /llms.txt. llms.txt è una breve panoramica in Markdown dei tuoi contenuti chiave che alcuni sistemi IA usano per orientarsi.

Ecco cosa dovresti fare: Crea un /llms.txt: un H1 con il nome, un breve paragrafo sull'offerta e un elenco di link alle pagine centrali.

# La tua azienda

> Descrizione in una frase.

## Pagine chiave
- [Prodotto](https://il-tuo-dominio.it/prodotto): …
- [Prezzi](https://il-tuo-dominio.it/prezzi): …
- [Chi siamo](https://il-tuo-dominio.it/chi-siamo): …
nota

Livelli di titolo saltati

La sequenza dei titoli salta almeno un livello (ad es. H2 direttamente a H4). Questo rende più difficile ricostruire automaticamente la struttura del contenuto.

Ecco cosa dovresti fare: Usa i livelli di titolo senza lacune e in ordine (H1 → H2 → H3 …).

nota

Nessun markup FAQ o HowTo

I contenuti in forma di domanda-risposta e passo-passo sono più difficili da riconoscere come risposte direttamente citabili per i sistemi IA senza markup FAQPage o HowTo.

Ecco cosa dovresti fare: Dove la pagina risponde a domande reali o dà istruzioni, marcala come FAQPage o HowTo (nessun markup senza contenuto visibilmente corrispondente).

Segnali di fiducia e di entità (E-E-A-T)

nota

Nessun collegamento sameAs

Nel JSON-LD manca «sameAs». Permette ai sistemi IA di associare chiaramente il tuo marchio o la tua persona a entità note (Wikidata, LinkedIn, directory di settore).

Ecco cosa dovresti fare: Aggiungi un «sameAs» in Organization o Person con le URL dei tuoi profili ufficiali e delle schede in directory.

Base tecnica

nota

Nessun sitemap.xml trovato

Nessuna sitemap XML valida era raggiungibile a /sitemap.xml e robots.txt non ne nomina alcuna. Una sitemap aiuta i crawler a trovare tutte le URL rilevanti.

Ecco cosa dovresti fare: Genera una sitemap.xml con tutte le URL indicizzabili e falla riferire in robots.txt.

Conforme (8)
  • Il contenuto principale è nell'HTML senza JavaScript.
  • Sono presenti dati strutturati (JSON-LD). — HomeAndConstructionBusiness, Organization, WebSite, ImageObject, WebPage, Person, Article, VideoObject
  • L'organizzazione è marcata come JSON-LD.
  • Esattamente un titolo H1.
  • È impostata una URL canonica.
  • Il titolo della pagina ha una lunghezza sensata.
  • È presente un segnale di autore.
  • Tempo di risposta del server rapido.

Prossimi passi

  1. Il server blocca bot che robots.txt consente. Aggiungi gli user agent e/o gli intervalli IP dei crawler IA desiderati a una lista di consentiti nel tuo WAF / Cloudflare / firewall. Verificali tramite DNS inverso, non solo tramite la stringa user agent.
  2. Nessun llms.txt. Crea un /llms.txt: un H1 con il nome, un breve paragrafo sull'offerta e un elenco di link alle pagine centrali.
  3. Nessun sitemap.xml trovato. Genera una sitemap.xml con tutte le URL indicizzabili e falla riferire in robots.txt.
Monitora questa pagina

Nuova scansione settimanale con avviso via e-mail a ogni cambiamento. In preparazione — inserisci il tuo indirizzo.

Metodo e limiti

Controllato il 23/09/2026. citeglass recupera rehau-termopane.ro e i file associati (robots.txt, llms.txt, sitemap.xml) via HTTP — una volta come browser normale, una volta per ogni user agent di crawler IA. Non viene eseguito JavaScript. Tempo al primo byte: 774 ms.

Cosa non è: Nessun monitoraggio di posizioni o citazioni, nessuna affermazione sul fatto che un modello ti nomini davvero, e nessun controllo di contenuti caricati via JavaScript. Un'istantanea dal punto di vista di un IP server.

Controlla un altro sito