Lietuvių
citeglass · DI matomumo patikra

Patikrinta 2026-09-23 · https://rehau-termopane.ro/

DI aptinkamumui yra 1 kritinių kliūčių — pašalinkite jas pirmiausia.

C
69 / 100
1 kritiniai · 0 tikrintini

DI robotų matrica

Kiekvienam robotui: ką leidžia jūsų robots.txt — ir ką jūsų serveris iš tikrųjų grąžina roboto naudotojo agentui. Raudonai paryškintos eilutės: robots leidžia, bet serveris blokuoja (paprastai WAF arba apsaugos nuo robotų taisyklė).

RobotasOperatoriusrobots.txtServerio atsakas
GPTBotOpenAInepaminėtablokuojama (403 / WAF)
OAI-SearchBotOpenAInepaminėta200 + turinys
ChatGPT-UserOpenAInepaminėta200 + turinys
ClaudeBotAnthropicnepaminėta200 + turinys
Claude-SearchBotAnthropicnepaminėtaklaida / laiko limitas
Claude-UserAnthropicnepaminėta200 + turinys
PerplexityBotPerplexitynepaminėtaklaida / laiko limitas
Perplexity-UserPerplexitynepaminėtaklaida / laiko limitas
Google-ExtendedGoogle (Gemini-Training)nepaminėta
GooglebotGoogle (KI-Übersichten)nepaminėta200 + turinys
CCBotCommon Crawl (Trainingsdaten vieler LLMs)nepaminėta200 + turinys
BytespiderByteDance (Doubao)nepaminėta200 + turinys
AmazonbotAmazon (Alexa/Rufus)nepaminėta200 + turinys
Applebot-ExtendedApple (Intelligence-Training)nepaminėta
Meta-ExternalAgentMeta (Llama/Meta AI)nepaminėtablokuojama (403 / WAF)
Kaip susidaro įvertinimas?
Serveris blokuoja robotus, nors robots.txt juos leidžia-12
Nėra llms.txt-5
sitemap.xml nerastas-4
Praleidžiami antraščių lygiai-3
Nėra sameAs sąsajų-3
robots.txt nerastas-2
Nėra FAQ arba HowTo žymėjimo-2
Rezultatas69 / 100

Prieiga DI robotams

kritinis

Serveris blokuoja robotus, nors robots.txt juos leidžia

2 robotams iš OpenAI, Meta (Llama/Meta AI) robots.txt sako „leidžiama“, bet serveris atsako kodu 403 arba apsaugos nuo robotų puslapiu. Paprastai WAF, ugniasienės arba CDN taisyklė, kuri neįsileidžia roboto apeidama robots.txt.

Štai ką turėtumėte padaryti: Pridėkite pageidaujamų DI robotų naudotojo agentus ir (arba) IP diapazonus į leidžiamųjų sąrašą savo WAF / Cloudflare / ugniasienėje. Patikrinkite juos per atvirkštinį DNS, ne tik pagal naudotojo agento eilutę.

pastaba

robots.txt nerastas

Adresu /robots.txt nebuvo pasiekiamas joks galiojantis failas. Tada robotai daro prielaidą „viskas leidžiama“ — veikia, bet neturite valdymo nei sitemap signalo.

Štai ką turėtumėte padaryti: Sukurkite robots.txt šakniniame kataloge, bent su nuoroda į sitemap ir pageidaujamomis allow/disallow taisyklėmis.

User-agent: *
Allow: /

Sitemap: https://jusu-domenas.lt/sitemap.xml

Struktūra ir mašininis suprantamumas

pastaba

Nėra llms.txt

Adresu /llms.txt nėra failo. llms.txt yra trumpa jūsų pagrindinio turinio Markdown apžvalga, kurią kai kurios DI sistemos naudoja orientuotis.

Štai ką turėtumėte padaryti: Sukurkite /llms.txt: H1 su pavadinimu, trumpą pastraipą apie pasiūlymą ir nuorodų sąrašą į pagrindinius puslapius.

# Jūsų įmonė

> Aprašymas vienu sakiniu.

## Svarbūs puslapiai
- [Produktas](https://jusu-domenas.lt/produktas): …
- [Kainos](https://jusu-domenas.lt/kainos): …
- [Apie mus](https://jusu-domenas.lt/apie-mus): …
pastaba

Praleidžiami antraščių lygiai

Antraščių seka praleidžia bent vieną lygį (pvz., H2 tiesiai į H4). Tai apsunkina automatinį turinio struktūros atkūrimą.

Štai ką turėtumėte padaryti: Naudokite antraščių lygius be spragų ir iš eilės (H1 → H2 → H3 …).

pastaba

Nėra FAQ arba HowTo žymėjimo

Klausimo–atsakymo ir žingsnis po žingsnio turinį DI sistemoms be FAQPage arba HowTo žymėjimo sunkiau atpažinti kaip tiesiogiai cituotiną atsakymą.

Štai ką turėtumėte padaryti: Ten, kur puslapis atsako į tikrus klausimus arba pateikia instrukcijas, pažymėkite jį kaip FAQPage arba HowTo (jokio žymėjimo be matomai atitinkamo turinio).

Pasitikėjimo ir esybės signalai (E-E-A-T)

pastaba

Nėra sameAs sąsajų

JSON-LD trūksta „sameAs“. Su juo DI sistemos aiškiai susieja jūsų prekės ženklą ar asmenį su žinomomis esybėmis (Wikidata, LinkedIn, šakos katalogai).

Štai ką turėtumėte padaryti: Pridėkite „sameAs“ į Organization arba Person su savo oficialių profilių ir katalogo įrašų URL adresais.

Techninis pagrindas

pastaba

sitemap.xml nerastas

Adresu /sitemap.xml nebuvo pasiekiamas joks galiojantis XML sitemap ir robots.txt nė vieno neįvardija. Sitemap padeda robotams rasti visus svarbius URL.

Štai ką turėtumėte padaryti: Sugeneruokite sitemap.xml su visais indeksuojamais URL ir nurodykite jį robots.txt.

Tvarkoje (8)
  • Pagrindinis turinys yra HTML be JavaScript.
  • Yra struktūrizuotų duomenų (JSON-LD). — HomeAndConstructionBusiness, Organization, WebSite, ImageObject, WebPage, Person, Article, VideoObject
  • Organizacija pažymėta kaip JSON-LD.
  • Tiksliai viena H1 antraštė.
  • Nustatytas canonical URL.
  • Puslapio pavadinimas pagrįsto ilgio.
  • Yra autorystės signalas.
  • Greitas serverio atsako laikas.

Kiti žingsniai

  1. Serveris blokuoja robotus, nors robots.txt juos leidžia. Pridėkite pageidaujamų DI robotų naudotojo agentus ir (arba) IP diapazonus į leidžiamųjų sąrašą savo WAF / Cloudflare / ugniasienėje. Patikrinkite juos per atvirkštinį DNS, ne tik pagal naudotojo agento eilutę.
  2. Nėra llms.txt. Sukurkite /llms.txt: H1 su pavadinimu, trumpą pastraipą apie pasiūlymą ir nuorodų sąrašą į pagrindinius puslapius.
  3. sitemap.xml nerastas. Sugeneruokite sitemap.xml su visais indeksuojamais URL ir nurodykite jį robots.txt.
Stebėti šį puslapį

Savaitinis pakartotinis nuskaitymas su el. laiško įspėjimu kiekvieną kartą pasikeitus. Rengiama — įveskite savo adresą.

Metodas ir ribos

Patikrinta 2026-09-23. citeglass per HTTP atsisiunčia rehau-termopane.ro ir susijusius failus (robots.txt, llms.txt, sitemap.xml) — vieną kartą kaip įprastą naršyklę, vieną kartą kiekvienam DI roboto naudotojo agentui. JavaScript nevykdomas. Laikas iki pirmojo baito: 774 ms.

Kas tai nėra: Jokio pozicijų ar citavimo stebėjimo, jokio teiginio, ar modelis jus iš tikrųjų paminės, ir jokio per JavaScript įkelto turinio tikrinimo. Momentinė nuotrauka iš vieno serverio IP perspektyvos.

Tikrinti kitą svetainę