Patikrinta 2026-09-04 · https://example.org/
Kietų kliūčių nėra, bet 4 punktai silpnina DI aptinkamumą.
DI robotų matrica
Kiekvienam robotui: ką leidžia jūsų robots.txt — ir ką jūsų serveris iš tikrųjų grąžina roboto naudotojo agentui. Raudonai paryškintos eilutės: robots leidžia, bet serveris blokuoja (paprastai WAF arba apsaugos nuo robotų taisyklė).
| Robotas | Operatorius | robots.txt | Serverio atsakas |
|---|---|---|---|
| GPTBot | OpenAI | nepaminėta | 200 + turinys |
| OAI-SearchBot | OpenAI | nepaminėta | 200 + turinys |
| ChatGPT-User | OpenAI | nepaminėta | 200 + turinys |
| ClaudeBot | Anthropic | nepaminėta | 200 + turinys |
| Claude-SearchBot | Anthropic | nepaminėta | 200 + turinys |
| Claude-User | Anthropic | nepaminėta | 200 + turinys |
| PerplexityBot | Perplexity | nepaminėta | 200 + turinys |
| Perplexity-User | Perplexity | nepaminėta | 200 + turinys |
| Google-Extended | Google (Gemini-Training) | nepaminėta | — |
| Googlebot | Google (KI-Übersichten) | nepaminėta | 200 + turinys |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | nepaminėta | 200 + turinys |
| Bytespider | ByteDance (Doubao) | nepaminėta | 200 + turinys |
| Amazonbot | Amazon (Alexa/Rufus) | nepaminėta | 200 + turinys |
| Applebot-Extended | Apple (Intelligence-Training) | nepaminėta | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | nepaminėta | 200 + turinys |
Kaip susidaro įvertinimas?
| Labai mažai teksto HTML | -10 |
| Nėra struktūrizuotų duomenų (JSON-LD) | -8 |
| Puslapio pavadinimas per trumpas arba per ilgas | -6 |
| Meta aprašymo trūksta arba jis netinka | -5 |
| Nėra llms.txt | -5 |
| Nėra autoriaus ar autorystės signalo | -4 |
| sitemap.xml nerastas | -4 |
| Nėra sameAs sąsajų | -3 |
| Nėra nuorodos į teisinę informaciją / apie mus / kontaktus | -3 |
| Nėra matomos ar pažymėtos datos | -3 |
| Nėra canonical URL | -3 |
| robots.txt nerastas | -2 |
| Rezultatas | 44 / 100 |
Prieiga DI robotams
robots.txt nerastas
Adresu /robots.txt nebuvo pasiekiamas joks galiojantis failas. Tada robotai daro prielaidą „viskas leidžiama“ — veikia, bet neturite valdymo nei sitemap signalo.
Štai ką turėtumėte padaryti: Sukurkite robots.txt šakniniame kataloge, bent su nuoroda į sitemap ir pageidaujamomis allow/disallow taisyklėmis.
User-agent: * Allow: / Sitemap: https://jusu-domenas.lt/sitemap.xml
Turinys be JavaScript
Labai mažai teksto HTML
Pradiniame HTML yra tik apie 142 simbolių matomo teksto. To vos pakanka, kad DI sistemos tikrai suprastų puslapio temą.
Štai ką turėtumėte padaryti: Įsitikinkite, kad tikrasis turinys yra visas HTML, o ne paveikslėliuose, iframe'uose ar per JavaScript įkeltuose blokuose.
Struktūra ir mašininis suprantamumas
Nėra struktūrizuotų duomenų (JSON-LD)
Puslapyje nėra JSON-LD. Struktūrizuoti duomenys padeda DI sistemoms vienareikšmiškai atpažinti esybes, autorių, organizaciją, datą ir puslapio tipą — be jų viską reikia spėti iš teksto.
Štai ką turėtumėte padaryti: Pridėkite bent „Organization“ schemą ir puslapio tipui tinkamą (Article, Product, FAQPage …) kaip JSON-LD į <head>.
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"Jūsų įmonė","url":"https://jusu-domenas.lt",
"sameAs":["https://www.linkedin.com/company/…"]}
</script>Puslapio pavadinimas per trumpas arba per ilgas
<title> yra 14 simbolių ilgio. Pagrįsta yra apie 30–60 simbolių: pakankamai aprašomasis, kad įvardytų temą, pakankamai trumpas, kad nebūtų nukirstas.
Štai ką turėtumėte padaryti: Parašykite glaustą pavadinimą, kuriame būtų tema ir prireikus prekės ženklas.
Meta aprašymo trūksta arba jis netinka
Meta aprašymas yra 0 simbolių ilgio. Tai dažnai pirmas dalykas, kurį DI sistemos ir paieškos sistemos perskaito kaip puslapio santrauką.
Štai ką turėtumėte padaryti: Parašykite savarankišką puslapio santrauką vienu ar dviem sakiniais (apie 120–200 simbolių), o ne raktažodžių eilę.
Nėra llms.txt
Adresu /llms.txt nėra failo. llms.txt yra trumpa jūsų pagrindinio turinio Markdown apžvalga, kurią kai kurios DI sistemos naudoja orientuotis.
Štai ką turėtumėte padaryti: Sukurkite /llms.txt: H1 su pavadinimu, trumpą pastraipą apie pasiūlymą ir nuorodų sąrašą į pagrindinius puslapius.
# Jūsų įmonė > Aprašymas vienu sakiniu. ## Svarbūs puslapiai - [Produktas](https://jusu-domenas.lt/produktas): … - [Kainos](https://jusu-domenas.lt/kainos): … - [Apie mus](https://jusu-domenas.lt/apie-mus): …
Pasitikėjimo ir esybės signalai (E-E-A-T)
Nėra autoriaus ar autorystės signalo
Autorius neatpažįstamas (nei meta žyma, nei rel=author, nei JSON-LD Person). „Patirčiai“ ir „ekspertiškumui“ E-E-A-T prasme svarbi įvardyta, atsekama autorystė.
Štai ką turėtumėte padaryti: Redakciniam turiniui įvardykite autorių vardu ir susiekite autoriaus puslapį; pažymėkite jį ir kaip JSON-LD „Person“.
Nėra sameAs sąsajų
JSON-LD trūksta „sameAs“. Su juo DI sistemos aiškiai susieja jūsų prekės ženklą ar asmenį su žinomomis esybėmis (Wikidata, LinkedIn, šakos katalogai).
Štai ką turėtumėte padaryti: Pridėkite „sameAs“ į Organization arba Person su savo oficialių profilių ir katalogo įrašų URL adresais.
Nėra nuorodos į teisinę informaciją / apie mus / kontaktus
Patikrintame puslapyje neatpažįstama jokia nuoroda į teisinę informaciją, puslapį „Apie mus“ ar kontaktus. Tokie puslapiai yra stiprus pasitikėjimo signalas ir padeda susieti esybę.
Štai ką turėtumėte padaryti: Susiekite teisinę informaciją arba „Apie mus“ ir kontaktus matomai, paprastai kiekvieno puslapio poraštėje.
Nėra matomos ar pažymėtos datos
Neatpažįstama paskelbimo ar keitimo data (nei <time>, nei article:published_time, nei datePublished JSON-LD). Daugeliui klausimų DI sistemos teikia pirmenybę naujiems šaltiniams.
Štai ką turėtumėte padaryti: Su laiku susijusiam turiniui rodykite datą matomai ir pažymėkite datePublished / dateModified JSON-LD.
Techninis pagrindas
sitemap.xml nerastas
Adresu /sitemap.xml nebuvo pasiekiamas joks galiojantis XML sitemap ir robots.txt nė vieno neįvardija. Sitemap padeda robotams rasti visus svarbius URL.
Štai ką turėtumėte padaryti: Sugeneruokite sitemap.xml su visais indeksuojamais URL ir nurodykite jį robots.txt.
Nėra canonical URL
Puslapis nenustato <link rel="canonical">. Be canonical gali likti neaišku, kuri versija yra pagrindinė, kai yra kelios URL variantų versijos.
Štai ką turėtumėte padaryti: Kiekviename puslapyje nustatykite į save nukreipiantį <link rel="canonical"> su pageidaujamu URL.
Tvarkoje (2)
- Tiksliai viena H1 antraštė.
- Greitas serverio atsako laikas.
Kiti žingsniai
- Labai mažai teksto HTML. Įsitikinkite, kad tikrasis turinys yra visas HTML, o ne paveikslėliuose, iframe'uose ar per JavaScript įkeltuose blokuose.
- Nėra struktūrizuotų duomenų (JSON-LD). Pridėkite bent „Organization“ schemą ir puslapio tipui tinkamą (Article, Product, FAQPage …) kaip JSON-LD į <head>.
- Puslapio pavadinimas per trumpas arba per ilgas. Parašykite glaustą pavadinimą, kuriame būtų tema ir prireikus prekės ženklas.
Savaitinis pakartotinis nuskaitymas su el. laiško įspėjimu kiekvieną kartą pasikeitus. Rengiama — įveskite savo adresą.
Metodas ir ribos
Patikrinta 2026-09-04. citeglass per HTTP atsisiunčia example.org ir susijusius failus (robots.txt, llms.txt, sitemap.xml) — vieną kartą kaip įprastą naršyklę, vieną kartą kiekvienam DI roboto naudotojo agentui. JavaScript nevykdomas. Laikas iki pirmojo baito: 21 ms.
Kas tai nėra: Jokio pozicijų ar citavimo stebėjimo, jokio teiginio, ar modelis jus iš tikrųjų paminės, ir jokio per JavaScript įkelto turinio tikrinimo. Momentinė nuotrauka iš vieno serverio IP perspektyvos.