Verificat pe 04.09.2026 · https://example.org/
Fără blocaje dure, dar 4 puncte slăbesc descoperirea prin AI.
Matricea roboților AI
Pentru fiecare robot: ce permite robots.txt-ul tău — și ce returnează serverul tău de fapt agentului de utilizator al robotului. Rânduri marcate cu roșu: robots permite, dar serverul blochează (de obicei o regulă WAF sau de protecție anti-roboți).
| Robot | Operator | robots.txt | Răspunsul serverului |
|---|---|---|---|
| GPTBot | OpenAI | nemenționat | 200 + conținut |
| OAI-SearchBot | OpenAI | nemenționat | 200 + conținut |
| ChatGPT-User | OpenAI | nemenționat | 200 + conținut |
| ClaudeBot | Anthropic | nemenționat | 200 + conținut |
| Claude-SearchBot | Anthropic | nemenționat | 200 + conținut |
| Claude-User | Anthropic | nemenționat | 200 + conținut |
| PerplexityBot | Perplexity | nemenționat | 200 + conținut |
| Perplexity-User | Perplexity | nemenționat | 200 + conținut |
| Google-Extended | Google (Gemini-Training) | nemenționat | — |
| Googlebot | Google (KI-Übersichten) | nemenționat | 200 + conținut |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | nemenționat | 200 + conținut |
| Bytespider | ByteDance (Doubao) | nemenționat | 200 + conținut |
| Amazonbot | Amazon (Alexa/Rufus) | nemenționat | 200 + conținut |
| Applebot-Extended | Apple (Intelligence-Training) | nemenționat | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | nemenționat | 200 + conținut |
Cum se formează scorul?
| Foarte puțin text în HTML | -10 |
| Fără date structurate (JSON-LD) | -8 |
| Titlul paginii prea scurt sau prea lung | -6 |
| Meta descrierea lipsește sau nu se potrivește | -5 |
| Fără llms.txt | -5 |
| Fără semnal de autor sau de autorat | -4 |
| Niciun sitemap.xml găsit | -4 |
| Fără legături sameAs | -3 |
| Fără link către informații legale / despre noi / contact | -3 |
| Fără dată vizibilă sau marcată | -3 |
| Fără URL canonic | -3 |
| Niciun robots.txt găsit | -2 |
| Rezultat | 44 / 100 |
Acces pentru roboții AI
Niciun robots.txt găsit
La /robots.txt nu era accesibil niciun fișier valid. Roboții presupun atunci „totul permis” — funcționează, dar nu ai control și nici semnal de sitemap.
Iată ce ar trebui să faci: Creează un robots.txt în directorul rădăcină, cel puțin cu o trimitere la sitemap și regulile allow/disallow dorite.
User-agent: * Allow: / Sitemap: https://domeniul-tau.ro/sitemap.xml
Conținut fără JavaScript
Foarte puțin text în HTML
HTML-ul inițial conține doar circa 142 caractere de text vizibil. Este abia suficient pentru ca sistemele AI să prindă cu certitudine tema paginii.
Iată ce ar trebui să faci: Asigură-te că textul propriu-zis este integral în HTML și nu în imagini, iframe-uri sau blocuri încărcate prin JavaScript.
Structură și înțelegere de către mașină
Fără date structurate (JSON-LD)
Pagina nu conține JSON-LD. Datele structurate ajută sistemele AI să recunoască fără ambiguitate entități, autor, organizație, dată și tip de pagină — fără ele, totul trebuie ghicit din text.
Iată ce ar trebui să faci: Adaugă cel puțin o schemă „Organization” și una potrivită tipului de pagină (Article, Product, FAQPage …) ca JSON-LD în <head>.
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"Firma ta","url":"https://domeniul-tau.ro",
"sameAs":["https://www.linkedin.com/company/…"]}
</script>Titlul paginii prea scurt sau prea lung
<title> are 14 caractere. Rezonabil este circa 30–60 de caractere: suficient de descriptiv pentru a numi tema, suficient de scurt pentru a nu fi tăiat.
Iată ce ar trebui să faci: Scrie un titlu concis care conține tema și, dacă e cazul, marca.
Meta descrierea lipsește sau nu se potrivește
Meta descrierea are 0 caractere. Este adesea primul lucru pe care sistemele AI și motoarele de căutare îl citesc drept rezumat al paginii.
Iată ce ar trebui să faci: Scrie un rezumat de sine stătător al paginii în una sau două propoziții (circa 120–200 de caractere), nu un șir de cuvinte-cheie.
Fără llms.txt
La /llms.txt nu există niciun fișier. llms.txt este o scurtă prezentare în Markdown a conținutului tău cheie, pe care unele sisteme AI o folosesc pentru orientare.
Iată ce ar trebui să faci: Creează un /llms.txt: un H1 cu numele, un paragraf scurt despre ofertă și o listă de linkuri către paginile centrale.
# Firma ta > Descriere într-o propoziție. ## Pagini cheie - [Produs](https://domeniul-tau.ro/produs): … - [Prețuri](https://domeniul-tau.ro/preturi): … - [Despre noi](https://domeniul-tau.ro/despre-noi): …
Semnale de încredere și de entitate (E-E-A-T)
Fără semnal de autor sau de autorat
Nu se poate recunoaște niciun autor (nici meta tag, nici rel=author, nici JSON-LD Person). Pentru „experiență” și „expertiză” în sensul E-E-A-T contează un autorat numit și verificabil.
Iată ce ar trebui să faci: La conținut editorial, numește un autor și leagă o pagină de autor; marcheaz-o și ca JSON-LD „Person”.
Fără legături sameAs
În JSON-LD lipsește „sameAs”. Cu el, sistemele AI îți asociază clar marca sau persoana cu entități cunoscute (Wikidata, LinkedIn, directoare de branșă).
Iată ce ar trebui să faci: Adaugă un „sameAs” în Organization sau Person cu URL-urile profilurilor tale oficiale și ale intrărilor din directoare.
Fără link către informații legale / despre noi / contact
Pe pagina verificată nu se poate recunoaște niciun link către informații legale, o pagină „Despre noi” sau contact. Astfel de pagini sunt un semnal puternic de încredere și ajută la asocierea entității.
Iată ce ar trebui să faci: Leagă informațiile legale sau „Despre noi” și contactul vizibil, de obicei în subsolul fiecărei pagini.
Fără dată vizibilă sau marcată
Nu se poate recunoaște o dată de publicare sau de modificare (nici <time>, nici article:published_time, nici datePublished în JSON-LD). La multe întrebări, sistemele AI preferă surse actuale.
Iată ce ar trebui să faci: La conținut cu referință temporală, afișează o dată vizibil și marchează datePublished / dateModified în JSON-LD.
Bază tehnică
Niciun sitemap.xml găsit
La /sitemap.xml nu era accesibil niciun sitemap XML valid, iar robots.txt nu numește niciunul. Un sitemap ajută roboții să găsească toate URL-urile relevante.
Iată ce ar trebui să faci: Generează un sitemap.xml cu toate URL-urile indexabile și fă trimitere la el în robots.txt.
Fără URL canonic
Pagina nu setează un <link rel="canonical">. Fără canonical poate rămâne neclar ce versiune este cea de referință când există mai multe variante de URL.
Iată ce ar trebui să faci: Setează pe fiecare pagină un <link rel="canonical"> autoreferențial cu URL-ul preferat.
În regulă (2)
- Exact un titlu H1.
- Timp de răspuns rapid al serverului.
Pașii următori
- Foarte puțin text în HTML. Asigură-te că textul propriu-zis este integral în HTML și nu în imagini, iframe-uri sau blocuri încărcate prin JavaScript.
- Fără date structurate (JSON-LD). Adaugă cel puțin o schemă „Organization” și una potrivită tipului de pagină (Article, Product, FAQPage …) ca JSON-LD în <head>.
- Titlul paginii prea scurt sau prea lung. Scrie un titlu concis care conține tema și, dacă e cazul, marca.
Rescanare săptămânală cu alertă pe e-mail la fiecare modificare. În pregătire — introdu adresa ta.
Metodă și limite
Verificat pe 04.09.2026. citeglass preia example.org și fișierele asociate (robots.txt, llms.txt, sitemap.xml) prin HTTP — o dată ca browser normal, o dată pentru fiecare agent de utilizator de robot AI. Nu se execută JavaScript. Timp până la primul octet: 21 ms.
Ce nu este: Fără urmărirea pozițiilor sau a citărilor, fără vreo afirmație despre faptul dacă un model te numește cu adevărat și fără verificarea conținutului încărcat prin JavaScript. Un instantaneu din perspectiva unui IP de server.