Slovenščina
citeglass · Preverjanje vidnosti za UI

Preverjeno 24. 9. 2026 · https://www.nytimes.com/

Obstaja 2 kritičnih blokad za najdljivost prek UI — najprej jih odpravite.

F
1 / 100
2 kritičnih · 5 za preveritev
Od zadnjega skeniranja: Ocena -37 · 2 odpravljenih · 8 novih

Matrika UI-robotov

Za vsakega robota: kaj dovoljuje vaš robots.txt — in kaj vaš strežnik dejansko vrne uporabniškemu agentu robota. Rdeče označene vrstice: robots to dovoljuje, a strežnik blokira (običajno pravilo WAF ali zaščite pred roboti).

RobotUpravljavecrobots.txtOdziv strežnika
GPTBotOpenAIblokiranoblokirano (403 / WAF)
OAI-SearchBotOpenAIblokiranoblokirano (403 / WAF)
ChatGPT-UserOpenAIblokiranoblokirano (403 / WAF)
ClaudeBotAnthropicblokiranoblokirano (403 / WAF)
Claude-SearchBotAnthropicblokiranoblokirano (403 / WAF)
Claude-UserAnthropicblokiranoblokirano (403 / WAF)
PerplexityBotPerplexityblokiranoblokirano (403 / WAF)
Perplexity-UserPerplexityblokiranoblokirano (403 / WAF)
Google-ExtendedGoogle (Gemini-Training)blokirano—
GooglebotGoogle (KI-Übersichten)dovoljenoblokirano (403 / WAF)
CCBotCommon Crawl (Trainingsdaten vieler LLMs)blokiranoblokirano (403 / WAF)
BytespiderByteDance (Doubao)blokiranoblokirano (403 / WAF)
AmazonbotAmazon (Alexa/Rufus)dovoljenoblokirano (403 / WAF)
Applebot-ExtendedApple (Intelligence-Training)blokirano—
Meta-ExternalAgentMeta (Llama/Meta AI)blokiranoblokirano (403 / WAF)
Kako nastane ocena?
Iskalni boti UI so v robots.txt blokirani-32
Strežnik blokira robote, čeprav jih robots.txt dovoljuje-12
Zelo malo besedila v HTML-10
Ni strukturiranih podatkov (JSON-LD)-8
Naslov strani prekratek ali predolg-6
Ne natanko en naslov H1-5
Meta opis manjka ali ni ustrezen-5
Ni llms.txt-5
Ni signala avtorja ali avtorstva-4
Ni povezav sameAs-3
Ni povezave do pravnih informacij / o nas / stik-3
Ni vidnega ali označenega datuma-3
Ni canonical URL-ja-3
Rezultat1 / 100

Dostop za UI-robote

kritično

Iskalni boti UI so v robots.txt blokirani

Vaš robots.txt blokira 6 botov, ki pridobivajo vsebino za odgovore asistentov UI in iskalnikov: OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User. Dokler so blokirani, se vaše spletno mesto tam ne more pojaviti kot vir.

To bi morali storiti: Za vsakega bota preverite, ali je blokada namerna. Če želite izključiti le učenje UI, blokirajte bote za učenje (GPTBot, ClaudeBot, Google-Extended) in dovolite iskalne bote.

User-agent: OAI-SearchBot
Allow: /

User-agent: ChatGPT-User
Allow: /

User-agent: Claude-SearchBot
Allow: /

User-agent: Claude-User
Allow: /

User-agent: PerplexityBot
Allow: /

User-agent: Perplexity-User
Allow: /
kritično

Strežnik blokira robote, čeprav jih robots.txt dovoljuje

Za 2 robotov iz Google (KI-Übersichten), Amazon (Alexa/Rufus) robots.txt pravi »dovoljeno«, a strežnik odgovori s kodo 403 ali stranjo za zaščito pred roboti. Običajno pravilo WAF, požarnega zidu ali CDN, ki robota izključi mimo robots.txt.

To bi morali storiti: Dodajte uporabniške agente in/ali obsege IP želenih UI-robotov na seznam dovoljenih v svojem WAF / Cloudflare / požarnem zidu. Preverite jih prek obratnega DNS, ne le prek niza uporabniškega agenta.

opomba

Učenje UI izključeno

Vaš robots.txt blokira pajke, ki zbirajo vsebino za učenje jezikovnih modelov: GPTBot, ClaudeBot, Google-Extended, CCBot, Applebot-Extended. To ne preprečuje navajanja — iskalni in pridobitveni boti, kot so OAI-SearchBot, PerplexityBot in Googlebot za preglede z UI, so ločeni.

To bi morali storiti: Nič ni treba storiti, če je izključitev namerna. Poskrbite le, da iskalni boti ostanejo dovoljeni.

Vsebina brez JavaScripta

za preveritev

Zelo malo besedila v HTML

Začetni HTML vsebuje le okoli 55 znakov vidnega besedila. To komaj zadošča, da UI-sistemi zanesljivo razberejo temo strani.

To bi morali storiti: Poskrbite, da je dejanska vsebina v celoti v HTML in ne v slikah, iframih ali blokih, naloženih prek JavaScripta.

Struktura in strojno razumevanje

za preveritev

Ni strukturiranih podatkov (JSON-LD)

Stran ne vsebuje JSON-LD. Strukturirani podatki pomagajo UI-sistemom nedvoumno prepoznati entitete, avtorja, organizacijo, datum in vrsto strani — brez njih je treba vse ugibati iz besedila.

To bi morali storiti: Dodajte vsaj shemo »Organization« in eno, ki ustreza vrsti strani (Article, Product, FAQPage …), kot JSON-LD v <head>.

<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
 "name":"Vaše podjetje","url":"https://vasa-domena.si",
 "sameAs":["https://www.linkedin.com/company/…"]}
</script>
za preveritev

Naslov strani prekratek ali predolg

<title> je dolg 11 znakov. Smiselno je okoli 30–60 znakov: dovolj opisen za poimenovanje teme, dovolj kratek, da ni odrezan.

To bi morali storiti: Napišite jedrnat naslov, ki vsebuje temo in po potrebi blagovno znamko.

za preveritev

Ne natanko en naslov H1

Stran ima 0 naslovov H1. En nedvoumen H1 pove ljudem in strojem, o čem je stran predvsem.

To bi morali storiti: Nastavite natanko en H1, ki poimenuje glavno temo strani. Vse pod tem se začne pri H2.

za preveritev

Meta opis manjka ali ni ustrezen

Meta opis je dolg 0 znakov. Pogosto je prvo, kar UI-sistemi in iskalniki preberejo kot povzetek strani.

To bi morali storiti: Napišite samostojen povzetek strani v enem ali dveh stavkih (okoli 120–200 znakov), ne niz ključnih besed.

opomba

Ni llms.txt

Na /llms.txt ni datoteke. llms.txt je kratek pregled vaše ključne vsebine v Markdown, ki ga nekateri UI-sistemi uporabljajo za orientacijo.

To bi morali storiti: Ustvarite /llms.txt: H1 z imenom, kratek odstavek o ponudbi in seznam povezav do osrednjih strani.

# Vaše podjetje

> Opis v enem stavku.

## Pomembne strani
- [Izdelek](https://vasa-domena.si/izdelek): …
- [Cene](https://vasa-domena.si/cene): …
- [O nas](https://vasa-domena.si/o-nas): …

Signali zaupanja in entitete (E-E-A-T)

opomba

Ni signala avtorja ali avtorstva

Ni prepoznavnega avtorja (niti meta oznaka, niti rel=author, niti JSON-LD Person). Za »izkušnje« in »strokovnost« v smislu E-E-A-T šteje poimenovano, sledljivo avtorstvo.

To bi morali storiti: Pri uredniški vsebini poimenujte avtorja in povežite avtorsko stran; označite ga tudi kot JSON-LD »Person«.

opomba

Ni povezav sameAs

V JSON-LD manjka »sameAs«. Z njim UI-sistemi jasno povežejo vašo blagovno znamko ali osebo z znanimi entitetami (Wikidata, LinkedIn, panožni imeniki).

To bi morali storiti: Dodajte »sameAs« v Organization ali Person z URL-ji vaših uradnih profilov in vnosov v imenike.

opomba

Ni povezave do pravnih informacij / o nas / stik

Na preverjeni strani ni prepoznavne povezave do pravnih informacij, strani »O nas« ali stika. Take strani so močan signal zaupanja in pomagajo pri povezovanju entitete.

To bi morali storiti: Povežite pravne informacije ali »O nas« in stik vidno, običajno v nogi vsake strani.

opomba

Ni vidnega ali označenega datuma

Ni prepoznavnega datuma objave ali spremembe (niti <time>, niti article:published_time, niti datePublished v JSON-LD). Pri mnogih vprašanjih UI-sistemi dajejo prednost aktualnim virom.

To bi morali storiti: Pri vsebini s časovno navezavo prikažite datum vidno in označite datePublished / dateModified v JSON-LD.

Tehnična podlaga

opomba

Ni canonical URL-ja

Stran ne nastavi <link rel="canonical">. Brez canonical lahko ostane nejasno, katera različica je merodajna, ko obstaja več različic URL-ja.

To bi morali storiti: Na vsaki strani nastavite samosklicujoč <link rel="canonical"> s prednostnim URL-jem.

V redu (3)
  • Sitemap je dosegljiv.
  • Hiter odzivni čas strežnika.
  • Brez noindex — stran je lahko indeksirana.

Naslednji koraki

  1. Iskalni boti UI so v robots.txt blokirani. Za vsakega bota preverite, ali je blokada namerna. Če želite izključiti le učenje UI, blokirajte bote za učenje (GPTBot, ClaudeBot, Google-Extended) in dovolite iskalne bote.
  2. Strežnik blokira robote, čeprav jih robots.txt dovoljuje. Dodajte uporabniške agente in/ali obsege IP želenih UI-robotov na seznam dovoljenih v svojem WAF / Cloudflare / požarnem zidu. Preverite jih prek obratnega DNS, ne le prek niza uporabniškega agenta.
  3. Zelo malo besedila v HTML. Poskrbite, da je dejanska vsebina v celoti v HTML in ne v slikah, iframih ali blokih, naloženih prek JavaScripta.
Spremljaj to stran

Tedensko ponovno skeniranje z e-poštnim opozorilom ob vsaki spremembi. V pripravi — vnesite svoj naslov.

Metoda in omejitve

Preverjeno 24. 9. 2026. citeglass naloži nytimes.com in povezane datoteke (robots.txt, llms.txt, sitemap.xml) prek HTTP — enkrat kot običajen brskalnik, enkrat na vsak uporabniški agent UI-robota. JavaScript se ne izvaja. Čas do prvega bajta: 99 ms.

Kaj to ni: Brez sledenja položajem ali navedbam, brez trditve, ali vas model dejansko imenuje, in brez preverjanja vsebine, naložene prek JavaScripta. Posnetek stanja z vidika enega strežniškega IP-ja.

Preveri drugo spletno mesto