Magyar
citeglass · MI-láthatóság ellenőrzése

Ellenőrizve: 2026. 09. 24. · https://www.nytimes.com/

2 kritikus akadály van az MI általi megtalálhatóság előtt — ezeket javítsd először.

F
1 / 100
2 kritikus · 5 ellenőrizendő
A legutóbbi szkennelés óta: Pontszám -37 · 2 javítva · 8 új

MI-robotok mátrixa

Robotonként: mit enged a robots.txt-d — és mit ad vissza valójában a szervered a robot user agentjének. Pirossal kiemelt sorok: a robots engedi, de a szerver blokkolja (általában WAF- vagy botvédelmi szabály).

RobotÜzemeltetőrobots.txtSzerverválasz
GPTBotOpenAIletiltvaletiltva (403 / WAF)
OAI-SearchBotOpenAIletiltvaletiltva (403 / WAF)
ChatGPT-UserOpenAIletiltvaletiltva (403 / WAF)
ClaudeBotAnthropicletiltvaletiltva (403 / WAF)
Claude-SearchBotAnthropicletiltvaletiltva (403 / WAF)
Claude-UserAnthropicletiltvaletiltva (403 / WAF)
PerplexityBotPerplexityletiltvaletiltva (403 / WAF)
Perplexity-UserPerplexityletiltvaletiltva (403 / WAF)
Google-ExtendedGoogle (Gemini-Training)letiltva—
GooglebotGoogle (KI-Übersichten)engedélyezveletiltva (403 / WAF)
CCBotCommon Crawl (Trainingsdaten vieler LLMs)letiltvaletiltva (403 / WAF)
BytespiderByteDance (Doubao)letiltvaletiltva (403 / WAF)
AmazonbotAmazon (Alexa/Rufus)engedélyezveletiltva (403 / WAF)
Applebot-ExtendedApple (Intelligence-Training)letiltva—
Meta-ExternalAgentMeta (Llama/Meta AI)letiltvaletiltva (403 / WAF)
Hogyan jön ki a pontszám?
MI-keresőbotok le vannak tiltva a robots.txt-ben-32
A szerver blokkolja a robotokat, pedig a robots.txt engedélyezi őket-12
Nagyon kevés szöveg a HTML-ben-10
Nincsenek strukturált adatok (JSON-LD)-8
Az oldalcím túl rövid vagy túl hosszú-6
Nem pontosan egy H1 címsor-5
A meta leírás hiányzik vagy nem megfelelő-5
Nincs llms.txt-5
Nincs szerzőségi jel-4
Nincsenek sameAs kapcsolatok-3
Nincs link a jogi tudnivalókhoz / rólunk / kapcsolat oldalhoz-3
Nincs látható vagy jelölt dátum-3
Nincs canonical URL-3
Eredmény1 / 100

Hozzáférés az MI-robotoknak

kritikus

MI-keresőbotok le vannak tiltva a robots.txt-ben

A robots.txt 6 olyan botot tilt le, amely tartalmat tölt le MI-asszisztensek és keresők válaszaihoz: OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User. Amíg tiltva vannak, az oldalad ott nem jelenhet meg forrásként.

Ezt kellene tenned: Botonként ellenőrizd, hogy a tiltás szándékos-e. Ha csak az MI-tanítást akarod kizárni, a tanító botokat tiltsd (GPTBot, ClaudeBot, Google-Extended), a keresőbotokat engedd.

User-agent: OAI-SearchBot
Allow: /

User-agent: ChatGPT-User
Allow: /

User-agent: Claude-SearchBot
Allow: /

User-agent: Claude-User
Allow: /

User-agent: PerplexityBot
Allow: /

User-agent: Perplexity-User
Allow: /
kritikus

A szerver blokkolja a robotokat, pedig a robots.txt engedélyezi őket

2 robot esetében a(z) Google (KI-Übersichten), Amazon (Alexa/Rufus) részéről a robots.txt „engedélyezve” állapotot mond, de a szerver 403-mal vagy botvédelmi oldallal válaszol. Általában egy WAF-, tűzfal- vagy CDN-szabály, amely a robots.txt-t megkerülve zárja ki a robotot.

Ezt kellene tenned: Vedd fel a kívánt MI-robotok user agentjeit és/vagy IP-tartományait egy engedélyezőlistára a WAF-odban / Cloudflare-ben / tűzfaladban. Fordított DNS-sel ellenőrizd őket, ne csak a user agent karakterlánc alapján.

megjegyzés

MI-tanítás kizárva

A robots.txt olyan crawlereket tilt le, amelyek nyelvi modellek tanításához gyűjtenek tartalmat: GPTBot, ClaudeBot, Google-Extended, CCBot, Applebot-Extended. Ez nem akadályozza a hivatkozásokat — a kereső- és lekérő botok, például az OAI-SearchBot, a PerplexityBot és a Googlebot az MI-áttekintésekhez, ettől függetlenek.

Ezt kellene tenned: Nincs teendő, ha a kizárás szándékos. Csak ügyelj arra, hogy a keresőbotok engedélyezve maradjanak.

Tartalom JavaScript nélkül

ellenőrizendő

Nagyon kevés szöveg a HTML-ben

A kezdeti HTML csak körülbelül 55 karakternyi látható szöveget tartalmaz. Ez alig elég ahhoz, hogy az MI-rendszerek biztosan megragadják az oldal témáját.

Ezt kellene tenned: Győződj meg róla, hogy a tényleges tartalom teljes egészében a HTML-ben van, és nem képekben, iframe-ekben vagy JavaScripttel betöltött blokkokban.

Szerkezet és gépi érthetőség

ellenőrizendő

Nincsenek strukturált adatok (JSON-LD)

Az oldal nem tartalmaz JSON-LD-t. A strukturált adatok segítik az MI-rendszereket az entitások, a szerző, a szervezet, a dátum és az oldaltípus egyértelmű felismerésében — nélkülük mindent a folyószövegből kell kitalálni.

Ezt kellene tenned: Adj hozzá legalább egy „Organization” sémát és egy az oldaltípushoz illőt (Article, Product, FAQPage …) JSON-LD-ként a <head>-be.

<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
 "name":"A céged","url":"https://a-domenod.hu",
 "sameAs":["https://www.linkedin.com/company/…"]}
</script>
ellenőrizendő

Az oldalcím túl rövid vagy túl hosszú

A <title> 11 karakter hosszú. Ésszerű a körülbelül 30–60 karakter: elég leíró a téma megnevezéséhez, elég rövid, hogy ne vágódjon le.

Ezt kellene tenned: Írj tömör címet, amely tartalmazza a témát és adott esetben a márkát.

ellenőrizendő

Nem pontosan egy H1 címsor

Az oldalon 0 H1 címsor van. Egy egyértelmű H1 megmondja embernek és gépnek, miről szól elsősorban az oldal.

Ezt kellene tenned: Állíts be pontosan egy H1-et, amely megnevezi az oldal fő témáját. Minden alatta H2-vel kezdődik.

ellenőrizendő

A meta leírás hiányzik vagy nem megfelelő

A meta leírás 0 karakter hosszú. Gyakran ez az első, amit az MI-rendszerek és a keresők az oldal összefoglalójaként olvasnak.

Ezt kellene tenned: Írj önálló összefoglalót az oldalról egy-két mondatban (körülbelül 120–200 karakter), ne kulcsszavak sorát.

megjegyzés

Nincs llms.txt

A /llms.txt címen nincs fájl. Az llms.txt a kulcsfontosságú tartalmad rövid, Markdown formátumú áttekintése, amelyet egyes MI-rendszerek tájékozódásra használnak.

Ezt kellene tenned: Hozz létre egy /llms.txt-t: egy H1 a névvel, egy rövid bekezdés a kínálatról, és egy hivatkozáslista a központi oldalakhoz.

# A céged

> Leírás egy mondatban.

## Fontos oldalak
- [Termék](https://a-domenod.hu/termek): …
- [Árak](https://a-domenod.hu/arak): …
- [Rólunk](https://a-domenod.hu/rolunk): …

Bizalmi és entitásjelek (E-E-A-T)

megjegyzés

Nincs szerzőségi jel

Nem ismerhető fel szerző (sem meta tag, sem rel=author, sem JSON-LD Person). A „tapasztalat” és „szakértelem” E-E-A-T értelmében a megnevezett, visszakövethető szerzőség számít.

Ezt kellene tenned: Szerkesztői tartalomnál nevezz meg szerzőt névvel, és linkelj egy szerzői oldalt; jelöld JSON-LD „Person”-ként is.

megjegyzés

Nincsenek sameAs kapcsolatok

A JSON-LD-ből hiányzik a „sameAs”. Ezzel az MI-rendszerek egyértelműen hozzárendelik a márkádat vagy személyedet ismert entitásokhoz (Wikidata, LinkedIn, szakmai jegyzékek).

Ezt kellene tenned: Adj hozzá egy „sameAs”-t az Organizationhez vagy Personhoz a hivatalos profiljaid és jegyzékbejegyzéseid URL-jeivel.

megjegyzés

Nincs link a jogi tudnivalókhoz / rólunk / kapcsolat oldalhoz

Az ellenőrzött oldalon nem ismerhető fel link jogi tudnivalókhoz, „Rólunk” oldalhoz vagy kapcsolathoz. Az ilyen oldalak erős bizalmi jelek, és segítik az entitás-hozzárendelést.

Ezt kellene tenned: Linkeld a jogi tudnivalókat vagy a „Rólunk”-at és a kapcsolatot jól láthatóan, általában minden oldal láblécében.

megjegyzés

Nincs látható vagy jelölt dátum

Nem ismerhető fel közzétételi vagy módosítási dátum (sem <time>, sem article:published_time, sem datePublished a JSON-LD-ben). Sok kérdésnél az MI-rendszerek az aktuális forrásokat részesítik előnyben.

Ezt kellene tenned: Időbeli vonatkozású tartalomnál jelenítsd meg a dátumot láthatóan, és jelöld a datePublished / dateModified értéket a JSON-LD-ben.

Technikai alap

megjegyzés

Nincs canonical URL

Az oldal nem állít be <link rel="canonical"> elemet. Canonical nélkül tisztázatlan maradhat, melyik változat a mérvadó, ha több URL-változat van.

Ezt kellene tenned: Minden oldalon állíts be önmagára hivatkozó <link rel="canonical"> elemet a preferált URL-lel.

Rendben (3)
  • A sitemap elérhető.
  • Gyors szerverválaszidő.
  • Nincs noindex — az oldal indexelhető.

Következő lépések

  1. MI-keresőbotok le vannak tiltva a robots.txt-ben. Botonként ellenőrizd, hogy a tiltás szándékos-e. Ha csak az MI-tanítást akarod kizárni, a tanító botokat tiltsd (GPTBot, ClaudeBot, Google-Extended), a keresőbotokat engedd.
  2. A szerver blokkolja a robotokat, pedig a robots.txt engedélyezi őket. Vedd fel a kívánt MI-robotok user agentjeit és/vagy IP-tartományait egy engedélyezőlistára a WAF-odban / Cloudflare-ben / tűzfaladban. Fordított DNS-sel ellenőrizd őket, ne csak a user agent karakterlánc alapján.
  3. Nagyon kevés szöveg a HTML-ben. Győződj meg róla, hogy a tényleges tartalom teljes egészében a HTML-ben van, és nem képekben, iframe-ekben vagy JavaScripttel betöltött blokkokban.
Ennek az oldalnak a megfigyelése

Heti újraszkennelés e-mail-riasztással minden változásnál. Előkészületben — add meg a címedet.

Módszer és korlátok

Ellenőrizve: 2026. 09. 24.. A citeglass HTTP-n keresztül tölti le a(z) nytimes.com-t és a hozzá tartozó fájlokat (robots.txt, llms.txt, sitemap.xml) — egyszer normál böngészőként, egyszer minden MI-robot user agentjével. JavaScript nem fut. Idő az első bájtig: 99 ms.

Ami ez nem: Nincs pozíció- vagy idézetkövetés, nincs állítás arról, hogy egy modell valóban megnevez-e, és nincs a JavaScripttel betöltött tartalom ellenőrzése. Pillanatkép egyetlen szerver-IP nézőpontjából.

Másik webhely ellenőrzése