Svenska
citeglass · AI-synlighetskontroll

Kontrollerad den 2026-09-24 · https://www.nytimes.com/

Det finns 2 kritiska blockeringar för AI-hittbarhet — åtgärda dem först.

F
1 / 100
2 kritiska · 5 att kontrollera
Sedan senaste skanningen: Poäng -37 · 2 åtgärdade · 8 nya

AI-robotmatris

För varje robot: vad din robots.txt tillåter — och vad din server faktiskt returnerar till robotens user agent. Rader markerade i rött: robots tillåter det, men servern blockerar det (oftast en WAF- eller botskyddsregel).

RobotOperatörrobots.txtServersvar
GPTBotOpenAIblockeradblockerad (403 / WAF)
OAI-SearchBotOpenAIblockeradblockerad (403 / WAF)
ChatGPT-UserOpenAIblockeradblockerad (403 / WAF)
ClaudeBotAnthropicblockeradblockerad (403 / WAF)
Claude-SearchBotAnthropicblockeradblockerad (403 / WAF)
Claude-UserAnthropicblockeradblockerad (403 / WAF)
PerplexityBotPerplexityblockeradblockerad (403 / WAF)
Perplexity-UserPerplexityblockeradblockerad (403 / WAF)
Google-ExtendedGoogle (Gemini-Training)blockerad—
GooglebotGoogle (KI-Übersichten)tillåtenblockerad (403 / WAF)
CCBotCommon Crawl (Trainingsdaten vieler LLMs)blockeradblockerad (403 / WAF)
BytespiderByteDance (Doubao)blockeradblockerad (403 / WAF)
AmazonbotAmazon (Alexa/Rufus)tillåtenblockerad (403 / WAF)
Applebot-ExtendedApple (Intelligence-Training)blockerad—
Meta-ExternalAgentMeta (Llama/Meta AI)blockeradblockerad (403 / WAF)
Hur beräknas poängen?
AI-sökbotar är blockerade i robots.txt-32
Servern blockerar robotar trots att robots.txt tillåter dem-12
Väldigt lite text i HTML:en-10
Inga strukturerade data (JSON-LD)-8
Sidtiteln är för kort eller för lång-6
Inte exakt en H1-rubrik-5
Meta description saknas eller passar inte-5
Ingen llms.txt-5
Ingen författar- eller upphovssignal-4
Inga sameAs-kopplingar-3
Ingen länk till juridisk info / om oss / kontakt-3
Inget synligt eller märkt datum-3
Ingen canonical-URL-3
Resultat1 / 100

Åtkomst för AI-robotar

kritiskt

AI-sökbotar är blockerade i robots.txt

Din robots.txt blockerar 6 botar som hämtar innehåll till svar i AI-assistenter och sökmotorer: OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User. Så länge de är blockerade kan din webbplats inte visas där som källa.

Detta bör du göra: Kontrollera för varje bot om blockeringen är avsiktlig. Vill du bara välja bort AI-träning, blockera träningsbotarna (GPTBot, ClaudeBot, Google-Extended) och tillåt sökbotarna.

User-agent: OAI-SearchBot
Allow: /

User-agent: ChatGPT-User
Allow: /

User-agent: Claude-SearchBot
Allow: /

User-agent: Claude-User
Allow: /

User-agent: PerplexityBot
Allow: /

User-agent: Perplexity-User
Allow: /
kritiskt

Servern blockerar robotar trots att robots.txt tillåter dem

För 2 robot(ar) från Google (KI-Übersichten), Amazon (Alexa/Rufus) säger robots.txt ”tillåten”, men servern svarar med en 403 eller en botskyddssida. Oftast en WAF-, brandväggs- eller CDN-regel som stänger ute roboten förbi robots.txt.

Detta bör du göra: Lägg user agents och/eller IP-intervall för de önskade AI-robotarna på en tillåtelselista i din WAF / Cloudflare / brandvägg. Verifiera dem via omvänd DNS, inte bara via user agent-strängen.

anmärkning

AI-träning bortvald

Din robots.txt blockerar crawlers som samlar innehåll för att träna språkmodeller: GPTBot, ClaudeBot, Google-Extended, CCBot, Applebot-Extended. Det hindrar inte citat — sök- och hämtbotar som OAI-SearchBot, PerplexityBot och Googlebot för AI-översikter är separata.

Detta bör du göra: Inget att göra om bortvalet är avsiktligt. Se bara till att sökbotarna fortsatt är tillåtna.

Innehåll utan JavaScript

att kontrollera

Väldigt lite text i HTML:en

Den initiala HTML:en innehåller bara omkring 55 tecken synlig text. Det räcker knappt för att AI-system säkert ska förstå sidans ämne.

Detta bör du göra: Se till att det egentliga innehållet finns fullständigt i HTML:en och inte i bilder, iframes eller block som laddas via JavaScript.

Struktur och maskinförståelse

att kontrollera

Inga strukturerade data (JSON-LD)

Sidan innehåller ingen JSON-LD. Strukturerade data hjälper AI-system att entydigt känna igen entiteter, författare, organisation, datum och sidtyp — utan dem måste allt gissas från brödtexten.

Detta bör du göra: Lägg till minst ett ”Organization”-schema och ett som passar sidtypen (Article, Product, FAQPage …) som JSON-LD i <head>.

<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
 "name":"Ditt företag","url":"https://din-domän.se",
 "sameAs":["https://www.linkedin.com/company/…"]}
</script>
att kontrollera

Sidtiteln är för kort eller för lång

<title> är 11 tecken lång. Cirka 30–60 tecken är rimligt: beskrivande nog för att namnge ämnet, kort nog för att inte klippas av.

Detta bör du göra: Skriv en kortfattad titel som innehåller ämnet och ev. varumärket.

att kontrollera

Inte exakt en H1-rubrik

Sidan har 0 H1-rubriker. En entydig H1 talar om för människor och maskiner vad sidan främst handlar om.

Detta bör du göra: Sätt exakt en H1 som namnger sidans huvudämne. Allt därunder börjar på H2.

att kontrollera

Meta description saknas eller passar inte

Meta description är 0 tecken lång. Det är ofta det första AI-system och sökmotorer läser som sammanfattning av sidan.

Detta bör du göra: Skriv en fristående sammanfattning av sidan i en eller två meningar (cirka 120–200 tecken), inte en rad nyckelord.

anmärkning

Ingen llms.txt

Det finns ingen fil på /llms.txt. llms.txt är en kort Markdown-översikt över ditt viktigaste innehåll som vissa AI-system använder för att orientera sig.

Detta bör du göra: Skapa en /llms.txt: en H1 med namnet, ett kort stycke om erbjudandet och en länklista till de centrala sidorna.

# Ditt företag

> Beskrivning i en mening.

## Viktiga sidor
- [Produkt](https://din-domän.se/produkt): …
- [Priser](https://din-domän.se/priser): …
- [Om oss](https://din-domän.se/om-oss): …

Förtroende- och entitetssignaler (E-E-A-T)

anmärkning

Ingen författar- eller upphovssignal

Ingen författare går att känna igen (varken metatagg, rel=author eller JSON-LD Person). För ”erfarenhet” och ”expertis” i E-E-A-T-mening räknas ett namngivet, spårbart upphov.

Detta bör du göra: Vid redaktionellt innehåll: namnge en författare och länka en författarsida; märk personen även som JSON-LD ”Person”.

anmärkning

Inga sameAs-kopplingar

I JSON-LD saknas ”sameAs”. Med det kopplar AI-system tydligt ditt varumärke eller din person till kända entiteter (Wikidata, LinkedIn, branschkataloger).

Detta bör du göra: Lägg till ett ”sameAs” i Organization eller Person med URL:erna till dina officiella profiler och katalogposter.

anmärkning

Ingen länk till juridisk info / om oss / kontakt

På den kontrollerade sidan går det inte att känna igen någon länk till juridisk information, en ”Om oss”-sida eller kontakt. Sådana sidor är en stark förtroendesignal och hjälper till med entitetskoppling.

Detta bör du göra: Länka juridisk info eller ”Om oss” och kontakt tydligt, oftast i sidfoten på varje sida.

anmärkning

Inget synligt eller märkt datum

Inget publicerings- eller ändringsdatum går att känna igen (varken <time>, article:published_time eller datePublished i JSON-LD). Vid många frågor föredrar AI-system aktuella källor.

Detta bör du göra: Vid innehåll med tidsanknytning: visa ett datum synligt och märk datePublished / dateModified i JSON-LD.

Teknisk grund

anmärkning

Ingen canonical-URL

Sidan sätter ingen <link rel="canonical">. Utan canonical kan det förbli oklart vilken version som är den gällande när det finns flera URL-varianter.

Detta bör du göra: Sätt en självrefererande <link rel="canonical"> med den föredragna URL:en på varje sida.

I ordning (3)
  • Sitemappen går att nå.
  • Snabb svarstid från servern.
  • Inget noindex — sidan får indexeras.

Nästa steg

  1. AI-sökbotar är blockerade i robots.txt. Kontrollera för varje bot om blockeringen är avsiktlig. Vill du bara välja bort AI-träning, blockera träningsbotarna (GPTBot, ClaudeBot, Google-Extended) och tillåt sökbotarna.
  2. Servern blockerar robotar trots att robots.txt tillåter dem. Lägg user agents och/eller IP-intervall för de önskade AI-robotarna på en tillåtelselista i din WAF / Cloudflare / brandvägg. Verifiera dem via omvänd DNS, inte bara via user agent-strängen.
  3. Väldigt lite text i HTML:en. Se till att det egentliga innehållet finns fullständigt i HTML:en och inte i bilder, iframes eller block som laddas via JavaScript.
Övervaka den här sidan

Veckovis omskanning med e-postavisering vid varje ändring. Under förberedelse — ange din adress.

Metod och gränser

Kontrollerad den 2026-09-24. citeglass hämtar nytimes.com och tillhörande filer (robots.txt, llms.txt, sitemap.xml) via HTTP — en gång som vanlig webbläsare, en gång per AI-robots user agent. Ingen JavaScript körs. Tid till första byte: 99 ms.

Vad det inte är: Ingen positions- eller citatuppföljning, inget påstående om huruvida en modell faktiskt nämner dig, och ingen kontroll av innehåll som laddas via JavaScript. En ögonblicksbild sett från en server-IP.

Kontrollera en annan webbplats