Tarkistettu 4.9.2026 · https://www.mozilla.org/de/
Ei kovia esteitä, mutta 1 kohtaa heikentää tekoälyllä löytymistä.
Tekoälyrobottien matriisi
Kunkin robotin osalta: mitä robots.txt sallii — ja mitä palvelimesi tosiasiassa palauttaa robotin user agentille. Punaisella korostetut rivit: robots sallii sen, mutta palvelin estää (yleensä WAF- tai bottisuojaussääntö).
| Robotti | Ylläpitäjä | robots.txt | Palvelimen vastaus |
|---|---|---|---|
| GPTBot | OpenAI | sallittu (User-agent: * -säännöllä) | 200 + sisältö |
| OAI-SearchBot | OpenAI | sallittu (User-agent: * -säännöllä) | 200 + sisältö |
| ChatGPT-User | OpenAI | sallittu (User-agent: * -säännöllä) | 200 + sisältö |
| ClaudeBot | Anthropic | sallittu (User-agent: * -säännöllä) | 200 + sisältö |
| Claude-SearchBot | Anthropic | sallittu (User-agent: * -säännöllä) | 200 + sisältö |
| Claude-User | Anthropic | sallittu (User-agent: * -säännöllä) | 200 + sisältö |
| PerplexityBot | Perplexity | sallittu (User-agent: * -säännöllä) | 200 + sisältö |
| Perplexity-User | Perplexity | sallittu (User-agent: * -säännöllä) | 200 + sisältö |
| Google-Extended | Google (Gemini-Training) | sallittu (User-agent: * -säännöllä) | — |
| Googlebot | Google (KI-Übersichten) | sallittu (User-agent: * -säännöllä) | 200 + sisältö |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | sallittu (User-agent: * -säännöllä) | 200 + sisältö |
| Bytespider | ByteDance (Doubao) | sallittu (User-agent: * -säännöllä) | 200 + sisältö |
| Amazonbot | Amazon (Alexa/Rufus) | sallittu (User-agent: * -säännöllä) | 200 + sisältö |
| Applebot-Extended | Apple (Intelligence-Training) | sallittu (User-agent: * -säännöllä) | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | sallittu (User-agent: * -säännöllä) | 200 + sisältö |
Miten pistemäärä muodostuu?
| Ei jäsenneltyjä tietoja (JSON-LD) | -8 |
| Ei llms.txt:ää | -5 |
| Ei tekijä- tai tekijyyssignaalia | -4 |
| sitemap.xml:ää ei löytynyt | -4 |
| Ei sameAs-yhdistelyjä | -3 |
| Ei näkyvää tai merkittyä päivämäärää | -3 |
| Tulos | 73 / 100 |
Rakenne ja koneellinen ymmärrettävyys
Ei jäsenneltyjä tietoja (JSON-LD)
Sivu ei sisällä JSON-LD:tä. Jäsennellyt tiedot auttavat tekoälyjärjestelmiä tunnistamaan yksiselitteisesti entiteetit, tekijän, organisaation, päivämäärän ja sivutyypin — ilman niitä kaikki on arvattava leipätekstistä.
Tämä sinun tulisi tehdä: Lisää vähintään ”Organization”-skeema ja sivutyyppiin sopiva (Article, Product, FAQPage …) JSON-LD:nä <head>-osaan.
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"Yrityksesi","url":"https://oma-verkkotunnuksesi.fi",
"sameAs":["https://www.linkedin.com/company/…"]}
</script>Ei llms.txt:ää
Osoitteessa /llms.txt ei ole tiedostoa. llms.txt on lyhyt Markdown-yleiskatsaus keskeiseen sisältöösi, jota jotkin tekoälyjärjestelmät käyttävät suunnistamiseen.
Tämä sinun tulisi tehdä: Luo /llms.txt: H1 nimellä, lyhyt kappale tarjonnasta ja linkkiluettelo keskeisille sivuille.
# Yrityksesi > Kuvaus yhdellä lauseella. ## Tärkeät sivut - [Tuote](https://oma-verkkotunnuksesi.fi/tuote): … - [Hinnat](https://oma-verkkotunnuksesi.fi/hinnat): … - [Tietoa meistä](https://oma-verkkotunnuksesi.fi/tietoa): …
Luottamus- ja entiteettisignaalit (E-E-A-T)
Ei tekijä- tai tekijyyssignaalia
Tekijää ei ole tunnistettavissa (ei meta-tagia, rel=author- eikä JSON-LD Person -merkintää). ”Kokemuksen” ja ”asiantuntemuksen” kannalta E-E-A-T-mielessä nimetty, jäljitettävä tekijyys on tärkeää.
Tämä sinun tulisi tehdä: Toimituksellisessa sisällössä nimeä tekijä ja linkitä tekijäsivu; merkitse hänet myös JSON-LD:n ”Person”-tyypiksi.
Ei sameAs-yhdistelyjä
JSON-LD:stä puuttuu ”sameAs”. Sen avulla tekoälyjärjestelmät yhdistävät brändisi tai henkilösi selkeästi tunnettuihin entiteetteihin (Wikidata, LinkedIn, toimialahakemistot).
Tämä sinun tulisi tehdä: Lisää ”sameAs” Organization- tai Person-kohtaan virallisten profiiliesi ja hakemistomerkintöjesi URL-osoitteilla.
Ei näkyvää tai merkittyä päivämäärää
Julkaisu- tai muokkauspäivämäärää ei ole tunnistettavissa (ei <time>, article:published_time eikä datePublished JSON-LD:ssä). Monissa kysymyksissä tekoälyjärjestelmät suosivat ajantasaisia lähteitä.
Tämä sinun tulisi tehdä: Aikaan sidotussa sisällössä näytä päivämäärä näkyvästi ja merkitse datePublished / dateModified JSON-LD:hen.
Tekninen perusta
sitemap.xml:ää ei löytynyt
Osoitteessa /sitemap.xml ei ollut kelvollista XML-sivukarttaa eikä robots.txt mainitse yhtään. Sivukartta auttaa robotteja löytämään kaikki olennaiset URL-osoitteet.
Tämä sinun tulisi tehdä: Luo sitemap.xml, joka sisältää kaikki indeksoitavat URL-osoitteet, ja viittaa siihen robots.txt:ssä.
Kunnossa (5)
- Pääsisältö on HTML:ssä ilman JavaScriptiä.
- Tasan yksi H1-otsikko.
- Canonical-URL on asetettu.
- Sivun otsikon pituus on järkevä.
- Ei noindexiä — sivu saa olla indeksoitu.
Seuraavat vaiheet
- Ei jäsenneltyjä tietoja (JSON-LD). Lisää vähintään ”Organization”-skeema ja sivutyyppiin sopiva (Article, Product, FAQPage …) JSON-LD:nä <head>-osaan.
- Ei llms.txt:ää. Luo /llms.txt: H1 nimellä, lyhyt kappale tarjonnasta ja linkkiluettelo keskeisille sivuille.
- Ei tekijä- tai tekijyyssignaalia. Toimituksellisessa sisällössä nimeä tekijä ja linkitä tekijäsivu; merkitse hänet myös JSON-LD:n ”Person”-tyypiksi.
Viikoittainen uudelleenskannaus sähköpostihälytyksellä jokaisesta muutoksesta. Valmisteilla — anna osoitteesi.
Menetelmä ja rajat
Tarkistettu 4.9.2026. citeglass noutaa sivun mozilla.org ja siihen liittyvät tiedostot (robots.txt, llms.txt, sitemap.xml) HTTP:llä — kerran tavallisena selaimena, kerran kutakin tekoälyrobotin user agentia kohti. JavaScriptiä ei suoriteta. Aika ensimmäiseen tavuun: 1071 ms.
Mitä tämä ei ole: Ei sijoitusten tai lainausten seurantaa, ei väitettä siitä, nimeääkö malli sinut tosiasiassa, eikä JavaScriptillä ladattavan sisällön tarkistusta. Tilannekuva yhden palvelin-IP:n näkökulmasta.