Tarkistettu 4.9.2026 · https://example.org/
Ei kovia esteitä, mutta 4 kohtaa heikentää tekoälyllä löytymistä.
Tekoälyrobottien matriisi
Kunkin robotin osalta: mitä robots.txt sallii — ja mitä palvelimesi tosiasiassa palauttaa robotin user agentille. Punaisella korostetut rivit: robots sallii sen, mutta palvelin estää (yleensä WAF- tai bottisuojaussääntö).
| Robotti | Ylläpitäjä | robots.txt | Palvelimen vastaus |
|---|---|---|---|
| GPTBot | OpenAI | ei mainittu | 200 + sisältö |
| OAI-SearchBot | OpenAI | ei mainittu | 200 + sisältö |
| ChatGPT-User | OpenAI | ei mainittu | 200 + sisältö |
| ClaudeBot | Anthropic | ei mainittu | 200 + sisältö |
| Claude-SearchBot | Anthropic | ei mainittu | 200 + sisältö |
| Claude-User | Anthropic | ei mainittu | 200 + sisältö |
| PerplexityBot | Perplexity | ei mainittu | 200 + sisältö |
| Perplexity-User | Perplexity | ei mainittu | 200 + sisältö |
| Google-Extended | Google (Gemini-Training) | ei mainittu | — |
| Googlebot | Google (KI-Übersichten) | ei mainittu | 200 + sisältö |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | ei mainittu | 200 + sisältö |
| Bytespider | ByteDance (Doubao) | ei mainittu | 200 + sisältö |
| Amazonbot | Amazon (Alexa/Rufus) | ei mainittu | 200 + sisältö |
| Applebot-Extended | Apple (Intelligence-Training) | ei mainittu | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | ei mainittu | 200 + sisältö |
Miten pistemäärä muodostuu?
| Hyvin vähän tekstiä HTML:ssä | -10 |
| Ei jäsenneltyjä tietoja (JSON-LD) | -8 |
| Sivun otsikko liian lyhyt tai liian pitkä | -6 |
| Meta-kuvaus puuttuu tai ei sovi | -5 |
| Ei llms.txt:ää | -5 |
| Ei tekijä- tai tekijyyssignaalia | -4 |
| sitemap.xml:ää ei löytynyt | -4 |
| Ei sameAs-yhdistelyjä | -3 |
| Ei linkkiä oikeudellisiin tietoihin / tietoa meistä / yhteystietoihin | -3 |
| Ei näkyvää tai merkittyä päivämäärää | -3 |
| Ei canonical-URL:ää | -3 |
| robots.txt:ää ei löytynyt | -2 |
| Tulos | 44 / 100 |
Tekoälyrobottien pääsy
robots.txt:ää ei löytynyt
Osoitteessa /robots.txt ei ollut kelvollista tiedostoa. Robotit olettavat silloin ”kaikki sallittu” — se toimii, mutta sinulla ei ole ohjausta eikä sivukarttasignaalia.
Tämä sinun tulisi tehdä: Luo robots.txt juurihakemistoon, vähintään sivukarttaviittauksella ja haluamillasi allow-/disallow-säännöillä.
User-agent: * Allow: / Sitemap: https://oma-verkkotunnuksesi.fi/sitemap.xml
Sisältö ilman JavaScriptiä
Hyvin vähän tekstiä HTML:ssä
Alkuperäinen HTML sisältää vain noin 142 merkkiä näkyvää tekstiä. Se riittää tuskin siihen, että tekoälyjärjestelmät hahmottaisivat sivun aiheen varmasti.
Tämä sinun tulisi tehdä: Varmista, että varsinainen sisältö on kokonaan HTML:ssä eikä kuvissa, iframeissa tai JavaScriptillä ladattavissa lohkoissa.
Rakenne ja koneellinen ymmärrettävyys
Ei jäsenneltyjä tietoja (JSON-LD)
Sivu ei sisällä JSON-LD:tä. Jäsennellyt tiedot auttavat tekoälyjärjestelmiä tunnistamaan yksiselitteisesti entiteetit, tekijän, organisaation, päivämäärän ja sivutyypin — ilman niitä kaikki on arvattava leipätekstistä.
Tämä sinun tulisi tehdä: Lisää vähintään ”Organization”-skeema ja sivutyyppiin sopiva (Article, Product, FAQPage …) JSON-LD:nä <head>-osaan.
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"Yrityksesi","url":"https://oma-verkkotunnuksesi.fi",
"sameAs":["https://www.linkedin.com/company/…"]}
</script>Sivun otsikko liian lyhyt tai liian pitkä
<title> on 14 merkkiä pitkä. Noin 30–60 merkkiä on järkevä: riittävän kuvaava aiheen nimeämiseen, riittävän lyhyt jäämättä katkeamatta.
Tämä sinun tulisi tehdä: Kirjoita ytimekäs otsikko, joka sisältää aiheen ja tarvittaessa brändin.
Meta-kuvaus puuttuu tai ei sovi
Meta-kuvaus on 0 merkkiä pitkä. Se on usein ensimmäinen asia, jonka tekoälyjärjestelmät ja hakukoneet lukevat sivun tiivistelmänä.
Tämä sinun tulisi tehdä: Kirjoita sivusta itsenäinen tiivistelmä yhdellä tai kahdella lauseella (noin 120–200 merkkiä), ei avainsanajonoa.
Ei llms.txt:ää
Osoitteessa /llms.txt ei ole tiedostoa. llms.txt on lyhyt Markdown-yleiskatsaus keskeiseen sisältöösi, jota jotkin tekoälyjärjestelmät käyttävät suunnistamiseen.
Tämä sinun tulisi tehdä: Luo /llms.txt: H1 nimellä, lyhyt kappale tarjonnasta ja linkkiluettelo keskeisille sivuille.
# Yrityksesi > Kuvaus yhdellä lauseella. ## Tärkeät sivut - [Tuote](https://oma-verkkotunnuksesi.fi/tuote): … - [Hinnat](https://oma-verkkotunnuksesi.fi/hinnat): … - [Tietoa meistä](https://oma-verkkotunnuksesi.fi/tietoa): …
Luottamus- ja entiteettisignaalit (E-E-A-T)
Ei tekijä- tai tekijyyssignaalia
Tekijää ei ole tunnistettavissa (ei meta-tagia, rel=author- eikä JSON-LD Person -merkintää). ”Kokemuksen” ja ”asiantuntemuksen” kannalta E-E-A-T-mielessä nimetty, jäljitettävä tekijyys on tärkeää.
Tämä sinun tulisi tehdä: Toimituksellisessa sisällössä nimeä tekijä ja linkitä tekijäsivu; merkitse hänet myös JSON-LD:n ”Person”-tyypiksi.
Ei sameAs-yhdistelyjä
JSON-LD:stä puuttuu ”sameAs”. Sen avulla tekoälyjärjestelmät yhdistävät brändisi tai henkilösi selkeästi tunnettuihin entiteetteihin (Wikidata, LinkedIn, toimialahakemistot).
Tämä sinun tulisi tehdä: Lisää ”sameAs” Organization- tai Person-kohtaan virallisten profiiliesi ja hakemistomerkintöjesi URL-osoitteilla.
Ei linkkiä oikeudellisiin tietoihin / tietoa meistä / yhteystietoihin
Tarkistetulla sivulla ei ole tunnistettavissa linkkiä oikeudellisiin tietoihin, ”Tietoa meistä” -sivulle tai yhteystietoihin. Tällaiset sivut ovat vahva luottamussignaali ja auttavat entiteetin yhdistämisessä.
Tämä sinun tulisi tehdä: Linkitä oikeudelliset tiedot tai ”Tietoa meistä” ja yhteystiedot näkyvästi, yleensä jokaisen sivun alatunnisteessa.
Ei näkyvää tai merkittyä päivämäärää
Julkaisu- tai muokkauspäivämäärää ei ole tunnistettavissa (ei <time>, article:published_time eikä datePublished JSON-LD:ssä). Monissa kysymyksissä tekoälyjärjestelmät suosivat ajantasaisia lähteitä.
Tämä sinun tulisi tehdä: Aikaan sidotussa sisällössä näytä päivämäärä näkyvästi ja merkitse datePublished / dateModified JSON-LD:hen.
Tekninen perusta
sitemap.xml:ää ei löytynyt
Osoitteessa /sitemap.xml ei ollut kelvollista XML-sivukarttaa eikä robots.txt mainitse yhtään. Sivukartta auttaa robotteja löytämään kaikki olennaiset URL-osoitteet.
Tämä sinun tulisi tehdä: Luo sitemap.xml, joka sisältää kaikki indeksoitavat URL-osoitteet, ja viittaa siihen robots.txt:ssä.
Ei canonical-URL:ää
Sivu ei aseta <link rel="canonical"> -elementtiä. Ilman canonicalia voi jäädä epäselväksi, mikä versio on määräävä, kun URL-variantteja on useita.
Tämä sinun tulisi tehdä: Aseta jokaiselle sivulle itseensä viittaava <link rel="canonical"> ensisijaisella URL:lla.
Kunnossa (2)
- Tasan yksi H1-otsikko.
- Palvelimen nopea vasteaika.
Seuraavat vaiheet
- Hyvin vähän tekstiä HTML:ssä. Varmista, että varsinainen sisältö on kokonaan HTML:ssä eikä kuvissa, iframeissa tai JavaScriptillä ladattavissa lohkoissa.
- Ei jäsenneltyjä tietoja (JSON-LD). Lisää vähintään ”Organization”-skeema ja sivutyyppiin sopiva (Article, Product, FAQPage …) JSON-LD:nä <head>-osaan.
- Sivun otsikko liian lyhyt tai liian pitkä. Kirjoita ytimekäs otsikko, joka sisältää aiheen ja tarvittaessa brändin.
Viikoittainen uudelleenskannaus sähköpostihälytyksellä jokaisesta muutoksesta. Valmisteilla — anna osoitteesi.
Menetelmä ja rajat
Tarkistettu 4.9.2026. citeglass noutaa sivun example.org ja siihen liittyvät tiedostot (robots.txt, llms.txt, sitemap.xml) HTTP:llä — kerran tavallisena selaimena, kerran kutakin tekoälyrobotin user agentia kohti. JavaScriptiä ei suoriteta. Aika ensimmäiseen tavuun: 21 ms.
Mitä tämä ei ole: Ei sijoitusten tai lainausten seurantaa, ei väitettä siitä, nimeääkö malli sinut tosiasiassa, eikä JavaScriptillä ladattavan sisällön tarkistusta. Tilannekuva yhden palvelin-IP:n näkökulmasta.