Ελέγχθηκε στις 24/9/2026 · https://www.nytimes.com/
Υπάρχουν 2 κρίσιμα εμπόδια για την ανευρεσιμότητα μέσω AI — διορθώστε τα πρώτα.
3 σαρώσεις αυτού του ιστότοπου, βαθμολογία -37 από την πρώτη. Με την παρακολούθηση, το citeglass ελέγχει αυτόματα τον ιστότοπο κάθε εβδομάδα και ειδοποιεί αν κάτι χαλάσει — εγγράψου για να ενημερωθείς στην κυκλοφορία.
Πίνακας ρομπότ AI
Για κάθε ρομπότ: τι επιτρέπει το robots.txt σας — και τι επιστρέφει πραγματικά ο διακομιστής σας στον user agent του ρομπότ. Γραμμές με κόκκινη επισήμανση: το robots το επιτρέπει, αλλά ο διακομιστής το αποκλείει (συνήθως κανόνας WAF ή προστασίας από ρομπότ).
| Ρομπότ | Χειριστής | robots.txt | Απόκριση διακομιστή |
|---|---|---|---|
| GPTBot | OpenAI | αποκλεισμένο | αποκλεισμένο (403 / WAF) |
| OAI-SearchBot | OpenAI | αποκλεισμένο | αποκλεισμένο (403 / WAF) |
| ChatGPT-User | OpenAI | αποκλεισμένο | αποκλεισμένο (403 / WAF) |
| ClaudeBot | Anthropic | αποκλεισμένο | αποκλεισμένο (403 / WAF) |
| Claude-SearchBot | Anthropic | αποκλεισμένο | αποκλεισμένο (403 / WAF) |
| Claude-User | Anthropic | αποκλεισμένο | αποκλεισμένο (403 / WAF) |
| PerplexityBot | Perplexity | αποκλεισμένο | αποκλεισμένο (403 / WAF) |
| Perplexity-User | Perplexity | αποκλεισμένο | αποκλεισμένο (403 / WAF) |
| Google-Extended | Google (Gemini-Training) | αποκλεισμένο | — |
| Googlebot | Google (KI-Übersichten) | επιτρέπεται | αποκλεισμένο (403 / WAF) |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | αποκλεισμένο | αποκλεισμένο (403 / WAF) |
| Bytespider | ByteDance (Doubao) | αποκλεισμένο | αποκλεισμένο (403 / WAF) |
| Amazonbot | Amazon (Alexa/Rufus) | επιτρέπεται | αποκλεισμένο (403 / WAF) |
| Applebot-Extended | Apple (Intelligence-Training) | αποκλεισμένο | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | αποκλεισμένο | αποκλεισμένο (403 / WAF) |
Πώς προκύπτει η βαθμολογία;
| Bots αναζήτησης AI είναι αποκλεισμένα στο robots.txt | -32 |
| Ο διακομιστής αποκλείει ρομπότ ενώ το robots.txt τα επιτρέπει | -12 |
| Πολύ λίγο κείμενο στο HTML | -10 |
| Χωρίς δομημένα δεδομένα (JSON-LD) | -8 |
| Ο τίτλος σελίδας πολύ σύντομος ή πολύ μακρύς | -6 |
| Όχι ακριβώς μία επικεφαλίδα H1 | -5 |
| Η meta description λείπει ή δεν ταιριάζει | -5 |
| Χωρίς llms.txt | -5 |
| Χωρίς σήμα συγγραφέα ή πατρότητας | -4 |
| Χωρίς συνδέσεις sameAs | -3 |
| Χωρίς σύνδεσμο προς νομικές πληροφορίες / σχετικά / επικοινωνία | -3 |
| Χωρίς ορατή ή σημασμένη ημερομηνία | -3 |
| Χωρίς canonical URL | -3 |
| Αποτέλεσμα | 1 / 100 |
Πρόσβαση για ρομπότ AI
Bots αναζήτησης AI είναι αποκλεισμένα στο robots.txt
Το robots.txt αποκλείει 6 bots που ανακτούν περιεχόμενο για απαντήσεις βοηθών AI και μηχανών αναζήτησης: OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User. Όσο είναι αποκλεισμένα, ο ιστότοπός σας δεν μπορεί να εμφανιστεί εκεί ως πηγή.
Αυτό θα πρέπει να κάνετε: Ελέγξτε για κάθε bot αν ο αποκλεισμός είναι σκόπιμος. Αν θέλετε να εξαιρέσετε μόνο την εκπαίδευση AI, αποκλείστε τα bots εκπαίδευσης (GPTBot, ClaudeBot, Google-Extended) και επιτρέψτε τα bots αναζήτησης.
User-agent: OAI-SearchBot Allow: / User-agent: ChatGPT-User Allow: / User-agent: Claude-SearchBot Allow: / User-agent: Claude-User Allow: / User-agent: PerplexityBot Allow: / User-agent: Perplexity-User Allow: /
Ο διακομιστής αποκλείει ρομπότ ενώ το robots.txt τα επιτρέπει
Για 2 ρομπότ από Google (KI-Übersichten), Amazon (Alexa/Rufus), το robots.txt λέει «επιτρέπεται», αλλά ο διακομιστής απαντά με 403 ή με σελίδα προστασίας από ρομπότ. Συνήθως κανόνας WAF, τείχους προστασίας ή CDN που αποκλείει το ρομπότ παρακάμπτοντας το robots.txt.
Αυτό θα πρέπει να κάνετε: Προσθέστε τους user agents ή/και τα εύρη IP των επιθυμητών ρομπότ AI σε μια λίστα επιτρεπόμενων στο WAF / Cloudflare / τείχος προστασίας σας. Επαληθεύστε τους μέσω αντίστροφου DNS, όχι μόνο από τη συμβολοσειρά user agent.
Περιεχόμενο χωρίς JavaScript
Πολύ λίγο κείμενο στο HTML
Το αρχικό HTML περιέχει μόνο περίπου 55 χαρακτήρες ορατού κειμένου. Αυτό μόλις που φτάνει για να αντιληφθούν με βεβαιότητα τα συστήματα AI το θέμα της σελίδας.
Αυτό θα πρέπει να κάνετε: Βεβαιωθείτε ότι το πραγματικό περιεχόμενο βρίσκεται πλήρως στο HTML και όχι σε εικόνες, iframe ή μπλοκ που φορτώνονται μέσω JavaScript.
Δομή και κατανόηση από μηχανή
Χωρίς δομημένα δεδομένα (JSON-LD)
Η σελίδα δεν περιέχει JSON-LD. Τα δομημένα δεδομένα βοηθούν τα συστήματα AI να αναγνωρίσουν αναμφίβολα οντότητες, συγγραφέα, οργανισμό, ημερομηνία και τύπο σελίδας — χωρίς αυτά όλα πρέπει να μαντεύονται από το κείμενο.
Αυτό θα πρέπει να κάνετε: Προσθέστε τουλάχιστον ένα σχήμα «Organization» και ένα που ταιριάζει στον τύπο σελίδας (Article, Product, FAQPage …) ως JSON-LD στο <head>.
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"Η εταιρεία σας","url":"https://to-domain-sas.gr",
"sameAs":["https://www.linkedin.com/company/…"]}
</script>Ο τίτλος σελίδας πολύ σύντομος ή πολύ μακρύς
Το <title> έχει μήκος 11 χαρακτήρες. Λογικό είναι περίπου 30–60 χαρακτήρες: αρκετά περιγραφικό για να ονομάσει το θέμα, αρκετά σύντομο για να μην κόβεται.
Αυτό θα πρέπει να κάνετε: Γράψτε έναν περιεκτικό τίτλο που περιέχει το θέμα και, αν χρειάζεται, τη μάρκα.
Όχι ακριβώς μία επικεφαλίδα H1
Η σελίδα έχει 0 επικεφαλίδες H1. Μία αναμφίβολη H1 λέει σε ανθρώπους και μηχανές για τι πράγμα είναι κυρίως η σελίδα.
Αυτό θα πρέπει να κάνετε: Ορίστε ακριβώς μία H1 που ονομάζει το κύριο θέμα της σελίδας. Οτιδήποτε από κάτω ξεκινά από H2.
Η meta description λείπει ή δεν ταιριάζει
Η meta description έχει μήκος 0 χαρακτήρες. Είναι συχνά το πρώτο που διαβάζουν τα συστήματα AI και οι μηχανές αναζήτησης ως σύνοψη της σελίδας.
Αυτό θα πρέπει να κάνετε: Γράψτε μια αυτοτελή σύνοψη της σελίδας σε μία ή δύο προτάσεις (περίπου 120–200 χαρακτήρες), όχι μια σειρά λέξεων-κλειδιών.
Χωρίς llms.txt
Στο /llms.txt δεν υπάρχει αρχείο. Το llms.txt είναι μια σύντομη επισκόπηση του βασικού σας περιεχομένου σε Markdown, την οποία ορισμένα συστήματα AI χρησιμοποιούν για προσανατολισμό.
Αυτό θα πρέπει να κάνετε: Δημιουργήστε ένα /llms.txt: μια H1 με το όνομα, μια σύντομη παράγραφο για την προσφορά και μια λίστα συνδέσμων προς τις κεντρικές σελίδες.
# Η εταιρεία σας > Περιγραφή σε μία πρόταση. ## Βασικές σελίδες - [Προϊόν](https://to-domain-sas.gr/proion): … - [Τιμές](https://to-domain-sas.gr/times): … - [Σχετικά](https://to-domain-sas.gr/schetika): …
Σήματα εμπιστοσύνης και οντότητας (E-E-A-T)
Χωρίς σήμα συγγραφέα ή πατρότητας
Δεν αναγνωρίζεται συγγραφέας (ούτε meta tag, ούτε rel=author, ούτε JSON-LD Person). Για «εμπειρία» και «τεχνογνωσία» με την έννοια E-E-A-T μετρά η ονομαζόμενη, ιχνηλατήσιμη πατρότητα.
Αυτό θα πρέπει να κάνετε: Σε συντακτικό περιεχόμενο ονομάστε έναν συγγραφέα με το όνομά του και συνδέστε μια σελίδα συγγραφέα· σημάνετέ τον και ως JSON-LD «Person».
Χωρίς συνδέσεις sameAs
Στο JSON-LD λείπει το «sameAs». Με αυτό τα συστήματα AI αντιστοιχίζουν σαφώς τη μάρκα ή το πρόσωπό σας με γνωστές οντότητες (Wikidata, LinkedIn, κατάλογοι κλάδου).
Αυτό θα πρέπει να κάνετε: Προσθέστε ένα «sameAs» στο Organization ή Person με τα URL των επίσημων προφίλ σας και των καταχωρήσεων σε καταλόγους.
Χωρίς σύνδεσμο προς νομικές πληροφορίες / σχετικά / επικοινωνία
Στη σελίδα που ελέγχθηκε δεν αναγνωρίζεται σύνδεσμος προς νομικές πληροφορίες, σελίδα «Σχετικά» ή επικοινωνία. Τέτοιες σελίδες είναι ισχυρό σήμα εμπιστοσύνης και βοηθούν στην αντιστοίχιση οντότητας.
Αυτό θα πρέπει να κάνετε: Συνδέστε τις νομικές πληροφορίες ή το «Σχετικά» και την επικοινωνία εμφανώς, συνήθως στο υποσέλιδο κάθε σελίδας.
Χωρίς ορατή ή σημασμένη ημερομηνία
Δεν αναγνωρίζεται ημερομηνία δημοσίευσης ή τροποποίησης (ούτε <time>, ούτε article:published_time, ούτε datePublished στο JSON-LD). Σε πολλές ερωτήσεις τα συστήματα AI προτιμούν επίκαιρες πηγές.
Αυτό θα πρέπει να κάνετε: Σε περιεχόμενο με χρονική αναφορά εμφανίστε μια ημερομηνία εμφανώς και σημάνετε datePublished / dateModified στο JSON-LD.
Τεχνική βάση
Χωρίς canonical URL
Η σελίδα δεν ορίζει <link rel="canonical">. Χωρίς canonical μπορεί να παραμείνει ασαφές ποια έκδοση είναι η καθοριστική όταν υπάρχουν πολλές παραλλαγές URL.
Αυτό θα πρέπει να κάνετε: Ορίστε σε κάθε σελίδα ένα αυτοαναφορικό <link rel="canonical"> με το προτιμώμενο URL.
Εντάξει (3)
- Το sitemap είναι προσβάσιμο.
- Γρήγορος χρόνος απόκρισης διακομιστή.
- Χωρίς noindex — η σελίδα μπορεί να ευρετηριαστεί.
Επόμενα βήματα
- Bots αναζήτησης AI είναι αποκλεισμένα στο robots.txt. Ελέγξτε για κάθε bot αν ο αποκλεισμός είναι σκόπιμος. Αν θέλετε να εξαιρέσετε μόνο την εκπαίδευση AI, αποκλείστε τα bots εκπαίδευσης (GPTBot, ClaudeBot, Google-Extended) και επιτρέψτε τα bots αναζήτησης.
- Ο διακομιστής αποκλείει ρομπότ ενώ το robots.txt τα επιτρέπει. Προσθέστε τους user agents ή/και τα εύρη IP των επιθυμητών ρομπότ AI σε μια λίστα επιτρεπόμενων στο WAF / Cloudflare / τείχος προστασίας σας. Επαληθεύστε τους μέσω αντίστροφου DNS, όχι μόνο από τη συμβολοσειρά user agent.
- Πολύ λίγο κείμενο στο HTML. Βεβαιωθείτε ότι το πραγματικό περιεχόμενο βρίσκεται πλήρως στο HTML και όχι σε εικόνες, iframe ή μπλοκ που φορτώνονται μέσω JavaScript.
Μέθοδος και όρια
Ελέγχθηκε στις 24/9/2026. Το citeglass ανακτά το nytimes.com και τα σχετικά αρχεία (robots.txt, llms.txt, sitemap.xml) μέσω HTTP — μία φορά ως κανονικό πρόγραμμα περιήγησης, μία φορά ανά user agent ρομπότ AI. Δεν εκτελείται JavaScript. Χρόνος έως το πρώτο byte: 123 ms.
Τι δεν είναι αυτό: Καμία παρακολούθηση θέσεων ή παραπομπών, καμία δήλωση για το αν ένα μοντέλο σας αναφέρει πραγματικά, και κανένας έλεγχος περιεχομένου που φορτώνεται μέσω JavaScript. Ένα στιγμιότυπο από την οπτική ενός IP διακομιστή.