עברית
citeglass · בדיקת נראות ל-בינה מלאכותית

נבדק ב-14.9.2026 · https://www.eureko.sk/

יש 1 חסמים קריטיים למציאוּת בבינה מלאכותית — תקן אותם קודם.

F
24 / 100
1 קריטיים · 4 לבדיקה

מטריצת סורקי בינה מלאכותית

לכל בוט: מה robots.txt שלך מתיר — ומה השרת שלך באמת מחזיר לסוכן המשתמש של הבוט. שורות מודגשות באדום: robots מתיר, אך השרת חוסם (בדרך כלל כלל WAF או הגנה מפני בוטים).

בוטמפעילrobots.txtתגובת השרת
GPTBotOpenAIלא צויןחסום (403 / WAF)
OAI-SearchBotOpenAIלא צויןחסום (403 / WAF)
ChatGPT-UserOpenAIלא צויןחסום (403 / WAF)
ClaudeBotAnthropicלא צויןחסום (403 / WAF)
Claude-SearchBotAnthropicלא צויןחסום (403 / WAF)
Claude-UserAnthropicלא צויןחסום (403 / WAF)
PerplexityBotPerplexityלא צויןחסום (403 / WAF)
Perplexity-UserPerplexityלא צויןחסום (403 / WAF)
Google-ExtendedGoogle (Gemini-Training)לא צוין
GooglebotGoogle (KI-Übersichten)לא צויןחסום (403 / WAF)
CCBotCommon Crawl (Trainingsdaten vieler LLMs)לא צויןחסום (403 / WAF)
BytespiderByteDance (Doubao)לא צויןחסום (403 / WAF)
AmazonbotAmazon (Alexa/Rufus)לא צויןחסום (403 / WAF)
Applebot-ExtendedApple (Intelligence-Training)לא צוין
Meta-ExternalAgentMeta (Llama/Meta AI)לא צויןחסום (403 / WAF)
כיצד נוצר הציון?
השרת חוסם בוטים למרות ש-robots.txt מתיר אותם-20
מעט מאוד טקסט ב-HTML-10
אין נתונים מובְנים (JSON-LD)-8
כותרת העמוד קצרה מדי או ארוכה מדי-6
meta description חסר או לא מתאים-5
אין llms.txt-5
אין אות מחבר או מחברוּת-4
לא נמצא sitemap.xml-4
אין קישורי sameAs-3
אין קישור למידע משפטי / אודות / צור קשר-3
אין תאריך נראה או מסומן-3
אין כתובת canonical-3
לא נמצא robots.txt-2
תוצאה24 / 100

גישה לסורקי בינה מלאכותית

קריטי

השרת חוסם בוטים למרות ש-robots.txt מתיר אותם

עבור 13 בוט(ים) מ-OpenAI, Anthropic, Perplexity, Google (KI-Übersichten), Common Crawl (Trainingsdaten vieler LLMs), ByteDance (Doubao), Amazon (Alexa/Rufus), Meta (Llama/Meta AI), robots.txt אומר «מותר», אך השרת מגיב עם 403 או עם עמוד הגנה מפני בוטים. בדרך כלל כלל WAF, חומת אש או CDN שנועל בחוץ את הסורק תוך עקיפת robots.txt.

מה שכדאי לך לעשות: הוסף את סוכני המשתמש ו/או טווחי ה-IP של סורקי הבינה המלאכותית הרצויים לרשימת היתר ב-WAF / Cloudflare / חומת האש שלך. אמת אותם דרך DNS הפוך, לא רק לפי מחרוזת סוכן המשתמש.

הערה

לא נמצא robots.txt

בכתובת /robots.txt לא היה נגיש קובץ תקף. סורקים אז מניחים «הכול מותר» — עובד, אך אין לך שליטה ואין אות מפת אתר.

מה שכדאי לך לעשות: צור robots.txt בתיקיית השורש, לכל הפחות עם הפניה למפת אתר וכללי allow/disallow רצויים.

User-agent: *
Allow: /

Sitemap: https://הדומיין-שלך.example/sitemap.xml

תוכן ללא JavaScript

לבדיקה

מעט מאוד טקסט ב-HTML

ה-HTML הראשוני מכיל רק כ-40 תווים של טקסט נראה. זה בקושי מספיק כדי שמערכות בינה מלאכותית יתפסו בביטחון את נושא העמוד.

מה שכדאי לך לעשות: ודא שהתוכן האמיתי נמצא במלואו ב-HTML ולא בתמונות, ב-iframe או בבלוקים הנטענים דרך JavaScript.

מבנה והבנה מכונתית

לבדיקה

אין נתונים מובְנים (JSON-LD)

העמוד אינו מכיל JSON-LD. נתונים מובְנים עוזרים למערכות בינה מלאכותית לזהות באופן חד-משמעי ישויות, מחבר, ארגון, תאריך וסוג עמוד — בלעדיהם צריך לנחש הכול מהטקסט.

מה שכדאי לך לעשות: הוסף לפחות סכמת «Organization» וסכמה המתאימה לסוג העמוד (Article, Product, FAQPage …) כ-JSON-LD ב-<head>.

<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
 "name":"החברה שלך","url":"https://הדומיין-שלך.example",
 "sameAs":["https://www.linkedin.com/company/…"]}
</script>
לבדיקה

כותרת העמוד קצרה מדי או ארוכה מדי

אורך ה-<title> הוא 13 תווים. כ-30–60 תווים סביר: מתאר מספיק כדי לנקוב בנושא, קצר מספיק כדי שלא ייחתך.

מה שכדאי לך לעשות: כתוב כותרת תמציתית המכילה את הנושא ובמידת הצורך את המותג.

לבדיקה

meta description חסר או לא מתאים

אורך ה-meta description הוא 0 תווים. לעיתים קרובות זה הדבר הראשון שמערכות בינה מלאכותית ומנועי חיפוש קוראים כתקציר של העמוד.

מה שכדאי לך לעשות: כתוב תקציר עצמאי של העמוד במשפט או שניים (כ-120–200 תווים), לא רצף מילות מפתח.

הערה

אין llms.txt

בכתובת /llms.txt אין קובץ. llms.txt הוא סקירה קצרה ב-Markdown של התוכן המרכזי שלך שחלק ממערכות הבינה המלאכותית משתמשות בה להתמצאות.

מה שכדאי לך לעשות: צור /llms.txt: H1 עם השם, פסקה קצרה על ההצעה, ורשימת קישורים לעמודים המרכזיים.

# החברה שלך

> תיאור במשפט אחד.

## עמודים חשובים
- [מוצר](https://הדומיין-שלך.example/product): …
- [מחירים](https://הדומיין-שלך.example/pricing): …
- [אודות](https://הדומיין-שלך.example/about): …

אותות אמון וישות (E-E-A-T)

הערה

אין אות מחבר או מחברוּת

לא ניתן לזהות מחבר (לא meta tag, לא rel=author ולא JSON-LD Person). עבור «ניסיון» ו«מומחיות» במובן E-E-A-T נחשבת מחברוּת נקובה שניתן לעקוב אחריה.

מה שכדאי לך לעשות: בתוכן עריכתי, נקוב בשם מחבר וקשר עמוד מחבר; סמן אותו גם כ-JSON-LD «Person».

הערה

אין קישורי sameAs

ב-JSON-LD חסר «sameAs». באמצעותו מערכות בינה מלאכותית ממפות בבירור את המותג או האדם שלך לישויות מוכרות (Wikidata, LinkedIn, מדריכי ענף).

מה שכדאי לך לעשות: הוסף «sameAs» ב-Organization או ב-Person עם כתובות ה-URL של הפרופילים הרשמיים ורשומות המדריכים שלך.

הערה

אין קישור למידע משפטי / אודות / צור קשר

בעמוד שנבדק לא ניתן לזהות קישור למידע משפטי, לעמוד «אודות» או לצור קשר. עמודים כאלה הם אות אמון חזק ומסייעים במיפוי ישות.

מה שכדאי לך לעשות: קשר את המידע המשפטי או «אודות» ואת צור הקשר באופן נראה, בדרך כלל בכותרת התחתונה של כל עמוד.

הערה

אין תאריך נראה או מסומן

לא ניתן לזהות תאריך פרסום או שינוי (לא <time>, לא article:published_time ולא datePublished ב-JSON-LD). בשאלות רבות מערכות בינה מלאכותית מעדיפות מקורות עדכניים.

מה שכדאי לך לעשות: בתוכן הקשור בזמן, הצג תאריך באופן נראה וסמן datePublished / dateModified ב-JSON-LD.

בסיס טכני

הערה

לא נמצא sitemap.xml

בכתובת /sitemap.xml לא הייתה נגישה מפת אתר XML תקפה ו-robots.txt אינו נוקב באף אחת. מפת אתר עוזרת לסורקים למצוא את כל כתובות ה-URL הרלוונטיות.

מה שכדאי לך לעשות: צור sitemap.xml עם כל כתובות ה-URL הניתנות לאינדוקס והפנה אליו ב-robots.txt.

הערה

אין כתובת canonical

העמוד אינו מגדיר <link rel="canonical">. ללא canonical עשוי להישאר לא ברור איזו גרסה קובעת כשקיימות כמה וריאציות של כתובת URL.

מה שכדאי לך לעשות: הגדר בכל עמוד <link rel="canonical"> המפנה לעצמו עם כתובת ה-URL המועדפת.

תקין (2)
  • בדיוק כותרת H1 אחת.
  • זמן תגובה מהיר מהשרת.

הצעדים הבאים

  1. השרת חוסם בוטים למרות ש-robots.txt מתיר אותם. הוסף את סוכני המשתמש ו/או טווחי ה-IP של סורקי הבינה המלאכותית הרצויים לרשימת היתר ב-WAF / Cloudflare / חומת האש שלך. אמת אותם דרך DNS הפוך, לא רק לפי מחרוזת סוכן המשתמש.
  2. מעט מאוד טקסט ב-HTML. ודא שהתוכן האמיתי נמצא במלואו ב-HTML ולא בתמונות, ב-iframe או בבלוקים הנטענים דרך JavaScript.
  3. אין נתונים מובְנים (JSON-LD). הוסף לפחות סכמת «Organization» וסכמה המתאימה לסוג העמוד (Article, Product, FAQPage …) כ-JSON-LD ב-<head>.
נטר את העמוד הזה

סריקה חוזרת שבועית עם התראה במייל בכל שינוי. בהכנה — הזן את הכתובת שלך.

שיטה וגבולות

נבדק ב-14.9.2026. citeglass מביא את eureko.sk ואת הקבצים הקשורים (robots.txt, llms.txt, sitemap.xml) דרך HTTP — פעם כדפדפן רגיל, פעם לכל סוכן משתמש של סורק בינה מלאכותית. JavaScript אינו מורץ. זמן עד הבייט הראשון: 270 מ"ש.

מה זה לא: אין מעקב אחר דירוגים או ציטוטים, אין קביעה אם מודל באמת מזכיר אותך, ואין בדיקת תוכן הנטען דרך JavaScript. תצלום מצב מנקודת מבט של כתובת IP אחת של שרת.

בדוק אתר אחר