فُحص في 4/9/2026 · https://example.com/
لا عوائق صارمة، لكن 4 نقاط تُضعف قابلية الاكتشاف بالذكاء الاصطناعي.
مصفوفة زواحف الذكاء الاصطناعي
لكل روبوت: ماذا يسمح به robots.txt الخاص بك — وماذا يُرجع خادمك فعليًا إلى وكيل المستخدم للروبوت. الصفوف المُظللة بالأحمر: robots يسمح، لكن الخادم يحجب (عادةً قاعدة WAF أو حماية من الروبوتات).
| الروبوت | المُشغِّل | robots.txt | استجابة الخادم |
|---|---|---|---|
| GPTBot | OpenAI | غير مذكور | 200 + محتوى |
| OAI-SearchBot | OpenAI | غير مذكور | 200 + محتوى |
| ChatGPT-User | OpenAI | غير مذكور | 200 + محتوى |
| ClaudeBot | Anthropic | غير مذكور | 200 + محتوى |
| Claude-SearchBot | Anthropic | غير مذكور | 200 + محتوى |
| Claude-User | Anthropic | غير مذكور | 200 + محتوى |
| PerplexityBot | Perplexity | غير مذكور | 200 + محتوى |
| Perplexity-User | Perplexity | غير مذكور | 200 + محتوى |
| Google-Extended | Google (Gemini-Training) | غير مذكور | — |
| Googlebot | Google (KI-Übersichten) | غير مذكور | 200 + محتوى |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | غير مذكور | 200 + محتوى |
| Bytespider | ByteDance (Doubao) | غير مذكور | 200 + محتوى |
| Amazonbot | Amazon (Alexa/Rufus) | غير مذكور | 200 + محتوى |
| Applebot-Extended | Apple (Intelligence-Training) | غير مذكور | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | غير مذكور | 200 + محتوى |
كيف تنشأ الدرجة؟
| نص قليل جدًا في HTML | -10 |
| لا بيانات منظَّمة (JSON-LD) | -8 |
| عنوان الصفحة قصير جدًا أو طويل جدًا | -6 |
| وصف meta مفقود أو غير مناسب | -5 |
| لا llms.txt | -5 |
| لا إشارة مؤلف أو تأليف | -4 |
| لم يُعثر على sitemap.xml | -4 |
| لا روابط sameAs | -3 |
| لا رابط إلى المعلومات القانونية / من نحن / اتصل بنا | -3 |
| لا تاريخ مرئي أو مُرمَّز | -3 |
| لا عنوان canonical | -3 |
| لم يُعثر على robots.txt | -2 |
| النتيجة | 44 / 100 |
الوصول لزواحف الذكاء الاصطناعي
لم يُعثر على robots.txt
لم يتوفر أي ملف صالح على /robots.txt. عندها تفترض الزواحف «كل شيء مسموح» — يعمل، لكن ليس لديك توجيه ولا إشارة خريطة موقع.
ما ينبغي أن تفعله: أنشئ robots.txt في الدليل الجذر، على الأقل بإشارة إلى خريطة الموقع وقواعد allow/disallow المطلوبة.
User-agent: * Allow: / Sitemap: https://نطاقك.example/sitemap.xml
المحتوى دون JavaScript
نص قليل جدًا في HTML
يحتوي HTML الأولي على نحو 142 حرفًا فقط من النص المرئي. يكاد لا يكفي لأنظمة الذكاء الاصطناعي لتدرك موضوع الصفحة بثقة.
ما ينبغي أن تفعله: تأكد من أن المحتوى الفعلي موجود كاملاً في HTML وليس في صور أو إطارات iframe أو كتل تُحمَّل عبر JavaScript.
البنية وقابلية الفهم الآلي
لا بيانات منظَّمة (JSON-LD)
لا تحتوي الصفحة على JSON-LD. تساعد البيانات المنظَّمة أنظمة الذكاء الاصطناعي على التعرف بوضوح على الكيانات والمؤلف والمؤسسة والتاريخ ونوع الصفحة — بدونها يجب تخمين كل شيء من النص.
ما ينبغي أن تفعله: أضِف على الأقل مخطط «Organization» ومخططًا يناسب نوع الصفحة (Article، Product، FAQPage …) بوصفه JSON-LD في <head>.
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"شركتك","url":"https://نطاقك.example",
"sameAs":["https://www.linkedin.com/company/…"]}
</script>عنوان الصفحة قصير جدًا أو طويل جدًا
طول <title> هو 14 حرفًا. نحو 30–60 حرفًا معقول: وصفي بما يكفي لتسمية الموضوع، قصير بما يكفي كي لا يُقتطع.
ما ينبغي أن تفعله: اكتب عنوانًا مقتضبًا يحتوي على الموضوع والعلامة التجارية عند الحاجة.
وصف meta مفقود أو غير مناسب
طول وصف meta هو 0 حرفًا. غالبًا ما يكون أول ما تقرؤه أنظمة الذكاء الاصطناعي ومحركات البحث كملخص للصفحة.
ما ينبغي أن تفعله: اكتب ملخصًا مستقلاً للصفحة في جملة أو جملتين (نحو 120–200 حرف)، لا سلسلة كلمات مفتاحية.
لا llms.txt
لا يوجد ملف على /llms.txt. llms.txt نظرة عامة قصيرة بصيغة Markdown لمحتواك المحوري تستخدمها بعض أنظمة الذكاء الاصطناعي للتوجُّه.
ما ينبغي أن تفعله: أنشئ /llms.txt: عنوان H1 بالاسم، وفقرة قصيرة عن العرض، وقائمة روابط إلى الصفحات المحورية.
# شركتك > وصف في جملة واحدة. ## صفحات مهمة - [المنتج](https://نطاقك.example/product): … - [الأسعار](https://نطاقك.example/pricing): … - [من نحن](https://نطاقك.example/about): …
إشارات الثقة والكيان (E-E-A-T)
لا إشارة مؤلف أو تأليف
لا يمكن التعرف على مؤلف (لا وسم meta، ولا rel=author، ولا JSON-LD Person). لأجل «الخبرة» و«الاختصاص» بمعنى E-E-A-T يُحتسب تأليف مُسمّى وقابل للتتبع.
ما ينبغي أن تفعله: للمحتوى التحريري سمِّ مؤلفًا بالاسم واربط صفحة مؤلف؛ رمِّزه أيضًا كـ JSON-LD «Person».
لا روابط sameAs
يفتقر JSON-LD إلى «sameAs». بها تربط أنظمة الذكاء الاصطناعي علامتك أو شخصك بوضوح بكيانات معروفة (Wikidata، LinkedIn، أدلة القطاع).
ما ينبغي أن تفعله: أضِف «sameAs» في Organization أو Person بعناوين URL لملفاتك الرسمية ومُدخلات الأدلة.
لا رابط إلى المعلومات القانونية / من نحن / اتصل بنا
على الصفحة المفحوصة لا يمكن التعرف على رابط إلى المعلومات القانونية أو صفحة «من نحن» أو الاتصال. هذه الصفحات إشارة ثقة قوية وتساعد على ربط الكيان.
ما ينبغي أن تفعله: اربط المعلومات القانونية أو «من نحن» والاتصال بشكل مرئي، عادةً في تذييل كل صفحة.
لا تاريخ مرئي أو مُرمَّز
لا يمكن التعرف على تاريخ نشر أو تعديل (لا <time>، ولا article:published_time، ولا datePublished في JSON-LD). في كثير من الأسئلة تُفضِّل أنظمة الذكاء الاصطناعي المصادر الحديثة.
ما ينبغي أن تفعله: للمحتوى المرتبط بالزمن اعرض تاريخًا بشكل مرئي ورمِّز datePublished / dateModified في JSON-LD.
الأساس التقني
لم يُعثر على sitemap.xml
لم تتوفر خريطة موقع XML صالحة على /sitemap.xml، ولا يذكر robots.txt أيًا منها. تساعد خريطة الموقع الزواحف على إيجاد كل عناوين URL ذات الصلة.
ما ينبغي أن تفعله: أنشئ sitemap.xml بكل عناوين URL القابلة للفهرسة وأشِر إليه في robots.txt.
لا عنوان canonical
لا تضبط الصفحة <link rel="canonical">. بدون canonical قد يبقى غير واضح أي نسخة هي المرجعية عند وجود عدة صيغ لعنوان URL.
ما ينبغي أن تفعله: اضبط في كل صفحة <link rel="canonical"> ذاتي المرجعية بعنوان URL المفضل.
سليم (2)
- عنوان H1 واحد بالضبط.
- زمن استجابة سريع من الخادم.
الخطوات التالية
- نص قليل جدًا في HTML. تأكد من أن المحتوى الفعلي موجود كاملاً في HTML وليس في صور أو إطارات iframe أو كتل تُحمَّل عبر JavaScript.
- لا بيانات منظَّمة (JSON-LD). أضِف على الأقل مخطط «Organization» ومخططًا يناسب نوع الصفحة (Article، Product، FAQPage …) بوصفه JSON-LD في <head>.
- عنوان الصفحة قصير جدًا أو طويل جدًا. اكتب عنوانًا مقتضبًا يحتوي على الموضوع والعلامة التجارية عند الحاجة.
إعادة فحص أسبوعية مع تنبيه بالبريد الإلكتروني عند كل تغيير. قيد الإعداد — أدخل عنوانك.
المنهجية والحدود
فُحص في 4/9/2026. يجلب citeglass example.com والملفات المرتبطة (robots.txt وllms.txt وsitemap.xml) عبر HTTP — مرة كمتصفح عادي، ومرة لكل وكيل مستخدم لزاحف ذكاء اصطناعي. لا يُنفَّذ JavaScript. الزمن حتى أول بايت: 12 مللي ثانية.
ما هذا ليس عليه: لا تتبُّع للترتيب أو الاقتباسات، ولا تصريح بما إذا كان نموذج يذكرك فعلاً، ولا فحص لمحتوى يُحمَّل عبر JavaScript. لقطة من منظور عنوان IP واحد للخادم.