فُحص في 24/9/2026 · https://www.heise.de/
لا عوائق صارمة، لكن 2 نقاط تُضعف قابلية الاكتشاف بالذكاء الاصطناعي.
مصفوفة زواحف الذكاء الاصطناعي
لكل روبوت: ماذا يسمح به robots.txt الخاص بك — وماذا يُرجع خادمك فعليًا إلى وكيل المستخدم للروبوت. الصفوف المُظللة بالأحمر: robots يسمح، لكن الخادم يحجب (عادةً قاعدة WAF أو حماية من الروبوتات).
| الروبوت | المُشغِّل | robots.txt | استجابة الخادم |
|---|---|---|---|
| GPTBot | OpenAI | مسموح | 200 + محتوى |
| OAI-SearchBot | OpenAI | مسموح | 200 + محتوى |
| ChatGPT-User | OpenAI | مسموح | 200 + محتوى |
| ClaudeBot | Anthropic | مسموح | 200 + محتوى |
| Claude-SearchBot | Anthropic | مسموح | 200 + محتوى |
| Claude-User | Anthropic | مسموح | 200 + محتوى |
| PerplexityBot | Perplexity | مسموح | 200 + محتوى |
| Perplexity-User | Perplexity | مسموح | 200 + محتوى |
| Google-Extended | Google (Gemini-Training) | محجوب | — |
| Googlebot | Google (KI-Übersichten) | مسموح (عبر User-agent: *) | 200 + محتوى |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | محجوب | 200 + محتوى |
| Bytespider | ByteDance (Doubao) | محجوب | 200 + محتوى |
| Amazonbot | Amazon (Alexa/Rufus) | محجوب | 200 + محتوى |
| Applebot-Extended | Apple (Intelligence-Training) | محجوب | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | محجوب | 200 + محتوى |
كيف تنشأ الدرجة؟
| عنوان الصفحة قصير جدًا أو طويل جدًا | -6 |
| ليس عنوان H1 واحدًا بالضبط | -5 |
| لا llms.txt | -5 |
| لا مخطط Organization | -4 |
| لا إشارة مؤلف أو تأليف | -4 |
| لا روابط sameAs | -3 |
| لا ترميز FAQ أو HowTo | -2 |
| النتيجة | 71 / 100 |
الوصول لزواحف الذكاء الاصطناعي
تم استبعاد تدريب الذكاء الاصطناعي
يحظر ملف robots.txt لديك زواحف تجمع المحتوى لتدريب النماذج اللغوية: Google-Extended, CCBot, Applebot-Extended. هذا لا يمنع الاقتباس — فروبوتات البحث والجلب مثل OAI-SearchBot وPerplexityBot وGooglebot لنظرات الذكاء الاصطناعي العامة منفصلة عنها.
ما ينبغي أن تفعله: لا حاجة لأي إجراء إذا كان الاستبعاد مقصودًا. فقط تأكّد من بقاء روبوتات البحث مسموحًا بها.
البنية وقابلية الفهم الآلي
عنوان الصفحة قصير جدًا أو طويل جدًا
طول <title> هو 67 حرفًا. نحو 30–60 حرفًا معقول: وصفي بما يكفي لتسمية الموضوع، قصير بما يكفي كي لا يُقتطع.
ما ينبغي أن تفعله: اكتب عنوانًا مقتضبًا يحتوي على الموضوع والعلامة التجارية عند الحاجة.
ليس عنوان H1 واحدًا بالضبط
تحتوي الصفحة على 0 من عناوين H1. عنوان H1 واحد واضح يخبر البشر والآلات عمّا تدور الصفحة أساسًا.
ما ينبغي أن تفعله: اضبط عنوان H1 واحدًا بالضبط يسمّي الموضوع الرئيسي للصفحة. وكل ما تحته يبدأ من H2.
لا llms.txt
لا يوجد ملف على /llms.txt. llms.txt نظرة عامة قصيرة بصيغة Markdown لمحتواك المحوري تستخدمها بعض أنظمة الذكاء الاصطناعي للتوجُّه.
ما ينبغي أن تفعله: أنشئ /llms.txt: عنوان H1 بالاسم، وفقرة قصيرة عن العرض، وقائمة روابط إلى الصفحات المحورية.
# شركتك > وصف في جملة واحدة. ## صفحات مهمة - [المنتج](https://نطاقك.example/product): … - [الأسعار](https://نطاقك.example/pricing): … - [من نحن](https://نطاقك.example/about): …
لا مخطط Organization
يوجد JSON-LD، لكن لا مُدخل «Organization». عندها تُموضِع أنظمة الذكاء الاصطناعي علامتك التجارية بشكل أضعف ككيان مستقل وتربطها بشكل أضعف بمصادر خارجية.
ما ينبغي أن تفعله: أضِف مخطط «Organization» يتضمن name وurl وlogo وsameAs (روابط إلى ملفاتك الرسمية).
لا ترميز FAQ أو HowTo
المحتوى على هيئة سؤال وجواب وخطوة بخطوة أصعب على أنظمة الذكاء الاصطناعي في التعرف عليه كإجابة قابلة للاقتباس مباشرةً دون ترميز FAQPage أو HowTo.
ما ينبغي أن تفعله: حيث تجيب الصفحة عن أسئلة حقيقية أو تقدم تعليمات، رمِّزها كـ FAQPage أو HowTo (لا ترميز دون محتوى مطابق مرئي).
إشارات الثقة والكيان (E-E-A-T)
لا إشارة مؤلف أو تأليف
لا يمكن التعرف على مؤلف (لا وسم meta، ولا rel=author، ولا JSON-LD Person). لأجل «الخبرة» و«الاختصاص» بمعنى E-E-A-T يُحتسب تأليف مُسمّى وقابل للتتبع.
ما ينبغي أن تفعله: للمحتوى التحريري سمِّ مؤلفًا بالاسم واربط صفحة مؤلف؛ رمِّزه أيضًا كـ JSON-LD «Person».
لا روابط sameAs
يفتقر JSON-LD إلى «sameAs». بها تربط أنظمة الذكاء الاصطناعي علامتك أو شخصك بوضوح بكيانات معروفة (Wikidata، LinkedIn، أدلة القطاع).
ما ينبغي أن تفعله: أضِف «sameAs» في Organization أو Person بعناوين URL لملفاتك الرسمية ومُدخلات الأدلة.
سليم (6)
- المحتوى الرئيسي في HTML دون JavaScript.
- توجد بيانات منظَّمة (JSON-LD). — ItemList, Thing
- تم ضبط عنوان canonical.
- يمكن الوصول إلى خريطة الموقع.
- زمن استجابة سريع من الخادم.
- لا noindex — يمكن فهرسة الصفحة.
الخطوات التالية
- عنوان الصفحة قصير جدًا أو طويل جدًا. اكتب عنوانًا مقتضبًا يحتوي على الموضوع والعلامة التجارية عند الحاجة.
- ليس عنوان H1 واحدًا بالضبط. اضبط عنوان H1 واحدًا بالضبط يسمّي الموضوع الرئيسي للصفحة. وكل ما تحته يبدأ من H2.
- لا llms.txt. أنشئ /llms.txt: عنوان H1 بالاسم، وفقرة قصيرة عن العرض، وقائمة روابط إلى الصفحات المحورية.
إعادة فحص أسبوعية مع تنبيه بالبريد الإلكتروني عند كل تغيير. قيد الإعداد — أدخل عنوانك.
المنهجية والحدود
فُحص في 24/9/2026. يجلب citeglass heise.de والملفات المرتبطة (robots.txt وllms.txt وsitemap.xml) عبر HTTP — مرة كمتصفح عادي، ومرة لكل وكيل مستخدم لزاحف ذكاء اصطناعي. لا يُنفَّذ JavaScript. الزمن حتى أول بايت: 67 مللي ثانية.
ما هذا ليس عليه: لا تتبُّع للترتيب أو الاقتباسات، ولا تصريح بما إذا كان نموذج يذكرك فعلاً، ولا فحص لمحتوى يُحمَّل عبر JavaScript. لقطة من منظور عنوان IP واحد للخادم.