فُحص في 23/9/2026 · https://rehau-termopane.ro/
توجد 1 عوائق حرجة أمام قابلية الاكتشاف بالذكاء الاصطناعي — أصلحها أولاً.
مصفوفة زواحف الذكاء الاصطناعي
لكل روبوت: ماذا يسمح به robots.txt الخاص بك — وماذا يُرجع خادمك فعليًا إلى وكيل المستخدم للروبوت. الصفوف المُظللة بالأحمر: robots يسمح، لكن الخادم يحجب (عادةً قاعدة WAF أو حماية من الروبوتات).
| الروبوت | المُشغِّل | robots.txt | استجابة الخادم |
|---|---|---|---|
| GPTBot | OpenAI | غير مذكور | محجوب (403 / WAF) |
| OAI-SearchBot | OpenAI | غير مذكور | 200 + محتوى |
| ChatGPT-User | OpenAI | غير مذكور | 200 + محتوى |
| ClaudeBot | Anthropic | غير مذكور | 200 + محتوى |
| Claude-SearchBot | Anthropic | غير مذكور | خطأ / انتهاء المهلة |
| Claude-User | Anthropic | غير مذكور | 200 + محتوى |
| PerplexityBot | Perplexity | غير مذكور | خطأ / انتهاء المهلة |
| Perplexity-User | Perplexity | غير مذكور | خطأ / انتهاء المهلة |
| Google-Extended | Google (Gemini-Training) | غير مذكور | — |
| Googlebot | Google (KI-Übersichten) | غير مذكور | 200 + محتوى |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | غير مذكور | 200 + محتوى |
| Bytespider | ByteDance (Doubao) | غير مذكور | 200 + محتوى |
| Amazonbot | Amazon (Alexa/Rufus) | غير مذكور | 200 + محتوى |
| Applebot-Extended | Apple (Intelligence-Training) | غير مذكور | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | غير مذكور | محجوب (403 / WAF) |
كيف تنشأ الدرجة؟
| الخادم يحجب الروبوتات رغم أن robots.txt يسمح بها | -12 |
| لا llms.txt | -5 |
| لم يُعثر على sitemap.xml | -4 |
| تُتخطّى مستويات العناوين | -3 |
| لا روابط sameAs | -3 |
| لم يُعثر على robots.txt | -2 |
| لا ترميز FAQ أو HowTo | -2 |
| النتيجة | 69 / 100 |
الوصول لزواحف الذكاء الاصطناعي
الخادم يحجب الروبوتات رغم أن robots.txt يسمح بها
بالنسبة إلى 2 روبوت من OpenAI, Meta (Llama/Meta AI)، يقول robots.txt «مسموح»، لكن الخادم يردّ بـ 403 أو بصفحة حماية من الروبوتات. عادةً قاعدة WAF أو جدار حماية أو CDN تُغلق الباب أمام الزاحف متجاوزةً robots.txt.
ما ينبغي أن تفعله: أضِف وكلاء المستخدم و/أو نطاقات IP لزواحف الذكاء الاصطناعي المطلوبة إلى قائمة سماح في WAF / Cloudflare / جدار الحماية لديك. تحقق منها عبر DNS العكسي، لا بسلسلة وكيل المستخدم فقط.
لم يُعثر على robots.txt
لم يتوفر أي ملف صالح على /robots.txt. عندها تفترض الزواحف «كل شيء مسموح» — يعمل، لكن ليس لديك توجيه ولا إشارة خريطة موقع.
ما ينبغي أن تفعله: أنشئ robots.txt في الدليل الجذر، على الأقل بإشارة إلى خريطة الموقع وقواعد allow/disallow المطلوبة.
User-agent: * Allow: / Sitemap: https://نطاقك.example/sitemap.xml
البنية وقابلية الفهم الآلي
لا llms.txt
لا يوجد ملف على /llms.txt. llms.txt نظرة عامة قصيرة بصيغة Markdown لمحتواك المحوري تستخدمها بعض أنظمة الذكاء الاصطناعي للتوجُّه.
ما ينبغي أن تفعله: أنشئ /llms.txt: عنوان H1 بالاسم، وفقرة قصيرة عن العرض، وقائمة روابط إلى الصفحات المحورية.
# شركتك > وصف في جملة واحدة. ## صفحات مهمة - [المنتج](https://نطاقك.example/product): … - [الأسعار](https://نطاقك.example/pricing): … - [من نحن](https://نطاقك.example/about): …
تُتخطّى مستويات العناوين
يتخطى تسلسل العناوين مستوى واحدًا على الأقل (مثل H2 مباشرةً إلى H4). يجعل هذا إعادة بناء بنية المحتوى آليًا أصعب.
ما ينبغي أن تفعله: استخدم مستويات العناوين دون فجوات وبالترتيب (H1 ← H2 ← H3 …).
لا ترميز FAQ أو HowTo
المحتوى على هيئة سؤال وجواب وخطوة بخطوة أصعب على أنظمة الذكاء الاصطناعي في التعرف عليه كإجابة قابلة للاقتباس مباشرةً دون ترميز FAQPage أو HowTo.
ما ينبغي أن تفعله: حيث تجيب الصفحة عن أسئلة حقيقية أو تقدم تعليمات، رمِّزها كـ FAQPage أو HowTo (لا ترميز دون محتوى مطابق مرئي).
إشارات الثقة والكيان (E-E-A-T)
لا روابط sameAs
يفتقر JSON-LD إلى «sameAs». بها تربط أنظمة الذكاء الاصطناعي علامتك أو شخصك بوضوح بكيانات معروفة (Wikidata، LinkedIn، أدلة القطاع).
ما ينبغي أن تفعله: أضِف «sameAs» في Organization أو Person بعناوين URL لملفاتك الرسمية ومُدخلات الأدلة.
الأساس التقني
لم يُعثر على sitemap.xml
لم تتوفر خريطة موقع XML صالحة على /sitemap.xml، ولا يذكر robots.txt أيًا منها. تساعد خريطة الموقع الزواحف على إيجاد كل عناوين URL ذات الصلة.
ما ينبغي أن تفعله: أنشئ sitemap.xml بكل عناوين URL القابلة للفهرسة وأشِر إليه في robots.txt.
سليم (8)
- المحتوى الرئيسي في HTML دون JavaScript.
- توجد بيانات منظَّمة (JSON-LD). — HomeAndConstructionBusiness, Organization, WebSite, ImageObject, WebPage, Person, Article, VideoObject
- المؤسسة موسومة بوصفها JSON-LD.
- عنوان H1 واحد بالضبط.
- تم ضبط عنوان canonical.
- عنوان الصفحة بطول معقول.
- توجد إشارة مؤلف.
- زمن استجابة سريع من الخادم.
الخطوات التالية
- الخادم يحجب الروبوتات رغم أن robots.txt يسمح بها. أضِف وكلاء المستخدم و/أو نطاقات IP لزواحف الذكاء الاصطناعي المطلوبة إلى قائمة سماح في WAF / Cloudflare / جدار الحماية لديك. تحقق منها عبر DNS العكسي، لا بسلسلة وكيل المستخدم فقط.
- لا llms.txt. أنشئ /llms.txt: عنوان H1 بالاسم، وفقرة قصيرة عن العرض، وقائمة روابط إلى الصفحات المحورية.
- لم يُعثر على sitemap.xml. أنشئ sitemap.xml بكل عناوين URL القابلة للفهرسة وأشِر إليه في robots.txt.
إعادة فحص أسبوعية مع تنبيه بالبريد الإلكتروني عند كل تغيير. قيد الإعداد — أدخل عنوانك.
المنهجية والحدود
فُحص في 23/9/2026. يجلب citeglass rehau-termopane.ro والملفات المرتبطة (robots.txt وllms.txt وsitemap.xml) عبر HTTP — مرة كمتصفح عادي، ومرة لكل وكيل مستخدم لزاحف ذكاء اصطناعي. لا يُنفَّذ JavaScript. الزمن حتى أول بايت: 774 مللي ثانية.
ما هذا ليس عليه: لا تتبُّع للترتيب أو الاقتباسات، ولا تصريح بما إذا كان نموذج يذكرك فعلاً، ولا فحص لمحتوى يُحمَّل عبر JavaScript. لقطة من منظور عنوان IP واحد للخادم.