Nixeny DijitalMersin AI Readiness 2026 · 27 أغسطس 2026 · nixeny.com
تقرير بحثي · 05 / 2026

Nixeny Dijital - Mersin / AI Readiness 2026

جُلب ملف robots.txt لـ 3,395 موقعًا مؤسسيًا في مرسين، وفُحصت 3,382 صفحة رئيسية من حيث قابليتها للقراءة الآلية. نسبة المواقع التي يستطيع مساعدٌ أن يجيب منها مباشرةً عن سؤال «أين هذه الشركة، ومتى تفتح، وما رقمها» هي 4.5‎%‎. سؤال واحد: ماذا تحكي شركات مرسين للآلة؟

4.5‎%‎
من المواقع تتيح للذكاء الاصطناعي الإجابة عن سؤال
152 / 3,382
89.0‎%‎
من المواقع لم تكتب لزواحف الذكاء الاصطناعي قاعدة واحدة
n = 3,395
331
موقعًا تحجب زواحف الذكاء الاصطناعي عن قصد
9.8‎%‎ · قرار
بيانات الصفحة الرئيسية 2026·08·25 · جلب robots.txt 2026·08·27 · النشر 2026·08·27 · Nixeny Dijital · nixeny.com
00

ما الذي تقيسه هذه الأرقام وما الذي لا تقيسه

أربع ملاحظات · كل واحدة منها حدّ
01 · قِيست الشروط لا النتائج

لم يُطرح في هذه الدراسة سؤال واحد على أي نموذج ذكاء اصطناعي. ولم يُقَس أي شركة يستشهد بها المساعدون فعلًا. المُقاس وحده هو هل تتوفر الشروط التي يحتاجها مساعدٌ ليولّد إجابة من هذا الموقع. وعبارة «الذكاء الاصطناعي لا يجد هذه الشركة» لا تُستخرج من هذه البيانات.

02 · الحجب قرار

حجب زواحف الذكاء الاصطناعي قرار مشروع، ويُحسب في هذا التقرير قرارًا لا خطأً. والمواقع الـ 3,021 التي «لم تكتب أي قاعدة» والمواقع الـ 331 التي «تحجب عن قصد» لا تُدمج في أي جدول: الأولى لم تناقش الأمر قط، والثانية ناقشته وقررت.

03 · الصفحة الرئيسية فقط

أُجريت قياسات المحتوى والبيانات المنظَّمة على الصفحة الرئيسية وحدها. ولا تُرى المخططات ولا قوائم الخدمات ولا الأسئلة الشائعة في الصفحات الداخلية. وهذا يعني أن كل نسب المخطط والمحتوى هنا حدّ أدنى: قد تكون النسبة الحقيقية أعلى، لا أدنى.

04 · قائمة مؤرَّخة

أسماء الروبوتات وسياساتها تتغير خلال أشهر؛ وروبوت غير موجود اليوم قد يتصدر القائمة العام المقبل. والنسب هنا لا معنى لها إلا مع قائمة الـ 19 روبوتًا التي بجانبها، ولا يمكن نقلها إلى تاريخ آخر.

المسرد · كل مصطلح مشروح مرة واحدة

ظهور الذكاء الاصطناعي
موضوع هذا التقرير: كم من الشروط التي يحتاجها مساعد ذكاء اصطناعي ليولّد إجابة من موقع شركة قد تحقق. ليس حكمًا على الجودة بل مقياسًا لقابلية القراءة.
الأساس
يستخدم هذا التقرير ثلاثة أسس رئيسية: 3,395 موقعًا جُلب منه robots.txt، و3,382 موقعًا صفحته الرئيسية قابلة للقراءة، و4,167 نطاقًا مفحوصًا. وداخل الأقسام أسس أضيق (مُنتِجو llms.txt يُحسبون على 352 ملفًا). وإلى جانب كل نسبة مكتوب أيها المقصود.
robots.txt
ملف نصي في جذر الموقع يقول أي روبوت يدخل أين. وهو طوعي لا مُلزِم: الروبوتات تختار الالتزام به. وفي هذه الدراسة قُيّم لكل روبوت المسار الجذر ("/") فقط.
روبوت التدريب / روبوت البحث
روبوت التدريب (GPTBot، ClaudeBot، Google-Extended) يجمع المحتوى لتدريب النموذج. وروبوت البحث (OAI-SearchBot، PerplexityBot) يجد المصدر ويستشهد به حين يُطرح سؤال. وحجب الاثنين بالقاعدة نفسها يغلق أيضًا احتمال أن يُستشهد بك.
غياب القاعدة ≠ الحجب
إن لم يكن في robots.txt قاعدة لروبوت ما، فالسلوك الافتراضي هو السماح بالوصول. ولهذا لا تُوضع المواقع التي «لم تكتب أي قاعدة» والمواقع التي «حجبت عن قصد» في السلة نفسها في أي موضع من هذا التقرير.
البيانات المنظَّمة (JSON-LD)
معلومات مضمَّنة داخل الصفحة بصيغة تقرؤها الآلة مباشرة: الاسم والعنوان والهاتف وساعات العمل. غير مرئية للإنسان. وفي هذه الدراسة قُرئ JSON-LD وحده؛ أما microdata وRDFa فخارج النطاق.
مخطط LocalBusiness
نوع البيانات المنظَّمة الذي يقول «هذه شركة محلية». وهو الطريقة القياسية لأن يعرّف موقع نفسه للآلة بوصفه شركة؛ وبدونه يضطر المساعد إلى تخمين ماهية الصفحة من النص.
ثلاثي الاسم-العنوان-الهاتف
وجود اسم الشركة وعنوانها الصريح وهاتفها ثلاثتها معًا في البيانات المنظَّمة. وإن نقص أحدها فإما ألّا يعطي المساعد الإجابة وإما أن يأخذها من مصدر آخر — من دليل في الغالب.
llms.txt
ملف مقترح لتلخيص محتوى الموقع لمساعدات الذكاء الاصطناعي. وهو حتى الآن اقتراح مسوَّدة لا معيار. ولهذا يُبلَّغ عن غيابه بوصفه مقياس تبنٍّ لا نقصًا.
القابلية للإجابة
تحقق الشروط الأربعة كلها التي يحتاجها مساعد ليجيب من الموقع مباشرةً عن «أين هذه الشركة، ومتى تفتح، وما رقمها»: البحث غير محجوب، وثلاثي الاسم-العنوان-الهاتف كامل، وساعات العمل موجودة، والمحتوى ظاهر دون تشغيل JavaScript.
الاعتماد على JavaScript
أن يقل نص HTML الساكن عن 120 كلمة بينما تُظهر الصفحة التي يعرضها المتصفح أكثر من 2.5 ضعف ذلك. الصفحات الرئيسية لهذه المواقع تبدو فارغة لمتصفح لا يشغّل JavaScript.
درجة الظهور
خلاصة موزونة من 0 إلى 100 لستة مكوّنات: إذن الوصول (25)، والبيانات المنظَّمة (25)، وعمق المحتوى (20)، والأساس التقني (15)، وجاهزية الإجابة (10)، وllms.txt (5). ويسقط المكوّن غير القابل للقياس من البسط والمقام؛ وتحت تغطية 60 % لا تُنشر درجة.
01

أربعة مواقع من كل مئة تستطيع الإجابة عن سؤال

الأساس: 3,382 موقعًا صفحته الرئيسية قابلة للقراءة

لكي يجيب مساعد ذكاء اصطناعي عن أبسط سؤال عن شركة — أين هي، ومتى تفتح، وما رقمها — مباشرةً من موقع تلك الشركة، تلزم أربعة أشياء: ألّا يحجب robots.txt البحث، وأن يكون ثلاثي الاسم-العنوان-الهاتف كاملًا في البيانات المنظَّمة، وأن تكون ساعات العمل هناك، وأن يظهر المحتوى دون تشغيل JavaScript.

عدد المواقع التي تحقق الأربعة معًا 1524.5‎%‎. وتمثل هذه المواقع 170 شركة. أما البقية فإما أن يصمت المساعد وإما أن يأخذ الإجابة من مكان آخر، من دليل في الغالب.

شكل 01 · الشروط القائمة أمام القابلية للإجابة
n = 3,382 موقعًا

كل عمود هو عدد المواقع التي لا تحقق ذلك الشرط وحده. وقد يتعثر موقع في ثلاثة شروط في آنٍ واحد، ولذلك لا تُجمع الأسطر ولا تُقرأ بوصفها تقسيمًا؛ والترتيب بحسب تكرار عضّ الشرط.

152
يحقق الشروط الأربعة كلها
4.5‎%‎ · 170 شركة
3,188
ناقص: ساعات العمل غائبة عن البيانات المنظَّمة
94.3‎%‎ · n = 3,382
2,925
ناقص: ثلاثي الاسم-العنوان-الهاتف ناقص في البيانات المنظَّمة
86.5‎%‎ · n = 3,382
2,450
ناقص: لا توجد بيانات شركة منظَّمة (LocalBusiness/Organization)
72.4‎%‎ · n = 3,382
155
ناقص: المحتوى لا يأتي إلا مع JavaScript
4.6‎%‎ · n = 3,382
136
ناقص: بحث الذكاء الاصطناعي محجوب في robots.txt
4.0‎%‎ · n = 3,382
المصدر: جلب robots.txt 2026·08·27 وذاكرة الصفحات الرئيسية 2026·08·25 · أشيع عائق هو ساعات العمل: غائبة عن البيانات المنظَّمة لـ 3,188 موقعًا. وأندرها robots.txt: 136 موقعًا فقط أغلق بحث الذكاء الاصطناعي.
عدد المواقع التي أغلقت بابها أمام الذكاء الاصطناعي (331) أكبر من عدد المواقع التي يستطيع الذكاء الاصطناعي الإجابة منها (152).
كلاهما على الأساسين 3,395 / 3,382
02

89.0 % من المواقع لم تكتب للذكاء الاصطناعي قاعدة واحدة

الأساس: 3,395 موقعًا جُلب منه robots.txt

robots.txt هو الملف الذي يقول فيه الموقع أي روبوت يدخل أين. لدى 2,227 موقعًا (65.6‎%‎) ملف كهذا؛ لكن عدد المواقع التي تحمل بداخله ولو قاعدة واحدة لزواحف الذكاء الاصطناعي هو 374 فقط. أما المواقع الـ 3,021 الباقية فلم يُفتح الموضوع فيها بعد.

ألّا تضع قاعدة ليس حجبًا: إن لم يكن في robots.txt حكم لروبوت ما، فالسلوك الافتراضي هو السماح بالوصول. ولهذا لا يُدمج هذان السطران في أي موضع من التقرير. أحدهما لم يناقش الموضوع قط، والآخر ناقشه وقرر.

شكل 02 · قواعد الذكاء الاصطناعي في robots.txt
n = 3,395 موقعًا

سبع قراءات، من الملف نفسه وعلى الأساس نفسه. سطر «مُعرَّفة قاعدة واحدة على الأقل» هو مجموع قرارات الإذن والمنع؛ والسطران تحته يقسمان ذلك المجموع. وسطر Googlebot هو مجموعة الضبط.

لا قاعدة إطلاقًا لروبوتات الذكاء الاصطناعي
89.0‎%‎
3,021
مُعرَّفة قاعدة واحدة على الأقل للذكاء الاصطناعي
11.0‎%‎
374
يحجب روبوت ذكاء اصطناعي واحدًا على الأقل
9.8‎%‎
331
يحجب تدريب الذكاء الاصطناعي
9.8‎%‎
331
يحجب بحث الذكاء الاصطناعي
4.0‎%‎
136
يحجب Googlebot (ضبط)
0.3‎%‎
11
Crawl-delay مُعرَّف
7.0‎%‎
239
المصدر: جلب robots.txt 2026·08·27 · قُيّم لكل روبوت المسار الجذر ("/") فقط. والحجب يُحسب هنا قرارًا لا خطأً.

يمكن رؤية حال المواقع في تقسيم واحد. السلال الأربع أدناه تغطي المواقع الـ 3,395 كلها ومجموعها يعطي الأساس — لكن سلة «مغلق» ليست أسفل ترتيب، بل خارج الثلاث الأخرى. الموقع هناك أجاب عن السؤال؛ أما الموقع في سلة «غير مرئي» فلم يلتقِ السؤال قط.

شكل 03 · سلال الجاهزية
n = 3,395 موقعًا

كل مربع من المربعات المئة يمثل نحو 34 موقعًا. والسلال يستبعد بعضها بعضًا ومجموعها يساوي الأساس.

جاهز — 132 موقعًا (3.9‎%‎)يحقق الشروط الأربعة كلها
جاهز جزئيًا — 704 موقعًا (20.7‎%‎)يستطيع مساعد قراءة شيء ما
غير مرئي — 2,228 موقعًا (65.6‎%‎)الباب مفتوح ولا بنية تُقرأ
مغلق — 331 موقعًا (9.8‎%‎)حجب مقصود عبر robots.txt
المصدر: جلب robots.txt وذاكرة الصفحات الرئيسية · سلة «جاهز» هي المواقع الـ 132 التي تحقق الشروط الأربعة كلها في الشكل 01. والمواقع الـ 331 في سلة «مغلق» تمثل 368 شركة.
03

زواحف الذكاء الاصطناعي تُحجب 25 ضعف حجب محركات البحث

الأساس: 3,395 موقعًا · 19 روبوتًا

السبيل الوحيد لمعرفة ما إذا كان الحجب انغلاقًا عامًا أم تمييزًا خاصًا بالذكاء الاصطناعي هو النظر إلى ما تفعله المواقع نفسها بروبوتات البحث الكلاسيكية. 331 موقعًا يحجب في المسار الجذر روبوت ذكاء اصطناعي واحدًا على الأقل؛ وعدد المواقع التي تحجب Googlebot وBingbot هو 13. والفارق بينهما 25.5 ضعفًا.

أي أن المرفوض ليس الزحف، بل استخدام معيّن لما يُزحف عليه. والمواقع نفسها تُدخل محركات البحث.

شكل 04 · الحجب بحسب مجموعة الروبوتات
n = 3,395 موقعًا

أربع مجموعات، أساس واحد. ومجموعة الضبط هي روبوتات البحث الكلاسيكية: Googlebot وBingbot. وعمود «مذكور» يعدّ الحالات التي يكتب فيها الموقع اسم تلك المجموعة في robots.txt — والذِّكر ليس حجبًا، فقد يُذكر الروبوت للإذن له أيضًا.

روبوتات تدريب الذكاء الاصطناعي
مذكور في robots.txt: 346 (10.2‎%‎)
9.4‎%‎
318 موقعًا
روبوتات بحث الذكاء الاصطناعي
مذكور في robots.txt: 171 (5.0‎%‎)
3.9‎%‎
131 موقعًا
روبوتات تجلب بطلب المستخدم
مذكور في robots.txt: 160 (4.7‎%‎)
4.0‎%‎
135 موقعًا
روبوتات البحث الكلاسيكية (ضبط)
مذكور في robots.txt: 68 (2.0‎%‎)
0.4‎%‎
13 موقعًا
المصدر: جلب robots.txt 2026·08·27 · في مقابل 318 موقعًا تحجب روبوتات التدريب، هناك 13 موقعًا تحجب روبوتات البحث الكلاسيكية.

وبالنظر روبوتًا روبوتًا يتبين أن الحجب عمل قوائم: نسب حجب روبوتات التدريب متقاربة جدًا، لأن المواقع نفسها تعدّها في كتلة واحدة. وفي بضعة أسطر يفوق عدد الحاجبين عدد الذاكرين — فالقاعدة هناك تكتبها مجموعة البدل (*)، ولا يرد اسم الروبوت نفسه في الملف إطلاقًا.

شكل 05 · نسبة الحجب، روبوتًا روبوتًا
n = 3,395 موقعًا

كل سطر رمز user-agent. واللون يبيّن عمل الروبوت: الأحمر تدريب، والأزرق الداكن بحث، والأزرق الفاتح جلب بطلب المستخدم، والرمادي بحث كلاسيكي (ضبط).

نسب الذِّكر والحجب، روبوتًا روبوتًا
الروبوتعملهمذكورحاجبالنسبة
GPTBot (OpenAI، تدريب)تدريب3463129.2‎%‎
OAI-SearchBot (بحث ChatGPT)بحث62401.2‎%‎
ChatGPT-User (بطلب المستخدم)طلب المستخدم1601354.0‎%‎
ClaudeBot (Anthropic، تدريب)تدريب3363089.1‎%‎
Claude-User (بطلب المستخدم)طلب المستخدم40401.2‎%‎
Claude-SearchBot (بحث Claude)بحث43411.2‎%‎
PerplexityBot (فهرس بحث)بحث1711313.9‎%‎
Perplexity-User (بطلب المستخدم)طلب المستخدم32381.1‎%‎
Google-Extended (تدريب Gemini)تدريب3343059.0‎%‎
Applebot-Extended (Apple Intelligence)تدريب3163059.0‎%‎
meta-externalagent (Meta AI)تدريب2142186.4‎%‎
Bytespider (ByteDance)تدريب3093139.2‎%‎
CCBot (Common Crawl)تدريب3203189.4‎%‎
Amazonbotتدريب3033089.1‎%‎
cohere-aiتدريب44451.3‎%‎
YouBot (You.com)بحث1271313.9‎%‎
Diffbotتدريب1251364.0‎%‎
Googlebot (بحث كلاسيكي)بحث كلاسيكي68110.3‎%‎
Bingbot (بحث كلاسيكي + Copilot)بحث كلاسيكي40130.4‎%‎
المصدر: جلب robots.txt 2026·08·27 · القائمة مؤرَّخة: أسماء الروبوتات وسياساتها تتغير خلال أشهر، وهذه النسب لا معنى لها إلا مع قائمة الـ 19 روبوتًا هذه.
04

352 موقعًا لديه llms.txt، ونصفها كتبته إضافة برمجية

الأساس: 3,395 موقعًا · تفصيل المُنتِج على 352 ملفًا

llms.txt ملف مقترح لتلخيص محتوى الموقع لمساعدات الذكاء الاصطناعي. وهو ليس معيارًا بعد بل اقتراح مسوَّدة — ولهذا يُقرأ غيابه مقياسَ تبنٍّ لا نقصًا. يوجد لدى 352 موقعًا (10.4‎%‎)؛ أما llms-full.txt الأكثر تفصيلًا فلدى 30 موقعًا فقط.

البُغية الحقيقية ليست الرقم نفسه بل من كتبه. 183 من هذه الملفات الـ 352 (52.0‎%‎) أنتجتها تلقائيًا إضافة برمجية أو منصة. أي أن هذا الرقم لا يقيس قرار الشركات بشأن الذكاء الاصطناعي، بل ملاحظات إصدار الأداة التي تستخدمها.

شكل 06 · تبنّي llms.txt ومن أنتج الملفات
الكتلة العليا n = 3,395 موقعًا · الكتلة السفلى n = 352 ملفًا

أساسان مختلفان، أحدهما فوق الآخر. والنسب في الكتلة السفلى توزيع للملفات الموجودة لا لمجموع المواقع: فإن قُرئت على 3,395 خرج كل سطر خاطئًا برتبة مقدار.

ينشر llms.txt
10.4‎%‎
352 / 3,395
ينشر llms-full.txt
0.9‎%‎
30 / 3,395
من أنتج الملف · الأساس 352 llms.txt
غير محدَّد
48.0‎%‎
169 ملفًا
Wix
28.4‎%‎
100 ملفًا
All in One SEO
11.4‎%‎
40 ملفًا
Rank Math
4.6‎%‎
16 ملفًا
Shopify
4.3‎%‎
15 ملفًا
Yoast SEO
2.8‎%‎
10 ملفًا
إضافة أخرى
0.6‎%‎
2 ملفًا
المصدر: جلب llms.txt وllms-full.txt 2026·08·27 · «غير محدَّد» هي الملفات التي لا تحمل توقيعًا يذكر مُنتِجها؛ وقد تكون مكتوبة يدويًا.
05

المواقع التي تستطيع الآلة قراءة ساعات عملها: 5.7 بالمئة

الأساس: 3,382 موقعًا صفحته الرئيسية قابلة للقراءة

البيانات المنظَّمة هي المعلومات المضمَّنة داخل الصفحة والتي لا تراها إلا الآلة: الاسم والعنوان والهاتف وساعات العمل. نسبة المواقع التي تحمل في صفحتها الرئيسية أي كتلة JSON-LD هي 33.9‎%‎. لكن العدد ينخفض عند كل خطوة نزولًا من هناك: 10.7‎%‎ تعرّف نفسها بوصفها شركة، و13.5‎%‎ لديها ثلاثي الاسم-العنوان-الهاتف كاملًا، و5.7‎%‎ تعطي ساعات العمل.

هذا الانخفاض هو موضوع التقرير. الحقل الوحيد الذي يحتاجه مساعد ليجيب عن «هل هي مفتوحة الآن» موجود في موقع واحد من كل عشرين.

شكل 07 · حقول البيانات المنظَّمة الموجودة في الصفحة الرئيسية
n = 3,382 موقعًا

تسلسل يضيق: أي JSON-LD أولًا، ثم أنواع الشركات، ثم المعلومات الثلاث التي يحتاجها المساعد فعلًا للإجابة عن السؤال.

أي كتلة JSON-LD
33.9‎%‎
1,146
مخطط Organization
19.7‎%‎
666
ثلاثي الاسم-العنوان-الهاتف كامل
13.5‎%‎
457
مخطط LocalBusiness
10.7‎%‎
363
ساعات العمل
5.7‎%‎
194
معلومات السعر
5.2‎%‎
175
الإحداثيات (geo)
4.5‎%‎
151
التقييم المجمَّع (aggregateRating)
1.9‎%‎
63
كتلة JSON-LD معطوبة
0.7‎%‎
23
المصدر: ذاكرة الصفحات الرئيسية 2026·08·25 · قُرئ JSON-LD وحده؛ أما microdata وRDFa فخارج النطاق. وبما أن الصفحة الرئيسية وحدها فُحصت فالنسب حدّ أدنى.
شكل 08 · توزّع اكتمال المخطط
n = 3,382 موقعًا

نسبة اكتمال محسوبة على ثمانية حقول. الوسيط صفر: أكثر من نصف المواقع لا يحمل حقلًا واحدًا يمكن عدّه، ولذلك يُعطى التوزّع نفسه بدل متوسط.

0
2,238
site
1-25
191
site
26-50
537
site
51-75
278
site
76-100
138
site
المصدر: ذاكرة الصفحات الرئيسية 2026·08·25 · المواقع الـ 2,238 ذات الاكتمال الصفري (66.2‎%‎) هي التي لا JSON-LD لها إطلاقًا أو لا يوجد داخله أي من الحقول المطلوبة.
شكل 09 · أنواع المخططات التي يمكن أن تصير إجابة
n = 3,382 موقعًا

الأنواع التي يستطيع المساعد الاستشهاد بها مباشرة. FAQPage وQuestion تحملان إجابة جاهزة لسؤال؛ وOffer وService وProduct تقول ما هي الخدمة وبكم.

FAQPage
3.6‎%‎
123
Question
3.6‎%‎
120
Offer
2.0‎%‎
69
Service
1.6‎%‎
53
Product
0.6‎%‎
19
HowTo
0.0‎%‎
1
Menu
0.0‎%‎
1
المصدر: ذاكرة الصفحات الرئيسية 2026·08·25 · المحور ينتهي عند 5 %: حتى FAQPage، وهو أشيع الأنواع، موجود في 3.6‎%‎ من المواقع.
06

الصفحات الرئيسية لـ 155 موقعًا تبدو للزاحف فارغة

الأساس: 3,382 موقعًا · اختبار JavaScript على 3,364 موقعًا

إن غابت البيانات المنظَّمة بقي النص نفسه. تحمل الصفحة الرئيسية الوسيطة 382 كلمة؛ وربعها دون 176. ولدى معظم المواقع ما يُقرأ: 81.7‎%‎ من المواقع في سلة «كافٍ» أو «غني».

المشكلة عند الطرفين. محتوى 155 موقعًا لا يأتي إلا عند تشغيل JavaScript — أي أن زاحف ذكاء اصطناعي لا يشغّل JavaScript يرى تلك الصفحة الرئيسية فارغة. وفوق ذلك، تحمل الصفحات الرئيسية لـ 150 موقعًا نصًا دون 120 كلمة.

شكل 10 · سلال عمق المحتوى
n = 3,382 موقعًا

أربع سلال بحسب عدد كلمات النص الساكن في الصفحة الرئيسية. والسلال يستبعد بعضها بعضًا ومجموعها يساوي الأساس.

غني — 590 موقعًا (17.5‎%‎)1,000+ كلمة
كافٍ — 2,172 موقعًا (64.2‎%‎)300-999 كلمة
نحيف — 470 موقعًا (13.9‎%‎)120-299 كلمة
لا نص — 150 موقعًا (4.4‎%‎)أقل من 120 كلمة
المصدر: ذاكرة الصفحات الرئيسية 2026·08·25 · الوسيط 382 كلمة، والمئين 90 1,236 كلمة. وبما أن الصفحة الرئيسية وحدها تُحسب، فعمق الصفحات الداخلية لا يُرى.
شكل 11 · إشارات الإجابة الموجودة في النص
n = 3,382 موقعًا

الإشارات الست التي يبحث عنها المساعد في النص حين تغيب البيانات المنظَّمة. ورابط الهاتف (tel:) مقروء آليًا دون أي مخطط؛ وهو السطر الوحيد فوق النصف.

رابط هاتف (tel:)
52.4‎%‎
1,772
بنية العناوين قائمة
39.1‎%‎
1,322
أسئلة شائعة
17.1‎%‎
578
قائمة خدمات
17.0‎%‎
574
ساعات العمل (في النص)
16.1‎%‎
545
سعر أو قائمة طعام
13.2‎%‎
447
المصدر: ذاكرة الصفحات الرئيسية 2026·08·25 · هذه الإشارات لا تحل محل البيانات المنظَّمة: فما يقرؤه المساعد من النص لا ينقله بالثقة التي ينقل بها ما يقرؤه من المخطط.
صفحات تبدو للزاحف فارغة
155
المحتوى لا يأتي إلا مع JavaScript
4.6‎%‎ · n = 3,364
150
لا نص إطلاقًا في الصفحة الرئيسية
4.4‎%‎ · n = 3,382

هذان السطران ليسا المواقع نفسها ولا يُجمعان: الأول يعدّ المواقع التي تحمّل نصها لاحقًا، والثاني تلك التي لا نص في صفحتها الرئيسية إطلاقًا. والنتيجة واحدة في الحالتين: الروبوت الذي لا يشغّل الصفحة كمتصفح لا يجد هناك ما يُقرأ.

07

الموقع الوسيط يحصل على صفر في اثنين من ستة مكوّنات

الأساس: 3,382 موقعًا قابلًا للتقييم

ستة مكوّنات تعطي درجة موزونة من 0 إلى 100: إذن الوصول (25)، والبيانات المنظَّمة (25)، وعمق المحتوى (20)، والأساس التقني (15)، وجاهزية الإجابة (10)، وllms.txt (5). الوسيط 53.8، والربيعان بين 44.5 و63.7.

الدرجة ليست حكمًا على الجودة بل مقياسًا للظهور: الدرجة المنخفضة لا تعني شركة سيئة، بل تعني أن ما تستطيع الآلة قراءته أقل. وبالنظر إلى المكوّنات يتبين من أين يأتي التوزّع — الموقع الوسيط ينال الدرجة الكاملة في إذن الوصول وصفرًا في مكوّنين.

شكل 12 · توزّع درجة الظهور
n = 3,382 موقعًا

خمس سلال مجموعها يساوي الأساس. والتوزّع يتجمع في الوسط: نصف المواقع في نطاق 40-59.

0-19
36
site
20-39
533
site
40-59
1,689
site
60-79
895
site
80-100
229
site
المصدر: الخلاصة الموزونة لستة مكوّنات · الأدنى 5.0، والأعلى 100.0. والمواقع الـ 13 التي بقيت تغطيتها دون 60 % لم تُقيَّم ولم تُحتسب أصفارًا.
شكل 13 · الدرجات الحرفية
n = 3,382 موقعًا

كل مربع من المربعات المئة يمثل نحو 34 موقعًا.

A+ — 81 (2.4‎%‎)
A — 148 (4.4‎%‎)
B — 301 (8.9‎%‎)
C — 1,057 (31.3‎%‎)
D — 1,226 (36.3‎%‎)
E — 525 (15.5‎%‎)
F — 44 (1.3‎%‎)
المصدر: الدرجة نفسها · نطاقات الحروف ثابتة وغير مُعايَرة على توزّع هذا العام، ليكون التكرار في 2027 قابلًا للمقارنة مباشرة.
شكل 14 · وسيط مكوّنات الدرجة
كل مكوّن على عدد المواقع التي أمكن قياسه فيها

وزن المكوّن مكتوب بجانبه. ووسيط مكوّنين صفر: وهذا ليس فجوة في البيانات بل البُغية نفسها — أكثر من نصف المواقع لا تملك بيانات منظَّمة ولا llms.txt.

إذن الوصول (robots.txt)
الوزن 25 · n = 3,395
100.0
البيانات المنظَّمة
الوزن 25 · n = 3,382
0.0
عمق المحتوى
الوزن 20 · n = 3,382
68.8
الأساس التقني
الوزن 15 · n = 3,395
75.0
جاهزية الإجابة
الوزن 10 · n = 3,382
25.0
llms.txt
الوزن 5 · n = 3,395
0.0
المصدر: القياسات الخاصة للمكوّنات الستة · المكوّن غير القابل للقياس يسقط للموقع من البسط والمقام، ولا يُحتسب صفرًا.
08

الحاسم ليس القطاع بل المنصة المستخدمة

عتبة القطاع: 50+ موقعًا مفحوصًا · 30 قطاعًا

الفارق بين القطاعات ضيق. وسائط 30 قطاعًا محشورة بين 33.8 و64.4، ووسيطها 52.9. أما الفارق بين المنصات فأكبر: 68.9 في Wix، و48.8 في التطوير الخاص.

وأوضح ما يبين ذلك سطر مخطط LocalBusiness: 53.7‎%‎ من مواقع Wix تعرّف نفسها للآلة بوصفها شركة، مقابل 8.9‎%‎ من مواقع التطوير الخاص. والفرق بين موقع محامٍ وموقع مركز صيانة سيارات لا تصنعه المحاماة ولا صيانة السيارات، بل الأداة التي بُني بها الموقعان.

شكل 15 · الظهور بحسب المنصة
أساس الدرجة الوسيطة هو عدد المواقع؛ وأساس نسبة المخطط هو عدد الصفحات الرئيسية القابلة للقراءة

الأساسان في السطر الواحد ليسا نفسه، ولا ينبغي أن يكونا: الدرجة الوسيطة تُحسب على كل المواقع المفحوصة، ونسبة LocalBusiness على تلك التي أمكن قراءة صفحتها الرئيسية.

الدرجة الوسيطة للظهور ونسب المخططات بحسب المنصة
المنصةمواقعالدرجة الوسيطةLocalBusinessاسم-عنوان-هاتفقابل للإجابة
Wix12168.953.7‎%‎43.8‎%‎1.7‎%‎
Ticimaxمقارنة4866.94.2‎%‎81.3‎%‎4.2‎%‎
Next.js14661.439.0‎%‎39.0‎%‎19.2‎%‎
WordPress55959.47.7‎%‎8.8‎%‎3.8‎%‎
WooCommerce38658.85.2‎%‎5.7‎%‎2.3‎%‎
IdeaSoftمقارنة3756.30.0‎%‎5.4‎%‎0.0‎%‎
تطوير خاص1,91248.88.9‎%‎11.2‎%‎4.6‎%‎
المصدر: ذاكرة الصفحات الرئيسية 2026·08·25 · السطور الموسومة بـ«مقارنة» تحمل أقل من 50 موقعًا ولا تُنقل إلى عنوان.
شكل 16 · توزّع وسائط القطاعات
30 قطاعًا · 50+ موقعًا مفحوصًا لكل منها

كل شرطة هي الدرجة الوسيطة لقطاع. وارتفاع الشرطة لا يحمل معلومة؛ فهو يتبدل في دورة ثلاثية فقط ليبقى المتجاوران قابلين للعدّ. والخط الأحمر هو وسيط وسائط القطاعات.

الوسيط 52.9
%0%25%50%75%100
المصدر: الخلاصة الموزونة لستة مكوّنات · ضيق التوزّع هو البُغية نفسها: المدى كله البالغ 30.6 نقطة أصغر من الفارق الذي يفتحه تغيير منصة واحد.
شكل 17 · أعلى ثمانية قطاعات
n = 50+ موقعًا
متجر ملابسn 55
64.4‎%‎
محاماةn 72
63.7‎%‎
شركة نقلn 59
60.3‎%‎
شركة تنظيفn 58
59.1‎%‎
متجر أثاثn 71
57.5‎%‎
متجر هواتف وإلكترونياتn 107
57.3‎%‎
شركة تموينn 51
57.3‎%‎
مركز صيانة سياراتn 73
57.0‎%‎
النسبة المجاورة هي حصة المواقع التي تحمل مخطط LocalBusiness في ذلك القطاع.
شكل 18 · أدنى ثمانية قطاعات
n = 50+ موقعًا
متجر مواد بناءn 67
50.4‎%‎
شركة إنشاءاتn 83
49.5‎%‎
شركة تغليفn 50
49.1‎%‎
مركز تدريب خاصn 66
48.5‎%‎
نقل دولي وشحنn 86
48.3‎%‎
تخليص جمركيn 66
45.0‎%‎
حضانة وروضةn 56
43.8‎%‎
مدرسة خاصةn 87
33.8‎%‎
القطاعات في أسفل الترتيب ليست ترتيب جودة؛ بل هي القطاعات التي تنشر أقلّ مما تستطيع الآلة قراءته.
شكل 19 · الظهور بحسب القضاء
13 قضاءً · 3,395 موقعًا

بُغية هذا الشكل استواؤه. ففي بقية قياسات السلسلة يبلغ الفارق بين الأقضية أضعافًا، أما ظهور الذكاء الاصطناعي فلا يتحرك مع الجغرافيا.

Yenişehir
56.6
n 961
Mezitli
54.5
n 402
Tarsus
54.5
n 364
Erdemli
54.5
n 189
Silifke
53.3
n 207
Toroslar
52.5
n 257
Aydıncık
52.5
n 14
Bozyazı
52.3
n 36
Anamur
52.0
n 128
Gülnar
52.0
n 28
Akdeniz
51.2
n 716
Mut
50.0
n 48
Çamlıyayla
46.7
n 14
المصدر: ذاكرة الصفحات الرئيسية 2026·08·25 · السطور الرمادية تحمل أقل من 100 موقع ولا تدخل المقارنة. والمواقع الـ 31 التي تعذّر تحديد قضائها لم تُقدَّر بالحدس بل نُحّيت جانبًا.
09

هذه الدراسة لم تسأل أي ذكاء اصطناعي شيئًا

المُقاس: الشروط · غير المُقاس: النتيجة

كل أرقام هذا التقرير تقيس جاهزية: كم من الأشياء التي يحتاجها مساعدٌ ليولّد إجابة من هذا الموقع موجود في مكانه. ولا يقيس أي منها ما يفعله المساعد فعلًا.

لم يُطرح في هذه الدراسة سؤال واحد على أي نموذج. عبارة «ساعات العمل ليست في البيانات المنظَّمة» صحيحة وقابلة للتحقق؛ أما عبارة «الذكاء الاصطناعي لا يجد هذه الشركة» فلا تنتج عن هذه البيانات. فالمساعدون يولّدون إجابات أيضًا من الأدلة ومن خدمات الخرائط ومن مصادر لم تنظر إليها هذه الدراسة إطلاقًا. وتلك مسافة لم يقصد هذا التقرير سدّها.

وبالمثل فإن حجب 331 موقعًا لزواحف الذكاء الاصطناعي ليس عيبًا. فقد لا ترغب شركة في استخدام محتواها في تدريب النماذج، وهذه بالضبط طريقة قول ذلك. وهذا التقرير يعدّ ذلك القرار ولا يقيّمه.

ما يمكن قوله بهذه البيانات
  • أن مواقع الشركات المحلية ليست مهيأة للإجابة على مساعدات الذكاء الاصطناعي — نسبة المواقع التي تحقق الشروط الأربعة كلها 4.5 %.
  • أن موضوع زواحف الذكاء الاصطناعي لم يدخل بعد جدول أعمال الشركات المحلية: 89.0 % من المواقع لم تكتب لهذه الروبوتات قاعدة واحدة.
  • أن الحجب تمييز خاص بالذكاء الاصطناعي: المواقع نفسها تُدخل روبوتات البحث الكلاسيكية، والفارق يتجاوز 25 ضعفًا.
  • أن الفارق يعود في معظمه إلى الإعدادات الافتراضية للمنصة المستخدمة: الفارق الوسيط بين المنصات أكبر من الفارق بين القطاعات.
  • أن المواقع الـ 155 التي لا يأتي محتواها إلا مع JavaScript تبدو فارغة للزواحف التي لا تشغّله.
ما لا يمكن قوله بهذه البيانات
  • «الذكاء الاصطناعي لا يجد هذه الشركات» — لم يُسأل أي نموذج شيئًا؛ قِيست الشروط لا النتائج.
  • «هذا الموقع مخطئ لأنه يحجب الذكاء الاصطناعي» — الحجب خيار مشروع ويُحسب هنا قرارًا.
  • «X % من المواقع بلا مخطط» — والصواب: «لم يُرصد في الصفحة الرئيسية»؛ فالصفحات الداخلية والصيغ خارج JSON-LD لم تُرَ.
  • أن نسب الروبوتات دائمة — فأسماء الروبوتات وسياساتها تتغير خلال أشهر.
  • أن المواقع التي تنشر llms.txt قد اتخذت قرارًا بشأن الذكاء الاصطناعي — فأكثر من نصف الملفات أنتجتها إضافة برمجية تلقائيًا.
المُقاس ليس ما يفعله مساعد، بل ما يمكن أن يجده مساعد في هذا الموقع.
قِيست الشروط، ولم تُقَس النتائج

الحدود

مقطع زمني واحد.
قِيس robots.txt وllms.txt على حالهما وقت الجلب. وقد يكون موقع قد غيّر قاعدته في اليوم التالي؛ وهذه الدراسة تُظهر تلك اللحظة لا التغيّر.
قِيست الشروط لا النتائج.
لم يُقَس أي موقع يستشهد به المساعدون فعلًا. والإذن لا يضمن الاستشهاد؛ والحجب لا يعني الاختفاء التام.
الروبوتات ليست ملزمة باتباع robots.txt.
الملف اتفاق طوعي. وبعض الروبوتات لا تتبعه. ولهذا فعبارة «حجب» لا تعني «لم يدخل» بل تعني «طلب منه ألّا يدخل».
قُرئ JSON-LD وحده.
قُيّمت البيانات المنظَّمة عبر كتل JSON-LD فقط. أما microdata وRDFa فخارج النطاق؛ والمواقع التي تستخدم هاتين الصيغتين تظهر هنا بوصفها «بلا مخطط».
قياسات المحتوى محدودة بالصفحة الرئيسية.
لا يُرى عمق صفحات المدونة والخدمات والتواصل. وقد يبدو موقع ذو بنية داخلية غنية منخفضًا بسبب صفحة رئيسية نحيفة.
إسناد القطاع استدلال تقريبي.
يُشتق القطاع من عبارة البحث التي وجدت الشركة. وفي الشركات متعددة الخدمات يمكن الدفاع عن إسناد آخر؛ وترتيبات القطاعات مرهونة بهذه القاعدة.
فروق الأقضية تحمل عيّنة صغيرة.
في ثلاثة أقضية يقل عدد المواقع المفحوصة عن 30. وتبقى هذه السطور في الجدول لكنها لا تدخل المقارنة ولا تُنقل إلى عنوان.

قواعد الاقتباس

هذه القواعد الست ليست مسألة أسلوب. فتأطير رقم خطأً في هذا التقرير يحوّل خيارًا إلى عيب، أو مقياس جاهزية إلى نبوءة.

  1. 01الحجب خيار لا خطأ؛ و«لم يكتب قاعدة» و«حجب» يُذكران منفصلين.
  2. 02الدرجة مقياس ظهور لا حكم جودة؛ والدرجة المنخفضة لا تعني شركة سيئة.
  3. 03بما أن الصفحة الرئيسية وحدها قِيست، فنسب المحتوى والمخطط حدّ أدنى.
  4. 04قائمة الروبوتات مؤرَّخة؛ وفي تاريخ آخر ستكون هناك روبوتات أخرى.
  5. 05لا يُقال «الذكاء الاصطناعي لا يجد هذه الشركة»؛ بل يُقال «تنقص الشروط اللازمة للإجابة من هذا الموقع».
  6. 06llms.txt ما زال اقتراح مسوَّدة؛ ويُعرض غيابه مقياسَ تبنٍّ لا نقصًا.

المنهجية باختصار

  1. 01المجتمع المدروسبيانات دراسة «مرسين / State of Digital 2026»: 4,167 نطاقًا مفحوصًا، منها 3,395 يمكن الوصول إليه. ومجتمع الشركات هو 19,615 شركة محلية تظهر نشطة على Google؛ وخلف هذه المواقع 3,928 شركة.
  2. 02الجلب وقواعد التهذيبثلاثة طلبات GET كحد أقصى لكل نطاق: /robots.txt و/llms.txt و/llms-full.txt. واستُخدم User-Agent يعرّف بنفسه، وتزامن منخفض، وانتظار بين الطلبات. وقُرئ robots.txt أولًا، ولم تُرسل طلبات llms.txt إلى المواقع التي تحجب روبوت البحث هذا. وكُتبت النتائج في قاعدة بيانات، فإعادة التشغيل لا تنتج طلبات جديدة.
  3. 03كيف قُيّم robots.txtقُيّم لكل روبوت المسار الجذر ("/") فقط. والمطابقة غير حساسة لحالة الأحرف، وقاعدة أطول مسار تفوز، وعند التساوي يتقدم allow، والمطابقة التامة للرمز تغلب مجموعة البدل. و«لا قاعدة» و«محجوب» عُدّا منفصلين.
  4. 04البيانات المنظَّمة والمحتوىقُرئ HTML الصفحات الرئيسية من ذاكرة 2026·08·25؛ ولم يُرسل لهذا القسم طلب جديد. وحُلِّلت كتل JSON-LD وعُدّت الكتل المعطوبة على حدة. وأُجريت قياسات المحتوى على HTML الساكن.
  5. 05اختبار JavaScriptإن قلّ نص HTML الساكن عن 120 كلمة وكانت الصفحة التي رآها Playwright أكبر من 2.5 ضعف، عُدّ المحتوى معتمدًا على JavaScript. وأمكن تشغيل هذا الاختبار على 3,364 موقعًا.
  6. 06الدرجة والعتباتخلاصة موزونة من 0 إلى 100 لستة مكوّنات؛ ويسقط المكوّن غير القابل للقياس من البسط والمقام، وتحت تغطية 60 % لا تُنشر درجة. قُيّم 3,382 موقعًا وتعذّر تقييم 13. ولم تدخل القطاعات المقارنة إلا بـ50 موقعًا مفحوصًا فأكثر؛ وتجاوز هذه العتبة 30 قطاعًا.
الأسس
الأسس التي يستخدمها هذا التقرير
نطاقات مفحوصة4,167
مواقع جُلب منها robots.txt3,395
مواقع صفحتها الرئيسية قابلة للقراءة3,382
مواقع قابلة للتقييم3,382
الشركات خلف المواقع3,928
مواقع بلا درجة
13
لم تُحتسب أصفارًا
نطاقات تعذّر الوصول إليها
772
من أصل 4,167 نطاقًا مفحوصًا

المصادر

  1. 01جلب robots.txt / llms.txt (هذه الدراسة)القياس الميداني الجديد الوحيد في السلسلة. أُرسل لكل نطاق ثلاثة طلبات GET كحد أقصى: /robots.txt و/llms.txt و/llms-full.txt. ولم تُطلب أي صفحة أخرى. ونافذة الجلب 2026·08·27 من 16:28 إلى 16:44 UTC. وقُرئ robots.txt أولًا؛ ولم تُرسل طلبات llms.txt إلى المواقع التي تحجب روبوت البحث هذا في المسار الجذر.
  2. 02Nixeny Dijital · مرسين / State of Digital 2026المجتمع المدروس نفسه ومجموعة الشركات نفسها. النطاقات الـ 4,167 والمواقع الـ 3,395 التي يمكن الوصول إليها وذاكرات الصفحات الرئيسية الـ 3,382 التي يستخدمها هذا التقرير من تلك الدراسة؛ وأُخذ HTML الصفحات الرئيسية في 2026·08·25. وأُجريت قياسات البيانات المنظَّمة والمحتوى على تلك الذاكرة، ولم يُعَد إرسال أي طلب.nixeny.com
  3. 03قائمة الروبوتات19 رمز user-agent: روبوتات OpenAI وAnthropic وPerplexity وGoogle وApple وMeta وByteDance وCommon Crawl وAmazon وCohere وYou.com وDiffbot، إضافة إلى Googlebot وBingbot مجموعةَ ضبط. والقائمة مؤرَّخة ومذكورة صراحةً في `config/ai-readiness.json`؛ وفي تاريخ آخر ستكون هناك روبوتات أخرى.
  4. 04قواعد تفسير robots.txtيُقيَّم لكل روبوت المسار الجذر فقط. والمطابقة غير حساسة لحالة الأحرف، وقاعدة أطول مسار تفوز، وعند التساوي يتقدم allow، والمطابقة التامة للرمز تغلب مجموعة البدل (*).www.rfc-editor.org
  5. 05schema.org · LocalBusinessتعريف حقول البيانات المنظَّمة. والحقول المطلوبة في هذه الدراسة: name وaddress وtelephone وopeningHours / openingHoursSpecification وgeo وpriceRange وaggregateRating.schema.org
  6. 06اقتراح llms.txtالمسوَّدة التي تحدد صيغة الملف. وهو اقتراح لا معيار؛ ويقيس هذا التقرير التبنّي لا الامتثال.llmstxt.org

لم تُقارَن أرقام هذا التقرير بقياس محافظة أو بلد آخر. فـ«متوسط عالمي» أُنتج بقائمة روبوتات مختلفة وفي تاريخ مختلف وعلى أساس مختلف يبدو، حين يوضع جنبًا إلى جنب، وكأن الرقمين يقيسان الشيء نفسه. أما المشترك مع مرسين / State of Digital 2026 فهو المجتمع المدروس وتاريخ ذاكرة الصفحات الرئيسية؛ وجلب robots.txt خاص بهذه الدراسة وقد جرى بعد ذلك بيومين.

بيانات النشر

Nixeny Dijital - مرسين / AI Readiness 2026 · الإصدار 01 · بيانات الصفحة الرئيسية 2026·08·25 · جلب robots.txt 2026·08·27 · النشر 2026·08·27

أُجريت ونُشرت من Nixeny Dijital، مرسين. الجلب واحتساب الدرجات وتصميم التقرير من إنجاز Nixeny. والمجتمع المدروس وقائمة المواقع مشتركان مع دراسة «مرسين / State of Digital 2026». وأُرسل لأجل هذا التقرير ثلاثة طلبات كحد أقصى لكل نطاق: robots.txt وllms.txt وllms-full.txt.

إن أرادت شركة معرفة سطر موقعها في هذه الدراسة، يكفي أن تكتب اسم النطاق. وتُشارَك المنهجية وقائمة الروبوتات وسجلات التحقق أيضًا عند الطلب: info@nixeny.com

الاقتباس

كيف تُقتبس هذه الدراسة

Nixeny Dijital (2026). Nixeny Dijital - Mersin / AI Readiness 2026. https://nixeny.com/ar/research/mersin-ai-readiness-2026

العرض التقديمي وملف PDF

تُشارَك الشرائح وملف PDF عند الطلب

تتوفر لهذه الدراسة شرائح عرض ونسخة PDF جاهزة للطباعة والعدد المطلق خلف كل نسبة مئوية وملفات المنهجية. وتُشارَك مع الصحافة والأوساط الأكاديمية والمؤسسات العامة بشرط ذكر المصدر.

حقوق النشر وشروط الاستخدام

© 2026 Nixeny Dijital. جميع الحقوق محفوظة.

أعدّت Nixeny Dijital النصوص والتحليلات والرسوم والجداول والصور ومخرجات البيانات المجمّعة المنتَجة في إطار هذه الدراسة. ولا يجوز نسخ المحتوى كاملاً أو جزء جوهري منه أو إعادة نشره أو تقديمه تحت اسم عمل آخر دون إذن كتابي.

يُسمح بالاقتباس المحدود من الدراسة في الأخبار والمقالات وسائر المنشورات. وفي هذه الحالة يجب ذكر المصدر صراحةً بصيغة «Nixeny Dijital — Nixeny Dijital - Mersin / AI Readiness 2026» ووضع رابط فعّال إلى هذه الصفحة.

طلبات الاستخدام والإذن: kivanctasci@nixeny.cominfo@nixeny.com