قبل أن ترفع نسخة تجريبية أو تنقل موقعًا إلى نطاقه النهائي، افصل بين سؤالين: هل تريد أن لا يظهر في Google؟ وهل تريد أن لا يراه أي شخص غيرك؟ في ووردبريس هذان شيئان مختلفان. اختبرنا إعداد «منع محركات البحث من فهرسة هذا الموقع» في النسخة المحلية لمشروعنا، ثم راجعنا وسم robots الذي خرج في HTML.
متى تحتاج إيقاف الفهرسة؟
- عند بناء موقع جديد محليًا قبل أن تكتمل الصفحات والمحتوى والهوية.
- عند تشغيل نسخة staging لاختبار تغيير قالب أو إضافة أو نقل كبير.
- عند إنشاء نسخة مطابقة مؤقتة من موقع قائم.
لا تستخدم هذا الخيار لإخفاء بيانات خاصة. محركات البحث ليست نظام صلاحيات، ووسم noindex لا يمنع زائرًا يعرف الرابط من فتح الصفحة.
الطريقة من لوحة ووردبريس
- افتح الإعدادات ← قراءة.
- في قسم ظهور الموقع لمحركات البحث فعّل مربع «منع محركات البحث من فهرسة هذا الموقع».
- احفظ التغييرات.
- افتح صفحة من الموقع ثم اعرض مصدر الصفحة، وابحث عن
noindex.
يوضح دليل ووردبريس أن هذا الإعداد يولد وسم noindex,nofollow في رأس الصفحة في الإصدارات الحديثة عندما يستخدم القالب wp_head(). لذلك لا يكفي أن ترى علامة الحفظ في الإدارة؛ تحقّق من HTML الذي يصل للزائر.
نتيجة اختبارنا
في النسخة المحلية شغّلنا فحصًا مباشرًا للصفحة الرئيسية. النتيجة التي ظهرت في مصدر الصفحة كانت:
<meta name='robots' content='noindex, nofollow' />
هذه نتيجة مناسبة لنسخة تطوير محلية. كما أن عنوانها 127.0.0.1 لا يمكن لـ Google الوصول إليه من الإنترنت، لذلك لا نعتمد على وسم noindex وحده في الحماية.
لماذا robots.txt وحده ليس حلًا لإخفاء صفحة؟
ملف robots.txt يوجه الزواحف بشأن طلب الصفحات، لكنه ليس وسيلة لحماية المحتوى أو ضمان عدم ظهور الرابط في نتائج البحث. توضح Google أن وسم noindex يجب أن يكون قابلًا للرؤية للزاحف كي يُحترم؛ إذا منعت الزاحف من الصفحة في robots.txt فلن يقرأ وسم noindex الموجود داخلها. وللمحتوى السري، استخدم كلمة مرور أو تقييد وصول على مستوى الخادم.
ثلاث طبقات بحسب الحالة
| الحالة | الحل المناسب | ما لا يكفي وحده |
|---|---|---|
| موقع محلي على جهازك | استخدم عنوانًا محليًا مثل 127.0.0.1، مع noindex كطبقة إضافية | نشر الرابط على الإنترنت |
| نسخة staging عامة | كلمة مرور أو قائمة سماح IP، ومعها noindex | الاعتماد على robots.txt فقط |
| صفحة منشورة تريد إزالتها من البحث | noindex مع بقاء الصفحة قابلة للزحف، أو إزالة المحتوى حسب الهدف | حظرها في robots.txt قبل أن يراها Google |
ماذا نفعل عند إطلاق الموقع الحقيقي؟
لا نزيل منع الفهرسة في اليوم الأول تلقائيًا. ننتظر حتى تكتمل الهوية الحقيقية، صفحات الخصوصية والتواصل، المحتوى الذي راجعناه، وخريطة الموقع والروابط الداخلية. بعدها نلغي خيار المنع من الإعدادات، نتأكد أن وسم noindex اختفى من الصفحات القابلة للفهرسة، ونراجع Search Console بعد النشر.
صفحات مثل نتائج البحث الداخلية والوسوم الفارغة وصفحات المرفقات لا نريد فهرستها أصلًا؛ القالب والإضافة في هذا المشروع يضعان noindex عليها بصورة مقصودة، بينما تبقى المقالات والصفحات الأساسية قابلة للفهرسة عند الإطلاق.
قائمة تحقق قصيرة
- نسخة التطوير غير متاحة للعامة أو محمية بكلمة مرور عند الحاجة.
- وجود noindex مفحوص في مصدر صفحة واحدة على الأقل.
- لا توجد كلمات مرور أو ملفات نسخ احتياطي في مجلد عام.
- قبل الإطلاق: ألغِ منع الفهرسة فقط بعد مراجعة كل صفحات الثقة والمقالات الأساسية.
- بعد الإطلاق: افحص الصفحة الحية في Search Console بدل الافتراض أن الإعداد تغيّر كما أردت.