إذا لم تظهر صفحتك في جوجل، فالسبب في أغلب الأحيان واحد من ثمانية: الصفحة تُرجع noindex، أو ملف robots.txt يمنع الزحف، أو وسم canonical يشير إلى عنوان آخر، أو الصفحة داخل سلسلة إعادة توجيه، أو قررت Google أن المحتوى لا يستحق الأرشفة، أو لا تصل إلى الصفحة أي روابط داخلية، أو تُعامَل الصفحة الفارغة كخطأ 404 ضمني، أو إعداد hreflang معطّل.

لا داعي للتخمين؛ قائمة فحص مدتها عشر دقائق تكشف لك السبب. نشرح فيما يلي كل سبب بالترتيب: كيف تتحقق منه وكيف تصلحه.

المحتويات

التشخيص أولًا: في أي مرحلة تعثرت الصفحة

تعالج Google الصفحة على ثلاث مراحل: تكتشفها، ثم تزحف إليها، ثم تؤرشفها. ويتوقف الحل كليًا على المرحلة التي حدثت فيها المشكلة.

رسم متحرك يوضح كيف تكتشف Google الصفحة وتزحف إليها وتؤرشفها، وفي أي مرحلة تتعثر الصفحة
تمر الصفحة بهذه المراحل الثلاث بالترتيب، وتخبرك رسالة الحالة في أداة فحص عنوان URL أين توقفت.

أسرع طريقة لمعرفة المرحلة هي أداة فحص عنوان URL في Search Console. الصق العنوان وسجّل رسالة الحالة. أوردنا أسماء الحالات كما تظهر في الواجهة العربية والإنجليزية:

رسالة الحالة المرحلة السبب الذي تفحصه
عنوان URL غير معروف لدى Google (URL is unknown to Google) لم تُكتشف 6
تم الاكتشاف – غير مفهرسة حاليًا (Discovered – currently not indexed) لم يتم الزحف إليها 2، 6
تم الزحف إليها – غير مفهرسة حاليًا (Crawled – currently not indexed) تم الزحف إليها 1، 5
صفحة مكررة بدون صفحة أساسية يحددها المستخدم (Duplicate without user-selected canonical) تم الزحف إليها 3، 8
صفحة تتضمن إعادة توجيه (Page with redirect) تم الزحف إليها 4
خطأ 404 ضمني (Soft 404) تم الزحف إليها 7

في الأداة تبويبان يخلط بينهما كثيرون. تبويب فهرس Google يعرض الصفحة كما كانت عند آخر زحف، وقد تكون هذه البيانات قديمة. أما الاختبار المباشر فيجلب الصفحة في هذه اللحظة. إذا أجريت إصلاحًا، فسيظهر الاختبار المباشر نظيفًا بينما يظل تبويب الفهرس يعرض الخطأ. هذا طبيعي، ويعني أن إصلاحك نجح.

1. الصفحة تُرجع noindex

أكثر الأسباب شيوعًا وأسهلها في أن يفوتك. تُفتح الصفحة في المتصفح بشكل طبيعي، والمحتوى ظاهر، ولا يظهر أي تحذير. لكن في مكان ما داخل HTML يوجد سطر يقول لـ Google: «لا تؤرشفني».

كيف تتحقق:

curl -s https://example.com/page | grep 'name="robots"'

النتيجة المتوقعة هي index, follow. إذا رأيت noindex فلا حاجة إلى فحص الأسباب السبعة الأخرى؛ هذه هي المشكلة.

من أين يأتي: إعداد الصفحة في إضافة SEO، أو شرط في قالب الموقع، أو إعداد انتقل من موقع الاختبار، أو ترويسة X-Robots-Tag يرسلها الخادم. افحص الترويسة أيضًا:

curl -sI https://example.com/page | grep -i x-robots-tag

2. ملف robots.txt يمنع الزحف

هنا فرق مهم: ملف robots.txt يمنع الزحف لا الأرشفة. إذا حصلت صفحة محظورة على روابط كافية من مواقع أخرى، فقد تؤرشفها Google بعنوانها فقط دون أن ترى محتواها. والنتيجة سجل في نتائج البحث بلا وصف.

والعكس صحيح أيضًا: إذا أردت إزالة صفحة من الفهرس، فحظرها في robots.txt طريقة خاطئة. إذا لم تستطع Google الزحف إلى الصفحة فلن ترى وسم noindex أيضًا. الصواب أن تسمح بالزحف وتضيف noindex.

كيف تتحقق: تأكد أولًا من وجود الملف. ملف robots.txt يُرجع 404 أكثر شيوعًا مما تظن.

curl -sI https://example.com/robots.txt | head -1

بعد ذلك يمكنك أن ترى في تقرير robots.txt داخل Search Console أي قاعدة تحظر أي عنوان.

3. وسم canonical يشير إلى عنوان آخر

يخبر وسم canonical جوجل بمكان النسخة الأساسية من المحتوى. وإذا ضُبط بشكل خاطئ فأنت بنفسك تُخرج صفحتك من الفهرس.

كيف تتحقق:

curl -s https://example.com/page | grep canonical

يجب أن يطابق العنوان في النتيجة العنوان الذي تفحصه تمامًا، بما في ذلك الشرطة المائلة في النهاية، ووجود www من عدمه، والفرق بين http وhttps.

ثلاثة أخطاء شائعة:

  • غياب الإشارة إلى الذات: يجب أن تشير كل صفحة ليست نسخة مكررة إلى عنوانها هي.
  • canonical موحّد: كل الصفحات تشير إلى الصفحة الرئيسية. يحدث ذلك عادة بسبب وسم مكتوب بشكل ثابت في القالب، فيُخرج الموقع كله من الفهرس.
  • حلقة canonical: الصفحة A تشير إلى B، والصفحة B تعيد التوجيه إلى A. لا تستطيع Google اختيار أي منهما.
رسم متحرك لحلقة canonical: الصفحة A تشير إلى B عبر canonical، والصفحة B تعيد التوجيه إلى A برمز 307، فيعلق Googlebot بينهما، ثم الإعداد الصحيح
عندما يشير canonical وإعادة التوجيه كلٌّ منهما إلى الآخر، تعلق Google بين عنوانين. في الإعداد الصحيح يشير canonical إلى العنوان الأساسي الذي يُرجع 200 مباشرة.

وسم canonical تلميح قوي وليس أمرًا. إذا رأت Google أن الصفحات مختلفة فعلًا فقد تتجاهل الوسم، وعندها سيختلف حقل «عنوان URL الأساسي الذي اختارته Google» في أداة الفحص عن اختيارك.

4. الصفحة داخل سلسلة إعادة توجيه

العنوان الذي يعيد التوجيه لا يُؤرشف، بل تُؤرشف وجهته. وتبدأ المشكلة عندما تعيد الوجهة نفسها التوجيه إلى مكان آخر.

كيف تتحقق:

curl -IL https://example.com/page

عُدّ أسطر HTTP/2 30x في النتيجة. المثالي صفر أو واحد. إذا ظهر العنوان نفسه مرتين فأنت داخل حلقة، ولن تُؤرشف تلك الصفحة أبدًا.

فحص سلسلة إعادة التوجيه بأمر curl -IL: سلسلة تُرجع 200 بعد خطوتي 301 و302، وعنوان نظيف يُرجع 200 مباشرة
العنوان الأول يُرجع 200 بعد عمليتي إعادة توجيه، والثاني مباشرة. يجب أن تشير الروابط الداخلية وخريطة الموقع دائمًا إلى العنوان النهائي.

ونوع الرمز مهم أيضًا:

الرمز المعنى متى يُستخدم
301 دائم تغيّر العنوان بشكل دائم
302 مؤقت إعادة توجيه قصيرة المدى
307 مؤقت مع الحفاظ على الطريقة على مستوى الخادم أو إطار العمل
308 دائم مع الحفاظ على الطريقة المقابل الحديث لـ 301

استخدام 302 لنقل دائم يؤخر انتقال الإشارات. إذا كان النقل دائمًا فاستخدم 301 أو 308.

5. تم الزحف إليها ولم تتم أرشفتها

هذه الرسالة ليست خطأً تقنيًا. رأت Google صفحتك وقرأتها وقررت أنها لا تستحق الإضافة إلى الفهرس. قد يكون ذلك صعب السماع، لكن التشخيص واضح.

الأسباب المعتادة: الصفحة شبه مطابقة لصفحة أخرى، أو المحتوى سطحي مقارنة بالنتائج الأخرى لهذا البحث، أو أنها صفحة قوائم أو وسوم مولّدة تلقائيًا.

ما العمل: لا يوجد ما يُصلح في الكود. أضف إلى الصفحة شيئًا لا يجده الباحث في مكان آخر: بياناتك الخاصة، وقياساتك الخاصة، ولقطات الشاشة الخاصة بك. وإن لم تستطع، فادمج الصفحة مع غيرها أو احذفها. صفحة قوية واحدة أفضل من خمس صفحات ضعيفة عن الموضوع نفسه.

6. تم اكتشافها ولم يتم الزحف إليها

تعرف Google العنوان لكنها لم تصل إليه بعد في دور الزحف. وعادة يكون لذلك سببان: ميزانية الزحف المخصصة للموقع منخفضة، أو أن الصفحة لا تحصل على روابط كافية من داخل الموقع.

يُبالَغ في أهمية ميزانية الزحف بالنسبة للمواقع الصغيرة. في موقع من بضع مئات من الصفحات نادرًا ما تكون هي المشكلة الحقيقية. المشكلة غالبًا في الروابط الداخلية: إذا لم يصل إلى الصفحة أي رابط، تعدّها Google غير مهمة.

ما العمل:

  • أضف الصفحة إلى خريطة الموقع وأرسل الخريطة عبر Search Console.
  • اربط الصفحة من المحتوى ذي الصلة ضمن السياق. رابط القائمة في تذييل الصفحة لا يكفي؛ الرابط من داخل النص بنص ارتكاز ذي معنى أقوى بكثير.
  • اطلب الأرشفة مرة واحدة من أداة فحص عنوان URL. إذا لم يكن هناك مانع تقني، فغالبًا ما يؤتي ذلك ثماره في اليوم نفسه.

7. خطأ 404 ضمني

تُرجع الصفحة الرمز 200، لكن Google تفهم محتواها على أنه «لا شيء هنا». وأكثر ما يحدث ذلك في صفحات التصنيفات التي لم تُضف إليها مقالات بعد، وصفحات البحث بلا نتائج، وصفحات المنتجات المحذوفة.

لأطر عمل JavaScript الحديثة نسخة خفية من المشكلة: يعرض الإطار مكوّن 404 بينما يبقى رمز HTTP هو 200. يرى المستخدم الصفحة الصحيحة، وتتلقى Google إشارة خاطئة.

كيف تتحقق: اختلق عنوانًا غير موجود واقرأ الرمز الذي يُرجعه.

curl -sI https://example.com/this-page-does-not-exist | head -1

المتوقع 404. إذا حصلت على 200 فموقعك يقول لـ Google إن كل عنوان مختلق موجود.

ما العمل: إذا كانت الصفحة غير موجودة فعلًا فأرجع 404. وإذا كانت فارغة مؤقتًا فأضف محتوى أو ضع noindex حتى تمتلئ.

8. إعداد hreflang معطّل

في المواقع متعددة اللغات يحدد hreflang أي نسخة تُعرض لأي زائر حسب لغته. وإذا ضُبط بشكل خاطئ تعدّ Google النسخ اللغوية نسخًا مكررة من بعضها ولا تؤرشف بعضها.

أربع قواعد:

  • يجب أن يُرجع كل عنوان مستهدف الرمز 200 مباشرة. هدف واحد يعيد التوجيه يُبطل المجموعة كلها في تلك الصفحة.
  • يجب أن تُدرج كل صفحة نفسها أيضًا.
  • يجب أن تكون الروابط متبادلة: إذا أشارت الصفحة A إلى B فيجب أن تشير B إلى A.
  • حدّد x-default؛ إليه يُوجَّه الزائر الذي لا تطابق لغته أي نسخة.

كيف تتحقق:

curl -s https://example.com/ | grep -o 'hreflang="[^"]*" href="[^"]*"'

تحقق من كل عنوان يظهر في النتيجة واحدًا تلو الآخر بالأمر curl -I.

بأي ترتيب تفحص

الترتيب مهم، لأن المشكلة الأعلى تجعل ما تحتها بلا معنى. الروابط الداخلية لن تفيد صفحة تُرجع noindex.

الخطوة الفحص المتوقع
1 وسم robots الوصفي index, follow
2 الوصول في robots.txt 200 دون حظر
3 رمز حالة HTTP 200
4 سلسلة إعادة التوجيه 0 أو خطوة واحدة
5 canonical يشير إلى الصفحة نفسها
6 أهداف hreflang كلها تُرجع 200
7 الروابط الداخلية رابط سياقي واحد على الأقل
8 عمق المحتوى يجيب عن البحث

الفحوص الستة الأولى تقنية وقاطعة: إما صحيحة وإما خاطئة. أما الأخيران فيتطلبان تقديرًا ووقتًا.

الخلاصة

معظم مشكلات الأرشفة لا تتعلق بالمحتوى، بل بما تقوله الصفحة لـ Google. والخبر الجيد أن كل هذه الإشارات يمكن قياسها منفردة، ومعظمها يُصلح بتعديل سطر واحد.

ما ينجح عمليًا: طبّق الترتيب السابق أولًا وأزل الموانع التقنية، ثم أرسل الصفحة للأرشفة مرة واحدة، ثم امنحها رابطًا سياقيًا من داخل موقعك. عندما يزول المانع التقني تتحرك Google عادةً بسرعة؛ فما يستغرق شهورًا هو المانع نفسه لا ما يأتي بعد إزالته.

بعد أن يصبح الجانب التقني سليمًا يأتي دور الموثوقية. إذا كانت Google ترى الصفحة وتؤرشفها، فالعامل التالي الذي يحدد ترتيبها هو قوة الروابط التي تشير إليها.

الأسئلة الشائعة

لماذا لا يظهر موقعي في نتائج بحث جوجل؟

هناك ثمانية أسباب شائعة: وسم noindex، وحظر robots.txt، وcanonical خاطئ، وسلسلة إعادة توجيه، ومحتوى رأت Google أنه لا يستحق الأرشفة، وغياب الروابط الداخلية، وخطأ 404 ضمني، وhreflang معطّل. وتخبرك رسالة الحالة في أداة فحص عنوان URL داخل Search Console بالسبب الذي ينطبق على صفحتك.

كم يستغرق أرشفة صفحة جديدة؟

إذا لم يكن هناك مانع تقني فمن بضع ساعات إلى بضعة أيام. وإذا طلبت الأرشفة يدويًا فقد تتم في اليوم نفسه. وفي المواقع التي تزحف إليها Google كثيرًا تكون المدة أقصر.

هل يرفع طلب الأرشفة ترتيب صفحتي؟

لا. الطلب يضع الصفحة في دور الزحف فقط ولا يؤثر في الترتيب. كما أن إرسال الصفحة نفسها مرارًا لا يقدّمها في الدور.

ما الفرق بين noindex وحظر robots.txt؟

ملف robots.txt يمنع الزحف، ووسم noindex يمنع الأرشفة. إذا أردت إزالة صفحة من الفهرس فلا تحظرها في robots.txt؛ فإذا لم تستطع Google الزحف إلى الصفحة فلن ترى وسم noindex.

هل يجب أن يكون وسم canonical في كل صفحة؟

نعم، وسم canonical الذي يشير إلى الصفحة نفسها ممارسة معيارية، ويزداد أهمية في المواقع التي يمكن أن تنشأ فيها عناوين تحتوي على معاملات.

هل رسالة «تم الزحف إليها – غير مفهرسة حاليًا» خطأ؟

ليست خطأً تقنيًا. معناها أن Google رأت الصفحة وقررت أنها لا تستحق الأرشفة. والحل تقوية المحتوى أو دمج الصفحة مع صفحة أخرى.

هل يضمن إرسال خريطة الموقع الأرشفة؟

لا. خريطة الموقع تساعد على الاكتشاف لكنها لا تضمن الأرشفة، إذ يجب بعد الزحف أن تُعدّ الصفحة جديرة بالفهرس.

ماذا أفعل إذا عُدّت صفحتي نسخة مكررة؟

افحص وسم canonical أولًا وتأكد أنه يشير إلى الصفحة نفسها. وإذا استمرت المشكلة فربما تكون الصفحتان متشابهتين فعلًا؛ ادمجهما أو اجعل إحداهما مختلفة بوضوح.

ما اللغة التي يجب أن تكون x-default في موقع متعدد اللغات؟

النسخة التي تريد عرضها للزائر الذي لا تطابق لغته أي نسخة. وغالبًا تكون النسخة الإنجليزية أو صفحة اختيار اللغة.

الخطوة التالية

إذا فحصت الأساس التقني فالخطوة التالية هي بناء الموثوقية. ستجد باقات الروابط والأسعار في صفحة خدمة Hacklink. وإذا واجهتك أي عقبة راسلنا.