مولّد وفاحص robots.txt
ابنِ ملفّ robots.txt وافحص أي عنوان عليه بقواعد المطابقة نفسها التي تستعملها جوجل، بما فيها المرساة التي تجعل القاعدة لا تطابق شيئًا في صمت.
تتم المعالجة على جهازك — بلا رفع
| الرابط | الناتج | لماذا |
|---|---|---|
| / | مسموح | Allow: / — القاعدة المطابقة الوحيدة. |
| /admin/users | ممنوع | Disallow: /admin/ — 2 قواعد تطابق؛ ويفوز أطول نمط، والتعادل يذهب إلى Allow. |
| /products/?sort=price | ممنوع | Disallow: /*?sort= — 2 قواعد تطابق؛ ويفوز أطول نمط، والتعادل يذهب إلى Allow. |
| /blog/post-1/ | مسموح | Allow: / — القاعدة المطابقة الوحيدة. |
تستعمل المطابقة قواعد جوجل الثلاث وحدها: * تنوب عن أي سلسلة حروف، و$ ترسو عند نهاية الرابط، وما عدا ذلك بادئة حرفيّة. ويفوز أطول نمط مطابق حيثما كُتب في الملفّ، والتعادل يذهب إلى Allow.
افحص الرابط بسلسلة استعلامه لا بدونها. فالقاعدة المنتهية بـ$ تكفّ عن المطابقة لحظة يتلوها أي شيء — وهكذا تستطيع تعليمة تُقرأ قراءةً صحيحة ألّا تمنع شيئًا إطلاقًا، في صمت، ما دام أحد لا يفحص.
منع صفحة في robots.txt لا يزيلها من البحث. فجوجل قد تدرج رابطًا قيل لها ألّا تجلبه، بلا وصف تحته. ولإبقاء صفحة خارج الفهرس، اسمح بزحفها وأعطها وسم noindex.
كيف تكتب ملفّ robots.txt
- اكتب قواعدك أو ألصقها.
- اسرد الروابط التي تهمّك.
- اقرأ أي قاعدة حسمت كلًّا منها.
كيف يعمل
تستعمل المطابقة قواعد جوجل الثلاث وحدها. فـ* تنوب عن أي سلسلة حروف، و$ ترسو بالنمط عند نهاية الرابط، وما عدا ذلك بادئة حرفيّة. والأسبقيّة بطول النمط لا بموضعه في الملفّ، فتفوز القاعدة الأخصّ حيثما كُتبت، والتعادل يذهب إلى Allow.
ونصف التوليد هو النصف السهل. فملفّ robots.txt لا يُقرأ للتحقّق من صحّته: القاعدة التي لا تطابق شيئًا تبدو تمامًا كالقاعدة التي لا شيء لها لتطابقه. كلتاهما سطر نصّ بلا أثر، وواحدة منهما فقط عطل.
وهذا الموقع نشر ذلك العطل. بقي Disallow: /*/index.txt$ في الإنتاج أسابيع. يُحلَّل، ويجتاز التحقّق، ولم يمنع شيئًا إطلاقًا — فـ$ ترسو عند نهاية الرابط، والحمولات كانت تُطلب ببصمة بناء ملحقة، فلم ينتهِ /contact/index.txt?_rsc=gzsk8 بـ.txtقطّ. وذهب خمسة وثلاثون بالمئة من ميزانية زحف أسبوع إلى صفحات ما كان ينبغي جلبها. ولم يبلّغ شيء عن ذلك، لأنه لم يكن ثمّة ما يُبلَّغ عنه.
ففاحص بسلسلة الاستعلام لا بدونها. فتلك هي الهيئة التي تفوت المرساة، وهي الهيئة التي يطلبها الزاحفون فعلًا.
مثال عملي
وجدول الفحص يسمّي القاعدة الحاسمة، لا الحكم وحده. فحين تطابق أربع قواعد رابطًا واحدًا، تكون معرفة أنه ممنوع نصف الجواب؛ ومعرفة أي سطر منعه هي الجواب كلّه. وفي العيّنة Allow ينتشل فرعًا من Disallow أوسع، وهي الحالة التي تكفّ فيها الأسبقيّة عن كونها بديهيّة.
وافحص ما يجب أن يبقى متاحًا. فأشيع ضرر يأتي من robots.txt ليس صفحةً تُركت قابلة للزحف — بل /_next/ أو /assets/ أو /static/ ممنوعةً جملةً، فتُخفى CSS وجافاسكربت التي تعرض جوجل الصفحة بها. والنتيجة موقع يسجّل نتيجة سيّئة لأسباب لا يراها أحد في HTML.
والمنع ليس إزالة. فالرابط الممنوع هنا قد يظهر في البحث، بلا وصف تحته، لأن جوجل رأته مرتبطًا من مكان آخر وقيل لها ألّا تنظر. ولإبقاء صفحة خارج الفهرس، اسمح بزحفها وأعطها وسم noindex — والتعليمتان يستبعد بعضهما بعضًا، والمنع يفوز بمنعه الوسم من أن يُقرأ أصلًا.
وحين يستقيم الملفّ، وجّهه إلى خريطة موقع مبنيّة بـمولّد خريطة الموقع.
أسئلة
أين يوضع ملفّ robots.txt؟
في جذر المضيف، ولا مكان سواه — https://example.com/robots.txt. والملفّ في مجلّد فرعي يُتجاهَل، والنطاق الفرعي يحتاج ملفّه الخاصّ.
ماذا تفعل $؟
ترسو بالنمط عند نهاية الرابط. وهي أشيع مصدر منفرد للقواعد التي لا تطابق شيئًا في صمت، لأن أي سلسلة استعلام أو جزء بعد المسار يُخفق المرساة.
أيّهما يفوز حين تطابق قاعدتان؟
النمط الأطول، حيثما وقع في الملفّ. وإن تساوى طولهما فاز Allow. ولترتيب الملفّ لا أثر إطلاقًا.
هل يُبقي Disallow صفحةً خارج جوجل؟
لا. إنه يوقف الجلب لا الإدراج. فالرابط الممنوع قد يظهر بلا مقتطف. استعمل وسم noindex واسمح بالزحف، وإلّا لم يُقرأ الوسم أبدًا.
هل تدعم جوجل crawl-delay؟
لا، ولم تدعمه قطّ. وبينغ تدعمه. ومعدّل زحف جوجل يُضبط في Search Console لا في هذا الملفّ.
هل أضع noindex في robots.txt؟
كان سلوكًا غير موثَّق أُزيل عام 2019 ولم يكن مدعومًا قبل ذلك. وهو لا يفعل شيئًا الآن، فهذا يبلّغ عنه بدل أن يُخرجه.
هل أمنع منطقة الإدارة؟
فقط إن لم تكن الروابط سرّيّة. فملفّ robots.txt عامّ، وإدراج مسار فيه إعلان عنه. وما كان حسّاسًا يحتاج استيثاقًا لا رجاءً مهذّبًا.
هل مولّد وفاحص robots.txt مجاني على الإنترنت؟
نعم — مجاني، بلا حساب، وبلا حد يومي، وبلا علامة مائية. يعمل في متصفّحك عبر الإنترنت، ولأن المعالجة تجري على جهازك فإنه يستمر في العمل دون اتصال بعد تحميل الصفحة.
أدوات SEO ذات صلة
مولّد خريطة الموقع XML
حوّل قائمة عناوين إلى خريطة موقع XML صحيحة، ببدائل hreflang التي يحتاجها الموقع متعدّد اللغات ويغفلها أكثر المولّدات.
افتح$termiva hreflang --checkمولّد وسوم hreflang
ولّد وسوم hreflang لكل لغة من لغات الصفحة، وافحص العنقود بحثًا عن الأخطاء التي تجعل جوجل تُسقط المجموعة كلّها في صمت.
افتح$termiva meta --analyseمحلّل وسوم الرأس
ألصق شيفرة الصفحة واسترجع كل وسم في الرأس يهمّ، مقيسًا ومحكومًا عليه — عرض العنوان، وcanonical، وrobots، وOpen Graph، وhreflang، وh1.
افتح$termiva density --phrases 3فاحص كثافة الكلمات المفتاحية
عُدّ الكلمات والعبارات التي تتّكئ عليها الصفحة فعلًا، بطيّ السوابق العربية معًا حتى لا يصل المصطلح الواحد موزّعًا على اثني عشر سطرًا.
افتح