🤖 التحكم بالزحف

أنشئ ملف robots.txt احترافي مع قواعد Allow و Disallow و Sitemap

قم ببناء ملف robots.txt نظيف لموقعك، اختر محركات البحث التي تنطبق عليها القواعد، أضف مسارات Allow و Disallow، وحدد عناوين URL لخرائط الموقع.

استهدف جميع الزواحف باستخدام User-agent: * أو اكتب قواعد لروبوتات محددة
أضف مسارات متعددة للسماح أو المنع لكل مجموعة زواحف
حدد عناوين Sitemap حتى تتمكن محركات البحث من اكتشاف خريطة موقعك XML

🛠️ مولد ملف Robots.txt

أنشئ مجموعات الزواحف، وأنتج الملف النهائي، ثم انسخه أو قم بتنزيله.

اختر الروبوت أو حدد مخصص
مسار واحد في كل سطر (يجب أن يبدأ بـ /)
استخدم / لمنع الزحف بالكامل
عنوان URL كامل لكل خريطة موقع، واحد في كل سطر
0 مجموعات الزواحف
0 قواعد السماح
0 قواعد المنع
0 خرائط الموقع

📄 ملف robots.txt الناتج

لم يتم إنشاء الملف بعد
# انقر على "إضافة مجموعة" ثم "إنشاء الملف" لإنتاج ملف robots.txt الخاص بك

📌 نصائح سريعة

أفضل الممارسات

✅ استخدم مسارات نسبية من الجذر: /admin/

✅ عنوان Sitemap يحتاج URL كامل: https://example.com/sitemap.xml

✅ استخدم Disallow: / لمنع الزحف بالكامل

✅ أضف مجموعات متعددة لروبوتات مختلفة

⚠️ الملف حساس لحالة الأحرف والمسافات

📚 ما هو ملف robots.txt ولماذا هو مهم لموقعك؟

ملف robots.txt هو ملف نصي بسيط يوضع في الجذر الرئيسي لموقعك الإلكتروني (مثل: https://example.com/robots.txt)، ويُستخدم للتواصل مع زواحف محركات البحث (مثل Googlebot وBingbot) وإخبارها بالصفحات والمسارات التي يُسمح لها بالزحف إليها أو المنع من الوصول إليها.

💡 هل تعلم؟ ملف robots.txt ليس أداة أمان! أي شخص يمكنه قراءته عبر المتصفح. استخدمه فقط للتحكم في الزحف، وليس لإخفاء المحتوى الحساس.

🎯 فوائد استخدام ملف robots.txt لموقعك

  1. توفير موارد الخادم: منع الزواحف من الوصول إلى صفحات غير مهمة (مثل صفحات الإدارة أو الملفات المؤقتة) يقلل الحمل على السيرفر.
  2. تحسين ميزانية الزحف (Crawl Budget): توجيه الزواحف للتركيز على الصفحات المهمة يساعد في فهرسة أفضل للمحتوى القيّم.
  3. منع المحتوى المكرر: يمكنك منع الزحف إلى نسخ مكررة من الصفحات أو معاملات URL غير ضرورية.
  4. حماية الخصوصية: منع فهرسة الملفات الخاصة مثل ملفات البحث الداخلي أو صفحات الحساب الشخصي.
  5. تحديد خرائط الموقع: إخبار محركات البحث بموقع ملفات Sitemap XML لتسريع اكتشاف الصفحات الجديدة.

🔧 كيفية استخدام أداة مولد robots.txt

أداتنا المجانية تجعل إنشاء ملف robots.txt احترافي أمراً في غاية السهولة:

  1. اختر وكيل المستخدم (User-agent): حدد الروبوت الذي تريد توجيه القواعد له. استخدم "*" لاستهداف جميع الزواحف، أو اختر روبوت محدد مثل Googlebot أو Bingbot.
  2. أضف قواعد السماح (Allow): حدد المسارات التي تريد السماح للزواحف بالوصول إليها صراحةً (مفيد عند منع مجلد رئيسي مع السماح بمجلد فرعي).
  3. أضف قواعد المنع (Disallow): حدد المسارات التي تريد منع الزواحف من الوصول إليها (مثل /admin/ أو /cart/).
  4. حدد عناوين Sitemap: أضف الرابط الكامل لملف أو ملفات Sitemap XML الخاصة بموقعك.
  5. أضف المجموعة: انقر على "إضافة مجموعة" لحفظ هذه القواعد. يمكنك إضافة مجموعات متعددة لروبوتات مختلفة.
  6. أنشئ الملف: اضغط على "إنشاء الملف" لمعاينة الكود النهائي.
  7. انسخ أو حمّل: استخدم زر "نسخ الكود" لنسخه مباشرة، أو "تحميل الملف" لحفظه على جهازك.

⚙️ أمثلة عملية لملف robots.txt

مثال 1: السماح لجميع الزواحف بالوصول الكامل

User-agent: *
Disallow:
Sitemap: https://example.com/sitemap.xml

مثال 2: منع الزواحف من مجلدات معينة

User-agent: *
Disallow: /admin/
Disallow: /private/
Disallow: /temp/
Allow: /public/
Sitemap: https://example.com/sitemap.xml

مثال 3: قواعد مختلفة لروبوتات مختلفة

User-agent: Googlebot
Disallow: /private/

User-agent: Bingbot
Disallow: /admin/
Disallow: /private/

User-agent: *
Disallow: /

Sitemap: https://example.com/sitemap.xml

⚠️ أخطاء شائعة يجب تجنبها

  • استخدام robots.txt لإخفاء معلومات حساسة: الملف عام ويمكن لأي شخص قراءته. استخدم حماية كلمة المرور أو ملفات .htaccess بدلاً من ذلك.
  • عدم استخدام "/" في بداية المسارات: المسارات يجب أن تكون نسبية من الجذر وتبدأ بـ /
  • الخلط بين الزحف والفهرسة: منع الزحف لا يعني بالضرورة منع الفهرسة. استخدم noindex للمنع الفعلي من الفهرسة.
  • عدم اختبار الملف: استخدم أداة اختبار robots.txt في Google Search Console للتأكد من عمل القواعد بشكل صحيح.
  • نسيان إضافة Sitemap: إضافة عنوان Sitemap يساعد محركات البحث على اكتشاف صفحاتك بشكل أسرع.

🚀 نصائح متقدمة لتحسين ملف robots.txt

  • استخدم قواعد Allow لاستثناء مجلدات فرعية من قاعدة Disallow أوسع.
  • أضف تأخير الزحف (Crawl-delay) فقط إذا كان السيرفر يعاني من ضغط الزحف الشديد.
  • راقب سجلات السيرفر لمعرفة سلوك الزواحف الفعلي على موقعك.
  • حدّث الملف عند إضافة أقسام جديدة للموقع أو تغيير هيكل الروابط.
  • استخدم التعليقات (#) لتوثيق الغرض من كل قاعدة لتسهيل الصيانة المستقبلية.

✅ نصيحة احترافية: بعد إنشاء ملف robots.txt، ارفعه إلى جذر موقعك (example.com/robots.txt)، ثم اختبره باستخدام أداة اختبار robots.txt في Google Search Console للتأكد من عمله بشكل صحيح.

❓ الأسئلة الشائعة حول ملف robots.txt

🔹 هل ملف robots.txt إلزامي لجميع المواقع؟
ليس إلزامياً، لكنه مُوصى به بشدة. إذا لم يكن لديك ملف robots.txt، ستقوم الزواحف بافتراض أن جميع الصفحات متاحة للزحف.
🔹 ما الفرق بين Allow و Disallow؟
Disallow يمنع الزواحف من الوصول إلى مسار معين، بينما Allow يسمح صراحةً بالوصول (مفيد لاستثناء مجلد فرعي من قاعدة منع أوسع).
🔹 أين أضع ملف robots.txt؟
يجب وضعه في الجذر الرئيسي لموقعك: https://example.com/robots.txt (وليس في مجلد فرعي).
🔹 هل يمكنني استخدام أحرف البدل (wildcards)؟
نعم، يمكنك استخدام * للمطابقة مع أي تسلسل من الأحرف، و$ للمطابقة مع نهاية الرابط. مثال: Disallow: /*.pdf$ يمنع جميع ملفات PDF.
🔹 كم مرة يجب تحديث ملف robots.txt؟
حدّثه كلما أضفت أقسام جديدة لموقعك أو غيّرت هيكل الروابط. راجعه دورياً (كل 3-6 أشهر) للتأكد من توافقه مع بنية الموقع الحالية.
🔹 هل ملف robots.txt يحمي المحتوى من الظهور في نتائج البحث؟
لا! يمنع الزحف فقط. للمنع من الفهرسة، استخدم <meta name="robots" content="noindex"> أو رأس HTTP بـ X-Robots-Tag.
🔹 كيف أختبر ملف robots.txt بعد إنشائه؟
استخدم أداة اختبار robots.txt في Google Search Console، أو أدخل الرابط مباشرة في المتصفح (example.com/robots.txt) للتأكد من إمكانية الوصول إليه.
🔹 ما هو Crawl-delay وهل أحتاج إليه؟
Crawl-delay يحدد الوقت بالثواني بين طلبات الزحف. Google لا يدعمه، لكن Bing وبعض الزواحف الأخرى تدعمه. استخدمه فقط إذا كان السيرفر يعاني من ضغط شديد.

🎓 دليل متقدم: فهم بنية ملف robots.txt

المكونات الأساسية

1. User-agent (وكيل المستخدم)

يحدد الروبوت أو الزاحف الذي تنطبق عليه القواعد التالية. أمثلة:

  • User-agent: * → جميع الزواحف
  • User-agent: Googlebot → زاحف جوجل فقط
  • User-agent: Bingbot → زاحف بينج فقط

2. Disallow (المنع)

يحدد المسارات الممنوع على الزاحف الوصول إليها:

  • Disallow: / → منع الزحف لجميع الصفحات
  • Disallow: /admin/ → منع الزحف لمجلد admin وما بداخله
  • Disallow: (فارغ) → السماح بالزحف لجميع الصفحات

3. Allow (السماح)

يستخدم لاستثناء مسار من قاعدة Disallow أوسع:

User-agent: *
Disallow: /private/
Allow: /private/public-docs/

في هذا المثال، جميع ملفات /private/ ممنوعة إلا /private/public-docs/

4. Sitemap (خريطة الموقع)

يحدد موقع ملف أو ملفات XML Sitemap:

Sitemap: https://example.com/sitemap.xml
Sitemap: https://example.com/sitemap-images.xml

🔍 أمثلة متقدمة

منع صفحات البحث والفلاتر

User-agent: *
Disallow: /*?s=
Disallow: /*?filter=
Disallow: /search/

منع أنواع ملفات معينة

User-agent: *
Disallow: /*.pdf$
Disallow: /*.doc$
Disallow: /*.xls$

قواعد مختلفة لزواحف مختلفة

User-agent: Googlebot-Image
Disallow: /images/private/

User-agent: Googlebot
Allow: /

User-agent: Bingbot
Crawl-delay: 5
Disallow: /heavy-scripts/

User-agent: *
Disallow: /admin/