ابزار سئو

بررسی و تست فایل robots.txt

فایل robots.txt سایت را بررسی کنید، خطاهای دستوری را پیدا کنید و ببینید هر آدرس برای Googlebot و ربات‌های دیگر باز است یا مسدود؛ با همان قوانینی که گوگل اجرا می‌کند.

آدرس سایت را وارد کنید تا فایل robots.txt آن بررسی شود. رایگان و بدون ثبت‌نام.

این ابزار چه چیزهایی را بررسی می‌کند

  • گزارش کامل

    وضعیت دریافت فایل، گروه‌های ربات‌ها، نقشه‌های سایت و امتیاز کلی در یک نگاه.

  • پیدا کردن خطاها

    دستورهای ناشناخته یا غلط املایی، قانون بیرون از گروه، مسیر نامعتبر و Sitemap نسبی.

  • تست آدرس برای هر ربات

    Googlebot، Bingbot، GPTBot و ربات‌های دیگر؛ با نمایش قانونی که تصمیم را گرفته.

  • پیشنهاد اصلاح

    کنار هر مشکل نوشته شده چطور درستش کنید؛ مثل بستن فایل‌های CSS و JS یا مسدود شدن کل سایت.

ویژگی‌های کلیدی

  • بررسی Syntax
  • شناسایی صفحات مسدودشده
  • منطق تطبیق گوگل (RFC 9309)
  • ویرایش و تست دوباره

چطور کار می‌کند؟

  1. آدرس یا متن فایل

    آدرس سایت را بدهید یا متن robots.txt را بچسبانید.

  2. فایل دریافت می‌شود

    از ریشه دامنه، با دنبال کردن ریدایرکت‌ها مثل گوگل.

  3. قوانین بررسی می‌شوند

    هر خط تجزیه و خطاها با شماره خط مشخص می‌شوند.

  4. آدرس‌ها را تست کنید

    ببینید هر آدرس برای هر ربات باز است یا بسته.

پرسش‌های رایج

فایل robots.txt چیست؟

یک فایل متنی در ریشه دامنه (مثل example.com/robots.txt) که به ربات‌های موتور جستجو می‌گوید کدام بخش‌های سایت را خزش نکنند. هر ربات گروه مخصوص خودش (User-agent) را پیدا می‌کند و قوانین Allow و Disallow همان گروه را اجرا می‌کند.

Disallow جلوی ایندکس شدن صفحه را می‌گیرد؟

نه. Disallow فقط خزش را می‌بندد؛ اگر لینک‌های دیگری به صفحه باشد، گوگل ممکن است آدرس را بدون محتوا ایندکس کند. برای حذف از نتایج، صفحه را باز بگذارید و از متاتگ noindex استفاده کنید.

وقتی Allow و Disallow هر دو به یک آدرس بخورند چه می‌شود؟

گوگل قانونی را اجرا می‌کند که طولانی‌ترین مسیر (بیشترین کاراکتر) را دارد. اگر طولشان برابر باشد، Allow برنده است. همین ابزار دقیقاً با همین منطق تست می‌کند و قانون تعیین‌کننده را نشان می‌دهد.

اگر سایت robots.txt نداشته باشد؟

اگر آدرس robots.txt خطای ۴۰۴ (یا هر خطای ۴xx) بدهد، گوگل فرض می‌کند محدودیتی نیست و همه صفحه‌ها را خزش می‌کند. اما خطای ۵xx باعث می‌شود گوگل موقتاً خزش کل سایت را متوقف کند.

Crawl-delay در گوگل کار می‌کند؟

نه. گوگل Crawl-delay را نادیده می‌گیرد (بینگ و یاندکس آن را می‌خوانند). دستور noindex هم از سال ۲۰۱۹ در robots.txt پشتیبانی نمی‌شود.

مشاوره رایگان