بررسی robots.txt و نقشه سایت
محتوای robots.txt دامنهٔ شما خوانده و در یک جدول چیده می شود، نقشه های سایت اعلام شده باز و شمار نشانی هایشان شمرده می شود، و خطاهای پرتکراری که یک سایت را از گوگل پنهان می کنند نشانه دار می شوند.
- بی نیاز به ثبت نام
- شمار نشانی های هر نقشهٔ سایت
- علامت گذاری خطاهای متداول
ابزار را همین جا در صفحه اجرا کنید
مشخص می کند خزندهٔ گوگل به چه بخش هایی دسترسی دارد و نقشهٔ سایت شما سالم است یا نه.
- هزینه رایگان
- منبع داده سرور خودمان
- دسترسی بدون ثبت نام
جواب کوتاه
robots.txt به خزنده ها اعلام می کند کدام بخش های سایت را نخزند، و نقشهٔ سایت به آن ها می گوید چه نشانی هایی هست و آخرین به روزرسانی هر کدام کی بوده. اگر صفحه ای از سایت ایندکس نمی شود، پیش از هر کار دیگر باید همین دو فایل را نگاه کنید.
بدترین رویداد برای یک سایت در یک خط خلاصه می شود: Disallow: / . هر محیط آزمایشی این خط را دارد و درست هم هست، اما وقتی سایت از محیط آزمایشی به سرور اصلی می رود معمولا همراهش منتقل می شود و کل سایت را از گوگل بیرون می برد. هیچ هشداری هم جایی نمایان نمی شود؛ فقط ترافیک ظرف چند هفته به صفر میل می کند و کسی علتش را نمی داند. بعد از هر انتقال سایت، همان روز نخست این را وارسی کنید.
موردی که پیوسته روی سایت های وردپرسی داخل کشور می بینیم مسدود کردن wp-content است. این منطق زمانی درست بود و امروز نیست: گوگل برای تشخیص سازگاری صفحه با موبایل باید CSS و جاوااسکریپت آن را ببیند، و همهٔ آن ها درون wp-content هستند. با مسدود کردن آن پوشه، گوگل صفحه را بی استایل می بیند و دربارهٔ صفحه ای بی شکل داوری می کند.
در مورد نقشهٔ سایت، عددی که دیدن دارد فاصلهٔ میان شمار نشانی های نقشه و شمار صفحات ایندکس شده در سرچ کنسول است. اگر نقشه هزار نشانی دارد و گوگل دویست تا را ایندکس کرده، ایراد از نقشه نیست؛ گوگل هشتصد صفحه را دیده و ارزش ایندکس ندانسته. آن وقت پرسش درست دربارهٔ کیفیت آن صفحات است، نه فایل نقشه.
منبع و روش تامین داده
فایل را سرور ما مستقیم از دامنهٔ شما می خواند؛ هیچ سرویس بیرونی و هیچ هزینه ای در کار نیست. اگر robots.txt نقشهٔ سایت را اعلام نکرده باشد، مسیرهای متداول یعنی sitemap.xml و sitemap_index.xml و wp-sitemap.xml هم آزموده می شوند. الگویی که پیوسته می بینیم: شمار زیادی از سایت های وردپرسی داخل کشور هنوز wp-content را مسدود نگه داشته اند و همین باعث می شود گوگل صفحه را بدون CSS ببیند و آن را سازگار با موبایل نشمارد.
در چه موقعیتی به کار می آید
نخستین موردی که هنگام ایندکس نشدن یک صفحه باید بررسی شود. همچنین پس از هر کوچ سایت یا تعویض هاست، چون robots.txt محیط آزمایشی معمولا با Disallow: / منتقل می شود و کل سایت را از گوگل بیرون می اندازد.
جایی که کارساز نیست
این ابزار می گوید robots.txt چه چیزی را مجاز کرده، نه اینکه گوگل عملا چه کرده است. صفحه ای می تواند در robots.txt کاملا مجاز باشد و باز هم ایندکس نشود، چون گوگل ارزشش را نداشته یا کنونیکالش به جایی دیگر اشاره دارد. عکسش هم ممکن است: صفحه ای که در robots.txt مسدود شده اما از جایی دیگر لینک گرفته، گاهی با عنوانی خالی در نتایج پیدا می شود، چون robots اجازهٔ خزیدن را می گیرد نه اجازهٔ ایندکس. برای «ایندکس نشو»، ابزار درست تگ noindex است، نه robots.txt. برای دیدن اینکه گوگل با یک نشانی چه کرده، تنها منبع درست، سرچ کنسول همان سایت است.
نکته ای که از کار با آن آموخته ایم
اگر robots.txt نقشهٔ سایت را اعلام نکرده باشد، ابزار مسیرهای متداول را هم می آزماید: sitemap.xml و sitemap_index.xml و wp-sitemap.xml. این را به عمد گذاشته ایم، چون در عمل بارها دیده ایم نقشه ای وجود دارد و سالم است اما هیچ جا اعلام نشده، و صاحب سایت گمان می کند نقشه ای ندارد. اعلام نقشه در robots.txt یک خط است، و همان یک خط به خزنده ای که برای بار اول به سایت شما می رسد می گوید از کجا آغاز کند.
هزینه
اجرای این ابزار روی زیرساخت خودمان است و هیچ دادهٔ خریداری شده ای پشت آن نیست، پس هزینه ندارد و همین طور می ماند. تنها محدودیتش یک سقف روزانه است که نمی گذارد یک ربات کل ظرفیت را اشغال کند.
سقف روزانه به ازای هر بازدیدکننده شمرده می شود. اگر بیش از آن نیاز دارید، یک حساب بی هزینه سقفتان را بالا می برد.
پرسش های متداول دربارهٔ این ابزار
نداشتن robots.txt مشکل ساز است؟
نه لزوما. نبود فایل یعنی همه چیز مجاز است، که برای بیشتر سایت های کوچک همان خواستهٔ آن هاست. فایل زمانی لازم می شود که بخواهید بخش هایی مانند صفحات جست وجوی داخلی یا فیلترهای فروشگاه را از خزیدن کنار بگذارید.
می شود صفحه ای را با Disallow از گوگل بیرون برد؟
قابل اتکا نیست. اگر صفحه از جایی دیگر لینک گرفته باشد، ممکن است با عنوانی خالی در نتایج بماند. برای حذف واقعی از تگ noindex استفاده کنید، و مهم تر آنکه همان صفحه را در robots.txt مسدود نکنید، چون گوگل باید بتواند صفحه را بخزد تا noindex را ببیند.
نقشهٔ سایت هر چند وقت باید تازه شود؟
خودکار، با هر انتشار محتوای تازه. تقریبا همهٔ افزونه های سئوی وردپرس همین کار را می کنند. نقشه ای که دستی ساخته شده و ماه ها تازه نشده، از نبود نقشه بدتر است، چون خزنده را به سمت نشانی های حذف شده می فرستد.
خوانده می شود: سیمپ
robots.txt و sitemap.xml را می خواند و می گوید چه چیزی ناخواسته بسته مانده.
قاعده یکی است: See به یک کلمه می چسبد و یک واژه تازه می سازد، نه دو کلمه کنار هم. همان طور که See و commerce شدند Seemerce.
نام های همسایه
- بررسی گواهی SSL SeeLock
- ترندهای صعودی SeeRise
- حجم جستجوی کلمه SeeVolume
- پیشنهاد کلمه کلیدی SeeIdeas
- کلمات کلیدی سایت SeeTerms
- کلمات رتبه دار SeeMatch
- نمایش نتایج گوگل SeeSerp