Screpy - AI SEO ऑडिट टूल

मुफ़्त Robots.txt टेस्टर और वैलिडेटर

खोज, प्रशिक्षण और उपयोगकर्ता के अनुरोध पर सक्रिय होने वाले एजेंट के उद्देश्य अलग हो सकते हैं। हर प्रोडक्ट टोकन को अलग से जाँचें।

अकाउंट की ज़रूरत नहीं है। URL और robots.txt का कंटेंट सहेजा नहीं जाता।

जाँचें कि कोई URL Google, AI खोज, प्रशिक्षण और कस्टम क्रॉलर के लिए अनुमति प्राप्त है या ब्लॉक है। लागू होने वाला सटीक नियम और उसकी पंक्ति देखने के लिए लाइव वेबसाइट जाँचें या robots.txt फ़ाइल पेस्ट करें।

तीन चरणों में क्रॉल नियम जाँचें।

प्रोजेक्ट या अकाउंट बनाए बिना एक URL जाँचें। लाइव मोड केवल वेबसाइट की सार्वजनिक robots.txt फ़ाइल पढ़ता है।

01

स्रोत चुनें

वेबसाइट से सार्वजनिक robots.txt फ़ाइल प्राप्त करें या वह सामग्री पेस्ट करें, जिसे आप अपने ब्राउज़र में निजी तौर पर जाँचना चाहते हैं।

02

क्रॉलर चुनें

खोज, AI खोज, प्रशिक्षण, उपयोगकर्ता द्वारा सक्रिय किए गए या कस्टम क्रॉलर का प्रोडक्ट टोकन चुनें और जाँचने के लिए URL पाथ दर्ज करें।

03

सटीक मिलान देखें

देखें कि URL की अनुमति है या नहीं, कौन सा समूह लागू होता है और परिणाम के पीछे कौन सा सटीक Allow या Disallow नियम तथा पंक्ति है।

समझें कि क्रॉलर को अनुमति क्यों मिली है या उसे क्यों रोका गया है।

उपयोगी परिणाम में निर्णय का आधार बनने वाला नियम दिखना चाहिए, केवल हरी या लाल स्थिति नहीं।

सबसे विशिष्ट नियम लागू होता है

टेस्टर सबसे लंबे मिलान वाला नियम लागू करता है। समान विशिष्टता वाले Allow और Disallow नियमों में टकराव होने पर कम प्रतिबंध वाला Allow नियम लागू होता है।

वाइल्डकार्ड और अंतिम भाग का मिलान

कई अक्षरों के क्रम से मिलान के लिए तारांकन चिह्न और नियम को जाँचे गए URL के अंत से मिलाने के लिए डॉलर चिह्न इस्तेमाल करें।

User-agent समूह महत्वपूर्ण हैं

किसी विशेष क्रॉलर का समूह सभी पर लागू होने वाले * समूह से प्राथमिकता रखता है। खोज, प्रशिक्षण और उपयोगकर्ता द्वारा सक्रिय किए गए अलग-अलग एजेंटों को अलग से जाँचना चाहिए।

कोई नियम नहीं होने पर डिफ़ॉल्ट अनुमति मिलती है

जब कोई लागू Allow या Disallow नियम मेल नहीं खाता, तो robots exclusion protocol के अनुसार URL को डिफ़ॉल्ट रूप से अनुमति मिलती है।

robots.txt क्रॉल की अनुमति नियंत्रित करता है, खोज में शामिल होने को नहीं।

क्रॉल नियंत्रण

Allow और Disallow नियम संगत क्रॉलर को बताते हैं कि वह किन URL पथों का अनुरोध कर सकता है।

इंडेक्सिंग नियंत्रण

यदि किसी URL को खोज परिणामों में नहीं दिखाना चाहते, तो ऐसे noindex निर्देश दें जिन्हें क्रॉलर पढ़ सके और सर्च इंजन की हटाने की प्रक्रिया अपनाएँ।

Robots.txt टेस्टर से जुड़े सवाल

क्रॉल नियमों, AI क्रॉलर टोकन, त्रुटि की स्थितियों और इंडेक्सिंग के बारे में स्पष्ट जवाब।

robots.txt टेस्टर क्या करता है?

robots.txt टेस्टर किसी क्रॉलर के user-agent और URL की तुलना robots.txt फ़ाइल के नियमों से करता है। यह बताता है कि क्रॉल करने की अनुमति है या नहीं, कौन सा user-agent समूह लागू होता है और यदि कोई नियम मेल खाता है तो वह सटीक नियम कौन सा है।

“डिफ़ॉल्ट रूप से अनुमति है” का क्या मतलब है?

इसका मतलब है कि टेस्टर को URL ब्लॉक करने वाला कोई लागू नियम नहीं मिला। ऐसा तब हो सकता है जब कोई user-agent समूह मेल न खाए, मेल खाने वाले समूह में संबंधित नियम न हो या इस्तेमाल योग्य robots.txt फ़ाइल मौजूद न हो।

robots.txt से 404 या 403 मिलने पर क्या होता है?

प्रमुख क्रॉलर आम तौर पर अधिकांश 4xx प्रतिक्रियाओं को ऐसे मानते हैं जैसे कोई क्रॉल प्रतिबंध प्रकाशित नहीं किया गया हो। 429 प्रतिक्रिया अलग है क्योंकि यह अस्थायी अनुरोध सीमा का संकेत देती है, इसलिए टेस्टर लाइव स्थिति को अनिर्धारित बताता है।

क्या robots.txt किसी पेज को इंडेक्स होने से रोकता है?

अपने आप नहीं। Robots.txt क्रॉलिंग नियंत्रित करता है, इंडेक्सिंग नहीं। ब्लॉक किया गया URL फिर भी लिंक के माध्यम से मिल सकता है और पूरे स्निपेट के बिना खोज परिणामों में दिखाई दे सकता है। खोज परिणामों से हटाना उद्देश्य हो तो क्रॉल किए जा सकने वाले पेज पर उपयुक्त noindex निर्देश इस्तेमाल करें।

robots.txt में * और $ का क्या मतलब है?

तारांकन चिह्न URL पाथ में अक्षरों के क्रम से मेल खाता है। डॉलर चिह्न पैटर्न को URL के अंत से जोड़ता है। सबसे विशिष्ट लागू नियम पहचानते समय टेस्टर दोनों पैटर्न का समर्थन करता है।

5xx या टाइमआउट का परिणाम अनिर्धारित क्यों है?

अस्थायी सर्वर या नेटवर्क विफलता से यह साबित नहीं होता कि क्रॉलर को अनुमति है या वह ब्लॉक है। क्रॉलर अनुरोध रोक सकते हैं या पहले कैश की गई robots.txt फ़ाइल फिर से इस्तेमाल कर सकते हैं, इसलिए टेस्टर नियम के बारे में निश्चित निर्णय नहीं देता।

क्या AI क्रॉलर को Googlebot से अलग जाँच सकता हूँ?

हाँ। खोज क्रॉलर, AI खोज क्रॉलर, मॉडल प्रशिक्षण क्रॉलर और उपयोगकर्ता द्वारा सक्रिय किए गए फ़ेचर अलग प्रोडक्ट टोकन इस्तेमाल करते हैं और उनके नियम अलग हो सकते हैं। हर एजेंट पर लागू नीति जाँचने के लिए उसे अलग से चुनें।

क्या Screpy URL या पेस्ट की गई robots.txt सामग्री सहेजता है?

नहीं। पेस्ट की गई सामग्री का विश्लेषण आपके ब्राउज़र में होता है और वह अपलोड नहीं होती। लाइव मोड केवल वर्तमान जाँच के लिए वेबसाइट, जाँचा गया URL और चुना हुआ क्रॉलर भेजता है। टूल इन इनपुट को सहेजता नहीं है।