आरबी

एक Robot.txt फ़ाइल उत्पन्न करें

एक साफ-सफाई वाली रोबोट उत्पन्न करें.txt फ़ाइल को साइटमैप और क्रॉल नियमों के साथ उत्पन्न करें।

कैसे उपयोग करें Robots.txt जेनरेटर

  1. उपयोगकर्ता एजेंट चुनें

    प्रत्येक क्रॉलर के लिए * का उपयोग करें, या एक विशिष्ट नाम दें जब कोई नियम केवल उस पर लागू होना चाहिए।

  2. अपनी अनुमति सेट करें और पथ को अस्वीकार करें

    पथ क्रॉलरों की सूची में, जैसे कि व्यवस्थापक या आंतरिक खोज पृष्ठों, और अनुमति देने के लिए किसी भी अपवाद के रूप में छोड़ देना चाहिए।

  3. अपनी साइटमैप जोड़ें और कॉपी करें

    अपने sitemap URL दर्ज करें, फिर फ़ाइल की प्रतिलिपि बनाएँ और इसे अपने डोमेन की जड़ पर रोबोट.txt के रूप में सहेजें।

के बारे में Robots.txt जेनरेटर

रोबोट.txt पहली फ़ाइल है जो क्रॉलर पूछती है और यह सबसे आसान है कि वह कैटस्ट्रोफिक रूप से गलत हो जाए। यह आपके डोमेन की जड़ पर बैठता है और क्रॉलर को बताता है कि वे किस रास्ते का अनुरोध कर सकते हैं। एक अस्वस्थ नियम में एक slash खोज से पूरी साइट को छिपा सकता है, और क्योंकि कुछ भी वाइसिबिल ब्रेक नहीं कर सकता है, जो गलती अक्सर महीनों तक जीवित रहती है इससे पहले कि कोई भी इसे कभी नहीं पहुंचता।

वाक्य रचना छोटी लेकिन अप्रवर्तन है: नियमों को उपसर्ग, आदेश और विशिष्टता पारस्परिक क्रिया से मिलान किया जाता है, और एक खाली या विकृत फ़ाइल को एक permissive से बहुत अलग तरीके से इलाज किया जाता है। यह उपकरण उन हिस्सों से एक मान्य फ़ाइल बनाता है जिन्हें आप वास्तव में देख रहे हैं - जो क्रॉलर एक नियम लागू होता है, क्या अनुमति देना है, क्या करना है, क्या करना है, क्या करना है, और जहां आपका साइटमैप रहता है।

इसके बारे में स्पष्ट होने की एक चीज: रोबोट.txt नियंत्रण क्रॉलिंग, अनुक्रमण या पहुंच नहीं। एक अप्रयुक्त यूआरएल अभी भी परिणाम में दिखाई दे सकता है यदि अन्य साइटें इसके लिए लिंक करती हैं, और फ़ाइल सार्वजनिक है, इसलिए एक गुप्त पथ को सूचीबद्ध करना इसका विज्ञापन करता है। कुछ भी वास्तव में निजी जरूरतों को प्रमाणीकरण या noindex टैग, इस फाइल में एक पंक्ति नहीं। इसका उपयोग रेंगने वालों को एडमिन पथ, खोज परिणाम पृष्ठों और डुप्लिकेट पैरामीटर यूआरएल से दूर रखने के लिए करें, और उन्हें अपने sitemap पर इंगित करने के लिए करें।

अक्सर पूछे जाने वाले प्रश्न

मैं कहाँ रोबोट.txt फ़ाइल डाल सकते हैं?
अपने डोमेन की जड़ पर, इसलिए यह आपकी साइट.कॉम/robots.txt पर पहुंच योग्य है। क्रॉलर कहीं और नहीं देखते हैं।
क्या रोबोट.txt एक पृष्ठ को अनुक्रमित किया जा रहा है?
नहीं, यह क्रॉलिंग को रोकती है, लेकिन एक अवरुद्ध यूआरएल अभी भी सूचीबद्ध किया जा सकता है यदि अन्य साइटें इसके लिए लिंक करती हैं। इंडेक्स से बाहर पृष्ठ रखने के लिए एक नोड इंडेक्स टैग का उपयोग करें।
क्या मुझे अपने sitemap को रोबोट.txt में सूचीबद्ध करना चाहिए?
हाँ, यह आपके साइटमैप पर हर क्रॉलर को इंगित करने का मानक तरीका है, यह प्रत्येक व्यक्ति को व्यक्तिगत रूप से जमा किए बिना।

संबंधित उपकरण