XML साइटमैप जनरेटर
अपने पते जैसे भी हों — स्प्रेडशीट से, कंसोल से — पेस्ट कर दीजिए और ऐसी फ़ाइल पाइए जिसे सर्च इंजन स्वीकार करें। दोहराव और अनजान पंक्तियाँ चुपचाप नहीं हटतीं, उनकी गिनती बताई जाती है।
Google lastmod पढ़ता है और changefreq व priority को अनदेखा करता है — ये अन्य क्रॉलर के लिए हैं।
निष्कर्ष
- मुफ़्त
- फ़ाइलें आपके डिवाइस से बाहर नहीं जातीं
- बिना रजिस्ट्रेशन
- फ़ाइलों की कोई सीमा नहीं
कैसे इस्तेमाल करें
- पतों की सूची प्रति पंक्ति एक करके पेस्ट करें; साइट का पता भर देने पर सापेक्ष पथ भी चलते हैं।
- बदलाव की तारीख हो तो डालें — Google यही फ़ील्ड पढ़ता है।
- XML कॉपी करें या sitemap.xml डाउनलोड करके साइट की जड़ में अपलोड करें।
- मौजूदा फ़ाइल जाँचनी हो तो «जाँचें» पर जाकर उसे पेस्ट करें।
जानने योग्य बातें
वह एम्परसैंड जो पूरी फ़ाइल तोड़ देता है
पैरामीटर वाला पता — /?a=1&b=2 — आम बात है, पर XML में एम्परसैंड को & लिखना अनिवार्य है। वरना पार्सर पहली ऐसी पंक्ति पर ही रुक जाता है और सिर्फ़ उस प्रविष्टि को नहीं, पूरी फ़ाइल को अस्वीकार कर देता है। यह टूल हर लिखे जाने वाले पते को एस्केप करता है, इसलिए क्वेरी स्ट्रिंग की वजह से साइटमैप कभी नहीं जाती।
Google असल में क्या पढ़ता है
चार फ़ील्ड में से केवल lastmod काम आता है, और वह भी तभी जब ईमानदार हो: हर डिप्लॉय पर बदलने वाली तारीख क्रॉलर को उसे अनदेखा करना सिखा देती है। changefreq और priority को Google वर्षों से नहीं देखता; ये यहाँ इसलिए हैं कि दूसरे क्रॉलर और कुछ आंतरिक टूल अब भी इन्हें पढ़ते हैं — पर खोज में इनसे कुछ बदलने की उम्मीद न रखें।
अक्सर पूछे जाने वाले सवाल
एक फ़ाइल में कितने पते आ सकते हैं?
पचास हज़ार, और बिना कंप्रेशन पचास मेगाबाइट से ज़्यादा नहीं। उससे आगे सूची कई फ़ाइलों में बाँटकर उन्हें साइटमैप इंडेक्स में गिनाया जाता है। पेस्ट की गई फ़ाइल सीमा पार करे तो जाँच में यह बताया जाता है।
साइटमैप में कौन-से पेज नहीं होने चाहिए?
वह सब जो आप खोज नतीजे के रूप में नहीं चाहते: robots.txt या noindex से बंद पेज, ऐसे डुप्लिकेट जिनका canonical कहीं और है, रीडायरेक्ट और त्रुटि पेज। ऐसे पतों से भरी साइटमैप पूरी फ़ाइल का भरोसा घटा देती है।
तैयार फ़ाइल कहाँ रखूँ?
साइट की जड़ में, robots.txt के बग़ल में, और robots.txt में «Sitemap: https://example.com/sitemap.xml» पंक्ति जोड़ दें। उसके बाद Search Console में भेजना वैकल्पिक है, पर उससे पहला क्रॉल जल्दी होता है।
क्या इस टूल से अपनी साइट क्रॉल कर सकते हैं?
नहीं, और कोई भी ब्राउज़र टूल ईमानदारी से यह नहीं कर सकता — सुरक्षा कारणों से स्क्रिप्ट दूसरे डोमेन का पेज नहीं पढ़ सकती। यहाँ फ़ाइल आपकी दी हुई सूची से बनती है; वह सूची आपके CMS, आपके बिल्ड या किसी डेस्कटॉप क्रॉलर से आती है।
संबंधित टूल
- robots.txt जनरेटर और टेस्टर एक ही पेज पर दो काम: नियमों से फ़ाइल बनाना, और जो फ़ाइल पहले से है उसे जाँचना। जवाब सिर्फ़ «अनु…
- स्कीमा मार्कअप जनरेटर प्रकार चुनिए, जो पता है वह भरिए, और पेज के head में लगाने लायक़ तैयार script टैग कॉपी कर लीजिए।…
- UTM लिंक बिल्डर फ़ील्ड भरिए और लिंक अपने आप बन जाएगा। पहले से टैग वाला लिंक पेस्ट करें तो फ़ील्ड उसी से भर जाते…
- XML फ़ॉर्मैटर मशीन का बनाया XML अक्सर एक विशाल पंक्ति होता है। उसे यहाँ चिपकाइए और संरचना उभर आएगी: हर तत्व अ…