XML Sitemap विश्लेषक

XML sitemap को पार्स, सत्यापित और विश्लेषित करें। त्रुटियाँ, प्राथमिकताएँ, परिवर्तन आवृत्तियाँ, URL संरचना और इमेज/वीडियो/न्यूज़ की संख्या पहचानें।

अपडेट किया गया

Share:
Home/SEO Tools/XML Sitemap Analyzer

XML Sitemap Analyzer

Parse, validate, and inspect XML sitemaps. Detect errors, analyze URL structure, priorities, change frequencies, and more.

Sitemap Input

Drag & drop a sitemap.xml file here, or

अक्सर पूछे जाने वाले प्रश्न

यह क्या करता है?

यह XML sitemaps को पार्स और सत्यापित करता है — त्रुटियों की जाँच करता है और URL संरचना, प्राथमिकताओं, परिवर्तन आवृत्तियों, छवि/वीडियो गणना तथा lastmod तिथियों की रिपोर्ट देता है।

क्या यह निजी है?

हाँ — सारी पार्सिंग नेटिव DOMParser के ज़रिए क्लाइंट-साइड होती है। आपके sitemap का डेटा कभी आपके डिवाइस से बाहर नहीं जाता।

कौन-से फ़ॉर्मेट समर्थित हैं?

मानक URL sitemaps (urlset), sitemap इंडेक्स (sitemapindex) और छवि, वीडियो तथा समाचार namespaces वाले विस्तारित sitemaps।

क्या XML Sitemap Analyzer इस्तेमाल करना मुफ़्त है?

हाँ, XML Sitemap Analyzer 100% मुफ़्त है, बिना किसी पंजीकरण, छिपे शुल्क या उपयोग सीमा के। सारी प्रोसेसिंग आपके ब्राउज़र में स्थानीय रूप से होती है, जिससे पूरी निजता सुनिश्चित रहती है।

क्या इस टूल के साथ मेरा डेटा सुरक्षित है?

बिल्कुल। XML Sitemap Analyzer सब कुछ आपके ब्राउज़र में क्लाइंट-साइड प्रोसेस करता है। कोई भी डेटा किसी सर्वर पर अपलोड या संग्रहीत नहीं होता। आपकी सामग्री हमेशा आपके डिवाइस पर निजी रहती है।

क्या XML Sitemap Analyzer मोबाइल डिवाइस पर काम करता है?

हाँ, XML Sitemap Analyzer पूरी तरह रिस्पॉन्सिव है और स्मार्टफ़ोन तथा टैबलेट पर काम करता है। आप इसे किसी भी आधुनिक वेब ब्राउज़र वाले डिवाइस पर इस्तेमाल कर सकते हैं, किसी ऐप डाउनलोड की ज़रूरत नहीं।

क्या इस टूल का उपयोग करने के लिए मुझे खाता बनाना होगा?

किसी खाते या पंजीकरण की ज़रूरत नहीं है। बस अपने ब्राउज़र में XML Sitemap Analyzer खोलें और तुरंत इस्तेमाल शुरू करें। कोई साइन-अप दीवार या उपयोग प्रतिबंध नहीं है।

क्या यह टूल Google के नवीनतम दिशानिर्देशों का पालन करता है?

हाँ, XML Sitemap Analyzer को मौजूदा Google Search दिशानिर्देशों और सर्वोत्तम प्रथाओं के अनुसार बनाया गया है। हम सर्च इंजन की आवश्यकताओं में बदलावों को दर्शाने के लिए टूल को नियमित रूप से अपडेट करते हैं।

मैं XML Sitemap Analyzer का उपयोग कैसे करूँ?

बस दिए गए फ़ील्ड में अपनी जानकारी दर्ज करें, सेटिंग्स को अपनी पसंद के अनुसार समायोजित करें, और टूल उसे तुरंत प्रोसेस कर देगा। फिर आप परिणाम को क्लिपबोर्ड पर कॉपी कर सकते हैं या डाउनलोड कर सकते हैं।

कौन-से ब्राउज़र समर्थित हैं?

XML Sitemap Analyzer सभी आधुनिक ब्राउज़रों में काम करता है, जिनमें Chrome, Firefox, Safari, Edge और Opera शामिल हैं। बेहतरीन अनुभव के लिए अपने पसंदीदा ब्राउज़र के नवीनतम संस्करण का उपयोग करें।

एक XML साइटमैप में अधिकतम कितने URL हो सकते हैं?

sitemaps.org प्रोटोकॉल एक साइटमैप फ़ाइल को 50,000 URL और 50 MB अनकम्प्रेस्ड (gzip से पहले) तक सीमित करता है। अगर आपकी साइट पर इससे ज़्यादा URL हैं, तो आप उन्हें कई साइटमैप फ़ाइलों में बाँटते हैं और उन सभी को एक पेरेंट साइटमैप इंडेक्स से रेफर करते हैं, जो खुद 50,000 साइटमैप तक लिस्ट कर सकता है। प्रति-फ़ाइल लिमिट पार करना एक आम वजह है जिससे सर्च इंजन बीच में ही एंट्रीज़ पढ़ना बंद कर देते हैं। यह एनालाइज़र आपकी फ़ाइल में हर <url> को गिनता है और जैसे ही यह 50,000 पार करता है, एक एरर फ्लैग कर देता है, ताकि सबमिट करने से पहले ही आपको पता चल जाए कि इसे बाँटना है। यह sitemap-index फ़ाइलों को भी अपने आप पहचान लेता है और हर चाइल्ड साइटमैप को सूचीबद्ध करता है ताकि आप उन्हें एक-एक करके जाँच सकें। ऊपर अपना XML पेस्ट करें और तुरंत देखें कि आप लिमिट के भीतर हैं या नहीं, साथ ही कुल URL संख्या भी देखें।

क्या priority और changefreq टैग वाकई Google रैंकिंग को प्रभावित करते हैं?

नहीं। Google ने सार्वजनिक रूप से कहा है कि वह साइटमैप में <priority> और <changefreq> वैल्यू को काफी हद तक नज़रअंदाज़ करता है, इसलिए हर पेज को priority 1.0 सेट करने से रैंकिंग या क्रॉल ऑर्डर में कोई फायदा नहीं होगा। ये टैग शुरुआती साइटमैप प्रोटोकॉल में संकेत के तौर पर शामिल थे, लेकिन सर्च इंजन अब यह तय करने के लिए अपने खुद के सिग्नल्स पर निर्भर करते हैं कि क्या और कितनी बार क्रॉल करना है। फिर भी, इन वैल्यू का मान्य होना ज़रूरी है: priority 0.0 से 1.0 के बीच होनी चाहिए, और changefreq always, hourly, daily, weekly, monthly, yearly, या never में से एक होनी चाहिए। रेंज से बाहर या गलत-वर्तनी वाली वैल्यू को एरर के तौर पर फ्लैग किया जाता है क्योंकि वे किसी जनरेशन बग का संकेत देती हैं जिसे ठीक करना ज़रूरी है। यह टूल दोनों फ़ील्ड को वैलिडेट करता है और यह भी चार्ट करता है कि आपकी priority और frequency फ़ाइल में कैसे बँटी हुई हैं, इसलिए असंगत या अमान्य टैग पकड़ने के लिए अपना साइटमैप पेस्ट करें।

साइटमैप में सटीक lastmod तारीख क्यों मायने रखती है?

<lastmod> तारीख सर्च इंजनों को बताती है कि कोई पेज असल में आखिरी बार कब बदला था, और priority व changefreq के उलट, Google इसका इस्तेमाल रीक्रॉल शेड्यूल करने में मदद के लिए वाकई करता है। अगर आपकी तारीखें सटीक हैं, तो क्रॉलर हाल ही में अपडेट हुए पेजों को प्राथमिकता दे सकता है और उन पेजों को छोड़ सकता है जो नहीं बदले, जिससे आपका क्रॉल बजट ज़्यादा कुशलता से इस्तेमाल होता है। पेच यह है कि यह भरोसे पर टिका है: अगर हर बिल्ड में हर URL पर आज की तारीख दिखती है, या तारीखें सिरे से गायब हैं, तो सर्च इंजन इस फ़ील्ड को नज़रअंदाज़ करना सीख जाते हैं। यह एनालाइज़र आपके URL सेट में सबसे पुरानी, सबसे नई, और मीडियन lastmod तारीखें रिपोर्ट करता है ताकि आप ऐसे साइटमैप को पहचान सकें जो पुराना पड़ चुका है या जिसमें हर तारीख संदेहास्पद रूप से एक जैसी है। इसे जल्दी पकड़ना आपके फ्रेशनेस सिग्नल्स को विश्वसनीय बनाए रखता है। पूरी lastmod तारीख रेंज एक नज़र में देखने के लिए ऊपर अपना XML पेस्ट करें।

जब साइटमैप non-HTTPS या http:// URL फ्लैग करता है, तो इसका क्या मतलब है?

non-HTTPS वॉर्निंग का मतलब है कि एक या ज़्यादा <loc> एंट्रीज़ https:// की बजाय असुरक्षित http:// एड्रेस पर पॉइंट कर रही हैं। चूँकि HTTPS एक बुनियादी अपेक्षा है और एक हल्का रैंकिंग सिग्नल भी, आपके साइटमैप में हर URL का केवल सुरक्षित, कैनोनिकल वर्शन ही होना चाहिए। http:// लिंक का मिल जाना आमतौर पर किसी जनरेशन बग या माइग्रेशन-पूर्व टेम्पलेट के बचे हुए हिस्से का संकेत है, और यह क्रॉलर को ऐसे URL पर भेज सकता है जो रीडायरेक्ट होते हैं या उस वर्शन से अलग हैं जिसे आप वाकई इंडेक्स कराना चाहते हैं। यह टूल हर लोकेशन को स्कैन करता है और सभी non-HTTPS URL को गिनती सहित एक ही वॉर्निंग में ग्रुप कर देता है, ताकि "5 non-HTTPS URLs" जैसी एक साफ लाइन बने, न कि पाँच अलग-अलग नोटिस। इन्हें ठीक करना सुनिश्चित करता है कि सर्च इंजन सीधे आपके सुरक्षित पेजों को इंडेक्स करें। कोई असुरक्षित URL तो नहीं घुस आया, यह जाँचने के लिए ऊपर अपना साइटमैप पेस्ट करें।

क्या क्वेरी पैरामीटर वाले URL को XML साइटमैप में शामिल करना चाहिए?

आमतौर पर नहीं। क्वेरी स्ट्रिंग वाले URL — जैसे ?sort=, ?ref=, या सेशन ID — अक्सर किसी कैनोनिकल पेज के डुप्लिकेट या मिलते-जुलते वर्शन की ओर इशारा करते हैं, और इन्हें लिस्ट करने से इंडेक्सिंग सिग्नल बिखर सकते हैं और क्रॉल बजट बर्बाद हो सकता है। नियम के तौर पर, साइटमैप में केवल साफ, कैनोनिकल, इंडेक्स-योग्य URL होने चाहिए जिन्हें आप वाकई सर्च रिजल्ट में चाहते हैं। यह एनालाइज़र क्वेरी पैरामीटर वाले हर URL को सीधे एरर के बजाय एक इन्फॉर्मेशनल नोटिस के रूप में फ्लैग करता है, क्योंकि पैरामीटर हमेशा गलत नहीं होते, लेकिन उनकी समीक्षा ज़रूर ज़रूरी है। इन्हें एक साथ ग्रुप किया हुआ देखना यह तय करना आसान बना देता है कि हर एक को रखना है या उसके पैरामीटर-रहित वर्शन के पक्ष में हटाना है। यह उसी पास में डुप्लिकेट लोकेशन और गलत-फॉर्मेट URL को भी फ्लैग करता है। Search Console में सबमिट करने से पहले पैरामीटर-युक्त और डुप्लिकेट एंट्रीज़ सामने लाने के लिए ऊपर अपना XML पेस्ट करें।

संबंधित टूल

मुफ़्त SEO मेटा टैग जनरेटर

अपनी वेबसाइट के लिए SEO-अनुकूल मेटा टैग बनाएँ। शीर्षक, विवरण, कीवर्ड और बहुत कुछ। मुफ़्त, तेज़ और पूरी तरह आपके ब्राउज़र में काम करता है, बिना साइन-अप के।

मुफ़्त Open Graph टैग जनरेटर

सोशल मीडिया शेयरिंग के लिए Open Graph और Twitter Card मेटा टैग बनाएँ। मुफ़्त, तेज़ और पूरी तरह आपके ब्राउज़र में काम करता है, बिना साइन-अप के।

मुफ़्त Robots.txt जनरेटर

सर्च इंजन क्रॉलिंग को नियंत्रित करने के लिए robots.txt फ़ाइल बनाएँ। मुफ़्त, तेज़ और पूरी तरह आपके ब्राउज़र में काम करता है, बिना साइन-अप के।

मुफ़्त कीवर्ड डेंसिटी चेकर

SEO ऑप्टिमाइज़ेशन के लिए अपने कंटेंट में कीवर्ड डेंसिटी और फ़्रीक्वेंसी का विश्लेषण करें। मुफ़्त, तेज़ और पूरी तरह आपके ब्राउज़र में काम करता है, बिना साइन-अप के।

XML साइटमैप एनालाइज़र के बारे में

XML साइटमैप एनालाइज़र आपके XML साइटमैप को पार्स, वैलिडेट और ब्रेकडाउन करता है ताकि आप ठीक-ठीक देख सकें कि आप सर्च इंजनों को क्रॉल करने के लिए क्या दे रहे हैं। रॉ XML पेस्ट करें, sitemap.xml फ़ाइल को ड्रैग-इन करें, या बिल्ट-इन सैंपल लोड करें — टूल हर <url> एंट्री को पढ़ता है, यानी उसकी लोकेशन, लास्ट-मॉडिफाइड डेट, चेंज फ्रीक्वेंसी, प्रायोरिटी, और कोई भी इमेज, वीडियो या न्यूज़ एनोटेशन — फिर इसे पढ़ने-योग्य आँकड़ों और वैलिडेशन इश्यू की सूची में बदल देता है। यह उन SEO प्रोफेशनल्स, डेवलपर्स और साइट ओनर्स के लिए बनाया गया है जो Google Search Console या Bing Webmaster Tools में साइटमैप सबमिट करने से पहले उसे तुरंत जाँचना चाहते हैं।

सब कुछ आपके ब्राउज़र में ही होता है। यह एनालाइज़र XML को पढ़ने के लिए नेटिव DOMParser का इस्तेमाल करता है, यानी सारा प्रोसेसिंग आपकी अपनी डिवाइस पर होती है, इसलिए साइटमैप कभी किसी सर्वर पर अपलोड नहीं होता। न कोई साइन-अप, न कोई यूसेज कैप, और कुछ भी स्टोर नहीं होता — यह तब बेहद काम आता है जब आप किसी स्टेजिंग या प्री-लॉन्च साइटमैप की जाँच कर रहे हों जो अभी पब्लिक नहीं है।

एनालाइज़र क्या-क्या जाँचता और रिपोर्ट करता है

यह टूल दोनों स्टैंडर्ड साइटमैप फॉर्मेट पहचानता है। सामान्य <urlset> के लिए यह हर URL की जाँच करता है; वहीं <sitemapindex> के लिए यह हर चाइल्ड साइटमैप और उसकी लास्ट-मॉडिफाइड डेट को सूचीबद्ध करता है ताकि आप उन्हें एक-एक करके अलग से एनालाइज़ कर सकें। यह Google के इमेज, वीडियो और न्यूज़ एक्सटेंशन नेमस्पेस को भी समझता है और फ़ाइल में इनमें से हर एक की संख्या गिनता है।

वैलिडेशन के मामले में यह इश्यू को गंभीरता के हिसाब से फ्लैग करता है:

  • एरर — किसी <url> में <loc> का गायब होना, गलत-फॉर्मेट वाले URL, डुप्लिकेट लोकेशन, रेंज से बाहर <priority> वैल्यू, अमान्य <changefreq> वैल्यू, या 50,000-URL लिमिट पार करने वाली फ़ाइल।
  • वॉर्निंग — HTTPS की बजाय प्लेन http:// पर सर्व हो रहे URL।
  • इन्फो — क्वेरी-स्ट्रिंग पैरामीटर वाले URL, जो अक्सर डुप्लिकेट या मिलती-जुलती कंटेंट का संकेत देते हैं और जिनकी समीक्षा ज़रूरी है।

हर इश्यू को गिनती के साथ ग्रुप किया जाता है, ताकि "3 non-HTTPS URLs" जैसी एक लाइन बने, न कि तीन अलग-अलग नोटिस।

यह किस तरह के आँकड़े देता है

पास/फेल वैलिडेशन के अलावा, यह एनालाइज़र आपके URL सेट की पूरी संरचना का सार भी देता है। यह कुल URL संख्या, यूनीक डोमेन की संख्या, औसत <priority> वैल्यू, और सबसे पुरानी, सबसे नई, तथा मीडियन <lastmod> तारीखें रिपोर्ट करता है, ताकि आप ऐसे साइटमैप को पहचान सकें जो पुराना पड़ चुका है। इसके बाद यह चेंज फ्रीक्वेंसी, पाथ डेप्थ, फ़ाइल एक्सटेंशन और प्रायोरिटी बकेट के लिए डिस्ट्रिब्यूशन चार्ट बनाता है, साथ ही प्रति-डोमेन ब्रेकडाउन भी देता है — इससे आप तुरंत पहचान सकते हैं कि कोई सेक्शन बहुत गहराई में दबा हुआ है या कोई होस्ट वहाँ नहीं होना चाहिए। आप URL टेबल को फ़िल्टर और सॉर्ट कर सकते हैं (यह पहली 100 एंट्रीज़ दिखाती है), प्लेन-टेक्स्ट सारांश कॉपी कर सकते हैं, या पूरा पार्स किया हुआ डेटा CSV के रूप में डाउनलोड कर सकते हैं, जिसमें स्प्रेडशीट एनालिसिस के लिए डेप्थ, डोमेन और एक्सटेंशन कॉलम भी जोड़े जाते हैं।

साफ-सुथरा साइटमैप क्यों मायने रखता है

साइटमैप एक डिस्कवरी सहायक है: यह सर्च इंजनों को बताता है कि आप किन URL को क्रॉल करने लायक मानते हैं और वे आखिरी बार कब बदले थे। आधिकारिक प्रोटोकॉल एक फ़ाइल को 50,000 URL और 50 MB अनकम्प्रेस्ड तक सीमित करता है; बड़ी साइटें कई साइटमैप में बंटती हैं जिन्हें एक साइटमैप इंडेक्स से रेफर किया जाता है। Google ने पुष्टि की है कि वह <priority> और <changefreq> को रैंकिंग सिग्नल के तौर पर काफी हद तक नज़रअंदाज़ करता है, लेकिन सटीक <lastmod> तारीखें अब भी उसे रीक्रॉल शेड्यूल करने में मदद करती हैं — इसीलिए पुरानी या असंगत तारीखों की रेंज को जल्द पकड़ना ज़रूरी है।

इस टूल से पकड़ में आने वाली आम समस्याएँ वही हैं जो चुपचाप क्रॉल बजट बर्बाद करती हैं या URL को ड्रॉप करा देती हैं: डुप्लिकेट एंट्रीज़, नॉन-कैनोनिकल http:// लिंक, गलत-फॉर्मेट लोकेशन, और पैरामीटर से भरे URL जो इंडेक्सिंग को बिखेर देते हैं। साइटमैप को सबमिट करने से पहले एनालाइज़र से गुज़ारने का मतलब है कि आप इन समस्याओं को अपनी शर्तों पर ठीक करते हैं, न कि कई दिन बाद Search Console में वॉर्निंग के रूप में देखने के बाद। ऊपर अपना XML पेस्ट करें, उसे वैलिडेट करें और तुरंत पूरा ब्रेकडाउन देखें।