मुख्य साइट रीडायरेक्ट चेकर
पक्का करें कि आपकी साइट के पेज के सभी मुमकिन टेक्निकल डुप्लीकेट सर्च इंजन को पेज के मेन वर्शन पर रीडायरेक्ट करें (या कम से कम मौजूद न हों)।
डुप्लीकेट पेज क्यों बंद कर देने चाहिए
किसी वेबसाइट पर डुप्लीकेट पेज होने से प्राइमरी वर्शन सर्च रिज़ल्ट में नहीं दिखेगा, और उसकी जगह, बिना जोड़ी गई कॉपी दिखेगी। इसका मतलब है कि ज़रूरी SEO मेट्रिक्स (जैसे एक्सटर्नल लिंक और बिहेवियरल फैक्टर) इन दो वर्शन के बीच अलग हो जाते हैं, और इससे स्टैटिस्टिकल गलतियाँ भी हो सकती हैं।
यह टूल क्या करता है
सबसे पहले, टूल आपके डाले गए वेबसाइट एड्रेस की अवेलेबिलिटी चेक करता है, फिर मेन पेज के सभी साइट मिरर और पोटेंशियल डुप्लीकेट को चेक करता है। हम मेन पेज के बेस HTML को भी पार्स करते हैं, इंटरनल साइट पेज (पहले और दूसरे लेवल की नेस्टिंग) के लिंक ढूंढते हैं, और उनके टेक्निकल डुप्लीकेट की अवेलेबिलिटी चेक करते हैं।
किस तरह के टेक्निकल डुप्लीकेट चेक किए जाते हैं
हम वेबसाइट संगठन की विभिन्न तकनीकी विशेषताओं के कारण बनने वाले तकनीकी डुप्लिकेट पेजों का पता लगाते हैं:
- www के साथ / बिना www के वेबसाइट मिरर
- http के साथ / https के साथ वेबसाइट मिरर
- ट्रेलिंग स्लैश के साथ / बिना ट्रेलिंग स्लैश के पेज
- डायरेक्टरी इंडेक्स फाइलें (जैसे index.html)
- यूआरएल में लोअरकेस के बजाय अपरकेस अक्षर
- सर्वर के आईपी पते पर सीधी पहुंच
- वेबसाइट रूटिंग त्रुटियां (कोई 404 प्रतिक्रिया नहीं)
- यूआरएल में स्लग्स के क्रम को बदलना
- एचटीएमएल प्रारूप को किसी अन्य प्रारूप में बदलना
User-Agent कब बदलें
कभी-कभी, किसी वेबसाइट को एनालाइज़ करने की कोशिश करते समय, हमारे बॉट्स को आपकी साइट होस्ट करने वाले सर्वर या CloudFlare जैसी एंटी-स्क्रैपिंग सर्विस ब्लॉक कर सकती हैं। ब्लॉकिंग से बचने के लिए, आप टूल में ज़रूरी User-Agent (बॉट का नाम) वैल्यू सेट कर सकते हैं और उसके लिए एक ब्लॉकिंग एक्सेप्शन कॉन्फ़िगर कर सकते हैं।
यदि जाँच के दौरान त्रुटियाँ होती हैं
टूल के संचालन में त्रुटि का कारण समझने के लिए, इस तालिका का उपयोग करें:
| त्रुटि | संभावित कारण | हल कैसे करें |
|---|---|---|
| अमान्य वेबसाइट पता | दर्ज किए गए वेबसाइट पते के लिए सर्वर प्रतिक्रिया कोड 200 नहीं है। | वेबसाइट को ब्राउज़र में खोलें, उसके रेंडर होने की प्रतीक्षा करें, फिर ब्राउज़र के एड्रेस बार से URL कॉपी करें और इसे सेवा के "मुख्य वेबसाइट पता" फ़ील्ड में पेस्ट करें। |
| सर्वर प्रतिक्रिया कोड प्राप्त नहीं हुआ | या तो सर्वर बहुत धीमी गति से अनुरोधों का जवाब दे रहा है, या वेबसाइट पर स्क्रैपिंग ब्लॉकिंग कॉन्फ़िगर की गई है। | स्क्रैपिंग ब्लॉक हटाने के लिए वेबसाइट डेवलपर्स से संपर्क करें या अधिक शक्तिशाली होस्टिंग पर माइग्रेट करें (सर्च बॉट्स भी आपकी साइट को पार्स नहीं कर पाएंगे)। |
| आंतरिक पेजों की जाँच नहीं हो रही है | मुख्य पेज के HTML में आंतरिक पेजों के लिंक गायब हैं। | यदि आपकी साइट JS पर चलती है, तो हम HTML प्री-रेंडरिंग सेट अप करने की सलाह देते हैं। तथ्य यह है कि न केवल हम, बल्कि Yandex भी आंतरिक लिंक्स नहीं देख सकता है। |
अक्सर पूछे जाने वाले प्रश्न
हां, हम यह सत्यापित नहीं करते कि आप वेबसाइट मालिक हैं या नहीं। यह सेवा उपयोगकर्ताओं के काम को सरल बनाने के लिए किया गया है।
हालांकि, आपको हमारे टूल के माध्यम से किसी प्रतियोगी के सर्वर पर अत्यधिक लोड बनाने का प्रयास नहीं करना चाहिए, क्योंकि यह जांच के दौरान वेबसाइट पर बनने वाले लोड का सावधानीपूर्वक प्रबंधन करता है।
रीडायरेक्ट्स की श्रृंखला मिलने पर, टूल सर्च इंजन रोबोट्स के तर्क का पालन करता है: यह श्रृंखला में केवल पहले 5 रीडायरेक्ट्स का ही पालन करता है।
मुख्य वेबसाइट मिरर और टूल द्वारा खोजे गए पेज डुप्लिकेट से 301 रीडायरेक्ट्स सेट अप करें। साथ ही, गैर-मौजूद पेजों के लिए 404 सर्वर प्रतिक्रिया सही ढंग से कॉन्फ़िगर करें; हमारी सेवा गैर-मौजूद पेजों की जांच के लिए /4815162341/ और /a1b2c3d4/ पर समाप्त होने वाले टेस्ट URL का उपयोग करती है।
हाँ, tool rel=canonical टैग और हेडर की सामग्री को ध्यान में रखता है। लेकिन चूंकि खोज इंजन के लिए यह केवल एक सिफारिश है, न कि सख्त निर्देश (जैसे 301 रीडायरेक्ट या 404 सर्वर प्रतिक्रिया), यह rel=canonical के माध्यम से बंद तकनीकी डुप्लिकेट को चेतावनी के रूप में दिखाता है (उन्हें मैन्युअल रूप से जाँचना बेहतर है)।
मैंने रीडायरेक्ट चेकिंग टूल का पहला बिल्ड अपने लिए बनाया, ताकि मुझे किसी ऐसी चीज़ पर समय बर्बाद न करना पड़े जो ऑटोमेटेड हो सकती है और दो क्लिक में हो सकती है। समय के साथ, हमारी टीम ने टूल को इतना पावरफुल बना दिया है कि अब इसके फंक्शन को मैनुअली कॉपी करना लगभग नामुमकिन है।