अक्सर पूछे जाने वाले प्रश्न

रेटिंग कैसे काम करती है, इसमें क्या शामिल है, और डेटा का लाइसेंस कैसा है, इस सबके बारे में।

रेटिंग

रेटिंग क्या है?

0 से 100 तक की एक संख्या, जो बताती है कि हमें ज्ञात बाक़ी सभी डोमेन के मुक़ाबले कोई डोमेन कितनी अच्छी तरह लिंक किया गया है। जिस साइट से कुछ भी लिंक नहीं करता वह 0 के पास रहती है। जिन गिनी-चुनी साइटों से लगभग सब कुछ लिंक करता है वे 100 के पास रहती हैं। ज़्यादातर असली, चलती-फिरती साइटें 10 से 40 के बीच रहती हैं, और काम की तुलनाएँ भी वहीं होती हैं।

यह सिर्फ़ एक चीज़ नापती है: किसी डोमेन की ओर आने वाले लिंक। यह गुणवत्ता का अंक नहीं है, ट्रैफ़िक का अनुमान नहीं है, और यह अटकल भी नहीं कि कोई सर्च इंजन आपके साथ कैसा बर्ताव करेगा।

इसकी गणना कैसे होती है?

यह 0 से 100 तक की एक स्वतंत्र लघुगणकीय रेटिंग है, जो लिंक करने वाले अद्वितीय डोमेन की संख्या और अधिकारिता पर आधारित है, हमारे अपने वेब-स्तरीय लिंक सूचकांक से गणना की जाती है और हर महीने ताज़ा की जाती है।

तरीक़ा यह है। हम उन साइटों की एक छोटी सूची से शुरू करते हैं जिनके बारे में हमें पक्का पता है कि वे वही हैं जो होने का दावा करती हैं: राष्ट्रीय प्रसारक, विश्वविद्यालय, सरकारें, मानक संस्थाएँ, और पुराने भरोसेमंद संदर्भ ग्रंथ। हर एक को एक शुरुआती अंक मिलता है। फिर वह अंक दौर-दर-दौर पूरे वेब में आगे बढ़ाया जाता है। जिस डोमेन से कोई अंक वाला डोमेन लिंक करता है, वह उस डोमेन के अंक का एक हिस्सा लेता है, और फिर जो अब उसके पास है उसका एक हिस्सा उन डोमेन को देता है जिनसे वह लिंक करता है। यह दौर तब तक चलते हैं जब तक संख्याएँ ठहर न जाएँ। वहीं रुकने से नतीजा किसी एक साइट के आसपास के चंद क़दमों का नहीं, बल्कि पूरे वेब का तथ्य बन जाता है।

पूरे रास्ते हम पन्ने नहीं, अलग-अलग डोमेन गिनते हैं। जो साइट दस हज़ार पन्नों से आपको लिंक करती है वह एक ही बार गिनी जाती है, और उस लिंक का मोल इस पर है कि देने वाले डोमेन के पास उस समय कितना है। बहुत लिंक पाए डोमेन से आया एक लिंक, ऐसे सौ लिंकों से ज़्यादा असर डालता है जो उन डोमेन से आते हैं जिनकी ओर कोई इशारा नहीं करता।

इससे हर डोमेन के लिए एक अंक निकलता है, बहुत बड़े दायरे में। हम रिलीज़ के सभी डोमेन को उसी अंक से क्रम में लगाते हैं, और उस क्रम में उसका स्थान ही वह है जिसे हम 0 से 100 के पैमाने पर रखते हैं। यही वह संख्या है जो आप देखते हैं।

ऊँची रेटिंग नकली बनाना क्यों मुश्किल है। अंक सिर्फ़ हाथ से चुनी गई साइटों से ही भीतर आता है। इसलिए अच्छा अंक पाने का एकमात्र रास्ता यह है कि आप उन साइटों से, थोड़े ही क़दमों में, पहुँच में हों जिन पर शुरू से भरोसा था। ख़ुद से ख़ुद को लिंक करने से कुछ नहीं मिलता, क्योंकि लिंक अंक बनाता नहीं, सिर्फ़ आगे बढ़ाता है। एक-दूसरे से लिंक करने के लिए बनाए गए हज़ार डोमेन उसी को आपस में बाँटते हैं जो बाहर से उन तक पहुँचा, और अगर कुछ पहुँचा ही नहीं तो बाँटने को भी कुछ नहीं। जिन डोमेन तक वह शुरुआती सूची पहुँच ही नहीं सकती, उनसे लिंक ख़रीदना शून्य का हिस्सा ख़रीदना है।

AI के वेब को बड़ा करते जाने पर भी यह क्यों टिकता है। आज एक साइट, या दस हज़ार साइटें बनाना लगभग मुफ़्त है, और वेब पर सामग्री की मात्रा अब ज़्यादा कुछ नहीं बताती। महँगा आज भी वही है: किसी राष्ट्रीय अख़बार, विश्वविद्यालय विभाग या मानक संस्था से आया लिंक, क्योंकि उन्हें वे लोग देते हैं जिनके पास खोने को कुछ है। हम वेब के उसी छोर से नापते हैं, इसलिए नए डोमेन की बाढ़ पुराने डोमेन को शायद ही हिलाती है: नए आने वाले नीचे बैठते हैं और तब तक वहीं रहते हैं जब तक कोई वज़नदार उनकी ओर इशारा न करे।

व्यवहार में “लघुगणकीय” का क्या अर्थ है?

कि पैमाने पर बराबर क़दम का मतलब जोड़ना नहीं, गुणा करना है। 20 से 30 तक जाने में शायद कुछ और लिंक करने वाले डोमेन काफ़ी हों। 70 से 80 तक जाने में कई गुना चाहिए। 90 और 100 के बीच का फ़ासला 0 से 50 तक के पूरे फ़ासले से बड़ा है।

इसलिए इसे प्रतिशत नहीं, क्रम की तरह पढ़िए। किसी सूची का औसत निकालने के बजाय डोमेन की आपस में तुलना कीजिए, और याद रखिए कि ऊपर के पाँच अंक नीचे के पाँच अंकों से कहीं ज़्यादा भारी हैं।

लिंक करने वाला डोमेन किसे गिना जाता है?

एक पूरा डोमेन नाम, उसके मुख्य हिस्से तक छाँटा हुआ। blog.example.com और shop.example.com से आए लिंक एक ही लिंक करने वाला डोमेन हैं, यानी example.com। एक से ज़्यादा हिस्सों वाले अंत ठीक से सँभाले जाते हैं, इसलिए bbc.co.uk एक पूरा डोमेन है, co.uk का टुकड़ा नहीं।

अच्छी रेटिंग क्या होती है?

अच्छा सापेक्ष होता है, और इसी से यह संख्या काम की बनती है। जिन डोमेन की रेटिंग है उनमें से अधिकतर निचले सिरे पर हैं, इसलिए मोटे संकेत ये हैं: 30 से नीचे यानी जानी-मानी साइटों से कम लिंक, जिसमें अधिकतर नई और छोटी साइटें आ जाती हैं; 30 से 59 यानी अच्छी-ख़ासी संख्या में दूसरी साइटें उससे लिंक करती हैं; 60 और उससे ऊपर यानी पूरे वेब से लिंक, जिसका व्यवहार में मतलब है बड़े प्रकाशक, प्लेटफ़ॉर्म और संस्थान।

काम का सवाल लगभग कभी यह नहीं होता कि “34 अच्छा है क्या”। वह होता है “मेरी सूची के बाक़ी दो सौ के सामने यह डोमेन कहाँ ठहरता है”, और थोक डेटा इसी के लिए है।

दायरा और अपडेट

रेटिंग कितनी बार बदलती है?

हर महीने। हर रिलीज़ में हम अपने दायरे के हर डोमेन को शुरू से दोबारा आँकते हैं।

मेरी साइट पर कुछ नहीं बदला, फिर मेरी रेटिंग क्यों हिली?

क्योंकि रेटिंग सापेक्ष है और पूरा वेब हिलता रहता है। आपकी संख्या इसलिए बदल सकती है कि आपसे लिंक करने वाली साइटों ने ख़ुद लिंक पाए या खोए, कि पन्ने हटने पर आपकी ओर आने वाले लिंक चले गए, कि हमारा दायरा बदला, या कि आपके आसपास दूसरे डोमेन हिले। महीनों के बीच एक-दो अंक का फेरबदल सामान्य है और आमतौर पर कुछ नहीं कहता।

आप कितने डोमेन कवर करते हैं?

ताज़ा रिलीज़ 20 करोड़ से ज़्यादा डोमेन को आँकती है, यानी वेब का वह अधिकांश हिस्सा जिससे कोई भी लिंक करता है। अगर किसी साइट की ओर लिंक आते हैं, तो वह बहुत संभव है कि उसमें हो।

ठीक-ठीक संख्या महीने-दर-महीने बदलती है, और किसी रिलीज़ का हर डोमेन उसी रिलीज़ में आँका जाता है। हर रिलीज़ की संख्या आप डेटा पृष्ठ की तालिका में देख सकते हैं।

जिस डोमेन का होना मुझे पता है, उसकी रेटिंग 0 क्यों है?

क्योंकि उसने वे लिंक नहीं कमाए जिन्हें रेटिंग नापती है। उससे शायद ही कुछ लिंक करता है, और जो करता है वह ख़ुद भी ज़्यादा लिंक नहीं पाया, इसलिए वह पैमाने के सबसे नीचे बैठता है। कोई डोमेन असली, चालू और व्यस्त हो सकता है और फिर भी कम लिंक वाला: बिलकुल नई साइटें, लॉगिन के पीछे की साइटें, वे साइटें जिनके आगंतुक विज्ञापन या सोशल प्लेटफ़ॉर्म से आते हैं, और कंपनियों के भीतरी डोमेन सब यहीं हैं।

हर डोमेन 0 से शुरू होता है और तब ऊपर चढ़ता है जब अच्छी तरह लिंक की गई साइटें उसकी ओर इशारा करने लगती हैं।

क्या आप उपडोमेन या अलग-अलग पृष्ठ रेट करते हैं?

नहीं। रेटिंग मूल डोमेन के हिसाब से होती है। blog.example.com पूछिए और आपको example.com की रेटिंग मिलेगी।

यह कितनी सटीक है?

पैसे देने से पहले ख़ुद परखिए। मुफ़्त नमूना मौजूदा रिलीज़ से बेतरतीब चुने गए 10,000 डोमेन हैं, एक CSV फ़ाइल में, उन्हीं स्तंभों के साथ जो सशुल्क फ़ाइलों में हैं, ताकि आप हमारे आँकड़े उनके साथ रखकर देख सकें जिनका आप पहले से इस्तेमाल करते हैं। हमारी सबसे अच्छी पंक्तियों के बजाय बेतरतीब, और यह जान-बूझकर है: तालिका के ऊपरी हिस्से का नमूना उन छोटी साइटों के बारे में कुछ नहीं बताता जिन्हें आप असल में छाँटेंगे। खाते की ज़रूरत नहीं।

रेटिंग 20 करोड़ से ज़्यादा डोमेन वाले लिंक सूचकांक पर निकाली जाती है और हर महीने शुरू से दोबारा बनाई जाती है, और इसी से वह इतनी स्थिर रहती है कि एक बड़ी सूची को छाँटा और फ़िल्टर किया जा सके। यह किसी डोमेन के आसपास के लिंक बताती है और कुछ नहीं: यह न ट्रैफ़िक का अनुमान है, न गुणवत्ता का अंक, न यह अटकल कि कोई सर्च इंजन आपके साथ कैसा बर्ताव करेगा। यह जैसी है वैसी दी जाती है, सटीकता के वादे के बिना, और इस साइट पर कुछ भी उन डोमेन के बारे में सलाह नहीं है जिनका यह वर्णन करती है।

मुफ़्त जाँच और एक्सटेंशन

मुझे कितनी मुफ़्त जाँच मिलती हैं?

बिना खाते के दिन में तीन, मुफ़्त खाते के साथ दिन में पच्चीस। हर जाँच में 10,000 तक डोमेन की सूची चलती है, इसलिए दिन की तीन जाँचें यानी दिन के तीस हज़ार डोमेन। बिना खाते के सीमा इस्तेमाल के 24 घंटे बाद फिर से शुरू हो जाती है। साइन इन होने पर वह UTC आधी रात को फिर शुरू होती है।

क्या मुझे पासवर्ड चाहिए?

नहीं, और बनाने के लिए कोई है भी नहीं। आप अपना ईमेल पता डालते हैं, हम आपको एक लिंक भेजते हैं, और उस पर जाते ही आप साइन इन हो जाते हैं। लिंक एक ही बार चलता है और 15 मिनट बाद समाप्त हो जाता है। हम कोई पासवर्ड नहीं रखते, इसलिए न कुछ लीक होने को है, न रीसेट करने को, न दोबारा इस्तेमाल होने को।

क्या आप मेरे देखे हुए डोमेन का रिकॉर्ड रखते हैं?

नहीं। यह हिस्सा सिर्फ़ वादा नहीं, बनाया गया है। एक जाँच एक ही अनुक्रमित पठन है; डोमेन कभी किसी लॉग फ़ाइल, डेटाबेस तालिका, विश्लेषण उपकरण, कैश या त्रुटि रिपोर्ट में नहीं लिखा जाता। उपयोग की सीमाएँ आपके सत्र पर गिनी जाती हैं, किसी डोमेन पर कभी नहीं। ब्राउज़र एक्सटेंशन जवाब सिर्फ़ आपके ब्राउज़र की स्मृति में रखता है, और ब्राउज़र दोबारा चलने पर वे चले जाते हैं। पूरी नीति यहाँ है

एक्सटेंशन मेरी ब्राउज़िंग हिस्ट्री पढ़ने की चेतावनी क्यों देता है?

क्योंकि वह Chrome की tabs अनुमति का उपयोग करता है, जो उस टैब का पता जानने का इकलौता तरीक़ा है जिस पर आप अभी-अभी गए हैं, बिना हर बार आपसे आइकॉन दबवाए। एक्सटेंशन उससे चाहे जो करे, Chrome उस अनुमति को ब्राउज़िंग इतिहास पढ़ना ही कहता है। हमारा एक्सटेंशन होस्ट नाम लेता है, उसे मुख्य डोमेन तक छाँटता है, उस डोमेन की रेटिंग पूछता है, और फिर उसे भूल जाता है।

चेकर को सूची कैसे दें?

उसे बॉक्स में चिपकाइए, हर पंक्ति में एक, या अल्पविराम, स्पेस, टैब या अर्धविराम से अलग करके, या कोई .csv या .txt फ़ाइल अपलोड कीजिए। चिपकाया गया वेब पता, पोर्ट सहित होस्ट नाम और अंत का बिंदु सब समझ लिए जाते हैं, और हर प्रविष्टि देखने से पहले उसके मुख्य डोमेन तक छाँट दी जाती है। दोहराव का जवाब एक ही बार मिलता है, इसलिए जवाब सूची से छोटा हो सकता है। 10,000 से आगे की प्रविष्टियाँ पूरी सूची ठुकराने के बजाय छोड़ दी जाती हैं, और जवाब में यह लिखा होता है।

थोक डेटासेट

डेटा कितना पीछे तक जाता है?

2017 से हर महीने की रिलीज़, और आपके लाइसेंस के चलते हुए प्रकाशित होने वाली हर नई रिलीज़। हर रिलीज़ में हर डोमेन दोबारा आँका जाता है, इसलिए कोई डोमेन एक अकेली संख्या नहीं, एक रेखा है जिसे आप देख सकते हैं: किन्हीं दो महीनों की तुलना कीजिए और पता चल जाएगा कि साइट चढ़ रही है, फिसल रही है या वहीं ठहरी है।

मुफ़्त जाँच और API सिर्फ़ मौजूदा रिलीज़ देते हैं। पुराना इतिहास थोक डेटा लाइसेंस के साथ आता है।

मुझे असल में क्या मिलता है?

हर महीने की रिलीज़ के लिए एक parquet फ़ाइल, साथ में 2017 तक पीछे की हर रिलीज़, और आपके लाइसेंस के चलते हुए प्रकाशित हर रिलीज़। फ़ाइलों के नाम उनके महीने पर होते हैं, जैसे 2025-12.parquet

हर पंक्ति एक डोमेन है, इन स्तंभों के साथ:

  • domain (string) – मुख्य डोमेन
  • rating (int16) – 0 से 100 की रेटिंग
  • score (double) – पैमाने पर लाने से पहले का कच्चा अंक, अगर आप ख़ुद पैमाना लगाना चाहें
  • inbound_count (int64) – भीतर लिंक करने वाले अलग-अलग डोमेन
  • outbound_count (int64) – बाहर लिंक किए गए अलग-अलग डोमेन

पंक्तियाँ डोमेन के क्रम में हैं और फ़ाइलें ZSTD में सिकुड़ी हैं, इसलिए उन पर क्रमित मिलान या द्विआधारी खोज सस्ती पड़ती है।

फ़ाइलें कितनी बड़ी हैं?

खुलने पर डिस्क पर हर एक लगभग 25 GB तक। डाउनलोड का हिस्सा लिखते समय यह ध्यान रखिए: स्मृति में नहीं, डिस्क पर लिखिए।

मैं parquet फ़ाइल कैसे पढ़ूँ?

Arrow पारिस्थितिकी की कोई भी चीज़ इसे खोल लेगी। DuckDB को तो कुछ भी सेट करने की ज़रूरत नहीं:

SELECT domain, rating FROM read_parquet('2025-12.parquet') WHERE domain IN ('example.com', 'bbc.co.uk');

या Python में:

import pandas as pd frame = pd.read_parquet("2025-12.parquet", columns=["domain", "rating"])

चूँकि पंक्तियाँ डोमेन के क्रम में हैं, जब आप domain पर फ़िल्टर करते हैं तो DuckDB और Arrow फ़ाइल का बड़ा हिस्सा छोड़ सकते हैं, इसलिए लक्षित क्वेरी 25 GB नहीं पढ़ती।

पूरी मार्गदर्शिका में नौ भाषाओं के चलते हुए कोड, बिना कोड लिखे parquet खोलने वाले अनुप्रयोगों की सूची, और किसी रिलीज़ को अपने डेटाबेस में लादने का तरीका है।

क्या कोई API है?

हाँ, एक ही एंडपॉइंट। यह आपके लाइसेंस में आने वाली हर फ़ाइल सूचीबद्ध करता है, हर एक के साथ एक हस्ताक्षरित डाउनलोड लिंक, ताकि कोई निर्धारित कार्य बिना किसी के क्लिक किए हर नई रिलीज़ उठा ले। यह प्रति डोमेन खोज वाला API नहीं है और न ही प्रति डोमेन शुल्क लेता है। दस्तावेज़ीकरण यहाँ है

क्या मैं खरीदने से पहले आज़मा सकता हूँ?

हाँ। डेटा पृष्ठ पर मौजूद नमूना फ़ाइल मौजूदा रिलीज़ से बेतरतीब चुने गए 10,000 डोमेन है, एक CSV फ़ाइल में, उन्हीं स्तंभों के साथ जो सशुल्क फ़ाइलों में हैं। यह हमारी सबसे अच्छी पंक्तियों के बजाय एक निष्पक्ष हिस्सा है, इसलिए जो आप देखते हैं वही पूरी फ़ाइल जैसा है। खाते की ज़रूरत नहीं।

लाइसेंस, बिलिंग और डेटा

मैं इस डेटा के साथ क्या कर सकता हूँ?

अपने संगठन के भीतर लगभग कुछ भी: उसे रखिए, उससे सवाल पूछिए, अपने डेटा से जोड़िए, उस पर उत्पाद बनाइए, उस पर आधारित काम प्रकाशित कीजिए। कितने लोग उसका उपयोग करें इसकी कोई सीमा नहीं, और कहाँ चलाएँ इसकी भी नहीं।

आप अपने उत्पाद या अपनी रिपोर्टों में अपने ग्राहकों को अलग-अलग रेटिंग भी दिखा सकते हैं, और हमारा नाम देना ज़रूरी नहीं।

जो आप नहीं कर सकते वह है डेटा आगे बढ़ाना: फ़ाइलें, या उनका इतना बड़ा हिस्सा जो पूरे की जगह ले ले, अपने संगठन के बाहर किसी को बेचना, दोबारा प्रकाशित करना या सौंपना। पूरी शर्तें यहाँ हैं

भुगतान कैसे करें?

बैंक ट्रांसफ़र से। सदस्यता लीजिए और हम आपको अपने बैंक विवरण के साथ एक चालान भेजते हैं, जो 14 दिन में देय है। आपकी पहुँच उसी दिन शुरू होती है जिस दिन भुगतान हम तक पहुँचता है, और उसी दिन से पूरे एक साल तक चलती है।

क्या आप पैसे लौटाते हैं?

नहीं। भुगतान हो जाने के बाद सारी रक़म अंतिम है। इसीलिए मुफ़्त नमूना मौजूद है, और इसीलिए ख़रीदने से पहले स्तंभ और फ़ाइलों के आकार पूरे प्रकाशित किए जाते हैं: ताकि आप पहले जाँच सकें कि डेटा वही है जो आपको चाहिए।

वर्ष के अंत में क्या होता है?

आपका साल ख़त्म होने से 30 दिन पहले हम नवीनीकरण का चालान भेजते हैं और ईमेल से बता देते हैं। उसे चुकाने पर बिना किसी अंतराल के एक साल और जुड़ जाता है। उसे अनदेखा करने पर लाइसेंस अपनी अंतिम तारीख़ पर ख़त्म हो जाता है, और जो फ़ाइलें आप पहले ही डाउनलोड कर चुके हैं वे आपकी रहती हैं, लाइसेंस की शर्तों के तहत उपयोग के लिए।

आप मेरे बारे में क्या रखते हैं?

आपका ईमेल पता, आपने पहली और आख़िरी बार कब साइन इन किया, और अगर आप डेटा का लाइसेंस लेते हैं तो आपकी कंपनी का नाम और बिलिंग पता, ताकि चालान सही बने। मुफ़्त जाँच की गिनती आपके खाते या IP पते पर रखी जाती है और 24 घंटे के भीतर मिट जाती है। हर जाँच का एक छोटा रिकॉर्ड भी रहता है: वह कब हुई, जाँच टूल से आई या एक्सटेंशन से, उसमें कितने डोमेन थे, और वह किस IP पते, किस देश और किस ब्राउज़र से आई। इस रिकॉर्ड में डोमेन कभी नहीं होते और यह आपके खाते से नहीं जोड़ा जाता। बस इतनी ही सूची है।

मैं अपना खाता कैसे मिटाऊँ?

[email protected] पर लिखिए और हम खाता तथा उससे जुड़ी हर चीज़ मिटा देंगे। भुगतान किए गए चालान हमारे बिलिंग प्रदाता के अभिलेखों में तब तक रहते हैं जब तक कर कानून उन्हें रखने को कहता है।

अब भी उलझन है?

[email protected] पर लिखिए, कोई व्यक्ति जवाब देगा।