常见问题
关于评分如何运作、覆盖什么,以及数据如何授权的全部说明。
评分
- 什么是评分?
-
一个 0 到 100 的数字,表示某个域名与我们所知的其他所有域名相比,被链接得有多好。没有任何网站 链接的站点接近 0。几乎所有网站都链接的少数站点接近 100。大多数真实运作的网站在 10 到 40 之间, 绝大部分有用的比较也发生在这一段。
它只衡量一件事:指向一个域名的链接。它不是质量评分,不是流量估算,也不是对搜索引擎会如何对待 你的猜测。
- 它是如何计算的?
-
它是一个独立的 0 到 100 对数评分,依据是唯一链接域名的数量与权威度,由我们自有的网络规模链接索引计算得出,每月刷新。
具体做法是这样。我们从一份很短的名单开始,这些站点我们确知它们名副其实:国家级广播机构、大学、 政府、标准组织,以及历史悠久且可靠的参考资料。每一个都获得一个起始分。这个分数随后在网络上一轮 一轮向外传递。被已有分数的域名链接的域名,会拿到那个域名所持分数的一部分,然后又把自己此刻所持 的一部分传给它所链接的域名。一轮轮重复,直到数字不再变动。停在这里,才使结果成为关于整个网络的 事实,而不只是关于某个网站周围几步之内的事实。
整个过程中我们统计的是不同的域名,而不是页面。一个网站即使从一万个页面链接到你,也只 算一次,而这条链接值多少,取决于给出链接的域名当时持有多少。来自一个被大量链接的域名的一条链接, 比来自无人指向的域名的一百条链接更能推动这个数字。
由此得出每个域名一个分数,跨度极大。我们按这个分数把该版本中的所有域名排序,域名在这个排序中 的位置,就是我们放到 0 到 100 刻度上的数值。这就是你看到的数字。
为什么高分难以伪造。分数只从人工挑选的那些站点进入。因此要拿到高分,唯一的办法 就是能在很少的几步之内,从一开始就被信任的站点到达。给自己加链接没有任何作用,因为链接不产生 分数,只传递分数。一千个专为互相链接而建的域名,只能分配从外部到达它们的那点分数,如果什么都 没到达,它们就什么都分不到。向那份起始名单根本到不了的域名购买链接,等于买下零的一份。
为什么在人工智能让网络变大之后它依然成立。如今做一个网站,甚至一万个网站,几乎 不花钱,网络上内容的数量已经说明不了什么。仍然昂贵的,是来自全国性报纸、大学院系或标准组织的一条 链接,因为给出它们的人有东西可失去。我们从网络的这一端来衡量,所以大量新域名涌入几乎不会撼动旧 域名:新来者落在底部,一直待在那里,直到有分量的人指向它们。
- “对数”在实际中意味着什么?
-
刻度上相等的一步意味着相乘,而不是相加。从 20 升到 30,也许只需要多几个链接域名。从 70 升到 80, 需要的是许多倍。90 到 100 之间的差距,比 0 到 50 的整段差距还大。
所以请把它当作排名,而不是百分比。让域名彼此比较,而不是对一份列表取平均,并且记住:顶端的 五分,远比底端的五分值钱。
- 什么算一个链接域名?
-
一个完整的域名,截取到它的主要部分。来自
blog.example.com和shop.example.com的链接算作一个链接域名,即example.com。由多段组成的 后缀会被正确处理,所以bbc.co.uk是一个完整域名,而不是co.uk的一部分。 - 多少分算好?
-
好是相对的,这正是这个数字有用的原因。有评分的域名大多集中在低端,所以可参照的界线是:低于 30 表示来自知名网站的链接很少,大多数新站和小站都属于这一档;30 到 59 表示相当多的其他网站链接到 它;60 及以上表示来自整个网络的链接,实际上就是大型出版机构、平台和公共机构。
有用的问题几乎从来不是“34 分算好吗”,而是“这个域名和我列表里另外两百个相比 如何”,而这正是批量数据的用途。
覆盖范围与更新
- 评分多久变一次?
-
每月一次。每个版本都会把我们覆盖的所有域名从头重新评分。
- 我的网站没有任何改动,为什么评分变了?
-
因为评分是相对的,而整个网络都在变动。你的数字可能变化,是因为链接到你的网站自己获得或失去了 链接,因为页面被撤下导致指向你的链接消失,因为我们覆盖的范围有所变化,或者因为其他域名在你周围 发生了变动。相邻两个月之间一两分的浮动很正常,通常不说明任何问题。
- 你们覆盖多少域名?
-
最新版本为超过 2 亿个域名评分,这已经是网络上有人链接的绝大部分。如果一个网站 有链接指向它,它很可能就在里面。
确切数量每月都会变动,而且一个版本中的每个域名在该版本里都有评分。你可以在 数据页面的表格中看到每个版本的数量。
- 为什么我知道存在的域名评分是 0?
-
因为它还没有赢得评分所衡量的那些链接。几乎没有网站链接到它,而链接它的网站本身也没什么人链接, 所以它落在刻度的最底部。一个域名可以是真实的、在线的、访问量不小的,同时仍然链接很少:全新的 网站、需要登录才能访问的网站、访客主要来自广告或社交平台的网站,以及公司内部域名,都在这里。
每个域名都从 0 开始,当链接良好的网站开始指向它时就会上升。
- 你们会为子域名或单个页面评分吗?
-
不会。评分以主域为单位。查询
blog.example.com,得到的是example.com的评分。 - 它有多准确?
-
付费之前请自行判断。免费样本是从 当前版本中随机抽取的 10,000 个域名,以 CSV 文件提供,列与付费文件完全相同,因此你可以把我们的 数字和你已经在用的数据放在一起,看看是否吻合。刻意随机抽取而不是挑我们最好的行:只看表格顶端的 样本,对你真正要排序的那些较小网站毫无参考价值。无需账户。
评分是在一个覆盖超过 2 亿个域名的链接索引上计算的,每月从头重做一次,正因如此它足够稳定,可以 用来给一份很大的列表排序和筛选。它只描述一个域名周围的链接,别的什么也不是:它不是流量估算, 不是质量评分,也不是对搜索引擎会如何对待你的猜测。它按现状提供,不保证准确,本站的任何内容都不 构成对它所描述域名的建议。
免费查询与扩展程序
- 我有多少次免费查询?
-
没有账户每天三次,注册免费账户后每天二十五次。每次查询可提交最多 10,000 个域名的列表,所以每天 三次就是每天三万个域名。没有账户时,额度在使用后 24 小时重置;登录后则在世界协调时午夜重置。
- 我需要密码吗?
-
不需要,而且也没有密码可设。您输入电子邮件地址,我们给您发一个链接,点开它就登录了。该链接只能使用一次,15 分钟后失效。我们不保存任何密码,因此没有什么可以泄露、重设或被重复利用。
- 你们会记录我查询过的域名吗?
-
不会。这一部分是做出来的,不只是承诺。一次查询就是一次带索引的读取;域名从不会写入日志文件、 数据库表、分析工具、缓存或错误报告。用量限制记在你的会话上,绝不记在某个域名上。浏览器扩展只把 结果放在你浏览器的内存里,浏览器重启后就没有了。 完整政策在这里。
- 为什么扩展程序会提示它能读取我的浏览记录?
-
因为它使用了 Chrome 的
tabs权限,这是唯一一种不必让你每次都点击图标,就能知道你 刚切换到的标签页地址的办法。无论扩展拿它做什么,Chrome 都把这个权限称为读取浏览历史。我们的做法 是:取出主机名,截取到主域名,查询该域名的评分,然后忘掉它。 - 怎样把列表交给查询工具?
-
粘贴到输入框里,一行一个,或用逗号、空格、制表符或分号分隔,也可以上传 .csv 或 .txt 文件。粘贴 的网址、带端口的主机名和结尾的点都能识别,每一项在查询前都会截取到它的主域名。重复的只回答一次, 所以结果可能比列表短。超过 10,000 条的部分会被略去,而不是拒绝整份列表,结果里也会说明这一点。
完整数据集
- 数据可以追溯到什么时候?
-
2017 年以来的每月版本,加上你的授权期内新发布的每一个版本。每个域名在每个版本里都会重新评分, 所以一个域名是一条你可以跟踪的曲线,而不只是一个数字:比较任意两个月,就能看出一个网站是在上升、 下滑还是原地不动。
免费查询工具和 API 只提供当前版本。历史数据随批量数据授权一起提供。
- 我实际能得到什么?
-
每个月度版本一个 parquet 文件,加上此前追溯到 2017 年的每个版本,以及你的授权期内发布的每个 版本。文件以其月份命名,例如
2025-12.parquet。每一行是一个域名,包含这些列:
domain(string)– 主域名rating(int16)– 0 到 100 的评分score(double)– 缩放之前的原始分数,方便你自己缩放inbound_count(int64)– 链接进来的不同域名数outbound_count(int64)– 链接出去的不同域名数
各行按域名排序,文件使用 ZSTD 压缩,因此在其上做有序归并或二分查找的成本很低。
- 文件有多大?
-
每个文件解压后在磁盘上最多约 25 GB。写下载步骤时请把这一点算进去:写到磁盘,而不是写进内存。
- 我该怎么读取 parquet 文件?
-
Arrow 生态中的任何工具都能打开它。DuckDB 完全无需配置:
SELECT domain, rating FROM read_parquet('2025-12.parquet') WHERE domain IN ('example.com', 'bbc.co.uk');或者用 Python:
import pandas as pd frame = pd.read_parquet("2025-12.parquet", columns=["domain", "rating"])由于行按域名排序,当您对
domain做筛选时,DuckDB 和 Arrow 可以跳过文件的大部分内容,因此一次定向查询并不会读取 25 GB。完整指南提供了九种语言的可运行代码、一份无需写代码即可打开 parquet 的应用清单,以及如何把一个版本导入您自己的数据库。
- 有 API 吗?
-
有,只有一个接口。它列出您的授权所涵盖的每一个文件,每个都附带一个签名下载链接,这样定时任务就能自动取得每个新版本,无需任何人点击。它不是按域名查询的 API,也不按域名计费。文档在此。
- 购买前可以试用吗?
-
可以。数据页面上的样本文件,是从当前 版本中随机抽取的 10,000 个域名,以 CSV 文件提供,列与付费文件完全相同。它是公平的一份切片,而不是 我们最好的那些行,所以你看到的就是整个文件的样子。无需账户。
授权、计费与数据
- 我可以用这些数据做什么?
-
在你自己的组织内部,几乎什么都可以:存储、查询、与你自己的数据关联、在其上构建产品、发表基于 它的研究。使用的人数没有限制,运行的地点也没有限制。
你也可以在自己的产品或报告中,向自己的客户展示单个评分,而且不必注明来自我们。
不可以做的是把数据集转手:向组织之外的任何人出售、再发布或交付这些文件,或其中大到足以代表 整体的一部分。完整条款在这里。
- 怎么付款?
-
通过银行转账。订阅后我们会给你开一张带有我们银行信息的发票,14 天内付款。你的使用权从款项到账 当天开始,自该日起满一年。
- 你们提供退款吗?
-
不退款。所有费用一经支付即为最终款项。免费样本正是为此存在,列结构和文件大小也在购买前完整 公布:让你先确认数据是否符合需要。
- 一年到期后会怎样?
-
在你的年度结束前 30 天,我们会开一张续费发票并发邮件通知你。付款即可无缝续上一年。不理会它, 授权就在到期日结束,而你已经下载的文件仍然归你,可按授权条款继续使用。
- 你们保存我的哪些信息?
-
你的邮箱地址、你首次和最近一次登录的时间,以及在你购买数据授权时,为了让发票正确而需要的公司 名称和账单地址。免费查询的计数记在你的账户或 IP 地址上,24 小时内失效。每次查询还会留下一条简短记录: 发生的时间、来自查询工具还是扩展程序、涉及多少个域名,以及来源的 IP 地址、国家和浏览器。这条记录从不包含 域名本身,也不与你的账户关联。就是这些。
- 我该如何删除账户?
-
发邮件到 [email protected],我们会删除该账户及其所有相关内容。已付款的发票会按税法要求的期限,保留在我们开票服务商的记录中。
还是没解决?
发邮件到 [email protected],会有人回复您。