常见问题

关于评分如何运作、覆盖什么,以及数据如何授权的全部说明。

评分

什么是评分?

一个 0 到 100 的数字,表示某个域名与我们所知的其他所有域名相比,被链接得有多好。没有任何网站 链接的站点接近 0。几乎所有网站都链接的少数站点接近 100。大多数真实运作的网站在 10 到 40 之间, 绝大部分有用的比较也发生在这一段。

它只衡量一件事:指向一个域名的链接。它不是质量评分,不是流量估算,也不是对搜索引擎会如何对待 你的猜测。

它是如何计算的?

它是一个独立的 0 到 100 对数评分,依据是唯一链接域名的数量与权威度,由我们自有的网络规模链接索引计算得出,每月刷新。

具体做法是这样。我们从一份很短的名单开始,这些站点我们确知它们名副其实:国家级广播机构、大学、 政府、标准组织,以及历史悠久且可靠的参考资料。每一个都获得一个起始分。这个分数随后在网络上一轮 一轮向外传递。被已有分数的域名链接的域名,会拿到那个域名所持分数的一部分,然后又把自己此刻所持 的一部分传给它所链接的域名。一轮轮重复,直到数字不再变动。停在这里,才使结果成为关于整个网络的 事实,而不只是关于某个网站周围几步之内的事实。

整个过程中我们统计的是不同的域名,而不是页面。一个网站即使从一万个页面链接到你,也只 算一次,而这条链接值多少,取决于给出链接的域名当时持有多少。来自一个被大量链接的域名的一条链接, 比来自无人指向的域名的一百条链接更能推动这个数字。

由此得出每个域名一个分数,跨度极大。我们按这个分数把该版本中的所有域名排序,域名在这个排序中 的位置,就是我们放到 0 到 100 刻度上的数值。这就是你看到的数字。

为什么高分难以伪造。分数只从人工挑选的那些站点进入。因此要拿到高分,唯一的办法 就是能在很少的几步之内,从一开始就被信任的站点到达。给自己加链接没有任何作用,因为链接不产生 分数,只传递分数。一千个专为互相链接而建的域名,只能分配从外部到达它们的那点分数,如果什么都 没到达,它们就什么都分不到。向那份起始名单根本到不了的域名购买链接,等于买下零的一份。

为什么在人工智能让网络变大之后它依然成立。如今做一个网站,甚至一万个网站,几乎 不花钱,网络上内容的数量已经说明不了什么。仍然昂贵的,是来自全国性报纸、大学院系或标准组织的一条 链接,因为给出它们的人有东西可失去。我们从网络的这一端来衡量,所以大量新域名涌入几乎不会撼动旧 域名:新来者落在底部,一直待在那里,直到有分量的人指向它们。

“对数”在实际中意味着什么?

刻度上相等的一步意味着相乘,而不是相加。从 20 升到 30,也许只需要多几个链接域名。从 70 升到 80, 需要的是许多倍。90 到 100 之间的差距,比 0 到 50 的整段差距还大。

所以请把它当作排名,而不是百分比。让域名彼此比较,而不是对一份列表取平均,并且记住:顶端的 五分,远比底端的五分值钱。

什么算一个链接域名?

一个完整的域名,截取到它的主要部分。来自 blog.example.comshop.example.com 的链接算作一个链接域名,即 example.com。由多段组成的 后缀会被正确处理,所以 bbc.co.uk 是一个完整域名,而不是 co.uk 的一部分。

多少分算好?

好是相对的,这正是这个数字有用的原因。有评分的域名大多集中在低端,所以可参照的界线是:低于 30 表示来自知名网站的链接很少,大多数新站和小站都属于这一档;30 到 59 表示相当多的其他网站链接到 它;60 及以上表示来自整个网络的链接,实际上就是大型出版机构、平台和公共机构。

有用的问题几乎从来不是“34 分算好吗”,而是“这个域名和我列表里另外两百个相比 如何”,而这正是批量数据的用途。

覆盖范围与更新

评分多久变一次?

每月一次。每个版本都会把我们覆盖的所有域名从头重新评分。

我的网站没有任何改动,为什么评分变了?

因为评分是相对的,而整个网络都在变动。你的数字可能变化,是因为链接到你的网站自己获得或失去了 链接,因为页面被撤下导致指向你的链接消失,因为我们覆盖的范围有所变化,或者因为其他域名在你周围 发生了变动。相邻两个月之间一两分的浮动很正常,通常不说明任何问题。

你们覆盖多少域名?

最新版本为超过 2 亿个域名评分,这已经是网络上有人链接的绝大部分。如果一个网站 有链接指向它,它很可能就在里面。

确切数量每月都会变动,而且一个版本中的每个域名在该版本里都有评分。你可以在 数据页面的表格中看到每个版本的数量。

为什么我知道存在的域名评分是 0?

因为它还没有赢得评分所衡量的那些链接。几乎没有网站链接到它,而链接它的网站本身也没什么人链接, 所以它落在刻度的最底部。一个域名可以是真实的、在线的、访问量不小的,同时仍然链接很少:全新的 网站、需要登录才能访问的网站、访客主要来自广告或社交平台的网站,以及公司内部域名,都在这里。

每个域名都从 0 开始,当链接良好的网站开始指向它时就会上升。

你们会为子域名或单个页面评分吗?

不会。评分以主域为单位。查询 blog.example.com,得到的是 example.com 的评分。

它有多准确?

付费之前请自行判断。免费样本是从 当前版本中随机抽取的 10,000 个域名,以 CSV 文件提供,列与付费文件完全相同,因此你可以把我们的 数字和你已经在用的数据放在一起,看看是否吻合。刻意随机抽取而不是挑我们最好的行:只看表格顶端的 样本,对你真正要排序的那些较小网站毫无参考价值。无需账户。

评分是在一个覆盖超过 2 亿个域名的链接索引上计算的,每月从头重做一次,正因如此它足够稳定,可以 用来给一份很大的列表排序和筛选。它只描述一个域名周围的链接,别的什么也不是:它不是流量估算, 不是质量评分,也不是对搜索引擎会如何对待你的猜测。它按现状提供,不保证准确,本站的任何内容都不 构成对它所描述域名的建议。

免费查询与扩展程序

我有多少次免费查询?

没有账户每天三次,注册免费账户后每天二十五次。每次查询可提交最多 10,000 个域名的列表,所以每天 三次就是每天三万个域名。没有账户时,额度在使用后 24 小时重置;登录后则在世界协调时午夜重置。

我需要密码吗?

不需要,而且也没有密码可设。您输入电子邮件地址,我们给您发一个链接,点开它就登录了。该链接只能使用一次,15 分钟后失效。我们不保存任何密码,因此没有什么可以泄露、重设或被重复利用。

你们会记录我查询过的域名吗?

不会。这一部分是做出来的,不只是承诺。一次查询就是一次带索引的读取;域名从不会写入日志文件、 数据库表、分析工具、缓存或错误报告。用量限制记在你的会话上,绝不记在某个域名上。浏览器扩展只把 结果放在你浏览器的内存里,浏览器重启后就没有了。 完整政策在这里

为什么扩展程序会提示它能读取我的浏览记录?

因为它使用了 Chrome 的 tabs 权限,这是唯一一种不必让你每次都点击图标,就能知道你 刚切换到的标签页地址的办法。无论扩展拿它做什么,Chrome 都把这个权限称为读取浏览历史。我们的做法 是:取出主机名,截取到主域名,查询该域名的评分,然后忘掉它。

怎样把列表交给查询工具?

粘贴到输入框里,一行一个,或用逗号、空格、制表符或分号分隔,也可以上传 .csv 或 .txt 文件。粘贴 的网址、带端口的主机名和结尾的点都能识别,每一项在查询前都会截取到它的主域名。重复的只回答一次, 所以结果可能比列表短。超过 10,000 条的部分会被略去,而不是拒绝整份列表,结果里也会说明这一点。

完整数据集

数据可以追溯到什么时候?

2017 年以来的每月版本,加上你的授权期内新发布的每一个版本。每个域名在每个版本里都会重新评分, 所以一个域名是一条你可以跟踪的曲线,而不只是一个数字:比较任意两个月,就能看出一个网站是在上升、 下滑还是原地不动。

免费查询工具和 API 只提供当前版本。历史数据随批量数据授权一起提供。

我实际能得到什么?

每个月度版本一个 parquet 文件,加上此前追溯到 2017 年的每个版本,以及你的授权期内发布的每个 版本。文件以其月份命名,例如 2025-12.parquet

每一行是一个域名,包含这些列:

  • domain(string)– 主域名
  • rating(int16)– 0 到 100 的评分
  • score(double)– 缩放之前的原始分数,方便你自己缩放
  • inbound_count(int64)– 链接进来的不同域名数
  • outbound_count(int64)– 链接出去的不同域名数

各行按域名排序,文件使用 ZSTD 压缩,因此在其上做有序归并或二分查找的成本很低。

文件有多大?

每个文件解压后在磁盘上最多约 25 GB。写下载步骤时请把这一点算进去:写到磁盘,而不是写进内存。

我该怎么读取 parquet 文件?

Arrow 生态中的任何工具都能打开它。DuckDB 完全无需配置:

SELECT domain, rating FROM read_parquet('2025-12.parquet') WHERE domain IN ('example.com', 'bbc.co.uk');

或者用 Python:

import pandas as pd frame = pd.read_parquet("2025-12.parquet", columns=["domain", "rating"])

由于行按域名排序,当您对 domain 做筛选时,DuckDB 和 Arrow 可以跳过文件的大部分内容,因此一次定向查询并不会读取 25 GB。

完整指南提供了九种语言的可运行代码、一份无需写代码即可打开 parquet 的应用清单,以及如何把一个版本导入您自己的数据库。

有 API 吗?

有,只有一个接口。它列出您的授权所涵盖的每一个文件,每个都附带一个签名下载链接,这样定时任务就能自动取得每个新版本,无需任何人点击。它不是按域名查询的 API,也不按域名计费。文档在此

购买前可以试用吗?

可以。数据页面上的样本文件,是从当前 版本中随机抽取的 10,000 个域名,以 CSV 文件提供,列与付费文件完全相同。它是公平的一份切片,而不是 我们最好的那些行,所以你看到的就是整个文件的样子。无需账户。

授权、计费与数据

我可以用这些数据做什么?

在你自己的组织内部,几乎什么都可以:存储、查询、与你自己的数据关联、在其上构建产品、发表基于 它的研究。使用的人数没有限制,运行的地点也没有限制。

你也可以在自己的产品或报告中,向自己的客户展示单个评分,而且不必注明来自我们。

不可以做的是把数据集转手:向组织之外的任何人出售、再发布或交付这些文件,或其中大到足以代表 整体的一部分。完整条款在这里

怎么付款?

通过银行转账。订阅后我们会给你开一张带有我们银行信息的发票,14 天内付款。你的使用权从款项到账 当天开始,自该日起满一年。

你们提供退款吗?

不退款。所有费用一经支付即为最终款项。免费样本正是为此存在,列结构和文件大小也在购买前完整 公布:让你先确认数据是否符合需要。

一年到期后会怎样?

在你的年度结束前 30 天,我们会开一张续费发票并发邮件通知你。付款即可无缝续上一年。不理会它, 授权就在到期日结束,而你已经下载的文件仍然归你,可按授权条款继续使用。

你们保存我的哪些信息?

你的邮箱地址、你首次和最近一次登录的时间,以及在你购买数据授权时,为了让发票正确而需要的公司 名称和账单地址。免费查询的计数记在你的账户或 IP 地址上,24 小时内失效。每次查询还会留下一条简短记录: 发生的时间、来自查询工具还是扩展程序、涉及多少个域名,以及来源的 IP 地址、国家和浏览器。这条记录从不包含 域名本身,也不与你的账户关联。就是这些。

我该如何删除账户?

发邮件到 [email protected],我们会删除该账户及其所有相关内容。已付款的发票会按税法要求的期限,保留在我们开票服务商的记录中。

还是没解决?

发邮件到 [email protected],会有人回复您。