BreakHub
知识库排行榜与测试

GreatFire 与本站的关系

GreatFire.org 是谁,翻墙中心(Circumvention Central)做什么,本站怎么导入它的数据、怎么标注来源,以及我们和它之间的边界。

5 分钟阅读 · 发布于 2026年9月10日

本站排行榜上的大部分数据不是我们自己测的,而是从 GreatFire 的翻墙中心(Circumvention Central)定期导入的。这不是秘密,页面上每一处用到导入数据的地方都写着“数据来源:GreatFire Circumvention Central”。但“导入”两个字背后有不少细节:GreatFire 是谁,数据怎么拿、怎么标,还有哪些事我们和他们根本没关系。

GreatFire.org 是谁

GreatFire 是一个从 2011 年前后开始活动的匿名团队,主要工作是监测和对抗中国的互联网审查。他们最早为人所知的是 GreatFire Analyzer——一个持续探测哪些网址、关键词在中国大陆被封的数据库,很多媒体报道里“某某网站在中国被封”的证据就是从那里来的。

后来的项目还有几个。FreeWeibo 收集并展示被微博删掉的帖子。“Collateral Freedom”是一种镜像策略:把被封网站的镜像放到大型云服务商的域名下,让审查者要么放行、要么承担封掉整个云服务的代价。AppleCensorship(后来归入 App Censorship 项目)追踪苹果应用商店在各国下架了哪些应用。这些项目的规模和现状各不相同,有的活跃有的沉寂,细节以他们官网为准。

翻墙中心是他们比较新的一个项目。

翻墙中心做什么

翻墙中心(cc.greatfire.org)的思路很直接:与其靠评测网站的主观打分,不如让身处封锁网络内部的真实用户跑测试,把结果汇总成排行榜。用户在浏览器里点一下,测速度、延迟、稳定性,选一个所在地和正在用的工具,结果匿名进入公开数据集。

它的排行榜按地区(中国大陆、俄罗斯、伊朗、土库曼斯坦、其他)和操作系统筛选,用中位数聚合,要求一个工具至少有 5 次跨多天的测试才参与排名。它还公开了 API——这是我们能做这个站的前提。

GreatFire 的做法有个明显的优点:数据来自墙内。海外评测机构测出来的速度,跟在北京晚高峰用同一个工具的体验是两回事。缺点也明显:样本依赖用户自愿提交,热门工具数据多,冷门工具可能几个月才几条。

本站怎么导入

我们的同步程序每小时的第 15 分钟跑一次增量导入,每天 03:30 UTC 做一次全量对齐,把翻墙中心的公开数据拉进本站数据库。具体拉四样东西:单条测试结果、各筛选条件下的聚合数据(用来算“GreatFire 排名”那一列)、工具目录(含服务商/自建、免费/付费的标注)、各地区的整体中位数。

抓取的方式是刻意克制的:请求自报 User-Agent 为 BreakHub-sync,附带本站地址;所有请求串行,相邻两次至少隔 300 毫秒;失败退避重试;同一时刻只允许一个同步在跑。我们希望这个站给上游带来的负载可以忽略不计。

导入的每一条结果都带 source = 'greatfire' 标记,id 以 gf_ 开头,跟本站实测的 bh_ 前缀区分开。在界面上,导入数据旁边有 GreatFire 的来源徽章,点开单条结果能看到链接回上游原始页面(cc.greatfire.org/en/test?id=…)。每个展示导入数据的页面底部都有一行“数据来源”说明和上次同步时间。

我们不改动导入的数据。上游删了的记录我们不会主动删,但会在全量同步时对齐;上游明显异常的记录我们可能会隐藏(hidden 标记),隐藏的记录不参与统计,但不会被删除。

两边榜单怎么对照

本站的排名算法和翻墙中心一样:三项指标各自的名次取平均,至少 5 次测试且跨 48 小时才入池。在此基础上我们做了两件事。

第一,我们把本站实测的数据和导入数据合在一起算排名,所以本站的名次可能和上游有一两位的出入。第二,我们在表格里保留一列“GreatFire 排名”,用同一算法对上游最新快照重算得到。两列并排放着,你可以自己判断差异是否值得在意。想只看纯上游数据,把“数据来源”筛选切到“GreatFire 导入”即可。

更详细的解释见 排行榜怎么读

我们和 GreatFire 没有的关系

有几件事需要说清楚。

本站不隶属于 GreatFire,不是他们的镜像或分站,也没有得到他们的背书。我们使用的是他们公开的数据和 API,遵守他们能被观察到的使用规范,并且在每一处标明来源。如果 GreatFire 要求我们停止导入,我们会停止。

钱的问题也说一下:本站不接受任何 VPN 服务商的付费排名、赞助位或“推荐”标签。名次只由数据决定,算法公开在文档里。工具目录里的链接指向服务商主页,不带推广参数。

两类数据分开标注,永远不混淆来源。本站实测的每条结果附带完整详情(每个 URL 的速度、每个域名的延迟、每张图片的校验结果),导入的结果只有上游提供的汇总字段。

隐私上,我们不存访问者的原始 IP。只有在你选择了翻墙工具的情况下,才会把出口 IP 解析成国家代码存下来,而那是梯子出口的位置,不是你的位置。指纹实验室只存哈希和粗粒度属性,不存原始画布或音频数据。

除了导入,我们还做了什么

翻墙中心是一个数据集加一张榜单。我们在此之上加了几样东西:可达性测试(十个常被封的站点能不能开)、3 并发峰值速度、按工具的历史趋势页、本站实测与上游数据的并排对照,以及一个独立的浏览器指纹实验室。中文是本站的第一语言,英文是完整版本而不是节选。

如果你觉得翻墙中心的数据有用,直接去 cc.greatfire.org 跑一次测试,那边的数据一小时内就会出现在这里。在本站跑测试也可以,只是数据不会回传给上游,它会留在这里,和上游数据一起参与排名。

常见问题

本站是 GreatFire 官方的吗? 不是。我们是独立项目,使用他们公开的数据并注明来源。

在本站跑的测试会同步到 GreatFire 吗? 不会。数据只在本站保存和展示。想给上游贡献数据,去 cc.greatfire.org 测。

为什么不直接用 GreatFire 的网站? 可以用,我们也建议你用。本站的价值在于中文优先、额外的测试项、历史趋势和指纹实验室,以及把两边数据放在一起看。

导入的数据多久更新? 每小时增量一次,每天一次全量。页面底部有上次同步时间。