问题
这里的排名与大多数其他排名不同,而且方向很明确:几乎没有服务商得分很高。以下问题正是由此而来,答案依据模型本身,而不是绕开模型。
因为一个数字必须在隐私与覆盖范围之间取舍,而这不是我们可以替你做的取舍。隐私保护较弱的审查规避工具,与网络规模较小、优先保护隐私的 VPN,都是正确答案 — 只是对应不同的问题。
因此,每个服务商都有一个安全得分和一个易用性得分,两个得分都满分 100 分,而且从不取平均值。排名只依据安全得分。易用性得分会显示在旁边;如果你要求按它排序,表格也会照做,但它绝不会让服务商越过安全得分更高的服务商 — 它唯一决定的顺序,是安全得分相同的记录之间的顺序,而 56 个服务商中的 77 个处于这种情况。
分布就是这样:0 个强,2 个尚可,2 个弱,11 个不足,53 个不推荐。其余 0 个的判定为 no_data:已公开的信息太少,无法为它们定位,因此没有榜单会为它们排名,但它们各自仍保留自己的页面。
但要看清这个结果衡量的是什么。模型评估的是证据的状态,而不是对公司的直觉判断。服务商得分较低,要么是因为有已记录的事实对它不利,要么是因为几乎没有任何事情得到确认 — 这两种情况截然不同,而星级评分会把它们模糊成同一种结果。
诚实的总结不是“市场很糟”。而是这个市场中的大多数服务商,除了自己之外,从未被任何人核查过。
仅凭排名,不应该。请在排名中找到它的记录并阅读明细:得分由八个通道构成,究竟是哪一个通道拉低了得分,会改变这个数字对你的意义。
如果法院记录显示某服务商提供过数据,它因此被扣分;而另一个服务商则因为从未接受过审计而被扣分。这两种情况传达的信息不同。前者是一个发现,后者是一个空白。
不是。这意味着,关于该服务商已公开的信息,结合信息发布者及其发布时间进行权衡后,服务商本身能够识别你的路径较少。
它并未说明你的设备、浏览器、你通过隧道登录的内容,或不需要服务商配合的对手会如何。它也无法识别尚未被任何人揭穿的谎言 — 模型曾对四个后来被发现说谎的服务商进行测试,但只有一个在事前被明确区分出来。
没有,而且这是有意为之。我们不运行这些软件;我们阅读关于它们的已公开信息,并为每个数值记录出处和日期。一次从一个地点测得的速度数字,并不能成为关于某个服务商的事实;把它与事实放在同一张表里也不合适。
我们在易用性维度记录的是可以找到来源的信息:服务器国家、网络规模、价格、免费套餐、协议、终止开关、同时连接数,以及是否允许流媒体和 P2P。
unknown。研究还没有完成吗?名录中的安全字段有 42% 为 unknown — 即 5,159 个中的 2,143 个 — 这个数字是一个发现,而不是道歉。unknown 意味着没有人公开过答案 — 不是我们没有查找,也不意味着答案很糟。
这也会让服务商失分。未填入的字段会进入无知通道,因为无人能够核查的主张,其价值低于已经得到核查的主张。另一种做法 — 从营销页面推断数值 — 会得到一张更完整、但更糟糕的表。
10 个服务商中的 77 个带有 usability.state: no_data。已公开的信息太少,无法为它们定位,因此你看到的数字是下限,而不是一次测量 — 它是记录能够支持的结果,真实答案只可能更高。
这说明的是研究状况,而不是服务商本身。这类服务商不是没有通过检查,而是从未接受检查。安全维度也是如此:77 个服务商中有 0 个带有 no_data 判定,没有榜单会为它们排名。
因为记录询问的不是服务商声称了什么,而是存在什么记录可以将流量与个人关联起来,并通过一个带有出处和日期的字段给出答案。
在存档的数值中,3,285 个依据他人发布的文件,2,875 个属于服务商自己的声明。两者都会被保存,但处理方式不同:未经核查的有利声明会向市场先验值回归,而不利于自身的承认则保留全部权重。而且大多数声明并不能解决任何问题 — 2,875 个声明中有 2,415 个所对应的字段,记录仍计为 unknown。隐私政策中的“不记录日志”句子,是受其约束的一方对未来作出的声明。
这是不同的问题,页面也有意放在不同的 URL上,因此它们不会争夺同一个搜索结果。
管辖地是运营公司注册所在的地方 — 它决定谁可以强制公司采取行动,以及公司是否有发言权。服务器国家是流量出口所在的地方,这决定哪些当地制度会触及硬件。一家公司即使注册在监管宽松的地方,仍可能让其服务器网络经过强制要求记录日志的国家,而且确实有多家公司如此运营。
审计是证据,而证据具有不同属性。模型会读取其中五项:审计机构是谁、依据什么标准开展工作、报告是完整公开还是只有新闻稿中的一句话、审计范围是整个服务器网络还是抽样,以及这是一次性审计还是系列审计。
而且证据会变旧。审计结果在 12 个月内保持原有权重,此后每 18 个月减半;已观察到的实践保持 12 个月,此后每 60 个月减半,因为习惯比一次快照衰减得慢。两者都不会降到零 — 仍会保留一个下限,因为通过的审计永远不可能一文不值。
出处也以相同方式分级:A 完整计入,B 按 0.85 计入,C 按 0.7 计入,D 按 0.35 计入。在整个名录中,有 580 个 A 级出处,另有 3,200 个 B 级、289 个 C 级和 26 个 D 级出处。
没有可以操控的杠杆。得分根据已公开字段计算,并且不接受编辑调整 — 过去曾存在的手动调节已被删除,正是因为每个服务商页面都会列出计算过程,改动数字会让这份计算结果变成谎言。
服务商可以改变的是证据:完整公开审计报告,把留存问题的答案放在可核查的位置,维护透明度报告。这会改变数字,而且本来就应该如此。
因为根据他人的商业排名拼出的评分,说明的更多是那些排名,而不是服务商本身。它不能与依据出处和日期建立的评估放在同一张表里,否则其中一方会在不知不觉中借用另一方的权威。
这里的排名只根据安全评估建立,不含其他因素。
按字段分别处理,取决于答案变化的速度。价格和平台事实的有效期为 30 天;服务器数量和执法记录为 90 天;架构和留存为 180 天;审计和公司事实为 365 天。数值超过有效期后,必须重新核查,才能再次采信。
每个数值还会记录上次确认的日期,并显示在记录中相应数值旁边。本次核查截至 2026年9月26日,依据的方法论版本为 3.7.0。
这里有专门处理此事的表单,它要求使用我们已经掌握的该服务服务商域名下的工作邮箱 — 这是本网站唯一进行的身份核查。
但它不会做的一件事,是与您协商数字。请指出字段及其已公开的信息,字段就会发生变化;得分来自字段,而不是来自对话。
这正是术语表的用途 — 其中解释字段状态、八个通道、数值的来源,以及记录所使用的常见 VPN 术语。