我们打造 Pirate Face,是因为开放权重 AI 太重要了,不能依赖任何单点,包括我们喜爱的那些平台。我们的使命是:基于开放标准(BitTorrent 的 BEP-19 网络种子、SHA-256 验证),让开放模型永久地具备反脆弱性。我们认为这是 AI 应该拥有的一层,并且应该尽可能贴近主权 AI 已经所在的地方。

模型不应该消亡。

然而每周都有开放权重模型从互联网上消失。它们被设置访问限制、更换许可证、被弃用,或者被悄悄撤下。一个模型消失,下游的一切都会中断:复现、基准测试、微调、产品和研究。

支柱级的项目也不例外。2025 年 7 月,Meta 一夜之间关闭了 Papers with Code,79,817 个论文与代码的链接、9,327 个排行榜和 5,628 个数据集随之失效,其中大部分再也没有完全恢复。机器学习领域本就存在有据可查的可复现性危机,而消失的成果只会让它更加严重。

AI 公共资源的价值惊人,但也脆弱得惊人。Hugging Face 是它的核心,托管着近 300 万个开放模型,而且还在增长,其中第二个一百万只用了不到 11 个月。但任何单一托管方,无论多好,都是一个单点故障:面对下架、服务中断、政策变化,或者仅仅是时间的流逝。

这并不是批评。所有中心化系统都带有中心化的风险。而且,以安全为由限制或撤下开放权重模型的压力只会越来越大。

一张安全网。

Pirate Face 是开放模型的永久保存层。Hugging Face 上每一个采用宽松许可证的模型,都可以被镜像为经过校验和验证的种子,并把 Hugging Face 上的文件本身作为网络种子内置其中。

简单来说:模型仍然直接从 Hugging Face 全速下载,和以前完全一样。对用户来说什么都没有变。但如果那个文件哪天消失了,下载会无缝切换到全球点对点节点群。

模型不会消亡。它会继续正常工作。

对 Hugging Face 有好处。

我们正在让 Hugging Face 去中心化,让所有依赖它的人受益。原因有三点。

  1. Hugging Face 仍是权威来源。 网络种子让 HF 保持为主要来源。我们在它之下充当安全网。HF 在线时(几乎总是如此),你就是从 HF 下载。

  2. 我们加强信任。 每个文件都会与 Hugging Face 官方的 SHA-256 进行比对。被篡改或伪造的副本无法完成下载。我们不是未经验证的镜像,而是用密码学方法把每一个字节都锚定到 HF 自己的记录上。

  3. 我们保护创作者的身份。 认证用户名把模型与其背后真实的 Hugging Face 账户或组织绑定,任何人都无法冒充某个实验室,社区也始终知道某个模型确实出自他们之手。

具体到 Hugging Face 生态,这意味着公共资源的灾难恢复:任何重要的开放模型都不必丢失,这既是使命上的胜利,也是整个生态的声誉保险。

这意味着带宽韧性:在远离 HF 基础设施的地区,节点群可以更快地为节点提供服务,在不改变任何人工作流程的情况下减轻负载。

这意味着一条即插即用的路径:设置一个环境变量,现有的流水线就会通过我们解析:HF 在线时从 Hugging Face 下载,一旦不在线就从节点群下载。同样的路径,同样的 API,无需修改任何代码。它让 HF 原生的工作流程更具黏性。

这意味着防冒充的来源记录:经过验证的创作者身份,对 HF 的用户和 HF 的品牌都有好处。

以永久为原则。

对于任何把开放知识视为原则问题的人来说,这是一次对思想自由的实践。知识不会被抹去。权重比任何公司、任何政策、任何服务中断都活得更久。模型成为真正的公共物品,不由某一台服务器持有,而由每一个选择承载它的人共同持有。

pirateface.co