安全研究员 Jeremiah Fowler 找到一个 450.2GB 的 Amazon S3 存储桶,里面装着 9042977 个人脸图像文件,分放在 faces 和 profiles 两个目录下。桶没有设任何访问控制,取回地址直接写在服务商自家网站的前端代码里,任何人拿到 URL 就能下载。Ars Technica 在 8 月 20 日报道了这次泄露。
服务商叫 ClarityCheck,做的是人脸反向查询:上传一张照片,系统扫描面部标志、映射面部几何,拿去比对全网图像,然后吐出一份报告,内容可以包括姓名、住址、社交账号,进阶报告收费。这类工具的用户画像很清楚——想弄明白相亲对象是谁,想扒出匿名账号背后的人。
泄露的不止是脸
另一处配置错误还暴露了邮箱、电话、实体住址、位置历史和社交资料。Fowler 描述库里的照片包含成年人、青少年和儿童,他给出的判断是:
“AI bots could crawl and scrape faces for training. There were a lot of photos of children there.” AI 爬虫可以把这些人脸抓走拿去训练。里面有大量儿童照片。
人脸和密码不一样,泄了没法改。银行卡能补办,密码能重置,面部几何跟着人一辈子。这批数据一旦被复制走,用途可以是未授权的身份识别、跨平台追踪,或者拿去做诈骗素材。
公司说这不算暴露
ClarityCheck 不认「公开暴露」这个说法,理由是普通公众发现不了这些文件,访问需要知道一串特定的、未被索引的 URL,而这串地址不会在正常使用服务或普通网页搜索中冒出来。
**问题在于那串地址就写在自家网站的公开代码里。**安全性靠「没人会去翻前端源码」维持,跟设置权限完全是两回事。Malwarebytes 消费产品负责人 Mark Beare 的定义要直接得多:暴露指的是敏感个人数据处在可访问、可被发现或面临未授权访问风险的状态。
时间线也不好看。据报道,数据库在被锁上之前疑似已经敞了数月,Fowler 最初向公司报告没得到回应,直到 WIRED 在 7 月联系该公司,桶才被关掉。
这门生意本身的账
美国公民自由联盟的 Rebecca Williams 把矛头指向模式本身:依赖高度敏感个人信息来验证身份的系统,就算把数据最小化和安全实践做得更强,这些风险依然会存在。
这句话点出了一个绕不开的结构性矛盾。人脸反查服务的商业价值来自它握有的图像库规模,库越大匹配命中率越高,产品越好卖。规模既是资产也是风险敞口,两者同向增长,很难靠单点加固把它们拆开。同类产品在欧洲已经因为生物识别数据处理反复被监管盯上;美国这边除了伊利诺伊等少数几个州的生物识别法,联邦层面没有统一约束。
对普通人来说还有一层:这次泄露里的照片多半不是本人交给 ClarityCheck 的,上传方是那些花钱查人的用户,被查的人从头到尾不知情。数据主体和数据提供方分离,让「通知受影响用户」这件事在实操上几乎无从下手。
参考来源:Ars Technica、Malwarebytes 安全博客、CocoLoop、Biometric Update;图像数量与存储桶容量经多家来源核对,均为 9042977 张、450.2GB,公司回应口径引自其对媒体的书面说明。