安全不是一句承诺,而是一种架构。唯一重要的问题是:实际离开你设备的到底是哪些字节?而任何把整个文件上传的工具,早就已经把这个问题回答了——那张图里的一切现在都在别人的服务器上,包括你压根没想到的东西。
另一种做法是把敏感的那一段留在本地做。当检测和对齐在你的浏览器里执行,服务器根本看不到原图。它收到的是一小块裁切好的人脸区域和五个特征点坐标,那是算出一个向量所需要的最低限度。
一个典型的图片搜索工具会从你这边收到什么?
比一张图多。上传的是一个文件,而文件带着上下文。
| 传出去的内容 | 整文件上传 | 浏览器端检测 |
|---|---|---|
| 完整原图 | 会 | 不会 |
| 脸以外的一切——房间、其他人、屏幕上的文件 | 会 | 不会 |
| EXIF 元数据(GPS、设备、时间戳) | 会,除非被清掉 | 不适用——根本不会送 |
| 裁切后的人脸区域 | 会 | 会 |
| 五个特征点坐标 | 在服务器端算 | 会 |
| 你的 IP 地址和请求头 | 会 | 会 |
最后一行在任何网站、任何网络请求上都无法避免。它上面那几行则是架构上的选择,各家工具真正的差别就在那里。
尤其注意第二行。从台式机截下来的图,经常包含远比视频本身更多的东西:一个登录着各种标签页的浏览器、文件管理器、消息通知。整文件上传等于把这些全都交出去。
浏览器端检测实际上是怎么运作的?
检测器以加载到你浏览器标签页里的代码形式运行,处理的是本地内存中的图像。
- 你选一张图。它被读进页面里——没有任何网络请求发生。
- YuNet 在本地运行,对找到的每一张脸返回一个边界框加五个特征点。
- 如果找到好几张脸,由你决定搜哪一张。
- 只有那块裁切区域和它的特征点坐标会送到服务器,由服务器算出 512 维的 ArcFace 人脸向量并搜索索引。
- 结果返回。这次请求之后不会留下任何东西。
实际结果是:一张本来就没有可检测人脸的图,根本不会产生任何上传。失败完全发生在你这一端。
上传之前,该问任何一个工具哪些问题?
五个,而且每一个都有可观察的答案,不是营销话术式的答案。
| 问题 | 你自己怎么查 |
|---|---|
| 整个文件会离开我的设备吗? | 开发者工具 → Network 面板 → 检查请求体的大小 |
| 连接有加密吗? | HTTPS,而且证书有效——看地址栏 |
| 搜索之后图片会被保存吗? | 读隐私政策;没写保存期限,本身就是一种答案 |
| 图片会被拿去训练吗? | 找有没有明确声明。沉默通常意味着会 |
| 需要注册账号吗? | 账号会把每一次搜索都绑到一个长期存在的身份上 |
最后一项被低估了。一个不用注册就能用的工具,无论政策怎么写,都建不出一份绑在你身上的搜索记录。
诚实排序的话,真正的风险有哪些?
风险并不等值,而且喊得最响的恐惧往往不是最大的那个。
- 最高:上传普通人的图像。 这才是真正严重的风险,而且它是由用户制造的,不是工具。拿同学、同事或前任的照片去搜成人内容的人脸索引,那是骚扰的基础设施,不是研究。而且它也不管用——索引里放的是公开的宣传图像,所以一个普通人只会换回一串分数很低的陌生人,然后人们把那个误读成一项发现。
- 高:画面里不小心入镜的上下文。 一张包含你的桌面、打开的标签页或邮件客户端的截图,泄露的关于你的信息比视频本身还多。
- 中等:保存与再利用。 存在服务器上的图片,日后可能外泄、被司法调取,或被挪去做训练。
- 低:人脸裁切本身。 一位已公开发行作品的女优、112 像素的对齐人脸裁切,经 TLS 传输且不保存,已经接近这件事所需的最低可行披露量。
这个工具具体是怎么做的?
检测在你的浏览器里执行。只有裁切后的人脸区域和五个特征点坐标会送到服务器。原图绝不会离开你的设备,搜索结果也不会被存储。
这个说法是刻意写成可被推翻的——打开 Network 面板自己看。我们这样讲,是因为「我们重视您的隐私」无法验证,而一个请求体可以。
我们手上真正握有的是被搜索的那份索引:241,792 张脸,跨 106 个站点,其中 2,333 张关联到具名女优(我们的索引,2026-08 快照)。那些素材是已发行成人作品的公开宣传图像。它不是一个普通人的数据库,行为也不会像一个。
**有一条边界值得说明:**没有任何架构能改变「一个请求会带着 IP 地址」这件事,也改变不了你的网络运营商看得到你连向某个域名。如果你需要那个层级的保护,那是网络层的问题,需要网络层的解法,而不是一个更好的上传表单。
相关问题
如果你想实测这个说法,而不是选择相信:打开浏览器的开发者工具,切到 Network 面板,然后在这里跑一次搜索。你会看到送出去的是一小块裁切,不是你的文件。