一次失败的搜索几乎总是四个原因之一,而它们要用不同的办法解决。判断自己撞上的是哪一个大概花一分钟,能省下你换着拼写把同一个查询重复十遍的力气。

这四个是:输入太弱身份没有名字不在索引范围内名字形式不对。它们的症状差别够大,通常光看结果页就能分辨。

怎么判断我撞上的是哪一种失败?

去读结果,而不是只看到「没有我要的答案」。

你看到什么 最可能的原因 该怎么做
「未检测到人脸」 输入太弱 换一帧;参考截图指南
有结果,但全都低于 0.40 输入太弱,或不在索引范围内 先换第二帧再试一次
分数很高,但结果没有名字 索引里有这个身份,但没名字 用返回的参考图和相似脸列表继续查
找对了女优,但不是这一部 这部作品不在索引里,或名字形式不同 改用番号搜,或从女优作品列表里找
番号搜不出东西 名字形式不对,或格式写错 检查分隔符、前缀和后缀的写法惯例

第二行是最常被误读的。有一串结果,不等于答案就在里面——向量检索永远会返回它最接近的那几个候选,哪怕对的那个人根本没进过索引。

为什么匹配分数很高,却没有名字?

因为把人脸放进索引和识别出这张人脸是谁,是两个步骤,而第二步不会自动发生。

我们的索引里有 241,792 张人脸,但只有 2,333 张关联到了具名的女优记录(我们的索引,2026-08 快照)。这个落差不是 bug——大多数进索引的人脸来自封面和剧照,图上本来就没有可靠的名字。光是我们的相似女优数据里,就有 7,004 条引用指向没有名字的身份,分散在 1,899 位具名女优的相似脸列表中。

实际操作上:如果你拿到一个分数很高、但没有名字的结果,你已经找对脸了。接下来你需要另一条通往名字的路——它所来自的那张参考图、它的来源站点,或者跟这个身份最接近的那几位具名女优。

为什么一部作品会完全不在索引里?

因为没有哪个索引能覆盖一切,而我们这个索引有它自己的形状,你应该知道。

我们从 106 个站点建立人脸索引。但我们 2,333 位具名女优里有 2,246 位,代表图都来自同一个站点。这个集中度很高,也定义了盲区所在:

  • 只在我们没有覆盖的片库里流通过的作品
  • 早于我们所索引来源的老片
  • 素人和个人制作的内容,很少被带着一致的元数据聚合起来
  • 在我们看到之前,就已经从我们索引的每一个来源下架的作品

这些都不会给你一条错误提示。它们给你的是一串看起来挺像回事、但人不对的结果,这正是为什么读分数比读排名顺序更重要。

为什么同一部作品会有好几个名字?

因为一部作品在片库之间流转的过程中会不断累积标识符,而只搜其中一种形式就会漏掉别的。

形式 大致长相 出现在哪里
片商番号 字母 + 数字,通常带连字符 封面、官方片库
另一种番号写法 同样的字母,分隔符或补零不同 聚合站、数据库
日文原名 发行时的原始片名 官方页面
译名 英文或机翻 国际聚合站
带后缀的变体 番号后面再挂一个标记 复刻版、不同格式的版本

翻译是一个规模很大、却常被低估的漏查来源。在我们自己的女优数据里,有 197 条记录的英文写法与主名字形式不同——也就是说,同一个人会因为你从哪个来源出发,而分别以两种拼写被找到。同样的分歧也发生在片名上,规模还更大。

按什么顺序试最有效率?

从最便宜的往最贵的升级:

  1. 换第二帧。 免费,花十秒,能解决因为姿势或模糊而失败的一大部分情况。
  2. 换画面里的另一个人。 多人场景等于给了你好几次识别机会。
  3. 如果画面里有番号,就用番号。 番号被压在片头、封面和水印上的频率,比大多数人以为的高。有了番号,图像问题就变成了文本问题。
  4. 翻这位女优的作品列表。 有了名字之后,用场景细节缩小范围——服装、发长、场地、画面上的文字。
  5. 暂时接受「找不到」。 有些素材确实不在任何你够得着的索引里。过几个月再查一次,比今天把同一个查询换个说法再问一遍更有用。

关于诚实的一点说明: 我们宁愿告诉你索引里没有这个东西,也不愿意给你一个自信满满的错答案。这也是为什么每一条结果上都标着分数。一个永远都能找到东西的工具并不更好——它只是把失败藏得更安静。

相关问题


如果你还没试过换第二帧,那是收益最高的下一步。传上来试试——检测在你的浏览器里跑,原图不会离开你的设备,而每条结果上的分数会告诉你它到底有没有意义。