素人和企划系列的作品是按系列编号的,不是按片商。典型形态是 259LUXU-1234:一个数字的平台标识、一个系列代号,然后是数这个系列集数的流水号。这个流水号说的是这个系列发了多少集,不是某个厂牌出了多少部片。

这个差别很要紧,因为大家从片商番号带过来的那套心智模型——前缀代表公司、流水号代表目录位置——在这里只对了一半。前缀代表的是形式,而背后的公司往往在番号里根本看不见。

系列番号由哪几部分组成?

三部分,而第一部分几乎把所有人都绕晕过。

部分 例子 它是什么
数字平台标识 259 收录方给这个系列的标识
系列代号 LUXU 系列自己的简称
流水号 1234 在这个系列里的位置

开头那几位数字,跟片商前缀那种厂牌代号不是一回事。它是收录这个系列的平台分配的标识,所以同一个系列在有些地方写成 259LUXU-1234,在另一些地方就只写 LUXU-1234。两者指的是同一集;一个带收录方标识,一个不带。

实际的用处是:当一个系列番号查不到时,先分别试试带前面数字和不带前面数字两种写法,再断定番号写错了。

最常遇到的系列番号有哪些?

流通中的绝大部分,来自少数几个长跑系列。

番号形态 系列 形式
SIRO-1234 素人TV 素人访谈形式
200GANA-1234 ナンパTV 街头搭讪形式
259LUXU-1234 ラグジュTV 素人访谈形式
300MIUM-1234 MIUM 素人形式
261ARA-1234 ARA 素人形式

有意略去的是:哪家公司拥有哪个系列。外界普遍把它们归到同一个关联网络名下,但我们读不到其中任何一个的厂牌字段——它们完全不在 FANZA 的目录里,而确实收录它们的那家商店在我们核对时打不开。与其重复一条我们自己打不开也验证不了的归属说法,不如把这一栏留空。片商番号对照表对厂牌前缀采用的是同一条规则。

片商出的企划系列番号有什么不同?

由老牌片商发行的企划系列保持着片商番号的常规形态,行为上却像系列:一个前缀、一种反复使用的形式、一段很长的号段。

前缀 性质 状态
SDMU SOD 的长跑企划线 2022 年 12 月停在 999;由 SDMUA 接续
NHDTB Natural High 的企划线 2024 年 12 月停在 999;由 NHDTC 接续
DVDMS Deep's 的企划线 2022 年 8 月停在 999;Deep's 现在用 DVMM 编号
RCTD ROCKET 的企划线 仍在继续编号

*状态依 FANZA 的商品记录与各片商自己的发行列表核对,2026-08-03。*四个里有三个正好撞到 999 才翻篇,这和单体女优产品线撞到的是同一个天花板——区别只在于花多久才走到那里。

判断的关键在流水号。单体女优的片商产品线通常在一百多号就换新前缀;企划系列则会在一个前缀底下跑上几百甚至几千集,因为产品是那个概念、不是那位女优,而概念不需要换代。

为什么系列的流水号会爬得高那么多?

因为前缀绑的是一种一直在生产的形式,而不是一条会被重新包装的产品线。

片商前缀轮换是出于营销考虑——新的制作标准、新的产品线定位、一次改版。每一次轮换都会把流水号归零。系列没有对应的事件:LUXU 的第 1400 集和第 400 集是同一个卖点,只是晚一些而已。没有任何东西会触发归零,数字就这么一路累积。

这给了你一个粗略的判断法。一个陌生前缀后面跟着四位流水号,那更可能是系列而不是片商产品线;一个陌生前缀后面跟着一百多的流水号,那更可能是片商产品线。

系列作品能有哪些元数据?

比片商作品少,而且结构也不一样。

字段 片商作品 系列作品
具名标注女优 通常有 常常没有,或只写一个名
固定的片长惯例 每集不一
封面版式 按厂牌统一 按系列统一
演员可在目录里检索 通常可以 常常不行

对查找来说要紧的是女优字段。素人形式的系列经常只标一个名字,或者只用那一集专用的名字,所以就算作品本身被收录了,按女优搜索往往还是搜不到。文字搜索失败不是因为条目不存在,而是因为你要搜的那个字段从来就没被填过。

而这个空档,恰恰是基于图像的识别真正管用的地方,因为它不依赖有没有人把名字打进去。

系列番号该怎么搜?

先原样保留整串,再按顺序试变体。

  1. 照原样 —— 259LUXU-1234,连前面的数字一起
  2. 去掉数字前缀 —— LUXU-1234
  3. 去掉连字符 —— 259LUXU1234,有些收录方就是这么写的
  4. 把系列名和流水号拆成两个关键词,如果精确匹配一直失败的话

不要像剥站点标签那样,把数字前缀当噪声剥掉。它是一套正当收录惯例的一部分,而且有时候某个索引里存的就只有这一种写法。其他失败情形收在番号查不到里。

女优完全没被标注时该怎么办?

去比对人脸,因为那是作品唯一没省掉的标识。

不标名字或只标一个名字,在素人形式里是常态,这让文字搜索在结构上就回答不了「这是谁」。人脸比对不依赖那个署名字段:我们的索引把人脸编码成 512 维的 ArcFace 向量,在 241,792 张已建索引的人脸2,333 位具名女优之间比对(我们的索引,2026-08 快照),相似度阈值为 0.40。

**有必要说清楚的边界:**对这类素材来说,「有没有名字」正是我们索引最薄的一环。索引里有很大一部分是我们叫不出名字的脸——光是相似度数据里就有数千条指向无名身份的记录——而覆盖也很集中,2,333 张代表图像里有 2,246 张来自同一个来源。对素人系列来说,「没有可信匹配」是一个常见而诚实的结果。

相关问题