Dentro de nuestros datos de actrices parecidas hay 7,004 referencias que apuntan a identidades sin ningún nombre asociado. Eso es el 52% de las 13,420 referencias que contienen esas listas: más de la mitad de todos los punteros de «¿quién se parece a esta persona?» que tenemos lleva a alguien a quien el registro publicado nunca puso nombre (nuestro índice, muestra de 2026-08).
Es la cifra más honesta que podemos publicar sobre nuestros propios datos, y también la más útil, porque cuantifica algo que toda herramienta de búsqueda por cara tiene y ninguna te enseña: la distancia entre las caras que existen y las caras que alguien se ha molestado en identificar.
¿Qué cuenta exactamente el número 7,004?
7,004 cuenta referencias, no personas. Ser preciso en esto es el motivo de este artículo.
Cada registro de identidad de nuestro índice lleva una lista corta de sus vecinos más cercanos en el espacio vectorial: las caras que el modelo considera más parecidas. Algunas entradas de esas listas se resuelven en un perfil de actriz con nombre. El resto se resuelve en una identidad que existe solo como clave interna, imagen representativa y vector.
| Magnitud | Valor | Qué es |
|---|---|---|
| Referencias totales a actrices parecidas | 13,420 | Todas las entradas de todas las listas de vecinos |
| Referencias a un perfil con nombre | 6,416 | 48% del total |
| Referencias a una identidad sin nombre | 7,004 | 52% del total |
| Identidades sin nombre distintas referenciadas | 589 | Las personas detrás de esos 7,004 punteros |
| Actrices con al menos una vecina sin nombre | 1,899 | De 2,070 registros que tienen lista de vecinos |
| Registros de identidad del índice | 2,333 | De los cuales 1,707 llevan un perfil con nombre resoluble |
Fuente: nuestro índice, muestra de 2026-08, n=2,333 registros de identidad.
O sea: 7,004 punteros, 589 personas. La identidad media sin nombre es vecina cercana de alguien unas doce veces. Si solo leyeras el número del titular, exagerarías el problema aproximadamente por un factor de doce, y por eso publicamos el desglose justo al lado.
¿Por qué acaban las caras en un índice sin nombre?
Porque la cara y el nombre llegan por circuitos distintos, y solo uno de ellos es fiable.
Una cara entra en el índice en cuanto un detector la encuentra en una imagen indexada. Eso es mecánico y casi completo. Un nombre entra solo cuando alguna página publicada lo dice en una forma que podamos analizar y enlazar. Eso es editorial, inconsistente entre sitios y muchas veces está sencillamente ausente.
Las causas habituales, más o menos por orden de frecuencia con que las vemos:
- La página de origen no acredita a ninguna actriz, algo muy común en los sitios agregadores, que republican material con los metadatos arrancados.
- La página acredita un nombre solo en japonés, en una forma que nunca se vinculó a un perfil canónico. De nuestros 2,333 registros de identidad, 626 existen como una cadena de nombre en bruto, sin perfil enlazado y sin ningún campo biográfico.
- La actriz trabajó bajo varios nombres y ninguna fuente los conecta.
- La cara pertenece a alguien incidental a la producción que nunca fue una actriz acreditada.
La última merece decirse con claridad: no toda cara de un índice de vídeo para adultos es una actriz, y un índice que diera por supuesto lo contrario estaría equivocado de una forma que importa.
¿Qué te dice una vecina sin nombre dentro de un resultado de búsqueda?
Te dice que el parecido es real y que falta la identificación, que es distinto de una búsqueda fallida y mucho más frecuente de lo que la gente supone.
1,899 de los 2,070 registros con lista de vecinos (92%) tienen al menos una identidad sin nombre entre sus vecinos más cercanos. Si haces una búsqueda por cara y recibes un resultado con una puntuación por encima del umbral pero sin nombre, no has dado con un fallo. Has dado con el estado real del registro público.
Por eso tampoco filtramos las identidades sin nombre fuera de los resultados. Suprimirlas produciría una lista de aspecto más limpio que tergiversa los datos en voz baja: convertiría «esta persona existe pero nunca fue acreditada» en «aquí no hay nadie». La primera frase es verdad y la segunda no.
¿Cómo condiciona esto las cifras de cobertura?
Las tira hacia abajo, y publicamos las cifras bajas en vez de las halagadoras.
Todos los porcentajes de cobertura que publicamos usan como denominador la población completa de 2,333 registros de identidad, incluidos los 626 que llevan una cadena de nombre y nada más.
| Campo | Registros con valor | Cobertura sobre n=2,333 |
|---|---|---|
| Lista de actrices parecidas | 2,070 | 89% |
| Talla de sujetador | 1,375 | 59% |
| Fecha de debut | 1,371 | 59% |
| Altura | 1,340 | 57% |
| Medidas | 1,316 | 56% |
| Fecha de nacimiento | 1,301 | 56% |
| Lugar de nacimiento | 716 | 31% |
| Grupo sanguíneo | 547 | 23% |
Fuente: nuestro índice, muestra de 2026-08, n=2,333.
Podríamos subir todas estas cifras cambiando discretamente el denominador a los 1,707 registros que tienen un perfil de verdad. El grupo sanguíneo pasaría del 23% al 32%, y el lugar de nacimiento del 31% al 42%. No lo hacemos, porque los 626 están en el índice y salen en las búsquedas, así que dejarlos fuera de las cuentas describiría una base de datos que en realidad no operamos.
Datos y método
Fuente. El índice de caras de starlikeness: vectores faciales y registros de identidad derivados de portadas y fotogramas de 106 sitios.
Muestra. 241,792 vectores faciales; 2,333 registros de identidad; 13,420 referencias a actrices parecidas repartidas en 2,070 listas de vecinos.
Método. Caras detectadas con YuNet, alineadas a partir de cinco puntos de referencia y codificadas con ArcFace en vectores de 512 dimensiones. Las listas de vecinos son los vectores más cercanos por similitud del coseno, sujetos a un umbral de 0.40 para considerar que son la misma persona. Una referencia se clasifica como «sin nombre» cuando se resuelve en una identidad identificada solo por un hash interno, sin perfil de actriz enlazado.
Fecha de la muestra. 2026-08. Todos los recuentos se recalcularon a partir del fichero de datos en vivo en esa fecha.
Sesgo conocido. Nuestras fuentes están muy concentradas. 2,246 de 2,333 imágenes representativas vienen de un único sitio y, de los 106 sitios que indexamos, solo unos 13 llevan identificadores de contenido japonés; el resto son en su mayoría tubes y agregadores internacionales. El vacío de nombres que medimos es, por tanto, en parte una propiedad de los hábitos de metadatos de esas fuentes, no de la industria en su conjunto. Lo que este índice mide es la exposición en agregadores, no el volumen de lanzamientos. Una actriz bien documentada cuyo trabajo no esté en nuestras fuentes aparecería aquí como ausente, y una subida mal acreditada a un agregador infla el recuento de caras sin nombre.
Lo que no podemos calcular. El índice guarda caras, no títulos. No hay campos de fecha de lanzamiento, estudio ni número de títulos, así que de él no puede derivarse ninguna afirmación sobre volumen de producción, cuota de mercado de un estudio ni producción año a año.
Cita.
starlikeness (2026). «Nuestro índice contiene 7,004 caras sin nombre».
Índice de caras, muestra de 2026-08 (n=2,333 registros de identidad; 13,420
referencias de vecinos). https://starlikeness.com/es/articles/faces-without-names
Preguntas relacionadas
- ¿Cuánto de la industria alcanzamos a ver realmente?
- De dónde vienen nuestros datos y qué falta
- ¿Qué significa una puntuación de similitud de 0.40?
- Cómo funciona la búsqueda por cara, paso a paso
Si quieres ver una identidad sin nombre por ti mismo, haz una búsqueda por cara y fíjate en si aparece un resultado con puntuación alta y sin perfil detrás. La detección ocurre en tu navegador; solo se envía la región recortada de la cara para el cotejo.