Dans nos données d'actrices similaires, il y a 7,004 références qui pointent vers des identités sans nom attaché. Cela représente 52% de l'ensemble des 13,420 références de ces listes — plus d'un pointeur « qui ressemble à cette personne ? » sur deux mène à quelqu'un que le registre public n'a jamais nommé (notre index, instantané 2026-08).
C'est le chiffre le plus honnête que nous puissions publier sur nos propres données, et c'est aussi le plus utile, parce qu'il quantifie une chose que tout outil de recherche par visage possède et qu'aucun ne vous montre : l'écart entre les visages qui existent et les visages que quelqu'un a pris la peine d'identifier.
Que compte exactement le nombre 7,004 ?
7,004 compte des références, pas des personnes. Être précis là-dessus, c'est tout l'objet de cet article.
Chaque fiche d'identité de notre index porte une courte liste de ses plus proches voisins dans l'espace vectoriel — les visages que le modèle juge les plus semblables. Certaines entrées de ces listes se résolvent en un profil d'actrice nommée. Les autres se résolvent en une identité qui n'existe que sous la forme d'une clé interne, d'une image représentative et d'un vecteur.
| Quantité | Valeur | Ce que c'est |
|---|---|---|
| Total des références d'actrices similaires | 13,420 | Toutes les entrées de toutes les listes de voisins |
| Références vers un profil nommé | 6,416 | 48% du total |
| Références vers une identité sans nom | 7,004 | 52% du total |
| Identités sans nom distinctes référencées | 589 | Les personnes derrière ces 7,004 pointeurs |
| Actrices ayant au moins un voisin sans nom | 1,899 | Sur 2,070 fiches disposant d'une liste de voisins |
| Fiches d'identité dans l'index | 2,333 | Dont 1,707 mènent à un profil nommé exploitable |
Source : notre index, instantané 2026-08, n=2,333 fiches d'identité.
Donc : 7,004 pointeurs, 589 personnes. L'identité anonyme moyenne est le proche voisin de quelqu'un une douzaine de fois. Si vous ne lisiez que le chiffre du titre, vous exagéreriez le problème d'un facteur douze environ — et c'est justement pour ça que nous publions le détail à côté.
Pourquoi des visages se retrouvent-ils dans un index sans nom ?
Parce que le visage et le nom arrivent par deux filières différentes, et qu'une seule des deux est fiable.
Un visage entre dans l'index dès qu'un détecteur en trouve un dans une image indexée. C'est mécanique et quasi exhaustif. Un nom n'y entre que si une page publiée l'énonce sous une forme que nous pouvons analyser et relier. C'est éditorial, inconstant d'un site à l'autre, et souvent totalement absent.
Les causes habituelles, à peu près par ordre de fréquence observée :
- La page source ne crédite aucune actrice — très courant sur les sites agrégateurs, qui republient du contenu dépouillé de ses métadonnées.
- La page ne crédite un nom qu'en japonais, sous une forme qui n'a jamais été reliée à un profil canonique. Sur nos 2,333 fiches d'identité, 626 existent sous la forme d'une simple chaîne de caractères, sans profil lié ni le moindre champ biographique.
- L'actrice a travaillé sous plusieurs noms et aucune source ne les relie.
- Le visage appartient à quelqu'un d'accessoire à la production, qui n'a jamais été crédité comme actrice.
Le dernier cas mérite d'être dit sans détour : tous les visages d'un index de vidéo adulte ne sont pas des actrices, et un index qui supposerait le contraire se tromperait d'une manière qui compte.
Que vous dit un voisin sans nom dans un résultat de recherche ?
Il vous dit que la ressemblance est réelle et que l'identification manque — ce qui n'est pas la même chose qu'une recherche ratée, et bien plus fréquent que les gens ne le supposent.
1,899 des 2,070 fiches dotées d'une liste de voisins (92%) comptent au moins une identité sans nom parmi leurs plus proches voisins. Si vous lancez une recherche par visage et obtenez un résultat au score supérieur au seuil mais sans nom, vous n'êtes pas tombé sur un bug. Vous êtes tombé sur l'état réel du registre public.
C'est aussi pourquoi nous ne filtrons pas les identités sans nom hors des résultats. Les supprimer produirait une liste d'apparence plus propre qui travestirait discrètement les données : elle transformerait « cette personne existe mais n'a jamais été créditée » en « il n'y a personne ici ». La première affirmation est vraie, la seconde non.
En quoi cela façonne-t-il les taux de couverture ?
Cela les tire vers le bas, et nous publions les chiffres les plus bas plutôt que les plus flatteurs.
Chaque pourcentage de couverture que nous publions prend pour dénominateur la population complète de 2,333 fiches d'identité — y compris les 626 qui ne portent qu'une chaîne de caractères et rien d'autre.
| Champ | Fiches avec une valeur | Couverture sur n=2,333 |
|---|---|---|
| Liste d'actrices similaires | 2,070 | 89% |
| Bonnet | 1,375 | 59% |
| Date de début | 1,371 | 59% |
| Taille | 1,340 | 57% |
| Mensurations | 1,316 | 56% |
| Date de naissance | 1,301 | 56% |
| Lieu de naissance | 716 | 31% |
| Groupe sanguin | 547 | 23% |
Source : notre index, instantané 2026-08, n=2,333.
Nous pourrions relever chacun de ces chiffres en changeant discrètement le dénominateur pour les 1,707 fiches dotées d'un vrai profil. Le groupe sanguin passerait de 23% à 32%, le lieu de naissance de 31% à 42%. Nous ne le faisons pas, parce que les 626 sont dans l'index et qu'elles ressortent dans les recherches : les exclure du calcul reviendrait à décrire une base de données que nous n'exploitons pas.
Données et méthode
Source. L'index de visages starlikeness : vecteurs de visages et fiches d'identité tirés de jaquettes et de photogrammes issus de 106 sites.
Échantillon. 241,792 vecteurs de visages ; 2,333 fiches d'identité ; 13,420 références d'actrices similaires réparties sur 2,070 listes de voisins.
Méthode. Visages détectés avec YuNet, alignés à partir de cinq points de repère, encodés avec ArcFace en vecteurs de 512 dimensions. Les listes de voisins sont les vecteurs les plus proches par similarité cosinus, sous un seuil de 0.40 pour la même personne. Une référence est classée « sans nom » quand elle se résout en une identité identifiée seulement par un hachage interne, sans profil d'actrice lié.
Date de l'instantané. 2026-08. Tous les décomptes ont été recalculés à partir du fichier de données en production à cette date.
Biais connu. Nos sources sont très concentrées. 2,246 des 2,333 images représentatives viennent d'un seul site, et sur les 106 sites que nous indexons, seuls 13 environ portent des identifiants de contenu japonais — le reste est surtout composé de sites tube et agrégateurs internationaux. L'écart de nommage que nous mesurons tient donc en partie aux habitudes de métadonnées de ces sources-là, pas à celles de l'industrie dans son ensemble. Ce que cet index mesure, c'est l'exposition sur les agrégateurs, pas le volume de sorties. Une actrice bien documentée dont le travail est absent de nos sources apparaîtrait ici comme absente, et un envoi mal crédité sur un agrégateur gonfle le compte des identités sans nom.
Ce que nous ne pouvons pas calculer. L'index stocke des visages, pas des titres. Il n'y a ni champ de date de sortie, ni champ de studio, ni compteur de titres : aucune affirmation sur le volume de production, les parts de marché des studios ou l'évolution annuelle ne peut en être tirée.
Citation.
starlikeness (2026). « Notre index contient 7,004 visages sans nom ».
Index de visages, instantané 2026-08 (n=2,333 fiches d'identité ; 13,420
références de voisins). https://starlikeness.com/fr/articles/faces-without-names
Questions liées
- Quelle part de l'industrie voyons-nous vraiment ?
- D'où viennent nos données, et ce qui manque
- Que signifie un score de similarité de 0.40 ?
- Comment fonctionne la recherche par visage, étape par étape
Si vous voulez voir une identité sans nom de vos propres yeux, lancez une recherche par visage et guettez un résultat au score élevé sans profil derrière. La détection se fait dans votre navigateur ; seule la zone de visage recadrée est envoyée pour la comparaison.