Dentro dos nossos dados de atrizes parecidas existem 7,004 referências que apontam para identidades sem nenhum nome associado. Isso é 52% de todas as 13,420 referências dessas listas — mais da metade de cada ponteiro de "quem se parece com esta pessoa" que temos leva a alguém que o registro publicado nunca nomeou (nosso índice, amostra de 2026-08).

Esse é o número mais honesto que podemos publicar sobre os nossos próprios dados, e também o mais útil, porque quantifica algo que toda ferramenta de busca por rosto tem e nenhuma delas mostra: a distância entre rostos que existem e rostos que alguém se deu ao trabalho de identificar.

O que o número 7,004 conta, exatamente?

7,004 conta referências, não pessoas. Ser preciso quanto a isso é o ponto deste artigo.

Cada registro de identidade do nosso índice carrega uma lista curta dos seus vizinhos mais próximos no espaço vetorial — os rostos que o modelo considera mais parecidos. Algumas entradas dessas listas resolvem para um perfil de atriz com nome. As demais resolvem para uma identidade que existe apenas como uma chave interna, uma imagem representativa e um vetor.

Quantidade Valor O que é
Total de referências a atrizes parecidas 13,420 Todas as entradas de todas as listas de vizinhos
Referências a um perfil com nome 6,416 48% do total
Referências a uma identidade sem nome 7,004 52% do total
Identidades sem nome distintas referenciadas 589 As pessoas por trás desses 7,004 ponteiros
Atrizes com pelo menos um vizinho sem nome 1,899 De 2,070 registros que têm lista de vizinhos
Registros de identidade no índice 2,333 Dos quais 1,707 têm um perfil com nome resolvível

Fonte: nosso índice, amostra de 2026-08, n=2,333 registros de identidade.

Ou seja: 7,004 ponteiros, 589 pessoas. A identidade sem nome média é vizinha próxima de alguém umas doze vezes. Se você lesse só o número da manchete, exageraria o problema por um fator de aproximadamente doze — e é por isso que publicamos a decomposição ao lado dele.

Por que rostos acabam num índice sem nome?

Porque o rosto e o nome chegam por esteiras diferentes, e só uma delas é confiável.

Um rosto entra no índice sempre que um detector encontra um numa imagem indexada. Isso é mecânico e quase completo. Um nome entra só quando alguma página publicada o declara numa forma que conseguimos interpretar e vincular. Isso é editorial, inconsistente entre sites e muitas vezes simplesmente não existe.

As causas comuns, mais ou menos na ordem em que as vemos:

  • A página de origem não credita atriz nenhuma — muito comum em sites agregadores, que republicam material com os metadados removidos.
  • A página credita um nome só em japonês, numa forma que nunca foi mapeada para um perfil canônico. Dos nossos 2,333 registros de identidade, 626 existem como uma string de nome bruta, sem perfil vinculado e sem nenhum campo biográfico.
  • A atriz trabalhou com vários nomes e nenhuma fonte os conecta.
  • O rosto é de alguém incidental à produção e nunca foi uma atriz creditada, para começo de conversa.

Vale dizer o último caso com todas as letras: nem todo rosto num índice de vídeo adulto é de uma atriz, e um índice que assumisse o contrário estaria errado de um jeito que importa.

O que um vizinho sem nome te diz num resultado de busca?

Ele te diz que a semelhança é real e que a identificação está faltando — o que é diferente de uma busca fracassada, e muito mais comum do que os usuários imaginam.

1,899 dos 2,070 registros com lista de vizinhos (92%) têm pelo menos uma identidade sem nome entre os vizinhos mais próximos. Se você faz uma busca por rosto e recebe um resultado com pontuação acima do limiar mas sem nome, você não encontrou um bug. Você encontrou o estado real do registro público.

É também por isso que não filtramos as identidades sem nome dos resultados. Suprimi-las produziria uma lista de aparência mais limpa que distorce os dados em silêncio: transformaria "esta pessoa existe, mas nunca foi creditada" em "não tem ninguém aqui". A primeira afirmação é verdadeira e a segunda não é.

Como isso afeta os números de cobertura?

Puxa todos para baixo, e nós reportamos os números menores em vez dos lisonjeiros.

Toda porcentagem de cobertura que publicamos usa a população completa de 2,333 registros de identidade como denominador — incluindo os 626 que só têm uma string de nome e mais nada.

Campo Registros com valor Cobertura de n=2,333
Lista de atrizes parecidas 2,070 89%
Tamanho de busto 1,375 59%
Data de estreia 1,371 59%
Altura 1,340 57%
Medidas 1,316 56%
Data de nascimento 1,301 56%
Local de nascimento 716 31%
Tipo sanguíneo 547 23%

Fonte: nosso índice, amostra de 2026-08, n=2,333.

Poderíamos elevar cada um desses números trocando discretamente o denominador para os 1,707 registros que têm um perfil de verdade. Tipo sanguíneo passaria de 23% para 32%, local de nascimento de 31% para 42%. Não fazemos isso, porque os 626 estão no índice e são devolvidos nas buscas, então tirá-los da conta descreveria um banco de dados que não é o que operamos.

Dados e método

Fonte. O índice de rostos da starlikeness: vetores de rosto e registros de identidade derivados de imagens de capa e de stills de 106 sites.

Amostra. 241,792 vetores de rosto; 2,333 registros de identidade; 13,420 referências a atrizes parecidas em 2,070 listas de vizinhos.

Método. Rostos detectados com YuNet, alinhados a partir de cinco pontos de referência, codificados com ArcFace em vetores de 512 dimensões. As listas de vizinhos são os vetores mais próximos por similaridade de cosseno, sujeitos a um limiar de mesma pessoa de 0.40. Uma referência é classificada como "sem nome" quando resolve para uma identidade indexada apenas por um hash interno, sem perfil de atriz vinculado.

Data da amostra. 2026-08. Todas as contagens recalculadas a partir do arquivo de dados em produção nessa data.

Viés conhecido. Nossas fontes são muito concentradas. 2,246 de 2,333 imagens representativas vêm de um único site e, dos 106 sites que indexamos, só uns 13 carregam IDs de conteúdo japoneses — o resto é majoritariamente de sites internacionais de tube e agregadores. A lacuna de nomes que medimos é, portanto, em parte uma propriedade dos hábitos de metadados dessas fontes, e não da indústria como um todo. O que este índice mede é exposição em agregadores, não volume de lançamentos. Uma atriz bem documentada cujo trabalho não esteja nas nossas fontes apareceria aqui como ausente, e um upload mal creditado num agregador infla a contagem de rostos sem nome.

O que não conseguimos calcular. O índice guarda rostos, não títulos. Não há campos de data de lançamento, estúdio ou número de títulos, então dele não se pode derivar nenhuma afirmação sobre volume de produção, participação de mercado de estúdio ou produção ano a ano.

Citação.

starlikeness (2026). "Nosso índice contém 7,004 rostos sem nome."
Índice de rostos, amostra de 2026-08 (n=2,333 registros de identidade; 13,420
referências de vizinhos). https://starlikeness.com/pt-BR/articles/faces-without-names

Perguntas relacionadas


Se você quiser ver uma identidade sem nome com os próprios olhos, faça uma busca por rosto e fique de olho num resultado com pontuação alta e nenhum perfil por trás. A detecção acontece no seu navegador; só o recorte da região do rosto é enviado para comparação.