Les outils de recherche par image ne sont pas des implémentations concurrentes d'une même idée. Ils appartiennent à deux familles qui répondent à des questions différentes, et se tromper de famille garantit l'échec quel que soit le produit choisi à l'intérieur.
La première famille demande « où cette image apparaît-elle ailleurs ? » La seconde demande « à qui appartient ce visage ? » Si vous avez en main une capture d'écran prise dans un lecteur vidéo, seule la seconde question a une réponse.
Quelle est la vraie différence entre les deux familles ?
Les détecteurs de quasi-doublons construisent une empreinte de l'image entière et cherchent des empreintes concordantes dans une exploration du web. Les moteurs à vecteurs de visage localisent un visage, le normalisent, l'encodent en nombres, et comparent ces nombres à un index de visages.
| Détection de quasi-doublons | Correspondance par vecteur de visage | |
|---|---|---|
| Question posée | Où cette image apparaît-elle ? | À qui appartient ce visage ? |
| Unité comparée | Empreinte de l'image entière | Visage aligné → vecteur numérique |
| Exige que l'image exacte existe en ligne | Oui | Non |
| Recadrer sur le visage | Nuit — supprime le signal | Aide — c'est l'entrée attendue |
| Pose, éclairage, année différents | Échoue en général | Conçu pour y survivre |
| Fonctionne sur une image que vous avez capturée | Non | Oui |
| Mode d'échec typique | Renvoie des images de banque sans rapport | Renvoie de vraies personnes avec des scores bas |
La ligne qui décide de tout pour les images de vidéo est la troisième. Mettez un lecteur en pause et faites-en une capture : vous venez de créer une image qui n'a jamais existé sur le web sous forme de fichier. Il n'y a aucune copie à trouver, et la détection de quasi-doublons n'a donc rien sur quoi travailler — c'est une limite structurelle, pas un écart de qualité.
Que fait réellement chacun des grands outils ?
Les regrouper par comportement plutôt que par marque rend le choix évident.
| Outil | Famille | Ce qu'il met en correspondance | Où il casse sur les images de vidéo |
|---|---|---|---|
| Google Images / Lens | Quasi-doublon + similarité visuelle | L'image entière contre l'exploration de Google | Les sites pour adultes sont largement absents de l'exploration et supprimés par SafeSearch |
| Bing Visual Search | Quasi-doublon + recherche par zone | L'image entière ou une zone sélectionnée | Même problème de couverture d'exploration pour les catalogues pour adultes |
| TinEye | Quasi-doublon strict | Copies exactes et retouchées du même fichier | Explicitement un chercheur de copies ; une image inédite n'a aucune copie |
| Yandex Images | Quasi-doublon + forte similarité visuelle | L'image entière, avec un classement de similarité plus lâche | Renvoie souvent des inconnues visuellement proches, ce qui se lit comme une correspondance sans en être une |
| Outils web de « recherche de visage » généralistes | Vecteur de visage | Des visages indexés depuis le web ouvert | L'index est bâti sur des images du web ouvert et des réseaux sociaux, pas sur des catalogues pour adultes |
| Recherche de visage indexée sur le contenu pour adultes | Vecteur de visage | Des visages indexés depuis des jaquettes et des photos de tournage | Limitée à ce que ces sources ont publié |
Yandex mérite un avertissement particulier. Son classement par similarité visuelle est assez lâche pour renvoyer des personnes qui se ressemblent simplement — mêmes cheveux, même pose, même palette de couleurs. Les utilisateurs y lisent une identification. Ce n'en est pas une ; rien dans cette chaîne de traitement ne mesure l'identité.
Pourquoi l'index compte-t-il plus que le moteur ?
Parce qu'une recherche ne peut renvoyer que ce qui a été indexé, et qu'aucun algorithme ne compense un contenu absent.
Un moteur à vecteurs de visage de qualité état de l'art, braqué sur un index de photographies du web ouvert, ne trouvera pas une actrice pour adultes dont les images ne vivent que dans des catalogues que cet index n'a jamais explorés. La qualité de l'ingénierie n'a aucun effet sur le résultat.
Le nôtre est bâti précisément sur ce matériau : 241,792 visages issus de jaquettes et de photos de tournage pour adultes sur 106 sites, dont 2,333 rattachés à une actrice nommée (notre index, instantané 2026-08). C'est toute la raison pour laquelle il peut répondre à une question que Google ne peut pas.
Une limite à énoncer : notre couverture est biaisée. 2,246 de ces 2,333 actrices nommées ont leur image représentative issue d'une source unique. Tout ce qui se trouve hors des catalogues que nous couvrons nous est invisible, et nous vous montrerons quand même une liste classée de quasi-succès — d'où le fait que chaque résultat porte un score, avec 0.40 comme seuil calibré pour les images extraites de vidéos.
En quoi les outils diffèrent-ils sur ce que vous leur confiez ?
La comparaison s'arrête d'ordinaire à la qualité des résultats, alors que les architectures de confidentialité diffèrent davantage que les algorithmes.
| Comportement | Outil typique à envoi du fichier entier | Détection côté navigateur |
|---|---|---|
| Image originale transmise | Oui | Non |
| Métadonnées (GPS, appareil, horodatage) transmises | Oui, sauf si elles sont retirées | Jamais envoyées |
| Contenu situé hors du visage transmis | Oui | Non |
| Envoyé au serveur | Le fichier complet | Le visage recadré + 5 coordonnées de points de repère |
| Vérifiable par l'utilisateur | Seulement sur parole | Oui — inspectez la requête réseau |
La plupart des outils des deux familles envoient le fichier entier, parce que c'est plus simple à construire. Faire tourner la détection côté client signifie que le serveur ne reçoit jamais l'original.
Ce que disent les grands services des envois qu'ils reçoivent varie plus qu'on ne le croirait, et la distinction utile est celle entre une politique énoncée et un silence.
| Service | Sur la conservation des envois | Sur l'usage pour l'entraînement |
|---|---|---|
| Conservés seulement si l'historique de recherche visuelle est activé, ce qui n'est pas le cas par défaut | S'il est activé, les images peuvent servir à entraîner ses modèles de recherche visuelle ; les copies d'entraînement sont conservées jusqu'à quatre ans, détachées du compte | |
| Bing Visual Search | Aucune durée de conservation publiée | Dit que les photos peuvent servir à améliorer son traitement d'images ; n'emploie pas le mot « entraîner » |
| Yandex Images | Aucune déclaration propre aux images | Aucune déclaration propre aux images |
| TinEye | Déclare que les envois sont supprimés après affichage des résultats et jamais ajoutés à son index | Aucune déclaration dans un sens ou dans l'autre |
Lisez les cases vides comme des inconnues, pas comme des garanties. Deux autres pièges : la formule généreuse « nous n'entraînons pas sur vos images » qu'on attribue à Microsoft relève de son produit de génération d'images, pas de la recherche visuelle ; et le réglage par défaut de Google ci-dessus est documenté pour son application et ses interfaces Lens, sans déclaration équivalente couvrant un envoi depuis un ordinateur sans être connecté.
Sources : les pages d'aide ou de politique publiées par chaque service ; vérifié le 2026-08-03.
Lequel utiliser, et dans quel cas ?
- Vous avez une image publiée — une jaquette, une photo promotionnelle, quelque chose qui existe comme fichier sur le web : un détecteur de quasi-doublons est le bon premier réflexe. Il peut retrouver la page exacte d'où elle vient.
- Vous avez une image que vous avez capturée vous-même : allez directement à la recherche par vecteur de visage. La détection de quasi-doublons ne fonctionnera pas et réessayer n'y changera rien.
- Vous avez un visage mais vous soupçonnez que la personne n'est pas une actrice pour adultes : aucun moteur indexé sur ce contenu ne vous aidera, et en utiliser un sur un particulier est un détournement de l'outil, pas une astuce.
- Vous avez un code ou le texte d'un titre : laissez tomber la recherche par image. Une recherche textuelle est plus rapide et plus fiable que n'importe quelle méthode visuelle.
Un diagnostic en un test avant d'investir du temps dans un outil : recadrez votre image sur le seul visage et relancez-la. Si les résultats empirent, cet outil fait de la détection de quasi-doublons et ne peut identifier personne.
Questions connexes
- Pourquoi la recherche d'image inversée de Google ne marche pas pour les vidéos pour adultes
- Comment fonctionne la recherche par visage, étape par étape
- Envoyer une photo à un outil de recherche, est-ce sans risque ?
- Comment retrouver une vidéo à partir d'une simple capture d'écran
- Les erreurs courantes quand on cherche une source
La comparaison se tranche le plus facilement à l'expérience : passez la même image dans un outil de quasi-doublons puis dans la recherche par visage ici. La détection tourne dans votre navigateur — l'original ne quitte jamais votre appareil, et chaque résultat affiche son score.