Aller au contenu principal

Recherche vidéo inversée : retrouver quelqu'un dans une vidéo

Aucun moteur de recherche faciale n'interroge directement un fichier vidéo, et FaceSearch n'accepte que les images JPEG, PNG et WebP. Pour retrouver une personne apparaissant dans une vidéo, mettez en pause sur une image où le visage est net et de face, enregistrez cette image, puis lancez dessus une recherche faciale inversée.

Dernière révision

En bref

  • Une vidéo n'est pas une entrée interrogeable. Une image extraite de celle-ci l'est.
  • Choisissez une image où la personne regarde l'objectif sans bouger, puis recadrez sur la tête et les épaules.
  • Les images figées sont en général plus molles que des photos : préférez un moment calme à un moment spectaculaire.
  • Retrouver la personne dans une vidéo et retrouver l'origine de la vidéo sont deux tâches distinctes, aux outils distincts.
  • Les images issues de séquences compressées ou sombres échouent souvent. Essayer une autre image coûte moins cher que relancer la même.

Peut-on faire une recherche inversée sur une vidéo ?

Pas en tant que vidéo. Aucun moteur n'accepte un fichier vidéo pour en renvoyer les personnes, et FaceSearch ne fait pas exception : son envoi n'accepte que les images JPEG, PNG et WebP. Ce que l'on appelle recherche vidéo inversée est en pratique une opération en deux temps. Une seule image est extraite, puis cette image est recherchée comme une image ordinaire. Tout ce qui détermine la réussite de la recherche se joue au moment de choisir cette image.

Comment extraire d'une vidéo une image exploitable ?

Chaque plateforme offre un moyen de capturer une image fixe, et aucun logiciel particulier n'est nécessaire. La méthode compte moins que le moment choisi.

  • Lisez la vidéo et mettez en pause sur un instant où le visage est immobile, éclairé et tourné à peu près vers l'objectif.
  • Avancez image par image si le lecteur le permet. Sur beaucoup de lecteurs web, les touches virgule et point déplacent d'une image en pause.
  • Prenez une capture d'écran, puis recadrez-la sur la tête et les épaules pour que le visage soit le plus grand élément de l'image.
  • Enregistrez le recadrage en PNG plutôt qu'en JPEG recompressé, ce qui évite d'ajouter une seconde couche d'artefacts.
  • Vérifiez l'image enregistrée en taille réelle avant l'envoi. Si les contours des yeux et de la bouche paraissent pâteux, changez d'image.

Quelle image faut-il choisir ?

La meilleure image est un moment calme, pas un moment intéressant. Le mouvement est l'ennemi d'une correspondance faciale, car un visage en mouvement se brouille pendant l'exposition et la géométrie fine dont dépend le modèle s'efface. Une personne qui écoute donne une meilleure image que la même personne au milieu d'une phrase.

À privilégierÀ éviterPourquoi
Une pause ou une expression tenueEn plein geste ou en pleine paroleLe flou de mouvement efface entièrement le détail des traits
Visage tourné vers l'objectifProfil ou regard détournéUn profil masque la moitié de la géométrie comparée
Lumière stable et homogèneContre-jour ou scène stroboscopiqueSilhouettes et dominantes de couleur aplatissent les traits
Un plan rapproché ou zooméUn plan large ou de fouleUn petit visage supporte mal la compression
Qualité d'origine de la mise en ligneUn enregistrement d'écran de la vidéoChaque réencodage cumule les artefacts

Pourquoi une image de vidéo est-elle plus difficile à apparier qu'une photo ?

Une image de vidéo est une moins bonne photographie qu'une photographie. La compression vidéo réserve le détail à ce qui change d'une image à l'autre plutôt qu'à la netteté de l'une d'elles : une image figée porte donc un blocage et un lissage visibles qu'une photo de la même scène n'aurait pas. L'obturateur roulant peut déformer un visage en mouvement, une séquence sombre est plus bruitée qu'une photo sombre car l'exposition par image est courte, et toute remise en ligne recompresse le tout. C'est pourquoi la même personne peut s'apparier facilement depuis une photo de profil et échouer depuis une image de la vidéo dont cette photo est tirée.

Comment retrouver l'origine d'une vidéo plutôt qu'une personne ?

Retrouver d'où vient une vidéo est une autre tâche, qui demande un autre outil. Une recherche faciale répond à la question de qui est dans l'image : elle n'aide donc pas pour un extrait sans attribution, une rediffusion remise en ligne ou l'origine d'un contenu soupçonné d'être un deepfake. Pour la provenance, prenez une image clé ou la vignette et passez-la dans une recherche d'images inversée généraliste, qui cherche des copies du fichier et des scènes visuellement proches sur tout le web. Lancez les deux à la suite quand les deux questions comptent : la recherche d'images pour savoir où la séquence a été publiée, la recherche faciale pour savoir qui y figure.

Et les directs et les enregistrements d'écran ?

La même règle s'applique, avec une perte de qualité supplémentaire à anticiper. Un enregistrement d'écran réencode une séquence déjà compressée pour la diffusion : une image tirée de l'enregistrement d'un direct est donc à deux générations de l'original et constitue en général l'entrée la plus faible disponible. Quand la plateforme le permet, capturez une image fixe directement plutôt que d'enregistrer l'écran pour en extraire ensuite une image, et préférez un moment où le direct ne baissait pas sa qualité pour tenir la cadence.