Búsqueda inversa de vídeo: encontrar a alguien de un vídeo
Ningún motor de búsqueda facial consulta un archivo de vídeo directamente, y FaceSearch acepta únicamente imágenes JPEG, PNG y WebP. Para encontrar a una persona que aparece en un vídeo, pausa en un fotograma donde el rostro se vea nítido y de frente, guarda ese fotograma como imagen y ejecuta con él una búsqueda facial inversa.
Última revisión
En resumen
- Un vídeo no es una entrada consultable. Un fotograma suyo sí lo es.
- Elige un fotograma en el que la persona mire a la cámara y no se esté moviendo, y recorta a cabeza y hombros.
- Los fotogramas pausados suelen ser más blandos que las fotos, así que elige un momento quieto antes que uno espectacular.
- Encontrar a la persona del vídeo y encontrar el origen del vídeo son tareas distintas con herramientas distintas.
- Los fotogramas de material comprimido o con poca luz fallan a menudo. Probar otro fotograma sale más barato que repetir el mismo.
¿Se puede hacer una búsqueda inversa de un vídeo?
Como vídeo, no. No existe un motor que acepte un archivo de vídeo y devuelva a las personas que aparecen en él, y FaceSearch no es una excepción: su subida acepta solo imágenes JPEG, PNG y WebP. Lo que se llama búsqueda inversa de vídeo es en la práctica una operación en dos partes. Se extrae un único fotograma y ese fotograma se busca después como una imagen normal. Todo lo que determina si la búsqueda funciona se decide al elegir el fotograma.
¿Cómo se saca de un vídeo un fotograma consultable?
Cualquier plataforma ofrece alguna forma de capturar una imagen fija y no hace falta software especial. El método importa menos que el momento elegido.
- Reproduce el vídeo y pausa en un momento en que el rostro esté quieto, iluminado y mirando más o menos a la cámara.
- Avanza fotograma a fotograma si el reproductor lo permite. En muchos reproductores web, las teclas de coma y punto mueven un fotograma mientras está en pausa.
- Haz una captura y recórtala a cabeza y hombros para que el rostro sea lo más grande de la imagen.
- Guarda el recorte como PNG y no como un JPEG recomprimido, lo que evita añadir una segunda ronda de artefactos.
- Revisa la imagen guardada a tamaño completo antes de subirla. Si los bordes de los ojos y la boca se ven pastosos, elige otro fotograma.
¿Qué fotograma conviene elegir?
El mejor fotograma es un momento quieto, no un momento interesante. El movimiento es el enemigo de una coincidencia facial, porque un rostro en movimiento queda emborronado durante la exposición y la geometría fina de la que depende el modelo se difumina. Una persona escuchando da mejor fotograma que esa misma persona a mitad de una frase.
| Prefiere | Evita | Motivo |
|---|---|---|
| Una pausa o un gesto sostenido | Mitad de un gesto o de una palabra | El desenfoque de movimiento borra por completo el detalle de los rasgos |
| Rostro girado hacia la cámara | Perfil o mirada desviada | Un perfil oculta la mitad de la geometría que se compara |
| Luz estable y uniforme | Contraluz o escena con destellos | Las siluetas y las dominantes de color aplanan los rasgos |
| Un plano cercano o con zoom | Un plano general o de multitud | Un rostro pequeño soporta mal la compresión |
| Calidad original de subida | Una grabación de pantalla del vídeo | Cada recodificación acumula artefactos |
¿Por qué los fotogramas cuestan más de emparejar que las fotos?
Un fotograma de vídeo es una fotografía peor que una fotografía. La compresión de vídeo reserva el detalle para lo que cambia entre fotogramas y no para la nitidez de uno solo, así que un fotograma pausado arrastra bloques y emborronamientos visibles que una imagen fija de la misma escena no tendría. El obturador rodante puede deformar un rostro en movimiento, el material con poca luz tiene más ruido que una foto con poca luz porque la exposición por fotograma es corta, y cualquier resubida vuelve a comprimirlo todo. Por eso la misma persona puede emparejarse fácilmente desde una foto de perfil y fallar desde un fotograma del vídeo del que salió esa foto.
¿Cómo se encuentra el origen de un vídeo en lugar de a una persona?
Averiguar de dónde viene un vídeo es otra tarea y necesita otra herramienta. Una búsqueda facial responde a quién aparece en el fotograma, así que no ayuda con un clip sin atribuir, una retransmisión resubida ni el origen de un posible deepfake. Para la procedencia, toma un fotograma clave o la miniatura y pásalo por una búsqueda inversa de imágenes general, que busca copias del archivo y escenas visualmente parecidas por toda la web. Ejecuta las dos en secuencia cuando ambas preguntas importen: la búsqueda de imágenes para saber dónde se ha publicado el material y la facial para saber quién aparece en él.
¿Y las retransmisiones en directo y las grabaciones de pantalla?
Se aplica la misma regla, con una pérdida de calidad adicional que hay que prever. Una grabación de pantalla recodifica material que ya venía comprimido para su entrega, así que un fotograma tomado de la grabación de una retransmisión está a dos generaciones del original y suele ser la entrada más débil disponible. Cuando la plataforma lo permita, captura una imagen fija directamente en vez de grabar la pantalla y extraer luego un fotograma, y prefiere un momento en el que la retransmisión no estuviera bajando la calidad para mantener el ritmo.