⭐ Vídeo patrocinado por Keysfan: licencias originales de Windows y Office a precio muy reducido. Con estos códigos tienes descuento extra:
52 % de descuento con el código APP52
62 % de descuento con el código APP62
Un deepfake es una sustitución de cara en un vídeo hecha con inteligencia artificial, la misma técnica que se usa en cine. Hoy te enseño a hacerlo gratis con DeepFaceLab. En mi ejemplo pongo mi cara sobre una charla de Chema Alonso (con perdón, porque la mía es más bonita).
Antes de empezar: úsalo para aprender, para bromas con amigos que estén de acuerdo o para tus propios proyectos. Usar la cara de alguien sin su permiso para engañar, suplantarle, desprestigiarle o en contenido sexual puede ser delito, además de hacer mucho daño. Y si lo publicas, deja claro que es un montaje.
1. Descargar DeepFaceLab
- Entra en la página del proyecto DeepFaceLab en GitHub y baja hasta Releases. Hay descarga por torrent, magnet o MEGA.
- Elige la versión según tu tarjeta gráfica:
- NVIDIA RTX 3000 (la mía es una RTX 3080): la versión para RTX 3000.
- Otras gráficas (AMD, Intel o NVIDIA más modestas): la versión DirectX 12.
- El archivo descargado es un .exe, pero en realidad es un comprimido (el programa está hecho en Python). Ábrelo con 7-Zip y descomprímelo en una carpeta con espacio: pesa unos 2,5 GB comprimido y unos 4 GB descomprimido.
- Crea un acceso directo de la carpeta en el escritorio (clic derecho → Enviar a → Escritorio).
2. Cómo funciona
Dentro de la carpeta hay muchos archivos .bat: pequeños scripts que ejecutan el programa por pasos. Solo usaremos unos pocos (yo les pongo un guion delante para localizarlos). En casi todos basta con pulsar Intro para aceptar las opciones por defecto, que suelen ser las mejores.
3. Preparar los vídeos
En la carpeta workspace tiene que haber dos vídeos .mp4 con estos nombres exactos:
- data_dst.mp4 (destination): el vídeo donde quieres poner la cara.
- data_src.mp4 (source): un vídeo de la persona cuya cara vas a poner, grabado por ejemplo con el móvil, con la cara bien iluminada y en distintas posturas (mirando arriba, abajo, a los lados, hablando…) para que la IA aprenda sus gestos.
Consejos:
- Vídeos cortos (1-2 minutos) y a 720p o menos. Con un vídeo largo en 4K, el proceso puede tardar días.
- Mejor sin barba: la IA la lleva regular.
4. Los pasos, uno a uno
- 1) clear workspace: limpia el espacio de trabajo. Solo hace falta si ya habías hecho otro proyecto (¡borra lo anterior!).
- 2) extract images from video data_src: convierte el vídeo src en fotos. Intro a todo (formato por defecto).
- 3) extract images from video data_dst FULL FPS: lo mismo con el vídeo de destino.
- 4) data_src faceset extract: recorta las caras de esas fotos. Elige la tarjeta gráfica (opción por defecto) e Intro a todo. Tarda un rato.
- 4.1) data_src view aligned result: abre las caras extraídas. Borra las que estén mal (que no sean una cara, que salga otra persona, borrosas…). Con Ctrl + clic seleccionas varias; luego clic derecho → Eliminar.
- 5) data_dst faceset extract: recorta las caras del vídeo de destino.
- 5.1) data_dst view aligned results: revisa y borra las incorrectas.
- 6) train Quick96: el paso importante, el entrenamiento.
- 7) merge Quick96: monta la cara nueva sobre cada fotograma.
- 8) merged to mp4: genera el vídeo final.
5. El entrenamiento
Se abre una ventana de vista previa: a la izquierda las caras reales y a la derecha cómo las dibuja la IA. Al principio es un borrón; con cada iteración se parece más. Pulsa P para actualizar la vista previa.
- ¿Cuántas iteraciones? No hay una cifra mágica: depende de los vídeos y de tu ordenador. A partir de unas 20.000 empieza a verse algo decente. Para mi vídeo hice unas 400.000: casi dos días con el PC encendido (seguramente con 50.000 hubiera bastado).
- Puedes pararlo cuando quieras con Intro: guarda el progreso. Al volver a ejecutar el paso 6, continúa donde lo dejaste. Así puedes entrenar varios días sin dejar el PC encendido por la noche.
- Mientras entrena, no uses el ordenador para cosas pesadas: la gráfica va al máximo.
6. El merge: ajustar la cara
En el paso 7 se abre una ventana con los atajos de teclado. Pulsa Tab para ver el fotograma con la cara cambiada y ajusta:
- E / D: más o menos desenfoque del borde de la cara, para que se funda con la piel.
- R / F: desenfoque de movimiento, para cuando la cabeza se mueve.
- U / J: hacer la cara más pequeña o más grande.
- C: cambia el modo de transferencia de color, por si el tono de piel no encaja.
Sin pasarse: si abusas, sale una chapuza. Cuando te guste, pulsa Mayús + > para aplicarlo a todos los fotogramas. Al terminar, cierra las ventanas.
7. Exportar el vídeo
- 8) merged to mp4: versión rápida, para ver cómo va.
- 8) merged to mp4 lossless: sin pérdida de calidad, para el vídeo final.
Intro para aceptar el bitrate y, en un minuto o dos, tendrás en la carpeta workspace el archivo result.mp4 con tu deepfake.
Preguntas frecuentes
¿Necesito una NVIDIA?
No, la versión DirectX 12 funciona con otras gráficas, pero todo irá bastante más lento. Sin gráfica dedicada, el entrenamiento se eterniza.
La cara se ve borrosa
Falta entrenamiento (más iteraciones) o las caras de origen son de mala calidad. Graba el vídeo src con buena luz y más variedad de gestos.