Paso 01 — Sube tus entradas
Añade una escena objetivo y una referencia de rostro para que el modelo conserve las señales clave de identidad mientras se ajusta a la composición objetivo.
En Cleep AI, este modelo permite re-renderizar un vídeo usando un clip objetivo y una referencia facial, manteniendo la estructura del contenido y mejorando la coherencia visual entre fotogramas.






De una escena objetivo y una referencia de rostro a resultados fieles al modelo: directamente en Cleep.ai.
Añade una escena objetivo y una referencia de rostro para que el modelo conserve las señales clave de identidad mientras se ajusta a la composición objetivo.
Define tu resolución de salida y la duración, y luego ajusta con qué fuerza la referencia de rostro guía el resultado.
Haz clic en generar y espera unos minutos. Wan VACE produce tu resultado. Descárgalo, o cambia las entradas y lanza un lote rápido.

Primero se sube el vídeo objetivo para que el sistema tome como base el movimiento, el encuadre y la secuencia. Después se añade una referencia facial para fijar identidad y reducir variaciones entre fotogramas. Al ejecutar el re-render, conviene revisar un preview y repetir con ajustes si aparecen cambios no deseados en elementos clave del contenido.

Sirve para re-renderizar tomas manteniendo la narrativa del clip, por ejemplo al unificar estilo visual en una serie de piezas sin rehacer la edición. También encaja en iteraciones de identidad (misma persona, distinta estética) cuando se necesita consistencia facial en planos consecutivos. En publicidad y social, permite probar variantes de look sin perder el timing del movimiento original.

La revisión debe centrarse en tres puntos: identidad estable, continuidad temporal y preservación de elementos del plano (fondo, objetos y encuadre). Para validar, se recomienda inspeccionar fotogramas clave y transiciones rápidas, donde suelen aparecer “saltos” o deformaciones. Si el resultado se desvía, conviene ajustar la referencia facial o acotar el estilo para priorizar la fidelidad al clip objetivo.

En entornos técnicos, es habitual identificar el modelo por sus pesos; una referencia común es Wan2_1_VACE_1_3B_preview_bf16.safetensors para ejecuciones de preview y pruebas rápidas. El sufijo “1.3B” suele indicar el tamaño aproximado del modelo, y “bf16” el tipo de precisión, lo que influye en consumo de VRAM y velocidad. Para producción, se recomienda empezar con un preview, verificar preservación de contenido y solo después lanzar un render más largo o de mayor calidad.

Sube un clip objetivo, añade una referencia facial y genera un preview para comprobar continuidad e identidad antes de exportar. Si el contenido no se preserva como esperas, repite con una referencia más limpia o ajusta el estilo para priorizar fidelidad. Cleep AI está pensado para iterar rápido sin perder el control del resultado.
