Paso 01 — Descríbelo y añade frames
Escribe tu prompt y luego añade frames de referencia — una imagen inicial y un frame final opcional para dirigir el movimiento exactamente como quieras.
Transforma una imagen de referencia en un clip de vídeo con indicaciones de texto, control de fotograma final y una guía visual tipo CLIP-Guided Diffusion para mantener el concepto estable de principio a fin.





De una idea escrita a un vídeo listo para publicar — sin configuración, sin plugins, sin Discord.
Escribe tu prompt y luego añade frames de referencia — una imagen inicial y un frame final opcional para dirigir el movimiento exactamente como quieras.
Elige tu resolución (720p, 480p) y la duración del clip (2–12s). Una resolución más alta se ve más nítida; los clips más cortos se renderizan más rápido.
Haz clic en generar y espera unos minutos. Seedance Lite crea tu vídeo. Descárgalo y úsalo como quieras, o ajusta tu prompt y crea otra versión.

Primero se sube una imagen objetivo que actúa como ancla visual del clip. Después se escribe el prompt (Text to Video) indicando acción, cámara y ambiente, y se puede añadir una imagen como función de fotograma final para fijar el último frame. La herramienta aplica una guía tipo CLIP-Guided Diffusion para mantener la intención del texto alineada con la referencia y reducir cambios bruscos entre fotogramas.

Para e-commerce, permite animar una foto de producto con un giro suave y terminar en un encuadre limpio usando el fotograma final. En redes sociales, convierte una ilustración o key visual en un clip corto con movimiento de cámara y micro-acciones descritas por texto. En branding, ayuda a mantener estilo y composición cuando se necesitan varias versiones del mismo concepto con variaciones mínimas.

Conviene revisar la estabilidad de contornos y texturas en zonas críticas (manos, tipografías, bordes del producto) y detectar parpadeos entre fotogramas. Si el resultado se desvía del concepto, se ajusta el prompt para acotar movimiento y se refuerza la referencia con una guía CLIP-Guided Diffusion más estricta. Cuando el cierre es importante (packshot, pose o logo), se valida que el último frame coincide con la imagen marcada como fotograma final.

En Cleep AI, el modelo se usa como un paso claro dentro del flujo creativo: referencia visual, dirección por texto y cierre controlado. Esto facilita iterar sin perder consistencia cuando se necesitan varias tomas cortas a partir de un mismo key visual. Además, el enfoque de Image-to-Video con guía CLIP-Guided Diffusion reduce la distancia entre lo que se describe y lo que aparece en pantalla.

Sube una imagen, describe el movimiento con Text to Video y decide cómo debe terminar el plano con la función de fotograma final. En pocos intentos puedes comparar versiones y quedarte con la que mantiene mejor el estilo y la intención. Empieza en Cleep AI y valida el resultado con una revisión de fotogramas clave antes de publicarlo.
