Trin 01 — Beskriv det og tilføj billeder
Skriv din prompt, og tilføj derefter referencebilleder — et startbillede og et valgfrit slutbillede for at styre bevægelsen præcis, som du vil have det.
Byg korte, sammenhængende klip fra et billede eller en reference—med lip-sync, stabil A/V-sync og mulighed for at generere lyd og video samlet, når formatet kræver det.






Fra en nedskrevet idé til en publiceringsklar video — ingen opsætning, ingen plugins, ingen Discord.
Skriv din prompt, og tilføj derefter referencebilleder — et startbillede og et valgfrit slutbillede for at styre bevægelsen præcis, som du vil have det.
Vælg opløsning (720p, 480p, 1080p) og kliplængde (2–12s). Højere opløsning ser skarpere ud; kortere klip renderes hurtigere.
Klik på generer og vent et par minutter. Wan 2.5 laver din video. Download den og brug den, som du vil, eller juster din prompt og lav en ny version.

Upload et billede eller en kort referencevideo, og angiv ønsket bevægelse, stil og varighed. Til talende scener tilføjes lyd, så modellen kan lave lip-sync og holde A/V-sync stabil gennem klippet. Når det giver mening, kan der arbejdes med native audio-video generation for at få lyd og billede ud som én samlet version. Afslut med en hurtig gennemgang af mundbevægelser, timing og artefakter før eksport.

Marketingteams kan lave produkt- og kampagneklip fra stills, hvor bevægelse og tempo matcher SoMe-formater. E-commerce kan animere packshots og miljøbilleder til korte annoncer uden tung postproduktion. Kreative kan bygge talende karakterer med lip-sync til dansk voice-over, mens A/V-sync holder dialogen troværdig. Interne teams kan skabe hurtige forklaringsklip til onboarding og support, hvor lyd og video leveres samlet.

En praktisk kontrol er at se efter stabilitet i ansigt, hænder og kanter, især ved hurtige bevægelser. Til talende klip bør mundformer og lydens konsonanter passe, så lip-sync opleves naturlig, og A/V-sync ikke driver over tid. Vurder også støj, flimmer og uønskede forvrængninger i baggrunden, før der skaleres op i antal variationer. Til sidst testes output i det format, det skal ud i, så timing og lydniveauer sidder rigtigt.

Cleep AI samler workflowet, så input, generering og eksport kan håndteres uden at hoppe mellem mange værktøjer. Det gør det lettere at iterere på stil, tempo og udtryk, mens synkronisering og lydvalg holdes konsistente på tværs af versioner. Teams får en mere forudsigelig proces til både stille produktklip og talende scener med lip-sync. Resultatet er hurtigere godkendelser og mindre manuelt oprydningsarbejde.

Start med et enkelt billede og få et klip, der kan bruges som udkast, annoncevariant eller proof-of-concept. Tilføj lyd, når der skal være tale, og tjek lip-sync og A/V-sync før du sender videre til godkendelse. Når tempoet er sat, kan du lave flere versioner til forskellige kanaler uden at miste retning. Åbn Cleep AI og kom i gang på få minutter.
