Zo schrijf je AI-videoprompts: beschrijf de beweging, niet het plaatje
Door Het Fellowi-team · · 7 min leestijd

Dit is het ene idee dat de meeste slechte videoprompts repareert: bij beeld-naar-video heeft het beeld het halve werk al gedaan. Wat je uploadt naar Fellowi Video legt vast wie er in beeld is, wat die persoon draagt, waar hij staat, hoe het licht valt. Het model ziet dat allemaal. Dus als je prompt dertig woorden besteedt aan het herhalen daarvan, heb je het beginpunt twee keer beschreven en de volgende vier seconden helemaal niet. Het beeld doet het wat. De prompt doet het hoe het beweegt.
Als je onze gids voor het schrijven van afbeeldingsprompts hebt gelezen, let dan op hoe anders de klus is. Een afbeeldingsprompt bouwt een scène uit niets, dus detail is je vriend. Een videoprompt krijgt een afgemaakte scène en voegt tijd toe. Detail over de scène is nu ruis; detail over beweging is het signaal.
De vijf dingen die een videoprompt moet beantwoorden
Je hebt ze niet alle vijf in elke prompt nodig. Maar elke goede prompt beantwoordt er minstens twee of drie, en een zwakke meestal geen enkele.
1. Camera: beweegt hij, en hoe?
Stil, langzaam inzoomen door naar voren te bewegen, langzaam terugtrekken, een zachte pan naar links of rechts, een lichte handheld-drift. Noem er één. Een camera die langzaam beweegt is de makkelijkste manier om een stilstaand beeld als filmmateriaal te laten voelen, ook als er verder niets verandert.
2. Beweging van het onderwerp: wat doet de persoon of het voorwerp?
Een hoofd dat draait, een ademhaling, een glimlach die opkomt, haar dat opwaait in een briesje, vingers die zich om een kop sluiten. Klein en specifiek wint van groot en vaag. “Ze kijkt op en glimlacht” komt aan; “ze beweegt natuurlijk” laat het model gissen.
3. Tempo: hoe snel gebeurt dit allemaal?
Slow motion, realtime, een luie drift, een snelle blik. Tempo bepaalt of vier seconden als een moment voelen of als een montage. Bij twijfel: zeg “langzaam”. Langzaam leest als bedoeld; snel leest als chaos.
4. Sfeer en omgeving: wat verandert er in de wereld?
Flikkerend licht, gordijnen die bewegen, regen die begint, stoom van koffie, stof in een zonnestraal. Eén omgevingsdetail geeft de scène een hartslag en voorkomt dat de achtergrond opgeplakt lijkt.
5. Geluid: wat moeten we horen?
Fellowi Video genereert bij elke clip geluid, en in de prompt stuur je dat. Zachte regen, verkeer in de verte, een stille kamer met een klok, wind door bladeren, ingetogen achtergrondmuziek. Zeg je niets, dan kiest het model. Zeg je één ding, dan luistert het meestal.
Voor en na
Dezelfde startafbeelding in elk paar. Alleen de prompt verandert.
Een portret bij een raam
Voor:“Een mooie vrouw met lang donker haar in een wit overhemd staat bij een raam in een licht appartement.”
Dat is een onderschrift bij het beeld. Het model kent elk woord ervan al, en niets hier zegt wat er gebeurt.
Na:“Langzaam naar voren. Ze draait haar hoofd naar het raam en ademt zacht uit; een lok haar komt omhoog in een licht briesje. Het gordijn wiegt. Stille kamer, buiten een vaag stadsgeruis.”
Camera, beweging, omgeving en geluid in één adem, en niets uit het beeld herhaald.
Een bergmeer in de schemering
Voor:“Epische filmische zonsondergang boven een meer met bergen, dramatisch licht, 4K, hyperrealistisch.”
Bijvoeglijke naamwoorden over kwaliteit doen niets voor beweging, en “4K” is niet iets wat je van een 720p-clip kunt vragen.
Na:“Stille camera. Rimpelingen verspreiden zich langzaam over het water; wolken drijven naar rechts; het laatste licht op de toppen dooft een beetje. Wind over water, één vogel in de verte.”
Een gegenereerde foto uit het tabblad Foto
Voor:“Laat het bewegen. Realistisch. Ze loopt door de kamer, pakt haar telefoon, gaat op de bank zitten, lacht en zwaait naar de camera.”
Vier acties in vier seconden. Het model probeert ze allemaal en maakt er geen af.
Na:“Lichte handheld-drift. Ze werpt een blik op de camera en breekt in een langzame glimlach. Zacht binnenlicht flikkert. Gedempte muziek uit een andere kamer.”
Eén actie met een begin en een einde, en die past ruim in de clip. Wil je ook de wandeling naar de bank, dan is dat een tweede clip met een andere startafbeelding, geen langere zin. Ons artikel over je AI-foto’s animeren laat zien hoe je zo een reeks opbouwt.
Drie fouten die een clip verpesten
Het beeld opnieuw beschrijven
De meest voorkomende, en de meest vergeeflijke, omdat afbeeldingsprompts je precies dit aanleren. Test jezelf: bedek het plaatje en lees je prompt. Kan hij dienen als onderschrift bij de foto, dan heb je nog geen videoprompt geschreven. Schrap elk woord dat het model al kan zien en besteed ze aan beweging.
Te veel acties voor vier seconden
Een hoofd draaien kost ongeveer een seconde. Een glimlach nog een. Een stap of twee de rest. Dat is de hele clip. Alles voorbij twee duidelijke bewegingen wordt samengeperst tot een waas of stilzwijgend weggelaten. Kies het ene gebaar waar dit moment om draait en laat camera en omgeving de rest dragen.
Het beeld tegenspreken
Zit de persoon, vraag dan niet om te rennen. Is het nacht, vraag dan niet om fel zonlicht. Staat hij met de rug naar je toe, vraag dan niet om een close-up van zijn ogen. Het model moet het startbeeld respecteren, dus een prompt die ertegen vecht levert vervorming, morphing of een gezicht dat niet meer lijkt op het gezicht dat je uploadde. Werk met wat er in het plaatje zit: de beweging die je vraagt moet er een zijn waar precies dit beeld geloofwaardig in over kan gaan.
Een klein sjabloon om mee te beginnen
Vul in wat van toepassing is en verwijder de rest:
- Camera: stil / langzaam naar voren / langzaam terug / zachte pan / handheld-drift
- Onderwerp: één gebaar met een begin en een einde
- Tempo: langzaam / realtime
- Omgeving: één ding dat op de achtergrond beweegt
- Geluid: een of twee omgevingsgeluiden
Uitgeschreven: “Langzaam terug. Hij laat het boek zakken en kijkt naar de regen buiten. Lamplicht flikkert. Regen op glas, bladzijden die tot rust komen.” Dat is ongeveer twintig woorden, en het is een complete videoprompt.
Veelgestelde vragen
Hoe lang moet een videoprompt zijn?
Eén tot drie korte zinnen. Zit je boven de veertig woorden, dan beschrijf je waarschijnlijk het plaatje of stapel je acties. Schrap tot alleen beweging, tempo en geluid overblijven.
Moet ik noemen hoe de persoon eruitziet?
Alleen als het deel is van de beweging (“haar haar komt omhoog”, “zijn sjaal wappert”). Het uiterlijk ligt vast door het beeld; het herhalen verandert niets en verdringt de nuttige woorden.
Wat als de render mislukt?
Een mislukte render wordt nooit in rekening gebracht: coins worden terugbetaald en een plek uit het Director-tegoed komt terug. De gebruikelijke oplossing is vereenvoudigen: minder acties, een lager tempo en geen instructie die ruziet met de startafbeelding. Probeer het opnieuw met hetzelfde plaatje.
Mag ik om expliciete inhoud vragen?
Fellowi is een 18+-platform, en volwassen inhoud tussen volwassenen is toegestaan. Alles met minderjarigen of zonder instemming wordt botweg geweigerd. De regels hierboven gelden precies hetzelfde: beschrijf de beweging, houd het bij een of twee tellen en spreek het beeld niet tegen.
Waar probeer ik dit?
Open de studio via het toverstaf-icoon in de kop van de pagina, of ga rechtstreeks naar fellowi.com/video. Kies een startafbeelding, plak je prompt en kijk wat twintig goedgekozen woorden kunnen doen.