Eén korte clip maken, van leeg scherm tot afgemaakt bestand
Door The Fellowi Team · · 8 min leestijd

Ik wilde één clip van tien seconden: een vrouw op een balkon bij nacht, de stad achter haar, het soort shot waarmee iets zou openen. Niets ambitieus. Het kostte een minuut of veertig en 3.150 coins, en opschrijven waar die heen gingen is nuttiger dan welke nette handleiding ook, want het grootste deel van die veertig minuten ging niet aan typen op.
Eerst de route kiezen, waar ik het bijna verkeerd deed
Mijn reflex was alles in tekst beschrijven en het model laten verzinnen. Dat zou de verkeerde keuze zijn geweest, en de reden is het enige wat je vooraf moet weten: tekst naar video verzint de persoon ook, en elke run een andere.
Omdat ik een specifiek uiterlijk wilde dat de hele clip zou overleven, was het antwoord: eerst een still maken en die animeren. Had ik golven op een pier of nachtelijk verkeer gewild, dan was tekst prima geweest en had ik een stap bespaard. Die hele beslissing is één zin lang, en het vergelijkingsstuk levert hem.
De still: vier beelden, 160 coins
Standardkwaliteit, 40 coins per stuk. De eerste was te licht, op de tweede keek ze in de lens terwijl ik haar wegkijkend wilde, de derde klopte maar was te ruim gekaderd, de vierde was het.
Eén ding deed ik bewust, omdat ik het op de dure manier had geleerd: ik schreef de still als een startbeeld, niet als een goede foto. Dat betekent dat het onderwerp in rust is en niet midden in een gebaar, want een still die er al uitziet als het midden van een beweging laat het videomodel nergens heen. En de achtergrond is onscherp, omdat drift zich daar het eerst laat zien.
Eerste clip: vier seconden, 500 coins, mis
Schets op vier seconden en 720p met een turbomodel, de goedkoopste bruikbare combinatie die er is. Mijn prompt beschreef de scène: het balkon, de stadslichten, haar haar, de sfeer.
Het kwam terug alsof de still licht was aangestoten. Nauwelijks beweging, en wat er was voelde doelloos.
De fout is achteraf duidelijk en ik maak hem elke keer als ik een week geen video heb aangeraakt. De still had al gezegd hoe de scène eruitziet. Dat herhalen in de prompt gaf mijn hele instructiebudget uit aan informatie die het model al had. Een videoprompt hoort te gaan over wat beweegt.
Tweede clip: vier seconden, 500 coins, bijna
Herschreven met alleen beweging: een langzame ademhaling, haar haar licht opgetild door de wind, de stadslichten die zacht van scherpte verschuiven achter haar, camera stil. Vier zinnen, allemaal over verandering in de tijd.
Enorm verschil. Nu was het een shot en geen wiebelende foto. Toch nog niet goed: doordat de camera stilstond leek het op beveiligingsbeelden. Nuttig om te leren, want het betekende dat de variabele de camera was, en die had ik niet aangeraakt.
Derde clip: vier seconden, 500 coins, dit is hem
Precies één ding veranderd. Stilstaande camera werd “very slow push in”. De rest identiek.
Dat was het shot. Een lichte beweging naar het onderwerp toe doet iets met de aandacht wat niets binnen het kader alleen kan, en het kostte één zin.
Dezelfde discipline als bij beelden: één variabele per poging. Bij video is die belangrijker, niet minder, want elke poging kost twaalf keer zoveel.
Vastleggen op duur: tien seconden, 1.250 coins
Pas nu, met beweging en camera geregeld, draaide ik het opnieuw op tien seconden. Dezelfde prompt, hetzelfde startbeeld, langere duur.
Dit is het deel van de werkwijze dat werkelijk geld bespaart. Tien seconden is 1.250 coins op 720p turbo; ik deed de proeven op 500 en betaalde de tienseconden-prijs één keer, aan het eind. Andersom eet één clip een groot pakket op, en de prijsladder is steil genoeg dat die discipline zich meteen terugbetaalt.
Een eerlijke kanttekening: de langere versie is niet simpelweg de vierseconden-versie verlengd. Hij wordt opnieuw gegenereerd, dus de beweging is vergelijkbaar maar niet identiek. Soms is de langere take slechter en draai je hem nog eens. Reken op die mogelijkheid in plaats van erdoor verrast te worden.
Geluid: niets
Letterlijk niets te doen. De clip kwam als één MP4 met een audiospoor er al in, gemaakt voor dezelfde scène, en de prijs veranderde niet. Ik had “distant traffic, wind” in de prompt gezet en dat was ongeveer wat erin zat.
Dit is de stap die vroeger de helft van het werk was, en nu de stap die niet bestaat. Meer daarover in het stuk over gegenereerd geluid.
De eindafrekening
- 4 stills à 40 coins: 160
- 3 schetsclips van vier seconden: 1.500
- 1 eindclip van tien seconden: 1.250
- Totaal: 3.150 coins, ongeveer veertig minuten
Van die veertig minuten was er misschien zes typen. De rest was wachten op renders die minuten in plaats van seconden duren, en rondlopen met de vraag of de vorige goed genoeg was. Dat ritme is het echte verschil met werken aan beelden: je kunt niet snel itereren, dus elke poging moet het waard zijn.
Wat ik mezelf vooraf zou zeggen: schrijf de still als startbeeld, beschrijf alleen beweging, verander één variabele, en blijf van de duur af tot de vierseconden-versie het shot is dat je wilt. De rest is geduld. Het gebeurt in Fellowi Video, en de gids voor videoprompts is de samengeperste versie van de twee clips die ik verspilde.