Leer hoe je met behulp van AI een videoscript schrijft, van de structuur van de prompt tot de lengte van het script, wat AI vaak verkeerd doet en hoe je het voltooide script omzet in een video.
Een videoscript schrijven met AI: een praktische handleiding
Vraag een taalmodel om een videoscript, en het geeft je er binnen ongeveer vier seconden een. Vraag of dat script bruikbaar is, en het antwoord is meestal nee.
Het concept komt binnen met een pakkende openingszin waar niemand voor zou stoppen met scrollen, zinnen die allemaal even lang zijn en een oproep tot actie die er aan het einde aan is geplakt. Het leest als een blogpost die iemand hardop heeft voorgelezen. Dat is geen modelfout. Het is wat er gebeurt als een algemene schrijftool om een specifieke opmaak wordt gevraagd zonder dat er informatie over die opmaak is gegeven.
De oplossing is niet een beter hulpmiddel. Het gaat erom te weten wat je moet specificeren vóór het genereren en wat je achteraf moet corrigeren.
Wat een videoscript daadwerkelijk moet bevatten

Een videoscript is geen proza. Het is een reeks instructies voor wat een kijker zal horen en zien, tot op de seconde nauwkeurig getimed. Een bruikbaar script bevat vijf elementen: een pakkende openingsscène in de eerste vijf seconden, één helder idee, gesproken commentaar, een visuele toelichting voor elk onderdeel en één duidelijke oproep tot actie.
Die definitie is belangrijk omdat ze het meeste verklaart van wat er misgaat. AI schrijft goede proza. Proza dat hardop wordt voorgelezen, wordt geen script; het wordt alsof iemand een artikel voorleest.
Twee eigenschappen onderscheiden de twee formaten:
- De video is lineair en kan niet worden overgeslagen. Een lezer kan naar het gewenste gedeelte springen. Een kijker krijgt te zien wat er daarna komt, in het tempo dat je bepaalt. Alles wat herlezen vereist, moet worden vereenvoudigd of weggelaten.
- Video draagt betekenis over via twee kanalen tegelijk. Vertelling en beeld werken samen, en een script dat slechts één van beide specificeert, laat de helft van de video ongedefinieerd.
Stap 1: Definieer de video voordat je de prompt geeft.
De meeste zwakke AI-scripts komen voort uit zwakke input. Een model dat de opdracht krijgt "schrijf een script over e-mailmarketing" weet niets over de lengte, doelgroep, het platform of het doel, dus produceert het het statistische gemiddelde van alle e-mailmarketingscripts die het ooit heeft gezien. Dat gemiddelde is precies het generieke concept waar mensen over klagen.
De vier invoeropties die elke prompt nodig heeft
Bepaal dit voordat je een tool opent:
- Publiek— Niet "marketeers" in de traditionele zin, maar "marketeers bij kleine bureaus die al campagnes uitvoeren en de openingsratio willen verbeteren."
- Doel— Wat de kijker daarna moet weten, voelen of doen. Eén uitkomst, niet drie.
- Platform— Een verticale clip van 30 seconden en een uitlegvideo van vijf minuten op YouTube vereisen een andere structuur, tempo en invalshoek.
- Toon— Instructief, conversatiegericht, gezaghebbend of energiek. Geef aan welke stijl u verkiest.
Specificiteit op deze vier gebieden draagt meer bij aan de kwaliteit van het script dan welke andere wijziging dan ook.
Bepaal eerst de lengte van je script.
Dit is de stap die bijna iedereen overslaat, en die meer herschrijven tot gevolg heeft dan wat dan ook.
Het tempo van de gesproken tekst ligt comfortabel rond de 140 woorden per minuut. Door terug te rekenen vanuit de beoogde speelduur, bepaal je het woordenbudget:
- 15 seconden— 35 woorden
- 30 seconden— 70 woorden
- 60 seconden— 140 woorden
- 90 seconden— 200 tot 220 woorden
- 3 minuten— 400 tot 450 woorden
- 5 minuten— 700 woorden
Voer het getal in de prompt in. Een model dat de opdracht krijgt om "een script van 60 seconden" te schrijven, zal dit meestal overschrijden, omdat het geen betrouwbaar gevoel heeft voor de duur van gesproken tekst. Een model dat de opdracht krijgt om "140 woorden aan gesproken tekst" te schrijven, zal de doelstelling veel vaker halen.
Controleer de maximale capaciteit van je productietool voordat je een runtime kiest. VidSpotAI'sAI-videogeneratorHet programma genereert video's van maximaal 10 minuten, variërend van een verticaal filmpje van 15 seconden tot een lange uitlegvideo. De lengte van het script kan dus worden bepaald door het onderwerp in plaats van door de tool zelf.
Stap 2: Schrijf een schrijfopdracht die een bruikbaar concept oplevert
Een vage aanwijzing leidt tot een vaag script. De onderstaande structuur plaatst alles wat het model nodig heeft aan het begin.
Een promptstructuur die werkt
Write narration for a [length]-word video script.
Audience: [specific description]
Goal: [what the viewer should do or understand]
Platform: [YouTube / TikTok / LinkedIn / product page]
Tone: [instructional/conversational/authoritative]
Structure:
- Hook (first 5 seconds): [the problem or payoff]
- Body: [2 to 4 key points]
- Close: [single call to action]
Write for the ear. Short sentences, contractions, no
subheadings, no bullet points in the narration itself.
De laatste regel is belangrijker dan hij lijkt. Zonder deze regel nemen modellen automatisch de geschreven opmaak aan: kopjes, lijsten en tussenwerpsels die hardop uitgesproken geen betekenis hebben.
Genereer scène voor scène, niet alles tegelijk.
Het opvragen van een volledig script in één keer levert een evenwichtig resultaat op, waarbij de belangrijkste elementen evenveel aandacht krijgen als het derde ondersteunende punt. Genereren in delen levert betere resultaten op:
- Genereer eerst vijf haakopties. Kies er één uit, of combineer er twee.
- Genereer het lichaam tegen de gekozen haak.
- Schrijf de afsluiting apart, zodat de oproep tot actie aansluit op de specifieke belofte die in de inleiding werd gedaan.
Dit duurt iets langer, maar levert steevast een sterkere opening op, en dat is het gedeelte dat bepaalt of er verder nog gekeken wordt.
Stap 3: Corrigeer de fouten die de AI consequent maakt
Elk gegenereerd script moet worden nagekeken. Vier problemen doen zich vaak genoeg voor om standaard te controleren.
Generieke haken
"In de snelle digitale wereld van vandaag" en "Heb je je ooit afgevraagd?" zijn statistische gemiddelden, geen openingszinnen. Vervang de eerste zin door iets dat specifiek is voor jouw onderwerp: een getal, een tegenspraak of een directe formulering van het probleem.
Gelijkmatig zinsritme
Generaties van gesproken tekst neigen naar zinnen van vergelijkbare lengte, wat mechanisch klinkt wanneer ze worden uitgesproken. Doorbreek dit patroon bewust. Laat na een lange verklarende zin een korte volgen. Lees het concept hardop voor, en de vlakke passages worden meteen duidelijk.
Ontbrekende details
Modellen produceren veilige, algemene uitspraken omdat algemeenheid kenmerkend is voor gemiddelden. Jouw script heeft de details nodig die alleen jij hebt: het exacte getal, het concrete voorbeeld, het specifieke hulpmiddel en wat er is gebeurd. Elke algemene bewering die je vervangt door een specifieke bewering versterkt het script.
Een oproep tot actie die niet aansluit bij de inleiding.
AI sluit vaak af met een standaard call-to-action (CTA) die niets te maken heeft met de openingsbelofte. Als de hook een oplossing voor een probleem beloofde, zou de afsluiting naar die oplossing moeten verwijzen, en niet naar een aanmelding voor de nieuwsbrief.
Stap 4: Het script formatteren voor productie
Een script dat alleen gesproken tekst bevat, laat alle visuele beslissingen onbeantwoord. De indeling met twee kolommen lost dit op en is in enkele minuten te maken.
Het schrift met twee kolommen
- Vertelling:"De meeste e-mailcampagnes mislukken al voordat de onderwerpregel goed en wel is."Visueel:Close-up van een inbox met ongeopende berichten.
- Vertelling:"Het probleem zit hem in de timing, niet in de tekst."Visueel:Gesplitst scherm, twee verzendtijden
- Vertelling:"Dit is wat er veranderde toen we naar dinsdag verhuisden."Visueel:Grafiek die de verschuiving van de openingsratio weergeeft
Elke rij hierboven vertegenwoordigt één scène. De linker kolom toont wat de kijker hoort; de rechter kolom toont wat de kijker ziet. Scènes duren ongeveer vijf tot vijftien seconden, dus een video van 90 seconden heeft acht tot twaalf rijen nodig.
Het zelf schrijven van de visuele beschrijving is belangrijk. Het vormt de leidraad voor alles wat je beeldmateriaal genereert of gebruikt, en vage visuele aantekeningen leiden tot vaag beeldmateriaal. Of die aantekeningen nu een stockbibliotheek of een generatieplatform zoals VidSpotAI voeden, de specificiteit die je in de juiste kolom stopt, bepaalt hoe dicht het eindresultaat bij je oorspronkelijke visie ligt.
Lees het hardop voor voordat je verdergaat.
Dit is de meest effectieve kwaliteitscontrole die er is, en de kosten ervan zijn gelijk aan de lengte van de video.
Lees het script in een normaal spreektempo. Zinnen waar je over struikelt zijn te lang. Passages die vlak klinken hebben ritmische variatie nodig. Woorden die je nooit hardop zou uitspreken, moeten worden vervangen. Als de speelduur te lang is, knip dan nu in in plaats van na de productie.
Stap 5: Zet het voltooide script om in een video.
Met een kant-en-klaar script van twee kolommen wordt de productie mechanisch in plaats van creatief. Het script specificeert immers al wat er gezegd wordt en wat er op het scherm verschijnt.
Twee routes dekken de meeste video's:
- Een presentator die het script voordraagt.Geschikt voor uitleg, opiniestukken en alles waarbij autoriteit belangrijker is dan demonstratie. AI-avatars maken dit praktisch zonder te hoeven filmen. VidSpotAI bevatAI-avatargeneratie met lipsynchronisatie in het Pro-abonnement, dat de door de presentator geleide voordracht van een voltooid script mogelijk maakt.
- Er is beeldmateriaal gegenereerd dat aansluit bij elke visuele aanwijzing.Geschikt voor procesuitleg, productinformatie en alles met een concreet onderwerp om te laten zien. De visuele kolom fungeert hier direct als aanzet tot het genereren van informatie, vandaar dat het specifiek uitschrijven ervan de moeite waard is.
De modelkeuze beïnvloedt hoe goed het eindresultaat overeenkomt met de visuele intentie. VidSpotAI stuurt verschillende generatiemodellen via één interface, waaronder Veo, Kling, Runway, Luma, Pixverse, Hailuo, Haiper, Seedance, Hunyuan en Midjourney. Hierdoor kan een scène die met het ene model niet goed werkt, met een ander model opnieuw worden gegenereerd in plaats van te worden geaccepteerd of afgewezen.
Een belangrijk punt om te weten tijdens de scriptfase: met ondersteuning voor meer dan 40 talen kan een script dat in één taal werkt, in andere talen worden gebruikt zonder de structuur te hoeven herschrijven. Eén script wordt zo meerdere gelokaliseerde video's in plaats van meerdere afzonderlijke schrijfklussen.
Aanpassingen na de generatie vinden plaats in de browsereditor, die bij alle abonnementen is inbegrepen. Een scène die te lang duurt of een fragment waar de gesproken tekst ontbreekt, kan worden gecorrigeerd zonder de video opnieuw op te bouwen.
Veelgemaakte fouten bij het schrijven van videoscripts met AI

Hieronder volgen de meest voorkomende fouten die mensen maken bij het schrijven van videoscripts met AI, en waarom elk van deze fouten het eindresultaat negatief beïnvloedt.
Het eerste ontwerp accepteren
De eerste output is een uitgangspunt. Het onbewerkt publiceren ervan is de meest voorkomende reden waarom door AI gegenereerde video's generiek overkomen.
Schrijven voor het oog in plaats van het oor.
Subkopjes, opsommingstekens en opmerkingen tussen haakjes horen thuis in documenten. Hardop uitgesproken klinken ze verkeerd.
De lengteberekening overslaan
Een script dat zonder woordenbudget is geschreven, is bijna altijd te lang, en het schrappen ervan na de productie kost veel meer dan ervoor.
De visuele kolom leeg laten
De voice-over alleen is al de helft van een script. Alles wat de beelden genereert, heeft regie nodig, en "kantoorscène" is geen regie.
Gebruik één prompt voor elke video.
Een prompt die is afgestemd op een socialmediafilmpje van 30 seconden, levert een slechte uitlegvideo van vijf minuten op. Pas de structuur aan, niet alleen het onderwerp.
De praktische conclusie
Een videoscript schrijven met AI werkt het beste als het model wordt behandeld als een hulpmiddel voor het opstellen van teksten, en niet als een schrijver. Definieer de doelgroep, het doel, het platform en de toon. Bereken het aantal woorden op basis van de speelduur. Genereer de hook apart van de rest van het script. Bewerk het script vervolgens op details, ritme en een afsluiting die aansluit op de opening.
De redactionele beslissingen blijven bij u. Wat verandert, is de tijd tussen het krijgen van een idee en het daadwerkelijk vastleggen of produceren ervan. Vroeger duurde dat uren, nu slechts minuten.
Zodra het script klaar is, ligt de meeste resterende inspanning in de productiefase. VidSpotAI neemt die fase voor zijn rekening: van tekst naar video enbeeld naar videoGeneratie van avatars voor door de presentator geleide secties, een keuze aan modellen voor verschillende visuele stijlen en een browsereditor om scènes na generatie aan te passen. Elk abonnement biedt een gratis proefperiode van één dag.
Veelgestelde vragen
Hoe lang moet een door AI gegenereerd videoscript zijn?
Ga uit van de looptijd en neem ongeveer 140 woorden per minuut. Een video van 60 seconden heeft ongeveer 140 woorden aan gesproken tekst nodig, en een uitlegvideo van drie minuten 400 tot 450 woorden. Het specificeren van het aantal woorden in je opdracht levert nauwkeurigere resultaten op dan het specificeren van de duur.
Kan AI zelfstandig een compleet videoscript schrijven?
Het kan een volledig concept produceren, maar geen afgewerkt script. Gegenereerde concepten hebben doorgaans een specifieke openingszin, een gevarieerd zinsritme, concrete details en een oproep tot actie nodig die aansluit op de opening. Het concept bewaart het lege blad; de bewerkingsronde maakt het bruikbaar.
Wat is de beste schrijfopdracht voor een videoscript?
De meest effectieve aanwijzingen specificeren het publiek, het doel, het platform, de toon, het beoogde aantal woorden en de structuur, en instrueren het model vervolgens om voor het oor te schrijven in plaats van voor de pagina. Vage aanwijzingen leiden tot generieke scripts, omdat een model zonder beperkingen het gemiddelde geeft van alles wat het heeft gezien.
Moet het script visuele aanwijzingen bevatten?
Ja. Een script met twee kolommen, waarbij elke gesproken regel gekoppeld is aan een visuele notitie, definieert beide kanalen van de video. De visuele kolom dient tevens als uitgangspunt voor het genereren of verzamelen van beeldmateriaal, dus het specifiek uitschrijven ervan verbetert het eindresultaat.
Hoe voorkom ik dat een AI-script robotachtig klinkt?
De meeste robotachtige voordracht komt voort uit het script, niet uit het stemmodel. Lange zinnen met veel bijzinnen geven een verteller geen ademruimte, en een formeel register klinkt stijf als het hardop wordt uitgesproken. Het inkorten van zinnen en het toevoegen van samentrekkingen lost meer op dan het aanpassen van de instellingen voor de voordracht ooit zal doen.
