VidspotAI logovidspotai
door Anoniem Sep 20, 2026

Hoe maak je AI-trainingsvideo's?

Hoe maak je AI-trainingsvideo's?

Leer hoe je AI-trainingsvideo's kunt plannen, scripten en produceren voor onboarding, compliance en vaardigheidsontwikkeling, zonder te hoeven filmen of een productiebudget te hebben.

Hoe maak je trainingsvideo's voor AI: een praktische handleiding

A person editing a training video across dual monitors in a home office

Het produceren van één trainingsvideo op de traditionele manier kost doorgaans tussen de 40 en 100 uur aan totale inspanning: script schrijven, acteurs inplannen, filmen, monteren en goedkeuringsrondes. Wanneer een beleid verandert of een proces wordt bijgewerkt, moet de video volledig opnieuw worden gemaakt.

AI neemt het grootste deel van die overhead weg. Een team dat gebonden is aan traditionele productietermijnen kan realistisch gezien van een paar modules per kwartaal naar meerdere per week gaan. De beperkende factor is niet langer de productiecapaciteit, maar de kwaliteit van de inhoud en het pedagogische ontwerp.

Deze handleiding beschrijft het volledige proces: hoe je trainingsmateriaal voor video structureert, welk formaat geschikt is voor elk type training, hoe je de video produceert zonder te filmen en wat je moet doen als de informatie verandert.

Waarom trainingsvideo's falen: wat AI verandert

De meest voorkomende reden waarom trainingsvideo's mislukken, heeft niets te maken met de productiekwaliteit. Ze zijn te lang.

Het percentage voltooide video's daalt aanzienlijk bij video's langer dan 15 minuten, en trainingsvideo's presteren het best bij een lengte van 3 tot 7 minuten per module. Een introductieprogramma voor nieuwe medewerkers van 45 minuten wordt niet boeiend omdat het goed geproduceerd is. Het moet worden opgedeeld in vijf korte modules, die elk één ding behandelen dat de cursist kan onthouden en toepassen.

De tweede reden waarom trainingsvideo's falen, is relevantie. Generieke content die niet aansluit bij de rol, tools of workflow van de cursist, vraagt van de kijker om extra vertaalwerk te verrichten om de link met zijn of haar werk te leggen. Die vertaling vindt zelden plaats.

AI pakt beide problemen aan. Een capabele AIAI-videogeneratorDit maakt het produceren van veel korte, specifieke video's economisch haalbaar. Een team dat voorheen moest kiezen tussen één dure video en helemaal niets, kan nu een aparte module maken voor elke rol, elke tool en elke processtap, en deze onafhankelijk van elkaar bijwerken wanneer er iets verandert.

Soorten trainingsvideo's en welk formaat het meest geschikt is voor elk type.

Verschillende trainingsdoelen vragen om verschillende formats. Het kiezen van het verkeerde format is de op één na meest voorkomende structurele fout, na het kiezen van de verkeerde lengte.

  • Inwerken en cultuur— Door een presentator geleid of geanimeerd — 3 tot 5 minuten
  • Software- of procesdemonstratie— Schermopname met voice-over — 2 tot 4 minuten per taak
  • Naleving en beleid— Door een presentator geleid met voorbeelden uit verschillende scenario's — 2 tot 4 minuten
  • Productkennis— Gemengd: presentator plus zelfgemaakt beeldmateriaal — 3 tot 6 minuten
  • Soft skills en communicatie— Scenario-gebaseerd of onder leiding van een presentator — 4 tot 7 minuten

Video's met een presentatorIn deze video's is er een persoon te zien, gefilmd of gegenereerd door AI, die de inhoud rechtstreeks presenteert. Video's met een presentator zijn geschikt voor introducties, culturele content en onderwerpen waarbij naast de informatie ook de toon en de relatie met de kijker belangrijk zijn.

Schermopnamevideo'sDeze video's zijn de standaard voor softwaretrainingen en tonen de daadwerkelijke interface in gebruik. De beelden moeten afkomstig zijn van een schermrecorder; AI verzorgt de voice-over, de kadrering en de montage rondom de beelden.

Gegenereerde videobeeldengebruik tekst-naar-video ofbeeld-naar-videoDe uitvoer dient als visuele laag onder de gesproken tekst. Ze zijn geschikt voor productkennis, conceptuele uitleg en procesoverzichten waarbij geen interface getoond hoeft te worden, maar het onderwerp wel baat heeft bij visuele ondersteuning.

De meeste trainingsvideo's van enige complexiteit gebruiken meer dan één format binnen dezelfde module.

Hoe maak je AI-trainingsvideo's: stap voor stap

A team reviewing a video storyboard and script on a large screen in a workshop

De volgende zes stappen volgen elkaar in chronologische volgorde op, van contentontwerp tot productie en distributie. Stappen 1 en 2 betreffen de redactie en vinden plaats voordat er een programma voor contentgeneratie wordt gebruikt. Stappen 3 tot en met 6 behandelen de productie.

Stap 1: Definieer het leerdoel

Elke trainingsvideo moet één leerdoel hebben: een specifiek gedrag, een vaardigheid of een stukje kennis dat de kijker na het bekijken van de video zal verwerven.

Niet "ons nalevingsbeleid begrijpen". Dat is een onderwerp op zich.

"Identificeer de drie situaties die een verplichte melding vereisen en het formulier dat voor elk daarvan moet worden ingevuld." Dat is een doelstelling.

Het onderscheid is belangrijk omdat het doel het script, de vorm, de lengte en de succesindicator bepaalt. Een video zonder een duidelijk omschreven doel is een presentatie die toevallig is opgenomen.

Formuleer de doelstelling als een meetbaar resultaat. Gebruik de volgende structuur: "Na het bekijken van deze video is de kijker in staat om [specifieke actie] te ondernemen."

  • "Identificeer phishingpogingen en meld deze via het interne ticketsysteem."
  • "Vul het wekelijkse urenformulier in binnen drie minuten."
  • "Geef feedback met behulp van het driedelige model dat in de managementtraining is geïntroduceerd."

Eén doelstelling per video. Als de inhoud twee doelstellingen vereist, zijn er twee video's nodig.

Stap 2: Schrijf een script dat geschikt is voor video, niet voor documenten.

De grootste fout die gemaakt wordt bij het produceren van trainingsvideo's voor AI is het zonder aanpassingen omzetten van een beleidsdocument of presentatie naar een script. Documenten zijn geschreven voor lezers. Scripts zijn geschreven voor luisteraars.

Een document zou bijvoorbeeld kunnen luiden: "Werknemers zijn verplicht om binnen 30 dagen na hun indiensttreding een verplichte cybersecuritytraining te volgen. Daarna is jaarlijks een herhalingstraining vereist, zoals beschreven in paragraaf 4.2 van het personeelshandboek."

Een voorbeeld van dezelfde informatie: "Je hebt 30 dagen vanaf je startdatum om de cybersecuritytraining af te ronden. Daarna komt deze training jaarlijks terug. Beide trainingen zijn verplicht."

De luisteraar hoort de informatie één keer en moet die direct begrijpen. Formeel taalgebruik, geneste bijzinnen en verwijzingen naar documenten zijn niet vertaalbaar.

Gebruik een lay-out met twee kolommen: de tekst aan de ene kant, de visuele beschrijving aan de andere.

  • Vertelling:"Er zijn drie situaties die altijd een meldingsplicht vereisen."Visueel:Titelkaart: "3 situaties die een melding vereisen"
  • Vertelling:"Ten eerste is er sprake van een vermoedelijk datalek, zelfs als je daar niet zeker van bent."Visueel:Pictogram of afbeelding die een datalek weergeeft
  • Vertelling:"De tweede betreft een klacht van een klant over de facturering."Visueel:Pictogram dat een factuurgeschil weergeeft
  • Vertelling:"De derde categorie betreft elk verzoek van een regelgevende instantie."Visueel:Pictogram dat een regelgevende instantie vertegenwoordigt

De visuele beschrijving dient als uitgangspunt bij het maken van de video. Door al in de scriptfase specifieke visuele beschrijvingen te schrijven, bespaar je later tijd bij het genereren van de video.

Scriptlengte.Bij een natuurlijk spreektempo van ongeveer 150 woorden per minuut vereist een module van 3 minuten ongeveer 450 woorden script, en een module van 5 minuten ongeveer 750 woorden. Bepaal het streefdoel voordat je begint met schrijven, want scripts die zonder streefdoel worden geschreven, zijn bijna altijd te lang.

Stap 3: Kies uw productieaanpak

De juiste aanpak hangt af van wat de trainingsvideo moet laten zien.

Door een presentator geleid (geen opnames nodig).Voor onboarding, compliance, soft skills en cultuurcontent presenteert een spreker het script rechtstreeks aan de kijker. AI-avatars met lipsynchronisatie maken filmen overbodig. Dit werkt wanneer een menselijk gezicht geloofwaardigheid uitstraalt en het materiaal geen interface of fysiek proces hoeft te tonen. Het Pro-abonnement van VidSpotAI omvat eenAI-avatarGenerator met lipsynchronisatie, waarmee een presentator elk trainingsscript kan geven zonder camera of studioboeking.

Schermopname plus gegenereerde omgeving.Softwaretraining vereist de daadwerkelijke interface op het scherm. Die beelden worden opgenomen met een schermrecorder; zowel macOS als Windows hebben er een, en de meeste teams hebben een voorkeursprogramma. Schermopname levert het bewijs: het laat precies zien op welke knop geklikt moet worden en waar het menu-item verschijnt. AI-generatie verzorgt alles eromheen: de inleidende context, de presentator die uitlegt wat de cursist te zien krijgt, de gesproken toelichting bij elke stap en de afsluitende samenvatting.

Volledig gegenereerd.Productkennis, conceptuele uitleg, procesoverzichten en trainingen in internationale communicatie vereisen vaak geen beeldmateriaal. Tekst-naar-video-generatie creëert de visuele laag; het script verzorgt de gesproken tekst. Dit is de meest flexibele aanpak en de snelste manier om op grote schaal te produceren, met name voor meertalige content.

Stap 4: Genereer de video

Met een script in twee kolommen en een gekozen aanpak wordt het genereren systematisch.

Stem het model af op de inhoud.Verschillende generatiemodellen produceren verschillende looks: van fotorealistische en geïllustreerde stijlen tot strakke, zakelijke visuals. VidSpotAI beheert tien modellen via één interface: Veo, Kling, Runway, Luma, Pixverse, Hailuo, Haiper, Seedance, Hunyuan en Midjourney. Voor trainingsmateriaal is visuele consistentie binnen een module belangrijker dan fotorealisme. Kies een model en blijf dit gedurende de hele reeks gebruiken.

Aanwijzing uit de visuele rubriek.De visuele beschrijving in het script is de aanwijzing. "Een pictogram dat een factuurgeschil voorstelt" is een beginpunt; "een close-up van een telefoonscherm met een klantenservicechatinterface, een strakke witte achtergrond en professionele belichting" levert iets bruikbaars op. Specifieke aanwijzingen leveren over het algemeen bruikbarere resultaten op dan vage aanwijzingen.

Besteed de inspanningen aan de herontwikkeling rond de opening.De eerste 10 seconden zijn cruciaal om de aandacht vast te houden. Het percentage voltooide video's wordt sterk beïnvloed door de mate waarin de aandacht in de eerste paar seconden wordt vastgehouden. Besteed daarom meer tijd aan het herstellen van de aandacht in die eerste seconden dan in de middelste gedeelten.

VidSpotAI genereert video's van maximaal 10 minuten, waarmee alle bovenstaande formaten worden ondersteund, van een compliance-module van 2 minuten tot een diepgaande productanalyse van 7 minuten. Voor teams die een complete trainingsbibliotheek willen samenstellen, biedt VidSpotAI een oplossing.AI-videoagentHet Pro-abonnement maakt autonoom videocreatie mogelijk op basis van een script, waarbij een complete eerste versie wordt geproduceerd zonder handmatige scène-assemblage.

Stap 5: Voeg gesproken tekst en ondertiteling toe

AI-voice-over is de standaard voor trainingsmateriaal op grote schaal, vooral omdat het snelle updates mogelijk maakt: verander het script, genereer de voice-over opnieuw en de video is actueel. Stem de stemtoon af op het type training: content over compliance profiteert van een duidelijke, afgemeten voordracht; onboarding kan warmer en meer conversatiegericht zijn.

Veel werknemers in het bedrijfsleven bekijken trainingsvideo's zonder geluid, op hun mobiel, in gedeelde ruimtes of tijdens het woon-werkverkeer. Trainingsvideo's zonder ondertiteling verliezen deze kijkers volledig.

VidSpotAI ondersteunt meertalige uitvoer in meer dan 40 talen, waardoor een trainingsvideo die in één taal is geproduceerd, versies voor andere markten kan genereren zonder de scriptstructuur te hoeven aanpassen. Nauwkeurigheid is bij trainingsondertiteling belangrijker dan in de meeste andere contexten; controleer de ondertiteling daarom zorgvuldig aan de hand van het script voordat u deze publiceert.

Stap 6: Beoordelen, aanpassen en distribueren

Voer deze drie controles uit voordat je een trainingsvideo publiceert:

Bekijk de video zonder geluid.Als het leerdoel niet duidelijk is aan de hand van de beelden en bijschriften alleen, is de video te afhankelijk van gesproken uitleg.

Controleer elke procedurele bewering.Controleer bij softwaretrainingen of elke stap overeenkomt met de huidige interface. Controleer bij compliance-trainingen of alle beleidsverwijzingen actueel zijn.

Neem de tijd op voor de verschillende onderdelen.Als een segment langer dan 90 seconden duurt zonder visuele verandering, is de oplossing om het op te splitsen in kortere visuele fragmenten.

VidSpotAI's browsergebaseerdeAI-video-editorDeze functie, beschikbaar in alle abonnementen, verwerkt correcties op scèneniveau na de generatie. Een verkeerd getimede overgang, een onjuiste clip of een verouderd beeldmateriaal wordt gecorrigeerd in plaats van opnieuw opgebouwd. Controleer voor distributie of het exportformaat compatibel is met het LMS voordat u de productie afrondt, aangezien de formaatvereisten per platform verschillen.

Trainingsbibliotheken actueel houden

De grootste verborgen kostenpost bij de productie van trainingsvideo's zit niet in de initiële creatie, maar in het onderhoud.

Een trainingsbibliotheek die is opgebouwd uit gefilmd materiaal raakt verouderd telkens wanneer een tool wordt bijgewerkt, een beleid verandert of een proces wordt herzien. Elke update vereist nieuwe opnames: nieuwe acteurs boeken, nieuwe montage en een nieuwe goedkeuringsronde.

Door AI gegenereerde trainingscontent is vaak makkelijker bij te werken dan gefilmde content. Wanneer een script verandert, genereer je de betreffende voice-over en scènes opnieuw en publiceer je het materiaal opnieuw. De visuele consistentie blijft behouden omdat dezelfde modelinstellingen dezelfde stijl produceren voor de hele serie.

Beschouw elke trainingsvideo als een levend document in plaats van een afgerond product. Bewaar het script bij het videobestand. Als er iets verandert, werk dan eerst het script bij en genereer vervolgens alleen de betreffende gedeelten opnieuw.

Veelgemaakte fouten bij het maken van trainingsvideo's voor AI

A person reviewing a training video production checklist and error logs at a desktop workstation

Verschillende veelvoorkomende fouten kunnen de duidelijkheid, kwaliteit en effectiviteit van AI-trainingsvideo's beïnvloeden. De volgende problemen kunnen de uiteindelijke video verzwakken.

Schrijven voor lezers in plaats van luisteraars.

Beleidstaal en technische documentatie lenen zich niet goed voor een voice-over. Elke zin moet ook bij normaal luisteren duidelijk hoorbaar zijn.

Eén lange video in plaats van een reeks modules.

Een trainingsvideo van 20 minuten die zes onderwerpen behandelt, zal een lagere voltooiingsgraad hebben dan zes video's van 3 minuten die elk één onderwerp behandelen. Verdeel de inhoud daarom al vroeg in het planningsproces in kortere modules.

Het leerdoel overslaan

Een video zonder een duidelijk omschreven doel is content, geen training. Training vereist een duidelijk omschreven doel en een manier om het leerproces te meten.

Generieke afbeeldingen

Trainingsmateriaal profiteert van specificiteit: de branche van de cursist, de daadwerkelijke tools die hij of zij gebruikt en de echte interface waarop de training plaatsvindt. Vage aanwijzingen voor het genereren van beelden leiden tot vage beelden die er net zo goed uit kunnen zien als elke andere bedrijfsvideo.

Publiceren zonder de bijschriften te controleren

Automatische ondertiteling verminkt regelmatig technische termen, productnamen en regelgeving. Controleer de ondertiteling aan de hand van het script voordat u deze publiceert.

Het gegenereerde concept wordt beschouwd als de definitieve output.

De opening en de afsluiting van een trainingsmodule zijn de belangrijkste onderdelen. De opening bepaalt of er überhaupt iemand naar het middenstuk kijkt. De afsluiting bepaalt wat de cursist ervan opsteekt. Plan voor beide onderdelen voldoende tijd in om op adem te komen.

Veelgestelde vragen

Hoe lang moet een trainingsvideo voor AI zijn?

De effectieve lengte voor trainingen op de werkplek ligt tussen de 3 en 7 minuten per module. Het aantal voltooide modules neemt sterk af bij modules langer dan 15 minuten. Voor langere onderwerpen is het beter om de inhoud op te splitsen in een reeks korte modules in plaats van de lengte van één video te vergroten.

Kan AI een trainingsvideo maken zonder te filmen?

Ja, voor de meeste soorten trainingen. Trainingen over onboarding, compliance, soft skills, productkennis en bedrijfscultuur kunnen volledig door AI worden gegenereerd met behulp van presentatoravatars en gegenereerd beeldmateriaal. Softwaretrainingen vormen hierop een uitzondering; het beeldmateriaal van de interface moet nog steeds afkomstig zijn van een schermrecorder, omdat AI-generatie een specifieke softwareomgeving mogelijk niet betrouwbaar kan nabootsen.

Hoe houd ik trainingsvideo's actueel wanneer processen veranderen?

Bewaar het scriptbestand samen met de video. Wanneer een proces of beleid verandert, werk dan het script bij en genereer vervolgens alleen de betreffende gesproken tekst en scènes opnieuw. Door AI gegenereerde trainingscontent is aanzienlijk sneller bij te werken dan gefilmde content, omdat er geen nieuwe opnames nodig zijn.

Kunnen trainingsvideo's in meerdere talen worden geproduceerd?

Ja. VidSpotAI ondersteunt meer dan 40 talen, dus een trainingsmodule die in één taal is gemaakt, kan gelokaliseerde versies genereren zonder de visuele structuur opnieuw op te bouwen. Elke versie moet nog wel een controleronde ondergaan om de timing van de gesproken tekst en de nauwkeurigheid van de ondertiteling te bevestigen voordat deze wordt verspreid.

Wat is het verschil tussen een trainingsvideo en een uitlegvideo?

Trainingsvideo's hebben een duidelijk omschreven leerdoel en worden beoordeeld op basis van de vraag of de kijker na het bekijken een specifieke vaardigheid of kennis kan demonstreren. Uitlegvideo's informeren of overtuigen doorgaans zonder een meetbaar leerresultaat. Het productieproces is vergelijkbaar, maar trainingsvideo's vereisen een strakker script en zijn meestal gekoppeld aan een toets of vervolgactiviteit.

Bouw je trainingsbibliotheek op met AI.

VidSpotAI bestrijkt het volledige productieproces: van tekst-naar-video en beeld-naar-video conversie, tot AI-avatars voor modules met een presentator, een keuze aan generatiemodellen voor visuele consistentie in een serie en een browsereditor voor correcties op scèneniveau. Elk abonnement biedt een gratis proefperiode van één dag.