VidspotAI logovidspotai
ved Anonym Aug 18, 2026

Hvordan skrive et videomanus med AI

Hvordan skrive et videomanus med AI

Lær hvordan du skriver et videomanus med AI, fra promptstruktur til manuslengde, hva AI gjør feil, og hvordan du gjør det ferdige manuset om til en video.

Hvordan skrive et videomanus med AI: En praktisk guide

Spør en språkmodell om et videoskript, og den vil gi deg et på omtrent fire sekunder. Spør om skriptet er brukbart, og svaret er vanligvis nei.

Utkastet kommer med en krok ingen ville slutte å bla etter, setninger som alle er like lange, og en oppfordring til handling på slutten. Det leses som et blogginnlegg noen bestemte seg for å si høyt. Det er ikke en modellfeil. Det er hva som skjer når et generelt skriveverktøy blir bedt om et spesialisert format uten informasjon om formatet.

Løsningen er ikke et bedre verktøy. Det er å vite hva man skal spesifisere før generering og hva man skal korrigere etterpå.

Hva et videoskript egentlig må inneholde

What a video script actually needs to contain: strong hook, one clear idea, spoken narration, matching visuals, call to action

Et videomanus er ikke prosa. Det er et sett med instruksjoner for hva en seer vil høre og se, tidsbestemt til sekundet. Et brukbart manus inneholder fem ting: en krok i de første fem sekundene, én klar idé, en muntlig fortellerstemme, et visuelt notat for hver seksjon og en enkelt oppfordring til handling.

Den definisjonen er viktig fordi den forklarer det meste av det som går galt. KI skriver prosa godt. Høytlest prosa blir ikke et manus; det blir en person som leser en artikkel.

To egenskaper skiller de to formatene:

  • Videoen er lineær og kan ikke hoppes over. En leser kan hoppe til den delen de trenger. En seer mottar det som kommer etterpå, i det tempoet du setter. Alt som er avhengig av gjenlesning må forenkles eller kuttes.
  • Video bærer mening i to kanaler samtidig. Fortelling og visuelle elementer fungerer sammen, og et manus som bare spesifiserer én av dem, lar halve videoen være udefinert.

Trinn 1: Definer videoen før du ber om det

De fleste svake AI-skript kommer fra svake input. En modell gitt «skriv et skript om e-postmarkedsføring» har ingen måte å vite lengden, målgruppen, plattformen eller formålet, så den produserer det statistiske gjennomsnittet av hvert e-postmarkedsføringsskript den har sett. Det gjennomsnittet er akkurat det generiske utkastet folk klager over.

De fire innspillene enhver ledetekst trenger

Bestem deg for dette før du åpner et verktøy:

  • Publikum– Ikke «markedsførere», men «markedsførere i små byråer som allerede kjører kampanjer og ønsker å forbedre åpningsratene».
  • Mål– Hva seeren bør vite, føle eller gjøre etterpå. Ett resultat, ikke tre.
  • Plattform– Et 30 sekunder langt vertikalt klipp og en fem minutter lang YouTube-forklaring trenger forskjellige strukturer, tempo og hooks.
  • Tone— Instruksjonsmessig, samtalemessig, autoritativ eller energisk. Si hvilken.

Spesifisitet i disse fire feltene gjør mer for manuskvaliteten enn noen annen enkeltendring.

Regn ut manuslengden først

Dette er trinnet nesten alle hopper over, og det forårsaker mer omskriving enn noe annet.

Fortellerstemme ligger komfortabelt rundt 140 ord per minutt. Å jobbe bakover fra målkjøretiden gir et ordbudsjett:

  • 15 sekunder— 35 ord
  • 30 sekunder— 70 ord
  • 60 sekunder— 140 ord
  • 90 sekunder— 200 til 220 ord
  • 3 minutter— 400 til 450 ord
  • 5 minutter— 700 ord

Skriv inn tallet i ledeteksten. En modell som blir bedt om å skrive «et 60-sekunders manus» vil vanligvis overdrive, fordi den ikke har noen pålitelig forståelse av talevarighet. En modell som blir bedt om å skrive «140 ord med fortelling» treffer blinken mye oftere.

Sjekk produksjonsverktøyets maksimale kapasitet før du bestemmer deg for en kjøretid. VidSpotAIAI-videogeneratorgenererer videoer på opptil 10 minutter, som dekker alt fra et 15-sekunders vertikalt klipp til en lang forklaring, slik at manuslengden kan styres av motivet snarere enn av verktøyet.

Trinn 2: Skriv en ledetekst som produserer et brukbart utkast

En vag prompt produserer et vagt skript. Strukturen nedenfor laster inn alt modellen trenger på forhånd.

En rask struktur som fungerer

Write narration for a [length]-word video script.

Audience: [specific description]
Goal: [what the viewer should do or understand]
Platform: [YouTube / TikTok / LinkedIn / product page]
Tone: [instructional/conversational/authoritative]

Structure:
- Hook (first 5 seconds): [the problem or payoff]
- Body: [2 to 4 key points]
- Close: [single call to action]

Write for the ear. Short sentences, contractions, no
subheadings, no bullet points in the narration itself.

Den siste linjen er viktigere enn den ser ut til. Uten den bruker modeller som standard skriftlig formatering: overskrifter, lister og parenteser som ikke gir mening når de blir sagt høyt.

Generer scene for scene, ikke alt på én gang

Å be om et komplett manus i én utdata gir noe jevnt vektet, der hooken får samme oppmerksomhet som det tredje støttepunktet. Generering i deler gir bedre resultater:

  1. Generer først fem alternativer for hook. Velg ett, eller kombiner to.
  2. Generer kroppen mot den valgte kroken.
  3. Skriv avslutningen separat, slik at handlingsfremmende oppfordring samsvarer med det spesifikke løftet som ble gitt i kroken.

Dette tar marginalt lengre tid og gir konsekvent en sterkere åpning, som er den delen som avgjør om noe annet blir sett.

Trinn 3: Fiks det AI konsekvent gjør feil

Alle genererte skript trenger en redigeringsprosess. Fire problemer dukker opp pålitelig nok til å kunne sjekkes som standard.

Generiske kroker

«I dagens hektiske digitale verden» og «Har du noen gang lurt på det?» er statistiske gjennomsnitt, ikke åpninger. Erstatt den første linjen med noe spesifikt for emnet ditt: et tall, en selvmotsigelse eller en direkte beskrivelse av problemet.

Enhetlig setningsrytme

Generert fortelling tenderer mot setninger av lignende lengde, noe som høres mekanisk ut når det leses. Bryt mønsteret bevisst. Etter en lang forklarende setning følger en kort. Les utkastet høyt, og de flate passasjene blir umiddelbart åpenbare.

Manglende spesifikasjoner

Modeller produserer trygge, generelle utsagn fordi generalitet er hva gjennomsnitt ser ut som. Skriptet ditt trenger detaljene som bare du har: det faktiske tallet, det virkelige eksemplet, det spesifikke verktøyet og det som skjedde. Hver generisk påstand du erstatter med en spesifikk styrker skriptet.

En oppfordring til handling som ikke samsvarer med kroken

AI avsluttes ofte med en standard handlingsfremmende oppfordring som ikke er relatert til åpningsløftet. Hvis kroken lovet en løsning på et problem, bør avslutningen peke på den løsningen, ikke på en påmelding til et nyhetsbrev.

Trinn 4: Formater skriptet for produksjon

Et manus som bare inneholder fortellerstemme lar alle visuelle avgjørelser være ugjort. Tokolonneformatet løser dette og tar minutter å bygge.

To-kolonneskriptet

  • Fortelling:«De fleste e-postkampanjer mislykkes før emnelinjen.»Visuell:Nærbilde av en innboks, uåpnede meldinger
  • Fortelling:«Problemet er timing, ikke kopi.»Visuell:Delt skjerm, to sendetider
  • Fortelling:«Her er hva som endret seg da vi flyttet til tirsdag.»Visuell:Diagram som viser endring i åpningsrate

Hver rad ovenfor er én scene. Venstre kolonne er det seeren hører; høyre er det de ser. Scener varer omtrent fem til femten sekunder, så en 90-sekunders video trenger åtte til tolv rader.

Det er viktig å skrive den visuelle kolonnen selv. Den blir ledetråden til det som genererer eller kildekilder opptakene dine, og vage visuelle notater produserer vage opptak. Enten disse notatene gir næring til et arkivbibliotek eller en genereringsplattform som VidSpotAI, er det spesifisiteten du legger inn i høyre kolonne som avgjør hvor nært resultatet kommer til det du så for deg.

Les det høyt før du går videre

Dette er den mest effektive kvalitetskontrollen som er tilgjengelig, og den koster videoens lengde.

Les manuset i normalt taletempo og -tid. Setninger du snubler over er for lange. Passasjer som føles flate trenger rytmevariasjon. Ord du aldri ville sagt høyt må erstattes. Hvis timingen går over, kutt nå i stedet for etter produksjonen.

Trinn 5: Gjør det ferdige manuset om til video

Med et ferdig manus med to kolonner blir produksjonen mekanisk snarere enn kreativ. Manuset spesifiserer allerede hva som sies og hva som vises på skjermen.

To ruter dekker de fleste videoene:

  • En programleder som fremfører manuset.Passer til forklaringer, meningsinnlegg og alt der autoritet er viktigere enn demonstrasjoner. AI-avatarer gjør dette praktisk uten filming. VidSpotAI inkludererAI-avatargenerasjon med leppesynkronisering på Pro-abonnementet, som håndterer presentatørledet levering av et ferdig manus.
  • Genererte opptak som matcher hver visuelle note.Passer til prosessforklaringer, produktinnhold og alt som har et konkret emne å vise. Her blir den visuelle kolonnen direkte genereringsledetekst, og det er derfor det lønner seg å skrive den spesifikt.

Modellvalg påvirker hvor godt resultatet samsvarer med den visuelle intensjonen. VidSpotAI ruter flere generasjonsmodeller gjennom et enkelt grensesnitt, inkludert Veo, Kling, Runway, Luma, Pixverse, Hailuo, Haiper, Seedance, Hunyuan og Midjourney, slik at en scene som ikke fungerer med én modell kan regenereres med en annen i stedet for å bli akseptert eller forlatt.

Et poeng som er verdt å vite i skriptfasen: med støtte for over 40 språk kan et skript som fungerer på ett språk produseres på andre uten å omskrive strukturen. Et enkelt skript blir til flere lokaliserte videoer i stedet for flere separate skrivejobber.

Justeringer etter generering skjer i nettleserredigereren, som er inkludert i alle planer. En scene som er lang eller et klipp som mangler fortellerstemmen kan korrigeres uten å bygge videoen på nytt.

Vanlige feil når du skriver videomanus med AI

Common mistakes when writing video scripts with AI

Følgende er de vanligste feilene folk gjør når de skriver videomanus med AI, og hvorfor hver av dem svekker det endelige resultatet.

Godtar det første utkastet

Det første resultatet er et utgangspunkt. Publisering av det uredigert er den vanligste grunnen til at AI-skrevne videoer føles generiske.

Å skrive for øyet i stedet for øret

Underoverskrifter, punktlister og parenteser hører hjemme i dokumenter. Når de uttales høyt, høres de feil ut.

Hopper over lengdeberegningen

Et manus skrevet uten et ordbudsjett blir nesten alltid langt, og det koster mye mer å kutte etter produksjon enn å kutte før det.

Lar visuell kolonne stå tom

Bare fortellerstemme er halve manuset. Uansett hva som genererer opptakene dine trenger regi, og «kontorscene» er ikke regi.

Bruk én ledetekst for hver video

En melding som er justert for et 30-sekunders sosialt klipp gir en dårlig fem minutters forklaring. Juster strukturen, ikke bare emnet.

Den praktiske lærdommen

Å skrive et videomanus med AI fungerer når modellen behandles som et tegneverktøy snarere enn en forfatter. Definer målgruppen, målet, plattformen og tonen. Beregn ordbudsjettet fra kjøretiden. Generer hooken separat fra brødteksten. Rediger deretter for spesifikasjoner, rytme og en avslutning som samsvarer med åpningen.

De redaksjonelle avgjørelsene blir værende hos deg. Det som endrer seg er tiden fra du har en idé til du har noe å spille inn eller generere, noe som tidligere ble målt i timer og nå tar minutter.

Når manuset er ferdig, er det produksjonstrinnet der mesteparten av den gjenværende innsatsen ble lagt ned. VidSpotAI dekker dette stadiet: tekst til video ogbilde til videogenerasjon, avatarer for presentatørledede seksjoner, et utvalg av modeller for ulike visuelle stiler og en nettlesereditor for justering av scener etter generasjon. En gratis prøveperiode på én dag er tilgjengelig for hvert abonnement.

Vanlige spørsmål

Hvor langt bør et AI-generert videoskript være?

Arbeid bakover fra spilletid med omtrent 140 ord per minutt. En 60-sekunders video trenger omtrent 140 ord med fortellerstemme, og en tre minutters forklarende tekst trenger 400 til 450. Å spesifisere ordantall i oppgaven gir mer nøyaktige resultater enn å spesifisere varigheten.

Kan AI skrive et komplett videomanus på egenhånd?

Det kan produsere et komplett utkast, men ikke et ferdig manus. Genererte utkast trenger pålitelig en spesifikk hook, variert setningsrytme, konkrete detaljer og en handlingsfremmende oppfordring som samsvarer med åpningen. Utkastet lagrer den blanke siden; redigeringsprosessen gjør den brukbar.

Hva er den beste oppfordringen til å skrive et videomanus?

De mest effektive promptene spesifiserer målgruppe, mål, plattform, tone, antall ord og struktur, og instruerer deretter modellen til å skrive for øret i stedet for siden. Vage prompter produserer generiske skript, fordi en modell uten begrensninger returnerer gjennomsnittet av alt den har sett.

Bør manuset inneholde visuelle instruksjoner?

Ja. Et skript med to kolonner som kombinerer hver fortellerstemmelinje med et visuelt notat, definerer begge kanalene i videoen. Den visuelle kolonnen blir også oppfordringen til å generere eller hente frem opptak, så det å skrive den spesifikt forbedrer det endelige resultatet.

Hvordan kan jeg hindre at et AI-skript høres robotisk ut?

Mesteparten av robotisk fremføring har sitt opphav i manuset, ikke stemmemodellen. Lange setninger med mange leddsetninger gir fortelleren ingen steder å puste, og formelt register lyder stivt når det snakkes høyt. Å forkorte setninger og legge til sammentrekninger fikser mer enn det justering av fortellerstemmene noen gang vil gjøre.

Gjør det ferdige manuset ditt om til en video

VidSpotAI dekker produksjonstrinnet: generering av tekst til video og bilde til video, avatarer for presentatørledede seksjoner, et utvalg av genereringsmodeller for ulike visuelle stiler og en nettleserredigerer for justering av scener etter generering. En gratis prøveperiode på én dag er tilgjengelig for hvert abonnement.