Sådan dekonstrueres video-prompts: Et shot-by-shot-workflow
En referencevideo er sjældent blot ét prompt. Det er en sekvens af skud (shots), og hvert skud har sit eget subjekt, handling, kamerabevægelse, belysning, lyd og overgang. Denne guide viser, hvordan du forvandler den sekvens til strukturerede, genanvendelige AI-video-prompts uden at fladgøre hele klippet til et uklart resumé.
Du vil lære et praktisk workflow til dekonstruktion af video-prompts, et tidsstemplet output-skema, seks scene-gennemgange og en tjekliste til at konvertere resultatet til Veo, Runway, Seedance eller en anden målmodel.
Vil du have det første udkast automatisk? Upload et klip til PixMind Video to Prompt, og brug derefter denne guide til at inspicere og finjustere listen over skud.
Del 1: Kernekoncepter & parameter-snydeark
Hvad er dekonstruktion af video-prompts?
Dekonstruktion af video-prompts (reverse-engineering) betyder, at man analyserer et klip skud for skud og konverterer dets synlige og hørbare valg til et struktureret produktionssprog. I stedet for at gætte den oprindelige skabers prompt, dokumenterer du det, der faktisk er til stede: subjekt, handling, miljø, indramning, kamerabevægelse, belysning, farve, lyd og overgange.
Resultatet er ikke en retsmedicinsk kopi af kilden. Det er en redigerbar kreativ specifikation, som du kan genbruge med et andet subjekt, produkt, lokation eller en anden mål-videomodel.
Prompt-strukturen i fem lag
Ethvert stærkt video-prompt er opbygget af fem stablede lag:
| Lag | Hvad det fanger | Eksempler på beskrivelser |
|---|---|---|
| Subjekt | Hvem eller hvad der er i billedet | "a woman in a white linen dress" |
| Handling / Bevægelse | Hvad der bevæger sig og hvordan | "walking slowly through tall grass" |
| Miljø | Lokation, tidspunkt på dagen, vejr | "golden-hour meadow, soft wind" |
| Kamera | Billedbeskæring, bevægelse, linsekarakter | "wide tracking shot, slight lens flare" |
| Stil / Stemning | Æstetisk retning, farvegraduering, tone | "cinematic, warm tones, film grain" |
Snydeark til kerneparametre
| Parameter | Standardudgangspunkt | Avancerede muligheder |
|---|---|---|
| Billedbeskæring | Medium shot | Extreme close-up / aerial |
| Bevægelseshastighed | Normal speed | Slow motion / time-lapse |
| Belysning | Natural daylight | Golden hour / neon backlight |
| Farvegraduering | Neutral | Teal-orange / desaturated |
| Kamerabevægelse | Static | Dolly / handheld shake |
| Varigheds-hint | 5–8 sekunder | 15–30 sekunder |
| Lyd-hint | Ingen | Ambient sound / dialogue |
| Billedformat | 16:9 | 9:16 (vertikal) / 1:1 |
Kerneprincip: Start med de detaljer, der ændrer skuddet væsentligt, og tilføj derefter én kontrol ad gangen. Et kort, internt konsistent prompt er mere nyttigt end et langt prompt, der indeholder modstridende instruktioner om kamera, belysning eller handling.
Et shot-by-shot-outputskema til video-prompts
For klip med flere skud bør du oprette én registrering pr. skud i stedet for ét afsnit for hele videoen:
| Felt | Hvad der skal registreres | Eksempel |
|---|---|---|
| Tidskode | Start og slutning på skuddet | 00:04–00:07 |
| Subjekt | Synlig person, genstand eller produkt | Runner in a red windbreaker |
| Handling | Subjektets og miljøets bevægelse | Runner turns; rain blows left to right |
| Kamera | Billedbeskæring, vinkel og bevægelse | Low-angle medium shot, handheld tracking |
| Belysning og farve | Kilde, retning, kontrast, palette | Cool overcast key, muted blue shadows |
| Lyd | Dialog, atmosfære, effekter, musik | Footsteps, rain, low bass pulse |
| Overgang | Hvordan det næste skud begynder | Whip-pan cut on movement |
Dette skema adresserer direkte scene-for-scene-udtrækningssøgninger som f.eks. "AI prompt from clip to each scene". Det gør også fejl nemme at spotte: Hvis et værktøj markerer et fastlåst skud som et dolly-skud, kan du rette ét felt uden at skulle omskrive hele promptet.
Del 2: Scene-gennemgang — Kinematisk naturlandskab
Mål
Du finder et klip fra en rejsedokumentar: en tågeindhyllet bjergkæde ved daggry, en langsom luftbåren tilbagetrækning (aerial pull-back), ingen mennesker. Du ønsker at genskabe den atmosfære.
✅ Visuelt referenceeksempel
(Illustrativt eksempel — ikke et faktisk PixMind-modeloutput.)
Anbefalet prompt-skabelon
Aerial drone shot slowly pulling back from a mist-covered mountain ridge at dawn.
Pale blue and soft orange light filters through low clouds. Pine trees visible below.
No people. Cinematic color grade, anamorphic lens flare, 4K quality.
Mood: serene, vast, slightly melancholic.
Duration: ~8 seconds.
Trin-for-trin
- Slå lyden fra, og se klippet tre gange. Fokuser kun på, hvad kameraet gør — ignorer subjektets indhold i første omgang.
- Identificer den dominerende bevægelsesretning. I dette tilfælde: opad + bagud (pull-back).
- Navngiv lyskilden og dens kvalitet. Daggry = lav vinkel, diffust, varm-til-kold gradient.
- Kog stilen ned til 2–3 adjektiver. "Cinematic, serene, vast."
- Indsæt dine noter i PixMinds Video-to-Prompt-værktøj for automatisk at udtrække et udkast, og finjuster det derefter manuelt.
⚠️ Almindelig fejl
Undgå at skrive hele scenebeskrivelsen som én lang, sammenhængende sætning. Modeller som Veo 3 præsterer mærkbart bedre, når subjekt, bevægelse og stil er adskilt med linjeskift eller kommaer — at begrave det hele i et enkelt afsnit forringer outputkvaliteten.
Del 3: Scene-gennemgang — Produktreklame
Mål
En 10-sekunders skønhedsreklame: et produkt på en marmoroverflade, langsomt push-in, blød studiobelysning, pastelbaggrund. Du ønsker at udvinde en genanvendelig skabelon til produktvideoer.
✅ Visuelt referenceeksempel
(Illustrativt eksempel — ikke et faktisk PixMind-modeloutput.)
Anbefalet prompt-skabelon
Close-up slow zoom-in on a [product name] bottle placed on white marble surface.
Soft diffused studio lighting from upper-left. Pastel pink background, out of focus.
Subtle water droplets on the product. No hands, no people.
Elegant, minimal, luxury aesthetic. Smooth camera movement, no shake.
5-second clip, 16:9.
Trin-for-trin
- Sæt på pause ved tre keyframes i referencereklamen: starten, midten og slutningen.
- Læg mærke til, hvad der ændrer sig mellem billederne. Her ændrer kun kameraafstanden sig (push-in) — baggrunden og belysningen forbliver konstante hele vejen igennem.
- Identificer brandspecifikke elementer og udskift dem. Erstat produktnavnet og farvepaletten med dine egne.
- Test med PixMinds Seedance 2 AI-videogenerator — dens håndtering af produktreklamescener er specifikt optimeret til denne form for kontrollerede studieæstetik.
⚠️ Almindelig fejl
Undgå vage luksusbeskrivelser som "high-end" eller "premium". Beskriv i stedet de visuelle beviser på luksus: marmor, bløde skygger, minimalistisk komposition, langsomme bevægelser. Modeller reagerer på konkrete visuelle signaler, ikke abstrakte kvalitetsmærkater.
Del 4: Scene-gennemgang — Urban gadescene med mennesker
Mål
En video i gadefotografistil: et travlt lyskryds om natten, håndholdt kamera, neonlys, der reflekteres i våd asfalt, fodgængere, der bevæger sig hurtigt gennem billedet.
✅ Visuelt referenceeksempel
(Illustrativt eksempel — ikke et faktisk PixMind-modeloutput.)
Anbefalet prompt-skabelon
Handheld medium shot of a busy city intersection at night, wet pavement reflecting
neon signs in red, blue, and yellow. Crowds of people walking quickly in multiple
directions. Slight motion blur on pedestrians. Shallow depth of field.
Urban, gritty, high-contrast. Tokyo or New York aesthetic.
Camera: slight sway, no stabilization. 6–8 seconds.
Trin-for-trin
- Oplist alle lyskilder i scenen. Neonlys, forlygter, butiksvinduer — hver enkelt er en beskrivelse.
- Beskriv mængden af mennesker. "Sparse", "moderate" eller "dense" giver modellen et signal om befolkningstætheden.
- Fang kameraets personlighed. Håndholdt betyder bevidst ufuldkommenhed — skriv eksplicit "no stabilization" eller "slight camera sway".
- Brug PixMinds Text-to-Prompt-værktøj til at generere et basisudkast ud fra dine scenenoter, og tilføj derefter kamerabeskrivelser manuelt.
⚠️ Almindelig fejl
At navngive en specifik lokation fra den virkelige verden (f.eks. "Shibuya Crossing") hjælper med at etablere en æstetisk reference, men det kan ikke erstatte en visuel beskrivelse. Modeller ignorerer muligvis stednavnet og genererer en generisk gade. Beskriv altid det, du ser, og ikke kun hvor det er.
Del 5: Scene-gennemgang — Følelsesladet nærbillede-portræt
Mål
Et nærbillede i dokumentarstil: en ældre persons ansigt, naturligt lys fra et vindue, langsomt push-in, ingen dialog, eftertænksom atmosfære.
✅ Visuelt referenceeksempel
(Illustrativt eksempel — ikke et faktisk PixMind-modeloutput.)
Anbefalet prompt-skabelon
Slow push-in close-up of an elderly person's face, mid-60s, neutral expression,
thoughtful and calm. Natural soft light from a window on the left side.
Slight skin texture visible. Background: blurred warm interior.
Documentary style, desaturated color grade, no music cue.
Camera: very slow dolly-in, ultra-stable. 8 seconds.
Trin-for-trin
- Identificer det følelsesmæssige anker. Hvilket enkelt ord fanger stemningen? Her er det "contemplative". Skriv det eksplicit.
- Beskriv lysets retning og kvalitet. "Window light from the left" giver modellen langt mere at arbejde med end blot "natural light".
- Bemærk, hvad der bevidst mangler. Intet smil, ingen handling, ingen dialog — negative beskrivelser er lige så effektive som positive.
- Test på Veo — baseret på de annoncerede specifikationer håndterer Veo 3/3.1 realistiske nærbilleder af mennesker med stærk lysgengivelse særligt godt.
⚠️ Almindelig fejl
Angiv aldrig en virkelig persons ansigt eller lighed i et prompt. Beskriv i stedet demografiske og følelsesmæssige karakteristika. Dette holder dit prompt inden for modellens retningslinjer for brug og producerer mere ensartede resultater på tværs af flere genereringer.
Del 6: Scene-gennemgang — Action- / sportsoptagelser
Mål
En surfervideo: luftperspektiv, atlet der rider på en enorm bølge, slow motion, vandsprøjt der glitrer i sollyset, høj energi.
✅ Visuelt referenceeksempel
(Illustrativt eksempel — ikke et faktisk PixMind-modeloutput.)
Anbefalet prompt-skabelon
Aerial shot looking down at a surfer riding a large breaking wave, slow motion.
White water spray exploding upward, backlit by bright midday sun — sparkle effect.
Ocean: deep blue-green. Surfer: small relative to the wave.
High energy, dynamic composition. Camera: hovering drone angle, slight tilt.
Slow motion at 50% speed. 6 seconds, 16:9.
Trin-for-trin
- Etabler størrelsesforhold. "Surfer appears small relative to the wave" giver modellen et kompositionelt ankerpunkt.
- Beskriv, hvordan lyset interagerer med scenen. Modbelyst vandsprøjt skaber en glitrende/glorie-effekt — nævn det eksplicit.
- Angiv slow motion med et tal. "50% speed" eller "120fps playback" er tydeligere end blot at skrive "slow motion".
- Tjek Seedance 2-promptsiden for bevægelsesspecifikke prompt-strukturer, der er optimeret til scener med høj action.
⚠️ Almindelig fejl
Scener med høj action er der, hvor modeller producerer flest artefakter — forvrængede lemmer, forkert vandfysik. Tilføjelse af begrænsninger som "physically realistic water motion" eller "no distortion" reducerer sandsynligheden for disse problemer mærkbart.
Del 7: Scene-gennemgang — Brand Story / narrativ kortfilm
Mål
En 15-sekunders brand-film: en håndværkers hænder, der former ler på en drejeskive, varm værkstedsbelysning, nærbilleddetaljer, langsomme klip mellem skud.
✅ Visuelt referenceeksempel
(Illustrativt eksempel — ikke et faktisk PixMind-modeloutput.)
Anbefalet prompt-skabelon
Close-up of weathered hands shaping wet clay on a pottery wheel, slow deliberate
movement. Warm tungsten workshop light, dust particles visible in the air.
Background: blurred wooden shelves with ceramic pieces.
Tactile, artisanal, warm color grade. Camera: slow macro push-in on hands.
Ambient sound: soft spinning wheel, no music. 10–12 seconds.
Trin-for-trin
- Læg ud med teksturbeskrivelser. "Weathered hands", "wet clay", "wooden shelves" — taktilt sprog aktiverer en rigere visuel gengivelse.
- Tilføj detaljer om svævende partikler. "Dust particles visible in the air" tilføjer betydelig dybde og realisme uden at øge den kompositionelle kompleksitet.
- Inkluder et lyd-hint, hvis modellen understøtter det. Både Veo 3 og Seedance 2.5 understøtter indbygget lydgenerering — "ambient sound: soft spinning wheel" er et gyldigt og effektivt prompt-element.
- Se Seedance 2-brugsscenarier for produktreklamer for prompt-strukturer til brand-fortællinger, der er valideret mod kommercielt output.
⚠️ Almindelig fejl
Narrative prompts med flere skud (Skud A → Skud B → Skud C) har tendens til at forvirre modeller, der genererer enkelte klip. Hvis du har brug for klip mellem skud, bør du generere hvert klip separat og samle dem i redigeringen bagefter — forsøg ikke at beskrive en klippesekvens inde i et enkelt prompt.
Del 8: Universelt prompt-rammeværktøj & tjekliste før afsendelse
Universelt rammeværktøj til video-prompts
En struktur, der fungerer på tværs af alle scenetyper:
[Shot size] + [Subject] + [Action/Motion],
[Environment] + [Lighting],
[Camera movement] + [Camera character],
[Style/Color grade] + [Mood],
[Duration] + [Aspect ratio].
Optional: [Audio hint].
Udfyldt eksempel:
Wide tracking shot of a woman in a red coat walking through a snowy forest,
late afternoon light filtering through bare trees, soft blue shadows on snow.
Camera: slow lateral track, smooth and stable.
Cinematic, desaturated cool tones, quiet and melancholic.
8 seconds, 16:9. No dialogue.
Reference for prompt-længde
| Prompt-længde | Bedst til | Risiko |
|---|---|---|
| Under 30 ord | Hurtige test, udforskning af stil | For vagt, uensartet output |
| 40–80 ord | De fleste produktionsscenarier | Det ideelle punkt (sweet spot) |
| 80–120 ord | Komplekse scener med flere elementer | Mulige konflikter mellem elementer |
| Over 120 ord | Sjældent passende | Høj risiko for modsigelser |
Tjekliste før afsendelse
Gå igennem dette, før du indsender et video-prompt:
- [ ] Ingen modstridende bevægelsesinstruktioner — f.eks. kan "handheld" og "perfectly stable" ikke eksistere i det samme prompt.
- [ ] Lyskilden er navngivet — "natural light" er svagere end "golden-hour sidelight from the right."
- [ ] Kamerabevægelse er angivet — static, dolly, pan, tilt, handheld, aerial: vælg én og angiv den tydeligt.
- [ ] Subjektets størrelsesforhold er defineret — særligt vigtigt i landskaber, actionscener og billeder med menneskemængder.
- [ ] Stiladjektiver er visuelle, ikke abstrakte — "warm tones, film grain" slår "cinematic masterpiece."
- [ ] Varighed er inkluderet — modeller bruger varighed til at kalibrere bevægelsestempo og overgange.
- [ ] Ingen reference til virkelige personers lighed — beskriv fysiske og følelsesmæssige karakteristika, ikke en specifik identitet.
- [ ] Lyd-hint tilføjet til modeller, der understøtter det — lad ikke lydfeltet være tomt i prompts til Veo 3 eller Seedance 2.5.
Hurtig reference: Anbefalede PixMind-værktøjer efter trin
| Trin | Opgave | Anbefalet værktøj |
|---|---|---|
| 1 | Upload optagelser, få et prompt-udkast | Video-to-Prompt |
| 2 | Finpuds scenenoter til et poleret prompt | Text-to-Prompt |
| 3 | Generer video ud fra dit endelige prompt | Veo eller Seedance 2 |
| 4 | Gå dybere ned i prompt-strategi | YouTube Video-to-Prompt Guide |
Del 9: Samling på det hele
Text-to-prompt er grundlæggende en oversættelsesfærdighed — at konvertere visuel information til det specifikke ordforråd, som AI-modeller er trænet til at forstå. Jo mere præcist du beskriver det, du ser (frem for hvad du føler), jo mere konsistent kan modellen reproducere det.
Start med fem-lags-rammeværktøjet, brug den universelle skabelon som stillads, og kør tjeklisten igennem før hver afsendelse. Over tid vil du opbygge dit eget personlige bibliotek af testede prompt-skabeloner, som kan tilpasses til ethvert nyt projekt.
Den hurtigste måde at fremskynde den proces på: Brug PixMinds Video-to-Prompt-værktøj til automatisk at udtrække et udkast fra referenceoptagelser, og anvend derefter teknikkerne i denne guide til at finjustere det manuelt. Kombinationen af maskinel udtrækning og menneskelig finjustering overgår konsekvent begge metoder hver for sig.



