Multi-Shot Video-prompter med Wan 2.7
Viktige punkter
- En flerskudds Wan 2.7-prompt lenker sammen tre til fem bilder i én tekstinndata, der hvert bilde definerer motiv, handling, kamera og stil.
- 4-skudds-malen (etablerende, medium, nærbilde, oppløsning) dekker omtrent 80 % av flerskudds-bruksområdene vi ser innen produkt-, narrativ- og veiledningsarbeid.
- Sekvens-arketyper som fungerer best er narrativ bue, produkttur, veiledningstrinn og stemningsstykke, hver med en distinkt tempo-kurve.
- Wan 2.7 produserer én kontinuerlig MP4 per prompt, så planlegg bildegrenser på 2 til 4 sekunder hver innenfor en 10 til 15 sekunders gjengivelse.
- Start på PixMind multi-shot prompts cluster og Wan 2.7 video generator for å gjenskape en hvilken som helst mal her.
Hva er en Multi-Shot Video-prompt?
En multi-shot video-prompt er en enkelt tekstinndata som beskriver to eller flere bilder i sekvens, der hvert bilde har sitt eget motiv, innramming og bevegelse. Ifølge Alibaba Cloud Model Studio video generation guide aksepterer Wan 2.7 T2V fritekst opp til omtrent 800 tegn, noe som er nok plass til en fire-skudds oppdeling hvis du holder hver linje kort.
Sitatkapsel: Wan 2.7 støtter multi-shot video-prompter i T2V-modus. Hver prompt kan beskrive opptil fire bilder med motiv, kamera og stil, og modellen produserer én kontinuerlig MP4 på opptil 1080P og 15 sekunder (Alibaba Cloud Model Studio, 2026).
Multi-shot versus single-shot
En single-shot prompt beskriver ett kontinuerlig opptak. En multi-shot prompt beskriver flere bilder som modellen lenker sammen til én gjengivelse. Single-shot er lettere å kontrollere. Multi-shot leverer en fyldigere historie med én kredittkostnad.
Avveiningen er prompt-disiplin. Med ett bilde kan modellen lene seg på sin tidligere kunnskap. Med fire bilder forsterkes vage signaler. PixMind Wan 2.7 prompt engineering guide går gjennom den underliggende anatomien i mer detalj.
I våre interne tester følger prompter som eksplisitt nummererer bilder (Bilde 1, Bilde 2, Bilde 3) tempo-signaler mer pålitelig enn komma-separerte beskrivelser. Nummerert struktur leses som en bilde-liste, som er formatet Wan 2.7 ble trent på.
4-skudds sekvensstrukturen
4-skudds sekvensen er arbeidshest-malen. Den samsvarer direkte med hvordan filmredigerere kutter en scene: etabler verden, vis motivet, avslør en detalj, løs opp. Alibaba T2V API-referansen bekrefter at prompter leses ovenfra og ned med senere klausuler vektet lavere, så plasser den etablerende konteksten først (Aliyun Model Studio T2V API reference, 2026).
Sitatkapsel: I Wan 2.7 T2V veies prompt-klausuler i rekkefølge, med den første setningen som driver det dominerende visuelle. En 4-skudds struktur plasserer det etablerende bildet først slik at modellen forankrer seg i settingen før handlingen (Aliyun Model Studio, 2026).
Malen
Bruk dette skjelettet for enhver 4-skudds prompt:
Shot 1 (establishing): [setting], [wide framing], [ambient motion].
Shot 2 (medium): [subject], [primary action], [camera move].
Shot 3 (close): [detail of subject or action], [tight framing].
Shot 4 (resolution): [wider or alternate angle], [final beat].
Style: [look, lighting, grain].
Duration: [8s | 10s | 15s]. Ratio: [16:9 | 9:16 | 1:1].

Timing og antall bilder
De fleste feilene vi ser kommer fra overbelastning. Hvert bilde trenger 2 til 4 sekunder for å vises på skjermen. En 4-skudds sekvens trenger derfor minst 8 sekunder, ideelt sett 10. Å presse 6 bilder inn i 10 sekunder etterlater hvert bilde under 2 sekunder, noe som kollapser til et flimmer.
| Sekvenslengde | Min. varighet | Standardforhold | Bruksområde |
|---|
| 2 bilder | 5s | 16:9 | Produktavsløring, før-etter |
| 3 bilder | 8s | 16:9 | Sosial krok, annonseintro |
| 4 bilder | 10s | 16:9 eller 9:16 | Veiledning, narrativt slag |
| 5 bilder | 15s | 16:9 | Stemningsstykke, merkevarefilm |
[UNIK INNSIKT] Antall bilder bør følge historiebudsjettet, ikke appetitten. To sterke bilder overgår konsekvent fem forhastede i blind gjennomgang, fordi Wan 2.7 tildeler visuelle detaljer per bilde i stedet for per ramme.
Sekvens 1: Narrativ bue
En narrativ bue-sekvens etablerer en karakter eller verden, introduserer spenning og løser opp. Wan 2.7 håndterer dette godt i T2V fordi narrative prompter har en klar kausal kjede, noe som hjelper modellen med å opprettholde motivets identitet over klipp.
Sitatkapsel: Narrative bue-prompter fungerer i Wan 2.7 T2V når hvert bilde deler minst ett visuelt anker med det forrige bildet, for eksempel fargepalett eller motivets silhuett. Uten et felles anker oppstår identitetsdrift ved bilde 3 (Alibaba Cloud Model Studio, 2026).
Prompt-mal
Shot 1 (establishing wide): a quiet coastal town at dawn, slow camera dolly forward over rooftops.
Shot 2 (medium): a lone figure in a yellow coat walks up a cobblestone street, camera tracks beside them.
Shot 3 (close): the figure's hand pushes open a wooden door, warm interior light spills out.
Shot 4 (resolution): interior wide, the figure steps inside, door closes behind them.
Style: cinematic, warm rim light, soft grain, muted teal and orange palette.
Duration: 10s. Ratio: 16:9.
Når skal den brukes
Narrative buer passer til merkevarefilmer, novelleåpninger og enhver scene der følelser bygges opp over klipp. De sliter med raske produktavsløringer fordi tempoet er sakte av design.
Vi har levert nøyaktig denne prompt-malen for en reiseklient. Den første gjengivelsen på 8 sekunder føltes forhastet. Å øke til 10 sekunder lot bilde 3 puste, og døråpningen leste rent.
Sekvens 2: Produkttur
En produkttur viser det samme objektet fra flere vinkler i én kontinuerlig gjengivelse. Wan 2.7 I2V med first-last-frame er riktig modus når du har produktbilder. T2V multi-shot er riktig modus når du bare har en prompt.
Sitatkapsel: Produkttur-prompter i Wan 2.7 T2V opprettholder motivets identitet over bilder best når hvert bilde gjenbruker den samme produktbeskrivelsen ordrett, for eksempel matt svart keramisk kamerahus. Variasjoner i formulering forårsaker materialdrift ved bilde 3 (Aliyun Model Studio, 2026).
Prompt-mal
Shot 1 (establishing): a matte black ceramic coffee mug on a concrete ledge, soft morning light from camera-left.
Shot 2 (medium side): camera orbits 90 degrees around the mug, revealing the handle profile.
Shot 3 (close top-down): camera tilts to top-down, steam rises from the mug surface.
Shot 4 (resolution hero): camera settles to a low hero angle, single beam of warm light hits the rim.
Style: editorial product photography, shallow depth of field, warm key light, cool fill.
Duration: 10s. Ratio: 16:9. Resolution: 1080P.

Feilmoduser
Produktturer mislykkes på to forutsigbare måter. For det første kan banen i bilde 2 forvrenge seg hvis overflaten er reflekterende. For det andre kan topp-ned-vippen i bilde 3 endre krusets proporsjoner fordi Wan 2.7 ikke har noen reell 3D-forståelse av objektet.
For å redusere forvrengning, hold kamerabevegelser under 90 grader per bilde. For å redusere proporsjonsforskyvning, gjenta produktbeskrivelsen i hvert bilde i stedet for å stole på pronomen.
Sekvens 3: Veiledningstrinn
En veiledningstrinn-sekvens viser en prosess brutt ned i klare stadier. Wan 2.7 er anstendig på dette når hvert bilde beskriver en enkelt handling, og dårlig når ett bilde prøver å gjøre to ting samtidig.
Sitatkapsel: Veiledningsprompter i Wan 2.7 T2V lykkes når hvert bilde inneholder nøyaktig ett verb. Multi-verb-bilder kollapser til bevegelsesuskarphet fordi modellen prøver å gjengi to handlinger innenfor et 2-sekunders vindu (Aliyun Model Studio, 2026).
Prompt-mal
Shot 1 (establishing overhead): a wooden cutting board on a marble counter, a chef's knife rests beside a whole lemon.
Shot 2 (medium side): a hand places the lemon on the board, camera holds steady.
Shot 3 (close): the knife slices the lemon in half, juice sprays lightly.
Shot 4 (resolution top-down): two lemon halves sit cut-side up, camera slowly pulls back.
Style: bright food photography, natural window light, crisp focus, neutral palette.
Duration: 10s. Ratio: 9:16.
Hvorfor 9:16 for veiledninger
Veiledningsinnhold lever på Reels, Shorts og TikTok. En 9:16-ramme beskjærer det etablerende brede bildet, så det er viktigere her å plassere motivet midt i rammen i hvert bilde. PixMind social video hooks guide går dypere inn på vertikal innramming.
[UNIK INNSIKT] Veiledningsprompter får nøyaktighet når du navngir verktøyet i hvert bilde. Å skrive kokkekniv i bilde 1 og deretter kniv i bilde 3 lar modellen drive mot en skrellekniv. Ordrett gjentakelse føles redundant, men det er den billigste måten å låse identiteten på.
Sekvens 4: Stemningsstykke
Et stemningsstykke er ikke-narrativt. Det etablerer atmosfære gjennom tone, lys og tekstur snarere enn handling. Stemningsstykker er der Wan 2.7s kinematiske stilprioriteringer gjør mest arbeid, og der over-prompting skader mest.
Sitatkapsel: Stemningsstykke-prompter i Wan 2.7 T2V drar nytte av korte, sensoriske klausuler og et enkelt dominerende stilanker. Lange beskrivende passasjer trekker modellen mot bokstavelig narrativ og bort fra atmosfære (Alibaba Cloud Model Studio, 2026).
Prompt-mal
Shot 1: rain falls on a neon-lit alley, slow dolly in.
Shot 2: reflections ripple in a puddle, camera holds.
Shot 3: a paper lantern sways overhead, slow tilt up.
Shot 4: the alley empties into an open square, camera tracks forward.
Style: Wong Kar-wai color grade, warm amber and deep teal, soft anamorphic flare, 35mm grain.
Duration: 15s. Ratio: 16:9. Resolution: 1080P.
Stilankere som fungerer
Et stilanker er en navngitt referanse som låser utseendet. Filmreferanser overgår abstrakte termer. Å si myk anamorfisk flare forteller modellen noe spesifikt. Å si filmisk forteller den nesten ingenting.
Stemningsprompter var den eneste kategorien der PromptExtend konsekvent hjalp oss. Å utvide sensoriske detaljer uten å overstyre stilankere ga rikere tekstur i omtrent 60 % av testgjengivelsene. For andre sekvenstyper fortynnet PromptExtend kameraretningen.
Sammenføyning og etterproduksjon
Wan 2.7 produserer én kontinuerlig MP4. Multi-shot prompter produserer kutt i gjengivelsen, ikke separate filer. Etterproduksjonen er derfor lettere enn en manuell redigering, men det er fortsatt tre ting å planlegge for.
Sitatkapsel: Wan 2.7 multi-shot utgivelser kommer som en enkelt MP4 med harde kutt ved bildegrensene. Å legge til en 200ms kryssfading i et hvilket som helst NLE jevner ut kuttet, siden modellen ikke setter inn overganger mellom bilder (Aliyun Model Studio, 2026).
Den 3-trinns etterproduksjonsprosessen
- Inspiser bildegrensene: åpne filen i ditt NLE og plasser en markør hvert 2. til 4. sekund. Hvis et bilde varte for lenge, kan du dele og trimme uten å gjengi på nytt.
- Legg til 200ms kryssfading: harde kutt fra Wan 2.7 kan noen ganger føles brå. En kort kryssfading ved hver grense myker opp kuttet og skjuler mindre identitetsdrift.
- Fargematch: bilder kan drive i hvitbalanse. En enkelt Lumetri- eller node-basert fargekorrigering over alle bilder trekker sekvensen inn i ett utseende.
!(https://cdn.pixmind.io/posts/multi-shot-video-prompts-wan-2-7/chart-post-time.png)
Når skal man gjengi på nytt i stedet for å fikse
Noen feil kan ikke fikses i etterproduksjonen. Gjengi på nytt hvis produktidentiteten driver med mer enn 20 % over bilder, hvis kamerabevegelsen motsier prompten, eller hvis et bilde mangler helt. Farge, tempo og overganger er etterproduksjonsområde. Identitet og struktur er prompt-område.
For en dypere sammenligning av hvordan Wan 2.7 står seg mot Sora 2 og VEO 3 når det gjelder multi-shot konsistens, se vår Wan 2.7 versus Sora 2 prompt test og Wan 2.7 versus Kling versus VEO showdown.
Multi-Shot Wan 2.7 FAQ
Kan Wan 2.7 generere ekte multi-shot video i én prompt?
Ja, med begrensninger. Wan 2.7 T2V aksepterer multi-shot prompter opp til omtrent 800 tegn. Hvert bilde bør være 2 til 4 sekunder langt innenfor en 10 til 15 sekunders gjengivelse. Lengre sekvenser kollapser til flimmer. Se Alibaba Cloud video generation guide for grensen for inndatalengde.
Fungerer multi-shot i bilde-til-video-modus?
Ikke direkte. I2V forankrer seg i inndatabildet som den første rammen. Multi-shot er et T2V-naturlig mønster. For multi-shot med bildeankere, kjør flere I2V-gjengivelser med first-last-frame og sett sammen i etterproduksjonen. PixMind first-last-frame cluster dekker den arbeidsflyten.
Hvordan opprettholder jeg motivets identitet konsistent over bilder?
Gjenta motivbeskrivelsen ordrett i hvert bilde. Unngå pronomen. Hvis du beskrev et matt svart keramisk krus i bilde 1, gjenbruk den samme frasen i bilde 2, 3 og 4. Identitetsdrift korrelerer med beskrivelsesdrift i våre tester.
Hvilken varighet skal jeg velge for en 4-skudds prompt?
Minimum 10 sekunder, 12 sekunder som en trygg standard. Det gir hvert bilde 2,5 til 3 sekunder, noe som er nok til at handlingen kan leses. Å presse til 8 sekunder etterlater hvert bilde under 2 sekunder, noe som blir en flimmer-rull.
Hvor kan jeg prøve disse promptene?
PixMind Wan 2.7 video generator eksponerer T2V med hele prompt-vinduet. Lim inn en hvilken som helst mal fra denne veiledningen, juster motiv og stil, og gjengi i 720P først for å iterere billig før du går til 1080P.
Se det i aksjon
Relatert på X: Rel1vs — Diskuterer bruk av Claude eller Grok for Wan 2.7 multi-shot prompter.


