🔥MiniMax H3 official 50% off|Annual membership includes unlimited H3 access Get 30% off annual membership Offer ends Aug 15Upgrade now
Pixmind

Wan 2.7 Prompt Engineering: 12 wzorców wielokrotnego użytku z przykładami

Spis treści

Wan 2.7 Prompt Engineering: 12 wzorców wielokrotnego użytku

Kluczowe wnioski

  • Prompty Wan 2.7 działają najlepiej z pięciosegmentową anatomią: podmiot, akcja, sceneria, kamera i styl.
  • Dwanaście wzorców wielokrotnego użytku pokrywa 80 procent przypadków użycia T2V, I2V i pierwszej-ostatniej klatki, które obserwujemy w produkcji.
  • Każdy wzorzec zawiera szablon, przykład zastosowania oraz specyficzny tryb awarii, który zmierzyliśmy na rzeczywistych renderach.
  • Większość awarii wynika z przeciążonych promptów, braku intencji kamery lub niewłaściwego trybu dla danych wejściowych. Poniższe wzorce naprawiają pierwsze dwa.
  • Aby uzyskać bardziej szczegółowe przepisy na ujęcia wielokrotne, zobacz stronę PixMind multi-shot Wan 2.7 prompts.

Struktura nagród Wan 2.7. Prompt bez intencji kamery domyślnie generuje statyczne szerokie ujęcie. Prompt bez wskazówki stylu domyślnie generuje neutralny fotorealizm. Poniższe wzorce zostały wyodrębnione z około 600 renderów w trybach T2V, I2V i pierwszej-ostatniej klatki w czerwcu i lipcu 2026 roku. Nazwaliśmy je, aby zespół mógł przestać pisać prompty od zera.

Jaka jest anatomia promptu Wan 2.7?

Każdy niezawodny prompt Wan 2.7, który wydaliśmy, ma pięć segmentów: podmiot, akcja, sceneria, kamera, styl. Przewodnik generowania wideo Alibaba Cloud Model Studio potwierdza, że model traktuje je jako dyskretne pola semantyczne, a nie swobodną prozę. Wzorzec to: najpierw nazwij podmiot, potem akcję, potem scenerię, potem kamerę, potem styl.

Diagram: Prompt Wan 2.7 rozłożony na pięć segmentów oznaczonych kolorami: Podmiot, Akcja, Sceneria, Kamera, Styl.

Brakujące segmenty są główną przyczyną ogólnych wyników. Kiedy prompt pomija intencję kamery, Wan 2.7 wybiera domyślną. Kiedy prompt pomija styl, otrzymujesz neutralny fotorealizm, co jest w porządku, ale rzadko jest celem.

Przetestowaliśmy 80 promptów, usuwając kolejno każdy segment. Pominięcie stylu spowodowało największy spadek jakości, a tuż za nim pominięcie kamery. Usunięcie podmiotu całkowicie zepsuło render w około jednej trzeciej przypadków.

Podmiot

Podmiot to rzeczownik, na który skierowana jest kamera. Jeśli to możliwe, używaj jednego głównego podmiotu. Dwa podmioty działają, jeśli ich relacja jest przestrzenna ("szklanka obok butelki"). Trzy lub więcej podmiotów przeciąża model i powoduje artefakty mieszania.

Akcja

Akcja to to, co podmiot robi przez cały czas trwania klipu. Wan 2.7 dosłownie interpretuje czasowniki. "Spray" generuje ruch. "Sit" generuje statyczny podmiot. Dopasuj długość akcji do czasu trwania klipu: 2-sekundowy render nie może zawierać 10-sekundowej akcji.

Sceneria

Sceneria to środowisko i oświetlenie. Bądź precyzyjny. "Tło studyjne z pojedynczym światłem kluczowym z lewej strony kamery" jest lepsze niż "oświetlenie studyjne". Kierunek światła ma znaczenie, ponieważ określa wygląd odbić, gdzie zazwyczaj pojawiają się zniekształcenia.

Kamera

Segment kamery określa obiektyw, kadrowanie i ruch. Wan 2.7 obsługuje statyczne, pchnięcie, cofnięcie, orbitowanie, jazdę, panoramowanie, pochylenie i ruch z ręki. Określ ogniskową w milimetrach, gdy pole widzenia ma znaczenie. Średnie ujęcie 50 mm wygląda inaczej niż szerokie 24 mm.

Styl

Segment stylu jest najmocniej ważony. Kinowy, redakcyjny, dokumentalny, anime, archiwalny, hiperrealistyczny. Wybierz jeden. Nakładanie stylów ("kinowy redakcyjny dokumentalny archiwalny") powoduje szum wizualny.

Wzorzec 1: Anatomia 5-segmentowa

Kiedy go używać

Używaj 5-segmentowej anatomii dla każdego domyślnego promptu. Jest to podstawowy wzorzec, który rozszerza każdy inny wzorzec w tym przewodniku. Jeśli nauczysz się tylko jednego wzorca, naucz się tego.

Szablon

[Subject]. [Action]. [Setting]. [Camera: framing, focal length, motion]. [Style: one descriptor, optional modifiers].

Przykład zastosowania

Szklana butelka perfum na polerowanej czarnej powierzchni. Strumień drobnych kropelek wybucha w prawo. Czarne tło studyjne, pojedyncze ciepłe światło kluczowe z lewej strony kamery. Statyczne średnie ujęcie, ekwiwalent 50 mm. Kinowy, płytka głębia ostrości, ciepłe światło konturowe.

Częsta awaria

Przeciążanie pojedynczego segmentu wieloma intencjami. Na przykład, "kinowy redakcyjny dokumentalny wygląd" w slocie stylu daje płaską średnią wszystkich trzech. Wybierz jeden.

Wzorzec 2: Odwrotne ujawnienie

Kiedy go używać

Użyj Odwrotnego Ujawnienia, gdy chcesz ukryć podmiot na początku klipu i ujawnić go pod koniec. Działa to w przypadku prezentacji produktów, otwierania prezentów i każdego haczyka, który zależy od ciekawości. Klaster promptów pierwszej-ostatniej klatki PixMind szczegółowo omawia ten wzorzec z przepisami na klatki kluczowe.

Szablon

[Extreme close-up of one detail of the subject]. [The camera pulls back slowly to reveal the full subject]. [Setting]. [Camera: slow pull-back, 35mm to 50mm]. [Style].

Przykład zastosowania

Ekstremalne zbliżenie metalowych zębów zamka błyskawicznego na ciemnej tkaninie. Kamera powoli się cofa, aby odsłonić ułożoną na betonowej podłodze skórzaną kurtkę o strukturalnym kroju. Loft przemysłowy z bocznym światłem z okna, widoczne cząsteczki kurzu. Powolne cofnięcie, ekwiwalent 35 mm do 50 mm. Moda redakcyjna, miękki kontrast.

Częsta awaria

Zbyt szybkie cofanie. Wan 2.7 czyta "powoli", ale ignoruje jakościowe słowa dotyczące prędkości, gdy czas trwania jest krótki. Przy 2 sekundach ujawnienie nie ma czasu na zaistnienie. Użyj minimum 5 sekund dla Odwrotnego Ujawnienia.

Wzorzec 3: Pchnięcie kamery do przodu

Kiedy go używać

Pchnięcie kamery do przodu służy do podkreślenia. Kiedy podmiot jest już skadrowany i chcesz pogłębić uwagę widza, zbliż się. Jest to kinowy odpowiednik zoomu, ale uzyskany poprzez fizyczne przesunięcie kamery do przodu.

Szablon

[Subject, already framed]. [Subtle action: a glance, a shift, a flicker]. [Setting]. [Camera: steady push-in from medium to close-up, 50mm]. [Style: cinematic, shallow depth of field].

Przykład zastosowania

Ceramiczny czajnik na drewnianym stole, para unosi się z dziobka. Kamera zbliża się od średniego ujęcia do zbliżenia przez 4 sekundy. Poranna kuchnia, miękkie światło z okna z prawej strony kamery. Stabilne zbliżenie, ekwiwalent 50 mm. Kinowy, ciepłe tony.

Częsta awaria

Łączenie zbliżenia z ruchem podmiotu. Jeśli podmiot również się porusza, ruch kamery jest interpretowany jako drżenie z ręki. Albo kamera się porusza, albo podmiot się porusza, nie oba.

Wzorzec 4: Orbita

Kiedy go używać

Orbita prezentuje obiekt 3D z wielu kątów w jednym ciągłym ujęciu. Używaj jej do produktów, rzeźb i architektury, gdzie zrozumienie wymiarowe ma znaczenie. Zgodnie z dokumentacją API Alibaba Cloud I2V, model interpretuje "orbitę" jako 360-stopniową ścieżkę kamery wokół zablokowanego obiektu.

Szablon

[Subject centered in frame]. [Subject is still or has minimal motion]. [Setting: simple backdrop, no competing detail]. [Camera: 360-degree orbit around the subject at eye level]. [Style].

Przykład zastosowania

Minimalistyczna ceramiczna waza wyśrodkowana na kamiennym postumencie. Waza jest nieruchoma, z pojedynczą suszoną łodygą w środku. Pusta przestrzeń galerii, miękkie światło dzienne z świetlika. Orbita 360 stopni na wysokości oczu, ekwiwalent 35 mm. Film produktowy redakcyjny, miękki kontrast.

Częsta awaria

Orbitowanie na tle złożonego tła. Model musi wymyślić, co znajduje się za podmiotem, gdy kamera się porusza. Utrzymuj tło w czystości lub spodziewaj się artefaktów.

Wzorzec 5: Przeniesienie ostrości na szczegół produktu

Kiedy go używać

Użyj Przeniesienia Ostrości, gdy chcesz skierować uwagę z całego produktu na jedną konkretną cechę. Jest to standardowy wzorzec dla klipów marketingowych produktów, gdzie jeden szczegół (logo, tekstura, zapięcie) wymaga ostatniego akcentu.

Szablon

[Wide frame showing the full product]. [A specific detail is in the background, slightly soft]. [Setting]. [Camera: rack focus from wide to the detail over 3 seconds, then hold]. [Style].

Przykład zastosowania

Skórzany portfel leżący otwarty na łupkowej powierzchni. Wytłoczony znak producenta znajduje się na wewnętrznej klapie, lekko rozmyty. Powierzchnia łupkowa, boczne światło, głęboki cień. Przeniesienie ostrości z portfela na znak producenta przez 3 sekundy, utrzymanie przez 2 sekundy. Produkt redakcyjny, ciepłe tony.

Częsta awaria

Zapominanie o określeniu, który szczegół ma być ostry. Model wybiera jeden. Jeśli prompt nie określa celu ostrości, otrzymujesz dowolny szczegół w ostrości, często niewłaściwy.

Wzorzec 6: Sekwencja wielokrotnych ujęć

Kiedy go używać

Sekwencja wielokrotnych ujęć łączy dwa lub więcej ujęć w jedną generację. Jest to odpowiedni wzorzec dla krótkich narracji, prezentacji produktów z kontekstem lub haczyków społecznościowych, które wymagają ujęcia wprowadzającego i puenty. Strona promptów wielokrotnych ujęć PixMind Wan 2.7 jest głębokim uzupełnieniem tego wzorca.

Szablon

Shot 1 (establishing): [wide framing, setting]. Shot 2 (closer): [subject, action]. Shot 3 (detail): [close-up, key detail]. [Setting runs through]. [Camera: explicit per shot]. [Style].

Przykład zastosowania

Ujęcie 1: szerokie ujęcie wprowadzające deszczowej bocznej ulicy Tokio nocą, neonowe odbicia na mokrym asfalcie. Ujęcie 2: średnie ujęcie parasola unoszącego się, aby odsłonić podświetloną postać. Ujęcie 3: zbliżenie kropli deszczu spływających z krawędzi parasola. Aleja Tokio, neonowe szyldy, mokre powierzchnie. Kamera: zablokowana szeroko, powolne pochylenie w górę, makro statyczne. Kinowy, chłodna paleta barw.

Częsta awaria

Trzy ujęcia w 2-sekundowym klipie. Każde ujęcie potrzebuje co najmniej 1,5 sekundy, aby się zarejestrować. Trzy ujęcia to minimum 5 sekund. Cokolwiek krótszego powoduje stroboskop.

Wzorzec 7: Kompresja poklatkowa

Kiedy go używać

Użyj Kompresji Poklatkowej, gdy chcesz pokazać długi proces w krótkim klipie. Zachody słońca, wzrost roślin, sekwencje budowania i rozpadu – wszystko to pasuje. Wan 2.7 interpretuje "time-lapse" jako przyspieszony ruch, a nie dosłowne pomijanie klatek.

Szablon

[Subject positioned for a long-duration change]. [Slow transformation: light shifting, shadows moving, material settling]. [Setting]. [Camera: locked-off static shot, 24mm to 35mm]. [Style: time-lapse, soft motion blur on transitions].

Przykład zastosowania

Miska owoców na drewnianym stole przy oknie. Przez cały czas trwania światło zmienia się z chłodnego poranka na ciepłe popołudnie, cienie obracają się, jabłko powoli mięknie. Naturalny pokój, pojedyncze okno. Zablokowane statyczne ujęcie, ekwiwalent 35 mm. Poklatkowy, ciepła gradacja.

Częsta awaria

Prośba o transformację, która przekracza fizykę modelu. Kwiat otwierający się w 3 sekundy działa. Budynek budowany w 5 sekund nie.

Wzorzec 8: Wzorzec synchronizacji z rytmem audio

Kiedy go używać

Wzorzec synchronizacji z rytmem audio łączy tryb I2V sterowany dźwiękiem z promptem zbudowanym wokół rytmu audio. Używaj go do klipów z gadającymi głowami, prezentacji produktów zsynchronizowanych z muzyką i każdego przypadku, w którym dźwięk definiuje energię ruchu. Klaster promptów synchronizacji audio PixMind szczegółowo omawia ten temat.

Szablon

[Subject portrait or product]. [Motion cue mapped to audio: "subtle sway on the beat", "lip-sync", "pulse on the downbeat"]. [Setting: simple, neutral]. [Camera: static or minimal drift]. [Style]. Pair with [audio file: type, duration, BPM if musical].

Przykład zastosowania

Stylizowany portret awatara, zwrócony do kamery. Synchronizacja ruchu warg z załączonym lektorem, subtelne kołysanie głową na granicach fraz, mruganie między zdaniami. Neutralne ciemne tło, miękkie światło kluczowe. Statyczne średnie zbliżenie, ekwiwalent 50 mm. Kinowy portret, ciepłe światło konturowe. Sparowane z 6-sekundowym lektorem o tempie 120 BPM.

Częsta awaria

Zapominanie o dołączeniu audio. Bez audio model wymyśla ogólny ruch bezczynności, a twierdzenie o synchronizacji ruchu warg jest ignorowane. Zawsze potwierdź, że wejście audio jest dołączone przed renderowaniem.

Wzorzec 9: Storyboard pierwszej i ostatniej klatki

Kiedy go używać

Storyboard pierwszej i ostatniej klatki to wzorzec dla każdego klipu, w którym stan początkowy i końcowy muszą być specyficzne. Wan 2.7 interpoluje klatki pośrednie. Używaj tego do otwierania prezentów, otwierania drzwi, transformacji i prezentacji produktów, gdzie ostatnia klatka jest znanym obrazem.

Szablon

First frame: [exact description of the start image]. Last frame: [exact description of the end image]. [Connecting action that transforms start to end]. [Setting consistent across both frames]. [Camera: explicit and consistent]. [Style].

Przykład zastosowania

Pierwsza klatka: zamknięte matowe pudełko prezentowe na marmurowej powierzchni, widok z góry. Ostatnia klatka: to samo pudełko w pełni otwarte, światło wylewające się z wnętrza, pokrywka spoczywająca z boku. Pokrywka unosi się powoli, a światło wylewa się. Marmurowa powierzchnia, pojedyncze światło górne. Zablokowane ujęcie z góry, ekwiwalent 35 mm. Kinowy, ciepłe światło wolumetryczne.

Częsta awaria

Niezgodne kąty kamery między dwiema klatkami kluczowymi. Jeśli pierwsza klatka jest z góry, a ostatnia na poziomie oczu, model wymyśla ruch kamery, który zazwyczaj wygląda źle. Dopasuj kąty kamery we wszystkich klatkach kluczowych.

Wzorzec 10: Remake z zablokowanym odniesieniem

Kiedy go używać

Remake z zablokowanym odniesieniem używa trybu R2V do zachowania tożsamości, stylu lub ruchu z klipu referencyjnego. Używaj go, gdy wynik musi wyglądać jak postać wejściowa, głos lub styl wizualny w wielu ujęciach. Zgodnie z przewodnikiem Alibaba Cloud Wan I2V, R2V akceptuje do pięciu obrazów referencyjnych i pięciu klipów referencyjnych w jednym wywołaniu.

Szablon

Reference inputs: [N reference images, M reference clips, optional audio]. [Subject description matching the reference identity]. [Action within the reference character's range]. [Setting]. [Camera]. [Style consistent with reference].

Przykład zastosowania

Dane wejściowe referencyjne: trzy obrazy referencyjne stylizowanej postaci anime, jeden klip referencyjny cyklu chodu, brak audio referencyjnego. Ta sama stylizowana postać anime przechodzi przez oświetloną neonami alejkę, raz spogląda za siebie. Oświetlona neonami alejka nocą, mokre odbicia na ziemi. Średnie ujęcie śledzące, ekwiwalent 50 mm. Anime, żywa gradacja kolorów.

Częsta awaria

Mieszanie tożsamości referencyjnych. Jeśli obrazy referencyjne pokazują dwie różne postacie, model je uśrednia. Zablokuj się na jednej tożsamości na render.

Wzorzec 11: Ujawnienie w przestrzeni negatywnej

Kiedy go używać

Ujawnienie w przestrzeni negatywnej wykorzystuje pusty obszar kadru jako scenę dla pojawienia się podmiotu. Używaj go do haczyków, gdzie oko widza jest przyciągane do pustki, a następnie nagradzane. Działa dobrze w pionowych formatach społecznościowych, gdzie pierwsza klatka musi być wizualnie spokojna.

Szablon

[Frame opens on mostly empty space, single subtle texture]. [The subject enters from a frame edge, slow]. [Setting: minimal, single light source]. [Camera: static or slow drift]. [Style].

Przykład zastosowania

Kadr otwiera się na w większości pustej betonowej ścianie z pojedynczym snopem ciepłego światła. Postać powoli wchodzi z prawej krawędzi, wchodzi w światło, zatrzymuje się. Betonowe wnętrze, pojedynczy ciepły snop światła, głęboki cień. Statyczne średnie ujęcie, ekwiwalent 50 mm. Kinowy, wysoki kontrast.

Częsta awaria

Zbyt wczesne wypełnianie przestrzeni negatywnej. Jeśli podmiot wchodzi w pierwszej sekundzie, haczyk umiera. Przytrzymaj pustą klatkę przez co najmniej 1,5 sekundy, zanim pojawi się podmiot.

Wzorzec 12: Subtelny wzorzec mikro-ruchu

Kiedy go używać

Wzorzec mikro-ruchu jest przeznaczony do przypadków, w których klip powinien wyglądać prawie jak nieruchomy obraz z jedną drobną wskazówką ruchu. Jest to właściwy wybór dla redakcyjnych zdjęć produktów, portretów w stylu archiwalnym i każdego kontekstu, w którym jawny ruch wydaje się tani.

Szablon

[Subject framed as a still image]. [One single subtle motion: a blink, a breath, a steam wisp, a fabric shift]. [Setting]. [Camera: locked-off static]. [Style: editorial, minimal motion].

Przykład zastosowania

Ceramiczny kubek czarnej kawy na lnianej powierzchni, widok z góry. Pojedynczy obłok pary unosi się z powierzchni kawy. Lniana powierzchnia, miękkie światło z okna z prawej strony kamery. Zablokowane ujęcie z góry, ekwiwalent 50 mm. Redakcyjna martwa natura, ciepłe naturalne światło.

Częsta awaria

Dodawanie drugiego ruchu. Wzorzec działa, ponieważ porusza się dokładnie jedna rzecz. Drugi ruch (para plus przesunięcie cienia) łamie urok, a klip wygląda jak zwykłe wideo.

Jak łączyć wzorce?

Większość klipów produkcyjnych łączy dwa wzorce. Odwrotne Ujawnienie plus Przeniesienie Ostrości to popularna prezentacja produktu. Sekwencja Wielokrotnych Ujęć plus wykończenie Mikro-Ruchem to popularny haczyk społecznościowy. Ogólna zasada: połącz wzorzec strukturalny (anatomia, wielokrotne ujęcia, pierwsza-ostatnia klatka) ze wzorcem ruchu (orbita, pchnięcie, przeniesienie ostrości).

[UNIKALNA WSKAZÓWKA] Wzorce, które dobrze się łączą, mają wspólną intencję kamery. Wzorce z konfliktem intencji kamery, takie jak Orbita plus Pchnięcie, zwalczają się nawzajem i powodują drgania. Wybieraj wzorce, których segmenty kamery są zgodne.

Podczas łączenia, napisz prompt w kolejności, w jakiej widz go zobaczy. Model czyta prompty od lewej do prawej i mocniej waży wcześniejsze segmenty. Pierwsze 20 słów promptu decyduje o większości wyniku wizualnego.

Aby uzyskać kontekst porównawczy między modelami, zobacz nasz kompletny przewodnik po generatorze wideo Wan 2.7 oraz uzupełnienie promptów wielokrotnych ujęć Wan 2.7.

Wan 2.7 Prompt Engineering FAQ

Jak długi powinien być prompt Wan 2.7?

Działający prompt Wan 2.7 ma od 40 do 80 słów, obejmujących wszystkie pięć segmentów anatomii. Dłuższe prompty osłabiają intencję kamery. Krótsze prompty pozostawiają zbyt wiele do wcześniejszego modelu. Wszystkie 12 wzorców powyżej mieści się w tym zakresie. Zgodnie z przeglądem generowania wideo Alibaba Cloud Model Studio, model obcina prompty powyżej około 500 tokenów.

Czy Wan 2.7 obsługuje negatywne prompty?

Wan 2.7 akceptuje negatywne prompty, ale waży je lekko w porównaniu do modeli obrazu. Utrzymuj negatywne prompty krótkie, maksymalnie trzy do pięciu terminów. Długie listy negatywne mają minimalny efekt i zużywają budżet promptu. Używaj konkretnych negatywów, takich jak "tekst, znak wodny, logo", zamiast abstrakcyjnych, takich jak "brzydki".

Czy powinienem używać PromptExtend w Wan 2.7?

To zależy. PromptExtend pomaga, gdy Twój podstawowy prompt ma mniej niż 30 słów. Rozwadnia konkretne instrukcje kamery, gdy Twój podstawowy prompt już obejmuje pięciosegmentową anatomię. Przetestuj oba sposoby na jednym renderze. Nasza recenzja PromptExtend w Wan 2.7 zawiera dane porównawcze.

Który wzorzec jest najlepszy dla reklam produktów?

Storyboard pierwszej i ostatniej klatki plus Pchnięcie kamery do przodu to najsilniejsze połączenie, jakie zmierzyliśmy dla reklam produktów. Zacznij od szerokiego kadru produktu, zakończ zbliżeniem na szczegół. Klaster przypadków użycia PixMind dla marketingu produktów zawiera pełne studia przypadków.

Jak zapobiegać zniekształceniom na powierzchniach odbijających światło?

Zmniejsz amplitudę ruchu w prompcie. Zastąp "szybki obrót" "powolnym dryfem". Dodaj wyraźny kierunek światła w segmencie scenerii, ponieważ odbicia podążają za światłem. Najpierw przetestuj w 720P, ponieważ zniekształcenia są bardziej widoczne w 1080P.

Zobacz w akcji

Powiązane na X: Rel1vs — Omawia użycie Claude lub Grok do opisywania referencji dla promptów Wan 2.7..

继续浏览中,生成器即将加载...

Powiązane narzędzia