Wan 3.0 Promptguide: Sådan får du det bedste ud af Wan 3.0
Jeg har brugt Wan 3.0 en del tid, og jeg vil sige, at det er mere en instruktørledet model end sine forgængere. Den understøtter nu 30-sekunders generationer med tekst, billede, lyd, video, dokumenter og websider som referenceinput, så det kræver lidt mere finesse at prompte nu. Vil du vide tricket bag det? Læs videre, hvor vi forklarer, hvad Wan 3.0 præcist reagerer bedst på.
TL;DR
Uanset hvad du skriver i starten af din prompt, er det det, Wan 3.0 vil fastlåse først, fordi den kortlægger kompositionen tidligt. Etabler optagelsen og scenen, før du identificerer motivet, beskriv derefter handlingen, angiv belysning og stil, og tilføj derefter lyd. Angiv også hver references rolle for at undgå tilfældige resultater. Du kan bruge Pollo AI som det perfekte arbejdsområde til at generere videoer med Wan 3.0.
Wan 3.0 -promptvejledning: Forståelse af nøgleaspekter
Før vi går i dybden med, hvordan man laver den perfekte Wan 3.0 prompt, skal du først forstå kerneformlen for enhver grundlæggende promptanmodning, så lad os hurtigt gennemgå den for dig:
Aspekt | Spørgsmål at besvare | Eksempel |
|---|---|---|
| Emne | Hvad er emnet, og hvad skal forblive genkendeligt? | En vejrbidt blå leveringscykel med en fletkurv. |
| Scene | Hvor er den, og hvad omgiver den? | En smal fransk gade efter regn, flisebelagte facader, vandpytter, reflekterende belægning |
| Bevægelse | Hvad bevæger sig, i hvilken rækkefølge og med hvilken hastighed? | Cyklen ruller langsomt ned ad bakke; vand sprøjter fra dækkene |
| Kamerastyring | Hvordan skal optagelsen filmes? | Lavvinkelsporingsbillede, 35 mm objektiv, blødt overskyet lys |
| Stilisering | Hvilken visuel æstetik styrer scenen? | Dokumentarvideo med dæmpede farver |
Hvorfor kræver Wan 3.0 mere nuancerede promptinger?
De forbedrede funktioner i Wan 3.0 tvang mig til at anvende en anden prompt-stil end den, jeg ofte brugte i Wan 2.7. En af grundene er, at den maksimale varighed af AI-videoer er blevet forlænget til 30 sekunder pr. klip. Hvorfor er det så vigtigt? Her er hvorfor…
Jeg testede Wan 3.0 ret grundigt, og en vigtig forskel mellem de videoer, der ikke levede op til mine forventninger, var manglen på tidskontrol i mine prompts. Da jeg blot gav visuelle beskrivelser uden at tage højde for hvert sekund af optagelsen, floppede det.
Uden en klar tidslinje ville Wan 3.0 fylde tomme sekunder med tilfældige ændringer. De bedste prompts kortlægger nøglehandlinger og kameraets adfærd gennem hele klippet, samtidig med at hvert billede, video, lydfil eller link får en klar rolle.
Jeg bemærkede også, at Wan 3.0 etablerer kompositionen tidligt, ofte ved at bruge de første detaljer som scenens fundament. Rækkefølgen er vigtig, især for billede-til-video, hvor den oprindelige komposition og motividentitet bevares, men har en tendens til at udføre drastiske ændringer for lidt.
Hvis jeg for eksempel gengiver et foto til en videoannonce og anmoder om en alt for radikal transformation, får jeg muligvis ikke et solidt resultat. I betragtning af alle disse overvejelser synes jeg, det er rimeligt at sige, at det kræver en nuanceret tilgang at bruge Wan 3.0. Så lad os se på, hvordan du kan få de bedst mulige prompts.
Før du dykker ned i Wan 3.0 prompts, kan du udforske modellens seneste opgraderinger i vores guide om, hvad Wan 3.0 er .
Prøv Wan 3.0 gratis på Pollo AI nu
Indtast dine kreative opfordringer for at lave fantastiske videoer med Wan 3.0 på Pollo AI.
Begynd at skabe gratis
Wan 3.0 -promptering: Tekst-til-video vs. billede-til-video
Måden du udarbejder Wan 3.0 prompts til T2V vil være anderledes end til I2V, fordi hele sekvensen afhænger af en korrekt definition af motiv, miljø, handling, kamera og visuel stil.
Og som jeg nævnte tidligere, kortlægger Wan 3.0 kompositionen tidligt, så det du starter din prompt med, er det, modellen låser først, før resten af scenen. Hvis din prompt for eksempel starter med at beskrive en stemning, vil Wan 3.0 forankre sig omkring den stemning i stedet for motiverne.
Derfor bør du fastlægge din kameraoptagelsestype, før du identificerer motivet og de funktioner, du ønsker at bevare. Derefter kan du fortsætte med at definere belysning, stil og afslutte med dialog, lydeffekter eller musik. Her er en animeret film, jeg har genereret som et eksempel:
Hurtig | Produktion |
|---|---|
| Filmisk 8K stiliseret 3D kontinuerlig optagelse. En ung mand i en blå bandana bruger et holografisk smartwatch til at udløse mekaniske arme, der vasker hans mudrede Mazda RX-7. Bilen opgraderes, bruser med blå elektricitet og skifter fra hvid til blank sort med glødende lilla energi. Den sorte bil suser gennem en regnvåd neon cyberpunk-by om natten. En forrude-HUD aktiveres, og bilen hopper og forvandler sig midt i luften til en kæmpe tobenet mech med føreren synlig i det glødende cockpit. Mechanen lander tungt på gaden og bruger derefter blå jetmotorer til at flyve op og stå heroisk på et skyskrabertag. |
Hvis du derimod har til hensigt at bruge referencebilleder, kræver det en anden tilgang. Ud fra hvad jeg har set ved hjælp af det, ser det ud til, at Wan 3.0 fastholder kompositionen og motividentiteten i kildebilledet meget strengere end andre modeller.
På grund af det kan det være ret vanskeligt at bruge prompts, der er radikalt transformerende eller forårsager pludselige ændringer. I de fleste af disse tilfælde ville Wan 3.0 undereksekvere og ikke leve op til min vision for scenen, så jeg anbefaler at bruge prompts med jævne, kontinuerlige overgange som nedenfor:
Hurtig:
Live-action-sekvens med fire billeder. Brug billede 1 som præcis åbningsbillede og visuelt anker. Bevar identisk lejesoldatprinsesse, barsk smugler, ansigter, kostumer, pistol, rumskibs-set, belysning og lærredsregi. Praktisk rumactionfilm fra 1980'erne: rigtige skuespillere, fysiske kulisser, gummibelagt alien-dragt, animatronisk robot i fuld størrelse, praktiske gnister/røg, begrænsede optiske lasere, 35 mm anamorfisk.
SKUDD 1 (0–3,2s): Låst mellem toskudsskud. Hun læner sig tilbage til venstre, støvlen oppe, pistolen dinglende; han sidder til højre.
SKUD 2 (3,2–6,7s): Hurtigt tilbageslag. Rumvæsenet eksploderer efter ham. Hun affyrer et præcist skud forbi hans skulder; bolten rammer brystet, der opstår en gnist, og den falder. Orkesterstik, laserspræk.
SKUDD 3 (6,7–10,3s): Lav trekvart. Robotten tramper til højre, løfter armen. Hun drejer, affyrer to skud (led derefter bryst); armen falder ned, den brager ned med gnister/røg. Han stirrer i ærefrygt; hun sænker pistolen. Perkussion rammer, messingbranchen florerer.
SKUD 4 (10,3–14 sekunder): Stramt to-skuds skud. Oprindelig øjenlinje. Hun vender tilbage til sin kedsommelige positur, pistolen dinglende, stirrer. Hun forbliver ubesværet, kontrolleret og uimponeret.
Input | Produktion |
|---|---|
![]() |
Wan 3.0 -promptering: Håndtering af bevægelse
Af personlig erfaring kræver håndtering af bevægelse med Wan 3.0 en del sekvensering. Selvom man kan bruge en prompt som "en mand går hen over en strand", vil jeg sige, at denne beskrivelse blot er en simpel forudindstillet handling, hvilket gør timing og interaktion uklar.
En bedre mulighed er at tilføje en kæde af observerbare begivenheder. Jeg ville sige: "En mand går hen over en strand, holder en pause, da han hører et højt gøen, vender sig mod lyden og kigger ned for at se en golden retriever løbe imod ham". Dette skaber en mere realistisk bevægelse billede-for-billede.
Men samtidig skal man ikke overbelaste klippet med overdreven koreografi. Det er også noget, jeg har bemærket, som Wan 3.0 ikke reagerer godt på. Da jeg prøvede at få en karakter til at udføre for mange præcise handlinger eller interagere med mange objekter, var resultatet ikke så ideelt.
Så selvom Wan 3.0 nu understøtter længere klip på 30 sekunder, foreslår jeg, at du fokuserer på at give motivet et klart og ligetil job/central handling for at sikre tidsmæssig stabilitet. Du kan se et godt eksempel på dette i den realistiske video , jeg genererede nedenfor:
Hurtig:
@Image1 er den eneste hovedperson. Bevar hendes nøjagtige ansigt, frisure, krop og tøj hele vejen igennem. Ultrarealistisk filmisk tidsfrysning fra 30'erne på en solbeskinnet italiensk gade i den gamle bydel (stenbygninger, brosten, caféer, fodgængere, duer).
0–5'ere: Hun går selvsikkert hen imod kameraet (Steadicam sporer tilbage) midt i et normalt liv.
5–8s: Stopper, knipser med fingrene → elegant usynlig chokbølge fryser alt.
8–20'erne: Kun hun bevæger sig; kameraet cirkler, mens hun går på den frosne gade, rører ved en svævende dråbe, vender sig derefter mod kameraet med et halvt smil og tager et billede igen.
20-30'erne: Anden chokbølge optøer verden; hun forbliver rolig.
Stil: fotorealistisk, 50 mm, lav dybdeskarphed, naturligt lys, diskret korndannelse, realistisk fysik/VFX. Ingen morphing, ekstramateriale eller artefakter.
Input | Produktion |
|---|---|
![]() |
Wan 3.0 -promptering: Kamerasprog
For kamerasprog er en simpel tommelfingerregel, som jeg gerne følger, at strukturere det i fire dele: optagelsesstørrelse, vinkel, bevægelse og objektiv. For eksempel "et bredt etablerende optagelse fra en høj vinkel, derefter ned i en langsom fremadgående vogn til fyrtårnet; brug et 50 mm filmisk perspektiv."
Du kan bruge denne regel i alle dine Wan 3.0 prompter, men husk altid at undgå modstridende sprog. For eksempel kan du ikke sige: "Et låst, statisk kamera cirkler hurtigt rundt om motivet". Disse to separate retninger er uforenelige, så bed ikke modellen om at få det til at fungere.
Hvis du nogensinde vil generere en dynamisk sekvens som f.eks. en trailervideo , er her en generel guide til kameraperspektiv, som du kan bruge gentagne gange, når du laver scenen:
Hensigt | Kameraretning | Visuel effekt |
|---|---|---|
| Etabler plads | Bredt skud, langsom kran eller udtræk | Kontekst og skala |
| Skab intimitet | Mellem nærbillede, blidt indtryk | Følelsesmæssig opmærksomhed |
| Følg handling | Sidesporingsskud eller fremadgående dolly | Momentum og deltagelse |
| Vis vigtighed | Langsom bane, centreret komposition | Heroisk eller ikonisk fremhævelse |
| Bevar detaljer | Fast nærbillede, lav dybdeskarphed | Fokus og inspektion |
| Skab ustabilitet | Kontrolleret håndholdt bevægelse | Hastighed eller dokumentarisk energi |
En anden vigtig ting er, at det ikke er nok blot at sige "filmisk kamerabevægelse" for at skabe en ordentlig scene med Wan 3.0. Du skal være mere specifik; for eksempel vil "kameraets spor bevæger sig i ganghastighed, mens hunden løber" give mere bevidste resultater. Her er et godt eksempel:
Hurtig | Produktion |
|---|---|
| Stil: Ultrarealistisk, filmisk vinterdokumentar, 4K HDR, naturligt lys, lav dybdeskarphed, jævn kamerabevægelse, blød farvegraduering, fredelig atmosfære. Scene 1 (0-3s) Droneoptagelse fra luften af en lille træhytte gemt dybt inde i en snedækket fyrreskov. Tung sne falder blidt, mens varme gyldne lys gløder fra vinduerne. Tynd røg stiger op fra skorstenen, mens kameraet langsomt bevæger sig ned mod hytten. Scene 2 (3-6s) Inde i hytten sidder den samme kvinde ved siden af en knitrende stenpejs pakket ind i et blødt uldtæppe og læser en bog. Scene 3 (6-10s) Hun åbner trædøren og træder ud på den snedækkede veranda. Snefnug lander blidt på hendes sweater og hår. Hun smiler, tager en langsom, dyb indånding og kigger ud over den stille skov, mens kameraet blidt cirkler omkring hende. Scene 4 (10-13s) Nærbilleder af filmiske optagelser: støvler efterlader friske fodspor i uberørt sne, hendes behandskede hånd børster sne af fyrregrene, snefnug, der lægger sig på det varme hyttevindue, og røg, der driver op i den friske vinterluft. Scene 5 (13-15 s) Bred filmisk tilbagetrækning fra hytten i skumringen. Sneen fortsætter med at falde, mens den glødende hytte bliver mindre i den store hvide skov. |
Udover at lære at lave Wan 3.0 -prompts, kan du læse vores guide til brug af Wan 3.0 for at lave endnu bedre AI-videoer.
Wan 3.0 -promptering: Lyd-/dialogscener
Vi ved, at Wan 3.0 understøtter native lydgenerering, men det er let at glemme, at lyd også skal beskrives lige så bevidst som visuelle elementer. Når det kommer til dialog, har jeg lært om Wan 3.0 efter at have genereret daglige vlogs , tutorials , korte film osv., at holde replikkerne korte.
Desværre er lip-sync ikke altid konsekvent pålidelig, så betragt blot dialogen som korte performance-signaler, ikke en lang manuskriptfortælling. Ud fra hvad jeg har set, er det dette, der fungerer bedst med Wan 3.0. Du kan se, hvordan dette bidrog til at producere et fantastisk audiovisuelt resultat nedenfor:
Hurtig:
Bevar det nøjagtige ansigt, frisure, identitet, hudtone og krop fra @image1. Autentisk indonesisk kvinde i overdimensioneret terrakotta-hørskjorte, støvede bordeauxrøde bukser med vide ben, brune lædersandaler, små guldøreringe og løst, bølget hår.
Rå vlog med flip-camera fra slutningen af 2000'erne: kraftige rystelser, fokussøgning, eksponeringsskift, varme, falmede farver, digital støj. Ingen posering eller moderne grading.
00:00–00:04 Går smilende gennem en tropisk landsby: “I dag skal vi på jagt efter friske kokosnødder!”
00:04–00:08 Ser begejstret på en sælger, der hakker kokosnød.
00:08–00:12 Nipper til kokosvand og smiler: “Det her er så forfriskende!”
00:12–00:16 Snakker/griner med landsbyboere, der holder kokosnødder.
00:16–00:20 Forsøger at åbne kokosnød, kæmper, griner; lokalbefolkningen jubler.
00:20–00:24 Skobler kødet ud, smager, giver tommelfingeren opad.
00:24–00:27 Går og vinker til de lokale.
00:27–00:30 Smiler, vinker: “Vi ses på mit næste eventyr. Farvel!”
Input | Produktion |
![]() |
En anden ting jeg bemærkede er, at hvis det er en scene med flere karakterer, skal man sørge for at bruge etiketter. For eksempel: "[Sarah, hæs stemme] siger: 'Vi skal afsted klokken seks.' "[Jon, blød, tøvende stemme] ser tilbage på hende og siger: 'Det er fint. Lad os begynde at pakke.'"
Vil du se flere eksempler på, hvad Wan 3.0 kan skabe? Se denne artikel om de bedste Wan 3.0 anvendelsesscenarier .
Vil du generere videoer med Wan 3.0? Gå til Pollo AI
Nu hvor du har en klar forståelse af, hvordan man laver en solid Wan 3.0 prompt, vil du sikkert gerne begynde at generere videoer med den. Hvis det er tilfældet, vil jeg anbefale at gå til Pollo AI. Hvorfor? Fordi det er den ultimative AI-kreative suite , der indeholder alle de bedste AI-videomodeller på ét sted.
Her kan du få adgang til Wan 3.0 , Seedance 2.5 , Kling 3.0 og Veo 3.1 samt snesevis af andre muligheder, hvilket gør det nemt at sammenligne forskellige output for at opnå det bedst mulige resultat. Og ikke nok med det, du kan også uploade alle dine aktiver og hoste alle dine projekter på denne ene platform.

I bund og grund anser jeg det for at være det perfekte arbejdsområde, der vil supplere alt, hvad du har tænkt dig at lave med Wan 3.0. Bedst af alt? Det tilbyder Pollo Agent , en AI Agent til videoer , historier , annoncer og kreativt design , som automatiserer alt fra struktur og tempo til visuelle elementer, hvilket betyder, at det også kan guide dig til at lave den perfekte prompt.
Prøv Wan 3.0 gratis på Pollo AI nu
Giv dine dristigste idéer liv med Wan 3.0 , og forvandl dem til publiceringsklare videoer på Pollo AI.
Begynd at skabe gratis
Det tager kun et par minutter, og så forvandler den enhver idé til et produktionsklart resultat. Derudover kommer Pollo AI med snesevis af værktøjer, som du kan bruge i postproduktionen, f.eks. AI-videoforlængeren , der sikrer, at du har alt, hvad du behøver for at få arbejdet gjort.
Bare gå over til Pollo AI og opret en konto. Du kan begynde at generere videoer med Wan 3.0 uden omkostninger via den gratis prøveperiode . Jeg garanterer, at du efter et par timer på denne platform vil begynde at se den som din egen personlige videoproduktionsassistent.
Ofte stillede spørgsmål om Wan 3.0 promptguiden
Hvor lang kan en Wan 3.0 -generation være?
Med Wan 3.0 kan du generere videoer med op til 30 sekunders lyd i én omgang. Sørg blot for, at din prompt tager højde for hvert sekund af optagelsen, hvis du vil have det bedst mulige resultat. Ellers kan den udfylde hullerne ved hjælp af sin egen dømmekraft på uventede måder.
Hvor mange referencer understøtter Wan 3.0 ?
Du kan uploade op til 10 referencebilleder, 5 videoer og 5 lydfiler, med understøttelse af dokument- og websidelinks pr. generation. Husk altid at angive, hvad hver af disse referencer gør; ellers kan de ende med at påvirke det endelige output tilfældigt.
Hvordan kan jeg forbedre en lang Wan 3.0 prompt?
Fokuser på at give Wan 3.0 lagdelte direktiver. For eksempel: "En stille skov. Pludselig ryster jorden og revner op. Zombier klatrer ud af revnerne." Adskil alle nøgletilstandene og behandl dem som uafhængige kronologiske taktslag. For scener på 30 sekunder skal du bruge tidsstempler for hver sluttilstand.
Hvordan skal jeg fremskynde generering af billede til video?
Wan 3.0's evne til referenceforankring er ret stærk, så den foretrækker en gradvis udvikling frem for drastiske ændringer i kildebilledet. Fokuser på at lave prompts, der viser en naturlig progression af scenen ved at specificere, hvordan kameraet eller motivet skal bevæge sig i den.
Hvordan kan jeg forbedre karakterkonsistensen med Wan 3.0?
Du kan bruge et referencebillede/en referencevideo af karakteren og derefter definere de attributter, du ønsker, at Wan 3.0 skal holde stabile. For eksempel: "Bevar kvindens lange blonde hår og ansigtstræk i hele scenen." Minimer blot antallet af karakterer, handlinger og placeringsændringer.
Hvordan styrer jeg lyden, når jeg bruger Wan 3.0?
Når du skriver prompten, bør du placere lyd i en separat kategori og beskrive kilden/opførslen for hver enkelt separat. For eksempel: "En blid kvindestemme taler. Regn banker på glasset. Klavermusik spiller under dialogen." Det dækker stemme, lydeffekter og baggrundsmusik, så hver del indfanges i den genererede scene.






