Forside/Blogg/Innsikt i AI-modeller/Wan 3.0 promptveiledning: Slik får du mest mulig ut av Wan 3.0

Wan 3.0 promptveiledning: Slik får du mest mulig ut av Wan 3.0

Jeg har brukt Wan 3.0 en stund, og jeg vil si at det er mer en regissørledet modell enn forgjengerne. Den støtter nå 30-sekunders generasjoner med tekst, bilde, lyd, video, dokumenter og nettsider som referanseinngang, så det krever litt mer finesse å stille spørsmål nå. Vil du vite trikset? Les videre mens vi forklarer hva Wan 3.0 reagerer best på.

TL;DR

Det du skriver i starten av oppgaven din, er det Wan 3.0 vil låse først fordi den kartlegger komposisjonen tidlig. Etabler bildet og scenen før du identifiserer motivet, beskriv deretter handlingen, spesifiser belysning og stil, og legg deretter til lyd. Spesifiser også hver referanses rolle for å unngå tilfeldige resultater. Du kan bruke Pollo AI som det perfekte arbeidsområdet for å generere videoer med Wan 3.0.

WAN 3.0-ledetekstveiledning: Forstå viktige aspekter

Før vi går inn på hvordan du lager den perfekte Wan 3.0-ledeteksten, må du først forstå kjerneformelen for enhver grunnleggende ledetekstforespørsel, så la oss raskt bryte den ned for deg:

Aspekt

Spørsmål å svare på

Eksempel

Tema Hva er temaet, og hva må forbli gjenkjennelig? En værslitt blå leveringssykkel med en flettet kurv.
Scene Hvor er den, og hva omgir den? En smal fransk gate etter regn, flislagte fasader, vannpytter, reflekterende fortau
Bevegelse Hva beveger seg, i hvilken rekkefølge og med hvilken hastighet? Sykkelen ruller sakte nedover; vann blafrer fra dekkene
Kamerakontroll Hvordan bør opptaket filmes? Lavvinkelsporingsbilde, 35 mm objektiv, mykt overskyet lys
Stilisering Hvilken visuell estetikk styrer scenen? Dokumentarvideo med dempede farger

Hvorfor krever WAN 3.0 mer nyansert prompting?

De forbedrede funksjonene i Wan 3.0 tvang meg til å bruke en annen spørrestil enn det jeg ofte brukte i Wan 2.7. En grunn er at maksvarigheten til AI-videoer er utvidet til 30 sekunder per klipp. Hvorfor er dette viktig? Her er hvorfor…

Jeg testet Wan 3.0 ganske grundig, og en viktig forskjell mellom videoene som ikke var like gode som forventningene mine, var mangelen på tidskontroll i oppgavene mine. Da jeg bare ga visuelle beskrivelser uten å ta hensyn til hvert sekund av opptaket, slo det feil.

Uten en tydelig tidslinje ville Wan 3.0 fylt tomme sekunder med tilfeldige endringer. De beste ledetekstene kartlegger viktige handlinger og kameraets oppførsel gjennom hele klippet, samtidig som de gir hvert bilde, video, lydfil eller lenke en tydelig rolle.

Jeg la også merke til at Wan 3.0 etablerer komposisjonen tidlig, ofte med de første detaljene som grunnlag for scenen. Rekkefølge er viktig, spesielt for bilde-til-video, hvor den bevarer den opprinnelige komposisjonen og motividentiteten, men har en tendens til å underutføre drastiske endringer.

Hvis jeg for eksempel gjengir et bilde til en videoannonse og ber om en altfor radikal transformasjon, får jeg kanskje ikke et solid resultat. Med tanke på alle disse hensynene, tror jeg det er rimelig å si at det krever en nyansert tilnærming å bruke Wan 3.0. Så la oss se på hvordan du kan få best mulige ledetekster.

Før du dykker ned i Wan 3.0-ledetekster, bør du utforske modellens nyeste oppgraderinger i guiden vår om hva Wan 3.0 er .

Prøv Wan 3.0 gratis på Pollo AI nå

Skriv inn dine kreative spørsmål for å lage fantastiske videoer med Wan 3.0 på Pollo AI.

Begynn å lage gratis
Begynn å lage gratis

Wan 3.0-spørsmål: Tekst-til-video vs. bilde-til-video

Måten du lager Wan 3.0-ledetekster for T2V vil være forskjellig fra I2V fordi hele sekvensen avhenger av å definere motivet, miljøet, handlingen, kameraet og den visuelle stilen riktig.

Og som jeg nevnte tidligere, kartlegger Wan 3.0 komposisjonen tidlig, så det du starter prompten din med er det modellen låser først før resten av scenen. Hvis for eksempel prompten din starter med å beskrive en stemning, vil Wan 3.0 forankre seg rundt den stemningen i stedet for motivene.

Derfor bør du bestemme kameraets bildetype før du identifiserer motivet og trekkene du vil bevare. Deretter kan du fortsette med å definere belysning, stil og avslutte med dialog, lydeffekter eller musikk. Her er en animasjonsfilm jeg laget som et eksempel:

Spørsmål

Produksjon

Filmatisk 8K stilisert 3D-serieopptak. En ung mann i en blå bandana bruker en holografisk smartklokke til å utløse mekaniske armer som vasker hans gjørmete Mazda RX-7. Bilen oppgraderes, bølger med blå elektrisitet og går fra hvit til skinnende svart med glødende lilla energi. Den svarte bilen suser gjennom en regnvåt neon cyberpunk-by om natten. En frontrute-HUD aktiveres, og bilen hopper og forvandles midt i luften til en gigantisk tobent mech med føreren synlig i den glødende cockpiten. Mechanismen lander tungt på gaten, og bruker deretter blå jetmotorer til å fly opp og stå heroisk på et skyskrapertak.

På den annen side, hvis du har tenkt å bruke referansebilder, krever det en annen tilnærming. Ut fra det jeg har sett ved bruk av det, ser det ut til at Wan 3.0 låser komposisjonen og motividentiteten til kildebildet mye strengere enn andre modeller.

På grunn av dette kan det være ganske vanskelig å bruke ledetekster som er radikalt transformative eller forårsaker brå endringer. I de fleste av disse tilfellene ville Wan 3.0 underutføre og ikke oppfylle min visjon for scenen, så jeg anbefaler å bruke ledetekster med jevne, kontinuerlige overganger som nedenfor:

Spørsmål:

Fireskudds live-action-sekvens. Bruk bilde 1 som eksakt åpningsbilde og visuelt anker. Behold identisk leiesoldatprinsesse, barsk smugler, ansikter, kostymer, pistol, romskip-sett, belysning og skjermregi. Praktisk rom-actionfilm fra 1980-tallet: ekte skuespillere, fysiske sett, romvesendrakt i gummi, animatronisk robot i full størrelse, praktiske gnister/røyk, begrensede optiske lasere, 35 mm anamorfisk.

SKUDD 1 (0–3,2s): Låst middels toskudds. Hun lener seg tilbake til venstre, støvelen hevet, pistolen dinglende; han sitter til høyre.

SKUDD 2 (3,2–6,7 s): Raskt bakover. Romvesen eksploderer etter ham. Hun avfyrer ett presist skudd forbi skulderen hans; bolten treffer brystet, det gnister, den faller. Orkesterstikk, lasersprekk.

SKUDD 3 (6,7–10,3s): Lav trekvart. Roboten tramper til høyre, løfter armen. Hun snur seg, avfyrer to skudd (leddet deretter brystet); armen faller ned, den krasjer med gnister/røyk. Han stirrer i ærefrykt; hun senker pistolen. Perkusjonstreff, messingbrakettene blomstrer.

SKUDD 4 (10,3–14 s): Stramt toskudd. Opprinnelig øyelinje. Hun går tilbake til en lei positur, med pistol dinglende, og stirrer. Hun forblir uanstrengt, kontrollert og uimponert.

Inndata

Produksjon

1787800046944-64220116-6849-48a5-b8cd-426e0ca3c699.webp

WAN 3.0-spørsmål: Håndtering av bevegelse

Av personlig erfaring krever håndtering av bevegelse med Wan 3.0 en god del sekvensering. Selv om du kan bruke en ledetekst som «en mann går over en strand», vil jeg si at denne beskrivelsen bare er en enkel forhåndsinnstilt handling, noe som gjør timing og interaksjon uklar.

Et bedre alternativ er å legge til en kjede av observerbare hendelser. Jeg ville sagt: «En mann går over en strand, stopper opp når han hører et høyt bjeff, snur seg mot lyden og ser ned for å se en golden retriever løpe mot ham». Dette skaper mer realistisk bevegelse bilde-for-bilde.

Prøv Wan 3.0 på Pollo AI gratis 💳 Ett abonnement, alle modeller • 🌟 Ingen registrering nødvendig

Men samtidig bør du ikke overbelaste klippet med overdreven koreografi. Dette er noe annet jeg la merke til at Wan 3.0 ikke responderer godt på. Da jeg prøvde å få en karakter til å utføre for mange presise handlinger eller samhandle med mange objekter, var ikke resultatet så ideelt.

Så selv om Wan 3.0 nå støtter lengre klipp på 30 sekunder, foreslår jeg at du fokuserer på å gi motivet en klar og grei jobb/sentral handling for å sikre tidsmessig stabilitet. Du kan se et godt eksempel på dette i den realistiske videoen jeg genererte nedenfor:

Spørsmål:

@Image1 er den eneste hovedpersonen. Behold hennes eksakte ansikt, frisyre, kropp og klær gjennom hele filmen. Ultrarealistisk filmatisk tidsfrysing fra 30-tallet på en solbelyst italiensk gammelbygate (steinbygninger, brostein, kafeer, fotgjengere, duer).

0–5s: Hun går selvsikkert mot kameraet (Steadicam sporer tilbake) midt i et normalt liv.

5–8s: Stopper, knipser med fingrene → elegant usynlig sjokkbølge fryser alt.

8–20-tallet: Bare hun beveger seg; kameraet sirkler mens hun går på den frosne gaten, berører en svevende dråpe, vender seg deretter mot kameraet med et halvt smil og knipser igjen.

20–30-tallet: Den andre sjokkbølgen tiner verden opp; hun forblir rolig.

Stil: fotorealistisk, 50 mm, grunn dybdeskarphet, naturlig lys, subtil kornstruktur, realistisk fysikk/visuelle effekter. Ingen morphing, ekstramateriale eller artefakter.

Inndata

Produksjon

根据这张图片里的女人形象,生成一张她穿t-skjorte的平面模特照片.webp

WAN 3.0-spørsmål: Kameraspråk

Når det gjelder kameraspråk, er en enkel tommelfingerregel jeg liker å følge å strukturere det i fire deler: bildestørrelse, vinkel, bevegelse og objektiv. For eksempel: «et bredt etableringsbilde fra en høy vinkel, deretter ned i en sakte fremovergående vogn til fyrtårnet; bruk et 50 mm filmatisk perspektiv.»

Du kan bruke denne regelen i alle Wan 3.0-ledetekstene dine, men husk alltid å unngå motstridende språkbruk. Du kan for eksempel ikke si: «Et låst statisk kamera sirkler raskt rundt motivet». Disse to separate retningene er inkompatible, så ikke be modellen om å få det til å fungere.

Hvis du noen gang ønsker å generere en dynamisk sekvens, som for eksempel en trailervideo , er her en generell veiledning for kameraperspektiv som du kan referere til gjentatte ganger når du lager scenen:

Intensjon

Kameraretning

Visuell effekt

Etablere sted Bredt skudd, langsom kran eller uttrekk Kontekst og skala
Bygg intimitet Middels nærbilde, forsiktig innskyving Emosjonell oppmerksomhet
Følg handlingen Sidesporingsskudd eller fremovergående dolly Momentum og deltakelse
Vis viktighet Langsom bane, sentrert komposisjon Heroisk eller ikonisk vektlegging
Bevar detaljer Fast nærbilde, liten dybdeskarphet Fokus og inspeksjon
Skap ustabilitet Kontrollert håndholdt bevegelse Hastighet eller dokumentarisk energi

En annen viktig ting er at det ikke er nok å bare si «filmisk kamerabevegelse» for å sette en skikkelig scene med Wan 3.0. Du må være mer spesifikk; for eksempel vil «kameraet spores i gangfart mens hunden løper» gi mer bevisste resultater. Her er et godt eksempel:

Spørsmål

Produksjon

Stil: Ultrarealistisk, filmatisk vinterdokumentar, 4K HDR, naturlig belysning, grunn dybdeskarphet, jevn kamerabevegelse, myk fargegradering, fredelig atmosfære. Scene 1 (0–3s) Droneopptak fra luften av en liten trehytte gjemt dypt inne i en snødekt furuskog. Tung snø faller forsiktig mens varme, gyldne lys gløder fra vinduene. Tynn røyk stiger opp fra pipa mens kameraet sakte beveger seg ned mot hytta. Scene 2 (3–6s) Inne i hytta sitter den samme kvinnen ved siden av en knitrende peis i stein, pakket inn i et mykt ullteppe, og leser en bok. Scene 3 (6–10s) Hun åpner tredøren og går ut på den snødekte verandaen. Snøflak lander mykt på genseren og håret hennes. Hun smiler, tar et sakte, dypt pust og ser over den stille skogen mens kameraet forsiktig sirkler rundt henne. Scene 4 (10–13s) Nærbilder fra filma: støvler som etterlater ferske fotspor i urørt snø, den behandskede hånden hennes børster snø av furugrener, snøflak som legger seg på det varme hyttevinduet og røyk som driver opp i den friske vinterluften. Scene 5 (13–15s) Bred filmatisk tilbaketrekning fra hytta i skumringen. Snøen fortsetter å falle mens den glødende hytta blir mindre i den enorme hvite skogen.

Utover å lære hvordan du lager Wan 3.0-ledetekster, les vår veiledning om hvordan du bruker Wan 3.0 for å lage enda bedre AI-videoer.

Wan 3.0-spørsmål: Lyd-/dialogscener

Vi vet at Wan 3.0 støtter generering av innebygd lyd, men det er lett å glemme at lyd også må beskrives like bevisst som visuelle elementer. Når det gjelder dialog, har jeg lært om Wan 3.0 etter å ha generert daglige vlogger , veiledninger , kortfilmer osv., at man skal holde linjene korte.

Dessverre er ikke leppesynkronisering alltid konsekvent pålitelig, så bare se på dialogen som korte fremføringssignaler, ikke en lang manusfortelling. Ut fra det jeg har sett, er det dette som fungerer best med Wan 3.0. Du kan se hvordan dette bidro til et flott audiovisuelt resultat nedenfor:

Spørsmål:

Bevar nøyaktig ansikt, frisyre, identitet, hudtone og kropp fra @image1. Autentisk indonesisk kvinne i overdimensjonert terrakottaskjorte i lin, støvete burgunderbukser med vide ben, brune skinnsandaler, små gullfargede øredobber og løst, bølgete hår.

Rå vlog med vippekamera fra slutten av 2000-tallet: kraftig risting, fokusjakt, eksponeringsskift, varme, falmede farger, digital støy. Ingen posering eller moderne gradering.

00:00–00:04 Går smilende gjennom en tropisk landsby: «I dag leter vi etter ferske kokosnøtter!»

00:04–00:08 Ser på selgeren som hakker kokosnøtt, begeistret.

00:08–00:12 Nipper til kokosvann og smiler: «Dette er så forfriskende!»

00:12–00:16 Prater/ler med landsbyboere som holder kokosnøtt.

00:16–00:20 Prøver å åpne kokosnøtt, sliter, ler; lokalbefolkningen jubler.

00:20–00:24 Øser av kjøttet, smaker, tommelen opp.

00:24–00:27 Går og vinker til lokalbefolkningen.

00:27–00:30 Smiler, vinker: «Vi sees på mitt neste eventyr. Ha det!»

Inndata

Produksjon

根据这张图片里的女人形象,生成一张她正面生活照,形象,发型,脸部,肤色等等都要一样.webp

En annen ting jeg la merke til er at hvis det er en scene med flere karakterer, må du huske å bruke etiketter. For eksempel: «[Sarah, hes stemme] sier: 'Vi må dra klokken seks.' «[Jon, myk, nølende stemme] ser tilbake på henne og sier: 'Det går bra. La oss begynne å pakke.'»

Vil du se flere eksempler på hva Wan 3.0 kan skape? Sjekk ut denne artikkelen om de beste brukstilfellene for Wan 3.0 .

Vil du generere videoer med Wan 3.0? Gå til Pollo AI

Nå som du har en klar forståelse av hvordan du lager en solid Wan 3.0-ledetekst, vil du sannsynligvis begynne å generere videoer med den. I så fall anbefaler jeg at du går til Pollo AI. Hvorfor? Fordi det er den ultimate AI-kreative suiten som inneholder alle de beste AI-videomodellene på ett sted.

Her får du tilgang til Wan 3.0 , Seedance 2.5 , Kling 3.0 og Veo 3.1 , og dusinvis av andre alternativer, noe som gjør det enkelt å sammenligne ulike resultater for best mulig resultat. Og ikke bare det, du kan også laste opp alle ressursene dine og være vert for alle prosjektene dine på denne ene plattformen.

Grensesnittet til Pollo.ais markedsføringsstudio for å lage visuelt innhold.

I bunn og grunn anser jeg det for å være det perfekte arbeidsområdet som vil utfylle hva enn du har tenkt å gjøre med Wan 3.0. Best av alt? Det tilbyr Pollo Agent , en AI-agent for videoer , historier , annonser og kreativ design , som automatiserer alt fra struktur og tempo til visuelle elementer, noe som betyr at den også kan veilede deg i å lage den perfekte prompten.

Prøv Wan 3.0 gratis på Pollo AI nå

Gjør dine dristigste ideer til virkelighet med Wan 3.0 og gjør dem om til publiseringsklare videoer på Pollo AI.

Begynn å lage gratis
Begynn å lage gratis

Alt det tar er noen få minutter, så vil den gjøre enhver grov idé du har om til et produksjonsklart resultat. I tillegg kommer Pollo AI med dusinvis av verktøy du kan bruke i etterproduksjon, som AI-videoforlengeren , som sikrer at du har alt du trenger for å få jobben gjort.

Bare gå til Pollo AI og registrer deg for en konto. Du kan begynne å generere videoer med Wan 3.0 uten kostnad via den gratis prøveperioden . Jeg garanterer at etter noen timer på denne plattformen vil du begynne å se den som din egen personlige videoproduksjonsassistent.

Vanlige spørsmål om Wan 3.0-ledetekstveiledningen

Hvor lang kan en Wan 3.0-generasjon være?

Med Wan 3.0 kan du generere videoer med innebygd lyd på opptil 30 sekunder i én omgang. Bare sørg for at prompten din tar hensyn til hvert sekund av opptaket hvis du vil ha best mulig resultat. Ellers kan den fylle ut hullene ved å bruke sin egen dømmekraft på uventede måter.

Hvor mange referanser støtter Wan 3.0?

Du kan laste opp opptil 10 referansebilder, 5 videoer og 5 lydfiler, med støtte for dokument- og nettsidelenker inkludert per generasjon. Husk alltid å merke hva hver av disse referansene gjør; ellers kan de ende opp med å påvirke det endelige resultatet tilfeldig.

Hvordan kan jeg forbedre en lang Wan 3.0-ledetekst?

Fokuser på å gi Wan 3.0 lagdelte direktiver. For eksempel: «En stille skog. Plutselig rister bakken og sprekker. Zombier klatrer ut av sprekkene.» Skill alle nøkkeltilstandene og behandle dem som uavhengige kronologiske taktslag. For 30-sekundersscener, bruk tidsstempler for hver slutttilstand.

Hvordan bør jeg be om generering av bilde til video?

Wan 3.0s evne til referanseforankring er ganske sterk, så den foretrekker en gradvis utvikling fremfor drastiske endringer i kildebildet. Fokuser på å lage ledetekster som viser en naturlig progresjon av scenen ved å spesifisere hvordan kameraet eller motivet skal bevege seg i den.

Hvordan kan jeg forbedre karakterkonsistensen med Wan 3.0?

Du kan bruke et referansebilde/-video av karakteren, og deretter definere attributtene du vil at Wan 3.0 skal holde stabile. For eksempel: «Bevar kvinnens lange blonde hår og ansiktstrekk gjennom hele scenen.» Bare minimer antallet karakterer, handlinger og stedsendringer.

Hvordan kontrollerer jeg lyd når jeg bruker Wan 3.0?

Når du skriver oppgaven, bør du plassere lyd i en egen kategori og beskrive kilden/oppførselen til hver enkelt separat. For eksempel: «En mild kvinnestemme snakker. Regn banker på glasset. Pianomusikk spiller under dialogen.» Dette dekker stemme, lydeffekter og bakgrunnsmusikk, slik at hver del fanges opp i den genererte scenen.

Du liker kanskje også

Se mer

Wan 3.0-anmeldelse: Jeg testet den i 10 dager, og her er det jeg fant ut

Denne anmeldelsen av Wan 3.0 deler det jeg fant etter å ha testet denne modellen på tvers av ekte videoprosjekter. Lær hvordan den presterte, og hvorfor jeg anbefaler å bruke Wan 3.0 på Pollo AI.

Wan 3.0 vs Seedance 2.5: Hvilken AI-videogenerator bør du bruke?

Lær mer om Wan 3.0 vs Seedance 2.5 her! Les vår detaljerte sammenligningsguide av Wan 3.0 og Seedance 2.5 for å finne ut hvilken AI-videogenerator som er best for deg å bruke i dag!

Seedance 2.5-veiledning for oppgaver: Slutt å gjette, begynn å regissere

Seedance 2.5 oppfordrer deg til å slutte å skrive poesi og begynne å regissere! Lås opp de beste Seedance 2.5-formlene for imponerende tekst-, bilde- og videoutdata.

Gemini Omni (Veo 4) vs. Seedance 2.0: Hvilken er den beste AI-videogeneratoren for deg?

Sammenlign Gemini Omni (Veo 4) og Seedance 2.0 på tvers av hovedfunksjonene. Se hvilken AI-videogenerator som passer dine behov, og prøv Gemini Omni og Seedance 2.0 gratis på Pollo AI!