首頁/部落格/AI模型洞察/Wan 3.0 提示詞指南:如何充分發揮 Wan 3.0 的最佳效果

Wan 3.0 提示詞指南:如何充分發揮 Wan 3.0 的最佳效果

我使用Wan 3.0一段時間了,感覺它比之前的版本更偏向導演主導。現在它支援 30 秒的劇本生成,並支援文字、圖像、音訊、視訊、文件和網頁等多種輸入格式,因此提示操作需要更精細的技巧。想知道訣竅嗎?請繼續閱讀,我們將詳細解釋Wan 3.0最適合處理哪些輸入格式。

太長不看

提示開頭寫的內容, Wan 3.0會先鎖定,因為它會事先規劃構圖。在確定主體之前,先確定鏡頭和場景,然後描述動作,指定光線和風格,最後再加入音訊。此外,也要明確每個參考物的作用,以避免隨機結果。你可以使用Pollo AI作為理想的工作空間,透過Wan 3.0產生影片。

Wan 3.0提示指南:了解關鍵面

在深入探討如何編寫完美的Wan 3.0提示符之前,您首先需要了解任何基本提示符請求的核心公式,所以讓我們快速地為您分解一下:

方面

待回答的問題

例子

主題主題是什麼?哪些內容必須保持可辨識性?一輛斑駁的藍色送貨自行車,配有一個柳條籃子。
場景它在哪裡?周圍環境如何?雨後的法國狹窄街道,瓦片外牆,積水,反光的路面。
運動哪些物體在移動?以什麼順序移動?以什麼速度移動?自行車緩緩下坡,輪胎濺起水花。
相機控制這個鏡頭該如何拍攝?低角度追蹤拍攝,35mm鏡頭,柔和的陰天光線
風格化該場景遵循怎樣的視覺美學?色彩柔和的紀錄片影片。

為什麼Wan 3.0需要更細緻的提示?

Wan 3.0的增強功能迫使我採用了與 Wan 2.7 不同的提示方式。其中一個原因是AI影片的最大時長已延長至每段 30 秒。那麼,這為什麼重要呢?原因如下…

我對Wan 3.0進行了相當全面的測試,發現達不到預期效果的影片和符合預期的影片之間的一個關鍵區別在於,我的提示缺乏時間控制。當我只是簡單地給出視覺描述而沒有考慮到鏡頭的每一秒時,效果就大打折扣。

如果沒有清晰的時間線, Wan 3.0會用隨機變化填滿空白秒數。最佳的提示會規劃整個片段中的關鍵操作和鏡頭運動,同時賦予每個圖像、影片、音訊檔案或連結明確的作用。

我還注意到, Wan 3.0會儘早確定構圖,通常以最初的提示細節作為場景的基礎。順序很重要,尤其是在圖像轉影片時,它能保留初始構圖和主題特徵,但往往難以處理劇烈的變化。

例如,如果我要將照片渲染成影片廣告,並要求過於激進的轉換,可能無法獲得理想的結果。考慮到所有這些因素,我認為使用Wan 3.0需要一種細緻的方法。那麼,讓我們來看看如何才能獲得最佳的提示資訊。

在深入了解Wan 3.0提示之前,請先閱讀我們的Wan 3.0指南,以了解該模型的最新升級。

立即在Pollo AI免費試用Wan 3.0

輸入您的創意提示,使用Pollo AI上的Wan 3.0製作精彩影片。

開始免費創作
開始免費創作

Wan 3.0提示:文字轉視頻與圖像轉視頻

您為 T2V 製作Wan 3.0提示的方式與 I2V 不同,因為整個序列取決於正確定義主體、環境、動作、攝影機和視覺風格。

正如我之前提到的, Wan 3.0會事先規劃構圖,所以你提示的開頭部分會是模型首先鎖定的內容,然後再考慮場景的其他部分。例如,如果你的提示以描述一種氛圍開頭,那麼Wan 3.0會圍繞著這種氛圍而不是主體來構圖。

因此,在確定拍攝對象和想要保留的特徵之前,你應該先確定鏡頭類型。然後,你可以著手定義光線、風格,最後加上對話、音效或音樂。以下是我製作的一個動畫短片範例:

迅速的

輸出

電影級8K風格化3D長鏡頭。一位頭戴藍色頭巾的年輕男子使用全像智慧手錶,展開機械手臂清洗他沾滿泥濘的馬自達RX-7。車子隨即升級,湧動著藍色電流,由白色變成閃耀著紫色光芒的亮黑色。這輛黑色跑車在雨後霓虹閃爍的賽博朋克夜城中疾馳。擋風玻璃上的抬頭顯示器啟動,汽車騰空而起,在空中變形為一個巨大的雙足機甲,駕駛員的身影出現在發光的胸前駕駛艙中。機甲重重地落在街道上,然後啟動藍色噴射推進器飛向高樓,英勇地屹立在摩天大樓的屋頂上。

另一方面,如果您打算使用參考圖像,則需要採用不同的方法。就我使用經驗而言, Wan 3.0似乎比其他型號更嚴格地限制了來源圖像的構圖和主體。

正因如此,使用那些會帶來徹底改變或突兀變化的提示可能會相當困難。在大多數情況下, Wan 3.0效果會不盡如人意,無法達到我對場景的預期,所以我建議使用過渡平滑、連續的提示,例如以下範例:

迅速的:

四鏡頭實拍序列。使用圖像1作為確切的開場畫面和視覺錨點。保留傭兵公主、粗獷走私犯的臉部特徵、服裝、手槍、太空船佈景、燈光和鏡頭方向。典型的80年代太空動作電影:真人演員、實景佈景、橡膠外星人服裝、全尺寸電子動畫機器人、實拍火花/煙霧、克制的雷射特效、35毫米變形鏡頭。

第一槍(0-3.2秒):鎖定中距離雙槍射擊。她向左側傾斜,靴子抬起,手槍晃動;他坐在右側。

鏡頭2(3.2-6.7秒):快速倒放。外星人從他身後向左疾馳而去。她精準地射出一槍,子彈掠過他的肩膀;子彈擊中胸口,火花四濺,外星人倒地。管弦樂般的刺耳聲,雷射爆裂聲。

鏡頭3(6.7-10.3秒):低四分之三視角。機器人向右跺腳,舉起手臂。她轉身,開兩槍(先擊中關節,然後是胸部);手臂落下,撞擊地面,火花四濺,冒出濃煙。他目瞪口呆;她放下手槍。打擊樂響起,銅管樂器奏出華麗的樂章。

鏡頭4(10.3-14秒):雙人特寫。保持原有的視線。她回到百無聊賴的姿勢,手槍晃來晃去,目光呆滯。她依舊輕鬆自如,鎮定自若,一副漠不關心的樣子。

輸入

輸出

1787800046944-64220116-6849-48a5-b8cd-426e0ca3c699.webp

Wan 3.0提示:處理運動

以我個人經驗來看,使用Wan 3.0處理動作需要相當多的順序設定。雖然你可以使用類似「一個人走過沙灘」這樣的提示,但我認為這只是一個簡單的預設動作,無法清楚地展現動作的時機和互動方式。

更好的辦法是添加一系列可觀察的事件。例如,「一個男人走過沙灘,聽到一聲響亮的狗吠後停下腳步,轉身看向聲音來源,低頭看到一隻金毛犬正朝他跑來」。這樣就能創造出更逼真的逐格運動效果。

在Pollo AI免費試用Wan 3.0 💳 一次訂閱,享受所有模型 • 🌟 無需註冊

但同時,你也不希望影片片段充斥著過多的動作編排。我注意到Wan 3.0在這方面表現不佳。當我嘗試讓角色執行過多精細動作或與過多物體互動時,輸出效果並不理想。

因此,儘管Wan 3.0現在支援更長的 30 秒影片片段,但我建議您專注於為主體設定一個清晰、直接的任務/核心動作,以確保時間上的穩定性。您可以在我下面生成的逼真影片中看到一個很好的例子:

迅速的:

@Image1 是唯一的主角。請始終保持她的面容、髮型、身材和服裝不變。超寫實的 30 年代電影風格畫面,定格在陽光明媚的意大利老城街道上(石頭建築、鵝卵石路、咖啡館、行人、鴿子)。

0-5秒:她在日常生活中自信地走向鏡頭(斯坦尼康向後移動)。

5-8秒:停止,打響指→優雅的無形衝擊波凍結一切。

8-20秒:只有她一動;鏡頭在她走在冰凍的街道上時旋轉,她觸摸了一滴懸浮的水滴,然後對著鏡頭露出半個微笑,再次按下快門。

20-30秒:第二道衝擊波解凍了世界;她保持冷靜。

風格:照片級寫實,50mm焦距,淺景深,自然光,細微顆粒感,逼真的物理效果/視覺特效。無變形、無額外元素、無瑕疵。

輸入

輸出

根據這張圖片裡的女人形象,生成一張她穿T恤的平面模特兒照片.webp

Wan 3.0提示:攝影機語言

對於鏡頭語言,我喜歡遵循一個簡單的經驗法則,即用四個部分來建立畫面:鏡頭大小、角度、運動和鏡頭。例如,“先從高角度拍攝一個廣角全景鏡頭,然後緩慢地向前推移鏡頭直至燈塔;使用50毫米電影視角。”

您可以在所有Wan 3.0提示中使用此規則,但請務必避免使用自相矛盾的語言。例如,您不能說「一台鎖定的固定攝影機快速繞著主體旋轉」。這兩個不同的指令相互矛盾,因此不要要求模型執行此操作。

例如,如果您想產生類似預告片影片的動態序列,這裡有一個通用的攝影機視角指南,您可以在製作場景時反覆參考:

意圖

攝影機方向

視覺效果

設立地點廣角鏡頭、慢速搖臂或拉遠鏡頭背景和規模
建立親密關係中近景,輕輕推入情緒關注
後續行動側向移動鏡頭或前方移動鏡頭動力和參與
重視慢軌道,中心構築英雄主義或標誌性強調
保留細節固定特寫鏡頭,淺景深聚焦與檢查
製造不穩定可控手持運動緊迫性或文獻能量

另一點要注意的是,僅僅描述「電影般的鏡頭運動」不足以在Wan 3.0中設定合適的場景。你需要更具體一些;例如,「當狗奔跑時,鏡頭以步行速度向左移動」會產生更符合預期的效果。以下是一個很好的例子:

迅速的

輸出

風格:超寫實電影級冬季紀錄片,4K HDR,自然光,淺景深,流暢的鏡頭運動,柔和的色彩調校,營造寧靜的氛圍。場景1(0-3秒):無人機空拍鏡頭,一座小木屋隱藏在白雪皚皚的松林深處。大雪輕柔飄落,溫暖的金光從窗戶透出。隨著鏡頭緩緩下降,煙囪升起縷縷炊煙。場景2(3-6秒):木屋內,同一位女子裹著柔軟的羊毛毯,坐在劈啪作響的石砌壁爐旁,正在讀書。場景3(6-10秒):她打開木質前門,踏上積雪覆蓋的門廊。雪花輕柔地落在她的毛衣和頭髮上。她微笑著,緩緩深吸一口氣,眺望著寂靜的森林,鏡頭在她周圍輕輕環繞。場景4(10-13秒)特寫:靴子在未踏過的雪地上留下新鮮的腳印,她戴著手套的手拂去松枝上的積雪,雪花落在溫暖的小屋窗戶上,煙霧飄散到清冷的冬日空氣中。場景5(13-15秒)黃昏時分,鏡頭從小屋拉遠。雪繼續飄落,小屋在廣闊的白色森林中漸漸縮小。

除了學習如何製作Wan 3.0提示之外,還可以閱讀我們的Wan 3.0使用指南,以創建更好的AI影片。

Wan 3.0提示:音訊/對話場景

我們知道Wan 3.0支援原生音訊生成,但很容易忘記音訊也需要像視覺效果一樣精心製作。就對話而言,我在使用Wan 3.0產生日常 vlog教學、短片等內容後總結出的經驗是:要盡量保持台詞簡短。

遺憾的是,口型同步並不總是那麼可靠,所以請將對話視為簡短的表演提示,而不是冗長的劇本敘述。就我所見,這種方法在Wan 3.0中效果最佳。您可以在下方看到它如何幫助實現出色的視聽效果:

迅速的:

保留@image1中人物的臉部、髮型、身分、膚色和體型。一位道地的印尼女性,身穿寬鬆的赤陶色亞麻襯衫、灰褐色闊腿褲、棕色皮涼鞋、小巧的金色耳環,一頭蓬鬆的波浪捲髮。

2000 年代末期翻蓋相機拍攝的原始 vlog:畫面抖動嚴重,對焦不準,曝光偏移,色調偏暖偏暗,有數位雜訊。沒有擺拍,也沒有現代調色。

00:00–00:04 漫步熱帶村莊,面帶微笑:“今天我們要去尋找新鮮的椰子!”

00:04–00:08 看著小販切椰子,很興奮。

00:08–00:12 啜飲椰子水,微笑著說:“這太清爽了!”

00:12–00:16 與村民聊天/大笑,手裡拿著椰子。

00:16–00:20 試著打開椰子,費了好大勁,笑了;當地人歡呼。

00:20–00:24 舀起肉,嚐一嘗,豎起大拇指。

00:24–00:27 邊走邊向當地人揮手。

00:27–00:30 微笑揮手:“下次冒險再見!拜拜!”

輸入

輸出

根據這張圖片裡的女人形象,生成一張她的正面生活照片,形象,髮型,嚴肅,膚色等等都要一樣.webp

我還注意到,如果是多角色場景,一定要使用標籤。例如,“[莎拉,沙啞的聲音]說:‘我們六點出發。’”“[喬恩,輕柔而猶豫的聲音]回頭看著她,說:‘好的。我們開始收拾行李吧。’”

想了解更多Wan 3.0的應用案例嗎?請查看這篇關於Wan 3.0最佳應用案例的文章。

想用Wan 3.0生成影片?請訪問Pollo AI

既然您已經清楚了解如何製作一個優秀的Wan 3.0提示,您可能想開始用它來產生影片。如果是這樣,我建議您使用Pollo AI。為什麼呢?因為它是一個功能強大的AI創意套件,匯集了所有頂尖的AI視訊模型。

在這裡,您可以存取Wan 3.0Seedance 2.5Kling 3.0Veo 3.1等數十種軟體,方便您比較不同的輸出效果,從而獲得最佳結果。不僅如此,您還可以將所有資源上傳到這個平台,並將所有專案託管在這個平台上。

Pollo.ai行銷工作室的介面,用於創建視覺內容。

從本質上講,我認為它是一個完美的工作空間,可以完美配合你使用Wan 3.0 的任何計劃。最棒的是什麼?它提供了Pollo 智能體 ,一個用於影片故事廣告創意設計AI Agent,它可以自動完成從結構和節奏到視覺效果的一切工作,這意味著它還可以引導你創作完美的提示語。

立即在Pollo AI免費試用Wan 3.0

使用Wan 3.0將您最大膽的想法變為現實,並在Pollo AI上將其轉換為可發布的影片。

開始免費創作
開始免費創作

只需幾分鐘,就能將你任何粗略的想法轉化為可用於製作的成品。此外, Pollo AI還配備了數十種後製工具,例如AI視訊擴展器,確保你擁有完成工作所需的一切。

只需前往Pollo AI並註冊一個帳號即可。您可以透過免費試用版開始使用Wan 3.0產生影片。我保證,只需幾個小時,您就會發現它就像您自己的私人影片製作助手一樣得心應手。

關於Wan 3.0提示指南的常見問題解答

Wan 3.0 的生命週期可以有多長?

Wan 3.0可讓您一次產生最長 30 秒的原生音訊的影片。為了獲得最佳效果,請確保您的提示訊息涵蓋鏡頭的每一秒。否則,它可能會根據自身判斷以意想不到的方式填充空白。

Wan 3.0支援多少個引用?

您最多可以上傳 10 張參考圖片、5 個影片和 5 個音訊文件,每次生成都支援新增文件和網頁連結。請務必標記每個參考文件的作用;否則,它們可能會隨機影響最終輸出結果。

如何改進過長的Wan 3.0提示符號?

重點在於為Wan 3.0提供分層指令。例如:「一片寂靜的森林。突然,地面震動並裂開。殭屍從裂縫中爬出。」將所有關鍵狀態分開,並將它們視為獨立的時間節點。對於 30 秒的場景,為每個結束狀態使用時間戳記。

我應該如何觸發圖像轉視頻生成?

Wan 3.0的參考錨定能力非常強,因此它傾向於對來源圖像進行漸進式的演變,而不是劇烈的改變。重點在於精心設計提示,透過指定攝影機或拍攝主體在場景中的移動方式,來展現場景的自然發展過程。

如何提升Wan 3.0的角色一致性?

你可以使用角色的參考圖像/視頻,然後定義你希望Wan 3.0保持穩定的屬性。例如,「在整個場景中保持女性的金色長髮和臉部特徵不變。」盡量減少角色數量、動作和地點變化。

使用Wan 3.0時如何控制音訊?

編寫提示時,應將音訊單獨歸類,並分別描述每種音訊的來源/表現形式。例如:「一個溫柔的女聲響起。雨滴敲打著玻璃。鋼琴曲在對話中緩緩響起。」這就涵蓋了人聲、音效和背景音樂,確保生成的場景中每個部分都得到了體現。

您可能也喜歡

查看更多

Wan 3.0 評測:我實測了 10 天,這是我的發現

這篇 Wan 3.0 評測分享了我在真實影片專案中測試這個模型後的發現。了解它的表現,以及為什麼我推薦在 Pollo AI 上使用 Wan 3.0。

Wan 3.0 vs Seedance 2.5:你应该使用哪款 AI 视频生成器?

在这里了解更多关于 Wan 3.0 vs Seedance 2.5 的信息!阅读我们关于 Wan 3.0 和 Seedance 2.5 的详细比较指南,找出哪款 AI 视频生成器最适合你今天使用!

Seedance 2.5 提示指南:停止猜測,開始指導

Seedance 2.5 提示您停止寫詩,開始導演吧!解鎖Seedance 2.5 的最佳公式,打造驚人的文字、圖像和影片輸出。

Gemini Omni (Veo 4) 對比 Seedance 2.0:哪款 AI 影片生成器更適合你?

比較 Gemini Omni (Veo 4) 和 Seedance 2.0 的主要功能。看看哪款 AI 影片產生器更符合你的需求,並在 Pollo AI 上免費試用 Gemini Omni 和 Seedance 2.0!