دليل مطالبات Wan 3.0: كيف تحصل على أفضل ما في Wan 3.0
لقد استخدمتُ Wan 3.0 لفترة، وأستطيع القول إنه نموذج يعتمد على توجيه المخرج أكثر من سابقيه. يدعم الآن إنشاء مقاطع فيديو مدتها 30 ثانية باستخدام النصوص والصور والصوت والفيديو والمستندات وصفحات الويب كمدخلات مرجعية، لذا يتطلب التوجيه الآن دقةً أكبر. هل تريد معرفة السر؟ تابع القراءة لنشرح لك ما الذي يستجيب له Wan 3.0 على أفضل وجه.
باختصار شديد
أيًا كان ما تكتبه في بداية طلبك، سيعتمد عليه برنامج Wan 3.0 أولًا لأنه يُحدد التكوين مُسبقًا. حدد اللقطة والمشهد قبل تحديد الموضوع، ثم صف الحركة، وحدد الإضاءة والأسلوب، ثم أضف الصوت. كذلك، حدد دور كل مرجع لتجنب النتائج العشوائية. يمكنك استخدام Pollo AI كبيئة عمل مثالية لإنشاء مقاطع فيديو باستخدام Wan 3.0.
دليل استخدام Wan 3.0 : فهم الجوانب الرئيسية
قبل أن نتطرق إلى كيفية صياغة موجه Wan 3.0 المثالي، عليك أولاً فهم الصيغة الأساسية لأي طلب موجه أساسي، لذا دعونا نشرحها لك بإيجاز:
وجه | سؤال للإجابة عليه | مثال |
|---|---|---|
| موضوع | ما هو الموضوع وما الذي يجب أن يبقى قابلاً للتمييز؟ | دراجة توصيل زرقاء باهتة مزودة بسلة من الخوص. |
| مشهد | أين يقع، وماذا يحيط به؟ | شارع فرنسي ضيق بعد المطر، واجهات مبلطة، برك من الماء، رصيف عاكس |
| حركة | ما الذي يتحرك، وبأي ترتيب، وبأي سرعة؟ | تتدحرج الدراجة ببطء نحو أسفل التل؛ ويتناثر الماء من الإطارات |
| التحكم بالكاميرا | كيف ينبغي تصوير المشهد؟ | لقطة تتبع من زاوية منخفضة، عدسة 35 مم، إضاءة خافتة من الغيوم |
| أسلوب | ما هو الطابع الجمالي البصري الذي يحكم المشهد؟ | فيديو وثائقي بألوان هادئة |
لماذا يتطلب Wan 3.0 توجيهًا أكثر دقة؟
أجبرتني الإمكانيات المحسّنة لـ Wan 3.0 على اعتماد أسلوب مختلف في التوجيه عما كنت أعتمد عليه في WAN 2.7. أحد الأسباب هو زيادة الحد الأقصى لمدة مقاطع الفيديو المُعالجة بالذكاء الاصطناعي إلى 30 ثانية لكل مقطع. الآن، ما أهمية ذلك؟ إليكم السبب...
لقد اختبرتُ برنامج Wan 3.0 بدقة، وكان الفرق الرئيسي بين مقاطع الفيديو التي لم ترقَ إلى مستوى توقعاتي وتلك التي حققتها هو غياب التحكم الزمني في التعليمات. فعندما اكتفيتُ بتقديم وصف مرئي دون مراعاة كل ثانية من اللقطة، فشلت العملية.
بدون جدول زمني واضح، سيُملأ Wan 3.0 الثواني الفارغة بتغييرات عشوائية. أفضل التنبيهات تُحدد الإجراءات الرئيسية وسلوك الكاميرا خلال المقطع، مع إعطاء كل صورة أو فيديو أو ملف صوتي أو رابط دورًا واضحًا.
لاحظتُ أيضاً أن Wan 3.0 يُرسي التكوين مبكراً، وغالباً ما يستخدم تفاصيل المشهد الأولى كأساس له. الترتيب مهم، خاصةً عند تحويل الصور إلى فيديو، حيث يحافظ على التكوين الأولي وهوية الموضوع، ولكنه يميل إلى عدم تنفيذ التغييرات الجذرية بشكل كامل.
على سبيل المثال، إذا كنتُ أقوم بتحويل صورة إلى إعلان فيديو وطلبتُ تعديلاً جذرياً للغاية، فقد لا أحصل على نتيجة مرضية. وبالنظر إلى كل هذه الاعتبارات، أعتقد أنه من الإنصاف القول إن استخدام Wan 3.0 يتطلب نهجاً دقيقاً. لذا، دعونا نلقي نظرة على كيفية الحصول على أفضل التوجيهات الممكنة.
قبل الخوض في مطالبات Wan 3.0 ، استكشف أحدث ترقيات هذا الطراز في دليلنا حول ماهية Wan 3.0 .
جرّب Wan 3.0 مجاناً على Pollo AI الآن
أدخل أفكارك الإبداعية لإنشاء مقاطع فيديو مذهلة باستخدام Wan 3.0 على Pollo AI.
ابدأ الإبداع مجاناً
توجيهات Wan 3.0 : تحويل النص إلى فيديو مقابل تحويل الصورة إلى فيديو
ستختلف طريقة صياغة مطالبات Wan 3.0 لـ T2V عن I2V لأن التسلسل بأكمله يعتمد على تحديد الموضوع والبيئة والحركة والكاميرا والأسلوب المرئي بشكل صحيح.
وكما ذكرتُ سابقاً، يقوم برنامج Wan 3.0 بتحديد التكوين مُبكراً، لذا فإن ما تبدأ به تعليماتك هو ما يُثبّت النموذج أولاً قبل بقية المشهد. على سبيل المثال، إذا بدأت تعليماتك بوصف حالة مزاجية، فسيركز برنامج Wan 3.0 على تلك الحالة المزاجية بدلاً من العناصر الرئيسية.
لهذا السبب، ينبغي عليك تحديد نوع لقطة الكاميرا قبل تحديد الموضوع والخصائص التي ترغب في إبرازها. بعد ذلك، يمكنك تحديد الإضاءة والأسلوب، ثم إضافة الحوار والمؤثرات الصوتية أو الموسيقى. إليك فيلم رسوم متحركة قمت بإنشائه كمثال:
اِسْتَدْعَى | الناتج |
|---|---|
| لقطة سينمائية ثلاثية الأبعاد متواصلة بتقنية 8K. شاب يرتدي عصابة رأس زرقاء يستخدم ساعة ذكية ثلاثية الأبعاد لتشغيل أذرع آلية تغسل سيارته مازدا RX-7 الملطخة بالطين. تتطور السيارة، فتتدفق عليها طاقة كهربائية زرقاء وتتحول من الأبيض إلى الأسود اللامع مع طاقة أرجوانية متوهجة. تنطلق السيارة السوداء بسرعة عبر مدينة سايبربانك ليلية مضاءة بأضواء النيون ومغطاة بالمطر. يتم تفعيل شاشة عرض المعلومات على الزجاج الأمامي، وتقفز السيارة، متحولة في الهواء إلى روبوت عملاق ثنائي الأرجل مع ظهور السائق في قمرة القيادة المتوهجة على صدره. يهبط الروبوت بقوة على الطريق، ثم يستخدم محركات نفاثة زرقاء ليطير عالياً ويقف بشجاعة على سطح ناطحة سحاب. |
من ناحية أخرى، إذا كنت تنوي استخدام صور مرجعية، فإن ذلك يتطلب منهجًا مختلفًا. من خلال تجربتي، يبدو أن Wan 3.0 يُحكم قبضته على تكوين الصورة الأصلية وهوية موضوعها بشكل أكثر صرامة من النماذج الأخرى.
لهذا السبب، قد يكون من الصعب استخدام توجيهات تُحدث تحولات جذرية أو تغييرات مفاجئة. في معظم هذه الحالات، لن يُحقق برنامج Wan 3.0 الأداء المرجو ولن يُلبي رؤيتي للمشهد، لذا أنصح باستخدام توجيهات ذات انتقالات سلسة ومتواصلة كما يلي:
اِسْتَدْعَى:
مشهد تمثيلي حيّ من أربع لقطات. استخدم الصورة رقم 1 كإطار افتتاحي دقيق ونقطة ارتكاز بصرية. حافظ على ملامح الأميرة المرتزقة، والمهرب المتمرس، والأزياء، والمسدس، ومجموعة سفينة الفضاء، والإضاءة، وتوجيه الشاشة كما هي. فيلم فضائي واقعي من ثمانينيات القرن العشرين: ممثلون حقيقيون، ومجموعات تصوير مادية، وبدلة فضائية مطاطية، وروبوت متحرك بالحجم الطبيعي، وشرارات/دخان عملي، وأشعة ليزر بصرية محدودة، وتقنية أنامورفيك 35 مم.
الطلقة الأولى (0-3.2 ثانية): طلقتان متوسطتان ثابتتان. تستلقي إلى اليسار، رافعةً حذائها، ومسدسها متدلٍ؛ يجلس هو إلى اليمين.
اللقطة الثانية (3.2–6.7 ثانية): انعكاس سريع. يندفع الكائن الفضائي يسارًا خلفه. تطلق رصاصة دقيقة واحدة بجانب كتفه؛ يصيب الرصاص صدره، شرارة، ويسقط. موسيقى أوركسترالية صاخبة، صوت انفجار ليزر.
اللقطة الثالثة (6.7–10.3 ثانية): لقطة منخفضة من زاوية ثلاثة أرباع. تدوس الروبوتة إلى اليمين، وترفع ذراعها. تدور، وتطلق رصاصتين (على المفصل ثم الصدر)؛ تسقط الذراع، وتتحطم مع شرارات ودخان. يحدق بها في ذهول؛ تخفض المسدس. دويّ إيقاعي، وصوت آلات نفخ نحاسية.
اللقطة الرابعة (10.3–14 ثانية): لقطة مقرّبة لشخصين. خط النظر الأصلي. تعود إلى وضعية الملل، المسدس متدلٍّ، تحدق. تبقى هادئة، مسيطرة على نفسها، وغير متأثرة.
مدخل | الناتج |
|---|---|
![]() |
توجيه Wan 3.0 : معالجة الحركة
انطلاقاً من تجربتي الشخصية، يتطلب التعامل مع الحركة باستخدام Wan 3.0 قدراً كبيراً من التخطيط والتسلسل. صحيح أنه يمكنك استخدام عبارة مثل "رجل يمشي على الشاطئ"، إلا أن هذا الوصف مجرد إجراء مُعد مسبقاً، مما يجعل التوقيت والتفاعل غير واضحين.
الخيار الأفضل هو إضافة سلسلة من الأحداث الملحوظة. على سبيل المثال، "رجل يسير على الشاطئ، يتوقف عندما يسمع نباحًا عاليًا، يستدير عائدًا نحو الصوت، وينظر إلى أسفل ليرى كلبًا من فصيلة غولدن ريتريفر يركض نحوه". هذا يخلق حركة أكثر واقعية إطارًا بإطار.
لكن في الوقت نفسه، لا ترغب في إثقال المقطع بحركات رقص مفرطة. هذا أمر آخر لاحظته في برنامج Wan 3.0، حيث لا يستجيب له بشكل جيد. فعندما حاولت جعل شخصية ما تؤدي الكثير من الحركات الدقيقة أو تتفاعل مع العديد من العناصر، لم تكن النتيجة مثالية.
لذا، على الرغم من أن Wan 3.0 يدعم الآن مقاطع فيديو أطول مدتها 30 ثانية، أنصحك بالتركيز على إعطاء الشخص مهمة/فعلًا مركزيًا واضحًا ومباشرًا للمساعدة في ضمان استقرار التوقيت. يمكنك رؤية مثال جيد على ذلك في الفيديو الواقعي الذي أنشأته أدناه:
اِسْتَدْعَى:
الشخصية الرئيسية الوحيدة هي @Image1. حافظ على ملامح وجهها وتسريحة شعرها وجسمها وملابسها بدقة تامة. لقطة سينمائية واقعية للغاية من ثلاثينيات القرن الماضي، مع تجميد الزمن في شارع مشمس ببلدة إيطالية قديمة (مبانٍ حجرية، أحجار مرصوفة، مقاهٍ، مشاة، حمام).
0-5 ثوانٍ: تمشي بثقة نحو الكاميرا (تتحرك الكاميرا الثابتة للخلف) وسط الحياة الطبيعية.
5-8 ثوانٍ: يتوقف، يفرقع الأصابع → موجة صدمة أنيقة غير مرئية تجمد كل شيء.
8-20 ثانية: هي فقط من تتحرك؛ تدور الكاميرا بينما تمشي في الشارع المتجمد، وتلمس قطرة معلقة، ثم تواجه الكاميرا بنصف ابتسامة وتلتقط صورة أخرى.
20-30 ثانية: موجة الصدمة الثانية تذيب تجمد العالم؛ وهي تبقى هادئة.
النمط: واقعي للغاية، 50 مم، عمق مجال ضحل، إضاءة طبيعية، حبيبات دقيقة، فيزياء/مؤثرات بصرية واقعية. لا يوجد تحويل أو إضافات أو تشوهات.
مدخل | الناتج |
|---|---|
![]() |
توجيهات Wan 3.0 : لغة الكاميرا
فيما يخص لغة الكاميرا، أفضّل اتباع قاعدة بسيطة وهي تقسيمها إلى أربعة أجزاء: حجم اللقطة، والزاوية، والحركة، والعدسة. على سبيل المثال: "لقطة واسعة من زاوية علوية، ثم لقطة بطيئة للأمام مع تحريك الكاميرا على دوللي باتجاه المنارة؛ باستخدام منظور سينمائي 50 مم".
يمكنك استخدام هذه القاعدة في جميع أوامر Wan 3.0 ، ولكن تذكر دائمًا تجنب اللغة المتناقضة. على سبيل المثال، لا يمكنك قول: "تدور كاميرا ثابتة ومثبتة بسرعة حول الهدف". هذان الاتجاهان المختلفان غير متوافقين، لذا لا تطلب من النموذج جعلهما يعملان.
إذا كنت ترغب في إنشاء تسلسل ديناميكي مثل فيديو دعائي ، على سبيل المثال، فإليك دليل عام لمنظور الكاميرا يمكنك الرجوع إليه مرارًا وتكرارًا عند تصميم المشهد:
نية | اتجاهات الكاميرا | المؤثرات البصرية |
|---|---|---|
| تحديد المكان | لقطة واسعة، أو حركة رافعة بطيئة، أو سحب للخلف | السياق والنطاق |
| بناء الألفة | لقطة متوسطة مقربة، ضغط خفيف للداخل | الاهتمام العاطفي |
| اتبع الإجراء | لقطة جانبية أو لقطة متحركة للأمام | الزخم والمشاركة |
| إظهار الأهمية | مدار بطيء، تركيبة مركزية | التركيز البطولي أو الرمزي |
| الحفاظ على التفاصيل | لقطة مقرّبة ثابتة، عمق مجال ضحل | التركيز والتفتيش |
| خلق حالة من عدم الاستقرار | حركة يدوية يتم التحكم فيها | الاستعجال أو الطاقة الوثائقية |
من الأمور المهمة الأخرى أن مجرد ذكر عبارة "حركة الكاميرا السينمائية" لا يكفي لرسم مشهد مناسب باستخدام Wan 3.0. عليك أن تكون أكثر تحديدًا؛ على سبيل المثال، عبارة "تتحرك الكاميرا يسارًا بسرعة المشي بينما يركض الكلب" ستُنتج نتائج أكثر دقة. إليك مثال جيد:
اِسْتَدْعَى | الناتج |
|---|---|
| الأسلوب: فيلم وثائقي شتوي سينمائي فائق الواقعية، بتقنية 4K HDR، إضاءة طبيعية، عمق مجال ضحل، حركة كاميرا سلسة، تدرج لوني ناعم، أجواء هادئة. المشهد 1 (0-3 ثوانٍ): لقطة جوية بطائرة بدون طيار لكوخ خشبي صغير مخبأ في أعماق غابة صنوبر مغطاة بالثلوج. يتساقط الثلج بكثافة برفق بينما تتوهج أضواء ذهبية دافئة من النوافذ. يتصاعد دخان خفيف من المدخنة بينما تهبط الكاميرا ببطء نحو الكوخ. المشهد 2 (3-6 ثوانٍ): داخل الكوخ، تجلس المرأة نفسها بجانب مدفأة حجرية متوهجة، ملفوفة ببطانية صوفية ناعمة، تقرأ كتابًا. المشهد 3 (6-10 ثوانٍ): تفتح الباب الأمامي الخشبي وتخرج إلى الشرفة الثلجية. تتساقط رقاقات الثلج برفق على سترتها وشعرها. تبتسم، وتأخذ نفسًا عميقًا ببطء، وتنظر عبر الغابة الصامتة بينما تدور الكاميرا حولها برفق. المشهد 4 (10-13 ثانية): لقطات سينمائية مقرّبة: أحذية تترك آثار أقدام جديدة على ثلج بكر، يدها المُغطاة بقفاز تُزيل الثلج عن أغصان الصنوبر، رقاقات الثلج تتساقط على نافذة الكوخ الدافئة، ودخان يتصاعد في هواء الشتاء المنعش. المشهد 5 (13-15 ثانية): لقطة سينمائية واسعة من الكوخ عند الغسق. يستمر تساقط الثلج بينما يصغر حجم الكوخ المتوهج وسط الغابة البيضاء الشاسعة. |
بالإضافة إلى تعلم كيفية إنشاء مطالبات Wan 3.0 ، اقرأ دليلنا حول كيفية استخدام Wan 3.0 لإنشاء مقاطع فيديو ذكاء اصطناعي أفضل.
توجيه Wan 3.0 : مشاهد الصوت/الحوار
نعلم أن تقنية Wan 3.0 تدعم توليد الصوت الأصلي، لكن من السهل نسيان أن الصوت يحتاج إلى وصف دقيق تمامًا كالصورة. فيما يخص الحوار، ما تعلمته عن Wan 3.0 بعد إنتاج مدونات فيديو يومية ، وشروحات ، وأفلام قصيرة، وغيرها، هو ضرورة إبقاء الحوارات قصيرة.
لسوء الحظ، لا تكون مزامنة حركة الشفاه دقيقة دائمًا، لذا تعامل مع الحوار كإشارات أداء موجزة، وليس كنص سردي مطول. حسب ما رأيت، هذه هي الطريقة الأمثل مع Wan 3.0. يمكنك أن ترى كيف ساهم ذلك في إنتاج نتيجة سمعية بصرية رائعة أدناه:
اِسْتَدْعَى:
حافظ على ملامح الوجه، وتسريحة الشعر، والهوية، ولون البشرة، والجسم بدقة من الصورة رقم 1. امرأة إندونيسية أصيلة ترتدي قميصًا واسعًا من الكتان بلون الطين، وبنطالًا واسع الساقين بلون عنابي باهت، وصندلًا جلديًا بنيًا، وأقراطًا ذهبية صغيرة، وشعرًا مموجًا منسدلًا.
فيديو مدونة خام من أواخر العقد الأول من القرن الحادي والعشرين، مصوّر بكاميرا فليب: اهتزاز شديد، بحث عن التركيز، تغيرات في التعريض، ألوان دافئة باهتة، تشويش رقمي. بدون وضعيات مصطنعة أو معالجة ألوان حديثة.
00:00–00:04 يتجول في قرية استوائية مبتسماً: "اليوم نبحث عن جوز الهند الطازج!"
00:04–00:08 يشاهد البائع وهو يقطع جوز الهند بحماس.
00:08–00:12 يحتسي ماء جوز الهند، ويبتسم قائلاً: "هذا منعش للغاية!"
00:12–00:16 محادثات/ضحكات مع القرويين وهم يحملون جوز الهند.
00:16–00:20 يحاول فتح جوز الهند، ويكافح، ويضحك؛ ويهتف السكان المحليون.
00:20–00:24 يغرف اللحم، يتذوق، ويعطي علامة إعجاب.
00:24–00:27 يمشي وهو يلوح للسكان المحليين.
00:27–00:30 يبتسم ويلوح بيده: "أراكم في مغامرتي القادمة. مع السلامة!"
مدخل | الناتج |
![]() |
شيء آخر لاحظته هو أنه إذا كان المشهد يضم عدة شخصيات، فتأكد من استخدام التسميات. على سبيل المثال، تقول سارة بصوت أجش: "علينا المغادرة في السادسة". ينظر إليها جون بصوت ناعم متردد ويقول: "حسنًا، لنبدأ في حزم الأمتعة".
هل ترغب في رؤية المزيد من الأمثلة لما يمكن أن تقدمه Wan 3.0 ؟ اطلع على هذه المقالة حول أفضل حالات استخدام Wan 3.0 .
هل ترغب في إنشاء مقاطع فيديو باستخدام Wan 3.0؟ توجه إلى Pollo AI
الآن وقد فهمت جيداً كيفية إنشاء موجه Wan 3.0 متين، فربما ترغب في البدء بإنتاج مقاطع الفيديو باستخدامه. إذا كان الأمر كذلك، أنصحك بالتوجه إلى Pollo AI. لماذا؟ لأنه مجموعة أدوات إبداعية متكاملة تعتمد على الذكاء الاصطناعي، وتضم أفضل نماذج الفيديو المدعومة بالذكاء الاصطناعي في مكان واحد.
هنا، يمكنك الوصول إلى Wan 3.0 و Seedance 2.5 و Kling 3.0 و Veo 3.1 ، بالإضافة إلى عشرات الخيارات الأخرى، مما يُسهّل مقارنة المخرجات المختلفة للحصول على أفضل النتائج. ليس هذا فحسب، بل يمكنك أيضًا تحميل جميع ملفاتك واستضافة جميع مشاريعك على هذه المنصة الموحدة.

باختصار، أعتبره بيئة العمل المثالية التي ستُكمّل أي شيء تنوي القيام به باستخدام Wan 3.0. والأفضل من ذلك؟ أنه يُقدّم Pollo Agent ، وهو AI Agent للفيديوهات والقصص والإعلانات والتصميم الإبداعي ، والذي يُؤتمت كل شيء بدءًا من الهيكلة والإيقاع وصولًا إلى العناصر المرئية، ما يعني أنه يُمكنه أيضًا إرشادك في صياغة المحتوى الأمثل.
جرّب Wan 3.0 مجاناً على Pollo AI الآن
حوّل أفكارك الأكثر جرأة إلى واقع ملموس مع Wan 3.0 وقم بتحويلها إلى مقاطع فيديو جاهزة للنشر على Pollo AI.
ابدأ الإبداع مجاناً
كل ما يتطلبه الأمر بضع دقائق، وسيحوّل أي فكرة أولية لديك إلى نتيجة جاهزة للإنتاج. علاوة على ذلك، يأتي Pollo AI مزودًا بعشرات الأدوات التي يمكنك استخدامها في مرحلة ما بعد الإنتاج، مثل أداة تمديد الفيديو بالذكاء الاصطناعي ، مما يضمن لك امتلاك كل ما تحتاجه لإنجاز العمل.
ما عليك سوى التوجه إلى Pollo AI وإنشاء حساب. يمكنك البدء في إنشاء مقاطع فيديو باستخدام Wan 3.0 مجانًا عبر النسخة التجريبية المجانية . أضمن لك أنك بعد بضع ساعات من استخدام هذه المنصة، ستعتبرها مساعدك الشخصي لإنتاج الفيديو.
الأسئلة الشائعة حول دليل Wan 3.0
ما هو طول جيل Wan 3.0 ؟
يتيح لك Wan 3.0 إنشاء مقاطع فيديو بصوت أصلي تصل مدتها إلى 30 ثانية في عملية واحدة. تأكد فقط من أن التعليمات الصوتية تغطي كل ثانية من اللقطة للحصول على أفضل نتيجة ممكنة. وإلا، فقد يقوم النظام بملء الفراغات بشكل غير متوقع.
كم عدد المراجع التي يدعمها Wan 3.0 ؟
يمكنك تحميل ما يصل إلى 10 صور مرجعية، و5 مقاطع فيديو، و5 ملفات صوتية، مع دعم روابط المستندات وصفحات الويب لكل عملية إنشاء. تذكر دائمًا تسمية وظيفة كل مرجع من هذه المراجع؛ وإلا فقد تؤثر بشكل عشوائي على الناتج النهائي.
كيف يمكنني تحسين استجابة موجه الأوامر الطويل Wan 3.0 ؟
ركّز على إعطاء Wan 3.0 توجيهات متعددة الطبقات. على سبيل المثال: "غابة هادئة. فجأة، تهتز الأرض وتتشقق. يخرج الزومبي من الشقوق." افصل جميع الحالات الرئيسية وتعامل معها كأحداث زمنية مستقلة. بالنسبة للمشاهد التي مدتها 30 ثانية، استخدم طوابع زمنية لكل حالة نهائية.
كيف يمكنني تفعيل خاصية تحويل الصور إلى فيديو؟
تتمتع تقنية Wan 3.0 بقدرة عالية على تثبيت الصورة المرجعية، لذا فهي تميل إلى تفضيل التطور التدريجي على التغييرات الجذرية في الصورة الأصلية. ركّز على تصميم توجيهات تُظهر تطورًا طبيعيًا للمشهد من خلال تحديد كيفية تحرك الكاميرا أو العنصر فيه.
كيف يمكنني تحسين اتساق الأحرف مع Wan 3.0؟
يمكنك استخدام صورة/فيديو مرجعي للشخصية، ثم تحديد السمات التي تريد أن يحافظ عليها Wan 3.0 ثابتة. على سبيل المثال، "الحفاظ على شعر المرأة الأشقر الطويل وملامح وجهها طوال المشهد". ما عليك سوى تقليل عدد الشخصيات والحركات وتغييرات المواقع.
كيف يمكنني التحكم في الصوت عند استخدام Wan 3.0؟
عند كتابة وصف المشهد، ينبغي تصنيف الصوت في فئة مستقلة، مع وصف مصدر/سلوك كل عنصر على حدة. على سبيل المثال: "صوت أنثوي رقيق يتحدث. صوت المطر يقرع على الزجاج. موسيقى البيانو تُعزف في الخلفية أثناء الحوار." يشمل هذا الوصف الصوت والمؤثرات الصوتية والموسيقى الخلفية، مما يضمن تضمين كل جزء في المشهد المُنشأ.






