ما هو Wan 3.0؟ دليل مفصّل حول نموذج الفيديو الجديد من Alibaba
مع Wan 2.7، كان لازم نكتفي بسير عمل منفصل لتحويل النص إلى فيديو، والصورة إلى فيديو، والمرجع إلى فيديو، وتحرير الفيديو. لكن لما سمعت إن إصدار Wan 3.0 الجديد يقبل كل المدخلات عبر نموذج موحّد واحد، كنت متحمّس جدًا أستكشفه لأنه يشير إلى تغيير جذري في طريقة عمل المستخدمين. تبغى تعرف أكثر؟ كمل قراءة لأننا راح نتعمق في Wan 3.0 بالتفصيل!
الخلاصة السريعة
يجمع Wan 3.0 بين مدخلات متعددة الوسائط، وتوليد 1080p لمدة 30 ثانية، وصوت متزامن، وفيزياء واقعية، واتساق أقوى لفيديوهات المنتجات، ومشاهد الحركة، والعروض الموسيقية.
جرّب Wan 3.0 على Pollo AI مع Pollo Agent وMarketing Studio لسير عمل انسيابي من إنشاء الفيديو إلى حملات العلامة التجارية.
تفصيل ميزات Wan 3.0 الأساسية: نظرة سريعة
قبل ما ندخل في التفاصيل الدقيقة اللي تخلّي Wan 3.0 مميز، خليني ألخّص بسرعة أحدث ميزات النموذج وكيف تنعكس على إنشاء الفيديو:
| الميزات الأساسية | تحسينات Wan 3.0 | الاستخدام العملي |
| المدة | تم تمديدها من حد Wan 2.7 البالغ 15 ثانية إلى 30 ثانية لكل مقطع مُولَّد | تعطي مساحة أكبر للحركة، وتبادل حوارات أفضل، وحركات كاميرا ديناميكية، ومنحنيات سردية أطول |
| الدقة | تتوفر دقات أصلية 480p و720p و1080p | خيارات مرنة للاختيار حسب السرعة والتكلفة والجودة المفضلة |
| الصوت | توليد صوتي-مرئي أصلي | يمكّن من إخراج الحوار والموسيقى والمؤثرات الصوتية والفيديو كنتيجة سمعية بصرية واحدة |
| مدخلات متعددة الوسائط | يمكنه دمج مراجع النصوص والصور والفيديو والصوت والمستندات وصفحات الويب في تمريرة واحدة | يضمن للمستخدمين دمج أصول موجودة كثيرة لتوليد مخرجات أدق |
| الاتساق الزمني | ثبات محسّن للشخصيات والأشياء والتفاصيل البصرية عبر سرديات بصرية أطول | تشوه أقل وانحراف أقل في الهوية يضمنان مشاهد أفضل متعددة الشخصيات وتسلسلات حركة ديناميكية مثل قتال شخصيات الألعاب، وغيرها. |
| فيزياء الحركة | يعرض الأقمشة والسوائل وحركة الأجسام والتصادمات وغيرها بواقعية أكبر. | أنشئ تسلسلات حركة/أكشن معقدة، وفيديوهات منتجات الأزياء، ولحظات تناثر تبدو واقعية |
| التسعير | 0.05$ لكل ثانية على 480p، و0.10$ لكل ثانية على 720p، و0.20$ لكل ثانية على 1080p. | أغلى من Wan 2.7، لكن مع توليد أطول يساعد على تبرير ذلك. |
ما الذي يجعل Wan 3.0 يستحق التجربة؟
أعلنت Alibaba عن النسخة التجريبية العامة من Wan 3.0 في 6 أغسطس 2026. ومن البداية، كان واضح بالنسبة لي إن هذا الإصدار الجديد ما كان مجرد تحسين واحد في الجودة. هو أشبه بترقية كاملة لسير العمل تركز على حل نقاط الضعف في الإصدارات السابقة، فخلّنا نفصلها:
توليد فيديو أصلي لمدة 30 ثانية
أولًا، ارتحت جدًا لما شفت إنهم مدّدوا الحد الأقصى للمدة إلى لقطة مستمرة واحدة لمدة 30 ثانية. بهذا التغيير وحده، صار Wan 3.0 أسهل لنا في استثمار لغة الكاميرا بشكل صحيح وسرد القصص متعددة الشخصيات.
كنت دائمًا أحس إن Wan 2.7 محدود جدًا عند 15 ثانية، فبعد مضاعفة المدة، كنت متشوق أشوف نوع السرد الممتد اللي ممكن يقدمه Wan 3.0. ومع إن الرندر الأول ما كان مثالي بالكامل، قدرت أولّد هذا التسلسل لمدة 30 ثانية واستمتعت جدًا بمشاهدته.
حتى لوحده، يحسسك إنه قوس قصصي بدل ما يكون مجرد مقطع مولّد انقطع بدري جدًا. ومع إن البرومبت ما تم الالتزام فيه 100%، كنت سعيد إن الرندر النهائي كان يتدفق كتسلسل سينمائي، وهذا يعني إني أقدر أستخدمه حتى لإنشاء فيديوهات وثائقية، وغيرها.
مراجع متعددة الوسائط بشكل أوسع
جانب آخر كنت سعيد بتحسّنه مقارنة بـ Wan 2.7 هو إننا ما عدنا نحتاج نستخدم نماذج منفصلة خاصة بكل مهمة مثل T2V وI2V وغيرها. مع Wan 3.0، أخيرًا نقدر نستفيد من دعم النص والصورة والصوت والفيديو وحتى المستندات ضمن نموذج موحّد واحد.
مثلًا، أقدر أحدد بحرية أن "العنصر من الصورة 1 سيتم التقاطه ورميه بواسطة الشخصية من الصورة 2 بينما تعمل الكاميرا بنفس الحركة المستخدمة في المقطع 1". كل هذا صار ممكن في تمريرة واحدة، فجرّبت وهذا اللي طلّعته:
رفعت عدة صور مرجعية للعنصر، والنظارة الشمسية، وصندوق البيع بالتجزئة، وحقيبة الحمل الجلدية قبل ما أوجّه Wan 3.0 بكيفية عرضها عبر البرومبت. وكما توقعت، قدر ينتج عرض قوي يحسّ ويظهر كأنه فيديو إنفلونسر منزلي.
تحسين فيزياء الحركة والواقعية
مقارنة بسابقه، يقدم Wan 3.0 محاكاة أفضل للسوائل والأقمشة وحتى تفاعل الأجسام مع الوزن والزخم. في الماضي، أتذكر كيف كان Wan 2.7 يواجه صعوبة مع الوميض الزمني، فكنت سعيد إنه تم إعطاء هذا أولوية.
نظريًا، هذا لازم يترجم إلى تسلسلات حركة وديناميكيات بيئية أفضل تبدو أكثر واقعية، لذلك كنت متحمس جدًا لاختباره. في عينتي، قررت أجرب وأرندر فيلمًا فائق الواقعية لامرأة رياضية تتدرب على الرماية ببندقية.
بصراحة، انصدمت من جودة هذا المخرج المولّد. طريقة تفاعل شعرها مع الرياح، وطريقة تعاملها مع البندقية، والأبرز كيف انكسرت الزجاجة؛ كله كان عملي وواقعي وأقل أسلوبية بكثير مما توقعت.
حركة مدفوعة بالصوت ومزامنة الشفاه
مع Wan 3.0، نقدر نستمتع بتوليد صوتي أصلي وإحالة صوتية. لكن اللي أبهرني فعلًا في هذا الجانب هو كيف يستخدم النموذج الصوت أيضًا لتوجيه حركة الشخصيات وتوقيت المشهد، بالإضافة إلى مزامنة حركة الشفاه.
هذا يسهل إنتاج تسلسلات يقودها الصوت مثل فيديوهات رقص موسيقية أو مقاطع حوار بأداء أكثر طبيعية من قبل. ولأشوف مدى تطبيقه لهذا فعليًا، حاولت أولد فيديو موسيقي، وكانت هذه النتيجة النهائية:
من البداية، لاحظت مدى دقة التوقيت السمعي البصري، خصوصًا أنه عرض موسيقي. حتى مزامنة الشفاه تبدو دقيقة، ومع التعبير المتناسق لحركات جسمها، أقدر أقول إن Wan 3.0 قام بعمل رائع هنا.
تحسين الاتساق الزمني
بعد عدة عمليات رندر للفيديو، لاحظت أيضًا أن Wan 3.0 قادر جدًا على الحفاظ على الثبات البصري عبر مشاهد أطول. واجهت تشوهات وانحرافات أقل مما كنت أرى مع Wan 2.7، خصوصًا في التسلسلات السينمائية، وهذا فعلًا حمّسني.
كنت أبغى أفهم حدوده في هذا الجانب، فركّزت بشكل كبير على اللقطات السينمائية. هذا مثال لأحد مخرجاتي المفضلة التي أنتجها Wan 3.0. من البداية للنهاية، كان بصريًا نظيفًا، مع شبه انعدام للآثار/الأعطال بين الإطارات.
أكثر شيء عجبني هو مستوى ثبات الشخصية اللي أظهره. لكن لازم أعترف أيضًا إنه للحصول على نتيجة شبه مثالية مثل هذه، احتجت عدة محاولات. على الأقل، هو أفضل من نموذج Wan 2.7 في ضمان أن المشهد ما ينهار في منتصفه.
تبغى نظرة مباشرة على أداء Wan 3.0؟ اقرأ مراجعة Wan 3.0 الآن.
مقارنة Wan 3.0 مع Wan 2.7: ما هي الفروقات؟
عرفنا قدرات Wan 3.0، صح؟ طيب، كيف يقارن مع Wan 2.7؟ عشان أعطيك تفصيل بسيط وواضح، هذا جدول مقارنة سريع:
| الجوانب | Wan 3.0 | Wan 2.7 |
| التركيز الأساسي | يركز على إنشاء فيديوهات أطول ومتعددة المراجع | يركز على التوليد السمعي البصري ومتعدد اللقطات |
| الحد الأقصى لطول الفيديو | حتى 30 ثانية لكل مقطع | حتى 15 ثانية لكل مقطع |
| الحد الأقصى لدقة الفيديو | يدعم حتى 1080p | يدعم حتى 1080p |
| الاتساق الزمني | اتساق أكثر ثباتًا للشخصيات والأشياء والصوت والمكان على مدى أطول | يميل للمعاناة من انجراف أو تدهور بصري كلما طال تشغيل الفيديو |
| فيزياء الحركة | ديناميكيات بيئية وأقمشة محسّنة عبر المشاهد؛ وتفاعل أكثر واقعية بين عدة عناصر | يحاكي الحركة الشائعة وتفاعلات المشهد بشكل جيد إلى حد ما |
| توليد الصوت | توليد سمعي بصري أصلي مع الحوار، إضافة إلى صوت محيطي ومؤثرات صوتية بشكل متزامن | يدعم الصوت الأصلي الأساسي ومزامنة الشفاه |
| المدخلات المرجعية | مصمم لدمج مراجع كثيرة، سواء نصوص أو صور أو فيديوهات أو صوت أو مستندات أو صفحات ويب في تمريرة واحدة | سير عمل خاص بكل مهمة للنص والصورة والمرجع وتحرير الفيديو، مما يعطي نطاق مدخلات أضيق |
| التسعير | أغلى بحوالي 33% من Wan 2.7 | من 0.10$ إلى 0.15$ لكل ثانية، حسب المزود |
| الأنسب لـ | قصص قصيرة أكثر اكتمالًا، وإعلانات، وفيديوهات منتجات، ومحتوى اجتماعي، وفيديوهات تعليمية، ومشاريع تستخدم ملفات مرجعية متعددة | مقاطع سمعية بصرية أقصر، ومفاهيم متعددة اللقطات، وتوليد بسيط من صورة إلى فيديو |
إذا كان Seedance 2.5 أيضًا ضمن اهتماماتك، اطلع على مقارنة Wan 3.0 وSeedance 2.5 لمعرفة أداء النموذجين جنبًا إلى جنب.
وين أقدر أوصل إلى Wan 3.0؟ جرّب Pollo AI
تبغى تبدأ توليد فيديوهات باستخدام Wan 3.0؟ فقط توجّه إلى Pollo AI الآن واقرأ دليلنا خطوة بخطوة حول كيفية استخدام Wan 3.0 لإنشاء فيديوهات مذهلة.
أعتمد كثيرًا على هذه المنصة في إنشاء الفيديو لأنها باقة إبداعية AI متكاملة، ومندمجة مع عدة نماذج فيديو AI رائدة في المجال، بما في ذلك Seedance 2.5، وKling 3.0، وVeo 3.1.

هنا، أقدر أولّد مقاطع سينمائية قصيرة، ورسوم متحركة، وفيديوهات موسيقية، وأكثر بكثير خلال دقائق. في الواقع، القدرة على التنقل بين نماذج فيديو AI كانت غالبًا تتيح لي استكشاف مخرجات مختلفة واختيار أفضل نتيجة ممكنة لمشاريعي.
لكن جانبي المفضل في استخدام Pollo AI هو Pollo Agent. أقدر أستخدمه لعصف الأفكار وإنشاء فيديوهات جاهزة للإنتاج في بضع نقرات فقط. وبما أنه أداة مدفوعة بالوكلاء، فهو يؤتمت البنية والإيقاع والعناصر البصرية وغيرها، لذلك غالبًا أقدر أستريح وأصقل موجزاتي بسهولة.
إضافة إلى ذلك، أقدر أوصل إلى Marketing Studio في Pollo AI، اللي يساعدني على إنتاج محتوى فيديو مصقول لحملات العلامة التجارية، والإعلانات، ومنشورات التواصل الاجتماعي، وقوائم التجارة الإلكترونية، وغيرها. وهذا يشمل إنشاء عروض توضيحية للمنتجات، وإعلانات فيديو UGC، ومقاطع فتح الصناديق، وتجارب افتراضية، وأكثر.
وهذا مجرد جزء بسيط من إمكانيات Pollo AI! لما تجمع Wan 3.0 مع كل هذه الأدوات والميزات الأخرى، تحصل على قوة هائلة في إنتاج الفيديو الإبداعي. لكن إذا عندك أي شكوك، ما تحتاج تاخذ كلامي كمسلمة!
جرّب Wan 3.0 مجانًا على Pollo AI الآن
ادفع بإبداعك لأبعد مدى وأنشئ فيديوهات مصقولة باستخدام Wan 3.0 على Pollo AI.
ابدأ الإنشاء مجانًا
فقط سجّل حسابًا في Pollo AI حتى تبدأ استخدام Wan 3.0 بدون أي تكلفة عبر خطة التجربة المجانية. وإذا أخذت وقتك في استكشاف كل ما تقدمه هذه المنصة، فأنا واثق إنك ما راح تحتاج تدور في مكان ثاني لتوليد فيديوهات بمستوى pro اليوم.
ما الذي لا يزال Wan 3.0 بحاجة لتحسينه؟
مثل أي نموذج فيديو جديد اختبرته من قبل، لا يزال لدى Wan 3.0 بعض الأمور التي تحتاج ضبط. كبداية، حسّيت إن جودة الصوت الأصلية كانت مقبولة؛ الأصوات واضحة ومتزامنة. لكن لتعليق صوتي واقعي، أنصح باستخدام مدخلات صوتية لرفع تسجيل حقيقي.
أيضًا، بعض المشاهد اللي حاولت توليدها ما زالت تظهر فيها انحرافات، خصوصًا عند وجود عدة شخصيات. لذلك، ثباته البصري ليس دائمًا قويًا. في المشاهد البسيطة، الاتساق موجود 100%، لكن كلما زاد التعقيد، تقل الموثوقية.
لكن التقييد الأساسي بالنسبة لي كان ملاحظة مدى تحفظه في تفسير البرومبتات. في أغلب الحالات، يتمسك بإحكام بمراجع الموضوع/الإعداد التي أرفعها، لذلك أداؤه جيد في الحفاظ على الهوية، لكن هذا قد يكون مشكلة لما أبغاه يكون أكثر خيالًا.
بمعنى آخر، أقدر أقول إن Wan 3.0 رائع جدًا عندما أحتاج الحفاظ على الصورة أو الشخصية أو العنصر أو البيئة المصدرية، مثل فيديو عقاري مثلًا. لكن إذا كنت أبغى أستبدل المشهد أو أرتب مشهدًا مختلفًا، فهذه القيود المرجعية قد تكون محبِطة قليلًا.
الأسئلة الشائعة حول Wan 3.0
ما هو Wan 3.0؟
Wan 3.0 هو أحدث نموذج توليد فيديو AI من Alibaba ويركز على الفيديوهات الأطول المعتمدة على المراجع. مقارنةً بـ Wan 2.7، هذا الإصدار الجديد أسرع في التوليد، ويدعم مدخلات مرجعية أكثر، ويقدم ثباتًا أفضل عبر المشاهد الممتدة، ويعرض فيزياء أكثر إقناعًا.
ما المدة التي يمكن أن تصل إليها فيديوهات Wan 3.0؟
لدى Wan 3.0 حد أقصى للمدة يبلغ 30 ثانية لكل مقطع. هذه زيادة كبيرة عن حد Wan 2.7 البالغ 15 ثانية، وهذا يعطيك مساحة أكبر لإنتاج أقواس قصصية أكمل أو حتى سرديات متعددة الشخصيات بعمق أكبر من قبل.
ما هي قيود Wan 3.0؟
قد يكون Wan 3.0 محافظًا نوعًا ما في طريقة تفسيره للبرومبتات. في الغالب، يعمل بشكل جيد إذا كنت تريد الحفاظ على المدخل المصدر. لكن إذا كان مطلوب تغيير إبداعي كبير، فقد ينفذه بشكل أقل من المتوقع. وقد يظهر أيضًا انحرافًا في المشاهد المعقدة إذا لم يتم تحديد التفاصيل.
هل Wan 3.0 مناسب لصناعة الأفلام الاحترافية؟
خطا Wan 3.0 خطوة كبيرة نحو دعم السرديات البصرية الممتدة. كما أنه يقدم تشوهًا وانحرافًا أقل عبر الإطارات، لذلك يمكن للعديد من المبدعين وصنّاع الأفلام المحترفين استخدامه بثقة لتطوير المفاهيم الأولية، وإنتاج فيديوهات B-roll، وإعلانات الأفلام الترويجية، وأكثر.
ما أفضل طريقة لكتابة برومبت لـ Wan 3.0؟
مع Wan 3.0، يفيد استخدام وسائط مرجعية لأن النموذج يتفوق في الحفاظ على الهوية. سمّ أدوارها واشرح ما تريد رؤيته يتطور: الموضوع، والإعداد، والأفعال، وحركات الكاميرا، والأسلوب، والحوار، وغيرها. ولمخرجات أدق، حدّد المشهد باستخدام الطوابع الزمنية.
هل Wan 3.0 مولد فيديو مناسب للمبتدئين؟
Wan 3.0 هو نموذج موحّد واحد، وهذا يجعله أسهل للمستخدمين في صياغة موجزات إبداعية مفصلة مدعومة بمدخلات مرجعية متعددة. وبسبب ذلك، حتى المبتدئون تمامًا يقدرون ينتجون تسلسلات بصرية تطابق رؤيتهم الإبداعية بشكل قريب مع عدد توليدات أقل.



