Руководство по промптам для Wan 3.0: как получить максимум от Wan 3.0
Я некоторое время пользовался Wan 3.0, и могу сказать, что это скорее модель, управляемая директором, чем её предшественники. Теперь она поддерживает 30-секундную генерацию с использованием текста, изображений, аудио, видео, документов и веб-страниц в качестве входных данных, поэтому для управления подсказками теперь требуется немного больше точности. Хотите узнать секрет? Читайте дальше, и мы объясним, на что именно Wan 3.0 реагирует лучше всего.
Вкратце:
Всё, что вы напишете в начале запроса, Wan 3.0 зафиксирует первым, поскольку он определяет композицию на раннем этапе. Определите ракурс и сцену до того, как определите объект съёмки, затем опишите действие, укажите освещение и стиль, а затем добавьте звук. Также укажите роль каждого элемента, чтобы избежать случайных результатов. Pollo AI идеально подходит в качестве рабочей среды для создания видеороликов с помощью Wan 3.0.
Руководство по использованию командной строки Wan 3.0 : понимание ключевых аспектов
Прежде чем мы перейдем к тому, как составить идеальное приглашение Wan 3.0 , вам сначала нужно понять основную формулу любого базового запроса, поэтому давайте быстро разберем ее для вас:
Аспект | Вопрос, на который нужно ответить | Пример |
|---|---|---|
| Предмет | В чём заключается предмет обсуждения, и что должно оставаться узнаваемым? | Потертый синий велосипед для доставки с плетеной корзиной. |
| Сцена | Где оно находится и что его окружает? | Узкая французская улочка после дождя, облицованные плиткой фасады, лужи, отражающий свет тротуар. |
| Движение | Что движется, в каком порядке и с какой скоростью? | Велосипед медленно катится вниз по склону; вода брызгает с шин. |
| Управление камерой | Как следует снимать этот кадр? | Съемка с нижнего ракурса, объектив 35 мм, мягкий пасмурный свет. |
| Стилизация | Какая визуальная эстетика определяет данную сцену? | Документальный фильм с приглушенными цветами. |
Почему Wan 3.0 требует более тонких и продуманных подсказок?
Улучшенные возможности Wan 3.0 заставили меня изменить стиль подсказок по сравнению с тем, что я часто использовал в Wan 2.7. Одна из причин — максимальная продолжительность видеороликов с использованием ИИ увеличена до 30 секунд на клип. Почему это важно? Вот почему…
Я довольно тщательно протестировал Wan 3.0 , и ключевое различие между видеороликами, которые не оправдали моих ожиданий, и теми, которые им соответствовали, заключалось в отсутствии контроля времени в моих подсказках. Когда я просто давал визуальные описания, не учитывая каждую секунду кадра, всё проваливалось.
Без четкой временной шкалы Wan 3.0 будет заполнять пустые секунды случайными изменениями. Лучшие подсказки определяют ключевые действия и поведение камеры на протяжении всего ролика, при этом каждому изображению, видео, аудиофайлу или ссылке отводится четкая роль.
Я также заметил, что Wan 3.0 закладывает композицию на раннем этапе, часто используя первые детали в качестве основы сцены. Порядок имеет значение, особенно при преобразовании изображения в видео, где сохраняется первоначальная композиция и идентичность объекта, но при этом часто не реализуются радикальные изменения.
Например, если я преобразую фотографию в видеорекламу и запрашиваю слишком радикальное преобразование, я могу не получить удовлетворительного результата. Учитывая все эти факторы, я думаю, справедливо будет сказать, что использование Wan 3.0 требует тонкого подхода. Итак, давайте посмотрим, как можно получить наилучшие возможные запросы.
Прежде чем углубляться в настройки Wan 3.0 , ознакомьтесь с последними обновлениями этой модели в нашем руководстве о том, что такое Wan 3.0 .
Попробуйте Wan 3.0 бесплатно на Pollo AI прямо сейчас!
Введите свои творческие идеи, чтобы создавать потрясающие видеоролики с помощью Wan 3.0 на Pollo AI.
Начните создавать бесплатно
Подсказки Wan 3.0 : текст-видео против изображения-видео
Способ создания подсказок Wan 3.0 для T2V будет отличаться от I2V, поскольку вся последовательность зависит от правильного определения объекта, окружения, действия, камеры и визуального стиля.
Как я уже упоминал ранее, Wan 3.0 определяет композицию на раннем этапе, поэтому то, с чего вы начинаете свой запрос, модель фиксирует в первую очередь, прежде чем переходить к остальной части сцены. Например, если ваш запрос начинается с описания настроения, то Wan 3.0 будет ориентироваться на это настроение, а не на объекты.
Поэтому тип съемки следует определить до того, как выбрать объект и детали, которые вы хотите сохранить. Затем можно приступить к определению освещения, стиля и завершить созданием диалога, звуковых эффектов или музыки. Вот пример анимационного фильма , который я создал:
Быстрый | Выход |
|---|---|
| Кинематографический 8K-стилизованный 3D-кадр. Молодой человек в синей бандане использует голографические смарт-часы, чтобы запустить механические руки, которые моют его грязную Mazda RX-7. Машина модернизируется, наполняясь синим электричеством и меняя цвет с белого на глянцево-черный с фиолетовым свечением. Черный автомобиль мчится по залитому дождем неоновому киберпанк-городу ночью. На лобовом стекле активируется HUD, и машина подпрыгивает, превращаясь в воздухе в гигантского двуногого робота, водитель которого виден в светящейся кабине. Робот тяжело приземляется на улицу, затем использует синие реактивные двигатели, чтобы взлететь и героически встать на крышу небоскреба. |
С другой стороны, если вы собираетесь использовать эталонные изображения, то это потребует другого подхода. Судя по тому, что я видел, Wan 3.0, похоже, гораздо строже, чем другие модели, ограничивает композицию и идентичность объекта на исходном изображении.
Поэтому довольно сложно использовать подсказки, которые радикально меняют облик сцены или вызывают резкие изменения. В большинстве таких случаев Wan 3.0 не справится с задачей и не оправдает моих ожиданий, поэтому я рекомендую использовать подсказки с плавными, непрерывными переходами, как показано ниже:
Быстрый:
Четырехкадровая игровая сцена. Используйте изображение 1 в качестве точного начального кадра и визуальной опоры. Сохраните идентичных принцессу-наемницу, сурового контрабандиста, лица, костюмы, пистолет, декорации космического корабля, освещение и режиссуру. Практический космический боевик 1980-х годов: реальные актеры, физические декорации, резиновый костюм инопланетянина, полноразмерный аниматронный робот, реалистичные искры/дым, сдержанные оптические лазеры, анаморфная пленка 35 мм.
КАДР 1 (0–3,2 с): Средний план, два кадра подряд. Она откинулась влево, ботинок поднят, пистолет болтается; он сидит справа.
ВЫПУСК 2 (3.2–6.7 с): Быстрый реверс. Чужая появляется слева от него. Она делает один точный выстрел мимо его плеча; болт попадает в грудь, искра, он падает. Оркестровый звук удара, лазерный луч.
КАДР 3 (6,7–10,3 с): Низкий ракурс. Робот топает вправо, поднимает руку. Она поворачивается, делает два выстрела (в сустав, затем в грудь); рука опускается, разлетается на куски с искрами и дымом. Он смотрит с благоговением; она опускает пистолет. Звучит перкуссия, духовые инструменты.
Кадр 4 (10,3–14 с): Крупный план с двух сторон. Первоначальный взгляд. Она возвращается к скучающей позе, пистолет болтается в воздухе, взгляд прикован. Она остается непринужденной, сдержанной и невозмутимой.
Вход | Выход |
|---|---|
![]() |
Wan 3.0 Запросы: Обработка движения
Исходя из личного опыта, обработка движений в Wan 3.0 требует довольно сложной последовательности действий. Хотя можно использовать подсказку типа «мужчина идёт по пляжу», я бы сказал, что это всего лишь простое предустановленное действие, из-за чего неясны время и взаимодействие.
Более удачный вариант — добавить цепочку наблюдаемых событий. Я бы сказал так: «Человек идёт по пляжу, останавливается, услышав громкий лай, поворачивается в сторону источника звука и видит, как к нему бежит золотистый ретривер». Это создаёт более реалистичное покадровое движение.
Но в то же время, не стоит перегружать клип излишней хореографией. Это еще одна вещь, на которую, как я заметил, Wan 3.0 плохо реагирует. Когда я пытался заставить персонажа выполнять слишком много точных действий или взаимодействовать со многими объектами, результат получался не таким уж идеальным.
Таким образом, хотя Wan 3.0 теперь поддерживает более длинные 30-секундные клипы, я рекомендую сосредоточиться на том, чтобы придать объекту четкую и понятную задачу/центральное действие, чтобы обеспечить временную стабильность. Хороший пример этого можно увидеть вреалистичном видео , которое я создал ниже:
Быстрый:
@Image1 — единственный главный персонаж. Её лицо, причёска, фигура и одежда сохранены в точности. Ультрареалистичная кинематографическая заморозка времени в стиле 30-х годов на залитой солнцем улице старого итальянского города (каменные здания, булыжник, кафе, пешеходы, голуби).
0–5 с: Она уверенно идёт к камере (стедикам отслеживает её движение назад) посреди обычной жизни.
5–8 с: Останавливается, щелкает пальцами → элегантная невидимая ударная волна замораживает все вокруг.
8–20 секунд: Движется только она; камера кружит, пока она идет по замерзшей улице, касается подвешенной капли, затем поворачивается к камере с полуулыбкой и снова делает снимок.
20–30 секунд: Вторая ударная волна размораживает мир; она сохраняет спокойствие.
Стиль: фотореалистичный, 50 мм, малая глубина резкости, естественное освещение, едва заметная зернистость, реалистичная физика/визуальные эффекты. Без морфинга, статичных изображений и артефактов.
Вход | Выход |
|---|---|
![]() |
Wan 3.0 Подсказка: Язык камеры
Что касается операторской работы, я обычно придерживаюсь простого правила: она состоит из четырех частей — размер кадра, ракурс, движение и объектив. Например: «широкий общий план с высокого ракурса, затем медленный спуск с использованием тележки к маяку; используйте кинематографическую перспективу 50 мм».
Это правило можно использовать во всех запросах Wan 3.0 , но всегда следует избегать противоречивых формулировок. Например, нельзя сказать: «Зафиксированная статическая камера быстро вращается вокруг объекта». Эти два разных направления несовместимы, поэтому не просите модель реализовать это.
Если вам когда-нибудь понадобится создать динамическую последовательность, например, трейлер , вот общее руководство по ракурсу камеры, к которому вы можете неоднократно обращаться при создании сцены:
Намерение | Режиссура камеры | Визуальный эффект |
|---|---|---|
| Создать место | Общий план, медленный подъем с крана или выдвижение. | Контекст и масштаб |
| Создайте близость | Средний крупный план, плавное приближение | Эмоциональное внимание |
| Следуйте инструкциям | Боковая съемка или съемка с использованием тележки. | Динамика и участие |
| Продемонстрировать важность | Медленная орбита, центрированный состав | Героический или символический акцент |
| Сохраните детали. | Фиксированный крупный план, малая глубина резкости | Фокусировка и осмотр |
| Создать нестабильность | Контролируемое ручное перемещение | Срочность или документальная энергия |
Ещё один важный момент: простого описания «кинематографическое движение камеры» недостаточно для создания подходящей сцены в Wan 3.0. Необходимо быть более конкретным; например, фраза «камера движется влево со скоростью ходьбы, пока бежит собака» даст более целенаправленный результат. Вот хороший пример:
Быстрый | Выход |
|---|---|
| Стиль: Ультрареалистичный, кинематографический зимний документальный фильм, 4K HDR, естественное освещение, малая глубина резкости, плавное движение камеры, мягкая цветокоррекция, спокойная атмосфера. Сцена 1 (0–3 с) Аэросъемка с дрона небольшой деревянной хижины, спрятанной глубоко в заснеженном сосновом лесу. Легкий снег мягко падает, а из окон исходит теплый золотистый свет. Из дымохода поднимается тонкий дым, камера медленно опускается к хижине. Сцена 2 (3–6 с) Внутри хижины та же женщина сидит у потрескивающего каменного камина, завернувшись в мягкое шерстяное одеяло, и читает книгу. Сцена 3 (6–10 с) Она открывает деревянную входную дверь и выходит на заснеженное крыльцо. Снежинки мягко падают на ее свитер и волосы. Она улыбается, делает глубокий вдох и смотрит через тихий лес, пока камера мягко кружит вокруг нее. Сцена 4 (10–13 с) Крупные планы: ботинки, оставляющие свежие следы на нетронутом снегу, ее рука в перчатке, счищающая снег с сосновых ветвей, снежинки, оседающие на теплом окне хижины, и дым, поднимающийся в свежий зимний воздух. Сцена 5 (13–15 с) Широкий кинематографический кадр, снятый из хижины на закате. Снег продолжает падать, а светящаяся хижина становится все меньше на фоне бескрайнего белого леса. |
Помимо изучения того, как создавать подсказки для Wan 3.0 , ознакомьтесь с нашим руководством по использованию Wan 3.0 для создания еще более качественных видеороликов с использованием ИИ.
Wan 3.0 Подсказки: Аудио/Диалоговые сцены
Мы знаем, что Wan 3.0 поддерживает нативную генерацию звука, но легко забыть, что звук также нужно описывать так же тщательно, как и визуальный ряд. Что касается диалогов, то, как я понял, работая над ежедневными видеоблогами , обучающими видео , короткометражными фильмами и т. д., в Wan 3.0 , нужно говорить короткими фразами.
К сожалению, синхронизация губ не всегда надежна, поэтому рассматривайте диалоги как короткие реплики, а не как длинный сценарий. Судя по тому, что я видел, это лучше всего работает с Wan 3.0. Ниже вы можете увидеть, как это помогло добиться отличного аудиовизуального результата:
Быстрый:
Сохранены точные черты лица, прическа, личность, тон кожи и телосложение с @image1. Настоящая индонезийская женщина в свободной терракотовой льняной рубашке, пыльно-бордовых широких брюках, коричневых кожаных сандалиях, маленьких золотых серьгах-кольцах, с распущенными волнистыми волосами.
Необработанный видеоблог, снятый на повседневную камеру конца 2000-х: сильная тряска, поиск фокуса, смещение экспозиции, теплые, приглушенные цвета, цифровой шум. Без позирования и современной цветокоррекции.
00:00–00:04 Прогуливается по тропической деревне с улыбкой: «Сегодня мы ищем свежие кокосы!»
00:04–00:08 Наблюдает, как продавец рубит кокос, с волнением.
00:08–00:12 Отпивает кокосовую воду, улыбается: «Как же это освежает!»
00:12–00:16 Разговоры/смех с жителями деревни, держащими в руках кокосы.
00:16–00:20 Пытается открыть кокос, испытывает трудности, смеется; местные жители аплодируют.
00:20–00:24 Лопатка мяса, дегустация, поднятый большой палец вверх.
00:24–00:27 Идет, машет рукой местным жителям.
00:27–00:30 Улыбки, приветственный взмах рукой: «Увидимся в моем следующем приключении. Пока!»
Вход | Выход |
![]() |
Ещё я заметила, что если в сцене участвует несколько персонажей, обязательно используйте подписи. Например: «[Сара, хриплый голос] говорит: „Нам нужно уехать в шесть“. [Джон, мягкий, неуверенный голос] оглядывается на неё и говорит: „Хорошо. Давай начнём собирать вещи“».
Хотите увидеть больше примеров того, на что способен Wan 3.0 ? Ознакомьтесь с этой статьей о лучших вариантах использования Wan 3.0 .
Хотите создавать видео с помощью Wan 3.0? Зайдите на сайт Pollo AI.
Теперь, когда вы четко понимаете, как создать качественный сэмпл Wan 3.0 , вы, вероятно, захотите начать создавать с его помощью видео. В таком случае я бы порекомендовал обратиться к Pollo AI. Почему? Потому что это лучший набор инструментов для творчества с использованием ИИ , в котором собраны все лучшие модели видео на основе ИИ в одном месте.
Здесь вы можете получить доступ к Wan 3.0 , Seedance 2.5 , Kling 3.0 и Veo 3.1 , а также десяткам других вариантов, что позволяет легко сравнивать различные результаты для достижения наилучшего возможного результата. И это еще не все: вы можете загружать все свои ресурсы и размещать все свои проекты на этой единой платформе.

По сути, я считаю это идеальным рабочим пространством, которое дополнит все ваши планы по использованию Wan 3.0. А самое главное? Оно предлагает Pollo Agent , AI Agent для видео , рассказов , рекламы и креативного дизайна , который автоматизирует все — от структуры и темпа до визуальных элементов, а значит, может помочь вам создать идеальную подсказку.
Попробуйте Wan 3.0 бесплатно на Pollo AI прямо сейчас!
Воплотите в жизнь свои самые смелые идеи с помощью Wan 3.0 и превратите их в готовые к публикации видеоролики на Pollo AI.
Начните создавать бесплатно
Всего несколько минут — и любая ваша приблизительная идея превратится в готовый к производству результат. Кроме того, Pollo AI включает в себя десятки инструментов для постобработки, таких как расширение видео с помощью ИИ , что гарантирует наличие всего необходимого для выполнения работы.
Просто зайдите на сайт Pollo AI и зарегистрируйте аккаунт. Вы можете начать создавать видео с помощью Wan 3.0 совершенно бесплатно, воспользовавшись бесплатной пробной версией . Гарантирую, что после нескольких часов работы на этой платформе вы начнете воспринимать ее как своего личного помощника по видеопроизводству.
Часто задаваемые вопросы о руководстве по использованию командной строки Wan 3.0
Какова может быть продолжительность поколения Wan 3.0 ?
Wan 3.0 позволяет создавать видеоролики с собственным звуком продолжительностью до 30 секунд за один проход. Просто убедитесь, что ваш запрос учитывает каждую секунду кадра, если вы хотите получить наилучший результат. В противном случае, он может заполнить пробелы, используя собственное суждение, неожиданным образом.
Сколько ссылок поддерживает Wan 3.0 ?
Вы можете загрузить до 10 эталонных изображений, 5 видеороликов и 5 аудиофайлов, при этом поддерживаются ссылки на документы и веб-страницы для каждого варианта генерации. Всегда указывайте назначение каждой из этих ссылок; в противном случае они могут случайным образом повлиять на конечный результат.
Как можно улучшить длинное приглашение командной строки Wan 3.0 ?
Сосредоточьтесь на многоуровневых директивах для Wan 3.0 . Например: «Тихий лес. Внезапно земля содрогается и раскалывается. Из трещин вылезают зомби». Разделите все ключевые состояния и рассматривайте их как независимые хронологические этапы. Для 30-секундных сцен используйте временные метки для каждого конечного состояния.
Как мне следует инициировать процесс преобразования изображения в видео?
Wan 3.0 обладает достаточно мощными возможностями для привязки к исходному изображению, поэтому он, как правило, предпочитает постепенное развитие, а не радикальные изменения исходного изображения. Сосредоточьтесь на создании подсказок, демонстрирующих естественное развитие сцены, указывая, как камера или объект должны двигаться в ней.
Как можно улучшить согласованность символов в Wan 3.0?
Вы можете использовать эталонное изображение/видео персонажа, а затем определить атрибуты, которые вы хотите сохранить в Wan 3.0 . Например, «Сохранить длинные светлые волосы и черты лица женщины на протяжении всей сцены». Просто сведите к минимуму количество персонажей, действий и изменений локаций.
Как управлять звуком при использовании Wan 3.0?
При написании задания следует выделить аудиоматериалы в отдельную категорию и описать источник/характеристики каждого из них отдельно. Например: «Раздается нежный женский голос. Дождь стучит по стеклу. Под диалог играет фортепианная музыка». Это включает в себя голос, звуковые эффекты и фоновую музыку, гарантируя, что каждая часть будет учтена в создаваемой сцене.






