Главная страница/Блог/Анализ моделей ИИ/Руководство по промптам для Wan 3.0: как получить максимум от Wan 3.0

Руководство по промптам для Wan 3.0: как получить максимум от Wan 3.0

Я некоторое время пользовался Wan 3.0, и могу сказать, что это скорее модель, управляемая директором, чем её предшественники. Теперь она поддерживает 30-секундную генерацию с использованием текста, изображений, аудио, видео, документов и веб-страниц в качестве входных данных, поэтому для управления подсказками теперь требуется немного больше точности. Хотите узнать секрет? Читайте дальше, и мы объясним, на что именно Wan 3.0 реагирует лучше всего.

Вкратце:

Всё, что вы напишете в начале запроса, Wan 3.0 зафиксирует первым, поскольку он определяет композицию на раннем этапе. Определите ракурс и сцену до того, как определите объект съёмки, затем опишите действие, укажите освещение и стиль, а затем добавьте звук. Также укажите роль каждого элемента, чтобы избежать случайных результатов. Pollo AI идеально подходит в качестве рабочей среды для создания видеороликов с помощью Wan 3.0.

Руководство по использованию командной строки Wan 3.0 : понимание ключевых аспектов

Прежде чем мы перейдем к тому, как составить идеальное приглашение Wan 3.0 , вам сначала нужно понять основную формулу любого базового запроса, поэтому давайте быстро разберем ее для вас:

Аспект

Вопрос, на который нужно ответить

Пример

Предмет В чём заключается предмет обсуждения, и что должно оставаться узнаваемым? Потертый синий велосипед для доставки с плетеной корзиной.
Сцена Где оно находится и что его окружает? Узкая французская улочка после дождя, облицованные плиткой фасады, лужи, отражающий свет тротуар.
Движение Что движется, в каком порядке и с какой скоростью? Велосипед медленно катится вниз по склону; вода брызгает с шин.
Управление камерой Как следует снимать этот кадр? Съемка с нижнего ракурса, объектив 35 мм, мягкий пасмурный свет.
Стилизация Какая визуальная эстетика определяет данную сцену? Документальный фильм с приглушенными цветами.

Почему Wan 3.0 требует более тонких и продуманных подсказок?

Улучшенные возможности Wan 3.0 заставили меня изменить стиль подсказок по сравнению с тем, что я часто использовал в Wan 2.7. Одна из причин — максимальная продолжительность видеороликов с использованием ИИ увеличена до 30 секунд на клип. Почему это важно? Вот почему…

Я довольно тщательно протестировал Wan 3.0 , и ключевое различие между видеороликами, которые не оправдали моих ожиданий, и теми, которые им соответствовали, заключалось в отсутствии контроля времени в моих подсказках. Когда я просто давал визуальные описания, не учитывая каждую секунду кадра, всё проваливалось.

Без четкой временной шкалы Wan 3.0 будет заполнять пустые секунды случайными изменениями. Лучшие подсказки определяют ключевые действия и поведение камеры на протяжении всего ролика, при этом каждому изображению, видео, аудиофайлу или ссылке отводится четкая роль.

Я также заметил, что Wan 3.0 закладывает композицию на раннем этапе, часто используя первые детали в качестве основы сцены. Порядок имеет значение, особенно при преобразовании изображения в видео, где сохраняется первоначальная композиция и идентичность объекта, но при этом часто не реализуются радикальные изменения.

Например, если я преобразую фотографию в видеорекламу и запрашиваю слишком радикальное преобразование, я могу не получить удовлетворительного результата. Учитывая все эти факторы, я думаю, справедливо будет сказать, что использование Wan 3.0 требует тонкого подхода. Итак, давайте посмотрим, как можно получить наилучшие возможные запросы.

Прежде чем углубляться в настройки Wan 3.0 , ознакомьтесь с последними обновлениями этой модели в нашем руководстве о том, что такое Wan 3.0 .

Попробуйте Wan 3.0 бесплатно на Pollo AI прямо сейчас!

Введите свои творческие идеи, чтобы создавать потрясающие видеоролики с помощью Wan 3.0 на Pollo AI.

Начните создавать бесплатно
Начните создавать бесплатно

Подсказки Wan 3.0 : текст-видео против изображения-видео

Способ создания подсказок Wan 3.0 для T2V будет отличаться от I2V, поскольку вся последовательность зависит от правильного определения объекта, окружения, действия, камеры и визуального стиля.

Как я уже упоминал ранее, Wan 3.0 определяет композицию на раннем этапе, поэтому то, с чего вы начинаете свой запрос, модель фиксирует в первую очередь, прежде чем переходить к остальной части сцены. Например, если ваш запрос начинается с описания настроения, то Wan 3.0 будет ориентироваться на это настроение, а не на объекты.

Поэтому тип съемки следует определить до того, как выбрать объект и детали, которые вы хотите сохранить. Затем можно приступить к определению освещения, стиля и завершить созданием диалога, звуковых эффектов или музыки. Вот пример анимационного фильма , который я создал:

Быстрый

Выход

Кинематографический 8K-стилизованный 3D-кадр. Молодой человек в синей бандане использует голографические смарт-часы, чтобы запустить механические руки, которые моют его грязную Mazda RX-7. Машина модернизируется, наполняясь синим электричеством и меняя цвет с белого на глянцево-черный с фиолетовым свечением. Черный автомобиль мчится по залитому дождем неоновому киберпанк-городу ночью. На лобовом стекле активируется HUD, и машина подпрыгивает, превращаясь в воздухе в гигантского двуногого робота, водитель которого виден в светящейся кабине. Робот тяжело приземляется на улицу, затем использует синие реактивные двигатели, чтобы взлететь и героически встать на крышу небоскреба.

С другой стороны, если вы собираетесь использовать эталонные изображения, то это потребует другого подхода. Судя по тому, что я видел, Wan 3.0, похоже, гораздо строже, чем другие модели, ограничивает композицию и идентичность объекта на исходном изображении.

Поэтому довольно сложно использовать подсказки, которые радикально меняют облик сцены или вызывают резкие изменения. В большинстве таких случаев Wan 3.0 не справится с задачей и не оправдает моих ожиданий, поэтому я рекомендую использовать подсказки с плавными, непрерывными переходами, как показано ниже:

Быстрый:

Четырехкадровая игровая сцена. Используйте изображение 1 в качестве точного начального кадра и визуальной опоры. Сохраните идентичных принцессу-наемницу, сурового контрабандиста, лица, костюмы, пистолет, декорации космического корабля, освещение и режиссуру. Практический космический боевик 1980-х годов: реальные актеры, физические декорации, резиновый костюм инопланетянина, полноразмерный аниматронный робот, реалистичные искры/дым, сдержанные оптические лазеры, анаморфная пленка 35 мм.

КАДР 1 (0–3,2 с): Средний план, два кадра подряд. Она откинулась влево, ботинок поднят, пистолет болтается; он сидит справа.

ВЫПУСК 2 (3.2–6.7 с): Быстрый реверс. Чужая появляется слева от него. Она делает один точный выстрел мимо его плеча; болт попадает в грудь, искра, он падает. Оркестровый звук удара, лазерный луч.

КАДР 3 (6,7–10,3 с): Низкий ракурс. Робот топает вправо, поднимает руку. Она поворачивается, делает два выстрела (в сустав, затем в грудь); рука опускается, разлетается на куски с искрами и дымом. Он смотрит с благоговением; она опускает пистолет. Звучит перкуссия, духовые инструменты.

Кадр 4 (10,3–14 с): Крупный план с двух сторон. Первоначальный взгляд. Она возвращается к скучающей позе, пистолет болтается в воздухе, взгляд прикован. Она остается непринужденной, сдержанной и невозмутимой.

Вход

Выход

1787800046944-64220116-6849-48a5-b8cd-426e0ca3c699.webp

Wan 3.0 Запросы: Обработка движения

Исходя из личного опыта, обработка движений в Wan 3.0 требует довольно сложной последовательности действий. Хотя можно использовать подсказку типа «мужчина идёт по пляжу», я бы сказал, что это всего лишь простое предустановленное действие, из-за чего неясны время и взаимодействие.

Более удачный вариант — добавить цепочку наблюдаемых событий. Я бы сказал так: «Человек идёт по пляжу, останавливается, услышав громкий лай, поворачивается в сторону источника звука и видит, как к нему бежит золотистый ретривер». Это создаёт более реалистичное покадровое движение.

Попробуйте Wan 3.0 на Pollo AI бесплатно 💳 Одна подписка, все модели • 🌟 Регистрация не требуется

Но в то же время, не стоит перегружать клип излишней хореографией. Это еще одна вещь, на которую, как я заметил, Wan 3.0 плохо реагирует. Когда я пытался заставить персонажа выполнять слишком много точных действий или взаимодействовать со многими объектами, результат получался не таким уж идеальным.

Таким образом, хотя Wan 3.0 теперь поддерживает более длинные 30-секундные клипы, я рекомендую сосредоточиться на том, чтобы придать объекту четкую и понятную задачу/центральное действие, чтобы обеспечить временную стабильность. Хороший пример этого можно увидеть вреалистичном видео , которое я создал ниже:

Быстрый:

@Image1 — единственный главный персонаж. Её лицо, причёска, фигура и одежда сохранены в точности. Ультрареалистичная кинематографическая заморозка времени в стиле 30-х годов на залитой солнцем улице старого итальянского города (каменные здания, булыжник, кафе, пешеходы, голуби).

0–5 с: Она уверенно идёт к камере (стедикам отслеживает её движение назад) посреди обычной жизни.

5–8 с: Останавливается, щелкает пальцами → элегантная невидимая ударная волна замораживает все вокруг.

8–20 секунд: Движется только она; камера кружит, пока она идет по замерзшей улице, касается подвешенной капли, затем поворачивается к камере с полуулыбкой и снова делает снимок.

20–30 секунд: Вторая ударная волна размораживает мир; она сохраняет спокойствие.

Стиль: фотореалистичный, 50 мм, малая глубина резкости, естественное освещение, едва заметная зернистость, реалистичная физика/визуальные эффекты. Без морфинга, статичных изображений и артефактов.

Вход

Выход

фото с изображением футболки, фото с изображением футболки и фото.webp

Wan 3.0 Подсказка: Язык камеры

Что касается операторской работы, я обычно придерживаюсь простого правила: она состоит из четырех частей — размер кадра, ракурс, движение и объектив. Например: «широкий общий план с высокого ракурса, затем медленный спуск с использованием тележки к маяку; используйте кинематографическую перспективу 50 мм».

Это правило можно использовать во всех запросах Wan 3.0 , но всегда следует избегать противоречивых формулировок. Например, нельзя сказать: «Зафиксированная статическая камера быстро вращается вокруг объекта». Эти два разных направления несовместимы, поэтому не просите модель реализовать это.

Если вам когда-нибудь понадобится создать динамическую последовательность, например, трейлер , вот общее руководство по ракурсу камеры, к которому вы можете неоднократно обращаться при создании сцены:

Намерение

Режиссура камеры

Визуальный эффект

Создать место Общий план, медленный подъем с крана или выдвижение. Контекст и масштаб
Создайте близость Средний крупный план, плавное приближение Эмоциональное внимание
Следуйте инструкциям Боковая съемка или съемка с использованием тележки. Динамика и участие
Продемонстрировать важность Медленная орбита, центрированный состав Героический или символический акцент
Сохраните детали. Фиксированный крупный план, малая глубина резкости Фокусировка и осмотр
Создать нестабильность Контролируемое ручное перемещение Срочность или документальная энергия

Ещё один важный момент: простого описания «кинематографическое движение камеры» недостаточно для создания подходящей сцены в Wan 3.0. Необходимо быть более конкретным; например, фраза «камера движется влево со скоростью ходьбы, пока бежит собака» даст более целенаправленный результат. Вот хороший пример:

Быстрый

Выход

Стиль: Ультрареалистичный, кинематографический зимний документальный фильм, 4K HDR, естественное освещение, малая глубина резкости, плавное движение камеры, мягкая цветокоррекция, спокойная атмосфера. Сцена 1 (0–3 с) Аэросъемка с дрона небольшой деревянной хижины, спрятанной глубоко в заснеженном сосновом лесу. Легкий снег мягко падает, а из окон исходит теплый золотистый свет. Из дымохода поднимается тонкий дым, камера медленно опускается к хижине. Сцена 2 (3–6 с) Внутри хижины та же женщина сидит у потрескивающего каменного камина, завернувшись в мягкое шерстяное одеяло, и читает книгу. Сцена 3 (6–10 с) Она открывает деревянную входную дверь и выходит на заснеженное крыльцо. Снежинки мягко падают на ее свитер и волосы. Она улыбается, делает глубокий вдох и смотрит через тихий лес, пока камера мягко кружит вокруг нее. Сцена 4 (10–13 с) Крупные планы: ботинки, оставляющие свежие следы на нетронутом снегу, ее рука в перчатке, счищающая снег с сосновых ветвей, снежинки, оседающие на теплом окне хижины, и дым, поднимающийся в свежий зимний воздух. Сцена 5 (13–15 с) Широкий кинематографический кадр, снятый из хижины на закате. Снег продолжает падать, а светящаяся хижина становится все меньше на фоне бескрайнего белого леса.

Помимо изучения того, как создавать подсказки для Wan 3.0 , ознакомьтесь с нашим руководством по использованию Wan 3.0 для создания еще более качественных видеороликов с использованием ИИ.

Wan 3.0 Подсказки: Аудио/Диалоговые сцены

Мы знаем, что Wan 3.0 поддерживает нативную генерацию звука, но легко забыть, что звук также нужно описывать так же тщательно, как и визуальный ряд. Что касается диалогов, то, как я понял, работая над ежедневными видеоблогами , обучающими видео , короткометражными фильмами и т. д., в Wan 3.0 , нужно говорить короткими фразами.

К сожалению, синхронизация губ не всегда надежна, поэтому рассматривайте диалоги как короткие реплики, а не как длинный сценарий. Судя по тому, что я видел, это лучше всего работает с Wan 3.0. Ниже вы можете увидеть, как это помогло добиться отличного аудиовизуального результата:

Быстрый:

Сохранены точные черты лица, прическа, личность, тон кожи и телосложение с @image1. Настоящая индонезийская женщина в свободной терракотовой льняной рубашке, пыльно-бордовых широких брюках, коричневых кожаных сандалиях, маленьких золотых серьгах-кольцах, с распущенными волнистыми волосами.

Необработанный видеоблог, снятый на повседневную камеру конца 2000-х: сильная тряска, поиск фокуса, смещение экспозиции, теплые, приглушенные цвета, цифровой шум. Без позирования и современной цветокоррекции.

00:00–00:04 Прогуливается по тропической деревне с улыбкой: «Сегодня мы ищем свежие кокосы!»

00:04–00:08 Наблюдает, как продавец рубит кокос, с волнением.

00:08–00:12 Отпивает кокосовую воду, улыбается: «Как же это освежает!»

00:12–00:16 Разговоры/смех с жителями деревни, держащими в руках кокосы.

00:16–00:20 Пытается открыть кокос, испытывает трудности, смеется; местные жители аплодируют.

00:20–00:24 Лопатка мяса, дегустация, поднятый большой палец вверх.

00:24–00:27 Идет, машет рукой местным жителям.

00:27–00:30 Улыбки, приветственный взмах рукой: «Увидимся в моем следующем приключении. Пока!»

Вход

Выход

根据这张图片里的女人形象,生成一张她正面生活照,形象,发型,脸部,肤色等等都要一样.webp

Ещё я заметила, что если в сцене участвует несколько персонажей, обязательно используйте подписи. Например: «[Сара, хриплый голос] говорит: „Нам нужно уехать в шесть“. [Джон, мягкий, неуверенный голос] оглядывается на неё и говорит: „Хорошо. Давай начнём собирать вещи“».

Хотите увидеть больше примеров того, на что способен Wan 3.0 ? Ознакомьтесь с этой статьей о лучших вариантах использования Wan 3.0 .

Хотите создавать видео с помощью Wan 3.0? Зайдите на сайт Pollo AI.

Теперь, когда вы четко понимаете, как создать качественный сэмпл Wan 3.0 , вы, вероятно, захотите начать создавать с его помощью видео. В таком случае я бы порекомендовал обратиться к Pollo AI. Почему? Потому что это лучший набор инструментов для творчества с использованием ИИ , в котором собраны все лучшие модели видео на основе ИИ в одном месте.

Здесь вы можете получить доступ к Wan 3.0 , Seedance 2.5 , Kling 3.0 и Veo 3.1 , а также десяткам других вариантов, что позволяет легко сравнивать различные результаты для достижения наилучшего возможного результата. И это еще не все: вы можете загружать все свои ресурсы и размещать все свои проекты на этой единой платформе.

Интерфейс маркетинговой студии Pollo.ai для создания визуального контента.

По сути, я считаю это идеальным рабочим пространством, которое дополнит все ваши планы по использованию Wan 3.0. А самое главное? Оно предлагает Pollo Agent , AI Agent для видео , рассказов , рекламы и креативного дизайна , который автоматизирует все — от структуры и темпа до визуальных элементов, а значит, может помочь вам создать идеальную подсказку.

Попробуйте Wan 3.0 бесплатно на Pollo AI прямо сейчас!

Воплотите в жизнь свои самые смелые идеи с помощью Wan 3.0 и превратите их в готовые к публикации видеоролики на Pollo AI.

Начните создавать бесплатно
Начните создавать бесплатно

Всего несколько минут — и любая ваша приблизительная идея превратится в готовый к производству результат. Кроме того, Pollo AI включает в себя десятки инструментов для постобработки, таких как расширение видео с помощью ИИ , что гарантирует наличие всего необходимого для выполнения работы.

Просто зайдите на сайт Pollo AI и зарегистрируйте аккаунт. Вы можете начать создавать видео с помощью Wan 3.0 совершенно бесплатно, воспользовавшись бесплатной пробной версией . Гарантирую, что после нескольких часов работы на этой платформе вы начнете воспринимать ее как своего личного помощника по видеопроизводству.

Часто задаваемые вопросы о руководстве по использованию командной строки Wan 3.0

Какова может быть продолжительность поколения Wan 3.0 ?

Wan 3.0 позволяет создавать видеоролики с собственным звуком продолжительностью до 30 секунд за один проход. Просто убедитесь, что ваш запрос учитывает каждую секунду кадра, если вы хотите получить наилучший результат. В противном случае, он может заполнить пробелы, используя собственное суждение, неожиданным образом.

Сколько ссылок поддерживает Wan 3.0 ?

Вы можете загрузить до 10 эталонных изображений, 5 видеороликов и 5 аудиофайлов, при этом поддерживаются ссылки на документы и веб-страницы для каждого варианта генерации. Всегда указывайте назначение каждой из этих ссылок; в противном случае они могут случайным образом повлиять на конечный результат.

Как можно улучшить длинное приглашение командной строки Wan 3.0 ?

Сосредоточьтесь на многоуровневых директивах для Wan 3.0 . Например: «Тихий лес. Внезапно земля содрогается и раскалывается. Из трещин вылезают зомби». Разделите все ключевые состояния и рассматривайте их как независимые хронологические этапы. Для 30-секундных сцен используйте временные метки для каждого конечного состояния.

Как мне следует инициировать процесс преобразования изображения в видео?

Wan 3.0 обладает достаточно мощными возможностями для привязки к исходному изображению, поэтому он, как правило, предпочитает постепенное развитие, а не радикальные изменения исходного изображения. Сосредоточьтесь на создании подсказок, демонстрирующих естественное развитие сцены, указывая, как камера или объект должны двигаться в ней.

Как можно улучшить согласованность символов в Wan 3.0?

Вы можете использовать эталонное изображение/видео персонажа, а затем определить атрибуты, которые вы хотите сохранить в Wan 3.0 . Например, «Сохранить длинные светлые волосы и черты лица женщины на протяжении всей сцены». Просто сведите к минимуму количество персонажей, действий и изменений локаций.

Как управлять звуком при использовании Wan 3.0?

При написании задания следует выделить аудиоматериалы в отдельную категорию и описать источник/характеристики каждого из них отдельно. Например: «Раздается нежный женский голос. Дождь стучит по стеклу. Под диалог играет фортепианная музыка». Это включает в себя голос, звуковые эффекты и фоновую музыку, гарантируя, что каждая часть будет учтена в создаваемой сцене.

Вам также может понравиться

Посмотреть больше

Обзор Wan 3.0: я тестировал его 10 дней, и вот что выяснил

В этом обзоре Wan 3.0 я делюсь тем, что выяснил после тестирования этой модели в реальных видеопроектах. Узнай, как она себя показала и почему я рекомендую использовать Wan 3.0 на Pollo AI.

Wan 3.0 или Seedance 2.5: какой генератор видео с ИИ тебе выбрать?

Узнай больше о Wan 3.0 и Seedance 2.5 здесь! Прочитай наше подробное руководство по сравнению Wan 3.0 и Seedance 2.5, чтобы понять, какой ИИ-генератор видео лучше всего подойдёт тебе уже сегодня!

Руководство по подсказкам для Seedance 2.5: перестаньте гадать, начните режиссировать.

Seedance 2.5 предлагает перестать писать стихи и начать режиссировать! Откройте для себя лучшие формулы Seedance 2.5 для создания потрясающих текстовых, графических и видеорезультатов.

Gemini Omni (Veo 4) против Seedance 2.0: какой генератор видео на основе ИИ лучше всего подходит именно вам?

Сравните ключевые функции Gemini Omni (Veo 4) и Seedance 2.0. Узнайте, какой ИИ-генератор видео подходит вам, и попробуйте их на Pollo AI бесплатно!