Accueil/Blog/Perspectives des modèles d'IA/Guide des prompts Wan 3.0 : comment tirer le meilleur parti de Wan 3.0

Guide des prompts Wan 3.0 : comment tirer le meilleur parti de Wan 3.0

J'ai passé un certain temps à utiliser Wan 3.0, et je dirais que son modèle est davantage axé sur le réalisateur que ses prédécesseurs. Il prend désormais en charge les générations de 30 secondes avec du texte, des images, de l'audio, de la vidéo, des documents et des pages web comme entrées de référence ; la génération de prompteurs exige donc un peu plus de finesse. Vous voulez connaître le secret ? Poursuivez votre lecture pour découvrir à quels types de contenus Wan 3.0 réagit le mieux.

TL;DR

Ce que vous écrivez au début de votre prompt est ce que Wan 3.0 enregistrera en premier, car il définit la composition dès le départ. Définissez le plan et la scène avant d'identifier le sujet, puis décrivez l'action, spécifiez l'éclairage et le style, et enfin ajoutez l'audio. Précisez également le rôle de chaque référence pour éviter des résultats aléatoires. Vous pouvez utiliser Pollo AI comme environnement de travail idéal pour générer des vidéos avec Wan 3.0 .

Guide prompt de Wan 3.0 : Comprendre les aspects clés

Avant d'aborder la création d'une prompt Wan 3.0 parfaite, il est essentiel de comprendre la formule de base de toute requête prompt simple. Voici donc un bref aperçu :

Aspect

Question à répondre

Exemple

Sujet Quel est le sujet et qu'est-ce qui doit rester reconnaissable ? Un vélo de livraison bleu délavé avec un panier en osier.
Scène Où se trouve-t-il, et qu'y a-t-il autour ? Une rue française étroite après la pluie, façades carrelées, flaques d'eau, pavés réfléchissants
Mouvement Quels mouvements, dans quel ordre et à quelle vitesse ? Le vélo descend lentement la pente ; de l'eau jaillit des pneus.
Contrôle de la caméra Comment la prise de vue doit-elle être filmée ? Plan en contre-plongée, objectif 35 mm, lumière douce et diffuse.
Stylisation Quelle esthétique visuelle domine la scène ? Vidéo documentaire aux couleurs atténuées

Pourquoi Wan 3.0 exige-t-il des prompts plus nuancées ?

Les fonctionnalités améliorées de Wan 3.0 m'ont contraint à adopter une méthode de guidage différente de celle que j'utilisais fréquemment avec Wan 2.7. L'une des raisons est que la durée maximale des vidéos IA a été étendue à 30 secondes par clip. Pourquoi est-ce important ? Voici pourquoi…

J'ai testé Wan 3.0 de manière approfondie, et une différence majeure entre les vidéos décevantes et celles qui répondaient à mes attentes résidait dans l'absence de contrôle du temps dans mes indications. Lorsque je me contentais de descriptions visuelles sans tenir compte de chaque seconde du plan, le résultat était catastrophique.

Sans chronologie précise, Wan 3.0 comblerait les secondes vides par des modifications aléatoires. Les meilleures prompts décrivent les actions clés et le comportement de la caméra tout au long du clip, en attribuant un rôle clair à chaque image, vidéo, fichier audio ou lien.

J'ai également remarqué que Wan 3.0 établit la composition dès le début, utilisant souvent les premiers détails de prompt comme base de la scène. L'ordre est important, surtout pour la conversion d'images en vidéo, où il préserve la composition initiale et l'identité du sujet, mais tend à atténuer les changements radicaux.

Par exemple, si je transforme une photo en publicité vidéo et que je demande une transformation trop radicale, le résultat risque de ne pas être satisfaisant. Compte tenu de ces éléments, il est clair que l'utilisation de Wan 3.0 requiert une approche nuancée. Voyons donc comment obtenir les meilleures prompts possibles.

Avant de vous plonger dans les prompts Wan 3.0 , découvrez les dernières améliorations du modèle dans notre guide sur ce qu'est Wan 3.0 .

Essayez Wan 3.0 gratuitement sur Pollo AI dès maintenant

Saisissez vos prompts créatives pour réaliser des vidéos époustouflantes avec Wan 3.0 sur Pollo AI.

Commencez à créer gratuitement
Commencez à créer gratuitement

Wan 3.0 : Conversion de texte en vidéo ou d’image en vidéo

La manière dont vous créez les prompts Wan 3.0 pour T2V sera différente de celle pour I2V, car toute la séquence repose sur la définition correcte du sujet, de l'environnement, de l'action, de la caméra et du style visuel.

Comme je l'ai mentionné précédemment, Wan 3.0 définit la composition très tôt ; ainsi, ce que vous indiquez en début de prompt est ce que le modèle verrouille en premier, avant le reste de la scène. Par exemple, si votre prompt commence par décrire une ambiance, Wan 3.0 basera sa composition sur cette ambiance plutôt que sur les sujets.

C’est pourquoi il est conseillé de définir le type de plan avant d’identifier le sujet et les éléments à préserver. Vous pourrez ensuite définir l’éclairage, le style, et terminer par les dialogues, les effets sonores ou la musique. Voici un court métrage d’animation que j’ai réalisé à titre d’exemple :

Prompt

Sortir

Plan-séquence 3D stylisé en 8K. Un jeune homme au bandana bleu utilise une montre connectée holographique pour déployer des bras mécaniques qui lavent sa Mazda RX-7 couverte de boue. La voiture se métamorphose, parcourue d'une décharge électrique bleue et passant du blanc au noir brillant, illuminée d'une énergie violette. La voiture noire file à travers une ville cyberpunk nocturne, baignée de néons et baignée de pluie. Un affichage tête haute s'active sur le pare-brise, et la voiture bondit, se transformant en plein vol en un gigantesque robot bipède. Le pilote apparaît dans le cockpit lumineux intégré au torse. Le robot atterrit lourdement sur la chaussée, puis utilise des réacteurs bleus pour s'envoler et se dresser héroïquement sur le toit d'un gratte-ciel.

En revanche, si vous comptez utiliser des images de référence, une autre approche s'impose. D'après mon expérience, Wan 3.0 semble figer la composition et l'identité du sujet de l'image source de manière beaucoup plus stricte que d'autres modèles.

De ce fait, il peut être assez difficile d'utiliser des prompts qui transforment radicalement l'action ou provoquent des changements brusques. Dans la plupart de ces cas, Wan 3.0 ne serait pas à la hauteur et ne correspondrait pas à ma vision de la scène. Je recommande donc d'utiliser des prompts avec des transitions douces et continues, comme ci-dessous :

Prompt:

Séquence en prises de vues réelles en quatre plans. Utiliser l'image 1 comme plan d'ouverture et point de repère visuel. Conserver à l'identique la princesse mercenaire, le contrebandier, les visages, les costumes, le pistolet, le décor du vaisseau spatial, l'éclairage et la mise en scène. Film d'action spatiale des années 1980, réalisé avec des effets spéciaux pratiques : acteurs réels, décors physiques, costume d'extraterrestre en caoutchouc, robot animatronique grandeur nature, effets d'étincelles et de fumée réels, lasers discrets, format anamorphique 35 mm.

PLAN 1 (0–3,2 s) : Plan rapproché moyen à deux. Elle est allongée sur le côté gauche, botte levée, pistolet pendant ; il est assis à droite.

PLAN 2 (3,2–6,7 s) : Marche arrière prompt. L’extraterrestre explose derrière lui. Elle tire un projectile précis juste au-dessus de son épaule ; le projectile le frappe à la poitrine, étincelle, il tombe. Coup de tonnerre orchestral, craquement laser.

PLAN 3 (6,7–10,3 s) : Plan trois-quarts bas. Le robot piétine la droite, lève le bras. Elle pivote, tire deux coups (articulation puis poitrine) ; le bras retombe, s’écrase dans un nuage d’étincelles et de fumée. Il la regarde, stupéfait ; elle abaisse son pistolet. Coup de percussion, cuivres retentissants.

PLAN 4 (10,3–14 s) : Gros plan sur deux personnes. Regard initial. Elle reprend une pose blasée, pistolet pendant, le regard fixe. Elle reste imperturbable, maîtresse d’elle-même et impassible.

Saisir

Sortir

1787800046944-64220116-6849-48a5-b8cd-426e0ca3c699.webp

Wan 3.0 Invite : Gestion du mouvement

D'après mon expérience, la gestion des mouvements avec Wan 3.0 exige une séquence assez précise. Bien qu'il soit possible d'utiliser une prompt comme « un homme marche sur une plage », je dirais que cette description ne représente qu'une action prédéfinie, ce qui laisse planer le doute sur le timing et l'interaction.

Une meilleure option consiste à ajouter une suite d'événements observables. Je dirais : « Un homme marche sur une plage, s'arrête en entendant un aboiement sonore, se retourne vers la source du bruit et aperçoit un golden retriever qui court vers lui. » Cela crée un mouvement image par image plus réaliste.

Essayez Wan 3.0 sur Pollo AI gratuitement 💳 Un seul abonnement, tous les modèles • 🌟 Aucune inscription requise

Mais en même temps, il ne faut pas surcharger la vidéo avec une chorégraphie excessive. C'est un autre point que j'ai constaté : Wan 3.0 a du mal à gérer cela. Lorsque j'ai essayé de faire exécuter à un personnage trop d'actions précises ou d'interagir avec de nombreux objets, le résultat n'était pas optimal.

Ainsi, bien que Wan 3.0 prenne désormais en charge les clips de 30 secondes, je vous suggère de veiller à ce que le sujet ait une tâche ou une action principale claire et simple afin de garantir une meilleure stabilité temporelle. Vous pouvez en voir un bon exemple dans la vidéo réaliste que j'ai générée ci-dessous :

Prompt:

@Image1 est le seul personnage principal. Conservez son visage, sa coiffure, son corps et ses vêtements à l'identique. Un arrêt sur image ultra-réaliste de 30 secondes, façon cinéma, dans une rue ensoleillée d'une vieille ville italienne (bâtiments en pierre, pavés, cafés, piétons, pigeons).

0–5s : Elle marche avec assurance vers la caméra (la Steadicam recule) au milieu de la vie normale.

5–8 s : S'arrête, claque des doigts → une élégante onde de choc invisible fige tout.

8–20 s : Seule elle bouge ; la caméra tourne autour d'elle tandis qu'elle marche dans la rue gelée, touche une gouttelette en suspension, puis fait face à la caméra avec un demi-sourire et prend une autre photo.

20–30 s : Une seconde onde de choc libère le monde de son froid ; elle reste calme.

Style : photoréaliste, 50 mm, faible profondeur de champ, lumière naturelle, grain subtil, physique/effets spéciaux réalistes. Sans morphing, sans effets supplémentaires ni artefacts.

Saisir

Sortir

根据这张图片里的女人形象,生成一张她穿t-shirt的平面模特照photo.webp

Invite Wan 3.0 : Langage de la caméra

En matière de cadrage, une règle simple que j'aime suivre consiste à structurer l'image en quatre parties : le cadrage, l'angle de prise de vue, le mouvement et l'objectif. Par exemple : « un plan d'ensemble large en plongée, puis un lent travelling avant vers le phare ; utiliser une perspective cinématographique de 50 mm. »

Vous pouvez utiliser cette règle dans toutes vos prompts Wan 3.0 , mais veillez à éviter toute formulation contradictoire. Par exemple, vous ne pouvez pas dire : « Une caméra fixe verrouillée tourne promptment autour du sujet. » Ces deux instructions sont incompatibles ; ne demandez donc pas au modèle de les combiner.

Si vous souhaitez générer une séquence dynamique, comme une bande-annonce par exemple, voici un guide général de perspective de caméra auquel vous pouvez vous référer à plusieurs reprises lors de la création de la scène :

Intention

Direction de la caméra

Effet visuel

Établir un lieu Plan large, travelling lent ou travelling avant Contexte et échelle
Créer de l'intimité Gros plan moyen, léger zoom avant attention émotionnelle
Suivre l'action travelling latéral ou travelling avant Dynamique et participation
Montrer l'importance Orbite lente, composition centrée accent héroïque ou iconique
Préserver les détails Gros plan fixe, faible profondeur de champ Concentration et inspection
Créer de l'instabilité Mouvement contrôlé de la main urgence ou énergie documentaire

Autre point important : parler simplement de « mouvement de caméra cinématographique » ne suffit pas pour créer une scène correcte avec Wan 3.0. Il faut être plus précis ; par exemple, « la caméra suit le chien vers la gauche à vitesse de marche » donnera un résultat plus convaincant. Voici un bon exemple :

Prompt

Sortir

Style : Documentaire hivernal ultra-réaliste et cinématographique, 4K HDR, éclairage naturel, faible profondeur de champ, mouvements de caméra fluides, étalonnage des couleurs doux, atmosphère paisible. Scène 1 (0–3 s) : Vue aérienne par drone d’une petite cabane en bois nichée au cœur d’une forêt de pins enneigée. La neige tombe doucement tandis que de chaudes lueurs dorées filtrent par les fenêtres. Une fine fumée s’échappe de la cheminée tandis que la caméra descend lentement vers la cabane. Scène 2 (3–6 s) : À l’intérieur de la cabane, la même femme est assise près d’une cheminée en pierre où crépite le feu, enveloppée dans une douce couverture en laine, un livre à la main. Scène 3 (6–10 s) : Elle ouvre la porte d’entrée en bois et sort sur le perron enneigé. Des flocons de neige se posent délicatement sur son pull et ses cheveux. Elle sourit, inspire profondément et contemple la forêt silencieuse tandis que la caméra effectue un doux cercle autour d’elle. Scène 4 (10-13 s) Gros plans cinématographiques : des bottes laissent des empreintes fraîches dans la neige vierge, sa main gantée enlève la neige des branches de pin, des flocons de neige se déposent sur la vitre chaude de la cabane, et la fumée se dissipe dans l’air vif de l’hiver. Scène 5 (13-15 s) Plan large cinématographique depuis la cabane au crépuscule. La neige continue de tomber tandis que la cabane illuminée se rétrécit au milieu de l’immensité blanche de la forêt.

Au-delà de l'apprentissage de la création d'prompts Wan 3.0 , consultez notre guide d'utilisation de Wan 3.0 pour créer des vidéos d'IA encore meilleures.

Wan 3.0 Invite : Scènes audio/de dialogue

Nous savons que Wan 3.0 prend en charge la génération audio native, mais il est facile d'oublier que l'audio doit être décrit avec autant de soin que l'image. En ce qui concerne les dialogues, ce que j'ai appris sur Wan 3.0 après avoir généré quotidiennement des vlogs , des tutoriels , des courts métrages, etc., c'est qu'il faut privilégier les répliques courtes.

Malheureusement, la synchronisation labiale n'est pas toujours fiable. Il faut donc considérer les dialogues comme de brèves indications de jeu, et non comme un long texte narratif. D'après mon expérience, c'est la méthode qui fonctionne le mieux avec Wan 3.0. Vous pouvez constater ci-dessous comment cela a permis d'obtenir un excellent résultat audiovisuel :

Prompt:

Conserver exactement le visage, la coiffure, l'identité, le teint et le corps de @image1. Authentique femme indonésienne portant une chemise en lin couleur terre cuite surdimensionnée, un pantalon large bordeaux délavé, des sandales en cuir marron, de petites boucles d'oreilles créoles dorées et des cheveux ondulés lâches.

Vlog brut de la fin des années 2000, filmé avec une caméra à clapet : fortes vibrations, mise au point difficile, variations d’exposition, couleurs chaudes et délavées, bruit numérique. Sans mise en scène ni étalonnage moderne.

00:00–00:04 Les habitants d'un village tropical se promènent en souriant : « Aujourd'hui, nous partons à la recherche de noix de coco fraîches ! »

00:04–00:08 Observe le vendeur couper une noix de coco, enthousiaste.

00:08–00:12 Elle sirote de l'eau de coco et sourit : « C'est tellement rafraîchissant ! »

00:12–00:16 Discussions/rires avec des villageois tenant une noix de coco.

00:16–00:20 Il essaie d'ouvrir une noix de coco, a du mal, rit ; les habitants applaudissent.

00:20–00:24 Il prend de la chair, goûte, lève le pouce.

00:24–00:27 Promenades en saluant les habitants.

00:27–00:30 Sourires, saluts : « À bientôt pour ma prochaine aventure ! Au revoir ! »

Saisir

Sortir

根据这张图片里的女人形象,生成一张她正面生活照,形象,发型,脸部,肤色等等都要一样.webp

Autre chose que j'ai remarquée : dans les scènes à plusieurs personnages, il est important d'utiliser des indications scénaristiques. Par exemple : « [Sarah, voix rauque] dit : « Il faut partir à six heures. » [Jon, voix douce et hésitante] se retourne vers elle et dit : « D'accord. Commençons à faire nos valises. » »

Vous souhaitez voir d'autres exemples de ce que le Wan 3.0 peut réaliser ? Consultez cet article sur les meilleurs cas d'utilisation du Wan 3.0 .

Vous souhaitez créer des vidéos avec Wan 3.0? Rendez-vous sur Pollo AI.

Maintenant que vous comprenez bien comment créer une prompt Wan 3.0 efficace, vous souhaitez probablement commencer à générer des vidéos. Dans ce cas, je vous recommande Pollo AI. Pourquoi ? Parce qu'il s'agit de la suite créative IA par excellence , regroupant tous les meilleurs modèles vidéo IA.

Ici, vous pouvez accéder à Wan 3.0 , Seedance 2.5 , Kling 3.0 et Veo 3.1 , ainsi qu'à des dizaines d'autres options, ce qui facilite la comparaison de différents rendus pour obtenir le meilleur résultat possible. De plus, vous pouvez également importer tous vos fichiers et héberger tous vos projets sur cette plateforme unique.

Interface du studio marketing de Pollo.ai pour la création de contenu visuel.

En résumé, je le considère comme l'espace de travail idéal qui complétera parfaitement tout ce que vous souhaitez faire avec Wan 3.0. Le meilleur atout ? Il propose Pollo Agent , un AI Agent pour les vidéos , les stories , les publicités et la création graphique , qui automatise tout, de la structure et du rythme aux visuels, et peut donc vous guider dans la création du prompt parfait.

Essayez Wan 3.0 gratuitement sur Pollo AI dès maintenant

Donnez vie à vos idées les plus audacieuses avec Wan 3.0 et transformez-les en vidéos prêtes à être publiées sur Pollo AI.

Commencez à créer gratuitement
Commencez à créer gratuitement

Quelques minutes suffisent pour transformer n'importe quelle idée, même la plus floue, en un résultat prêt pour la production. De plus, Pollo AI intègre des dizaines d'outils de post-production, comme l' extension vidéo IA , vous assurant ainsi de disposer de tout le nécessaire pour mener à bien votre projet.

Rendez-vous sur Pollo AI et créez un compte. Vous pourrez commencer à créer des vidéos avec Wan 3.0 gratuitement grâce à l'essai gratuit . Je vous garantis qu'après quelques heures d'utilisation, vous considérerez cette plateforme comme votre assistant personnel de production vidéo.

FAQ sur le guide prompt Wan 3.0

Quelle peut être la durée d'une génération Wan 3.0 ?

Wan 3.0 vous permet de générer des vidéos avec audio natif jusqu'à 30 secondes en une seule passe. Veillez simplement à ce que votre prompt prenne en compte chaque seconde de la prise de vue pour un résultat optimal. Sinon, le logiciel risque de compléter les informations manquantes de manière inattendue.

Combien de références Wan 3.0 prend-il en charge ?

Vous pouvez importer jusqu'à 10 images de référence, 5 vidéos et 5 fichiers audio, avec prise en charge des liens vers des documents et des pages web pour chaque génération. Veillez à toujours indiquer la fonction de chaque référence ; à défaut, elles pourraient influencer le résultat final de manière aléatoire.

Comment puis-je améliorer un long prompt Wan 3.0 ?

Concentrez-vous sur la création de directives détaillées Wan 3.0 . Par exemple : « Une forêt paisible. Soudain, le sol tremble et se fissure. Des zombies surgissent des fissures. » Séparez tous les états clés et traitez-les comme des séquences chronologiques indépendantes. Pour les scènes de 30 secondes, utilisez des horodatages pour chaque état final.

Comment prompt la génération d'images en vidéo ?

Wan 3.0 possède une excellente capacité d'ancrage de référence ; il privilégie donc une évolution progressive aux changements brusques de l'image source. Concentrez-vous sur la création d'prompts qui illustrent une progression naturelle de la scène en précisant les mouvements de la caméra ou du sujet.

Comment puis-je améliorer la cohérence des personnages avec Wan 3.0?

Vous pouvez utiliser une image ou une vidéo de référence du personnage, puis définir les attributs que vous souhaitez que Wan 3.0 conserve. Par exemple : « Préserver les longs cheveux blonds et les traits du visage de la femme tout au long de la scène. » Veillez à minimiser le nombre de personnages, d’actions et de changements de lieu.

Comment contrôler le son lorsque j'utilise Wan 3.0?

Lors de la rédaction du prompt, vous devez placer l'audio dans une catégorie distincte et décrire la source et le comportement de chaque élément séparément. Par exemple : « Une douce voix féminine se fait entendre. La pluie tambourine sur la vitre. Une musique de piano accompagne le dialogue. » Cela inclut la voix, les effets sonores et la musique de fond, garantissant ainsi que chaque élément est bien présent dans la scène générée.

Vous pourriez aussi aimer

Voir plus

Avis sur Wan 3.0 : je l’ai testé pendant 10 jours et voici ce que j’ai trouvé

Cet avis sur Wan 3.0 partage ce que j’ai constaté après avoir testé ce modèle sur de vrais projets vidéo. Découvre ses performances et pourquoi je recommande d’utiliser Wan 3.0 sur Pollo AI.

Wan 3.0 vs Seedance 2.5 : quel générateur de vidéos IA devrais-tu utiliser ?

Découvre ici Wan 3.0 et Seedance 2.5 en comparaison ! Lis notre guide comparatif détaillé de Wan 3.0 et Seedance 2.5 pour savoir quel générateur de vidéos IA te convient le mieux dès aujourd’hui !

Guide d'utilisation de Seedance 2.5 : Arrêtez de deviner, commencez à diriger

Seedance 2.5 vous invite à délaisser l'écriture poétique pour la mise en scène ! Découvrez les meilleures formules Seedance 2.5 pour des rendus texte, image et vidéo exceptionnels.

Gemini Omni (Veo 4) vs Seedance 2.0 : Quel est le meilleur générateur de vidéo par IA pour vous | Pollo AI

Comparez Gemini Omni (Veo 4) et Seedance 2.0 selon leurs fonctionnalités clés. Découvrez quel générateur de vidéos IA correspond à vos besoins et essayez Gemini Omni et Seedance 2.0 sur Pollo AI gratuitement !