Guide des prompts Wan 3.0

Le guide des prompts Wan 3.0, d’après les formules d’Alibaba : les six couches que le modèle lit, le réécriveur qui tourne avant chaque prise, le son.
7 septembre 2026

Un prompt Wan 3.0 est lu comme une seule prise continue, en couches, et le modèle remplit lui-même toute couche que vous laissez vide. Ce qui veut dire que la correction d’un clip revenu de travers n’est presque jamais un prompt plus long. C’est de nommer la couche que vous aviez laissée au hasard.

Voici toute la forme. Tout ce qui suit plus bas est l’une de ces six lignes, avec la règle dont elle vient et la date à laquelle cette règle a été vérifiée.

Sujet       qui ou quoi, décrit tel que vous voulez qu’il reste
Décor       où cela se passe, et ce que fait la lumière
Mouvement   ce qui change entre la première seconde et la dernière
Caméra      où est l’objectif, et s’il bouge
Son         une réplique, un effet, de la musique — l’un des trois, ou aucun
Référence   Image 1, Video 1, Audio 1, si vous avez joint quelque chose

Collez cela dans le générateur de prompts Wan 3.0 et il remplira les couches dans la formulation d’Alibaba — offert, sans compte, sans plafond quotidien. Ou écrivez-les vous-même et servez-vous de cette page pour vérifier chacune.

Ce que Wan 3.0 fait d’une couche que vous omettez

La même montre à gousset, la même graine : le clip qui nommait la caméra est revenu en plongée, celui à qui il manquait la ligne Caméra est revenu à hauteur d’œil

Deux paires appariées, lancées ici le 2026-09-07. La même graine à l’intérieur de chaque paire, le réécriveur désactivé, cinq secondes en 480P, et la seule modification entre les deux prompts était la suppression de la ligne Caméra et de la ligne Son.

Caméra et Son écritsLes deux lignes supprimées
Tasse de café, graine 71547Le cadrage tient sur les vingt images échantillonnéesLe cadrage dérive au fil du clip
Montre à gousset, graine 88213Gros plan en plongée, comme demandéTrois-quarts à hauteur d’œil — un autre plan de la même scène
Tasse, niveau audiomoyenne −47,5 dB, crête −35,9 dBmoyenne −16,8 dB, crête −2,2 dB
Montre, niveau audiomoyenne −31,5 dB, crête 0,0 dBmoyenne −28,4 dB, crête −4,9 dB

Deux de ces observations ont tenu dans les deux paires, et les deux méritent qu’on écrive ses prompts autour :

  • Supprimez la ligne Caméra et vous n’obtenez pas une caméra neutre, vous obtenez le choix de quelqu’un d’autre. Dans la paire de la montre, ce choix était un angle entièrement différent — la plongée est devenue une hauteur d’œil, ce qui est un plan remis en scène plutôt qu’une variation sur un plan.
  • Supprimez la ligne Son et vous obtenez quand même du son. Aucun des clips écrits sans elle n’est revenu silencieux. Si une piste non demandée pose un problème pour votre livraison, la couche Son est l’endroit où l’arrêter.

Une chose n’a pas tenu, et il vaut mieux le savoir avant de s’appuyer dessus. « Quiet room tone only, no music and no voice » n’est pas un réglage de volume. Cela a retiré 31 dB au niveau moyen dans la paire de la tasse et 3 dB dans celle de la montre, et le clip de la montre qui demandait le silence a quand même crêté à pleine échelle. Écrivez la couche Son pour dire ce qui doit être entendu. N’attendez pas d’elle qu’elle dise à quel volume.

« The camera does not move » n’a pas tenu non plus. Les deux clips qui demandaient un cadre verrouillé dérivent quand même. Dans ces deux paires, la ligne Caméra a acheté l’angle de façon fiable et n’a jamais acheté le verrou.

Deux paires restent deux paires — assez pour rapporter ce qui s’est passé, pas assez pour arrêter une règle valable pour tous les sujets. Les graines et les réglages sont ci-dessus, donc le même test tourne sur votre propre brief Wan 3.0 en une minute environ.

Votre prompt Wan 3.0 est réécrit avant de tourner

Un paramètre change la façon dont toutes les autres règles de cette page se comportent, et il est activé tant que vous ne le désactivez pas. prompt_extend vaut true par défaut, et tant qu’il est activé, un modèle de langage réécrit ce que vous avez tapé avant que le modèle vidéo n’en voie quoi que ce soit.

Deux conséquences, et il vaut la peine d’agir sur les deux dès aujourd’hui :

  • Le même prompt lancé deux fois n’est pas le même prompt. Deux réécritures sont entrées, donc deux briefs sont entrés. Si votre deuxième tentative est revenue avec une autre composition alors que vous n’aviez rien changé, c’est généralement pour cette raison.
  • Un brief maigre gagne le plus et contrôle le moins. Développer un prompt court est exactement ce à quoi sert le réécriveur. Donnez-lui trois mots et il invente les quarante autres. Donnez-lui les six couches et il ne lui reste presque rien à inventer.

Donc, quand vous comparez deux versions d’un plan — deux mouvements de caméra, deux tenues — désactivez d’abord le réécriveur. Sinon trois choses ont changé et vous n’en voyez que deux.

Une graine fixée ne sauvera pas la comparaison non plus. La note d’Alibaba sur seed dit elle-même que les résultats peuvent ne pas être parfaitement identiques à valeur égale : « même prompt, même graine » fait donc deux affirmations molles plutôt qu’une dure.

Écrire un dialogue que Wan 3.0 joue au lieu de le raconter

Le son est généré dans la même passe que l’image, et c’est pourquoi une réplique appartient au prompt et non à un fichier que vous enregistrez après coup. Couper le son ne rend pas le clip moins cher : il n’y a rien à économiser en le laissant de côté.

Alibaba publie la formule :

Voice = Character's lines + Emotion + Tone + Speed + Timbre + Accent

Soit, en clair : la réplique elle-même, puis l’émotion, le ton, le débit, le timbre et l’accent.

Son propre exemple travaillé utilise des guillemets doubles :

He says, "Study hard and make progress every day," in a relaxed tone.

Avec plus d’un locuteur, nommez-les d’abord et citez-les ensuite :

[Character A: Black-suited Agent]

[Black-suited Agent, angrily]: "Where is the truth?"

Si vous avez lu ici la règle des accolades, elle était trop forte

Sept pages de ce site disaient autrefois que les accolades étaient la seule chose qui séparait une réplique parlée d’une narration, et que des guillemets feraient lire la ligne en voix off. Les accolades fonctionnent. « Seule » non, et la partie sur les guillemets non plus — cinq des démonstrations de dialogue sur la page de sortie d’Alibaba n’utilisent aucune accolade. Corrigé le 2026-09-04.

Trois choses décident réellement si une réplique est jouée, et le type de délimiteur n’en fait pas partie :

  1. Écrivez la réplique mot pour mot. Un résumé de ce que quelqu’un dit revient raconté. Les mots que vous voulez entendre doivent apparaître comme ces mots-là.
  2. Gardez-la séparée de la description. Une réplique enfouie dans une phrase sur la pièce se lit comme une partie de la pièce.
  3. Attachez-la à quelqu’un de visible à l’image. Une voix sans corps à l’écran est de loin la façon la plus courante dont un dialogue devient une voix off.

Diriger votre prompt vers la matière que vous avez jointe

En mode référence, le prompt peut s’adresser à une pièce jointe par son numéro — Image 1, Video 1, Audio 1 — et la numérotation court par type, donc les images et les clips comptent chacun à partir de un.

Trompez-vous de forme et rien ne renvoie d’erreur. La requête tourne, elle est facturée, et le modèle invente le sujet que vous pensiez avoir fourni. C’est ce silence qui coûte cher.

Une requête porte jusqu’à 10 images de référence, 5 clips totalisant 15 secondes et 5 pistes audio totalisant 15 secondes, plus soit un document de 50 pages au maximum, soit un lien web public.

La matière de référence et les première/dernière images ne voyagent pas ensemble. Une requête qui porte les deux est refusée — et elle est refusée après la mise en file, donc vous attendez l’échec. Choisissez la famille avant d’écrire : les images clés quand vous savez exactement comment le plan ouvre et ferme, la matière de référence quand il vous faut un visage, un produit ou une gamme de couleurs qui survive au clip entier.

Trois commandes que Wan 3.0 n’a pas

Des guides actuellement bien classés pour ce modèle décrivent les trois. Aucune n’est dans le schéma de requête, et écrire un prompt qui dépend de l’une d’elles est la façon dont un après-midi disparaît.

Ce que vous avez peut-être luCe que le schéma contient
Un mode réalisateur à six plansAucun paramètre de nombre de plans et aucun mode AI Director n’existent. Le multi-plans est quelque chose que le prompt demande, jamais quelque chose qu’un réglage garantit
Identity Lock, qui tiendrait un personnage entre deux sessionsRien n’est mémorisé d’une génération à l’autre. Il n’y a aucun verrou entre sessions ; la matière de référence est renvoyée à chaque requête
Une trajectoire de caméra que vous pourriez animer par clésLe mouvement de caméra se décrit avec des mots, dans la couche Caméra, et s’interprète à chaque génération

La version pratique : le nombre de plans que vous demandez est une demande, pas un contrat. Décrivez des temps distincts et il coupera généralement entre eux. Demandez une prise continue et il la tiendra généralement. Les deux sont des tendances que vous orientez, et le tableau complet des paramètres qui les sous-tend est sur la page fiche technique de Wan 3.0.

Quand Wan 3.0 a besoin du raisonnement activé

Si votre prompt pointe vers un document ou une page web, enable_thinking doit valoir true, sans quoi le modèle ne l’ouvre jamais. La requête réussit quand même et est facturée quand même — elle génère simplement à partir de votre texte et ignore la pièce jointe, ce qui ressemble exactement à un mauvais prompt sans en être un.

Il est décrit comme raisonnant sur la composition, la mise en place et le mouvement avant que la première image ne soit calculée, ce qui le rend aussi intéressant à essayer pour une suite d’événements à l’intérieur d’une même action continue. La recommandation d’Alibaba est de le laisser désactivé quand aucun document ni lien n’est joint. C’est documenté de façon cohérente par quatre passerelles d’API indépendantes et cela apparaît dans les exemples de requête d’Alibaba, mais pas encore dans la référence anglaise — traitez-le donc comme fiable plutôt que certain. Lu le 2026-09-02.

Quelle ligne du prompt changer, selon ce qui est revenu

Ce que vous avez obtenuLa couche laissée videLa correction
Le sujet a dérivé dès le troisième tempsSujetRépétez la clause d’apparence à la fin du prompt, en nommant les cheveux, les vêtements et la couleur
La réplique a été racontée, pas jouéeSonCitez-la mot pour mot et attachez-la à une personne à l’écran
Il a coupé vers un angle que vous n’aviez pas demandéMouvementDécrivez une action continue au lieu d’une suite de temps
Votre document ou votre lien n’a rien changéLe raisonnement était désactivé. Rien d’autre dans le prompt ne provoque cela
Rien ne ressemble à votre photo de référenceRéférenceCitez-la comme Image 1 et comptez par type
La facture valait quatre fois ce que vous attendiezLa résolution vaut 1080P par défaut quand elle n’est pas réglée. Brouillonnez en 480P et l’image coûte quatre fois moins
Deux lancements d’un même prompt n’ont aucun rapportLe réécriveur était activé pour les deux. Désactivez-le avant de comparer

Des prompts Wan 3.0 qui ont déjà produit un clip

Lire une règle est plus lent que lire un prompt qui a marché. Chaque entrée de la bibliothèque d’exemples de prompts Wan 3.0 est imprimée en entier à côté du clip qu’elle a produit, découpée selon ces six mêmes couches, avec les leviers que vous pouvez déplacer et les modifications connues pour la casser. Commencez là quand c’est la forme de votre brief qui vous fait douter, et revenez ici quand vous savez quelle couche est fausse.

Ce que coûte un prompt juste

Obtenir un prompt juste demande des tentatives, et l’endroit le moins cher pour les prendre est le 480P, où une seconde coûte le quart de ce qu’elle coûte en 1080P et où le son est identique. Réglez la formulation en 480P, passez en 720P une fois que les temps tiennent, et ne dépensez du 1080P que sur la prise que vous gardez.

Vous pouvez tester un prompt corrigé ici sans carte bancaire : le premier clip est offert — 3 secondes en 480P, avec le son, sur le même wan3.0-video que font tourner tous les forfaits payants. Pas un moteur d’essai et aucun filigrane incrusté. Quand un prompt mérite d’être lancé sur toute la longueur, les forfaits commencent à $12.90 par mois avec facturation annuelle et chacun d’eux atteint les trois résolutions et les trente secondes entières. Lancez le prompt corrigé.

Questions fréquentes

Comment écrit-on un bon prompt Wan 3.0 ?

Nommez six choses : le sujet, le décor, le mouvement, la caméra, le son et toute matière de référence. Le modèle remplit ce que vous laissez de côté, donc une couche non nommée est une couche qu’il décide pour vous. La longueur n’est pas le levier — un prompt de 40 mots avec les six couches nommées bat un prompt de 400 mots auquel il en manque deux.

Pourquoi ma vidéo Wan 3.0 diffère-t-elle du prompt ?

Le plus souvent parce qu’un modèle de langage a réécrit le prompt avant que le modèle vidéo ne le lise. prompt_extend est activé par défaut, et c’est sur les briefs maigres qu’il développe le plus. Écrivez les six couches, ou désactivez le réécriveur, et l’écart entre ce que vous avez tapé et ce que vous avez obtenu se referme.

Faut-il des accolades autour d’un dialogue dans Wan 3.0 ?

Non. Les accolades fonctionnent, et les guillemets doubles utilisés partout dans les exemples d’Alibaba aussi. Ce qui compte, c’est que la réplique apparaisse mot pour mot, qu’elle soit séparée de la description, et qu’elle appartienne à quelqu’un de visible à l’image.

Puis-je demander à Wan 3.0 un nombre précis de plans ?

Vous pouvez demander, et aucun paramètre ne le tient. Ni nombre de plans ni mode réalisateur n’existent dans le schéma : décrire des temps distincts est donc une indication forte plutôt qu’un réglage.

Quelle longueur peut faire un prompt Wan 3.0 ?

Jusqu’à 20 000 caractères, en chinois ou en anglais. Au-delà, il est tronqué en silence plutôt que refusé, ce qu’il vaut mieux savoir si vous collez un brief entier.

Pourquoi Wan 3.0 a-t-il ignoré mon PDF ?

Parce que le raisonnement était désactivé. Un document ou un lien demande que enable_thinking vaille true ; sans cela, la requête tourne quand même, elle est facturée quand même, et la pièce jointe n’est jamais ouverte.

Écrit et maintenu par l’équipe éditoriale de wan-3.runPublié le Mis à jour le