Wan 3.0 提示词生成器
一句进去,阿里巴巴自己的结构出来
用一句话把想法打出来。这个 Wan 3.0 提示词生成器会按阿里巴巴公布的结构把它写全 —— 主体、场景、运动、镜头、风格 —— 并把节拍按你选的长度铺开。免费,不用账号,写多少条都不限。
你的提示词
descriptionsoundmusic
检查12 条规则,在你复制之前跑完
- 按阿里巴巴公布的顺序组句
- 排除项写成句子,不是反向提示词
- 点了运镜,却既没给幅度也没给速度
the camera pushes in
那个灰色骨架就是我们组句的顺序 —— 三段,带参考素材时四段。Wan 3.0 读的是一整段白话,所以这些标签从来不会被写进去。
0 / 20,000 characters
生成需要一个账号,而它上面的第一条片子不要钱:480P,最长三秒,带声音。
免费,而且是真的免费
我们在 2026 年 8 月核过的其他每一个 Wan 3.0 提示词工具都写着「免费」,而它们说的都比这个词本身窄 —— 每次会话一条,或者每天三条,然后要账号。这一个没有计数器。这个下午写四十条也行,只要镜头需要。
阿里巴巴对 Wan 3.0 是按输出的秒数计量的,不是按输入的字符 —— 一条两万字符的提示词和一条二十个词的提示词,跑起来一样贵。所以请写长的那条。你在这里打的任何东西都不计量,而价格页量的单位是秒。
这里免费,不限次
- 写和改 Wan 3.0 提示词,想写多少写多少
- 核一条别人写的提示词
- 提示词范例库 —— 做好的提示词,就摆在它们做出的片子旁边
- 把一条视频反推成提示词
- 上传之前先检查一张图片
要消耗积分
- 生成视频 —— 第一条算我们的:480P,最长三秒,带声音
- 720P 和 1080P,以及任何超过三秒的
- 参考画面,它按和输出一样的单价计费
不要邮箱,不要卡,第三条之后也没有「注册才能继续」。就算你在这里从不生成视频,这些提示词工具照样能用。
一个提示词生成器,四种 Wan 3.0 输入形状
你挂什么,决定提示词得怎么写,所以它排在最前面。Wan 3.0 没有公布任何模式代号 —— 请求的形状随你发的文件种类而变,而提示词必须点名它指的是什么:Image 1、Video 2。
文本
无媒体
整条时间线都是用词搭出来的。
必须给比例 —— 自适应会被拒
首帧
first_frame
你的图片给镜头开场,片子从那里往前发展。
首帧 + 尾帧
first_frame + last_frame
两张图片,中间那段路是生成出来的。
参考素材
reference_image / _video / _audio
素材定义主体;场景是搭来服从它们的。
那两种帧形状多出一行文字提示词没有的东西:一句对齐说明,把每张图片钉在它那个时刻上。它们也会无视你选的比例 —— 图片说了算。而且它们不能和参考素材组合:同时带两者的请求,Wan 3.0 会直接拒绝,而不是替你挑一个。
这一页写的是词。挂东西发生在图生视频和参考生视频上,而提示词会跟着结果面板里那个按钮一起过去。
参考模式:多一段,以及能真正绑定的点名
参考模式多出一段,用来说明每份附件是什么。Wan 3.0 没有一套「保持」词汇,也没有单独的汇总 —— 一份附件是在正文里按 Image 1、Video 1 或 Audio 1 点名的,并且只描述一次。编号按类型各自排、按上传顺序排,而且区分大小写:image 1 绑不到任何东西上。点名一份你没上传的,模型就没有东西可指。关于那两族不能混的输入,更多写在参考生视频里。
阿里巴巴公布的那个公式
阿里巴巴自己的文档给出了一条 Wan 3.0 提示词应该遵循的顺序。大多数工具无视它,改去写漂亮句子。这一个照着它来,因为顺序本身就是指令的一部分 —— 而这些东西没有一样会作为标签被写进提示词,因为 Wan 3.0 读的是一整段白话。
主体主体,描述到能在脑子里成像那么具体。场景它在哪儿,什么时辰,背后是什么。运动什么在动、动多远、多快 —— 静止也算。美学控制景别、运镜、镜头、光。风格化一个具名的风格,只在镜头需要时才给。声音和画面一起写,不是写在它后面。
为什么顺序就是指令
这五层从「画面里有什么」走到「怎么拍」,正是一个剧组干活的顺序。一条从镜头焦段开场、最后才说到主体的提示词,是把最具体的约束先给模型、最重要的那个最后给。这个生成器每一次都按这个顺序组句,所以你事后要改的是措辞,不是形状。
主体 → 场景 → 运动 → 美学控制 → 风格化
声音是第六样,而且不是可选的
Wan 3.0 把音频和画面在同一次生成里做出来,所以提示词同时也是声音说明。对它一句不说,你照样会拿到一条配乐 —— 一条模型自己挑的。我们组句时依据的划分,是「场景本身发出的声音」对「只有观众听得见的声音」,因为那是一个观众真能听出来的界线。
雨打在布料和沥青上 —— 以及,只给观众的,一段压在底下的稀疏 lo-fi 爵士。
把运镜说出名字,感觉才会来
「有电影感」不是一条运镜指令。阿里巴巴的提示词指南把每一个运镜和它产生的感觉配成对,而这个生成器写的是那句措辞,不是那个形容词。
- 运动推进
- 幅度小幅度
- 速度slowly
推进亲密感,或者渐起的紧张 —— Wan 3.0 上最可靠的运镜。拉远尺度感,或者孤立感。跟拍把你放在主体旁边。环绕宣告这个主体才是重要的那一个。固定机位静止与专注。有电影感的运镜里面没有可执行的东西。
「镜头缓慢推进,小幅度」是可执行的。「有电影感的运镜」不是,而且说它还得花字符。当你的意思就是中等和正常时,就把幅度和速度略掉 —— 检查器只会标出那种两样都不给的运镜。
要一个锁死的画面时,请说固定机位:一个你从不提起的镜头,是一个模型可以随便动的镜头。
这个生成器替你处理掉的四条 Wan 3.0 规则
这四条会绊倒任何一个手写 Wan 3.0 提示词的人,而且没有一条是能猜出来的。生成器把四条全自动套用,检查器则会在你粘进来的任何东西里找它们。
- 这里没有反向提示词字段所以排除项要作为句子写进去 ——「不要音乐」「不要画面上的字」
- 对白需要确切的词{ } 把这句话标记出来 —— 外面是描述,而一句转述不算台词
- 参考素材的编号区分大小写Image 1 能绑上;image 1 和 Image_1 绑不到任何东西
- 长度会改变结构8 秒以内一个动作;超过 15 秒要排好序的节拍,并把结尾点名
一条发现,按检查器自己的写法
「the camera pushes in」—— 幅度和速度都没给。
试试:镜头缓慢推进,小幅度。
在你复制之前,会有十二项检查跑在这条提示词上。除了上面那四条,它们还覆盖那些会静默出事的东西:一条超过两万字符上限的提示词,Wan 3.0 会截断而不是拒绝;一个留在正文里的段落标签,它会当成字画在画面上;一条按另一个模型的格式写的提示词,它会当成散文来读。
往「检查」页签里粘任何东西,都会得到同样的待遇:把不过的那一行引出来,并给出修法。发现一条坏提示词,正常要花掉一次付费生成。在这里不要钱。
同一个想法,写成三种
一个输入 ——「雨里的一个快递员」—— 三种 Wan 3.0 长度。并排读下来,规律就很明显:长度加的不是形容词,加的是结构。
3 秒
雨里的一个快递员一个主体、一个动作、一个构图 —— 没有节拍,因为没有地方放一次变化
10 秒
雨里的一个快递员那个动作,一个贯穿整条片子的运镜,外加点名一层声音铺底
25 秒
雨里的一个快递员三个排好序的节拍,转场都说清楚,镜头每个节拍换一次,结尾是指定的而不是编出来的
最后那一条,正是长度选择器紧挨着想法框、而不是塞进选项面板的原因。没规划好的最后三分之一,是一条长 Wan 3.0 片子出问题最常见的方式,所以超过十五秒时,不管你有没有要求,生成器都会把收尾那个节拍点名。
生成器实际改了什么
结构看起来比说起来容易懂。这就是上面那个 雨巷 按钮背后的例子 —— 一句进去,以及回来的东西。
一个女人给了年龄、发型和一件大衣。一个你能拿去选角的人,胜过一个名词。被雨浇透,在夜里给了一个光源:一块闪烁的红色拉面招牌,湿沥青上的霓虹。雨是天气;这个镜头需要一样能借光的东西。然后笑了给了它自己的节拍和自己的构图 —— 一个紧特写,镜头固定。十秒装得下两个镜头,而那一次切换必须说出来。(声音只字未提)雨打在布料和沥青上,雨水从雨棚滴下,左边一个小吃摊在滋滋作响。Wan 3.0 在同一次生成里做音频,所以静默是一个你不小心做出的决定。(音乐只字未提)一段稀疏的 lo-fi 爵士从中途进来,压在雨声底下。配乐是唯一一层剧中人听不见的声音。
一句进去
白话,没有结构,没有镜头。这就是全部输入。
A woman waits under a dripping awning in a rain-soaked Tokyo alley at night, then smiles.
回来的是什么
一整段,按公布的顺序,里面任何地方都没有标签。后面跟着两段,写声音和配乐,三段在你复制之前都可以改。
Live-action, cinematic, a medium-wide shot frames a rain-soaked Tokyo alley at night, lit by a flickering red ramen sign and wet neon reflections on the asphalt. A woman in her early 30s, short black bob, oversized grey trench coat, stands under a dripping awning holding a paper umbrella. The camera pushes in slowly, a small move as she watches steam rise from a food cart to her left. Then, a tight close-up on her face. The camera holds a static shot. Raindrops streak the frame edge. She exhales, breath visible, and a faint smile forms as she looks off-camera right.
把它直接带进生成器
多数提示词工具把一段文字递给你就祝你好运,于是你得在别人的站上去发现这条提示词到底行不行。结果面板里那个按钮,会把它放进这里一个真正的 Wan 3.0 生成器,而且长度和画面比例已经和你写它时的设定对上了。
01
写它、改它、核它
结果面板里的每一段都能改,而检查会随着你打字重新跑。
02
按面板里那个按钮
提示词、长度和比例一起过去,所以什么都不用重打 —— 而模式决定它落在哪一页。
03
生成
这一步需要一个账号,而它上面的第一条片子不要钱:Wan 3.0 本体,480P,最长三秒,带声音。
或者复制它,粘到别的任何地方去 —— 这条提示词是你的,它是纯文本,没有什么要解锁的。
Wan 3.0 提示词生成器常见问题
一条 Wan 3.0 提示词必须带上什么、什么会悄悄把它写坏,以及为什么在这里写它不要钱
Wan 3.0 提示词生成器真的免费吗?
用 Wan 3.0 提示词生成器需要账号吗?
我的 Wan 3.0 提示词该写多长?
Wan 3.0 提示词能用中文写吗?
对白怎么写?
生成器为什么不加反向提示词?
我从另一个工具粘了一条提示词过来,检查全不过。为什么?
这条提示词在别的视频模型上能用吗?
如果我已经有一条想照着做的视频呢?
由 wan-3.run 编辑团队撰写与维护发布于 最后更新 工具 版本 2026.09.4