Wan 3.0 提示词生成器 一句进去,阿里巴巴自己的结构出来

用一句话把想法打出来。这个 Wan 3.0 提示词生成器会按阿里巴巴公布的结构把它写全 —— 主体、场景、运动、镜头、风格 —— 并把节拍按你选的长度铺开。免费,不用账号,写多少条都不限。

16:9

要哪种镜头?

什么都不挂,所以整个镜头都是用词搭出来的 —— 画面比例也由你自己挑。

不用账号,写多少条也不限。

从这里起手 , , , , , 或者载入一个做好的例子: , ,

这里的每一条提示词都不要钱 —— 没有计数器、没有账号、没有邮箱,最后也没有卡。只有生成视频才消耗积分,数字在价格页上。

你的提示词

  • description
  • sound
  • music

检查12 条规则,在你复制之前跑完

  • 按阿里巴巴公布的顺序组句
  • 排除项写成句子,不是反向提示词
  • 点了运镜,却既没给幅度也没给速度the camera pushes in

那个灰色骨架就是我们组句的顺序 —— 三段,带参考素材时四段。Wan 3.0 读的是一整段白话,所以这些标签从来不会被写进去。

0 / 20,000 characters

生成需要一个账号,而它上面的第一条片子不要钱:480P,最长三秒,带声音。

承诺

免费,而且是真的免费

我们在 2026 年 8 月核过的其他每一个 Wan 3.0 提示词工具都写着「免费」,而它们说的都比这个词本身窄 —— 每次会话一条,或者每天三条,然后要账号。这一个没有计数器。这个下午写四十条也行,只要镜头需要。

阿里巴巴对 Wan 3.0 是按输出的秒数计量的,不是按输入的字符 —— 一条两万字符的提示词和一条二十个词的提示词,跑起来一样贵。所以请写长的那条。你在这里打的任何东西都不计量,而价格页量的单位是秒。

这里免费,不限次

要消耗积分

  • 生成视频 —— 第一条算我们的:480P,最长三秒,带声音
  • 720P 和 1080P,以及任何超过三秒的
  • 参考画面,它按和输出一样的单价计费

不要邮箱,不要卡,第三条之后也没有「注册才能继续」。就算你在这里从不生成视频,这些提示词工具照样能用。

四种输入形状

一个提示词生成器,四种 Wan 3.0 输入形状

你挂什么,决定提示词得怎么写,所以它排在最前面。Wan 3.0 没有公布任何模式代号 —— 请求的形状随你发的文件种类而变,而提示词必须点名它指的是什么:Image 1、Video 2。

  • 文本

    无媒体
    一个完全用词搭出来的镜头

    整条时间线都是用词搭出来的。

    必须给比例 —— 自适应会被拒

  • 首帧

    first_frame
    一张用作开场那一帧的照片

    你的图片给镜头开场,片子从那里往前发展。

  • 首帧 + 尾帧

    first_frame + last_frame
    两张图片,中间那段路由模型生成

    两张图片,中间那段路是生成出来的。

  • 参考素材

    reference_image / _video / _audio
    用来定义一个主体的参考素材

    素材定义主体;场景是搭来服从它们的。

那两种帧形状多出一行文字提示词没有的东西:一句对齐说明,把每张图片钉在它那个时刻上。它们也会无视你选的比例 —— 图片说了算。而且它们不能和参考素材组合:同时带两者的请求,Wan 3.0 会直接拒绝,而不是替你挑一个。
这一页写的是词。挂东西发生在图生视频参考生视频上,而提示词会跟着结果面板里那个按钮一起过去。

参考模式:多一段,以及能真正绑定的点名

参考模式多出一段,用来说明每份附件是什么。Wan 3.0 没有一套「保持」词汇,也没有单独的汇总 —— 一份附件是在正文里按 Image 1、Video 1 或 Audio 1 点名的,并且只描述一次。编号按类型各自排、按上传顺序排,而且区分大小写:image 1 绑不到任何东西上。点名一份你没上传的,模型就没有东西可指。关于那两族不能混的输入,更多写在参考生视频里。

  1. references
  2. description
  3. sound
  4. music

格式

阿里巴巴公布的那个公式

阿里巴巴自己的文档给出了一条 Wan 3.0 提示词应该遵循的顺序。大多数工具无视它,改去写漂亮句子。这一个照着它来,因为顺序本身就是指令的一部分 —— 而这些东西没有一样会作为标签被写进提示词,因为 Wan 3.0 读的是一整段白话。

  1. 主体主体,描述到能在脑子里成像那么具体。
  2. 场景它在哪儿,什么时辰,背后是什么。
  3. 运动什么在动、动多远、多快 —— 静止也算。
  4. 美学控制景别、运镜、镜头、光。
  5. 风格化一个具名的风格,只在镜头需要时才给。
  6. 声音和画面一起写,不是写在它后面。

为什么顺序就是指令

这五层从「画面里有什么」走到「怎么拍」,正是一个剧组干活的顺序。一条从镜头焦段开场、最后才说到主体的提示词,是把最具体的约束先给模型、最重要的那个最后给。这个生成器每一次都按这个顺序组句,所以你事后要改的是措辞,不是形状。

主体 → 场景 → 运动 → 美学控制 → 风格化

声音是第六样,而且不是可选的

Wan 3.0 把音频和画面在同一次生成里做出来,所以提示词同时也是声音说明。对它一句不说,你照样会拿到一条配乐 —— 一条模型自己挑的。我们组句时依据的划分,是「场景本身发出的声音」对「只有观众听得见的声音」,因为那是一个观众真能听出来的界线。

雨打在布料和沥青上 —— 以及,只给观众的,一段压在底下的稀疏 lo-fi 爵士。

运镜语法

把运镜说出名字,感觉才会来

「有电影感」不是一条运镜指令。阿里巴巴的提示词指南把每一个运镜和它产生的感觉配成对,而这个生成器写的是那句措辞,不是那个形容词。

  • 运动推进
  • 幅度小幅度
  • 速度slowly
  • 推进亲密感,或者渐起的紧张 —— Wan 3.0 上最可靠的运镜。
  • 拉远尺度感,或者孤立感。
  • 跟拍把你放在主体旁边。
  • 环绕宣告这个主体才是重要的那一个。
  • 固定机位静止与专注。
  • 有电影感的运镜里面没有可执行的东西。

「镜头缓慢推进,小幅度」是可执行的。「有电影感的运镜」不是,而且说它还得花字符。当你的意思就是中等和正常时,就把幅度和速度略掉 —— 检查器只会标出那种两样都不给的运镜。

要一个锁死的画面时,请说固定机位:一个你从不提起的镜头,是一个模型可以随便动的镜头。

规则

这个生成器替你处理掉的四条 Wan 3.0 规则

这四条会绊倒任何一个手写 Wan 3.0 提示词的人,而且没有一条是能猜出来的。生成器把四条全自动套用,检查器则会在你粘进来的任何东西里找它们。

  • 这里没有反向提示词字段所以排除项要作为句子写进去 ——「不要音乐」「不要画面上的字」
  • 对白需要确切的词{ } 把这句话标记出来 —— 外面是描述,而一句转述不算台词
  • 参考素材的编号区分大小写Image 1 能绑上;image 1 和 Image_1 绑不到任何东西
  • 长度会改变结构8 秒以内一个动作;超过 15 秒要排好序的节拍,并把结尾点名

一条发现,按检查器自己的写法

「the camera pushes in」—— 幅度和速度都没给。

试试:镜头缓慢推进,小幅度。

在你复制之前,会有十二项检查跑在这条提示词上。除了上面那四条,它们还覆盖那些会静默出事的东西:一条超过两万字符上限的提示词,Wan 3.0 会截断而不是拒绝;一个留在正文里的段落标签,它会当成字画在画面上;一条按另一个模型的格式写的提示词,它会当成散文来读。

往「检查」页签里粘任何东西,都会得到同样的待遇:把不过的那一行引出来,并给出修法。发现一条坏提示词,正常要花掉一次付费生成。在这里不要钱。

长度就是结构

同一个想法,写成三种

一个输入 ——「雨里的一个快递员」—— 三种 Wan 3.0 长度。并排读下来,规律就很明显:长度加的不是形容词,加的是结构。

  • 3 秒

    雨里的一个快递员一个主体、一个动作、一个构图 —— 没有节拍,因为没有地方放一次变化

  • 10 秒

    雨里的一个快递员那个动作,一个贯穿整条片子的运镜,外加点名一层声音铺底

  • 25 秒

    雨里的一个快递员三个排好序的节拍,转场都说清楚,镜头每个节拍换一次,结尾是指定的而不是编出来的

最后那一条,正是长度选择器紧挨着想法框、而不是塞进选项面板的原因。没规划好的最后三分之一,是一条长 Wan 3.0 片子出问题最常见的方式,所以超过十五秒时,不管你有没有要求,生成器都会把收尾那个节拍点名。

一个做好的例子

生成器实际改了什么

结构看起来比说起来容易懂。这就是上面那个 雨巷 按钮背后的例子 —— 一句进去,以及回来的东西。

  1. 一个女人给了年龄、发型和一件大衣。一个你能拿去选角的人,胜过一个名词。
  2. 被雨浇透,在夜里给了一个光源:一块闪烁的红色拉面招牌,湿沥青上的霓虹。雨是天气;这个镜头需要一样能借光的东西。
  3. 然后笑了给了它自己的节拍和自己的构图 —— 一个紧特写,镜头固定。十秒装得下两个镜头,而那一次切换必须说出来。
  4. (声音只字未提)雨打在布料和沥青上,雨水从雨棚滴下,左边一个小吃摊在滋滋作响。Wan 3.0 在同一次生成里做音频,所以静默是一个你不小心做出的决定。
  5. (音乐只字未提)一段稀疏的 lo-fi 爵士从中途进来,压在雨声底下。配乐是唯一一层剧中人听不见的声音。

一句进去

白话,没有结构,没有镜头。这就是全部输入。

A woman waits under a dripping awning in a rain-soaked Tokyo alley at night, then smiles.

回来的是什么

一整段,按公布的顺序,里面任何地方都没有标签。后面跟着两段,写声音和配乐,三段在你复制之前都可以改。

Live-action, cinematic, a medium-wide shot frames a rain-soaked Tokyo alley at night, lit by a flickering red ramen sign and wet neon reflections on the asphalt. A woman in her early 30s, short black bob, oversized grey trench coat, stands under a dripping awning holding a paper umbrella. The camera pushes in slowly, a small move as she watches steam rise from a food cart to her left. Then, a tight close-up on her face. The camera holds a static shot. Raindrops streak the frame edge. She exhales, breath visible, and a faint smile forms as she looks off-camera right.

下一步

把它直接带进生成器

多数提示词工具把一段文字递给你就祝你好运,于是你得在别人的站上去发现这条提示词到底行不行。结果面板里那个按钮,会把它放进这里一个真正的 Wan 3.0 生成器,而且长度和画面比例已经和你写它时的设定对上了。

  1. 01

    写它、改它、核它

    结果面板里的每一段都能改,而检查会随着你打字重新跑。

  2. 02

    按面板里那个按钮

    提示词、长度和比例一起过去,所以什么都不用重打 —— 而模式决定它落在哪一页。

  3. 03

    生成

    这一步需要一个账号,而它上面的第一条片子不要钱:Wan 3.0 本体,480P,最长三秒,带声音。

打开文生视频

或者复制它,粘到别的任何地方去 —— 这条提示词是你的,它是纯文本,没有什么要解锁的。

人们真的会问的问题

Wan 3.0 提示词生成器常见问题

一条 Wan 3.0 提示词必须带上什么、什么会悄悄把它写坏,以及为什么在这里写它不要钱

Wan 3.0 提示词生成器真的免费吗?

是的,不用账号,也没有每日上限 —— 想写、想核、想复制多少条 Wan 3.0 提示词都行。积分只有在生成一条片子时才会花掉,所以一条在这里写好、拿到别处去跑的提示词,一分钱都不要。

用 Wan 3.0 提示词生成器需要账号吗?

不需要。这里没有任何东西设门槛。有一个防自动化滥用的速率限制,但正常使用永远碰不到 —— 就算碰到了,它也只是请你慢一点,而不是告诉你额度用完了。

我的 Wan 3.0 提示词该写多长?

Wan 3.0 接受两万字符,而大多数好提示词用两百。长度不是目标 —— 一条每句话都有活干的提示词,胜过一条自我重复的长提示词。超过上限,Wan 是静默截断而不是拒绝,所以计数器会在撞墙之前先提醒。

Wan 3.0 提示词能用中文写吗?

能。Wan 3.0 两种都读,而且阿里巴巴自己文档里的示例就是中文的。这个生成器默认写英文,而检查器只要求一条提示词的描述部分统一用一种语言 —— 大括号里的台词,角色说什么语言就用什么语言。

对白怎么写?

把确切的词放进大括号里,把谁说的、怎么说的留在外面的散文里。引号对 Wan 3.0 一样能把一句台词标记出来 —— 那是阿里巴巴自己提示词指南里的写法 —— 而这个生成器用大括号,是为了在台词本身已经含引号时边界毫不含糊。一句转述 ——「她说了句安慰的话」—— 换来的是一句模型自己编的台词。

生成器为什么不加反向提示词?

因为 Wan 3.0 没有反向提示词字段。你按那种格式写的任何东西,到模型那儿都是要画出来的字,这正是一条片子最后画面上出现「模糊、低质量」的原因。排除项属于提示词内部的指令,而生成器就是这么写的。

我从另一个工具粘了一条提示词过来,检查全不过。为什么?

很可能它是为另一个模型写的。镜头标记、时间戳和尖括号素材标签是别人的格式;Wan 3.0 读的是白话散文,会把这些标记当字画出来。检查器会点名这个格式,而不是把碎片一条条报给你。

这条提示词在别的视频模型上能用吗?

部分能。主体、场景和镜头语言在多数模型上都通用。而 Wan 3.0 特有的那些 —— 参考素材编号、三十秒的节拍结构、写成句子的排除项 —— 是我们这边的,可能会让别的系统迷糊。

如果我已经有一条想照着做的视频呢?

那就用视频转提示词。它从一条片子反推出一条 Wan 3.0 提示词,一样不要钱,而且你可以把结果带回这里来改。如果你想要的是已经跑通过的提示词,提示词范例库里就摆着它们,旁边是它们产出的片子。

十秒钟写出一条更好的提示词。

一句进去,一条结构完整的 Wan 3.0 提示词出来。不用账号,没有计数器,末尾那个按钮是真能把东西生成出来的。

由 wan-3.run 编辑团队撰写与维护发布于 最后更新 工具 版本 2026.09.4