Wan 3.0 影片剪輯
上傳一支片子,把要改的地方描述出來。Wan 3.0 影片剪輯會改寫主體、背景、光線或台詞,而你本來就喜歡的那些運動和構圖,會原封不動留在原地。
三個真實的鏡頭,接著是站上其他所有點子 · 按「試試這個」會把來源片和提示詞一起載進來
[影片剪輯] · 9:16 · 7 秒街頭行走
Wan 3.0 影片剪輯會改掉什麼,
又會放過什麼
你既有的畫面,加上一句指示。回來的東西是你指名的那樣東西被改了,其餘的沒有。
Wan 3.0 影片剪輯可以換掉一個主體、把場景搬走、重新調光、改寫一句台詞、拿掉一個東西,或者把故事從它停下來的地方接下去。動作、構圖和時間感之所以延續下來,是因為你的指示要求了它們,不是因為那些像素被保留了 — 一次剪輯是一次被告知要尊重什麼的重新生成。
- 來源片
- ≤ 15 秒
- 輸入+輸出,共用
- 30 秒
- 輸出,30 fps
- 2–30 秒
- 解析度
- 480P / 720P / 1080P
來源片
輸入+輸出,共用
輸出,30 fps
解析度
- 不是時間軸剪輯軟體
- 不是遮罩工具 — 你是把改動描述出來,不是畫一個選取範圍
- 你的檔案一個都不會被改;輸出是一個新的
Wan 3.0 保得住什麼,
以及一次從頭到尾的剪輯
一次剪輯值不值得做,取決於你沒有提到的那些部分活不活得下來。它抓得住的東西,是你的指示釘住的東西 — 而它會飄掉的東西,是沒有人指名過的那些細節。
你的片子
你的片子 · 7 秒出來的東西
[影片剪輯] · 9:16 · 7 秒heldframingwardrobetiming
movedgradesurfaces
被你的指示釘住,所以抓得住:運鏡與構圖、整體節奏與剪接點、主體走位與畫面位置、環境音底。從來沒有被指名,所以會飄:背景的細部、畫面邊緣的小道具、確切的顆粒與壓縮質地、從來沒有被描述過的零星聲音。
這裡有一個人為這條規則付了一次錢。 一支十二秒的 720P 片子 — 一個穿紅外套的男人走在一條濕漉漉的街上,鏡頭在他旁邊跟移,音軌上有雨聲。要求是灰色外套加破曉光線。第一次嘗試,「把外套改成灰色,時間設在破曉」,回來的是一件灰外套和破曉光線 — 外加不一樣的走路、不一樣的街、沒有雨。那句指示從來沒有說要留住它們。第二次嘗試把它們指名了:同一個男人、同樣的走路節奏、同樣的跟移鏡頭、同一條街、同樣的雨。對了。第二段提示詞並沒有比第一段更有創意;它只是在「什麼絕不能動」那一半上寫得比較長。 十二秒進、十二秒出,是三十秒上限裡的二十四秒,也是二十四秒的計費。
有一件事我們不會宣稱:有些網站描述一種區域鎖定的剪輯,說改動範圍以外的每一個像素都是位元組等同。那不在阿里巴巴的文件裡,而提出那個說法的網站,同時也在宣傳一個不存在的 4K 輸出。把這件事當成一次很好的、會尊重你指示的重新生成,不要當成一次遮罩合成。要把好幾份素材合進一個從來不存在的場景,那是另一件事 — 那是參考圖生影片。
六種剪輯,
配上真的有用的寫法
這六種每一種都是同一個形狀:先指名什麼要改,再指名什麼絕不能改。一句只說了要改什麼的指示,等於邀請 Wan 3.0 順手把其他東西也整理一下,而那就是一次單純的替換為什麼會連髮型一起換掉回來。
換掉主體
「把那個穿紅外套的男人換成一個穿灰大衣的女人。走路、節奏和街道維持不變。」最常見的剪輯,也是飄得最厲害的一種,因為一個新的主體等於給了模型一張把他們周圍的一切重新調度的許可證。
- 把這些說成一定要留
- 走路、節奏、街道
- 要求這些
- 畫面上是誰
換一個環境
「把這個從辦公室搬到黃昏的頂樓。主體、構圖和運鏡完全維持原樣。」把構圖和鏡頭指名出來,就是讓一個新的場景不會連一個新的鏡頭一起送到的原因。
- 把這些說成一定要留
- 主體、構圖、鏡頭
- 要求這些
- 事情發生在哪裡
換視覺風格
「重新調光成冷色、高反差的樣子。不要改動作,也不要改剪接點。」只描述新的樣子。你多提到的任何東西,都會變成可以被改的。
- 把這些說成一定要留
- 動作、剪接點
- 要求這些
- 調光、光線、質地
改寫台詞
「把說出來的台詞改成 {We should go}。同一個說話者、同樣的時間點、結尾同樣的嘴型。」台詞要寫得夠短,短到裝得進你要求的那個秒數,不然嘴型對不上。
- 把這些說成一定要留
- 說話者、時間點、構圖
- 要求這些
- 那句台詞、對嘴
拿掉某樣東西
「把桌上那個咖啡杯拿掉。畫面裡其他所有東西都別動。」Wan 3.0 收得下的最短指示,也是最需要它後半句的那一種。
- 把這些說成一定要留
- 畫面裡其他所有東西
- 要求這些
- 一個物件,不見了
把故事延長
「再接八秒:她轉身,從畫面左邊走出去,門在她身後關上。」六種裡常常最有用的一種。一支你已經喜歡的十秒片子,不用重新生成你已經付過錢的那十秒就變成三十秒 — 它接的是運動、光線和聲音,而不是切到某個新的東西。Wan 3.0 也可以往回接,或者兩頭同時接。要更長就延長兩次,但只要把尾巴餵回去:整支來源片都要算進上限,而三十秒進去就沒有東西剩下來給它生成了。
- 把這些說成一定要留
- 主體、場景、風格
- 要求這些
- 接下來發生什麼
台詞放在大括號裡,Wan 3.0 才會把那幾個確切的字和它周圍的指示分開 — 跟文字轉影片是同一個慣例。
三十秒是一個共用額度,
而你的輸入也要計費
這是那條每個人都會踩一次的 Wan 3.0 規則。你的輸入片和它的輸出算在同一個三十秒上限裡:input seconds + output seconds ≤ 30。
⚠️ 你的來源片按它自己的長度計費,疊在輸出上面。 十四秒的來源配十六秒的結果,是三十秒計費,不是十六秒。上傳之前先把輸入修短,是一次 Wan 3.0 剪輯能省下的最大一筆 — 而一次失敗的剪輯會自動退款,所以一次跑壞只花掉你等待的時間。
上傳十四秒,Wan 3.0 回得了的最長剪輯就是十六秒。上傳二十八秒,你剩下兩秒。要求超過剩下的那些,請求會在任何東西生成之前就被拒 — 所以上面那條長條會在你的片子一載入的那一刻更新,而輸出滑桿會跟著縮短,這也就是按鈕上那個數字永遠是 Wan 3.0 收得下的長度的原因。
還有一條規則值得在踩到它之前先知道。 你的來源片是一個參考輸入,這讓一次剪輯落在參考族裡;首影格和末影格是另外一族,而同時含有兩者的請求會直接被拒。如果你要把一支全新片子的開頭那一張圖釘死,那是圖片轉影片。完整的費率在價格上。
你片子的配樂會跟著一起來
上傳一支片子,它的聲音就跟著一起來,不管你有沒有這個意思。
這就是為什麼一個你從來沒有描述過的聲音會出現在結果裡,而且它會把性別和口音一起帶著走。一段錄自女性的笑聲,貼在一張男性的臉上,聽起來還是女性的笑聲。在說畫面會怎麼樣的同一句指示裡,把聲音會怎麼樣也說了。
整條留著
把環境音底指名出來,它就活得下來:「音軌上的雨聲留著」。
留住聲音留在新台詞底下
把新台詞放進大括號,那層音底就會留在它下面:「{We should go},同一個說話者,同樣的時間點」。
改寫台詞換掉它
把你要的聲音描述出來。你沒有提到的任何東西,就是最可能飄掉的那部分。
新的聲音
Wan 3.0 影片剪輯不見得是比較便宜的那個選項。 有四種情況別的東西會贏:一支已經接近三十秒的來源片留不下輸出額度,所以要嘛生成短一點、要嘛先修短;一個完全不同的場景意味著你要為一段完全撐不過這次剪輯的畫面付輸入秒數,那就用文字轉影片;要一張確切的開頭影格是圖片轉影片;而要同一個角色跨好幾個全新鏡頭是參考圖生影片。剪輯值回它的成本,是在來源片裡的運動、表演或構圖真的值得留下來的時候。
在你上傳別人的畫面之前
改寫一句台詞,會讓畫面上一個真實的人說出他沒有說過的話。那是本站風險最高的一個控制項。
- 肖像讓一個真實的人說出他從來沒有說過的話,可能是違法的,而且在沒有取得他同意的情況下,這違反我們的條款。
- 聲音一段音色參考會複製一個特定的人聽起來是什麼樣子。請用你自己的、有授權的,或者合成的。
- 著作權上傳你不擁有的畫面或音樂,不會把任何權利轉移到產出上。請去查那份來源的授權。
- 內容審核送上來的媒體會自動篩檢;誤判和漏判都會發生。
- 揭露請遵守你發布的那個平台的標示規定。
Wan 3.0 影片剪輯的問題
Wan 3.0 影片剪輯改得了一支片子裡的什麼,以及為什麼來源片要和結果一起計費
我要註冊才能剪一支片子嗎?
Wan 3.0 剪得了我自己拍的影片嗎?
我的來源片最長能多久?
它會改到我的原始檔案嗎?
它會改到我沒有提到的部分嗎?
我可以改一個人說的話嗎?
一次剪輯比從頭生成便宜嗎?
我可以把一支片子延長不只一次嗎?
我的剪輯為什麼還沒開始就被拒了?
這跟影片轉影片的風格轉換是同一件事嗎,而且我可以把結果拿去商用嗎?
/video-to-video,現在轉址到這裡。關於權利:每一個付費方案和每一包點數都含商用授權,剪輯也包含在內 — 拿去發布、拿去賣、拿去跟客戶請款都可以。免費額度的剪輯供評估之用,而阿里巴巴自己對 Wan 3.0 AI 模型的使用政策適用於每一個請求。確切的措辭在我們的條款裡。這是一份摘要,不是法律意見。把一支你已經有的片子帶過來
上傳它,說什麼要改、什麼絕不能改,然後讓 Wan 3.0 把你要的那個版本交回來。剪輯要用點數 — 來源秒數和輸出秒數一起計費,而失敗的生成會自動退款。
由 wan-3.run 編輯團隊撰寫與維護發布於 最後更新 工具 版本 2026.09.4
