AI 說明影片
需求單上從來不是寫「做得刺激一點」。是:把這件事講對,用我們的語言,不要誇大,而且要能過那個必須簽字的人那一關。把鏡頭寫出來、把台詞引起來,Wan 3.0 就會把畫面和旁白一起生成。第一支免費 —— 一個 email,不用信用卡。
Wan 3.0 自己公布的四則說明影片案例,每一則都把完整提示詞印在它生成出來的影片旁邊 · 按「試這條」會把提示詞載入
四顆鏡頭 · 要了 120 秒 · 回來 30 秒一支主題說明影片,它的時間軸長了四倍
這裡的 AI 說明影片
是用什麼做出來的
不用上傳腳本,沒有語音庫,沒有時間軸。你一次寫一顆鏡頭,把裡面說的話引起來,影片回來的時候話已經說完了。

一次一顆鏡頭
畫面、演出與旁白一起生成
其他每一個說明影片工具都要你先挑一個虛擬人、貼上腳本,然後等它算完。Wan 3.0 收的是一顆寫出來的鏡頭 —— 畫面上有什麼、鏡頭怎麼動,以及引號裡的那句話 —— 然後在同一次執行裡生成畫面和口說,輸出成一支 MP4。可以用英文、中文、日文或韓文寫。一支完整的影片就是這件事重複做:沒有鏡頭數這個參數,所以一支兩分鐘的說明影片是 12 到 20 次分開的生成,再由你剪在一起。 這個「沒有」是可以查證的,不是抱怨 —— 阿里巴巴的 API 文件 列出了模型收的每一個參數,鏡頭數不在裡面;單一請求的上限是 30 秒。
- 旁白,用引號引起來
- 寫在提示詞裡
- 提示詞與口說台詞
- 4 種語言
- 每顆鏡頭,30 fps
- 2–30 秒
- 一支兩分鐘影片要生成幾次
- 約 12–20
旁白,用引號引起來
提示詞與口說台詞
每顆鏡頭,30 fps
一支兩分鐘影片要生成幾次
- 沒有「腳本一鍵成片」的按鈕 —— 鏡頭是你自己寫、自己剪的
- 沒有虛擬人資料庫 —— 講解者是生成出來的,或者是你自己的參考圖
- 沒有字幕軌 —— 要求畫面上不要出現文字,字幕在你的剪輯軟體裡加
從一份文件開始,或是從分鏡表開始
多數說明影片的內容其實已經存在某個地方 —— 一份簡報、一張規格表,或一個商品頁。你是把那個交出去,還是自己寫鏡頭,決定的是「誰在決定這個故事」。
檔案 · 連結把素材交出去文件或連結一份簡報、一份報告或一個最多五十頁的 PDF,或是一個公開網頁。Wan 3.0 會讀它,然後決定什麼值得放上畫面。快,而且是模型在挑重點 —— 做摘要沒問題,但如果有一條合規要點你非放上畫面不可,那就錯了。
一顆鏡頭,一句台詞自己寫鏡頭這一頁一顆鏡頭一次生成,每一顆有自己的影格、自己的動作、自己引起來的台詞。慢,但每一條會出現的訴求都由你決定。 這裡做認證與安全影片的帳號,走的就是這條路。
把一支企業 說明影片 弄沉的六件事
這些不是美感問題。每一件都是一支做完的片子被退回去、再跑一輪核准流程的原因。
它必須提出警告,但不能把傷害演出來
一支安全影片不能演那場意外,而「不要出現 X」是一個很弱的指令 —— 點名一樣東西,等於把它放進模型的腦子裡
描述那個測試,不要描述那場失敗:治具、量表、手、撐住的載重。寫畫面裡有什麼,不要寫什麼被禁止
提示詞結構它聽起來像一支廣告
每一個影片模型的預設語氣都是明亮、溫暖、向上的,因為它的素材多數是那樣
把語氣和畫面並列成一條限制:「紀錄片風格、霧面質感、低飽和色調、不要配樂、克制的口白」。語氣和其他任何一個提示詞欄位一樣
提示詞結構認證標章或商標長得不對
標章小、對比高、而且在法律上必須精確 —— 這三件事正好是生成最不擅長的
用外觀條款把它守住,那一顆鏡頭讓鏡位不要動,如果它必須逐畫素正確,事後把真的標章合成上去。認證標章是註冊商標,有公布的使用規則 —— 日本的 SG 標章 就是一個現成例子 —— 所以一個生成出來的近似品,和你被授權可以使用的那枚標章是兩個不同的東西,不管那一格看起來多像
發布前先把那一格看清楚成品比你寫的時間軸還短
分鏡表只有在它的秒數加起來是模型算得出來的長度時才會被遵守。超過 30 秒,時間軸不會被拒絕 —— 它會被靜靜地壓縮,而每一個節拍拿到的時間都比你給的少
把分鏡表最後一個數字寫成 30 或更小,並且在第一行就把總長講出來。這一頁上面四則全是 Wan 自己的案例,而且剛好二比二:要了 120 秒和 150 秒的那兩則,分別以 30.0 秒和 25.0 秒回來,四顆和五顆鏡頭被壓進去;而一開頭就宣告 30 秒的那兩則 —— 其中一則開頭就寫「This video contains 6 shots, with a total duration of 30.0 seconds」—— 以 30.0 秒和 30.1 秒回來,節拍完整。把它們對著旁邊印出來的提示詞播一次;算術就在這一頁上
提示詞結構第七顆鏡頭跟第二顆對不上
沒有鏡頭數參數,兩次生成之間也沒有記憶。一支片子是一堆從來沒見過面的請求
把色調、鏡頭和光線固定成一段風格區塊,貼進每一段提示詞裡,而且每次都送同一組參考圖。參考圖生影片
旁白的語感對不上那個語言
一句從英文翻過來的台詞會留著英文的節奏,而日文或韓文的審稿人一聽就聽得出來
直接用目標語言寫口說台詞,只把外觀條款留成英文。這裡做非英語品牌案子的帳號,用的就是這個組合
整個失敗掉的執行會自動退點數。上面這六種都不算失敗 —— 每一種都是完整跑完但不能用,而這些是要收費的。每一顆鏡頭都先用 480P 打草稿,直到語氣和限制都守得住,再把留下來的重跑一次。
一支兩分鐘的 說明影片 真正的成本
在你答應交期之前先把算術做完。一支兩分鐘的片子大約是 12 到 20 顆鏡頭,每一顆要三到四次生成才對 —— 所以要抓四十到八十次,不是二十次。先用 480P 打草稿,一次嘗試只要成品的四分之一,然後只把進到成片的那幾顆重跑。失敗的執行自動退點數,旁白不另外收費,而且所有付費方案都含商用授權。
這裡怎麼計費
- 計費單位
- 輸出的每一秒
- 旁白
- no extra cost
- 文件或連結
- no surcharge
- 你的第一支
- 免費 · 480P
整支片子先用 480P 跑一遍,那是一份你真的看得下去的分鏡,而且只要成品的四分之一。完整價格。
兩種繳法,每月點數一樣
怎麼一顆鏡頭一顆鏡頭做出 AI 說明影片
四個步驟,每一顆鏡頭重複一次。第一步是寫在文件裡的,不是寫在這個產生器裡 —— 而跳過它,正是多數人做到第四顆鏡頭就卡住的原因。
生成任何東西之前,先寫分鏡表
一顆鏡頭一行:畫面上有什麼、說了什麼、多長。兩分鐘的片子就是十二行。這是工具沒辦法幫你做的部分,也正是讓後面變便宜的那個部分。
先做這個固定一段風格區塊,然後一字不改地重複用
色調、鏡頭、光線、表面質感、語氣,以及「畫面上不要有文字」。把一模一樣的那段貼進每一段提示詞 —— 它是唯一把二十次獨立生成綁在一起的東西。
複製進每一段提示詞生成一顆鏡頭,把它的台詞放進引號裡
旁白是和畫面一起產出的,所以沒有東西要錄,也沒有東西要對時間軸。台詞直接用它會被聽到的那個語言寫。
聲音在同一次執行裡整支片先用 480P 打草稿,再重跑留下來的
把草稿剪在一起,從頭到尾看完,再決定要不要為解析度花錢。多數改動是結構性的,而一份 480P 的分鏡用四分之一的價錢就能把它們找出來。
最高 1080P
這裡做企業影片得出的三分之二法則:示範本身就是那支片子。開場和收尾生成起來便宜、剪起來也便宜 —— 真正換到核准的,是那幾顆把事情實際做一次給你看的鏡頭。
AI 說明影片 問答
它會不會幫你寫腳本、聲音怎麼來、一支片子真正要多久,以及你能發布什麼
它會自動把一份腳本變成一支做好的說明影片嗎?
旁白是從哪來的?
旁白可以講日文、中文或韓文嗎?
我要怎麼讓它不要看起來像廣告?
我要怎麼讓二十顆鏡頭看起來像同一支片子?
它能提出警告而不演出那場意外嗎?
一支兩分鐘的說明影片要花多少點數?
我可以把它發在公司網站上嗎?
我必須揭露這支說明影片是用 AI 做的嗎?
寫一顆鏡頭。九十秒後聽到它。
在你編一整支片子的預算之前,先生成它最難的那一顆 —— 帶著標章、帶著限制、帶著那句非對不可的台詞。第一支免費,480P,一個 email,不用信用卡。如果語氣不對,你今天就會知道,而不是在審片會上才知道。
由 wan-3.run 編輯團隊撰寫與維護發布於 最後更新 工具 版本 2026.09.4
