Wan 3.0 對嘴影片

丟一張臉進來,把那句話引起來,嘴就會跟著字走。Wan 3.0 對嘴在跟畫面同一次生成裡把聲音做出來,所以前面不用先錄一個音檔,後面也不用再配一次音。二到三十秒,聲音就在 MP4 裡面,而你的第一支片子不用錢。

說話的人

產生一張圖

JPG · PNG · BMP · WEBP · ≤20MB · 240–8000px · 比例 ≤8:1

0 / 20000

說話的人從頭到尾維持同樣的臉、頭髮、衣著和顏色;只有鏡頭和被描述的動作會變。

Model
Aspect ratio
Duration
Resolution
免費註冊 · 送一支 Wan 3.0 片子

免費那支就是同一個 Wan 3.0,聲音也有,上限是 480P · 3s,走的是共用佇列。方案能把上限抬高到 1080P 和三十秒 —— 免費檔是一個解析度,不是另一個模型。

在真模型上 1 支不用錢 · 一個電子郵件,不用卡 · 把聲音打開,和不打開一樣貴

阿里巴巴自己的 Wan 3.0 對白展示片 · 按「試試這個」會把提示詞載進來

一個女人在廚房檯面前拿著一台粉紅色隨行果汁機,直接對著鏡頭說話對鏡頭說話 · 9:16 · 720P

一段對鏡頭的口播,六句話長

回來的是什麼

提示詞裡有一句台詞的時候,Wan 3.0 會做什麼

這裡每一支片子都是阿里巴巴為 Wan 3.0 公布的展示片,而每一支都附著產生它的那段提示詞。按聽聽看聽聲音,或者按用這段提示詞把整段載進這一頁最上面那個框裡 — 全文照印,用它原本寫成的那個語言。

  • 1 次生成畫面、語音和嘴部動作在同一次生成裡
  • $0音軌要另外加的錢
  • wan3.0-video這一整條帶子上每一支片子背後的模型
  • 一個女人在廚房檯面前拿著一台粉紅色隨行果汁機,直接對著鏡頭說話參考
    六句對鏡頭的台詞,產品靠一張參考圖穩住
  • 一位歌手站在夜間頂樓舞台的正中央,後面有一位 DJ,再過去是城市天際線參考
    一位歌手在語言之間切換,八種都對得上
  • 一個穿著長灰大衣、戴著護目鏡的男人站在陽光灑落的木造道場裡參考
    兩個說話的人,日文,一人一句而且不會搶話
  • 一隻薑黃色的貓和一隻黃金獵犬戴著耳機坐在播客麥克風前,頭上是 ModelTalk 的霓虹招牌首影格
    一張兩隻動物的靜態圖變成十輪對話

一句台詞要怎樣才站得住

  • 那些字

    確切的那句話引起來。一個轉述換到的是模型自己編的一句話。

  • 說話的人

    誰在說話釘死 — 年紀、頭髮、衣著 — 不然動的會是錯的那張嘴。

  • 鏡頭

    在整句話的長度裡,讓鏡頭留在那張臉上

  • 文字

    不要字幕收尾,不然那句話可能會印在畫面上到達。

從一段文字提示詞開始

簡單的文字提示詞生出 AI 對嘴影片

沒有腳本格式,沒有時間軸,沒有語音檔。用平常的句子把鏡頭描述出來,把角色說的那些字引起來並指名是鏡頭前的那個人說的,Wan 3.0 就會在單一一個請求裡把畫面算出來、把聲音合成出來,並讓嘴跟著它動。

一段提示詞,一句台詞

中景主鏡。那個女人站在廚房檯面後面
拿著那台粉紅色隨行果汁機,自然地對著鏡頭說話。
她說:「常有人問我怎麼可以這麼快就打好一杯果昔。」
不要字幕、不要文字覆蓋、不要介面元素、不要浮水印。

  • 鏡頭、運鏡,以及誰在說話
  • 被引起來的那句話,以及什麼不要印出來
2484 / 20,000

一次生成出來

一個女人在廚房檯面前拿著一台粉紅色隨行果汁機,直接對著鏡頭說話9:16 · 720P · 30 秒

wan3.0-video · 16:9 · 720P · 14 秒 · 語音和嘴型在同一次生成裡

那四行是從阿里巴巴自己那支三十秒展示片裡摘出來的,而那段提示詞寫了 2,484 個字元,上限是 20,000。多出來的空間是拿來釘死說話的人、產品和那些排除項的 — 不是拿來寫更多。改成上傳一張人像而不是描述一張,並不會改變那句台詞本身怎麼寫。

在你花掉一點之前

把你的對嘴影片提示詞 用 AI改好

一次跑回來是錯的,幾乎從來不是模型的問題。是一段只指名了畫面、卻把表達方式、鏡頭和字幕規則交給運氣的提示詞。

提示詞產生器會拿你要說的那句話,繞著它回給你一整段 Wan 3.0 提示詞 — 說話的人釘死了、指名了一個運鏡、聲音層次排好了順序,而且那句話被界定起來,所以它會被演出來而不是被旁白唸。它會拿這個模型真正會執行的那些規則去核對結果,所以大家會忘的那一句,是在點數花掉之前補上去的,不是之後。

  1. 01

    打出你需要被說出來的那句話

    一句話就夠開始了。誰說的、在哪裡,可以只是一個片段。

  2. 02

    拿到一段繞著它蓋起來的提示詞

    說話的人、鏡頭、聲音層次和被界定起來的那句話,照 Wan 3.0 讀它們的順序排。

  3. 03

    把它送到這裡,再加上那張臉

    提示詞會到達這一頁最上面那個框裡,長度和比例都已經設好。

打開提示詞產生器

已經有一支你喜歡它表達方式的片子?影片轉提示詞會把那句台詞抄下來,用大括號包著還給你 — 那正是這個模型會演出來、而不是旁白唸的那個形式。

從頭到尾

一整套 AI 流程,從腳本到影片

同一個端點,四道門。不管你手上拿的是什麼 — 一段腳本、一份簡報、一張人像,或者一支你已經算好的片子 — 都有一條路通到一支說話的片子,而且沒有一條需要外掛另一個語音工具。

  • 一個年輕男子和一位年長女性在熱鬧的城市廣場一張桌子上下棋

    腳本 → 提示詞

    把那句話交出去,換回一整段繞著它蓋起來的鏡頭描述,說話的人已經釘死,那句話也已經歸給他了。

    不用錢 · 不用點數
  • 一台長途貨櫃車在空曠的公路上展開成一台行走機器

    簡報或網頁 → 腳本

    一個 PDF 或一個公開網址,會變成這個鏡頭蓋起來所依據的那個故事,而不是投影片配一個虛擬人在唸。

    50 頁 · 100 MB
  • 兩個穿西裝的男人在一間貼磁磚的辦公室洗手間裡,其中一個正說到一半

    人像+台詞 → 一支說話的片子

    那張臉當第一個影格進去,那句話引起來並歸給他,然後嘴就跟著它走。

    2–30 秒 · 最高 1080P
  • 同一位紅髮女子被穩住跨過一個遠景、一部電梯內部和一個購物中庭的特寫

    新台詞,同一個鏡頭

    不用重拍就改掉一支既有片子說的話:說話的人、時間點和構圖都留在原地,只有嘴部動作被重新生成。

    你已經有的畫面

上面全部都落在同一個地方 — 我的作品會替每一次生成留著 MP4、提示詞和任務 id,所以一個你喜歡的鏡頭可以重新打開,而不用重新拼回來。

整套流程

怎麼用 Wan 3.0 讓一張照片對嘴

大家做錯的是第三步:去描述模型本來就看得到的那張畫面,而不是寫下它猜不到的那些字。

  1. 把那張臉丟進來

    檢查會立刻在你的瀏覽器裡跑。一個好的檔案會亮綠色那一列;一個壞的會在你花任何錢之前把解法指名出來。

    檢查不用錢
  2. 把那句話引起來,並且說是誰說的

    把確切的那些字用引號框起來,歸給鏡頭前的那個人。一個轉述 —「她說了一些讓人安心的話」— 換到的是模型自己編的一句話。

    只能是確切的字
  3. 用「不要字幕」收尾

    這裡沒有負向提示詞欄位,所以「不要把那句話印出來」就是一句和其他句子一樣的句子。它是一個子句,而它救得了一整次生成。

    一個子句
  4. 設好長度和解析度,然後生成

    先把那句話需要的秒數買下來。一個 MP4 會回來,語音、室內音和嘴部動作都已經在裡面。

    最高 1080P

一支短片大約九十秒,而它在跑的時候你可以把分頁關掉。上傳的那張照片永遠不會被改動 — 輸出是一個新檔案。

對嘴在這裡是什麼意思

你的照片就是第一個影格。 那個聲音是寫出來的,不是上傳的。

這個類別裡多數工具收一張圖和一個音檔,然後讓嘴去配它。這一個收一張圖和一個句子。

一張被拿來當 Wan 3.0 對嘴片開頭影格的人像

第 001 影格 · 你的臉

從這裡開始,說出來而且對上

Wan 3.0 對嘴把你的照片放進去當字面意義上的第一個影格,然後從它往前生出 2 到 30 秒,30 fps,480P、720P 或 1080P。你引起來的那些字,會以語音的形式回到那支片子自己的音軌裡,而嘴會跟著它動,因為畫面和聲音是在同一次生成裡算出來的,不是分兩次縫起來的。

你的照片就是第一個影格
001

你的照片就是第一個影格

你必須自己提供的音檔
0

你必須自己提供的音檔

任意整數秒
2–30 秒

任意整數秒

回來一個 MP4,聲音已經在裡面
1

回來一個 MP4,聲音已經在裡面

  • 算繪之前不用做文字轉語音
  • 算繪之後不用再配一次音
  • 不用為那張嘴再授權第二個模型

那句話

什麼決定一句話是被說出來 還是被印在畫面上

有兩句話決定一句台詞是被聽到還是被讀到。一句把確切的字放進說話者的嘴裡;另一句把它們擋在畫面外。少了任何一句,那次失敗都會以一支做完、而且已經計費的影片形式到達。

一句對上的台詞的解剖

語音和畫面 · 一次生成

…自然地對著鏡頭說話。她說:「它什麼都打得很綿密。」

真實的廚房環境音、果汁機馬達聲、隨意的室內音。不要字幕,不要文字覆蓋。

一隻薑黃色的貓和一隻黃金獵犬戴著耳機坐在播客麥克風前,頭上是 ModelTalk 的霓虹招牌十輪 · 720P · 30 秒
兩個說話的,十輪,而且只有正在講話的那一個張嘴 — 按一下有聲音

那張嘴要站得住需要什麼

3

  • 確切的那些字,是引起來的而不是摘要的
  • 一個描述到足以釘死的說話者
  • 他們講話的時候,鏡頭在他們臉上

大家會漏掉的那一條

這裡沒有負向提示詞欄位,所以「不要印這個」就是提示詞裡一句和其他一樣的句子。少了它,模型就可以自由地把你的對白既當成要說出來的、也當成要畫在畫面上的東西 — 而這正是為什麼上面印出來的、阿里巴巴自己那支三十秒展示片,結尾就是那一句指示。

  • 不要字幕,不要文字覆蓋
  • 負向提示詞:字幕

任何長得像負向提示詞的東西,都會被讀成更多要畫出來的字,而請求照樣成功 — 所以那次失敗會以一支做完的片子的形式到達,而畫面某處印著「負向提示詞」這幾個字。

大括號也行 — {like this} 是本站那些提示詞工具吐出來的形式。模型真正在找的,是一句被界定起來、而且附著一個看得見的說話者的台詞,而阿里巴巴自己公布的提示詞用的是引號。文字轉影片講的是那四層聲音,以及該用什麼順序把它們指名出來。

在你花錢之前

在你花掉一點之前 先檢查那張人像

一張 Wan 3.0 讀不了的臉,是最惱人的一種損失,因為你是在排隊之後才發現,不是之前。把照片丟到這裡,它會對著真正的那些限制被檢查一遍 — 格式、大小、尺寸、比例和透明度 — 而且哪一列沒過,就把那一列的解法指名出來。什麼都沒有上傳:這個檢查跑在你的瀏覽器裡。

JPG · JPEG · PNG · BMP · WEBP · ≤20.0 MB · 2408,000px · ratio ≤8:1

一張臉,構圖上讓嘴不要是畫面裡最小的東西,能給對嘴最多可以依據的東西。這個檢查器完全不碰模型,所以一張本來就不會被讀到的人像,查清楚它不用花任何錢。

什麼東西進得去

Wan 3.0 對嘴的各項上限 — 人像、片子和聲音

這幾列裡有五列管那張照片,兩列管出來的東西,而最後一列是那條會產生一次沒有人預期的拒收的。這一頁最上面那個上傳框,會在你花任何錢之前先把圖片那幾列檢查過。

一張鎖死的首影格和一段語音錄音不能一起走。 影格是一族輸入,參考是另一族;同時帶著兩者的請求會被直接拒絕,而不是被降級處理,所以這個選擇發生在你上傳之前。

人像格式
JPEG · JPG · PNG · BMP · WEBPHEIC 會被拒 — iPhone 的預設容器不在清單上
官方
人像大小
≤ 20 MB
官方
尺寸
每邊 240 – 8,000 px
官方
畫面比例
8:1 – 1:8是一個範圍,不是一個上限 — 一張 1:9 的直條會像一張 9:1 的橫幅一樣被拒
官方
透明度
不收PNG 的 alpha 通道會被拒,不會被壓平
官方
片長
2 – 30 秒,30 fps任意整數秒,480P、720P 或 1080P
官方
音色參考
5 段 · 合計 ≤ 15 秒WAV 或 MP3,每個最大 15 MB,每段 1–15 秒
官方
影格與參考
互斥
官方

那句台詞本身沒有獨立的欄位,也沒有獨立的上限:它和其他所有東西一起住在提示詞裡,而提示詞裝得下 20,000 個字元。限制一句台詞的是時鐘,不是字數 — 一個短句大約要兩到三秒的畫面時間,所以一句十五個字的台詞放在一支四秒的片子裡,不是被趕就是被切掉。先把那句話需要的秒數買下來,再去買解析度。

價格 · 每個付費方案都有 1080P · 原生聲音

一支 Wan 3.0 對嘴的片子要多少錢

長度和解析度決定價格。語音不決定:那個聲音開關改的是回來什麼東西,不是它多少錢,而音色參考完全不計費。失敗的生成會自動退款,而上面那個檢查器一開始就把多數可避免的失敗擋在模型外面。

這是怎麼計費的

計費依據
每一秒輸出
語音、音色參考
不收錢
你的第一支片子
不用錢 · 480P

在 480P 上把那句話打草稿,直到表達方式對了,再花一次生成跑 720P 或 1080P — 兩次生成之間,那張人像不需要重新檢查。完整價格

兩種繳法,每月點數一樣

  • 免費的第一支不用信用卡

    在真正的 wan3.0-video 上跑一次生成。看看 Wan 3.0 拿你自己的鏡頭做出什麼 —— 480P、三秒,聲音在同一次生成裡。

    $0一次

    全程不用信用卡

    生成免費的一支

    一個 email,不用信用卡

    1 支,只有一次

    480P · 最長 3 秒 · 帶聲音
    一個 email,不用信用卡

    和阿里巴巴為付費方案跑的是同一個 `wan3.0-video` —— 480P 是一個解析度,不是次一等的模型

    • 真正的 wan3.0-video,不是 2.7
    • 聲音和畫面一起生成
    • 收據上有 model ID 和 task ID
    • 失敗的一次永遠不算你的
    • 720P 與 1080P付費
    • 超過 3 秒的片子付費
    • 參考、文件與剪輯模式付費
    • 不只一支付費

    回答一個問題:Wan 3.0 拿你的想法做出什麼。1080P、三十秒和全部輸入方式,從 $12.90 起。

    一眼看完

    每月支數
    1 支,只有一次
    每次出幾條
    1
    最長一支
    3s
    最高解析度
    480P
  • Starter最多省 20%

    一週一篇發布貼文。夠你弄清楚 Wan 3.0 AI 影片產生器合不合你的做事方式,先不用決定量。

    $12.90/ 月$15.90

    年繳 $154.80

    隨時取消

    每月 640 點 · 約 16 支

    以 5 秒 480P 計 · 720P 8 支 · 1080P 4 支

    方案點數月底歸零

    • 每月 640 點 —— 大約 16 支成片
    • 同一句提示詞每次出 2 條
    • 全部解析度 —— 480P、720P 與 1080P
    • 全部長度 —— 2 到 30 秒,一次跑完
    • 全部輸入 —— 文字、圖片、參考圖、文件、網頁
    • 聲音在同一次生成裡寫好,沒有浮水印
    • 含商用授權 —— 可發布、可販售、可開發票
    • 高速檔 Wan 3.0 Prime,隨時想用就用
    • 失敗的一次永遠不扣點
    • 點數沒動過,7 天內可退
    • 兩下取消 —— 你加入時的價格鎖住

    前兩行以下的每一項,在 $12.90 這個方案上都有。更大的方案買的是秒數和條數 —— 永遠不是更好的模型。

    一眼看完

    每月支數
    5 秒 480P 約 12 支
    每次出幾條
    2
    每一元幾點
    基準
    退款期
    7 天
  • 多數人落在這裡
    Pro

    每個工作日一支成片,各配三個備選。先在 480P 打草稿、再到 1080P 收尾的那個循環,照一個工作週的量配好。

    $39.90/ 月$49.90

    年繳 $478.80

    隨時取消

    每月 2,240 點 · 約 56 支

    以 5 秒 480P 計 · 720P 28 支 · 1080P 14 支

    方案點數月底歸零

    • 每月 2,240 點 —— Starter 的 3.5 倍
    • 每月約 56 支成片,或 14 支完整 1080P
    • 同一句提示詞每次出 4 條 —— 挑一條,而不是重跑2 倍條數
    • 每一元的點數比 Starter 多 13%更好的單價
    • 夠你在同一週裡先 480P 打草稿、再 1080P 收尾
    • 全部解析度 —— 480P、720P 與 1080P
    • 全部長度 —— 2 到 30 秒,一次跑完
    • 全部輸入 —— 文字、圖片、參考圖、文件、網頁
    • 聲音在同一次生成裡寫好,沒有浮水印
    • 含商用授權 —— 可發布、可販售、可開發票
    • 高速檔 Wan 3.0 Prime,隨時想用就用
    • 失敗的一次永遠不扣點
    • 點數沒動過,7 天內可退
    • 兩下取消 —— 你加入時的價格鎖住

    從 Starter 往上,換來的是數量、條數和單價。模型、那些解析度和那三十秒,本來就已經是你的了。

    一眼看完

    每月支數
    5 秒 480P 約 44 支
    每次出幾條
    4
    每一元幾點
    比 Starter 多 21%
    退款期
    7 天
  • Studio最好的單價

    客戶級的量,以及那個你不必再省著用 1080P 的方案。每月三十一支完整解析度的成片,用我們賣得最低的每點單價。

    $99.90/ 月$119.90

    年繳 $1,198.80

    隨時取消

    每月 6,240 點 · 約 156 支

    以 5 秒 480P 計 · 720P 78 支 · 1080P 39 支

    方案點數月底歸零

    • 每月 6,240 點 —— Starter 的 9.75 倍、Pro 的 2.8 倍13×
    • 每月約 156 支成片,或 39 支完整 1080P
    • 每一元的點數多 26% —— 我們賣的最好單價最好的單價
    • 1080P 夠多,多到你不必先在 480P 打草稿
    • 同一句提示詞每次出 4 條
    • 照一整份客戶名單配的量,不是一個頻道
    • 任何一個月都能加購,不必換方案
    • 全部解析度 —— 480P、720P 與 1080P
    • 全部長度 —— 2 到 30 秒,一次跑完
    • 全部輸入 —— 文字、圖片、參考圖、文件、網頁
    • 聲音在同一次生成裡寫好,沒有浮水印
    • 含商用授權 —— 可發布、可販售、可開發票
    • 高速檔 Wan 3.0 Prime,隨時想用就用
    • 失敗的一次永遠不扣點
    • 點數沒動過,7 天內可退
    • 兩下取消 —— 你加入時的價格鎖住

    這是照一整份客戶名單、而不是一個頻道配的方案:每一句提示詞出四條、1080P 不必省著用,還有重拍一場戲而不必盯著餘額往下掉的空間。

    一眼看完

    每月支數
    5 秒 480P 約 124 支
    完整 1080P
    每月約 31 支
    每一元幾點
    比 Starter 多 28%
    退款期
    7 天

問題

Wan 3.0 對嘴 — 大家真的帶著來的那些問題

值得在你上傳一張臉之前先答掉的那些,數字取自阿里巴巴自己的參數表,不是取自一份功能清單。

我需要一個音檔才能對嘴嗎?

不需要 — 所以你可以不用再找了。把那些字在提示詞裡引起來,歸給鏡頭前的那個人 — She says: "Two minutes to set up."Wan 3.0 就會自己把語音生出來,在跟畫面同一次生成裡,而且嘴會跟著它動。一張照片加一個句子就是全部的輸入。一段語音錄音是另外那條路,給音色非得是某一個特定的人的時候用。

那句台詞要怎麼寫,才會被說出來而不是被描述?

把它引起來,並且掛在某個人身上。阿里巴巴自己的提示詞公式,把要說的內容擺在它應該帶著的情緒、語氣和口音旁邊,而這一頁上每一支展示片都照著做 — She says: "…",然後是表達方式。只被摘要過的字,會變成旁白或者被模型自己編掉。本站那些提示詞工具會把台詞包在大括號裡,{like this},做的是同一件事:標出那句話從哪裡開始、到哪裡結束。

我那句話印在畫面上了,沒有被說出來。為什麼?

因為提示詞裡沒有任何東西說不要印它。這個模型上沒有負向提示詞欄位,所以排除項就是普通的句子 — 用「不要字幕,不要文字覆蓋」收尾,那句話就會以聲音的形式算出來。寫 Negative prompt: subtitles 會產生相反的效果:那幾個字會變成要畫出來的東西。

我可以把照片和語音錄音一起上傳嗎?

同一個請求裡不行。一張被釘成首影格的照片屬於影格族,而一段音軌屬於參考族,而這兩族互斥 — 請求會被拒絕,而不是被降級處理。挑一個:確切的開頭影格配一個生成出來的聲音,或者你錄的那個聲音,而畫面改用參考的形式掛上去。

那句台詞可以多長?

長到裝得進你買下來的那些秒數。提示詞欄位裝得下 20,000 個字元,而片子裝得下 2 到 30 秒的 30 fps,所以限制在時鐘上:上面阿里巴巴自己那支三十秒展示片裝了六句台詞,把空鏡的拍子算進去,大約是五秒一個短句。一句超長的台詞會被趕或被切,而再長的提示詞都修不好這件事 — 改成多買幾秒。

對嘴支援哪些語言?

比你以為的多,而證據就在這一頁上:上面那支頂樓的片子,是阿里巴巴自己展示一位歌手切換八種語言而對嘴撐得住的片子,而那支道場的片子是用日文跑對白的。不存在的東西是一份公布的支援語音語言清單,或者任何音素鎖定參數,所以別處引的一個具體數字,請當成某個人的猜測。用你需要的那個語言,在 480P 上跑三秒 — 那只花掉一支成片的零頭,而且它會替你的情況回答這個問題。

同一支片子裡可以有兩個人說話嗎?

可以,而上面那支播客的片子就是兩個在來回十輪。給每一個說話的人一個獨一無二的標籤,以及足夠分辨的描述,把每一句話錨在那個說話者看得見在做的某件事上,然後照它們被說出來的順序把台詞寫下來。阿里巴巴的指引寫得很明白:代名詞會把說話者合併起來 —「他說…然後他說」就是兩個角色最後變成一個聲音的方式。

語音要另外收錢嗎?

不用。計費只看每一秒輸出和解析度,所以一支有對白的片子,和同一支靜音的片子完全一樣貴。參考圖和參考音訊也都不計費。唯一會加到帳單上的輸入是參考畫面 — 那些秒數會按輸出單價,疊在你要求的秒數上面收費。

他們講話的時候,畫面其他部分會靜止嗎?

只有你說了才會。你的照片是第一個影格,不是一張鎖死的定版 — 它後面的一切都是生成出來的,所以房間、光線和構圖除非被提示詞釘住,不然都會飄。上面兩支阿里巴巴的展示片,都花了一整段在講這件事,指名什麼必須維持完全一致;提示詞框旁邊那個外觀鎖定,會替你把同樣的句子寫出來。

我可以把一支說話的片子拿去商用嗎?

可以。每一個付費方案都含商用授權,沒有浮水印,也不用另外買一份授權,適用阿里巴巴的使用政策和我們的條款。限制不在授權上,在那張臉上:照片裡的那個人和錄音裡的那個聲音,兩邊都必須同意過。

一張臉,一個句子

上傳那張人像,把你需要被說出來的那句話引起來,然後聽聽看回來的是什麼。一支不用錢的 Wan 3.0 片子,480P,最長三秒 — 一個電子郵件,不用卡。如果表達方式不是你想像的那個,它一毛都沒花到你。

由 wan-3.run 編輯團隊撰寫與維護發布於 最後更新 工具 版本 2026.09.4