Wan 3.0 のプロンプト例を、全文そのまま

ここにある Wan 3.0 のプロンプト例 はどれも、隣のクリップを実際に生み出したそのままの文面です — 要約も短縮もしていません。それぞれを、Wan 3.0 がプロンプトを読む 6 つの層に分けてあります。被写体、情景、動き、カメラ、音、スタイル。ひとつコピーして、名詞をひとつ変えて、走らせてください。

11 テンプレート · どのプロンプトも全文、生み出したクリップと並べて

テキストから動画

2

アップロードするものはありません。プロンプトだけが唯一の情報源なので、被写体も、舞台も、動きも、見た目も、そこに全部載せる必要があります。この 2 本がページ内で最も長い文面なのは、そのためです。テキストから動画で走らせる

  • A ruined overgrown avenue, a child holding a light in a derelict store, and an astronaut lifting off her helmet
    P—01テキストだけ

    Astronaut in the ruins

    The plainest shape a Wan 3.0 prompt takes: what happens, then what it looks like.

    5s720PWan 3.080 cr
  • A young man and an elderly woman play chess at a table in a busy city square
    P—02テキストだけ

    Street chess turnaround

    A reversal in five seconds, carried by one face rather than by anything on the board.

    5s720PPrime120 cr

画像から動画

2

先頭フレームがすでに被写体と舞台とスタイルを持っているので、プロンプトは「何が変わるか」だけを言えば済みます。ここで最も短い 2 本がこれで、それは偶然ではなく、そのまま教訓です。画像から動画で走らせる

  • A small ranger reaches toward an enormous green dragon lying in a sunlit forest clearing
    P—03画像が要ります

    The dragon opens its eyes

    The shortest prompt here. A first frame already holds the world, so the text only says what moves.

    5s720PWan 3.080 cr
  • A man with a camera stands in a busy European square looking toward a distant clock tower
    P—04画像が要ります

    The man at the clock tower

    A five-second story hook that never describes its subject, because the first frame already did.

    5s720PPrime120 cr

参照素材から動画

3

1 回のリクエストに画像 10 点、動画 5 本、音声 5 本まで — Wan 3.0 がそもそもこのために作られたモードであり、モデルが本当に解釈する記法を持つ唯一のモードです。参照素材から動画で走らせる

  • A masked rider on a black horse gallops alongside a steam train across a sunset desert
    P—05リファレンスが要ります

    Desert train heist

    Four action beats written into a five-second request — and the two ways to fix that.

    5s720PWan 3.080 cr
  • A silver-haired navigator holds a cyan star map opposite a black-coated operative in an orbital scrapyard
    P—06リファレンスが要ります

    Orbital scrapyard handoff

    Paragraph beats and a full maintain clause — with the asset numbering it should have had.

    5s720PPrime120 cr
  • A woman in white sits on a lime-green sofa in a flower meadow as a butterfly lands on her hand
    P—07リファレンスが要ります

    Meadow sofa portrait

    A near-still portrait that holds a reference image while only the butterflies move.

    5s720PWan 3.080 cr

5 秒を超えたら

4

12 秒と 15 秒、書き方が変わるところです。8 秒未満ならプロンプトはひとつの動作ですが、それを超えると拍を順番に名指しし、どう終わるかまで言う必要があります。Wan 3.0 は払った秒数を最後まで埋めますし、空けておいた分の終わり方は勝手に作るからです。テキストから動画で走らせる

  • Five dancers in black dresses silhouetted against a hard white backlight in ground fog
    P—08テキストだけ

    Dancers in backlit fog

    One hard backlight, five silhouettes, and three ordered beats: gather, open, close.

    12s720PWan 3.0192 cr
  • A red supercar unfolding into a four-legged machine on wet asphalt under floodlights
    P—09テキストだけ

    Supercar to predator

    A car becomes an animal in four ordered beats, the last of which is the ending.

    15s720PWan 3.0240 cr
  • A pink mech suit firing a beam at a green armoured brute across a concrete plaza
    P—10テキストだけ

    Schoolgirl to mech suit

    Street, then a face behind glass, then a stand-off — three shot sizes in one request.

    15s720PWan 3.0240 cr
  • A first-person view charging across a blue glacier canyon past a wrecked ship, with ice crusting over both arms
    P—11テキストだけ

    Across the glacier

    A continuous first-person travel shot where duration buys distance rather than beats.

    15s720PWan 3.0240 cr

ここにある Wan 3.0 のクリップのうち 6 本は、生み出したプロンプトと一緒に公開されたものです。どの文面がそのショットを買ったのか、そのまま確かめられます。残る 5 本はプロンプトが公開されていないため、映像から書き起こしました。どのカードにも、そのクリップの出どころへのリンクがあります。どれでも被写体を差し替えれば、バッジに出ている長さと解像度のまま、アリババの wan3.0-video で書いたとおりに動きます。

ここからは細かい話

コピーは無料、隠している部分はありません

Wan 3.0 のプロンプトはどれも、音の指定まで含めて、走らせたときのまま全文を載せています — 切り詰めも、言い換えも、クリップへの透かしもありません。ひとつ取って名詞を変えれば、wan3.0-video が動いている場所ならどこでも書いたとおりに走ります。コピーには一切お金がかかりません。クレジットを使うのはクリップを生成したときだけです。

ここでは無料、アカウント不要

クレジットを使うもの

  • Wan 3.0 でクリップを生成する — 初回の 1 本はこちら持ちです。480P、3 秒まで
  • 720P と 1080P、そしてそれより長いもの
  • リファレンス動画。出力と同じ単価で課金されます

何本でも、今日、誰であるかを告げずにコピーしてかまいません — メールもアカウントも透かしもなし。ここでクレジットを使うのは、Wan 3.0 が実際に生成したクリップだけです。

4 ステップ

この中の 1 本を使うには

プロンプトを丸ごとコピーして被写体を変えるやり方でも動きますし、多くの人がまずそうします。1 層だけ取るほうがもっとうまくいきますし、元とまるで似ていない被写体にも効きます。

The six layers

  • Entity
  • Scene
  • Motion
  • Aesthetic control
  • Stylization
  • Sound
  1. 01

    被写体ではなく、動きで探す

    カメラと動きが自分の狙いにいちばん近いクリップを選んでください。画面に何が写っているかはまだ関係ありません — 探しているのは情景ではなく、形です。

  2. 02

    2 つの層をそのまま持ってくる

    分解を開いて、画づくりの指定の行を書かれているとおりにコピーします。この 2 つはいちばん書き慣れない部分で、しかもどんな被写体にも手直しなしで移せます。

  3. 03

    被写体と情景は自分で書く

    誰が出て、どこで起きるのか。ここはあなたにしか分からない部分であり、自分の言葉を使う価値があるのはここだけです。

  4. 04

    長さは保つか、新しい長さに書き直す

    Wan 3.0 は 2 秒から 30 秒まで整数秒で受け取り、長さが変わればプロンプトの形も変わります。8 秒未満ならひとつの動作を書いてください。15 秒を超えるなら拍を順に名指しし、どう終わるかまで書きます — 書かなかった終わり方は、勝手に作られます。

4 層を入れ替えるやり方は、「生成した」ではなく「演出した」ように見える結果への最短路です。本サイトのプロンプトジェネレーターがやっているのも、まさにこれです。自分で組むより任せたい場合はそちらへ。

自分で書くなら

ここに合うものがなければ、Wan 3.0 のプロンプトジェネレーターが、一行の説明から、この例と同じ 6 層の構造で組み立てます。無料、アカウント不要、1 日の上限もありません。

  1. 01

    一行で書く

    一文で足ります。ジェネレーターが聞くのは長さとモードで、段落ではありません。

  2. 02

    6 つの層を組み立てます

    被写体、情景、動き、画づくりの指定、スタイル化、音 — Wan 3.0 が読む平たい文章にならしたうえで。

  3. 03

    そのまま生成へ送る

    プロンプトも長さも縦横比も一緒に運ばれるので、打ち直すものはありません。

プロンプトジェネレーターを開く

あるいは、気に入った動画から始める

見た目を真似したいクリップがすでに手元にありますか。動画からプロンプトはそれを読み、映像から逆に Wan 3.0 のプロンプトを書き起こします — こちらも無料、こちらも回数の制限なし。しかも対象は本サイトの素材ではなく、あなた自身の素材です。

動画からプロンプトを開く

どちらのツールも書き出すのは動画ではなくテキストで、回数の制限はありません。ショットが必要とするだけ使ってください。クレジットを使うのは、生成されたクリップだけです。

コピーする前に

Wan 3.0 のプロンプトについてよくある質問

ここにある Wan 3.0 のプロンプトはどこから来たのか、安全に変える方法、そして走らせるといくらかかるか

この Wan 3.0 のプロンプトは自由にコピーできますか?

はい。この集にある Wan 3.0 のプロンプトはすべて全文を載せており、持ち帰っても、書き換えても、使ってもかまいません。アカウントもメールも不要で、コピーでクレジットが減ることはありません。減るのはクリップを生成したときです。

プロンプトは全文ですか、途中で切れていますか?

全文です。それぞれ本文と同じ基準で文字数を表示しているので、貼り付けたものと公開されているものを突き合わせられます。この数字は文字列から計算していて、手で書いたものではありません。

このクリップは、このプロンプトを使って Wan 3.0 で生成されたものですか?

6 本はそうです — それらは生み出したプロンプトと一緒に公開されているので、プロンプトとクリップは対になっています。残る 5 本はプロンプトなしで公開されていたため、映像から書き起こしました。どちらであるかは各カードに書いてあり、そのクリップが公開された場所へのリンクもあります。そしてどのプロンプトも、Wan 3.0 が読む形 — 映像と音をひとつの欄に — で書かれています。

Wan 3.0 には構造化されたプロンプトが必要ですか?

いいえ。そして、これがいちばん高くつく思い違いです。Wan 3.0 が読むのは最大 20,000 文字の平たい文字列ひとつです。項目名も、[Shot 1] のような目印も、00:00.000 のようなタイムコードも解釈されません — それらは画の中に描き込まれ、しかもリクエストは成功します。

台詞はどう書きますか?

話す言葉そのものを波括弧に入れ — {It is not ready.} — 話者と言い方は括弧の外に普通の文章として置きます。引用符でも同じように台詞を区切れますし、アリババ自身が公開しているプロンプトはそちらの書き方です。行が作られてしまうのは、書かずに要約したときです。

何かを除外したいのですが。ネガティブプロンプトの欄がありません。

そのとおり、ありません。除外はプロンプトの中に文として書いてください。"no music"、"no on-screen text" のように。ネガティブプロンプトの書式で渡したものは、描き込むべき文字として届きます。

コピーしたプロンプトの結果がおかしくなるのはなぜですか?

たいていは長さです。Wan 3.0 が生成するのは 2 秒から 30 秒の整数秒で、5 拍を描いたプロンプトを 5 秒のリクエストに渡しても、切り詰められるわけではありません — 指定した尺の中に段取り全体が圧縮されるので、どの拍も早く来るか、ほとんどが落ちます。プロンプトを削るのではなく、長さを上げてください。

同じプロンプトなら、2 回とも同じクリップになりますか?

近くはなりますが、同一にはなりません。Wan 3.0 はシードを受け取るので、固定すればかなり近づきます — ただし解像度が違えば結果も変わります。同じ画そのものではなく、同じ調子が返ると考えてください。

アップロードした画像をプロンプトから指すには?

Image 1 と書きます。大文字で、間に半角スペースを入れ、番号は配列の中でのそのファイルの位置です。Video 1 と Audio 1 も同じ書き方です。小文字、アンダースコア、"picture 1" はどれにも結びつかず、モデルは黙って被写体を作り出します。

この中の 1 本を走らせるといくらかかりますか?

各カードにクレジットで表示しています。秒数と解像度とモデルの段から、残高を実際に引き落とすのと同じコードで計算した数字です。3 つの解像度は 1 段ごとに倍になり、長さに無料の下限はありません。だから 15 秒の例は隣の 5 秒の 3 倍かかり、どれも 480P なら半額になります。

1 本持っていって、走らせてください。

コピーにアカウントは一切要りません — ここには隠したものも、切り詰めたものも、透かしを載せたものもありません。生成にはメールアドレスが要り、初回の 1 本はこちら持ちです。Wan 3.0 本体を 480P で 3 秒まで、音つきで。

wan-3.run 編集チームが執筆・管理しています公開 最終更新