Vidu Q4 reference to video: 複数の参照から1本のクリップを作る
Vidu Q4 reference to video は複数の参照画像から1本のクリップを組み立てます。向いている人、すぐ使えるプロンプト、キャラクターを保つコツ。

このモデルが解く問題はこうです。人物、ジャケット、場所、商品がそれぞれ別の画像にあって、それらを同じカットに収めたい。画像から動画のモデルは1枚のフレームからしか始められないので、まずその合成フレームを描く必要があります。Vidu Q4 Preview reference to video はその手順を飛ばします。参照画像の束とプロンプトを渡せば、それらを中心に場面を組み立ててくれます。モデルページの作例は、レザージャケットにサングラスの男性が工業的な空間を歩くファッション映像で、普通なら作り込んだ開始フレームが必要なタイプのカットです。
向いている人
- ブランドやファッション。場面は新しくても、服や商品がひと目でわかる必要がある仕事。
- 同じキャラクターが登場するシリーズ。 毎回同じ顔と服の参照を渡せば、キャラクターは同じ人物のままです。
- 開始フレームがない人。 場面を描くより説明したいならこのモデル。正確なフレームがすでにあるならimage to video 版を使いましょう。
入力とそれぞれの役割
必須なのは Prompt だけです。Images は複数の参照を一度に受け付けます(かなりの枚数まで入ります)。Advanced の中の Audios は、クリップの音のための音声参照をいくつか受け付け、Generate audio が自分で書く音に加わります。あとはおなじみの設定で、アスペクト比(初期値は横長、ほかに縦、正方形、中間の2種)、軽い試作から大きな仕上げサイズまでの 解像度、秒単位の 長さ、Generate audio(初期設定でオン)、そして シード です。
すぐ使えるプロンプト
ポートレートの男性が、ほかの写真のレザージャケットとサングラスを身につけ、コンクリートの倉庫をカメラに向かって歩いてくる。ゆっくりした移動撮影、高い窓から差す冷たい昼光、足音が響く。参照の香水瓶が濡れた黒い石の上に立ち、キャップに一滴だけしずくが落ちる。ゆっくりしたマクロのズームイン、柔らかな紫の輪郭光、低く静かなうなり。1枚目の画像の少女が2枚目の画像の電車の座席に座り、窓の外を見て静かに言う。「もうすぐ家だね」。窓ガラスに雨。一貫性を保つコツ
- ノイズの多い参照をたくさんより、きれいな参照を少し。 無地背景の顔写真1枚と服装の写真1枚は、互いに食い違うスナップ10枚より多くを伝えます。
- 参照1枚に被写体は1つ。 3人写った画像では、どの人のことかモデルが迷います。
- 下書きは最低の解像度と長さで。 Generate ボタンの価格はその両方で決まります。場面が固まったらシードを固定し、必要なサイズで本番を生成します。
- シリーズを通して同じ参照セットを同じ順番で使い、プロンプトのキャラクター描写も使い回します。使い回せる参照セットの作り方は一貫したスタイルのガイドにあります。
正直な弱点
参照は手がかりであって、貼り付けではありません。ロゴ、服のプリント文字、繊細なアクセサリーはだいたいの形になり、参照を増やすほどそれぞれが平均化されます。小さなディテールを正確に出したいなら、そのディテールが正しい開始フレームを作って image to video を使いましょう。またプレビュー版なので、成熟したモデルより撮り直しが多くなると考えてください。より安定したモデルを選ぶべき場面は動画モデルの選び方が参考になります。
よくある質問
参照画像は必ずアップロードしますか?
いいえ。必須はプロンプトだけなので、普通のテキストから動画としても使えます。ただ、このモデルを選ぶ価値は参照にあります。
音声参照は何のためにありますか?
クリップの音が参考にできる任意の音声ファイルです。Advanced にあり、なくても Generate audio が場面の音を書き出します。
縦長の動画は作れますか?
はい。実行前に縦のアスペクト比を選んでください。横長は初期値にすぎません。


