参照画像から動画
最大9枚の参照画像を追加。動画全体でキャラクター、スタイル、商品の一貫性を保ちます。
参照から動画AI
必要な顔、衣装、商品、場所をアップロードしてプロンプトでそれぞれタグ付けすれば、AI Hug がそれらを崩れないひとつのショットにまとめます。参照から動画は、モデルの再学習も何十回もの撮り直しも不要で、キャラクターが一貫したAI動画を作るいちばんの近道です。
- 参照画像は最大9枚
- 参照動画と音声
- Seedance 2.0 · Wan 3.0
参照素材がショットにもたらすもの
以下のクリップは、どれも1〜2枚の静止画から始まっています。プロンプトが動きとカメラを指定し、参照画像が被写体の本当の姿を固定します。
1枚の参照で、シーン全体を
1体のクリーチャーデザインが、逆光の砂漠での包囲戦になりました。シルエット、脚の本数、体型は参照画像そのままなので、カットが変わってもクリーチャーの姿は崩れません。
顔と衣装をセットで保つ
顔のアップを画像 1、衣装の全身写真を画像 2 としてタグ付けしました。人物と衣装を2枚の参照に分けるのが、速いカメラワークでもキャラクターを一貫させるいちばん確実な方法です。
デフォルメキャラもそのままのタッチで
参照は実在の人物だけのものではありません。ぬいぐるみのようなデフォルメ体型のクリーチャーも、高速の追跡シーンで毛の色と丸いフォルムを保ちました。モデルが文章から推測するのではなく、デザインをなぞっているからです。
崩れの多くは、プロンプトではなく入力素材が原因です
崩れにくい参照画像の選び方
- 01
1枚に1つの役割
参照画像には役割を1つだけ持たせましょう。顔、衣装、商品、部屋などです。ごちゃごちゃしたコラージュだと、何が重要かをモデルに判断させることになり、たいてい間違えます。
- 02
鮮明で光の均一な顔写真
人物には、ピントが合っていて正面を向き、光が均一で目が隠れていない写真を使いましょう。強いフィルター、サングラス、極端な角度は、途中で顔が変わってしまう主な原因です。
- 03
人物と衣装を分ける
衣装が重要なら、顔のアップとは別に全身写真を参照として追加し、プロンプトで両方をタグ付けして、同じ人物であることをモデルに伝えましょう。
- 04
商品は無地の背景で
白や無彩色の背景で撮った商品写真は、商品が小さく写っていたり一部が隠れていたりするイメージ写真より、ラベル・色・比率をはるかに正確に再現します。
- 05
動きは動画で、声は音声で
ダンスの振り付け、カメラの動き、ジェスチャーを伝えるには、短い参照動画がいちばん明確です。参照音声は声やリズムの手がかりになります。どちらも短く、内容を絞りましょう。
- 06
すべての参照をプロンプトでタグ付け
プロンプト欄で @ を入力すると、画像 1・動画 1・音声 1 を必要な位置に挿入できます。例:「画像 1 が画像 3 のカフェに入り、画像 2 のボトルを手にしている」。タグ付けしない素材も送信されますが、役割はモデルが推測することになります。
参照画像からAI動画を作る3ステップ
アップロードから完成クリップまで
- 1
参照素材をアップロード
プロンプト上のアップロード欄に画像を最大9枚、必要に応じて参照動画や音声も追加します。アップロードした素材はプロンプト内に番号付きのタグとして表示され、ドラッグで位置を調整できます。
- 2
ショットを説明し、参照をタグ付け
何が、どこで起こり、カメラがどう動くかを書き、@ で各被写体に対応する参照を指定します。精細な4〜15秒のショットなら Seedance 2.0、最大30秒・1080pまでの動画なら Wan 3.0 を選びましょう。
- 3
生成して、確認して、調整する
長さ・解像度・サウンドを選んで生成します。細部が崩れたら、プロンプトを全部書き直すのではなく、より鮮明な参照に差し替えるか、タグの位置をより具体的にしましょう。
FAQ
参照から動画のよくある質問
参照から動画、複数参照の動画AI、キャラクターを一貫させるコツについての質問。
参照から動画AIとは?
自分の素材でガイドする動画生成です。キャラクターを言葉で説明して毎回同じ人物が描かれることを祈る代わりに、画像(必要なら動画や音声も)をアップロードすると、モデルがそれを被写体の見た目・動き・声の基準として扱います。
画像から動画とは何が違いますか?
画像から動画は1枚の画像を最初のフレームとしてアニメーションさせるので、ショットはその写真から始まります。参照から動画は複数の素材をガイドとして、それらを中心にまったく新しいシーンを作るため、キャラクターをどこにでも、どの角度からでも登場させられます。最初のフレームが重要なら画像から動画を、人物の一貫性が重要ならこのツールを使いましょう。
参照はいくつまで使えますか?
画像は最大9枚、さらに参照動画と参照音声をそれぞれ最大3本まで使えます。Wan 3.0 では、参照動画の合計は15秒まで、参照音声の合計も15秒まで、さらに参照動画の長さと生成する長さの合計が30秒以内である必要があります。これらの制限は送信前にツールが自動でチェックします。
どのモデルを選べばいいですか?
480pまたは720pで、物理的に自然な仕上がりの4〜15秒のショットなら Seedance 2.0、コストを抑えたいなら Seedance 2.0 Mini がおすすめです。Wan 3.0 は2〜30秒の長めのクリップ、最大1080p、音声のネイティブ生成に対応しています。クレジットは出力の秒数に応じて消費され、正確な消費量は開始前に生成ボタンに表示されます。
実在の人物の写真を参照に使えますか?
使用する権利のある写真に限ります。誰だか分かる人物を動画にする前には本人の同意を得てください。また、有名人や他人になりすます目的で写真をアップロードしないでください。プロンプトと参照画像はコンテンツ審査の対象です。
それでもショットごとにキャラクターが変わるのはなぜ?
多くの場合、参照があいまいなことが原因です。解像度が低い、顔が一部隠れている、1枚に複数の人物が写っている、などです。被写体1人に切り抜き、別アングルの参照を追加し、そのキャラクターが行う動作のすぐ横でタグ付けしましょう。非常に速い動きや極端なクローズアップは、ミディアムショットより一貫性を保ちにくくなります。
動画は商用利用できますか?
有料プランで生成した動画は、参照素材の使用権があれば、自分のプロジェクト、広告、SNSコンテンツに利用できます。権利を持たない著作権キャラクター、ロゴ、ブランドは避けてください。参照に使っても、生成された動画に権利が移るわけではありません。