August 12

2枚の参照画像から15秒のAIファッション動画を作成する方法

WeShop MiniMax H3で雰囲気とキャラクターの参照画像を使い、15秒のシネマティックなAIファッション動画を生成する方法を学びましょう。

このチュートリアルでは、ファッションブランド、EC販売者、クリエイティブチーム、コンテンツクリエイター向けに、2枚の参照画像を使って、一貫したキャラクターとビジュアルディレクションを持つシネマティックなAIファッション動画を制作する方法を紹介します。

1枚の画像で雰囲気、照明、フィルム表現を設定します。もう1枚の画像でモデルの外見と衣装を定義します。これらを構造化されたプロンプトと組み合わせることで、15秒の横長ファッションCMのビジュアル基盤を構築できます。

  • 入力: 雰囲気の参照画像1枚、キャラクターの参照画像1枚、動画プロンプト
  • ツール: WeShop MiniMax H3
  • 出力: 15秒、16:9のAIファッション動画
  • ケースの基準: 提供された2枚の参照画像、生成プロンプト、生成された動画

本ケースでは、1つの生成結果を記録しています。異なる入力や後続の生成では、同一のディテールが得られない場合があります。

Blonde fashion model in a glossy black coat standing in front of an orange nighttime fire
Clipboard_Screenshot_1785247818.png
Front, side, and back reference views of a blonde model wearing a glossy black trench coat
image (19).png

ステップ1:異なる役割を持つ2枚の参照画像を準備する

同じ情報を伝える2枚の参照画像は使用しないでください。このAIファッション動画のワークフローでは、各画像に明確な目的を持たせる必要があります。

画像1でムードとビジュアルスタイルをコントロールする

1枚目の参照画像は、全体のアートディレクションを設定します。

  • 黒煙が立ち込める夜間の炎のシーン
  • オレンジレッドの炎とハイコントラストな照明
  • 光沢のある黒いパテントレザーに映る暖かな反射
  • アナログフィルムの粒子感とさりげない画像の損傷
  • 放送中断または監視カメラ風のグラフィック
  • 冷たく危険な印象のエディトリアルなファッション広告構図

この画像では、キャラクターのあらゆる詳細を定義するのではなく、最終動画がどのような印象を与えるかを伝える必要があります。

画像2でキャラクターの一貫性を支える

2枚目の参照画像には、正面、側面、背面から見たキャラクターを配置します。AIファッション動画生成ツールに、認識しやすい視覚的アンカーを提供します。

  • 長いプラチナブロンドの髪
  • 細身の黒いレトロサングラス
  • 光沢のある黒いパテントレザーのトレンチコート
  • ベルトで締めたウエストとロングコートのシルエット
  • 黒いヒールブーツ
  • クールで自信に満ちたファッションポーズ

参照画像をアップロードする前に、人物、衣装画像、生成結果を使用するために必要な権利を持っていることを確認してください。参照画像に実在の人物が描かれている場合は、適切な許可を取得し、実際には存在しない推薦や支持を示唆しないようにしてください。

ステップ2:参照画像をWeShop MiniMax H3にアップロードする

WeShop MiniMax H3を開き、参照画像による動画生成エリアを見つけます。

意図した役割に応じて、元画像をアップロードします。

  1. 画像1を雰囲気とビジュアルスタイルの参照として使用します。
  2. 画像2をキャラクターと衣装の参照として使用します。
  3. 両方の画像が正しく表示されていることを確認します。
  4. 髪、サングラス、トレンチコートのシルエット、炎の照明がはっきり見えていることを確認します。

現在のインターフェースでは、参照画像の枚数、順序、形式、サイズに関する特定のルールが適用される場合があります。実際のツールページに表示されているオプションに従ってください。

screenshot-20260812-162515.png screenshot-20260812-162606.png

ステップ3:構造化されたAIファッション動画プロンプトを入力する

効果的なプロンプトでは、出力、キャラクター、環境、編集スタイルを説明する前に、各参照画像の役割を定義する必要があります。

このケースでは、以下のプロンプトを使用します。

画像1は全体的なテクスチャ、ムード、雰囲気の参照です。画像2はキャラクターの外見の参照です。

15秒、16:9の横長ファッションフィルムを作成してください。キャラクターの一貫性を保ってください:長いプラチナブロンドの髪、細身の黒いレトロサングラス、光沢のある黒いパテントレザーのトレンチコート、そしてクールで自信に満ちたファッション表情。オレンジ色の炎の光がレザーコートに反射します。

黒煙とオレンジレッドの炎が立ち上る夜間の炎のシーンを舞台に、テンポの速いカットによるシネマティックなファッションCMスタイルを使用してください。VHSグリッチ、CCTV放送中断、1990年代のアナログフィルム粒子、走査線、色収差、光漏れ、ホワイトフラッシュのトランジション、さりげないカメラの揺れを取り入れてください。

プロンプトには、5つのコントロールレイヤーがあります。

コントロールレイヤープロンプト内容目的
参照画像の役割画像1が雰囲気を制御し、画像2が外見を制御する2つの入力間の曖昧さを軽減する
出力形式15秒、16:9、横長想定する納品物を定義する
キャラクターアンカープラチナブロンドの髪、細身のサングラス、光沢のある黒いコートショット間で認識しやすい特徴を強化する
環境と照明夜の炎、煙、オレンジレッドの炎、レザーへの反射統一感のある舞台設定を作る
映像表現高速カット、VHSグリッチ、粒子感、走査線、光漏れエディトリアルな広告スタイルを確立する

目的は、できるだけ多くの形容詞を重ねることではありません。指示の各グループは、結果の1つの側面をコントロールするようにしてください。

キャラクターの説明は簡潔で認識しやすいものにします。環境は一貫性のある1つのロケーションを中心に構築し、同じ広告スタイルを支える視覚効果を選択してください。

ステップ4:15秒のAIファッション動画を生成する

生成を開始する前に、2枚の参照画像とプロンプトを確認します。

現在のインターフェースに対応するコントロールがある場合は、意図した結果に合った設定を使用してください。

  • 長さ: 15秒
  • アスペクト比: 16:9
  • 向き: 横長
  • その他の設定: WeShop MiniMax H3で現在利用可能なオプションに従ってください

すべての詳細を個別のコントロールで設定する必要があるとは限りません。要件によっては、プロンプトで指定する場合もあります。実際の製品ページで、現在利用可能な動画の長さオプション、アスペクト比のコントロール、解像度設定、ポイント、価格、生成制限を確認してください。

入力の準備ができたら、インターフェースに表示されている生成ボタンをクリックします。

右側のツールから直接お試しいただけます。

screenshot-20260812-162827.png

ステップ5:キャラクターの一貫性と最終結果を確認する

個々のフレームを確認する前に、生成された動画全体を視聴してください。キャラクター、雰囲気、編集スタイルをそれぞれ分けて確認します。

AIファッション動画におけるキャラクターの一貫性を確認する

クローズアップ、横顔のショット、全身フレーム、歩行シーケンスにわたってキャラクターを比較します。最も認識しやすいアンカーに注目してください。

  • プラチナブロンドの髪
  • 細身の黒いサングラス
  • 光沢のある黒いトレンチコート
  • 顔の構造と全体的なスタイリング
  • クールで自信に満ちた表情とポーズ

このケースでは、顔のクローズアップ、横顔、全身ショット、歩行シーケンスにわたって、主なスタイリング要素が認識可能な状態で維持されています。ただし、AI生成動画の顔、手、アクセサリー、衣服の詳細については、引き続き人による確認が必要です。

雰囲気が画像1と一致しているか確認する

以下の要素に連続性があるかを確認します。

  • 夜間の炎の舞台
  • 黒煙とオレンジレッドの炎
  • ハイコントラストな照明を用いた暗い背景
  • 光沢のあるレザーに映るオレンジ色の反射
  • 炎と車両を組み合わせたシネマティックな環境

雰囲気の参照画像は、すべてのフレームに元の構図をコピーさせることなく、全体のビジュアル表現を導くものであるべきです。

エフェクトがファッション広告のリズムを支えているか確認する

結果には、ポートレートのクローズアップ、衣服のディテール、全身の動き、炎のある環境ショット、放送中断を思わせるフレームが含まれます。

以下のエフェクトが動画内に自然に現れているかを確認してください。

  • 高速カット編集
  • アナログフィルムの粒子感
  • VHSまたはCCTVスタイルのノイズ
  • 走査線と色収差
  • 光漏れとホワイトフラッシュのトランジション
  • さりげない画像の揺れ

プロンプトにエフェクトを含めたからといって、生成動画で正確に再現されたことにはなりません。各エフェクトは実際のフレームで判断してください。

最初の結果に改善が必要な場合

まず、問題がキャラクター、環境、視覚効果のどれに関係するかを判断します。その後、プロンプトの該当部分だけを修正してください。

  • ショットごとにキャラクターが変わる: 二次的な外見の詳細を削除し、重要な髪、サングラス、コートのアンカーを繰り返します。
  • 衣装が変わる: 光沢のある黒いパテントレザー素材、長いシルエット、ベルトで締めたウエストを強調します。
  • 炎が被写体を圧倒している: キャラクターが主役であり、炎と煙は背景に留まると明記します。
  • ビジュアル表現が過剰に感じられる: グリッチエフェクトの数を減らし、フィルム粒子、走査線、光漏れを優先します。
  • ショットの流れに焦点がない: ファッションCM、高速カット、キャラクターのクローズアップという3つの優先事項に指示を簡略化します。

変更する変数のグループは、一度に1つだけにしてください。これにより、どの修正が出力を改善したかを判断しやすくなります。

可能であれば、失敗した生成結果も保存してください。失敗した結果、修正したプロンプト、修正後の結果を並べることで、文脈なしに成功した動画を提示するよりも信頼性の高い証拠になります。

公開前の最終チェック

生成された動画を広告、商品ページ、SNS投稿で使用する前に、以下を確認してください。

  • メインショットでキャラクターが認識可能な状態に保たれている。
  • 顔、手、サングラス、衣服に明らかな視覚的エラーがない。
  • アスペクト比と長さが掲載先プラットフォームの要件を満たしている。
  • 炎、車両、背景要素に注意をそらすアーティファクトがない。
  • 音声が意図した用途に対して利用許諾済みであり、正しく再生される。
  • 参照画像および描写された肖像を使用するために必要な権利を有している。
  • ページ上で動画がAI生成であることを明確に開示している。
  • 人間のレビュアーが、結果が視聴者を誤解させないことを確認している。