如何用两张参考图创建15秒 AI 时尚视频
了解如何使用氛围图和角色参考图,借助 WeShop MiniMax H3 生成一支15秒、具有电影感的 AI 时尚视频。
本教程面向时尚品牌、电商卖家、创意团队和内容创作者,讲解如何使用两张参考图制作一支角色与视觉方向保持一致、具有电影感的 AI 时尚视频。
其中一张图片用于确定氛围、灯光和胶片质感,另一张则定义模特的外观与服装。结合结构化提示词后,它们可为一支15秒横版时尚广告提供视觉基础。
- 输入: 一张氛围参考图、一张角色参考图和一段视频提示词
- 工具: WeShop MiniMax H3
- 输出: 一支15秒、16:9 的 AI 时尚视频
- 案例依据: 两张提供的参考图、生成提示词及生成的视频结果
本案例记录了一次生成结果。不同的输入或后续生成可能不会产生完全相同的细节。
Blonde fashion model in a glossy black coat standing in front of an orange nighttime fire
|
Front, side, and back reference views of a blonde model wearing a glossy black trench coat
|
第 1 步:准备两张具有不同角色的参考图
避免使用传达相同信息的两张参考图。对于此 AI 时尚视频工作流,每张图片都应具有明确的用途。
使用图片 1 控制情绪与视觉风格
第一张参考图用于确定整体艺术方向:
- 带有黑烟的夜间火焰场景
- 橙红色火焰与高对比度灯光
- 温暖光线在亮面黑色漆皮上的反射
- 模拟胶片颗粒与轻微图像损坏效果
- 广播中断或监控风格的图形元素
- 冷峻、危险、具有编辑感的时尚广告构图
这张图片应传达最终视频的整体感受,而不是定义角色的每一个细节。
使用图片 2 支持角色一致性
第二张参考图从正面、侧面和背面展示角色。它为 AI 时尚视频生成器提供可识别的视觉锚点:
- 长铂金金发
- 窄款黑色复古太阳镜
- 亮面黑色漆皮风衣
- 系腰带设计与长风衣轮廓
- 黑色高跟靴
- 冷静自信的时尚姿势
在上传任何参考图之前,请确认你拥有使用人物、服装图片及生成结果所需的权利。如果参考图描绘了真实人物,请获得适当授权,并避免暗示不存在的代言关系。
第 2 步:将参考图上传至 WeShop MiniMax H3
打开 WeShop MiniMax H3,找到参考图视频生成区域。
根据图片的预期用途上传源图片:
- 将图片 1 用作氛围和视觉风格参考。
- 将图片 2 用作角色和服装参考。
- 确认两张图片均已正确显示。
- 检查发型、太阳镜、风衣轮廓和火焰灯光是否清晰可见。
当前界面可能会对参考图的数量、顺序、格式或尺寸设定特定规则。请遵循工具实时页面中显示的选项。

第 3 步:输入结构化 AI 时尚视频提示词
实用的提示词应先定义每张参考图的角色,再描述输出内容、角色、环境和剪辑风格。
本案例可使用以下提示词:
图片 1 用作整体质感、情绪和氛围的参考。图片 2 用作角色外观的参考。
创建一支15秒、16:9 的横版时尚短片。保持角色一致:长铂金金发、窄款黑色复古太阳镜、亮面黑色漆皮风衣,以及冷静自信的时尚表情。橙色火光映照在皮革风衣上。
采用快切、电影感时尚广告风格,场景设定在有黑烟和橙红色火焰的夜间火灾现场。融入 VHS 故障效果、CCTV 广播中断、20世纪90年代模拟胶片颗粒、扫描线、色差、漏光、白闪转场和轻微镜头抖动。
该提示词包含五个控制层:
| 控制层 | 提示词内容 | 目的 |
|---|---|---|
| 参考图角色 | 图片 1 控制氛围;图片 2 控制外观 | 减少两个输入之间的歧义 |
| 输出格式 | 15秒、16:9、横版 | 定义预期交付内容 |
| 角色锚点 | 铂金发、窄款太阳镜、亮面黑色风衣 | 强化不同镜头中的可识别特征 |
| 环境与灯光 | 夜间火焰、烟雾、橙红色火焰、皮革反光 | 创建统一场景 |
| 影片语言 | 快切、VHS 故障、颗粒、扫描线和漏光 | 确立编辑感广告风格 |
目标并不是堆叠尽可能多的形容词。每组指令都应控制结果的一个方面。
保持角色描述简洁且易于识别。围绕一个连贯地点构建环境,然后选择能够支持相同广告风格的视觉效果。
第 4 步:生成15秒 AI 时尚视频
开始生成前,请检查两张参考图和提示词。
如果当前界面提供相应控制项,请使用与预期结果一致的设置:
- 时长: 15秒
- 画面比例: 16:9
- 方向: 横版
- 其他设置: 请遵循 WeShop MiniMax H3 当前提供的选项
不要假设每一项细节都必须通过单独的控制项进行配置。有些要求可以通过提示词表达。请在实时产品页面确认当前可选时长、画面比例控制、分辨率设置、积分、价格和生成限制。
输入准备就绪后,点击界面中显示的生成按钮。
你可以直接使用右侧工具试一试。

第 5 步:检查角色一致性与最终结果
在查看单个画面之前,先完整观看生成的视频。分别检查角色、氛围和剪辑风格。
检查 AI 时尚视频中的角色一致性
在特写、侧面镜头、全身画面和行走片段之间对比角色。重点关注最具辨识度的锚点:
- 铂金金发
- 窄款黑色太阳镜
- 亮面黑色风衣
- 面部结构与整体造型
- 冷静、自信的表情与姿势
在本案例中,主要造型线索在面部特写、侧面视角、全身镜头和行走片段中仍保持可识别性。然而,AI 生成视频中的面部、手部、配饰和服装细节仍需人工审核。
检查氛围是否与图片 1 一致
查看以下元素是否保持连贯:
- 夜间火焰场景
- 黑烟与橙红色火焰
- 具有高对比度灯光的深色背景
- 橙色光线在亮面皮革上的反射
- 结合火焰与车辆的电影感环境
氛围参考图应引导整体视觉语言,而不应强迫每一帧都复制原始构图。
检查特效是否支持时尚广告节奏
结果包含人像特写、服装细节、全身动作、环境火焰镜头,以及类似广播中断的画面。
检查这些效果是否自然地出现在视频中:
- 快切剪辑
- 模拟胶片颗粒
- VHS 或 CCTV 风格干扰
- 扫描线与色差
- 漏光与白闪转场
- 轻微画面抖动
在提示词中包含某种效果,并不代表生成的视频准确还原了该效果。请根据实际画面判断每种效果。
如果首次结果需要改进
首先判断问题涉及角色、环境还是视觉效果。然后只修改提示词中相关的部分。
- 角色在不同镜头中发生变化: 删除次要外观细节,并重复强调关键的发型、太阳镜和风衣锚点。
- 服装发生变化: 强调亮面黑色漆皮材质、长款轮廓和系腰带设计。
- 火焰压过主体: 明确说明角色是主要主体,火焰和烟雾应保留在背景中。
- 视觉处理显得过度: 减少故障特效数量,优先保留胶片颗粒、扫描线和漏光。
- 镜头序列显得缺乏重点: 将方向简化为三个重点——时尚广告、快切和角色特写。
每次只修改一组变量。这样更容易判断是哪项调整改善了输出结果。
如有可能,请保存不成功的生成结果。失败结果、修改后的提示词和修正后的结果,比脱离上下文展示一支成功视频更能提供可信证据。
发布前最终检查
在广告、产品页面或社交媒体帖子中使用生成的视频之前,请确认:
- 角色在主要镜头中仍清晰可辨。
- 面部、手部、太阳镜和服装没有明显的视觉错误。
- 画面比例和时长符合目标平台的要求。
- 火焰、车辆和背景元素不存在分散注意力的瑕疵。
- 音频已获准用于预期用途,且能够正常播放。
- 你拥有参考图和所描绘肖像所需的权利。
- 页面清楚披露该视频由 AI 生成。
- 人工审核人员已确认结果不会误导观众。