AI Pulse
📡 X 信号

用户用Minimax H3结合方法 复现创意换装视频的步骤

用户用Minimax H3结合方法 复现创意换装视频的步骤

@GaryLau0101曾用黑白深度加精准分镜提示词,复刻了陶阿狗君的创意换装视频。@HoodyLiu使用Minimax H3结合@GaryLau0101的黑白深度方法,微调提示词后,用新模特复现了这一效果。

复现的具体步骤如下:

1. 准备好目标模特的人物三视图。

2. 生成四个不同场景下的人物参考图,可以用gpt image 2.5完成换人的操作。

3. 调整提示词中对原模特的特征锁定部分,按照新模特的信息重写。

4. 将新的提示词、参考图片和黑白深度视频交给Minimax H3,生成最终的12秒竖版连续视频。

调整后的提示词对生成细节做了明确要求:

每张参考图分别定义开场造型和四个城市对应的服装、场景、道具,其中第6张参考图是最高优先级的面部身份参考,所有造型都要保留这张图里的五官形状、间距、比例,不能做美颜处理,2到5号参考图只提供服装和环境,不能替换面部。

整个视频全程是同一个成年女性更换不同服装,黑白深度视频只提供身体动作、相机移动和时间线参考,深度亮度代表距离,不代表肤色或面部细节,最终要生成自然的全色彩,深度图里的无特征面部不能变成后脑勺,要根据场景参考图确定转头后脸部和胸部的朝向。

要求生成时长12秒的竖版连续视频,下方标注的分镜时间是输出内容的连续阶段,不是要求插入镜头切换,要保持原参考时间线的速度,不能压缩开场给城市部分腾出空间,只有模特在换装时旋转,相机不能绕着模特移动,背部视角只是旋转过程中的短暂朝向,不能成为停下后的定格姿势,每次换装完成后都要露出脸部和新服装的正面,和对应参考图一致,服装、手持道具、城市地图和城市名称UI要一起更换,不能只换背景不换之前的服装。

每个时间区间的具体要求:

0.00到2.50秒:白色影棚内是开场服装,模特看着放在胸前的手机,跟随深度视频的开场拉镜,躯干基本朝向镜头,保留原有的小幅手机和头部动作,这个区间内不做全身旋转,不出现定位标记、城市背景和换装。

2.50到3.15秒:红色定位标记出现在模特上方,只添加这个标记,模特继续在白色影棚看手机,还穿着开场服装,定位标记不触发旋转或场景变化,这里不开始换装。

3.15到4.05秒:跟随深度视频的小幅预备转向,之后回到朝向镜头的起始姿势,全程保留开场服装、白色背景和红色定位标记,4.05秒之前不出现巴黎地图和夏季服装。

4.05到6.00秒:4.05秒开始按照深度视频快速旋转换装,中途经过侧面、背部朝向时不停顿,大约4.25秒旋转过程中,一起换成巴黎对应的服装、饮品、墨镜、地图和导航UI,4.50秒完成旋转,露出朝向镜头的模特脸部和服装正面,4.50到6.00秒保持这个正面展示姿势,保持对应参考图里的饮品和墨镜姿势,原有开场服装被完全替换,展示巴黎阶段不保留原服装、手机,搜索栏和位置卡都显示「巴黎」。

6.00到8.00秒:6.00秒开始下一次旋转,大约6.25秒换成罗马对应的服装、道具、城市和UI,6.55秒完成旋转,露出正面的模特脸部和服装,保持对应参考图的姿势直到8.00秒,地名显示「罗马」,只有旋转过程中会出现背部朝向,旋转完成后不能停在背部视角。

8.00到10.00秒:8.00秒开始下一次旋转,大约8.25秒一起换成开罗对应的服装、道具、地图和UI,8.55秒露出正面的模特脸部和服装,保持正面展示姿势加自然小幅动作直到10.00秒,地名显示「开罗」,要保留开罗的服装和地图,不能提前出现悉尼的内容或者保留之前的服装。

10.00到12.00秒:10.00秒开始最后一次旋转,大约10.25秒换成悉尼对应的服装、道具、地图和UI,10.55秒完成旋转朝向镜头,保持对应参考图的姿势,直到12.00秒都保持这个正面展示姿势加自然小幅动作,地名显示「悉尼」,最后一次展示完成后不能再做旋转、换装。

全程都要保留模特的面部特征、自然身体比例、发型和刘海,换装不能改变脸部、年龄、体型、发色和发长,不能生成参考图的分块布局、多余人物、脸部特写或者保留深度图的灰度,脸部可见时必须是正常的脸部,不能保留参考图里的空白脸部,城市UI风格要保持一致,每次换城市都要更新两个位置标签,不需要生成语音或音乐,面部参考图只定义身份,不固定头部姿势,脸部朝向、表情、头部倾斜、手势和全身动作跟随深度视频,每个城市展示都要和对应参考图匹配,巴黎阶段墨镜要一直完整遮住双眼,罗马阶段换成对应参考图的配饰。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新