MiniMax H3生成短剧分段衔接问题可通过这个工具解决
做AI生成短剧时,MiniMax H3单次最多生成15秒,需要分段生成再拼接,很多人不知道怎么让衔接不突兀。eternityspring推荐使用ComfyUI-H3-Motion-Context方案,该项目提供了可直接使用的工作流示例。
常见做法是将上一段的最后一帧用作图生视频的输入。但静态图片不包含运动信息,模型只能猜测人物的移动方向和速度,因此拼接处经常出现卡顿或者动作突变。
Motion Context的做法是,把上一段最后22帧(约0.92秒)固定在新生成段落的开头,生成过程中这些帧保持不变。模型能直接看到真实的运动信息,不需要从单张图片猜测。
画面和声音都直接从上一段的潜在空间(latent)中裁剪,不需要先解码成视频再重新编码,因此每次拼接不会损失画质。
生成完成后,用Trim节点剪掉开头的22帧,两段就可以直接首尾拼接,不需要添加转场。逐帧检查可以发现,拼接前后角色的姿势、位置、表情都完全匹配。
该方法最关键的提示词要求是:下一段开头先描述上一段的结束状态,保证同一个角色、同样的景别、同样的动作保持一两秒,再写入新的剧情内容。
按照这个方法生成30秒的功夫熊猫视频,不特意说明的话,没人能看出来是两段生成拼接而成的。项目地址: