网友实测gpt-6 Astra生成Blender文生视频,参考角色可减少白模问题
网友@YuanA41755085最新测试了gpt-6 Astra操作Blender生成文生视频。测试显示,如果直接用文本生成视频,模型相似度太高的话很容易生成只有轮廓的白模。
如果生成过程中加入参考角色,效果会好很多。本次测试需要生成一条15秒、宽高比16:9的写实悬疑电影片段,名为《最后一秒》。
生成要求以动态白模视频作为动作、人物站位、场景空间、摄影机运动和剪辑节奏的主要参考,保留五个镜头,目标切点为第3、6、9、12秒,各镜头事件顺序与参考一致。
浅灰色人形对应女人定妆图,深灰色人形对应男人定妆图。地下通道的材质、色彩和灯光参考场景风格图,保留白模中的门洞尺寸、走廊方向与按钮位置。
不同时间段有对应的镜头要求:0–3秒,女人向正在下降的安全闸门奔跑,摄影机从背后跟随,男人在门内右侧接应;3–6秒,切到男人按住按钮的中近景,闸门停在半开位置,男人回头招手说“快”,女人开始俯身;6–9秒,切到低机位侧面镜头,女人低头弯膝,用两个低姿步完整钻过闸门,后脚进入安全区,男人持续按住按钮;9–12秒,切到安全区内的双人中景,女人起身退开,男人确认她通过后松开按钮并后退,闸门继续下降;12–15秒,切到正对闸门的固定镜头,两人的肩背分列左右前景,闸门落地,短暂停顿后门外传来猛烈撞击,门板轻颤,两人同时惊缩,警戒地望着门。
画面要求为冷灰色地下通道,门内暖色应急灯,真实皮肤、布料和金属质感,动作有重量,脚掌落地明确,人物保持一致,保留白模中主要遮挡、人物运动方向和门板运动时序,无新增人物,无字幕,无标志。声音需要包含脚步、喘息、按钮、电机、闸门落地和一次撞门声。
本次测试直接展示了文生视频当前会出现的问题,提示词可以在原发布的评论区查看。