用不同AI生成视频,分享提升真实感的提示词原则
这个视频参考自@津軽 的作品。
左边的那个是我把原提示词稍微改了一下,用Seedance2.0生成的,效果已经很不错了。右边那个是我重新优化了提示词,用H3生成的。
下面说说提示词原则,要想让它真实,最重要的是4点。
- 首先是把个人主页想象成一个真实的墙体,头像的那个圆洞是墙上的一个窟窿,角色的所有行为都应该依照现实的物理规律和空间关系。
- 第二,无论用哪个模型,优先选择首尾帧模式,而不是智能参考模式。
- 第三,真实感来自于物理效果,提示词里每一段都严格要求了。
- 第四,尽量避免无中生有个人主页之外的元素。
prompt挺长,放到下面了。建议大家改一改,加入自己的创意。
15秒,竖屏 9:16。
以提供的个人主页截图作为视频的唯一视觉基础。输入截图本身从第一帧开始就完整铺满整个视频画面,四边贴合画面边缘,始终全屏显示,不留黑边,不留额外边框,不做缩放,不做平移,不做旋转,不做透视变化,不做重新构图。镜头全程完全固定。观众看到的始终是同一张被完整填充在视频中的个人主页截图。
不要重新设计页面,不要重绘成另一种界面风格。除人物和被人物直接作用到的文字之外,其他所有界面元素都保持原位。背景图、圆形头像框、图标、按钮外框、分割线、图片内容、黑色横向UI栏、底部导航等非文字视觉元素都必须保留,不允许自行变化。
将圆形头像中的成年男性作为唯一角色参照。角色必须让人一眼看出就是头像里的同一个男人。保持同一张脸、同一发型、同一发色、同一肤色、同一年龄感、同一真人照片质感。不要卡通化,不要二次元化,不要3D化,不要换人。上半身服装必须严格延续头像中实际可见的上衣,颜色、款式、领口、材质感都保持一致。头像中看不到的下半身,不允许自由发挥,固定补全为蓝色牛仔裤。鞋子简洁低调。整个视频中不允许换装。
【0.0~2.8秒】
画面完全静止,整个个人主页截图保持不动。只有圆形头像内部的人开始动。男人先看一眼圆形边缘,露出“洞口太小”的明确表情:眉头轻微皱起,嘴巴轻闭,表情认真而吃力。然后他用双手撑住头像圆框的左右边缘,开始用力往外挤。动作必须明确分步骤发生,不要一下子直接钻出来:
第1步:先把头和一侧肩膀艰难地挤出圆框,动作缓慢而费力。
第2步:停顿不到0.2秒,再继续把另一侧肩膀和胸口挤出来。
第3步:双臂向外撑,腰部和上半身继续向外拖出。
第4步:下半身这时才逐渐显现,并且必须自然补全为蓝色牛仔裤。
第5步:最后把双腿也完全从头像里拖出来。
整个“挤出来”的过程必须清楚表现出空间狭小、身体被卡住、必须用力才能出来的感觉。人物的脸部表情始终是“认真用力、略带窘迫但有喜剧感”,不是夸张鬼脸,不要突然大笑。头像圆框本身不变形、不破裂、不移动,仍然留在原位。
【2.8~3.8秒】
男人完整脱离头像后,立刻低头看向下方那条黑色横向UI栏,判断那里可以落脚。然后他双膝微弯,双臂自然打开保持平衡,从头像位置向下跳,准确落到中部的黑色横向UI栏上,把黑色横向UI栏明确当作地面。
落地必须有清楚的重量感:双脚先触地,膝盖轻微缓冲,身体轻轻下沉,再迅速站稳。
落地瞬间,黑色横向UI栏先轻微下压,再轻微回弹;与此同时,整个界面里的其他UI元素同步发生一次短暂、轻微、统一的震动:昵称、数字、标签、按钮、文字、内容卡片都一起小幅抖动一下,然后立刻恢复稳定。注意,这是UI元素被震了一下,不是镜头抖动,不是页面扭曲,不是整体缩放。
【3.8~9.2秒】
男人站稳在黑色横向UI栏上,把它当作一条窄地面。他先抬头看向黑条上方的那些文字,脸上露出“准备搞点恶作剧”的表情:嘴角轻微上扬,眼神集中。然后他用右手掏出一把手枪。枪只有一把,不要重复生成。
接下来,他开始逐段清理黑条上方区域中的文字。可被清理的对象是页面上的可读文字和数字,例如昵称、身份描述、IP信息、关注/粉丝/获赞数字、简介文案、链接文字、标签文字、按钮里的字、分区栏文字等。只允许清理“文字与数字”,不允许误伤图片、头像、图标、按钮轮廓和其他非文字元素。
每一次射击都严格遵循同样的动作顺序,不要简化:
1. 男人先用手枪明确瞄准某一段文字;
2. 表情专注,手臂稳定;
3. 开一枪;
4. 被击中的那一小段文字先在击中点出现裂纹;
5. 裂纹迅速扩散到这个字符或这一小段字符;
6. 文字随后碎裂成大小不一的实体碎片;
7. 大碎片向下掉落,小碎屑短暂飞散后也向下坠落;
8. 一部分碎片可落到黑色横向UI栏上,发生轻微碰撞、弹跳、滑落,再掉出画面;
9. 原来那段文字所在位置留下真实、干净、明确的空白。
不要让文字一下子凭空消失,不要做成魔法消散,不要做成廉价粒子爆炸,不要做成科幻能量特效。效果必须像真实附着在界面上的脆性字层,被子弹打裂、打碎、脱落。相邻但没有直接被击中的文字可以轻微震一下,但不能自己消失。
在这个阶段,男人连续进行多次相同动作,把黑色横向UI栏上方的大部分文字逐段清掉。节奏明确、连贯、干脆。每次开枪后,男人的动作都要回到站姿,再重新瞄准下一处,不要无规律乱扫射。随着几次射击,黑条上方逐渐形成一大片明显的空白区域。
【9.2~10.8秒】
男人继续补枪,专门清理零散残留的文字,直到黑色横向UI栏上方出现足够完整、清楚、可用的一块空白区域。这块空白区域必须明显位于黑条上方。不要把整个页面所有内容都清空;下方内容区、底部导航和其他未被处理的视觉部分仍然存在。
确认清理完成后,男人放低枪口,左右看一眼这块空白区域,露出“差不多了”的满意表情,然后后退半步,双脚在黑条上站稳,身体转向空白区域正面,准备开始“写字”。
【10.8~12.6秒】
这是最关键的段落,必须严格执行,不允许自由发挥。
男人站在黑色横向UI栏上,面向黑条上方那块空白区域,右手持枪,快速、清楚地连续开4枪。总共只能是4次主射击,每一枪对应打出一个完整的汉字,顺序固定,不能打错,不能多枪乱补,不能把四个字混在一起生成。
第1枪:打出“请”
第2枪:打出“看”
第3枪:打出“下”
第4枪:打出“集”
这4枪必须按从左到右的顺序依次完成。每打一枪,就在空白区域中形成一个完整、清晰、稳定的白色大字。不是普通字幕浮现,不是打字机效果,不是笔写效果,而是“开枪后,这个字被清楚地打出来”。四枪的节奏要快、准、干脆,有明显的“砰、砰、砰、砰”连续动作感,但画面表达仍要清楚,让人看得见每一枪对应哪个字。
最终形成的4个白色大字必须准确无误地显示为:
请看下集
必须保证:
- 只能是这4个字
- 顺序不能错
- 不能缺字
- 不能多字
- 不能乱码
- 不能繁简混乱
- 不能出现其他无关文本
这4个字要足够大、足够亮、足够清楚,位于黑色横向UI栏上方那块空白区域的中央位置,整体易读、醒目。
【12.6~15.0秒】
四个字全部打完后,男人放下手枪,站在黑色横向UI栏上,先转头看一眼“请看下集”,确认成果,然后再慢慢回头看向镜头。此时表情必须明确:嘴角微微扬起,眼神里带一点得意和顽皮,像恶作剧成功后的满意神情。不要夸张大笑,不要张大嘴,不要做过火表演。
最后约0.8秒保持稳定收尾,人物不再做大动作。结尾构图必须同时清楚包含以下三项:
1. 站在黑色横向UI栏上的男人;
2. 黑条上方完整、清晰、醒目的4个白色大字“请看下集”;
3. 仍然完整铺满整个视频画面的原始个人主页截图界面。
【全局强约束】
- 输入的个人主页截图始终完整铺满整个视频画面,始终全屏,不缩放,不平移,不旋转,不重构。
- 镜头全程固定。
- 角色只有头像中的这个成年男性,不能新增其他人物。
- 角色必须保持真人外观,不变成卡通、二次元、3D角色。
- 上衣严格延续头像中可见的上衣;下装固定为蓝色牛仔裤;全程不换装。
- 角色从头像中出来时,必须表现出“圆形头像太小,所以要费力挤出来”的动作逻辑,不能轻松一步跨出。
- 落到黑色横向UI栏时,必须出现一次明确但轻微的UI联动震动。
- 黑色横向UI栏必须被当作地面使用。
- 只允许清理文字和数字,不允许破坏非文字UI元素。
- 每次击中文字,都必须有真实的局部裂纹、碎裂、脱落、掉落、碰撞和重力效果。
- 最终必须在黑条上方形成一块空白区域。
- 最终新增的文字只能是“请看下集”。
- “请看下集”必须通过快速连续4枪,一枪一个字,按“请→看→下→集”的顺序打出来。
- 不要加入旁白、对白、气泡字幕、额外说明文字、额外logo。
- 不要出现血腥内容,不要伤害人物,射击对象仅限界面文字。