开发者重构开源AI手绘视频自动化生成系统
之前开源具有的10种风格 AI 手绘视频自动化系统,又被我重构了一轮,更像是一条可以在本地 24 小时持续跑的 AI 视频生产线 先放项目: GitHub: 之前的版本已经可以做到: · 上传 10–30 秒参考声音 · 粘贴一段文案 · 选择画面风格 然后自动完成: 声音克隆 → 分镜拆解 → 插画生成 → 白板绘制 → 字幕 → 渲染 → 成片 今天我又补了一大堆东西 这次主要更新了 7 个方向: 1. 第 11 种画面风格 新增「纸感隐喻拼贴风」 系统会根据文案结构,从本地 10 张参考图里自动选择构图,同时重新适配了深色、霓虹类画面的渲染效果 2. 人物和画风终于可以自己定了 新增「自定义参考」页面 现在可以直接上传: · 1 张风格参考图 · 最多 5 个角色 · 每个角色 1–3 张参考图 尽可能保证整条视频里人物和画风的一致性。 3. 成片控制进一步开放 现在可以: · 给任务命名 · 选择 4 档线条绘制量 · 开关重点文字 · 开关字幕 重点文字没有继续让图片模型硬生成,而是改成本地准确叠字,主要就是为了解决 AI 生成中文容易乱码的问题 4. 任务可以真正“复用”了 新增完整历史记录 任务失败后可以从断点继续,成片也可以直接换设置重新渲染。 最重要的是: 原来的配音和分镜会直接复用 也就是说重新渲染时,不需要再重复消耗 GPT、图片生成和 TTS 调用 5. 后端并发架构重做 之前是每个任务一个独立线程,现在改成了三级队列: · 最多 2 路语音任务 · 最多 4 路模型调用 · 渲染阶段立即执行 任务元数据也全部持久化 哪怕后端重启,之前没有跑完的任务也会自动恢复 6. 支持局域网多电脑协作 现在多台电脑可以共享: · 任务队列 · 实时进度 · 历史记录 同时会显示任务来源 IP 每个浏览器自己的制作偏好又是独立保存的,所以几个人同时使用也不会互相覆盖设置 7. 整个前端重新做了一遍 新增: · 标准制作 / 自定义参考切换 · 实时队列状态 · 每个阶段耗时 · 完整历史任务区 品牌和交互也基本重新设计了一遍 我自己的方案目前还是: 本地 TTS + Codex Image 接口 + 本地电脑渲染 一台电脑就可以一直跑 如果手里有 20x 这类账号,图片生成这块的产能基本也不用太担心 代码我还是全部开源了,能放的基本都放出来了 不过提前提醒一句: 小白真的不要看到开源就直接一顿乱跑 这套东西已经涉及本地模型、并发队列、图片接口、TTS、FFmpeg、渲染环境和局域网服务 环境没搞明白之前,先看文档 别视频没做出来,先把自己电脑环境搞炸了 功能演示👇 如果觉得有用,可以帮忙转发关注一下 也欢迎直接 Fork,拿去魔改
优质ai创作者看过来
回复一些问题: 1)我跑这个东西的机子差不多20w左右(同时也跑了一些别的东西) 2)并不是存粹的codex就可以跑了,涉及到一些部署问题,小白用起来可以去学习 3)这个是搞量的,个人玩玩就好,数据在国内还算可以,主要是推产品好用,自然流打透就好