Browser Use 团队开源video-use AI视频剪辑工具(30 มิลลิวินาที)
video-use 是 Browser Use 团队开发的通过和 AI 对话来剪辑视频的工具。你只需把原始素材扔进文件夹,打开 Claude Code 然后输入你想要什么样的成品视频,最后就能得到 final.mp4 文件,全程没有需要你点击按钮的剪辑界面。
它能完成的工作包括:剪掉“呃”“啊”这些口误停顿,剪掉拍摄间隙的静音片段,给所有片段校色,在每个剪辑点给音频添加30毫秒的淡入淡出消除爆音,给视频嵌入字幕,还可以通过 HyperFrames、Remotion 或 Manim 给视频叠加动画。它会拆分出子代理同时处理动画部分。
我喜欢的一点是,它的 AI 处理思路是读取视频,而不是逐帧查看。它先用 ElevenLabs Scribe 转录音频,得到字词级时间戳,区分说话人,甚至还能识别笑声和掌声。然后把所有镜头汇总成一个大约12KB的文本文件给 AI 读取,只查看必须决策剪辑点对应的波形图和胶片条。团队计算过,如果把所有帧都发给 AI 查看,会消耗大约4500万 token。
另一个优点是它不会急着动手剪辑,它会先浏览完所有素材,给出剪辑方案让你批准。渲染完成后,它还会自行检查每个剪辑点,看看有没有画面卡顿、音频爆音或者字幕被遮挡,如果发现问题就会修正重新渲染,最多可以自动重渲染3次再给你看。所有内容都会记录在项目文件(md)中,下周回来就能继续做。
你只需要提前准备好 ffmpeg 和 ElevenLabs 的 API 密钥,可以搭配 Claude Code、Codex 以及其他能在本机运行命令的代理使用。这个仓库是 MIT 协议开源,在 GitHub 上已经获得了近27000颗星。
来源:GitHub 搜索 browser-use/video-use
#peesamac #ClaudeCode #BrowserUse #视频剪辑 #AI代理
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖