大家好,我是冷逸。
AI 视频创作的门槛,真的要彻底降为 0 了。
给大家看一下我用LibTV Agent + Skill,10分钟全自动生成的王家卫风格的电影短片。
不光是王家卫的电影风格,还有这个岩井俊二风格的校园 MV 也是被我轻松拿捏。
大家觉得,这两支短片的效果怎么样?
照以前的做法,这两段视频背后,至少得手动创建两套特别复杂的画布,才能把人物、场景、叙事控制好,就像这样。
![]()
但这次,画布里没有任何一个节点是我手动创建的。
我只进行了简单的对话,建节点、连线、填提示词、生成资产和最终合成,都由右侧的 Agent 在画布里继续往下跑。
这也是 LibTV 这次更新最让我兴奋的地方:Agent 终于进了视频画布。
下面拆开给大家看,它到底是怎么把片子做完的。
![]()
一手测评
1)Agent 进了画布,MV 是这么跑出来的
这次 LibTV 更新了之后,新建一个空白画布,右侧直接就是 Agent。以前要在画布里完成的所有操作,现在可以直接在这里完成。
![]()
输入框下方有一个 Skill 入口。打开 Skill ,我们可以看到各种官方已经准备好的 Skill 列表,点击右上角“全部”。
![]()
然后,你就会发现打开了一个新世界的大门。
![]()
这是官方提供的 Skill 广场,专业影视、商业广告、短剧漫剧、动漫游戏等,都已经帮你做好了分类。
从此以后你想做任何类型的视频,都可以在这里直接找到对应的 Skill 了。
比如,我们随便打开一个 Skill。
![]()
你会发现,详情页里会展示这个 Skill 的成品视频样片。并且会写清楚这个 Skill 适合拍什么、需要哪些素材,以及最后会交付什么。
更实用的是,有的 Skill 左上角还会有一个“创作详情”的按钮。
![]()
点进去以后,官方样片背后的角色图、场景、分段视频、BGM、字幕和合成节点,全都能看到。
![]()
所以今后,在这里调用任何一个 Skill 之前,都可以先看看它究竟打算怎么拍。
以这个夏日MV为例,我选的是“岩井俊二电影美学” Skill。
![]()
我在Agent对话框内,选择了这个Skill,然后上传了一首我用 AI 生成的《夏日课桌》的音乐。没有给他非常详细的描述和限制,直接一句话让他帮我生成一个MV,看看会发生什么。
![]()
任务提交后,它并没有急着直接生视频。而是把他不确定的信息向我进行了提问。
![]()
问题包括时长、执行模式、画幅、语言字幕、核心元素、故事大纲等等他的不确定因素。
![]()
依次回复之后。接下来,它就开启了全自动模式。
它先分析音频,再生成故事大纲、moodboard、男女主角模卡、教室与走廊场景图,最后写入锚点清单和分镜表。
这些都准备好以后,Agent 就开始自动生成视频了。
![]()
也就刷会儿短视频的功夫,画布上已经创建了非常丰富的节点和元素了。
等到所有的视频片段生成完毕。接着,Agent 就会自己生成一个合成节点,把所有生成好的视频素材自动剪辑合成好,发布到画布上,得到最终文章开头的那个 MV。
![]()
这么一通操作下来,最省心的地方,是我完全不需要再去画布里逐个创建和连接节点、添加素材、编写提示词等等了。审美预设、资产准备、视频生成和最终合成,都由 Agent 自己接着往下做。
2)一个 Skill,背后是一套完整的拍法
如果说《夏日课桌》的任务相对简单。那接下来,我给 LibTV Agent 上了一个更有挑战的任务,看看它能不能独立完成专业影视级别的电影片段。
大家在文章开头看到的那个,王家卫风格的电影,就是这个 Skill 做的。
![]()
点击右上角的按钮:添加 Skill ,就可以直接使用了。
我依然只输入了一句话:
请帮我制作一部王家卫风格的电影。
Skill 加载完成后,依然是先通过问题向我把需求补齐。
剧本从哪里来、有没有角色参考、要不要内心独白、字幕用什么语言、分辨率、画幅、成片时长,一项一项跟我确认。
![]()
我选的是:让 Agent 根据一句话扩写故事、没有人脸参考、内心独白跟随剧本、简体中文字幕、720P、16:9、45 秒,分成 3 段。
然后,它又继续追问了故事想法和主角设定。我只确定了亚洲男性,故事仍然让它自己写。
最后,Agent 给出了一版名为《过期》的故事概念,并且把故事分成了3段15s的剧情:深夜便利店、雨夜街巷电话亭、逼仄公寓楼梯间。
![]()
然后向我确认,觉得如何?
我是觉得挺不错,就这个了,开拍吧!
接着,Agent 自己创作并保存了锚点清单和分镜表。
![]()
![]()
角色也不是随便抽一张。它先给了 4 套男主造型,我选了“皮夹克、乱发、墨镜”的这个。
![]()
然后他再自己生成了男主的三视图。
![]()
三视图的锚点确认了之后,又同时生成了 3 个场景的影调图。每个各出了 4 张,并让我逐一选择确认。
![]()
所有的场景锚点确认后,agent又继续帮我生成了完整的3段分镜表。
![]()
所有资产确认后,就开始自动生成每一段视频了,别看那么多步骤,其实整个过程执行的非常快。
只有在有需要你抉择的地方,它才会停下来等你确认。
![]()
三段全部确认后,Agent 又自己生成了 BGM,分别给 3 段加上简体中文字幕,最后合成为一支 45 秒、1280×720、16:9 的电影成片。
![]()
项目跑完以后,我又切了一遍“故事板”和“工作流”。
![]()
《过期》故事板视图
故事板会把文本、图片和视频分区摆好,锚点、分镜、角色参考和最终成片可以集中查看。
![]()
《过期》工作流视图
工作流更适合回到具体节点,定位是哪一段、哪张图出了问题。
从一句话到剧本、角色、场景、三段视频、BGM、字幕和成片,这些任务都由 Agent 在同一条工作流里继续往下调度。
再看一遍最终效果吧。
说实话,我挺满意的。冷暖撞色、雨夜霓虹、逼仄空间和人物状态,都真正落到了成片里,王家卫的味道很明显。
45 秒电影可以靠 Agent 自己执行全流程到这个程序,我已经觉得很不错了。
3)自己的方法,也能装进 Agent
官方 Skill 是别人整理好的拍法。那自己的方法,能不能也放进去呢?
lengyi-shotlist是我之前在 GitHub 上开源的一套分镜 Skill。
而这次 LibTV 不仅支持把对话过程直接转为 Skill ,还支持创建自定义 Skill,我试着把这套分镜方法装了进去。
只需要在 Agent 对话窗口点击 Skill。
![]()
再点击右上角的创建按钮,创建自定义 Skill。
![]()
在创建页,填好必要的名称、简介和使用场景等,再把 SKILL.md 放进去就行。
![]()
点击保存后,它会出现在“我的 Skill”里。
这里有个小细节:在 LibTV Agent 里,创建的 Skill 名称是有长度 12 个字限制的,所以像我的 lengyi-shotlist 这种偏长的英文名字,就会写不下。建议大家直接写上中文名称就行,也更方便后续在库里调用和查找。
![]()
回到项目画布,点开 Agent 右下角的 Skill,在“我的”里就能找到它。
![]()
到这里,只是装好了。它能不能真按这套方法出片呢,要看下面的实测。
这次我选了一个很小的亲情故事。
《未接来电》 深夜办公室,一个 28 岁的女策划在赶方案。妈妈连续打来两次电话,她都按掉了。凌晨下班后,她站在公司门口回拨,没人接。过了一会儿,手机收到一条语音:“没事,就是想听听你的声音。”
我选中刚建好的 Skill,把剧情、比例、时长和风格一次写清楚。
![]()
Agent 先提取了 6 个叙事节拍,然后把剧情拆成了 9 个分镜。接着建立了 4 个锚点:女主、深夜办公室、凌晨公司走廊,以及手机来电界面。
它同时生成了两份文件。一份是锚点清单,记录每个主体对应的资产节点;另一份是分镜表,写清楚 9 个镜头的时间、内容、景别和引用资产。
![]()
锚点文件写入资产节点
![]()
《未接来电》9镜分镜表
这一步我觉得很重要。
Agent 没有急着给我一张看起来很厉害的图。它先把后面容易漂的东西钉住了。女主固定成齐耳短发、灰色针织毛衣、黑色长裤;办公室固定冷白荧光灯和屏幕蓝光;走廊则换成凌晨的昏黄灯光。
接下来,它把 9 镜分成两批。先并行生成 S1 到 S5,前 5 镜全部完成后,又自动接着生成 S6 到 S9。
![]()
前 5 镜成功后自动生成后 4 镜
4)做完以后,继续用嘴改
9 个分镜一次性跑通了,但因为我在skill里设定了时间只有 8-15s,所以在实际的剧情里,有的台词和过渡被 Agent 自动帮我剪辑掉了。
于是,我又根据叙事节奏,让 Agent 帮我重新调整了每个片段的时长。
![]()
最终得到了一支 40 秒版本的短片。成片如下:
![]()
这 3 支片子实测下来,我觉得 LibTV 这次最有意思的变化,就是终于可以在画布上口喷做视频了。
以前做一支片,要先学会创建节点、填提示词、连线和检查素材。有了 LibTV Agent 之后,我大部分时间都留在对话框里:告诉它要拍什么,看结果,哪里不对再让它改。
它还会在不确定的地方向你追问确认,如果生成失败也会自动重试。
我们只需要在一些关键画面、声音和叙事节奏上,进行判断把关就好了。
画布终于不用从学习工具开始了。
从此以后,你可以只专注于把任务说清楚,剩下的那些操作工具的事,让 Agent 替你执行。
现在 LibTV Agent 已经正式开放,感兴趣的朋友可以体验。体验完回来评论区聊聊,你觉得效果如何。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.