上周我写了,文章发出去之后,后台一直有人在问同一类问题:H3和Seedance2.0到底选哪个?结果次日,Seedance 2.5都出来了,讨论似乎被终结了?不过呢,还是值得聊聊的,尤其是今天Seedance2.5 API 开放后,LibTV第一时间接了进来,要测试很容易(看来我这个LibTV会员的含金量还在提升)。
开测前先说一个数字:Seedance2.5这次的价格是0.4元一秒,一条30秒的片子也就12块钱。这个数字对我的意义很实际——以前测视频模型,我是写完prompt默念两遍才舍得点生成的,错一条肉疼半天;这次是真的敞开用,反正错了就框住那几秒重拍,很爽。另外说一句很多人关心的:LibTV是火山引擎的官方合作伙伴,模型从官方API接入,每一条生成都能查到taskid,怀疑跑的是不是满血版的,拿taskid就能对上号。
![]()
今天为了写这篇文章,我在LibTV上做了十多次完整测试,从零参考直出、白模驱动到超长视频挨个过了一遍,烧掉两万多积分。求个点赞不过分吧
先回答两个模型选择题的问题...其实呢,这俩模型你都可以直接在LibTV里用上,同一块画布上切个下拉框的事,所以成年人何必做选择。
简单对比的话,H3单段上限15秒、清晰度最高2K,是性价比路线;Seedance 2.5单段30秒、最多吃50个参考素材(30图+10视频+10音频),长叙事和素材密集的活是它的主场。我还拿同一段15秒剧本、同样4个参考素材让两边各出过一条:H3画质确实更锐,但一旦剧本里涉及到「城市向上卷曲对折」这种超现实设定,它只还我一条楼微微歪了歪的写实街景,2.5则全部执行到位。一句话,目前是H3目前赢清晰度,2.5赢指令遵从程度。15秒内的单镜头、预算敏感,选H3;要完整叙事、要多素材、要改得动,选2.5。
![]()
这篇主要讲后者,以及一个更少人讲清楚的问题:LibTV围着这个模型做了些什么。
一、先说说Seedance2.5 提示词的最佳实践
为了搞清楚2.5该怎么用好,我把字节Seed官方的发布博客从头读了一遍,把里面每一段官方prompt都抄下来对照成片看。值得抄的有三个。
第一,时间戳要直接写进prompt。官方每条案例都是「0-5秒怎么样、5-12秒怎么样」的结构,每段同时交代两件事:镜头怎么动,主体做什么。你写「一只猫在街上走过四季」它只能自由发挥,你写「0-8秒猫沿屋脊小跑、8-12秒钻过床单出来已是夏天」,它就真的按这个节拍走。
第二,参考素材要定向引用。2.5最多吃50个参考,但官方案例里每个素材都带着明确的分工声明:这条视频只管时间轴和运镜,这张图只管主体造型,那张图只管色调光影。最关键的是要写清不继承什么。你不写「不从这条参考继承光线和场景」,模型会把参考里的一切都端过来。
第三,它真的能听懂长指令了。我这次的prompt都是四五百字起步,每一秒的画面和镜头都有交代,夜里跑的几条片子全部一次出片、零重抽。作为对比,去年5月我用Veo 3测体操动作(人体的快速空中动作最容易穿帮),四张卡抽出来张张有问题,那时候249美金一个月的会员一天还只有5次抽卡额度。一年多过去,抽卡这个词在2.5这里开始变得不太准确了,官方说抽卡成功率比2.0提升明显,我实测下来确实有体感。
我拿同一组输入让2.0和2.5各出了一条:一张街头参考图,加同一段prompt
生成一段使用iPhone第一视角走在巴黎街头拍摄的短片,那是一个艳阳高照天气极其出色的好天气。拍摄过程中街上有许多行人,部分片段里有小孩临时挡住去路导致拍摄者要绕行,以及有人和拍摄者打招呼的画面。
左边2.5,右边2.0:
2.5从头到尾都在塞纳河边同一片街区里流转,行人、临时挡路的小孩、跟镜头打招呼的路人,都按prompt的点位出现,整条看下来就是一个人举着手机边走边拍的散步视频;2.0走着走着突然切到了另一条不那么「巴黎」的巷子里跟小孩相遇,结尾的镜头移动也有点奇怪,一眼就露了「这是生成的」的馅。而且2.5这条就是一次直出,没挑没抽——这次测下来我的体感是,基本一次就中。
这三条合起来,你大概就能理解现在写视频prompt是什么感觉了:以前像许愿,现在是在写分镜表。
二、实测一:零参考图直出30秒,错了7秒只重拍7秒
先考模型本体。这一条我一张参考图都不给,只喂一段500字的剧本直出30秒,考的是三件事:长指令和时间戳分镜的服从性、六次场景切换还保不保得住一镜到底、以及没有参考图垫底时它自己的美学想象力。
剧本是一场不可能的换乘:0-4秒战斗机驾驶舱穿云,4-8秒穿进一团浓云、出来四周变成翻动的巨大书页,8-13秒钻出书页跟上一把飞天扫帚掠过中世纪古堡,13-18秒扎进深海穿过鲸骨拱廊和老式潜艇,18-23秒冲出海面变成无人机穿过黄昏的城市楼缝,23-28秒撞进一块屏幕跌入8bit像素世界,最后两秒所有载具变成微缩模型,静静排在一个纯黑展台上。每段都写清了镜头怎么动、色温是什么、穿越遮挡的瞬间在哪。
![]()
出片30秒,一次过。驾驶舱的暖金逆光、书页漩涡里剥离的铅字、暮紫色天空下的古堡尖顶群、鲸骨的肋骨拱廊、潜艇探照灯的锥形光柱,六段全部执行,色温按剧本一路演进,几次穿越转场都没断。结尾那个展台也做出来了,刚才还在天上水里的载具,全变成手办大小排成一排。
![]()
但有一段我不满意:18-23秒无人机穿城,楼是一排整整齐齐的方盒子,建筑不够写实,城市布局也太无聊,跟前后几段的密度不在一个档上。
放在以前这就是重抽的命,为了5秒钱重出30秒,而且原本满意的25秒大概率又变样。LibTV的片段重拍是另一个逻辑:框选出问题的时间段,只重生成那一段,替换回原片。我框了16-23秒,写了一句话:
调整为更真实的纽约城市的景观,建筑细节更丰富,更错落有致,让无人机的第一视角快速从这个城市中穿过。
![]()
几分钟后新的7秒回来了:无人机贴地穿行在真实的纽约街道峡谷里,砖石立面、消防梯、街口驶过的出租车,远处能认出克莱斯勒大厦的尖顶。重拍前后对比:
![]()
我把两版放进了同一个画面里同步播:左边直出版,右边重拍版。前16秒两边一模一样,播到16-23秒左右两侧会分别亮起红框和绿框,把重拍区间标出来——那7秒里左边还是方盒子,右边已经是真实纽约了:
这7秒只花了重出整条四分之一不到的钱。更关键的是接缝:色系、音效、运动速度都对得上,潜艇段和像素段一帧没动。以前抽卡的逻辑是错一处赔整条,现在是哪里不对改哪里。
三、实测二:30秒一镜到底穿过三部诺兰电影
模型本体过关了,接下来测参考素材怎么用。我出了道大题:30秒一镜到底,第一人称飞行视角,连续穿过三个世界——向上对折的巴黎街道(盗梦空间)、无限延伸的图书墙峡谷(星际穿越)、逆向倒卷的巨浪和倒吸回去的爆炸(信条)。
素材侧我用Seedream 5.0现生成了6张参考图,挂参考的时候每张只声明「继承材质与光线,不继承构图与机位」,运镜交给一条现成的飞行视角视频管。
出片30秒,一次过。折叠的巴黎复刻度很高,街道连车带楼向上卷曲对折,行人剪影站在暖金逆光里;书架峡谷俯冲时旧书布纹和烫金书脊飞速后掠;最后冲进海岸上空,青绿色浪筒逆向倒卷,废楼的爆炸拖着尘云往爆心收,连悬空回吸的汽车都有。三段色温还按prompt从暖金到暖褐到冷灰蓝自然演进。
![]()
这条片子约10分钟出片。同样的东西放在半年前,大概是剪辑师和特效师一周的工作量。
四、实测三:拿乐高水平的白模,换一条巴黎追车
参考图能锁住质感和造型,但有一样东西它锁不住:运镜和调度。镜头什么时候切、两台车怎么走位、行人几时散开,这些用文字描述总是隔靴搔痒——你写「警车漂移过弯」,它漂在哪个弯、从哪个机位看,全靠模型脑补。
专业的解法LibTV也给了:它有个Blender插件,在Blender里搭好3D白模动画,一键导出直接成片。白模就是没有材质的灰模型,影视和游戏行业拿它排调度用的,相当于立体的分镜表。
![]()
问题是我不会Blender。所以我干了件自己更擅长的事:让AI写了一个生成白模视频的skill,几行Three.js代码把几何块渲成20秒视频——顺便给Seedance 2.5上点强度,看看它认不认这种乐高水平的东西。
我的白模长这样:红色方块代表摩托车,蓝色方块代表警车,白灰色的盒子是巴黎的街和楼,圆柱加球就是行人。简陋归简陋,二十秒里排了六个镜头:迎面怼拍、追尾跟拍绕报刊摊、街角看压弯和警车漂移甩尾、窄巷贴墙、巷口拉升、最后路口正上方俯瞰摩托从两辆横穿车的缝里钻过去。行人会在车到之前散开,横穿车流和摩托的时机差了半秒。
质感的部分交给两张现生成的图:一辆黑色运动摩托带骑手、一辆巴黎涂装的POLICE警车,还是纯灰背景零环境那套原则。然后一条prompt把分工写死:运镜、切换节奏、追逐轨迹听白模的,红色方块就是摩托、蓝色方块就是警车,造型材质听两张图的,场景是黄昏入夜的巴黎湿街。
![]()
出片放在白模下面,你可以逐个镜头对着看:
镜头对比如下
![]()
六次镜头切换一次没丢,切换时间和白模基本对齐;那个连车灯都没有的红方块,出来是蓝调时刻的巴黎湿街上拖着警灯反光的摩托;街角那格连巴黎的蓝色路牌都自己长出来了。白模里我排的调度细节:行人退避、警车换道、路口穿缝,都被翻译成了实拍语言。
这个玩法我觉得对视频生成行业来说非常重要:分镜表不一定要写成文字,可以直接拍给它看。会Blender的用Blender,不会的像我这样让AI写几行代码渲一段方块,Seedance 2.5都认。
五、实测四:110字剧本,素材它自己挑
Seedance 2.5的50个参考位,手动其实很难排满。一个素材要写清它是什么角色、继承什么、不继承什么,昨晚我挂3个素材写了两三百字声明,今天早上又试了把12个素材全手工挂满,挂素材加写声明花了22分钟,写到第8条的时候已经要回头数哪段用哪张了,30个素材纯手写,我觉得根本不可行。
LibTV给的答案是AutoLink:素材挂上,剧本一贴,引用自动插进prompt的正确位置。
这次我换了个测法:把剧本压到110字,看素材能不能把一条片子撑起来。创意是一个女歌手在演唱会开场前的三十秒,从化妆间被导演叫走,穿过后台走廊,走进十万人的体育场,坐到场地中心的钢琴前,落键开唱。
备料只有四张图,全部现生成:女歌手、化妆间、追光下的钢琴、体育场全景。
然后是视频prompt的全文,一共110字:
30秒一镜到底手持跟拍,真实演唱会纪录片质感。前20秒:化妆间里导演喊开场,女歌手起身,镜头跟她穿过走廊,与工作人员击掌、接过耳返,幕布拉开,十万人的欢呼和手机星海扑面而来。后10秒:她走到场地中心追光下的三角钢琴前坐下,落键开唱,镜头缓缓升起拉远至整座体育场,定格。
高级设置里打开「智能引用AutoLink」,把这段贴进去,四张图的引用就被自动插到了剧本的对应位置,化妆间的图接在「化妆间」后面,女歌手的图接在「女歌手」后面。我一个@都没打。
![]()
![]()
成片出来我反复看了几遍:
化妆镜的灯泡串是暖黄的,墙上贴着节目流程表,这些都是从化妆间那张图里继承来的;她起身穿过走廊,光变成冷蓝,工作人员帮她戴耳返;幕布拉开那一秒,全片的光换了世界,十万人的手机星海铺到看台顶;最后镜头从琴键升起来,拉到整座体育场只剩中央一个亮点。低马尾、红唇、亮片裙,从化妆间到钢琴前没有变过。
六、实测五:60字,换一支一分钟的邮轮广告片
用AI视频做商业级的广告片,今年已经是很常见的场景了。Seedance 2.5现在的可控程度,加上LibTV的超长成片能力,做一支一分钟的广告片我觉得是绰绰有余的,正好拿一个我自己念念不忘的东西验证一下。
上个月我坐了趟加勒比海的邮轮,到现在后劲都还挺大,估计下半年还要去刷一波。所以我把题目出成:给这艘邮轮做一支全球航线的宣传片。
交给它的东西少到有点不好意思:一张邮轮参考图,加一段60字的prompt:
生成这个邮轮的广告片,需要包含这个邮轮在全球10个不同港口停靠,乘客在享受不同城市风情的场景,涉及冰川、欧洲古城、加勒比海盗、非洲沙漠等不同的丰富场景!
![]()
选超长视频档,61秒,剩下的复杂度平台全部自己吃掉了。点开「查看生成」能看到它的干活现场:它自主调用Agent,先给十来个目的地各生成了一张场景参考图——里约的基督像、京都的樱花街巷、迪拜帆船酒店、北欧峡湾的极光、撒哈拉的驼队——再拆成十二个分段、每段写好分段提示词,分头生成,最后用智能剪辑拼成一分钟的成片。整个过程我没有插过一次手。这个设计对新手是真友好,做长片的复杂度平台留给了自己,交到你手上的直接是结果。
![]()
结果我又被打动了一次。那艘邮轮在冰川、古城、海岛的每一个场景里都维持了完全的一致性,跨十几个分段没有变过样;更让我意外的是,很多城市子片段里还有多个镜头的切换剪辑,远景进近景、再切到乘客视角,是很成熟的导演处理。这完全是一句话出了一支有剪辑意识的成片。
七、没灵感的时候,去拆一支你喜欢的广告
实测写完了,还有一个功能值得单独说。后台常见的一类留言是:模型是很强,但我拿到它不知道做什么,也不知道怎么做。
导演课里对这件事有个标准答案,叫拉片:找一支成熟的作品,逐镜头拆,记录它的景别、机位、节奏,以及每个镜头在叙事里承担什么。影视生的镜头感就是这么一支支拆出来的,认真拆一支片子要一两个小时。
LibTV把这门功课做成了产品功能,叫逐帧拉片,而且是免费的,不花积分。丢一支视频进去,勾选拆解维度(分镜、动态、音乐),点开始就行。
![]()
我丢进去的是保时捷911 GT3的一支广告(A Drive Like No Other)。拆出来10个分镜,按叙事归成三组:开篇隧道出发、航拍俯冲建立世界观;中段低空跟拍、多机位快切穿林过弯;结尾隧道剪影正对拉什莫尔山定格。每个分镜都标了景别、机位和它在叙事里承担什么,另拆出3段可以直接当运镜参考的切片和一条30秒的BGM。
![]()
光拆完还不算,我把这条链路走到了头:拆出来的分镜图和运镜切片整组挂进视频节点当参考,再加两张我自己的图——一辆蓝色概念超跑、一片火星风格的红岩地貌,prompt里把分工写清楚:分镜图和切片只继承拍摄分镜和构图风格,不继承车辆和地貌材质;超跑图只管车的完整样式、材质、颜色;红岩图只管地貌场景的风格。
![]()
出来的就是这条。保时捷那套镜头骨架原封不动——黑暗隧道里亮着灯冲出来、航拍盘山公路、侧面跟拍、第一视角冲刺——但车已经换成了那辆蓝色超跑,盘山路搬到了火星:
等于免费拆走一支顶级广告的导演功力,再让2.5照着这副骨架,给你换上自己的血肉。不知道做什么的时候,先去看别人做了什么,这在哪个行当都成立。
Seedance 2.5已经在LibTV上线。活动期间720P限时58折、低至0.4元/秒,最高赠送60条免费生成。MiniMax H3目前也有会员专享6折,两个都想试的话,这几天是成本最低的窗口。
![]()
入口:
https://www.liblib.tv/
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.