}

文 丨 阑夕

就在月初,Seedance 2.5、MiniMax H3、Wan 3.0三款国产模型的撞车发布,又把AI视频的热度推上了一个新层级。

其实视频模型开启倍速发展的这半年多以来,AI生成一段以假乱真的几十秒画面已经不是问题了,平时上网冲浪强度稍微高一点的人,就不会对「卧槽,这是AI?」的画面感到陌生。

AI在未来势必能愈发广泛地接入影视工业,这是趋势也是共识,只不过眼下随着赛道越来越拥挤,新的问题也逐渐浮上水面,以致于到了不容忽视的地步。

对于专业创作者和团队而言,一部长视频有太多需要考虑的地方,比如要如何统一人物一致性、视觉素材和分镜设计等管线,文生视频、图生视频的老路子在大项目里又有怎样的局限性,视频模型的不受控又是如何让抽卡成本骤增的......

所以不意外的是,随着模型本身的能力越来越强,连同工具类市场的热度也在水涨船高。

只是过去这半年来,工具的迭代并没有太多新意可言,大家都在接入更强模型,都在做画布,都在优化素材流转,到最后似乎只剩下了价格可以卷,这显然不是创作者们想看到的。

直到一向低调务实的updream今天整了个大活,正式上线的「预演台」功能非常值得单独拿出来说一说。

原因是它没有继续沿着「把提示词写得更复杂」这条路走,而是把传统影视里的Previs工作流接进了AI视频创作:先把空间、机位、人物走位和镜头运动预演出来,再交给模型生成。

传统影视从业者想必已经很熟悉Previs了,在昂贵的影视制作流程里,它可以实现先验证空间和调度再进入正式制作,是一个相当必要的中间层环节。

也就是说,但凡涉及到复杂动作戏、大场面和特效镜头,通常都要先用相对低成本的方式,把镜头、场景、人物走位和机位运动搭出来,让所有人知道这场戏到底怎么运转,再进入正式制作。

updream释放的明确信号是,AI视频现在也到了需要这层「预演」的时候。

注意啊,这倒不是updream一家的判断,Seedance 2.5的官方文档里就已经明确强化了白模参考能力,用户可以用无纹理3D模型搭出画面的雏形,再让模型参考这些结构生成视频,利好创作者的意图很明显。

只不过建模技能向来门槛颇高,想要从零到上手,短则得学几个月,长则一年起步,对于寸秒寸金的AI行业来说,时间就是一切。

所以我认为updream预演台的最大亮点,就在于把这套原本需要建模经验和专业软件支撑的门槛降了下来。

具体来看,updream在画布里把这件事拆成了更接近创作现场的几个步骤。

先上传一张静态场景图,updream的预演台会先把它解析成3D白模场景,让模型可以精准理解分镜中的深度、遮挡、比例和可运动空间等等,这些概念都是很难单纯通过提示词来描述清楚的。

接着,创作者可以在这个3D空间里设置虚拟摄像机机位、运动轨迹,也可以安排人物走位,推、拉、摇、移、跟这些过去需要写进提示词里的镜头语言,在这里变成了可以直接调整的空间动作。

这一步很关键。

因为创作者脑子里的镜头,本来就是运动、立体、有先后顺序的,如若把它翻译成文字会带来极高的信息损耗。

但白模不同,先预演、再生成的次序,相当于把「我要怎么拍」这件事从抽象语言变成了具体参照。

最后,白模视频可以一键录制,再回到画布里作为参考素材进入生成流程。

短短三步,就把过去只属于专业团队和大项目的Previs环节,搬进了方寸之间的画布里。

这倒不是说updream可以就此取代专业3D软件了,要我说,现阶段所有承诺「一键出大片」的工具产品都是非蠢即坏的,影视创作本身就是个费时费力的活,起码就目前的技术水平来说,能走的捷径并不多。

但有了快速空间预演能力之后,创作者确实可以从专业制作链条里抽身出来,把更多精力放在其他地方,而不是一遍遍抽卡,苦恼AI为什么总是理解不了自己的想法。

这对个人创作者和小团队尤其重要。

AI视频的普及,在表面上降低了生成门槛,但只要进入稍微复杂一点的镜头就不灵了,两个人在同一空间里交错走位,摄影机还要跟随其中一人绕过前景障碍,问题就开始变多,人物可能漂移,背景可能变形,机位可能突然切掉,原本要保持的空间方向也可能中途翻转。

就像我做的这条致敬韦斯·安德森的视频:

懂行的人可能一眼就能看出来,这个看似简单的分镜,如果放在对话框里,可能得写出一份堪比「永乐大典」的提示词,而且效果还未必很好。

但靠着updream的预演台,我只用了不到30分钟……

第二个案例,是测试预演台多机位切换的镜头连贯性:

可以看到,视频中的武士从街头走到街尾,中间完全没有出现任何空间错乱、前后不一致等问题,要知道放在以前,这是AI视频穿帮的重灾区,这意味着只要补足白模预演环节,通过分镜来提升叙事感已经不再是什么难事了。

最后一个案例,考验的是在一镜到底且完全不同的画风里,白模预演是否仍然能生效,完成度同样在90分以上:

看完这些,你大概就能得到一个很清晰的答案了,那就是提示词,本质上并不是一种导演语言。

文字可以描述镜头,却很难锁死镜头;图片可以定义画面,却定义不了时间;视频可以提供运动参考,却要求先拥有一段足够接近目标的素材。

这就是我为什么觉得updream预演台不应该被简单理解成一个「降低抽卡次数」的工具,降低抽卡当然重要,尤其是现在高质量视频模型的生成成本并不低,但如果只讲省钱,还是低估了它。

更深一层的变化在于,updream把创作意图前置了,过去大伙习惯了生成以后再修修补补,发现空间不对、运镜不对、人物站位不对,就只能改提示词、换参考图。

现在则完全可以先在白模里验证镜头,看空间能不能成立,机位路径是否合理,人物走位是否和叙事节奏对得上,精准实现导演的所思所想。

或者说,工具的本质,就是降低创作者和视频模型之间的沟通摩擦,而有了updream的预演台,创作者终于可以用更接近传统影视和现实世界的方式和模型沟通了。

不知不觉,我们已经跟着国产视频模型的爆发,来到了一个新的阶段。

如果说视频模型早期最迷人的地方,是它让很多没有专业训练的人也能获得某种影像表达能力,把创作工具从少数人手里解放了出来,也让大量普通用户第一次感受到模型的魅力。

那么如今,海量工具就是在将不可控的部分一点点变少,放大创作者的判断、审美和经验,在影视化这更高的山、更长的河面前,重新让人类回到主导位置。

updream也在配合预演台上线「千万积分预演台挑战赛」,在为期一个月的时间里,把作品投到两大创作赛道里,有机会获得流量扶持与曝光资源,如果足够优秀,还能拿到上万元的积分奖励。

毕竟未来的视频生成能力只会越来越便宜,越来越普及,最终真正拉开差距的,还是一个创作者能不能把镜头想清楚、设计清楚,再让工具帮他稳定地实现出来。

还是那句话,从未有过一个时代像今天这般,给予才华最丰厚的奖励,给予平庸最严厉的惩罚。

AI视频的猎奇时代已经过去了,接下来,势必会有越来越多的人开始深刻意识到:

AI可以替你生成画面,但它无法替你当导演。