AI 自动剪辑视频之(三)

2026 年 9 月 12 日AI 教学

上一篇讲了让 AI 画图再让图动起来。这一篇讲另一条路,根本不画,直接上视频。

写之前先说个当天真实发生的误会,因为它太典型了,很多人都会撞上。

一、大模型只会造,不会找

那天我说了一句“不要图片生成的视频,我要真正的视频”,结果事情就拧了。

它回我说素材这件事它干不了,项目里一段视频素材都没有,也没法去把 WSBK 的转播画面抓下来,那是有版权的赛事信号,然后列了三条路给我选:给它文件夹路径,给它下载链接,或者干脆退回去用 AI 生成。

我当时挺懵的,心想找素材这种活儿,不是该交给火山那边的大模型去干吗。

后来才反应过来,“找素材”跟“生成素材”,压根就是两码事啊。

Seedance 能凭一句提示词造出一段赛车过弯的画面,那是它想象出来的,模型里没存过任何一段真实的比赛视频。而“上网搜一段真实的 WSBK 转播画面下载下来”,这件事没有哪个大模型能干,也不该干。转播信号有版权,人家那边盯得死死的,你抓下来剪进自己的片子,账号能不能保住都两说呢。

所以它说的没错,只不过它嘴里那个“素材”,说的全是实拍素材

而我说的“真正的视频”,要的是会动的画面,别再拿静图推来推去了。 一个词两种理解,愣是把我卡了十几分钟。

后来我把话说死才通:用文生视频,画面让模型生成,不需要实拍素材。这一句它就懂了。

二、实拍素材从哪儿来

排除掉“让 AI 上网找”这条根本不存在的路,实拍素材实际就三个来源。

头一个是你自己拍的、自己录的。 这个最好,你可别嫌它土。

我做的内容是 AI 写代码、一个人做产品这一类,真正有说服力的画面本来就是录屏,Claude Code 在跑,网页一点点做出来,最后在手机上打开的样子。这些我直播时天天在录,硬盘里堆了一大把,比 AI 生的图有说服力得多,还一分钱不花。

你做美食就拍你的锅,做门店就拍你的店,做育儿就拍你家娃的手。你手机相册里那些东西,AI 这辈子也画不出来。

第二个是素材站。 Pexels、Pixabay 这类站上有大把免费可商用的通用镜头,赛车、城市、办公室、咖啡,基本够用。缺点是同质化太严重,一看就是素材,观众刷多了眼熟。

第三个才是 AI 生成。 没有实拍素材,通用镜头又找不到对味的,那就让模型造。

三、自己的素材怎么接进流水线

这一步我做得很简单,简单到没原理可讲。

素材丢进项目的 assets 目录,然后在脚本里那一镜写清楚用哪个文件就行,具体字段写法我放在文末附录里了。

写 video 就直接用这段视频,写 image 就用这张图再加本地推拉摇移,流水线看到这两个字段就跳过生成那一步,直接拿你的东西用。

时长也不用你操心,素材比这一镜长它就自动裁掉,比这一镜短它就自动循环补齐,裁到哪一秒、循环几遍,全跟着配音走。

这条路零成本,画面还真。 我个人觉得对绝大多数做内容的人来说,这才该是主路,AI 生成顶多算个补充。

四、文生视频到底怎么用

说回 AI 生成这条。

我在流水线里加了个开关叫 t2v,干的事就是跳过生图,直接让 Seedance 每一镜出一段真视频,再拼起来。人和物真的在动,不再是静图在那儿推拉了。

用法上没什么门槛,跑的时候加一个参数的事,或者你直接跟 Claude Code 说一句“用真视频”,它自己就加上了。

要交代的是两个代价。

一个是钱。 Seedance 最短出五秒,两个镜头就按十秒计费,一条十秒的片子十几块。改一次文案重跑一次,钱就跟着重烧一次。所以脚本一定要先定稿,用免费档把节奏和字幕全确认完,最后才开这个开关。

另一个是连贯。 上一篇说过,文生视频每一镜都由模型独立想象,两镜之间不保证同一台车、同一个人、同一种光。

这个缺点得分场合看,你做赛车飞驰、城市空镜、氛围铺垫这一类,跳一点其实没人在意,观众不会真去比对第一镜和第二镜的车牌。你要做有人物有情节的叙事,那就必须回到图生视频那条路,先用参考图把人定死,再让它动起来。

五、四条路,我自己怎么选

写到这儿可以把两篇的东西并起来看了。

自己的素材放第一位,零成本,画面真,还带着你自己的味道,手上有就先用。没有实拍但要能发的画面,走 Seedream 生图加本地推拉摇移,几毛钱一条,口播类完全够。要人物在多个镜头里不变脸,走生图加图生视频,贵一些但连贯。只要氛围只要动感,不在乎镜头之间对不对得上,直接文生视频,最省事。

判断标准其实只有一句话:你这条片子里,观众到底在看什么。

看你说的那几句话,画面别难看就行,那就别烧钱。看的就是画面那股冲击力,那画面就是主角,该花的钱一分别省。

六、最后

这两篇写下来,我最想说的不是哪条路更好,而是你得知道自己在哪一档

我见过太多人一上来就冲最贵的那一档,做了三条片子,钱烧掉好几百,播放量三位数,然后得出个结论说 AI 做视频是骗人的。问题真不在 AI,在他压根没想清楚,那条片子里观众看的到底是什么。

我自己现在的顺序是这样,先想清楚要说什么,再想画面配什么,最后才轮到用哪个工具去弄那个画面。工具永远排在最后一位。

下次谁再跟你说他有一套让 AI 全自动做视频的独门方法,你就问他一句:素材从哪儿来。他要是答不上来,那套方法多半就是把方舟的接口包了一层壳,跟我这两篇里写的是同一个东西,而这东西我已经白送给你了。


AI 自动剪辑视频之(三) · 萧慕的博客