短视频怎么用 AI 一键剪辑
上周三晚上十一点,同事往群里丢了八段手机拍的素材,说明天上午要一条六十秒的门店探店视频。我对着空白时间线坐了十分钟没动手,最后靠剪映的智能成片熬到一点半交了差,也顺手摸清这条路上 AI 到底能替我干到哪一步。 先说我的判断:从一堆素材到一条有节奏的粗剪,AI 现在真能交活,八段素材压成两分钟的时间线,我掐表是十四分钟。剩下那些细活,一首音乐对不对、一句口播卡不卡点,还得自己听。 粗剪我一般直接开 剪映 的「智能成片」。素材全选丢进去,挑一个跟内容调性接近的模板,它自己选镜头、卡节奏、铺转场,出来就是一条能过审的片子。手机端也能跑,出门在外应急够用。 它的毛病也明显。模板出来的东西一眼能看出是模板,转场和字幕样式满屏都撞,做多了你会发现自己的片子跟别人的越来越像。另外智能成片挑镜头只看画面好不好看,你说的叙事逻辑它不知道,产品细节经常被跳过去,我每次都得手动把关键镜头拖回来。所以我的用法是让它出第一版,然后自己拖时间线改顺序,从不直接导出。 踩点是另一个省时间的地方。音乐轨上右键「自动踩点」,它按鼓点打标记,你跟着标记切镜头就行。这招对鼓点清晰的音乐很管用,对纯口播、没有节奏的素材基本没用,硬用会让画面切得莫名其妙。我现在只在有音乐的片头十五秒用卡点,正文老老实实按说话节奏切。 字幕不用手打。剪映的「智能字幕」识别普通话准确率够高,出来之后通读一遍改错字,五分钟的片子大概三分钟改完。专业名词、品牌名、人名是重灾区,我习惯先在稿子里把这些词统一成一个写法再识别,能少改一半。 横屏素材要发竖屏,我会用它的「画面跟随」,让主体自动留在画面中间,比手动打关键帧快得多。碰到主体移动很快的镜头它跟丢,这种我干脆手动裁,别跟它较劲。 去重这步我固定做四处。片头三秒换一个画面,音乐换一首,字幕换个位置和字体,画面色温和裁切比例各调一点。四处都动完,平台的重复检测基本过得去。只改标题就发是最容易被判重复的,我见过同事这么干被限流。 素材不够的时候我会用生成镜头补空。要实拍感的空镜,我用 可灵AI 出几段,输入画面描述加运动方向,一段几秒的镜头够补一个转场。要人物出镜讲一段话,我用 海螺AI视频 生成带动作的片段,比拿静态图撑时长自然一些。 这俩的共同问题是抽卡。同一句提示词跑五次,能用的可能就一两条,人物手指、走路姿态最容易崩,镜头时长也短,长镜头别指望。生成要消耗积分,具体额度和套餐以 App 内为准。我的习惯是把提示词写细一点,景别、光线、运动方向都写进去,比反复重抽省时间。 需要数字人口播的,我用过 HeyGen 做过一次内部培训视频。它适合字幕式讲解、知识口播这类,人物形象稳定,换个语种能直接出对应口型。不适合要实拍细节的内容,产品特写、现场画面这种,数字人一上场反而显得假。中文口型的自然度不如英文,长句念起来有点僵,我把稿子拆成十来个字一句之后好很多。价格和可商用范围看官网当前说明。 片头三秒我单独说一下。别从 logo 动画开始,直接上素材里信息量最大的那个画面,比如产品出锅的一瞬、店门口的人流。AI 给的第一版片头多半是慢镜头加转场,我基本都删掉重做。 转场我用得越来越少。花哨的推拉转场在手机上反而显廉价,现在默认硬切,只在时间跳跃的地方加一个闪白。这条是审美判断,AI 帮不了你。 导出我固定设成 1080P、30 帧,码率用默认的高档就行。除非客户点名要 4K,不然口播类视频上传平台一样会被压,4K 白占体积。导出前一定完整放一遍,重点听字幕跟口播有没有错位,识别错一句整段就对不上。 耗时的实话:一条六十秒的片子,从拿到素材到导出,我现在稳定在四十分钟上下,其中二十分钟花在改镜头顺序和听节奏上。素材本身拍得乱、前后不连贯,AI 也救不回来。 更多工具见 AI 视频工具。 你手上那条片子卡在哪一步了?如果卡在「素材一堆不知道从哪下刀」,先跑一次智能成片,然后只做「把关键镜头拖回来」这一件事,看看能不能省下二十分钟。