让 AI 写声画分离剪辑单:声音先到,与声音晚走是两种接法

前天 4阅读

剪两个场景时,AI写“自然过渡到下一幕”很难直接执行。可以让它把这句话拆成两张表:画面何时换,声音何时换。本文为原创短片设计两个六秒小样,交付精确到帧的剪辑单;这是一份制作方案,没有声称播放过成片。

让 AI 写声画分离剪辑单:声音先到,与声音晚走是两种接法

AI模型生成的概念插图:画面条与声音条表达独立剪接的想法;不是实拍、软件截图或可据以量取切点的精确时间线。

先把素材和时间坐标固定

素材甲是空房间,声音为低声读信;素材乙是车站,声音为进站提示。设两段都有足够的可用画面和声音,目标视频24帧每秒,共144帧,从0编号。用左闭右开的区间记法,例如[0,72)包含0到71帧,时长三秒。两种方案都在第72帧换到车站画面。

Adobe将J剪辑定义为下一场的声音先于画面进入;L剪辑则让上一场声音在画面切走以后继续。字母来自时间线外形,判断时看声音属于哪一场,比看图像是不是弯成字母更可靠。

让AI交两份真正不同的剪辑单

J版:甲画面[0,72),乙画面[72,144);甲声音[0,60),乙声音[60,144)。观众从第60帧听见车站,直到第72帧才看到它。声音提前12帧,即0.5秒。此版先采用直接换声,不额外叠加淡化,以便只比较切点。

L版:画面安排不变;甲声音[0,84),乙声音[84,144)。第72帧已经看到车站,读信声仍持续到第83帧,上一场的声音延后12帧离开。它可以形成“信里的话跟着人到了车站”的联想,但观众是否这样理解,必须看实际小样。

两版声音都完整覆盖144帧,却分别需要乙声84帧和甲声84帧。若素材中可用的读信声只有72帧,L版不能凭空拉长;应缩短延续量、换可用片段,或另行制作获准的声音。AI不能把不存在的尾音写进剪辑单。

核对表格之外,还要听两次

纸面验收有三项:每条轨道相邻区间首尾相接;每条轨道总长为144帧;J版60小于72,L版84大于72。本文已用整数帧脚本逐帧检查覆盖与时差,避免把末帧也重复算进下一段。

实际制作时先只看画面,确认同一切点;再闭眼听声音,检查句子是否被截断、底噪是否突变。最后声画一起播放。需要加交叉淡化时,另外记录淡化起止及重叠声音,不继续沿用“每刻只有一段声音”的检查规则。

可复制的提示词

“为原创空房读信镜头甲与车站镜头乙写J、L两版剪辑单。成片24fps、144帧、从0编号,区间左闭右开,画面统一在72换场。J版乙声从60开始,L版甲声到84结束,先不做淡化。列四条轨道区间、帧数、秒数和素材最低可用长度;逐帧检查缺口与重叠,解释声音归属。若读信声只有72帧,指出哪版需要重排。给实际试听步骤,不编造观看结果。”

这份任务让AI把叙事意图转成可复现的编辑参数。口型同步、对白内容和声音空间感仍须回到素材判断;切点正确,只说明方案被准确执行,还不能保证情绪成立。

参考资料

Adobe:Perform J cuts and L cuts

文章版权声明:除非注明,否则均为云鹊BLOG原创文章,转载或复制请以超链接形式并注明出处。