收益:
- 能够理解基于文本的编辑、场景检测和自动粗剪的逻辑并创建初稿
- 能够使用人工智能作为助手来选择最佳时刻、清理填充声音并获得节奏建议
- 理解人工智能建议的剪辑可能会错过叙事流程、情感和连续性错误,并且最终剪辑属于剪辑师
剪辑是视频制作的核心。根据相同的原始素材,一个剪辑师可以创建一个无聊的视频,另一个剪辑师可以创建一个令人惊叹的故事。不同之处在于选择哪个时刻、何时何地剪辑以及如何建立节奏。在传统小说中,存在一个障碍:了解材料。观看几个小时的镜头并找到、记录和整理最佳时刻需要花费几天的时间。人工智能从根本上加快了第一步——识别材料并得出一个粗略的初始序列。但小说的灵魂,即叙事和情感,仍然是人物。在本单元中,我们将了解如何使用人工智能作为编辑助手以及您可以在哪里进行控制。
条款。粗剪是第一个、粗略排序的镜头版本;微调前的骨架。精剪是指节奏、切点、转场都经过精心调整。基于文本的编辑是一种在脚本文本上编辑视频的方法:当您从文本中删除句子时,相关图像也会被剪切。场景检测自动将视频划分为场景/镜头。填充音是语音间隙,例如“嗯”、“嗯”、“所以”。跳切是通过跳过同一镜头中的某个部分而发生的跳切。 B 卷是覆盖主图像的补充镜头。
文本小说:最大的加速
人工智能给小说带来的最具体的创新就是基于文本的小说。该工具首先转录视频;您编辑文本,而不是视频。如果您不喜欢某个句子,可以将其从文本中删除,视频将自动剪切。无需花费数小时寻找某人最有力的三个句子,只需阅读文本并对其进行标记即可。这是一个巨大的速度增益,尤其是对于语音较多的内容(采访、播客视频、教程、视频博客)。人工智能可以自动查找并清理填充音(“eee”、“uh”)和重复音;你只要确认一下。
您的角色:编辑助理。以下是采访的时间编码记录(12 分钟)。任务:1) 选择演讲者的 8 个最强时刻;给出每个片段的时间码、引用和“为什么它如此强大”(单句话)。2) 突出显示重复或偏离主题的部分。3) 按照建议的顺序排列 8 个时刻,以实现 3 分钟的流畅剪辑; 简要写下您的排名理由。注意:不要断章取义;建议一个不完整的句子。
这个提示让AI去做“选择和排序”的工作;但最终决定权在你。建议的顺序是一个开始;你建立叙事逻辑、情感弧线和实际流程。
叙事的节奏、连续性和人性化部分
人工智能可以选择一个“统计上良好”的片段:突出显示说话最清晰、能量最高、包含关键词最多的时刻。但小说的真正艺术远不止于此。节奏:场景什么时候应该加速,什么时候应该呼吸?情绪曲线:观众应该在哪里笑,在哪里停顿?叙事逻辑:信息揭示的顺序是否正确?连续性:一个场景中的玻璃杯是满的,而下一个场景中的玻璃杯是空的吗?视线方向是否一致?人工智能常常会忽略这些微妙之处。例如,基于文本的编辑在剪切句子时可能会在图像中留下令人不安的跳切;或者他可以连续选择两个“最佳时刻”,并将它们之间的过渡跳到观众身上。
下表总结了小说中的作品共享:
编辑任务
人工智能的贡献
男人的决定
识别/搜索材料
转录、搜索、标记
—
第一选择(最佳时刻)
候选人建议
哪个时刻、哪个顺序?
填充声音消除
自动查找
批准、自然性检查
粗略排序
建议订单
叙事和情感弧线
节奏和切点
有限
全人类
连续性检查
弱
全人类
最终切割批准
无
全人类
幕后花絮和剪辑建议
通过阅读文字记录,人工智能可以说“这里的幕后花絮会很好”,并就在哪里放置什么样的辅助镜头提出建议。例如,在描述“步行穿过城市”的部分中,他建议了城市景观。这加快了装配进度。但有两个注意事项:首先,您可以控制推荐的 B 片是否确实存在(或者可以免版税使用)。其次,过多的幕后花絮,或者在每个句子上都撒满镜头,会使视频变得混乱。蒙太奇是一种强调的手段;它被放置在正确的位置,而不是到处。
三个迷你箱子
案例 1 — 快速安排面试。编辑会根据 50 分钟的专家访谈创建 6 分钟的摘要。通过基于文本的编辑,他阅读了文字记录,标记了 10 个最有力的句子,清理了填充声音,并进行了粗剪。然后他根据叙事逻辑重新设计了序列,在过渡中添加了幕后花絮。原来需要两天的工作,现在减少到一个下午;创意决定权仍由编辑决定。
情况 2 — 连续性错误。一位剪辑师没有遵循人工智能建议的粗剪,而是改用了细剪。人工智能并列了两个“最佳时刻”;但在第一个剪辑中,演讲者穿着夹克,在第二个剪辑中,他没有穿夹克(拍摄于不同时间)。观众注意到了跳跃,视频看起来很业余。教训:AI 部分知道叙述,但看不到连续性;监控至关重要。
案例 3 — 断章取义的引用。一名社交媒体编辑将人工智能断章取义的一句“引人注目”的句子记录下来。说话者实际上是在批评一种观点;该组织将他描绘成捍卫这一观点的人。演讲者反对,剪辑被删除。教训:人工智能说“强”的那一刻应该通过上下文来验证。
弱提示/强提示
弱提示:
缩短这次采访,省略最好的部分。
“最佳”是未定义的,没有持续时间,没有上下文警告。输出是随机的,与上下文无关。
强力提示:
您的角色:编辑助理。目标:从50分钟的采访中剪辑出5分钟,讲述一个主要思想(X)。 任务:1)选择8-10个服务于主要思想的时刻(X);时间码 + 每个引述。2) 用一句话总结每个引述的上下文;不要做出破坏环境的选择。 3)建立情感曲线:建议强烈的开放、发展、强烈的结束。 4) 标记存在连续性风险的连续切口(不同的衣服/位置)。
常见错误
- 不看粗剪就继续。连续性和节奏错误只有在观看时才能看到。
- 断章取义地使用引号。 “引人注目”的时刻可能会扭曲对方想说的话。
- 忽略跳切。从文本中删除的一句话会在图像中留下斑点;与 B 卷或转场重叠。
- 极端的 B 卷。在每个句子中散布图像会分散叙述的注意力;蒙太奇用于强调。
- 把节奏留给AI。呼吸、停顿和节奏是人们的决定。
提示:粗剪出来后,请调低音量观看一次视频,将视频静音,然后再观看一次。关闭声音观看可以发现连续性和节奏错误;聆听关闭的图像可以揭示叙事流程。
注意:在基于文本的小说中,删除句子很容易,但呼吸/停顿也可以删除。通过语音控制截止点,保持自然的说话节奏。
总之
作为编辑助理,AI 在素材识别和初始选择阶段做出了最大的贡献:基于文本的文字编辑、填充音消除和“最佳时刻”建议将工作时间缩短为数小时。但剪辑的艺术——节奏、情感弧线、叙事逻辑和连续性——仍然取决于人。人工智能可能会破坏上下文、留下跳接、看不到连续性错误。这就是为什么总是对粗剪进行跟踪,引用在上下文中进行验证,最终剪辑带有编辑的签名。人工智能加速发展;你讲故事。
应用任务
录制对话录音(采访、您自己的叙述,8-10 分钟)。从成绩单中标记出 6 个最精彩的时刻,并进行粗略排名。然后按照这个顺序两次:一次关闭声音(连续性/节奏),一次关闭图片(叙述)。记下并修复您发现的每个跳接、连续性错误和上下文问题。解释初始排序和最终排序之间的差异。
清单
- [ ] 我是否在分别关闭音频和视频的情况下观看粗剪?
- [ ] 我是否验证了每条引文的上下文以确保没有扭曲含义?
- [ ] 我能找到跳接和连续性错误并通过转场/B-roll 修复它们吗?
- [ ] 我是否有意识地建立了节奏和情绪曲线(开放-发展-结束)?
- [ ] 我是否保留了最终的切割决定和责任?