收益:
- 能够区分生产线中的哪些位置(创意、转录、粗剪、配音、发行)人工智能可以实时节省时间,以及哪些创意方向和出版审批留给人类,具体取决于任务风险级别
- 能够执行监控每个人工智能输出、检查其版权/许可以及在最终剪辑之前对其进行专业过滤的纪律。
- 能够在保密和版权范围内保护原始素材、品牌材料和客户数据,并养成选择安全车辆的习惯。
视频项目以一个想法的火花开始,以几周后发布的剪辑结束。一路上要做出数百个小决定:这个场景应该持续多少秒;这个场景应该持续多少秒;等等。应该使用哪种变形;音乐应该什么时候进入?字幕应该使用什么语言?标题应该是什么?我们有权发布这张图片吗?其中一些决定是重复的、机械的、耗时的——比如听一个三小时的采访并记录下最好的时刻。其中一些直接决定企业的精神、品牌的声誉或法律安全。人工智能(AI,简称AI——可以生成文本、图像和声音、识别模式、转录语音和总结内容的计算机系统)正好适合这幅图景:如果使用得当,它可以在几分钟而不是几小时内完成转录、粗剪和字幕;如果使用不当,它可以代表您播放受版权保护的音乐、捏造的细节或未经同意的面孔。
本模块的第一个单元不是软件介绍。其目的是阐明在生产流程中哪些地方应该放置人工智能,哪些地方根本不应该放置人工智能。因为视频业务既是“交付关键”又是“声誉关键”领域:交付迟了会失去客户;侵犯版权或误导性的部分将损害您的品牌多年。我们从一开始就摆出一个基本原则:人工智能是助手,而不是导演。创意方向、品牌声音、真实性和最终播出的剪辑的责任和批准由有能力的专业人士负责。
AI产线及场所
要理解视频作业,将管道分为三个阶段会很有帮助。前期制作是拍摄前的准备工作:创意、剧本、分镜、拍摄计划。制作就是实际拍摄:摄影、灯光、声音、表演。后期制作是拍摄后的处理:转录、剪辑、调色、声音、配音、字幕、标题、交付。人工智能涉及所有三个阶段;但每个人都有不同的权力。在前期制作中,人工智能产生想法和草稿;在生产中,这主要是人类的工作;它可以最大程度地节省后期制作的时间,但这也是需要最多验证的地方。
让我们从一开始就定义一些基本术语。粗剪是第一个镜头的大致顺序版本。转录是将语音转化为文字。 B 卷是支持主图像的补充镜头。元数据是描述性信息,例如视频的标题、描述和标签。许可证是确定您可以使用材料(音乐、图像、字体)的条件的许可。我们将在以下单元中一一解释这些概念;现在,请知道这一点:人工智能为您提供了所有这一切的蓝图和节奏,但它并不做出最终决定。
下表按任务总结了人工智能的作用和风险级别:
任务
人工智能的作用
风险等级
谁批准
转录/粗略字幕
转录员
低
编辑
想法/场景草案
头脑风暴伙伴
低中
编剧/导演
粗剪/选择时刻
建议生成器
中等
编辑
配音/声音克隆
声音发生器
高
制作人+声主同意
生成视频/深度伪造图像
图像生成器
非常高
制片人+法律+同意
最后剪辑即将发布
帮手从来都不是硬道理
非常高
导演/制片人
请记住这一点:随着风险的增加,人工智能的作用会缩小,而人类的同意和同意会增加。
为什么“验证”是这项业务的核心
人工智能工具似乎对它们产生的输出充满信心,但事实可能并非如此。在文本模型中,这称为幻觉:模型流畅地编造实际上并不存在的信息,就好像它是真实的一样。这在视频工具中也有对应的功能:转录工具可以“听到”未说出口的单词;图像增强器可能“添加”不存在的面部细节;生成视频可能会在帧之间产生不一致的手写或书写。一切都以同样的信心呈现。唯一区分对错的就是你的眼睛、耳朵和验证习惯。
验证规则包括三个步骤:
- 观看/收听和比较:将人工智能生成的文字记录、剪辑、字幕或音频与原始来源进行比较。将文本与声音相匹配,剪辑与变形相匹配,翻译与含义相匹配。
- 版权/许可控制:对于制作的每一个音乐、图像、字体和材料,“我有权在本作品中使用它吗?”问问题。明确商业使用许可、归属要求和同意状态。
- 创意和品牌过滤:专业测试输出是否符合品牌声音、目标受众和商业精神。陈词滥调、人为和误导在这里被消除。
注意:在未经验证或未将其交付给客户的情况下发布人工智能制作的剪辑或画外音就像播放未经批准的片段一样。仅仅因为输出看起来是流动的或“罐装的”,是不准确、不真实或不合法安全的。
版权与隐私:创意产业的两条火线
视频是版权最为紧张的领域之一。一个细分市场中可能有数十个权利持有者:音乐作曲家、库存图像提供商、字体设计师、图像中的人物。虽然人工智能工具可以加快工作速度,但它们可能会模糊这些界限:生成音乐工具的输出是否可用于商业用途?是模仿受版权保护的艺术家风格的图像制作者;克隆声音听起来像真人的声音吗?规则很简单:“人工智能制作”并不意味着“免版税和免费”。使用前验证每种材料的许可、商业使用权和同意状态。
隐私是第二道防线。未发布的客户项目的原始素材、脚本和品牌材料通常包含在保密协议 (NDA) 中。将这些材料加载到公共人工智能工具中意味着将它们移动到外部服务器,有时甚至移动到模型的训练数据。规则:除非必要,否则不要共享敏感材料;如果必须共享,请选择不在模型训练中使用您的数据的签约公司工具。匿名简报,而非“Famous X 品牌新品发布会”;仅分享您制作的一小部分,而不是整个原始素材。
三个迷你箱子
案例 1——安全使用。剪辑师会将 3 小时的采访制作成 8 分钟的视频。他将录音输入一个机构转录工具,该工具不在教育中使用其数据,并收到了时间编码的文本;他标记了文本中最有力的 12 条引言,并删除了粗剪部分。以前需要2天时间的“看-笔记-记-选”工作现在减少到半天。 AI转录并建议;剪辑师做出了叙事决定和最终剪辑。
案例2——版权陷阱。一位内容创作者从多产的音乐媒体中制作了一首“史诗电影”曲目,并将其用于品牌广告中。该工具的免费计划已停止用于商业用途,并且必须注明归属。该品牌在 YouTube 上收到版权声明,广告收入被冻结。错误:“人工智能产生了它,因此它是免费的”假设和未能阅读许可证。
案例 3——违反保密规定。一名制作助理将尚未公布的电影预告片的原始镜头上传到公共视频编辑网站,称这将“剪掉最好的时刻”。内容泄露,在社交媒体上流传,与工作室的关系也被切断。正确的方法:仅在合同规定的封闭环境中处理 NDA 涵盖的材料。
弱提示/强提示
弱提示:
为该视频找到一个好听的音乐和标题。
这种说法是错误的:无论是类型、持续时间、平台还是许可证限制都不清楚。人工智能产生的推荐是通用的,与品牌声音相反,其版权状况也不清楚。
强力提示:
您的角色:品牌内容编辑助理。项目:45秒Instagram Reels,可持续时尚品牌,语气平静安心。任务:1)为视频的前 3 秒建议 5 个替代的钩子句子。 2)每个标题不超过60个字符,低调、诚实; 3) 描述音乐的类型和节奏(例如“柔和的原声音乐,90 bpm”);不要建议特定的受版权保护的歌曲名称。4) 如果您不确定,请注明“不确定”。
在这个请求中,平台、时长、语气、品牌、字符限制和版权限制都明确。您仍然验证输出:标题是否诚实、音乐许可是否适当、音调是否适合品牌。
下表总结了本课中的一句话规则:
原则
这是什么意思
AI是助手
创作方向和最终剪辑都是人的
观看并比较
每个输出都与原始源匹配
“人工智能制作”≠“免版税”
许可、商业用途和同意均经过验证
除非必要,否则请勿分享
NDA 材料在封闭的合同工具中进行处理
常见错误
- 认为“人工智能产生了它,因此它是免费的”。许可证和商业使用权也必须经过验证。
- 将原材料/机密材料装载到敞篷车辆中。未发布的内容不应离开该机构。
- 无需监控即可交付输出。看起来流畅的切口是不受控制的切口。
- 未经同意使用面部/声音。类似于真人的制作需要同意和透明度。
- 将创意方向交给AI。人工智能建议;专业人士拥有语气、叙述和最终决定权。
提示:在每个人工智能会话中都包含一条简短的“规则线”:“不要推荐特定的受版权保护的作品标题;提及您不确定的地方;不要夸大或制造点击诱饵。”这一句话大大降低了版权和声誉风险。
总之
人工智能是视频制作中强大的加速器:它可以更快地准备转录、粗剪、字幕、画外音和标题。但创意方向、品牌声音、真实性以及最终播出的剪辑始终由个人决定。随着风险的增加,人工智能的作用变得越来越小。三个习惯是一切的基础:与原作比较、版权/许可控制以及保护机密材料。一旦您内化了这三个工具,该模块其余部分中的每个工具都将成为您的安全加速器。
应用任务
选择您自己的(或假设的)视频项目。将制作流程分为三个阶段(预制作、后期),并写在表格中,在每个阶段放置人工智能以及该任务的风险级别。然后使用上面的“强力提示”模板来获取标题和音乐流派建议;验证输出:标题是否诚实,音乐许可是否不清楚,是否符合品牌声音。用 5 项写下你的发现。
清单
- [ ] 我是否确定了任务的风险级别并定义了审批权限?
- [ ] 我是否验证了我使用的每种材料的许可和商业使用权?
- [ ] 我是否避免将未发布/机密材料上传到开放工具?
- [ ] 我是否将 AI 输出与原始来源(音频/视频/含义)进行了比较?
- [ ] 我是否将创意方向和最终剪辑责任分配给了人?