收益:
- 了解人工智能支持的遮罩(动态观察)、对象去除、放大和噪声去除工具
- 能够在人工智能的支持下准备和修改颜色分级和声音清理草稿
- 能够理解自动改进可以捏造细节(伪影)以及纪录片/新闻内容中扭曲现实的道德极限。
剪辑完成后,视频的“叙事”已经准备就绪,但尚未经过“视觉和听觉”的打磨。最后的抛光阶段(颜色、音频清理、效果和增强)是将视频从业余爱好者提升为专业人士的层。传统上,其中大部分都需要专业知识和时间:手动遮蔽以从框架中擦除对象,精细的声音制作以消除采访中的嗡嗡声。人工智能既加速了这些任务的速度,又降低了专业知识的门槛。但增强工具有一个独特的危险:它们有时会“弥补”不存在的细节。在本单元中,我们将讨论权力和现实的极限。
条款。遮罩/动态观察是通过逐帧分离来选择对象(要替换背景,请删除对象)。对象删除是指从图像中删除不需要的元素(电话、徽标、人物)并填充背景。分辨率提升是将低分辨率图像提升到更高分辨率。降噪是为了减少图像中的噪声或音频中的嗡嗡声。色彩分级是通过调整图像的颜色和色调特征来营造气氛。伪影是在细化过程中引入的人为的、不需要的扭曲或捏造的细节。
人工智能驱动的视觉效果
过去编辑需要几天时间才能完成的工作现在只需要几分钟。自动遮罩可以将人物与背景分开,无需绿屏。对象删除可以从画面中删除垃圾桶、麦克风或不需要的人,并智能地填充背景。背景变化和运动跟踪已基本实现自动化。这些都是真正的生产力飞跃。但结果永远不会被盲目接受:在物体去除时,背景可能会留下“鬼”痕迹;遮蔽可能会在头发和边缘处闪烁;填充区域可能与周围组织不相容。每个效果帧都必须在全屏和运动状态下进行检查。
颜色和声音:自动启动,人工打磨
在色彩校正中,人工智能可以自动校正白平衡并均衡曝光,甚至建议“电影外观”。这是一个很好的起点,但颜色也是一种表达工具:冷色调传达紧张感,暖色调传达亲密感。让这个创造性的决定自然而然地削弱了视频的情感。人工智能实现平等;你创造气氛。
如今,人工智能在声音净化方面的作用非常强大:它可以在一定程度上减少背景嗡嗡声、空调噪音、回声,甚至风声;它可以突出对话。但过度清洁会使声音低沉、不自然,就像“在水下”一样; “s”和“t”等声音可能会失真(伪音)。规则:用耳朵检查清洁情况,并保持适度。目的不是使声音变得枯燥,而是使其自然且易于理解。
下表按目的和风险总结了修复工具:
交易
人工智能贡献
主要风险
控制
物体移除
自动填充
鬼影、纹理不匹配
动画全屏观看
升级
分辨率增加
人造细节,人造脸
与原版比较
去噪(图像)
减少刺痛感
极致软化,塑料质感
细节损失控制
声音清洁
减少嗡嗡声/回声
低沉的、人造的声音、伪影
凭耳朵,适量
色彩编辑
自动同步
目光平淡,没有感情
创意基调的决定权掌握在人类手中
现实限制:当改进不道德时
这是最关键的概念。分辨率增强和噪声消除工具可以弥补现实中不存在的细节。当锐化一张模糊的脸时,放大器可以“产生”实际上并不存在的面部特征——一张看起来像那个人但又不是他们的脸。这可能不是虚构或审美内容的问题;但在新闻、纪录片、法医和自称真实的内容中扭曲现实是不道德的。 “澄清”安全摄像头图像并读取车牌实际上可能是在读取模型制作的车牌。规则很明确:允许降噪和锐化;但改变内容、言语或实际细节的含义会产生误导。
注意:纪录片和新闻内容的改进应仅限于“使现有的东西更加可见”。 “添加不存在的东西”(面部细节、车牌、文字)会误导观众并破坏职业信心。如有疑问,请保留原件并注明干扰。
三个迷你箱子
案例 1 — 快速清理。一位纪录片导演在户外拍摄采访时遭受了风和交通噪音的影响。通过声音净化,人工智能减少了嗡嗡声并强调了语音;他用耳朵检查了结果并确保没有任何伪影。无需重新拍摄,采访已保存。车辆消除了声音;编辑保持自发性。
案例 2 — 假升级器。一个团队通过放大档案中的低分辨率面部图像来“澄清”它,并将其用于纪录片中。后来人们了解到,那张清晰的脸的特征实际上并不属于那个人,而是由模特化妆而成的。这部纪录片的可靠性受到质疑。教训:在声称真实的面部/细节上,放大结果不能被视为真实。
情况 3 — 过度清洁。一位编辑非常积极地清理了播客的音频,使其变得“完美”。结果是低沉的、水下的、人造的。听众表示声音令人不安。正确的做法是保持清洁剂量,并通过耳朵多次比较。
弱提示/强提示
音频/视频工具大多是按钮操作的,但您也可以让文本助理创建工作流程计划。
愿望薄弱:
修复和优化音频和视频。
“最佳”没有定义;哪种程序、哪种剂量、哪种控制尚不清楚。
强烈的愿望:
您的角色:后期制作工作流程顾问。素材:户外采访拍摄;风声呼啸,图像略有噪点,背景中有不需要的迹象。任务:逐步写出改进计划。每一步:目的、剂量警告和控制方法。限制:这是一部纪录片;不要提出会改变现实的干预措施,只建议使存在的事物可见/可听的操作。
常见错误
- 不观看运动中的效果帧。重影和闪烁仅在播放时可见。
- 过度噪音清洁。当剂量超过时,声音变得沙哑、不自然;出现伪影。
- 误认为放大输出是真实的。可以贴合模型脸部/细节;它不能用来宣称现实。
- 将颜色保留为自动。色彩是一种表达方式;情感决定属于人。
- 纪录片改变现实。添加不存在的内容是一种误导,也是一种职业违规。
提示:增强时,请始终保留原始内容并进行“之前/之后”比较。一个小小的改进往往比重大干预更自然、更安全。
总之
在视觉效果、色彩和声音增强方面,人工智能降低了专业门槛,将工作时间缩短到几分钟:自动遮蔽、物体去除、声音净化和色彩均衡现在已经触手可及。但始终存在两个限制。首先是技术方面的:每次干预都会产生伪影(鬼影、低沉的声音、虚构的细节),因此必须适度进行并与原始内容进行比较。第二个是道德的:减少噪音和澄清是允许的,但改变现实——尤其是在新闻和纪录片中——会产生误导。 AI打磨图像和声音;你保持现实主义和创造性的基调。
应用任务
选择嘈杂的录音和稍微扭曲的图像剪辑(也许是您自己的镜头)。使用两种不同剂量的清音并通过耳朵进行比较;注意自然度被扭曲的程度。尝试删除或放大图像中的对象,并将输出与原始图像进行比较,以找到至少两个伪影/制造的迹象。如果要在纪录片中使用该剪辑,请写下您不干预的原因。
清单
- [ ] 我是否检查了运动/播放中的每个效果/清理输出并与原始输出进行了比较?
- [ ] 我是否将声音保持在不会造成伪影的水平?
- [ ] 我是否检查了放大/优化输出中的虚假细节?
- [ ] 我是否有意识地将颜色决定作为一种创造性的选择?
- [ ] 我是否在声称真实的内容中保持了不会扭曲现实的限制?