单位 1 / 11

音乐制作中的人工智能简介:角色、边界、验证和道德

收益:

  • 能够区分人工智能在音乐制作中实时节省时间的地方(想法、草稿、技术分析、口头内容),以及根据任务风险级别将美学决策和标志性声音等选择留给艺术家的地方。
  • 能够应用验证规则,通过耳朵、参考和技术测量来测试每个人工智能输出
  • 了解哪些输入(未发布的演示、艺术家的声音、合同作品)在版权、许可和保密方面不能给予人工智能

每天在工作室或卧室工作室(在家中设置的小型制作环境)中静静地做出数十个创意决策。这首歌应该用什么音调?合唱应该在哪里爆发?低音应该突出到什么程度?这声音是不是太紧了?这种说法是陈词滥调吗?这个鼓循环有版权吗?其中一些决策是重复性的、技术性的且耗时的;其中一些直接决定歌曲的精神、艺术家的身份和作品的法律地位。人工智能(AI,简称AI——可以像人类一样生成文本、创造声音和音乐、识别模式并提供建议的计算机系统)正好适合这幅图景:如果使用得当,它可以在几分钟而不是几小时内准备好想法、草稿和技术分析;如果使用不当,可能会导致出版物内容不明确、陈词滥调或存在道德问题。

本模块的第一个单元不是软件介绍。其目的是阐明在生产中哪些地方应该放置人工智能,哪些地方根本不应该放置人工智能。因为音乐既是一个“技术关键”又是“身份关键”的领域:你所做的混音决定决定了歌曲的听起来如何;你做出的审美决定决定了你是谁。让我们从一开始就阐明基本原则:人工智能是助手,而不是艺术家。审美选择、标志性声音和最终批准取决于有能力的制作人和艺术家。未经验证或受版权保护的输出就像未签名的母版。

音乐制作的层次和人工智能的地位

将歌曲的起源分为三个层次是很有用的。创意层是理念:旋律、和弦、歌词、情感、身份。编曲制作层是将想法转化为作品:乐器、节奏、声音设计、编曲。技术出版层是作品变得可听和可分发的过程:混音(声音平衡)、母带处理(最终润色和响度调整)、分发。人工智能可以触及所有三个层面,但每个层面都有不同的权威。在创意层面,人工智能生成选项,决定权在艺术家手中。在技​​术层面,AI给出测量和草稿,验证是工程师的。

让我们从一开始就定义一些基本术语。 DAW(数字音频工作站)是您录制、编辑和混合音乐的主要软件(例如 Ableton Live、FL Studio、Logic Pro)。 MIDI 是携带何时以及以何种强度演奏音符的“指令”的数据,而不是声音本身。 Stem 是歌曲在不同声音组中的形式(例如只有人声、只有鼓声)。 BPM(每分钟节拍数)是节奏;是每分钟的节拍数。我们将在以下单元中一一解释这些概念;现在,请知道这一点:人工智能为您提供所有这些概念的概述和建议,但它并不能决定歌曲“应该是什么”。

下表按任务总结了人工智能的作用和风险级别:

任务

人工智能的作用

风险等级

谁批准

生成和弦/旋律创意

想法生成器

作曲家

写歌词草稿

草图生成器

中等

词曲作者/艺术家

声音设计参数推荐

技术顾问

中等

声音设计师

推荐混合设置

诊断+初始设置

中高

混音工程师

自动母带制作

自动处理器

母带工程师

使用采样/生成的音频

原料

版权/法务人员

克隆艺术家的声音

仅在允许的情况下

非常高

艺术家+法律

请记住这一点:随着风险的增加,人工智能的作用会缩小,而人类的认可和版税控制会增加。

为什么“验证”是这项业务的核心

人工智能似乎对自己的答案充满信心,但也可能不确定。用技术语言来说,这称为幻觉:模型流畅地呈现实际不存在或错误的信息,就好像它是真的一样。在音乐制作中,这看起来像这样:模型可能会告诉您“-8 LUFS 是这首歌的理想母带级别”,而您的目标平台需要 -14 LUFS,而该值会损害您的曲目。或者他们可能会说,“这个和弦进行是完全原创的”,尽管它几乎与一首著名歌曲的副歌相同。当一首歌词与一首现有歌曲极其相似时,人们可能会说“这句歌词是原创的”。既然他都以同样的信心说出来,那么唯一区分对错的就是你的耳朵、知识和验证习惯。

音乐验证的原则包括三个步骤:

  1. 用耳朵聆听:在应用每项技术建议(EQ、压缩、电平、节奏)之前和之后,在自己的监听器上聆听,如果可能的话,使用耳机或手机扬声器聆听。这个数字可能看起来是正确的,但听上去可能是错误的。
  2. 与参考比较:与您的流派中受推崇的商业发行的“参考歌曲”进行比较。人工智能的建议会让你离参考值更近还是更远?
  3. 版权和道德过滤器:测试所产生的旋律、文字或声音是否侵犯他人权利、陈词滥调或违反品牌安全。
注意:在不听AI的情况下应用AI给出的技术值,或者在不检查的情况下发布它产生的旋律/歌词,就像发送未签名的母带一样。仅仅因为输出平滑或快速是不准确或安全的。

版权和隐私:您不提供哪些信息

音乐是一个商业和创意领域;某些输入永远不应该提供给公共人工智能工具。其中包括未发行的演示(您尚未发行的歌曲)、合同作品的主干(您为另一位艺术家/唱片公司制作并受保密义务约束的材料)、未经授权的艺术家原始声音录音以及个人/财务合同详细信息。原因是这样的:公共工具可以将数据存储在其服务器上或使用它来训练模型。这造成了泄露、版权链不确定性和违约的风险。规则很简单:不要分享敏感材料;如果您需要共享,请选择一个合同化且安全的工具,该工具不会在训练中使用您的数据。对于创意生成或一般咨询,匿名、通用的描述就足够了:将其描述为“80 BPM,小调、忧郁的 R&B 曲目”,而不是“我的秘密演示的完整录音”。

三个迷你箱子

案例 1——安全使用。一位制作人需要为一则广告制作 6 个不同的旋律创意草稿,他花了 2 天的时间亲自尝试每一个草稿。他给出了 YZ 的风格、节奏(110 BPM)、情感(“希望、干净”)和时间限制,并要求 6 份和弦旋律草稿。 AI 15分钟生成骨骼;制作人在他的钢琴上演奏了每首曲子,删除了两首,用自己的主题重写了一首,然后将其编入了他的 DAW 中。持续时间:半天而不是两天。 AI给出一个想法,工作就交给了制作人。

案例 2——未经证实的技术价值陷阱。一位beatmaker问AI“我应该让我的master有多高?” “-6 LUFS 左右是行业标准,”YZ 说。 Beatmaker 实现了这一点;该曲目在流媒体平台上被节流,低音增强并失去动力。实际目标约为-14 LUFS。错误:应用技术价值而不用平台环境验证它。

案例 3 — 侵犯版权/道德行为。一位制作人在未经她许可的情况下克隆了一位著名艺术家的声音,并将其用于单曲中并发行。这首歌迅速走红,但艺术家团队以侵犯人格和名人权利为由采取了行动;轨道被从站台上拆除,制造商面临法律风险。正确的方法是要么根本不使用语音,要么在明确的、有记录的许可下工作。

弱提示/强提示

弱提示:

给我一首优美歌曲的和弦。

这个要求是有缺陷的:体裁、语气、节奏、情感和目的不明确。人工智能只会产生平均、陈词滥调和与上下文无关的输出;它不太可能可用。

强力提示:

您的角色:音乐制作人助理。流派:忧郁的独立流行音乐。声调:小调。节奏:92 BPM。感受:渴望、希望、悲伤。参考音:简单,以吉他钢琴为主。任务:分别为主歌和副歌建议 4 小节和弦进行。为每个进行提供罗马数字和和弦名称,写下简短的理由。避免非常常见的陈词滥调模式;还提供替代方案。注:这是初稿;旋律和最终选择都是我的。

这个提示阐明了体裁、语气、节奏、情感、格式和角色;将输出定位为存根。结果是一个可用的开始。

常见错误

  • 让人工智能代替艺术家:将审美和身份决策委托给人工智能最终会导致毫无灵魂的作品,看起来和其他人一样。
  • 在不倾听的情况下应用技术价值:不通过耳朵和平台上下文验证 LUFS、EQ、节奏等值。
  • 忽视版权:不检查所产生的旋律/单词/声音是否侵犯其他权利。
  • 将敏感材料上传到公共工具:向公共人工智能提供未发布的演示或合同干。
  • 在没有上下文的情况下编写提示:说“做一些好事”,但不给出体裁、语气、节奏或情感。
提示:在每个 AI 会话的输出结束时,在心里添加:“这是草稿,决定权在我。”这一句话将工具置于助手的位置,而不是大师的位置。

总之

人工智能是音乐制作的强大加速器:它将数小时的想法、草稿、技术分析和口头内容缩短为几分钟。但音乐在技术上和身份上都很敏感。将AI定位为一个助手,在创意层生成选项,在技术层给出测量和草图;始终保留您的审美选择、标志性声音和最终批准。通过聆听、将其与参考文献进行比较并过滤其版权和道德来验证每个打印输出。请勿向敞篷车辆运送敏感和合同材料。随着风险的增加,人工智能的作用会缩小,而人类的认可度会增加。

应用任务

从您自己的上一个项目中选择一个任务(例如合唱旋律或混音问题)。首先按照上面的“弱提示/强提示”逻辑写出两个提示并进行比较。然后将强提示的输出通过三个验证步骤:(1)用耳朵听,(2)与参考歌曲进行比较,(3)版权/道德测试。用三句话写下结果:AI得到了什么,你没有接受什么,你最终做了什么决定。

清单

  • [ ]我把AI定位为助手;我自己保留了审美和最终决定。
  • [ ] 我通过耳朵和平台上下文验证了每个技术价值。
  • [ ] 我根据版权和道德对产生的旋律/歌词/声音进行了过滤。
  • [ ] 我没有提供未发布的演示、合同请求或未经许可打开声音的车辆。
  • [ ] 我在提示中添加了流派、语气、节奏、情感和角色背景。
  • [ ]我根据任务的风险级别调整了人工智能的角色和人类的批准。