ユニット 1 / 11

音楽制作における人工知能の概要: 役割、境界、検証、倫理

利益:

  • タスクのリスク レベルに応じて、音楽制作において人工知能がリアルタイムで時間を節約する部分 (アイデア、草案、技術分析、口頭の内容) と、美的決定や特徴的なサウンドなどの選択がアーティストに委ねられる部分を区別できるようになります。
  • すべての AI 出力を耳、参照、および技術的測定によってテストする検証規律を適用する能力
  • 著作権、ライセンス、機密保持の観点から、どの入力 (未公開のデモ、アーティストの声、契約した作品) を人工知能に与えることができないかを理解する

スタジオやベッドルーム スタジオ (自宅に設置された小規模な制作環境) では、毎日何十ものクリエイティブな意思決定が静かに行われます。この曲はどのようなトーンにすべきでしょうか?どこでコーラスを爆発させるべきでしょうか?低音はどのくらい目立たせる必要がありますか?このボーカルはきつすぎますか?この発言は決まり文句でしょうか?このドラムループは著作権で保護されていますか?これらの決定の中には、反復的で技術的で時間がかかるものもあります。それらの中には、曲の精神、アーティストのアイデンティティ、作品の法的地位を直接決定するものもあります。人工知能 (AI、略して AI、人間のようにテキストを生成し、音や音楽を作成し、パターンを認識し、提案を提供できるコンピューター システム) は、この図のちょうど真ん中に当てはまります。正しく使用すれば、数時間ではなく数分でアイデア、草案、技術分析を準備できます。誤って使用すると、不明確でありきたりな、または倫理的に問題のある出力を含む出版物が作成される可能性があります。

このモジュールの最初の単元はソフトウェアの紹介ではありません。その目的は、プロダクションのどこに AI を導入するか、どこにまったく導入しないかを明確にすることです。なぜなら、音楽は「技術が重要」であると同時に「アイデンティティが重要」な分野だからです。ミキシングの決定によって、その曲がどのように聞こえるかが決まります。あなたが行う美的決定が、あなたが誰であるかを決定します。最初から基本原則を説明しましょう。AI はアシスタントであり、アーティストではありません。審美的な選択、特徴的なサウンド、そして最終的な承認は、有能なプロデューサーとアーティストに委ねられます。未検証または著作権で保護された出力は、署名されていないマスターのようなものです。

音楽制作のレイヤーと AI の場所

曲の成り立ちを 3 つの層に分けると便利です。クリエイティブな層はアイデア、つまりメロディー、コード、歌詞、感情、アイデンティティです。アレンジ制作レイヤーでは、楽器編成、リズム、サウンドデザイン、アレンジメントなど、アイデアを作品に変換します。技術出版レイヤーは、ミキシング (サウンドのバランス調整)、マスタリング (最終的な磨きとラウドネス調整)、配布という、作品を聴いたり配布したりできるようにするプロセスです。 AI は 3 つのレイヤーすべてにアクセスできますが、それぞれのレイヤーで異なる権限を持ちます。クリエイティブ層ではAIが選択肢を生成し、決定はアーティストに委ねられます。技術レイヤーでは、AIが測定と製図を行い、検証はエンジニアが行います。

最初からいくつかの基本的な用語を定義しましょう。 DAW (デジタル オーディオ ワークステーション) は、音楽を録音、編集、ミックスするための主要なソフトウェア (Ableton Live、FL Studio、Logic Pro など) です。 MIDI は音そのものではなく、音をいつ、どのくらいの強さで演奏するかという「指示」を伝えるデータです。ステムとは、別々のサウンドグループ(ボーカルのみ、ドラムのみなど)に分かれた曲の形式です。 BPM (ビート/分) はテンポです。は 1 分あたりの拍数です。次の単元でこれらの概念を 1 つずつ説明します。現時点では、次のことを知っておいてください。AI はこれらすべてのコンセプトの概要と提案を提供しますが、曲が「どうあるべきか」を決定するものではありません。

次の表は、AI の役割とリスク レベルをミッションごとにまとめたものです。

クエスト

AIの役割

リスクレベル

誰が承認するか

コード/メロディーのアイデアを生成する

アイデアジェネレーター

低い

作曲家

歌詞の草案を書く

スケッチジェネレーター

中程度

ソングライター/アーティスト

サウンドデザインパラメータの推奨事項

技術コンサルタント

中程度

サウンドデザイナー

推奨ミックス設定

診断+初期設定

中~高

ミックスエンジニア

自動マスタリング

自動処理機

高い

マスタリングエンジニア

サンプリング/生成されたオーディオの使用

原材料

高い

著作権・法務担当者

アーティストの声を複製する

許可された場合のみ

非常に高い

アーティスト + 法律

この 1 行を念頭に置いてください。賭け金が高まるにつれて、AI の役割は縮小し、人間の承認とロイヤルティの管理が増大します。

なぜ「検証」がこのビジネスの肝なのか

人工知能はその答えに自信を持っているように見えますが、確実ではない可能性があります。専門用語では、これは幻覚と呼ばれます。これは、モデルが、実際には存在しない情報、または虚偽の情報を、あたかも真実であるかのように流暢に提示する場合です。音楽制作では、これは次のようになります。モデルは「この曲の理想的なマスター レベルは -8 LUFS です」と指示するかもしれませんが、ターゲットとしているプラ​​ットフォームでは -14 LUFS が必要であり、その値はトラックに悪影響を及ぼします。あるいは、有名な曲のサビとほぼ同じなのに、「このコード進行は完全にオリジナルだ」と言われるかもしれません。ある歌詞が既存の曲と危険なほど似ている場合、「この行はオリジナルである」と言えるかもしれません。彼はどれも同じ自信を持って言っているので、善悪を区別できるのはあなたの耳と知識と検証の習慣だけです。

音楽における検証の規律は 3 つのステップで構成されます。

  1. 耳で聞く: 各技術的な提案 (EQ、コンプレッション、レベル、テンポ) を適用する前後に、自分のモニターで、可能であればヘッドフォンや電話のスピーカーで聞いてください。この数字は正しいように見えても、耳には間違っているように聞こえるかもしれません。
  2. リファレンスと比較する: あなたのジャンルで尊重されている市販の「リファレンス ソング」と比較します。 AI の提案によって、参照に近づくのか、それとも遠ざかるのか?
  3. 著作権と倫理フィルター: 生成されたメロディー、単語、またはサウンドが他人の権利を侵害していないか、決まり文句であるか、またはブランド セキュリティに違反していないかをテストします。
注意: AI によって与えられた技術的価値を、それを聴かずに適用したり、AI が生成したメロディーや歌詞を確認せずに公開したりすることは、署名のないマスターを送信するようなものです。出力がスムーズまたは高速であるというだけでは、正確または安全ではありません。

著作権とプライバシー: 入力してはいけないもの

音楽は商業的かつ創造的な分野です。一部の入力は公開 AI ツールに決して与えてはなりません。これらには、未リリースのデモ (まだリリースされていない曲)、契約した作品の一部 (別のアーティスト/レーベルのために制作した素材で、機密保持義務の対象となるもの)、アーティストの未許可の生のボーカル録音、および個人/財務契約の詳細が含まれます。その理由は次のとおりです。公開ツールはデータをサーバーに保存したり、それを使用してモデルをトレーニングしたりできるからです。これにより、漏洩、著作権チェーンの不確実性、契約違反のリスクが生じます。ルールは単純です。機密性の高い内容は共有しないでください。共有する必要がある場合は、トレーニングでデータを使用しない、契約済みの安全なツールを選択してください。アイデア創出や一般的なコンサルティングの場合は、匿名の一般的な説明で十分です。「秘密のデモの完全な録音」の代わりに、「80 BPM、短調、憂鬱な R&B トラック」と説明します。

ミニケース3個

ケース 1 — 安全な使用。プロデューサーはコマーシャル用のメロディー アイデアの 6 つの異なる草案を必要とし、それぞれを手作業で試すのに 2 日かかりました。彼は YZ のジャンル、テンポ (110 BPM)、感情 (「希望に満ちた、きれいな」)、時間の制約を与え、6 つのコード メロディーの草案を求めました。 AI は 15 分で骨格を作成しました。プロデューサーはそれぞれをピアノで演奏し、2つを削除し、1つを独自のモチーフで書き直し、DAWでアレンジしました。期間: 2 日ではなく半日。 AI がアイデアを出し、仕事はプロデューサーに渡されました。

ケース 2 — 未確認の技術的価値の罠。ビートメイカーがAIに「マスターをどれくらいの高さにすればいいですか?」と尋ねた。 「業界では約 -6 LUFS が標準です」と YZ 氏は述べています。 Beatmaker はこれを実装しました。ストリーミング プラットフォームではトラックの速度が低下し、低音が強調され、ダイナミクスが失われていました。実際の目標は約 -14 LUFS でした。間違い: プラットフォームのコンテキストで検証せずに技術的価値を適用します。

ケース 3 — 著作権/倫理違反。プロデューサーが有名アーティストの声を無断で複製し、シングルに使用してリリースした。この曲は急速に広まったが、アーティストのチームは人格と有名人の権利の侵害を理由に行動を起こした。線路はプラットフォームから撤去され、製造業者は法的リスクにさらされた。正しい方法は、音声をまったく使用しないか、文書化された明示的な許可を得て作業することです。

弱いプロンプト / 強いプロンプト

弱いプロンプト:

美しい曲のコードを教えてください。

このリクエストには欠陥があります。ジャンル、トーン、テンポ、感情、目的が明確ではありません。 AI は、平均的でありきたりで文脈のない出力のみを生成します。使えそうにありません。

強力なプロンプト:

あなたの役割: 音楽プロデューサーのアシスタント。ジャンルはメランコリックなインディーポップ。口調:未成年です。テンポ: 92BPM。感情:憧れ、希望に満ちた悲しみ。基準音:プレーン、ギターピアノ志向。タスク: ヴァースとコーラスに分けて 4 小節のコード進行を提案します。各進行にローマ数字とコード名を付け、簡単な理由を書きます。決まり文句になり得る非常に一般的なパターンは避けてください。代替案も提供します。注: これは初期草案です。メロディーと最終的な選択は私のものです。

このプロンプトは、ジャンル、トーン、テンポ、感情、形式、役割を明確にします。出力をスタブとして配置します。結果は、使用可能なスタートです。

よくある間違い

  • アーティストの代わりに AI を置く: 美学とアイデンティティの決定を AI に委ねると、最終的には他の人と同じように魂のない作品が生まれます。
  • 耳を傾けずに技術的価値を適用する: LUFS、EQ、耳でのテンポ、プラットフォームのコンテキストなどの値を検証しません。
  • 著作権の無視: 作成されたメロディー/単語/サウンドが別の権利を侵害していないかどうかを確認しないこと。
  • 機密データを公開ツールにアップロードする: 未公開のデモまたは契約ステムを公開 AI に提供します。
  • 文脈を無視してプロンプトを書く: ジャンル、口調、テンポ、感情を与えずに「何か良いことをしてください」と言う。
ヒント: 各 AI セッションの出力の最後に、心の中で「これは草案です。決定は私が行います。」と付け加えます。この一文により、ツールはマスターではなくアシスタントの位置に置かれます。

要約すれば

人工知能は音楽制作における強力な促進剤であり、何時間にもわたるアイデア、草稿、技術分析、口頭コンテンツを数分に短縮します。しかし、音楽は技術的にもアイデンティティの点でも繊細です。 AI をクリエイティブ層でオプションを生成し、技術層で測定とスケッチを提供するアシスタントとして位置付けます。審美的な選択、特徴的なサウンド、最終的な承認を常に自分のものにしてください。各プリントアウトを聞いて、リファレンスと比較し、著作権と倫理についてフィルタリングすることによって検証します。機密性の高い、収縮した物質を開いた車両に運ばないでください。リスクが増大するにつれて、AI の役割は縮小し、人間の承認が増大します。

アプリケーションタスク

自分の最後のプロジェクトからタスクを選択します (コーラスのメロディーやミックスの問題など)。まず、上記の「弱いプロンプト / 強いプロンプト」ロジックを使用して 2 つのプロンプトを作成し、比較します。次に、強力なプロンプトの出力を 3 つの検証ステップに掛けます: (1) 耳で聞く、(2) 参照曲と比較する、(3) 著作権/倫理テスト。結果を 3 つの文で書き留めてください: AI が何を獲得したのか、何を受け入れられなかったのか、最終的にどのような決断を下したのか。

チェックリスト

  • [ ] 私は AI をアシスタントとして位置づけました。私は美学と最終決定を自分自身で守りました。
  • [ ] 各技術的価値を耳とプラットフォームのコンテキストによって検証しました。
  • [ ] 制作されたメロディ/歌詞/サウンドを著作権と倫理の観点からフィルタリングしました。
  • [ ] 私は未公開のデモ、契約上の要求、または許可なくサウンドをオンにした車両を提供したわけではありません。
  • [ ] ジャンル、トーン、テンポ、感情、役割のコンテキストをプロンプトに追加しました。
  • [ ] ミッションのリスクレベルに基づいて、AI の役割と人間の承認を調整しました。