Прибуток:
- Здатність розуміти різні робочі процеси штучного інтелекту щодо музики, звукових ефектів і шарів дубляжу, а також тестувати досвід прототипу з створенням заповнювачів
- Здатність розробляти такі методи, як набір варіацій у звукових ефектах і адаптивна карта стану музики з підтримкою штучного інтелекту
- Здатність розпізнавати межі, такі як етика клонування аудіо, вимоги щодо дозволу/контракту та авторське право на музику, і визнавати, що кінцева якість часто належить людині-митцю
Кажуть, що візуальне зображення керує очима, а звук контролює емоції. Звуковий дизайн гри складається з трьох рівнів: музика (композиції, що визначають атмосферу та темп), звукові ефекти (SFX — звукові ефекти) (звуки подій, такі як кроки, стрільба, двері, клацання інтерфейсу) і озвучка (VO — voice over) (репліки персонажів, оповідач). Штучний інтелект, що генерує аудіо (моделі, які генерують музику, ефекти та мову з тексту чи посилання) може бути прискорювачем на всіх цих рівнях: прототип музики, ефекти заповнювача, ескізи концепції, навіть ескізи голосу за кадром. Але звук, як і візуальні матеріали, має авторське право, послідовність і - особливо в голосі за кадром - етичні аспекти.
У цьому розділі ви дізнаєтесь, як використовувати штучний інтелект у виробництві звуку; Ви дізнаєтеся про різні робочі процеси музики, ефектів і голосу за кадром, адаптивної музики, авторського права та етики клонування звуку.
Три шари, три робочі процеси
музика AI може створювати музичні ескізи, які передають настрій сцени: тему меню, бойову музику, атмосферу дослідження. Це неоціненне значення на етапі прототипу та заповнювача — сцена не «порожня», поки не прийде композитор. Але остаточна музика часто є твором людини-композитора; оскільки тема бренду, емоційна кульмінація та адаптивна музика (багата музика, яка змінюється залежно від ігрової ситуації) вимагають тонкого контролю.
звукові ефекти. ШІ та процедурні аудіоінструменти практичні у створенні ефектів із великою кількістю варіацій (10 різних кроків, 5 різних дверей); Це порушує монотонність. Ефекти заповнювачів оживляють прототип.
Дубляж. Найбільш чутлива зона. AI може створювати швидкі чернетки/заповнювачі VO з текстом у мовлення (TTS); Він використовується для перевірки досвіду гравця на етапі редагування. Але клонування справжнього людського голосу (клонування голосу) вимагає дозволу, контрактів і етики; Останній голос за кадром у більшості проектів є людиною-митцем.
Крок за кроком:
- Опишіть функцію звуку (яким він має бути, у якій події він має відтворюватися).
- Дайте посилання/настрій (темп, жанр, атмосфера, семпли — авторські рецепти).
- Створити заповнювач (заповнити прототип, перевірити досвід).
- Перейти до художника-людини (для остаточної якості та бренду).
- Перевірка авторських прав/ліцензій/дозволів (особливо для музики та аудіо).
Порада: створюйте набір варіацій звукових ефектів, а не окремі зразки. Програвання одного зразка одного і того ж кроку знову і знову здається фальшивим; Це стає природним, коли ви граєте 6-8 варіацій випадковим чином.
Адаптивна музика та інтеграція
У сучасних іграх музика не статична, а адаптована: спокійна, коли гравець досліджує, інтенсивна, коли бере участь у бою. ШІ може допомогти скласти проект цієї багатошарової структури (який шар у якому стані, правила переходу); Його виробництво є роботою, інтегрованою із звуковим механізмом (наприклад, проміжним програмним забезпеченням). Попросіть штучний інтелект відобразити стан музики, а потім перевірте технічну інтеграцію.
Увага: Етика клонування голосу. Копування голосу актора голосу за допомогою штучного інтелекту без його або її прямого дозволу та згоди є як порушенням етики, так і юридичним ризиком. Імітація голосів померлих або відомих людей також викликає проблеми з правами особистості. Використовуйте загальний TTS для Placeholder; погодьтеся з виконавцем остаточне звучання.
Технічні факти звукового оформлення
Аудіо в іграх — це набагато більше, ніж просто відтворення музичного файлу; Він інтерактивний. Звук повинен миттєво реагувати (з низькою затримкою) на дії гравця, резонувати по-різному в залежності від місця (звук лунає в печері, висихає на відкритому просторі) і не повинен створювати какофонію при змішуванні з іншими звуками. AI не створює цей інтерактивний дизайн сам; виробляє сировину (ефекти, музичні шари, лінії). Що пов’язує цей матеріал із грою, так це звуковий движок/проміжне програмне забезпечення (проміжне програмне забезпечення, яке запускає та змішує звуки відповідно до ігрової ситуації) і звуковий дизайнер, який ним керує. Тож не вважайте кожен створений штучним інтелектом звуковий актив «добре», не перевіривши його в контексті реальної гри — у русі, з іншими звуками, у різних місцях.
Ще один важливий момент — рівні гучності та баланс міксів: музика не повинна перекривати діалог, критичні звуки гри (наприклад, звук наближення ворога) мають бути чутні завжди. ШІ може запропонувати вам план стратегії міксування (який звук має виділятися в якій ситуації), але остаточне рішення мікшування залежить від слуху та досвіду. Звук, на відміну від візуалу, помітний «на задньому плані»; Поганий звук створює відчуття низької якості, що гравець не може свідомо зрозуміти, чому його турбує. Отже, правило те саме у створенні звуку: ШІ прискорює, слух і досвід підтверджують.
три міні-чохла
Випадок 1 — Заповнювач зберіг досвід. Одній команді довелося мовчки подати прототип після того, як їхній композиторський контракт було відкладено. Вони створили музику-заповнювач для 4 сцен за допомогою штучного інтелекту та провели тест відтворення зі звуком; Відгуки гравців були набагато точнішими, тому що атмосферу можна було перевірити. Остаточна музика була написана разом з композитором.
Випадок 2 — Ефект варіації доданої природності. У бойовій грі один звук меча відтворювався знову і знову, і це здавалося фальшивим. Коли ми створили 8 варіантів за допомогою штучного інтелекту та розіграли їх у випадковому порядку, оцінка гравців «бійка стала жвавішою» значно зросла; виробництво тривало кілька годин.
Випадок 3 — Відмова від етики клонування голосу. Одна команда розглядала можливість клонувати голос відомого актора озвучування без дозволу бюджету. Закон попереджав: несанкціоноване клонування голосу є порушенням договірних та особистих прав. Команда використовувала загальний TTS для заповнювача та виконавця за контрактом для фіналу; Це було етичне та безпечне рішення.
Чотири шаблони, які можна копіювати
1) Брифінг музичного настрою:
Ваша роль: режисер саундтреку. Сцена: [напр. ніч, дослідження покинутого міста]. Бажане відчуття: [незручно, але цікаво]. Темп: повільний. Завдання: написати характеристику музичного напрямку до цієї сцени (інструмент, темп, атмосфера, динаміка). НЕ використовуйте захищені авторським правом назви треків/виконавців; просто опишіть їх з кваліфікацією. Укажіть, що це заповнювач.
2) Варіаційний план ефекту:
Заплануйте набір звукових ефектів для такої події: [напр. кроки на кам'яній підлозі]. Запропонуйте 8 варіантів; кожен трохи відрізняється (вага, швидкість, вологість поверхні). Мета: позбутися відчуття повторення. Запропонуйте іменування, яке буде відтворено випадковим чином у двигуні.
3) Адаптивна карта стану музики:
Створює адаптивну карту музичних станів для такої гри: стани [дослідження, напруга, битва, перемога], музичний шар кожного стану, правила переходу між станами та час переходу. Зверніть увагу, що це ескіз дизайну, який вимагає інтеграції з аудіосистемою.
4) Контроль авторських прав/етики аудіо:
Я планую створити такий голосовий ресурс: [опис]. Нагадайте мені про (1) міркування щодо авторського права/ліцензування, (2) дозволи та угоди, необхідні, якщо йдеться про уособлення/клонування людського голосу, (3) розрізнення між заповнювачем і кінцевим продуктом.
Слабка підказка / Сильна підказка
Слабка підказка:
Створи мені військову музику.
Ні відчуття, ні темпу, ні інструментів, ні контексту; загальний результат.
Потужна підказка:
Сцена: фінальна битва з босом; Гравець мало не програв, але надія є. Відчуття: епічне, напружене, ширяюче. Темп: швидкий, ударні домінують, кульмінація з приспівом. Тривалість: 90 секунд з можливістю повторення, з динамічним переривом посередині. Це заповнювач; остаточна версія буде зроблена з композитором. Не посилайтеся на роботу, захищену авторським правом.
Функція, емоційна дуга, темп і потреба в циклі керують результатом.
Таблиця порівняння аудіошарів
шар
Придатність AI
кінцеве виробництво
Авторські/етичні ризики
музика
Заповнювач/концепція
Взагалі композитор
Середній (імітація роботи)
звуковий ефект
Генерація варіації
Може бути частково ШІ
низький-середній
озвучка
Заповнювач TTS
Взагалі художник
Голосно (клонування голосу)
Адаптивний дизайн
карта ситуації
Інтеграція двигуна
низький
Поширені помилки
- Використання єдиного зразка ефекту. Це знову здається фальшивим; необхідна варіація.
- Помилково приймаючи заповнювач за ultimate. Аудіо штучного інтелекту є схематичним у більшості проектів.
- Клонування голосу без дозволу. Це етичне та правове порушення.
- Цитування захищеної авторським правом роботи. Ризик порушення в підказках «як така-то пісня».
- Встановлення адаптивної музичної статики. Шари потрібні залежно від ігрової ситуації.
Підсумовуючи
Звук передає емоції гри. ШІ; Він прискорює виробничу лінію, виробляючи концепції та заповнювачі в музиці, варіації ефектів і чернетки у вокалізації. Але кінцева якість, тема бренду та адаптивний контроль часто є роботою людини-митця; Для клонування голосу потрібен дозвіл і етика. Природність із варіаціями, швидкість із заповнювачем, найвища якість із художником.
Аплікаційне завдання
Виберіть сцену зі своєї гри. Визначте музичний напрямок-заповнювач за допомогою шаблону «Короткий запис музичного настрою» та сплануйте набір ефектів із 8 варіантів для події за допомогою шаблону «План варіацій ефекту». Нарешті перевірте свій план за допомогою шаблону «Перевірка авторських прав/етики аудіо».
контрольний список
- [ ] Я чітко визначив звукову функцію та бажане відчуття.
- [ ] Я створив набір варіацій ефектів.
- [ ] Я позиціонував голос ШІ як заповнювач.
- [ ] Я дотримувався вимог дозволу/контракту для клонування голосу.
- [ ] Я не згадував жодного твору/виконавця, захищеного авторським правом.