سود:
- توانایی درک جریان های کاری مختلف هوش مصنوعی موسیقی، جلوه های صوتی و لایه های دوبله و آزمایش تجربه نمونه اولیه با تولید placeholder
- امکان طراحی تکنیک هایی مانند مجموعه تنوع در جلوه های صوتی و نقشه حالت تطبیقی موسیقی با پشتیبانی از هوش مصنوعی
- توانایی تشخیص مرزهایی مانند اخلاق شبیه سازی صوتی، الزامات مجوز/قرارداد و حق چاپ موسیقی، و تشخیص اینکه کیفیت نهایی اغلب به هنرمند انسانی تعلق دارد.
می گویند بینایی چشم را کنترل می کند و صدا احساسات را کنترل می کند. طراحی صدای یک بازی از سه لایه تشکیل شده است: موسیقی (ترکیبهایی که اتمسفر و تمپو را تعیین میکنند)، جلوههای صوتی (SFX - جلوههای صوتی) (صداهای رویداد مانند گامها، اسلحهها، درها، کلیکهای رابط) و صداگذاری (VO - Voice Over) (خطوط کاراکتر، راوی). هوش مصنوعی تولید کننده صوتی (مدل هایی که موسیقی، جلوه ها و گفتار را از متن یا مرجع تولید می کنند) می تواند شتاب دهنده همه این لایه ها باشد: موسیقی نمونه اولیه، جلوه های مکان نگهدار، طرح های مفهومی، حتی طرح های صوتی. اما صدا، مانند تصاویر بصری، دارای کپی رایت، ثبات و - به ویژه در صداگذاری - ابعاد اخلاقی است.
در این واحد، نحوه استفاده از هوش مصنوعی در تولید صدا را یاد خواهید گرفت. شما جریان های کاری مختلف موسیقی، جلوه ها و صداگذاری، موسیقی تطبیقی، کپی رایت و اخلاق شبیه سازی صدا را خواهید آموخت.
سه لایه، سه گردش کار
موسیقی. هوش مصنوعی میتواند طرحهای موسیقایی ایجاد کند که حال و هوای یک صحنه را به تصویر بکشد: تم منو، موسیقی رزمی، فضای کاوش. در مرحله نمونه اولیه و مکاندار بسیار ارزشمند است - تا زمانی که آهنگساز نرسد، صحنه "خالی" نیست. اما موسیقی پایانی اغلب کار آهنگساز انسان است. زیرا تم برند، اوج احساسی و موسیقی تطبیقی (موسیقی لایه ای که بسته به موقعیت بازی تغییر می کند) نیاز به کنترل دقیق دارد.
جلوه های صوتی. هوش مصنوعی و ابزارهای صوتی رویهای در تولید افکتها با تعداد زیادی تنوع (10 قدم مختلف، 5 در متفاوت) عملی هستند. یکنواختی را می شکند. جلوههای نگهدارنده مکان، نمونه اولیه را زنده میکند.
دوبله. حساس ترین منطقه هوش مصنوعی میتواند VO پیشنویس/حفرهدار سریع با متن به گفتار (TTS) تولید کند. برای آزمایش تجربه بازیکن در مرحله ویرایش استفاده می شود. اما شبیه سازی صدای واقعی انسان (کلون سازی صدا) مستلزم اجازه، قراردادها و اخلاق است. صداپیشه نهایی در اکثر پروژه ها هنرمند انسان است.
جریان گام به گام:
- عملکرد صدا را توصیف کنید (چه احساسی باید داشته باشد، در چه رویدادی باید پخش شود).
- مرجع / حالت (تمپو، ژانر، فضا، نمونه ها - دستور العمل ایمن با حق چاپ).
- ایجاد مکان نگهدار (پر کردن نمونه اولیه، تجربه آزمایش).
- حرکت به سمت هنرمند انسان (برای کیفیت نهایی و برند).
- بررسی حق چاپ/مجوز/مجوز (مخصوصاً برای موسیقی و صدا).
نکته: مجموعه ای از تغییرات را در جلوه های صوتی تولید کنید، نه نمونه های تکی. پخش یک نمونه از همان گام به طور مکرر به نظر جعلی است. وقتی 6-8 واریشن را به صورت تصادفی بازی می کنید طبیعی می شود.
موسیقی تطبیقی و ادغام
در بازی های مدرن، موسیقی ایستا نیست، بلکه قابل انطباق است: زمانی که بازیکن در حال کاوش است، آرام است، زمانی که درگیر مبارزه می شود، شدید است. هوش مصنوعی می تواند به پیش نویس طراحی این ساختار لایه ای کمک کند (کدام لایه در کدام حالت، قوانین انتقال). تولید آن کاری است که با موتور صدا (به عنوان مثال میان افزار) یکپارچه شده است. وضعیت موسیقی را نقشه هوش مصنوعی قرار دهید، سپس یکپارچگی فنی را تأیید کنید.
احتیاط: اخلاق شبیه سازی صدا. شبیه سازی صدای یک صداپیشه با هوش مصنوعی بدون اجازه و موافقت صریح او هم یک نقض اخلاقی و هم یک خطر قانونی است. تقلید صدای افراد متوفی یا شناخته شده نیز مسائل مربوط به حقوق شخصیتی را مطرح می کند. از TTS عمومی برای Placeholder استفاده کنید. با هنرمند برای صدای نهایی موافقم.
حقایق فنی طراحی صدا
صدای بازی بسیار بیشتر از پخش یک فایل موسیقی است. تعاملی است. یک صدا باید فوراً (با تأخیر کم) به کنش پخش کننده پاسخ دهد، بسته به مکان، طنین متفاوتی داشته باشد (صدایی در غار طنین انداز می شود، در فضای باز خشک می شود)، و نباید هنگام مخلوط شدن با صداهای دیگر، صدای ناهنجاری ایجاد کند. هوش مصنوعی این طراحی تعاملی را خودش تولید نمی کند. مواد خام (افکت ها، لایه های موسیقی، خطوط) را تولید می کند. چیزی که این مواد را به بازی متصل میکند، موتور/میانافزار صدا (میانافزاری است که صداها را با توجه به موقعیت بازی تحریک و ترکیب میکند) و طراح صدا که آن را مدیریت میکند. بنابراین، هر دارایی صوتی تولید شده توسط هوش مصنوعی را بدون آزمایش آن در یک زمینه بازی واقعی - در حال حرکت، با صداهای دیگر، در مکانهای مختلف، "خوب" در نظر نگیرید.
نکته مهم دیگر سطح صدا و تعادل میکس است: موسیقی نباید دیالوگ ها را تحت الشعاع قرار دهد، صداهای مهم گیم پلی (مانند صدای نزدیک شدن دشمن) همیشه باید شنیده شوند. هوش مصنوعی میتواند به شما یک طرح کلی از یک استراتژی میکس را پیشنهاد دهد (که در چه موقعیتی صدا باید برجسته باشد)، اما تصمیم نهایی میکس یک موضوع شنیداری و تجربه است. صدا، بر خلاف تصاویر بصری، "در پس زمینه" قابل توجه است. صدای بد باعث ایجاد حسی با کیفیت پایین می شود که پخش کننده نمی تواند آگاهانه درک کند که چرا آنها اذیت شده اند. بنابراین قانون در تولید صدا یکسان است: هوش مصنوعی شتاب می گیرد، گوش و تجربه تایید می کنند.
سه کیف کوچک
مورد 1 - Placeholder تجربه را ذخیره کرد. یک تیم مجبور شد پس از به تاخیر افتادن قرارداد آهنگساز خود، یک نمونه اولیه را در سکوت ارسال کند. آنها برای 4 صحنه موسیقی با هوش مصنوعی تولید کردند و تست پخش را با صدا انجام دادند. بازخورد بازیکنان بسیار دقیق تر بود زیرا جو می توانست آزمایش شود. سپس موسیقی نهایی با آهنگساز تولید شد.
مورد 2 - تغییرات اثر طبیعی بودن را اضافه کرد. در یک بازی اکشن، یک صدای شمشیر بارها و بارها پخش میشد و احساس میکرد که جعلی است. هنگامی که ما 8 تغییر را با هوش مصنوعی ایجاد کردیم و آنها را به صورت تصادفی بازی کردیم، امتیاز بازیکنان "مبارزه زنده تر است" به طور قابل توجهی افزایش یافت. تولید چند ساعت طول کشید
مورد 3 - دور شدن از اخلاق شبیه سازی صدا. یک تیم در نظر داشت صدای یک صداپیشه معروف را بدون اجازه بودجه شبیه سازی کند. قانون هشدار داد: شبیه سازی صوتی غیرمجاز نقض قرارداد و حقوق شخصی است. تیم از TTS عمومی برای جانشین و هنرمند قراردادی برای فینال استفاده کرد. هم راه حلی اخلاقی و هم بی خطر بود.
چهار قالب قابل کپی
1) خلاصه حالت موسیقی:
نقش شما: کارگردان موسیقی متن. صحنه: [به عنوان مثال. شب، کاوش شهر متروک].احساس مطلوب: [ناآرام اما کنجکاو]. سرعت: کند وظیفه: شرحی از جهت موسیقی برای این صحنه بنویسید (ساز، تمپو، اتمسفر، دینامیک). از نام آهنگ/هنرمند دارای حق چاپ استفاده نکنید. فقط آنها را با شرایط توصیف کنید. مشخص کنید که این مکان نگهدارنده است.
2) طرح تغییر اثر:
یک مجموعه افکت صوتی برای رویداد زیر برنامه ریزی کنید: [به عنوان مثال. رد پای روی زمین سنگی]. پیشنهاد 8 تغییر؛ هر کدام کمی متفاوت است (وزن، سرعت، رطوبت سطح). هدف: شکستن احساس تکرار. پیشنهاد نامگذاری به صورت تصادفی در موتور پخش شود.
3) نقشه وضعیت موسیقی تطبیقی:
یک نقشه حالت موسیقی تطبیقی برای بازی زیر ایجاد میکند: حالتها [کاوش، تنش، نبرد، پیروزی]، لایه موسیقی هر حالت، قوانین انتقال بین حالتها و زمان انتقال. توجه داشته باشید که این یک طرح طراحی است که نیاز به ادغام با موتور صوتی دارد.
4) کپی رایت صوتی/کنترل اخلاقی:
من قصد دارم دارایی صوتی زیر را تولید کنم: [توضیح]. (1) ملاحظات حق نسخه برداری/مجوز، (2) مجوزها و توافقات مورد نیاز در صورتی که شامل جعل هویت/شبیه سازی صدای انسان باشد، (3) تمایز بین نگهدارنده مکان و تولید نهایی را به من یادآوری کنید.
اعلان ضعیف / اعلان قوی
اعلان ضعیف:
از من موسیقی جنگی بساز
بدون احساس، بدون تمپو، بدون ساز، بدون زمینه. نتیجه عمومی
اعلان قدرتمند:
صحنه: مبارزه نهایی با رئیس. این بازیکن تقریباً شکست خورد، اما امید وجود دارد. احساس: حماسی، پرتنش، سر به فلک کشیده. تمپو: سریع، پرکاشن غالب، اوج با کر. طول: قابل حلقه 90 ثانیه، با افت پویا در وسط. این یک مکان نگهدار است. نسخه نهایی با آهنگساز ساخته خواهد شد. به آثار دارای حق چاپ ارجاع ندهید.
عملکرد، قوس احساسی، سرعت و تقاضای حلقه خروجی را هدایت می کنند.
نمودار مقایسه لایه های صوتی
لایه
مناسب بودن هوش مصنوعی
تولید نهایی
خطر کپی رایت/اخلاق
موسیقی
مکان یا مفهوم
به طور کلی آهنگساز
رسانه (تقلید از کار)
جلوه صوتی
تولید تنوع
می تواند تا حدی هوش مصنوعی باشد
کم متوسط
صداگذاری
مکان نگهدار TTS
عموما هنرمند
با صدای بلند (کلون سازی صدا)
طراحی قابل تطبیق
نقشه وضعیت
یکپارچه سازی موتور
پایین
اشتباهات رایج
- با استفاده از یک نمونه اثر واحد. دوباره تقلبی به نظر می رسد. تنوع لازم است
- اشتباه گرفتن جای جای برای نهایی. صدای هوش مصنوعی در اکثر پروژه ها واضح است.
- شبیه سازی صدا بدون اجازه این یک تخلف اخلاقی و قانونی است.
- استناد به اثر دارای حق چاپ خطر نقض در دستورات "مانند آهنگ فلانی".
- ایجاد موسیقی تطبیقی ثابت. لایه ها بسته به موقعیت بازی مورد نیاز است.
به طور خلاصه
صدا حامل احساسات بازی است. هوش مصنوعی این خط تولید را با تولید مفاهیم و مکانهایی در موسیقی، تغییرات در افکتها و پیشنویسها در صداسازی سرعت میبخشد. اما کیفیت نهایی، موضوع برند و کنترل تطبیقی اغلب کار هنرمند انسان است. شبیه سازی صدا نیاز به اجازه و اخلاق دارد. طبیعی بودن با تنوع، سرعت با مکانیابی، کیفیت نهایی با هنرمند.
وظیفه کاربردی
یک صحنه از بازی خود را انتخاب کنید. با الگوی "Music Mood Brief" یک مسیر موسیقی جایگیر تعریف کنید و با الگوی "Effect variation plan" یک مجموعه افکت 8 تغییری برای یک رویداد برنامه ریزی کنید. در نهایت، طرح خود را با الگوی «بررسی حق نشر صوتی/بررسی اخلاقی» بررسی کنید.
چک لیست
- [ ] من عملکرد صدا و احساس مورد نظر را به وضوح تعریف کرده ام.
- [ ] من یک مجموعه تنوع در جلوه ها تولید کردم.
- [ ] من صدای هوش مصنوعی را به عنوان نگهدارنده قرار دادم.
- [ ] من الزامات مجوز/قرارداد برای شبیه سازی صدا را رعایت کردم.
- [ ] من به هیچ اثر/هنرمند دارای حق چاپ اشاره نکردم.