واحد 7 / 11

زیرنویس، دوبله و ترجمه سمعی و بصری

سود:

  • قابلیت تناسب با حفظ معنی با اعمال قوانین فنی زیرنویس (خط، کاراکتر، CPS)
  • امکان بررسی صحیح اشتباهات نام و شماره با صدا در حالی که سرعت رونویسی و کد زمانی خودکار با ASR را افزایش می دهد.
  • امکان مدیریت محدودیت های هوش مصنوعی با در نظر گرفتن زمینه بصری، تفاوت تونال و همگام سازی لب در دوبله

ترجمه فیلم، سریال تلویزیونی، ویدیوی شرکتی یا دوره آنلاین به طور اساسی با ترجمه متن ساده متفاوت است: زمان، سرعت خواندن، تصویر روی صفحه، صدا و حرکت لب کاراکترها نیز محدودیت هایی هستند. در این واحد ترجمه سمعی و بصری (زیرنویس، دوبله، صداگذاری)، قوانین فنی زیرنویس، رونویسی و کدگذاری زمانی با پشتیبانی هوش مصنوعی و مشکلات کیفی این رشته را خواهید آموخت. هدف این است که مانند یک کارشناس ترجمه سمعی و بصری کار کنیم که به جای «ترجمه متن» «مطابق چشم و گوش مخاطب» باشد.

مفاهیم اساسی

ترجمه سمعی و بصری (AVT) ترجمه محتوایی است که حاوی صدا و تصویر است. فرم های اصلی زیرنویس، دوبله و توضیحات صوتی است. زیرنویس انعکاس گفتار به صورت مکتوب روی صفحه است. دوبله، دوبله مجدد صدای اصلی به زبان مقصد است. صداگذاری زمانی است که صدای اصلی قطع می شود و ترجمه روی آن خوانده می شود (معمولاً در مستندها).

دو اصطلاح فنی مهم زیرنویس: CPS (شخصیت در ثانیه) سرعت زیرنویس را محدود می کند تا بیننده بتواند آن را راحت بخواند. حد بالایی که به طور کلی پذیرفته شده است حدود 17 کاراکتر در ثانیه است (کمتر برای محتوای کودکان). Timecode زمان شروع پایان است که نشان می دهد چه زمانی زیرنویس روی صفحه ظاهر می شود و ناپدید می شود (مانند 00:01:23,400).

چرا سخت است؟ زیرا به معنای جا دادن ترجمه در زیرنویس است. دو خط، ~ 42 کاراکتر در هر خط، حداقل ~ 1 ثانیه و حداکثر ~ ~ ~ 6 ثانیه زمان صفحه نمایش، و محدودیت CPS - شما باید با همه اینها با حفظ معنی و لحن مطابقت داشته باشید. به همین دلیل است که ترجمه زیرنویس اغلب با فشرده سازی و بازنویسی است، نه ترجمه کلمه به کلمه.

نکته: از رفلکس "ترجمه هر کلمه" در زیرنویس خودداری کنید. بیننده هم تصویر را تماشا می کند و هم می خواند. زیرنویس های خیلی طولانی قابل خواندن نیستند. یافتن کوتاه ترین بیان طبیعی که معنا را حفظ کند، تسلط واقعی تیتراژ است.

نقش هوش مصنوعی در ترجمه سمعی و بصری

هوش مصنوعی چندین مرحله را در این زمینه به طور قابل توجهی سرعت می بخشد:

  1. رونویسی: با ASR (تشخیص خودکار گفتار)، صدا به طور خودکار رونویسی می شود. این منبع خام زیرنویس را در چند دقیقه استخراج می کند.
  2. کدگذاری خودکار زمان: ابزارها مکالمه را به بخش هایی تقسیم می کنند و کدهای زمان پیش نویس را تولید می کنند.
  3. پیش نویس ترجمه: متن رونوشت ترجمه شده است.
  4. CPS/کنترل طول: هوش مصنوعی می‌تواند مشخص کند که کدام زیرنویس از سرعت خواندن بیشتر است و کوتاه‌تر کردن را پیشنهاد کند.

اما مراقب باشید: ASR در نویز، لهجه، گفتار همپوشانی، نام‌های مناسب و اصطلاحات فنی اشتباه می‌کند. نمی تواند "توضیحات صوتی" را ارائه دهد. چه کسی صحبت می کند ممکن است گیج شود. ترجمه هوش مصنوعی تصویر را نمی‌بیند - نمی‌تواند بفهمد که چه زمانی به یک شی نشان داده شده روی صفحه نمایش "that" گفته می‌شود. بنابراین، انسان زمینه بصری و دقت رمزگشایی را تأیید می کند.

احتیاط: رایج ترین اشتباه این است که فکر کنید خروجی ASR "رمزگشایی" شده است. ASR مرتکب اشتباهات مکرر می شود، به خصوص در نام های خاص، اعداد، نام های تجاری و اصطلاحات فنی. رونویسی نادرست به ترجمه و زیرنویس منتقل می شود. مطمئن شوید که با گوش دادن به صدا، مناطق بحرانی را تأیید کنید.

قوانین قالب زیرنویس

قوانین رایج (بر اساس پلتفرم متفاوت است):

  • ~37-42 کاراکتر در هر خط، حداکثر 2 خط.
  • مدت زمان: ~ 1-6 ثانیه. از زیرنویس های بسیار کوتاه «فلش» خودداری کنید.
  • CPS نباید بیش از 17 باشد (محتوای بزرگسالان).
  • جمله را در جایی که معنی دارد بشکنید («و» یا «اما» را در آخر خط رها نکنید).
  • در صورت امکان، از کات صحنه (تغییر شات) صرفنظر نکنید.
  • قوانین پلت فرم را برای مواردی مانند فحش دادن، آهنگ ها، نوشتن صفحه نمایش دنبال کنید.

سه کیف کوچک

مورد 1 - ASR + ویرایش پس از ویرایش 60٪ افزایش یافت. یک تیم ابتدا یک مستند 45 دقیقه ای را با ASR رونویسی و کدگذاری کردند، سپس آن را ترجمه و پس از ویرایش انجام دادند. زمان نسبت به رونویسی + زمان کدگذاری از ابتدا 60 درصد کاهش یافت. اما همه اسامی و اعداد مناسب با مقایسه صدا تصحیح شدند.

مورد 2 - بررسی CPS خوانایی ذخیره شده. اولین ترجمه یک ویدیوی آموزشی با زیرنویس دقیق بود، اما CPS به طور متوسط ​​24 بود — مخاطبان نتوانستند ادامه دهند. یک دور کوتاه کردن زیرنویس‌های مبتنی بر هوش مصنوعی تا 30% کوتاه شد و CPS را به 16 کاهش داد. معنی حفظ شد، خوانایی آمد.

مورد 3 - خطای زمینه بصری. در ترجمه مبتنی بر ASR، شخصیتی به علامتی روی صفحه اشاره کرد و گفت: «بخوان که». هوش مصنوعی آن را به عنوان "خواندن آن" ترجمه کرد، اما متن روی علامت ترجمه نشد، بنابراین بیننده نمی توانست ببیند چه چیزی را بخواند. زیرنویس یک عنوان جداگانه برای عنوان صفحه اضافه کرد. شخصی که تصویر را دید تفاوت را ایجاد کرد.

چهار قالب قابل کپی

1) فهرست تأیید رونویسی (ASR):

در زیر یک رونویسی خودکار از یک ویدیو وجود دارد. خطاهای احتمالی در رونویسی را علامت بزنید: نام های مناسب، نام های تجاری، اعداد، اصطلاحات فنی، جملات مبهم/ناقص. این موارد را به عنوان «تأیید از طریق صدا» فهرست کنید. ترجمه نکن رونویسی: [...]

2) ترجمه زیرنویس (CPS/طول محدود):

رونویسی زیر را به زیرنویس [زبان مقصد] ترجمه کنید. محدودیت: هر زیرنویس باید حداکثر 2 خط، خط ~42 کاراکتر، CPS از ~17 بیشتر نباشد. کوتاه کردن و طبیعی کردن با حفظ معنی. کلمه به کلمه ترجمه نکنید حفظ کدهای زمانی رونویسی + کدهای زمان: [...]

3) بررسی CPS/خوانایی:

CPS تقریبی را بر اساس مدت زمان و تعداد کاراکتر برای هر یک از زیرنویس‌های زیر محاسبه کنید. هر کدام را که بیش از 17 است علامت بزنید و جایگزین کوتاه تری پیشنهاد کنید که معنی را حفظ کند. زیرنویس (متن | مدت ثانیه): [...]

4) متن صفحه / بررسی زمینه بصری:

در گفتگوی زیر، مکان هایی را که ممکن است به تصویر اشاره داشته باشد (متن صفحه، شیء اشاره دار، علامت) علامت بزنید. با فرض اینکه بیننده نمی تواند تصویر را ببیند، بگویید که آیا زیرنویس / توضیحات اضافی برای این موارد لازم است یا خیر. گفتگو: [...]

اعلان ضعیف / اعلان قوی

ضعیف: "این زیرنویس ها را ترجمه کنید." (بدون طول، CPS، قوانین خط؛ خروجی روی صفحه نمایش نمی‌شود، قابل خواندن نیست.)

گوچلو: "این رونوشت دیالوگ را به زیرنویس ترکی ترجمه کنید. هر زیرنویس باید حداکثر 2 خط، 42 کاراکتر در هر خط باشد؛ با حفظ معنی در صورت لزوم برای سرعت خواندن، آن را کوتاه کنید. زبان گفتاری را به ترکی طبیعی بدهید، زبان عامیانه را نرم کنید. رمزهای زمانی را لمس نکنید."

تفاوت: اعلان قوی محدودیت های فنی زیرنویس (خط، کاراکتر، CPS، لحن) را نشان می دهد. خروجی در واقع به زیرنویس های قابل استفاده نزدیک می شود.

نمودار مقایسه فرمت های AVT

قالب

چه می کند

سهم هوش مصنوعی

نقطه بحرانی انسان

زیرنویس

سخنرانی را رونویسی می کند

ASR، ترجمه، CPS

مناسب، زمینه بصری

دوبله

صداگذاری به زبان مقصد

پیش نویس ترجمه

همگام سازی لب، بازیگری

صداگذاری

ترجمه بالا را بخوانید

ترجمه، زمان بندی

جریان طبیعی، تن

توضیحات صوتی

تصویر را با صدا توصیف می کند

متن پیش نویس

تفسیر بصری (انسان)

اشتباهات رایج

  • ترجمه رونوشت ASR بدون تأیید آن. اشتباهات نام / شماره مناسب به زیرنویس منتقل می شود.
  • ترجمه کلمه به کلمه و دور زدن CPS. مخاطب نمی تواند بخواند. متناسب باید ساخته شود.
  • نادیده گرفتن زمینه بصری متن صفحه و اشیاء اشاره‌دار ترجمه نشده باقی می‌مانند.
  • بیهوده کردن شکاف خط خوانایی را خراب می کند.
  • صاف کردن لحن/رجیستر. لهجه و زبان عامیانه شخصیت ها از بین می رود.

دوبله و همگام سازی لب

در حالی که محدودیت زیرنویس سرعت خواندن است، محدودیت دوبله زمان و لب است. سه نوع متمایز همگام سازی در ترجمه صوتی وجود دارد: همگام سازی لب - جایی که ترجمه با حرکات دهان شخصیت، به ویژه مصوت های باز در نماهای نزدیک مطابقت دارد. isochrony - طول خط ترجمه به اندازه خط اصلی است، نه خیلی کوتاه و نه خیلی طولانی. همگامی ژست - مطابقت با آنچه گفته می شود با حرکات دست و بازوی شخصیت. به همین دلیل است که مترجم دوبله اغلب یک خط "جذاب" می نویسد که معنی را حفظ می کند اما با کلمات کاملاً متفاوت. وفاداری کلمه در اینجا حتی کمتر از زیرنویس است.

هوش مصنوعی می تواند یک پیش نویس ترجمه خام و یک هشدار زمانی برای دوبله ارائه دهد ("این خط 40٪ طولانی تر از خط اصلی است، آن را کوتاه کنید"). فناوری‌های جدید حتی می‌توانند صدا را شبیه‌سازی کنند و دوبله خودکار تولید کنند. اما بازیگری، احساس، تنظیم دقیق تنفس و همگام سازی شخصیت هنوز کار مترجم و صداپیشه انسان است. دوبله خودکار یک طرح کلی را ارائه می دهد. تصمیم هنری و همزمان با انسان است. علاوه بر این، رضایت فردی که صدای او شبیه سازی شده است، یک موضوع مهم اخلاقی و قانونی است.

به طور خلاصه

ترجمه سمعی و بصری هنر تناسب متن با محدودیت های چشم و گوش بیننده است: مرزهای خط / شخصیت / CPS در زیرنویس، همگام سازی لب در دوبله، زمینه بصری عامل تعیین کننده در همه آنها است. هوش مصنوعی رونویسی، زمان‌کدگذاری، تهیه پیش‌نویس ترجمه و بررسی CPS را با ASR سرعت می‌بخشد. اما ASR در نام‌های مناسب و نویز اشتباه می‌شود، تصویر را نمی‌بیند و تصمیمات تناسبی توسط انسان گرفته می‌شود. زیرنویس اصلی کلمه به کلمه ترجمه نمی کند. کوتاه ترین و طبیعی ترین بیان را می یابد که معنی را حفظ می کند.

وظیفه کاربردی

یک کلیپ ویدیویی کوتاه (2-3 دقیقه) انتخاب کنید. با یک ابزار ASR رونویسی کنید و مناطق پرخطر را با صدا با الگوی "تأیید رونویسی" مقایسه و تصحیح کنید. سپس با محدودیت CPS ~17 با الگوی "ترجمه زیرنویس" ترجمه کنید و زیرنویس هایی را که از حد مجاز فراتر می روند با "کنترل CPS" کوتاه کنید. اگر متن یا علامت صفحه وجود دارد، یک "بررسی زمینه بصری" اعمال کنید.

چک لیست

  • [ ] من رمزگشایی ASR را با صدا برای نام/شماره خاص تأیید کردم.
  • [ ] زیرنویس‌ها را در قوانین خط/شخصیت/CPS قرار دادم.
  • [ ] آن را کوتاه و طبیعی کردم، نه کلمه به کلمه، با حفظ معنی.
  • [ ] من زمینه بصری (متن روی صفحه، علامت) را در نظر گرفتم.
  • [ ] برای حفظ تفاوت لحن و شخصیت آن را ترجمه کردم.