એકમો
1. અનુવાદ અને અર્થઘટનમાં આર્ટિફિશિયલ ઇન્ટેલિજન્સનો પરિચય: ભૂમિકાઓ, સીમાઓ, પ્રમાણીકરણ, ગોપનીયતા અને નીતિશાસ્ત્ર 2. મશીન ટ્રાન્સલેશન ફંડામેન્ટલ્સ: NMT, LLM, એન્જિન પસંદગી અને પૂર્વ-મૂલ્યાંકન 3. મશીન ટ્રાન્સલેશન પોસ્ટ-એડિટિંગ (MTPE): હલકો અને સંપૂર્ણ પોસ્ટ-એડિટિંગ 4. પરિભાષા વ્યવસ્થાપન અને ટર્મબેઝ: સુસંગતતા અને કોર્પોરેટ ભાષા 5. CAT ટૂલ્સ અને ટ્રાન્સલેશન મેમરી (TM) સાથે AI એકીકરણ 6. સ્થાનિકીકરણ (L10n): સોફ્ટવેર, વેબ, ગેમ અને સાંસ્કૃતિક અનુકૂલન 7. સબટાઇટલિંગ, ડબિંગ અને ઑડિઓવિઝ્યુઅલ અનુવાદ 8. ગુણવત્તા નિયંત્રણ (QA), મૂલ્યાંકન મેટ્રિક્સ અને LQA 9. અર્થઘટનની તૈયારી: સળંગ અને એકસાથે અર્થઘટન 10. સંદર્ભ, સંસ્કૃતિ, સ્વર અને સર્જનાત્મક અનુવાદ (લિપિકરણ) 11. ગોપનીયતા, નીતિશાસ્ત્ર, કૉપિરાઇટ, અધિકૃતતા અને વ્યવસાયનું ભવિષ્ય
એકમ 7 / 11

સબટાઇટલિંગ, ડબિંગ અને ઑડિઓવિઝ્યુઅલ અનુવાદ

નફો:

  • ઉપશીર્ષક (લાઇન, પાત્ર, CPS) ના તકનીકી નિયમો લાગુ કરીને અર્થ સાચવતી વખતે ફિટ થવાની ક્ષમતા
  • ASR સાથે ટ્રાન્સક્રિપ્શન અને ઓટોમેટિક ટાઇમકોડિંગને ઝડપી બનાવતી વખતે અવાજ દ્વારા યોગ્ય નામ અને નંબરની ભૂલો ચકાસવાની ક્ષમતા
  • ડબિંગમાં દ્રશ્ય સંદર્ભ, ટોનલ તફાવત અને લિપ સિંકને ધ્યાનમાં લઈને કૃત્રિમ બુદ્ધિની મર્યાદાઓનું સંચાલન કરવાની ક્ષમતા

મૂવી, ટીવી શ્રેણી, કોર્પોરેટ વિડિયો અથવા ઑનલાઇન કોર્સનું ભાષાંતર કરવું એ સાદા ટેક્સ્ટના અનુવાદ કરતાં ધરમૂળથી અલગ છે: સમય, વાંચવાની ઝડપ, ઑન-સ્ક્રીન છબી, અવાજ અને પાત્રોની હોઠની હિલચાલ પણ અવરોધો છે. આ એકમમાં, તમે ઑડિયોવિઝ્યુઅલ અનુવાદ (સબટાઇટલિંગ, ડબિંગ, વૉઇસ-ઓવર), સબટાઇટલિંગના તકનીકી નિયમો, AI-સપોર્ટેડ ટ્રાંસ્ક્રિપ્શન અને ટાઇમ કોડિંગ અને આ ક્ષેત્રની ગુણવત્તાની ખામીઓ શીખી શકશો. ઉદ્દેશ્ય ઑડિયોવિઝ્યુઅલ અનુવાદ નિષ્ણાતની જેમ કામ કરવાનો છે જે "ટેક્સ્ટનું ભાષાંતર" કરવાને બદલે "પ્રેક્ષકોની આંખો અને કાનને બંધબેસે છે".

મૂળભૂત ખ્યાલો

ઑડિયોવિઝ્યુઅલ ટ્રાન્સલેશન (AVT) ઑડિયો અને વિડિયો ધરાવતી સામગ્રીનો અનુવાદ છે; મુખ્ય સ્વરૂપો સબટાઇટલિંગ, ડબિંગ અને ઑડિઓ વર્ણન છે. સબટાઇટલિંગ એ સ્ક્રીન પર લેખિત સ્વરૂપમાં ભાષણનું પ્રતિબિંબ છે. ડબિંગ એ લક્ષ્ય ભાષામાં મૂળ અવાજનું ફરીથી ડબિંગ છે. વૉઇસ-ઓવર એ છે જ્યારે મૂળ અવાજ મ્યૂટ કરવામાં આવે છે અને તેના પર અનુવાદ વાંચવામાં આવે છે (ડોક્યુમેન્ટરીમાં સામાન્ય).

સબટાઇટલિંગની બે જટિલ તકનીકી શરતો: CPS (કેરેક્ટર પ્રતિ સેકન્ડ) સબટાઇટલિંગની ઝડપને મર્યાદિત કરે છે જેથી દર્શક તેને આરામથી વાંચી શકે; સામાન્ય રીતે સ્વીકૃત ઉપલી મર્યાદા લગભગ 17 અક્ષરો પ્રતિ સેકન્ડ છે (બાળકોની સામગ્રી માટે ઓછી). ટાઈમકોડ એ શરુઆતનો અંત સમય છે જે દર્શાવે છે કે સબટાઈટલ ક્યારે દેખાશે અને સ્ક્રીન પર અદૃશ્ય થઈ જશે (જેમ કે 00:01:23,400).

શા માટે તે મુશ્કેલ છે? કારણ કે તેનો અર્થ સબટાઈટલમાં ફિટિંગ અનુવાદ છે. બે લીટીઓ, પ્રતિ લીટી ~42 અક્ષરો, ન્યૂનતમ ~1 સેકન્ડ અને વધુમાં વધુ ~6 સેકન્ડનો સ્ક્રીન સમય, અને CPS મર્યાદા — તમારે અર્થ અને સ્વર જાળવી રાખીને આ બધાનું પાલન કરવાની જરૂર છે. એટલા માટે સબટાઈટલ ભાષાંતર ઘણીવાર સંકોચન અને રિફ્રેસિંગની બાબત હોય છે, શબ્દ-બદ-શબ્દ અનુવાદની નહીં.

ટીપ: ઉપશીર્ષકોમાં "દરેક શબ્દનું ભાષાંતર કરવું" ના પ્રતિબિંબને ટાળો. દર્શક બંને છબી જુએ છે અને વાંચે છે; ખૂબ લાંબા સબટાઈટલ વાંચી શકાતા નથી. સૌથી ટૂંકી પ્રાકૃતિક અભિવ્યક્તિ શોધવી જે અર્થને જાળવી રાખે છે તે કૅપ્શનરનું સાચું નિપુણતા છે.

ઑડિયોવિઝ્યુઅલ અનુવાદમાં AI ની ભૂમિકા

AI આ ક્ષેત્રમાં ઘણા પગલાંને નોંધપાત્ર રીતે ઝડપી બનાવે છે:

  1. ટ્રાન્સક્રિપ્શન: ASR (ઓટોમેટિક સ્પીચ રેકગ્નિશન) સાથે, અવાજ આપમેળે ટ્રાન્સક્રિપ્શન થાય છે. આ મિનિટોમાં સબટાઈટલના કાચા સ્ત્રોતને બહાર કાઢે છે.
  2. સ્વચાલિત સમય કોડિંગ: સાધનો વાર્તાલાપને ભાગોમાં વિભાજિત કરે છે અને ડ્રાફ્ટ સમય કોડ બનાવે છે.
  3. અનુવાદનો મુસદ્દો: ટ્રાંસ્ક્રિપ્ટ ટેક્સ્ટનો અનુવાદ કરવામાં આવે છે.
  4. CPS/લેન્થ કંટ્રોલ: AI એ ચિહ્નિત કરી શકે છે કે કયું સબટાઈટલ વાંચવાની ઝડપને ઓળંગે છે અને ટૂંકું કરવાનું સૂચન કરી શકે છે.

પરંતુ સાવચેત રહો: ​​અવાજ, ઉચ્ચારણ, ઓવરલેપિંગ ભાષણ, યોગ્ય નામો અને તકનીકી શબ્દો પર ASR ભૂલો; "ઑડિઓ વર્ણન" પ્રદાન કરી શકતા નથી; કોણ વાત કરે છે તે મૂંઝવણમાં પડી શકે છે. AI અનુવાદ ઇમેજને જોતું નથી - તે જાણી શકતું નથી કે સ્ક્રીન પર બતાવેલ ઑબ્જેક્ટ ક્યારે "તે" કહેવાય છે. તેથી, માનવ દ્રશ્ય સંદર્ભ અને ડિસાયફરીંગ ચોકસાઈની ચકાસણી કરે છે.

સાવધાન: સૌથી સામાન્ય ભૂલ એ છે કે ASR આઉટપુટ "ડીકોડેડ" છે. ASR વારંવાર ભૂલો કરે છે, ખાસ કરીને યોગ્ય નામો, નંબરો, બ્રાન્ડ નામો અને તકનીકી શરતોમાં; અયોગ્ય ટ્રાંસ્ક્રિપ્શન અનુવાદ અને સબટાઇટલિંગ પર વહન કરે છે. ઑડિયો સાંભળીને નિર્ણાયક વિસ્તારોને ચકાસવાની ખાતરી કરો.

સબટાઈટલ ફોર્મેટ નિયમો

સામાન્ય નિયમો (પ્લેટફોર્મ પ્રમાણે બદલાય છે):

  • ~37-42 અક્ષરો પ્રતિ લીટી, મહત્તમ 2 લીટીઓ.
  • અવધિ: ~1-6 સેકન્ડ; ખૂબ ટૂંકા "ફ્લેશ" સબટાઈટલ ટાળો.
  • CPS ~17 (પુખ્ત સામગ્રી) થી વધુ ન હોવો જોઈએ.
  • વાક્યને તોડો જ્યાં તે અર્થપૂર્ણ બને છે (લાઇનના અંતે "અને" અથવા "પરંતુ" છોડશો નહીં).
  • જો શક્ય હોય તો, સીન કટ (શોટ ચેન્જ) છોડશો નહીં.
  • શપથ, ગીતો, સ્ક્રીન રાઇટિંગ જેવી વસ્તુઓ માટે પ્લેટફોર્મ નિયમોનું પાલન કરો.

ત્રણ નાના કેસો

કેસ 1 — ASR + પોસ્ટ-એડિટની ઝડપ 60% વધી. એક ટીમે સૌપ્રથમ ASR સાથે 45-મિનિટની ડોક્યુમેન્ટરીને ટ્રાંસ્ક્રાઇબ અને ટાઇમ-કોડ કરી, પછી તેનું ભાષાંતર અને પોસ્ટ-એડિટ કર્યું. શરૂઆતથી ટ્રાંસસ્ક્રાઇબ + ટાઇમ કોડિંગની સરખામણીમાં સમય 60% ઓછો થયો. પરંતુ તમામ યોગ્ય નામો અને સંખ્યાઓ ધ્વનિ સરખામણી દ્વારા સુધારવામાં આવી હતી.

કેસ 2 - CPS ચેક સાચવેલ વાંચનક્ષમતા. ઉપશીર્ષકો સાથે સૂચનાત્મક વિડિઓનો પ્રથમ અનુવાદ સચોટ હતો, પરંતુ CPS સરેરાશ 24 છે — પ્રેક્ષકો ચાલુ રાખી શક્યા નથી. AI-સંચાલિત શોર્ટનિંગના રાઉન્ડમાં સબટાઈટલને 30%થી ટૂંકાવીને, CPSને 16 સુધી ઘટાડીને; અર્થ સચવાયો, વાંચનક્ષમતા આવી.

કેસ 3 - દ્રશ્ય સંદર્ભ ભૂલ. ASR-આધારિત અનુવાદમાં, એક અક્ષરે સ્ક્રીન પરની નિશાની તરફ ધ્યાન દોર્યું અને કહ્યું કે "તે વાંચો"; AI એ તેનો અનુવાદ "તે વાંચો" તરીકે કર્યો, પરંતુ સાઇન પરના ટેક્સ્ટનો અનુવાદ થયો ન હતો, તેથી દર્શક શું વાંચવું તે જોઈ શક્યા નહીં. કૅપ્શનરે સ્ક્રીન કૅપ્શન માટે અલગ કૅપ્શન ઉમેર્યું છે; જે વ્યક્તિએ છબી જોઈ તે તફાવત બનાવે છે.

ચાર નકલ કરી શકાય તેવા નમૂનાઓ

1) ટ્રાન્સક્રિપ્શન (ASR) ચકાસણી સૂચિ:

નીચે વિડિઓનું સ્વચાલિત ટ્રાન્સક્રિપ્શન છે. ટ્રાંસ્ક્રિપ્શનમાં સંભવિત ભૂલોને ચિહ્નિત કરો: યોગ્ય નામો, બ્રાન્ડ નામો, સંખ્યાઓ, તકનીકી શબ્દો, અસ્પષ્ટ/અપૂર્ણ વાક્યો. આને "વૉઇસ દ્વારા ચકાસો" તરીકે સૂચિબદ્ધ કરો. અનુવાદ કરશો નહીં. ટ્રાંસ્ક્રાઇબ કરો: [...]

2) ઉપશીર્ષક અનુવાદ (CPS/લંબાઈ મર્યાદિત):

નીચેના ટ્રાન્સક્રિપ્શનનું [લક્ષ્ય ભાષા] ઉપશીર્ષકોમાં અનુવાદ કરો. નિયંત્રણ: દરેક સબટાઈટલ મહત્તમ 2 લીટીઓ, લીટી ~42 અક્ષરોની હોવી જોઈએ, CPS ~17 થી વધુ ન હોવી જોઈએ. અર્થ સાચવતી વખતે ટૂંકો અને કુદરતી બનાવો; શબ્દ દ્વારા શબ્દનો અનુવાદ કરશો નહીં. સમય કોડ સાચવો. ટ્રાન્સક્રિપ્શન + ટાઇમ કોડ્સ: [...]

3) CPS/વાંચનક્ષમતા તપાસ:

નીચેના દરેક ઉપશીર્ષકો માટે અવધિ અને અક્ષરોની ગણતરીના આધારે અંદાજિત CPS ની ગણતરી કરો. 17 થી વધુ હોય તેવા કોઈપણને ચિહ્નિત કરો અને ટૂંકા વિકલ્પ સૂચવો જે અર્થને સાચવે. સબટાઈટલ (ટેક્સ્ટ | અવધિ સેકન્ડ): [...]

4) સ્ક્રીન ટેક્સ્ટ / વિઝ્યુઅલ સંદર્ભ તપાસ:

નીચેના સંવાદમાં, તે સ્થાનોને ચિહ્નિત કરો જે છબીનો સંદર્ભ આપી શકે છે (સ્ક્રીન ટેક્સ્ટ, પોઇન્ટેડ ઑબ્જેક્ટ, સાઇન). કહો કે શું આના માટે વધારાના સબટાઈટલ/સ્પષ્ટીકરણો જરૂરી છે, એમ માનીને કે દર્શક ઇમેજ જોઈ શકતા નથી. સંવાદ: [...]

નબળા પ્રોમ્પ્ટ / મજબૂત પ્રોમ્પ્ટ

નબળા: "આ ઉપશીર્ષકોનો અનુવાદ કરો." (કોઈ લંબાઈ, CPS, રેખા નિયમો નથી; આઉટપુટ સ્ક્રીન પર ફિટ થશે નહીં, વાંચી શકાય નહીં.)

Güçlü: "આ ડાયલોગ ટ્રાન્સક્રિપ્ટનું ટર્કિશ સબટાઈટલમાં ભાષાંતર કરો. દરેક સબટાઈટલ મહત્તમ 2 લીટીઓ, 42 અક્ષરો પ્રતિ લીટીનું હોવું જોઈએ; વાંચવાની ઝડપ માટે જરૂરી હોય ત્યારે અર્થ સાચવીને તેને ટૂંકો કરો. પ્રાકૃતિક ટર્કિશમાં બોલાતી ભાષા આપો, અશિષ્ટ ભાષાને નરમ કરો. સમય કોડને સ્પર્શ કરશો નહીં."

તફાવત: મજબૂત પ્રોમ્પ્ટ ઉપશીર્ષક (લાઇન, અક્ષર, CPS, સ્વર) ની તકનીકી અવરોધો આપે છે; આઉટપુટ વાસ્તવમાં ઉપયોગી સબટાઈટલ સુધી પહોંચે છે.

AVT ફોર્મેટ્સ સરખામણી ચાર્ટ

ફોર્મેટ

શું કરે છે

AI યોગદાન

માનવ નિર્ણાયક બિંદુ

ઉપશીર્ષક

ભાષણનું અનુલેખન કરે છે

ASR, અનુવાદ, CPS

ફિટ, દ્રશ્ય સંદર્ભ

ડબિંગ

લક્ષ્ય ભાષામાં વૉઇસઓવર

અનુવાદ ડ્રાફ્ટ

હોઠ સુમેળ, અભિનય

વૉઇસ-ઓવર

ઉપરનો અનુવાદ વાંચો

અનુવાદ, સમય

કુદરતી પ્રવાહ, સ્વર

ઓડિયો વર્ણન

ધ્વનિ સાથે છબીનું વર્ણન કરે છે

ડ્રાફ્ટ ટેક્સ્ટ

દ્રશ્ય અર્થઘટન (માનવ)

સામાન્ય ભૂલો

  • ASR ટ્રાન્સક્રિપ્ટની ચકાસણી કર્યા વિના તેનું ભાષાંતર કરવું. યોગ્ય નામ/સંખ્યાની ભૂલો સબટાઈટલ પર લઈ જવામાં આવે છે.
  • શબ્દ દ્વારા શબ્દનો અનુવાદ કરવો અને CPS ની આસપાસ મેળવવું. પ્રેક્ષકો વાંચી શકતા નથી; ફિટ થવું જોઈએ.
  • દ્રશ્ય સંદર્ભની અવગણના. સ્ક્રીન ટેક્સ્ટ અને પોઇન્ટેડ ઑબ્જેક્ટ્સ અનઅનુવાદિત રહે છે.
  • રેખા વિભાજનને અર્થહીન બનાવવું. તે વાંચનક્ષમતાને બગાડે છે.
  • ટોન/રજિસ્ટરને ચપટી બનાવવું. પાત્રોની બોલીઓ અને અશિષ્ટ અદૃશ્ય થઈ જાય છે.

ડબિંગ અને લિપ સિંક

જ્યારે સબટાઇટલિંગની મર્યાદા વાંચવાની ઝડપ છે, ત્યારે ડબિંગની મર્યાદા સમય અને હોઠ છે. વૉઇસ-ઓવર ટ્રાન્સલેશનમાં ત્રણ અલગ-અલગ પ્રકારના સિંક છે: લિપ-સિંક — જ્યાં અનુવાદ પાત્રના મોંની હિલચાલ સાથે મેળ ખાય છે, ખાસ કરીને ક્લોઝ-અપ્સમાં ખુલ્લા સ્વરો; isochrony — અનુવાદ રેખા મૂળ રેખા જેટલી જ લંબાઈ ધરાવે છે, ન તો ખૂબ ટૂંકી કે ન તો ખૂબ લાંબી; હાવભાવ સુમેળ — પાત્રના હાથ અને હાથની હિલચાલ સાથે જે કહેવામાં આવે છે તેની સાથે મેળ ખાય છે. એટલા માટે ડબિંગ અનુવાદક ઘણીવાર "આકર્ષક" લાઇન લખે છે જે અર્થને સાચવે છે પરંતુ સંપૂર્ણપણે અલગ શબ્દો સાથે; શબ્દ વફાદારી અહીં સબટાઈટલ કરતાં પણ ઓછી છે.

AI કાચો અનુવાદ ડ્રાફ્ટ અને ડબિંગ માટે સમયની ચેતવણી આપી શકે છે ("આ લાઇન મૂળ કરતાં 40% લાંબી છે, તેને ટૂંકી કરો"). નવી તકનીકો અવાજનું ક્લોન પણ કરી શકે છે અને ઓટોમેટિક ડબિંગ પણ બનાવી શકે છે; પરંતુ અભિનય, લાગણી, પાત્રના શ્વાસ અને લિપ-સિંકિંગને ફાઇન ટ્યુનિંગ કરવું એ હજી પણ માનવ અનુવાદક અને અવાજ અભિનેતાનું કામ છે. આપોઆપ ડબિંગ એક રૂપરેખા પૂરી પાડે છે; કલાત્મક અને સુમેળભર્યો નિર્ણય માનવનો છે. વધુમાં, જે વ્યક્તિનો અવાજ ક્લોન કરવામાં આવ્યો છે તેની સંમતિ એ એક મહત્વપૂર્ણ નૈતિક અને કાનૂની મુદ્દો છે.

સારાંશમાં

ઑડિયોવિઝ્યુઅલ ટ્રાન્સલેશન એ દર્શકની આંખ અને કાનની મર્યાદાઓમાં ટેક્સ્ટને ફિટ કરવાની કળા છે: સબટાઇટલિંગમાં રેખા/પાત્ર/સીપીએસ સીમાઓ, ડબિંગમાં લિપ-સિંકિંગ, વિઝ્યુઅલ સંદર્ભ એ બધામાં નિર્ણાયક પરિબળ છે. AI એએસઆર સાથે ટ્રાંસ્ક્રિપ્શન, ટાઇમકોડિંગ, ટ્રાન્સલેશન ડ્રાફ્ટિંગ અને CPS ચેકિંગને ઝડપી બનાવે છે; પરંતુ ASR યોગ્ય નામો અને ઘોંઘાટમાં ભૂલથી છે, તે છબી જોઈ શકતું નથી અને ફિટ-ટોન નિર્ણયો માનવ દ્વારા લેવામાં આવે છે. મુખ્ય સબટાઇટલર શબ્દ માટે શબ્દનું ભાષાંતર કરતું નથી; સૌથી ટૂંકી, સૌથી કુદરતી અભિવ્યક્તિ શોધે છે જે અર્થને સાચવે છે.

એપ્લિકેશન કાર્ય

ટૂંકી (2-3 મિનિટ) વિડિયો ક્લિપ પસંદ કરો. ASR ટૂલ વડે ટ્રાંસ્ક્રાઇબ કરો અને "ટ્રાન્સક્રિપ્શન વેરિફિકેશન" ટેમ્પલેટ સાથે ઓડિયો સાથે જોખમી વિસ્તારોની તુલના કરો અને તેને ઠીક કરો. પછી "સબટાઈટલ ટ્રાન્સલેશન" ટેમ્પલેટ સાથે CPS ~17 ની મર્યાદા સાથે અનુવાદ કરો અને "CPS નિયંત્રણ" વડે મર્યાદા ઓળંગતી સબટાઈટલને ટૂંકી કરો. જો ત્યાં સ્ક્રીન ટેક્સ્ટ અથવા સાઇન હોય, તો "દ્રશ્ય સંદર્ભ તપાસ" લાગુ કરો.

ચેકલિસ્ટ

  • [ ] મેં ચોક્કસ નામ/નંબર માટે અવાજ દ્વારા ASR ડિક્રિપ્શનની ચકાસણી કરી.
  • [ ] મેં સબટાઈટલને લીટી/અક્ષર/CPS નિયમોમાં ફિટ કર્યા છે.
  • [ ] મેં તેને ટૂંકું કર્યું અને પ્રાકૃતિક બનાવ્યું, શબ્દ માટે શબ્દ નહીં, અર્થ સાચવીને.
  • [ ] મેં વિઝ્યુઅલ સંદર્ભ (ઓનસ્ક્રીન ટેક્સ્ટ, સાઇન)ને ધ્યાનમાં લીધું.
  • [ ] મેં સ્વર અને પાત્રના તફાવતને સાચવવા માટે તેનો અનુવાદ કર્યો છે.