એકમો
1. વિડીયો પ્રોડક્શનમાં AI નો પરિચય: ભૂમિકાઓ, સીમાઓ, પ્રમાણીકરણ, કોપીરાઈટ અને ગોપનીયતા 2. આઈડિયાથી સ્ક્રિપ્ટ સુધી: કન્સેપ્ટ ડેવલપમેન્ટ, સ્ક્રિપ્ટ અને શૂટિંગ પ્લાન 3. સ્ટોરીબોર્ડ અને વિઝ્યુઅલ તૈયારી: પ્રીવિઝ, સંદર્ભ અને શૂટિંગ ડિઝાઇન 4. ટ્રાન્સક્રિપ્શન અને સબટાઇટલિંગ: સ્પીચ ટુ ટેક્સ્ટ અને બહુભાષી સબટાઇટલિંગ 5. સંપાદન સહાયક: રફ એડિટિંગ, સીન સિલેક્શન, રિધમ અને એડિટિંગ 6. ડબિંગ, વૉઇસ ક્લોનિંગ અને બહુભાષી ડબિંગ 7. ટૂંકી ક્લિપ અને ઉત્પાદક વિડિઓ: ટેક્સ્ટ-ટુ-ટેક્સ્ટ વિડિઓ, બી-રોલ અને સોશિયલ મીડિયા ક્લિપ્સ 8. વિઝ્યુઅલ ઇફેક્ટ્સ, કલર, ઑડિયો ક્લિનિંગ અને એન્હાન્સમેન્ટ 9. શીર્ષક, થંબનેલ, મેટાડેટા અને વિતરણ ઓપ્ટિમાઇઝેશન 10. કૉપિરાઇટ, બ્રાન્ડ સલામતી, ડીપફેક એથિક્સ અને સંમતિ 11. એન્ડ-ટુ-એન્ડ વર્કફ્લો: ટૂલસ્ટેક, ટીમ, ગુણવત્તા નિયંત્રણ અને ડિલિવરી
એકમ 8 / 11

વિઝ્યુઅલ ઇફેક્ટ્સ, કલર, ઑડિયો ક્લિનિંગ અને એન્હાન્સમેન્ટ

નફો:

  • આર્ટિફિશિયલ ઇન્ટેલિજન્સ-સપોર્ટેડ માસ્કિંગ (રોટોસ્કોપિંગ), ઑબ્જેક્ટ રિમૂવલ, અપસ્કેલિંગ અને અવાજ દૂર કરવાના સાધનોની સમજ
  • આર્ટિફિશિયલ ઇન્ટેલિજન્સ સપોર્ટ સાથે કલર ગ્રેડિંગ અને સાઉન્ડ ક્લિનિંગ ડ્રાફ્ટ તૈયાર કરવાની અને તેમાં સુધારો કરવાની ક્ષમતા
  • એ સમજવામાં સક્ષમ બનવું કે સ્વચાલિત સુધારણા દસ્તાવેજી/સમાચાર સામગ્રીમાં વિગતો (આર્ટિફેક્ટ) અને વાસ્તવિકતાને વિકૃત કરવાની નૈતિક મર્યાદા બનાવી શકે છે.

જ્યારે સંપાદન સમાપ્ત થાય છે, ત્યારે વિડિયો "કથનાત્મક રીતે" તૈયાર છે, પરંતુ તે હજુ સુધી "દૃષ્ટિપૂર્વક અને શ્રાવ્ય રીતે" પોલિશ કરવામાં આવ્યો નથી. આ અંતિમ પોલિશિંગ સ્ટેજ—રંગ, ઑડિયો ક્લિનઅપ, ઇફેક્ટ્સ અને એન્હાન્સમેન્ટ—એ સ્તર છે જે વિડિઓને કલાપ્રેમીથી વ્યાવસાયિક સુધી લઈ જાય છે. પરંપરાગત રીતે, આમાંના મોટા ભાગના માટે કુશળતા અને કલાકોની જરૂર પડે છે: ફ્રેમમાંથી ઑબ્જેક્ટને ભૂંસી નાખવા માટે હેન્ડ માસ્કિંગ, ઇન્ટરવ્યૂના હમને સાફ કરવા માટે સુંદર અવાજની રચના. આર્ટિફિશિયલ ઇન્ટેલિજન્સે આ બંને કાર્યોને વેગ આપ્યો છે અને કુશળતાની થ્રેશોલ્ડને ઓછી કરી છે. પરંતુ ઉન્નતીકરણ સાધનોમાં એક અનોખો ભય હોય છે: તેઓ કેટલીકવાર એવી વિગતો "મેકઅપ" કરે છે જે અસ્તિત્વમાં નથી. આ એકમમાં આપણે શક્તિ અને વાસ્તવિકતાની મર્યાદા બંનેને આવરી લઈશું.

શરતો. માસ્કિંગ / રોટોસ્કોપિંગ એ ઑબ્જેક્ટને ફ્રેમ દ્વારા ફ્રેમને અલગ કરીને પસંદ કરવાનું છે (બેકગ્રાઉન્ડ બદલવા માટે, ઑબ્જેક્ટ કાઢી નાખો). ઑબ્જેક્ટ દૂર કરવું એ છબીમાંથી અનિચ્છનીય તત્વ (ફોન, લોગો, વ્યક્તિ) દૂર કરવું અને પૃષ્ઠભૂમિમાં ભરવાનું છે. રિઝોલ્યુશન અપસ્કેલિંગ એ નીચા રિઝોલ્યુશનની ઇમેજને ઊંચી કરવા માટે છે. Denoise એ ઇમેજમાં અવાજ ઘટાડવા અથવા ઑડિયોમાં હમ કરવાનો છે. કલર ગ્રેડિંગ ઇમેજના રંગ અને ટોનલ કેરેક્ટરને એડજસ્ટ કરીને વાતાવરણનું સર્જન કરે છે. આર્ટિફેક્ટ એ કૃત્રિમ, અનિચ્છનીય વિકૃતિ અથવા બનાવટી વિગતો છે જે શુદ્ધિકરણ દરમિયાન રજૂ કરવામાં આવે છે.

કૃત્રિમ બુદ્ધિ સંચાલિત વિઝ્યુઅલ ઇફેક્ટ્સ

સંપાદકને દિવસો લાગતા કામ હવે મિનિટ લે છે. ઓટોમેટિક માસ્કિંગ ગ્રીન સ્ક્રીન વગર વ્યક્તિને બેકગ્રાઉન્ડમાંથી અલગ કરી શકે છે. ઑબ્જેક્ટ દૂર કરવાથી ફ્રેમમાંથી ટ્રૅશ કૅન, માઇક્રોફોન અથવા અનિચ્છનીય વ્યક્તિ કાઢી શકાય છે અને બૅકગ્રાઉન્ડમાં બુદ્ધિપૂર્વક ભરી શકાય છે. બેકગ્રાઉન્ડ ચેન્જીંગ અને મુવમેન્ટ ટ્રેકિંગ મોટાભાગે ઓટોમેટેડ બની ગયા છે. આ એક વાસ્તવિક ઉત્પાદકતા લીપ છે. પરંતુ પરિણામ ક્યારેય આંધળાપણે સ્વીકારવામાં આવતું નથી: ઑબ્જેક્ટ દૂર કરવામાં પૃષ્ઠભૂમિ "ભૂત" ટ્રેસ છોડી શકે છે; માસ્કિંગ વાળ અને કિનારીઓ પર ફ્લિકર કરી શકે છે; ભરાયેલો વિસ્તાર આસપાસના પેશીઓ સાથે અસંગત હોઈ શકે છે. દરેક અસર ફ્રેમને પૂર્ણ સ્ક્રીનમાં અને ગતિમાં તપાસવી આવશ્યક છે.

રંગ અને ધ્વનિ: સ્વચાલિત પ્રારંભ, માનવ પોલીશ

રંગ સુધારણામાં, AI આપમેળે સફેદ સંતુલન સુધારી શકે છે અને એક્સપોઝરને સમાન કરી શકે છે, અથવા "સિનેમેટિક દેખાવ" પણ સૂચવી શકે છે. આ એક સારો પ્રારંભિક બિંદુ છે, પરંતુ રંગ પણ અભિવ્યક્તિનું એક સાધન છે: ઠંડા ટોન તણાવ દર્શાવે છે, ગરમ ટોન આત્મીયતા દર્શાવે છે. આ સર્જનાત્મક નિર્ણયને સ્વચાલિત કરવા માટે છોડી દેવાથી વિડિયોની લાગણી સપાટ થાય છે. AI બરાબરી કરે છે; તમે વાતાવરણ બનાવો.

ધ્વનિ સફાઈમાં AI આજે ખૂબ જ શક્તિશાળી છે: તે બેકગ્રાઉન્ડ હમ, એર કન્ડીશનીંગ અવાજ, પડઘો અને પવનને પણ અમુક અંશે ઘટાડી શકે છે; તે વાતચીતને પ્રકાશિત કરી શકે છે. પરંતુ વધુ પડતી સફાઈ અવાજને "પાણીની અંદર" ની જેમ મફલ અને કૃત્રિમ બનાવે છે; "s" અને "t" જેવા અવાજો વિકૃત થઈ શકે છે (આર્ટિફેક્ટ). નિયમ: કાન દ્વારા સફાઈ તપાસો અને તેને મધ્યસ્થતામાં રાખો. ઉદ્દેશ્ય અવાજને જંતુરહિત બનાવવાનો નથી, પરંતુ તેને કુદરતી અને સમજી શકાય તેવું બનાવવાનો છે.

નીચેનું કોષ્ટક હેતુ અને જોખમ દ્વારા ઉપાયના સાધનોનો સારાંશ આપે છે:

વ્યવહાર

AI યોગદાન

મુખ્ય જોખમ

નિયંત્રણ

ઑબ્જેક્ટ દૂર કરવું

ઑટોફિલ

ઘોસ્ટ ટ્રેસ, મેળ ન ખાતી રચના

એનિમેટેડ પૂર્ણ સ્ક્રીન જોવા

અપસ્કેલિંગ

રિઝોલ્યુશન વધારો

બનાવટી વિગતો, કૃત્રિમ ચહેરો

મૂળ સાથે સરખામણી

Denoise (છબી)

કળતર ઘટાડો

એક્સ્ટ્રીમ સોફ્ટનિંગ, પ્લાસ્ટિક ટેક્સચર

વિગત નુકશાન નિયંત્રણ

અવાજ સફાઈ

હમિંગ/ઇકો રિડક્શન

મફ્લ્ડ, કૃત્રિમ અવાજ, આર્ટિફેક્ટ

કાન દ્વારા, મધ્યસ્થતામાં

રંગ સંપાદન

સ્વતઃ સમન્વયન

લાગણીહીન, સપાટ નજર

સર્જનાત્મક સ્વરનો નિર્ણય માનવીના હાથમાં છે

વાસ્તવિકતા મર્યાદા: જ્યારે સુધારણા અનૈતિક હોય છે

આ સૌથી જટિલ ખ્યાલ છે. રિઝોલ્યુશન એન્હાન્સમેન્ટ અને અવાજ દૂર કરવાના સાધનો એવી વિગતો બનાવી શકે છે જે વાસ્તવિકતામાં નથી. ઝાંખા ચહેરાને શાર્પ કરતી વખતે, અપસ્કેલર ચહેરાના લક્ષણો "ઉત્પાદિત" કરી શકે છે જે વાસ્તવમાં અસ્તિત્વમાં નથી - એક ચહેરો જે તે વ્યક્તિ જેવો દેખાય છે પણ તે નથી. આ કાલ્પનિક અથવા સૌંદર્યલક્ષી સામગ્રી સાથે સમસ્યા ન હોઈ શકે; પરંતુ સમાચાર, દસ્તાવેજી, ફોરેન્સિક અને વાસ્તવિક હોવાનો દાવો કરતી સામગ્રીમાં વાસ્તવિકતાને વિકૃત કરવી અનૈતિક છે. સિક્યોરિટી કેમેરાની ઈમેજને "સ્પષ્ટતા" કરવી અને લાયસન્સ પ્લેટ વાંચવી વાસ્તવમાં મોડેલ બનાવેલી લાઇસન્સ પ્લેટ વાંચી રહી હોઈ શકે. નિયમ સ્પષ્ટ છે: અવાજ ઘટાડવા અને તીક્ષ્ણ કરવાની મંજૂરી છે; પરંતુ સામગ્રીનો અર્થ, બોલાયેલા શબ્દ અથવા વાસ્તવિક વિગતમાં ફેરફાર કરવો એ ભ્રામક છે.

ધ્યાન: દસ્તાવેજી અને સમાચાર સામગ્રીમાં સુધારો "જે અસ્તિત્વમાં છે તેને વધુ દૃશ્યમાન બનાવવા" પૂરતો મર્યાદિત હોવો જોઈએ. "જે અસ્તિત્વમાં નથી તે ઉમેરવું" (ચહેરાની વિગતો, લાઇસન્સ પ્લેટ, શબ્દો) દર્શકોને ગેરમાર્ગે દોરે છે અને વ્યાવસાયિક આત્મવિશ્વાસનો નાશ કરે છે. જ્યારે શંકા હોય, ત્યારે મૂળ રાખો અને દખલગીરી સૂચવો.

ત્રણ નાના કેસો

કેસ 1 - ઝડપી સફાઈ. એક ડોક્યુમેન્ટેરીયનને ઈન્ટરવ્યુની બહાર શૂટ દરમિયાન પવન અને ટ્રાફિકના અવાજથી પીડાય છે. ધ્વનિ સફાઈ સાથે, AI એ હમ ઘટાડ્યું અને વાણી પર ભાર મૂક્યો; તેણે કાન દ્વારા પરિણામ તપાસ્યું અને ખાતરી કરી કે ત્યાં કોઈ કલાકૃતિઓ નથી. કોઈ રીશૂટની જરૂર નહોતી, ઇન્ટરવ્યુ સાચવવામાં આવ્યો હતો. વાહને અવાજ સાફ કર્યો; સંપાદકે સહજતા જાળવી રાખી.

કેસ 2 — નકલી અપસ્કેલર. એક ટીમે આર્કાઇવમાંથી લો-રિઝોલ્યુશન ચહેરાની છબીને અપસ્કેલ કરીને "સ્પષ્ટ" કરી અને તેનો ડોક્યુમેન્ટરીમાં ઉપયોગ કર્યો. પાછળથી, એવું સમજાયું કે જે ચહેરો સ્પષ્ટ થઈ ગયો હતો તેમાં એવા લક્ષણો હતા જે વાસ્તવમાં તે વ્યક્તિના ન હતા, પરંતુ મોડેલ દ્વારા બનાવવામાં આવ્યા હતા. ડોક્યુમેન્ટ્રીની વિશ્વસનીયતા પર સવાલ ઉઠાવવામાં આવ્યા છે. પાઠ: અપસ્કેલિંગ પરિણામ વાસ્તવિક હોવાનો દાવો કરતા ચહેરા/વિગત પર વાસ્તવિક ગણી શકાય નહીં.

કેસ 3 - અતિશય સફાઈ. એક સંપાદકે ખૂબ જ આક્રમક રીતે પોડકાસ્ટના ઓડિયોને "સંપૂર્ણ" બનાવવા માટે તેને સાફ કર્યો. પરિણામ મફલ્ડ, પાણીની અંદર અને કૃત્રિમ હતું; સાંભળનારાઓએ કહ્યું કે અવાજ ખલેલ પહોંચાડતો હતો. સાચો રસ્તો એ હતો કે સફાઈને ડોઝમાં રાખવી અને તેની કાન દ્વારા ઘણી વખત સરખામણી કરવી.

નબળા પ્રોમ્પ્ટ / મજબૂત પ્રોમ્પ્ટ

ઑડિઓ/વિડિયો ટૂલ્સ મોટાભાગે બટન-સંચાલિત હોય છે, પરંતુ તમારી પાસે વર્કફ્લો પ્લાન બનાવવા માટે ટેક્સ્ટ સહાયક પણ હોઈ શકે છે.

નબળી ઇચ્છા:

ઑડિઓ અને વિડિયોને ઠીક કરો અને ઑપ્ટિમાઇઝ કરો.

"શ્રેષ્ઠ" અવ્યાખ્યાયિત છે; કઈ પ્રક્રિયા, કઈ માત્રા, કયું નિયંત્રણ અસ્પષ્ટ છે.

તીવ્ર ઇચ્છા:

તમારી ભૂમિકા: પોસ્ટ-પ્રોડક્શન વર્કફ્લો સલાહકાર. સામગ્રી: ઇન્ટરવ્યુ બહાર ગોળી; ત્યાં પવનની કિકિયારી છે, છબી સહેજ ઘોંઘાટીયા છે, પૃષ્ઠભૂમિમાં એક અનિચ્છનીય નિશાની છે. કાર્ય: પગલાવાર સુધારણા યોજના લખો. દરેક પગલામાં: હેતુ, ડોઝ ચેતવણી અને નિયંત્રણ પદ્ધતિ. પ્રતિબંધ: આ એક દસ્તાવેજી છે; હસ્તક્ષેપોની દરખાસ્ત કરશો નહીં કે જે વાસ્તવિકતાને બદલશે, ફક્ત એવા ઓપરેશન્સ સૂચવો કે જે અસ્તિત્વમાં છે તે દૃશ્યમાન/શ્રાવ્ય બનાવે.

સામાન્ય ભૂલો

  • ગતિમાં અસર ફ્રેમ જોવાનું નથી. ઘોસ્ટ ટ્રેઇલ અને ફ્લિકર ફક્ત ત્યારે જ દેખાય છે જ્યારે પાછા વગાડવામાં આવે.
  • અતિશય અવાજ સફાઈ. જ્યારે ડોઝ ઓળંગી જાય છે, ત્યારે અવાજ કર્કશ અને કૃત્રિમ બને છે; આર્ટિફેક્ટ થાય છે.
  • વાસ્તવિક માટે અપસ્કેલિંગ આઉટપુટને ભૂલવું. મોડેલ ચહેરો/વિગત ફિટ કરી શકે છે; તેનો ઉપયોગ વાસ્તવિકતાનો દાવો કરવા માટે કરી શકાતો નથી.
  • રંગ આપોઆપ છોડો. રંગ એ અભિવ્યક્તિનું સાધન છે; ભાવનાત્મક નિર્ણય વ્યક્તિનો છે.
  • ડોક્યુમેન્ટરીમાં બદલાતી વાસ્તવિકતા. જે અસ્તિત્વમાં નથી તે ઉમેરવું એ ભ્રામક અને વ્યાવસાયિક ઉલ્લંઘન છે.
ટીપ: વધારો કરતી વખતે, હંમેશા મૂળ રાખો અને "પહેલા/પછી" સરખામણી કરો. એક નાનો સુધારો મોટાભાગે મોટા હસ્તક્ષેપ કરતાં વધુ કુદરતી અને સલામત હોય છે.

સારાંશમાં

વિઝ્યુઅલ ઇફેક્ટ્સ, રંગ અને ધ્વનિ વૃદ્ધિમાં, AI કુશળતાના થ્રેશોલ્ડને ઘટાડે છે, કામના કલાકોને મિનિટમાં ઘટાડે છે: સ્વચાલિત માસ્કિંગ, ઑબ્જેક્ટ દૂર કરવું, અવાજની સફાઈ અને રંગ સમાનતા હવે દરેકની પહોંચમાં છે. પરંતુ બે મર્યાદા હંમેશા લાગુ પડે છે. પ્રથમ તકનીકી છે: દરેક હસ્તક્ષેપ કલાકૃતિઓ (ભૂતની નિશાની, મફલ્ડ સાઉન્ડ, મેડ-અપ વિગતો) ઉત્પન્ન કરી શકે છે, તેથી તે મધ્યસ્થતામાં થવું જોઈએ અને મૂળ સાથે સરખામણી કરવી જોઈએ. બીજું નૈતિક છે: ઘોંઘાટ ઘટાડવા અને સ્પષ્ટતા કરવાની મંજૂરી છે, પરંતુ વાસ્તવિકતામાં ફેરફાર - ખાસ કરીને સમાચાર અને દસ્તાવેજીમાં - ભ્રામક છે. AI છબી અને ધ્વનિને પોલિશ કરે છે; તમે વાસ્તવિકતા અને સર્જનાત્મક સ્વર જાળવી રાખો છો.

એપ્લિકેશન કાર્ય

ઘોંઘાટીયા ઓડિયો રેકોર્ડિંગ અને થોડી વિકૃત ઇમેજ ક્લિપ (કદાચ તમારું પોતાનું ફૂટેજ) પસંદ કરો. બે અલગ-અલગ ડોઝમાં સાઉન્ડ ક્લિયરિંગ લાગુ કરો અને કાન દ્વારા સરખામણી કરો; નોંધ કરો કે કયા ડોઝ પર પ્રાકૃતિકતા વિકૃત છે. ઇમેજમાંથી ઑબ્જેક્ટને દૂર કરવાનો અથવા તેને વધારવાનો પ્રયાસ કરો અને આર્ટિફેક્ટ/ફેબ્રિકેશનના ઓછામાં ઓછા બે ચિહ્નો શોધવા માટે મૂળ સાથે આઉટપુટની તુલના કરો. જો આ ક્લિપ ડોક્યુમેન્ટરીમાં ઉપયોગમાં લેવાતી હોય, તો તમે શા માટે દરમિયાનગીરી કરશો નહીં તેના કારણો લખો.

ચેકલિસ્ટ

  • [ ] શું મેં ગતિ/પ્લેબેકમાં દરેક અસરગ્રસ્ત/સાફ કરેલ આઉટપુટ અને મૂળની તુલનામાં તપાસ કરી છે?
  • [ ] શું મેં અવાજની સફાઈને એવી માત્રામાં રાખી છે કે જેનાથી કલાકૃતિઓ ન બને?
  • [ ] શું મેં બનાવટી વિગતો માટે અપસ્કેલિંગ/ઓપ્ટિમાઇઝેશન આઉટપુટ તપાસ્યું છે?
  • [ ] શું મેં સર્જનાત્મક પસંદગી તરીકે સભાનપણે રંગનો નિર્ણય લીધો હતો?
  • [ ] શું મેં એવી મર્યાદા જાળવી રાખી છે જે વાસ્તવિક હોવાનો દાવો કરતી સામગ્રીમાં વાસ્તવિકતાને વિકૃત કરશે નહીં?