નફો:
- ઇમેજ જનરેટ કરતી કૃત્રિમ બુદ્ધિ (પ્રસરણ) કેવી રીતે કાર્ય કરે છે અને ફોટોગ્રાફિક વાસ્તવવાદ માટે કયા રેસીપી ઘટકો જરૂરી છે તે સમજવું
- વિષય, પ્રકાશ, લેન્સ/કેમેરા, રચના, વાતાવરણ અને તકનીકી ઘટકોનો સમાવેશ કરીને મજબૂત ફોટોગ્રાફિક પ્રોમ્પ્ટ લખવાની ક્ષમતા.
- ઉત્પાદિત ઇમેજ અને લીધેલા ફોટોગ્રાફ, ઉપયોગની મર્યાદા અને અધિકૃતતાની ઘોષણાના મહત્વ વચ્ચેનો તફાવત પારખવાની ક્ષમતા
ફોટોગ્રાફર ત્રણ કાયદેસર હેતુઓ માટે જનરેટિવ વિઝ્યુઅલ AI નો ઉપયોગ કરે છે: મૂડબોર્ડ્સ અને ખ્યાલો માટે ડ્રાફ્ટ સંદર્ભો બનાવવા માટે, વાસ્તવિક શોટ (પૃષ્ઠભૂમિ, રચના, સંયુક્ત ભાગ) ને પૂરક હોય તેવા ઘટકો બનાવવા અને સંપૂર્ણ રીતે ઉત્પાદિત છબીઓ બનાવવા માટે (ઉદાહરણ તરીકે, સ્ટોક વેચાણ અથવા જાહેરાત ખ્યાલ માટે). આ એકમમાં, આપણે શીખીશું કે આ સાધનો કેવી રીતે કાર્ય કરે છે અને ફોટોગ્રાફિક વાસ્તવિકતા માટે પ્રોમ્પ્ટ કેવી રીતે લખવા. ધ્યેય તક દ્વારા એક સરસ શોટ માટે રાહ નથી; તેનો અર્થ છે ફોટોગ્રાફરની ભાષામાં તમને શું જોઈએ છે તેનું વર્ણન કરવું અને પરિણામનું નિર્દેશન કરવું.
પ્રસરણ: મોડેલ "ફોટોગ્રાફ્સ" કેવી રીતે ઉત્પન્ન કરે છે?
આજના મોટા ભાગના ઇમેજ-જનરેટીંગ AI પ્રસરણ નામની પદ્ધતિ સાથે કામ કરે છે. ફક્ત: મોડેલ લાખો છબીઓ પર "ઘોંઘાટથી અર્થપૂર્ણ છબી તરફ" જવાનું શીખી ગયું છે. તે ઉત્પાદન દરમિયાન અવ્યવસ્થિત અવાજથી શરૂ થાય છે (જેમ કે બરફીલા સ્ક્રીનશૉટ) અને તમારા ટેક્સ્ટ (પ્રોમ્પ્ટ)ને ફિટ કરવા માટે ધીમે ધીમે અવાજને સાફ કરીને એક છબી બનાવે છે. આમાંથી બે મૂળભૂત હકીકતો બહાર આવે છે:
પ્રથમ, મોડેલ જે વર્ણવેલ નથી તે ઉત્પન્ન કરી શકતું નથી. જો તમે પ્રકાશ ન કહો, તો એક અવ્યવસ્થિત પ્રકાશ આવશે; જો તમે ઉદ્દેશ્ય દૃષ્ટિકોણને ધ્યાનમાં ન લો, તો "ફોટોગ્રાફીની લાગણી" એક સંયોગ જ રહેશે. બીજું, મોડેલ સમજી શકતું નથી, તે આગાહી કરે છે. તેથી જ તે એવા સ્થળોએ ભૂલો (આભાસ) કરે છે જેમાં તર્કની જરૂર હોય, જેમ કે હાથ, ટેક્સ્ટ, પ્રતિબિંબ, સમપ્રમાણતા. જો તમને ફોટોગ્રાફિક વાસ્તવવાદ જોઈએ છે, તો તમારે સ્પષ્ટપણે તકનીકી નિર્ણયોનું વર્ણન કરવું જોઈએ - પ્રકાશ, લેન્સ, રચના - જે ફોટોગ્રાફને ફોટોગ્રાફ બનાવે છે.
સાવધાન: જો કે જનરેટ કરેલી છબી "ફોટા જેવી" દેખાઈ શકે છે, તે ફોટો નથી; તે વાસ્તવિક ક્ષણનું દસ્તાવેજીકરણ કરતું નથી. સમાચાર વાર્તા, દસ્તાવેજી અથવા સંદર્ભમાં તેનો ઉપયોગ કરીને "આ ખરેખર બન્યું છે" એવો દાવો કરવો ભ્રામક છે અને નૈતિક સીમાનું ઉલ્લંઘન કરે છે, જેને અમે એકમ 9 માં આવરી લઈશું.
ફોટોગ્રાફિક પ્રોમ્પ્ટ એનાટોમી
એક શક્તિશાળી ફોટોગ્રાફિક પ્રોમ્પ્ટમાં છ ઘટકોનો સમાવેશ થાય છે. શૂટનું આયોજન કરવા જેવું આનો વિચાર કરો:
- વિષય: શું/કોણ? ઉંમર, કપડાં, અભિવ્યક્તિ, ક્રિયા, સંખ્યા. ("એક આધેડ સુથાર, એપ્રોનમાં, વર્કબેંચ પર કામ કરે છે")
- પ્રકાશ: દિશા, કઠિનતા, સ્ત્રોત, સમય. તે ફોટોગ્રાફીનું હૃદય છે. ("સોફ્ટ સાઇડ વિન્ડો લાઇટ, મોર્નિંગ, લો કોન્ટ્રાસ્ટ")
- લેન્સ અને કેમેરા વ્યૂ: ફોકલ લંબાઈ, ક્ષેત્રની ઊંડાઈ, કોણ. ("85mm પોટ્રેટ લેન્સ ફીલ, ફીલ્ડની છીછરી ઊંડાઈ, સોફ્ટ બેકગ્રાઉન્ડ બોકેહ, આંખનું સ્તર")
- રચના: ફ્રેમિંગ, પ્લેસમેન્ટ, ફ્રેમિંગ. ("ક્લોઝ-અપ, ત્રીજા ભાગનો નિયમ, ડાબી બાજુનો વિષય")
- વાતાવરણ અને રંગ: સ્વર, મૂડ, પેલેટ. ("ગરમ પૃથ્વી ટોન, શાંત, નોસ્ટાલ્જિક")
- ટેક/ગુણવત્તા: ટેક્સચર, વાસ્તવવાદની નોંધો, આસ્પેક્ટ રેશિયો. ("કુદરતી ત્વચા રચના, ફિલ્મ અનાજ, 3:2 ગુણોત્તર")
જ્યારે તમે આ ઘટકોને ક્રમમાં રજૂ કરો છો, ત્યારે મોડેલ વધુ નિયંત્રિત, "ફોટોગ્રાફિક" પરિણામ ઉત્પન્ન કરે છે. તમે છોડો છો તે કોઈપણ ઘટક તક માટે બાકી છે.
ટીપ: AI પાસે ટેક્સ્ટ/લોગો દોરો નહીં. પ્રસરણ મોડેલો વિશ્વસનીય રીતે વાંચી શકાય તેવા ટેક્સ્ટ અને માલિકીના લોગોનું ઉત્પાદન કરી શકતા નથી; તેમને વાસ્તવિક ડિઝાઇન તબક્કામાં ઉમેરો. ઉપરાંત, વાંચી શકાય તેવા ટેક્સ્ટની જરૂર હોય તેવી છબીમાં, ફક્ત બેકડ્રોપ/વાતાવરણ માટે AI નો ઉપયોગ કરો.
પાસા ગુણોત્તર અને હેતુપૂર્વક ઉપયોગ
આસ્પેક્ટ રેશિયો એ ઇમેજનો પહોળાઈ-થી-ઊંચાઈનો ગુણોત્તર છે અને તેનો ઉપયોગ નક્કી કરે છે: સોશિયલ મીડિયા વર્ટિકલ સ્ટોરી માટે 9:16, સ્ટાન્ડર્ડ પ્રિન્ટ માટે 3:2, ચોરસ પોસ્ટ માટે 1:1, વિશાળ બેનર માટે 16:9. પછીથી તેને ટ્રિમ કરવા અને ગુણવત્તા ગુમાવવા કરતાં શરૂઆતથી પ્રોમ્પ્ટમાં ગુણોત્તરનો ઉલ્લેખ કરવો વધુ સારું છે. ઇચ્છિત ઉપયોગ (પ્રિન્ટિંગ અથવા ડિસ્પ્લે) જાણીને, શરૂઆતથી જ રીઝોલ્યુશન અને રેશિયો પસંદ કરો.
નકારાત્મક રેસીપી અને વિવિધતા
મોટા ભાગના ટૂલ્સમાં નકારાત્મક સંકેત પણ હોય છે: એક વિસ્તાર જ્યાં તમે ઈમેજમાં ન જોઈતી વસ્તુઓ લખો ("વિકૃત હાથ, વધારાની આંગળીઓ, ટેક્સ્ટ, વોટરમાર્ક, પ્લાસ્ટિક બંધન"). આ ઘટાડે છે પરંતુ સામાન્ય ખામીઓને સંપૂર્ણપણે અટકાવતું નથી; ચકાસણી હજુ પણ જરૂરી છે. બીજનો ખ્યાલ પણ છે - અવ્યવસ્થિતતાનું બીજ જેમાંથી ઉત્પાદન શરૂ થાય છે; સમાન બીજ અને પ્રોમ્પ્ટ ફરીથી સમાન પરિણામ આપે છે, જે તમને સુસંગત સમૂહ બનાવવામાં મદદ કરે છે (અમે 4 થી એકમમાં વધુ ઊંડાણમાં જઈશું).
ત્રણ નાના કેસો
કેસ 1 - રેસીપીની શક્તિ. એક સ્ટોક ફોટોગ્રાફરે "કોફી પીતી સ્ત્રી" લખ્યું અને નિરાશાજનક પરિણામો મળ્યા. જ્યારે પ્રોમ્પ્ટાએ પ્રકાશ (બાજુની વિન્ડો લાઈટ), લેન્સ (50 મીમી, ક્ષેત્રની છીછરી ઊંડાઈ), વાતાવરણ (ગરમ, શાંત સવાર) અને રચના (કુદરતી ત્વચા) ઉમેર્યા ત્યારે પરિણામ ઉપયોગી બન્યું. સ્વીકાર્ય ફ્રેમ જનરેશન રેટ આશરે 1/20 થી વધીને 1/4 થયો; ઉત્પાદનનો સમય એક તૃતીયાંશ જેટલો ઓછો કરવામાં આવ્યો હતો.
કેસ 2 - આભાસથી નુકશાન. એક ડિઝાઇનર-ફોટોગ્રાફરે તેને તપાસ્યા વિના પ્રસ્તુતિમાં "વ્યવસાયિક લોકો હાથ મિલાવતા" ની છબી મૂકી. મીટીંગમાં એક મેનેજરના ત્રણ હાથ હોવાનું ધ્યાને આવ્યું હતું. નાના પડદા પર નજરઅંદાજ કરવામાં આવેલી ખામીને પ્રોજેક્શનમાં વિસ્તૃત કરવામાં આવી હતી. 30-સેકન્ડનો હાથ/આંગળી સ્કેન આ અકળામણને અટકાવી શકત.
કેસ 3 - યોગ્ય સાધન પસંદ કરી રહ્યા છીએ. એક પ્રોડક્ટ ફોટોગ્રાફર એક વાસ્તવિક ઘડિયાળ મૂકવા માંગતો હતો જે તેણે અલગ વાતાવરણમાં શૂટ કર્યો હતો. તેને શરૂઆતથી ઉત્પન્ન કરવાને બદલે, તેણે વાસ્તવિક ઉત્પાદન ફ્રેમ જાળવી રાખી, ફક્ત પૃષ્ઠભૂમિ/વાતાવરણ AI સાથે ઉત્પન્ન કરવામાં આવ્યું અને સંયુક્ત બનાવવામાં આવ્યું. આમ, ઉત્પાદનની વાસ્તવિક વિગતો (બ્રાન્ડ, ડાયલ) વિકૃત ન હતી; વિશ્વસનીયતા અને ચોકસાઈ બંને સાચવવામાં આવ્યા હતા.
નકલ કરી શકાય તેવા નમૂનાઓ
1) ફોટોગ્રાફિક પ્રોમ્પ્ટ હાડપિંજર:
[વિષય: કોણ/શું, ઉંમર, કપડાં, અભિવ્યક્તિ, ક્રિયા], [પ્રકાશ: દિશા, કઠોરતા, સ્ત્રોત, સમય], [લેન્સ/કેમેરા: કેન્દ્રીય લંબાઈની સમજ, ક્ષેત્રની ઊંડાઈ, કોણ], [રચના: ફ્રેમિંગ, પ્લેસમેન્ટ, કન્વેન્શન], [વાતાવરણ/રંગ: સ્વર, મૂડ, પેલેટ, પ્રાકૃતિક લખાણ: ગુણોત્તર].ફોટોગ્રાફિક, વાસ્તવિક. ટેક્સ્ટ/લોગો ઉમેરો.
2) નકારાત્મક પ્રોમ્પ્ટ ડ્રાફ્ટ:
નકારાત્મક (મને જે જોઈતું નથી): ખોડખાંપણવાળા હાથ, વધારાની/ખુટતી આંગળીઓ, વાંકોચૂંકો ચહેરો, પ્લાસ્ટિક/મીણ જેવી ત્વચા, વાંચી ન શકાય તેવું લખાણ, વોટરમાર્ક, પુનરાવર્તિત રચના, અશક્ય પડછાયો, અતિસંતૃપ્ત રંગ.
3) મૂડબોર્ડ સંદર્ભ માટે (દિશા, વિતરણ નહીં):
હેતુ: શૂટ માટે મૂડબોર્ડ સંદર્ભ (વિતરિત કરી શકાય તેવું નથી). ખ્યાલ: [વિભાવના]. માત્ર લક્ષણો સાથે સૌંદર્યલક્ષી વર્ણન કરો: પ્રકાશ [..], રંગ પૅલેટ [..], વાતાવરણ [..], રચના [..]. કોઈપણ વ્યક્તિ/બ્રાન્ડ/ફોટોગ્રાફરના નામનો ઉપયોગ કરશો નહીં. 4 વિવિધતાઓ બનાવો.
4) વાસ્તવિક ઉત્પાદનને સુરક્ષિત કરતી સંયુક્ત યોજના:
મારી પાસે એક વાસ્તવિક [ઉત્પાદન] શોટ છે; ઉત્પાદન પોતે બદલાશે નહીં. માત્ર પૃષ્ઠભૂમિ/વાતાવરણ માટે ઇમેજ બનાવવા માટે પ્રોમ્પ્ટ લખો: [પ્રકાશ, સપાટી, રંગ, પર્યાવરણ]. ઉત્પાદનની પડછાયાની દિશા અને પ્રકાશની કઠિનતા [..] હોવી જોઈએ જેથી કરીને સંમિશ્રણ ખાતરી થાય.
નબળા પ્રોમ્પ્ટ / મજબૂત પ્રોમ્પ્ટ
નબળા: "સરસ પોટ્રેટ ફોટો."
સશક્ત: "મધ્યમ વયની ખેતીની સ્ત્રી, ઘઉંના ખેતરમાં સૂરજથી પથરાયેલો ચહેરો, સહેજ સ્મિત; બાજુથી સોનેરી કલાકનો પ્રકાશ, ઓછો કોન્ટ્રાસ્ટ; 85mm પોટ્રેટ વ્યૂ, છીછરા ક્ષેત્રની ઊંડાઈ, પૃષ્ઠભૂમિ નરમ; ક્લોઝ-અપ, વિષય ડાબી બાજુ, ત્રીજા ભાગનો નિયમ; ગરમ પૃથ્વી ટોન, શાંત અને પ્રતિષ્ઠિત મૂડ, ફોટો ગ્રાફ 2, 3 ફિલ્મ ગ્રાફિક, કુદરતી પ્રકાશ. વાસ્તવવાદી ટેક્સ્ટ ઉમેરવું."
નબળી ઇચ્છા સંપૂર્ણપણે તક પર છોડી દેવામાં આવે છે; મજબૂત માંગ પ્રકાશ, લેન્સ, રચના અને વાતાવરણનું વર્ણન કરતી હોવાથી, તે ઇચ્છિત પરિણામ ઉત્પન્ન કરવાની સંભાવનાને મોટા પ્રમાણમાં વધારે છે.
સામાન્ય ભૂલો
- પ્રકાશ અને લેન્સનું વર્ણન નથી. આ બે મોટાભાગે ફોટોગ્રાફને ફોટોગ્રાફ બનાવે છે; જો તમે તેને ખાલી છોડો છો, તો પરિણામ તક પર છોડી દેવામાં આવશે.
- AI ડ્રો વાંચી શકાય તેવા ટેક્સ્ટ/લોગો રાખવાથી. મોડેલ આને વિશ્વસનીય રીતે ઉત્પન્ન કરી શકતું નથી; તે ખામીયુક્ત અને કોપીરાઈટેડ હોઈ શકે છે.
- ઉત્પાદિત છબીને "ફોટોગ્રાફ" તરીકે રજૂ કરવી. તે દસ્તાવેજી/સમાચાર સંદર્ભમાં ભ્રામક છે; હકીકતનું નિવેદન જરૂરી છે.
- વ્યક્તિ/બ્રાન્ડ નામ સાથે શૈલીની નકલ કરવી. અનુકરણ અને કૉપિરાઇટ જોખમ; ગુણો સાથે સૌંદર્ય શાસ્ત્રનું વર્ણન કરો.
- ચકાસણી છોડવી. દરેક ઉત્પાદિત ઇમેજમાં હાથ, આંખો, પ્રતિબિંબ, પડછાયા અને પુનરાવર્તિત ટેક્સચરની તપાસ કરવી આવશ્યક છે.
સારાંશમાં
જનરેટિવ વિઝ્યુઅલ AI પ્રસરણ દ્વારા કાર્ય કરે છે: તે અવાજથી ઇમેજ સુધી જાય છે જે ટેક્સ્ટને બંધબેસે છે, જે વર્ણવેલ નથી તે ઉત્પન્ન કરી શકતું નથી અને જ્યાં તર્કની જરૂર હોય ત્યાં ભૂલો થાય છે. ફોટોગ્રાફિક વાસ્તવવાદ માટે, ફોટોગ્રાફરની જેમ વિષય, પ્રકાશ, લેન્સ, રચના, વાતાવરણ અને તકનીકનું વર્ણન કરો. હેતુ અનુસાર આસ્પેક્ટ રેશિયો પસંદ કરો, નેગેટિવ રેસીપી સાથે આર્ટિફેક્ટ ઘટાડો, AI પાસે ટેક્સ્ટ ડ્રો ન હોય અને દરેક આઉટપુટની ચકાસણી કરો. "ફોટો લીધેલ" હોવાનો દાવો કરતી ઉત્પાદિત છબીનો ક્યારેય ઉપયોગ કરશો નહીં.
એપ્લિકેશન કાર્ય
એક ખ્યાલ પસંદ કરો અને એક ફોટોગ્રાફિક પ્રોમ્પ્ટ લખો, ટેમ્પલેટ 1 સાથે તમામ છ ઘટકો ભરીને. એક જ વાક્યમાં પહેલા સમાન ખ્યાલ બનાવો (અથવા વર્ણન કરો), જેમ કે "એક સુંદર ફોટો," પછી સંપૂર્ણ હાડપિંજર સાથે, અને બે પરિણામોની તુલના કરો. હાથ, આંખો, પ્રતિબિંબ અને પડછાયાને મોટું કરીને તમે બનાવેલી ઇમેજમાં ઓછામાં ઓછા ત્રણ સંભવિત ખામીઓને ચિહ્નિત કરો.
ચેકલિસ્ટ
- [ ] પ્રોમ્પ્ટમાં, મેં વિષય, પ્રકાશ, લેન્સ, રચના, વાતાવરણ અને તકનીકનું અલગથી વર્ણન કર્યું.
- [ ] મેં ઇચ્છિત ઉપયોગ અનુસાર પાસા રેશિયો નક્કી કર્યો.
- [ ] મેં નકારાત્મક રેસીપી વડે સામાન્ય ખામીઓ ઘટાડી.
- [ ] મારી પાસે AI ડ્રો વાંચવા યોગ્ય ટેક્સ્ટ/લોગો નથી.
- [ ] મેં ખાતરી કરી છે કે મેં જનરેટ કરેલી છબી "ફોટો" તરીકે રજૂ કરી નથી.
- [ ] મેં હાથ/આંખ/પ્રતિબિંબ/છાયા માટે આઉટપુટ ચકાસ્યું.