Vienība 3 / 11

Fotogrāfijas vizuālā ražošana un tūlītēja anatomija: kā darbojas difūzija?

Ieguvumi:

  • Izpratne par to, kā darbojas attēlu ģenerējošais mākslīgais intelekts (difūzija) un kādi receptes komponenti ir nepieciešami fotogrāfiskajam reālismam
  • Spēja uzrakstīt spēcīgu fotogrāfisku uzvedni, kas sastāv no objekta, gaismas, objektīva/kameras, kompozīcijas, atmosfēras un tehniskajiem komponentiem.
  • Spēja atšķirt atšķirību starp izgatavoto attēlu un uzņemto fotogrāfiju, izmantošanas robežas un autentiskuma deklarācijas nozīmi

Fotogrāfs izmanto ģeneratīvu vizuālo AI trīs likumīgiem mērķiem: lai izveidotu atsauces uzmetumus noskaņu paneļiem un koncepcijām, lai izveidotu elementus, kas papildina faktisko kadru (fons, faktūra, salikts gabals), un lai izveidotu pilnībā izgatavotus attēlus (piemēram, akciju pārdošanai vai reklāmas koncepcijai). Šajā nodaļā mēs uzzināsim, kā šie rīki darbojas un kā rakstīt fotoreālisma uzvednes. Mērķis nav negaidīt labu sitienu nejauši; Tas nozīmē fotogrāfa valodā aprakstīt to, ko vēlaties, un virzīt rezultātu.

Difūzija: kā modelis rada "fotogrāfijas"?

Lielākā daļa mūsdienu attēlu ģenerēšanas AI darbojas ar metodi, ko sauc par difūziju. Vienkārši: modelis ir iemācījies miljoniem attēlu pāriet no trokšņa uz jēgpilnu attēlu. Tas sākas ar nejaušiem trokšņiem ražošanas laikā (piemēram, sniegots ekrānuzņēmums) un izveido attēlu, pakāpeniski notīrot troksni, lai tas atbilstu jūsu tekstam (uzvedne). No tā izriet divi pamata fakti:

Pirmkārt, modelis nevar radīt to, kas nav aprakstīts. Ja jūs neteiksiet gaismu, nāks nejauša gaisma; Ja neņem vērā objektīvo skatījumu, "fotogrāfijas sajūta" paliks nejaušība. Otrkārt, modelis nesaprot, tas prognozē. Tāpēc viņš pieļauj kļūdas (halucinācijas) vietās, kur nepieciešama loģika, piemēram, rokās, tekstā, refleksijā, simetrijā. Ja vēlaties fotogrāfisku reālismu, jums skaidri jāapraksta tehniskie lēmumi — gaisma, objektīvs, kompozīcija —, kas padara fotogrāfiju par fotogrāfiju.

Uzmanību: lai gan ģenerēts attēls var izskatīties kā fotoattēls, tas nav fotoattēls; tas nedokumentē reālu brīdi. Tās izmantošana ziņu sižetā, dokumentālā filmā vai kontekstā, kurā tiek apgalvots, ka tas tiešām notika, ir maldinoši un pārkāpj ētikas robežas, par kurām mēs runāsim 9. nodaļā.

Fotogrāfijas uzvednes anatomija

Jaudīga fotografēšanas uzvedne sastāv no sešām sastāvdaļām. Padomājiet par to, piemēram, par fotografēšanas plānošanu:

  1. Temats: Kas/kurš? Vecums, apģērbs, izteiksme, darbība, skaits. ("pusmūža galdnieks, priekšautā, strādā pie darbagalda")
  2. Gaisma: virziens, cietība, avots, laiks. Tā ir fotogrāfijas sirds. ("maigs sānu loga apgaismojums, rīts, zems kontrasts")
  3. Objektīva un kameras skats: fokusa attālums, lauka dziļums, leņķis. ("85 mm portreta objektīva sajūta, mazs lauka dziļums, mīksts fona bokehs, acu līmenis")
  4. Sastāvs: Ierāmējums, izvietojums, ierāmējums. ("tuvplāns, trešdaļu noteikums, tēma kreisajā pusē")
  5. Atmosfēra un krāsa: Tonis, noskaņa, palete. ("silti zemes toņi, mierīgi, nostalģiski")
  6. Tehnoloģija/kvalitāte: tekstūra, reālisma notis, malu attiecība. ("dabiskā ādas tekstūra, plēves graudainība, attiecība 3:2")

Ieviešot šos komponentus secīgi, modelis rada daudz kontrolētāku, "fotografiskāku" rezultātu. Jebkurš komponents, kuru jūs atstājat, ir atstāts nejaušības ziņā.

Padoms: nelieciet AI zīmēt tekstu/logotipu. Izkliedēšanas modeļi nevar droši radīt lasāmu tekstu un patentētus logotipus; pievienojiet tos faktiskajā projektēšanas fāzē. Turklāt attēlā, kuram nepieciešams lasāms teksts, AI izmantojiet tikai fonam/atmosfērai.

Malu attiecība un paredzētais lietojums

Malu attiecība ir attēla platuma un augstuma attiecība un nosaka tā izmantošanu: 9:16 sociālo mediju vertikālam stāstam, 3:2 standarta drukā, 1:1 kvadrātveida ziņai, 16:9 platam reklāmkarogam. Labāk ir norādīt attiecību uzvednē no sākuma, nekā to vēlāk apgriezt un zaudēt kvalitāti. Izšķirtspēju un attiecību izvēlieties jau pašā sākumā, zinot paredzēto lietojumu (drukāšana vai displejs).

Negatīvā recepte un variācijas

Lielākajai daļai rīku ir arī negatīva uzvedne: apgabals, kurā rakstāt lietas, kuras nevēlaties attēlā ("deformēta roka, papildu pirksti, teksts, ūdenszīme, plastmasas iesiešana"). Tas samazina, bet pilnībā nenovērš bieži sastopamos defektus; pārbaude joprojām ir būtiska. Ir arī jēdziens sēklas — nejaušības sēkla, no kuras sākas ražošana; Tā pati sēkla un uzvedne atkal rada līdzīgu rezultātu, kas palīdz izveidot konsekventu kopu (padziļināti iedziļināsimies 4. vienībā).

trīs mini futrāļi

1. gadījums — receptes spēks. Fonda fotogrāfs uzrakstīja "sieviete dzer kafiju" un ieguva bēdīgus rezultātus. Kad Prompta pievienoja gaismu (sānu loga apgaismojums), objektīvu (50 mm, mazs lauka dziļums), atmosfēru (silts, mierīgs rīts) un tekstūru (dabiskā āda), rezultāts kļuva lietojams. Pieņemamais kadru ģenerēšanas ātrums ir palielināts no aptuveni 1/20 līdz 1/4; Ražošanas laiks tika samazināts par vienu trešdaļu.

2. gadījums — zaudējums no halucinācijām. Dizainers-fotogrāfs prezentācijā ievietoja attēlu, kurā redzami "biznesmeņi, kas sarokojas", to nepārbaudot. Tikšanās reizē tika pamanīts, ka kādam vadītājam ir trīs rokas. Trūkums, kas netika ņemts vērā mazajā ekrānā, tika palielināts projekcijā. 30 sekunžu rokas/pirkstu skenēšana būtu novērsusi šo apmulsumu.

3. gadījums — pareizā rīka izvēle. Produktu fotogrāfs vēlējās ievietot īstu pulksteni, ko viņš uzņēma citā vidē. Tā vietā, lai to ražotu no nulles, tas saglabāja īsto produkta rāmi, tikai fons/atmosfēra tika ražota ar AI un izgatavota no kompozīta. Tādējādi faktiskā informācija par produktu (zīmols, ciparnīca) netika izkropļota; tika saglabāta gan ticamība, gan precizitāte.

Kopējamas veidnes

1) Fotoattēlu uzvednes skelets:

[tēma: kurš/kas, vecums, apģērbs, izteiksme, darbība],[gaisma: virziens, skarbums, avots, laiks],[objektīvs/kamera: fokusa attāluma sajūta, lauka dziļums, leņķis],[sastāvs: kadrējums, izvietojums, vienošanās],[atmosfēra/krāsa: tonis, noskaņa, palete],[tehnika: dabiska faktūra, graudu attiecība,].Pho. Pievienojiet tekstu/logotipu.

2) Negatīvs uzvednes melnraksts:

Negatīvie (ko es negribu): nepareizi veidota roka, lieki/trūkst pirksti, greiza seja, plastmasai/vaskam līdzīga āda, nesalasāms teksts, ūdenszīme, atkārtojoša tekstūra, neiespējama ēna, pārsātināta krāsa.

3) Moodboard atsaucei (virziens, nevis piegāde):

Mērķis: Moodboard atsauce filmēšanai (nevis nodevums). Jēdziens: [koncepcija]. Aprakstiet estētiku tikai ar atribūtiem: gaisma [..], krāsu palete [..], atmosfēra [..], kompozīcija [..]. Neizmantojiet personu/zīmolu/fotogrāfu vārdus. Izveidojiet 4 variācijas.

4) Salikts plāns, kas aizsargā īstu produktu:

Man ir īsts [produkts] shot; Pats produkts nemainīsies. Uzrakstiet uzvedni attēlam, kas jāizveido tikai fonam/atmosfērai: [gaisma, virsma, krāsa, vide]. Produkta ēnu virzienam un gaismas cietībai jābūt [..], lai kompozīts būtu pārliecinošs.

Vāja uzvedne / spēcīga uzvedne

Vāji: "Jauks portreta fotoattēls."

Spēcīga: "Pusmūža lauku saimniece, saulē nopostīta seja, viegls smaids, kviešu laukā; zelta stundas gaisma no sāniem, zems kontrasts; 85 mm portreta skats, mazs lauka dziļums, fons maigs; tuvplāns, objekts pa kreisi, trešdaļu noteikums; silti zemes toņi, mierīgs un cienīgs noskaņojums; dabiska ādas tekstūra, viegls filmas graudains,. 3. teksts.

Vāja griba ir pilnībā atstāta nejaušības ziņā; Tā kā liels pieprasījums raksturo gaismu, objektīvu, kompozīciju un atmosfēru, tas ievērojami palielina vēlamā rezultāta iespējamību.

Biežas kļūdas

  • Neaprakstot gaismu un objektīvu. Šie divi lielā mērā ir tas, kas padara fotogrāfiju par fotogrāfiju; Ja atstājat to tukšu, rezultāts tiks atstāts nejaušības ziņā.
  • Liekot AI zīmēt lasāmu tekstu/logotipu. Modelis nevar tos droši ražot; Tas var izrādīties bojāts un aizsargāts ar autortiesībām.
  • Izgatavotā attēla prezentēšana kā "fotogrāfija". Tas ir maldinošs dokumentālā/ziņu kontekstā; Nepieciešams faktu izklāsts.
  • Kopēšanas stils ar personas/zīmola nosaukumu. Imitācijas un autortiesību risks; Aprakstiet estētiku ar īpašībām.
  • Verifikācijas izlaišana. Rokas, acis, atspulgi, ēnas un faktūras, kas atkārtojas, ir jāpārbauda katrā izveidotajā attēlā.

Rezumējot

Ģeneratīvs vizuālais AI darbojas, izmantojot difūziju: tas pāriet no trokšņa uz attēlu, kas atbilst tekstam, nevar radīt to, kas nav aprakstīts, un kļūdās tur, kur nepieciešama loģika. Fotogrāfijas reālismam aprakstiet objektu, gaismu, objektīvu, kompozīciju, atmosfēru un tehniku ​​kā fotogrāfam. Izvēlieties malu attiecību atbilstoši mērķim, samaziniet artefaktu ar negatīvu recepti, nelieciet AI zīmēt tekstu un pārbaudiet katru izvadi. Nekad neizmantojiet izgatavotu attēlu, kas apgalvo, ka tas ir "uzņemts fotoattēls".

Lietojumprogrammas uzdevums

Izvēlieties jēdzienu un uzrakstiet fotogrāfisku uzvedni, aizpildot visus sešus komponentus ar 1. veidni. Vispirms izveidojiet (vai aprakstiet) vienu un to pašu jēdzienu vienā teikumā, piemēram, "skaists fotoattēls", pēc tam ar pilnu skeletu, un salīdziniet abus rezultātus. Atzīmējiet vismaz trīs iespējamos trūkumus attēlā, ko izveidojat, palielinot rokas, acis, atspulgus un ēnas.

kontrolsaraksts

  • [ ] Uzvednē es atsevišķi aprakstīju objektu, gaismu, objektīvu, kompozīciju, atmosfēru un tehniku.
  • [ ] Es noteicu malu attiecību atbilstoši paredzētajam lietojumam.
  • [ ] Kopējos defektus samazināju ar negatīvo recepti.
  • [ ] Man nebija AI zīmējuma lasāma teksta/logotipa.
  • [ ] Pārliecinājos, ka ģenerēto attēlu neparādīju kā "fotoattēlu".
  • [ ] Es pārbaudīju roku/acs/atspīdumu/ēnu izvadi.