Gevinster:
- Forståelse af, hvordan billedgenererende kunstig intelligens (diffusion) virker, og hvilke opskriftskomponenter der kræves for fotografisk realisme
- Evne til at skrive en stærk fotografisk prompt bestående af motiv, lys, linse/kamera, komposition, atmosfære og tekniske komponenter.
- Evne til at skelne mellem et produceret billede og et taget fotografi, grænserne for brug og vigtigheden af ægthedserklæringen
En fotograf bruger generativ visuel AI til tre legitime formål: at producere udkast til referencer til moodboards og koncepter, at skabe elementer, der komplementerer det faktiske billede (baggrund, tekstur, sammensat stykke) og at skabe fuldt producerede billeder (for eksempel til et lagersalg eller et reklamekoncept). I denne enhed lærer vi, hvordan disse værktøjer fungerer, og hvordan man skriver meddelelser til fotografisk realisme. Målet er ikke at vente på et flot skud tilfældigt; Det betyder, at man skal beskrive, hvad man vil, på en fotografs sprog og lede resultatet.
Diffusion: hvordan producerer modellen "fotografier"?
De fleste af nutidens billedgenererende AI'er arbejder med en metode kaldet diffusion. Simpelthen: Modellen har lært at gå "fra støj til meningsfuldt billede" på millioner af billeder. Det starter fra tilfældig støj under produktionen (som et snedækket skærmbillede) og skaber et billede ved gradvist at rense støjen, så den passer til din tekst (prompt). To grundlæggende fakta fremgår af dette:
For det første kan modellen ikke producere det, der ikke er beskrevet. Hvis du ikke siger lyset, kommer der et tilfældigt lys; Hvis du ikke overvejer det objektive synspunkt, vil "følelsen af fotografering" forblive en tilfældighed. For det andet forstår modellen ikke, forudsiger den. Det er derfor, han laver fejl (hallucinationer) på steder, der kræver logik, såsom hænder, tekst, refleksion, symmetri. Hvis du ønsker fotografisk realisme, skal du klart beskrive de tekniske beslutninger – lys, linse, komposition – der gør et fotografi til et fotografi.
Forsigtig: Selvom et genereret billede kan se "foto-lignende", er det ikke et foto; den dokumenterer ikke et faktisk øjeblik. At bruge det i en nyhedshistorie, dokumentar eller kontekst, hvor man hævder "dette skete virkelig" er vildledende og overtræder den etiske grænse, som vi vil dække i enhed 9.
Fotografisk prompt anatomi
En kraftfuld fotografisk prompt består af seks komponenter. Tænk på disse som at planlægge et shoot:
- Emne: Hvad/hvem? Alder, tøj, udtryk, handling, antal. ("en midaldrende tømrer, i et forklæde, arbejder ved arbejdsbordet")
- Lys: Retning, hårdhed, kilde, tid. Det er hjertet i fotografiet. ("blødt sidevinduelys, morgen, lav kontrast")
- Objektiv og kameravisning: Brændvidde, dybdeskarphed, vinkel. ("85 mm portrætlinsefornemmelse, lav dybdeskarphed, blød baggrundsbokeh, øjenhøjde")
- Sammensætning: Indramning, placering, indramning. ("nærbillede, tredjedelsregel, emne til venstre")
- Atmosfære og farve: Tone, stemning, palet. ("varme jordfarver, rolig, nostalgisk")
- Teknologi/kvalitet: Tekstur, noter af realisme, billedformat. ("naturlig hudtekstur, filmkorn, 3:2-forhold")
Når du introducerer disse komponenter i rækkefølge, producerer modellen et meget mere kontrolleret, "fotografisk" resultat. Enhver komponent, du udelader, er overladt til tilfældighederne.
Tip: Lad ikke AI tegne teksten/logoet. Diffusionsmodeller kan ikke pålideligt producere læsbar tekst og proprietære logoer; tilføje dem i selve designfasen. I et billede, der kræver læsbar tekst, skal du kun bruge AI til baggrunden/atmosfæren.
Størrelsesforhold og tilsigtet brug
Størrelsesforhold er billedets bredde-til-højde-forhold og bestemmer dets brug: 9:16 for en lodret historie på sociale medier, 3:2 for standardprint, 1:1 for et firkantet indlæg, 16:9 for et bredt banner. Det er bedre at angive forholdet i prompten fra begyndelsen end at trimme det senere og miste kvalitet. Vælg opløsning og forhold helt fra begyndelsen, vel vidende om den påtænkte brug (udskrivning eller visning).
Negativ opskrift og variation
De fleste værktøjer har også en negativ prompt: et område, hvor du skriver ting, du ikke vil have på billedet ("deformeret hånd, ekstra fingre, tekst, vandmærke, plastikbinding"). Dette reducerer, men forhindrer ikke helt almindelige defekter; verifikation er stadig vigtig. Der er også begrebet frø - frøet af tilfældighed, hvorfra produktionen begynder; Den samme frø og prompt giver et lignende resultat igen, hvilket hjælper dig med at skabe et ensartet sæt (vi vil gå mere i dybden i den 4. enhed).
tre minisager
Case 1 - Opskriftens magt. En stock fotograf skrev "kvinde drikker kaffe" og fik dystre resultater. Da Prompta tilføjede lys (sidevinduelys), linse (50 mm, lav dybdeskarphed), atmosfære (varm, rolig morgen) og tekstur (naturlig hud), blev resultatet brugbart. Acceptabel billedgenereringshastighed steg fra ca. 1/20 til 1/4; Produktionstiden blev reduceret med en tredjedel.
Tilfælde 2 - Tab fra hallucination. En designer-fotograf satte et billede af "forretningsfolk, der giver hånd" i en præsentation uden at tjekke det. På mødet blev det bemærket, at en leder havde tre hænder. Den fejl, der blev overset på det lille lærred, blev forstørret i projektionen. En 30-sekunders hånd-/fingerscanning ville have forhindret denne forlegenhed.
Case 3 - Valg af det rigtige værktøj. En produktfotograf ville placere et rigtigt ur, han skød, i et andet miljø. I stedet for at producere det fra bunden, beholdt det den rigtige produktramme, kun baggrunden/atmosfæren blev produceret med AI og lavet sammensat. Således blev de faktiske detaljer om produktet (mærke, skive) ikke forvrænget; både troværdighed og nøjagtighed blev bevaret.
Kopierbare skabeloner
1) Fotografisk promptskelet:
[emne: hvem/hvad, alder, tøj, udtryk, handling],[lys: retning, hårdhed, kilde, tid],[objektiv/kamera: fornemmelse af brændvidde, dybdeskarphed, vinkel],[sammensætning: indramning, placering, konvention],[atmosfære/farve: tone, stemning, palet],[teknik: naturlig tekstur, realistisk billedformat], korn, billedformat Tilføj tekst/logo.
2) Negativ promptudkast:
Negativer (hvad jeg ikke ønsker): misdannet hånd, ekstra/manglende fingre, skævt ansigt, plastik/vokslignende hud, ulæselig tekst, vandmærke, gentagende tekstur, umulig skygge, overmættet farve.
3) Til moodboard-reference (retning, ikke levering):
Formål: Moodboard-reference til et optagelser (ikke det leverede). Koncept: [koncept]. Beskriv æstetikken kun med attributter: lys [..], farvepalet [..], atmosfære [..], komposition [..]. Brug ikke nogen person-/mærke-/fotografnavne. Generer 4 variationer.
4) Sammensat plan, der beskytter det rigtige produkt:
Jeg har et rigtigt [produkt] skud; Selve produktet ændres ikke. Skriv prompten for, at billedet skal produceres kun til baggrund/atmosfære: [lys, overflade, farve, miljø]. Produktets skyggeretning og lyshårdhed skal være [..] så kompositten er overbevisende.
Svag prompt / Stærk prompt
Svag: "Fint portrætfoto."
Stærk: "Middelaldrende gårdkvinde, solslidt ansigt, let smil, i en hvedemark; gyldent time-lys fra siden, lav kontrast; 85 mm portrætvisning, lav dybdeskarphed, baggrund blød; nærbillede, motiv venstre, tredjedelsregel; varme jordfarver, rolig og værdig stemning; naturlig hudtekstur, 3, naturlig hudtekstur, 3 lys tekstur.."
Den svage vilje overlades helt til tilfældighederne; Da stor efterspørgsel beskriver lyset, linsen, kompositionen og atmosfæren, øger det i høj grad sandsynligheden for at producere det ønskede resultat.
Almindelige fejl
- Beskriver ikke lyset og linsen. Disse to er i høj grad det, der gør et fotografi til et fotografi; Hvis du lader det stå tomt, overlades resultatet til tilfældighederne.
- At få AI til at tegne læsbar tekst/logo. Modellen kan ikke producere disse pålideligt; Det kan vise sig at være defekt og ophavsretligt beskyttet.
- Præsentation af det producerede billede som et "fotografi". Det er vildledende i en dokumentar/nyhedssammenhæng; En faktaerklæring er påkrævet.
- Kopieringsstil med person/mærkenavn. Efterligning og ophavsretsrisiko; Beskriv æstetik med kvaliteter.
- Springer verifikation over. Hænder, øjne, refleksioner, skygger og gentagne teksturer skal kontrolleres i hvert fremstillet billede.
Sammenfattende
Generativ visuel AI fungerer ved diffusion: den går fra støj til billede, der passer til teksten, kan ikke producere det, der ikke er beskrevet, og fejler, hvor logik er påkrævet. For fotografisk realisme, beskriv motivet, lyset, linsen, kompositionen, atmosfæren og teknikken som en fotograf. Vælg størrelsesforholdet i henhold til formålet, reducer artefakten med negativ opskrift, lad ikke AI tegne teksten, og bekræft hvert output. Brug aldrig et produceret billede, der hævder at være et "foto taget".
Ansøgningsopgave
Vælg et koncept og skriv en fotografisk prompt, udfyld alle seks komponenter med skabelon 1. Fremstil (eller beskriv) det samme koncept først i en enkelt sætning, såsom "et smukt foto", derefter med hele skelettet, og sammenlign de to resultater. Marker mindst tre mulige fejlpunkter i det billede, du producerer, ved at forstørre hænder, øjne, refleksioner og skygger.
tjekliste
- [ ] I prompten beskrev jeg emne, lys, linse, komposition, atmosfære og teknik separat.
- [ ] Jeg bestemte billedformatet i henhold til den tilsigtede brug.
- [ ] Jeg reducerede de almindelige defekter med den negative opskrift.
- [ ] Jeg havde ikke AI Draw-læsbar tekst/logo.
- [ ] Jeg sørgede for, at jeg ikke præsenterede det genererede billede som et "foto".
- [ ] Jeg verificerede outputtet for hånd/øje/refleksion/skygge.