Winst:
- Begrijpen hoe visuele kunstmatige intelligentie (diffusie) werkt en hoe deze niet kan produceren wat niet wordt beschreven en geen tekst goed kan tekenen.
- Vermogen om een sterke visuele prompt te schrijven, bestaande uit onderwerp, context, stijl, compositie, licht en technische componenten.
- Het verkrijgen van de mogelijkheid om de beeldverhouding te bepalen, te voorkomen dat de leesbare tekst door kunstmatige intelligentie wordt getekend en het defect te verminderen met een negatieve beschrijving.
Een ontwerper die beelden produceert met AI is als het geven van een opdracht aan een kunstenaar: hoe duidelijker en nauwkeuriger je het uitlegt, hoe nauwkeuriger het resultaat zal zijn. In deze unit zullen we in duidelijke taal begrijpen hoe beeldgenererende kunstmatige intelligentie (image AI) werkt en de anatomie leren van het schrijven van een goede prompt (schriftelijke instructie voor een visueel beeld), stap voor stap. Het doel is om bewust het gewenste beeld te kunnen beschrijven, in plaats van "willekeurig te proberen en op geluk te vertrouwen".
Hoe werkt Beeld-AI? (Eenvoudige uitleg)
De meeste beeldproducenten gebruiken tegenwoordig een methode die diffusie wordt genoemd. Simpel gezegd: het model heeft de relaties 'welke woorden overeenkomen met welke afbeeldingen' geleerd uit miljoenen beeld-tekstparen. Bij het maken van beelden vertrekt het van een beeld met willekeurige ruis (zoals een besneeuwd televisiescherm) en ruimt deze ruis stap voor stap op, zodat deze aan uw wensen voldoet en verandert deze in een betekenisvol beeld. Met andere woorden: het model "tekent" niet het plaatje, het construeert op statistische wijze het beeld dat het beste bij uw vraag past.
Dit heeft drie praktische gevolgen. Ten eerste: dezelfde prompt geeft elke keer een ander resultaat, omdat de initiële ruis willekeurig is (we zullen zien hoe we dit kunnen controleren met "seed" in de volgende unit). Ten tweede: het model kan niet weten wat jij niet kunt beschrijven; Het kan het plaatje in je hoofd niet lezen, het interpreteert alleen wat je schrijft. Ten derde: het model kan tekst en cijfers niet goed tekenen, omdat het letters imiteert in vorm en niet in betekenis; Daarom is het riskant om het schrijven van logo’s aan AI over te laten.
Tip: Laat AI niet de duidelijke tekst (merknaam, slogan) in het beeld produceren. Je maakt een afbeelding zonder tekst en voegt vervolgens de tekst (als vector) toe in een ontwerpprogramma. Dit maakt het zowel leesbaar als bewerkbaar.
Anatomie van een goede prompt
Het helpt om een sterke visuele prompt in zes componenten op te delen. Je hoeft ze niet elke keer allemaal te gebruiken, maar bewust kiezen bepaalt de uitkomst.
- Onderwerp/onderwerp: Wat is het belangrijkste element van de afbeelding? ("een keramieken koffiekopje", "portret van een jonge vrouw").
- Actie/context: Wat doet hij, waar is hij? (“aan de houten tafel, in het ochtendlicht”).
- Stijl/esthetiek: Wat is de beeldtaal? (“minimale productfoto”, “aquarelillustratie”, “isometrische 3D-weergave”). Dit is het meest beslissende onderdeel.
- Compositie/hoek: Hoe is de lijst? ("close-up", "vogelperspectief", "groothoek", "in het midden, met ruimte").
- Licht en kleur: ("zacht natuurlijk licht", "palet met aardetinten", "hoog contrast").
- Techniek / kwaliteit: ("hoge resolutie", "1:1 framerate", "achtergrond effen wit").
Er is ook een negatief recept: dingen zeggen die je niet wilt ("geen tekst, geen mensen, geen rommelige achtergrond"). We zullen dit verdiepen met "negatieve prompt" in de 4e unit.
Verklarende woordenlijst
- Beeldverhouding: De beeldverhouding van de afbeelding; 1:1 frame (Instagram-post), 9:16 portret (verhaal/rollen), 16:9 liggend (omslag).
- Resolutie: Aantal pixels in de afbeelding; Hoog is genoeg voor afdrukken, medium is genoeg voor zeefdruk.
- Stijlreferentie: Een voorbeeld aan het model geven met de tekst "zie er zo uit".
- Render: De computer berekent en produceert een afbeelding; "3D-weergave" betekent realistisch volumetrisch zicht.
Stap voor stap: een afbeelding beschrijven
Laten we zeggen dat we een productafbeelding willen voor een olijfoliemerk.
Stap 1 — Focus op het onderwerp: “extra vierge olijfolie in een donkergroene glazen fles.”
Stap 2 — Voeg context toe: “op het rustieke houten aanrecht, met een paar verse olijftakken ernaast.”
Stap 3 — Kies stijl: “premium productfoto, realistisch”.
Stap 4 — Geef de compositie: “product in het midden, ruimte voor tekst bovenaan”.
Stap 5 — Licht/kleur: “zachte kant natuurlijk licht, warme aardetinten”.
Stap 6 — Techniek: “1:1 framesnelheid, hoge resolutie, effen achtergrond”.
Wanneer je ze allemaal combineert, krijg je een werkbaar concept dat past bij de identiteit van het merk.
drie minikoffers
Casus 1 — Van onzekerheid naar duidelijkheid. Een ontwerper schreef ‘een afbeelding van een modern kantoor’ en deed twaalf pogingen, maar geen daarvan werkte (verloren 30 minuten). Hij herschreef de opdracht in zes componenten: "helder, minimaal kantoor; houten bureau; natuurlijk licht door een groot raam; warme neutrale tinten; groothoek; tekstruimte bovenaan". 2 van de eerste 4 pogingen waren bruikbaar; De tijd werd teruggebracht tot 10 minuten.
Geval 2 — Tekstval. Eén stagiair liet een AI van begin tot eind een caféposter maken; De tekst "COFFEE" in de afbeelding bleek "COFEEE" te zijn en de prijzen waren niet leesbaar. De instructies veranderden: de afbeelding werd zonder tekst geproduceerd, de tekst werd later in het ontwerpprogramma toegevoegd. De fout daalde tot nul en de poster was geschikt om te printen.
Geval 3 — Verlies van ratio. Een expert op het gebied van sociale media produceerde een vierkante afbeelding van 1:1 voor het Instagram-verhaal; 9:16 Toen ik het in het verticale gebied plaatste, werden de boven- en onderkant afgesneden en ging het belangrijke element verloren. Toen ik in de prompt de beeldverhouding opgaf als "9:16 verticaal", paste de afbeelding in het juiste formaat en was reproductie niet nodig.
Kopieerbare sjablonen
1) Zescomponenten productafbeeldingskelet:
[Onderwerp: beschrijf het product] , [Context: waar/hoe] .Stijl: [bijv. premium productfoto, realistisch] .Compositie: [bijv. product in het midden, ruimte voor tekst bovenaan. Licht en kleur: [bijv. zacht natuurlijk licht, aardetinten] .Techniek: [beeldverhouding, hoge resolutie, effen achtergrond] .Let op: Geen leesbare tekst/logo in de afbeelding; Ik zal de tekst later toevoegen.
2) Illustratie skelet:
Onderwerp: [wat te tekenen]. Stijl: [bijv. egale kleur vectorillustratie / aquarel / isometrische 3D]. Kleurenpalet: [2-3 primaire kleuren]. Stemming: [bijv. vrolijk, kalm, serieus] .Achtergrond: [effen / patroon / transparant] .Ratio: [1:1 / 9:16 / 16:9] .
3) Stijlverkenning (zelfde onderwerp, andere esthetiek):
Beschrijf het volgende onderwerp met dezelfde compositie in 4 verschillende visuele stijlen: minimale platte vector, realistische foto, aquarel, isometrische 3D. Schrijf voor elk een prompt van één regel. Onderwerp: [plakken]
4) Negatieve beschrijving toevoegen:
Verbeter de volgende prompt en voeg de ongewenste aan het einde toe: "geen tekst, geen watermerk, geen rommelige achtergrond, geen slechte handen/vingers, niet te veel objecten". Vraag: [plakken]
Zwakke prompt/sterke prompt
Zwak: een prachtige koffiefoto
Resultaat: Willekeurige hoek, onduidelijke stijl, incidenteel imago dat niet bij het merk past.
Krachtig: Keramisch kopje gevuld met een hete latte, op lichthouten tafel, zijdelings in zacht ochtendlicht; minimale premium productfoto; warme neutrale tinten; close-up, ruimte voor tekst rechtsboven; 1:1 vierkant, effen achtergrond; Er mag geen leesbare tekst zijn.
Het resultaat: een merkadaptieve schets met gecontroleerde compositie, licht en proporties.
Verschil: Een sterke prompt vult de zes componenten (onderwerp, context, stijl, compositie, licht, techniek) duidelijk in en laat de tekst weg.
Promptcomponenten en effecttabel
bestanddeel
voorbeeld
Effect op het resultaat
onderwerp
"olijfolie in een glazen fles"
bepaalt wat er verschijnt
Stijl
"premium productfoto"
Het element dat de beeldtaal het meest bepaalt
samenstelling
"in het midden, met tekstruimte"
Verhoogt de bruikbaarheid
licht/kleur
"zacht licht, aardetinten"
Brengt het merkgevoel over
aspectverhouding
"9:16 verticaal"
Maakt het mogelijk om aan het formaat te voldoen
negatieve omschrijving
"geen tekst"
Vermindert defecten
Veel voorkomende fouten
- De stijl niet specificeren: Door het meest beslissende onderdeel weg te laten, wordt het resultaat cliché en willekeurig.
- De AI de tekst laten tekenen: Corrupte, onleesbare letters; voeg de tekst later in het ontwerpprogramma toe.
- De verhouding vergeten: De verkeerde beeldverhouding zorgt voor clipping en elementverlies in de publicatie.
- Overbelaste prompt: het stapelen van 20 concepten op elkaar brengt het model in verwarring; houd het duidelijk en geprioriteerd.
- In één keer opgeven: verspreiding is willekeurig; Het is normaal om verschillende variaties te maken en de beste te kiezen.
Samengevat
De beeldgenererende AI construeert geleidelijk het beeld zodat het bij uw prompt past, op basis van willekeurige ruis; Het kan het plaatje in je hoofd niet lezen, het interpreteert alleen wat je schrijft. Een goede opdracht bestaat uit zes componenten: onderwerp, context, stijl, compositie, licht/kleur en techniek. Stijl is het meest doorslaggevende element; Zorg ervoor dat u de beeldverhouding specificeert; Laat de leesbare tekst niet aan de AI over, die voeg je later toe. Naarmate de duidelijkheid toeneemt, neemt het aantal pogingen en het tijdverlies af.
Applicatie taak
Kies een product of onderwerp. Schrijf het eerst in één zin (“een mooie X”) en probeer het in een beeldgenerator en noteer het resultaat. Beschrijf vervolgens hetzelfde onderwerp opnieuw door het zescomponentenskelet in te vullen, samen met de beeldverhouding en de negatieve beschrijving. Zet de twee resultaten naast elkaar en schrijf in drie opsommingstekens hoe duidelijkheid de uitkomst verandert.
controlelijst
- [ ] Ik heb het onderwerp, de context en de stijl duidelijk vermeld in mijn opdracht.
- [ ] Ik heb compositie en licht/kleurcomponenten toegevoegd.
- [ ] Ik heb de beeldverhouding opgegeven (1:1 / 9:16 / 16:9).
- [ ] Ik heb de AI niet de leesbare tekst laten tekenen, die heb ik voor later bewaard.
- [ ] Met de negatieve omschrijving heb ik de ongewenste zaken uitgesloten.
- [ ] Ik vertrouwde geen enkel experiment en produceerde verschillende variaties.