Mga nadagdag:
- Pag-unawa sa kung paano gumagana ang visual artificial intelligence (diffusion) at kung paano ito hindi makagawa ng hindi inilalarawan at hindi makaguguhit ng teksto nang maayos.
- Kakayahang magsulat ng malakas na visual prompt na binubuo ng paksa, konteksto, istilo, komposisyon, liwanag at teknikal na mga bahagi.
- Pagkakaroon ng kakayahang matukoy ang aspect ratio, pigilan ang nababasang teksto na iguguhit ng artificial intelligence, at bawasan ang depekto na may negatibong paglalarawan.
Ang isang taga-disenyo na gumagawa ng mga visual na may AI ay tulad ng pagbibigay ng order sa isang artist: mas malinaw at mas tumpak na ipinapaliwanag mo ito, mas tumpak ang magiging resulta. Sa unit na ito, mauunawaan natin sa simpleng wika kung paano gumagana ang paggawa ng imahe ng artificial intelligence (image AI) at matutunan ang anatomy ng pagsulat ng isang magandang prompt (nakasulat na pagtuturo para sa isang visual), hakbang-hakbang. Ang layunin ay upang ma-conscious na ilarawan ang imahe na gusto mo, sa halip na "sumubok nang random at umasa sa swerte".
Paano gumagana ang Image AI? (Simpleng paliwanag)
Karamihan sa mga producer ng imahe ngayon ay gumagamit ng isang paraan na tinatawag na diffusion. Simple lang: natutunan ng modelo ang "aling mga salita ang tumutugma sa kung aling mga larawan" ang mga relasyon mula sa milyun-milyong mga pares ng imahe-text. Kapag gumagawa ng mga visual, nagsisimula ito sa isang imahe na may random na ingay (tulad ng isang maniyebe na screen ng telebisyon) at nililinis ang ingay na ito nang sunud-sunod upang umangkop sa iyong prompt at ginagawa itong isang makabuluhang larawan. Sa madaling salita, ang modelo ay hindi "gumuhit" ng larawan, ito ay istatistiks na bumubuo ng imahe na pinakaangkop sa iyong prompt.
Ito ay may tatlong praktikal na kahihinatnan. Una: Ang parehong prompt ay nagbibigay ng ibang resulta sa bawat oras, dahil ang paunang ingay ay random (makikita natin kung paano ito kontrolin gamit ang "binhi" sa susunod na yunit). Pangalawa: Ang modelo ay hindi maaaring malaman kung ano ang hindi mo maaaring ilarawan; Hindi nito mabasa ang larawan sa iyong ulo, binibigyang kahulugan lamang nito ang iyong isinulat. Ikatlo: Ang modelo ay hindi maaaring gumuhit ng teksto at numero nang maayos, dahil ginagaya nito ang mga titik sa hugis at hindi sa kahulugan; Iyon ang dahilan kung bakit mapanganib na iwanan ang pagsulat sa mga logo sa AI.
Tip: Huwag hayaan ang AI na gumawa ng malinaw na text (brand name, slogan) sa larawan. Gumawa ka ng isang imahe na walang teksto at pagkatapos ay idagdag ang teksto (bilang isang vector) sa isang disenyo ng programa. Ginagawa nitong parehong nababasa at nae-edit.
Anatomy ng isang magandang prompt
Nakakatulong itong hatiin ang isang malakas na visual prompt sa anim na bahagi. Hindi mo kailangang gamitin ang mga ito sa lahat ng oras, ngunit ang pagpili ng sinasadya ay matukoy ang resulta.
- Paksa/paksa: Ano ang pangunahing elemento ng larawan? ("isang ceramic coffee cup", "portrait of a young woman").
- Aksyon/konteksto: Ano ang ginagawa niya, nasaan siya? (“sa kahoy na mesa, sa liwanag ng umaga”).
- Estilo/aesthetics: Ano ang visual na wika? (“minimal na larawan ng produkto”, “ilustrasyon ng watercolor”, “isometric 3D rendering”). Ito ang pinaka mapagpasyang bahagi.
- Komposisyon / anggulo: Kumusta ang frame? ("close-up", "bird's eye view", "wide angle", "sa gitna, na may espasyo").
- Banayad at kulay: ("soft natural light", "earth tone palette", "high contrast").
- Teknik / kalidad: ("high resolution", "1:1 frame rate", "background plain white").
Mayroon ding negatibong recipe: pagsasabi ng mga bagay na hindi mo gusto ("walang text, walang tao, walang magulo na background"). Papalalimin natin ito gamit ang "negative prompt" sa ika-4 na unit.
Glossary ng mga termino
- Aspect ratio: Ang aspect ratio ng larawan; 1:1 frame (Instagram post), 9:16 portrait (story/reels), 16:9 landscape (cover).
- Resolusyon: Bilang ng mga pixel sa larawan; Ang mataas ay sapat para sa pag-print, ang medium ay sapat para sa screen.
- Sanggunian sa istilo: Pagbibigay ng sample sa modelo na nagsasabing "magmukhang ganito".
- Render: Ang computer ay kinakalkula at gumagawa ng isang imahe; Ang ibig sabihin ng "3D rendering" ay makatotohanang volumetric na view.
Hakbang-hakbang: naglalarawan ng isang larawan
Sabihin nating gusto namin ng larawan ng produkto para sa isang tatak ng langis ng oliba.
Hakbang 1 — Tumutok sa paksa: “extra virgin olive oil sa isang dark green glass bottle.”
Hakbang 2 — Magdagdag ng konteksto: "sa simpleng kahoy na counter, na may ilang sariwang sanga ng oliba sa tabi nito."
Hakbang 3 — Pumili ng istilo: “premium na larawan ng produkto, makatotohanan”.
Hakbang 4 — Ibigay ang komposisyon: "produkto sa gitna, espasyo para sa teksto sa itaas".
Hakbang 5 — Banayad/kulay: “soft side natural light, warm earth tones”.
Hakbang 6 — Diskarte: “1:1 frame rate, mataas na resolution, plain background”.
Kapag pinagsama mo silang lahat, makakakuha ka ng maisasagawang draft na nababagay sa pagkakakilanlan ng brand.
tatlong mini case
Kaso 1 — Mula sa kawalan ng katiyakan hanggang sa kalinawan. Sumulat ang isang taga-disenyo ng "larawan ng isang modernong opisina" at gumawa ng 12 pagtatangka, wala sa mga ito ang gumana (nawala ang 30 minuto). Muli niyang isinulat ang prompt sa anim na bahagi: "maliwanag, minimal na opisina; kahoy na desk; natural na liwanag mula sa malaking bintana; mainit na neutral na tono; malawak na anggulo; text space sa itaas". 2 sa unang 4 na pagtatangka ay magagamit; Ang oras ay nabawasan sa 10 minuto.
Case 2 — Text trap. Isang intern ang may AI na gumawa ng poster ng cafe mula simula hanggang matapos; Ang text na "COFFEE" sa larawan ay naging "COFEEE" at hindi nababasa ang mga presyo. Ang mga tagubilin ay nagbago: ang imahe ay ginawa nang walang teksto, ang teksto ay idinagdag sa ibang pagkakataon sa programa ng disenyo. Ang error ay bumaba sa zero at ang poster ay angkop para sa pag-print.
Kaso 3 — Pagkawala ng ratio. Isang social media expert ang gumawa ng 1:1 square image para sa Instagram story; 9:16 Kapag inilagay ko ito sa patayong lugar, ang itaas at ibaba ay pinutol at ang mahalagang elemento ay nawala. Nang tinukoy ko ang aspect ratio bilang "9:16 vertical" sa prompt, ang imahe ay umaangkop sa format nito at walang kinakailangang pagpaparami.
Mga nakopyang template
1) Anim na bahagi ng balangkas ng larawan ng produkto:
[Paksa: ilarawan ang produkto] , [Konteksto: saan/paano] .Estilo: [hal. premium na larawan ng produkto, makatotohanan] .Komposisyon: [hal. produkto sa gitna, espasyo para sa text sa itaas].Ilaw at kulay: [hal. soft natural light, earth tones] .Technique: [aspect ratio, high resolution, plain background] .Note: Walang nababasang text/logo sa larawan; Idadagdag ko ang text mamaya.
2) Kalansay ng paglalarawan:
Paksa: [kung ano ang iguguhit].Estilo: [hal. flat color vector illustration / watercolor / isometric 3D] .Color palette: [2-3 pangunahing kulay] .Mood: [hal. masayahin, mahinahon, seryoso] .Background: [plain / patterned / transparent] .Ratio: [1:1 / 9:16 / 16:9] .
3) Paggalugad ng istilo (parehong paksa, magkaibang aesthetic):
Ilarawan ang sumusunod na paksa na may parehong komposisyon sa 4 na magkakaibang visual na istilo: minimal na flat vector, makatotohanang larawan, watercolor, isometric 3D. Sumulat ng isang linyang prompt para sa bawat isa. Paksa: [i-paste]
4) Pagdaragdag ng negatibong paglalarawan:
Pagbutihin ang sumusunod na prompt at idagdag ang mga hindi gustong sa dulo: "walang text, walang watermark, walang magulo na background, walang masamang kamay/daliri, walang masyadong maraming bagay". Prompt: [i-paste]
Mahinang prompt / Malakas na prompt
Mahina: isang magandang larawan ng kape
Resulta: Random na anggulo, hindi malinaw na istilo, hindi sinasadyang larawan na hindi akma sa brand.
Napakahusay: Ceramic cup na puno ng mainit na latte, sa magaan na kahoy na mesa, patagilid sa malambot na liwanag ng umaga; minimal na premium na larawan ng produkto; mainit na neutral na tono; close-up, espasyo para sa teksto sa kanang tuktok; 1:1 square, plain background; Dapat walang nababasang teksto.
Ang resulta: isang brand-adaptive sketch na may kinokontrol na komposisyon, liwanag at proporsyon.
Pagkakaiba: Ang isang malakas na prompt ay pinupuno ang anim na bahagi (paksa, konteksto, estilo, komposisyon, liwanag, pamamaraan) nang malinaw at iniiwan ang teksto.
Mga prompt na bahagi at talahanayan ng epekto
sangkap
halimbawa
Epekto sa resulta
paksa
"langis ng oliba sa isang bote ng salamin"
tinutukoy kung ano ang lilitaw
Estilo
"premium na larawan ng produkto"
Ang elementong pinakatumutukoy sa visual na wika
komposisyon
"sa gitna, na may text space"
Pinapataas ang kakayahang magamit
liwanag/kulay
"malambot na liwanag, mga tono ng lupa"
Naghahatid ng pakiramdam ng tatak
aspect ratio
"9:16 patayo"
Nagbibigay-daan na sumunod sa format
negatibong paglalarawan
"walang text"
Binabawasan ang depekto
Mga karaniwang pagkakamali
- Hindi pagtukoy ng istilo: Sa pamamagitan ng pag-alis sa pinaka mapagpasyang bahagi, ang resulta ay nagiging cliché at random.
- Ang pagkakaroon ng AI ay gumuhit ng teksto: Mga sira, hindi nababasa na mga titik; idagdag ang teksto sa ibang pagkakataon sa disenyo ng programa.
- Nakakalimutan ang ratio: Ang maling aspect ratio ay lumilikha ng clipping at pagkawala ng elemento sa publikasyon.
- Overloaded prompt: ang pagsasalansan ng 20 konsepto sa ibabaw ng bawat isa ay nakalilito sa modelo; panatilihin itong malinaw at priority.
- Pagsuko sa isang pagsubok: Ang pagsasabog ay random; Normal na gumawa ng ilang mga variation at piliin ang pinakamahusay.
Sa buod
Ang AI na bumubuo ng imahe ay unti-unting bumubuo ng imahe upang magkasya sa iyong prompt mula sa random na ingay; Hindi nito mabasa ang larawan sa iyong ulo, binibigyang kahulugan lamang nito ang iyong isinulat. Ang isang magandang prompt ay binubuo ng anim na bahagi: paksa, konteksto, istilo, komposisyon, liwanag/kulay, at pamamaraan. Ang istilo ay ang pinaka mapagpasyang elemento; Tiyaking tukuyin ang aspect ratio; Huwag iwanan ang nababasang teksto sa AI, idagdag mo ito sa ibang pagkakataon. Habang tumataas ang kalinawan, bumababa ang bilang ng mga pagtatangka at pagkawala ng oras.
Gawain ng aplikasyon
Pumili ng produkto o paksa. Una, isulat ito sa isang pangungusap (“a nice X”) at subukan ito sa isang image generator at tandaan ang resulta. Pagkatapos ay ilarawan muli ang parehong paksa sa pamamagitan ng pagpuno sa anim na bahagi ng balangkas, pagdaragdag ng aspect ratio at negatibong paglalarawan. Ilagay ang dalawang resulta nang magkatabi at isulat sa tatlong bullet point kung paano binago ng kalinawan ang output.
checklist
- [ ] Malinaw kong sinabi ang paksa, konteksto at istilo sa aking prompt.
- [ ] Nagdagdag ako ng komposisyon at mga bahagi ng liwanag/kulay.
- [ ] Tinukoy ko ang aspect ratio (1:1 / 9:16 / 16:9).
- [ ] Wala akong AI na iguhit ang nababasang teksto, iniwan ko ito para sa ibang pagkakataon.
- [ ] Ibinukod ko ang mga hindi kanais-nais na may negatibong paglalarawan.
- [ ] Hindi ako nagtiwala sa isang eksperimento at gumawa ng ilang mga pagkakaiba-iba.