единици
1. Въведение в изкуствения интелект в графичния дизайн: роли, граници, проверка и информираност за авторските права 2. Основи на визуалното производство: Как работи изкуственият интелект на изображенията и бърза анатомия 3. Moodboard и разработване на концепции: визуално намиране и справка 4. Визуална вариация, итерация и фина настройка: начален етап, отрицателна подкана и рисуване 5. Концепция за лого и идентичност на марката: Генериране на идеи с изкуствен интелект и неговите граници 6. Език на марката и визуална система: цвят, типография и тон 7. Оформление и композиция: оформление, мрежа и визуална йерархия 8. Визуален комплект за социални медии: формат, шаблон и последователност 9. Авторско право, оригиналност и интелектуална собственост: ограничения, рискове и безопасна употреба 10. Интеграция на работния процес: Инструменти и цялостна работа от Brief до Delivery 11. Етика, контрол на качеството и комуникация с клиенти
единица 2 / 11

Основи на визуалното производство: Как работи изкуственият интелект на изображенията и бърза анатомия

Печалби:

  • Разбиране как работи визуалният изкуствен интелект (дифузия) и как не може да произведе това, което не е описано и не може да начертае текст добре.
  • Способност да напишете силна визуална подкана, състояща се от предмет, контекст, стил, композиция, светлина и технически компоненти.
  • Получаване на възможност за определяне на съотношението на страните, предотвратяване на изчертаването на четливия текст от изкуствен интелект и намаляване на дефекта с отрицателно описание.

Дизайнер, създаващ визуализации с AI, е като да дадеш поръчка на художник: колкото по-ясно и по-точно го обясниш, толкова по-точен ще бъде резултатът. В този урок ще разберем на разбираем език как работи изкуственият интелект за генериране на изображения (AI на изображения) и ще научим стъпка по стъпка анатомията на писането на добра подкана (писмена инструкция за визуализация). Целта е да можете съзнателно да опишете изображението, което искате, вместо да „опитвате на случаен принцип и да разчитате на късмет“.

Как работи Image AI? (Просто обяснение)

Повечето производители на изображения днес използват метод, наречен дифузия. Просто: моделът е научил връзките „кои думи съответстват на кои изображения“ от милиони двойки изображение-текст. Когато създава визуални елементи, той започва от изображение с произволен шум (като заснежен телевизионен екран) и почиства този шум стъпка по стъпка, за да отговаря на вашата подкана, и го превръща в смислено изображение. С други думи, моделът не "рисува" картината, той статистически изгражда изображението, което най-добре отговаря на вашата подкана.

Това има три практически последствия. Първо: Една и съща подкана дава различен резултат всеки път, тъй като първоначалният шум е случаен (ще видим как да контролираме това с "seed" в следващия модул). Второ: Моделът не може да знае това, което вие не можете да опишете; То не може да прочете картината в главата ви, то просто интерпретира написаното от вас. Трето: Моделът не може да рисува добре текст и цифри, защото имитира буквите по форма, а не по смисъл; Ето защо е рисковано да оставим писането в лога на AI.

Съвет: Не позволявайте на AI да създава ясен текст (име на марката, слоган) в изображението. Създавате изображение без текст и след това добавяте текста (като вектор) в програма за проектиране. Това го прави едновременно четим и редактиран.

Анатомия на добра подкана

Помага да се раздели силна визуална подкана на шест компонента. Не е необходимо да ги използвате всички всеки път, но съзнателният избор ще определи резултата.

  1. Тема/тема: Кой е основният елемент на изображението? ("керамична чаша за кафе", "портрет на млада жена").
  2. Действие/контекст: Какво прави, къде е? („на дървената маса, в утринната светлина“).
  3. Стил/естетика: Какъв е визуалният език? („минимална продуктова снимка“, „акварелна илюстрация“, „изометрично 3D изобразяване“). Това е най-решаващият компонент.
  4. Композиция / ъгъл: каква е рамката? ("близък план", "птичи поглед", "широк ъгъл", "в средата, с пространство").
  5. Светлина и цвят: („мека естествена светлина“, „палитра от земни тонове“, „висок контраст“).
  6. Техника / качество: ("висока разделителна способност", "1:1 кадрова честота", "обикновен бял фон").

Има и отрицателна рецепта: казване на неща, които не искате („няма текст, няма хора, няма разхвърлян фон“). Ще задълбочим това с „отрицателна подкана“ в 4-та част.

Речник на термините

  • Съотношение на страните: Съотношението на страните на изображението; 1:1 кадър (публикация в Instagram), 9:16 портрет (история/ролки), 16:9 пейзаж (корица).
  • Резолюция: Брой пиксели в изображението; Високо е достатъчно за печат, средно е достатъчно за екран.
  • Справка за стил: Даване на мостра на модела с думите „изглеждай така“.
  • Render: Компютърът изчислява и произвежда изображение; „3D изобразяване“ означава реалистичен обемен изглед.

Стъпка по стъпка: описание на изображение

Да кажем, че искаме имидж на продукт за марка зехтин.

Стъпка 1 — Съсредоточете се върху темата: „екстра върджин зехтин в тъмнозелена стъклена бутилка“.

Стъпка 2 — Добавете контекст: „върху селския дървен плот, с няколко пресни маслинови клонки до него.“

Стъпка 3 — Изберете стил: „премиум продуктова снимка, реалистична“.

Стъпка 4 — Дайте композицията: „продукт в средата, място за текст в горната част“.

Стъпка 5 — Светлина/цвят: „мека странична естествена светлина, топли земни тонове“.

Стъпка 6 — Техника: „1:1 кадрова честота, висока разделителна способност, обикновен фон“.

Когато комбинирате всички тях, получавате работеща чернова, която отговаря на идентичността на марката.

три мини калъфа

Случай 1 — От несигурност към яснота. Дизайнер написа „изображение на модерен офис“ и направи 12 опита, нито един от които не успя (загубени 30 минути). Той пренаписа подканата в шест компонента: „светъл, минималистичен офис; дървено бюро; естествена светлина от голям прозорец; топли неутрални тонове; широк ъгъл; текстово пространство отгоре“. 2 от първите 4 опита бяха използваеми; Времето беше намалено до 10 минути.

Случай 2 — Прихващане на текст. Един стажант накара AI да произведе плакат за кафене от началото до края; Текстът "КАФЕ" на изображението се оказа "КАФЕ" и цените не се четат. Инструкциите се промениха: изображението беше създадено без текст, текстът беше добавен по-късно в програмата за проектиране. Грешката намаля до нула и плакатът стана годен за печат.

Случай 3 — Загуба на съотношение. Експерт по социални медии създаде квадратно изображение 1:1 за Instagram история; 9:16 Когато го поставих във вертикалната зона, горната и долната част бяха отрязани и важният елемент беше загубен. Когато посочих съотношението на страните като „9:16 вертикално“ в подканата, изображението се вмести в своя формат и не беше необходимо възпроизвеждане.

Копируеми шаблони

1) Шесткомпонентен скелет на изображението на продукта:

[Тема: опишете продукта] , [Контекст: къде/как] .Стил: [напр. първокласна продуктова снимка, реалистична] .Композиция: [напр. продукт в средата, място за текст в горната част].Светлина и цвят: [напр. мека естествена светлина, земни тонове] .Техника: [пропорции, висока разделителна способност, обикновен фон] .Забележка: Няма четлив текст/лого в изображението; Ще добавя текста по-късно.

2) Скелет на илюстрация:

Тема: [какво да нарисувам]. Стил: [напр. векторна илюстрация с плосък цвят / акварел / изометрично 3D] .Цветова палитра: [2-3 основни цвята] .Настроение: [напр. весел, спокоен, сериозен] .Фон: [обикновен / шарен / прозрачен] .Съотношение: [1:1 / 9:16 / 16:9] .

3) Изследване на стил (същият предмет, различна естетика):

Опишете следния обект със същата композиция в 4 различни визуални стила: минимален плосък вектор, реалистична снимка, акварел, изометрично 3D. Напишете подкана от един ред за всеки. Тема: [постави]

4) Добавяне на отрицателно описание:

Подобрете следната подкана и добавете нежеланите в края: „без текст, без воден знак, без разхвърлян фон, без лоши ръце/пръсти, без твърде много обекти“. Подкана: [поставяне]

Слаба подкана / Силна подкана

Слабо: красива снимка на кафе

Резултат: Произволен ъгъл, неясен стил, случайно изображение, което не пасва на марката.

Мощен: Керамична чаша, пълна с горещо лате, върху светла дървена маса, настрани на мека утринна светлина; минимална първокласна снимка на продукта; топли неутрални тонове; едър план, място за текст горе вдясно; 1:1 квадрат, обикновен фон; Не трябва да има четлив текст.

Резултатът: адаптивна към марката скица с контролирана композиция, светлина и пропорции.

Разлика: Силната подкана запълва ясно шестте компонента (тема, контекст, стил, композиция, светлина, техника) и пропуска текста.

Подкани компоненти и таблица с ефекти

компонент

пример

Ефект върху резултата

предмет

"зехтин в стъклена бутилка"

определя какво се появява

стил

"премиум продукт снимка"

Елементът, който най-много определя визуалния език

състав

"в средата, с интервал за текст"

Увеличава използваемостта

светлина/цвят

"мека светлина, земни тонове"

Предава усещането за марката

аспектно съотношение

"9:16 вертикално"

Позволява спазване на формата

отрицателно описание

"без текст"

Намалява дефекта

Често срещани грешки

  • Без уточняване на стила: Пропускайки най-решаващия компонент, резултатът става клише и случаен.
  • Накарайте AI да нарисува текста: повредени, нечетливи букви; добавете текста по-късно в програмата за проектиране.
  • Забравяне на съотношението: Грешното съотношение създава изрязване и загуба на елементи в публикацията.
  • Претоварена подкана: подреждането на 20 концепции една върху друга обърква модела; поддържайте ясна и приоритетна.
  • Отказване с един опит: Дифузията е произволна; Нормално е да се произвеждат няколко варианта и да се избере най-добрият.

В обобщение

Изкуственият интелект, генериращ изображение, постепенно конструира изображението, за да пасне на вашата подкана от произволен шум; То не може да прочете картината в главата ви, то просто интерпретира написаното от вас. Добрата подкана се състои от шест компонента: предмет, контекст, стил, композиция, светлина/цвят и техника. Стилът е най-решаващият елемент; Не забравяйте да посочите съотношението на страните; Не оставяйте четливия текст на AI, добавяте го по-късно. С увеличаване на яснотата броят на опитите и загубата на време намаляват.

Задача за приложение

Изберете продукт или тема. Първо, напишете го в едно изречение („хубав X“) и го опитайте в генератор на изображения и отбележете резултата. След това опишете отново същия обект, като попълните шесткомпонентния скелет, като добавите съотношението на страните и отрицателното описание. Поставете двата резултата един до друг и напишете в три точки как яснотата променя резултата.

контролен списък

  • [ ] Заявих темата, контекста и стила ясно в моята подкана.
  • [ ] Добавих компоненти за композиция и светлина/цвет.
  • [ ] Посочих съотношението (1:1 / 9:16 / 16:9).
  • [ ] Не накарах изкуствения интелект да начертае четливия текст, оставих го за по-късно.
  • [ ] Изключих нежеланите с отрицателното описание.
  • [ ] Не се доверих на нито един експеримент и създадох няколко варианта.