Печалби:
- Разбиране как работи визуалният изкуствен интелект (дифузия) и как не може да произведе това, което не е описано и не може да начертае текст добре.
- Способност да напишете силна визуална подкана, състояща се от предмет, контекст, стил, композиция, светлина и технически компоненти.
- Получаване на възможност за определяне на съотношението на страните, предотвратяване на изчертаването на четливия текст от изкуствен интелект и намаляване на дефекта с отрицателно описание.
Дизайнер, създаващ визуализации с AI, е като да дадеш поръчка на художник: колкото по-ясно и по-точно го обясниш, толкова по-точен ще бъде резултатът. В този урок ще разберем на разбираем език как работи изкуственият интелект за генериране на изображения (AI на изображения) и ще научим стъпка по стъпка анатомията на писането на добра подкана (писмена инструкция за визуализация). Целта е да можете съзнателно да опишете изображението, което искате, вместо да „опитвате на случаен принцип и да разчитате на късмет“.
Как работи Image AI? (Просто обяснение)
Повечето производители на изображения днес използват метод, наречен дифузия. Просто: моделът е научил връзките „кои думи съответстват на кои изображения“ от милиони двойки изображение-текст. Когато създава визуални елементи, той започва от изображение с произволен шум (като заснежен телевизионен екран) и почиства този шум стъпка по стъпка, за да отговаря на вашата подкана, и го превръща в смислено изображение. С други думи, моделът не "рисува" картината, той статистически изгражда изображението, което най-добре отговаря на вашата подкана.
Това има три практически последствия. Първо: Една и съща подкана дава различен резултат всеки път, тъй като първоначалният шум е случаен (ще видим как да контролираме това с "seed" в следващия модул). Второ: Моделът не може да знае това, което вие не можете да опишете; То не може да прочете картината в главата ви, то просто интерпретира написаното от вас. Трето: Моделът не може да рисува добре текст и цифри, защото имитира буквите по форма, а не по смисъл; Ето защо е рисковано да оставим писането в лога на AI.
Съвет: Не позволявайте на AI да създава ясен текст (име на марката, слоган) в изображението. Създавате изображение без текст и след това добавяте текста (като вектор) в програма за проектиране. Това го прави едновременно четим и редактиран.
Анатомия на добра подкана
Помага да се раздели силна визуална подкана на шест компонента. Не е необходимо да ги използвате всички всеки път, но съзнателният избор ще определи резултата.
- Тема/тема: Кой е основният елемент на изображението? ("керамична чаша за кафе", "портрет на млада жена").
- Действие/контекст: Какво прави, къде е? („на дървената маса, в утринната светлина“).
- Стил/естетика: Какъв е визуалният език? („минимална продуктова снимка“, „акварелна илюстрация“, „изометрично 3D изобразяване“). Това е най-решаващият компонент.
- Композиция / ъгъл: каква е рамката? ("близък план", "птичи поглед", "широк ъгъл", "в средата, с пространство").
- Светлина и цвят: („мека естествена светлина“, „палитра от земни тонове“, „висок контраст“).
- Техника / качество: ("висока разделителна способност", "1:1 кадрова честота", "обикновен бял фон").
Има и отрицателна рецепта: казване на неща, които не искате („няма текст, няма хора, няма разхвърлян фон“). Ще задълбочим това с „отрицателна подкана“ в 4-та част.
Речник на термините
- Съотношение на страните: Съотношението на страните на изображението; 1:1 кадър (публикация в Instagram), 9:16 портрет (история/ролки), 16:9 пейзаж (корица).
- Резолюция: Брой пиксели в изображението; Високо е достатъчно за печат, средно е достатъчно за екран.
- Справка за стил: Даване на мостра на модела с думите „изглеждай така“.
- Render: Компютърът изчислява и произвежда изображение; „3D изобразяване“ означава реалистичен обемен изглед.
Стъпка по стъпка: описание на изображение
Да кажем, че искаме имидж на продукт за марка зехтин.
Стъпка 1 — Съсредоточете се върху темата: „екстра върджин зехтин в тъмнозелена стъклена бутилка“.
Стъпка 2 — Добавете контекст: „върху селския дървен плот, с няколко пресни маслинови клонки до него.“
Стъпка 3 — Изберете стил: „премиум продуктова снимка, реалистична“.
Стъпка 4 — Дайте композицията: „продукт в средата, място за текст в горната част“.
Стъпка 5 — Светлина/цвят: „мека странична естествена светлина, топли земни тонове“.
Стъпка 6 — Техника: „1:1 кадрова честота, висока разделителна способност, обикновен фон“.
Когато комбинирате всички тях, получавате работеща чернова, която отговаря на идентичността на марката.
три мини калъфа
Случай 1 — От несигурност към яснота. Дизайнер написа „изображение на модерен офис“ и направи 12 опита, нито един от които не успя (загубени 30 минути). Той пренаписа подканата в шест компонента: „светъл, минималистичен офис; дървено бюро; естествена светлина от голям прозорец; топли неутрални тонове; широк ъгъл; текстово пространство отгоре“. 2 от първите 4 опита бяха използваеми; Времето беше намалено до 10 минути.
Случай 2 — Прихващане на текст. Един стажант накара AI да произведе плакат за кафене от началото до края; Текстът "КАФЕ" на изображението се оказа "КАФЕ" и цените не се четат. Инструкциите се промениха: изображението беше създадено без текст, текстът беше добавен по-късно в програмата за проектиране. Грешката намаля до нула и плакатът стана годен за печат.
Случай 3 — Загуба на съотношение. Експерт по социални медии създаде квадратно изображение 1:1 за Instagram история; 9:16 Когато го поставих във вертикалната зона, горната и долната част бяха отрязани и важният елемент беше загубен. Когато посочих съотношението на страните като „9:16 вертикално“ в подканата, изображението се вмести в своя формат и не беше необходимо възпроизвеждане.
Копируеми шаблони
1) Шесткомпонентен скелет на изображението на продукта:
[Тема: опишете продукта] , [Контекст: къде/как] .Стил: [напр. първокласна продуктова снимка, реалистична] .Композиция: [напр. продукт в средата, място за текст в горната част].Светлина и цвят: [напр. мека естествена светлина, земни тонове] .Техника: [пропорции, висока разделителна способност, обикновен фон] .Забележка: Няма четлив текст/лого в изображението; Ще добавя текста по-късно.
2) Скелет на илюстрация:
Тема: [какво да нарисувам]. Стил: [напр. векторна илюстрация с плосък цвят / акварел / изометрично 3D] .Цветова палитра: [2-3 основни цвята] .Настроение: [напр. весел, спокоен, сериозен] .Фон: [обикновен / шарен / прозрачен] .Съотношение: [1:1 / 9:16 / 16:9] .
3) Изследване на стил (същият предмет, различна естетика):
Опишете следния обект със същата композиция в 4 различни визуални стила: минимален плосък вектор, реалистична снимка, акварел, изометрично 3D. Напишете подкана от един ред за всеки. Тема: [постави]
4) Добавяне на отрицателно описание:
Подобрете следната подкана и добавете нежеланите в края: „без текст, без воден знак, без разхвърлян фон, без лоши ръце/пръсти, без твърде много обекти“. Подкана: [поставяне]
Слаба подкана / Силна подкана
Слабо: красива снимка на кафе
Резултат: Произволен ъгъл, неясен стил, случайно изображение, което не пасва на марката.
Мощен: Керамична чаша, пълна с горещо лате, върху светла дървена маса, настрани на мека утринна светлина; минимална първокласна снимка на продукта; топли неутрални тонове; едър план, място за текст горе вдясно; 1:1 квадрат, обикновен фон; Не трябва да има четлив текст.
Резултатът: адаптивна към марката скица с контролирана композиция, светлина и пропорции.
Разлика: Силната подкана запълва ясно шестте компонента (тема, контекст, стил, композиция, светлина, техника) и пропуска текста.
Подкани компоненти и таблица с ефекти
компонент
пример
Ефект върху резултата
предмет
"зехтин в стъклена бутилка"
определя какво се появява
стил
"премиум продукт снимка"
Елементът, който най-много определя визуалния език
състав
"в средата, с интервал за текст"
Увеличава използваемостта
светлина/цвят
"мека светлина, земни тонове"
Предава усещането за марката
аспектно съотношение
"9:16 вертикално"
Позволява спазване на формата
отрицателно описание
"без текст"
Намалява дефекта
Често срещани грешки
- Без уточняване на стила: Пропускайки най-решаващия компонент, резултатът става клише и случаен.
- Накарайте AI да нарисува текста: повредени, нечетливи букви; добавете текста по-късно в програмата за проектиране.
- Забравяне на съотношението: Грешното съотношение създава изрязване и загуба на елементи в публикацията.
- Претоварена подкана: подреждането на 20 концепции една върху друга обърква модела; поддържайте ясна и приоритетна.
- Отказване с един опит: Дифузията е произволна; Нормално е да се произвеждат няколко варианта и да се избере най-добрият.
В обобщение
Изкуственият интелект, генериращ изображение, постепенно конструира изображението, за да пасне на вашата подкана от произволен шум; То не може да прочете картината в главата ви, то просто интерпретира написаното от вас. Добрата подкана се състои от шест компонента: предмет, контекст, стил, композиция, светлина/цвят и техника. Стилът е най-решаващият елемент; Не забравяйте да посочите съотношението на страните; Не оставяйте четливия текст на AI, добавяте го по-късно. С увеличаване на яснотата броят на опитите и загубата на време намаляват.
Задача за приложение
Изберете продукт или тема. Първо, напишете го в едно изречение („хубав X“) и го опитайте в генератор на изображения и отбележете резултата. След това опишете отново същия обект, като попълните шесткомпонентния скелет, като добавите съотношението на страните и отрицателното описание. Поставете двата резултата един до друг и напишете в три точки как яснотата променя резултата.
контролен списък
- [ ] Заявих темата, контекста и стила ясно в моята подкана.
- [ ] Добавих компоненти за композиция и светлина/цвет.
- [ ] Посочих съотношението (1:1 / 9:16 / 16:9).
- [ ] Не накарах изкуствения интелект да начертае четливия текст, оставих го за по-късно.
- [ ] Изключих нежеланите с отрицателното описание.
- [ ] Не се доверих на нито един експеримент и създадох няколко варианта.