единици
1. Въведение в изкуствения интелект във фотографията: роли, граници, валидиране и етични основания 2. Планиране на снимане и разработване на концепция: Кратка информация, Moodboard и Shot List 3. Фотографско визуално производство и бърза анатомия: Как работи дифузията? 4. Ретуширане и редактиране: цвят, светлина, кожа и отстраняване на дефекти 5. Избор и избиване: Избор на най-доброто от хиляди рамки 6. Визуално разширение, завършване и премахване на обекти: Генеративно запълване и прерисуване 7. Архив, маркиране и метаданни: Библиотека със снимки с възможност за търсене 8. Представяне на клиента, галерия и комуникация с оферти 9. Авторско право, етика на манипулиране, пускане на модел и поверителност 10. Работен процес от край до край: автоматизация, интеграция и последователност 11. Специализация и устойчиво приложение: политика за портфолио, ценообразуване и AI
единица 3 / 11

Фотографско визуално производство и бърза анатомия: Как работи дифузията?

Печалби:

  • Разбиране как работи изкуственият интелект за генериране на изображения (дифузия) и какви компоненти на рецептата са необходими за фотографски реализъм
  • Способност да напишете силна фотографска подкана, състояща се от обект, светлина, обектив/камера, композиция, атмосфера и технически компоненти.
  • Възможност за разграничаване на разликата между произведено изображение и направена снимка, границите на употреба и значението на декларацията за автентичност

Фотографът използва генеративен визуален AI за три легитимни цели: да създаде чернови на препратки за мудбордове и концепции, да създаде елементи, които допълват действителния кадър (фон, текстура, комбинирано парче) и да създаде напълно произведени изображения (например за разпродажба на акции или рекламна концепция). В тази част ще научим как работят тези инструменти и как да пишем подкани за фотографски реализъм. Целта е да не чакате случайно хубав удар; Това означава да опишете какво искате на езика на фотографа и да насочите резултата.

Дифузия: как моделът произвежда "снимки"?

Повечето от днешните изкуствени интелекти за генериране на изображения работят с метод, наречен дифузия. Просто: моделът се е научил да преминава „от шум към смислено изображение“ върху милиони изображения. Започва от произволен шум по време на производство (като заснежена екранна снимка) и създава изображение чрез постепенно почистване на шума, за да пасне на вашия текст (подкана). От това произтичат два основни факта:

Първо, моделът не може да произведе това, което не е описано. Ако не кажете светлината, ще дойде произволна светлина; Ако не вземете предвид обективния поглед, "усещането за фотография" ще си остане случайност. Второ, моделът не разбира, той предвижда. Ето защо той прави грешки (халюцинации) на места, които изискват логика, като ръце, текст, отражение, симетрия. Ако искате фотографски реализъм, трябва ясно да опишете техническите решения – светлина, обектив, композиция – които правят снимката снимка.

Внимание: Въпреки че генерираното изображение може да изглежда „подобно на снимка“, то не е снимка; не документира действителен момент. Използването му в новина, документален филм или контекст, в който се твърди, че „това наистина се е случило“, е подвеждащо и нарушава етичните граници, които ще разгледаме в раздел 9.

Фотографска бърза анатомия

Една мощна фотографска подкана се състои от шест компонента. Мислете за това като за планиране на снимки:

  1. Тема: Какво/кой? Възраст, облекло, изражение, действие, номер. ("дърводелец на средна възраст, в престилка, работещ на работната маса")
  2. Светлина: Посока, твърдост, източник, време. Това е сърцето на фотографията. ("мека светлина на страничните прозорци, сутрин, нисък контраст")
  3. Обектив и изглед на камерата: Фокусно разстояние, дълбочина на полето, ъгъл. ("Усещане за 85 мм портретен обектив, малка дълбочина на рязкост, меко фоново боке, ниво на очите")
  4. Композиция: Рамкиране, поставяне, рамкиране. ("едър план, правило на третините, обект отляво")
  5. Атмосфера и цвят: Тон, настроение, палитра. ("топли земни тонове, спокойствие, носталгия")
  6. Технология/качество: Текстура, нотки на реализъм, съотношение на страните. ("естествена текстура на кожата, зърнист филм, съотношение 3:2")

Когато въведете тези компоненти последователно, моделът произвежда много по-контролиран, „фотографски“ резултат. Всеки компонент, който пропуснете, е оставен на случайността.

Съвет: Не карайте AI да рисува текста/логото. Дифузионните модели не могат надеждно да произведат четлив текст и патентовани лога; добавете ги в действителната фаза на проектиране. Освен това, в изображение, което изисква четим текст, използвайте AI само за фон/атмосфера.

Съотношение на страните и предназначение

Съотношението на страните е съотношението ширина към височина на изображението и определя използването му: 9:16 за вертикална история в социални медии, 3:2 за стандартен печат, 1:1 за квадратна публикация, 16:9 за широк банер. По-добре е да посочите съотношението в подканата от самото начало, отколкото да го отрежете по-късно и да загубите качество. Изберете разделителната способност и съотношението от самото начало, като знаете предвидената употреба (печат или дисплей).

Отрицателна рецепта и вариация

Повечето инструменти също имат отрицателна подкана: област, в която пишете неща, които не искате в изображението („деформирана ръка, допълнителни пръсти, текст, воден знак, пластмасова подвързия“). Това намалява, но не предотвратява напълно често срещаните дефекти; проверката все още е от съществено значение. Съществува и понятието семе — семето на случайността, от което започва производството; Същата начална точка и подкана отново произвеждат подобен резултат, което ви помага да създадете последователен набор (ще навлезем в по-голяма дълбочина в 4-та част).

три мини калъфа

Случай 1 — Силата на рецептата. Стоков фотограф написа „жена, пиеща кафе“ и получи тъжни резултати. Когато Prompta добави светлина (осветление на страничния прозорец), обектив (50 мм, плитка дълбочина на полето), атмосфера (топла, спокойна сутрин) и текстура (естествена кожа), резултатът стана използваем. Приемливата честота на генериране на кадри е увеличена от приблизително 1/20 на 1/4; Времето за производство е намалено с една трета.

Случай 2 — Загуба от халюцинации. Дизайнер-фотограф постави изображение на „ръкуващи се бизнесмени“ в презентация, без да го провери. На срещата се забеляза, че един мениджър има три ръце. Недостатъкът, който беше пренебрегнат на малкия екран, беше увеличен в проекцията. 30-секундно сканиране на ръка/пръст би предотвратило този срам.

Случай 3 — Избор на правилния инструмент. Продуктов фотограф искаше да постави истински часовник, който засне, в различна среда. Вместо да го произвежда от нулата, той запази реалната продуктова рамка, само фонът/атмосферата беше създаден с AI и направен композитен. По този начин действителните детайли на продукта (марка, циферблат) не са били изкривени; както достоверността, така и точността бяха запазени.

Копируеми шаблони

1) Скелет за фотографска подсказка:

[тема: кой/какво, възраст, облекло, изражение, действие], [светлина: посока, острота, източник, време], [обектив/камера: усещане за фокусно разстояние, дълбочина на рязкост, ъгъл], [композиция: рамкиране, разположение, конвенция], [атмосфера/цвят: тон, настроение, палитра], [техника: естествена текстура, зърнистост, съотношение]. Фотографски, реалистични. Добавете текст/лого.

2) Отрицателна бърза чернова:

Негативи (това, което не искам): деформирана ръка, излишни/липсващи пръсти, изкривено лице, пластмасова/восъчна кожа, нечетлив текст, воден знак, повтаряща се текстура, невъзможна сянка, пренаситен цвят.

3) За справка за табло за настроение (посока, не доставка):

Цел: референтна табла за настроение за снимане (не резултатът). Концепция: [концепция]. Опишете естетиката само с атрибути: светлина [..], цветова палитра [..], атмосфера [..], композиция [..]. Не използвайте имена на лица/марки/фотографи. Генерирайте 4 варианта.

4) Композитен план, защитаващ реалния продукт:

Имам реална снимка на [продукт]; Самият продукт няма да се промени. Напишете подканата за изображението, което да се създаде само за фон/атмосфера: [светлина, повърхност, цвят, среда]. Посоката на сянката и твърдостта на светлината на продукта трябва да бъдат [..], така че композитът да е убедителен.

Слаба подкана / Силна подкана

Слаб: „Хубава портретна снимка.“

Силно: „Жена от ферма на средна възраст, изморено от слънцето лице, лека усмивка, в житно поле; светлина в златния час отстрани, нисък контраст; 85 mm портретен изглед, малка дълбочина на рязкост, мек фон; близък план, обект вляво, правило на третините; топли земни тонове, спокойно и достойно настроение; естествена текстура на кожата, лека филмова зърнистост, 3:2. Фотографски, реалистични. Добавяне на текст.“

Слабата воля е оставена изцяло на случайността; Тъй като силното търсене описва светлината, лещите, композицията и атмосферата, това значително увеличава вероятността за получаване на желания резултат.

Често срещани грешки

  • Без да описвам светлината и обектива. Тези две до голяма степен правят една снимка снимка; Ако го оставите празно, резултатът ще бъде оставен на случайността.
  • Накарайте AI да нарисува четим текст/лого. Моделът не може да ги произведе надеждно; Може да се окаже, че е дефектен и защитен с авторски права.
  • Представяне на създаденото изображение като „снимка“. Това е подвеждащо в документален/новински контекст; Изисква се декларация за факти.
  • Копиране на стил с име на лице/бранд. Риск от имитация и авторско право; Опишете естетиката с качества.
  • Пропускане на проверката. Ръцете, очите, отраженията, сенките и повтарящите се текстури трябва да се проверяват във всяко създадено изображение.

В обобщение

Генеративният визуален AI работи чрез дифузия: преминава от шум към изображение, което пасва на текста, не може да произведе това, което не е описано, и греши там, където е необходима логика. За фотографски реализъм опишете обекта, светлината, обектива, композицията, атмосферата и техниката като фотограф. Изберете съотношението на страните според целта, намалете артефакта с отрицателна рецепта, не карайте AI да рисува текста и проверете всеки изход. Никога не използвайте произведено изображение, за което се твърди, че е „направена снимка“.

Задача за приложение

Изберете концепция и напишете фотографска подкана, като попълните всичките шест компонента с шаблон 1. Създайте (или опишете) същата концепция първо в едно изречение, като например „красива снимка“, след това с пълния скелет и сравнете двата резултата. Маркирайте най-малко три възможни недостатъци в изображението, което създавате, като увеличите ръцете, очите, отраженията и сенките.

контролен списък

  • [ ] В подканата описах отделно обекта, светлината, обектива, композицията, атмосферата и техниката.
  • [ ] Определих съотношението според предназначението.
  • [ ] Намалих често срещаните дефекти с отрицателната рецепта.
  • [ ] Нямах AI да нарисува четим текст/лого.
  • [ ] Уверих се, че не представям генерираното изображение като "снимка".
  • [ ] Проверих резултата за ръка/око/отражение/сянка.