Я почав шукати найкращі інструменти для генеративного заповнення на основі штучного інтелекту, коли мені було важко вкластися в терміни ретушування проекту для клієнта з роздрібної торгівлі одягом. У FixThePhoto ми мали справу з сотнями фотографій, які мали насичений фон, відсутні частини та пошкоджені ділянки, які потрібно було відновлювати, а ручне редагування вимагало забагато часу.
Спочатку я думав, що будь-яке популярне рішення на основі штучного інтелекту підійде для цієї роботи, але мої тести швидко довели, що я помилявся. Для професійної роботи потрібні інструменти, які можуть забезпечити збереження оригінальної текстури шкіри, деталей тканини, тіней та освітлення, оскільки інакше результати можуть виглядати штучно.
Проєкт отримав вигоду від використання генеративних інструментів заповнення на основі штучного інтелекту в різних сценаріях, включаючи видалення туристів з модних фотографій, розширення фонів для банерів, реконструкцію обрізаних частин тіла та заміну пейзажів, постраждалих від негоди під час фотосесії.
Щоб належним чином оцінити кожен варіант, я визначив пріоритетність кількох важливих факторів – реалізму, підтримки високої роздільної здатності, перебудови текстур та універсальності функцій редагування. Тестуючи понад 60 інструментів генеративного заповнення на основі штучного інтелекту, я побачив величезні відмінності між варіантами.
Деякі платформи створювали візуально приголомшливі редагування на перший погляд, але при детальнішому розгляді такі деталі, як волосся, ювелірні вироби чи складки одягу, виглядали зіпсованими або спотвореними. Інші чудово зберігали текстури та освітлення, але їм бракувало універсальності або підтримки професійних робочих процесів редагування, орієнтованих на Photoshop.
Інструменти генеративного заповнення були створені в першу чергу для корекції, розширення або творчої реконструкції певних областей зображення, які зазвичай вимагають ручної роботи. Для професійних робочих процесів фотографії, як-от той, що ми маємо у FixThePhoto , такі платформи особливо корисні, коли ми стикаємося з жорсткими термінами, але не можемо поступатися якістю.
Найпоширеніша дія, яку вам доведеться виконувати, — це видалення об’єктів. Ця функція дозволяє позбутися відволікаючих елементів, таких як перехожі на задньому плані, лінії електропередач, пилові плями або випадкові елементи в навколишньому середовищі, а штучний інтелект відновлює те, що має бути реально за ними. Ви часто використовуватимете її для портретної, вуличної та нерухомої фотографії.
Такі платформи також часто використовуються для розширення фону та перефарбовування. Коли зображення надмірно обрізане або вам потрібно налаштувати його для розміщення під певні формати (наприклад, банери чи реклама в соціальних мережах), генеративне заповнення може розумно розширити небо, стіни, пейзажі або студійні фони, враховуючи освітлення та перспективу.
Генеративне заповнення за допомогою штучного інтелекту також чудово справляється з реконструкцією та відновленням об'єктів. Якщо певна область фотографії відсутня або пошкоджена, будь то обрізана рука, порваний край тканини або неповна деталь продукту, ви можете використовувати такий інструмент, щоб відтворити її візуально цілісним чином. Така функціональність особливо актуальна для комерційної фотографії товарів.
Зрештою, генеративне заповнення може допомогти з редагуванням та концептуалізацією креативних сцен. Замість того, щоб просто виправляти фотографії, ви можете кардинально трансформувати сцени, застосовувати атмосферні ефекти або створювати нові візуальні елементи, що відповідають стилю та настрою оригінального зображення. На практиці ви можете перетворити звичайну фотографію на гнучку основу для маркетингу, розповіді історій або креативного дизайну.
Я вже використовував інструмент штучного інтелекту для генеративного заповнення Photoshop для своєї ретуші, тому мені здалося природним спробувати імпортувати фотографії RAW високої роздільної здатності зі складним фоном, відсутніми краями та відволікаючими елементами. Мені сподобалося, наскільки реалістично штучний інтелект обробляв напрямок освітлення та текстуру шкіри. Навіть складні редагування, такі як відновлення обрізаних елементів одягу, виглядали реалістично вже після кількох поколінь.
Я присвятив кілька днів вивченню того, як генеративне заповнення працює в професійному проекті, а не для звичайного редагування в соціальних мережах. Я зосередився переважно на розширенні студійного фону, реконструкції пасом волосся та позбавленні від небажаних сторонніх осіб під час зйомок на вулиці.
Це безкоштовне програмне забезпечення Adobe впоралося з тінями та відблисками набагато краще, ніж я думав, особливо з обробкою глянцевих елементів та відбиваючих поверхонь. Більше того, Photoshop дозволив мені налаштовувати маски вручну, замість того, щоб покладатися виключно на автоматизацію.
Ключовою визначальною особливістю є неруйнівне редагування за допомогою штучного інтелекту на основі шарів. Я міг створювати кілька варіацій, не пошкоджуючи оригінальне фото, що спростило обробку клієнтських редагувань для комерційних проектів.
Можливість використовувати обробку RAW, смарт-об'єкти та керування кольором забезпечує перевагу цього програмного забезпечення для редагування фотографій для ПК над простішими інструментами генеративного заповнення. Мені ніколи не доводилося погоджуватися з певним результатом, оскільки всі покоління залишалися доступними для редагування.
Головна причина, чому Photoshop є моїм основним інструментом, — це стабільність. Деякі альтернативи можуть регулярно створювати вражаючі фотографії, але лише Photoshop забезпечує надійну якість портретів, фотографії товарів та маркетингових матеріалів. Навіть якщо штучний інтелект допускає помилку, я можу виправити її вручну завдяки професійним інструментам ретушування.
Я вперше спробував Pixelcut , коли шукав швидкий спосіб використовувати генеративне заповнення за допомогою штучного інтелекту онлайн під час роботи з фотографіями товарів електронної комерції. Інтерфейс користувача набагато інтуїтивніший порівняно з більш просунутими рішеннями. Всього за кілька хвилин я міг створювати професійні зображення товарів, не маючи справу зі складними меню ретушування.
Для свого тесту я імпортував фотографії ювелірних виробів, косметики та окремих модних аксесуарів з попередніх проектів FixThePhoto . Pixelcut показав вражаючі результати, коли справа доходила до швидкого очищення сцени та миттєвого створення фону для оголошень на торговельному майданчику.
Штучний інтелект ефективно створював поліровані, мінімалістичні поверхні та м’які тіні, що відповідали студійному освітленню. Проте, деякі дуже деталізовані текстури ризикували стати занадто гладкими під час експорту з високою роздільною здатністю.
Найкраща частина Pixelcut – це швидкість автоматизації. Замість того, щоб вибирати кожен край об'єкта вручну, я міг майже миттєво створювати професійно-якісні маркетингові візуальні матеріали. Робочий процес на основі шаблонів також дозволив мені готувати різні версії наших фотографій для соціальних мереж, окрім звичайних зображень продуктів.
Pixelcut не підходить для складного ретушування або масштабних комерційних print кампаній, але він є справжнім порятунком, коли справа доходить до швидкого виробництва для електронної комерції, тому я можу впевнено рекомендувати його як програмне забезпечення для редагування фотографій для початківців із функцією генеративного заповнення на основі штучного інтелекту.
Я вирішив спробувати Canva після того, як багато клієнтів почали просити швидкі рекламні матеріали разом із відредагованими фотографіями. Спочатку я не знав, чи можна використовувати дизайнерську платформу як безкоштовний інструмент для генеративного заповнення.
На щастя, його функціональність штучного інтелекту виявилася набагато практичнішою, ніж я очікував. Я використовував її в основному для розширення фонів, позбавлення від відволікаючих факторів та оптимізації портретів для макетів, зручних для банерів.
Мій тест був зосереджений на швидкості та доступності, а не на ідеальній ретуші до пікселів. Я імпортував портрети з фотосесій на природі та спробував розширити композиції для заголовків вебсайтів та реклами Instagram .
Штучний інтелект Canva чудово справлявся з розширенням неба та заміною фону, за умови передбачуваного освітлення оригінальних фотографій. Результати були достатньо високої якості, щоб їх можна було використовувати в цифровому маркетингу без необхідності використання складних навичок ретушування.
Що мені сподобалося в Canva , так це поєднання функціональності штучного інтелекту та інтегрованих інструментів дизайну. Це дозволило мені створювати нові фонові області та миттєво додавати текст, брендовані елементи та графіку для моїх зображень. Це допомогло мені оптимізувати мій процес створення контенту під час роботи над кампаніями в соціальних мережах.
Недоліки цього рішення для генеративного заповнення на основі штучного інтелекту стали очевидними, коли я придивився до текстури шкіри та деталей тканини. Canva цінує зручність використання більше, ніж точність ретуші. Тим не менш, я вважаю, що Canva — це фантастичний варіант для користувачів, які зацікавлені в швидкому отриманні візуальних ефектів, не витрачаючи години на вивчення та використання професійного програмного забезпечення.
Я багато очікував від Adobe Firefly оскільки вже знаю, наскільки надійним зазвичай є програмне забезпечення Adobe. Я хотів перевірити, чи зможе функція генеративного заповнення фотографій за допомогою штучного інтелекту у Firefly створювати реалістичні середовища для існуючих портретів з портфоліо FixThePhoto .
Я одразу оцінив, наскільки креативними були ці покоління порівняно зі звичайними інструментами редагування. Firefly чудово справляється зі створенням кінематографічних пейзажів, атмосферного освітлення та цілісних текстур, дотримуючись підказок користувача. Я використовував його для модних портретів, фотографій подорожей та концептуальних рекламних зображень, щоб перевірити його узгодженість. У багатьох сценаріях результати генеративного заповнення плавно поєднувалися з оригінальним фото.
Мені також сподобався робочий процес, керований підказками. Замість того, щоб покладатися на вибір та маски, я міг керувати ШІ за допомогою описових інструкцій. Процес нагадував роботу з асистентом художника, а не класичне ретушування. Ефективність Firefly мотивувала мене експериментувати з різноманітними візуальними стилями, не перетворюючи цілі сцени з нуля.
Хоча цей інструмент набагато креативніший порівняно з більшістю альтернатив генеративного заповнення на основі штучного інтелекту, він все ще може не забезпечити реалістичних результатів під час роботи з детальними комерційними проектами. Руки, ювелірні вироби та вишукані візерунки одягу іноді вимагали ручного редагування після цього. Тим не менш, Firefly все ще залишається одним з моїх улюблених рішень для візуалізації концепцій та створення складних композицій.
Я почав розмірковувати, чи можу я використовувати Krita AI Diffusion як інструмент для заповнення зображень за допомогою штучного інтелекту, коли побачив згадки про нього в різних спільнотах цифрового мистецтва. Процес налаштування та конфігурації цього рішення потребує багато часу та терпіння, але як винагороду ви отримуєте величезну творчу свободу. Він призначений для людей, які люблять експериментувати з налаштуваннями створення зображень.
Я використовував генеративне заповнення для реконструкції портретів, композиції у фентезійному стилі та регенерацію текстур для пошкоджених ділянок фотографії. Я присвятив багато зусиль налаштуванню підказок, інтенсивності шумозаглушення та параметрам генерації, щоб з'ясувати, як мої зміни вплинуть на систему дифузії.
На відміну від простіших програм штучного інтелекту, Krita пропагує ітеративне експериментування, а не покладається на результати одного кліку. Вивчення цієї платформи насправді стало для мене досить цікавим завданням.
Мій улюблений аспект цього безкоштовного інструменту для генеративного заповнення на основі штучного інтелекту – це гнучкість локальної генерації за допомогою штучного інтелекту. Він дозволяє мені набагато більше персоналізувати результати, ніж середнє хмарне рішення, особливо під час створення стилізованих ілюстрацій або роботи з просунутим композиційним процесом.
Найбільшим недоліком є крива навчання. Недосвідчені користувачі, ймовірно, будуть приголомшені вимогами до налаштування та налаштування параметрів. Однак, якщо ви досвідчений творчий фахівець, який хоче контролювати кожен крок процесу генерації, Krita AI Diffusion має бути саме тим, що вам потрібно. Він особливо добре підходить для концептуальних зображень та експериментальних візуальних ефектів.
Photoroom – чудова онлайн-платформа для генеративного заповнення, якщо ви цінуєте швидкість більше, ніж досконалість. Вона допомогла мені пережити тиждень, пов'язаний з нескінченними партіями фотографій з каталогу, які потрібно було швидко доставити.
Моєю метою було перевірити, наскільки надійним був штучний інтелект в ізоляції товарів та створенні чистіших комерційних фонів. Мені знадобилося лише кілька хвилин, щоб зрозуміти, чому Photoroom такий улюблений продавцями електронної комерції.
Якість видалення фону підкріплена вражаючою функцією генеративного заповнення, яка чудово справляється навіть із відбиваючими поверхнями та складними краями об'єктів. Я використовував Photoroom на зображеннях взуття, сумок та косметичної упаковки в різних умовах освітлення, щоб перевірити, чи можу я отримати стабільні результати.
Фони, згенеровані штучним інтелектом, виглядали достатньо вишуканими для цифрових торгових майданчиків, не змушуючи мене робити будь-які ручні корективи. Мені особливо сподобалася швидкість, з якою я міг створювати кілька варіантів для рекламних форматів.
Мені також дуже сподобалося, наскільки зручний цей інструмент для видалення фону на основі штучного інтелекту для мобільних пристроїв. Він дозволив мені переглядати редагування та створювати нові варіанти прямо з планшета, одночасно спілкуючись з клієнтами дистанційно.
Я підійшов до Claude інакше, ніж до більшості інших інструментів для заповнення фотографій на основі штучного інтелекту, оскільки хотів перевірити, чи зможе він допомогти мені створювати детальні підказки для редагування та креативні ідеї для сцен. Працюючи над масштабною кампанією FixThePhoto, у мене часто виникали проблеми з правильним описом складних замін фону для інструменту штучного інтелекту для обробки зображень.
Claude – чудовий помічник у цьому завданні. Він не може безпосередньо редагувати фотографії, але чудово допоміг мені структурувати візуальні концепції. Я надав описи портретних зйомок, фотографії продуктів та пейзажів навколишнього середовища, щоб перевірити, наскільки точно він генеруватиме швидкі ідеї.
Результати були детальними та зазвичай містили рекомендації щодо освітлення, стилістичні посилання та покращення композиції, які я не придумав сам. Таким чином, я міг отримувати результати вищої якості в інших інструментах штучного інтелекту для генеративного заповнення зображень.
Мені сподобалася глибина розмови. Мені вдалося природним чином повторити свої ідеї, замість того, щоб бути змушеним багаторазово писати окремі команди-підказки. Claude чудово впорався з моїми цілями щодо фотографії електронної комерції, бажаною естетикою брендингу моди та кінематографічними кольоровими настроями.
Після тестування різноманітних платних та безкоштовних онлайн-інструментів для генеративного заповнення, я почав тестувати ChatGPT , щоб перевірити, чи допоможе він мені впорядкувати ідеї ретуші. Працюючи над кампанією FixThePhoto , я використовував ChatGPT для створення концепцій заміни фону, колірних схем та композицій оголошень.
Я описав складні завдання редагування, пов'язані з пошкодженими портретами, фотографіями моди з відсутніми частинами та зображеннями продуктів з відволікаючим оточенням. Цей інструмент штучного інтелекту для створення контенту вразив мене своїми практичними порадами щодо редагування та добре написаними структурами підказок штучного інтелекту для різних програмних платформ.
Крім того, це допомогло мені підготувати описи кінематографічного освітлення та розширення природних сцен. Мені вдалося отримати значно кращі результати, надаючи деталі, що стосуються фотографії.
Мені дуже сподобалася гнучкість системи взаємодії. ChatGPT дозволив мені уточнювати інструкції за допомогою природної мови, пояснювати візуальні проблеми та легко отримувати альтернативні ідеї. Замість того, щоб змушувати мене дотримуватися одного творчого напрямку, я міг дослідити різні візуальні підходи за лічені хвилини. Такі мозкові штурми були особливо корисними під час роботи з клієнтами.
Я вирішив спробувати цей генеративний редактор зображень зі штучним інтелектом, щоб отримати більш експериментальні, художні та стилізовані фони, створені за допомогою штучного інтелекту. Я імпортував портретні зображення з минулих фотосесій FixThePhoto та створив навколо них сюрреалістичні розширення оточення. Більшість результатів виглядали радше кінематографічними, ніж реалістичними.
Мені сподобався цей редактор зображень зі штучним інтелектом та генеративною заливкою, оскільки кожна спроба видавала дивовижні художні варіації. Я спробував створювати фентезійні пейзажі, міські пейзажі в стилі кіберпанку, казкове небо та мальовничі текстури для існуючих зображень. Деякі результати виглядали погано для проектів електронної комерції, тоді як інші були достатньо вражаючими для кампаній.
Мені також сподобався широкий спектр стилів художньої генерації, тому NightCafe Creator – чудовий інструмент штучного інтелекту для дизайнерів та художників. Він не прагне фотореалізму, а радше сприяє творчій інтерпретації та експериментам.
Коли ми з Колеги FixThePhoto намагалися знайти найкращі інструменти для генеративного заповнення за допомогою штучного інтелекту, ми надали пріоритет роботі з реальними проектами редагування, а не базовим тестам. Ми хотіли перевірити, як кожен параметр працює в реальних робочих процесах, зокрема для видалення об'єктів, розширення сцени та реалістичного відновлення відсутніх областей фотографії.
До складу команди тестування входили Вадим Антипенко, Енн Янг та Тата Россі. Вадим надавав пріоритет оцінці технічної точності освітлення, тіней та узгодженості перспективи. Енн досліджувала швидкість робочого процесу та зручність використання, тоді як Тата зосередився на реалізмі та тому, як згенеровані області поєднуються у зображення.
Ми відібрали різноманітні складні тестові фотографії, які могли б відображати справжню професійну роботу. Ми імпортували портрети переповнених вулиць з пішоходами, що йдуть позаду моделі, щоб перевірити видалення об'єктів, фотографії моди з відволікаючими елементами на задньому плані для очищення, а також пейзажі, такі як пляжі, міські пейзажі та гірські хребти, яким можна було б покращити природне небо або розширення країв.
Крім того, ми використовували ці фоторедактори з генеративним заповненням на фотографіях кафе зі змішаним освітленням у приміщенні, щоб оцінити, наскільки добре вони можуть обробляти тепле штучне світло порівняно з денним, а також на фотографіях продуктів з відсутніми краями або відблисками, які потребували реалістичного малювання.
Кожну платформу було протестовано з однаковими підказками, такими як «видалити людей з фону», «природно розширити небо» або «відновити відсутній фон із реалістичним освітленням», щоб забезпечити справедливе порівняння.
Генеративні інструменти штучного інтелекту від Adobe забезпечили найреалістичніші результати для складних випадків, зберігаючи тіні та напрямок освітлення з більшою точністю.
Pixelcut та Photoroom пропонують значно вищу швидкість і ідеально підходять для швидкого комерційного редагування, хоча іноді вони спрощують текстури на детальних міських фонах. Canva добре справлялася з основним видаленням об'єктів, але цей інструмент заміни ШІ мав проблеми з обробкою відображень та елементів, що перекриваються.
Якщо вам потрібен онлайн-редактор фотографій із функцією генеративного заповнення, який може впоратися з більш творчими завданнями, NightCafe Creator забезпечив візуально захопливі художні результати, тоді як Krita AI Diffusion забезпечив глибоке налаштування, але вимагав набагато більше налаштувань та ручної роботи.
ChatGPT та Claude в основному використовуються для створення та уточнення підказок, що може допомогти вам отримати кращі результати в такому програмному забезпеченні, як Photoshop та Firefly.
Наші тести показали, що ринок не пропонує жодного ідеального інструменту для генерації на основі штучного інтелекту. Користувачі, які цінують швидкість, виграють від інших рішень, ніж ті, хто надає пріоритет якості або глибокому налаштуванню. Загалом, ми рекомендуємо поєднувати помічників на основі штучного інтелекту для швидкої генерації з більш потужними платформами редагування для створення кінцевого зображення.