Разбираю по шагам, как обучить нейросеть своему лицу, снять промпт с чужой красивой фотографии и довести результат в Lightroom до состояния, когда в комментариях спрашивают, что за фотограф снимал.
Хороший кадр для меня начинается там, где в фотографии есть движение и история, которую зритель достраивает сам. В нём видно состояние человека, и по свету понятно время суток и настроение, которое стояло на площадке. Такие снимки держат внимание дольше двух секунд, потому что в них есть что разглядывать: случайный жест, направление взгляда мимо камеры, ткань, которая ведёт себя как живая. Обычная персональная съёмка тоже так умеет, когда фотограф приходит с замыслом. Список поз, сохранённый в Pinterest накануне, такого не даёт.
Все кадры ниже сделала нейросеть по моим фотографиям, и на съёмку я при этом не ходила.
Моделью я впервые снялась осознанно в 2007 году, и с тех пор фотография осталась рядом с работой. 19 лет я проработала в IT: рисовала интерфейсы, потом руководила командой дизайнеров, обучила больше 800 человек, и многие из них ушли работать дизайнерами в продукты. В 2023 году у меня было 17 съёмок, где я стояла перед камерой. В 2024 я почти весь год провела рядом с фото и видео: прошла курс у фотографа, который берёт от 500 000 ₽ за съёмку, и отдельно курс по киношному свету у блогера, который этим светом занимается профессионально.
Поэтому, когда я генерирую кадр, я примерно представляю, какой свет и какая крупность нужны, чтобы человек на фотографии выглядел живым. Насмотренность нейросеть не заменяет. Чем точнее вы представляете, что хотите увидеть, тем меньше попыток уходит в мусор.
Есть фотографии, которые ИИ не повторит, и это стоит признать сразу. Репортаж держится на моменте, который никто не планировал и который фотограф успел поймать. За хорошим портретом обычно стоит час разговора и доверие между двумя людьми. А в семейных кадрах ценность в том, что событие правда случилось и человек его прожил.
Нейросеть умеет собрать правдоподобный кадр, но события за ним не стояло. Для контента, витрины услуг, обложек и аватарок этого хватает с запасом, для семейного архива и репортажа не хватает совсем.
Телеграм-бот, в котором собраны десятки нейросетей, включая ту, что учится вашему лицу.
Открыть бота →Оттуда берутся референсы, по которым вы будете собирать промпт.
На телефоне, бесплатной версии хватает: там 4 ползунка решают судьбу кадра.
Необязательно, но именно она отделяет красивый кадр от странного.
Весь процесс укладывается в 5 шагов: поставить бота, обучить его своему лицу, собрать промпт, сгенерировать серию и обработать лучшее.
Открываете бота Syntx AI и выбираете язык.
Дальше главное меню, в нём живут все инструменты бота.
В профиле видно баланс токенов и текущий тариф.
Бот работает по подписке, и обучение своей модели на бесплатном тарифе не поместится: там дают несколько запросов, чтобы просто посмотреть, как всё устроено.
Сначала нужно создать цифровой образ на своих фотографиях, чтобы нейросеть рисовала именно вас. Эта штука называется LoRA: маленькая модель-надстройка, которая знает одно лицо.
Есть способ проще и дешевле: дать нейросети одно своё фото и попросить поставить вас в другую сцену. Он работает, но устроен иначе. Модель забирает с фотографии конкретное лицо вместе с его ракурсом, светом и выражением, и переносит этот кусок в новый кадр. Пока новая сцена близка к исходной по свету и крупности, сходство держится хорошо.
Ломается оно на дистанции. Стоит уйти в другой свет, развернуть голову или отойти на общий план во весь рост, и в кадре появляется другая женщина, отдалённо на вас похожая. Нейросети просто неоткуда взять ваше лицо с той стороны, с которой она его не видела.
LoRA учится по 30–35 снимкам, где вы сняты по-разному, и поэтому знает лицо целиком. Она рисует вас там, где вас никогда не снимали: в профиль, в движении, в контровом закате, на дальнем плане. И она держит серию: 20 кадров подряд выглядят как одна съёмка одного человека. У подстановки по одному фото серия разъезжается, лицо гуляет от кадра к кадру.
Платите вы за это временем и подпиской. Обучение занимает около 10 минут и делается один раз, дальше генерируете сколько угодно.
В главном меню выбираете «Дизайн с ИИ», дальше «Обучить FLUX».
На этом шаге всё решает набор фотографий.
Дальше нажимаете кнопку внизу экрана и ждёте около 10 минут. Бот пришлёт сообщение, что модель готова.
Если сходство не понравилось, обучение можно повторить на другом наборе фотографий. По моим наблюдениям, результат стал заметно точнее за последний год, промахов меньше.
Промпт — это текстовое описание кадра для нейросети. Чем точнее описание, тем ближе результат к тому, что вы задумали.
Без промпта тоже что-то получится. Можно написать «портрет» и посмотреть, что выдаст бот, — на первое время нормальный способ познакомиться.
Разница между случайным кадром и задуманным появляется, когда вы описываете сцену. Проще всего не сочинять описание с нуля, а снять его с готовой фотографии.
Допустим, я хочу пляж в эстетике 90-х. Иду в Pinterest и ищу кадр с нужным настроением.
Возвращаюсь в бота и пишу /gpt.
Первый раз система работает мимо, её нужно настроить: заходите в «Управление», открываете вкладку GPTs, в поиске набираете Flux Prompt Wizard и добавляете его.
Дальше загружаете в диалог свой референс и пишете: create a prompt for this photo.
Бот разбирает фотографию и присылает несколько вариантов описания: свет, поза, фон, настроение, всё словами.
Копируете любой из них.
Пара вещей, которые я поняла на своих попытках.
Один референс на один промпт. Если скормить нейросети сразу несколько, она усреднит их в постороннего человека.
Из описания стоит выкинуть слова, по которым модель уходит в фотосток: professional headshot, looking at camera, studio lighting, centered composition. С ними выходит каталог одежды.
В хвост промпта я дописываю строчку про кожу: clear healthy skin, no blemishes, no redness, no beauty retouch, no skin smoothing, no plastic AI look. Без первой половины нейросеть дорисовывает несовершенства и лицо выходит уставшим, без второй заливает кожу пластиком.
В главном меню выбираете «Дизайн с ИИ», дальше Flux.
Заходите в настройки и проверяете формат кадра. Там же подключается ваша модель: в списке LoRA выбираете ту, что обучили.
Модели стоят разное количество токенов, и разница между ними видна невооружённым глазом: младшая рисует быстро и грубо, старшая дольше держит детали и свет.
Отправляете промпт в диалог и ждёте.
Первый результат редко бывает тем самым. У меня на серию уходит несколько прогонов: беру все варианты промпта, гоняю каждый по нескольку раз, меняю по одному слову и смотрю, что поменялось.
Есть старый одесский анекдот, который описывает этот шаг лучше любой инструкции. Умирающий старик, славившийся на всю округу своим чаем, собрал родню у кровати, чтобы наконец раскрыть рецепт. Все склонились к нему, и он прошептал: не жалейте заварки.
С генерацией так же: не жалейте попыток.
Я считаю обработку важнее промпта. Она убирает ту самую пластмассовость, по которой ИИ-фото узнают с первого взгляда.
У обработки есть предел. Если кадр изначально стеклянный, его не спасёт ни один ползунок.
Пластмассовость обычно делают 2 вещи: слишком сильный контраст и постановочный сюжет, который сам по себе неживой. Ну и руки: нейросеть до сих пор периодически выдаёт 6 пальцев.
Фэнтезийные сюжеты к натуральной фотографии тоже не приблизить, они остаются иллюстрацией.
Берём 2 кадра и обрабатываем.
В боте нажимаете «прямая ссылка» и скачиваете версию в полном качестве, дальше открываете её в Lightroom.
Что я делаю почти всегда: занижаю экспозицию, добавляю зерно и увожу цвет в тепло. Экспозиция забирает у кадра неестественную яркость, зерно возвращает ощущение плёнки, тепло делает свет похожим на настоящий.
Вот что получилось после обработки.
Нейрофотосессия — это один инструмент из десятка, которые лежат в том же боте. Рядом живут кадры для сайта, товарные фото, оживление снимков и озвучка голосом.
На курсе «Код бесконечности» мы собираем всё это в одного помощника, который работает на вас: снимает вам фотосессию, пишет посты и сторис, отвечает клиентам и продаёт ваши услуги. Курс для человека, который нейросети раньше не открывал.
Посмотреть курс