Большой разбор
Как подготовить фотографии для обучения персонажа
Для обучения персонажа важны не только количество и резкость снимков. Набор должен показывать узнаваемую внешность в разных условиях, не подменяя её одним костюмом, фоном или фильтром. Разберём отбор, дубли, кадрирование, подписи и отдельные фотографии для проверки результата.
Быстрый вход
В двух минутах
Для обучения персонажа важны не только количество и резкость снимков. Набор должен показывать узнаваемую внешность в разных условиях, не подменяя её одним костюмом, фоном или фильтром. Разберём отбор, дубли, кадрирование, подписи и отдельные фотографии для проверки результата.
- Двадцать селфи могут показывать один и тот же пример
- Сначала определить, что именно должно сохраняться
- Что получает модель из примеров
Двадцать селфи могут показывать один и тот же пример
Человек сделал много снимков за одну минуту: та же комната, тот же свет, почти тот же поворот головы. Файлов достаточно, но нового о внешности в них немного. При обучении такой набор может слишком тесно связать персонажа с привычным ракурсом и окружением.
Для подготовки полезнее другой вопрос: что показывают фотографии, чего ещё не было в наборе? Профиль, улыбку, форму волос, лицо при мягком боковом свете, пропорции в среднем плане. Не каждый новый файл добавляет новый полезный пример.
При этом разнообразие не означает сбор любых красивых портретов. На всех снимках должен быть тот персонаж, которого вы хотите воспроизводить. Сильная ретушь, чужое лицо после замены или рисунок вместо фотографии меняют сам предмет обучения.

Сначала определить, что именно должно сохраняться
Есть разница между обучением внешности человека, конкретного костюма и законченного образа. Если нужен узнаваемый человек в новой одежде, набор из одного фотосета в одинаковом пальто может мешать отделить личность от вещи.
Если же задача — определённый персонаж в постоянном костюме, одежда становится частью замысла. Тогда важно, чтобы её детали были согласованы: одинаковый воротник, застёжки, украшения. Универсально правильного набора вне задачи нет.
Полезно заранее записать будущие условия: крупные портреты или полный рост, реализм или стилизация, спокойные сцены или активные позы. Это не обещание, что обучение покроет любую комбинацию. Это ориентир для отбора и последующей проверки.
Также стоит решить, нужно ли обучение вообще. Иногда для короткой серии достаточно работы с изображениями-референсами. Разные способы удержания внешности и их ограничения разобраны в статье об одном персонаже в разных кадрах. Подготовка хороших исходников полезна в обоих случаях, но процессы не одинаковы.
Что получает модель из примеров
DreamBooth показывает подход к персонализации генеративной модели по нескольким изображениям объекта или персонажа. Задача — связать обозначение с узнаваемыми особенностями и использовать их в новых сценах. Это не точное трёхмерное сканирование и не гарантия неизменного лица в любом ракурсе.
Конкретное обучение может обновлять разные части модели или использовать адаптеры. Здесь мы готовим исходный набор, а не выбираем универсальные настройки запуска. Формат файлов, разрешение, подписи и способ кадрирования нужно согласовать с выбранным инструментом.
В документации Diffusers по DreamBooth отдельно отмечена чувствительность к настройкам и риск переобучения. Поэтому нельзя исправить любой набор одним «правильным» числом шагов. Данные, режим обучения и способ проверки рассматриваются вместе.
Использовать разрешённые исходники
Если персонаж основан на реальном человеке, полезно заранее согласовать цель: личные эксперименты, рабочая серия, публикация изображений или распространение обученного файла. Это разные способы использования, и не стоит подменять один другим без обсуждения.
Открытый профиль не означает автоматического согласия на обучение по фотографиям. Кроме отношения изображённого человека, имеют значение права на сами снимки и правила сервиса, в который вы их отправляете. Здесь нет одной отметки, которая решает все вопросы для любого проекта.
Для начала проще работать со своими фотографиями или с материалом, использование которого действительно согласовано. Чувствительные кадры, случайные люди на заднем плане, документы и личные сведения лучше не включать без необходимости.
Оригиналы стоит хранить отдельно от рабочей подборки. Так не придётся восстанавливать исходное качество после неудачного кропа или пересохранения. Если набор передаётся другому человеку, ему нужны выбранные файлы, а не весь личный фотоархив.
Первый отбор: узнаваемость важнее эффектности
Начать можно с просмотра без увеличения: на каких кадрах персонаж ясно виден и похож на себя? Затем приблизить лицо и проверить резкость, сжатие, волосы и контуры. Красивая общая атмосфера не компенсирует лицо, состоящее из нескольких смазанных пятен.
Сильные фильтры и ретушь опасны тем, что делают изображения согласованными по обработке, но не по внешности. Меняются форма носа, линия челюсти, размер глаз, текстура кожи. Модель получает несколько версий человека вместо разных наблюдений одного лица.
Особенно осторожно стоит относиться к предварительному «восстановлению» лица нейросетью. Оно может добавить убедительные, но выдуманные черты. Такой кадр уже нельзя считать просто более резким оригиналом. Для набора, где важна узнаваемость, лучше найти другой исходник или переснять.
Не каждый технически несовершенный снимок нужно выбрасывать. Небольшое зерно или мягкий естественный свет не обязательно мешают. Вопрос в том, сохранилась ли полезная информация, а не в том, насколько фотография похожа на глянцевую рекламу.
Второй отбор: убрать дубли и заметить пробелы

Почти одинаковые фотографии удобно смотреть группами. Если несколько кадров отличаются только положением ресницы, обычно достаточно выбрать лучший. Это практический способ не перегружать набор повторением одной сцены, а не запрет на похожие снимки вообще.
Затем можно разложить оставшееся по признакам: ракурс, крупность, выражение, свет, одежда и фон. Необязательно строить большую таблицу. Часто уже просмотр контактного листа показывает, что все лица повёрнуты в одну сторону или половина подборки снята в солнечных очках.
Если какой-то вид нужен для будущей работы, а в наборе его нет, разумнее доснять его, чем многократно копировать имеющееся. Например, профиль не появляется от десяти кропов фронтального портрета. А отражение изображения не всегда безопасная замена: оно меняет асимметричные особенности, надписи и расположение аксессуаров.
Разнообразие тоже может стать случайным шумом. Резкая смена возраста, причёски или внешности требует осмысленного решения: что считается постоянным, а что должно меняться? Лучше явно выбрать задачу, чем надеяться, что модель сама поймёт, какие версии объединять.
Крупный план и полный рост решают разные задачи
Крупный портрет даёт больше информации о лице. Средний и общий планы показывают пропорции, позу, волосы и одежду в контексте. Соотношение зависит от того, какие изображения нужны после обучения.
Если лицо на общем плане слишком маленькое, увеличение файла не создаст недостающих деталей. Такой кадр может быть полезен для других признаков, но не заменяет разборчивого портрета.
Важно посмотреть не только оригинал, но и будущую тренировочную версию. Автоматическое квадратное кадрирование способно отрезать голову, кисти или важный аксессуар. Если инструмент поддерживает разные соотношения сторон, его правила всё равно нужно понять заранее.
Для работы с генерацией в ComfyUI полезно различать подготовку исходников, обучение и применение готовой модели. Это разные этапы; понятия и устройство workflow можно сверить в разделе ComfyUI на Timesaver. Случайно сохранённый скриншот готовой картинки не заменяет исходный файл нужного качества.
Фон и одежда: что меняется, а что остаётся
Если каждый портрет снят на фоне одной красной стены, система может переносить этот фон в новые сцены. Это не обязательно произойдёт всегда, но такой набор не помогает отделить персонажа от окружения.
Для обучения внешности полезны разные, но не хаотичные условия. Не нужно превращать съёмку в коллекцию экстремальных эффектов: закрытое лицо, цветной дым и жёсткий прожектор одновременно делают наблюдение сложнее.
Удобнее начинать с разборчивых кадров и добавлять осмысленное разнообразие. На одном хорошо виден профиль, на другом — улыбка, на третьем — волосы и плечи. Фон при этом не должен перетягивать внимание или скрывать признаки, ради которых выбран снимок.
Если постоянный костюм нужен по сюжету, это тоже фиксируется. Проверка будет другой: способен ли персонаж оставаться узнаваемым в новых позах, не меняя детали одежды? Для актёрского образа, маскота и личного аватара наборы могут заметно различаться.
Подписи описывают видимое, а не желаемое
Не все инструменты используют подписи одинаково. Где-то есть отдельный текст для каждого изображения, где-то общий запрос или другая схема. Сначала нужно понять требования выбранного обучения, а затем готовить материал под них.
Если подписи нужны, полезно описывать изменяемые признаки кадра: ракурс, выражение, одежду, окружение. Общий идентификатор персонажа должен быть согласованным. Не стоит добавлять в подпись эмоции и обстоятельства, которые невозможно уверенно увидеть.
Например, «женщина в зелёной рубашке, поворот три четверти, нейтральный фон» — наблюдаемое описание. «Успешная уверенная женщина после важной победы» — уже интерпретация. Она может быть уместна в творческом промпте, но плохо описывает фактический состав фотографии.
Автоматические подписи удобны как черновик. Их стоит проверить на перепутанные цвета, аксессуары, число людей и ракурс. Ошибка, повторённая на многих файлах, становится частью обучающего материала, а не безобидной опечаткой.
Оставить отдельные материалы для проверки

Если оценивать результат только рядом с фотографиями, на которых модель училась, легко принять повторение знакомого образца за устойчивую узнаваемость. Полезно заранее отложить несколько подходящих снимков и не включать их в обучение.
При этом почти одинаковый дубль из той же короткой серии — слабая независимая проверка. Если один кадр попал в обучение, а соседний — в контроль, условия почти не изменились. Это может скрыть проблемы с другими ракурсами и светом.
Контрольные фотографии помогают сравнивать признаки лица, но не задают единственную правильную картинку для каждого промпта. Для новых сцен оценивают и узнаваемость, и выполнение задания. Похожий портрет, который игнорирует нужный ракурс, решает только часть задачи.
Также полезен небольшой постоянный набор тестовых запросов: спокойный портрет, другой ракурс, новое окружение, требуемая одежда. Он не должен состоять только из сцен, которые уже хорошо получались. Иначе после каждого изменения будет видно улучшение лишь на любимом примере.
Сохранить набор так, чтобы можно было вернуться
Рабочая папка становится понятнее, если исходники, выбранные изображения, подписи и контрольный набор лежат раздельно. Простые последовательные имена файлов удобнее случайных загрузочных названий. Важно, чтобы подпись не потеряла связь со своей фотографией.
Полезно записать, какие кадры вошли в конкретную версию набора и что изменилось перед новым обучением. Иначе будет трудно понять, почему следующий вариант стал хуже: из-за параметров или из-за незаметной замены фотографий.
Для первого испытания лучше проверяемый небольшой запуск, чем дорогое обучение без контрольных сцен. После него можно увидеть характер ошибки: тянется один фон, теряется профиль, повторяется одежда. Это повод пересмотреть данные и настройки, а не автоматически добавить ещё файлов.
В творческом проекте финальный критерий шире учебного портрета. Персонаж должен работать в серии, монтаже или выбранной подаче. Обучение нейросетям, видео и эффектам на Timesaver VFX связано с такими задачами; при подготовке набора полезно уже представлять, где будет использоваться результат.
Частые вопросы
Сколько фотографий нужно?
Единого числа нет: требования зависят от метода, модели и задачи. Полезнее проверить, какие важные условия представлены и сколько почти одинаковых дублей в наборе. Рекомендации конкретного инструмента — отправная точка, а не гарантия качества.
Можно ли обучать по одному удачному портрету?
Некоторые способы персонализации или работа с референсом допускают очень мало изображений. Но один портрет не показывает все ракурсы. Для устойчивого персонажа полезно проверить ограничения такого подхода до большой серии.
Нужно ли заранее увеличивать все снимки нейросетью?
Нет универсальной необходимости. Генеративное увеличение может дорисовать признаки. Лучше использовать качественные оригиналы и готовить размеры по правилам выбранного инструмента, не принимая выдуманные детали за исходные.
Подойдут ли фотографии в разном возрасте?
Это зависит от цели. Если нужен один определённый образ, сильные возрастные различия могут сделать задачу неоднозначной. Если возраст должен меняться, это отдельный замысел с собственной проверкой, а не случайное смешивание архива.
Можно ли использовать сгенерированные фотографии персонажа?
Да, если это допустимо для проекта и выбранного метода, но их сначала нужно проверить на единую внешность и артефакты. Несогласованные лица не становятся одним персонажем только потому, что получены одним промптом.
Хороший набор отвечает на конкретную задачу
Подготовка заканчивается не круглым числом файлов. Важно, чтобы персонаж был узнаваем, нужные условия представлены, дубли осмысленно отобраны, а проверочные примеры оставались отдельно.
Такой набор не обещает идеального результата с первого запуска. Зато с ним легче понять, чему модель действительно научилась и что стоит изменить дальше.
Подписка Neurosaver
Получать новые разборы Neurosaver
Большие материалы выходят не каждый день, зато их стоит читать спокойно. Подпишитесь, и мы пришлём новые разборы и важные обновления словаря.