AI-словарь · Адаптеры
Адаптеры
Адаптеры — небольшие надстройки, которые меняют поведение базовой модели без полного переобучения: LoRA добавляет стиль или персонажа, ControlNet задаёт позу и композицию, IP-Adapter переносит образ с готовой картинки. Раздел о том, как управлять генерацией точечно и предсказуемо.
Указатель
-
01
Tile / Tiling
Tile называют сразу несколько разных приёмов: обработку большого изображения перекрывающимися фрагментами, tiled diffusion во время sampling, tiled VAE для снижения пиковой нагрузки на память и генерацию…
-
02
Segmentation Map
Segmentation Map делит изображение на области и хранит для каждого пикселя метку класса или экземпляра объекта. В генеративном конвейере такая карта задаёт смысловую раскладку сцены, но…
-
03
Canny Edge
Canny Edge — алгоритм извлечения контуров изображения, изобретённый Джоном Канни в 1986-м. В Stable Diffusion через ControlNet Canny используется как «обводка», на которой модель строит новую…
-
04
Depth Map
Depth Map кодирует глубину сцены: какие поверхности находятся ближе, а какие дальше. Такая карта помогает генеративной модели сохранить расстановку и перспективу, даже если материалы, свет и…
-
05
OpenPose
OpenPose — препроцессор и модель ControlNet для управления позой человека в Stable Diffusion. Превращает любое фото в палочную фигуру (skeleton), где точки — суставы, линии —…
-
06
DreamBooth
DreamBooth — рецепт персонализации text-to-image модели по нескольким изображениям конкретного объекта. Во время обучения редкий идентификатор связывается с его внешностью, а prior preservation помогает не спутать…
-
07
Hypernetwork
Hypernetwork в генерации изображений — отдельный обучаемый модуль, который преобразует ключи и значения attention и добавляет к ним свою поправку. Базовую модель при таком обучении можно…
-
08
Textual Inversion TI
Textual Inversion учит новое текстовое представление концепта по примерам, сохраняя остальные веса генеративной модели замороженными. Полученный embedding загружается в совместимый текстовый энкодер и вызывается своей меткой…
-
09
IP-Adapter Image Prompt Adapter
IP-Adapter добавляет к текстовому промпту визуальное условие. Image encoder превращает референс в признаки, а отдельная ветка внимания передаёт их диффузионной модели рядом с текстовыми признаками. Базовая…
-
10
ControlNet
ControlNet — техника управления композицией в диффузионных моделях через зрительную подсказку: скелет позы (OpenPose), контур (Canny), карту глубины (Depth), набросок (Lineart). Промпт задаёт «что нарисовать», ControlNet…