ГЛАВА 11 · КРОЛИЧЬЯ НОРА

Что ещё врезают в граф: примочки и лесенка сложности

Всё, что выше, - база (можно жить только на ней). Дальше - примочки, которые превращают скелет из 6 нод в монстра на 60. Каждая решает одну конкретную задачу - разбираем по очереди, с примерами. В конце - лесенка, как они накапливаются от 6 нод до 60.

🕹 ControlNet - поза / контур / глубина принудительно

Промптом «пусть стоит вот так» не объяснишь. ControlNet берёт управляющую картинку (карта краёв, скелет позы, карта глубины) и заставляет генерацию следовать этой геометрии. Это прямой мост из 3D: рендеришь depth/lineart из Blender или другой 3D-программы - и нейросеть красит поверх, не ломая композицию.

В графе: препроцессор (делает карту из картинки) → Apply ControlNet (вмешивается в conditioning перед KSampler). Препроцессоры - из пака comfyui_controlnet_aux, сами модели кладут в models/controlnet/. Ручка strength 0.4-0.9: сколько слушать управление.

3D-болванка
1 · исходник · серый 3D-рендер
карта глубины
2 · depth · карта глубины
результат
3 · результат · покраска по depth

ControlNet depth в деле: DepthAnything снял глубину с серой болванки, и модель перекрасила её в детального воина, не сломав позу и геометрию. Это и есть мост из 3D.

🎭 IP-Adapter - «стиль или лицо вот с этой картинки»

Промпт описывает словами, а IP-Adapter даёт модели картинку-референс и говорит «сделай в этом духе» - по стилю, композиции или лицу. Часто зовут «one-image LoRA»: тренировать ничего не надо, просто подаёшь пример.

Нужны: пак ComfyUI_IPAdapter_plus, модель IP-Adapter (в models/ipadapter/) и clip_vision («глаза», в models/clip_vision/). Незаменим для консистентного стиля серии картинок и переноса лица персонажа между кадрами (подробный разбор - в кейсе про одинаковые лица).

🩹 Inpaint / Outpaint - перерисовать кусок или дорисовать за края

Inpaint - маской выделяешь область (лицо, руку, объект) и перегенеришь только её, остальное не трогая. Технически это img2img с маской: VAE Encode (for Inpainting) → KSampler по маске. Outpaint - то же, но дорисовываешь холст за границы (расширить кадр). Незаменимо для правок и фикса косяков без полной перегенерации.

🔍 Upscale - поднять разрешение с деталями

SDXL рисует ~1024². Для печати и крупного плана мало. Два пути:

до
до · 512px, один проход
после
после · второй проход, детали

🧑‍🔧 FaceDetailer / ADetailer - починить лица и руки

На общем плане лицо занимает мало пикселей и выходит «кашей», руки - с лишними пальцами. Detailer автоматически находит лицо или руку, вырезает, перегенеряет крупно и вклеивает обратно. Нода FaceDetailer из пака Impact Pack. Почти обязательная примочка для портретов и сцен с людьми.

кривые пальцы
до · каша из пальцев
лучше
после · +negative, детейлинг

🔤 Embeddings (Textual Inversion) - концепт одним словом

Крошечный файл (десятки КБ), который «упаковывает» концепт в новое слово. Частый кейс - negative-embeddings вроде badhands / easynegative: вписал embedding:badhands в negative - и типовые дефекты давятся пачкой. Кладут в models/embeddings/.

🗺 Regional prompting - разные промпты в разных зонах кадра

Хочешь «слева рыцарь в красном, справа маг в синем» - обычный промпт всё смешает. Regional / area conditioning позволяет привязать разные промпты к разным областям холста. Сложнее в сборке, живёт в продвинутых графах и паках (Impact Pack, спец-ноды). Это уже глубокая часть норы.

🧰 QoL-ноды - не про картинку, про удобство

Огромный класс нод не меняет генерацию, а делает граф удобным: rgthree-comfy (переключатели, реле, группы), Custom-Scripts (автодополнение промптов, превью), Crystools (монитор CPU/GPU/VRAM). Их наличие в чужом графе часто и раздувает список «missing nodes».

✔ Порядок врезки (запомни один раз)

LoRA сразу после checkpoint → ControlNet / IP-Adapter вмешиваются в conditioning перед KSampler → Detailer и Upscale идут после VAE Decode, по готовой картинке. Понимая «до KSampler / после KSampler», ты читаешь расположение любой примочки.

Лесенка: от 6 нод до 60

Теперь соберём всё в одну картину. Гигантский workflow «для стабильного Pixar-стиля» - это не другая технология. Это тот же скелет, на который слой за слоем навесили примочки выше. Вот лестница - и правило «не прыгай на верх»:

УРОВЕНЬ 0 · ~6 нод Базовый txt2img

Скелет из главы 2. Промпт → картинка. Даёт: первый результат, понимание. Не даёт: контроля стиля, композиции, чистых лиц.

УРОВЕНЬ 1 · ~8-10 нод + LoRA + хороший VAE + negative

Даёт: нужный стиль (Pixar/аниме/low-poly), нормальные цвета, меньше дефектов. Цена: следить за trigger words и совместимостью. Этого уровня хватает для 80% «красивых картинок».

УРОВЕНЬ 2 · ~15-20 нод + ControlNet / IP-Adapter

Даёт: контроль позы/композиции/референса - мост из 3D, консистентный стиль серии. Цена: препроцессоры, отдельные модели, подбор strength. Здесь начинается «режиссура».

УРОВЕНЬ 3 · ~25-35 нод + FaceDetailer + Upscale + inpaint

Даёт: чистые лица/руки, 4K-резкость, точечные правки без перегенерации. Цена: дольше рендер, больше связей. Это уровень «не стыдно показать/напечатать».

УРОВЕНЬ 4 · 40-60+ нод Продакшн-пайплайн

Несколько LoRA с балансом, regional prompting, 2-3 ControlNet, многопроходный upscale, авто-детейлинг лиц/рук/глаз отдельно, switches для вариантов, свои VAE/энкодеры. Даёт: повторяемость - тот самый «стабильно Pixar каждый раз». Цена: часы сборки, легко сломать. За этим и стоят монстр-графы, которые ты видел.

◆ Главный вывод

Большой граф пугает, пока ты ищешь в нём «новую магию». Магии нет. Есть скелет + N примочек, каждую из которых ты уже знаешь. Открывая монстра, ищи глазами KSampler - это центр. Всё слева от него по смыслу - «что подать» (модель, LoRA, промпты, control), всё справа - «что сделать с результатом» (decode, detailer, upscale, save). Двух-минутное чтение вместо паники.

▲ Частая ошибка новичка

Соблазн сразу собрать Уровень 4 - главная ловушка. Стабильный пайплайн собирают инкрементально: рабочий Уровень 1, потом по одной примочке, проверяя каждую. Скачать чужой граф на 60 нод и «чтоб работало» - почти гарантированно утонуть в missing nodes и чужих путях к моделям. Расти по лестнице, не прыгай на её верх.