ЧАСТЬ 2 · КЕЙСЫ

Кейсы: от черновика до финала

Хорошая картинка - это не один промпт, а несколько итераций. Вот несколько реальных прогонов по шагам - разные задачи, модели и стили. Каждый начинаем с нарочно грубых настроек, потом доводим по одному рычагу. Кликни по шагу - крупнее.

Кейс 1 · Обложка фэнтези-книги

ТЗ

Эпичная обложка фэнтези-романа: воин против дракона, портретный формат, место под заголовок сверху.

Референс

Цель - уровень книжной обложки / key art. Насмотренность бери на Pinterest, ArtStation; идём к «эпично, кинематографично, есть куда лечь заголовку».

Железо / время

Любой GPU от 8 ГБ (или Mac на Apple Silicon). Финал ~1-2 мин, черновики - секунды.

v1
v1 · SD 1.5 · 512px · 8 шагов
Голый промпт «warrior and dragon», без negative. Итог: сыро, композиции нет, мелко - но за секунды видим идею.
v2
v2 · сменили модель → SDXL · 20 шагов
+ «fantasy art, dramatic», Juggernaut. Итог: качество выше, но всё ещё пейзаж, а не обложка.
v3
v3 · композиция обложки · 832×1216 · 30 шагов
Портретный формат, «на скале, бурное небо, место под заголовок», + negative. Итог: это уже обложка.
v4
v4 · финал SDXL · +детали · 40 шагов
+ «cinematic, god rays, artstation, masterpiece». Итог: готовый кадр под заголовок.
Flux
+ смена модели · тот же бриф на Flux.1
Тот же сюжет, но модель - Flux. Итог: выше когерентность, свет и композиция с одного прохода, без доводки. Вывод: для фотореал-финала Flux сильнее SDXL; SDXL-шаги выше - быстрый и дешёвый путь к идее и композиции.

Кейс 2 · Рекламный кадр (парфюм)

ТЗ

Премиальный рекламный кадр флакона парфюма: чистый фон, студийный свет, отражения.

Референс

Цель - product photography уровня e-commerce / luxury-баннера.

Железо / время

SDXL на 8-12 ГБ, финал ~1 мин.

v1
v1 · SD 1.5 · 512px · 8 шагов
«perfume bottle». Итог: набросок, не реклама.
v2
v2 · SDXL · 20 шагов
+ «product photo, studio». Итог: чище, но фон и свет случайные.
v3
v3 · описали сцену · 1024 · 30 шагов
«на мокром чёрном камне, софтбокс, отражения, градиентный фон». Итог: уже рекламный кадр.
v4
v4 · финал · +luxury/macro · 40 шагов
+ «luxury, macro, commercial, dramatic rim light». Итог: готово под баннер.
✔ Паттерн любого кейса

Порядок правок один: идея (быстрый черновик) → модель под задачу → композиция/формат → детали и финиш → upscale. Не жди идеала с первого раза - иди итерациями, меняя по одному рычагу.

Кейс 3 · Рекламный кадр (кроссовки)

Разберём один прогон целиком: от нарочно грубого черновика до чистого рекламного кадра премиальных кроссовок. Правило то же, что и в любом кейсе - не ждать идеала с первого раза, а идти итерациями, меняя по одному рычагу. Кликни по шагу - крупнее.

ТЗ

Премиальный product-shot кроссовка: продукт-герой на пьедестале, студийный свет, глянцевые отражения, чистый тёмный фон - кадр под баннер или карточку luxury-товара.

Референс

Цель - product photography уровня e-commerce / luxury-рекламы. Насмотренность бери на Pinterest по запросам «product shot», «sneaker advertising»: продукт на подиуме, мокрый камень, softbox, драматичный rim light, отражения.

Железо / время

SDXL комфортно на 8-12 ГБ VRAM, ~30-60 сек на кадр. Черновик на SD 1.5 - секунды. Финал с upscale - ~1-2 мин.

v1
v1 · SD 1.5 · 512px · 8 шагов · cfg 7
Голый промпт «sneaker», без negative. Итог: мелко, мыльно, пластик, продукт даже не в центре - но за секунды видно идею. Рычаг дальше: модель слабовата для фотореализма - берём SDXL.
v2
v2 · сменили модель → SDXL Juggernaut · 768px · 20 шагов · cfg 7
+ «product photo, studio». Итог: резче и чище, уже похоже на съёмку, но фон и свет случайные, композиция плоская - рекламы ещё нет. Рычаг дальше: описываем сцену и свет словами + добавляем negative, поднимаем разрешение до родного.
v3
v3 · описали сцену · 1024px · 30 шагов · cfg 6.5 + negative
«на мокром чёрном камне-пьедестале, softbox, dramatic rim light, отражения, чистый тёмный градиент, macro, commercial photography». Итог: это уже рекламный кадр - свет, пьедестал, отражения на месте. Рычаг дальше: не хватает резкости и микродеталей - добавляем шаги и второй проход upscale.
финал
v4 · финал SDXL · 40 шагов + hires ×1.5 (LatentUpscale → KSampler denoise 0.45)
Тот же промпт, второй проход дорисовывает фактуру. Итог: резкий детальный кадр - глянец кожи, капли и золотые брызги, чистые отражения. Готово под баннер.
Flux
+ смена модели · тот же кадр на Flux.1
Тот же бриф, модель Flux. Итог: материал, отражения и свет реалистичнее с одного прохода, без hires. Вывод: где нужен максимум фотореала - берут Flux; SDXL быстрее для черновиков и итераций.

Задачу решил не один рычаг, а связка: правильная модель (SDXL вместо SD 1.5 дал фотореализм) + описанная сцена в промпте (пьедестал, свет, отражения превратили «фото объекта» в рекламу) + родное разрешение (1024 убрало мыло) + hires-проход (добавил резкость и микродетали финалу).

✔ Паттерн любого кейса

Порядок правок один: идея (быстрый черновик) → модель под задачу → композиция и свет в промпте → родное разрешение → детали и upscale. Меняй по одному рычагу и смотри, что именно он дал - так понятно, за счёт чего вырос результат.

Кейс 4 · Аниме-постер персонажа

Главный урок этого кейса - модель под задачу. Фотореалистичная база физически не умеет рисовать аниме: она мажет в «полуреализм 2.5D», сколько ни правь промпт. Лечится не настройками, а сменой базы на аниме-модель (семейство Illustrious) и переходом на её родной язык - booru-теги. Ниже - путь от нарочно неправильной модели до готового постера. Кликни по шагу - крупнее.

ТЗ

Постер аниме-персонажа: девушка с серебристыми волосами в красном кимоно, сакура, портретный формат под печать/обложку.

Референс

Цель - чистое аниме уровня key visual: ровная заливка, аккуратная линия, выразительные глаза, «постерная» подача. Насмотренность - Pixiv, Danbooru, официальные аниме-постеры.

Железо / время

Аниме-SDXL (Illustrious) на 8-12 ГБ VRAM, портрет 832×1216. Финал ~30-60 сек, черновики - секунды.

v1
v1 · НЕ ТА модель · Juggernaut XL (фото) · 832×1216 · 28 шагов · cfg 6
Промпт «anime girl, silver hair, kimono, cherry blossom» на фотореалистичной SDXL. Итог: вышло фото косплеера - настоящая кожа, объёмный свет, никакого аниме. Рычаг: база не та; тегами это не чинится.
v2
v2 · сменили базу → WAI Illustrious · 28 шагов · cfg 6 · euler_a
Та же сцена, но модель аниме, а промпт всё ещё предложением («an anime girl with long silver hair wearing a red kimono...»). Итог: это уже аниме, но подача плоская и «случайная». Рычаг: правильная база - главный скачок качества.
v3
v3 · booru-теги через запятую · 832×1216 · 30 шагов · cfg 6
«1girl, solo, silver hair, long hair, red kimono, cherry blossom, detailed eyes, masterpiece, best quality». Итог: чистое аниме, аккуратная линия, глаза «читаются». Рычаг: Illustrious слушает теги, а не фразы - на её родном языке она собраннее.
финал
финал · +quality/свет/фон-постер · 30 шагов · cfg 6
+ «masterpiece, best quality, very aesthetic, hair ornament, upper body, falling cherry blossom petals, soft cinematic lighting, depth of field, poster background, bokeh». Итог: готовый постер - профиль, украшение в волосах, боке, ветка сакуры. Рычаг: quality-теги + свет + кадрирование доводят до печатного вида.
✔ Вывод кейса

Два рычага, в правильном порядке: сначала модель под задачу (фото-база → аниме-база Illustrious - это даёт основной скачок), потом язык модели (booru-теги через запятую вместо предложений, плюс quality-теги masterpiece, best quality). Только после этого - свет, кадр и фон. Пытаться «допромптить» аниме на фотомодели - тупик: композиция и настройки бессильны, если база не умеет нужного стиля. Не забудь про negative для аниме-баз: nsfw, nude сверху к обычному списку.

Кейс 5 · Чёрно-белая иллюстрация

Задача - получить чистую line-art страницу под раскраску: только чёрный контур на белом, без цвета и без полутонов. Главный урок кейса: стиль задаёт не один промпт, а связка стилевая LoRA + грамотный negative. LoRA учит модель «языку туши», а negative вычищает то, что модель тащит по привычке - цвет и тени. Идём по шагам, меняя по одному рычагу. Кликни по шагу - крупнее.

ТЗ

Сова анфас, чистая line-art / страница раскраски: чёткий чёрный контур, белый фон, без заливок цветом и без серых полутонов. Пригодно под печать и раскрашивание.

Референс

Цель - уровень coloring book page: ровная толстая обводка, читаемые зоны под заливку. Насмотренность бери по запросам «coloring page», «ink line art», «clean lineart».

Железо / время

SDXL (Juggernaut-XL) на 8-12 ГБ или Mac на Apple Silicon. Один кадр ~30-60 сек, первый прогон с новой LoRA - дольше (грузится в память).

v1
v1 · Juggernaut-XL · без LoRA · 32 шага
Промпт «black and white line art of an owl», negative по умолчанию (blurry, low quality, watermark, deformed). Итог: цвета нет, но модель сыплет полутонами - плотная штриховка перьев, глаза залиты чёрным. Это ещё не чистый контур под раскраску.
v2
v2 · + InkArtXL LoRA · strength 0.8
В negative добавили «color, colored, shading». Рычаг: стилевая LoRA задаёт язык туши. Итог: язык линии включился, но LoRA пересветила чёрным - гравюрные заливки, темно и грязновато.
v3
v3 · InkArtXL 1.0 + crosshatch 0.45
Подняли strength и добавили вторую LoRA, промпт «clean ink line art, coloring book page, white background». Итог: линия чище и легче - но negative слабоват, и цвет пролез обратно в глаза (янтарь). Наглядно: без сильного negative стиль не держится.
final
финал · InkArtXL 0.85 · cfg 7.5
Рычаг: усилили negative - явно гасим «yellow / orange / amber eyes», а в промпт добавили «monochrome». Итог: чистый чёрный контур на белом, глаза без цвета, ровная обводка - готовая страница раскраски под печать.
✔ LoRA + negative = стиль

Стиль в диффузии - это две силы вместе: LoRA говорит, что рисовать (язык туши, чистая линия), а negative говорит, чего быть не должно (цвет, тени, полутона). Одна LoRA без negative тащит цвет обратно (см. v3), голый negative без LoRA не даёт стиля (см. v1). Порядок правок: сначала подбери стилевую LoRA и её strength, потом дожимай чистоту через negative и cfg - по одному рычагу за прогон.

Кейс 6 · YouTube-превью с текстом

Задача, на которой спотыкаются почти все: нужен яркий thumbnail 16:9 с крупным ЧИТАЕМЫМ словом в кадре. Здесь решает не настройка, а выбор модели - и это главный урок кейса. Кликни по шагу - крупнее.

ТЗ

Превью для ролика: крупное эмоциональное лицо, высокий контраст, жёлто-чёрная гамма и большое читаемое слово «COMFYUI» в кадре. Формат 16:9.

Референс

Насмотренность - Pinterest / YouTube по «youtube thumbnail»: крупный объект, контраст, короткий крупный текст. Ключевое требование - текст должен читаться.

Железо / время

SDXL ~30-60 сек на 8-12 ГБ. Flux тяжелее (12-24 ГБ или fp8/gguf на меньшем), ~1-2 мин на кадр.

SDXL
v1 · SDXL Juggernaut · 1216×704
Тот же запрос с текстом «COMFYUI». Итог: картинка и эмоция отличные, но текст - каша: «TOP», «COMFI!», случайные буквы врассыпную. SDXL и SD1.5 не умеют надёжно рисовать буквы. Рычаг дальше: это не чинится настройками - нужна модель, которая умеет текст.
Flux
финал · Flux.1 dev · 1344×768 · cfg 1 · euler / simple
Тот же промпт, но модель - Flux (её конёк - текст в кадре). Итог: крупное читаемое «COMFYU» жёлтым по чёрному, эмоция на месте. Задача решена сменой семейства модели.

Рычаг здесь один и жёсткий: модель под задачу. Текст в кадре надёжно рисуют Flux и Qwen-Image; SDXL/SD1.5 - почти никогда. Альтернатива, если нужен именно SDXL-стиль: сгенерировать фон без текста и наложить надпись потом в редакторе (Photoshop/Figma) - так чаще всего и делают в продакшене.

✔ Когда рычаг - это модель, а не ручки

Если задача упирается в фундаментальное умение (чистый текст, определённый стиль, аниме), никакие steps/cfg/seed не помогут - меняй модель. Сначала спроси «а эта база вообще умеет то, что я прошу?», потом крути настройки.

Кейс 7 · 3D-болванка в рендер (ControlNet depth)

Мост из 3D в ComfyUI: берём грубую серую болванку из 3D-редактора, снимаем с неё карту глубины и «красим» нейросетью, НЕ ломая позу и геометрию. Ключевой приём, когда важно точно управлять композицией. Кликни по шагу - крупнее.

ТЗ

Есть 3D-модель рыцаря (серый untextured рендер, «глина»). Нужно превратить её в детального фэнтези-воина, сохранив ровно ту же позу, пропорции и ракурс.

Референс

Цель - concept-art уровня artstation: богатые доспехи, драматичный свет. Геометрию задаёт 3D-исходник, стиль - промпт. Здесь болванку сгенерировали текстом, но точно так же работает скриншот из Blender / Unreal / ZBrush.

Железо / время

SDXL + ControlNet-union на 8-12 ГБ. Препроцессор depth и один проход ControlNet добавляют ~10-20 сек к обычной генерации.

исходник
1 · исходник - серая 3D-болванка
Untextured рендер рыцаря на подставке. Поза и геометрия есть, но ни материалов, ни света, ни деталей. Обычный img2img «покрасит» её случайно и поедет по форме. Рычаг: зафиксировать геометрию через ControlNet.
depth
2 · карта глубины (DepthAnything)
Препроцессор снимает с болванки depth-карту: ближе - светлее, дальше - темнее. Именно она станет «рельсами» для генерации - модель будет обязана уважать этот объём.
финал
финал · ControlNet depth (strength 0.8) + фэнтези-промпт · 32 шага
Apply ControlNet кормит depth-карту в KSampler, а промпт задаёт стиль: «ornate golden armor, god rays, glowing runes, cinematic». Итог: детальный воин с ровно той же позой, шлемом, мечом и подставкой - геометрия не поехала.

Секрет в разделении ролей: ControlNet depth держит форму (поза, объём, композиция), промпт задаёт содержание (материалы, свет, стиль). Тот же приём с canny/lineart - для контуров, с openpose - для позы персонажа. Это управляемая «режиссура» вместо лотереи seed.

✔ Зачем это на практике

Так делают консистентные ракурсы для игр и раскадровок: один раз выставил 3D-болванку или позу - и генеришь по ней сколько угодно вариантов стиля, не теряя композицию. Промпт меняешь свободно, геометрия остаётся.

Кейс 8 · Пиксель-арт спрайт для игры

Задача - получить настоящий pixel-art спрайт под игру: чёткая сетка пикселей, ограниченная палитра, читаемый силуэт на однотонном фоне под вырезание. Главный урок кейса: слова «pixel art» в промпте дают лишь высокодетальную картинку «про пиксели» с мягкими краями, а настоящую чёткую пиксельную сетку задаёт специализированная LoRA под стиль. Модель по умолчанию не умеет рисовать ровные ступенчатые пиксели - её этому учит LoRA. Идём по шагам, меняя по одному рычагу. Кликни по шагу - крупнее.

ТЗ

Спрайт рыцаря под 2D-игру: цельный персонаж в полный рост, ограниченная палитра, чистые пиксели ровной сеткой, читаемый силуэт, однотонный фон под вырезание. Пригодно как игровой ассет.

Референс

Цель - уровень 16-bit RPG спрайта (SNES-эра). Насмотренность бери по запросам «16-bit sprite», «pixel art character», «game asset sprite sheet»: крупные читаемые пиксели, малая палитра, чёткий контур.

Железо / время

SDXL (Juggernaut-XL) на 8-12 ГБ или Mac на Apple Silicon. Один кадр ~30-60 сек, первый прогон с новой LoRA - дольше (грузится в память).

v1
v1 · Juggernaut-XL · без LoRA · 1024px · 30 шагов
Промпт «pixel art knight character», negative по умолчанию. Итог: Juggernaut уже нахватался пиксель-стиля, но края мягкие (анти-алиасинг), броня в плавных градиентах, фон бежевый с размытой тенью-кляксой - это высокодетальная иллюстрация «под пиксели», а не чистый спрайт с ровной сеткой. Рычаг дальше: голых слов мало, нужна LoRA под стиль.
v2
v2 · + pixel-art-xl LoRA · strength 1.0
Промпт «pixel art, a knight character sprite, 16-bit, side view». Рычаг: стилевая LoRA учит модель языку пикселей. Итог: появилась настоящая чёткая пиксельная сетка и ступенчатые края, фон стал чистым белым - но спрайт мелкий, детали в центре смазаны, меч едва читается. Стиль включился, чистоты силуэта ещё нет.
v3
v3 · pixel-art-xl 1.0 · подобрали промпт
«pixel art, cute knight sprite, limited palette, clean pixels, game asset, black background». Рычаг: явно просим милый чиби-силуэт, ограниченную палитру и чистые пиксели. Итог: персонаж стал крупнее и читаемее - большая голова, синий плюмаж, ровные пиксели, собранная палитра. Фон LoRA выдала ровный серый, а не чёрный (стилевая LoRA часто перебивает такие мелочи промпта) - но он однотонный и чистый.
final
финал · pixel-art-xl 1.0 · cfg 7.5
Рычаг: дожали промпт - «limited color palette, clean crisp pixels, sharp edges, centered game asset, solid black background, 16-bit rpg». Итог: чистый читаемый чиби-спрайт рыцаря с ограниченной серо-стальной палитрой, ровными пикселями и чётким контуром на однотонном фоне - годный игровой ассет. Фон снова серый: чтобы получить строго чёрный или прозрачный - см. блок ниже.

Урок кейса: настоящий стиль даёт не промпт, а специализированная LoRA под этот стиль. Одни слова «pixel art» (v1) дают лишь картинку «на тему пикселей» - мыльную и без сетки. Пиксельную сетку рисует pixel-art LoRA (v2), а промпт затем дожимает палитру и чистоту (v3 → финал). Тот же принцип с любым узким стилем: ink, low-poly, isometric - берётся профильная LoRA, а не только текст.

⚠ Для боевого ассета - ещё один шаг

Даже с LoRA пиксели тут «нарисованные», а не идеально выровненные по сетке: если приблизить, край пикселя гуляет, а фон вышел серым вместо запрошенного чёрного. Для реального игрового ассета картинку дополнительно прогоняют через downscale + пиксель-квантование (например, ужать до 64×64 методом nearest, ограничить палитру до N цветов, затем при желании увеличить обратно nearest-ом) и вычищают фон (chroma-key или замена ровного серого на прозрачность). Тогда пиксели ложатся ровной сеткой, фон чистый, и спрайт готов под тайлмап или анимацию. LoRA даёт стиль, квантование - техническую чистоту.

Кейс 9 · Изометрическая low-poly сцена

Разберём один прогон целиком: от перегруженного «псевдо-3D» до чистого изометрического low-poly домика уровня game-art. Ключевой рычаг здесь - не промпт сам по себе, а связка тематической LoRA и аккуратной формулировки. Меняем по одному шагу и смотрим, что именно дал каждый. Кликни по шагу - крупнее.

ТЗ

Уютный домик в изометрии, low-poly: единый объект на квадратном тайле, мягкие цвета, чистый фон, ровные грани - ассет под мобильную игру или иконку локации.

Референс

Цель - stylized game asset уровня App Store / ArtStation: гранёная геометрия, пастельная палитра, читаемый силуэт. Насмотренность бери на Pinterest по запросам «isometric low poly», «tiny house diorama»: один объект, плоский фон, аккуратные полигоны.

Железо / время

SDXL (Juggernaut) комфортно на 8-12 ГБ VRAM, ~30-60 сек на кадр 1024×1024. LoRA почти не добавляет времени - грузится один раз.

v1
v1 · Juggernaut SDXL · без LoRA · 1024px · 30 шагов · cfg 6.5
Голый промпт «isometric cozy house». Итог: ракурс изометрический, но модель уходит в перегруженный фотореалистичный рендер - домик-разрез, куча декора, плотная листва. Это «псевдо-3D», а не чистый low-poly game asset. Рычаг дальше: задать сам стиль - подключаем изометрическую low-poly LoRA.
v2
v2 · + isometric_lowpoly LoRA · strength 0.9 · триггер «isometric»
«isometric low poly cozy house, game asset, plain background». Итог: появилась гранёная low-poly геометрия и пастель - стиль тот, что нужен. Но кадр грязноват: жёсткий двухцветный свет, база забита травой и мелочью, силуэт читается хуже. Рычаг дальше: чистим промпт под «диораму» и мягкие цвета.
v3
v3 · подбор промпта · та же LoRA · 30 шагов
«clean isometric low poly diorama, cozy cottage, soft colors, plain background, centered». Итог: заметно чище - ровная пастель, аккуратный тайл, мягкий свет. Слова «clean diorama, soft colors» убрали визуальный шум. Осталась мелочь: сцена расползлась на пару домиков, фокус размывается. Рычаг дальше: явно просим один объект по центру и добавляем шагов на резкость.
финал
финал · + «single object, centered» · 38 шагов · cfg 6.5
«clean isometric low poly diorama of a cozy cottage on a small grass tile, tidy simple geometric shapes, soft pastel colors, plain white background, centered, single object, mobile game asset». Итог: один аккуратный домик по центру тайла, чистые грани, тёплый свет в окнах, читаемый силуэт - готовый low-poly ассет уровня game-art.

Задачу решил не один рычаг, а связка: тематическая LoRA (задала сам low-poly-стиль, которого базовая модель не даёт) + триггер isometric (включил нужный ракурс) + чистящие слова в промпте (clean diorama, soft colors убрали визуальный шум) + жёсткая композиция (single object, centered собрал сцену в один читаемый объект).

✔ Зачем это на практике

Так штампуют консистентные ассеты для игр и иконок локаций: одна LoRA держит единый стиль, а меняя объект в промпте (домик → кофейня → островок → башня), получаешь целый набор в одной эстетике. Стиль задаёт LoRA, содержание - промпт, чистоту - слова вроде clean, single object, centered.

Кейс 10 · Sci-fi концепт-окружение

Кинематографичный кадр не требует LoRA. Тот же движок, но каждый шаг добавляет один рычаг: сначала модель под задачу, потом сцена и свет в промпте, потом композиция и настроение, в конце - разрешение и upscale. Смотрим, как «просто картинка» превращается в концепт-кадр для sci-fi окружения - неоновый киберпанк-переулок под дождём. Кликни по шагу - крупнее.

ТЗ

Кинематографичный концепт-кадр окружения: неоновый киберпанк-переулок ночью под дождём, глубина, объёмный свет, настроение Blade Runner. Широкий кадр под key art.

Референс

Цель - уровень environment concept art со ArtStation: атмосфера, слои глубины, читаемый силуэт на переднем плане. Насмотренность бери на ArtStation, Pinterest по запросам «cyberpunk alley concept», «Blade Runner environment».

Железо / время

SDXL на 8-12 ГБ (или Mac на Apple Silicon). Черновик v1 - секунды, финал с hires-проходом ~2-3 мин. LoRA не нужна.

v1
v1 · SD 1.5 dreamshaper · 512×512 · 10 шагов
Голый промпт «cyberpunk alley». Итог: плоско, мелко, без атмосферы - но за секунды видно идею. Рычаг: быстрый черновик.
v2
v2 · сменили модель → SDXL Juggernaut · 1216×832 · 25 шагов
+ «rain-soaked alley at night, neon signs, reflections, atmospheric, cinematic, volumetric light». Итог: появились сцена, свет и широкий кадр. Рычаг: модель под задачу + сцена и свет в промпте.
v3
v3 · композиция и настроение · 1216×832 · 30 шагов
+ «lone hooded figure silhouette in foreground, deep fog, layered depth, moody key art». Итог: силуэт на переднем плане, слои глубины - это уже концепт-кадр. Рычаг: композиция и depth в промпте.
финал
финал SDXL · +детали · 40 шагов · hires ×1.5
+ «ultra detailed, sharp focus, dramatic rim light, blade runner mood». Второй проход: LatentUpscale ×1.5 → KSampler denoise 0.45. Итог: резкий кинематографичный концепт под key art. Рычаг: разрешение + upscale.
Flux
+ смена модели · тот же концепт на Flux.1
Тот же промпт, модель Flux. Итог: атмосфера, глубина и неон-отражения сильнее, даже вывески почти читаются. Вывод: Flux - топ для атмосферного фотореала; SDXL-путь выше показывает, как дожать композицию рычагами.
✔ Кинематографичность без LoRA

Ни одной LoRA - только композиция и свет в промпте + разрешение + upscale. Порядок тот же, что в любом кейсе: быстрый черновик → модель под задачу → сцена/свет → композиция и настроение → детали и hires-проход. Меняй по одному рычагу за итерацию - и обычная генерация вырастает в концепт-кадр.

Кейс 11 · Логотип / эмблема

Задача - получить иконический знак: геометрическую эмблему-лису без текста, плоский вектор на сплошном фоне, годный как логотип. Главный урок кейса: сам по себе промпт «logo» плоскую эмблему не даёт - базовая модель тянет в фотореализм или в детального маскота с тенями и градиентами. «Язык логотипа» - плоские заливки, крупные формы, две-три краски - включает стилевая LoRA, а чистоту дожимает точный промпт и ограничение по цветам. Идём по шагам, меняя по одному рычагу. Кликни по шагу - крупнее.

ТЗ

Голова лисы анфас как эмблема: плоский вектор, крупные геометрические грани, 2-3 краски, симметрично, по центру, сплошной фон. Без текста и без фотодеталей - знак должен читаться значком в 32px.

Референс

Уровень flat vector emblem / low-poly mascot: жирные грани, минимум цветов, чистый силуэт. Насмотренность бери по запросам «flat logo», «geometric animal logo», «low poly emblem».

Железо / время

SDXL (Juggernaut-XL) на 8-12 ГБ или Mac на Apple Silicon. Квадрат 1024x1024, один кадр ~30-60 сек, первый прогон с новой LoRA дольше (грузится в память).

v1
v1 · Juggernaut-XL · без LoRA · наивный промпт
Просим у базовой модели просто «лису». Итог: фотореалистичная морда - живой мех, влажный нос, боке в лесу. Показательно: даже если дописать слово «logo», SDXL без стиля рисует детального маскота с тенями и градиентным фоном - тоже не плоский вектор. Знака как такового нет.
v2
v2 · + Logo LoRA · strength 0.8
Промпт «minimalist flat vector logo, fox head, geometric, simple». Рычаг: стилевая LoRA задаёт язык логотипа. Итог: знак появился - плоская low-poly голова, грани вместо меха. Но краски приглушённые, фон не сплошной (бежевый градиент), композиция мелковата - до «сдать клиенту» ещё далеко.
v3
v3 · Logo LoRA 0.9 · точный промпт
Подняли strength и уточнили: «clean flat emblem, bold shapes, 2 colors, centered, plain background». Итог: грани чище и крупнее, форма собранная - но модель ушла в почти белую маску на светло-сером круге. Контраста мало, фон-подложка грязноват. Наглядно: без явного указания цветов эмблема выцветает.
final
финал · Logo LoRA 0.85 · cfg 6.0 · две краски
Рычаг: зафиксировали палитру в промпте - «two colors orange and dark navy», плюс «symmetrical, plain solid background». Итог: жирная двухцветная эмблема, симметрия, сплошной тёмный фон, читаемый силуэт - готовый плоский знак под логотип.
✔ LoRA даёт «язык логотипа», промпт дожимает чистоту

Плоская эмблема в диффузии - это тоже две силы вместе: стилевая LoRA переучивает модель с фотомеха на плоские грани и заливки (см. скачок v1 → v2), а точный промпт задаёт то, чего LoRA сама не угадывает - количество красок, симметрию, сплошной фон (см. v3 → финал). Голая LoRA без ограничений выцветает или мельчит, голый промпт без LoRA тянет в фото и маскота. Порядок правок: сначала подбери Logo-LoRA и её strength, потом фиксируй палитру и композицию промптом - по одному рычагу за прогон.

▲ Оговорка: это ещё не готовый бренд-лого

На выходе - растровый PNG, а настоящий логотип нужен в векторе. Финал прогоняют через трассировку (Illustrator Image Trace, vectorizer.ai, Inkscape) - получаются чистые кривые, которые масштабируются без потерь и легко перекрашиваются. И второе: текст в лого лучше добавлять отдельно, шрифтом в редакторе. SDXL мажет буквы - выдаёт кривые псевдо-надписи, поэтому эмблему генерируем без текста (мы и просили знак без надписей), а название дописываем поверх уже вектором.