Кейсы: от черновика до финала
Хорошая картинка - это не один промпт, а несколько итераций. Вот несколько реальных прогонов по шагам - разные задачи, модели и стили. Каждый начинаем с нарочно грубых настроек, потом доводим по одному рычагу. Кликни по шагу - крупнее.
Кейс 1 · Обложка фэнтези-книги
ТЗ
Эпичная обложка фэнтези-романа: воин против дракона, портретный формат, место под заголовок сверху.
Референс
Цель - уровень книжной обложки / key art. Насмотренность бери на Pinterest, ArtStation; идём к «эпично, кинематографично, есть куда лечь заголовку».
Железо / время
Любой GPU от 8 ГБ (или Mac на Apple Silicon). Финал ~1-2 мин, черновики - секунды.

Голый промпт «warrior and dragon», без negative. Итог: сыро, композиции нет, мелко - но за секунды видим идею.

+ «fantasy art, dramatic», Juggernaut. Итог: качество выше, но всё ещё пейзаж, а не обложка.

Портретный формат, «на скале, бурное небо, место под заголовок», + negative. Итог: это уже обложка.

+ «cinematic, god rays, artstation, masterpiece». Итог: готовый кадр под заголовок.

Тот же сюжет, но модель - Flux. Итог: выше когерентность, свет и композиция с одного прохода, без доводки. Вывод: для фотореал-финала Flux сильнее SDXL; SDXL-шаги выше - быстрый и дешёвый путь к идее и композиции.
Кейс 2 · Рекламный кадр (парфюм)
ТЗ
Премиальный рекламный кадр флакона парфюма: чистый фон, студийный свет, отражения.
Референс
Цель - product photography уровня e-commerce / luxury-баннера.
Железо / время
SDXL на 8-12 ГБ, финал ~1 мин.

«perfume bottle». Итог: набросок, не реклама.

+ «product photo, studio». Итог: чище, но фон и свет случайные.

«на мокром чёрном камне, софтбокс, отражения, градиентный фон». Итог: уже рекламный кадр.

+ «luxury, macro, commercial, dramatic rim light». Итог: готово под баннер.
Порядок правок один: идея (быстрый черновик) → модель под задачу → композиция/формат → детали и финиш → upscale. Не жди идеала с первого раза - иди итерациями, меняя по одному рычагу.
Кейс 3 · Рекламный кадр (кроссовки)
Разберём один прогон целиком: от нарочно грубого черновика до чистого рекламного кадра премиальных кроссовок. Правило то же, что и в любом кейсе - не ждать идеала с первого раза, а идти итерациями, меняя по одному рычагу. Кликни по шагу - крупнее.
ТЗ
Премиальный product-shot кроссовка: продукт-герой на пьедестале, студийный свет, глянцевые отражения, чистый тёмный фон - кадр под баннер или карточку luxury-товара.
Референс
Цель - product photography уровня e-commerce / luxury-рекламы. Насмотренность бери на Pinterest по запросам «product shot», «sneaker advertising»: продукт на подиуме, мокрый камень, softbox, драматичный rim light, отражения.
Железо / время
SDXL комфортно на 8-12 ГБ VRAM, ~30-60 сек на кадр. Черновик на SD 1.5 - секунды. Финал с upscale - ~1-2 мин.

Голый промпт «sneaker», без negative. Итог: мелко, мыльно, пластик, продукт даже не в центре - но за секунды видно идею. Рычаг дальше: модель слабовата для фотореализма - берём SDXL.

+ «product photo, studio». Итог: резче и чище, уже похоже на съёмку, но фон и свет случайные, композиция плоская - рекламы ещё нет. Рычаг дальше: описываем сцену и свет словами + добавляем negative, поднимаем разрешение до родного.

«на мокром чёрном камне-пьедестале, softbox, dramatic rim light, отражения, чистый тёмный градиент, macro, commercial photography». Итог: это уже рекламный кадр - свет, пьедестал, отражения на месте. Рычаг дальше: не хватает резкости и микродеталей - добавляем шаги и второй проход upscale.

Тот же промпт, второй проход дорисовывает фактуру. Итог: резкий детальный кадр - глянец кожи, капли и золотые брызги, чистые отражения. Готово под баннер.

Тот же бриф, модель Flux. Итог: материал, отражения и свет реалистичнее с одного прохода, без hires. Вывод: где нужен максимум фотореала - берут Flux; SDXL быстрее для черновиков и итераций.
Задачу решил не один рычаг, а связка: правильная модель (SDXL вместо SD 1.5 дал фотореализм) + описанная сцена в промпте (пьедестал, свет, отражения превратили «фото объекта» в рекламу) + родное разрешение (1024 убрало мыло) + hires-проход (добавил резкость и микродетали финалу).
Порядок правок один: идея (быстрый черновик) → модель под задачу → композиция и свет в промпте → родное разрешение → детали и upscale. Меняй по одному рычагу и смотри, что именно он дал - так понятно, за счёт чего вырос результат.
Кейс 4 · Аниме-постер персонажа
Главный урок этого кейса - модель под задачу. Фотореалистичная база физически не умеет рисовать аниме: она мажет в «полуреализм 2.5D», сколько ни правь промпт. Лечится не настройками, а сменой базы на аниме-модель (семейство Illustrious) и переходом на её родной язык - booru-теги. Ниже - путь от нарочно неправильной модели до готового постера. Кликни по шагу - крупнее.
ТЗ
Постер аниме-персонажа: девушка с серебристыми волосами в красном кимоно, сакура, портретный формат под печать/обложку.
Референс
Цель - чистое аниме уровня key visual: ровная заливка, аккуратная линия, выразительные глаза, «постерная» подача. Насмотренность - Pixiv, Danbooru, официальные аниме-постеры.
Железо / время
Аниме-SDXL (Illustrious) на 8-12 ГБ VRAM, портрет 832×1216. Финал ~30-60 сек, черновики - секунды.

Промпт «anime girl, silver hair, kimono, cherry blossom» на фотореалистичной SDXL. Итог: вышло фото косплеера - настоящая кожа, объёмный свет, никакого аниме. Рычаг: база не та; тегами это не чинится.

Та же сцена, но модель аниме, а промпт всё ещё предложением («an anime girl with long silver hair wearing a red kimono...»). Итог: это уже аниме, но подача плоская и «случайная». Рычаг: правильная база - главный скачок качества.

«1girl, solo, silver hair, long hair, red kimono, cherry blossom, detailed eyes, masterpiece, best quality». Итог: чистое аниме, аккуратная линия, глаза «читаются». Рычаг: Illustrious слушает теги, а не фразы - на её родном языке она собраннее.

+ «masterpiece, best quality, very aesthetic, hair ornament, upper body, falling cherry blossom petals, soft cinematic lighting, depth of field, poster background, bokeh». Итог: готовый постер - профиль, украшение в волосах, боке, ветка сакуры. Рычаг: quality-теги + свет + кадрирование доводят до печатного вида.
Два рычага, в правильном порядке: сначала модель под задачу (фото-база → аниме-база Illustrious - это даёт основной скачок), потом язык модели (booru-теги через запятую вместо предложений, плюс quality-теги masterpiece, best quality). Только после этого - свет, кадр и фон. Пытаться «допромптить» аниме на фотомодели - тупик: композиция и настройки бессильны, если база не умеет нужного стиля. Не забудь про negative для аниме-баз: nsfw, nude сверху к обычному списку.
Кейс 5 · Чёрно-белая иллюстрация
Задача - получить чистую line-art страницу под раскраску: только чёрный контур на белом, без цвета и без полутонов. Главный урок кейса: стиль задаёт не один промпт, а связка стилевая LoRA + грамотный negative. LoRA учит модель «языку туши», а negative вычищает то, что модель тащит по привычке - цвет и тени. Идём по шагам, меняя по одному рычагу. Кликни по шагу - крупнее.
ТЗ
Сова анфас, чистая line-art / страница раскраски: чёткий чёрный контур, белый фон, без заливок цветом и без серых полутонов. Пригодно под печать и раскрашивание.
Референс
Цель - уровень coloring book page: ровная толстая обводка, читаемые зоны под заливку. Насмотренность бери по запросам «coloring page», «ink line art», «clean lineart».
Железо / время
SDXL (Juggernaut-XL) на 8-12 ГБ или Mac на Apple Silicon. Один кадр ~30-60 сек, первый прогон с новой LoRA - дольше (грузится в память).

Промпт «black and white line art of an owl», negative по умолчанию (blurry, low quality, watermark, deformed). Итог: цвета нет, но модель сыплет полутонами - плотная штриховка перьев, глаза залиты чёрным. Это ещё не чистый контур под раскраску.

В negative добавили «color, colored, shading». Рычаг: стилевая LoRA задаёт язык туши. Итог: язык линии включился, но LoRA пересветила чёрным - гравюрные заливки, темно и грязновато.

Подняли strength и добавили вторую LoRA, промпт «clean ink line art, coloring book page, white background». Итог: линия чище и легче - но negative слабоват, и цвет пролез обратно в глаза (янтарь). Наглядно: без сильного negative стиль не держится.

Рычаг: усилили negative - явно гасим «yellow / orange / amber eyes», а в промпт добавили «monochrome». Итог: чистый чёрный контур на белом, глаза без цвета, ровная обводка - готовая страница раскраски под печать.
Стиль в диффузии - это две силы вместе: LoRA говорит, что рисовать (язык туши, чистая линия), а negative говорит, чего быть не должно (цвет, тени, полутона). Одна LoRA без negative тащит цвет обратно (см. v3), голый negative без LoRA не даёт стиля (см. v1). Порядок правок: сначала подбери стилевую LoRA и её strength, потом дожимай чистоту через negative и cfg - по одному рычагу за прогон.
Кейс 6 · YouTube-превью с текстом
Задача, на которой спотыкаются почти все: нужен яркий thumbnail 16:9 с крупным ЧИТАЕМЫМ словом в кадре. Здесь решает не настройка, а выбор модели - и это главный урок кейса. Кликни по шагу - крупнее.
ТЗ
Превью для ролика: крупное эмоциональное лицо, высокий контраст, жёлто-чёрная гамма и большое читаемое слово «COMFYUI» в кадре. Формат 16:9.
Референс
Насмотренность - Pinterest / YouTube по «youtube thumbnail»: крупный объект, контраст, короткий крупный текст. Ключевое требование - текст должен читаться.
Железо / время
SDXL ~30-60 сек на 8-12 ГБ. Flux тяжелее (12-24 ГБ или fp8/gguf на меньшем), ~1-2 мин на кадр.

Тот же запрос с текстом «COMFYUI». Итог: картинка и эмоция отличные, но текст - каша: «TOP», «COMFI!», случайные буквы врассыпную. SDXL и SD1.5 не умеют надёжно рисовать буквы. Рычаг дальше: это не чинится настройками - нужна модель, которая умеет текст.

Тот же промпт, но модель - Flux (её конёк - текст в кадре). Итог: крупное читаемое «COMFYU» жёлтым по чёрному, эмоция на месте. Задача решена сменой семейства модели.
Рычаг здесь один и жёсткий: модель под задачу. Текст в кадре надёжно рисуют Flux и Qwen-Image; SDXL/SD1.5 - почти никогда. Альтернатива, если нужен именно SDXL-стиль: сгенерировать фон без текста и наложить надпись потом в редакторе (Photoshop/Figma) - так чаще всего и делают в продакшене.
Если задача упирается в фундаментальное умение (чистый текст, определённый стиль, аниме), никакие steps/cfg/seed не помогут - меняй модель. Сначала спроси «а эта база вообще умеет то, что я прошу?», потом крути настройки.
Кейс 7 · 3D-болванка в рендер (ControlNet depth)
Мост из 3D в ComfyUI: берём грубую серую болванку из 3D-редактора, снимаем с неё карту глубины и «красим» нейросетью, НЕ ломая позу и геометрию. Ключевой приём, когда важно точно управлять композицией. Кликни по шагу - крупнее.
ТЗ
Есть 3D-модель рыцаря (серый untextured рендер, «глина»). Нужно превратить её в детального фэнтези-воина, сохранив ровно ту же позу, пропорции и ракурс.
Референс
Цель - concept-art уровня artstation: богатые доспехи, драматичный свет. Геометрию задаёт 3D-исходник, стиль - промпт. Здесь болванку сгенерировали текстом, но точно так же работает скриншот из Blender / Unreal / ZBrush.
Железо / время
SDXL + ControlNet-union на 8-12 ГБ. Препроцессор depth и один проход ControlNet добавляют ~10-20 сек к обычной генерации.

Untextured рендер рыцаря на подставке. Поза и геометрия есть, но ни материалов, ни света, ни деталей. Обычный img2img «покрасит» её случайно и поедет по форме. Рычаг: зафиксировать геометрию через ControlNet.

Препроцессор снимает с болванки depth-карту: ближе - светлее, дальше - темнее. Именно она станет «рельсами» для генерации - модель будет обязана уважать этот объём.

Apply ControlNet кормит depth-карту в KSampler, а промпт задаёт стиль: «ornate golden armor, god rays, glowing runes, cinematic». Итог: детальный воин с ровно той же позой, шлемом, мечом и подставкой - геометрия не поехала.
Секрет в разделении ролей: ControlNet depth держит форму (поза, объём, композиция), промпт задаёт содержание (материалы, свет, стиль). Тот же приём с canny/lineart - для контуров, с openpose - для позы персонажа. Это управляемая «режиссура» вместо лотереи seed.
Так делают консистентные ракурсы для игр и раскадровок: один раз выставил 3D-болванку или позу - и генеришь по ней сколько угодно вариантов стиля, не теряя композицию. Промпт меняешь свободно, геометрия остаётся.
Кейс 8 · Пиксель-арт спрайт для игры
Задача - получить настоящий pixel-art спрайт под игру: чёткая сетка пикселей, ограниченная палитра, читаемый силуэт на однотонном фоне под вырезание. Главный урок кейса: слова «pixel art» в промпте дают лишь высокодетальную картинку «про пиксели» с мягкими краями, а настоящую чёткую пиксельную сетку задаёт специализированная LoRA под стиль. Модель по умолчанию не умеет рисовать ровные ступенчатые пиксели - её этому учит LoRA. Идём по шагам, меняя по одному рычагу. Кликни по шагу - крупнее.
ТЗ
Спрайт рыцаря под 2D-игру: цельный персонаж в полный рост, ограниченная палитра, чистые пиксели ровной сеткой, читаемый силуэт, однотонный фон под вырезание. Пригодно как игровой ассет.
Референс
Цель - уровень 16-bit RPG спрайта (SNES-эра). Насмотренность бери по запросам «16-bit sprite», «pixel art character», «game asset sprite sheet»: крупные читаемые пиксели, малая палитра, чёткий контур.
Железо / время
SDXL (Juggernaut-XL) на 8-12 ГБ или Mac на Apple Silicon. Один кадр ~30-60 сек, первый прогон с новой LoRA - дольше (грузится в память).
Промпт «pixel art knight character», negative по умолчанию. Итог: Juggernaut уже нахватался пиксель-стиля, но края мягкие (анти-алиасинг), броня в плавных градиентах, фон бежевый с размытой тенью-кляксой - это высокодетальная иллюстрация «под пиксели», а не чистый спрайт с ровной сеткой. Рычаг дальше: голых слов мало, нужна LoRA под стиль.
Промпт «pixel art, a knight character sprite, 16-bit, side view». Рычаг: стилевая LoRA учит модель языку пикселей. Итог: появилась настоящая чёткая пиксельная сетка и ступенчатые края, фон стал чистым белым - но спрайт мелкий, детали в центре смазаны, меч едва читается. Стиль включился, чистоты силуэта ещё нет.
«pixel art, cute knight sprite, limited palette, clean pixels, game asset, black background». Рычаг: явно просим милый чиби-силуэт, ограниченную палитру и чистые пиксели. Итог: персонаж стал крупнее и читаемее - большая голова, синий плюмаж, ровные пиксели, собранная палитра. Фон LoRA выдала ровный серый, а не чёрный (стилевая LoRA часто перебивает такие мелочи промпта) - но он однотонный и чистый.
Рычаг: дожали промпт - «limited color palette, clean crisp pixels, sharp edges, centered game asset, solid black background, 16-bit rpg». Итог: чистый читаемый чиби-спрайт рыцаря с ограниченной серо-стальной палитрой, ровными пикселями и чётким контуром на однотонном фоне - годный игровой ассет. Фон снова серый: чтобы получить строго чёрный или прозрачный - см. блок ниже.
Урок кейса: настоящий стиль даёт не промпт, а специализированная LoRA под этот стиль. Одни слова «pixel art» (v1) дают лишь картинку «на тему пикселей» - мыльную и без сетки. Пиксельную сетку рисует pixel-art LoRA (v2), а промпт затем дожимает палитру и чистоту (v3 → финал). Тот же принцип с любым узким стилем: ink, low-poly, isometric - берётся профильная LoRA, а не только текст.
Даже с LoRA пиксели тут «нарисованные», а не идеально выровненные по сетке: если приблизить, край пикселя гуляет, а фон вышел серым вместо запрошенного чёрного. Для реального игрового ассета картинку дополнительно прогоняют через downscale + пиксель-квантование (например, ужать до 64×64 методом nearest, ограничить палитру до N цветов, затем при желании увеличить обратно nearest-ом) и вычищают фон (chroma-key или замена ровного серого на прозрачность). Тогда пиксели ложатся ровной сеткой, фон чистый, и спрайт готов под тайлмап или анимацию. LoRA даёт стиль, квантование - техническую чистоту.
Кейс 9 · Изометрическая low-poly сцена
Разберём один прогон целиком: от перегруженного «псевдо-3D» до чистого изометрического low-poly домика уровня game-art. Ключевой рычаг здесь - не промпт сам по себе, а связка тематической LoRA и аккуратной формулировки. Меняем по одному шагу и смотрим, что именно дал каждый. Кликни по шагу - крупнее.
ТЗ
Уютный домик в изометрии, low-poly: единый объект на квадратном тайле, мягкие цвета, чистый фон, ровные грани - ассет под мобильную игру или иконку локации.
Референс
Цель - stylized game asset уровня App Store / ArtStation: гранёная геометрия, пастельная палитра, читаемый силуэт. Насмотренность бери на Pinterest по запросам «isometric low poly», «tiny house diorama»: один объект, плоский фон, аккуратные полигоны.
Железо / время
SDXL (Juggernaut) комфортно на 8-12 ГБ VRAM, ~30-60 сек на кадр 1024×1024. LoRA почти не добавляет времени - грузится один раз.

Голый промпт «isometric cozy house». Итог: ракурс изометрический, но модель уходит в перегруженный фотореалистичный рендер - домик-разрез, куча декора, плотная листва. Это «псевдо-3D», а не чистый low-poly game asset. Рычаг дальше: задать сам стиль - подключаем изометрическую low-poly LoRA.

«isometric low poly cozy house, game asset, plain background». Итог: появилась гранёная low-poly геометрия и пастель - стиль тот, что нужен. Но кадр грязноват: жёсткий двухцветный свет, база забита травой и мелочью, силуэт читается хуже. Рычаг дальше: чистим промпт под «диораму» и мягкие цвета.

«clean isometric low poly diorama, cozy cottage, soft colors, plain background, centered». Итог: заметно чище - ровная пастель, аккуратный тайл, мягкий свет. Слова «clean diorama, soft colors» убрали визуальный шум. Осталась мелочь: сцена расползлась на пару домиков, фокус размывается. Рычаг дальше: явно просим один объект по центру и добавляем шагов на резкость.

«clean isometric low poly diorama of a cozy cottage on a small grass tile, tidy simple geometric shapes, soft pastel colors, plain white background, centered, single object, mobile game asset». Итог: один аккуратный домик по центру тайла, чистые грани, тёплый свет в окнах, читаемый силуэт - готовый low-poly ассет уровня game-art.
Задачу решил не один рычаг, а связка: тематическая LoRA (задала сам low-poly-стиль, которого базовая модель не даёт) + триггер isometric (включил нужный ракурс) + чистящие слова в промпте (clean diorama, soft colors убрали визуальный шум) + жёсткая композиция (single object, centered собрал сцену в один читаемый объект).
Так штампуют консистентные ассеты для игр и иконок локаций: одна LoRA держит единый стиль, а меняя объект в промпте (домик → кофейня → островок → башня), получаешь целый набор в одной эстетике. Стиль задаёт LoRA, содержание - промпт, чистоту - слова вроде clean, single object, centered.
Кейс 10 · Sci-fi концепт-окружение
Кинематографичный кадр не требует LoRA. Тот же движок, но каждый шаг добавляет один рычаг: сначала модель под задачу, потом сцена и свет в промпте, потом композиция и настроение, в конце - разрешение и upscale. Смотрим, как «просто картинка» превращается в концепт-кадр для sci-fi окружения - неоновый киберпанк-переулок под дождём. Кликни по шагу - крупнее.
ТЗ
Кинематографичный концепт-кадр окружения: неоновый киберпанк-переулок ночью под дождём, глубина, объёмный свет, настроение Blade Runner. Широкий кадр под key art.
Референс
Цель - уровень environment concept art со ArtStation: атмосфера, слои глубины, читаемый силуэт на переднем плане. Насмотренность бери на ArtStation, Pinterest по запросам «cyberpunk alley concept», «Blade Runner environment».
Железо / время
SDXL на 8-12 ГБ (или Mac на Apple Silicon). Черновик v1 - секунды, финал с hires-проходом ~2-3 мин. LoRA не нужна.

Голый промпт «cyberpunk alley». Итог: плоско, мелко, без атмосферы - но за секунды видно идею. Рычаг: быстрый черновик.

+ «rain-soaked alley at night, neon signs, reflections, atmospheric, cinematic, volumetric light». Итог: появились сцена, свет и широкий кадр. Рычаг: модель под задачу + сцена и свет в промпте.

+ «lone hooded figure silhouette in foreground, deep fog, layered depth, moody key art». Итог: силуэт на переднем плане, слои глубины - это уже концепт-кадр. Рычаг: композиция и depth в промпте.

+ «ultra detailed, sharp focus, dramatic rim light, blade runner mood». Второй проход: LatentUpscale ×1.5 → KSampler denoise 0.45. Итог: резкий кинематографичный концепт под key art. Рычаг: разрешение + upscale.

Тот же промпт, модель Flux. Итог: атмосфера, глубина и неон-отражения сильнее, даже вывески почти читаются. Вывод: Flux - топ для атмосферного фотореала; SDXL-путь выше показывает, как дожать композицию рычагами.
Ни одной LoRA - только композиция и свет в промпте + разрешение + upscale. Порядок тот же, что в любом кейсе: быстрый черновик → модель под задачу → сцена/свет → композиция и настроение → детали и hires-проход. Меняй по одному рычагу за итерацию - и обычная генерация вырастает в концепт-кадр.
Кейс 11 · Логотип / эмблема
Задача - получить иконический знак: геометрическую эмблему-лису без текста, плоский вектор на сплошном фоне, годный как логотип. Главный урок кейса: сам по себе промпт «logo» плоскую эмблему не даёт - базовая модель тянет в фотореализм или в детального маскота с тенями и градиентами. «Язык логотипа» - плоские заливки, крупные формы, две-три краски - включает стилевая LoRA, а чистоту дожимает точный промпт и ограничение по цветам. Идём по шагам, меняя по одному рычагу. Кликни по шагу - крупнее.
ТЗ
Голова лисы анфас как эмблема: плоский вектор, крупные геометрические грани, 2-3 краски, симметрично, по центру, сплошной фон. Без текста и без фотодеталей - знак должен читаться значком в 32px.
Референс
Уровень flat vector emblem / low-poly mascot: жирные грани, минимум цветов, чистый силуэт. Насмотренность бери по запросам «flat logo», «geometric animal logo», «low poly emblem».
Железо / время
SDXL (Juggernaut-XL) на 8-12 ГБ или Mac на Apple Silicon. Квадрат 1024x1024, один кадр ~30-60 сек, первый прогон с новой LoRA дольше (грузится в память).

Просим у базовой модели просто «лису». Итог: фотореалистичная морда - живой мех, влажный нос, боке в лесу. Показательно: даже если дописать слово «logo», SDXL без стиля рисует детального маскота с тенями и градиентным фоном - тоже не плоский вектор. Знака как такового нет.

Промпт «minimalist flat vector logo, fox head, geometric, simple». Рычаг: стилевая LoRA задаёт язык логотипа. Итог: знак появился - плоская low-poly голова, грани вместо меха. Но краски приглушённые, фон не сплошной (бежевый градиент), композиция мелковата - до «сдать клиенту» ещё далеко.

Подняли strength и уточнили: «clean flat emblem, bold shapes, 2 colors, centered, plain background». Итог: грани чище и крупнее, форма собранная - но модель ушла в почти белую маску на светло-сером круге. Контраста мало, фон-подложка грязноват. Наглядно: без явного указания цветов эмблема выцветает.

Рычаг: зафиксировали палитру в промпте - «two colors orange and dark navy», плюс «symmetrical, plain solid background». Итог: жирная двухцветная эмблема, симметрия, сплошной тёмный фон, читаемый силуэт - готовый плоский знак под логотип.
Плоская эмблема в диффузии - это тоже две силы вместе: стилевая LoRA переучивает модель с фотомеха на плоские грани и заливки (см. скачок v1 → v2), а точный промпт задаёт то, чего LoRA сама не угадывает - количество красок, симметрию, сплошной фон (см. v3 → финал). Голая LoRA без ограничений выцветает или мельчит, голый промпт без LoRA тянет в фото и маскота. Порядок правок: сначала подбери Logo-LoRA и её strength, потом фиксируй палитру и композицию промптом - по одному рычагу за прогон.
На выходе - растровый PNG, а настоящий логотип нужен в векторе. Финал прогоняют через трассировку (Illustrator Image Trace, vectorizer.ai, Inkscape) - получаются чистые кривые, которые масштабируются без потерь и легко перекрашиваются. И второе: текст в лого лучше добавлять отдельно, шрифтом в редакторе. SDXL мажет буквы - выдаёт кривые псевдо-надписи, поэтому эмблему генерируем без текста (мы и просили знак без надписей), а название дописываем поверх уже вектором.