Модератор Ardi Опубликовано 7 часов назад Модератор Поделиться Опубликовано 7 часов назад Нейросеть Stable Diffusion создаёт изображения по текстовому описанию и помогает подобрать визуальный стиль под конкретную задачу. С её помощью можно подготовить иллюстрацию для статьи, портрет персонажа, концепт интерьера, предметную сцену, постер или изображение для публикации в социальных сетях. Однако результат зависит не только от текста запроса. Важны выбранный чекпойнт, сэмплер, количество шагов, уровень креативности, пропорции кадра и другие параметры. Один и тот же промт при разных настройках может дать совершенно разные изображения. Разберём, как создавать изображения, писать промты и настраивать Stable Diffusion 1.5 и Stable Diffusion XL. Отдельное внимание уделим параметрам интерфейса: чекпойнтам, стилям, шумоподавлению, Hires Fix и количеству шагов. Что такое нейросеть Stable Diffusion? Stable Diffusion — семейство диффузионных моделей для генерации и редактирования изображений. Модель начинает работу с визуального шума, а затем постепенно преобразует его в картинку, соответствующую текстовому описанию. Пользователь задаёт содержание сцены с помощью промта и регулирует технические параметры. Например, можно указать: кто или что находится в кадре; где происходит действие; как выглядит освещение; с какого ракурса показана сцена; какой стиль нужно использовать; какие цвета должны преобладать; насколько детализированным должен быть результат. Stable Diffusion 1.5 и Stable Diffusion XL относятся к разным поколениям моделей. У них различаются требования к промтам, рабочее разрешение и характер интерпретации текстового запроса. Stable Diffusion 1.5 обычно хорошо подходит для стилизованных изображений, аниме, портретов и работы со специализированными для этого чекпойнтами. Stable Diffusion XL, или SDXL, лучше понимает естественные описания, увереннее выстраивает сложные сцены и рассчитана на генерацию в более высоком базовом разрешении. При этом название модели само по себе не гарантирует нужного результата. Гораздо важнее правильно подобрать чекпойнт и согласовать с ним промт. Как создавать изображения в Stable Diffusion? Базовый процесс генерации выглядит так: Выберите Stable Diffusion 1.5 или Stable Diffusion XL. Подберите чекпойнт под необходимый тип изображения. Укажите пропорции кадра. Напишите промт с описанием сюжета и визуальных характеристик. При необходимости добавьте негативный промт. Настройте сэмплер, количество шагов и уровень креативности. При необходимости включите Hires Fix. Создайте несколько вариантов. Сравните результаты и скорректируйте только те части запроса, которые требуют изменения. Последний пункт особенно важен. Если после каждой попытки полностью переписывать запрос и одновременно менять все параметры, определить причину улучшения или ухудшения результата будет сложно. Работайте поэтапно. Сначала добейтесь правильной композиции. Затем уточните внешность персонажа, материалы, свет и цвет. После этого можно увеличивать разрешение и исправлять мелкие детали. Пошаговая инструкция по работе с интерфейсом Stable Diffusion По ссылке откройте нейросеть 👉 Stable Diffusion 1.5 или 👉 Stable Diffusion XL. Для удобства и сравнения результатов создайте два новых чата под каждую модель соответственно (см. скриншот выше). Шаг 1. Выберите модель Для стилизованных изображений и для понимания принципов работы с различными чекпойнтами можно начать со Stable Diffusion 1.5. Если нужна сложная композиция, более естественное понимание запроса или крупный исходный размер, целесообразно выбрать Stable Diffusion XL. Шаг 2. Откройте настройки Нажмите кнопку с изображением шестерёнки в меню, затем выберите необходимые параметры. В меню доступны следующие параметры: чекпойнт; сэмплер; пропорции; креативность; шумоподавление; количество шагов; количество копий; Hires Fix; настройки стилей. Шаг 3. Выберите чекпойнт и стиль Шаг 4. Задайте пропорции Шаг 5. Напишите промт Шаг 6. Запустите генерацию Шаг 7. Сохраните изображение или доработайте промт Что такое чекпоинт в нейросети Stable Diffusion? Чекпойнт — это файл с весами модели, обученной или дополнительно настроенной на определённом наборе изображений. Он влияет на анатомию, палитру, фактуру, освещение и общую эстетику результата. В настройках на скриншоте выбран чекпойнт "Anything". Этот чекпойнт, ориентирован прежде всего на аниме-эстетику и рисованных персонажей. Такой чекпойнт логично сочетать со стилями Anime и Detailed, а также с промтами, описывающими дизайн героя, одежду, выражение лица и фон. Условно чекпойнты можно разделить на несколько категорий: фотореалистичные; аниме; цифровая иллюстрация; фэнтези; трёхмерная графика; универсальные модели. Сначала определите тип нужного вам результата, а уже затем выбирайте чекпойнт. Если нужен реалистичный кадр, аниме-модель придётся постоянно «переубеждать» с помощью промта, в этом случае логичнее выбрать другую модель, например: "Realistic". Даже подробный запрос не всегда сможет полностью изменить заложенные в модель особенности обучения. Не стоит считать чекпойнт обычным фильтром. Это не эффект, который накладывается в конце. Он участвует в создании изображения с первого шага и определяет, какие визуальные решения должны быть в приоритете. Как писать промты для Stable Diffusion 1.5 Stable Diffusion 1.5 лучше работает с компактными смысловыми блоками и конкретными тегами. Длинный литературный текст модель может интерпретировать непредсказуемо, особенно если в нём много второстепенных деталей. Удобный шаблон промта: Тип изображения + главный объект + внешность или свойства + действие или поза + окружение + композиция + освещение + стиль + детализация Пример: anime illustration, young female astronomer, short silver hair, dark blue coat, standing on an observatory balcony, holding a glowing star map, night sky, medium shot, moonlight, blue and violet color palette, detailed background В таком запросе: `anime illustration` задаёт тип изображения; `young female astronomer` определяет персонажа; `short silver hair, dark blue coat` описывает внешность и одежду; `standing on an observatory balcony` задаёт позу и место; `holding a glowing star map` добавляет действие; `medium shot` определяет план; `moonlight` описывает освещение; `blue and violet color palette` задаёт палитру; `detailed background` уточняет уровень и характер детализации. Для Stable Diffusion 1.5 порядок слов имеет значение. Важные элементы лучше ставить ближе к началу. Не перегружайте промт длинными списками похожих определений: `beautiful, stunning, amazing, gorgeous`, они почти не добавляют полезной информации. Вместо общих оценок используйте наблюдаемые признаки: soft side lighting, symmetrical composition, embroidered fabric, shallow depth of field Такие формулировки объясняют модели, что именно должно появиться в кадре. Пример промта для портрета в Stable Diffusion 1.5: portrait photo of a middle-aged ceramic artist, thoughtful expression, linen apron, clay workshop, handmade pottery in the background, warm window light, shallow depth of field, natural skin texture, muted earthy colors Возможный негативный промт: low quality, blurry, deformed hands, extra fingers, duplicate person, asymmetrical eyes, oversaturated colors, text, watermark, logo Негативный промт перечисляет нежелательные элементы. Его не следует превращать в огромную коллекцию случайных тегов. Добавляйте только те ограничения, которые соответствуют текущей сцене и действительно помогают устранить повторяющиеся дефекты. Для добавления негативного промта в конце вашего промта добавьте команду /np. Тогда запрос для нейросети будет выглядеть так: portrait photo of a middle-aged ceramic artist, thoughtful expression, linen apron, clay workshop, handmade pottery in the background, warm window light, shallow depth of field, natural skin texture, muted earthy colors /np low quality, blurry, deformed hands, extra fingers, duplicate person, asymmetrical eyes, oversaturated colors, text, watermark, logo. Как писать промты для Stable Diffusion XL Stable Diffusion XL лучше понимает связные и естественные описания. Для SDXL можно использовать не только теги, но и полноценные предложения, сохраняя ясную структуру. Подходящий шаблон: Что изображено + что происходит + где находится объект + как построена композиция + каким должен быть свет + визуальная стилистика + важные детали качества Пример: A cinematic editorial photograph of a young architect working alone in a spacious concrete studio. She is examining a scale model of a sustainable house beside a large window. Soft overcast daylight creates gentle shadows, while the neutral gray interior is balanced by warm wooden details. Eye-level composition, realistic materials, restrained color palette, subtle film grain. Этот запрос описывает не набор отдельных признаков, а целостную сцену. Stable Diffusion XL лучше связывает объект, действие и окружение, если между ними обозначены логические отношения. Но и SDXL не стоит перегружать. Если в одном промте одновременно запросить пять персонажей, несколько действий, сложный интерьер и множество мелких предметов, часть деталей может потеряться или появится множество деформаций объектов. Полезный приём — разделить описание на уровни: Сначала обозначить основной сюжет. Затем добавить композицию и ракурс. После этого описать свет и палитру. В конце перечислить несколько критически важных деталей. Пример промта для предметной сцены в Stable Diffusion XL: A minimalist product photograph of a matte black wireless speaker standing on a pale limestone pedestal. Thin rays of morning sunlight pass through blinds and form geometric shadows on the background. Front three-quarter view, clean composition, realistic surface texture, soft beige and charcoal color palette, premium editorial photography. Негативный промт: /np distorted product, duplicated object, warped geometry, unreadable labels, text, logo, watermark, cluttered background, harsh reflections Если на корпусе должен быть точный логотип или читаемая надпись, надёжнее добавить их после генерации в графическом редакторе. Модели SD могут создавать буквы, отдалённо похожие на текст, но не корректно воспроизводят конкретное написание. Чем отличаются промты для Stable Diffusion 1.5 и Stable Diffusion XL? Для Stable Diffusion 1.5 чаще используют последовательность тегов: fantasy library, young wizard, floating books, candlelight, wide shot, intricate details, digital painting Для Stable Diffusion XL ту же сцену можно описать естественнее: A young wizard stands in the center of an ancient fantasy library while open books float around him. Hundreds of candles illuminate tall wooden shelves, creating a warm and mysterious atmosphere. Wide composition, detailed digital painting, deep perspective. Главное отличие не в том, что Stable Diffusion 1.5 понимает только теги, а Stable Diffusion XL — только предложения. Обе модели могут работать с разными формами текста. Речь идёт о практической тенденции: SD 1.5 часто увереннее реагирует на короткие конкретные конструкции, а SDXL лучше понимает смысл связного описания. Шаблоны промтов и примеры генераций Ниже приведены шаблоны, которые можно адаптировать под собственные задачи. Текст в квадратных скобках следует заменить нужными параметрами. Шаблон для портрета [тип изображения] of [персонаж], [возраст и внешность], [одежда], [выражение лица], [фон], [тип освещения], [крупность плана], [палитра], [стилистика] Пример для Stable Diffusion 1.5: digital portrait of a young botanist, curly red hair, round glasses, green field jacket, calm expression, greenhouse background, soft diffused sunlight, close-up, natural green palette, detailed illustration Ожидаемый результат: поясной или крупный портрет исследовательницы в оранжерее, мягкий свет, зелёная палитра и рисованная детализация. Шаблон для интерьера [тип помещения], [архитектурный стиль], [основные материалы], [мебель], [свет], [ракурс], [палитра], [уровень реализма] Пример для Stable Diffusion XL: A compact reading room in a contemporary Japanese style, with light oak wall panels, built-in bookshelves and a low cream armchair. Late afternoon sunlight enters through a narrow window and creates soft shadows. Wide-angle interior photography, warm neutral palette, realistic materials, uncluttered composition. Ожидаемый результат: спокойный интерьер с понятным зонированием, натуральными материалами и мягким дневным светом. Шаблон для персонажа в аниме-стиле anime character, [пол и роль], [причёска], [одежда], [поза], [локация], [освещение], [палитра], detailed background, clean line art Пример: anime character, female train conductor, long black braid, navy uniform with brass buttons, standing beside a vintage mountain train, early morning mist, soft golden light, teal and amber palette, detailed background, clean line art С чекпойнтом Anything и стилем Anime модель должна сформировать рисованного персонажа на фоне поезда. Если лицо получилось удачным, а фон — слишком простым, не меняйте описание героини. Добавьте конкретные признаки окружения: каменная платформа, горы, пар. Шаблон для рекламной предметной сцены product photograph of [предмет], [материал и цвет], placed on [поверхность], [фон], [освещение], [ракурс], [композиция], [палитра], realistic texture Пример для SDXL: product photograph of a translucent blue glass perfume bottle, placed on wet dark stone, misty gradient background, narrow side lighting, front three-quarter view, centered composition, blue and graphite palette, realistic glass texture, subtle reflections Ожидаемый результат: предметный кадр с направленным светом и контролируемой цветовой гаммой. Если модель добавляет надписи, укажите в негативном промте `/np text, letters, logo, watermark`. Сэмплер: как модель формирует изображение Сэмплер определяет алгоритм, по которому модель удаляет шум и собирает изображение. В интерфейсе на скриншоте выбран Euler a. Euler a часто даёт выразительные результаты при сравнительно небольшом количестве шагов. Он подходит для быстрых экспериментов, иллюстраций и аниме. Буква `a` означает ancestral: на отдельных этапах алгоритм добавляет вариативность, поэтому повторные генерации могут заметнее отличаться друг от друга. Если результат выглядит интересно, но нестабильно, попробуйте другой доступный сэмплер. Для более спокойной и предсказуемой детализации применяются варианты DPM++. Менять сэмплер имеет смысл, когда: детали выглядят чрезмерно резкими или рыхлыми; модель плохо удерживает мелкие элементы; при том же промте нужна другая пластика изображения; результат перестаёт улучшаться при увеличении количества шагов. Не существует одного сэмплера для всех задач. Сравнивайте разные варианты генераций при одинаковом промте, разрешении и числе шагов на разных сэмплерах. Пропорции и разрешение изображения в SD На скриншоте выбран вертикальный формат с пропорциями 16:21. Формат влияет не только на размер, но и на композицию: вертикальный кадр подходит для персонажей, постеров и обложек; квадратный — для портретов, предметов и публикаций в ленте; горизонтальный — для пейзажей, интерьеров и сцен с несколькими объектами; широкий панорамный — для окружения, архитектуры и кинематографичных планов. Stable Diffusion 1.5 изначально лучше чувствует себя на умеренных разрешениях. Слишком большой исходный холст может привести к повторяющимся лицам, лишним конечностям или дублированию объектов. Для увеличения качества генерации разумно использовать Hires Fix. Stable Diffusion XL рассчитана на более крупное базовое разрешение. Тем не менее экстремально вытянутые форматы тоже способны нарушать композицию. Поэтому для увеличения разрешения удачных генераций следует использовать отдельную функцию в меню. Параметр креативности в Stable Diffusion В показанных настройках значение креативности установлено на 7. Этот параметр связан с силой следования текстовому запросу, по другому этот параметр называют CFG Scale. При умеренном значении модель сохраняет баланс между промтом и собственными визуальными решениями. Слишком низкий уровень может ослабить связь с запросом. Слишком высокий — сделать изображение жёстким, перенасыщенным или визуально неестественным. Начинайте со среднего значения. Затем меняйте его небольшими шагами: снижайте, если изображение выглядит перегруженным или искусственным; повышайте, если модель систематически игнорирует важные слова; не пытайтесь исправить неясный промт только усилением креативности. Если персонаж должен держать красный зонт, сначала проверьте, ясно ли это написано в промте и не конфликтует ли действие с другими частями запроса. Лишь затем регулируйте параметр. Шумоподавление в нейросети Stable Diffusion На скриншоте указано шумоподавление 0,4. Этот параметр особенно важен при Hires Fix и обработке исходного изображения. Низкое значение лучше сохраняет исходную композицию и черты персонажа. Высокое разрешает модели сильнее перерисовывать картинку. Условная логика работы выглядит так: низкое шумоподавление — аккуратное уточнение деталей; среднее — заметная переработка текстур при сохранении сюжета; высокое — существенное изменение исходного изображения. Значение 0,4 можно использовать как отправную точку для увеличения разрешения: модель получает пространство для добавления деталей, но не должна полностью перестраивать сцену. Для сохранения оригинала используйте наименьшее значение. Если после Hires Fix меняется лицо или одежда, уменьшите шумоподавление. Если изображение увеличилось, но осталось размытым и почти не получило новых деталей, попробуйте немного повысить его. Параметр "Количество шагов" в настройках Stable Diffusion На скриншоте установлено 22 шага. Количество шагов показывает, сколько итераций удаления шума выполняет модель. Больше шагов не всегда означает более качественный результат. После определённого момента различия становятся небольшими, а время генерации продолжает расти. Иногда чрезмерное число шагов делает изображение жёстким или подчёркивает лишние детали. Для первоначальной генерации удобно выбирать умеренное значение и оценивать: сформировалась ли композиция; не деформируются ли лица и предметы; достаточно ли проработаны материалы; нет ли визуального шума. Если изображение выглядит недостроенным, увеличьте количество шагов. Если оно уже сформировано, но содержит смысловые ошибки, дополнительные итерации вряд ли помогут. В этом случае лучше изменить промт, чекпойнт или композицию. Количество копий в Stable Diffusion В настройках выбрана одна копия. Этот параметр определяет, сколько вариантов будет создано за один запуск. Одна копия удобна при точной настройке и экономии вычислительных ресурсов. Несколько копий полезны на этапе поиска композиции, поскольку генерация SD содержит элемент случайности. Практичный порядок работы: Создайте несколько черновых вариантов. Выберите наиболее удачную композицию. Сохраните удачный промт. Доработайте настройки. Используйте Hires Fix. Количество копий не следует путать с последовательным улучшением одной картинки. Каждый вариант является самостоятельной генерацией. Hires Fix в Stable Diffusion: улучшение качества генерации На скриншоте функция "Hires Fix" включена. Нейросеть SD при активированной функции "Hires Fix" выполняет генерацию в два этапа: сначала создаёт изображение в базовом размере, затем дополнительно уточняет его. Hires Fix незаменим для Stable Diffusion 1.5, особенно при создании вертикальных портретов и детализированных иллюстраций. Используйте Hires Fix, когда: исходная композиция уже устраивает; требуется больше деталей в лице, одежде или окружении; нужно получить чёткое изображение; базовая генерация выглядит размытой. Важно понимать: Hires Fix не исправляет слабую композицию автоматически. Он может усилить уже существующие ошибки. Настройки стилей в нейросети Stable Diffusion На скриншоте в меню SD вы можете увидеть перечень предустановленных стилей, расположенных в алфавитном порядке. Одновременно допускается использование трёх стилей. Стиль обычно добавляет к запросу заранее подготовленные визуальные признаки. Например: Anime усиливает рисованную эстетику; Detailed может повышать насыщенность мелкими элементами; Cinematic добавляет характерное освещение и композицию; Photo смещает результат в сторону фотографии. Не включайте сразу три стиля. Они могут конфликтовать друг с другом и с выбранным чекпойнтом. Для чекпойнта Anything сочетание с Anime логично, поскольку оба параметра направляют генерацию в одну сторону. Полезный тест — создать изображение с одним стилем и без него, оставив остальные настройки одинаковыми. Так будет видно, какой вклад действительно вносит используемый пресет. Как получить управляемый результат в Stable Diffusion? У Stable Diffusion нет кнопки, которая автоматически исправляет все проблемы. Зато есть понятный порядок диагностики. Если модель игнорирует главный объект, перенесите его описание в начало промта и удалите конкурирующие детали. Если фон получается пустым, не пишите только `detailed background`. Перечислите конкретные элементы окружения. Если портрет выглядит неестественно, уточните крупность плана, тип света и выражение лица. Проверьте, подходит ли чекпойнт для реалистичных изображений. Если персонаж дублируется, уменьшите исходное разрешение или измените пропорции. Для Stable Diffusion 1.5 используйте Hires Fix. Если результат перегружен, сократите промт. Иногда проблема вызвана не недостатком описания, а конфликтом между его частями. Если меняется слишком многое, корректируйте по одному параметру. Например, сначала замените чекпойнт, но сохраните промт и шаги. Затем сравните результат. Такой подход занимает немного больше времени, зато позволяет понять поведение модели. Частые ошибки при работе со Stable Diffusion Промт состоит из абстрактных оценок Слова «красивый», «качественный» и «необычный» не объясняют, как должно выглядеть изображение. Заменяйте их описанием света, композиции, материалов и палитры. В одном запросе слишком много сюжетов Модель хуже справляется, когда должна одновременно показать портрет, городскую панораму, сложное действие и десятки мелких объектов. Определите главный визуальный центр. Чекпойнт не соответствует задаче Аниме-чекпойнт не является оптимальной основой для реалистичной предметной фотографии. Промт не всегда способен преодолеть особенности модели. Все параметры меняются одновременно После такого эксперимента невозможно понять, что повлияло на результат. Меняйте одну настройку и сохраняйте удачные комбинации. Hires Fix не используется Используйте этот параметр, особенно для SD 1.5 - это заметно улучшает качество генерации. Негативный промт перегружен Слишком длинный список ограничений может сделать изображение менее естественным. Начните с нескольких типичных дефектов и расширяйте список только при необходимости. Краткая инструкция по работе с нейросетью Stable Diffusion Чтобы создавать изображения в нейросети Stable Diffusion без хаотичного перебора настроек, придерживайтесь последовательности: Определите задачу и формат. Выберите Stable Diffusion 1.5 или Stable Diffusion XL. Подберите подходящий чекпойнт. Напишите промт, начиная с главного объекта. Укажите окружение, композицию, свет и стиль. Добавьте короткий негативный промт при необходимости. Используйте умеренное количество шагов и средний уровень креативности. Создайте несколько черновых вариантов. Исправьте смысловые и логические ошибки в промте. Включите Hires Fix. Проверьте изображение в полном размере на наличие дефектов. Нейросеть Stable Diffusion становится заметно понятнее, если относиться к генерации как к последовательной настройке сцены. Промт отвечает за содержание, чекпойнт — за визуальную основу, сэмплер — за способ формирования изображения, а технические параметры регулируют детализацию и степень проработки. Stable Diffusion 1.5 удобна для экспериментов со стилями. Stable Diffusion XL лучше подходит для связных описаний и сложных сцен. В обоих случаях наиболее полезная привычка — сохранять удачные промты и настройки. Со временем из них складывается собственная библиотека рабочих шаблонов, которую можно быстро адаптировать под портреты, иллюстрации, интерьеры и предметные изображения. 1 Цитата Ссылка на комментарий Поделиться на другие сайты Поделиться
Рекомендуемые сообщения
Присоединяйтесь к обсуждению
Вы можете написать сейчас и зарегистрироваться позже. Если у вас есть аккаунт, авторизуйтесь, чтобы опубликовать от имени своего аккаунта.
Примечание: Ваш пост будет проверен модератором, прежде чем станет видимым.