Перейти к содержанию

Чем полезен форум Yes Ai ?

  • Здесь вы найдете статьи о нейросетях: Midjourney, ChatGPT, Stable Diffusion, Sora, Flux.1, Kling Ai и других
  • Масса полезных инструкций для решения задач с помощью современных моделей ИИ
Статьи

Галерея бесплатных промтов

Откройте нашу галерею с бесплатными промтами для генерации изображений в нейросетях

Sora Images, Midjourney, SDXL, Stable Diffusion и Dalle-3

Галерея

API нейросетей для разработчиков

Добавьте функции нейросетей в собственное мобильное приложение,

веб-сайт или Telegram-бота

API

Хотите задать вопрос о нейросетях ?

Подробно опишите задачу, которую хотите решить с помощью ИИ,

а участники нашего сообщества постараются вам помочь. Это бесплатно!

Спросить
  • Форум о нейросетях и искусственном интеллекте

    ✌️ На форуме ИИ про нейросети Yes Ai размещены полезные статьи и бесплатные обучающие материалы про Midjourney, Chat GPT, Flux.1, Kling Ai, Stable Diffusion, SXDL и др. В галерее вы найдете множество промтов для генерации изображений в нейросетях.

    • Активность на форуме позволит получать бесплатные генерации в нейросетях через Telegram-бота @yes_ai_bot
    • Рекомендуем начать изучение форума про ИИ с прочтения статей 👇 или просмотра галереи работ нашего сообщества

    Добро пожаловать!

     

Форум ИИ о нейросетях

  1. Обсуждаем нейросети и искусственный интеллект

    В этом разделе обсуждаем нейронные сети, которые работают с видео, включая создание, стилизацию, редактирование видео и многое другое.

    Описание всех функций нейросети Nano Banana: генерация картинок по промтам и референсам (исходным фото), редактирование изображений и фотографий.

    Полезные статьи о нейросети для генерации изображений Midjourney. Как делать генерации в Миджорни, как писать промты, команды для нейросети.

    Sora Images

    • 38 постов

    Статьи о возможностях нейросети для генерации изображений Sora Images, разработанной компанией Open Ai. Промты, функции и настройки.

    Qwen Images

    • 41 пост

    Статьи про возможности нейросети Qwen Images и Qwen Edit для генерации изображений по промтам и референсам: полезные советы и примеры использования.

    Полезные статьи об использовании нейросети Flux.1 и ее расширенных возможностей. Как использовать LoRA и другие функции Flux.

    Советы и лайфхаки по использованию нейросети для работы с текстом Chat GPT / Gemma / LLaMA

    Описываем функции легендарной нейросети Stable Diffusion, позволяющей генерировать изображения и модифицировать их. Inpaint, Upscale и редактирование изображений.

    В этой ветке обсуждаем другие нейронные сети, которых нет в основном списке (например, HeyGen, Deforum и пр.)

  2. Новости про ИИ и нейросети

    В этом разделе публикуем новости о нейросетях и достижениях в развитии искусственного интеллекта.

    Новости проекта Yes Ai - @yes_ai_official. Обновления форума ИИ, новые функции нейросетей для работы с текстом, видео, изображениями и пр.

  3. Другие темы

    В этом разделе вы можете задать вопросы и получить ответы на темы, связанные с нейросетями и проектом Yes Ai. Здесь вы можете узнать, как решить конкретные задачи с ИИ.

    Здесь можно общаться на темы, связанные с нейросетями лишь косвенно. Расскажите о своем опыте, поделитесь кейсами при работе с ИИ - это будет интересно.

    Здесь мы публикуем информацию о бесплатных раздачах доступа к нейросетям в системе @yes_ai_bot, а также объявляем конкурсы, за участие в которых вы можете получать бонусы.

    Здесь вы можете написать свое видение того, что можно улучшить на форуме или в проекте Yes Ai. Форум ИИ про использование нейросетей может стать еще лучше!

    admin
  • Актуальные обсуждения

  • Новые сообщения

    • Вышло обновление Yes AI 2.1 — добавили настройки качества для изображений, расширили работу с референсами и открыли доступ к DeepFace Video. 🔹 GPT Images 2 теперь поддерживает выбор качества генерации Для модели GPT Images 2 появился новый параметр качества. Теперь можно гибко подбирать режим под задачу: быстро собрать картинку для черновика, сделать аккуратную инфографику или получить максимально чистый фотореализм. Доступны три варианта: Low — базовое качество, используется по умолчанию. Хорошо подходит для инфографики, макетов и изображений с текстом. Для реалистичных фото лучше выбрать режим выше. Medium — оптимальный вариант на каждый день. Балансирует между стоимостью, скоростью и качеством. При генерации фотореалистичных изображений заметно меньше визуального шума. High — режим для задач, где нужен лучший результат. Подойдет для коммерческих визуалов, промо-материалов и генераций, к которым предъявляются повышенные требования. 📌 Качество и разрешение — не одно и то же. Разрешение, как и раньше, задается отдельным параметром. А настройка quality влияет именно на уровень проработки результата. Подробнее об этом рассказывали ранее. 🚩 Новый параметр quality уже доступен в API Yes AI для GPT Images 2. Документация обновлена. В боте @yes_ai_bot выбор качества генераций тоже уже появился. 🔹 В Qwen Images открыли полный набор инструментов для работы с референсами Теперь доступны все функции, которые помогают редактировать и улучшать изображения на основе загруженных примеров: удаление фона; восстановление старых фотографий; колоризация черно-белых снимков; другие операции с референсами. Это удобно, когда нужно быстро привести изображение в порядок, подготовить фото для публикации или обновить старый визуал без сложной ручной обработки. 🔹 Добавлен доступ к DeepFace Video В Yes AI 2.1 также открыли доступ к нейросети DeepFace Video. Она позволяет заменить лицо в видео по одной фотографии. Загружаете снимок, выбираете видео — и модель переносит лицо в ролик. Инструмент может пригодиться для контента, тестовых креативов, видеомонтажа и развлекательных сценариев.
    • Замена лица в видео больше не требует ручной обработки каждого кадра. Нейросеть DeepFace Video работает с двумя исходниками: фотографией человека и роликом, где требуется изменить внешность героя. Пользователю достаточно загрузить оба файла и запустить обработку. Составлять длинный промпт и разбираться в сложных настройках не придётся. Качество замены лица зависит от фотографии и исходного ролика. Если часть лица закрывают волосы, человек резко поворачивает голову либо подходит близко к камере, цифровая маска может смещаться. Перед загрузкой проверьте материалы: это снизит риск ошибок и сократит число повторных попыток. Далее разберём, как заменить лицо в видео через DeepFace Video, подготовить исходники и избежать смещения маски. Как работает замена лица в видео Для обработки потребуются два файла: фотография с лицом, которое нужно перенести; видео, в котором будет выполнена замена. Нейросеть анализирует черты лица на фотографии, затем находит человека в ролике и переносит его внешность на обнаруженную область. При этом сохраняются движения головы, мимика и основная динамика исходного видео — насколько точно, зависит от качества материалов и сложности сцены. DeepFace Video заменяет одно лицо. Если персонаж появляется в кадре один, выбор очевиден. Если в первых кадрах находятся несколько людей, действует важное правило: для замены выбирается лицо, расположенное слева. Если в начале ролика виден только один человек, а остальные появляются позднее, обрабатывается то лицо, которое первым появилось на таймлайне. Это нужно учитывать ещё при выборе или монтаже исходного видео. Иногда достаточно обрезать несколько первых кадров, чтобы нужный персонаж оказался первым в ролике. Как сделать замену лица в видео с помощью нейросети DeepFace Video Рабочий процесс состоит из нескольких простых действий: Шаг 1. Выберите DeepFace Video Перейдите по ссылке 👉 DeepFace Video. Создайте новый чат и добавьте название. Так чат с нейросетью будет находится в отдельной вкладке. Шаг 2. Загрузите исходное видео Нажмите на значок скрепки слева от строки ввода. На скриншоте показана подсказка «Загрузите видео для замены лица (mp4)». Выберите ролик в формате MP4 и дождитесь окончания загрузки. Перед добавлением файла необходимо посмотреть видео. Нейросеть заменит лицо, которое первым появится на таймлайне. Если в начальном кадре сразу находятся несколько людей, будет выбрано лицо слева. Шаг 3. Добавьте фотографию лица Загрузите фотографию человека, чьё лицо должно появиться в видео. Для этого используйте соответствующую кнопку добавления изображения в интерфейсе. После загрузки видео необходимо добавить фотографию в формате jpg, jpeg или png. Лучше выбрать чёткий снимок анфас. Лицо должно быть хорошо освещено, находиться в фокусе и не закрываться волосами, очками с сильными бликами, маской или рукой. Нейтральное выражение обычно удобнее для переноса, чем сильно выраженная эмоция. Не стоит брать маленькое лицо из общей фотографии. Даже если сам файл имеет высокое разрешение, нужная область может содержать слишком мало деталей. Шаг 4. Проверьте прикреплённые файлы Перед запуском убедитесь, что загружены оба материала: исходное видео для обработки; фотография с новым лицом. Также проверьте, тот ли ролик выбран и правильно ли он начинается. Если первым появляется не нужный персонаж, лучше заранее обрезать видео или изменить начальный фрагмент. Шаг 5. При необходимости введите запрос Для обычной замены лица промпт не обязателен. Поле «Введите запрос…» можно оставить пустым. Нейросеть DeepFace Video получает основную информацию из фотографии и видеоролика. Подробно описывать внешность человека не нужно. Модель ориентируется на изображение, а не пытается создать лицо только по тексту. Шаг 6. Запустите обработку и проверьте результат Отправьте материалы в обработку и дождитесь готового ролика. Затем посмотрите его полностью, а не только первые секунды. Особое внимание уделите моментам, где человек: поворачивает или наклоняет голову; подносит руку к лицу; проходит через тень; оказывается частично закрыт другим объектом; приближается к камере; быстро меняет выражение лица; выходит из кадра и возвращается. Как подготовить фотографию для замены лица Качественная фотография — один из главных факторов удачной обработки. Лучше использовать портрет анфас, на котором хорошо видны глаза, нос, губы, подбородок и контур лица. Проверьте снимок по короткому списку: лицо находится в фокусе; освещение равномерное; кожа не пересвечена и не скрыта глубокой тенью; голова не повёрнута в профиль; лицо не закрывают волосы и посторонние предметы; на изображении нет сильных фильтров; фотография не размыта; в кадре нет нескольких лиц. Портрет не обязательно должен быть студийным. Подойдёт обычная фотография с телефона, если человек снят достаточно близко, камера не смазала детали, а изображение не пережато при пересылке. Полезный приём: не отправляйте снимок через мессенджер перед загрузкой, если он заметно сжимает файлы. Лучше использовать оригинал фотографии. Каким должно быть исходное видео Нейросети проще работать с чётким и равномерно освещённым роликом. Если лицо состоит из нескольких размытых пикселей, постоянно исчезает в тени или перекрывается предметами, восстановить стабильную маску будет сложно. Желательно, чтобы человек находился примерно в одном-двух метрах от камеры. Это не строгое техническое ограничение, а практический ориентир. При слишком крупном плане становятся заметнее несовпадения текстуры кожи и контуров, а сама замена лица может выглядеть менее аккуратно. Лучше выбирать ролики, где: лицо занимает умеренную часть кадра; персонаж не совершает резких движений; голова не разворачивается надолго в полный профиль; лицо не закрыто руками, волосами, микрофоном или одеждой; освещение не меняется каждую секунду; камера не создаёт сильное размытие в движении; разрешение позволяет различить основные черты лица. Если герой сильно поворачивает голову, маска может «соскочить»: на отдельных кадрах появится исходное лицо, сместятся контуры или возникнет заметное мерцание. Похожая проблема возникает, когда человек выходит из кадра, а затем возвращается под другим углом. Видео номер один.mp4   5424119773_1787369851450579.mp4   5424119773_1787372868671552.mp4 Как выбрать нужного человека, если в кадре несколько лиц DeepFace Video обрабатывает одно обнаруженное лицо. Выбор происходит по началу видеоряда: Нейросеть находит лицо, которое первым появляется на таймлайне. Если в первых кадрах присутствуют несколько людей, выбирается человек слева. Лица других участников сцены остаются без замены. Поэтому групповой ролик лучше предварительно отредактировать. Обрежьте начало так, чтобы нужный человек появился раньше остальных. Другой вариант — добавить в начало короткий фрагмент, где он находится в кадре один. Если нужный герой стоит справа рядом с другим человеком уже на первом кадре, нейросеть, вероятнее всего, выберет левое лицо. Текстовый запрос в такой ситуации не изменит автоматический выбор, поэтому надёжнее подготовить подходящее начало видео. Почему лицо «соскакивает» и как это исправить Смещение маски не всегда означает ошибку сервиса. Часто причина находится в самом видеоматериале. Слишком сильный поворот головы При развороте в профиль часть черт пропадает из кадра. Нейросети становится сложнее сопоставлять лицо с фотографией анфас. Что делать: выбрать фрагмент с более спокойными движениями или сократить проблемный момент при монтаже. Лицо закрыто предметом Рука, волосы, очки с бликами или край одежды могут нарушить отслеживание. Что делать: использовать ролик, где лицо остаётся открытым. Если перекрытие длится всего несколько кадров, проблемный участок можно вырезать. Герой находится слишком близко На очень крупном плане зритель замечает малейшие расхождения. Кроме того, часть головы может выходить за границы кадра. Что делать: выбрать средний или поясной план, снятый примерно с одного-двух метров. Видео размыто или сильно сжато Компрессия стирает мелкие детали и создаёт квадраты вокруг движущихся объектов. Что делать: загружать исходный MP4-файл, а не копию, многократно пересланную через социальные сети или мессенджеры. В кадре быстро меняется свет Вспышки, цветные прожекторы и резкий переход из света в тень усложняют подстройку цифрового лица. Что делать: выбрать сцену с более ровным освещением или разделить длинный ролик на несколько фрагментов. Нужен ли промпт для DeepFace Video? Для замены лица в видео достаточно фотографии и ролика. Промпт не является главным управляющим элементом и в стандартном сценарии может не понадобиться. Это отличает DeepFace Video от генераторов изображений и видео, где текст определяет сюжет, стиль и движение камеры. Здесь содержание уже задано исходным роликом, а фотография показывает, какое лицо необходимо перенести. Если вам необходимо создать DeepFace Video c текстовыми инструкциями, то используйте короткий и однозначный запрос. Не добавляйте требования изменить одежду, фон, освещение и внешность одновременно. Такие задачи относятся к другим видам обработки и не поддерживаются инструментом для замены лица. Быстрый чек-лист перед обработкой DeepFace Video Перед запуском DeepFace Video проверьте следующее: выбрана нейросеть DeepFace Video; видеоролик подготовлен в формате MP4; нужный человек первым появляется на таймлайне; если в начале несколько людей, нужное лицо находится слева; фотография снята анфас; глаза, нос, губы и контур лица хорошо видны; исходники не размыты и не пережаты; лицо в видео ничем не закрыто; персонаж не поворачивается слишком резко; камера расположена не слишком близко; загружены и фотография, и видеоролик; промпт добавлен только при необходимости. Где можно использовать замену лица в видео? Технология подходит для развлекательных роликов, творческих экспериментов, пародий, визуализации персонажей и подготовки контента при наличии необходимых разрешений. Например, можно создать персональное видеопоздравление или проверить, как определённый образ будет смотреться в готовой сцене. Однако реалистичный результат нейросети легко принять за подлинную запись. Поэтому замена лица требует ответственного использования. Не загружайте чужие фотографии без согласия владельца. Не используйте обработанные ролики для обмана, дискредитации, выдачи себя за другого человека, создания поддельных доказательств или обхода систем идентификации. При публикации желательно прямо отмечать, что видео создано или изменено с помощью ИИ. Для коммерческого проекта также нужно проверить права на исходный ролик, изображение, музыку и внешность человека. Заключение Нейросеть для замены лица в видео 👉 DeepFace Video работает по простой схеме: пользователь загружает фотографию и видео в формате MP4, после чего запускает обработку. Промпт обычно не нужен. Главное — правильно подготовить исходники. Используйте чёткую фотографию анфас и качественное видео, где лицо хорошо видно, не закрыто посторонними предметами и не поворачивается слишком резко. Желательно снимать человека не вплотную, а примерно с расстояния одного-двух метров. Заранее проверьте начало ролика. DeepFace Video заменит одно лицо — то, которое первым появится на таймлайне. Если в первых кадрах несколько людей, будет выбрано лицо слева. Эта небольшая деталь часто определяет, получит ли пользователь нужный результат с первой попытки.
    • Нейросеть Stable Diffusion создаёт изображения по текстовому описанию и помогает подобрать визуальный стиль под конкретную задачу. С её помощью можно подготовить иллюстрацию для статьи, портрет персонажа, концепт интерьера, предметную сцену, постер или изображение для публикации в социальных сетях. Однако результат зависит не только от текста запроса. Важны выбранный чекпойнт, сэмплер, количество шагов, уровень креативности, пропорции кадра и другие параметры. Один и тот же промт при разных настройках может дать совершенно разные изображения. Разберём, как создавать изображения, писать промты и настраивать Stable Diffusion 1.5 и Stable Diffusion XL. Отдельное внимание уделим параметрам интерфейса: чекпойнтам, стилям, шумоподавлению, Hires Fix и количеству шагов. Что такое нейросеть Stable Diffusion? Stable Diffusion — семейство диффузионных моделей для генерации и редактирования изображений. Модель начинает работу с визуального шума, а затем постепенно преобразует его в картинку, соответствующую текстовому описанию. Пользователь задаёт содержание сцены с помощью промта и регулирует технические параметры. Например, можно указать: кто или что находится в кадре; где происходит действие; как выглядит освещение; с какого ракурса показана сцена; какой стиль нужно использовать; какие цвета должны преобладать; насколько детализированным должен быть результат. Stable Diffusion 1.5 и Stable Diffusion XL относятся к разным поколениям моделей. У них различаются требования к промтам, рабочее разрешение и характер интерпретации текстового запроса. Stable Diffusion 1.5 обычно хорошо подходит для стилизованных изображений, аниме, портретов и работы со специализированными для этого чекпойнтами. Stable Diffusion XL, или SDXL, лучше понимает естественные описания, увереннее выстраивает сложные сцены и рассчитана на генерацию в более высоком базовом разрешении. При этом название модели само по себе не гарантирует нужного результата. Гораздо важнее правильно подобрать чекпойнт и согласовать с ним промт. Как создавать изображения в Stable Diffusion? Базовый процесс генерации выглядит так: Выберите Stable Diffusion 1.5 или Stable Diffusion XL. Подберите чекпойнт под необходимый тип изображения. Укажите пропорции кадра. Напишите промт с описанием сюжета и визуальных характеристик. При необходимости добавьте негативный промт. Настройте сэмплер, количество шагов и уровень креативности. При необходимости включите Hires Fix. Создайте несколько вариантов. Сравните результаты и скорректируйте только те части запроса, которые требуют изменения. Последний пункт особенно важен. Если после каждой попытки полностью переписывать запрос и одновременно менять все параметры, определить причину улучшения или ухудшения результата будет сложно. Работайте поэтапно. Сначала добейтесь правильной композиции. Затем уточните внешность персонажа, материалы, свет и цвет. После этого можно увеличивать разрешение и исправлять мелкие детали. Пошаговая инструкция по работе с интерфейсом Stable Diffusion По ссылке откройте нейросеть 👉 Stable Diffusion 1.5 или 👉 Stable Diffusion XL. Для удобства и сравнения результатов создайте два новых чата под каждую модель соответственно (см. скриншот выше).  Шаг 1. Выберите модель Для стилизованных изображений и для понимания принципов работы с различными чекпойнтами можно начать со Stable Diffusion 1.5. Если нужна сложная композиция, более естественное понимание запроса или крупный исходный размер, целесообразно выбрать Stable Diffusion XL. Шаг 2. Откройте настройки Нажмите кнопку с изображением шестерёнки в меню, затем выберите необходимые параметры. В меню доступны следующие параметры: чекпойнт; сэмплер; пропорции; креативность; шумоподавление; количество шагов; количество копий; Hires Fix; настройки стилей. Шаг 3. Выберите чекпойнт и стиль   Шаг 4. Задайте пропорции   Шаг 5. Напишите промт   Шаг 6. Запустите генерацию     Шаг 7. Сохраните изображение или доработайте промт   Что такое чекпоинт в нейросети Stable Diffusion? Чекпойнт — это файл с весами модели, обученной или дополнительно настроенной на определённом наборе изображений. Он влияет на анатомию, палитру, фактуру, освещение и общую эстетику результата. В настройках на скриншоте выбран чекпойнт "Anything". Этот чекпойнт, ориентирован прежде всего на аниме-эстетику и рисованных персонажей. Такой чекпойнт логично сочетать со стилями Anime и Detailed, а также с промтами, описывающими дизайн героя, одежду, выражение лица и фон. Условно чекпойнты можно разделить на несколько категорий: фотореалистичные; аниме; цифровая иллюстрация; фэнтези; трёхмерная графика; универсальные модели. Сначала определите тип нужного вам результата, а уже затем выбирайте чекпойнт. Если нужен реалистичный кадр, аниме-модель придётся постоянно «переубеждать» с помощью промта, в этом случае логичнее выбрать другую модель, например: "Realistic". Даже подробный запрос не всегда сможет полностью изменить заложенные в модель особенности обучения. Не стоит считать чекпойнт обычным фильтром. Это не эффект, который накладывается в конце. Он участвует в создании изображения с первого шага и определяет, какие визуальные решения должны быть в приоритете. Как писать промты для Stable Diffusion 1.5 Stable Diffusion 1.5 лучше работает с компактными смысловыми блоками и конкретными тегами. Длинный литературный текст модель может интерпретировать непредсказуемо, особенно если в нём много второстепенных деталей. Удобный шаблон промта: Тип изображения + главный объект + внешность или свойства + действие или поза + окружение + композиция + освещение + стиль + детализация Пример: anime illustration, young female astronomer, short silver hair, dark blue coat, standing on an observatory balcony, holding a glowing star map, night sky, medium shot, moonlight, blue and violet color palette, detailed background В таком запросе: `anime illustration` задаёт тип изображения; `young female astronomer` определяет персонажа; `short silver hair, dark blue coat` описывает внешность и одежду; `standing on an observatory balcony` задаёт позу и место; `holding a glowing star map` добавляет действие; `medium shot` определяет план; `moonlight` описывает освещение; `blue and violet color palette` задаёт палитру; `detailed background` уточняет уровень и характер детализации. Для Stable Diffusion 1.5 порядок слов имеет значение. Важные элементы лучше ставить ближе к началу. Не перегружайте промт длинными списками похожих определений: `beautiful, stunning, amazing, gorgeous`, они почти не добавляют полезной информации. Вместо общих оценок используйте наблюдаемые признаки: soft side lighting, symmetrical composition, embroidered fabric, shallow depth of field Такие формулировки объясняют модели, что именно должно появиться в кадре. Пример промта для портрета в Stable Diffusion 1.5: portrait photo of a middle-aged ceramic artist, thoughtful expression, linen apron, clay workshop, handmade pottery in the background, warm window light, shallow depth of field, natural skin texture, muted earthy colors Возможный негативный промт: low quality, blurry, deformed hands, extra fingers, duplicate person, asymmetrical eyes, oversaturated colors, text, watermark, logo Негативный промт перечисляет нежелательные элементы. Его не следует превращать в огромную коллекцию случайных тегов. Добавляйте только те ограничения, которые соответствуют текущей сцене и действительно помогают устранить повторяющиеся дефекты. Для добавления негативного промта в конце вашего промта добавьте команду /np. Тогда запрос для нейросети будет выглядеть так:  portrait photo of a middle-aged ceramic artist, thoughtful expression, linen apron, clay workshop, handmade pottery in the background, warm window light, shallow depth of field, natural skin texture, muted earthy colors /np low quality, blurry, deformed hands, extra fingers, duplicate person, asymmetrical eyes, oversaturated colors, text, watermark, logo. Как писать промты для Stable Diffusion XL Stable Diffusion XL лучше понимает связные и естественные описания. Для SDXL можно использовать не только теги, но и полноценные предложения, сохраняя ясную структуру. Подходящий шаблон: Что изображено + что происходит + где находится объект + как построена композиция + каким должен быть свет + визуальная стилистика + важные детали качества Пример: A cinematic editorial photograph of a young architect working alone in a spacious concrete studio. She is examining a scale model of a sustainable house beside a large window. Soft overcast daylight creates gentle shadows, while the neutral gray interior is balanced by warm wooden details. Eye-level composition, realistic materials, restrained color palette, subtle film grain. Этот запрос описывает не набор отдельных признаков, а целостную сцену. Stable Diffusion XL лучше связывает объект, действие и окружение, если между ними обозначены логические отношения. Но и SDXL не стоит перегружать. Если в одном промте одновременно запросить пять персонажей, несколько действий, сложный интерьер и множество мелких предметов, часть деталей может потеряться или появится множество деформаций объектов. Полезный приём — разделить описание на уровни: Сначала обозначить основной сюжет. Затем добавить композицию и ракурс. После этого описать свет и палитру. В конце перечислить несколько критически важных деталей. Пример промта для предметной сцены в Stable Diffusion XL: A minimalist product photograph of a matte black wireless speaker standing on a pale limestone pedestal. Thin rays of morning sunlight pass through blinds and form geometric shadows on the background. Front three-quarter view, clean composition, realistic surface texture, soft beige and charcoal color palette, premium editorial photography. Негативный промт: /np distorted product, duplicated object, warped geometry, unreadable labels, text, logo, watermark, cluttered background, harsh reflections Если на корпусе должен быть точный логотип или читаемая надпись, надёжнее добавить их после генерации в графическом редакторе. Модели SD могут создавать буквы, отдалённо похожие на текст, но не корректно воспроизводят конкретное написание. Чем отличаются промты для Stable Diffusion 1.5 и Stable Diffusion XL? Для Stable Diffusion 1.5 чаще используют последовательность тегов: fantasy library, young wizard, floating books, candlelight, wide shot, intricate details, digital painting Для Stable Diffusion XL ту же сцену можно описать естественнее: A young wizard stands in the center of an ancient fantasy library while open books float around him. Hundreds of candles illuminate tall wooden shelves, creating a warm and mysterious atmosphere. Wide composition, detailed digital painting, deep perspective. Главное отличие не в том, что Stable Diffusion 1.5 понимает только теги, а Stable Diffusion XL — только предложения. Обе модели могут работать с разными формами текста. Речь идёт о практической тенденции: SD 1.5 часто увереннее реагирует на короткие конкретные конструкции, а SDXL лучше понимает смысл связного описания. Шаблоны промтов и примеры генераций Ниже приведены шаблоны, которые можно адаптировать под собственные задачи. Текст в квадратных скобках следует заменить нужными параметрами. Шаблон для портрета [тип изображения] of [персонаж], [возраст и внешность], [одежда], [выражение лица], [фон], [тип освещения], [крупность плана], [палитра], [стилистика] Пример для Stable Diffusion 1.5: digital portrait of a young botanist, curly red hair, round glasses, green field jacket, calm expression, greenhouse background, soft diffused sunlight, close-up, natural green palette, detailed illustration Ожидаемый результат: поясной или крупный портрет исследовательницы в оранжерее, мягкий свет, зелёная палитра и рисованная детализация. Шаблон для интерьера [тип помещения], [архитектурный стиль], [основные материалы], [мебель], [свет], [ракурс], [палитра], [уровень реализма] Пример для Stable Diffusion XL: A compact reading room in a contemporary Japanese style, with light oak wall panels, built-in bookshelves and a low cream armchair. Late afternoon sunlight enters through a narrow window and creates soft shadows. Wide-angle interior photography, warm neutral palette, realistic materials, uncluttered composition. Ожидаемый результат: спокойный интерьер с понятным зонированием, натуральными материалами и мягким дневным светом. Шаблон для персонажа в аниме-стиле anime character, [пол и роль], [причёска], [одежда], [поза], [локация], [освещение], [палитра], detailed background, clean line art Пример: anime character, female train conductor, long black braid, navy uniform with brass buttons, standing beside a vintage mountain train, early morning mist, soft golden light, teal and amber palette, detailed background, clean line art С чекпойнтом Anything и стилем Anime модель должна сформировать рисованного персонажа на фоне поезда. Если лицо получилось удачным, а фон — слишком простым, не меняйте описание героини. Добавьте конкретные признаки окружения: каменная платформа, горы, пар. Шаблон для рекламной предметной сцены product photograph of [предмет], [материал и цвет], placed on [поверхность], [фон], [освещение], [ракурс], [композиция], [палитра], realistic texture Пример для SDXL: product photograph of a translucent blue glass perfume bottle, placed on wet dark stone, misty gradient background, narrow side lighting, front three-quarter view, centered composition, blue and graphite palette, realistic glass texture, subtle reflections Ожидаемый результат: предметный кадр с направленным светом и контролируемой цветовой гаммой. Если модель добавляет надписи, укажите в негативном промте `/np text, letters, logo, watermark`. Сэмплер: как модель формирует изображение Сэмплер определяет алгоритм, по которому модель удаляет шум и собирает изображение. В интерфейсе на скриншоте выбран "Euler a". "Euler a" часто даёт выразительные результаты при сравнительно небольшом количестве шагов. Он подходит для быстрых экспериментов, иллюстраций и аниме. Буква `a` означает ancestral: на отдельных этапах алгоритм добавляет вариативность, поэтому повторные генерации могут заметнее отличаться друг от друга. Если результат выглядит интересно, но нестабильно, попробуйте другой доступный сэмплер. Для более спокойной и предсказуемой детализации применяются варианты "DPM++". Менять сэмплер имеет смысл, когда: детали выглядят чрезмерно резкими или рыхлыми; модель плохо удерживает мелкие элементы; при том же промте нужна другая пластика изображения; результат перестаёт улучшаться при увеличении количества шагов. Не существует одного сэмплера для всех задач. Сравнивайте разные варианты генераций при одинаковом промте, разрешении и числе шагов на разных сэмплерах. Пропорции и разрешение изображения в SD На скриншоте выбран вертикальный формат с пропорциями 16:21. Формат влияет не только на размер, но и на композицию: вертикальный кадр подходит для персонажей, постеров и обложек; квадратный — для портретов, предметов и публикаций в ленте; горизонтальный — для пейзажей, интерьеров и сцен с несколькими объектами; широкий панорамный — для окружения, архитектуры и кинематографичных планов. Stable Diffusion 1.5 изначально лучше чувствует себя на умеренных разрешениях. Слишком большой исходный холст может привести к повторяющимся лицам, лишним конечностям или дублированию объектов. Для увеличения качества генерации разумно использовать Hires Fix. Stable Diffusion XL рассчитана на более крупное базовое разрешение. Тем не менее экстремально вытянутые форматы тоже способны нарушать композицию. Поэтому для увеличения разрешения удачных генераций следует использовать отдельную функцию в меню. Параметр креативности в Stable Diffusion В показанных настройках значение креативности установлено на 7. Этот параметр связан с силой следования текстовому запросу, по другому этот параметр называют "CFG Scale". При умеренном значении модель сохраняет баланс между промтом и собственными визуальными решениями. Слишком низкий уровень может ослабить связь с запросом. Слишком высокий — сделать изображение жёстким, перенасыщенным или визуально неестественным. Начинайте со среднего значения. Затем меняйте его небольшими шагами: снижайте, если изображение выглядит перегруженным или искусственным; повышайте, если модель систематически игнорирует важные слова; не пытайтесь исправить неясный промт только усилением креативности. Если персонаж должен держать красный зонт, сначала проверьте, ясно ли это написано в промте и не конфликтует ли действие с другими частями запроса. Лишь затем регулируйте параметр. Шумоподавление в нейросети Stable Diffusion На скриншоте указано шумоподавление 0,4. Этот параметр особенно важен при Hires Fix и обработке исходного изображения. Низкое значение лучше сохраняет исходную композицию и черты персонажа. Высокое разрешает модели сильнее перерисовывать картинку. Условная логика работы выглядит так: низкое шумоподавление — аккуратное уточнение деталей; среднее — заметная переработка текстур при сохранении сюжета; высокое — существенное изменение исходного изображения. Значение 0,4 можно использовать как отправную точку для увеличения разрешения: модель получает пространство для добавления деталей, но не должна полностью перестраивать сцену. Для сохранения оригинала используйте наименьшее значение. Если после Hires Fix меняется лицо или одежда, уменьшите шумоподавление. Если изображение увеличилось, но осталось размытым и почти не получило новых деталей, попробуйте немного повысить его. Параметр "Количество шагов" в настройках Stable Diffusion На скриншоте установлено 22 шага. Количество шагов показывает, сколько итераций удаления шума выполняет модель. Больше шагов не всегда означает более качественный результат. После определённого момента различия становятся небольшими, а время генерации продолжает расти. Иногда чрезмерное число шагов делает изображение жёстким или подчёркивает лишние детали. Для первоначальной генерации удобно выбирать умеренное значение и оценивать: сформировалась ли композиция; не деформируются ли лица и предметы; достаточно ли проработаны материалы; нет ли визуального шума. Если изображение выглядит недостроенным, увеличьте количество шагов. Если оно уже сформировано, но содержит смысловые ошибки, дополнительные итерации вряд ли помогут. В этом случае лучше изменить промт, чекпойнт или композицию. Количество копий в Stable Diffusion В настройках выбрана одна копия. Этот параметр определяет, сколько вариантов будет создано за один запуск. Одна копия удобна при точной настройке и экономии вычислительных ресурсов. Несколько копий полезны на этапе поиска композиции, поскольку генерация SD содержит элемент случайности. Практичный порядок работы: Создайте несколько черновых вариантов. Выберите наиболее удачную композицию. Сохраните удачный промт. Доработайте настройки. Используйте Hires Fix. Количество копий не следует путать с последовательным улучшением одной картинки. Каждый вариант является самостоятельной генерацией. Hires Fix в Stable Diffusion: улучшение качества генерации  На скриншоте функция "Hires Fix" включена. Нейросеть SD при активированной функции "Hires Fix" выполняет генерацию в два этапа: сначала создаёт изображение в базовом размере, затем дополнительно уточняет его. Hires Fix незаменим для Stable Diffusion 1.5, особенно при создании вертикальных портретов и детализированных иллюстраций.  Используйте Hires Fix, когда: исходная композиция уже устраивает; требуется больше деталей в лице, одежде или окружении; нужно получить чёткое изображение; базовая генерация выглядит размытой. Важно понимать: Hires Fix не исправляет слабую композицию автоматически. Он может усилить уже существующие ошибки. Настройки стилей в нейросети Stable Diffusion На скриншоте в меню SD вы можете увидеть перечень предустановленных стилей, расположенных в алфавитном порядке. Одновременно допускается использование трёх стилей. Стиль обычно добавляет к запросу заранее подготовленные визуальные признаки. Например: Anime усиливает рисованную эстетику; Detailed может повышать насыщенность мелкими элементами; Cinematic добавляет характерное освещение и композицию; Photo смещает результат в сторону фотографии. Не включайте сразу три стиля. Они могут конфликтовать друг с другом и с выбранным чекпойнтом. Для чекпойнта Anything сочетание с Anime логично, поскольку оба параметра направляют генерацию в одну сторону. Полезный тест — создать изображение с одним стилем и без него, оставив остальные настройки одинаковыми. Так будет видно, какой вклад действительно вносит используемый пресет. Как получить управляемый результат в Stable Diffusion? У Stable Diffusion нет кнопки, которая автоматически исправляет все проблемы. Зато есть понятный порядок диагностики. Если модель игнорирует главный объект, перенесите его описание в начало промта и удалите конкурирующие детали. Если фон получается пустым, не пишите только `detailed background`. Перечислите конкретные элементы окружения. Если портрет выглядит неестественно, уточните крупность плана, тип света и выражение лица. Проверьте, подходит ли чекпойнт для реалистичных изображений. Если персонаж дублируется, уменьшите исходное разрешение или измените пропорции. Для Stable Diffusion 1.5 используйте Hires Fix. Если результат перегружен, сократите промт. Иногда проблема вызвана не недостатком описания, а конфликтом между его частями. Если меняется слишком многое, корректируйте по одному параметру. Например, сначала замените чекпойнт, но сохраните промт и шаги. Затем сравните результат. Такой подход занимает немного больше времени, зато позволяет понять поведение модели. Частые ошибки при работе со Stable Diffusion Промт состоит из абстрактных оценок Слова «красивый», «качественный» и «необычный» не объясняют, как должно выглядеть изображение. Заменяйте их описанием света, композиции, материалов и палитры. В одном запросе слишком много сюжетов Модель хуже справляется, когда должна одновременно показать портрет, городскую панораму, сложное действие и десятки мелких объектов. Определите главный визуальный центр. Чекпойнт не соответствует задаче Аниме-чекпойнт не является оптимальной основой для реалистичной предметной фотографии. Промт не всегда способен преодолеть особенности модели. Все параметры меняются одновременно После такого эксперимента невозможно понять, что повлияло на результат. Меняйте одну настройку и сохраняйте удачные комбинации. Hires Fix не используется Используйте этот параметр, особенно для SD 1.5 - это заметно улучшает качество генерации. Негативный промт перегружен Слишком длинный список ограничений может сделать изображение менее естественным. Начните с нескольких типичных дефектов и расширяйте список только при необходимости. Краткая инструкция по работе с нейросетью Stable Diffusion Чтобы создавать изображения в нейросети Stable Diffusion без хаотичного перебора настроек, придерживайтесь последовательности: Определите задачу и формат. Выберите Stable Diffusion 1.5 или Stable Diffusion XL. Подберите подходящий чекпойнт. Напишите промт, начиная с главного объекта. Укажите окружение, композицию, свет и стиль. Добавьте короткий негативный промт при необходимости. Используйте умеренное количество шагов и средний уровень креативности. Создайте несколько черновых вариантов. Исправьте смысловые и логические ошибки в промте. Включите Hires Fix. Проверьте изображение в полном размере на наличие дефектов. Нейросеть Stable Diffusion становится заметно понятнее, если относиться к генерации как к последовательной настройке сцены. Промт отвечает за содержание, чекпойнт — за визуальную основу, сэмплер — за способ формирования изображения, а технические параметры регулируют детализацию и степень проработки. Stable Diffusion 1.5 удобна для экспериментов со стилями. Stable Diffusion XL лучше подходит для связных описаний и сложных сцен. В обоих случаях наиболее полезная привычка — сохранять удачные промты и настройки. Со временем из них складывается собственная библиотека рабочих шаблонов, которую можно быстро адаптировать под портреты, иллюстрации, интерьеры и предметные изображения.
  • Генерации из нейросетей

×
×
  • Создать...