Перейти к содержанию

Чем полезен форум Yes Ai ?

  • Здесь вы найдете статьи о нейросетях: Midjourney, ChatGPT, Stable Diffusion, Sora, Flux.1, Kling Ai и других
  • Масса полезных инструкций для решения задач с помощью современных моделей ИИ
Статьи

Галерея бесплатных промтов

Откройте нашу галерею с бесплатными промтами для генерации изображений в нейросетях

Sora Images, Midjourney, SDXL, Stable Diffusion и Dalle-3

Галерея

API нейросетей для разработчиков

Добавьте функции нейросетей в собственное мобильное приложение,

веб-сайт или Telegram-бота

API

Хотите задать вопрос о нейросетях ?

Подробно опишите задачу, которую хотите решить с помощью ИИ,

а участники нашего сообщества постараются вам помочь. Это бесплатно!

Спросить
  • Форум о нейросетях и искусственном интеллекте

    ✌️ На форуме ИИ про нейросети Yes Ai размещены полезные статьи и бесплатные обучающие материалы про Midjourney, Chat GPT, Flux.1, Kling Ai, Stable Diffusion, SXDL и др. В галерее вы найдете множество промтов для генерации изображений в нейросетях.

    • Активность на форуме позволит получать бесплатные генерации в нейросетях через Telegram-бота @yes_ai_bot
    • Рекомендуем начать изучение форума про ИИ с прочтения статей 👇 или просмотра галереи работ нашего сообщества

    Добро пожаловать!

     

Форум ИИ о нейросетях

  1. Обсуждаем нейросети и искусственный интеллект

    В этом разделе обсуждаем нейронные сети, которые работают с видео, включая создание, стилизацию, редактирование видео и многое другое.

    Описание всех функций нейросети Nano Banana: генерация картинок по промтам и референсам (исходным фото), редактирование изображений и фотографий.

    Полезные статьи о нейросети для генерации изображений Midjourney. Как делать генерации в Миджорни, как писать промты, команды для нейросети.

    Sora Images

    • 38 постов

    Статьи о возможностях нейросети для генерации изображений Sora Images, разработанной компанией Open Ai. Промты, функции и настройки.

    Qwen Images

    • 41 пост

    Статьи про возможности нейросети Qwen Images и Qwen Edit для генерации изображений по промтам и референсам: полезные советы и примеры использования.

    Полезные статьи об использовании нейросети Flux.1 и ее расширенных возможностей. Как использовать LoRA и другие функции Flux.

    Советы и лайфхаки по использованию нейросети для работы с текстом Chat GPT / Gemma / LLaMA

    Описываем функции легендарной нейросети Stable Diffusion, позволяющей генерировать изображения и модифицировать их. Inpaint, Upscale и редактирование изображений.

    В этой ветке обсуждаем другие нейронные сети, которых нет в основном списке (например, HeyGen, Deforum и пр.)

  2. Новости про ИИ и нейросети

    В этом разделе публикуем новости о нейросетях и достижениях в развитии искусственного интеллекта.

    Новости проекта Yes Ai - @yes_ai_official. Обновления форума ИИ, новые функции нейросетей для работы с текстом, видео, изображениями и пр.

  3. Другие темы

    В этом разделе вы можете задать вопросы и получить ответы на темы, связанные с нейросетями и проектом Yes Ai. Здесь вы можете узнать, как решить конкретные задачи с ИИ.

    Здесь можно общаться на темы, связанные с нейросетями лишь косвенно. Расскажите о своем опыте, поделитесь кейсами при работе с ИИ - это будет интересно.

    Здесь мы публикуем информацию о бесплатных раздачах доступа к нейросетям в системе @yes_ai_bot, а также объявляем конкурсы, за участие в которых вы можете получать бонусы.

    Здесь вы можете написать свое видение того, что можно улучшить на форуме или в проекте Yes Ai. Форум ИИ про использование нейросетей может стать еще лучше!

    admin
  • Актуальные обсуждения

  • Новые сообщения

    • Нейросеть Stable Diffusion создаёт изображения по текстовому описанию и помогает подобрать визуальный стиль под конкретную задачу. С её помощью можно подготовить иллюстрацию для статьи, портрет персонажа, концепт интерьера, предметную сцену, постер или изображение для публикации в социальных сетях. Однако результат зависит не только от текста запроса. Важны выбранный чекпойнт, сэмплер, количество шагов, уровень креативности, пропорции кадра и другие параметры. Один и тот же промт при разных настройках может дать совершенно разные изображения. Разберём, как создавать изображения, писать промты и настраивать Stable Diffusion 1.5 и Stable Diffusion XL. Отдельное внимание уделим параметрам интерфейса: чекпойнтам, стилям, шумоподавлению, Hires Fix и количеству шагов. Что такое нейросеть Stable Diffusion? Stable Diffusion — семейство диффузионных моделей для генерации и редактирования изображений. Модель начинает работу с визуального шума, а затем постепенно преобразует его в картинку, соответствующую текстовому описанию. Пользователь задаёт содержание сцены с помощью промта и регулирует технические параметры. Например, можно указать: кто или что находится в кадре; где происходит действие; как выглядит освещение; с какого ракурса показана сцена; какой стиль нужно использовать; какие цвета должны преобладать; насколько детализированным должен быть результат. Stable Diffusion 1.5 и Stable Diffusion XL относятся к разным поколениям моделей. У них различаются требования к промтам, рабочее разрешение и характер интерпретации текстового запроса. Stable Diffusion 1.5 обычно хорошо подходит для стилизованных изображений, аниме, портретов и работы со специализированными для этого чекпойнтами. Stable Diffusion XL, или SDXL, лучше понимает естественные описания, увереннее выстраивает сложные сцены и рассчитана на генерацию в более высоком базовом разрешении. При этом название модели само по себе не гарантирует нужного результата. Гораздо важнее правильно подобрать чекпойнт и согласовать с ним промт. Как создавать изображения в Stable Diffusion? Базовый процесс генерации выглядит так: Выберите Stable Diffusion 1.5 или Stable Diffusion XL. Подберите чекпойнт под необходимый тип изображения. Укажите пропорции кадра. Напишите промт с описанием сюжета и визуальных характеристик. При необходимости добавьте негативный промт. Настройте сэмплер, количество шагов и уровень креативности. При необходимости включите Hires Fix. Создайте несколько вариантов. Сравните результаты и скорректируйте только те части запроса, которые требуют изменения. Последний пункт особенно важен. Если после каждой попытки полностью переписывать запрос и одновременно менять все параметры, определить причину улучшения или ухудшения результата будет сложно. Работайте поэтапно. Сначала добейтесь правильной композиции. Затем уточните внешность персонажа, материалы, свет и цвет. После этого можно увеличивать разрешение и исправлять мелкие детали. Пошаговая инструкция по работе с интерфейсом Stable Diffusion По ссылке откройте нейросеть 👉 Stable Diffusion 1.5 или 👉 Stable Diffusion XL. Для удобства и сравнения результатов создайте два новых чата под каждую модель соответственно (см. скриншот выше).  Шаг 1. Выберите модель Для стилизованных изображений и для понимания принципов работы с различными чекпойнтами можно начать со Stable Diffusion 1.5. Если нужна сложная композиция, более естественное понимание запроса или крупный исходный размер, целесообразно выбрать Stable Diffusion XL. Шаг 2. Откройте настройки Нажмите кнопку с изображением шестерёнки в меню, затем выберите необходимые параметры. В меню доступны следующие параметры: чекпойнт; сэмплер; пропорции; креативность; шумоподавление; количество шагов; количество копий; Hires Fix; настройки стилей. Шаг 3. Выберите чекпойнт и стиль   Шаг 4. Задайте пропорции   Шаг 5. Напишите промт   Шаг 6. Запустите генерацию     Шаг 7. Сохраните изображение или доработайте промт   Что такое чекпоинт в нейросети Stable Diffusion? Чекпойнт — это файл с весами модели, обученной или дополнительно настроенной на определённом наборе изображений. Он влияет на анатомию, палитру, фактуру, освещение и общую эстетику результата. В настройках на скриншоте выбран чекпойнт "Anything". Этот чекпойнт, ориентирован прежде всего на аниме-эстетику и рисованных персонажей. Такой чекпойнт логично сочетать со стилями Anime и Detailed, а также с промтами, описывающими дизайн героя, одежду, выражение лица и фон. Условно чекпойнты можно разделить на несколько категорий: фотореалистичные; аниме; цифровая иллюстрация; фэнтези; трёхмерная графика; универсальные модели. Сначала определите тип нужного вам результата, а уже затем выбирайте чекпойнт. Если нужен реалистичный кадр, аниме-модель придётся постоянно «переубеждать» с помощью промта, в этом случае логичнее выбрать другую модель, например: "Realistic". Даже подробный запрос не всегда сможет полностью изменить заложенные в модель особенности обучения. Не стоит считать чекпойнт обычным фильтром. Это не эффект, который накладывается в конце. Он участвует в создании изображения с первого шага и определяет, какие визуальные решения должны быть в приоритете. Как писать промты для Stable Diffusion 1.5 Stable Diffusion 1.5 лучше работает с компактными смысловыми блоками и конкретными тегами. Длинный литературный текст модель может интерпретировать непредсказуемо, особенно если в нём много второстепенных деталей. Удобный шаблон промта: Тип изображения + главный объект + внешность или свойства + действие или поза + окружение + композиция + освещение + стиль + детализация Пример: anime illustration, young female astronomer, short silver hair, dark blue coat, standing on an observatory balcony, holding a glowing star map, night sky, medium shot, moonlight, blue and violet color palette, detailed background В таком запросе: `anime illustration` задаёт тип изображения; `young female astronomer` определяет персонажа; `short silver hair, dark blue coat` описывает внешность и одежду; `standing on an observatory balcony` задаёт позу и место; `holding a glowing star map` добавляет действие; `medium shot` определяет план; `moonlight` описывает освещение; `blue and violet color palette` задаёт палитру; `detailed background` уточняет уровень и характер детализации. Для Stable Diffusion 1.5 порядок слов имеет значение. Важные элементы лучше ставить ближе к началу. Не перегружайте промт длинными списками похожих определений: `beautiful, stunning, amazing, gorgeous`, они почти не добавляют полезной информации. Вместо общих оценок используйте наблюдаемые признаки: soft side lighting, symmetrical composition, embroidered fabric, shallow depth of field Такие формулировки объясняют модели, что именно должно появиться в кадре. Пример промта для портрета в Stable Diffusion 1.5: portrait photo of a middle-aged ceramic artist, thoughtful expression, linen apron, clay workshop, handmade pottery in the background, warm window light, shallow depth of field, natural skin texture, muted earthy colors Возможный негативный промт: low quality, blurry, deformed hands, extra fingers, duplicate person, asymmetrical eyes, oversaturated colors, text, watermark, logo Негативный промт перечисляет нежелательные элементы. Его не следует превращать в огромную коллекцию случайных тегов. Добавляйте только те ограничения, которые соответствуют текущей сцене и действительно помогают устранить повторяющиеся дефекты. Для добавления негативного промта в конце вашего промта добавьте команду /np. Тогда запрос для нейросети будет выглядеть так:  portrait photo of a middle-aged ceramic artist, thoughtful expression, linen apron, clay workshop, handmade pottery in the background, warm window light, shallow depth of field, natural skin texture, muted earthy colors /np low quality, blurry, deformed hands, extra fingers, duplicate person, asymmetrical eyes, oversaturated colors, text, watermark, logo. Как писать промты для Stable Diffusion XL Stable Diffusion XL лучше понимает связные и естественные описания. Для SDXL можно использовать не только теги, но и полноценные предложения, сохраняя ясную структуру. Подходящий шаблон: Что изображено + что происходит + где находится объект + как построена композиция + каким должен быть свет + визуальная стилистика + важные детали качества Пример: A cinematic editorial photograph of a young architect working alone in a spacious concrete studio. She is examining a scale model of a sustainable house beside a large window. Soft overcast daylight creates gentle shadows, while the neutral gray interior is balanced by warm wooden details. Eye-level composition, realistic materials, restrained color palette, subtle film grain. Этот запрос описывает не набор отдельных признаков, а целостную сцену. Stable Diffusion XL лучше связывает объект, действие и окружение, если между ними обозначены логические отношения. Но и SDXL не стоит перегружать. Если в одном промте одновременно запросить пять персонажей, несколько действий, сложный интерьер и множество мелких предметов, часть деталей может потеряться или появится множество деформаций объектов. Полезный приём — разделить описание на уровни: Сначала обозначить основной сюжет. Затем добавить композицию и ракурс. После этого описать свет и палитру. В конце перечислить несколько критически важных деталей. Пример промта для предметной сцены в Stable Diffusion XL: A minimalist product photograph of a matte black wireless speaker standing on a pale limestone pedestal. Thin rays of morning sunlight pass through blinds and form geometric shadows on the background. Front three-quarter view, clean composition, realistic surface texture, soft beige and charcoal color palette, premium editorial photography. Негативный промт: /np distorted product, duplicated object, warped geometry, unreadable labels, text, logo, watermark, cluttered background, harsh reflections Если на корпусе должен быть точный логотип или читаемая надпись, надёжнее добавить их после генерации в графическом редакторе. Модели SD могут создавать буквы, отдалённо похожие на текст, но не корректно воспроизводят конкретное написание. Чем отличаются промты для Stable Diffusion 1.5 и Stable Diffusion XL? Для Stable Diffusion 1.5 чаще используют последовательность тегов: fantasy library, young wizard, floating books, candlelight, wide shot, intricate details, digital painting Для Stable Diffusion XL ту же сцену можно описать естественнее: A young wizard stands in the center of an ancient fantasy library while open books float around him. Hundreds of candles illuminate tall wooden shelves, creating a warm and mysterious atmosphere. Wide composition, detailed digital painting, deep perspective. Главное отличие не в том, что Stable Diffusion 1.5 понимает только теги, а Stable Diffusion XL — только предложения. Обе модели могут работать с разными формами текста. Речь идёт о практической тенденции: SD 1.5 часто увереннее реагирует на короткие конкретные конструкции, а SDXL лучше понимает смысл связного описания. Шаблоны промтов и примеры генераций Ниже приведены шаблоны, которые можно адаптировать под собственные задачи. Текст в квадратных скобках следует заменить нужными параметрами. Шаблон для портрета [тип изображения] of [персонаж], [возраст и внешность], [одежда], [выражение лица], [фон], [тип освещения], [крупность плана], [палитра], [стилистика] Пример для Stable Diffusion 1.5: digital portrait of a young botanist, curly red hair, round glasses, green field jacket, calm expression, greenhouse background, soft diffused sunlight, close-up, natural green palette, detailed illustration Ожидаемый результат: поясной или крупный портрет исследовательницы в оранжерее, мягкий свет, зелёная палитра и рисованная детализация. Шаблон для интерьера [тип помещения], [архитектурный стиль], [основные материалы], [мебель], [свет], [ракурс], [палитра], [уровень реализма] Пример для Stable Diffusion XL: A compact reading room in a contemporary Japanese style, with light oak wall panels, built-in bookshelves and a low cream armchair. Late afternoon sunlight enters through a narrow window and creates soft shadows. Wide-angle interior photography, warm neutral palette, realistic materials, uncluttered composition. Ожидаемый результат: спокойный интерьер с понятным зонированием, натуральными материалами и мягким дневным светом. Шаблон для персонажа в аниме-стиле anime character, [пол и роль], [причёска], [одежда], [поза], [локация], [освещение], [палитра], detailed background, clean line art Пример: anime character, female train conductor, long black braid, navy uniform with brass buttons, standing beside a vintage mountain train, early morning mist, soft golden light, teal and amber palette, detailed background, clean line art С чекпойнтом Anything и стилем Anime модель должна сформировать рисованного персонажа на фоне поезда. Если лицо получилось удачным, а фон — слишком простым, не меняйте описание героини. Добавьте конкретные признаки окружения: каменная платформа, горы, пар. Шаблон для рекламной предметной сцены product photograph of [предмет], [материал и цвет], placed on [поверхность], [фон], [освещение], [ракурс], [композиция], [палитра], realistic texture Пример для SDXL: product photograph of a translucent blue glass perfume bottle, placed on wet dark stone, misty gradient background, narrow side lighting, front three-quarter view, centered composition, blue and graphite palette, realistic glass texture, subtle reflections Ожидаемый результат: предметный кадр с направленным светом и контролируемой цветовой гаммой. Если модель добавляет надписи, укажите в негативном промте `/np text, letters, logo, watermark`. Сэмплер: как модель формирует изображение Сэмплер определяет алгоритм, по которому модель удаляет шум и собирает изображение. В интерфейсе на скриншоте выбран Euler a. Euler a часто даёт выразительные результаты при сравнительно небольшом количестве шагов. Он подходит для быстрых экспериментов, иллюстраций и аниме. Буква `a` означает ancestral: на отдельных этапах алгоритм добавляет вариативность, поэтому повторные генерации могут заметнее отличаться друг от друга. Если результат выглядит интересно, но нестабильно, попробуйте другой доступный сэмплер. Для более спокойной и предсказуемой детализации применяются варианты DPM++. Менять сэмплер имеет смысл, когда: детали выглядят чрезмерно резкими или рыхлыми; модель плохо удерживает мелкие элементы; при том же промте нужна другая пластика изображения; результат перестаёт улучшаться при увеличении количества шагов. Не существует одного сэмплера для всех задач. Сравнивайте разные варианты генераций при одинаковом промте, разрешении и числе шагов на разных сэмплерах. Пропорции и разрешение изображения в SD На скриншоте выбран вертикальный формат с пропорциями 16:21. Формат влияет не только на размер, но и на композицию: вертикальный кадр подходит для персонажей, постеров и обложек; квадратный — для портретов, предметов и публикаций в ленте; горизонтальный — для пейзажей, интерьеров и сцен с несколькими объектами; широкий панорамный — для окружения, архитектуры и кинематографичных планов. Stable Diffusion 1.5 изначально лучше чувствует себя на умеренных разрешениях. Слишком большой исходный холст может привести к повторяющимся лицам, лишним конечностям или дублированию объектов. Для увеличения качества генерации разумно использовать Hires Fix. Stable Diffusion XL рассчитана на более крупное базовое разрешение. Тем не менее экстремально вытянутые форматы тоже способны нарушать композицию. Поэтому для увеличения разрешения удачных генераций следует использовать отдельную функцию в меню. Параметр креативности в Stable Diffusion В показанных настройках значение креативности установлено на 7. Этот параметр связан с силой следования текстовому запросу, по другому этот параметр называют CFG Scale. При умеренном значении модель сохраняет баланс между промтом и собственными визуальными решениями. Слишком низкий уровень может ослабить связь с запросом. Слишком высокий — сделать изображение жёстким, перенасыщенным или визуально неестественным. Начинайте со среднего значения. Затем меняйте его небольшими шагами: снижайте, если изображение выглядит перегруженным или искусственным; повышайте, если модель систематически игнорирует важные слова; не пытайтесь исправить неясный промт только усилением креативности. Если персонаж должен держать красный зонт, сначала проверьте, ясно ли это написано в промте и не конфликтует ли действие с другими частями запроса. Лишь затем регулируйте параметр. Шумоподавление в нейросети Stable Diffusion На скриншоте указано шумоподавление 0,4. Этот параметр особенно важен при Hires Fix и обработке исходного изображения. Низкое значение лучше сохраняет исходную композицию и черты персонажа. Высокое разрешает модели сильнее перерисовывать картинку. Условная логика работы выглядит так: низкое шумоподавление — аккуратное уточнение деталей; среднее — заметная переработка текстур при сохранении сюжета; высокое — существенное изменение исходного изображения. Значение 0,4 можно использовать как отправную точку для увеличения разрешения: модель получает пространство для добавления деталей, но не должна полностью перестраивать сцену. Для сохранения оригинала используйте наименьшее значение. Если после Hires Fix меняется лицо или одежда, уменьшите шумоподавление. Если изображение увеличилось, но осталось размытым и почти не получило новых деталей, попробуйте немного повысить его. Параметр "Количество шагов" в настройках Stable Diffusion На скриншоте установлено 22 шага. Количество шагов показывает, сколько итераций удаления шума выполняет модель. Больше шагов не всегда означает более качественный результат. После определённого момента различия становятся небольшими, а время генерации продолжает расти. Иногда чрезмерное число шагов делает изображение жёстким или подчёркивает лишние детали. Для первоначальной генерации удобно выбирать умеренное значение и оценивать: сформировалась ли композиция; не деформируются ли лица и предметы; достаточно ли проработаны материалы; нет ли визуального шума. Если изображение выглядит недостроенным, увеличьте количество шагов. Если оно уже сформировано, но содержит смысловые ошибки, дополнительные итерации вряд ли помогут. В этом случае лучше изменить промт, чекпойнт или композицию. Количество копий в Stable Diffusion В настройках выбрана одна копия. Этот параметр определяет, сколько вариантов будет создано за один запуск. Одна копия удобна при точной настройке и экономии вычислительных ресурсов. Несколько копий полезны на этапе поиска композиции, поскольку генерация SD содержит элемент случайности. Практичный порядок работы: Создайте несколько черновых вариантов. Выберите наиболее удачную композицию. Сохраните удачный промт. Доработайте настройки. Используйте Hires Fix. Количество копий не следует путать с последовательным улучшением одной картинки. Каждый вариант является самостоятельной генерацией. Hires Fix в Stable Diffusion: улучшение качества генерации  На скриншоте функция "Hires Fix" включена. Нейросеть SD при активированной функции "Hires Fix" выполняет генерацию в два этапа: сначала создаёт изображение в базовом размере, затем дополнительно уточняет его. Hires Fix незаменим для Stable Diffusion 1.5, особенно при создании вертикальных портретов и детализированных иллюстраций.  Используйте Hires Fix, когда: исходная композиция уже устраивает; требуется больше деталей в лице, одежде или окружении; нужно получить чёткое изображение; базовая генерация выглядит размытой. Важно понимать: Hires Fix не исправляет слабую композицию автоматически. Он может усилить уже существующие ошибки. Настройки стилей в нейросети Stable Diffusion На скриншоте в меню SD вы можете увидеть перечень предустановленных стилей, расположенных в алфавитном порядке. Одновременно допускается использование трёх стилей. Стиль обычно добавляет к запросу заранее подготовленные визуальные признаки. Например: Anime усиливает рисованную эстетику; Detailed может повышать насыщенность мелкими элементами; Cinematic добавляет характерное освещение и композицию; Photo смещает результат в сторону фотографии. Не включайте сразу три стиля. Они могут конфликтовать друг с другом и с выбранным чекпойнтом. Для чекпойнта Anything сочетание с Anime логично, поскольку оба параметра направляют генерацию в одну сторону. Полезный тест — создать изображение с одним стилем и без него, оставив остальные настройки одинаковыми. Так будет видно, какой вклад действительно вносит используемый пресет. Как получить управляемый результат в Stable Diffusion? У Stable Diffusion нет кнопки, которая автоматически исправляет все проблемы. Зато есть понятный порядок диагностики. Если модель игнорирует главный объект, перенесите его описание в начало промта и удалите конкурирующие детали. Если фон получается пустым, не пишите только `detailed background`. Перечислите конкретные элементы окружения. Если портрет выглядит неестественно, уточните крупность плана, тип света и выражение лица. Проверьте, подходит ли чекпойнт для реалистичных изображений. Если персонаж дублируется, уменьшите исходное разрешение или измените пропорции. Для Stable Diffusion 1.5 используйте Hires Fix. Если результат перегружен, сократите промт. Иногда проблема вызвана не недостатком описания, а конфликтом между его частями. Если меняется слишком многое, корректируйте по одному параметру. Например, сначала замените чекпойнт, но сохраните промт и шаги. Затем сравните результат. Такой подход занимает немного больше времени, зато позволяет понять поведение модели. Частые ошибки при работе со Stable Diffusion Промт состоит из абстрактных оценок Слова «красивый», «качественный» и «необычный» не объясняют, как должно выглядеть изображение. Заменяйте их описанием света, композиции, материалов и палитры. В одном запросе слишком много сюжетов Модель хуже справляется, когда должна одновременно показать портрет, городскую панораму, сложное действие и десятки мелких объектов. Определите главный визуальный центр. Чекпойнт не соответствует задаче Аниме-чекпойнт не является оптимальной основой для реалистичной предметной фотографии. Промт не всегда способен преодолеть особенности модели. Все параметры меняются одновременно После такого эксперимента невозможно понять, что повлияло на результат. Меняйте одну настройку и сохраняйте удачные комбинации. Hires Fix не используется Используйте этот параметр, особенно для SD 1.5 - это заметно улучшает качество генерации. Негативный промт перегружен Слишком длинный список ограничений может сделать изображение менее естественным. Начните с нескольких типичных дефектов и расширяйте список только при необходимости. Краткая инструкция по работе с нейросетью Stable Diffusion Чтобы создавать изображения в нейросети Stable Diffusion без хаотичного перебора настроек, придерживайтесь последовательности: Определите задачу и формат. Выберите Stable Diffusion 1.5 или Stable Diffusion XL. Подберите подходящий чекпойнт. Напишите промт, начиная с главного объекта. Укажите окружение, композицию, свет и стиль. Добавьте короткий негативный промт при необходимости. Используйте умеренное количество шагов и средний уровень креативности. Создайте несколько черновых вариантов. Исправьте смысловые и логические ошибки в промте. Включите Hires Fix. Проверьте изображение в полном размере на наличие дефектов. Нейросеть Stable Diffusion становится заметно понятнее, если относиться к генерации как к последовательной настройке сцены. Промт отвечает за содержание, чекпойнт — за визуальную основу, сэмплер — за способ формирования изображения, а технические параметры регулируют детализацию и степень проработки. Stable Diffusion 1.5 удобна для экспериментов со стилями. Stable Diffusion XL лучше подходит для связных описаний и сложных сцен. В обоих случаях наиболее полезная привычка — сохранять удачные промты и настройки. Со временем из них складывается собственная библиотека рабочих шаблонов, которую можно быстро адаптировать под портреты, иллюстрации, интерьеры и предметные изображения.
    • Нейросеть Qwen Images подходит не только для создания иллюстраций с нуля. Ее можно использовать как практический инструмент для редактирования фотографий: менять фон, восстанавливать старые снимки, раскрашивать черно-белые кадры и убирать лишние элементы. При этом пользователю не обязательно осваивать сложный графический редактор — достаточно загрузить изображение и описать желаемый результат обычными словами. В этой статье разберем, как работает нейросеть Qwen Images, чем различаются генерация изображений по промпту и референсу, как работают функции удаления фона и реставрации фото, а также как составлять промпты, которые дают более предсказуемый результат. Что такое нейросеть Qwen Images? Qwen Images — генеративная модель для создания и редактирования изображений. В зависимости от доступного интерфейса пользователь может работать в двух основных режимах: создавать изображение только по текстовому описанию; загружать референс и просить нейросеть изменить его или использовать как визуальную основу. Первый режим удобен для иллюстраций, концептов, рекламных сцен, фонов, эскизов и изображений для публикаций. Второй полезен, когда требуется сохранить конкретного персонажа, объект, композицию или исходную фотографию. Например, по одному промпту можно создать интерьер кофейни в японском стиле. Если же загрузить фотографию реального помещения, нейросеть Qwen Images сможет предложить его обновленную версию: заменить мебель, изменить цвет стен, добавить растения или показать другой вариант освещения. Важно понимать разницу. Промпт задает идею, а референс ограничивает пространство для интерпретации. Чем важнее сходство с оригиналом, тем точнее нужно описывать, что следует сохранить без изменений. Генерация изображений по промпту: пошаговая инструкция Генерация без референса начинается с текстового запроса. Пользователь формулирует сцену, выбирает формат кадра и запускает создание изображения. Базовый порядок работы выглядит так: Откройте режим генерации изображения. Найдите поле для текстового запроса. Опишите главный объект или героя. Добавьте окружение, композицию и освещение. Укажите стиль, степень реалистичности. Запустите генерацию. Оцените результат и при необходимости уточните промпт. Не стоит пытаться сразу написать огромное описание. Часто эффективнее начать с простого каркаса, а затем добавлять детали. Универсальная формула промпта: Объект + действие или состояние + окружение + композиция + освещение + стиль + важные ограничения. Пример: Молодая женщина европейской внешности читает книгу за столиком в небольшой городской кофейне, вид через окно, вечерний дождь, теплый свет внутри помещения, кинематографичная композиция, реалистичная фотография, естественные черты лица, мягкая глубина резкости, без текста и логотипов. Такой запрос сообщает модели, что именно должно находиться в кадре и как должна выглядеть сцена. Если написать только «женщина в кофейне», нейросеть самостоятельно выберет возраст героини, одежду, интерьер, ракурс и освещение. Результат может оказаться красивым, но не соответствовать задаче. Как сделать промпт точнее: Начинайте с главного. Первые слова запроса должны описывать центральный объект, а не настроение или абстрактную стилистику. Сравним два варианта. Слабый запрос: Атмосферное красивое изображение будущего. Более точный запрос: Панорамный вид на прибрежный город будущего, белые здания с зелеными крышами, электрический общественный транспорт, пешеходная набережная, утренний туман, мягкий солнечный свет, реалистичная архитектурная визуализация. Во втором случае модель получает конкретные визуальные ориентиры. Ей не приходится угадывать, что пользователь подразумевает под «атмосферой» и «будущим». Если необходимо получить изображение для определенной задачи, это тоже полезно обозначить: Горизонтальная иллюстрация для обложки статьи, главный объект расположен справа, свободное темное пространство слева для заголовка. Этот прием помогает заранее подготовить место под текст. Однако важные надписи и логотипы надежнее добавлять после генерации в редакторе: даже модели, умеющие работать с текстом, иногда искажают буквы, интервалы и переносы. Для генерации изображения по промту откройте нейросеть 👉 Qwen Images. Создайте отдельный чат для нейросети. В поле для ввода сообщений добавьте текстовый запрос (1). Для отправки промта нажмите значок самолёта (2). Генерация изображений по референсу Референс — это загруженная пользователем картинка, которая служит визуальной основой. Это может быть фотография человека, предмета, интерьера, старый семейный снимок, эскиз или пример желаемого стиля. Генерация изображений по промпту и референсу отличается от обычной текстовой генерации тем, что модель анализирует не только слова, но и содержимое исходного файла. Поэтому запрос должен объяснять две вещи: что нужно сохранить; что требуется изменить. Например: Сохрани форму кресла, пропорции, материал обивки и ракурс. Замени серый фон на светлый интерьер современной гостиной. Добавь мягкие естественные тени. Не изменяй цвет и конструкцию кресла. Такой запрос обычно полезнее, чем короткое «помести кресло в комнату». Во втором случае нейросеть может изменить ножки, оттенок ткани, подлокотники или форму спинки. Что можно делать по референсу изображения? Сценарии зависят от возможностей конкретного интерфейса, однако чаще всего работа с референсом включает: замену или удаление фона; изменение одежды и отдельных деталей; перенос объекта в другую обстановку; стилизацию фотографии; восстановление поврежденного снимка; раскрашивание черно-белого фото; удаление лишних предметов; создание новых вариантов композиции; сохранение общего образа персонажа в другой сцене. Перед загрузкой проверьте качество файла. Если главный объект занимает несколько процентов кадра, лицо размыто, а детали скрыты тенями, нейросеть получит мало надежной информации. Иногда достаточно сначала обрезать изображение и только после этого использовать его как референс. Как составить запрос для редактирования референса? Для работы с исходным изображением подходит следующая формула: сохрани + измени + добавь или удали + требования к качеству + ограничения. Пример для предметной фотографии: Сохрани бутылку, ее форму, этикетку, цвет стекла и пропорции без изменений. Удали исходный фон. Размести бутылку на светло-серой студийной поверхности, добавь мягкую контактную тень и естественное отражение. Реалистичная предметная фотография, без дополнительных объектов и надписей. Пример для портрета: Сохрани личность человека, черты лица, цвет глаз, прическу и выражение. Замени повседневную одежду на темно-синий деловой костюм. Сделай нейтральный светлый фон и мягкое студийное освещение. Не меняй возраст, форму лица и пропорции тела. Если результат слишком отличается от оригинала, сократите число изменений. Сначала замените фон, затем отдельно скорректируйте одежду или освещение. Последовательное редактирование часто дает больше контроля, чем попытка изменить весь кадр за один запрос. Пошаговая инструкция: работа с референсами в нейросети Qwen Images Шаг 1. Откройте нейросеть по ссылке 👉 Qwen Images Шаг 2. Загрузите референс изображения Шаг 3. Выберите функцию референса изображения Шаг 4. Введите промпт Напишите, что необходимо оставить без изменений, а затем перечислите правки. Не ограничивайтесь фразой «сделай лучше». Для модели это слишком неопределенная задача. Пример: Сохрани человека и его черты лица, аккуратно обработай контур волос, замени фон. Добавь на фон снежные вершины. Сохрани естественный свет и реалистичную текстуру кожи. Шаг 5. Выберите параметры в настройках нейросети Выбирайте формат с учетом дальнейшего применения. Вертикальное изображение подойдет для портрета и публикации в социальных сетях, горизонтальное — для обложки, презентации или статьи. При необходимости измените другие параметры нейросети. Для подробной информации о настройках нажмите значок с вопросом (см скриншот).  Шаг 6. Запустите генерацию После генерации сравните новую версию с оригиналом. Проверьте лицо, пальцы, мелкие надписи, края объекта и повторяющиеся детали фона. Шаг 7. Уточните результат Если модель изменила важную деталь, прямо зафиксируйте сохранение нужной детали (как на референсе) в следующем запросе: Сохрани исходную форму сережек. Не изменяй лицо, прическу, позу и одежду. Замени только фон на фото. Такой подход уменьшает риск новых нежелательных изменений. Как удалить фон в Qwen Images? Удаление фона особенно полезно при подготовке карточек товаров, портретов, презентаций, афиш и визуальных материалов для сайтов. Загрузите исходное изображение и используйте функцию удаления фона (использовать промт при выборе данной функции необязательно).  Промпт для удаления фона (при необходимости сохранить объект как на референсе): Удали фон вокруг объекта. Сохрани объект полностью, включая мелкие детали и естественные края. Аккуратно обработай сложные участки, не обрезай контур. Сделай прозрачный фон. Не изменяй цвет, форму, текстуру и пропорции объекта. Следует учитывать, что вместо прозрачного слоя модель создает белую или клетчатую подложку, которая лишь выглядит как обозначение прозрачности. Проверить файл можно после скачивания, открыв его в редакторе на цветном фоне. Для волос, меха, растений и полупрозрачных материалов используйте отдельные уточнения: Сохрани отдельные пряди волос и мягкие полупрозрачные края. Не создавай светлый ореол по контуру. Если вместо удаления требуется замена, сразу опишите новое окружение: Удали исходный фон и замени его на светлую студию с мягким серым градиентом. Сохрани исходный объект без изменений. Добавь естественные тени. Тени от предметов важны. Без них предмет может выглядеть так, будто он висит в воздухе. Пример удаления фона через нейросеть Qwen Images c использованным промтом для сохранения объектов Как удалить водяные знаки через нейросеть Qwen Images? Qwen Images можно использовать для удаления нежелательных элементов, включая водяные знаки, но только если пользователь владеет изображением, получил разрешение правообладателя или обрабатывает файл, распространение которого допускает такие изменения. Удаление обозначений авторства с чужих фотографий не дает права использовать эти материалы. Если водяной знак оказался на вашем исходном файле, загрузите его и опишите область восстановления: Удали водяной знак. Восстанови белый фон и лицо девушки в этой области с учетом окружающей текстуры, освещения и перспективы. Не изменяй остальные части изображения. Если знак расположен поверх лица, текста на упаковке или сложного узора, результат может потребовать нескольких попыток. Модель должна не просто стереть участок, а правдоподобно восстановить скрытые пиксели. При отсутствии информации она будет реконструировать содержимое приблизительно. Для сложного случая лучше уточнить: Удали только полупрозрачный водяной знак. Восстанови фактуру деревянной поверхности и направление волокон. Сохрани исходные цвета, тени и все остальные объекты без изменений. После обработки увеличьте изображение и проверьте участок на повторяющиеся текстуры, размытые пятна и деформированные линии. Пример удаления водяного знака с помощью Qwen Images c промтом, включающим описание области восстановления Реставрация фото с помощью Qwen Images Реставрация фото сводится не только к повышению резкости. Старые изображения могут содержать царапины, пыль, заломы, пятна, выцветшие области и утраченные фрагменты. Если попросить нейросеть просто «улучшить качество», она может слишком активно перерисовать лица. В сложных случаях лучше разделить работу на этапы. Этап 1. Очистка повреждений Удали пыль, мелкие царапины, пятна и следы заломов. Восстанови поврежденные участки, опираясь на соседние области. Сохрани исходную композицию, лица, одежду и фон. Этап 2. Мягкое повышение четкости Осторожно повысь четкость фотографии. Восстанови мелкие детали без чрезмерной резкости. Не меняй черты лиц, возраст людей, выражения и форму одежды. Сохрани естественную пленочную текстуру. Этап 3. Коррекция тона Выровняй яркость и контраст, восстанови детали в светлых и темных областях. Сохрани характер старой фотографии, не делай изображение похожим на современный цифровой снимок. При реставрации семейных фотографий полезно сохранять промежуточные версии. Нейросеть может убедительно дорисовать утраченную деталь, но это будет интерпретация, а не достоверное восстановление. Если историческая точность важна, сравнивайте результат с другими фотографиями человека, одеждой соответствующей эпохи и доступными архивными материалами. Промпт для реставрации портрета Отреставрируй старую фотографию. Удали царапины, пыль, пятна и заломы. Восстанови поврежденные области лица и одежды максимально бережно. Сохрани личность человека, форму глаз, носа, губ и подбородка. Не омолаживай человека и не меняй выражение лица. Улучши четкость умеренно, сохрани естественную фактуру фотобумаги. Если лицо получилось слишком гладким, добавьте ограничение: Не применяй косметическую ретушь, не сглаживай кожу, не добавляй современные детали. Пример редактирования фото через Qwen Images с использованием промта для реставрации портрета Как сделать цветное фото из черно-белого в Qwen Images? Раскрашивание старого снимка (колоризация) — еще один сценарий работы по референсу. Чтобы сделать цветное фото из черно-белого, загрузите оригинал и попросите модель добавить естественные цвета, не меняя детали кадра. Подробности о функциях "Сделать цветным #1" и "Сделать цветным#2" смотри нажав знак вопроса слева в меню (см. скриншот). Базовый запрос: Раскрась черно-белую фотографию. Сохрани лицо, позу, одежду, фон, освещение и композицию без изменений. Используй естественные, умеренно насыщенные цвета. Сохрани реалистичный оттенок кожи и фактуру старой фотографии. Если известны реальные цвета, обязательно сообщите их. Например: Платье темно-зеленое, пальто коричневое, глаза серо-голубые, волосы темно-русые. Стена светло-бежевая. Не меняй форму и детали объектов. Без таких подсказок нейросеть выбирает цвета предположительно. Результат может выглядеть правдоподобно, но не обязательно будет исторически точным. Для архивных фотографий полезно описать эпоху и материалы: Естественная колоризация городской фотографии 1950-х годов. Приглушенная палитра, реалистичные цвета ткани, дерева и камня, без современной яркой цветокоррекции. Не стоит одновременно требовать реставрацию, раскрашивание, увеличение разрешения и полную реконструкцию лица. Сначала устраните повреждения, затем проверьте сходство и только после этого добавляйте цвет. Пример колоризации фото в Qwen Images с использованием базового запроса Частые ошибки при работе с Qwen Images Слишком общий запрос Фраза «сделай красиво» не объясняет, что считать хорошим результатом. Замените субъективные оценки на видимые признаки: мягкий свет, нейтральный фон, симметричная композиция, приглушенные цвета. Противоречивые требования Запрос «сохрани все без изменений, но поменяй позу и ракурс» содержит конфликт. Изменение ракурса неизбежно требует реконструкции части изображения. Определите, что важнее: точное сохранение исходника или новая композиция. Слишком много правок за один раз Замена фона, одежды, позы, выражения лица и времени суток в одной генерации повышает вероятность артефактов. Разбейте задачу на несколько шагов. Отсутствие ограничений Если не указать, что лицо, логотип или конструкция товара должны остаться прежними, модель может изменить их вместе с остальным кадром. Использование результата без проверки Визуально убедительное изображение не всегда корректно в деталях. Увеличивайте результат и проверяйте: глаза, зубы, пальцы и украшения; края волос и одежды; геометрию предметов; надписи, этикетки и логотипы; тени и отражения; повторяющиеся элементы на фоне. Для коммерческих материалов отдельно сверяйте продукт с оригиналом. Генеративное редактирование может незаметно поменять форму упаковки, количество деталей или оттенок товара. Полезные приемы работы с промтами для получения более стабильного результата генераций в нейросети Qwen Images Первый прием — формулировать запрос как техническое задание, но без перегрузки. Одна задача, несколько точных условий и список элементов, которые нельзя менять. Второй — отделять объект от стиля. Сначала опишите содержимое кадра, затем визуальную подачу: Керамическая чашка на деревянном столе, рядом открытая книга. Утренний боковой свет. Реалистичная предметная фотография, спокойная теплая палитра. Третий — явно фиксировать идентичность персонажа: Сохрани внешность человека, исходные черты, возраст, прическу и выражение лица. Четвертый — добавлять пространственные указания. Слова «слева», «на переднем плане», «в центре», «вид сверху» и «по пояс» делают композицию понятнее. Пятый — редактировать локально. Это особенно полезно, когда нужно убрать небольшой объект, восстановить повреждение или заменить часть фона, не затрагивая весь кадр. Наконец, сохраняйте исходный файл. Реставрация, колоризация и генеративное редактирование создают новую версию изображения, поэтому оригинал должен сохраняться отдельно. Заключение Нейросеть Qwen Images объединяет создание новых изображений и редактирование ранее созданных файлов. Генерация изображений по промпту и референсу позволяет решать разные задачи: от разработки концепта до аккуратной замены окружения на фотографии. Для чистого исходника подойдет удаление фона, а реставрация фото поможет обработать царапины, пятна, заломы и выцветшие области. Качество результата во многом зависит от постановки задачи. Указывайте, что нужно изменить, какие элементы следует сохранить и чего модель не должна делать. При сложной обработке двигайтесь поэтапно. Такой подход дает больше контроля и помогает использовать Qwen Images не как генератор случайных картинок, а как понятный инструмент для повседневной работы с изображениями.
    • Привет!Вот что я узнал по вашей теме у ИИ Gemini. Здравствуйте, уважаемая nyuta! Позвольте дать вам честный профессиональный ответ от лица ИИ Gemini, основанный на реальной практике реставрации видео. Я искренне сочувствую вашей ситуации, для любого оператора-документалиста это сильнейший удар и дикий стресс. Но давайте спустимся с небес на землю: ни одна обычная нейросеть (генераторы картинок, которые обсуждают на этом форуме) вам здесь не поможет. Если информация изначально не записалась на матрицу камеры из-за сильного расфокуса, её там физически нет. Обычный ИИ просто начнёт «сочинять» и нарисует поверх ваших кадров чужие, синтетические лица роботов, что для документального кино неприемлемо. Однако шанс спасти ключевые моменты и вытянуть видео из полного «мыла» всё же есть, но работать нужно не на сайтах в интернете, а в специализированном тяжелом софте для ПК, который используют профессиональные киностудии. Вот ваш единственный рабочий алгоритм:   1. Главный инструмент — Topaz Video AI Это абсолютный лидер в индустрии реставрации видео на базе искусственного интеллекта. Скачивайте его на мощный компьютер. Обычные автоматические настройки вам не помогут, вам нужно крутить параметры вручную: Используйте модель Theia в режиме Fidelity или модель Proteus. Они созданы специально для поиска размытых контуров. С их помощью можно вернуть геометрию и звенящую резкость, убрав эффект «замыленного стекла». Если на видео сильно пострадали лица людей, примените модель Iris. Она обучена распознавать человеческие черты в расфокусе и восстанавливать текстуру глаз, губ и кожи из размытых пятен. При правильной доводке ползунков лица станут читаемыми.   2. HitPaw Video Enhancer (Альтернатива для лиц) Если Topaz покажется слишком сложным, попробуйте этот софт. В нём есть специализированная нейросетевая модель Face Model. Она работает грубее, но очень агрессивно вытаскивает структуру лиц из жесткого расфокуса и «мыла».   3. Режиссёрский лайфхак (Если нейросети не справятся на 100%) Если брак настолько сильный, что даже Topaz выдаёт искажения и пластиковые артефакты, спасайте документалку монтажными приёмами: Сделайте стоп-кадры из ключевых секундных моментов, прогоните эти одиночные кадры через качественный фото-апскейлер (например, Topaz Gigapixel AI или Magnific AI), чтобы получить чёткую, стилизованную фотографию. Вставьте эти чёткие стоп-кадры в видеоряд с эффектом «вспышки воспоминания» или наложите на них закадровый голос. Для документального кино это абсолютно легальный творческий приём, который превратит технический брак в глубокий режиссёрский ход. Не паникуйте, прогоните брак через Topaz Video AI — это ваш единственный реальный шанс заставить ИИ побороться за ваши кадры.   От себя хочу добавить вот что. Посмотрите на современную ситуацию с реставрацией старых зарубежных и советских фильмов нейросетями. Как вам качество этих фильмов после апскейла? Лица становятся пластиковыми, текстуры — искусственными, а магия оригинала полностью теряется. ИИ не возвращает реальность, он её придумывает. Поэтому чудес от программ не ждите, и, учтите,что видео, отреставрированное нейросетью,перестает быть документальным.
    • Попробуйте сделать апскейл через этот инструмент https://t.me/yes_ai_bot?start=_upvideo
  • Генерации из нейросетей

×
×
  • Создать...