Перейти к содержанию

Чем полезен форум Yes Ai ?

  • Здесь вы найдете статьи о нейросетях: Midjourney, ChatGPT, Stable Diffusion, Sora, Flux.1, Kling Ai и других
  • Масса полезных инструкций для решения задач с помощью современных моделей ИИ
Статьи

Галерея бесплатных промтов

Откройте нашу галерею с бесплатными промтами для генерации изображений в нейросетях

Sora Images, Midjourney, SDXL, Stable Diffusion и Dalle-3

Галерея

API нейросетей для разработчиков

Добавьте функции нейросетей в собственное мобильное приложение,

веб-сайт или Telegram-бота

API

Хотите задать вопрос о нейросетях ?

Подробно опишите задачу, которую хотите решить с помощью ИИ,

а участники нашего сообщества постараются вам помочь. Это бесплатно!

Спросить
  • Форум о нейросетях и искусственном интеллекте

    ✌️ На форуме ИИ про нейросети Yes Ai размещены полезные статьи и бесплатные обучающие материалы про Midjourney, Chat GPT, Flux.1, Kling Ai, Stable Diffusion, SXDL и др. В галерее вы найдете множество промтов для генерации изображений в нейросетях.

    • Активность на форуме позволит получать бесплатные генерации в нейросетях через Telegram-бота @yes_ai_bot
    • Рекомендуем начать изучение форума про ИИ с прочтения статей 👇 или просмотра галереи работ нашего сообщества

    Добро пожаловать!

     

Форум ИИ о нейросетях

  1. Обсуждаем нейросети и искусственный интеллект

    В этом разделе обсуждаем нейронные сети, которые работают с видео, включая создание, стилизацию, редактирование видео и многое другое.

    Описание всех функций нейросети Nano Banana: генерация картинок по промтам и референсам (исходным фото), редактирование изображений и фотографий.

    Полезные статьи о нейросети для генерации изображений Midjourney. Как делать генерации в Миджорни, как писать промты, команды для нейросети.

    Sora Images

    • 41 пост

    Статьи о возможностях нейросети для генерации изображений Sora Images, разработанной компанией Open Ai. Промты, функции и настройки.

    Qwen Images

    • 41 пост

    Статьи про возможности нейросети Qwen Images и Qwen Edit для генерации изображений по промтам и референсам: полезные советы и примеры использования.

    Flux.2

    Полезные статьи об использовании нейросети Flux.1 и Flux.2 и ее расширенных возможностей. Как использовать LoRA и другие функции Flux.

    Советы и лайфхаки по использованию нейросети для работы с текстом Chat GPT / Gemma / LLaMA

    Описываем функции легендарной нейросети Stable Diffusion, позволяющей генерировать изображения и модифицировать их. Inpaint, Upscale и редактирование изображений.

    В этой ветке обсуждаем другие нейронные сети, которых нет в основном списке (например, HeyGen, Deforum и пр.)

  2. Новости про ИИ и нейросети

    В этом разделе публикуем новости о нейросетях и достижениях в развитии искусственного интеллекта.

    Новости проекта Yes Ai - @yes_ai_official. Обновления форума ИИ, новые функции нейросетей для работы с текстом, видео, изображениями и пр.

  3. Другие темы

    В этом разделе вы можете задать вопросы и получить ответы на темы, связанные с нейросетями и проектом Yes Ai. Здесь вы можете узнать, как решить конкретные задачи с ИИ.

    Здесь можно общаться на темы, связанные с нейросетями лишь косвенно. Расскажите о своем опыте, поделитесь кейсами при работе с ИИ - это будет интересно.

    Здесь мы публикуем информацию о бесплатных раздачах доступа к нейросетям в системе @yes_ai_bot, а также объявляем конкурсы, за участие в которых вы можете получать бонусы.

    Здесь вы можете написать свое видение того, что можно улучшить на форуме или в проекте Yes Ai. Форум ИИ про использование нейросетей может стать еще лучше!

    admin
  • Актуальные обсуждения

  • Новые сообщения

    • Нейросеть Nano Banana в web-версии Yes AI предназначена для создания и редактирования изображений по текстовым запросам и загруженным референсам. Nano Banana позволяет генерировать реалистичные фотографии с нуля, переносить людей в другие локации, менять одежду и позы, объединять нескольких персонажей в одном кадре, применять заданный визуальный стиль и создавать статичные изображения для последующей анимации. В статье подробный обзор нейросети Nano Banana: генерация и редактирование фото по промтам и референсам, настройки, стили и примеры запросов. Общий обзор нейросети Nano Banana Для быстрого доступа к нейросети Nano Banana в web-версии Yes AI рекомендую создать отдельный чат (см. скриншот). Работу в Nano Banana можно организовать двумя основными способами: Генерация по промту — пользователь описывает сюжет, персонажа, одежду, фон, свет и композицию текстовым запросом. Генерация на основе референсов — пользователь загружает одно или несколько фото, а нейросеть использует их как визуальную основу. Оба способа можно сочетать. Например, фото девушки на загруженном референсе задаёт внешность, а промт описывает новую одежду, локацию и стиль фэшн-съёмки. Другой сценарий — загрузить отдельные референсы лица и одежды, назначить им разные типы в настройках меню и поручить нейросети собрать единый реалистичный кадр. Nano Banana подходит для следующих задач: создание реалистичных портретов; генерация фэшн-фото; замена одежды и окружения; перенос лица или персонажа в новую сцену; создание рекламных изображений; объединение нескольких людей на одном фото; перенос позы, фона или визуального стиля; колоризация чёрно-белых снимков; подготовка изображений для дальнейшей анимации. Результат зависит не только от качества промта. Большую роль играют выбранная версия модели, разрешение, пропорции кадра, стилевой пресет, качество изображений и корректно выбранные типы референсов. Настройки нейросети Nano Banana Перед запуском генерации рекомендуется проверить четыре основных параметра: версию, разрешение, пропорции и стили. Версия В интерфейсе web-версии yesai.su доступны версии v1.0 Pro и v2.0. Стоимость генерации может различаться в зависимости от выбранной версии. Узнать точную стоимость генераций можно в прайс-листе.  Разрешение Нейросеть Nano Banana предлагает три варианта разрешения: 1K — для тестов, эскизов и поиска композиции; 2K — для публикаций, презентаций и большинства задач для создания контента; 4K — для финальных изображений с повышенными требованиями к детализации и печати в типографии. Рациональная схема работы выглядит так: Создать тестовый вариант в 1K. Проверить лицо, руки, одежду, позу и окружение. Уточнить промт или роли референсов. Получить устойчивый результат. Запустить итоговую генерацию в 2K или 4K. Высокое разрешение не исправляет ошибки. Если нейросеть перепутала лица или изменила фасон одежды, увеличение разрешения лишь сделает эту ошибку более заметной. Пропорции Выбор зависит от назначения изображения: 1:1 — аватары, предметные композиции; 2:3 и 3:4 — портретные и фэшн-фото; 4:5 — вертикальные рекламные креативы; 9:16 — сторисы и шортсы; 3:2 и 4:3 — классическая фотографическая композиция; 16:9 — обложки статей, презентации и видеопревью; 21:9 — панорамы и кинематографичные сцены. Стили В Nano Banana можно выбирать до трёх предустановленных стилей. В интерфейсе web-версии Yes AI представлены, в частности: 3D, Advertising, Anime, Architecture, Art deco, Cinema, ComicBook, Cyberpunk, Detailed, Fantasy, Fashion, Futuristic, Illustration, Isometric, LineArt, Logo, Luxury, Minimalism, Photo, PixelArt, Pop art, Realism, Sci-Fi, Surrealism, Watercolor и другие варианты визуальных стилей. Дополнительно доступны: No style — без стилевого пресета; Random — случайное визуальное направление. Для реалистичных фото подходят: Photo, Realism, Fashion, Advertising и Cinema. Для коммерческой фэшн-съёмки можно сочетать: Fashion + Photo; Fashion + Realism; Fashion + Advertising; Fashion + Cinema; Luxury + Minimalism + Photo. Не стоит смешивать три различных стиля. Чем больше пресетов используется одновременно, тем выше вероятность визуального конфликта. Если художественное направление подробно описано в промте или задано отдельным типом референса, лучше выбрать No style. Генерация фото по промтам Для генерации изображения без референсов необходимо описать сцену фото в текстовом запросе. Примерная структура промта: Главный объект. Внешность и одежда. Действие или поза. Локация. Композиция и ракурс. Освещение. Визуальный стиль. Ограничения. Ниже приведены пять примеров промтов для Nano Banana. Пример 1. Фэшн-фото в городе Реалистичное фэшн-фото девушки в длинном бежевом тренче и чёрных кожаных сапогах. Она уверенно идёт по современной городской улице после дождя. Съёмка в полный рост, камера немного ниже уровня глаз, естественная походка, отражения в мокром асфальте, мягкий пасмурный свет. Редакционная фэшн-фотография, натуральная кожа, реалистичная ткань, сдержанная цветовая палитра. Без надписей, логотипов и лишних людей. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Пример 2. Студийный портрет Крупный реалистичный портрет девушки в белом жакете на нейтральном сером фоне. Прямая поза, спокойный уверенный взгляд в камеру, минималистичный макияж, естественная текстура кожи. Мягкий ключевой свет слева, деликатный контровой свет, профессиональная студийная фэшн-съёмка, объективный фотореализм. Без чрезмерной ретуши, пластикового блеска кожи, текста и аксессуаров. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Пример 3. Фото на морском побережье Реалистичная фотография девушки в свободном белом льняном платье на каменистом морском побережье. Она стоит боком к камере и смотрит на горизонт. Ветер слегка поднимает волосы и ткань, вечернее золотое освещение, спокойное море, натуральные оттенки. Кинематографичный фэшн-кадр в полный рост, естественные пропорции тела, детализированная ткань. Без лишних людей, надписей и логотипов. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Пример 4. Премиальная рекламная съёмка Премиальное рекламное фото девушки в строгом деловом чёрном костюме, белой рубашке и серебристых серьгах. Минималистичные стены из светлого бетона, мебель в стиле лофт, модель расположена в правой трети кадра, девушка сидит на стуле рядом со столом, слева свободное пространство для заголовка. Направленный солнечный свет, графичные тени, лаконичная композиция, стиль luxury fashion advertising. Без логотипов, текста, водяных знаков и лишних предметов. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Пример 5. Ночная съёмка Реалистичное ночное фэшн-фото девушки в серебристом платье на осенней городской улице. Средний план, камера на уровне глаз, влажный асфальт, малая глубина резкости. Современная журнальная фотография, кинематографичная атмосфера, естественное лицо и корректная анатомия. Без случайных символов, без логотипов, без текста и лишних людей. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Генерация по референсам: общий обзор Референс — загруженное изображение, которое используется как визуальный ориентир. В Nano Banana web-версии платформы Yes AI можно добавлять фото в форматах JPG, JPEG и PNG. Поддерживается загрузка до десяти изображений. По референсу можно передать: лицо; внешность персонажа; одежду; позу; отдельный предмет; фон; композицию; палитру; освещение; художественный стиль. Качество исходных фото напрямую влияет на результат. Для лица желательно использовать чёткий портрет без сильных фильтров, размытия и закрывающих черты лица предметов. Референс одежды должен хорошо показывать фасон и материал, а референс позы — положение рук, ног и корпуса. Нейросеть Nano Banana поддерживает одновременную обработку до десяти референсов, однако использовать максимальное количество необязательно. Для работы достаточно двух-трёх референсов. Чем больше противоречащих друг другу референсов загружено, тем сложнее нейросети правильно определить назначение каждого из них. Использование нескольких референсов без назначения типов Nano Banana позволяет загрузить несколько фото без выбора типов. В таком случае промт должен ясно объяснять назначение каждого изображения. Например, можно объединить три отдельных портрета девушек в одну групповую фотографию. Для такой задачи важно указать: признаки, которые нужно сохранить; признаки, которые нужно изменить; список предметов для запрета отображения на генерации; количество людей; порядок расположения; общий масштаб; план съёмки; фон и свет. Пример промта для смешивания нескольких фото: Перенеси всех девушек моделей на одно фото. Сохрани позы, одежду, лица, черты лица, прически и индивидуальные особенности. Девушки на фото должны располагаться не перекрывая друг друга. Стиль: монохромное фэшн-фото с белыми акцентами, без надписей, логотипов и вотермарок. Если нейросеть начинает путать людей, задачу следует упростить: Уменьшить количество персонажей. Расположить их в один ряд. Исключить пересечение фигур. Использовать одинаково крупные портреты. Убрать противоречивые требования к позам. Повторить генерацию или разделить создание сцены на этапы. Типы референсов R, C, O, S, B, F, G и P Для более точного управления каждому фото можно назначить определённый тип референса. R — референс всего Тип референса R используется, когда изображение должно передать комплекс признаков: композицию, персонажа, одежду, фон, позу и визуальное оформление. Подходит для: колоризации чёрно-белого фото; редактирования исходного кадра; создания близкой вариации; изменения одного элемента при сохранении всей сцены. C — референс персонажа Тип C задаёт общий образ героя: внешность, силуэт, причёску и характерные признаки. Он полезен, если один персонаж должен появляться в разных локациях и одежде. В отличие от типа F, который сфокусирован на лице, C передаёт персонажа более комплексно. O — референс элементов Тип O используется для отдельного предмета или детали: сумки; украшения; обуви; мебели; упаковки; аксессуара. S — референс стиля Тип S передаёт художественную манеру, палитру, контраст, освещение, фактуру и атмосферу. B — референс фона Тип B отвечает за окружение: интерьер, улицу, природную локацию или студийную декорацию. F — референс лица Тип F предназначен для сохранения лица. Он передаёт форму и пропорции лица, глаза, нос, губы, брови и другие особенности. Лучше использовать: чёткий крупный портрет; фото с нейтральным выражением лица; фото без маски, очков или волос, закрывающих лицо; фото без агрессивных фильтров. Тип F не гарантирует абсолютного совпадения, поэтому результат необходимо проверять через сравнение с референсом (подробно о том, как это сделать расскажу чуть позже). G — референс одежды Тип G задаёт одежду: фасон, материал, цвет, рисунок, длину и декоративные элементы. Для качественного переноса вещь должна быть хорошо видна. Если половина костюма скрыта, недостающую часть нейросеть создаст самостоятельно. P — референс позы Тип P определяет положение тела, рук и ног, наклон корпуса, направление взгляда и ракурс. Важное ограничение при работе с типами референсов В одну генерацию можно загрузить несколько фото и назначить каждому отдельный тип. На практике наиболее устойчивые результаты получаются, когда типы назначены не более чем двум референсам в одной генерации. Если указать типы у трёх и более фото, нейросеть может: перепутать назначение изображений; проигнорировать отдельные функции; смешать лица и одежду; перенести фон из неподходящего файла; ослабить влияние нужного референса; выполнить только часть условий. Поэтому рекомендуемая схема — максимум два типизированных референса на один этап. Например: F + G — лицо и одежда; F + B — лицо и локация; F + S — лицо и стиль; C + P — персонаж и поза; G + B — одежда и фон; O + S — объект и визуальное оформление. Если требуется объединить три или четыре изображения, лучше добавить их в качестве референсов типа R и чётко сформулировать инструкции в промпте — например, указать, что на одной фотографии необходимо разместить трёх девушек-моделей. Если необходимо использовать более двух типов референсов то лучшим выбором будет GPT Images. Ознакомиться с инструкцией по GPT Images можно 👉 по этой ссылке. Когда промт с использованием референсов можно не писать Если хотя бы одному загруженному фото назначен тип, текстовый промт можно не указывать. Нейросеть способна запустить генерацию, ориентируясь на выбранный тип референса. Например, можно загрузить портрет, выбрать тип F и выполнить генерацию без текстового описания для создания фона. Однако в этом случае модель самостоятельно определит, композицию, фон и другие параметры, которые не зафиксированы выбранным типом. Для примера я взяла стоковое фото вертикальной ориентации. Использовала тип референса B для генерации фона в горизонтальной композиции. Вот что получилось: Отсутствие промта удобно для: быстрого тестирования типа референса; проверки того, как модель интерпретирует фото; поиска случайных идей; создания вариаций без строгого сценария. Для контролируемого результата промт всё же предпочтителен. Он задаёт параметры, которые выбранный тип не описывает: локацию, одежду, план, освещение, композицию и ограничения. Работа с фото после создания генерации После получения изображения пользователь может продолжить работу с ним, не создавая фото с нуля. Функция «Доработать» Функция «Доработать» позволяет использовать готовое изображение как основу нового задания. Система Yes AI автоматически добавит созданное фото как референс. Пользователь может изменить промт и самостоятельно запустить следующую генерацию. Функция подходит, если необходимо: заменить одежду; изменить фон; скорректировать освещение; убрать лишний объект; освободить место для текста; сделать кадр более реалистичным; изменить цветовую гамму; сохранить персонажа, но поменять локацию. Правки лучше выполнять поэтапно. Вместо требования одновременно поменять одежду, фон, позу, причёску и ракурс сначала замените одежду, а затем переходите к окружению. Пример точечной доработки: Сохрани лицо, причёску, фигуру, позу и ракурс без изменений. Замени только одежду на длинное чёрное платье из матового шёлка. Сохрани естественные складки ткани и реалистичное освещение. Функция «Сравнить с референсом» Функция «Сравнить с референсом» помогает сопоставить исходное фото с результатом. Она особенно важна при работе с лицом, одеждой, позой или конкретным предметом. При сравнении проверьте: сохранены ли черты лица; совпадает ли причёска; правильно ли перенесён фасон одежды; не изменилась ли поза; не появились ли лишние детали; соответствует ли фон поставленной задаче; не смешались ли признаки нескольких людей. Если отличия слишком велики, необходимо сделать запрос строже: отдельно перечислить элементы, которые требуется сохранить, и отдельно описать разрешённые изменения. Функция «Повторить» Функция «Повторить» запускает ещё одну генерацию с теми же настройками, промтом и исходными материалами. Она полезна, когда промт составлен правильно, но конкретная вариация получилась неудачной. Повторение создаёт новую интерпретацию, а не точную копию. Если нужно сохранить уже полученный кадр и изменить одну деталь, лучше использовать функцию «Доработать». Функция «Анимировать» Функция «Анимировать» позволяет использовать полученное фото как начальный кадр для видеогенерации. После перехода следует выбрать видеонейросеть и написать отдельный запрос, описывающий движение. В промте для видео рекомендуется указывать: действие человека; движение камеры; движение предметов; изменение освещения; темп сцены; стиль съёмки.   Пример: Камера медленно приближается. Девушка делает один спокойный шаг вперёд и слегка поворачивает голову к объективу. Мягкое освещение. Волосы и ткань платья естественно движутся от слабого ветра. Без резких движений. 5424119773_1790944660120137.mp4 Подведём итоги Нейросеть Nano Banana заслуживает внимания как инструмент для создания фотореалистичных изображений: она позволяет получать детализированные кадры, естественно передавать внешность человека и сохранять узнаваемые черты при редактировании фотографий. Качество результата зависит от исходного изображения и точности запроса, поэтому для работы с портретами полезно отдельно указывать, какие особенности лица необходимо сохранить, а какие элементы — изменить. Nano Banana может стать хорошим выбором для тех, кому важны реалистичность и точная передача образа, однако готовые изображения стоит проверять на мелкие неточности.
    • Краткое изложение содержания статьи: GPT-6.1 Sol – это новое обновление линейки OpenAI, ориентированное на программирование, работу с документами и сложные задачи, предлагающее значительно более низкую стоимость по сравнению с GPT-6 Astra. Входные данные оцениваются в $2 за миллион токенов, выходные – в $10, а кэшированный ввод стоит всего $0,10 за миллион токенов, что делает его экономичным решением для задач с повторяющимся контекстом, таких как работа с документацией или кодовой базой. Модель превосходит предшественника GPT-6 Sol в тестах разработки ПО, анализе профессиональных PDF-документов и автоматизации бизнес-процессов, демонстрируя улучшения в управлении приложениями и научных задачах с использованием терминала. Несмотря на близость к флагманским моделям по результатам отдельных тестов, важно учитывать точность модели, количество повторных попыток и общую стоимость выполнения конкретных задач при выборе подходящего варианта. Производитель утверждает о повышенной надёжности и снижении количества ошибок в агентной работе, однако эти характеристики пока не получили независимого подтверждения. Доступ к GPT-6.1 Sol предоставляется подписчикам различных тарифов через ChatGPT Work и Codex, но дата появления модели в обычном интерфейсе ChatGPT остается неизвестной. Таким образом, это экономически выгодное обновление с улучшенными возможностями для специалистов, работающих с кодом, документами и автоматизацией процессов, при этом важно тщательно оценивать его производительность в конкретных сценариях использования.
    • Основные моменты публикации: GPT Images – нейросеть для создания и редактирования изображений по текстовому описанию и референсам, подходящая для рекламы, иллюстраций, обложек и других задач. Она позволяет работать с текстом на русском языке, размещая его в генерациях при точном задании параметров. В статье представлен обзор GPT Images, включающий разбор разрешения, пропорций, качества и стилей, а также функций 'Доработать', 'Анимировать', 'Сравнить с референсом' и 'Повторить'. Особое внимание уделено типам референсов (персонаж, лицо, одежда, поза, фон, стиль), позволяющим контролировать отдельные аспекты изображения. Работа в GPT Images строится вокруг трех способов: генерация по промпту, на основе референсов и редактирование готовых изображений. Пользователи могут комбинировать эти способы для достижения желаемого результата. Процесс начинается с выбора модели, разрешения, пропорций, качества, стилей, загрузки референсов и написания промта. Для эффективной генерации важно выбирать разрешение в зависимости от задачи (1K – для экспериментов, 2K – для большинства задач, 4K – для финальных версий), соотношение сторон под конкретный формат публикации, а также правильно составлять промпты, описывающие тип изображения, объект, действие, окружение и стиль. Функция 'Доработать' позволяет вносить локальные изменения в готовые изображения, а функции 'Сравнить с референсом' и 'Повторить' помогают оценить соответствие генерации заданным параметрам и получить альтернативные варианты. Также доступна функция 'Анимировать', позволяющая создать анимацию на основе статичного кадра. GPT Images предоставляет широкие возможности для создания разнообразных изображений, от рекламных креативов до концептов персонажей, требуя при этом последовательного подхода и внимательного отношения к деталям.
    • GPT Images — нейросеть для создания и редактирования изображений по текстовому описанию и загруженным референсам. Она подходит для рекламных креативов, иллюстраций, обложек, карточек товаров, постеров, портретов и концептов персонажей. Отдельное преимущество инструмента — работа с надписями: GPT Images умеет размещать на генерациях текст на русском языке, если его содержание, оформление и положение в кадре точно заданы в промте. В этой статье представлен полный обзор нейросети GPT Images в WEB-версии Yes AI: разберём разрешение, пропорции, качество и стили, рассмотрим генерацию изображений по промтам и референсам, а также функции «Доработать», «Анимировать», «Сравнить с референсом» и «Повторить». Особое внимание уделим типам референсов. Они позволяют отдельно передавать модели персонажа, лицо, одежду, позу, фон, элементы сцены или визуальный стиль. Что умеет нейросеть GPT Images Работа с GPT Images строится вокруг трёх способов постановки задач. Первый способ — генерация по промту. Пользователь описывает желаемый результат: задаёт сюжет, объекты, композицию, ракурс, освещение, стиль и текст для размещения в кадре. Второй способ — генерация на основе референсов. К запросу прикрепляются изображения, служащие ориентирами для нейросети. В качестве референсов можно использовать фотографию человека, образец одежды, изображение нужной позы, фона или предмета, а также пример художественного оформления. Третий способ — редактирование изображений, сгенерированных в GPT Images или других нейросетях, а также цифровых иллюстраций и фотографий. Перечисленные способы легко комбинировать. Например, можно загрузить фотографию товара, попросить нейросеть поместить товар на стеклянный подиум, добавить холодное студийное освещение и заголовок на русском языке, а затем отредактировать полученный результат. Нейросеть GPT Images подходит для решения широкого круга задач: создания рекламных креативов; подготовки обложек для статей и видеороликов; генерации иллюстраций для социальных сетей; разработки концептов персонажей; визуализации товаров для маркетплейсов; создания фонов и локаций; подготовки раскадровок; разработки постеров и баннеров; создания изображений по нескольким референсам; доработки ранее сгенерированных материалов; подготовки начального кадра для последующей анимации. Главное преимущество рабочего процесса заключается в том, что параметры изображения, текстовый запрос и визуальные референсы можно использовать совместно. Например, пользователь может загрузить фотографию товара, отдельно добавить референс фона и референс визуального стиля, а затем описать желаемую композицию в промпте. Как начать генерацию изображения через нейросеть GPT Images Нейросеть GPT Images в WEB-версии платформы YESAI.SU позволяет создавать и редактировать изображения без VPN и сложных настроек. Работа начинается с выбора модели GPT Images.  После этого необходимо: Выбрать разрешение. Установить подходящие пропорции. Определить качество генерации. Выбрать до трёх стилей или отключить стилевые пресеты. При необходимости загрузить референсы. Написать промпт. Проверить настройки и отправить запрос. Далее подробно рассмотрим каждый этап. Важно! При работе над сложной задачей не рекомендуется сразу запускать финальную генерацию с максимальными параметрами качества. Практичнее сначала проверить идею на черновой версии, а затем уточнить промпт и повысить качество генерации. Стоимость генераций указана 👉 в прайс-листе. Выбор разрешения: 1K, 2K или 4K В настройках GPT Images (Sora) доступны три варианта разрешения: 1K; 2K; 4K. Когда выбирать 1K Разрешение 1K удобно для быстрых экспериментов: проверки композиции; поиска удачного ракурса; тестирования разных стилей; подбора цветовой палитры; создания черновых вариантов; сравнения нескольких промптов. Если неизвестно, как модель интерпретирует запрос, целесообразно начать именно с 1K. После получения подходящей композиции можно переходить к более высокому разрешению. Когда выбирать 2K Разрешение 2K подходит для большинства практических задач: публикаций в социальных сетях; обложек; презентаций; рекламных макетов; иллюстраций для сайтов; изображений с заметными мелкими деталями. Это сбалансированный вариант, если необходимо получить качественный результат без преждевременного перехода к максимальному разрешению. Когда выбирать 4K Разрешение 4K следует использовать для финальных версий, особенно если изображение: будет показано на крупном экране; содержит много мелких объектов; требует тщательной прорисовки; предназначено для масштабного рекламного макета; будет дополнительно редактироваться или кадрироваться. Высокое разрешение не исправляет неудачную композицию или неточный промпт. Поэтому сначала следует согласовать содержание изображения, а уже затем создавать финальную версию в 4K. Как выбрать соотношение сторон для нейросети GPT Images В интерфейсе WEB-версии Yes AI для нейросети GPT Images представлены следующие пропорции: 1:1 — 1024 × 1024; 2:3 — 1024 × 1536; 3:2 — 1536 × 1024; 3:4 — 1104 × 1472; 4:3 — 1472 × 1104; 4:5 — 1152 × 1440; 5:4 — 1440 × 1152; 9:16 — 944 × 1680; 16:9 — 1680 × 944; 9:21 — 816 × 1904; 21:9 — 1904 × 816. Соотношение сторон необходимо определить до начала генерации с учётом требований площадки, формата публикации (пост или статья), композиции и планируемого размещения текста. Формат 1:1 Квадратный формат подходит для: карточек товаров; универсальных публикаций; аватаров и иллюстраций; каталожных изображений; композиций с центральным объектом. В промпте можно указывать: «главный объект расположен по центру, вокруг него достаточно свободного пространства». Вертикальные форматы 2:3, 3:4 и 4:5 Такие пропорции удобны для портретов, постеров, публикаций и рекламных материалов. Они позволяют показать человека в полный рост, одежду, интерьер или вертикльную композицию. Формат 4:5 особенно полезен для публикаций, где требуется крупный объект и ограниченное пространство по бокам. Форматы 2:3 и 3:4 подходят для портретной и предметной съёмки. Формат 9:16 Вертикальное соотношение 9:16 следует выбирать для: историй; коротких вертикальных видео; мобильных рекламных материалов; полноэкранных заставок; начальных кадров для последующей анимации. Чтобы элементы интерфейса площадки не перекрывали важные детали, следует оставлять свободные области сверху и снизу. Это требование желательно прямо указывать в промпте. Горизонтальные форматы 3:2, 4:3 и 5:4 Эти варианты подходят для пейзажей, предметных сцен, презентаций, иллюстраций к статьям и изображений с несколькими героями. Формат 3:2 выглядит динамичнее, а 4:3 помогает создать более компактную и уравновешенную композицию. Формат 16:9 Соотношение 16:9 удобно использовать для: обложек видеороликов; баннеров; презентаций; обложек и иллюстраций к статьям; кинематографичных сцен; начальных кадров горизонтального видео. Если на изображении планируется заголовок, следует заранее указать его расположение с точным написанием текста, например:  A polished editorial cover for a personal Russian-language blog about neural networks for beginners, showing a curious professional young woman at a modern desk interacting with an elegant AI workspace on a laptop; floating visual elements represent text writing, advertising concepts, design references, analytics charts, presentations, and structured information; warm human workspace blended with subtle blue and violet futuristic light, intelligent and approachable mood, premium modern digital editorial aesthetic, clean composition, realistic details, strong visual hierarchy, no robots, no brand logos, no watermark. Include one highly prominent, perfectly legible Russian headline in bold white sans-serif lettering on a dark contrasting panel: “НЕЙРОСЕТИ ДЛЯ НАЧИНАЮЩИХ”. Add a smaller clearly legible subtitle: “Как использовать ИИ в работе и творчестве”. Keep all other areas free of text. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Панорамные форматы 9:21 и 21:9 Формат 21:9 подходит для широких панорам, кинематографичных кадров и баннеров. Вертикальный вариант 9:21 можно использовать для необычных мобильных композиций. В панорамном формате важно не оставлять края без смысловой нагрузки. В запросе желательно описывать передний, средний и дальний планы, а также распределение объектов по всей ширине или высоте кадра. Настройка качества: Low, Medium и High для нейросети GPT Images GPT Images (Sora) предлагает три режима качества: Low; Medium; High. Low — для черновиков Режим Low рационально использовать, если нужно: быстро проверить идею; найти композицию; протестировать несколько ракурсов; сравнить стили; понять, правильно ли модель распознаёт объекты. На этом этапе не стоит требовать большого количества мелких деталей. Основное внимание следует уделить сюжету, расположению объектов и общей цветовой гамме. Medium — для основной работы Medium подходит для большинства повседневных генераций. Этот режим удобно использовать при уточнении концепции, работе с референсами и создании нескольких пригодных для публикации вариантов. Если результат близок к желаемому, но требует локальных исправлений, лучше воспользоваться функцией «Доработать», а не начинать весь процесс заново. High — для финального результата и печати Режим High следует выбирать после того, как определены: композиция; формат; стиль; освещение; положение объектов; ключевые детали. Максимальное качество особенно полезно для сложных рекламных сцен, детализированной одежды, архитектуры, предметных композиций и изображений с фактурами. Предустановленные стили для GPT Images В разделе настроек можно выбрать от одного до трёх стилей. Среди множества доступных вариантов представлены такие популярные стили как: 3D; Advertising; Anime; Architecture; Art deco; BioCyber; Biomechanical; Cinema; Color shift; ComicBook; Cubism; Cybernetic; Cyberpunk; Detailed. Также предусмотрены варианты: No style — без стилевого пресета; Random — случайный стиль. Когда выбирать один стиль? Один стиль лучше использовать, если нужен предсказуемый результат. Например: Advertising — для рекламной предметной сцены; Cinema — для кинематографичного кадра; Anime — для аниме-иллюстраций; Architecture — для визуализации здания или интерьера; ComicBook — для стилизации под комикс. Как сочетать несколько стилей? Комбинация двух или трёх стилей помогает создать более сложную эстетику. Например: Advertising + 3D + Detailed — детализированный рекламный рендер товара; Cinema + Cyberpunk + Color shift — контрастная футуристическая сцена; Architecture + Art deco + Detailed — архитектурная визуализация с декоративной геометрией; Anime + ComicBook + Cinema — выразительная иллюстрация с динамичной композицией. Не следует выбирать стили только ради количества. Если пресеты противоречат друг другу, результат может стать визуально перегруженным. Сначала стоит определить доминирующий стиль, а затем добавить один вспомогательный. Когда использовать No style? Режим No style полезен, если: стиль подробно описан в промпте; загружен отдельный стилевой референс; требуется нейтральная визуализация; необходимо сохранить внешний вид исходного изображения; пользователь хочет избежать избыточной стилизации. Когда использовать Random? Random подходит для поиска неожиданных идей и визуальных направлений. Его можно применять на этапе творческого эксперимента, но не следует использовать для задач со строгим брендбуком или заранее утверждённой стилистикой. Как составить промт для GPT Images Хороший промпт должен описывать не только объект, но и всю визуальную задачу. Удобно использовать следующую структуру: Тип изображения. Главный объект. Действие или состояние. Окружение. Композиция. Освещение. Цветовая палитра. Стиль и техника. Важные детали. Ограничения. Универсальный шаблон Создай [тип изображения] с изображением [главный объект]. Объект [действие, положение или состояние]. Сцена расположена [окружение]. Композиция [ракурс, крупность плана, положение объекта]. Освещение [тип света]. Цветовая палитра [цвета]. Визуальный стиль [стиль]. Добавь [важные детали]. Сохрани свободное пространство [где и для чего]. Не добавляй [нежелательные элементы]. Пример промпта для рекламного изображения (без текста на генерации) Создай премиальный рекламный кадр флакона парфюма из тёмного стекла. Флакон стоит на чёрном каменном постаменте, вокруг него лёгкий холодный туман и отдельные капли воды. Крупный предметный план, камера расположена немного ниже уровня объекта. Контрастное студийное освещение с синим контровым светом и мягким золотистым бликом. Чёрная, синяя и золотая палитра. Реалистичная рекламная фотография, чёткие фактуры стекла и камня. Флакон расположен справа, слева оставлено свободное пространство для заголовка. Не добавляй лишние флаконы, людей и декоративный текст. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Пример для обложки статьи с заголовком на русском языке Создай горизонтальную технологичную обложку статьи о генерации изображений в GPT Images. В центре — светящийся интерфейс создания изображения, вокруг — карточки с портретом, рекламным продуктом, архитектурой и кинематографичной сценой. Светлый фон, синие и фиолетовые акценты, мягкое объёмное освещение. Современный профессиональный стиль, высокая детализация. Сверху заголовок крупным шрифтом контрастного цвета к фону на русском языке: "Обзор нейросети GPT Images" Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Работа с референсами в нейросети GPT Images В GPT Images (Sora) можно загружать до десяти изображений в форматах JPG, JPEG и PNG. Для каждого файла можно выбрать назначение. Доступны следующие типы референсов: R — референс всего; C — референс персонажа; O — референс элементов; S — референс стиля; B — референс фона; F — референс лица; G — референс одежды; P — референс позы. Важно! При указании типов референсов промт необязателен, но желателен, если требуется описать композицию. R — референс всего Этот тип следует выбирать, если исходное изображение должно комплексно влиять на результат: на композицию, персонажа, фон, цвета и общую подачу. Такой режим удобен при создании вариации готового изображения. Однако для точного управления лучше разделить задачу между специализированными референсами. C — референс персонажа Используется для сохранения узнаваемых характеристик героя: внешности, причёски, телосложения и общего образа. В промпте дополнительно следует указать, что именно требуется сохранить, а что можно изменить: Сохрани узнаваемую внешность и причёску персонажа, измени одежду и окружение. O — референс элементов Подходит для конкретных предметов и деталей: товара, мебели, аксессуара, упаковки, автомобиля или декоративного объекта. Если загружен товар, полезно написать: Сохрани форму, пропорции, цвет и ключевые детали товара. Не изменяй конструкцию упаковки. S — референс стиля Этот тип передаёт цветовую палитру, характер освещения, фактуры и художественный подход, не требуя буквального повторения сюжета. Чтобы избежать копирования композиции, можно уточнить: Используй только цветовую палитру, освещение и характер фактур, но создай новую композицию. B — референс фона Используется, если необходимо перенести героя или товар в определённую локацию. Это может быть интерьер, улица, природный пейзаж или абстрактное пространство. В запросе следует описать взаимодействие объекта с фоном: направление света, контактные тени, отражения и перспективу. F — референс лица Предназначен для передачи черт лица. Качество исходного файла имеет большое значение: лицо должно быть различимым, без сильного размытия, чрезмерных фильтров и перекрывающих деталей. При работе с лицом реального человека необходимо соблюдать права на изображение и не создавать материалы, способные ввести аудиторию в заблуждение. G — референс одежды Позволяет перенести костюм, отдельный предмет гардероба, цветовую схему или особенности кроя. В промпте желательно уточнять, что следует сохранить: силуэт, материал, рисунок, фурнитуру или весь образ. P — референс позы Используется для управления положением тела и конечностей. Лучше всего подходят изображения, на которых поза читается однозначно, а руки и ноги не перекрыты крупными объектами. Как комбинировать несколько референсов До десяти изображений позволяют собрать сложную сцену из отдельных визуальных источников. Например: первое изображение — лицо F; второе — персонаж C; третье — одежда G; четвёртое — поза P; пятое — фон B; шестое — стиль S; седьмое — товар O. Чем больше референсов используется, тем важнее расставить приоритеты. Если требования конфликтуют, следует указать в промте, какой источник является главным. Функция «Доработать» в нейросети GPT Images После генерации изображение можно отправить на доработку. Готовая картинка добавляется в поле ввода как новый референс, после чего запрос можно изменить. Функция подходит для локальных исправлений: замены фона; изменения цвета объекта; удаления лишней детали; добавления предмета; корректировки композиции; изменения освещения; создания свободного пространства для текста; исправления надписи; изменения одежды или аксессуаров. Лучше формулировать одну или несколько связанных правок за раз. Если одновременно попросить изменить фон, позу, одежду, освещение и ракурс, модель может существенно переработать всю сцену. Пример запроса на доработку: Создай горизонтальную технологичную обложку статьи о генерации изображений в GPT Images. В центре — светящийся интерфейс создания изображения, вокруг — карточки с портретом, рекламным продуктом, архитектурой и кинематографичной сценой. Светлый фон, красные и оранжевые акценты, мягкое объёмное освещение. Современный профессиональный стиль, высокая детализация. Сверху заголовок крупным шрифтом графитового цвета на русском языке: "Обзор нейросети GPT Images" Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Функция «Сравнить с референсом» Функция «Сравнить с референсом» помогает оценить, насколько генерация соответствует загруженному изображению. Особенно она полезна при работе с типами F - референс лица, G - референс одежды, P - референс позы и O - референс элементов, где важно сохранить конкретные признаки. Проверяйте результат по типу референса: для F — черты и пропорции лица; для G — крой, цвет, материал и детали одежды; для P — положение корпуса, конечностей и головы; для O — форму и конструкцию предмета; для B — перспективу и особенности пространства; для S — палитру, свет и художественный характер; для C — целостность образа персонажа; для R — общую композицию и содержание. Не следует ожидать полного копирования при любом типе. Референс направляет генерацию, но степень сходства зависит от качества исходника, совместимости нескольких файлов и сложности задачи. Если отклонение слишком заметно, упростите промт, удалите противоречащие референсы или разделите доработку на несколько этапов. Функция «Повторить» Кнопка «Повторить» запускает новую генерацию с прежним промптом и теми же референсами. При этом модель создаёт другую интерпретацию запроса. Функция полезна, если: идея сформулирована правильно; настройки устраивают; требуется другая композиция; нужен альтернативный ракурс; необходимо получить несколько вариантов для выбора. Важно различать две команды: «Повторить» — создать ещё один вариант на основе тех же исходных данных; «Доработать» — использовать готовое изображение как основу для целевых изменений. Если результат принципиально неверен, повторение не всегда поможет. В таком случае лучше уточнить промпт или пересмотреть типы референсов. Как анимировать созданное изображение Функция «Анимировать» позволяет выбрать видео-нейросеть и использовать созданное изображение в качестве начального кадра. Затем необходимо написать отдельный промпт, описывающий движение. Промпт для анимации должен включать: Движение главного объекта. Движение камеры. Изменения фона. Динамику света и частиц. Элементы, которые должны оставаться стабильными. Пример промпта для анимации рекламного кадра Камера медленно приближается к флакону. Вокруг постамента плавно движется лёгкий туман, отдельные капли воды медленно скользят по стеклу. Синий контровой свет слегка меняет интенсивность, золотистый блик остаётся мягким. Флакон сохраняет исходную форму, цвет, пропорции и маркировку. Без резких движений камеры, деформации объекта и появления новых предметов. Не следует ограничиваться формулировкой «оживи изображение». Чем точнее заданы движение камеры, скорость, направление и элементы, которые должны оставаться неподвижными, тем более управляемым будет результат. 5424119773_1790770513355413.mp4 Как скачать готовое изображение? Кнопка «Скачать файл» сохраняет результат на устройство. Перед скачиванием финальной версии рекомендуется проверить: соответствует ли изображение выбранным пропорциям; правильно ли расположены главные объекты; нет ли лишних деталей; естественно ли выглядят руки и лицо; сохранена ли форма товара; корректны ли надписи; достаточно ли свободного места для заголовка; совпадает ли освещение объекта и фона; нет ли заметных искажений на краях кадра. Если изображение предназначено для рекламы, отдельно следует проверить логотип, упаковку, маркировку и элементы фирменного стиля. Подведём итоги GPT Images (Sora) объединяет генерацию изображений по текстовому описанию, работу с разными типами референсов, выбор стиля, точечное редактирование и подготовку статичного кадра к анимации. Для эффективной работы важно соблюдать последовательность: сначала определить формат и композицию, затем проверить идею в черновом качестве, уточнить промпт, добавить референсы и только после этого создать финальную версию. Последовательный подход помогает быстрее получать предсказуемые результаты, сокращать количество повторных генераций и адаптировать изображения для конкретных площадок — от рекламных баннеров до вертикальных видео.
  • Генерации из нейросетей

×
×
  • Создать...