Перейти к содержанию

Чем полезен форум Yes Ai ?

  • Здесь вы найдете статьи о нейросетях: Midjourney, ChatGPT, Stable Diffusion, Sora, Flux.1, Kling Ai и других
  • Масса полезных инструкций для решения задач с помощью современных моделей ИИ
Статьи

Галерея бесплатных промтов

Откройте нашу галерею с бесплатными промтами для генерации изображений в нейросетях

Sora Images, Midjourney, SDXL, Stable Diffusion и Dalle-3

Галерея

API нейросетей для разработчиков

Добавьте функции нейросетей в собственное мобильное приложение,

веб-сайт или Telegram-бота

API

Хотите задать вопрос о нейросетях ?

Подробно опишите задачу, которую хотите решить с помощью ИИ,

а участники нашего сообщества постараются вам помочь. Это бесплатно!

Спросить
  • Форум о нейросетях и искусственном интеллекте

    ✌️ На форуме ИИ про нейросети Yes Ai размещены полезные статьи и бесплатные обучающие материалы про Midjourney, Chat GPT, Flux.1, Kling Ai, Stable Diffusion, SXDL и др. В галерее вы найдете множество промтов для генерации изображений в нейросетях.

    • Активность на форуме позволит получать бесплатные генерации в нейросетях через Telegram-бота @yes_ai_bot
    • Рекомендуем начать изучение форума про ИИ с прочтения статей 👇 или просмотра галереи работ нашего сообщества

    Добро пожаловать!

     

Форум ИИ о нейросетях

  1. Обсуждаем нейросети и искусственный интеллект

    В этом разделе обсуждаем нейронные сети, которые работают с видео, включая создание, стилизацию, редактирование видео и многое другое.

    Описание всех функций нейросети Nano Banana: генерация картинок по промтам и референсам (исходным фото), редактирование изображений и фотографий.

    Полезные статьи о нейросети для генерации изображений Midjourney. Как делать генерации в Миджорни, как писать промты, команды для нейросети.

    Sora Images

    • 41 пост

    Статьи о возможностях нейросети для генерации изображений Sora Images, разработанной компанией Open Ai. Промты, функции и настройки.

    Qwen Images

    • 41 пост

    Статьи про возможности нейросети Qwen Images и Qwen Edit для генерации изображений по промтам и референсам: полезные советы и примеры использования.

    Flux.2

    Полезные статьи об использовании нейросети Flux.1 и Flux.2 и ее расширенных возможностей. Как использовать LoRA и другие функции Flux.

    Советы и лайфхаки по использованию нейросети для работы с текстом Chat GPT / Gemma / LLaMA

    Описываем функции легендарной нейросети Stable Diffusion, позволяющей генерировать изображения и модифицировать их. Inpaint, Upscale и редактирование изображений.

    В этой ветке обсуждаем другие нейронные сети, которых нет в основном списке (например, HeyGen, Deforum и пр.)

  2. Новости про ИИ и нейросети

    В этом разделе публикуем новости о нейросетях и достижениях в развитии искусственного интеллекта.

    Новости проекта Yes Ai - @yes_ai_official. Обновления форума ИИ, новые функции нейросетей для работы с текстом, видео, изображениями и пр.

  3. Другие темы

    В этом разделе вы можете задать вопросы и получить ответы на темы, связанные с нейросетями и проектом Yes Ai. Здесь вы можете узнать, как решить конкретные задачи с ИИ.

    Здесь можно общаться на темы, связанные с нейросетями лишь косвенно. Расскажите о своем опыте, поделитесь кейсами при работе с ИИ - это будет интересно.

    Здесь мы публикуем информацию о бесплатных раздачах доступа к нейросетям в системе @yes_ai_bot, а также объявляем конкурсы, за участие в которых вы можете получать бонусы.

    Здесь вы можете написать свое видение того, что можно улучшить на форуме или в проекте Yes Ai. Форум ИИ про использование нейросетей может стать еще лучше!

    admin
  • Актуальные обсуждения

  • Новые сообщения

    • В сервисе Yes AI нейросеть ChatGPT способна не только создавать тексты, но и управлять генерацией изображений через нейросеть выбранную в настройках "Иллюстраций". ChatGPT анализирует запрос, формирует точные инструкции и помогает получить визуальный результат, соответствующий заданной концепции. Создавать картинки с референсом через ChatGPT удобно, когда одного текстового описания недостаточно. Вместо длинного объяснения можно прикрепить фотографии человека или животного, примеры одежды, интерьера или желаемой визуальной атмосферы, а требования перечислить обычными тезисами. ChatGPT разберёт задачу, составит подробный промпт и запустит генерацию через функцию «Иллюстрации» в web-версии платформы Yes AI. Такой сценарий подходит для фэшн-съёмок, портретов, рекламных концепций, обложек, карточек товаров и публикаций в социальных сетях. Референс помогает показать нейросети то, что трудно точно описать словами: внешность героя, характер освещения, палитру, композицию, фактуру ткани или настроение кадра. В этой статье разберём, как создавать картинки с референсом через ChatGPT, выполнять замену лица, передавать образ и окружение, а также использовать копирование стиля. Отдельно рассмотрим, как поручить ChatGPT подготовку готового промпта, если самостоятельно составлять техническое описание не хочется. Как работает генерация изображений через ChatGPT При работе без референса нейросеть ориентируется только на текст. Например, запрос «девушка в терракотовом свитере на фоне осеннего парка» оставляет много пространства для интерпретации. Модель самостоятельно выбирает внешность героини, фасон одежды, позу, освещение и композицию. Референс делает задачу конкретнее. Пользователь может загрузить изображение и указать, какие элементы требуется сохранить: лицо и индивидуальные черты человека; причёску и цвет волос; общий образ; одежду или отдельные элементы гардероба; композицию; палитру; позу; фон и окружение; освещение; визуальный стиль. Необязательно писать полноценный профессиональный промпт. Достаточно перечислить требования в формате тезисов, а затем попросить ChatGPT проанализировать их, устранить противоречия и подготовить точную текстовую инструкцию для генератора изображений. Это важное преимущество функции «Иллюстрации» в web-версии платформы Yes AI: ChatGPT выступает не только генератором, но и редактором запроса. Он переводит идею пользователя на более понятный для модели язык, уточняет композицию, добавляет параметры света и оптики, описывает материалы, а также формулирует ограничения против типичных визуальных ошибок. Какие референсы можно прикреплять Для большинства задач удобно использовать от одного до трёх референсов. У каждого файла должна быть понятная функция. Например: первый референс — лицо или внешность персонажа; второй — одежда и цветовая палитра; третий — окружение, композиция или визуальная подача. Можно загрузить и фотографии нескольких людей, если требуется объединить их в одном кадре. В этом случае особенно важно дать инструкции нейросети с назначением каждого изображения, что нужно сохранить и что нужно изменить. Чем яснее распределены роли референсов, тем меньше вероятность, что нейросеть перепутает черты персонажей, перенесёт одежду не на того человека или смешает элементы разных фотографий. Каким должен быть референс лица Если задача предполагает замену лица или сохранение внешности, выбирайте чёткую фотографию без сильной ретуши. Лицо не должно быть закрыто волосами, очками, рукой или глубокими тенями. Лучше, если направление света соответствует будущей сцене. Для сложного ракурса полезно предоставить несколько изображений одного человека: анфас, три четверти и профиль. При этом в запросе нужно прямо указать, что на всех фотографиях изображён один и тот же человек. Используйте только собственные фотографии или изображения, на обработку которых у вас есть разрешение. Не следует применять замену лица для обмана, выдачи вымышленного события за реальное, создания компрометирующих материалов или имитации публичных заявлений от имени другого человека. Каким должен быть референс стиля Для передачи визуальной эстетики выбирайте пример, на котором хорошо различимы: палитра; тип освещения; контраст; построение кадра; фактуры; характер фона; чёткие контуры. Копирование стиля лучше формулировать через наблюдаемые признаки, а не через имя конкретного современного автора. Вместо фразы «сделай точно как у фотографа» полезнее написать: «мягкий рассеянный свет, приглушённая палитра, плёночное зерно, низкий контраст, симметричная журнальная композиция». Так запрос становится точнее, а результат — качественнее. Как включить функцию «Иллюстрации» в ChatGPT Шаг 1. Откройте ChatGPT В боковом меню веб-версии Yes AI нажмите «+ Новый чат». Введите название чата, а затем выберите созданный чат, чтобы начать работу с ChatGPT. Шаг 2. Перейдите в настройки Откройте меню настроек выбранной модели нажав на шестерёнку.  Выберите пункт «Иллюстрации». Шаг 3. Включите функцию «Иллюстрации» Активируйте переключатель. После включения функции ChatGPT сможет создавать изображения по теме запроса, если задача содержит чёткие инструкции по их созданию. Активация функции не гарантирует создание изображений без соответствующего указания в промте. Шаг 4. Выберите модель генерации В меню функции можно выбрать нейросеть для создания изображения. В интерфейсе Yes AI доступны: GPT Images (Sora); Midjourney; Nano Banana. Выбор зависит от задачи. Если приоритетом являются работа с референсами и сохранение внешности, стоит проверить результат в нескольких моделях: одна может точнее передать лицо, другая — одежду, свет или художественную композицию. Шаг 5. Настройте пропорции и количество вариантов В интерфейсе представлены форматы (см. скриншот выше): 1:1; 3:4; 4:3; 9:16; 16:9. Квадратный формат подходит для универсальных публикаций и карточек. Пропорции 3:4 удобны для портретов, 9:16 — для вертикального контента, а 16:9 — для горизонтальных сцен, обложек и групповых фэшн-фотографий. Количество иллюстраций задаётся ползунком. Несколько вариантов помогают сравнить композиции, позы и степень сходства, не меняя исходный запрос. Шаг 6. Прикрепите референсы Нажмите кнопку со скрепкой рядом с полем ввода и загрузите изображения. После этого кратко объясните назначение каждого файла. Шаг 7. Передайте требования тезисами Не нужно сразу писать длинную инструкцию. Перечислите желаемые изменения и попросите ChatGPT самостоятельно доработать промпт.   Шаг 8. Проверьте промпт и результаты ChatGPT может вывести несколько вариантов развёрнутых промптов, а затем создать изображения. Проверьте, правильно ли в нём описаны: лица и роли персонажей; расположение людей; одежда; фон; позы; формат кадра; свет; ограничения. Если какая-либо деталь потерялась, не нужно полностью переписывать запрос. Достаточно дать короткую корректировку. Стоимость генераций с использованием функции "Иллюстрации" через Chat GPT вы можете узнать в прайс-листе Yes AI. Как сформулировать задачу, чтобы ChatGPT сам доработал промпт Хороший запрос состоит из нескольких смысловых частей. Их не обязательно оформлять строго — ChatGPT способен превратить обычные заметки в инструкцию для создания изображений. Но важно дать ChatGPT информацию в формате тезисов. Укажите: Что нужно создать. Фэшн-фотографию, портрет, рекламную сцену, иллюстрацию или обложку. Как использовать каждый референс. С какого изображения взять лицо, одежду, позу, окружение или стиль. Что требуется сохранить. Узнаваемость лица, возраст, пропорции, причёску, цвет глаз, фактуру материала. Что необходимо изменить. Позу, гардероб, фон, время года, освещение или ракурс. Каким должен быть итоговый кадр. Вертикальным или горизонтальным, портретом или фото в полный рост, реалистичным или иллюстративным. Чего следует избегать. Смешивания лиц, перекрытия фигур, лишних людей, текста, логотипов и вотермарок. Что должен сделать ChatGPT до генерации. Проанализировать тезисы, устранить противоречия, составить подробный промпт и только после этого создать изображения. Универсальный шаблон запроса с референсами Этот шаблон можно адаптировать под портрет, рекламную сцену или фэшн-фотографию: Референс 1: [возьми лицо, причёску и индивидуальные черты человека с фото девушки. Сохрани узнаваемость, возраст и естественные пропорции.] Референс 2: [возьми одежду, материалы и цветовую палитру с фото модели в модной одежде.] Референс 3: [используй фото с пейзажем как ориентир для окружения, композиции и освещения.] Создай [тип изображения]. Измени: [перечень изменений]. Сохрани: [перечень обязательных элементов]. Не допускай: [нежелательные элементы и ошибки]. Формат: [ориентация]. Сначала проанализируй мои тезисы и доработай их в подробный промпт для выбранной нейросети. Сделай описание однозначным, добавь композицию, свет, положение камеры, фактуры и ограничения. Покажи готовый промпт, а затем создай [количество на основе выставленных настроек в меню функции "Иллюстрации"] вариантов изображения. Если нужен промпт на английском языке, добавьте: Подготовь итоговый промпт на английском языке, но кратко объясни внесённые уточнения по-русски. Пример: три модели в одном фэшн-кадре Рассмотрим задачу, в которой есть три фотографии разных девушек. Их нужно поместить в одну сцену, заменить одежду и сохранить индивидуальные лица. Исходные тезисы могут выглядеть так: Перемести трёх девушек с референсов на одно горизонтальное цветное фото для модного журнала. Сохрани лицо и индивидуальные черты каждой девушки. Не смешивай лица. Замени позы. Модели не должны перекрывать друг друга. Замени брюки, рубашки и жакеты на коллекцию тёплого осеннего трикотажа терракотовых оттенков и голубые джинсы. Помести девушек на фоне разноцветных клёнов. Составь подробные промпты на английском языке и доработай их для реалистичных фэшн-фото. После этого создай три варианта с разными композициями и комплектами одежды. ChatGPT может расширить эти тезисы: распределить моделей в кадре, назначить каждой отдельную позу, описать виды трикотажа, оттенки денима, дневной свет и глубину резкости. Кроме того, он добавит ограничения против смешивания лиц, наложения фигур и появления лишних персонажей. Это полезнее, чем перегружать исходный запрос техническими терминами. Пользователь отвечает за идею и обязательные условия, а ChatGPT — за структуру промпта. Как выполнять замену лица через ChatGPT Под заменой лица могут подразумеваться разные операции. В одном случае нужно перенести внешность человека в новую сцену. В другом — сохранить героя, но изменить одежду, фон и позу. Эти задачи лучше описывать по-разному. Для переноса внешности используйте формулировку: Используй лицо человека с портретного фото в новой сцене. Сохрани черты лица, возраст и естественную текстуру кожи. Не переноси фон и одежду с портрета. Если нужно отредактировать существующую фотографию: Сохрани человека и его лицо без изменений. Замени только одежду и окружение. Не меняй возраст, причёску, пропорции лица и выражение глаз. При этом чрезмерно длинное описание тоже может мешать. Если промпт содержит десятки равнозначных требований, модель начинает пропускать отдельные детали. Сначала зафиксируйте лицо и композицию, затем поэтапно уточняйте одежду, аксессуары и фон. Как копировать стиль и окружение Копирование стиля работает точнее, если разбить визуальный пример на составляющие. Вместо команды «повтори стиль референса» перечислите необходимые конкретные признаки: мягкий или яркий свет; тёплая или холодная палитра; низкий или высокий контраст; минималистичный либо насыщенный фон; симметричная или динамичная композиция; плёночная, журнальная, рекламная или документальная подача; реалистичные либо намеренно стилизованные материалы. Пример: Используй с фото только визуальную подачу: мягкий боковой свет, приглушённые терракотовые оттенки, неглубокую резкость и журнальную цветокоррекцию. Не копируй человека, одежду, логотипы и предметы. Окружение также лучше описывать отдельно: Возьми из фото с пейзажем расположение деревьев, осеннюю палитру и ощущение глубины. Создай новое место без точного воспроизведения объектов. Так ChatGPT получает ясное разграничение: что переносить, а что игнорировать. Что делать, если нейросеть смешивает референсы Одна из распространённых проблем — модель переносит причёску одного человека на другого, меняет одежду местами или объединяет черты нескольких лиц. Если ошибка повторяется, упростите сцену. Сначала создайте персонажей на нейтральном фоне, убедитесь в сходстве, а потом попросите изменить окружение. Поэтапная работа часто надёжнее попытки решить все задачи за одну генерацию. Частые ошибки при работе с референсами Непонятное назначение файлов Если просто прикрепить три фотографии и попросить «объединить всё», модель сама решит, что использовать. Результат может оказаться непредсказуемым.  Противоречивые требования Команды «полный рост» и «крупный портрет», «чёткий фон» и «сильное размытие фона» конфликтуют между собой. Попросите ChatGPT найти противоречия до генерации. Слишком много изменений за один раз Замена лица, одежды, позы, локации, освещения и композиции в одном запросе повышает вероятность ошибок. Если важна точность, разбейте работу на этапы. Отсутствие ограничений Нейросеть не всегда понимает, что модели не должны перекрывать друг друга или что в кадре нельзя добавлять других людей. Значимые запреты необходимо прописывать явно. Ожидание точной копии Референс — визуальный ориентир, а не гарантия полного совпадения. Генератор может изменить небольшие детали лица, принт, украшения или форму предметов. Для результата, требующего абсолютной идентичности, может понадобиться дополнительная ручная обработка или несколько повторных генераций. Чек-лист для работы с референсами в ChatGPT Чтобы создавать картинки с референсом через ChatGPT и получать более управляемый результат: выберите модель, пропорции и количество иллюстраций до начала работы с ChatGPT; прикрепите от одного до трёх референсов; объясните назначение каждого изображения; перечислите требования короткими тезисами; отдельно укажите, что нужно сохранить и изменить; при замене лица перечислите ключевые индивидуальные черты; при копировании стиля опишите свет, палитру, композицию и фактуры; попросите ChatGPT самостоятельно доработать промпт; проверьте готовый текст перед генерацией; корректируйте результат точечно, не переписывая весь запрос. Функция «Иллюстрации» объединяет анализ референсов, подготовку промпта и генерацию в одном диалоге. Пользователю не нужно заранее разбираться во всех терминах: достаточно понятно сформулировать идею, распределить роли изображений и обозначить ограничения. 
    • Нейросеть Nano Banana в web-версии Yes AI предназначена для создания и редактирования изображений по текстовым запросам и загруженным референсам. Nano Banana позволяет генерировать реалистичные фотографии с нуля, переносить людей в другие локации, менять одежду и позы, объединять нескольких персонажей в одном кадре, применять заданный визуальный стиль и создавать статичные изображения для последующей анимации. В статье подробный обзор нейросети Nano Banana: генерация и редактирование фото по промтам и референсам, настройки, стили и примеры запросов. Общий обзор нейросети Nano Banana Для быстрого доступа к нейросети Nano Banana в web-версии Yes AI рекомендую создать отдельный чат (см. скриншот). Работу в Nano Banana можно организовать двумя основными способами: Генерация по промту — пользователь описывает сюжет, персонажа, одежду, фон, свет и композицию текстовым запросом. Генерация на основе референсов — пользователь загружает одно или несколько фото, а нейросеть использует их как визуальную основу. Оба способа можно сочетать. Например, фото девушки на загруженном референсе задаёт внешность, а промт описывает новую одежду, локацию и стиль фэшн-съёмки. Другой сценарий — загрузить отдельные референсы лица и одежды, назначить им разные типы в настройках меню и поручить нейросети собрать единый реалистичный кадр. Nano Banana подходит для следующих задач: создание реалистичных портретов; генерация фэшн-фото; замена одежды и окружения; перенос лица или персонажа в новую сцену; создание рекламных изображений; объединение нескольких людей на одном фото; перенос позы, фона или визуального стиля; колоризация чёрно-белых снимков; подготовка изображений для дальнейшей анимации. Результат зависит не только от качества промта. Большую роль играют выбранная версия модели, разрешение, пропорции кадра, стилевой пресет, качество изображений и корректно выбранные типы референсов. Настройки нейросети Nano Banana Перед запуском генерации рекомендуется проверить четыре основных параметра: версию, разрешение, пропорции и стили. Версия В интерфейсе web-версии yesai.su доступны версии v1.0 Pro и v2.0. Стоимость генерации может различаться в зависимости от выбранной версии. Узнать точную стоимость генераций можно в прайс-листе.  Разрешение Нейросеть Nano Banana предлагает три варианта разрешения: 1K — для тестов, эскизов и поиска композиции; 2K — для публикаций, презентаций и большинства задач для создания контента; 4K — для финальных изображений с повышенными требованиями к детализации и печати в типографии. Рациональная схема работы выглядит так: Создать тестовый вариант в 1K. Проверить лицо, руки, одежду, позу и окружение. Уточнить промт или роли референсов. Получить устойчивый результат. Запустить итоговую генерацию в 2K или 4K. Высокое разрешение не исправляет ошибки. Если нейросеть перепутала лица или изменила фасон одежды, увеличение разрешения лишь сделает эту ошибку более заметной. Пропорции Выбор зависит от назначения изображения: 1:1 — аватары, предметные композиции; 2:3 и 3:4 — портретные и фэшн-фото; 4:5 — вертикальные рекламные креативы; 9:16 — сторисы и шортсы; 3:2 и 4:3 — классическая фотографическая композиция; 16:9 — обложки статей, презентации и видеопревью; 21:9 — панорамы и кинематографичные сцены. Стили В Nano Banana можно выбирать до трёх предустановленных стилей. В интерфейсе web-версии Yes AI представлены, в частности: 3D, Advertising, Anime, Architecture, Art deco, Cinema, ComicBook, Cyberpunk, Detailed, Fantasy, Fashion, Futuristic, Illustration, Isometric, LineArt, Logo, Luxury, Minimalism, Photo, PixelArt, Pop art, Realism, Sci-Fi, Surrealism, Watercolor и другие варианты визуальных стилей. Дополнительно доступны: No style — без стилевого пресета; Random — случайное визуальное направление. Для реалистичных фото подходят: Photo, Realism, Fashion, Advertising и Cinema. Для коммерческой фэшн-съёмки можно сочетать: Fashion + Photo; Fashion + Realism; Fashion + Advertising; Fashion + Cinema; Luxury + Minimalism + Photo. Не стоит смешивать три различных стиля. Чем больше пресетов используется одновременно, тем выше вероятность визуального конфликта. Если художественное направление подробно описано в промте или задано отдельным типом референса, лучше выбрать No style. Генерация фото по промтам Для генерации изображения без референсов необходимо описать сцену фото в текстовом запросе. Примерная структура промта: Главный объект. Внешность и одежда. Действие или поза. Локация. Композиция и ракурс. Освещение. Визуальный стиль. Ограничения. Ниже приведены пять примеров промтов для Nano Banana. Пример 1. Фэшн-фото в городе Реалистичное фэшн-фото девушки в длинном бежевом тренче и чёрных кожаных сапогах. Она уверенно идёт по современной городской улице после дождя. Съёмка в полный рост, камера немного ниже уровня глаз, естественная походка, отражения в мокром асфальте, мягкий пасмурный свет. Редакционная фэшн-фотография, натуральная кожа, реалистичная ткань, сдержанная цветовая палитра. Без надписей, логотипов и лишних людей. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Пример 2. Студийный портрет Крупный реалистичный портрет девушки в белом жакете на нейтральном сером фоне. Прямая поза, спокойный уверенный взгляд в камеру, минималистичный макияж, естественная текстура кожи. Мягкий ключевой свет слева, деликатный контровой свет, профессиональная студийная фэшн-съёмка, объективный фотореализм. Без чрезмерной ретуши, пластикового блеска кожи, текста и аксессуаров. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Пример 3. Фото на морском побережье Реалистичная фотография девушки в свободном белом льняном платье на каменистом морском побережье. Она стоит боком к камере и смотрит на горизонт. Ветер слегка поднимает волосы и ткань, вечернее золотое освещение, спокойное море, натуральные оттенки. Кинематографичный фэшн-кадр в полный рост, естественные пропорции тела, детализированная ткань. Без лишних людей, надписей и логотипов. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Пример 4. Премиальная рекламная съёмка Премиальное рекламное фото девушки в строгом деловом чёрном костюме, белой рубашке и серебристых серьгах. Минималистичные стены из светлого бетона, мебель в стиле лофт, модель расположена в правой трети кадра, девушка сидит на стуле рядом со столом, слева свободное пространство для заголовка. Направленный солнечный свет, графичные тени, лаконичная композиция, стиль luxury fashion advertising. Без логотипов, текста, водяных знаков и лишних предметов. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Пример 5. Ночная съёмка Реалистичное ночное фэшн-фото девушки в серебристом платье на осенней городской улице. Средний план, камера на уровне глаз, влажный асфальт, малая глубина резкости. Современная журнальная фотография, кинематографичная атмосфера, естественное лицо и корректная анатомия. Без случайных символов, без логотипов, без текста и лишних людей. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Генерация по референсам: общий обзор Референс — загруженное изображение, которое используется как визуальный ориентир. В Nano Banana web-версии платформы Yes AI можно добавлять фото в форматах JPG, JPEG и PNG. Поддерживается загрузка до десяти изображений. По референсу можно передать: лицо; внешность персонажа; одежду; позу; отдельный предмет; фон; композицию; палитру; освещение; художественный стиль. Качество исходных фото напрямую влияет на результат. Для лица желательно использовать чёткий портрет без сильных фильтров, размытия и закрывающих черты лица предметов. Референс одежды должен хорошо показывать фасон и материал, а референс позы — положение рук, ног и корпуса. Нейросеть Nano Banana поддерживает одновременную обработку до десяти референсов, однако использовать максимальное количество необязательно. Для работы достаточно двух-трёх референсов. Чем больше противоречащих друг другу референсов загружено, тем сложнее нейросети правильно определить назначение каждого из них. Использование нескольких референсов без назначения типов Nano Banana позволяет загрузить несколько фото без выбора типов. В таком случае промт должен ясно объяснять назначение каждого изображения. Например, можно объединить три отдельных портрета девушек в одну групповую фотографию. Для такой задачи важно указать: признаки, которые нужно сохранить; признаки, которые нужно изменить; список предметов для запрета отображения на генерации; количество людей; порядок расположения; общий масштаб; план съёмки; фон и свет. Пример промта для смешивания нескольких фото: Перенеси всех девушек моделей на одно фото. Сохрани позы, одежду, лица, черты лица, прически и индивидуальные особенности. Девушки на фото должны располагаться не перекрывая друг друга. Стиль: монохромное фэшн-фото с белыми акцентами, без надписей, логотипов и вотермарок. Если нейросеть начинает путать людей, задачу следует упростить: Уменьшить количество персонажей. Расположить их в один ряд. Исключить пересечение фигур. Использовать одинаково крупные портреты. Убрать противоречивые требования к позам. Повторить генерацию или разделить создание сцены на этапы. Типы референсов R, C, O, S, B, F, G и P Для более точного управления каждому фото можно назначить определённый тип референса. R — референс всего Тип референса R используется, когда изображение должно передать комплекс признаков: композицию, персонажа, одежду, фон, позу и визуальное оформление. Подходит для: колоризации чёрно-белого фото; редактирования исходного кадра; создания близкой вариации; изменения одного элемента при сохранении всей сцены. C — референс персонажа Тип C задаёт общий образ героя: внешность, силуэт, причёску и характерные признаки. Он полезен, если один персонаж должен появляться в разных локациях и одежде. В отличие от типа F, который сфокусирован на лице, C передаёт персонажа более комплексно. O — референс элементов Тип O используется для отдельного предмета или детали: сумки; украшения; обуви; мебели; упаковки; аксессуара. S — референс стиля Тип S передаёт художественную манеру, палитру, контраст, освещение, фактуру и атмосферу. B — референс фона Тип B отвечает за окружение: интерьер, улицу, природную локацию или студийную декорацию. F — референс лица Тип F предназначен для сохранения лица. Он передаёт форму и пропорции лица, глаза, нос, губы, брови и другие особенности. Лучше использовать: чёткий крупный портрет; фото с нейтральным выражением лица; фото без маски, очков или волос, закрывающих лицо; фото без агрессивных фильтров. Тип F не гарантирует абсолютного совпадения, поэтому результат необходимо проверять через сравнение с референсом (подробно о том, как это сделать расскажу чуть позже). G — референс одежды Тип G задаёт одежду: фасон, материал, цвет, рисунок, длину и декоративные элементы. Для качественного переноса вещь должна быть хорошо видна. Если половина костюма скрыта, недостающую часть нейросеть создаст самостоятельно. P — референс позы Тип P определяет положение тела, рук и ног, наклон корпуса, направление взгляда и ракурс. Важное ограничение при работе с типами референсов В одну генерацию можно загрузить несколько фото и назначить каждому отдельный тип. На практике наиболее устойчивые результаты получаются, когда типы назначены не более чем двум референсам в одной генерации. Если указать типы у трёх и более фото, нейросеть может: перепутать назначение изображений; проигнорировать отдельные функции; смешать лица и одежду; перенести фон из неподходящего файла; ослабить влияние нужного референса; выполнить только часть условий. Поэтому рекомендуемая схема — максимум два типизированных референса на один этап. Например: F + G — лицо и одежда; F + B — лицо и локация; F + S — лицо и стиль; C + P — персонаж и поза; G + B — одежда и фон; O + S — объект и визуальное оформление. Если требуется объединить три или четыре изображения, лучше добавить их в качестве референсов типа R и чётко сформулировать инструкции в промпте — например, указать, что на одной фотографии необходимо разместить трёх девушек-моделей. Если необходимо использовать более двух типов референсов то лучшим выбором будет GPT Images. Ознакомиться с инструкцией по GPT Images можно 👉 по этой ссылке. Когда промт с использованием референсов можно не писать Если хотя бы одному загруженному фото назначен тип, текстовый промт можно не указывать. Нейросеть способна запустить генерацию, ориентируясь на выбранный тип референса. Например, можно загрузить портрет, выбрать тип F и выполнить генерацию без текстового описания для создания фона. Однако в этом случае модель самостоятельно определит, композицию, фон и другие параметры, которые не зафиксированы выбранным типом. Для примера я взяла стоковое фото вертикальной ориентации. Использовала тип референса B для генерации фона в горизонтальной композиции. Вот что получилось: Отсутствие промта удобно для: быстрого тестирования типа референса; проверки того, как модель интерпретирует фото; поиска случайных идей; создания вариаций без строгого сценария. Для контролируемого результата промт всё же предпочтителен. Он задаёт параметры, которые выбранный тип не описывает: локацию, одежду, план, освещение, композицию и ограничения. Работа с фото после создания генерации После получения изображения пользователь может продолжить работу с ним, не создавая фото с нуля. Функция «Доработать» Функция «Доработать» позволяет использовать готовое изображение как основу нового задания. Система Yes AI автоматически добавит созданное фото как референс. Пользователь может изменить промт и самостоятельно запустить следующую генерацию. Функция подходит, если необходимо: заменить одежду; изменить фон; скорректировать освещение; убрать лишний объект; освободить место для текста; сделать кадр более реалистичным; изменить цветовую гамму; сохранить персонажа, но поменять локацию. Правки лучше выполнять поэтапно. Вместо требования одновременно поменять одежду, фон, позу, причёску и ракурс сначала замените одежду, а затем переходите к окружению. Пример точечной доработки: Сохрани лицо, причёску, фигуру, позу и ракурс без изменений. Замени только одежду на длинное чёрное платье из матового шёлка. Сохрани естественные складки ткани и реалистичное освещение. Функция «Сравнить с референсом» Функция «Сравнить с референсом» помогает сопоставить исходное фото с результатом. Она особенно важна при работе с лицом, одеждой, позой или конкретным предметом. При сравнении проверьте: сохранены ли черты лица; совпадает ли причёска; правильно ли перенесён фасон одежды; не изменилась ли поза; не появились ли лишние детали; соответствует ли фон поставленной задаче; не смешались ли признаки нескольких людей. Если отличия слишком велики, необходимо сделать запрос строже: отдельно перечислить элементы, которые требуется сохранить, и отдельно описать разрешённые изменения. Функция «Повторить» Функция «Повторить» запускает ещё одну генерацию с теми же настройками, промтом и исходными материалами. Она полезна, когда промт составлен правильно, но конкретная вариация получилась неудачной. Повторение создаёт новую интерпретацию, а не точную копию. Если нужно сохранить уже полученный кадр и изменить одну деталь, лучше использовать функцию «Доработать». Функция «Анимировать» Функция «Анимировать» позволяет использовать полученное фото как начальный кадр для видеогенерации. После перехода следует выбрать видеонейросеть и написать отдельный запрос, описывающий движение. В промте для видео рекомендуется указывать: действие человека; движение камеры; движение предметов; изменение освещения; темп сцены; стиль съёмки.   Пример: Камера медленно приближается. Девушка делает один спокойный шаг вперёд и слегка поворачивает голову к объективу. Мягкое освещение. Волосы и ткань платья естественно движутся от слабого ветра. Без резких движений. 5424119773_1790944660120137.mp4 Подведём итоги Нейросеть Nano Banana заслуживает внимания как инструмент для создания фотореалистичных изображений: она позволяет получать детализированные кадры, естественно передавать внешность человека и сохранять узнаваемые черты при редактировании фотографий. Качество результата зависит от исходного изображения и точности запроса, поэтому для работы с портретами полезно отдельно указывать, какие особенности лица необходимо сохранить, а какие элементы — изменить. Nano Banana может стать хорошим выбором для тех, кому важны реалистичность и точная передача образа, однако готовые изображения стоит проверять на мелкие неточности.
    • Краткое изложение содержания статьи: GPT-6.1 Sol – это новое обновление линейки OpenAI, ориентированное на программирование, работу с документами и сложные задачи, предлагающее значительно более низкую стоимость по сравнению с GPT-6 Astra. Входные данные оцениваются в $2 за миллион токенов, выходные – в $10, а кэшированный ввод стоит всего $0,10 за миллион токенов, что делает его экономичным решением для задач с повторяющимся контекстом, таких как работа с документацией или кодовой базой. Модель превосходит предшественника GPT-6 Sol в тестах разработки ПО, анализе профессиональных PDF-документов и автоматизации бизнес-процессов, демонстрируя улучшения в управлении приложениями и научных задачах с использованием терминала. Несмотря на близость к флагманским моделям по результатам отдельных тестов, важно учитывать точность модели, количество повторных попыток и общую стоимость выполнения конкретных задач при выборе подходящего варианта. Производитель утверждает о повышенной надёжности и снижении количества ошибок в агентной работе, однако эти характеристики пока не получили независимого подтверждения. Доступ к GPT-6.1 Sol предоставляется подписчикам различных тарифов через ChatGPT Work и Codex, но дата появления модели в обычном интерфейсе ChatGPT остается неизвестной. Таким образом, это экономически выгодное обновление с улучшенными возможностями для специалистов, работающих с кодом, документами и автоматизацией процессов, при этом важно тщательно оценивать его производительность в конкретных сценариях использования.
    • Основные моменты публикации: GPT Images – нейросеть для создания и редактирования изображений по текстовому описанию и референсам, подходящая для рекламы, иллюстраций, обложек и других задач. Она позволяет работать с текстом на русском языке, размещая его в генерациях при точном задании параметров. В статье представлен обзор GPT Images, включающий разбор разрешения, пропорций, качества и стилей, а также функций 'Доработать', 'Анимировать', 'Сравнить с референсом' и 'Повторить'. Особое внимание уделено типам референсов (персонаж, лицо, одежда, поза, фон, стиль), позволяющим контролировать отдельные аспекты изображения. Работа в GPT Images строится вокруг трех способов: генерация по промпту, на основе референсов и редактирование готовых изображений. Пользователи могут комбинировать эти способы для достижения желаемого результата. Процесс начинается с выбора модели, разрешения, пропорций, качества, стилей, загрузки референсов и написания промта. Для эффективной генерации важно выбирать разрешение в зависимости от задачи (1K – для экспериментов, 2K – для большинства задач, 4K – для финальных версий), соотношение сторон под конкретный формат публикации, а также правильно составлять промпты, описывающие тип изображения, объект, действие, окружение и стиль. Функция 'Доработать' позволяет вносить локальные изменения в готовые изображения, а функции 'Сравнить с референсом' и 'Повторить' помогают оценить соответствие генерации заданным параметрам и получить альтернативные варианты. Также доступна функция 'Анимировать', позволяющая создать анимацию на основе статичного кадра. GPT Images предоставляет широкие возможности для создания разнообразных изображений, от рекламных креативов до концептов персонажей, требуя при этом последовательного подхода и внимательного отношения к деталям.
  • Генерации из нейросетей

×
×
  • Создать...