Модератор Ardi Опубликовано вчера в 08:59 Модератор Поделиться Опубликовано вчера в 08:59 Нейросеть Nano Banana в web-версии Yes AI предназначена для создания и редактирования изображений по текстовым запросам и загруженным референсам. Nano Banana позволяет генерировать реалистичные фотографии с нуля, переносить людей в другие локации, менять одежду и позы, объединять нескольких персонажей в одном кадре, применять заданный визуальный стиль и создавать статичные изображения для последующей анимации. В статье подробный обзор нейросети Nano Banana: генерация и редактирование фото по промтам и референсам, настройки, стили и примеры запросов. Общий обзор нейросети Nano Banana Для быстрого доступа к нейросети Nano Banana в web-версии Yes AI рекомендую создать отдельный чат (см. скриншот). Работу в Nano Banana можно организовать двумя основными способами: Генерация по промту — пользователь описывает сюжет, персонажа, одежду, фон, свет и композицию текстовым запросом. Генерация на основе референсов — пользователь загружает одно или несколько фото, а нейросеть использует их как визуальную основу. Оба способа можно сочетать. Например, фото девушки на загруженном референсе задаёт внешность, а промт описывает новую одежду, локацию и стиль фэшн-съёмки. Другой сценарий — загрузить отдельные референсы лица и одежды, назначить им разные типы в настройках меню и поручить нейросети собрать единый реалистичный кадр. Nano Banana подходит для следующих задач: создание реалистичных портретов; генерация фэшн-фото; замена одежды и окружения; перенос лица или персонажа в новую сцену; создание рекламных изображений; объединение нескольких людей на одном фото; перенос позы, фона или визуального стиля; колоризация чёрно-белых снимков; подготовка изображений для дальнейшей анимации. Результат зависит не только от качества промта. Большую роль играют выбранная версия модели, разрешение, пропорции кадра, стилевой пресет, качество изображений и корректно выбранные типы референсов. Настройки нейросети Nano Banana Перед запуском генерации рекомендуется проверить четыре основных параметра: версию, разрешение, пропорции и стили. Версия В интерфейсе web-версии yesai.su доступны версии v1.0 Pro и v2.0. Стоимость генерации может различаться в зависимости от выбранной версии. Узнать точную стоимость генераций можно в прайс-листе. Разрешение Нейросеть Nano Banana предлагает три варианта разрешения: 1K — для тестов, эскизов и поиска композиции; 2K — для публикаций, презентаций и большинства задач для создания контента; 4K — для финальных изображений с повышенными требованиями к детализации и печати в типографии. Рациональная схема работы выглядит так: Создать тестовый вариант в 1K. Проверить лицо, руки, одежду, позу и окружение. Уточнить промт или роли референсов. Получить устойчивый результат. Запустить итоговую генерацию в 2K или 4K. Высокое разрешение не исправляет ошибки. Если нейросеть перепутала лица или изменила фасон одежды, увеличение разрешения лишь сделает эту ошибку более заметной. Пропорции Выбор зависит от назначения изображения: 1:1 — аватары, предметные композиции; 2:3 и 3:4 — портретные и фэшн-фото; 4:5 — вертикальные рекламные креативы; 9:16 — сторисы и шортсы; 3:2 и 4:3 — классическая фотографическая композиция; 16:9 — обложки статей, презентации и видеопревью; 21:9 — панорамы и кинематографичные сцены. Стили В Nano Banana можно выбирать до трёх предустановленных стилей. В интерфейсе web-версии Yes AI представлены, в частности: 3D, Advertising, Anime, Architecture, Art deco, Cinema, ComicBook, Cyberpunk, Detailed, Fantasy, Fashion, Futuristic, Illustration, Isometric, LineArt, Logo, Luxury, Minimalism, Photo, PixelArt, Pop art, Realism, Sci-Fi, Surrealism, Watercolor и другие варианты визуальных стилей. Дополнительно доступны: No style — без стилевого пресета; Random — случайное визуальное направление. Для реалистичных фото подходят: Photo, Realism, Fashion, Advertising и Cinema. Для коммерческой фэшн-съёмки можно сочетать: Fashion + Photo; Fashion + Realism; Fashion + Advertising; Fashion + Cinema; Luxury + Minimalism + Photo. Не стоит смешивать три различных стиля. Чем больше пресетов используется одновременно, тем выше вероятность визуального конфликта. Если художественное направление подробно описано в промте или задано отдельным типом референса, лучше выбрать No style. Генерация фото по промтам Для генерации изображения без референсов необходимо описать сцену фото в текстовом запросе. Примерная структура промта: Главный объект. Внешность и одежда. Действие или поза. Локация. Композиция и ракурс. Освещение. Визуальный стиль. Ограничения. Ниже приведены пять примеров промтов для Nano Banana. Пример 1. Фэшн-фото в городе Реалистичное фэшн-фото девушки в длинном бежевом тренче и чёрных кожаных сапогах. Она уверенно идёт по современной городской улице после дождя. Съёмка в полный рост, камера немного ниже уровня глаз, естественная походка, отражения в мокром асфальте, мягкий пасмурный свет. Редакционная фэшн-фотография, натуральная кожа, реалистичная ткань, сдержанная цветовая палитра. Без надписей, логотипов и лишних людей. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Пример 2. Студийный портрет Крупный реалистичный портрет девушки в белом жакете на нейтральном сером фоне. Прямая поза, спокойный уверенный взгляд в камеру, минималистичный макияж, естественная текстура кожи. Мягкий ключевой свет слева, деликатный контровой свет, профессиональная студийная фэшн-съёмка, объективный фотореализм. Без чрезмерной ретуши, пластикового блеска кожи, текста и аксессуаров. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Пример 3. Фото на морском побережье Реалистичная фотография девушки в свободном белом льняном платье на каменистом морском побережье. Она стоит боком к камере и смотрит на горизонт. Ветер слегка поднимает волосы и ткань, вечернее золотое освещение, спокойное море, натуральные оттенки. Кинематографичный фэшн-кадр в полный рост, естественные пропорции тела, детализированная ткань. Без лишних людей, надписей и логотипов. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Пример 4. Премиальная рекламная съёмка Премиальное рекламное фото девушки в строгом деловом чёрном костюме, белой рубашке и серебристых серьгах. Минималистичные стены из светлого бетона, мебель в стиле лофт, модель расположена в правой трети кадра, девушка сидит на стуле рядом со столом, слева свободное пространство для заголовка. Направленный солнечный свет, графичные тени, лаконичная композиция, стиль luxury fashion advertising. Без логотипов, текста, водяных знаков и лишних предметов. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Пример 5. Ночная съёмка Реалистичное ночное фэшн-фото девушки в серебристом платье на осенней городской улице. Средний план, камера на уровне глаз, влажный асфальт, малая глубина резкости. Современная журнальная фотография, кинематографичная атмосфера, естественное лицо и корректная анатомия. Без случайных символов, без логотипов, без текста и лишних людей. Кликните по [этой ссылке], чтобы запустить генерацию с этим промтом. Генерация по референсам: общий обзор Референс — загруженное изображение, которое используется как визуальный ориентир. В Nano Banana web-версии платформы Yes AI можно добавлять фото в форматах JPG, JPEG и PNG. Поддерживается загрузка до десяти изображений. По референсу можно передать: лицо; внешность персонажа; одежду; позу; отдельный предмет; фон; композицию; палитру; освещение; художественный стиль. Качество исходных фото напрямую влияет на результат. Для лица желательно использовать чёткий портрет без сильных фильтров, размытия и закрывающих черты лица предметов. Референс одежды должен хорошо показывать фасон и материал, а референс позы — положение рук, ног и корпуса. Нейросеть Nano Banana поддерживает одновременную обработку до десяти референсов, однако использовать максимальное количество необязательно. Для работы достаточно двух-трёх референсов. Чем больше противоречащих друг другу референсов загружено, тем сложнее нейросети правильно определить назначение каждого из них. Использование нескольких референсов без назначения типов Nano Banana позволяет загрузить несколько фото без выбора типов. В таком случае промт должен ясно объяснять назначение каждого изображения. Например, можно объединить три отдельных портрета девушек в одну групповую фотографию. Для такой задачи важно указать: признаки, которые нужно сохранить; признаки, которые нужно изменить; список предметов для запрета отображения на генерации; количество людей; порядок расположения; общий масштаб; план съёмки; фон и свет. Пример промта для смешивания нескольких фото: Перенеси всех девушек моделей на одно фото. Сохрани позы, одежду, лица, черты лица, прически и индивидуальные особенности. Девушки на фото должны располагаться не перекрывая друг друга. Стиль: монохромное фэшн-фото с белыми акцентами, без надписей, логотипов и вотермарок. Если нейросеть начинает путать людей, задачу следует упростить: Уменьшить количество персонажей. Расположить их в один ряд. Исключить пересечение фигур. Использовать одинаково крупные портреты. Убрать противоречивые требования к позам. Повторить генерацию или разделить создание сцены на этапы. Типы референсов R, C, O, S, B, F, G и P Для более точного управления каждому фото можно назначить определённый тип референса. R — референс всего Тип референса R используется, когда изображение должно передать комплекс признаков: композицию, персонажа, одежду, фон, позу и визуальное оформление. Подходит для: колоризации чёрно-белого фото; редактирования исходного кадра; создания близкой вариации; изменения одного элемента при сохранении всей сцены. C — референс персонажа Тип C задаёт общий образ героя: внешность, силуэт, причёску и характерные признаки. Он полезен, если один персонаж должен появляться в разных локациях и одежде. В отличие от типа F, который сфокусирован на лице, C передаёт персонажа более комплексно. O — референс элементов Тип O используется для отдельного предмета или детали: сумки; украшения; обуви; мебели; упаковки; аксессуара. S — референс стиля Тип S передаёт художественную манеру, палитру, контраст, освещение, фактуру и атмосферу. B — референс фона Тип B отвечает за окружение: интерьер, улицу, природную локацию или студийную декорацию. F — референс лица Тип F предназначен для сохранения лица. Он передаёт форму и пропорции лица, глаза, нос, губы, брови и другие особенности. Лучше использовать: чёткий крупный портрет; фото с нейтральным выражением лица; фото без маски, очков или волос, закрывающих лицо; фото без агрессивных фильтров. Тип F не гарантирует абсолютного совпадения, поэтому результат необходимо проверять через сравнение с референсом (подробно о том, как это сделать расскажу чуть позже). G — референс одежды Тип G задаёт одежду: фасон, материал, цвет, рисунок, длину и декоративные элементы. Для качественного переноса вещь должна быть хорошо видна. Если половина костюма скрыта, недостающую часть нейросеть создаст самостоятельно. P — референс позы Тип P определяет положение тела, рук и ног, наклон корпуса, направление взгляда и ракурс. Важное ограничение при работе с типами референсов В одну генерацию можно загрузить несколько фото и назначить каждому отдельный тип. На практике наиболее устойчивые результаты получаются, когда типы назначены не более чем двум референсам в одной генерации. Если указать типы у трёх и более фото, нейросеть может: перепутать назначение изображений; проигнорировать отдельные функции; смешать лица и одежду; перенести фон из неподходящего файла; ослабить влияние нужного референса; выполнить только часть условий. Поэтому рекомендуемая схема — максимум два типизированных референса на один этап. Например: F + G — лицо и одежда; F + B — лицо и локация; F + S — лицо и стиль; C + P — персонаж и поза; G + B — одежда и фон; O + S — объект и визуальное оформление. Если требуется объединить три или четыре изображения, лучше добавить их в качестве референсов типа R и чётко сформулировать инструкции в промпте — например, указать, что на одной фотографии необходимо разместить трёх девушек-моделей. Если необходимо использовать более двух типов референсов то лучшим выбором будет GPT Images. Ознакомиться с инструкцией по GPT Images можно 👉 по этой ссылке. Когда промт с использованием референсов можно не писать Если хотя бы одному загруженному фото назначен тип, текстовый промт можно не указывать. Нейросеть способна запустить генерацию, ориентируясь на выбранный тип референса. Например, можно загрузить портрет, выбрать тип F и выполнить генерацию без текстового описания для создания фона. Однако в этом случае модель самостоятельно определит, композицию, фон и другие параметры, которые не зафиксированы выбранным типом. Для примера я взяла стоковое фото вертикальной ориентации. Использовала тип референса B для генерации фона в горизонтальной композиции. Вот что получилось: Отсутствие промта удобно для: быстрого тестирования типа референса; проверки того, как модель интерпретирует фото; поиска случайных идей; создания вариаций без строгого сценария. Для контролируемого результата промт всё же предпочтителен. Он задаёт параметры, которые выбранный тип не описывает: локацию, одежду, план, освещение, композицию и ограничения. Работа с фото после создания генерации После получения изображения пользователь может продолжить работу с ним, не создавая фото с нуля. Функция «Доработать» Функция «Доработать» позволяет использовать готовое изображение как основу нового задания. Система Yes AI автоматически добавит созданное фото как референс. Пользователь может изменить промт и самостоятельно запустить следующую генерацию. Функция подходит, если необходимо: заменить одежду; изменить фон; скорректировать освещение; убрать лишний объект; освободить место для текста; сделать кадр более реалистичным; изменить цветовую гамму; сохранить персонажа, но поменять локацию. Правки лучше выполнять поэтапно. Вместо требования одновременно поменять одежду, фон, позу, причёску и ракурс сначала замените одежду, а затем переходите к окружению. Пример точечной доработки: Сохрани лицо, причёску, фигуру, позу и ракурс без изменений. Замени только одежду на длинное чёрное платье из матового шёлка. Сохрани естественные складки ткани и реалистичное освещение. Функция «Сравнить с референсом» Функция «Сравнить с референсом» помогает сопоставить исходное фото с результатом. Она особенно важна при работе с лицом, одеждой, позой или конкретным предметом. При сравнении проверьте: сохранены ли черты лица; совпадает ли причёска; правильно ли перенесён фасон одежды; не изменилась ли поза; не появились ли лишние детали; соответствует ли фон поставленной задаче; не смешались ли признаки нескольких людей. Если отличия слишком велики, необходимо сделать запрос строже: отдельно перечислить элементы, которые требуется сохранить, и отдельно описать разрешённые изменения. Функция «Повторить» Функция «Повторить» запускает ещё одну генерацию с теми же настройками, промтом и исходными материалами. Она полезна, когда промт составлен правильно, но конкретная вариация получилась неудачной. Повторение создаёт новую интерпретацию, а не точную копию. Если нужно сохранить уже полученный кадр и изменить одну деталь, лучше использовать функцию «Доработать». Функция «Анимировать» Функция «Анимировать» позволяет использовать полученное фото как начальный кадр для видеогенерации. После перехода следует выбрать видеонейросеть и написать отдельный запрос, описывающий движение. В промте для видео рекомендуется указывать: действие человека; движение камеры; движение предметов; изменение освещения; темп сцены; стиль съёмки. Пример: Камера медленно приближается. Девушка делает один спокойный шаг вперёд и слегка поворачивает голову к объективу. Мягкое освещение. Волосы и ткань платья естественно движутся от слабого ветра. Без резких движений. 5424119773_1790944660120137.mp4 Подведём итоги Нейросеть Nano Banana заслуживает внимания как инструмент для создания фотореалистичных изображений: она позволяет получать детализированные кадры, естественно передавать внешность человека и сохранять узнаваемые черты при редактировании фотографий. Качество результата зависит от исходного изображения и точности запроса, поэтому для работы с портретами полезно отдельно указывать, какие особенности лица необходимо сохранить, а какие элементы — изменить. Nano Banana может стать хорошим выбором для тех, кому важны реалистичность и точная передача образа, однако готовые изображения стоит проверять на мелкие неточности. 1 Ссылка на комментарий Поделиться на другие сайты Поделиться
Рекомендуемые сообщения
Для публикации сообщений создайте учётную запись или авторизуйтесь
Вы должны быть пользователем, чтобы оставить комментарий
Создать аккаунт
Зарегистрируйте новый аккаунт в нашем сообществе. Это очень просто!
Регистрация нового пользователяВойти
Уже есть аккаунт? Войти в систему.
Войти