Перейти к содержанию

Чем полезен форум Yes Ai ?

  • Здесь вы найдете статьи о нейросетях: Midjourney, ChatGPT, Stable Diffusion, Sora, Flux.1, Kling Ai и других
  • Масса полезных инструкций для решения задач с помощью современных моделей ИИ
Статьи

Галерея бесплатных промтов

Откройте нашу галерею с бесплатными промтами для генерации изображений в нейросетях

Sora Images, Midjourney, SDXL, Stable Diffusion и Dalle-3

Галерея

API нейросетей для разработчиков

Добавьте функции нейросетей в собственное мобильное приложение,

веб-сайт или Telegram-бота

API

Хотите задать вопрос о нейросетях ?

Подробно опишите задачу, которую хотите решить с помощью ИИ,

а участники нашего сообщества постараются вам помочь. Это бесплатно!

Спросить
  • Форум о нейросетях и искусственном интеллекте

    ✌️ На форуме ИИ про нейросети Yes Ai размещены полезные статьи и бесплатные обучающие материалы про Midjourney, Chat GPT, Flux.1, Kling Ai, Stable Diffusion, SXDL и др. В галерее вы найдете множество промтов для генерации изображений в нейросетях.

    • Активность на форуме позволит получать бесплатные генерации в нейросетях через Telegram-бота @yes_ai_bot
    • Рекомендуем начать изучение форума про ИИ с прочтения статей 👇 или просмотра галереи работ нашего сообщества

    Добро пожаловать!

     

Форум ИИ о нейросетях

  1. Обсуждаем нейросети и искусственный интеллект

    В этом разделе обсуждаем нейронные сети, которые работают с видео, включая создание, стилизацию, редактирование видео и многое другое.

    Описание всех функций нейросети Nano Banana: генерация картинок по промтам и референсам (исходным фото), редактирование изображений и фотографий.

    Полезные статьи о нейросети для генерации изображений Midjourney. Как делать генерации в Миджорни, как писать промты, команды для нейросети.

    Sora Images

    • 39 постов

    Статьи о возможностях нейросети для генерации изображений Sora Images, разработанной компанией Open Ai. Промты, функции и настройки.

    Qwen Images

    • 41 пост

    Статьи про возможности нейросети Qwen Images и Qwen Edit для генерации изображений по промтам и референсам: полезные советы и примеры использования.

    Полезные статьи об использовании нейросети Flux.1 и ее расширенных возможностей. Как использовать LoRA и другие функции Flux.

    Советы и лайфхаки по использованию нейросети для работы с текстом Chat GPT / Gemma / LLaMA

    Описываем функции легендарной нейросети Stable Diffusion, позволяющей генерировать изображения и модифицировать их. Inpaint, Upscale и редактирование изображений.

    В этой ветке обсуждаем другие нейронные сети, которых нет в основном списке (например, HeyGen, Deforum и пр.)

  2. Новости про ИИ и нейросети

    В этом разделе публикуем новости о нейросетях и достижениях в развитии искусственного интеллекта.

    Новости проекта Yes Ai - @yes_ai_official. Обновления форума ИИ, новые функции нейросетей для работы с текстом, видео, изображениями и пр.

  3. Другие темы

    В этом разделе вы можете задать вопросы и получить ответы на темы, связанные с нейросетями и проектом Yes Ai. Здесь вы можете узнать, как решить конкретные задачи с ИИ.

    Здесь можно общаться на темы, связанные с нейросетями лишь косвенно. Расскажите о своем опыте, поделитесь кейсами при работе с ИИ - это будет интересно.

    Здесь мы публикуем информацию о бесплатных раздачах доступа к нейросетям в системе @yes_ai_bot, а также объявляем конкурсы, за участие в которых вы можете получать бонусы.

    Здесь вы можете написать свое видение того, что можно улучшить на форуме или в проекте Yes Ai. Форум ИИ про использование нейросетей может стать еще лучше!

    admin
  • Актуальные обсуждения

  • Новые сообщения

    • Аннотация публикации: Обновление Yes AI 2.1 включает в себя расширенные возможности генерации изображений и новые инструменты для работы с видео. В GPT Images 2 появилась настройка качества (Low, Medium, High), позволяющая оптимизировать баланс между скоростью, стоимостью и детализацией генерируемых изображений, подходящая как для инфографики, так и для фотореалистичных визуалов. Разрешение остается отдельным параметром. Также в Qwen Images полностью реализован функционал работы с референсами, включая удаление фона, восстановление старых фотографий и колоризацию черно-белых снимков, что упрощает обработку изображений на основе примеров. Кроме того, теперь доступна нейросеть DeepFace Video, позволяющая заменять лицо в видео по фотографии, открывая новые возможности для создания контента, тестовых креативов и развлекательного видеомонтажа. Новые функции доступны как через API, так и непосредственно в боте @yes_ai_bot.
    • GPT (Sora) Images — нейросеть для генерации изображений по тексту и редактирования фото с помощью промптов. Нейросеть создаёт сцены с нуля, учитывает загруженные референсы, заменяет отдельные объекты, восстанавливает старые фотографии и добавляет надписи на генерацию. Для русскоязычных пользователей важна поддержка кириллицы: инструмент может выводить фразы на русском языке, но перед публикацией их следует проверить на опечатки и искажения букв. В этом обзоре разберём основные возможности GPT (Sora) Images, доступные разрешения и соотношения сторон, уровни качества, стоимость генераций и работу со стилями. Посмотрим и на ограничения. У модели бывают проблемы с мелкими деталями, а на некоторых изображениях заметен цифровой шум — особенно в тенях, на однородном фоне и при низком качестве. Материал пригодится тем, кто создаёт обложки, рекламные макеты, иллюстрации, карточки товаров и визуальный контент для социальных сетей. Примеры промптов можно копировать и адаптировать под свои задачи. Что умеет GPT (Sora) Images? У GPT (Sora) Images три основных режима работы: генерация изображений по промпту; генерация изображений на основе референса; редактирование изображений по текстовой инструкции. Эти возможности могут пересекаться. Например, пользователь загружает фотографию товара, просит сохранить его внешний вид, заменить фон и добавить рядом несколько предметов. Формально это редактирование, но значительная часть нового изображения создаётся заново. Нейросеть понимает обычные фразы. Промпт не обязательно превращать в длинное перечисление тегов — часто ясное описание сцены работает лучше. Удобная схема запроса выглядит так: главный объект → действие → окружение → композиция → освещение → визуальный стиль → текст в кадре → ограничения Не все пункты нужны одновременно. Если требуется простой предметный кадр, достаточно описать товар, поверхность, фон, направление света и положение объекта. Генерация изображений по промпту Генерация изображений по промпту подходит для задач, в которых исходного файла нет. Пользователь описывает будущую сцену словами, выбирает разрешение, соотношение сторон, качество и при необходимости добавляет стилевые пресеты. Вот пример запроса для обложки статьи: Горизонтальная редакционная иллюстрация о работе искусственного интеллекта. В центре — прозрачный экран с окном генерации изображений, слева в него входит текстовый промпт, справа появляется готовая иллюстрация. Тёмно-синий фон, белые и оранжевые акценты, чистая композиция, крупные формы, свободное место в верхней части. Добавь точный русский заголовок: «КАК РАБОТАЕТ GPT (SORA) IMAGES». Без логотипов, водяных знаков и дополнительного текста. В запросе сразу указаны формат, сюжет, палитра и место для заголовка. Есть и ограничения. Это снижает вероятность появления лишних надписей, хотя полностью исключить их одним запретом нельзя. Если первая генерация получилась близкой к задаче, но не идеальной, не стоит переписывать весь промпт. Лучше изменения вносить поэтапно: заменить для начала положение объекта, цвет фона или характер освещения. Так легче понять, на какую именно формулировку отреагировала GPT (Sora) Images. Как получить предсказуемую композицию при генерации изображений Слова «красиво», «стильно» и «эффектно» почти ничего не говорят о расположении объектов. Практичнее использовать пространственные указания: объект расположен в левой трети кадра; камера находится на уровне глаз; вид строго сверху; справа остаётся свободное место; главный персонаж показан по пояс; источник света находится слева; фон размыт, но окружение остаётся узнаваемым. Если нужен баннер с последующей вёрсткой, заранее попросите оставить отрицательное пространство. Иначе модель заполнит весь кадр декоративными деталями, а заголовок придётся накладывать поверх важных объектов. Генерация изображений на основе референса Референс помогает показать нейросети то, что трудно подробно описать словами. Это может быть фотография предмета, персонаж, эскиз, палитра, пример композиции или изображение с подходящим освещением. Если вы отправляете запрос в нейросеть с изображением-референсом, обязательно добавьте промт с описанием того, что нужно сделать с объектами на исходных изображениях. GPT Images может использовать референсы для нескольких типов работы. Смешивание изображений Можно загрузить несколько материалов и попросить объединить их признаки. Например: взять товар с первого изображения; использовать интерьер со второго; перенести цветовую палитру с третьего; собрать всё в единую сцену. Промпт лучше строить так, чтобы роль каждого файла была очевидна: Используй флакон с первого референса как главный объект. Сохрани его форму, пропорции, цвет стекла и крышку. Из второго референса возьми только композицию и направление света. Из третьего — бежево-зелёную палитру. Размести один флакон на каменной подставке, оставь свободное место слева. Не копируй текст и логотипы с референсов. При смешивании не стоит писать «объедини всё». Такая команда оставляет слишком много неопределённости. Лучше назначить каждому изображению конкретную функцию. Модификация референса Нейросеть позволяет менять фон, одежду, освещение, материалы и отдельные предметы. При этом важно отдельно перечислить элементы, которые должны сохраниться. Пример: Сохрани лицо, причёску, позу и ракурс человека с исходного изображения. Замени повседневную одежду на тёмно-синий деловой костюм без галстука. Перенеси сцену в светлую современную библиотеку. Сделай мягкое дневное освещение. Не меняй возраст, черты лица и выражение глаз. Фраза «не меняй человека» слишком общая. Модель может сохранить узнаваемость, но изменить причёску, возраст или мимику. Чем точнее перечислены постоянные элементы, тем меньше свободы остаётся у алгоритма. Реставрация фотографий GPT Images можно применять для восстановления старых и повреждённых снимков: удаления царапин, повышения читаемости деталей, коррекции выцветших участков и колоризации. Пример промпта: Аккуратно восстанови старую семейную фотографию. Удали царапины, заломы, пятна и следы пыли. Восстанови повреждённые края, сохрани лица, возраст людей, одежду, позы и композицию. Не добавляй новых предметов и не меняй черты лица. Сохрани характер плёночной фотографии, умеренное зерно и естественный контраст. Не превращай снимок в современный цифровой портрет. Здесь есть важное замечание. Нейросеть не извлекает утраченную информацию из пустого места, а правдоподобно достраивает её. Если часть лица полностью уничтожена, результат будет предположением. Для семейного архива это следует учитывать, а при работе с историческими документами — обязательно обозначать факт реконструкции.  Перенос визуального направления Референс можно использовать не ради копирования конкретной работы, а для передачи общих свойств: палитры, контраста, расположения объектов и характера света. Лучше писать: Используй референс только как ориентир по приглушённой палитре, мягким теням и минималистичной композиции. Не копируй персонажей, предметы и мелкие детали. Если референс создан другим автором, необходимо проверить право на его использование. Файл из поисковой выдачи не становится "свободным" только потому, что его можно скачать. Редактирование изображений и фото в GPT (Sora) Images Редактирование изображений отличается от полной перегенерации тем, что пользователь уже имеет основу. Задача модели — выполнить изменение и по возможности сохранить всё остальное. GPT (Sora) Images можно попросить: удалить объект; заменить фон; добавить новый предмет; изменить цвет одежды или товара; расширить изображение за исходные границы; поменять время суток; скорректировать освещение; адаптировать горизонтальную сцену под вертикальный формат; восстановить повреждённый снимок; убрать надпись; добавить русский текст; превратить эскиз в реалистичный кадр; изменить визуальный формат, например фотографию на иллюстрацию. Полезная формула для локального редактирования: Измени только [элемент]. Сохрани без изменений [перечень важных деталей]. Новый элемент должен выглядеть [характеристики]. Не меняй [критические ограничения]. Пример: Замени только фон на спокойную кухню с матовыми светло-серыми фасадами. Сохрани чашку, её форму, рисунок, положение ручки, масштаб и исходный ракурс. Направление света должно остаться прежним. Не добавляй еду, посуду, людей и надписи. Слово «только» полезно, но само по себе не гарантирует точечного изменения. Поэтому за ним должен идти список того, что необходимо сохранить. Как GPT (Sora) Images работает с русским текстом Одна из заметных особенностей GPT Images — нейросеть хорошо генерирует текст на русском языке на изображениях. Это полезно при создании: обложек статей; афиш; плакатов; карточек для социальных сетей; рекламных баннеров; упаковки; схем и инфографики; простых интерфейсных макетов. Лучше всего модель справляется с короткими заголовками. Чем больше текста, тем выше риск получить пропущенную букву, неправильное окончание или случайную дополнительную надпись. Чтобы повысить точность, заключайте фразу в кавычки и отдельно указывайте, что она должна быть воспроизведена без изменений: Создай вертикальный постер. В верхней части размести точный русский текст: «ИДЕИ ДЛЯ НОВОГО ПРОЕКТА». Воспроизведи надпись без изменений, сохрани все буквы и пробелы. Используй крупный белый геометрический шрифт. Не добавляй другой текст. Для длинных материалов разумнее сгенерировать изображение без типографики, а надписи добавить в графическом редакторе. Так проще контролировать шрифт, переносы, интервалы и соответствие фирменному стилю. Даже удачный заголовок нужно проверить вручную. Посмотрите на буквы «Ё» и «Й», окончания слов, кавычки, тире, даты и цифры. Иногда ошибка обнаруживается не сразу, потому что визуально надпись выглядит убедительно. Разрешение GPT (Sora) Images: 1K, 2K и 4K В интерфейсе веб-версии Yes AI 2.1 можно выбрать три разрешения GPT Images: 1K; 2K; 4K. Выбор зависит от задачи. Для черновых тестов обычно достаточно 1K. Это позволяет проверить сюжет, композицию и общую трактовку промпта, не расходуя повышенную стоимость на вариант, который может не подойти. Разрешение 2K уместно для публикаций, обложек, презентаций и изображений, где уже важны мелкие детали. Режим 4K имеет смысл выбирать для крупного экспорта, печати, детализированных рекламных материалов или последующего кадрирования. Есть нюанс. Разрешение 4K не исправляет неудачную композицию и не гарантирует безошибочную анатомию. Оно увеличивает размер и потенциальную детализацию результата, поэтому финальный вариант выгоднее создавать после проверки идеи в 1K или 2K. Практичная последовательность выглядит так: Сделать пробную генерацию в 1K. Исправить промпт и композицию. Выбрать удачное изображение. Повторить или доработать изображение в 2K либо 4K. Проверить мелкие элементы в полном масштабе. Так стоимость тратится на финальную версию, а не на первые эксперименты. Соотношения сторон GPT (Sora) Images В интерфейсе веб-версии Yes AI 2.1 доступны следующие соотношения сторон GPT Images: 1:1 — 1024 × 1024; 2:3 — 1024 × 1536; 3:2 — 1536 × 1024; 3:4 — 1104 × 1472; 4:3 — 1472 × 1104; 4:5 — 1152 × 1440; 5:4 — 1440 × 1152; 9:16 — 944 × 1680; 16:9 — 1680 × 944; 9:21 — 816 × 1904; 21:9 — 1904 × 816. Указанные размеры относятся к отображённым в интерфейсе вариантам. При выборе другого разрешения итоговое число пикселей может отличаться, поэтому его следует проверять перед запуском. Формат 1:1 подходит для универсальных карточек, аватаров и квадратных публикаций. Соотношения 4:5 и 3:4 удобны для портретов, товаров и ленты социальных сетей. Форматы 9:16 и 9:21 рассчитаны на вертикальный контент, мобильные экраны и длинные постеры. Для обложки статьи обычно выбирают 16:9. Более широкий формат 21:9 пригодится для панорамного баннера, сайта или кинематографичной сцены. Соотношения 3:2, 4:3 и 5:4 близки к привычным фотографическим форматам и подходят для пейзажей, предметной съёмки и редакционных иллюстраций. Соотношение сторон влияет не только на размер холста, но и на композицию. Один и тот же промпт в 1:1 и 9:16 может дать заметно разные результаты. В вертикальном кадре модель часто перестраивает позу человека и увеличивает количество пространства сверху или снизу. Поэтому формат нужно выбирать до генерации, а не после неё. Качество генерации: Low, Medium и High GPT Images предлагает три уровня качества: Low; Medium; High. Качество сильно влияет и на результат, и на цену. Режим Low подходит для быстрых эскизов, проверки идеи и перебора композиций. В Medium обычно имеет смысл выполнять основную часть рабочих генераций. High стоит оставлять для финальных изображений, сложных фактур, лиц, надписей и сцен с большим количеством важных деталей. Однако даже High не отменяет необходимость проверки. Модель может создать крупный и детализированный кадр, но ошибиться в логике отражения, количестве пальцев или написании слова. Стоимость одной генерации GPT (Sora) Images в зависимости от разрешения и качества Согласно 👉 прайсу, стоимость одной генерации указана во внутренних единицах сервиса Yes AI: Разница существенная. Одна генерация в 4K High стоит в 69,6 раза дороже, чем вариант 1K Low: 104,4 против 1,5 внутренней единицы. Поэтому начинать работу сразу с максимальных настроек не всегда рационально.  Цены от Open AI могут меняться. Перед запуском следует проверить актуальные значения в интерфейсе платформы Yes AI и уточнить, как внутренняя единица пересчитывается в реальную стоимость на выбранном тарифе. Для разных этапов можно использовать такую схему: 1K Low — черновой поиск идеи; 1K Medium — проверка более сложного промпта; 2K Medium — основной рабочий вариант; 2K High — изображение с лицами, мелкими предметами или текстом; 4K High — финальный экспорт, если действительно нужна крупная версия. Если задача — найти композицию, десять недорогих попыток могут принести больше пользы, чем одна генерация на максимальном качестве. Сначала нужно попасть в сюжет. Детализацию можно повышать позже. Выбор стиля в GPT (Sora) Images В показанном интерфейсе разрешено выбрать до трёх стилей одновременно. Доступны режимы Random и No style, а также готовые направления, такие как: 3D; Advertising; Anime; Architecture; Art deco; BioCyber; Biomechanical; Cinema; Color shift; ComicBook; Cubism; Cybernetic; Cyberpunk; Detailed; Disco; Dystopian; FairyTale; Fantasy и т.д. Random подойдёт для эксперимента, когда конкретное визуальное направление не определено. Но для повторяемой работы случайный стиль неудобен: трудно понять, что именно повлияло на результат. No style полезен, если промпт уже содержит подробное художественное описание. Предустановленный пресет способен спорить с текстовой инструкцией. Например, запрос на спокойную документальную фотографию и одновременно выбранный стиль Cyberpunk дают модели два разных направления. Сочетание двух или трёх стилей может дать интересный результат, если они выполняют разные функции. Например, Architecture + Cinema + Detailed задают тему, характер света и уровень визуальной проработки. А комбинация нескольких близких декоративных стилей способна перегрузить изображение. Для контролируемого теста лучше менять по одному параметру: создать результат в режиме No style; повторить тот же запрос с одним стилем; сравнить композицию, палитру и фактуры; только потом добавить второй пресет. Примеры генераций GPT (Sora) Images Ниже — несколько промптов, которые проверяют разные возможности нейросети. Для чистоты эксперимента полезно запускать каждый запрос один раз, а затем оценивать соответствие исходному описанию. Пример 1. Рекламная предметная фотография Матовая тёмно-зелёная бутылка оливкового масла без логотипа стоит на светлой каменной поверхности. Рядом лежат три оливки и одна небольшая ветка с листьями. Мягкий солнечный свет падает слева, на стене видна длинная размытая тень. Реалистичная предметная фотография, спокойная натуральная палитра. Бутылка расположена в правой трети кадра, слева оставлено чистое пространство для текста. Без дополнительной посуды, без людей, без надписей. Что проверять: количество предметов, расположение бутылки, материал стекла и наличие свободного пространства. Пример 2. Постер с русским текстом Вертикальный минималистичный плакат о цифровой грамотности. Тёмно-синий фон, в центре изображён простой оранжевый лабиринт в форме человеческой головы. В верхней части размести точный русский заголовок: «ПРОВЕРЯЙ ИСТОЧНИКИ». Крупные белые буквы без засечек, ровная строка, высокая читаемость. Воспроизведи надпись без изменений. Без логотипов, мелкого текста и водяных знаков. Что проверять: орфографию, форму букв, отсутствие лишних надписей и визуальную иерархию. Пример 3. Редактирование интерьера Загрузите фотографию комнаты и добавьте инструкцию: Сохрани планировку комнаты, положение окон, стены, пол и перспективу. Замени только мебель: добавь светло-серый диван, низкий деревянный стол и одно кресло горчичного цвета. Сделай интерьер жилым, но не перегруженным. Сохрани исходное дневное освещение. Не добавляй людей, растения, картины и текст. Что проверять: сохранение геометрии комнаты и отсутствие изменений за пределами поставленной задачи. Пример 4. Смешивание двух референсов Загрузите фотографию предмета и отдельный пример окружения: Возьми настольную лампу с первого изображения. Сохрани её форму, цвет, материал и пропорции. Помести её в рабочий кабинет со второго изображения, но не копируй остальные предметы буквально. Лампа стоит на деревянном столе и включена. Создай естественные тени и согласуй направление света с окружением. Не меняй конструкцию лампы, не добавляй надписей и логотипов. Что проверять: узнаваемость исходного предмета, масштаб и согласованность освещения. Пример 5. Реставрация Восстанови старую чёрно-белую фотографию. Удали царапины, пыль, пятна и залом в правом верхнем углу. Сохрани лица, одежду, фон и плёночную фактуру. Повышай резкость умеренно, не сглаживай кожу и не меняй выражения лиц. Не раскрашивай изображение и не добавляй новые детали. Что проверять: сохранение черт лица и отсутствие чрезмерной цифровой обработки. Пример 6. Обложка статьи Горизонтальная обложка статьи о генерации изображений. На переднем плане — рука, вводящая текстовый промпт в прозрачный интерфейс. За экраном из цветных пикселей постепенно формируется реалистичный городской пейзаж. Графитовый фон, синие и оранжевые акценты, мягкое объёмное освещение. Оставь свободное место вверху для заголовка. Современная редакционная иллюстрация, без логотипов, надписей и мелких интерфейсных элементов. Что проверять: читаемость идеи, переход от текста к изображению и свободную область для вёрстки. Преимущества GPT (Sora) Images Хорошая работа с русским текстом GPT Images хорошо генерирует текст на русском языке на изображениях. Это заметное преимущество для обложек, афиш, рекламных макетов и визуальных карточек. Короткие фразы нередко можно получить сразу внутри композиции, а не накладывать после генерации. Проверка ошибок обязательна. Особенно если в надписи есть редкие слова, числа, несколько строк или сложная пунктуация. Понимание обычных текстовых инструкций Промпт можно писать связными предложениями. Модель понимает просьбы сохранить конкретные элементы, заменить фон, оставить свободное место и изменить только часть сцены. Это удобно для пользователей, которые не хотят собирать запрос из десятков технических тегов. Генерация и редактирование в одном рабочем процессе Необязательно переходить между несколькими инструментами. После создания изображения можно попросить изменить цвет, переместить объект, удалить деталь или адаптировать сцену под другой формат. Поддержка референсов Референсы подходят для смешивания, модификации, восстановления, переноса композиции и работы с визуальной идентичностью предмета. Они сокращают объём текстового описания и помогают показать модели желаемый результат. Выбор разрешения, качества и пропорций Разрешения 1K, 2K и 4K позволяют разделить черновой и финальный этапы. Несколько соотношений сторон охватывают квадратные, вертикальные, горизонтальные и панорамные задачи. Недостатки GPT (Sora) Images Цифровой шум На изображениях может появляться цифровой шум. Он заметен на однородных поверхностях, в тенях, на коже, стенах и плавных градиентах. Иногда шум воспринимается как фактура, но в рекламной или предметной фотографии выглядит как дефект. Стоит проверить результат при масштабе 100%. В некоторых случаях помогает более высокий уровень качества, более мягкое описание освещения или повторное редактирование проблемного участка. Для финального файла может понадобиться шумоподавление в графическом редакторе. Цена заметно растёт вместе с настройками Переход от 1K Low к 4K High многократно увеличивает стоимость одной генерации. Это особенно ощутимо, если для поиска нужной композиции требуется серия попыток. Возможны изменения исходного объекта При редактировании модель иногда исправляет больше, чем просили: меняет лицо, форму товара, фоновые детали или освещение. Поэтому в промпте приходится подробно перечислять то, что должно остаться без изменений. Ошибки в мелких деталях Проблемы могут возникать с пальцами, отражениями, украшениями, повторяющимися элементами, геометрией мебели и взаимодействием персонажа с предметами. Чем сложнее действие, тем выше вероятность артефактов. Текст требует проверки Несмотря на хорошую работу с русским языком, модель не заменяет корректора. Она способна пропустить букву, изменить окончание или добавить лишние символы. Высокое разрешение не гарантирует точность 4K увеличивает размер изображения, но не устраняет смысловые ошибки. Если персонаж держит предмет неправильно, повышение разрешения лишь сделает эту ошибку более заметной. Где применять GPT (Sora) Images? Возможности GPT Images пригодятся в разных сценариях: обложки статей и публикаций; иллюстрации для блогов; рекламные баннеры; постеры и афиши; карточки товаров; предметные изображения; концепты упаковки; раскадровки; презентации; визуализация интерьеров; эскизы персонажей; образовательные материалы; инфографика с короткими надписями; адаптация контента под разные форматы; восстановление семейных фотографий; фоны и графические элементы для сайтов. Не каждую генерацию можно сразу использовать в коммерческом проекте. Следует проверить права на загруженные референсы, допустимость обработки лиц людей и условия коммерческого использования результата. Инструкция по работе с GPT Images Шаг 1. Откройте GPT Images 👉 по ссылке Сформулируйте задачу одним связным описанием. Укажите главный объект, окружение, композицию, свет и ограничения. Шаг 2. Выберите разрешение Для первого теста выберите 1K. Разрешения 2K и 4K разумнее использовать после того, как композиция и содержание изображения уже определены. Шаг 3. Укажите соотношение сторон Выберите формат под площадку: 1:1 для квадрата, 9:16 для вертикальной публикации, 16:9 для обложки или 21:9 для панорамного баннера. Шаг 4. Настройте качество Low подходит для черновиков, Medium — для основной работы, High — для финальных генераций, если повышенная детализация оправдывает стоимость. Шаг 5. Выберите стиль Можно включить до трёх стилей одновременно. Если промпт подробно описывает визуальное направление, попробуйте сначала No style. Режим Random лучше оставить для свободных экспериментов.  Рекомендуется использовать стиль Shining - это позволит немного улучшить качество создаваемых генераций. Шаг 6. Загрузите референс (при необходимости) Нажмите на значок скрепки для добавления референса.   Загрузите изображение или фото в формате jpg, jpeg или png. Напишите текстовое примечание для загруженного изображения. Не ограничивайтесь фразой «сделай похоже». Укажите, нужно ли сохранить предмет, лицо, композицию, палитру или освещение. Шаг 7. Запустите генерацию и дождитесь окончания генерации Проверьте результат: соответствие промпту; написание русского текста; лица и руки; края объектов; отражения и тени; наличие цифрового шума; случайные логотипы и подписи; сохранность элементов референса. Если нужно исправление, сформулируйте его отдельным текстовым сообщением и перечислите детали, которые нельзя менять. API для GPT (Sora) Images GPT Images можно использовать не только через графический интерфейс, но и через API. Такой вариант подходит разработчикам, редакциям, интернет-магазинам и сервисам, которым требуется автоматизировать генерацию или редактирование изображений. Через API можно выстроить собственный процесс (основные тезисы): Строго запрещены любые намёки на 18+ и иной NSFW-контент. Производите фильтрацию по стоп-словам и стоп-фразам ещё до подачи заданий на наш API. Нейросеть Sora Images может генерировать изображения по промту, то есть по текстовому описанию, на любом языке, включая русский. Sora Images поддерживает загрузку от 1 до 10 изображений, которые можно использовать как референсы для генерации изображения. Если вы отправляете запрос в API с хотя бы одним изображением-референсом, обязательно добавьте промт с описанием того, что нужно сделать с объектами на исходных изображениях. Sora может генерировать изображения со следующими соотношениями сторон: 1:1, 2:3, 3:2, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 9:21, 21:9. Вы также можете выбирать размер изображений: 1K, 2K, 4K. Важно: ограничение площади генераций в пикселях - 8294400. Доступна опция выбора качества генераций: low / medium / high. По каждому запросу API возвращает только одно изображение. Для производственного сценария полезно сохранять вместе с результатом: исходный промпт; идентификатор модели; дату генерации; разрешение; соотношение сторон; уровень качества; список референсов; инструкции редактирования; стоимость операции. Это упрощает повторение удачного результата и помогает понять, почему две генерации отличаются. Как снизить расходы и получить более точный результат с помощью GPT (Sora) Images Рабочая стратегия для GPT Images довольно проста. Сначала — дешёвый тест, затем уточнение, после него финальная генерация. Начните с 1K Low или 1K Medium. Проверьте расположение объектов, общий смысл и соответствие формату. Если сцена работает, исправьте промпт и только потом переходите к 2K либо 4K. Не меняйте сразу пять параметров. Допустим, изображение получилось слишком тёмным, объект смещён к центру, а фон перегружен. Сначала уточните композицию. Затем исправьте освещение. После этого сократите количество деталей на фоне. При работе с референсом перечисляйте неизменяемые признаки. Для товара это форма, цвет, материал, пропорции и расположение элементов. Для портрета — черты лица, возраст, причёска, выражение и ракурс. И всегда открывайте готовое изображение в полном размере. Цифровой шум, ошибки в русском тексте и странные отражения легко пропустить на маленькой превью-картинке. Заключение GPT Images объединяет генерацию и редактирование изображений по промпту и референсу в одном процессе. Это удобно для быстрых концептов и последовательной доработки, но результат требует проверки. Для черновиков достаточно 1K и низкого либо среднего качества. Для финальной иллюстрации можно перейти к 2K или 4K, предварительно убедившись, что выбранное соотношение сторон подходит площадке. Если в кадре есть русский текст, его нужно вычитать. Если использовались референсы — проверить права на исходные материалы. Отдельное внимание стоит уделить цифровому шуму. Он не всегда заметен в интерфейсе, зато проявляется после скачивания и увеличения изображения. Хороший промпт для GPT Images не обязан быть длинным. Он должен быть ясным. Чем точнее описаны главный объект, композиция, свет и элементы, которые нельзя менять, тем меньше времени уйдёт на случайные попытки.
    • Вышло обновление Yes AI 2.1 — добавили настройки качества для изображений, расширили работу с референсами и открыли доступ к DeepFace Video. 🔹 GPT Images 2 теперь поддерживает выбор качества генерации Для модели GPT Images 2 появился новый параметр качества. Теперь можно гибко подбирать режим под задачу: быстро собрать картинку для черновика, сделать аккуратную инфографику или получить максимально чистый фотореализм. Доступны три варианта: Low — базовое качество, используется по умолчанию. Хорошо подходит для инфографики, макетов и изображений с текстом. Для реалистичных фото лучше выбрать режим выше. Medium — оптимальный вариант на каждый день. Балансирует между стоимостью, скоростью и качеством. При генерации фотореалистичных изображений заметно меньше визуального шума. High — режим для задач, где нужен лучший результат. Подойдет для коммерческих визуалов, промо-материалов и генераций, к которым предъявляются повышенные требования. 📌 Качество и разрешение — не одно и то же. Разрешение, как и раньше, задается отдельным параметром. А настройка quality влияет именно на уровень проработки результата. Подробнее об этом рассказывали ранее. 🚩 Новый параметр quality уже доступен в API Yes AI для GPT Images 2. Документация обновлена. В боте @yes_ai_bot выбор качества генераций тоже уже появился. 🔹 В Qwen Images открыли полный набор инструментов для работы с референсами Теперь доступны все функции, которые помогают редактировать и улучшать изображения на основе загруженных примеров: удаление фона; восстановление старых фотографий; колоризация черно-белых снимков; другие операции с референсами. Это удобно, когда нужно быстро привести изображение в порядок, подготовить фото для публикации или обновить старый визуал без сложной ручной обработки. 🔹 Добавлен доступ к DeepFace Video В Yes AI 2.1 также открыли доступ к нейросети DeepFace Video. Она позволяет заменить лицо в видео по одной фотографии. Загружаете снимок, выбираете видео — и модель переносит лицо в ролик. Инструмент может пригодиться для контента, тестовых креативов, видеомонтажа и развлекательных сценариев.
    • Замена лица в видео больше не требует ручной обработки каждого кадра. Нейросеть DeepFace Video работает с двумя исходниками: фотографией человека и роликом, где требуется изменить внешность героя. Пользователю достаточно загрузить оба файла и запустить обработку. Составлять длинный промпт и разбираться в сложных настройках не придётся. Качество замены лица зависит от фотографии и исходного ролика. Если часть лица закрывают волосы, человек резко поворачивает голову либо подходит близко к камере, цифровая маска может смещаться. Перед загрузкой проверьте материалы: это снизит риск ошибок и сократит число повторных попыток. Далее разберём, как заменить лицо в видео через DeepFace Video, подготовить исходники и избежать смещения маски. Как работает замена лица в видео Для обработки потребуются два файла: фотография с лицом, которое нужно перенести; видео, в котором будет выполнена замена. Нейросеть анализирует черты лица на фотографии, затем находит человека в ролике и переносит его внешность на обнаруженную область. При этом сохраняются движения головы, мимика и основная динамика исходного видео — насколько точно, зависит от качества материалов и сложности сцены. DeepFace Video заменяет одно лицо. Если персонаж появляется в кадре один, выбор очевиден. Если в первых кадрах находятся несколько людей, действует важное правило: для замены выбирается лицо, расположенное слева. Если в начале ролика виден только один человек, а остальные появляются позднее, обрабатывается то лицо, которое первым появилось на таймлайне. Это нужно учитывать ещё при выборе или монтаже исходного видео. Иногда достаточно обрезать несколько первых кадров, чтобы нужный персонаж оказался первым в ролике. Как сделать замену лица в видео с помощью нейросети DeepFace Video Рабочий процесс состоит из нескольких простых действий: Шаг 1. Выберите DeepFace Video Перейдите по ссылке 👉 DeepFace Video. Создайте новый чат и добавьте название. Так чат с нейросетью будет находится в отдельной вкладке. Шаг 2. Загрузите исходное видео Нажмите на значок скрепки слева от строки ввода. На скриншоте показана подсказка «Загрузите видео для замены лица (mp4)». Выберите ролик в формате MP4 и дождитесь окончания загрузки. Перед добавлением файла необходимо посмотреть видео. Нейросеть заменит лицо, которое первым появится на таймлайне. Если в начальном кадре сразу находятся несколько людей, будет выбрано лицо слева. Шаг 3. Добавьте фотографию лица Загрузите фотографию человека, чьё лицо должно появиться в видео. Для этого используйте соответствующую кнопку добавления изображения в интерфейсе. После загрузки видео необходимо добавить фотографию в формате jpg, jpeg или png. Лучше выбрать чёткий снимок анфас. Лицо должно быть хорошо освещено, находиться в фокусе и не закрываться волосами, очками с сильными бликами, маской или рукой. Нейтральное выражение обычно удобнее для переноса, чем сильно выраженная эмоция. Не стоит брать маленькое лицо из общей фотографии. Даже если сам файл имеет высокое разрешение, нужная область может содержать слишком мало деталей. Шаг 4. Проверьте прикреплённые файлы Перед запуском убедитесь, что загружены оба материала: исходное видео для обработки; фотография с новым лицом. Также проверьте, тот ли ролик выбран и правильно ли он начинается. Если первым появляется не нужный персонаж, лучше заранее обрезать видео или изменить начальный фрагмент. Шаг 5. При необходимости введите запрос Для обычной замены лица промпт не обязателен. Поле «Введите запрос…» можно оставить пустым. Нейросеть DeepFace Video получает основную информацию из фотографии и видеоролика. Подробно описывать внешность человека не нужно. Модель ориентируется на изображение, а не пытается создать лицо только по тексту. Шаг 6. Запустите обработку и проверьте результат Отправьте материалы в обработку и дождитесь готового ролика. Затем посмотрите его полностью, а не только первые секунды. Особое внимание уделите моментам, где человек: поворачивает или наклоняет голову; подносит руку к лицу; проходит через тень; оказывается частично закрыт другим объектом; приближается к камере; быстро меняет выражение лица; выходит из кадра и возвращается. Как подготовить фотографию для замены лица Качественная фотография — один из главных факторов удачной обработки. Лучше использовать портрет анфас, на котором хорошо видны глаза, нос, губы, подбородок и контур лица. Проверьте снимок по короткому списку: лицо находится в фокусе; освещение равномерное; кожа не пересвечена и не скрыта глубокой тенью; голова не повёрнута в профиль; лицо не закрывают волосы и посторонние предметы; на изображении нет сильных фильтров; фотография не размыта; в кадре нет нескольких лиц. Портрет не обязательно должен быть студийным. Подойдёт обычная фотография с телефона, если человек снят достаточно близко, камера не смазала детали, а изображение не пережато при пересылке. Полезный приём: не отправляйте снимок через мессенджер перед загрузкой, если он заметно сжимает файлы. Лучше использовать оригинал фотографии. Каким должно быть исходное видео Нейросети проще работать с чётким и равномерно освещённым роликом. Если лицо состоит из нескольких размытых пикселей, постоянно исчезает в тени или перекрывается предметами, восстановить стабильную маску будет сложно. Желательно, чтобы человек находился примерно в одном-двух метрах от камеры. Это не строгое техническое ограничение, а практический ориентир. При слишком крупном плане становятся заметнее несовпадения текстуры кожи и контуров, а сама замена лица может выглядеть менее аккуратно. Лучше выбирать ролики, где: лицо занимает умеренную часть кадра; персонаж не совершает резких движений; голова не разворачивается надолго в полный профиль; лицо не закрыто руками, волосами, микрофоном или одеждой; освещение не меняется каждую секунду; камера не создаёт сильное размытие в движении; разрешение позволяет различить основные черты лица. Если герой сильно поворачивает голову, маска может «соскочить»: на отдельных кадрах появится исходное лицо, сместятся контуры или возникнет заметное мерцание. Похожая проблема возникает, когда человек выходит из кадра, а затем возвращается под другим углом. Видео номер один.mp4   5424119773_1787369851450579.mp4   5424119773_1787372868671552.mp4 Как выбрать нужного человека, если в кадре несколько лиц DeepFace Video обрабатывает одно обнаруженное лицо. Выбор происходит по началу видеоряда: Нейросеть находит лицо, которое первым появляется на таймлайне. Если в первых кадрах присутствуют несколько людей, выбирается человек слева. Лица других участников сцены остаются без замены. Поэтому групповой ролик лучше предварительно отредактировать. Обрежьте начало так, чтобы нужный человек появился раньше остальных. Другой вариант — добавить в начало короткий фрагмент, где он находится в кадре один. Если нужный герой стоит справа рядом с другим человеком уже на первом кадре, нейросеть, вероятнее всего, выберет левое лицо. Текстовый запрос в такой ситуации не изменит автоматический выбор, поэтому надёжнее подготовить подходящее начало видео. Почему лицо «соскакивает» и как это исправить Смещение маски не всегда означает ошибку сервиса. Часто причина находится в самом видеоматериале. Слишком сильный поворот головы При развороте в профиль часть черт пропадает из кадра. Нейросети становится сложнее сопоставлять лицо с фотографией анфас. Что делать: выбрать фрагмент с более спокойными движениями или сократить проблемный момент при монтаже. Лицо закрыто предметом Рука, волосы, очки с бликами или край одежды могут нарушить отслеживание. Что делать: использовать ролик, где лицо остаётся открытым. Если перекрытие длится всего несколько кадров, проблемный участок можно вырезать. Герой находится слишком близко На очень крупном плане зритель замечает малейшие расхождения. Кроме того, часть головы может выходить за границы кадра. Что делать: выбрать средний или поясной план, снятый примерно с одного-двух метров. Видео размыто или сильно сжато Компрессия стирает мелкие детали и создаёт квадраты вокруг движущихся объектов. Что делать: загружать исходный MP4-файл, а не копию, многократно пересланную через социальные сети или мессенджеры. В кадре быстро меняется свет Вспышки, цветные прожекторы и резкий переход из света в тень усложняют подстройку цифрового лица. Что делать: выбрать сцену с более ровным освещением или разделить длинный ролик на несколько фрагментов. Нужен ли промпт для DeepFace Video? Для замены лица в видео достаточно фотографии и ролика. Промпт не является главным управляющим элементом и в стандартном сценарии может не понадобиться. Это отличает DeepFace Video от генераторов изображений и видео, где текст определяет сюжет, стиль и движение камеры. Здесь содержание уже задано исходным роликом, а фотография показывает, какое лицо необходимо перенести. Если вам необходимо создать DeepFace Video c текстовыми инструкциями, то используйте короткий и однозначный запрос. Не добавляйте требования изменить одежду, фон, освещение и внешность одновременно. Такие задачи относятся к другим видам обработки и не поддерживаются инструментом для замены лица. Быстрый чек-лист перед обработкой DeepFace Video Перед запуском DeepFace Video проверьте следующее: выбрана нейросеть DeepFace Video; видеоролик подготовлен в формате MP4; нужный человек первым появляется на таймлайне; если в начале несколько людей, нужное лицо находится слева; фотография снята анфас; глаза, нос, губы и контур лица хорошо видны; исходники не размыты и не пережаты; лицо в видео ничем не закрыто; персонаж не поворачивается слишком резко; камера расположена не слишком близко; загружены и фотография, и видеоролик; промпт добавлен только при необходимости. Где можно использовать замену лица в видео? Технология подходит для развлекательных роликов, творческих экспериментов, пародий, визуализации персонажей и подготовки контента при наличии необходимых разрешений. Например, можно создать персональное видеопоздравление или проверить, как определённый образ будет смотреться в готовой сцене. Однако реалистичный результат нейросети легко принять за подлинную запись. Поэтому замена лица требует ответственного использования. Не загружайте чужие фотографии без согласия владельца. Не используйте обработанные ролики для обмана, дискредитации, выдачи себя за другого человека, создания поддельных доказательств или обхода систем идентификации. При публикации желательно прямо отмечать, что видео создано или изменено с помощью ИИ. Для коммерческого проекта также нужно проверить права на исходный ролик, изображение, музыку и внешность человека. Заключение Нейросеть для замены лица в видео 👉 DeepFace Video работает по простой схеме: пользователь загружает фотографию и видео в формате MP4, после чего запускает обработку. Промпт обычно не нужен. Главное — правильно подготовить исходники. Используйте чёткую фотографию анфас и качественное видео, где лицо хорошо видно, не закрыто посторонними предметами и не поворачивается слишком резко. Желательно снимать человека не вплотную, а примерно с расстояния одного-двух метров. Заранее проверьте начало ролика. DeepFace Video заменит одно лицо — то, которое первым появится на таймлайне. Если в первых кадрах несколько людей, будет выбрано лицо слева. Эта небольшая деталь часто определяет, получит ли пользователь нужный результат с первой попытки.
  • Генерации из нейросетей

×
×
  • Создать...