Перейти к содержанию

Чем полезен форум Yes Ai ?

  • Здесь вы найдете статьи о нейросетях: Midjourney, ChatGPT, Stable Diffusion, Sora, Flux.1, Kling Ai и других
  • Масса полезных инструкций для решения задач с помощью современных моделей ИИ
Статьи

Галерея бесплатных промтов

Откройте нашу галерею с бесплатными промтами для генерации изображений в нейросетях

Sora Images, Midjourney, SDXL, Stable Diffusion и Dalle-3

Галерея

API нейросетей для разработчиков

Добавьте функции нейросетей в собственное мобильное приложение,

веб-сайт или Telegram-бота

API

Хотите задать вопрос о нейросетях ?

Подробно опишите задачу, которую хотите решить с помощью ИИ,

а участники нашего сообщества постараются вам помочь. Это бесплатно!

Спросить
  • Форум о нейросетях и искусственном интеллекте

    ✌️ На форуме ИИ про нейросети Yes Ai размещены полезные статьи и бесплатные обучающие материалы про Midjourney, Chat GPT, Flux.1, Kling Ai, Stable Diffusion, SXDL и др. В галерее вы найдете множество промтов для генерации изображений в нейросетях.

    • Активность на форуме позволит получать бесплатные генерации в нейросетях через Telegram-бота @yes_ai_bot
    • Рекомендуем начать изучение форума про ИИ с прочтения статей 👇 или просмотра галереи работ нашего сообщества

    Добро пожаловать!

     

Форум ИИ о нейросетях

  1. Обсуждаем нейросети и искусственный интеллект

    В этом разделе обсуждаем нейронные сети, которые работают с видео, включая создание, стилизацию, редактирование видео и многое другое.

    Описание всех функций нейросети Nano Banana: генерация картинок по промтам и референсам (исходным фото), редактирование изображений и фотографий.

    Полезные статьи о нейросети для генерации изображений Midjourney. Как делать генерации в Миджорни, как писать промты, команды для нейросети.

    Sora Images

    • 39 постов

    Статьи о возможностях нейросети для генерации изображений Sora Images, разработанной компанией Open Ai. Промты, функции и настройки.

    Qwen Images

    • 41 пост

    Статьи про возможности нейросети Qwen Images и Qwen Edit для генерации изображений по промтам и референсам: полезные советы и примеры использования.

    Полезные статьи об использовании нейросети Flux.1 и ее расширенных возможностей. Как использовать LoRA и другие функции Flux.

    Советы и лайфхаки по использованию нейросети для работы с текстом Chat GPT / Gemma / LLaMA

    Описываем функции легендарной нейросети Stable Diffusion, позволяющей генерировать изображения и модифицировать их. Inpaint, Upscale и редактирование изображений.

    В этой ветке обсуждаем другие нейронные сети, которых нет в основном списке (например, HeyGen, Deforum и пр.)

  2. Новости про ИИ и нейросети

    В этом разделе публикуем новости о нейросетях и достижениях в развитии искусственного интеллекта.

    Новости проекта Yes Ai - @yes_ai_official. Обновления форума ИИ, новые функции нейросетей для работы с текстом, видео, изображениями и пр.

  3. Другие темы

    В этом разделе вы можете задать вопросы и получить ответы на темы, связанные с нейросетями и проектом Yes Ai. Здесь вы можете узнать, как решить конкретные задачи с ИИ.

    Здесь можно общаться на темы, связанные с нейросетями лишь косвенно. Расскажите о своем опыте, поделитесь кейсами при работе с ИИ - это будет интересно.

    Здесь мы публикуем информацию о бесплатных раздачах доступа к нейросетям в системе @yes_ai_bot, а также объявляем конкурсы, за участие в которых вы можете получать бонусы.

    Здесь вы можете написать свое видение того, что можно улучшить на форуме или в проекте Yes Ai. Форум ИИ про использование нейросетей может стать еще лучше!

    admin
  • Актуальные обсуждения

  • Новые сообщения

    • Новая версия Midjourney 8.2 уже доступна во всех продуктах Yes Ai: в WEB-версии, Telegram-боте и через API. Если коротко: v8.2 стала аккуратнее, реалистичнее и стабильнее в сложных сценах. Особенно это заметно там, где в промте много деталей: материалы, свет, глубина кадра, одежда, фон, ракурс, цветные источники освещения. Midjourney 8.1 и 8.2 работают по-разному с детализацией, цветом, перспективой и композицией. Ниже — основные изменения. 🔍 Детализация В Midjourney 8.2 мелкие элементы сохраняются заметно лучше. Контуры стали чётче, текстуры выглядят чище, а предметы меньше «слипаются» между собой. Это хорошо видно на сложных изображениях: интерьер с декором, портрет с фактурной одеждой, предметная съёмка, сцены с большим количеством объектов. 🎨 Цвет и свет Midjourney 8.2 даёт более естественную цветопередачу. Модель точнее разделяет светлые и тёмные участки, лучше понимает тени и аккуратнее работает с цветными источниками света. Например, если в запросе есть неоновая вывеска, тёплый свет лампы или холодный дневной свет из окна, результат чаще выглядит логично и не уходит в случайные оттенки. 📐 Композиция, масштаб и перспектива В версии 8.2 сцена строится стабильнее. Объекты лучше распределяются по глубине кадра: передний, средний и дальний планы читаются чётче. Также улучшилась работа с геометрией и масштабом. Это особенно полезно для архитектуры, интерьерных сцен, рекламных визуалов и кадров, где важен правильный ракурс. 📝 Понимание промтов Midjourney 8.2 точнее следует запросу. Отдельные элементы промта сохраняются надёжнее, а конкретные инструкции по объективу, освещению, материалам и глубине сцены модель воспринимает лучше. Если вы указываете, например, «85mm lens», «soft studio light», «matte ceramic», «shallow depth of field» — v8.2 чаще переносит эти параметры в результат без сильных искажений. ✨ Стиль и реализм Новая версия увереннее сочетает сложные стилистические требования. Она лучше удерживает описание одежды, фона, освещения и общего настроения сцены. При этом Midjourney 8.2 заметно сильнее ориентирована на реалистичный результат. Картинки чаще выглядят как продуманный кадр, а не как случайная красивая генерация. Подробный разбор Midjourney 8.2 мы подготовили в новой статье: [открыть на форуме]
    • Midjourney v8.1 и v8.2 по-разному интерпретируют детали, цвет, перспективу и сложные композиции. Обновление не меняет привычный принцип работы с генератором, однако влияет на то, как нейросеть прорисовывает мелкие объекты, распределяет визуальные акценты и передаёт материалы. Ниже представлено сравнение версий нейросети на основе пользовательских отзывов и практических наблюдений c примерами промтов. Это не лабораторный тест: результат Midjourney зависит от промта, формата кадра, персонализации, стилизации, seed и других параметров. Тем не менее в генерациях регулярно проявляются характерные различия, которые полезно учитывать при выборе модели. Основные отличия Midjourney v8.1 и v8.2 Детализация мелких элементов В Midjourney v8.1 небольшие объекты на втором плане иногда выглядят обобщённо. Тонкие украшения, пуговицы, элементы архитектуры, узоры на ткани и предметы в глубине сцены могут сливаться или терять форму. Midjourney v8.2 чаще сохраняет такие детали. Контуры становятся заметнее, текстуры — аккуратнее, а мелкие элементы лучше отделяются друг от друга. Разница особенно хорошо видна в портретах с аксессуарами, предметной фотографии и насыщенных городских сценах. При этом высокая детализация не всегда означает более удачный художественный результат. Для живописи, винтажной иллюстрации или атмосферного концепт-арта мягкость v8.1 может оказаться уместной: она не перегружает изображение фактурой и оставляет больше визуальных обобщений. Цветопередача и тональные переходы По отзывам пользователей, v8.2 чаще создаёт естественные цвета. Оттенки кожи, зелени, неба и отражений выглядят более согласованно, а локальные цвета объектов реже смешиваются между собой. В v8.1 палитра может быть мягче. Иногда это создаёт приятное ощущение плёночного кадра, старой печати или иллюстрации, написанной традиционными материалами. Однако в сценах со сложным освещением отдельные области могут получаться менее выразительными. Версия v8.2 заметнее разделяет свет и тень, лучше передаёт цветные источники света и сохраняет оттенки в небольших деталях. Это полезно для рекламных изображений, интерьерных визуализаций и реалистичных портретов. Композиция и перспектива Сложная сцена — одна из ситуаций, где различия между версиями проявляются сильнее. Когда в кадре одновременно присутствуют люди, транспорт, архитектура и множество предметов, Midjourney должна не только нарисовать каждый объект, но и расположить их в едином пространстве. В v8.1 второстепенные элементы порой соединяются друг с другом, перспектива становится менее последовательной, а дальний план выглядит условно. Это не обязательно портит изображение, но может мешать там, где требуется правдоподобная сцена. Midjourney v8.2 лучше справляется с распределением объектов по глубине кадра. Передний, средний и дальний планы чаще читаются отдельно. Геометрия помещений и улиц выглядит устойчивее, а масштаб объектов — логичнее. Особенно это заметно в широкоугольных композициях, интерьерах и сценах с несколькими персонажами. Следование промту В v8.2 отдельные смысловые элементы запроса чаще сохраняются в итоговой композиции. Если в промте перечислены материал, освещение, положение камеры, окружение и несколько важных объектов, обновлённая версия обычно распределяет эти условия точнее. v8.1 склонна свободнее интерпретировать длинные описания. Модель может усилить общий стиль, но ослабить небольшую деталь или заменить её визуально похожим объектом. Это различие стоит учитывать при подготовке текстового запроса. Для v8.2 допустимы более конкретные указания: вид объектива, характер света, фактура материала, глубина сцены. Но перегружать промт противоречивыми требованиями всё равно не следует. Чёткая последовательность «объект — действие — окружение — свет — стиль — параметры» обычно работает понятнее длинного списка эпитетов. Стили и пользовательские настройки По наблюдениям пользователей нейросети, Midjourney v8.2 увереннее сочетает сложные стилистические признаки с пользовательскими настройками. Например, модель может сохранить узнаваемую эстетику редакционной фотографии и одновременно выполнить требования к одежде, фону и освещению. v8.1 иногда сильнее подчиняет изображение общему стилю. За счёт этого кадр может быть выразительным, но часть конкретных деталей из промта уходит на второй план. Разница важна при использовании персонализации, референсов и других настроек. Чтобы оценивать характер конкретной версии по уже созданным работам, необходимо учитывать все параметры генерации. Изменение стилизации или референса способно повлиять на изображение сильнее, чем переход между моделями. Как выбрать Midjourney v8.2 в веб-версии Yes AI Откройте страницу создания изображений или создайте новый чат 👉 в нейросети Midjourney. Перейдите в панель параметров генерации через кнопку настроек. Найдите раздел выбора модели или версии. Настройки Midjourney, далее перейдите к версиям. Откройте список доступных вариантов. Выберите Midjourney v8.2. После выбора версия применяется к последующим генерациям, пока пользователь не изменит настройку или не укажет версию нейросети непосредственно в текстовом запросе. Перед запуском полезно проверить строку параметров: в ней должна отображаться выбранная модель либо не должно быть упоминания версии. Указание версии в промте имеет более высокий приоритет и выставленные настройки с v8.2 в интерфейсе будут проигнорированы.  Как указать версию нейросети Midjourney через промт Версию можно задать непосредственно в запросе. Для этого в конце промта добавляется параметр: --v 8.2 Пример: editorial portrait of a ceramic artist in a bright workshop, natural window light, clay dust in the air, realistic skin texture, muted earth tones --ar 4:5 --v 8.2 Параметр версии лучше размещать в конце, рядом с соотношением сторон и другими техническими настройками. Перед --v должен стоять пробел.  Для использования предыдущей модели указывается соответствующий параметр: --v 8.1 Не стоит одновременно добавлять в один запрос два параметра версии. Midjourney должна получить только одно указание модели. Сравнение генераций Midjourney v8.1 и v8.2 в пяти стилях Следующие примеры промтов показывают, на каких элементах заметны отличия Midjourney v8.1 и v8.2. Конкретная генерация может отличаться из-за случайности, персонализации и дополнительных настроек. 1. Реалистичный портрет Промт: close-up cinematic portrait of an elderly watchmaker in his workshop, round glasses, detailed gray beard, tiny metal watch parts on the table, warm window light, realistic skin texture, shallow depth of field, natural colors --ar 4:5 Midjourney v8.1: Кадр обычно выглядит мягче. Борода и кожа могут быть слегка сглажены, а крошечные детали часов на столе — частично слиты. Тёплое освещение создаёт цельную атмосферу, но отдельные фактуры не всегда хорошо разделены. Более близкий план лица. Midjourney v8.2: Чаще заметны отдельные волоски, оправа очков, инструменты и металлические детали. Кожа сохраняет естественную неоднородность, а фон лучше отделяется от лица за счёт глубины резкости. Цвет света выглядит более локальным: тёплый оттенок не обязательно окрашивает всё изображение одинаково. Изображение выглядит более реалистичным. Наиболее заметное различие: план, микродетали, фактура кожи, границы небольших предметов. 2. Фэнтезийная цифровая живопись Промт: ancient forest guardian figures standing among enormous twisted trees, moss-covered armor, glowing blue runes on his armor, birds in the branches, misty background, fantasy digital painting, dramatic light, intricate environment --ar 16:9 Midjourney v8.1: Доспехи чаще сохраняют структуру, фигура персонажа более прорисована. Версия может сильнее обобщать лес, создавая цельную живописную сцену. Светящиеся руны иногда превращаются в декоративные пятна, а птицы и ветви на дальнем плане становятся условными. Midjourney v8.2: Руны получают более чёткие края и лучше заметны, а деревья лучше распределяются по глубине. Туман остаётся атмосферным, но меньше скрывает средний план. Синие источники света аккуратнее взаимодействуют с зелёными и коричневыми оттенками окружения. Наиболее заметное различие: разделение планов, световые эффекты, прорисовка окружения и персонажа. Этот пример показывает, что v8.2 не обязана быть предпочтительнее для любой задачи. Mягкая интерпретация v8.1 способна выглядеть убедительно. 3. Архитектурная визуализация Промт: modern brutalist house built into a rocky coastal cliff, exposed concrete, panoramic windows, narrow stairs, wild grass, stormy sea below, architectural visualization, wide-angle view, overcast daylight --ar 16:9 Midjourney v8.1: Общая форма здания выглядит выразительно, но лестницы, оконные рамы и линии бетонных блоков могут быть менее отрисованными. На сложных участках архитектура иногда незаметно соединяется со скалой. Меняется форма здания. Midjourney v8.2: Геометрия чаще остаётся устойчивой. Окна, лестничные пролёты и границы материалов лучше читаются, а дом выглядит встроенным в рельеф без случайного слияния конструкций. Перспектива широкоугольного кадра обычно передаётся аккуратнее. Форма здания более стабильна. Наиболее заметное различие: геометрия, масштаб и соединение архитектуры с ландшафтом. 4. Винтажная журнальная иллюстрация Промт: 1960s travel magazine illustration of a woman waiting at a small Mediterranean train station, red suitcase, cream summer dress, mountains in the distance, screen print texture, limited color palette, vintage editorial composition --ar 3:4 Midjourney v8.1: Мягкость модели может органично поддерживать эстетику старой печати. Текстуры выглядят неровными, цвета — немного приглушёнными, а второстепенные детали не отвлекают от персонажа. Midjourney v8.2: Контуры чемодана, одежды и архитектуры чаще становятся точнее. Ограниченная палитра сохраняется, но цвета могут выглядеть чище и контрастнее. Иногда дополнительная детализация делает изображение менее похожим на грубую печатную иллюстрацию, поэтому в запросе особенно важны слова screen print texture и limited color palette. Наиболее заметное различие: чистота контуров и степень стилистического обобщения. 5. Сложная городская сцена Промт: busy rainy night market in a futuristic city, food stalls, pedestrians with transparent umbrellas, delivery bicycles, reflective pavement, layered neon signs, steam rising from street kitchens, cinematic street photography --ar 16:9 Midjourney v8.1: Сцена обычно получается атмосферной, однако дальние персонажи и велосипеды могут терять форму. Неоновые вывески иногда сливаются в общий цветовой фон, а отражения не всегда соответствуют расположению источников света. Midjourney v8.2: Люди, зонты, прилавки и транспорт чаще остаются отдельными объектами. Влажный асфальт получает более точные блики, пар не перекрывает всю сцену, а перспектива улицы выглядит глубже. Цвета вывесок лучше различаются даже при большом количестве источников света. Наиболее заметное различие: работа с множеством объектов, отражениями и пространственной глубиной. Что учитывать при работе с промтами для нейросети Midjourney Удобная схема запроса выглядит так: Главный объект, его особенности и действие, окружение, композиция, освещение, материалы и фактуры, визуальный стиль, технические параметры. Например: minimalist perfume bottle made of frosted blue glass, standing on wet black stone, small water drops, centered product composition, soft side light, realistic reflections, luxury editorial photography --ar 4:5 --v 8.2 В длинных промтах важные признаки лучше располагать ближе к началу. Если материал или предмет критичен для задачи, его следует описать конкретно. Вместо beautiful bottle полезнее написать rectangular perfume bottle made of frosted blue glass with a silver cap. Не следует пытаться исправить все возможные ошибки десятками отрицаний. Короткое положительное описание обычно даёт модели более ясное направление. Параметры стоит добавлять только тогда, когда понятна их роль. Работа с Midjourney в веб-версии: пошаговая инструкция Шаг 1. Откройте страницу генерации 👉 нейросеть Midjourney и введите промт Шаг 2. Перейдите к настройкам модели Шаг 3. Выберите необходимые параметры Шаг 4. Добавление параметра --v в промт Проверьте что необходимая версия указана в конце промта и написана правильно, если вам удобнее работать с командами через промт.  Шаг 5. Запустите генерацию Шаг 6. Просмотр результата и сохранение изображения Какую версию Midjourney выбрать? Midjourney v8.2 имеет смысл использовать в задачах, где важны мелкие элементы, точная геометрия, естественная цветопередача и сложная композиция. К таким сценариям относятся предметные изображения, архитектурные концепции, реалистичные портреты, интерьерные сцены и кадры с большим количеством объектов. Midjourney v8.1 может быть полезна для работ, в которых уместны мягкость, визуальное обобщение и менее выраженная цифровая резкость. Это касается винтажной графики, живописных фэнтезийных сцен, атмосферных пейзажей и некоторых видов концепт-арта. Сравнение версий нейросети показывает не только технические изменения. v8.2 чаще следует сложному описанию, увереннее прорисовывает небольшие элементы и лучше организует пространство стремясь к более реалистичному изображению. v8.1 отличается более свободной интерпретацией и в отдельных художественных стилях создаёт естественную мягкость, что выглядит гармоничнее. Понимание этих особенностей помогает заранее выбрать подходящую версию и составить промт с учётом характера той или иной версии.
    • Аннотация публикации: Обновление Yes AI 2.1 включает в себя расширенные возможности генерации изображений и новые инструменты для работы с видео. В GPT Images 2 появилась настройка качества (Low, Medium, High), позволяющая оптимизировать баланс между скоростью, стоимостью и детализацией генерируемых изображений, подходящая как для инфографики, так и для фотореалистичных визуалов. Разрешение остается отдельным параметром. Также в Qwen Images полностью реализован функционал работы с референсами, включая удаление фона, восстановление старых фотографий и колоризацию черно-белых снимков, что упрощает обработку изображений на основе примеров. Кроме того, теперь доступна нейросеть DeepFace Video, позволяющая заменять лицо в видео по фотографии, открывая новые возможности для создания контента, тестовых креативов и развлекательного видеомонтажа. Новые функции доступны как через API, так и непосредственно в боте @yes_ai_bot.
    • GPT (Sora) Images — нейросеть для генерации изображений по тексту и редактирования фото с помощью промптов. Нейросеть создаёт сцены с нуля, учитывает загруженные референсы, заменяет отдельные объекты, восстанавливает старые фотографии и добавляет надписи на генерацию. Для русскоязычных пользователей важна поддержка кириллицы: инструмент может выводить фразы на русском языке, но перед публикацией их следует проверить на опечатки и искажения букв. В этом обзоре разберём основные возможности GPT (Sora) Images, доступные разрешения и соотношения сторон, уровни качества, стоимость генераций и работу со стилями. Посмотрим и на ограничения. У модели бывают проблемы с мелкими деталями, а на некоторых изображениях заметен цифровой шум — особенно в тенях, на однородном фоне и при низком качестве. Материал пригодится тем, кто создаёт обложки, рекламные макеты, иллюстрации, карточки товаров и визуальный контент для социальных сетей. Примеры промптов можно копировать и адаптировать под свои задачи. Что умеет GPT (Sora) Images? У GPT (Sora) Images три основных режима работы: генерация изображений по промпту; генерация изображений на основе референса; редактирование изображений по текстовой инструкции. Эти возможности могут пересекаться. Например, пользователь загружает фотографию товара, просит сохранить его внешний вид, заменить фон и добавить рядом несколько предметов. Формально это редактирование, но значительная часть нового изображения создаётся заново. Нейросеть понимает обычные фразы. Промпт не обязательно превращать в длинное перечисление тегов — часто ясное описание сцены работает лучше. Удобная схема запроса выглядит так: главный объект → действие → окружение → композиция → освещение → визуальный стиль → текст в кадре → ограничения Не все пункты нужны одновременно. Если требуется простой предметный кадр, достаточно описать товар, поверхность, фон, направление света и положение объекта. Генерация изображений по промпту Генерация изображений по промпту подходит для задач, в которых исходного файла нет. Пользователь описывает будущую сцену словами, выбирает разрешение, соотношение сторон, качество и при необходимости добавляет стилевые пресеты. Вот пример запроса для обложки статьи: Горизонтальная редакционная иллюстрация о работе искусственного интеллекта. В центре — прозрачный экран с окном генерации изображений, слева в него входит текстовый промпт, справа появляется готовая иллюстрация. Тёмно-синий фон, белые и оранжевые акценты, чистая композиция, крупные формы, свободное место в верхней части. Добавь точный русский заголовок: «КАК РАБОТАЕТ GPT (SORA) IMAGES». Без логотипов, водяных знаков и дополнительного текста. В запросе сразу указаны формат, сюжет, палитра и место для заголовка. Есть и ограничения. Это снижает вероятность появления лишних надписей, хотя полностью исключить их одним запретом нельзя. Если первая генерация получилась близкой к задаче, но не идеальной, не стоит переписывать весь промпт. Лучше изменения вносить поэтапно: заменить для начала положение объекта, цвет фона или характер освещения. Так легче понять, на какую именно формулировку отреагировала GPT (Sora) Images. Как получить предсказуемую композицию при генерации изображений Слова «красиво», «стильно» и «эффектно» почти ничего не говорят о расположении объектов. Практичнее использовать пространственные указания: объект расположен в левой трети кадра; камера находится на уровне глаз; вид строго сверху; справа остаётся свободное место; главный персонаж показан по пояс; источник света находится слева; фон размыт, но окружение остаётся узнаваемым. Если нужен баннер с последующей вёрсткой, заранее попросите оставить отрицательное пространство. Иначе модель заполнит весь кадр декоративными деталями, а заголовок придётся накладывать поверх важных объектов. Генерация изображений на основе референса Референс помогает показать нейросети то, что трудно подробно описать словами. Это может быть фотография предмета, персонаж, эскиз, палитра, пример композиции или изображение с подходящим освещением. Если вы отправляете запрос в нейросеть с изображением-референсом, обязательно добавьте промт с описанием того, что нужно сделать с объектами на исходных изображениях. GPT Images может использовать референсы для нескольких типов работы. Смешивание изображений Можно загрузить несколько материалов и попросить объединить их признаки. Например: взять товар с первого изображения; использовать интерьер со второго; перенести цветовую палитру с третьего; собрать всё в единую сцену. Промпт лучше строить так, чтобы роль каждого файла была очевидна: Используй флакон с первого референса как главный объект. Сохрани его форму, пропорции, цвет стекла и крышку. Из второго референса возьми только композицию и направление света. Из третьего — бежево-зелёную палитру. Размести один флакон на каменной подставке, оставь свободное место слева. Не копируй текст и логотипы с референсов. При смешивании не стоит писать «объедини всё». Такая команда оставляет слишком много неопределённости. Лучше назначить каждому изображению конкретную функцию. Модификация референса Нейросеть позволяет менять фон, одежду, освещение, материалы и отдельные предметы. При этом важно отдельно перечислить элементы, которые должны сохраниться. Пример: Сохрани лицо, причёску, позу и ракурс человека с исходного изображения. Замени повседневную одежду на тёмно-синий деловой костюм без галстука. Перенеси сцену в светлую современную библиотеку. Сделай мягкое дневное освещение. Не меняй возраст, черты лица и выражение глаз. Фраза «не меняй человека» слишком общая. Модель может сохранить узнаваемость, но изменить причёску, возраст или мимику. Чем точнее перечислены постоянные элементы, тем меньше свободы остаётся у алгоритма. Реставрация фотографий GPT Images можно применять для восстановления старых и повреждённых снимков: удаления царапин, повышения читаемости деталей, коррекции выцветших участков и колоризации. Пример промпта: Аккуратно восстанови старую семейную фотографию. Удали царапины, заломы, пятна и следы пыли. Восстанови повреждённые края, сохрани лица, возраст людей, одежду, позы и композицию. Не добавляй новых предметов и не меняй черты лица. Сохрани характер плёночной фотографии, умеренное зерно и естественный контраст. Не превращай снимок в современный цифровой портрет. Здесь есть важное замечание. Нейросеть не извлекает утраченную информацию из пустого места, а правдоподобно достраивает её. Если часть лица полностью уничтожена, результат будет предположением. Для семейного архива это следует учитывать, а при работе с историческими документами — обязательно обозначать факт реконструкции.  Перенос визуального направления Референс можно использовать не ради копирования конкретной работы, а для передачи общих свойств: палитры, контраста, расположения объектов и характера света. Лучше писать: Используй референс только как ориентир по приглушённой палитре, мягким теням и минималистичной композиции. Не копируй персонажей, предметы и мелкие детали. Если референс создан другим автором, необходимо проверить право на его использование. Файл из поисковой выдачи не становится "свободным" только потому, что его можно скачать. Редактирование изображений и фото в GPT (Sora) Images Редактирование изображений отличается от полной перегенерации тем, что пользователь уже имеет основу. Задача модели — выполнить изменение и по возможности сохранить всё остальное. GPT (Sora) Images можно попросить: удалить объект; заменить фон; добавить новый предмет; изменить цвет одежды или товара; расширить изображение за исходные границы; поменять время суток; скорректировать освещение; адаптировать горизонтальную сцену под вертикальный формат; восстановить повреждённый снимок; убрать надпись; добавить русский текст; превратить эскиз в реалистичный кадр; изменить визуальный формат, например фотографию на иллюстрацию. Полезная формула для локального редактирования: Измени только [элемент]. Сохрани без изменений [перечень важных деталей]. Новый элемент должен выглядеть [характеристики]. Не меняй [критические ограничения]. Пример: Замени только фон на спокойную кухню с матовыми светло-серыми фасадами. Сохрани чашку, её форму, рисунок, положение ручки, масштаб и исходный ракурс. Направление света должно остаться прежним. Не добавляй еду, посуду, людей и надписи. Слово «только» полезно, но само по себе не гарантирует точечного изменения. Поэтому за ним должен идти список того, что необходимо сохранить. Как GPT (Sora) Images работает с русским текстом Одна из заметных особенностей GPT Images — нейросеть хорошо генерирует текст на русском языке на изображениях. Это полезно при создании: обложек статей; афиш; плакатов; карточек для социальных сетей; рекламных баннеров; упаковки; схем и инфографики; простых интерфейсных макетов. Лучше всего модель справляется с короткими заголовками. Чем больше текста, тем выше риск получить пропущенную букву, неправильное окончание или случайную дополнительную надпись. Чтобы повысить точность, заключайте фразу в кавычки и отдельно указывайте, что она должна быть воспроизведена без изменений: Создай вертикальный постер. В верхней части размести точный русский текст: «ИДЕИ ДЛЯ НОВОГО ПРОЕКТА». Воспроизведи надпись без изменений, сохрани все буквы и пробелы. Используй крупный белый геометрический шрифт. Не добавляй другой текст. Для длинных материалов разумнее сгенерировать изображение без типографики, а надписи добавить в графическом редакторе. Так проще контролировать шрифт, переносы, интервалы и соответствие фирменному стилю. Даже удачный заголовок нужно проверить вручную. Посмотрите на буквы «Ё» и «Й», окончания слов, кавычки, тире, даты и цифры. Иногда ошибка обнаруживается не сразу, потому что визуально надпись выглядит убедительно. Разрешение GPT (Sora) Images: 1K, 2K и 4K В интерфейсе веб-версии Yes AI 2.1 можно выбрать три разрешения GPT Images: 1K; 2K; 4K. Выбор зависит от задачи. Для черновых тестов обычно достаточно 1K. Это позволяет проверить сюжет, композицию и общую трактовку промпта, не расходуя повышенную стоимость на вариант, который может не подойти. Разрешение 2K уместно для публикаций, обложек, презентаций и изображений, где уже важны мелкие детали. Режим 4K имеет смысл выбирать для крупного экспорта, печати, детализированных рекламных материалов или последующего кадрирования. Есть нюанс. Разрешение 4K не исправляет неудачную композицию и не гарантирует безошибочную анатомию. Оно увеличивает размер и потенциальную детализацию результата, поэтому финальный вариант выгоднее создавать после проверки идеи в 1K или 2K. Практичная последовательность выглядит так: Сделать пробную генерацию в 1K. Исправить промпт и композицию. Выбрать удачное изображение. Повторить или доработать изображение в 2K либо 4K. Проверить мелкие элементы в полном масштабе. Так стоимость тратится на финальную версию, а не на первые эксперименты. Соотношения сторон GPT (Sora) Images В интерфейсе веб-версии Yes AI 2.1 доступны следующие соотношения сторон GPT Images: 1:1 — 1024 × 1024; 2:3 — 1024 × 1536; 3:2 — 1536 × 1024; 3:4 — 1104 × 1472; 4:3 — 1472 × 1104; 4:5 — 1152 × 1440; 5:4 — 1440 × 1152; 9:16 — 944 × 1680; 16:9 — 1680 × 944; 9:21 — 816 × 1904; 21:9 — 1904 × 816. Указанные размеры относятся к отображённым в интерфейсе вариантам. При выборе другого разрешения итоговое число пикселей может отличаться, поэтому его следует проверять перед запуском. Формат 1:1 подходит для универсальных карточек, аватаров и квадратных публикаций. Соотношения 4:5 и 3:4 удобны для портретов, товаров и ленты социальных сетей. Форматы 9:16 и 9:21 рассчитаны на вертикальный контент, мобильные экраны и длинные постеры. Для обложки статьи обычно выбирают 16:9. Более широкий формат 21:9 пригодится для панорамного баннера, сайта или кинематографичной сцены. Соотношения 3:2, 4:3 и 5:4 близки к привычным фотографическим форматам и подходят для пейзажей, предметной съёмки и редакционных иллюстраций. Соотношение сторон влияет не только на размер холста, но и на композицию. Один и тот же промпт в 1:1 и 9:16 может дать заметно разные результаты. В вертикальном кадре модель часто перестраивает позу человека и увеличивает количество пространства сверху или снизу. Поэтому формат нужно выбирать до генерации, а не после неё. Качество генерации: Low, Medium и High GPT Images предлагает три уровня качества: Low; Medium; High. Качество сильно влияет и на результат, и на цену. Режим Low подходит для быстрых эскизов, проверки идеи и перебора композиций. В Medium обычно имеет смысл выполнять основную часть рабочих генераций. High стоит оставлять для финальных изображений, сложных фактур, лиц, надписей и сцен с большим количеством важных деталей. Однако даже High не отменяет необходимость проверки. Модель может создать крупный и детализированный кадр, но ошибиться в логике отражения, количестве пальцев или написании слова. Стоимость одной генерации GPT (Sora) Images в зависимости от разрешения и качества Согласно 👉 прайсу, стоимость одной генерации указана во внутренних единицах сервиса Yes AI: Разница существенная. Одна генерация в 4K High стоит в 69,6 раза дороже, чем вариант 1K Low: 104,4 против 1,5 внутренней единицы. Поэтому начинать работу сразу с максимальных настроек не всегда рационально.  Цены от Open AI могут меняться. Перед запуском следует проверить актуальные значения в интерфейсе платформы Yes AI и уточнить, как внутренняя единица пересчитывается в реальную стоимость на выбранном тарифе. Для разных этапов можно использовать такую схему: 1K Low — черновой поиск идеи; 1K Medium — проверка более сложного промпта; 2K Medium — основной рабочий вариант; 2K High — изображение с лицами, мелкими предметами или текстом; 4K High — финальный экспорт, если действительно нужна крупная версия. Если задача — найти композицию, десять недорогих попыток могут принести больше пользы, чем одна генерация на максимальном качестве. Сначала нужно попасть в сюжет. Детализацию можно повышать позже. Выбор стиля в GPT (Sora) Images В показанном интерфейсе разрешено выбрать до трёх стилей одновременно. Доступны режимы Random и No style, а также готовые направления, такие как: 3D; Advertising; Anime; Architecture; Art deco; BioCyber; Biomechanical; Cinema; Color shift; ComicBook; Cubism; Cybernetic; Cyberpunk; Detailed; Disco; Dystopian; FairyTale; Fantasy и т.д. Random подойдёт для эксперимента, когда конкретное визуальное направление не определено. Но для повторяемой работы случайный стиль неудобен: трудно понять, что именно повлияло на результат. No style полезен, если промпт уже содержит подробное художественное описание. Предустановленный пресет способен спорить с текстовой инструкцией. Например, запрос на спокойную документальную фотографию и одновременно выбранный стиль Cyberpunk дают модели два разных направления. Сочетание двух или трёх стилей может дать интересный результат, если они выполняют разные функции. Например, Architecture + Cinema + Detailed задают тему, характер света и уровень визуальной проработки. А комбинация нескольких близких декоративных стилей способна перегрузить изображение. Для контролируемого теста лучше менять по одному параметру: создать результат в режиме No style; повторить тот же запрос с одним стилем; сравнить композицию, палитру и фактуры; только потом добавить второй пресет. Примеры генераций GPT (Sora) Images Ниже — несколько промптов, которые проверяют разные возможности нейросети. Для чистоты эксперимента полезно запускать каждый запрос один раз, а затем оценивать соответствие исходному описанию. Пример 1. Рекламная предметная фотография Матовая тёмно-зелёная бутылка оливкового масла без логотипа стоит на светлой каменной поверхности. Рядом лежат три оливки и одна небольшая ветка с листьями. Мягкий солнечный свет падает слева, на стене видна длинная размытая тень. Реалистичная предметная фотография, спокойная натуральная палитра. Бутылка расположена в правой трети кадра, слева оставлено чистое пространство для текста. Без дополнительной посуды, без людей, без надписей. Что проверять: количество предметов, расположение бутылки, материал стекла и наличие свободного пространства. Пример 2. Постер с русским текстом Вертикальный минималистичный плакат о цифровой грамотности. Тёмно-синий фон, в центре изображён простой оранжевый лабиринт в форме человеческой головы. В верхней части размести точный русский заголовок: «ПРОВЕРЯЙ ИСТОЧНИКИ». Крупные белые буквы без засечек, ровная строка, высокая читаемость. Воспроизведи надпись без изменений. Без логотипов, мелкого текста и водяных знаков. Что проверять: орфографию, форму букв, отсутствие лишних надписей и визуальную иерархию. Пример 3. Редактирование интерьера Загрузите фотографию комнаты и добавьте инструкцию: Сохрани планировку комнаты, положение окон, стены, пол и перспективу. Замени только мебель: добавь светло-серый диван, низкий деревянный стол и одно кресло горчичного цвета. Сделай интерьер жилым, но не перегруженным. Сохрани исходное дневное освещение. Не добавляй людей, растения, картины и текст. Что проверять: сохранение геометрии комнаты и отсутствие изменений за пределами поставленной задачи. Пример 4. Смешивание двух референсов Загрузите фотографию предмета и отдельный пример окружения: Возьми настольную лампу с первого изображения. Сохрани её форму, цвет, материал и пропорции. Помести её в рабочий кабинет со второго изображения, но не копируй остальные предметы буквально. Лампа стоит на деревянном столе и включена. Создай естественные тени и согласуй направление света с окружением. Не меняй конструкцию лампы, не добавляй надписей и логотипов. Что проверять: узнаваемость исходного предмета, масштаб и согласованность освещения. Пример 5. Реставрация Восстанови старую чёрно-белую фотографию. Удали царапины, пыль, пятна и залом в правом верхнем углу. Сохрани лица, одежду, фон и плёночную фактуру. Повышай резкость умеренно, не сглаживай кожу и не меняй выражения лиц. Не раскрашивай изображение и не добавляй новые детали. Что проверять: сохранение черт лица и отсутствие чрезмерной цифровой обработки. Пример 6. Обложка статьи Горизонтальная обложка статьи о генерации изображений. На переднем плане — рука, вводящая текстовый промпт в прозрачный интерфейс. За экраном из цветных пикселей постепенно формируется реалистичный городской пейзаж. Графитовый фон, синие и оранжевые акценты, мягкое объёмное освещение. Оставь свободное место вверху для заголовка. Современная редакционная иллюстрация, без логотипов, надписей и мелких интерфейсных элементов. Что проверять: читаемость идеи, переход от текста к изображению и свободную область для вёрстки. Преимущества GPT (Sora) Images Хорошая работа с русским текстом GPT Images хорошо генерирует текст на русском языке на изображениях. Это заметное преимущество для обложек, афиш, рекламных макетов и визуальных карточек. Короткие фразы нередко можно получить сразу внутри композиции, а не накладывать после генерации. Проверка ошибок обязательна. Особенно если в надписи есть редкие слова, числа, несколько строк или сложная пунктуация. Понимание обычных текстовых инструкций Промпт можно писать связными предложениями. Модель понимает просьбы сохранить конкретные элементы, заменить фон, оставить свободное место и изменить только часть сцены. Это удобно для пользователей, которые не хотят собирать запрос из десятков технических тегов. Генерация и редактирование в одном рабочем процессе Необязательно переходить между несколькими инструментами. После создания изображения можно попросить изменить цвет, переместить объект, удалить деталь или адаптировать сцену под другой формат. Поддержка референсов Референсы подходят для смешивания, модификации, восстановления, переноса композиции и работы с визуальной идентичностью предмета. Они сокращают объём текстового описания и помогают показать модели желаемый результат. Выбор разрешения, качества и пропорций Разрешения 1K, 2K и 4K позволяют разделить черновой и финальный этапы. Несколько соотношений сторон охватывают квадратные, вертикальные, горизонтальные и панорамные задачи. Недостатки GPT (Sora) Images Цифровой шум На изображениях может появляться цифровой шум. Он заметен на однородных поверхностях, в тенях, на коже, стенах и плавных градиентах. Иногда шум воспринимается как фактура, но в рекламной или предметной фотографии выглядит как дефект. Стоит проверить результат при масштабе 100%. В некоторых случаях помогает более высокий уровень качества, более мягкое описание освещения или повторное редактирование проблемного участка. Для финального файла может понадобиться шумоподавление в графическом редакторе. Цена заметно растёт вместе с настройками Переход от 1K Low к 4K High многократно увеличивает стоимость одной генерации. Это особенно ощутимо, если для поиска нужной композиции требуется серия попыток. Возможны изменения исходного объекта При редактировании модель иногда исправляет больше, чем просили: меняет лицо, форму товара, фоновые детали или освещение. Поэтому в промпте приходится подробно перечислять то, что должно остаться без изменений. Ошибки в мелких деталях Проблемы могут возникать с пальцами, отражениями, украшениями, повторяющимися элементами, геометрией мебели и взаимодействием персонажа с предметами. Чем сложнее действие, тем выше вероятность артефактов. Текст требует проверки Несмотря на хорошую работу с русским языком, модель не заменяет корректора. Она способна пропустить букву, изменить окончание или добавить лишние символы. Высокое разрешение не гарантирует точность 4K увеличивает размер изображения, но не устраняет смысловые ошибки. Если персонаж держит предмет неправильно, повышение разрешения лишь сделает эту ошибку более заметной. Где применять GPT (Sora) Images? Возможности GPT Images пригодятся в разных сценариях: обложки статей и публикаций; иллюстрации для блогов; рекламные баннеры; постеры и афиши; карточки товаров; предметные изображения; концепты упаковки; раскадровки; презентации; визуализация интерьеров; эскизы персонажей; образовательные материалы; инфографика с короткими надписями; адаптация контента под разные форматы; восстановление семейных фотографий; фоны и графические элементы для сайтов. Не каждую генерацию можно сразу использовать в коммерческом проекте. Следует проверить права на загруженные референсы, допустимость обработки лиц людей и условия коммерческого использования результата. Инструкция по работе с GPT Images Шаг 1. Откройте GPT Images 👉 по ссылке Сформулируйте задачу одним связным описанием. Укажите главный объект, окружение, композицию, свет и ограничения. Шаг 2. Выберите разрешение Для первого теста выберите 1K. Разрешения 2K и 4K разумнее использовать после того, как композиция и содержание изображения уже определены. Шаг 3. Укажите соотношение сторон Выберите формат под площадку: 1:1 для квадрата, 9:16 для вертикальной публикации, 16:9 для обложки или 21:9 для панорамного баннера. Шаг 4. Настройте качество Low подходит для черновиков, Medium — для основной работы, High — для финальных генераций, если повышенная детализация оправдывает стоимость. Шаг 5. Выберите стиль Можно включить до трёх стилей одновременно. Если промпт подробно описывает визуальное направление, попробуйте сначала No style. Режим Random лучше оставить для свободных экспериментов.  Рекомендуется использовать стиль Shining - это позволит немного улучшить качество создаваемых генераций. Шаг 6. Загрузите референс (при необходимости) Нажмите на значок скрепки для добавления референса.   Загрузите изображение или фото в формате jpg, jpeg или png. Напишите текстовое примечание для загруженного изображения. Не ограничивайтесь фразой «сделай похоже». Укажите, нужно ли сохранить предмет, лицо, композицию, палитру или освещение. Шаг 7. Запустите генерацию и дождитесь окончания генерации Проверьте результат: соответствие промпту; написание русского текста; лица и руки; края объектов; отражения и тени; наличие цифрового шума; случайные логотипы и подписи; сохранность элементов референса. Если нужно исправление, сформулируйте его отдельным текстовым сообщением и перечислите детали, которые нельзя менять. API для GPT (Sora) Images GPT Images можно использовать не только через графический интерфейс, но и через API. Такой вариант подходит разработчикам, редакциям, интернет-магазинам и сервисам, которым требуется автоматизировать генерацию или редактирование изображений. Через API можно выстроить собственный процесс (основные тезисы): Строго запрещены любые намёки на 18+ и иной NSFW-контент. Производите фильтрацию по стоп-словам и стоп-фразам ещё до подачи заданий на наш API. Нейросеть Sora Images может генерировать изображения по промту, то есть по текстовому описанию, на любом языке, включая русский. Sora Images поддерживает загрузку от 1 до 10 изображений, которые можно использовать как референсы для генерации изображения. Если вы отправляете запрос в API с хотя бы одним изображением-референсом, обязательно добавьте промт с описанием того, что нужно сделать с объектами на исходных изображениях. Sora может генерировать изображения со следующими соотношениями сторон: 1:1, 2:3, 3:2, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 9:21, 21:9. Вы также можете выбирать размер изображений: 1K, 2K, 4K. Важно: ограничение площади генераций в пикселях - 8294400. Доступна опция выбора качества генераций: low / medium / high. По каждому запросу API возвращает только одно изображение. Для производственного сценария полезно сохранять вместе с результатом: исходный промпт; идентификатор модели; дату генерации; разрешение; соотношение сторон; уровень качества; список референсов; инструкции редактирования; стоимость операции. Это упрощает повторение удачного результата и помогает понять, почему две генерации отличаются. Как снизить расходы и получить более точный результат с помощью GPT (Sora) Images Рабочая стратегия для GPT Images довольно проста. Сначала — дешёвый тест, затем уточнение, после него финальная генерация. Начните с 1K Low или 1K Medium. Проверьте расположение объектов, общий смысл и соответствие формату. Если сцена работает, исправьте промпт и только потом переходите к 2K либо 4K. Не меняйте сразу пять параметров. Допустим, изображение получилось слишком тёмным, объект смещён к центру, а фон перегружен. Сначала уточните композицию. Затем исправьте освещение. После этого сократите количество деталей на фоне. При работе с референсом перечисляйте неизменяемые признаки. Для товара это форма, цвет, материал, пропорции и расположение элементов. Для портрета — черты лица, возраст, причёска, выражение и ракурс. И всегда открывайте готовое изображение в полном размере. Цифровой шум, ошибки в русском тексте и странные отражения легко пропустить на маленькой превью-картинке. Заключение GPT Images объединяет генерацию и редактирование изображений по промпту и референсу в одном процессе. Это удобно для быстрых концептов и последовательной доработки, но результат требует проверки. Для черновиков достаточно 1K и низкого либо среднего качества. Для финальной иллюстрации можно перейти к 2K или 4K, предварительно убедившись, что выбранное соотношение сторон подходит площадке. Если в кадре есть русский текст, его нужно вычитать. Если использовались референсы — проверить права на исходные материалы. Отдельное внимание стоит уделить цифровому шуму. Он не всегда заметен в интерфейсе, зато проявляется после скачивания и увеличения изображения. Хороший промпт для GPT Images не обязан быть длинным. Он должен быть ясным. Чем точнее описаны главный объект, композиция, свет и элементы, которые нельзя менять, тем меньше времени уйдёт на случайные попытки.
  • Генерации из нейросетей

×
×
  • Создать...