Модератор Ardi Опубликовано 10 часов назад Модератор Поделиться Опубликовано 10 часов назад GPT (Sora) Images — нейросеть для генерации изображений по тексту и редактирования фото с помощью промптов. Нейросеть создаёт сцены с нуля, учитывает загруженные референсы, заменяет отдельные объекты, восстанавливает старые фотографии и добавляет надписи на генерацию. Для русскоязычных пользователей важна поддержка кириллицы: инструмент может выводить фразы на русском языке, но перед публикацией их следует проверить на опечатки и искажения букв. В этом обзоре разберём основные возможности GPT (Sora) Images, доступные разрешения и соотношения сторон, уровни качества, стоимость генераций и работу со стилями. Посмотрим и на ограничения. У модели бывают проблемы с мелкими деталями, а на некоторых изображениях заметен цифровой шум — особенно в тенях, на однородном фоне и при низком качестве. Материал пригодится тем, кто создаёт обложки, рекламные макеты, иллюстрации, карточки товаров и визуальный контент для социальных сетей. Примеры промптов можно копировать и адаптировать под свои задачи. Что умеет GPT (Sora) Images? У GPT (Sora) Images три основных режима работы: генерация изображений по промпту; генерация изображений на основе референса; редактирование изображений по текстовой инструкции. Эти возможности могут пересекаться. Например, пользователь загружает фотографию товара, просит сохранить его внешний вид, заменить фон и добавить рядом несколько предметов. Формально это редактирование, но значительная часть нового изображения создаётся заново. Нейросеть понимает обычные фразы. Промпт не обязательно превращать в длинное перечисление тегов — часто ясное описание сцены работает лучше. Удобная схема запроса выглядит так: главный объект → действие → окружение → композиция → освещение → визуальный стиль → текст в кадре → ограничения Не все пункты нужны одновременно. Если требуется простой предметный кадр, достаточно описать товар, поверхность, фон, направление света и положение объекта. Генерация изображений по промпту Генерация изображений по промпту подходит для задач, в которых исходного файла нет. Пользователь описывает будущую сцену словами, выбирает разрешение, соотношение сторон, качество и при необходимости добавляет стилевые пресеты. Вот пример запроса для обложки статьи: Горизонтальная редакционная иллюстрация о работе искусственного интеллекта. В центре — прозрачный экран с окном генерации изображений, слева в него входит текстовый промпт, справа появляется готовая иллюстрация. Тёмно-синий фон, белые и оранжевые акценты, чистая композиция, крупные формы, свободное место в верхней части. Добавь точный русский заголовок: «КАК РАБОТАЕТ GPT (SORA) IMAGES». Без логотипов, водяных знаков и дополнительного текста. В запросе сразу указаны формат, сюжет, палитра и место для заголовка. Есть и ограничения. Это снижает вероятность появления лишних надписей, хотя полностью исключить их одним запретом нельзя. Если первая генерация получилась близкой к задаче, но не идеальной, не стоит переписывать весь промпт. Лучше изменения вносить поэтапно: заменить для начала положение объекта, цвет фона или характер освещения. Так легче понять, на какую именно формулировку отреагировала GPT (Sora) Images. Как получить предсказуемую композицию при генерации изображений Слова «красиво», «стильно» и «эффектно» почти ничего не говорят о расположении объектов. Практичнее использовать пространственные указания: объект расположен в левой трети кадра; камера находится на уровне глаз; вид строго сверху; справа остаётся свободное место; главный персонаж показан по пояс; источник света находится слева; фон размыт, но окружение остаётся узнаваемым. Если нужен баннер с последующей вёрсткой, заранее попросите оставить отрицательное пространство. Иначе модель заполнит весь кадр декоративными деталями, а заголовок придётся накладывать поверх важных объектов. Генерация изображений на основе референса Референс помогает показать нейросети то, что трудно подробно описать словами. Это может быть фотография предмета, персонаж, эскиз, палитра, пример композиции или изображение с подходящим освещением. Если вы отправляете запрос в нейросеть с изображением-референсом, обязательно добавьте промт с описанием того, что нужно сделать с объектами на исходных изображениях. GPT Images может использовать референсы для нескольких типов работы. Смешивание изображений Можно загрузить несколько материалов и попросить объединить их признаки. Например: взять товар с первого изображения; использовать интерьер со второго; перенести цветовую палитру с третьего; собрать всё в единую сцену. Промпт лучше строить так, чтобы роль каждого файла была очевидна: Используй флакон с первого референса как главный объект. Сохрани его форму, пропорции, цвет стекла и крышку. Из второго референса возьми только композицию и направление света. Из третьего — бежево-зелёную палитру. Размести один флакон на каменной подставке, оставь свободное место слева. Не копируй текст и логотипы с референсов. При смешивании не стоит писать «объедини всё». Такая команда оставляет слишком много неопределённости. Лучше назначить каждому изображению конкретную функцию. Модификация референса Нейросеть позволяет менять фон, одежду, освещение, материалы и отдельные предметы. При этом важно отдельно перечислить элементы, которые должны сохраниться. Пример: Сохрани лицо, причёску, позу и ракурс человека с исходного изображения. Замени повседневную одежду на тёмно-синий деловой костюм без галстука. Перенеси сцену в светлую современную библиотеку. Сделай мягкое дневное освещение. Не меняй возраст, черты лица и выражение глаз. Фраза «не меняй человека» слишком общая. Модель может сохранить узнаваемость, но изменить причёску, возраст или мимику. Чем точнее перечислены постоянные элементы, тем меньше свободы остаётся у алгоритма. Реставрация фотографий GPT Images можно применять для восстановления старых и повреждённых снимков: удаления царапин, повышения читаемости деталей, коррекции выцветших участков и колоризации. Пример промпта: Аккуратно восстанови старую семейную фотографию. Удали царапины, заломы, пятна и следы пыли. Восстанови повреждённые края, сохрани лица, возраст людей, одежду, позы и композицию. Не добавляй новых предметов и не меняй черты лица. Сохрани характер плёночной фотографии, умеренное зерно и естественный контраст. Не превращай снимок в современный цифровой портрет. Здесь есть важное замечание. Нейросеть не извлекает утраченную информацию из пустого места, а правдоподобно достраивает её. Если часть лица полностью уничтожена, результат будет предположением. Для семейного архива это следует учитывать, а при работе с историческими документами — обязательно обозначать факт реконструкции. Перенос визуального направления Референс можно использовать не ради копирования конкретной работы, а для передачи общих свойств: палитры, контраста, расположения объектов и характера света. Лучше писать: Используй референс только как ориентир по приглушённой палитре, мягким теням и минималистичной композиции. Не копируй персонажей, предметы и мелкие детали. Если референс создан другим автором, необходимо проверить право на его использование. Файл из поисковой выдачи не становится "свободным" только потому, что его можно скачать. Редактирование изображений и фото в GPT (Sora) Images Редактирование изображений отличается от полной перегенерации тем, что пользователь уже имеет основу. Задача модели — выполнить изменение и по возможности сохранить всё остальное. GPT (Sora) Images можно попросить: удалить объект; заменить фон; добавить новый предмет; изменить цвет одежды или товара; расширить изображение за исходные границы; поменять время суток; скорректировать освещение; адаптировать горизонтальную сцену под вертикальный формат; восстановить повреждённый снимок; убрать надпись; добавить русский текст; превратить эскиз в реалистичный кадр; изменить визуальный формат, например фотографию на иллюстрацию. Полезная формула для локального редактирования: Измени только [элемент]. Сохрани без изменений [перечень важных деталей]. Новый элемент должен выглядеть [характеристики]. Не меняй [критические ограничения]. Пример: Замени только фон на спокойную кухню с матовыми светло-серыми фасадами. Сохрани чашку, её форму, рисунок, положение ручки, масштаб и исходный ракурс. Направление света должно остаться прежним. Не добавляй еду, посуду, людей и надписи. Слово «только» полезно, но само по себе не гарантирует точечного изменения. Поэтому за ним должен идти список того, что необходимо сохранить. Как GPT (Sora) Images работает с русским текстом Одна из заметных особенностей GPT Images — нейросеть хорошо генерирует текст на русском языке на изображениях. Это полезно при создании: обложек статей; афиш; плакатов; карточек для социальных сетей; рекламных баннеров; упаковки; схем и инфографики; простых интерфейсных макетов. Лучше всего модель справляется с короткими заголовками. Чем больше текста, тем выше риск получить пропущенную букву, неправильное окончание или случайную дополнительную надпись. Чтобы повысить точность, заключайте фразу в кавычки и отдельно указывайте, что она должна быть воспроизведена без изменений: Создай вертикальный постер. В верхней части размести точный русский текст: «ИДЕИ ДЛЯ НОВОГО ПРОЕКТА». Воспроизведи надпись без изменений, сохрани все буквы и пробелы. Используй крупный белый геометрический шрифт. Не добавляй другой текст. Для длинных материалов разумнее сгенерировать изображение без типографики, а надписи добавить в графическом редакторе. Так проще контролировать шрифт, переносы, интервалы и соответствие фирменному стилю. Даже удачный заголовок нужно проверить вручную. Посмотрите на буквы «Ё» и «Й», окончания слов, кавычки, тире, даты и цифры. Иногда ошибка обнаруживается не сразу, потому что визуально надпись выглядит убедительно. Разрешение GPT (Sora) Images: 1K, 2K и 4K В интерфейсе веб-версии Yes AI 2.1 можно выбрать три разрешения GPT Images: 1K; 2K; 4K. Выбор зависит от задачи. Для черновых тестов обычно достаточно 1K. Это позволяет проверить сюжет, композицию и общую трактовку промпта, не расходуя повышенную стоимость на вариант, который может не подойти. Разрешение 2K уместно для публикаций, обложек, презентаций и изображений, где уже важны мелкие детали. Режим 4K имеет смысл выбирать для крупного экспорта, печати, детализированных рекламных материалов или последующего кадрирования. Есть нюанс. Разрешение 4K не исправляет неудачную композицию и не гарантирует безошибочную анатомию. Оно увеличивает размер и потенциальную детализацию результата, поэтому финальный вариант выгоднее создавать после проверки идеи в 1K или 2K. Практичная последовательность выглядит так: Сделать пробную генерацию в 1K. Исправить промпт и композицию. Выбрать удачное изображение. Повторить или доработать изображение в 2K либо 4K. Проверить мелкие элементы в полном масштабе. Так стоимость тратится на финальную версию, а не на первые эксперименты. Соотношения сторон GPT (Sora) Images В интерфейсе веб-версии Yes AI 2.1 доступны следующие соотношения сторон GPT Images: 1:1 — 1024 × 1024; 2:3 — 1024 × 1536; 3:2 — 1536 × 1024; 3:4 — 1104 × 1472; 4:3 — 1472 × 1104; 4:5 — 1152 × 1440; 5:4 — 1440 × 1152; 9:16 — 944 × 1680; 16:9 — 1680 × 944; 9:21 — 816 × 1904; 21:9 — 1904 × 816. Указанные размеры относятся к отображённым в интерфейсе вариантам. При выборе другого разрешения итоговое число пикселей может отличаться, поэтому его следует проверять перед запуском. Формат 1:1 подходит для универсальных карточек, аватаров и квадратных публикаций. Соотношения 4:5 и 3:4 удобны для портретов, товаров и ленты социальных сетей. Форматы 9:16 и 9:21 рассчитаны на вертикальный контент, мобильные экраны и длинные постеры. Для обложки статьи обычно выбирают 16:9. Более широкий формат 21:9 пригодится для панорамного баннера, сайта или кинематографичной сцены. Соотношения 3:2, 4:3 и 5:4 близки к привычным фотографическим форматам и подходят для пейзажей, предметной съёмки и редакционных иллюстраций. Соотношение сторон влияет не только на размер холста, но и на композицию. Один и тот же промпт в 1:1 и 9:16 может дать заметно разные результаты. В вертикальном кадре модель часто перестраивает позу человека и увеличивает количество пространства сверху или снизу. Поэтому формат нужно выбирать до генерации, а не после неё. Качество генерации: Low, Medium и High GPT Images предлагает три уровня качества: Low; Medium; High. Качество сильно влияет и на результат, и на цену. Режим Low подходит для быстрых эскизов, проверки идеи и перебора композиций. В Medium обычно имеет смысл выполнять основную часть рабочих генераций. High стоит оставлять для финальных изображений, сложных фактур, лиц, надписей и сцен с большим количеством важных деталей. Однако даже High не отменяет необходимость проверки. Модель может создать крупный и детализированный кадр, но ошибиться в логике отражения, количестве пальцев или написании слова. Стоимость одной генерации GPT (Sora) Images в зависимости от разрешения и качества Согласно 👉 прайсу, стоимость одной генерации указана во внутренних единицах сервиса Yes AI: Разница существенная. Одна генерация в 4K High стоит в 69,6 раза дороже, чем вариант 1K Low: 104,4 против 1,5 внутренней единицы. Поэтому начинать работу сразу с максимальных настроек не всегда рационально. Цены от Open AI могут меняться. Перед запуском следует проверить актуальные значения в интерфейсе платформы Yes AI и уточнить, как внутренняя единица пересчитывается в реальную стоимость на выбранном тарифе. Для разных этапов можно использовать такую схему: 1K Low — черновой поиск идеи; 1K Medium — проверка более сложного промпта; 2K Medium — основной рабочий вариант; 2K High — изображение с лицами, мелкими предметами или текстом; 4K High — финальный экспорт, если действительно нужна крупная версия. Если задача — найти композицию, десять недорогих попыток могут принести больше пользы, чем одна генерация на максимальном качестве. Сначала нужно попасть в сюжет. Детализацию можно повышать позже. Выбор стиля в GPT (Sora) Images В показанном интерфейсе разрешено выбрать до трёх стилей одновременно. Доступны режимы Random и No style, а также готовые направления, такие как: 3D; Advertising; Anime; Architecture; Art deco; BioCyber; Biomechanical; Cinema; Color shift; ComicBook; Cubism; Cybernetic; Cyberpunk; Detailed; Disco; Dystopian; FairyTale; Fantasy и т.д. Random подойдёт для эксперимента, когда конкретное визуальное направление не определено. Но для повторяемой работы случайный стиль неудобен: трудно понять, что именно повлияло на результат. No style полезен, если промпт уже содержит подробное художественное описание. Предустановленный пресет способен спорить с текстовой инструкцией. Например, запрос на спокойную документальную фотографию и одновременно выбранный стиль Cyberpunk дают модели два разных направления. Сочетание двух или трёх стилей может дать интересный результат, если они выполняют разные функции. Например, Architecture + Cinema + Detailed задают тему, характер света и уровень визуальной проработки. А комбинация нескольких близких декоративных стилей способна перегрузить изображение. Для контролируемого теста лучше менять по одному параметру: создать результат в режиме No style; повторить тот же запрос с одним стилем; сравнить композицию, палитру и фактуры; только потом добавить второй пресет. Примеры генераций GPT (Sora) Images Ниже — несколько промптов, которые проверяют разные возможности нейросети. Для чистоты эксперимента полезно запускать каждый запрос один раз, а затем оценивать соответствие исходному описанию. Пример 1. Рекламная предметная фотография Матовая тёмно-зелёная бутылка оливкового масла без логотипа стоит на светлой каменной поверхности. Рядом лежат три оливки и одна небольшая ветка с листьями. Мягкий солнечный свет падает слева, на стене видна длинная размытая тень. Реалистичная предметная фотография, спокойная натуральная палитра. Бутылка расположена в правой трети кадра, слева оставлено чистое пространство для текста. Без дополнительной посуды, без людей, без надписей. Что проверять: количество предметов, расположение бутылки, материал стекла и наличие свободного пространства. Пример 2. Постер с русским текстом Вертикальный минималистичный плакат о цифровой грамотности. Тёмно-синий фон, в центре изображён простой оранжевый лабиринт в форме человеческой головы. В верхней части размести точный русский заголовок: «ПРОВЕРЯЙ ИСТОЧНИКИ». Крупные белые буквы без засечек, ровная строка, высокая читаемость. Воспроизведи надпись без изменений. Без логотипов, мелкого текста и водяных знаков. Что проверять: орфографию, форму букв, отсутствие лишних надписей и визуальную иерархию. Пример 3. Редактирование интерьера Загрузите фотографию комнаты и добавьте инструкцию: Сохрани планировку комнаты, положение окон, стены, пол и перспективу. Замени только мебель: добавь светло-серый диван, низкий деревянный стол и одно кресло горчичного цвета. Сделай интерьер жилым, но не перегруженным. Сохрани исходное дневное освещение. Не добавляй людей, растения, картины и текст. Что проверять: сохранение геометрии комнаты и отсутствие изменений за пределами поставленной задачи. Пример 4. Смешивание двух референсов Загрузите фотографию предмета и отдельный пример окружения: Возьми настольную лампу с первого изображения. Сохрани её форму, цвет, материал и пропорции. Помести её в рабочий кабинет со второго изображения, но не копируй остальные предметы буквально. Лампа стоит на деревянном столе и включена. Создай естественные тени и согласуй направление света с окружением. Не меняй конструкцию лампы, не добавляй надписей и логотипов. Что проверять: узнаваемость исходного предмета, масштаб и согласованность освещения. Пример 5. Реставрация Восстанови старую чёрно-белую фотографию. Удали царапины, пыль, пятна и залом в правом верхнем углу. Сохрани лица, одежду, фон и плёночную фактуру. Повышай резкость умеренно, не сглаживай кожу и не меняй выражения лиц. Не раскрашивай изображение и не добавляй новые детали. Что проверять: сохранение черт лица и отсутствие чрезмерной цифровой обработки. Пример 6. Обложка статьи Горизонтальная обложка статьи о генерации изображений. На переднем плане — рука, вводящая текстовый промпт в прозрачный интерфейс. За экраном из цветных пикселей постепенно формируется реалистичный городской пейзаж. Графитовый фон, синие и оранжевые акценты, мягкое объёмное освещение. Оставь свободное место вверху для заголовка. Современная редакционная иллюстрация, без логотипов, надписей и мелких интерфейсных элементов. Что проверять: читаемость идеи, переход от текста к изображению и свободную область для вёрстки. Преимущества GPT (Sora) Images Хорошая работа с русским текстом GPT Images хорошо генерирует текст на русском языке на изображениях. Это заметное преимущество для обложек, афиш, рекламных макетов и визуальных карточек. Короткие фразы нередко можно получить сразу внутри композиции, а не накладывать после генерации. Проверка ошибок обязательна. Особенно если в надписи есть редкие слова, числа, несколько строк или сложная пунктуация. Понимание обычных текстовых инструкций Промпт можно писать связными предложениями. Модель понимает просьбы сохранить конкретные элементы, заменить фон, оставить свободное место и изменить только часть сцены. Это удобно для пользователей, которые не хотят собирать запрос из десятков технических тегов. Генерация и редактирование в одном рабочем процессе Необязательно переходить между несколькими инструментами. После создания изображения можно попросить изменить цвет, переместить объект, удалить деталь или адаптировать сцену под другой формат. Поддержка референсов Референсы подходят для смешивания, модификации, восстановления, переноса композиции и работы с визуальной идентичностью предмета. Они сокращают объём текстового описания и помогают показать модели желаемый результат. Выбор разрешения, качества и пропорций Разрешения 1K, 2K и 4K позволяют разделить черновой и финальный этапы. Несколько соотношений сторон охватывают квадратные, вертикальные, горизонтальные и панорамные задачи. Недостатки GPT (Sora) Images Цифровой шум На изображениях может появляться цифровой шум. Он заметен на однородных поверхностях, в тенях, на коже, стенах и плавных градиентах. Иногда шум воспринимается как фактура, но в рекламной или предметной фотографии выглядит как дефект. Стоит проверить результат при масштабе 100%. В некоторых случаях помогает более высокий уровень качества, более мягкое описание освещения или повторное редактирование проблемного участка. Для финального файла может понадобиться шумоподавление в графическом редакторе. Цена заметно растёт вместе с настройками Переход от 1K Low к 4K High многократно увеличивает стоимость одной генерации. Это особенно ощутимо, если для поиска нужной композиции требуется серия попыток. Возможны изменения исходного объекта При редактировании модель иногда исправляет больше, чем просили: меняет лицо, форму товара, фоновые детали или освещение. Поэтому в промпте приходится подробно перечислять то, что должно остаться без изменений. Ошибки в мелких деталях Проблемы могут возникать с пальцами, отражениями, украшениями, повторяющимися элементами, геометрией мебели и взаимодействием персонажа с предметами. Чем сложнее действие, тем выше вероятность артефактов. Текст требует проверки Несмотря на хорошую работу с русским языком, модель не заменяет корректора. Она способна пропустить букву, изменить окончание или добавить лишние символы. Высокое разрешение не гарантирует точность 4K увеличивает размер изображения, но не устраняет смысловые ошибки. Если персонаж держит предмет неправильно, повышение разрешения лишь сделает эту ошибку более заметной. Где применять GPT (Sora) Images? Возможности GPT Images пригодятся в разных сценариях: обложки статей и публикаций; иллюстрации для блогов; рекламные баннеры; постеры и афиши; карточки товаров; предметные изображения; концепты упаковки; раскадровки; презентации; визуализация интерьеров; эскизы персонажей; образовательные материалы; инфографика с короткими надписями; адаптация контента под разные форматы; восстановление семейных фотографий; фоны и графические элементы для сайтов. Не каждую генерацию можно сразу использовать в коммерческом проекте. Следует проверить права на загруженные референсы, допустимость обработки лиц людей и условия коммерческого использования результата. Инструкция по работе с GPT Images Шаг 1. Откройте GPT Images 👉 по ссылке Сформулируйте задачу одним связным описанием. Укажите главный объект, окружение, композицию, свет и ограничения. Шаг 2. Выберите разрешение Для первого теста выберите 1K. Разрешения 2K и 4K разумнее использовать после того, как композиция и содержание изображения уже определены. Шаг 3. Укажите соотношение сторон Выберите формат под площадку: 1:1 для квадрата, 9:16 для вертикальной публикации, 16:9 для обложки или 21:9 для панорамного баннера. Шаг 4. Настройте качество Low подходит для черновиков, Medium — для основной работы, High — для финальных генераций, если повышенная детализация оправдывает стоимость. Шаг 5. Выберите стиль Можно включить до трёх стилей одновременно. Если промпт подробно описывает визуальное направление, попробуйте сначала No style. Режим Random лучше оставить для свободных экспериментов. Рекомендуется использовать стиль Shining - это позволит немного улучшить качество создаваемых генераций. Шаг 6. Загрузите референс (при необходимости) Нажмите на значок скрепки для добавления референса. Загрузите изображение или фото в формате jpg, jpeg или png. Напишите текстовое примечание для загруженного изображения. Не ограничивайтесь фразой «сделай похоже». Укажите, нужно ли сохранить предмет, лицо, композицию, палитру или освещение. Шаг 7. Запустите генерацию и дождитесь окончания генерации Проверьте результат: соответствие промпту; написание русского текста; лица и руки; края объектов; отражения и тени; наличие цифрового шума; случайные логотипы и подписи; сохранность элементов референса. Если нужно исправление, сформулируйте его отдельным текстовым сообщением и перечислите детали, которые нельзя менять. API для GPT (Sora) Images GPT Images можно использовать не только через графический интерфейс, но и через API. Такой вариант подходит разработчикам, редакциям, интернет-магазинам и сервисам, которым требуется автоматизировать генерацию или редактирование изображений. Через API можно выстроить собственный процесс (основные тезисы): Строго запрещены любые намёки на 18+ и иной NSFW-контент. Производите фильтрацию по стоп-словам и стоп-фразам ещё до подачи заданий на наш API. Нейросеть Sora Images может генерировать изображения по промту, то есть по текстовому описанию, на любом языке, включая русский. Sora Images поддерживает загрузку от 1 до 10 изображений, которые можно использовать как референсы для генерации изображения. Если вы отправляете запрос в API с хотя бы одним изображением-референсом, обязательно добавьте промт с описанием того, что нужно сделать с объектами на исходных изображениях. Sora может генерировать изображения со следующими соотношениями сторон: 1:1, 2:3, 3:2, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 9:21, 21:9. Вы также можете выбирать размер изображений: 1K, 2K, 4K. Важно: ограничение площади генераций в пикселях - 8294400. Доступна опция выбора качества генераций: low / medium / high. По каждому запросу API возвращает только одно изображение. Для производственного сценария полезно сохранять вместе с результатом: исходный промпт; идентификатор модели; дату генерации; разрешение; соотношение сторон; уровень качества; список референсов; инструкции редактирования; стоимость операции. Это упрощает повторение удачного результата и помогает понять, почему две генерации отличаются. Как снизить расходы и получить более точный результат с помощью GPT (Sora) Images Рабочая стратегия для GPT Images довольно проста. Сначала — дешёвый тест, затем уточнение, после него финальная генерация. Начните с 1K Low или 1K Medium. Проверьте расположение объектов, общий смысл и соответствие формату. Если сцена работает, исправьте промпт и только потом переходите к 2K либо 4K. Не меняйте сразу пять параметров. Допустим, изображение получилось слишком тёмным, объект смещён к центру, а фон перегружен. Сначала уточните композицию. Затем исправьте освещение. После этого сократите количество деталей на фоне. При работе с референсом перечисляйте неизменяемые признаки. Для товара это форма, цвет, материал, пропорции и расположение элементов. Для портрета — черты лица, возраст, причёска, выражение и ракурс. И всегда открывайте готовое изображение в полном размере. Цифровой шум, ошибки в русском тексте и странные отражения легко пропустить на маленькой превью-картинке. Заключение GPT Images объединяет генерацию и редактирование изображений по промпту и референсу в одном процессе. Это удобно для быстрых концептов и последовательной доработки, но результат требует проверки. Для черновиков достаточно 1K и низкого либо среднего качества. Для финальной иллюстрации можно перейти к 2K или 4K, предварительно убедившись, что выбранное соотношение сторон подходит площадке. Если в кадре есть русский текст, его нужно вычитать. Если использовались референсы — проверить права на исходные материалы. Отдельное внимание стоит уделить цифровому шуму. Он не всегда заметен в интерфейсе, зато проявляется после скачивания и увеличения изображения. Хороший промпт для GPT Images не обязан быть длинным. Он должен быть ясным. Чем точнее описаны главный объект, композиция, свет и элементы, которые нельзя менять, тем меньше времени уйдёт на случайные попытки. Цитата Ссылка на комментарий Поделиться на другие сайты Поделиться
Рекомендуемые сообщения
Присоединяйтесь к обсуждению
Вы можете написать сейчас и зарегистрироваться позже. Если у вас есть аккаунт, авторизуйтесь, чтобы опубликовать от имени своего аккаунта.
Примечание: Ваш пост будет проверен модератором, прежде чем станет видимым.