Перейти к содержанию

Чем полезен форум Yes Ai ?

  • Здесь вы найдете статьи о нейросетях: Midjourney, ChatGPT, Stable Diffusion, Sora, Flux.1, Kling Ai и других
  • Масса полезных инструкций для решения задач с помощью современных моделей ИИ
Статьи

Галерея бесплатных промтов

Откройте нашу галерею с бесплатными промтами для генерации изображений в нейросетях

Sora Images, Midjourney, SDXL, Stable Diffusion и Dalle-3

Галерея

API нейросетей для разработчиков

Добавьте функции нейросетей в собственное мобильное приложение,

веб-сайт или Telegram-бота

API

Хотите задать вопрос о нейросетях ?

Подробно опишите задачу, которую хотите решить с помощью ИИ,

а участники нашего сообщества постараются вам помочь. Это бесплатно!

Спросить
  • Форум о нейросетях и искусственном интеллекте

    ✌️ На форуме ИИ про нейросети Yes Ai размещены полезные статьи и бесплатные обучающие материалы про Midjourney, Chat GPT, Flux.1, Kling Ai, Stable Diffusion, SXDL и др. В галерее вы найдете множество промтов для генерации изображений в нейросетях.

    • Активность на форуме позволит получать бесплатные генерации в нейросетях через Telegram-бота @yes_ai_bot
    • Рекомендуем начать изучение форума про ИИ с прочтения статей 👇 или просмотра галереи работ нашего сообщества

    Добро пожаловать!

     

Форум ИИ о нейросетях

  1. Обсуждаем нейросети и искусственный интеллект

    В этом разделе обсуждаем нейронные сети, которые работают с видео, включая создание, стилизацию, редактирование видео и многое другое.

    Описание всех функций нейросети Nano Banana: генерация картинок по промтам и референсам (исходным фото), редактирование изображений и фотографий.

    Полезные статьи о нейросети для генерации изображений Midjourney. Как делать генерации в Миджорни, как писать промты, команды для нейросети.

    Sora Images

    • 39 постов

    Статьи о возможностях нейросети для генерации изображений Sora Images, разработанной компанией Open Ai. Промты, функции и настройки.

    Qwen Images

    • 41 пост

    Статьи про возможности нейросети Qwen Images и Qwen Edit для генерации изображений по промтам и референсам: полезные советы и примеры использования.

    Полезные статьи об использовании нейросети Flux.1 и ее расширенных возможностей. Как использовать LoRA и другие функции Flux.

    Советы и лайфхаки по использованию нейросети для работы с текстом Chat GPT / Gemma / LLaMA

    Описываем функции легендарной нейросети Stable Diffusion, позволяющей генерировать изображения и модифицировать их. Inpaint, Upscale и редактирование изображений.

    В этой ветке обсуждаем другие нейронные сети, которых нет в основном списке (например, HeyGen, Deforum и пр.)

  2. Новости про ИИ и нейросети

    В этом разделе публикуем новости о нейросетях и достижениях в развитии искусственного интеллекта.

    Новости проекта Yes Ai - @yes_ai_official. Обновления форума ИИ, новые функции нейросетей для работы с текстом, видео, изображениями и пр.

  3. Другие темы

    В этом разделе вы можете задать вопросы и получить ответы на темы, связанные с нейросетями и проектом Yes Ai. Здесь вы можете узнать, как решить конкретные задачи с ИИ.

    Здесь можно общаться на темы, связанные с нейросетями лишь косвенно. Расскажите о своем опыте, поделитесь кейсами при работе с ИИ - это будет интересно.

    Здесь мы публикуем информацию о бесплатных раздачах доступа к нейросетям в системе @yes_ai_bot, а также объявляем конкурсы, за участие в которых вы можете получать бонусы.

    Здесь вы можете написать свое видение того, что можно улучшить на форуме или в проекте Yes Ai. Форум ИИ про использование нейросетей может стать еще лучше!

    admin
  • Актуальные обсуждения

  • Новые сообщения

    • Нейросеть Nano Banana можно использовать не только для обычной генерации и редактирования изображений. Модель подходит для подготовки визуальных референсов, которые помогают управлять композицией, положением человека в кадре и распределением объектов по глубине. Один из таких сценариев — создание карты глубины изображения (depth map) и схемы OpenPose по фотографии. Эти технологии решают разные задачи. Карта глубины изображения описывает расстояние между камерой и объектами, а OpenPose фиксирует положение тела через систему ключевых точек. Если объединить результаты, можно получить основу для переноса позы, 3D-анимации, нейросетевой фотосессии, раскадровки или генерации видео. Однако важно понимать ограничение. Nano Banana способна создать визуальное представление карты глубины изображения и OpenPose, но такой результат не всегда является технически точным набором данных. Для художественной генерации этого часто достаточно.  В контексте работы с моделями вроде ControlNet это устоявшиеся термины: OpenPose отвечает за извлечение скелетной структуры (ключевых точек суставов), а depth map — за карту глубины (представляющую собой 3D-объём). Часто их комбинируют для более точного контроля при генерации изображений.  Что такое карта глубины изображения Карта глубины изображения, или Depth Map — это отдельное изображение, в котором значение каждого пикселя связано с расстоянием от камеры до соответствующей точки сцены. Чаще всего используется градация серого: близкие объекты отображаются светлее, дальние — темнее. Иногда применяется обратная схема, поэтому перед дальнейшей обработкой необходимо проверить принятую кодировку. Визуально такая карта напоминает чёрно-белую фотографию с плавными переходами. Но это не обычный монохромный фильтр. Яркость должна отражать положение объекта в пространстве, а не его реальный цвет или освещённость. Например, на портрете кончик носа обычно будет находиться ближе к камере, чем уши и фон. На корректной карте эти зоны должны отличаться по яркости. Если модель просто перевела исходный снимок в чёрно-белый формат, не учитывая геометрию лица, результат нельзя считать полноценной картой глубины. Как создаётся карта глубины При работе с одной фотографией нейросеть не измеряет реальное расстояние напрямую. Она оценивает его по перспективе, размеру объектов, перекрытиям, теням и другим визуальным признакам.  Nano Banana решает задачу иначе, чем специализированный инструмент. Генеративная модель создаёт изображение, которое выглядит как карта глубины. Это удобно для визуального контроля, творческих пайплайнов и подготовки управляющего референса.  Где применяется карта глубины изображения Карта глубины используется, когда плоскую фотографию необходимо преобразовать в сцену с передним, средним и дальним планами. При создании карты глубины (depth map) учитываются не только поза человека, но и контуры причёски и одежды, а также расстояние между объектами и камерой. В отличие от OpenPose, карта глубины позволяет определять пространственное положение не только человека, но и других объектов в кадре. Благодаря карте глубины можно точнее воспроизвести композицию референса, сохранив возможность изменять цвет волос, одежды и фона. Это главное отличие от OpenPose, где фиксируется только поза. AR и VR В приложениях дополненной и виртуальной реальности глубина помогает правильно размещать цифровые объекты. Виртуальный предмет может частично скрываться за человеком или мебелью, а не просто накладываться поверх кадра. Фото- и видеоредакторы Карта глубины изображения позволяет отделить главный объект от фона, добавить управляемое размытие и имитировать глубину резкости. В отличие от простой маски, она даёт несколько уровней дистанции. Благодаря этому размытие можно увеличивать постепенно. 3D-моделирование Depth Map используют для создания рельефа, параллакс-эффекта и черновой реконструкции сцены. Из одной фотографии нельзя достоверно восстановить невидимые стороны предметов, но можно подготовить основу для дальнейшей ручной работы. Генерация изображений и видео Карта глубины изображения помогает сохранить пространственную композицию при смене стиля, окружения или освещения. Например, можно заменить городскую улицу футуристическим интерьером, не меняя расстояние между персонажем и фоном. Робототехника и автономные системы Здесь карты глубины применяются для обнаружения препятствий и оценки дистанции. Однако визуально сгенерированные материалы Nano Banana для таких задач не подходят: автономным системам необходимы проверяемые данные сенсоров и специализированные алгоритмы. Что такое OpenPose OpenPose — технология определения позы человека по изображению или видео. Она находит ключевые точки тела и соединяет их в условный скелет. К ключевым точкам относятся плечи, локти, запястья, тазобедренные суставы, колени, стопы и элементы лица. Конкретное количество точек зависит от реализации и выбранной модели. Некоторые инструменты дополнительно анализируют кисти рук и мимику. Скелет OpenPose не повторяет анатомию человека буквально. Это схема, которая описывает положение суставов и частей тела. Она удобна для компьютера и понятна пользователю. Технология может работать с одним или несколькими людьми в кадре. Но точность снижается, если персонажи перекрывают друг друга, выходят за границы изображения, находятся в слишком сложных позах или сняты при слабом освещении. Для чего используется OpenPose OpenPose применяется значительно шире, чем может показаться на первый взгляд. В анимации OpenPose позволяет подготовить черновой motion capture без специального костюма. Движение извлекается из видео, после чего ключевые точки переносятся на цифрового персонажа. Обычно результат приходится очищать вручную: устранять дрожание, исправлять перепутанные конечности и восстанавливать точки, пропавшие из кадра. В генеративной графике схема используется в качестве управляющего референса. С её помощью можно перенести заданную позу на нового персонажа, сохранить положение рук и воспроизвести динамику исходного снимка - это важное отличие от depth mask. Такой подход особенно полезен при работе со сложными позами, требующими точной фиксации положения тела и конечностей на основе референсного изображения. Это дает возможность использования фиксированной позы с последующим добавлением любого фона, предметов и объектов.  Ещё один сценарий — интерактивные приложения. Положение тела может использоваться для управления персонажем, распознавания жестов или взаимодействия с виртуальными объектами. Что даёт совместное использование карты глубины изображения и OpenPose OpenPose показывает, где находятся суставы, но сам по себе не всегда точно описывает расстояние до камеры. Две точки могут располагаться рядом на плоскости кадра, хотя одна рука вытянута вперёд, а другая отведена назад. Карта глубины изображения добавляет недостающий пространственный контекст. В результате система получает две группы данных: координаты ключевых точек тела; предполагаемое расстояние от камеры до разных участков сцены. Такой подход помогает различать конечности, расположенные ближе и дальше от камеры, оценивать наклон корпуса и точнее передавать разворот тела. Преимущества особенно заметны в спортивных позах, танцевальных движениях и сценах с выраженными искажениями перспективы. Совместный референс можно применять в нескольких направлениях: для переноса позы на сгенерированного персонажа; для подготовки черновой 3D-анимации; для управления движением в нейросетевом видео; для создания эффекта параллакса; для виртуальных фотосессий; для размещения персонажа в AR- или VR-сцене; для проверки пространственной логики кадра. В профессиональной фотографии карта глубины изображения помогает отделить модель от окружения и настроить глубину резкости. OpenPose при этом фиксирует положение тела. Если нужно создать серию портретов с разными костюмами и локациями, такое сочетание снижает вероятность того, что при очередной генерации изменятся жест, наклон головы или положение рук. Как создать карту глубины изображения в Nano Banana Для начала выберите исходник. Лучше всего подходят резкие фотографии без сильного размытия и сложных перекрытий. У сцены должны читаться передний и задний планы. Далее загрузите изображение в интерфейс Nano Banana и сформулируйте задачу. Не ограничивайтесь словами «сделай Depth Map». Укажите шкалу, направление градиента, требования к контурам и назначение результата. Пример промта: Generate a clean high-resolution monochrome depth map from the uploaded portrait. Represent the nearest surfaces in white and the farthest surfaces in black, with smooth distance gradients, accurate facial geometry, clearly separated hair, shoulders, body, and background. Remove textures, shadows, colors, text, and decorative details. The result must be suitable as a visual depth reference for 3D modeling, AR, and image-generation control.   Перевод: Создай чистую монохромную карту глубины высокого разрешения по загруженному портрету. Покажи ближайшие поверхности белым, а самые дальние — чёрным. Сохрани плавные градиенты расстояния, геометрию лица и чёткое разделение волос, плеч, тела и фона. Удали текстуры, тени, цвета, текст и декоративные элементы. Результат должен подходить как визуальный референс глубины для 3D-моделирования, AR и управления генерацией изображений. После генерации проверьте логику: Ближайшие участки должны соответствовать выбранной шкале. Фон не должен сливаться с волосами или одеждой. Тени на лице не должны восприниматься моделью как углубления. Переходы по округлым поверхностям должны быть плавными. Внутри одного плоского объекта не должно появляться случайных перепадов яркости. Если результат неточен, лучше не просить модель «улучшить всё». Укажите конкретный дефект: Keep the current composition. Correct only the depth hierarchy around the left arm and torso. The left hand is closest to the camera, the face is slightly farther away, the torso is behind the face, and the background is the farthest area. Preserve smooth monochrome gradients. Такой запрос уменьшает риск полной перерисовки изображения. Промты для карты создания глубины изображения Короткий вариант, подходящий для большинства портретов: Generate a high-resolution depth map of the uploaded portrait photo with clear and smooth gradients representing distance. Nearest areas must be white, farthest areas must be black. Preserve accurate facial and body geometry. Remove texture, lighting, shadows, and color. Suitable for 3D modeling and AR applications.  Для предметной съёмки: Convert the uploaded product photo into a precise monochrome depth-map reference. Show the nearest surfaces in white and the farthest surfaces in black. Preserve the product silhouette, surface curvature, spatial separation from the table, and background distance. No texture, reflections, labels, shadows, or text. Для сцены с несколькими планами: Create a layered depth map from the uploaded street scene. Clearly separate foreground, middle ground, and background using smooth grayscale distance values. Preserve object boundaries, perspective, occlusion, and spatial hierarchy. Nearest objects are white, farthest objects are black. Как создать OpenPose по фото с помощью Nano Banana Загрузите фотографию, на которой хорошо видны руки, ноги и корпус. Для первого теста выбирайте кадр с одним человеком. Групповые сцены сложнее: модель может соединить плечо одного персонажа с рукой другого. Пример промта: Detect the full-body human pose in the uploaded image and create a clean OpenPose-style skeleton overlay. Mark anatomically consistent keypoints for the head, neck, shoulders, elbows, wrists, torso, hips, knees, ankles, and feet. Preserve the exact pose, body orientation, camera angle, and limb positions. Use a plain dark background, bright colored joints and connecting lines, no realistic person, no extra limbs, no text.   Перевод:  Определи позу человека на загруженном изображении и создай чистое наложение скелета в стиле OpenPose. Отметь анатомически соответствующие ключевые точки для головы, шеи, плеч, локтей, запястий, туловища, бедер, коленей, лодыжек и ступней. Сохрани точную позу. Если в кадре несколько людей: Create an OpenPose-style pose map for every visible person in the uploaded image. Keep each skeleton separate and anatomically consistent. Preserve the original positions, scale, overlaps, and camera perspective. Do not connect keypoints belonging to different people. Use a plain dark background and clearly visible colored joints and limb lines. Результат необходимо проверить вручную. Особое внимание стоит уделить кистям, перекрещенным ногам и частично скрытым конечностям. Если точные координаты суставов нужны для анализа или программной обработки, изображение от Nano Banana следует передать в специализированный OpenPose-инструмент либо сразу запускать локальную модель на исходной фотографии. Промты для OpenPose Для человека в движении: Detect and map full-body pose keypoints with accurate joint positions on the uploaded dynamic human figure. Preserve the exact athletic movement, limb angles, body orientation, foreshortening, and camera perspective. Create a clean OpenPose-style skeleton on a plain dark background. No extra joints, no missing limbs, no text.  Для переноса позы в нейросетевую фотосессию: Extract the exact pose from the uploaded reference and create a clean OpenPose-style control image. Preserve the head tilt, shoulder line, hand placement, hip rotation, leg position, body balance, and camera angle. Display only the skeleton and keypoints on a plain background. Пошаговая инструкция для создания depth map + OpenPose через нейросеть Откройте нейросеть 👉 Nano Banana Нажмите значок скрепки. Загрузите исходное фото в формате jpg, jpeg или png. Введите промт для карты глубины изображения с OpenPose + depth map. Проверьте и сохраните изображение, кликнув на созданную генерацию. По аналогии на основе вышеизложенной инструкции можно создать генерации только с OpenPose или depth map.   Промт для совместной генерации карты глубины и OpenPose Совмещённое изображение OpenPose + depth map удобно для точного переноса сложных поз с референсов с учётом контуров причёски и одежды. Create a combined depth map and OpenPose-style skeletal overlay from the uploaded image of a person performing an athletic movement. Use a monochrome depth gradient with nearest surfaces in white and farthest surfaces in black. Add accurate, clearly visible body keypoints and skeletal connections. Preserve the original pose, foreshortening, camera perspective, overlaps, and spatial hierarchy. Optimize the result as a visual reference for 3D animation and motion capture.   Для более чистого результата можно попросить модель подготовить три панели: Analyze the uploaded image and create a three-panel technical reference sheet. Panel 1: the original composition. Panel 2: a clean monochrome depth map, nearest surfaces white and farthest surfaces black. Panel 3: an accurate OpenPose-style skeleton on a dark background. Keep the same framing, proportions, pose, and camera perspective in all panels. No labels, no decorative elements. Здесь есть важный практический приём. Если карта глубины изображения и OpenPose нужны для разных задач, не используйте только объединённый файл. Скелет может изменить значения яркости и сделать Depth Map непригодной для автоматической обработки. Экспортируйте карту глубины и OpenPose раздельно. Использование генераций Nano Banana c OpenPose и depth map в качестве референсов Загрузите изображение с OpenPose, depth map или OpenPose + depth map в нейросеть Nano Banana и введите промт с подробным описанием внешностей персонажей, одежды, фона и других нужных параметров. Например:   Create a realistic image based on the provided depth map on reference. A man with blond hair wearing a burgundy jacket. A girl with red hair wearing a green blouse. Harmonious color palette. Рабочий пайплайн: от фотографии до 3D-анимации Один промт редко решает всю задачу. Надёжнее разбить процесс на этапы. Шаг 1. Подготовьте исходное изображение Уберите лишние рамки, подписи и интерфейсные элементы. Проверьте, что конечности человека видны на фото полностью. Если важны кисти, они должны быть достаточно крупными и резкими. Шаг 2. Создайте карту глубины изображения Сначала получите чистую Depth Map без скелета, текста и цветных меток. Сохраните файл отдельно. Не меняйте пропорции и кадрирование относительно исходника. Шаг 3. Создайте OpenPose Используйте ту же фотографию. Попросите сохранить точное положение тела и перспективное сокращение конечностей. Шаг 4. Сопоставьте результаты Размер холста, границы кадра и положение персонажа должны совпадать. Если Nano Banana слегка сместила фигуру, попросите выровнять карту по исходнику: Align the generated control image pixel-for-pixel with the uploaded source. Preserve the original canvas size, framing, subject scale, body position, and camera perspective. Do not crop or reposition the person.  Шаг 5. Передайте референсы в генератор В зависимости от используемого сервиса карта глубины изображения и OpenPose могут загружаться как управляющие изображения, референсы композиции или отдельные условия генерации. Если интерфейс поддерживает настройку силы влияния, начинайте с умеренных значений. Слишком сильный контроль сохраняет геометрию, но ограничивает вариативность. Слишком слабый — приводит к потере позы. Шаг 6. Исправьте локальные ошибки Чаще всего требуют коррекции пальцы, стопы, перекрещенные конечности и границы волос. Не перегенерируйте весь кадр без необходимости. Используйте маску области или точечный запрос. Шаг 7. Проведите финальную проверку Сравните исходник и результат по контрольным точкам: наклон головы; высота плеч; положение локтей; направление кистей; линия таза; углы коленей; опора стоп; расстояние между человеком и фоном. Для анимации дополнительно проверьте последовательность кадров. Даже правильная поза на каждом отдельном изображении может дрожать при воспроизведении видео. Как повысить точность результата Первый полезный приём — заранее определить шкалу карты глубины. Фраза «white is near, black is far» устраняет неоднозначность.  Второй — просить удалить освещение и текстуры. Генеративные модели нередко принимают светлое пятно за близкую поверхность, а глубокую тень — за удалённую область. Третий — не смешивать анализ и стилизацию в одном запросе. Сначала создайте технический референс, затем используйте его для художественной генерации. Четвёртый — сохранять одинаковое разрешение файлов. Если исходник, OpenPose и карта глубины изображения имеют разные пропорции, точки тела и границы объектов перестанут совпадать. Пятый — разбивать сложную сцену на этапы. При работе с групповой фотографией можно сначала создать OpenPose для каждого персонажа отдельно, проверить скелеты, а затем собрать их на общем холсте. Шестой — использовать специализированные локальные решения для верификации. Nano Banana удобна как генеративный и редакторский слой, но техническую карту лучше проверить моделью оценки глубины, а скелет — pose-estimation-инструментом. Дообучение имеет смысл, если изображения поступают из одного устойчивого источника: например, с фиксированной камеры в спортивном зале или производственном помещении. Для единичной нейросетевой фотосессии дообучение обычно избыточно. Гораздо быстрее улучшить исходник, уточнить промт и выполнить локальную коррекцию. Интеграция с 3D-моделированием и анимацией Карта глубины изображения может использоваться для создания displacement-рельефа или упрощённой геометрии. Но она описывает только видимую сторону сцены. Задняя часть объекта остаётся неизвестной, поэтому полноценная 3D-модель потребует дополнительных ракурсов либо ручного восстановления. OpenPose можно преобразовать в основу рига. Здесь тоже понадобится обработка: двухмерные точки нужно перенести в трёхмерное пространство, согласовать с пропорциями персонажа и сгладить движение. Для быстрого прототипа процесс выглядит так: Извлечь позу из исходного кадра. Получить карту глубины. Оценить положение суставов относительно камеры. Перенести скелет на 3D-персонажа. Исправить глубину рук и ног. Настроить положение камеры. Проверить пересечения частей тела. Сгладить анимационные кривые. Фразы вроде «создать 3D-модель за 15 минут» стоит воспринимать как описание чернового прототипа, а не готового производственного ассета. Скорость зависит от сложности сцены, качества исходника и требований к итоговой модели. Для тех, кому удобно работать в мессенджере c нейросетями 👉 ссылка на бот в Telegram. Если вам нужна дополнительная информация по теме статьи или по нейросетям доступным в боте, можете задать вопросы 👉 в нашем чате.
    • Суть текста: Новая версия Midjourney 8.2 стала доступна во всех платформах Yes AI и представляет собой значительный шаг вперед по сравнению с предыдущей версией (8.1) в плане аккуратности, реализма и стабильности, особенно при работе со сложными композициями и большим количеством деталей. Улучшена детализация мелких элементов: контуры стали четче, текстуры чище, объекты меньше сливаются. Цветопередача стала более естественной, с точным разделением света и тени и корректной обработкой цветных источников освещения. В версии 8.2 значительно улучшена композиция, масштаб и перспектива – объекты лучше распределены по глубине кадра, а работа с геометрией стала стабильнее, что особенно полезно для архитектурных визуализаций и рекламных материалов. Модель более точно следует инструкциям в промтах, корректно интерпретируя указания на объектив, освещение, материалы и глубину резкости. Midjourney 8.2 демонстрирует уверенное сочетание сложных стилистических требований и повышенную ориентацию на реалистичный результат, создавая изображения, которые выглядят как тщательно продуманные кадры, а не случайные генерации. Это делает ее особенно подходящей для задач, где требуется высокая точность в передаче деталей и естественность визуального восприятия. Подробный анализ новой версии доступен по ссылке на форуме.
    • Новая версия Midjourney 8.2 уже доступна во всех продуктах Yes Ai: в WEB-версии, Telegram-боте и через API. Если коротко: v8.2 стала аккуратнее, реалистичнее и стабильнее в сложных сценах. Особенно это заметно там, где в промте много деталей: материалы, свет, глубина кадра, одежда, фон, ракурс, цветные источники освещения. Midjourney 8.1 и 8.2 работают по-разному с детализацией, цветом, перспективой и композицией. Ниже — основные изменения. 🔍 Детализация В Midjourney 8.2 мелкие элементы сохраняются заметно лучше. Контуры стали чётче, текстуры выглядят чище, а предметы меньше «слипаются» между собой. Это хорошо видно на сложных изображениях: интерьер с декором, портрет с фактурной одеждой, предметная съёмка, сцены с большим количеством объектов. 🎨 Цвет и свет Midjourney 8.2 даёт более естественную цветопередачу. Модель точнее разделяет светлые и тёмные участки, лучше понимает тени и аккуратнее работает с цветными источниками света. Например, если в запросе есть неоновая вывеска, тёплый свет лампы или холодный дневной свет из окна, результат чаще выглядит логично и не уходит в случайные оттенки. 📐 Композиция, масштаб и перспектива В версии 8.2 сцена строится стабильнее. Объекты лучше распределяются по глубине кадра: передний, средний и дальний планы читаются чётче. Также улучшилась работа с геометрией и масштабом. Это особенно полезно для архитектуры, интерьерных сцен, рекламных визуалов и кадров, где важен правильный ракурс. 📝 Понимание промтов Midjourney 8.2 точнее следует запросу. Отдельные элементы промта сохраняются надёжнее, а конкретные инструкции по объективу, освещению, материалам и глубине сцены модель воспринимает лучше. Если вы указываете, например, «85mm lens», «soft studio light», «matte ceramic», «shallow depth of field» — v8.2 чаще переносит эти параметры в результат без сильных искажений. ✨ Стиль и реализм Новая версия увереннее сочетает сложные стилистические требования. Она лучше удерживает описание одежды, фона, освещения и общего настроения сцены. При этом Midjourney 8.2 заметно сильнее ориентирована на реалистичный результат. Картинки чаще выглядят как продуманный кадр, а не как случайная красивая генерация. Подробный разбор Midjourney 8.2 мы подготовили в новой статье: [открыть на форуме]
    • Midjourney v8.1 и v8.2 по-разному интерпретируют детали, цвет, перспективу и сложные композиции. Обновление не меняет привычный принцип работы с генератором, однако влияет на то, как нейросеть прорисовывает мелкие объекты, распределяет визуальные акценты и передаёт материалы. Ниже представлено сравнение версий нейросети на основе пользовательских отзывов и практических наблюдений c примерами промтов. Это не лабораторный тест: результат Midjourney зависит от промта, формата кадра, персонализации, стилизации, seed и других параметров. Тем не менее в генерациях регулярно проявляются характерные различия, которые полезно учитывать при выборе модели. Основные отличия Midjourney v8.1 и v8.2 Детализация мелких элементов В Midjourney v8.1 небольшие объекты на втором плане иногда выглядят обобщённо. Тонкие украшения, пуговицы, элементы архитектуры, узоры на ткани и предметы в глубине сцены могут сливаться или терять форму. Midjourney v8.2 чаще сохраняет такие детали. Контуры становятся заметнее, текстуры — аккуратнее, а мелкие элементы лучше отделяются друг от друга. Разница особенно хорошо видна в портретах с аксессуарами, предметной фотографии и насыщенных городских сценах. При этом высокая детализация не всегда означает более удачный художественный результат. Для живописи, винтажной иллюстрации или атмосферного концепт-арта мягкость v8.1 может оказаться уместной: она не перегружает изображение фактурой и оставляет больше визуальных обобщений. Цветопередача и тональные переходы По отзывам пользователей, v8.2 чаще создаёт естественные цвета. Оттенки кожи, зелени, неба и отражений выглядят более согласованно, а локальные цвета объектов реже смешиваются между собой. В v8.1 палитра может быть мягче. Иногда это создаёт приятное ощущение плёночного кадра, старой печати или иллюстрации, написанной традиционными материалами. Однако в сценах со сложным освещением отдельные области могут получаться менее выразительными. Версия v8.2 заметнее разделяет свет и тень, лучше передаёт цветные источники света и сохраняет оттенки в небольших деталях. Это полезно для рекламных изображений, интерьерных визуализаций и реалистичных портретов. Композиция и перспектива Сложная сцена — одна из ситуаций, где различия между версиями проявляются сильнее. Когда в кадре одновременно присутствуют люди, транспорт, архитектура и множество предметов, Midjourney должна не только нарисовать каждый объект, но и расположить их в едином пространстве. В v8.1 второстепенные элементы порой соединяются друг с другом, перспектива становится менее последовательной, а дальний план выглядит условно. Это не обязательно портит изображение, но может мешать там, где требуется правдоподобная сцена. Midjourney v8.2 лучше справляется с распределением объектов по глубине кадра. Передний, средний и дальний планы чаще читаются отдельно. Геометрия помещений и улиц выглядит устойчивее, а масштаб объектов — логичнее. Особенно это заметно в широкоугольных композициях, интерьерах и сценах с несколькими персонажами. Следование промту В v8.2 отдельные смысловые элементы запроса чаще сохраняются в итоговой композиции. Если в промте перечислены материал, освещение, положение камеры, окружение и несколько важных объектов, обновлённая версия обычно распределяет эти условия точнее. v8.1 склонна свободнее интерпретировать длинные описания. Модель может усилить общий стиль, но ослабить небольшую деталь или заменить её визуально похожим объектом. Это различие стоит учитывать при подготовке текстового запроса. Для v8.2 допустимы более конкретные указания: вид объектива, характер света, фактура материала, глубина сцены. Но перегружать промт противоречивыми требованиями всё равно не следует. Чёткая последовательность «объект — действие — окружение — свет — стиль — параметры» обычно работает понятнее длинного списка эпитетов. Стили и пользовательские настройки По наблюдениям пользователей нейросети, Midjourney v8.2 увереннее сочетает сложные стилистические признаки с пользовательскими настройками. Например, модель может сохранить узнаваемую эстетику редакционной фотографии и одновременно выполнить требования к одежде, фону и освещению. v8.1 иногда сильнее подчиняет изображение общему стилю. За счёт этого кадр может быть выразительным, но часть конкретных деталей из промта уходит на второй план. Разница важна при использовании персонализации, референсов и других настроек. Чтобы оценивать характер конкретной версии по уже созданным работам, необходимо учитывать все параметры генерации. Изменение стилизации или референса способно повлиять на изображение сильнее, чем переход между моделями. Как выбрать Midjourney v8.2 в веб-версии Yes AI Откройте страницу создания изображений или создайте новый чат 👉 в нейросети Midjourney. Перейдите в панель параметров генерации через кнопку настроек. Найдите раздел выбора модели или версии. Настройки Midjourney, далее перейдите к версиям. Откройте список доступных вариантов. Выберите Midjourney v8.2. После выбора версия применяется к последующим генерациям, пока пользователь не изменит настройку или не укажет версию нейросети непосредственно в текстовом запросе. Перед запуском полезно проверить строку параметров: в ней должна отображаться выбранная модель либо не должно быть упоминания версии. Указание версии в промте имеет более высокий приоритет и выставленные настройки с v8.2 в интерфейсе будут проигнорированы.  Как указать версию нейросети Midjourney через промт Версию можно задать непосредственно в запросе. Для этого в конце промта добавляется параметр: --v 8.2 Пример: editorial portrait of a ceramic artist in a bright workshop, natural window light, clay dust in the air, realistic skin texture, muted earth tones --ar 4:5 --v 8.2 Параметр версии лучше размещать в конце, рядом с соотношением сторон и другими техническими настройками. Перед --v должен стоять пробел.  Для использования предыдущей модели указывается соответствующий параметр: --v 8.1 Не стоит одновременно добавлять в один запрос два параметра версии. Midjourney должна получить только одно указание модели. Сравнение генераций Midjourney v8.1 и v8.2 в пяти стилях Следующие примеры промтов показывают, на каких элементах заметны отличия Midjourney v8.1 и v8.2. Конкретная генерация может отличаться из-за случайности, персонализации и дополнительных настроек. 1. Реалистичный портрет Промт: close-up cinematic portrait of an elderly watchmaker in his workshop, round glasses, detailed gray beard, tiny metal watch parts on the table, warm window light, realistic skin texture, shallow depth of field, natural colors --ar 4:5 Midjourney v8.1: Кадр обычно выглядит мягче. Борода и кожа могут быть слегка сглажены, а крошечные детали часов на столе — частично слиты. Тёплое освещение создаёт цельную атмосферу, но отдельные фактуры не всегда хорошо разделены. Более близкий план лица. Midjourney v8.2: Чаще заметны отдельные волоски, оправа очков, инструменты и металлические детали. Кожа сохраняет естественную неоднородность, а фон лучше отделяется от лица за счёт глубины резкости. Цвет света выглядит более локальным: тёплый оттенок не обязательно окрашивает всё изображение одинаково. Изображение выглядит более реалистичным. Наиболее заметное различие: план, микродетали, фактура кожи, границы небольших предметов. 2. Фэнтезийная цифровая живопись Промт: ancient forest guardian figures standing among enormous twisted trees, moss-covered armor, glowing blue runes on his armor, birds in the branches, misty background, fantasy digital painting, dramatic light, intricate environment --ar 16:9 Midjourney v8.1: Доспехи чаще сохраняют структуру, фигура персонажа более прорисована. Версия может сильнее обобщать лес, создавая цельную живописную сцену. Светящиеся руны иногда превращаются в декоративные пятна, а птицы и ветви на дальнем плане становятся условными. Midjourney v8.2: Руны получают более чёткие края и лучше заметны, а деревья лучше распределяются по глубине. Туман остаётся атмосферным, но меньше скрывает средний план. Синие источники света аккуратнее взаимодействуют с зелёными и коричневыми оттенками окружения. Наиболее заметное различие: разделение планов, световые эффекты, прорисовка окружения и персонажа. Этот пример показывает, что v8.2 не обязана быть предпочтительнее для любой задачи. Mягкая интерпретация v8.1 способна выглядеть убедительно. 3. Архитектурная визуализация Промт: modern brutalist house built into a rocky coastal cliff, exposed concrete, panoramic windows, narrow stairs, wild grass, stormy sea below, architectural visualization, wide-angle view, overcast daylight --ar 16:9 Midjourney v8.1: Общая форма здания выглядит выразительно, но лестницы, оконные рамы и линии бетонных блоков могут быть менее отрисованными. На сложных участках архитектура иногда незаметно соединяется со скалой. Меняется форма здания. Midjourney v8.2: Геометрия чаще остаётся устойчивой. Окна, лестничные пролёты и границы материалов лучше читаются, а дом выглядит встроенным в рельеф без случайного слияния конструкций. Перспектива широкоугольного кадра обычно передаётся аккуратнее. Форма здания более стабильна. Наиболее заметное различие: геометрия, масштаб и соединение архитектуры с ландшафтом. 4. Винтажная журнальная иллюстрация Промт: 1960s travel magazine illustration of a woman waiting at a small Mediterranean train station, red suitcase, cream summer dress, mountains in the distance, screen print texture, limited color palette, vintage editorial composition --ar 3:4 Midjourney v8.1: Мягкость модели может органично поддерживать эстетику старой печати. Текстуры выглядят неровными, цвета — немного приглушёнными, а второстепенные детали не отвлекают от персонажа. Midjourney v8.2: Контуры чемодана, одежды и архитектуры чаще становятся точнее. Ограниченная палитра сохраняется, но цвета могут выглядеть чище и контрастнее. Иногда дополнительная детализация делает изображение менее похожим на грубую печатную иллюстрацию, поэтому в запросе особенно важны слова screen print texture и limited color palette. Наиболее заметное различие: чистота контуров и степень стилистического обобщения. 5. Сложная городская сцена Промт: busy rainy night market in a futuristic city, food stalls, pedestrians with transparent umbrellas, delivery bicycles, reflective pavement, layered neon signs, steam rising from street kitchens, cinematic street photography --ar 16:9 Midjourney v8.1: Сцена обычно получается атмосферной, однако дальние персонажи и велосипеды могут терять форму. Неоновые вывески иногда сливаются в общий цветовой фон, а отражения не всегда соответствуют расположению источников света. Midjourney v8.2: Люди, зонты, прилавки и транспорт чаще остаются отдельными объектами. Влажный асфальт получает более точные блики, пар не перекрывает всю сцену, а перспектива улицы выглядит глубже. Цвета вывесок лучше различаются даже при большом количестве источников света. Наиболее заметное различие: работа с множеством объектов, отражениями и пространственной глубиной. Что учитывать при работе с промтами для нейросети Midjourney Удобная схема запроса выглядит так: Главный объект, его особенности и действие, окружение, композиция, освещение, материалы и фактуры, визуальный стиль, технические параметры. Например: minimalist perfume bottle made of frosted blue glass, standing on wet black stone, small water drops, centered product composition, soft side light, realistic reflections, luxury editorial photography --ar 4:5 --v 8.2 В длинных промтах важные признаки лучше располагать ближе к началу. Если материал или предмет критичен для задачи, его следует описать конкретно. Вместо beautiful bottle полезнее написать rectangular perfume bottle made of frosted blue glass with a silver cap. Не следует пытаться исправить все возможные ошибки десятками отрицаний. Короткое положительное описание обычно даёт модели более ясное направление. Параметры стоит добавлять только тогда, когда понятна их роль. Работа с Midjourney в веб-версии: пошаговая инструкция Шаг 1. Откройте страницу генерации 👉 нейросеть Midjourney и введите промт Шаг 2. Перейдите к настройкам модели Шаг 3. Выберите необходимые параметры Шаг 4. Добавление параметра --v в промт Проверьте что необходимая версия указана в конце промта и написана правильно, если вам удобнее работать с командами через промт.  Шаг 5. Запустите генерацию Шаг 6. Просмотр результата и сохранение изображения Какую версию Midjourney выбрать? Midjourney v8.2 имеет смысл использовать в задачах, где важны мелкие элементы, точная геометрия, естественная цветопередача и сложная композиция. К таким сценариям относятся предметные изображения, архитектурные концепции, реалистичные портреты, интерьерные сцены и кадры с большим количеством объектов. Midjourney v8.1 может быть полезна для работ, в которых уместны мягкость, визуальное обобщение и менее выраженная цифровая резкость. Это касается винтажной графики, живописных фэнтезийных сцен, атмосферных пейзажей и некоторых видов концепт-арта. Сравнение версий нейросети показывает не только технические изменения. v8.2 чаще следует сложному описанию, увереннее прорисовывает небольшие элементы и лучше организует пространство стремясь к более реалистичному изображению. v8.1 отличается более свободной интерпретацией и в отдельных художественных стилях создаёт естественную мягкость, что выглядит гармоничнее. Понимание этих особенностей помогает заранее выбрать подходящую версию и составить промт с учётом характера той или иной версии.
  • Генерации из нейросетей

×
×
  • Создать...