Промпты для фото нейросетью: формулы и примеры

НейросетиИгорь Мельник9 мин чтения
Промпты для фото нейросетью: формулы и примеры

Вводите в нейросеть «красивый портрет девушки, студийный свет» и получаете глянцевую картинку, которая выглядит как рендер, а не как фотография. Так работают обычные промпты для фото нейросетью без технических деталей: слова есть, а результата нет. Дело не в нейросети: формулировка задачи даже для фотостиля требует других слов, чем для иллюстрации или арта. Фотореализм держится на трёх опорах: свете, ракурсе и параметрах камеры, и если их не назвать прямо, модель достраивает их по своему усмотрению.

Общие гайды по промпт-инжинирингу разбирают анатомию запроса целиком: субъект, стиль, детали, технические флаги. Для фотостиля этого недостаточно. Портрет, товарное фото и интерьер строятся на разных формулах, и у каждой свой набор слов, который реально считывают Midjourney, Kandinsky и Шедеврум. Разница заметна уже на первой генерации: одна и та же сцена без привязки к типу съёмки превращается либо в иллюстрацию, либо в рендер из видеоигры. Дальше: готовые шаблоны под каждый случай и то, чем площадки отличаются в работе с этими формулами.

Из чего состоит формула фотопромпта

Фотопромпт отличается от обычного описания сцены тем, что в нём явно прописаны технические параметры съёмки, а не только содержание кадра. Рабочая формула выглядит так: субъект и действие, тип съёмки, свет, ракурс и объектив, фактура и детали, настроение. Пропустите хотя бы один пункт, и модель заполнит пробел шаблонным решением: чаще всего плоским фронтальным светом и ракурсом в упор.

  • Субъект: кто или что в кадре, возраст, одежда, поза, если это человек; материал и форма, если это предмет.
  • Тип съёмки: портретная, продуктовая, интерьерная, репортажная. Это слово задаёт модели весь стиль обработки.
  • Свет: источник, направление, мягкость. «Мягкий боковой свет от окна» и «жёсткий верхний свет» дают разные фотографии одного и того же объекта.
  • Ракурс и объектив: угол съёмки, высота камеры, фокусное расстояние, глубина кадра.
  • Фактура: текстуры, которые нейросеть обычно упускает: поры кожи, зерно дерева, отражения на металле.
  • Настроение: цветовая температура, атмосфера, общая тональность снимка.

Порядок слов в промпте почти не влияет на результат: важнее не пропустить ни один из шести пунктов. Опытные пользователи обычно пишут формулу как чек-лист и проверяют её перед отправкой запроса, особенно если предыдущая генерация получилась плоской или пластиковой.

Шаблон для портрета

Портрет страдает от двух проблем: пластиковая кожа и неестественный свет. Обе решаются словами, а не постобработкой.

Формула: [человек, возраст, детали внешности] + [поза и эмоция] + portrait photography + [тип света: natural window light / golden hour / softbox] + [объектив: 85mm lens, shallow depth of field] + [фактура: visible skin texture, soft shadows] + [фон].

Пример: «женщина 30 лет, лёгкая улыбка, смотрит в сторону, portrait photography, мягкий естественный свет из окна, 85mm lens, неглубокая глубина кадра, видна текстура кожи, нейтральный серый фон».

Где ошибаются: просят «реалистичный портрет» без упоминания света и объектива, и получают усреднённое лицо с ровным светом из ниоткуда. Фраза «85mm lens, shallow depth of field» размывает фон и сразу убирает ощущение рендера: это одна из немногих технических формулировок, которую все три нейросети считывают предсказуемо, потому что термин встречается в описаниях реальных фотографий, на которых они обучены.

Для портрета в полный рост формула почти не меняется, но добавляется уточнение по позе и одежде: «стоит, руки скрещены, деловой костюм». Чем конкретнее описана поза, тем меньше шансов, что нейросеть добавит неестественный изгиб тела или лишние пальцы на руках.

Шаблон для товарной фотографии

Товарный кадр нужен для маркетплейса или сайта, и здесь ошибка в формуле стоит продаж: размытые грани, искажённые пропорции, неправильный цвет упаковки.

Формула: [товар и материал] + product photography + [тип фона: white background / studio background / lifestyle background] + [свет: softbox lighting, no harsh shadows] + [ракурс: top-down view / 45 degree angle / eye level] + [детали: sharp focus, high detail].

Пример: «керамическая кружка с матовой глазурью, product photography, белый фон, мягкий студийный свет без резких теней, ракурс 45 градусов, высокая детализация, резкий фокус».

Для карточек на маркетплейсе отдельно указывайте white background: без этого слова нейросеть часто добавляет текстуру стола или тени, которые площадки отклоняют при модерации. Для лайфстайл-фото, наоборот, просите lifestyle background и описывайте сценарий использования: «кружка на деревянном столе рядом с книгой утром».

Для карточек с несколькими товарами в кадре формулу нужно повторить для каждого предмета отдельно, иначе модель смешивает материалы и пропорции: кружка может получить фактуру тарелки, а тарелка цвет кружки. Проще сгенерировать каждый товар отдельным запросом и собрать коллаж вручную.

Шаблон для интерьера

Интерьерные промпты чаще всего проваливаются из-за перспективы: комната выглядит искривлённой, как в кривом зеркале.

Формула: [тип помещения и стиль] + interior photography + [свет: natural daylight through windows / warm ambient light] + [ракурс: wide angle shot, eye level] + [детали: architectural details, realistic materials] + [время суток].

Пример: «гостиная в скандинавском стиле, interior photography, естественный дневной свет из окон, широкоугольный кадр на уровне глаз, реалистичные материалы, деревянный пол, раннее утро».

Где ошибаются: просят «широкий угол» без слова eye level, и камера улетает либо в пол, либо в потолок. Указание высоты камеры в паре с типом объектива решает проблему в большинстве случаев.

Для интерьера в вертикальной ориентации, например под карточку в соцсети, добавьте в формулу слово vertical composition: без него нейросеть по умолчанию тянется к горизонтальному кадру и обрезает верх или низ комнаты при смене соотношения сторон.

Таблица: как три нейросети работают с этими формулами

Параметр Midjourney Kandinsky Шедеврум
Соотношение сторон задаётся прямо в тексте промпта параметром –ar выбирается в настройках генерации, не текстом выбирается кнопкой настроек перед генерацией
Негативный промпт параметр –no в тексте запроса отдельное поле «негативный промпт» доступен в ручном режиме, отдельное поле
Слова про свет и ракурс считывает англоязычные фототермины точнее всего хорошо понимает русский, термины можно не переводить оптимизирован под русский язык, пишите без англицизмов
Контроль случайности параметр –chaos меняет разброс вариантов управляется через стиль и количество попыток управляется через повторную генерацию и уточнение промпта

Таблица показывает только управление параметрами. Содержательная часть формулы: свет, ракурс, фактура, переносится между площадками без изменений, а техническая обёртка каждый раз своя.

Чем Midjourney, Kandinsky и Шедеврум отличаются в работе с одним промптом

Одна и та же формула даёт разный результат в зависимости от площадки, и дело не только в качестве модели, а в том, как она принимает параметры. Эта разница особенно заметна при переносе готового промпта с одной площадки на другую без адаптации.

В Midjourney параметры пишутся прямо в строке промпта: после основного текста через пробел ставится –ar для соотношения сторон, –no для исключения объектов, –chaos для разброса вариантов. Площадка лучше понимает англоязычные фототермины: portrait photography, 85mm lens, softbox lighting работают точнее, чем их перевод.

В Kandinsky соотношение сторон и негативный промпт задаются отдельными полями интерфейса, а не текстовыми флагами. Площадка хорошо понимает русский язык, и фототермины можно писать на русском без потери смысла: «мягкий боковой свет» сработает не хуже soft side light.

В Шедевруме соотношение сторон выбирается кнопкой настроек перед генерацией, а негативный промпт доступен в ручном режиме. Нейросеть оптимизирована под русскоязычные запросы, и смешивать языки в одном промпте здесь обычно только мешает: результат стабильнее, если формула целиком на русском.

На практике удобно завести под каждую площадку короткую памятку с синтаксисом параметров: так при смене нейросети не придётся вспоминать, где искать соотношение сторон или негативный промпт.

Частые ошибки при составлении фотопромптов

Большинство неудачных генераций повторяют один и тот же набор причин, и их легко проверить по списку перед отправкой запроса.

  • Просят «фотореалистичное изображение» без упоминания света, ракурса и объектива: слово «фотореалистичное» само по себе не несёт технической информации для модели.
  • Смешивают стили в одном запросе: «портрет в стиле акварели, но как фотография» дает промежуточный результат, который не похож ни на то, ни на другое.
  • Перегружают промпт прилагательными вместо конкретики: «красивый, качественный, профессиональный свет» слабее, чем «мягкий боковой свет из окна в пасмурный день».
  • Забывают про фон: без указания фона на товарном фото модель часто добавляет случайную текстуру стола или ткани.
  • Копируют английскую формулу в Шедеврум без адаптации: русскоязычная площадка стабильнее работает с русским описанием.

Частые вопросы

Нужно ли писать промпт для фото на английском языке?

Для Midjourney английские фототермины вроде portrait photography или shallow depth of field дают точнее результат, потому что модель обучена в основном на англоязычных описаниях. Для Kandinsky и Шедеврума это не обязательно: обе площадки созданы российскими компаниями и устойчиво работают с русским языком, перевод терминов не даёт заметного преимущества. Смешивать языки в одном промпте для Kandinsky и Шедеврума не стоит: это иногда сбивает модель и даёт смазанный результат.

Как убрать эффект пластиковой кожи на портрете?

Добавьте в промпт прямое указание на фактуру: visible skin texture, soft natural light, и укажите объектив с неглубокой глубиной кадра, например 85mm lens. Жёсткий верхний свет и короткофокусные объективы чаще дают сглаженную, пластиковую кожу, поэтому их в промпте для портрета лучше не упоминать. Избегайте также слов «гладкая кожа» и «идеальная кожа»: они усиливают эффект сглаживания, а не убирают его.

Чем товарный промпт отличается от обычного описания предмета?

Товарный промпт обязательно включает тип фона, направление света и ракурс съёмки: white background, softbox lighting, top-down view. Без этих слов нейросеть генерирует предмет в произвольном окружении, которое не подходит для карточки на маркетплейсе и часто не проходит модерацию площадки. Дополнительно укажите материал фона словом backdrop, если нужна не чистая плоскость, а лёгкая текстура ткани.

Почему интерьер получается искривлённым?

Чаще всего в промпте не указана высота камеры. Добавьте eye level или camera at waist height вместе с wide angle shot, и перспектива станет ближе к реальной съёмке. Без этого уточнения модель сама выбирает угол, и результат может напоминать съёмку с рыбьим глазом. Если искривление остаётся, замените формулировку wide angle shot на standard lens: более длиннофокусный объектив меньше искажает линии стен.

Можно ли использовать один и тот же промпт в разных нейросетях?

Содержательную часть промпта: субъект, свет, ракурс, можно переносить между площадками без изменений. Технические параметры переносить нельзя: –ar и –no работают только в Midjourney, в Kandinsky и Шедевруме соотношение сторон и негативный промпт задаются через интерфейс, а не текстом. Также уберите слова усиления типа «очень» и «супер»: они не несут технической информации и просто занимают место в запросе.

С чего начать

Возьмите одну из трёх формул выше и примените её к реальной задаче: карточке товара, портрету для сайта или фото интерьера для презентации. Дальше действуйте так:

  1. Выберите тип съёмки и зафиксируйте формулу: субъект, свет, ракурс, фактура, настроение.
  2. Сгенерируйте три-четыре варианта с одной формулой, меняя только один параметр за раз: так видно, какое слово реально влияет на результат.
  3. Для Midjourney добавьте технические флаги в конец строки, для Kandinsky и Шедеврума настройте соотношение сторон и негативный промпт через интерфейс.
  4. Сохраните рабочие формулы как шаблоны для похожих задач: портретная съёмка персонала, карточки товаров одной линейки, интерьерные фото для каталога.

На третьей-четвёртой генерации обычно становится ясно, какие слова в формуле работают на вашей задаче, а какие можно убрать без потери качества.

Если нужен готовый поток фотореалистичных изображений для сайта, маркетплейса или рекламы без ручной настройки промптов под каждую нейросеть, этим занимаются контент-фабрики Neurounit.

Поделиться:

About Author: Игорь Мельник

nu_editor_melnik@neurounit.ai

Редактор Neurounit. Пишет про автоматизацию, разработку и внедрение AI в процессы.

Neurounit

Запустить рост с AI

Оставьте заявку или напишите в мессенджер