Новые промты каждый день в Telegram →
Главная/ Инструменты/ Промт по картинке

Промт по картинке: узнать, как сгенерировать похожее

Загрузите изображение — соберём промт, по которому получится похожий кадр. С разбором по слоям и в синтаксисе выбранной модели. Без регистрации, 2 раза в сутки.

Приёмник · фото
Целевая модель

Загруженные файлы не сохраняются, удаляются сразу после обработки и не попадают в резервные копии. Подробнее — в политике конфиденциальности.

Как это работает

Инструмент показывает изображение мультимодальной модели и просит описать его так, как описывают задачу генератору: что в кадре, как он скомпонован, откуда падает свет, какой оптикой снято, в какой стилистике обработано. Ответ разбирается на слои и собирается в один промт на английском.

Английский — не прихоть. Генеративные модели обучены преимущественно на англоязычных описаниях, и на английском они точнее попадают в нюансы: «soft rim light» модель понимает лучше, чем «мягкий контровой свет». Русское пояснение мы показываем рядом, чтобы было видно, что именно инструмент разглядел, — и чтобы вы могли поправить формулировку, если он ошибся.

Почему точное повторение чужой картинки невозможно

Это главное ожидание, которое стоит снять сразу. Промт — не файл проекта. Даже если восстановить его дословно, генерация не повторится, и вот почему.

Seed. Каждая генерация начинается со случайного числа. Один и тот же промт с разными seed даёт разные кадры — иногда очень разные. Автор исходной картинки свой seed вам не сообщил, и по изображению его восстановить нельзя.

Версия модели. Midjourney 6.1 и Midjourney 5 по одному промту дают непохожие результаты. Модели обновляются, старые версии со временем отключаются. Если картинка сделана год назад, той модели может уже не существовать.

Скрытые параметры и постобработка. Референсные изображения, веса стилей, апскейл, ретушь в редакторе — всё это не видно в результате, но влияет на него. Значительная часть красивых картинок в сети — это генерация плюс полчаса ручной работы.

Поэтому честная формулировка задачи звучит так: инструмент даёт промт, по которому получается кадр той же природы — тот же сюжет, тот же свет, та же стилистика. Это ровно то, что нужно, когда вы хотите не украсть картинку, а понять приём и применить его к своему товару.

Что делать с полученным промтом

Не вставляйте его как есть. Полученный текст — заготовка, из которой стоит собрать свой промт:

  • Замените предмет. Описание сюжета меняется на ваш товар, всё остальное — свет, оптика, композиция — остаётся. Именно эти слои и делают кадр профессиональным.
  • Уберите лишние детали. Модель описывает всё, что видит, включая случайные предметы фона. Чем короче и точнее промт, тем предсказуемее результат.
  • Проверьте пропорции. Для карточки маркетплейса нужен вертикальный кадр 4:5 или 3:4, а исходная картинка могла быть квадратной.
  • Сгенерируйте несколько вариантов. Один кадр ничего не говорит о промте: оценивать стоит по трём-четырём.

Чем отличается результат для Midjourney и Nano Banana

Это не косметическая разница, и на ней спотыкаются чаще всего. Midjourney понимает собственные флаги: --ar 4:5 задаёт пропорции, --v 6.1 — версию, --style raw отключает «художественность» по умолчанию, что важно для предметной съёмки. Флаги пишутся в конце промта и являются его частью.

Nano Banana, Flux и GPT Image этих флагов не знают. Строка --ar 4:5 для них — просто текст, который попадёт в описание сцены и испортит кадр. Пропорции у них задаются либо параметрами запроса, либо словами внутри промта. Поэтому инструмент собирает промт под выбранную модель, а не отдаёт один текст на все четыре: подставлять синтаксис Midjourney в модель, которая его не понимает, — частая и очень заметная ошибка.

Есть и стилистическая разница. Midjourney хорошо принимает плотное перечисление через запятые. Nano Banana и GPT Image точнее работают со связным текстом, написанным обычным языком. Flux любит длинные подробные описания материалов и света.

Чего инструмент не делает

Он не называет людей на фотографии и не пытается опознать конкретного человека: в промт попадёт «женщина 30–40 лет», а не имя. Он не переносит названия брендов с упаковки и не описывает стиль через имена ныне живущих художников — вместо «в стиле такого-то» вы получите описание приёма. Это и приватность, и юридическая гигиена: промт с чужим именем внутри — плохая основа для коммерческой карточки.

Изображения с документами и персональными данными, а также откровенный контент инструмент не обрабатывает.

Вопросы

Можно ли получить точно такую же картинку?

Нет. Даже идеальный промт не воспроизведёт чужой кадр: результат зависит от версии модели и от seed — случайного числа, с которого начинается генерация. Инструмент даёт промт, по которому получается похожая по сюжету, свету и стилю картинка, а не копия.

Почему промт на английском?

Модели обучены преимущественно на английских описаниях и понимают их точнее. Русский перевод-пояснение мы показываем рядом, чтобы было видно, что именно мы разглядели на фото и как это описали.

Почему для разных моделей промт разный?

У Midjourney есть собственные флаги — --ar задаёт пропорции, --v версию. Nano Banana, Flux и GPT Image этих флагов не понимают и принимают их за часть описания, портя кадр. Поэтому мы отдаём промт в синтаксисе выбранной модели, а не один текст на всех.

Сохраняете ли вы загруженные фото?

Нет. Файл обрабатывается и удаляется, в резервные копии не попадает. Метаданные, включая GPS-координаты съёмки, срезаются сразу после приёма. В логи пишутся только хэш и размер файла.

Сколько раз в сутки можно пользоваться?

Два раза без регистрации. Дальше можно продолжить в Telegram-боте. Повторная загрузка того же файла не тратит попытку — результат берётся из кэша.

СКОПИРОВАНО