Загрузите изображение — соберём промт, по которому получится похожий кадр. С разбором по слоям и в синтаксисе выбранной модели. Без регистрации, 2 раза в сутки.
Загруженные файлы не сохраняются, удаляются сразу после обработки и не попадают в резервные копии. Подробнее — в политике конфиденциальности.
Инструмент показывает изображение мультимодальной модели и просит описать его так, как описывают задачу генератору: что в кадре, как он скомпонован, откуда падает свет, какой оптикой снято, в какой стилистике обработано. Ответ разбирается на слои и собирается в один промт на английском.
Английский — не прихоть. Генеративные модели обучены преимущественно на англоязычных описаниях, и на английском они точнее попадают в нюансы: «soft rim light» модель понимает лучше, чем «мягкий контровой свет». Русское пояснение мы показываем рядом, чтобы было видно, что именно инструмент разглядел, — и чтобы вы могли поправить формулировку, если он ошибся.
Это главное ожидание, которое стоит снять сразу. Промт — не файл проекта. Даже если восстановить его дословно, генерация не повторится, и вот почему.
Seed. Каждая генерация начинается со случайного числа. Один и тот же промт с разными seed даёт разные кадры — иногда очень разные. Автор исходной картинки свой seed вам не сообщил, и по изображению его восстановить нельзя.
Версия модели. Midjourney 6.1 и Midjourney 5 по одному промту дают непохожие результаты. Модели обновляются, старые версии со временем отключаются. Если картинка сделана год назад, той модели может уже не существовать.
Скрытые параметры и постобработка. Референсные изображения, веса стилей, апскейл, ретушь в редакторе — всё это не видно в результате, но влияет на него. Значительная часть красивых картинок в сети — это генерация плюс полчаса ручной работы.
Поэтому честная формулировка задачи звучит так: инструмент даёт промт, по которому получается кадр той же природы — тот же сюжет, тот же свет, та же стилистика. Это ровно то, что нужно, когда вы хотите не украсть картинку, а понять приём и применить его к своему товару.
Не вставляйте его как есть. Полученный текст — заготовка, из которой стоит собрать свой промт:
Это не косметическая разница, и на ней спотыкаются чаще всего.
Midjourney понимает собственные флаги: --ar 4:5 задаёт
пропорции, --v 6.1 — версию, --style raw
отключает «художественность» по умолчанию, что важно для предметной
съёмки. Флаги пишутся в конце промта и являются его частью.
Nano Banana, Flux и GPT Image этих флагов не знают.
Строка --ar 4:5 для них — просто текст, который попадёт в
описание сцены и испортит кадр. Пропорции у них задаются либо параметрами
запроса, либо словами внутри промта. Поэтому инструмент собирает промт
под выбранную модель, а не отдаёт один текст на все четыре: подставлять
синтаксис Midjourney в модель, которая его не понимает, — частая и очень
заметная ошибка.
Есть и стилистическая разница. Midjourney хорошо принимает плотное перечисление через запятые. Nano Banana и GPT Image точнее работают со связным текстом, написанным обычным языком. Flux любит длинные подробные описания материалов и света.
Он не называет людей на фотографии и не пытается опознать конкретного человека: в промт попадёт «женщина 30–40 лет», а не имя. Он не переносит названия брендов с упаковки и не описывает стиль через имена ныне живущих художников — вместо «в стиле такого-то» вы получите описание приёма. Это и приватность, и юридическая гигиена: промт с чужим именем внутри — плохая основа для коммерческой карточки.
Изображения с документами и персональными данными, а также откровенный контент инструмент не обрабатывает.
Нет. Даже идеальный промт не воспроизведёт чужой кадр: результат зависит от версии модели и от seed — случайного числа, с которого начинается генерация. Инструмент даёт промт, по которому получается похожая по сюжету, свету и стилю картинка, а не копия.
Модели обучены преимущественно на английских описаниях и понимают их точнее. Русский перевод-пояснение мы показываем рядом, чтобы было видно, что именно мы разглядели на фото и как это описали.
У Midjourney есть собственные флаги — --ar задаёт пропорции, --v версию. Nano Banana, Flux и GPT Image этих флагов не понимают и принимают их за часть описания, портя кадр. Поэтому мы отдаём промт в синтаксисе выбранной модели, а не один текст на всех.
Нет. Файл обрабатывается и удаляется, в резервные копии не попадает. Метаданные, включая GPS-координаты съёмки, срезаются сразу после приёма. В логи пишутся только хэш и размер файла.
Два раза без регистрации. Дальше можно продолжить в Telegram-боте. Повторная загрузка того же файла не тратит попытку — результат берётся из кэша.