В этой статье
Иногда фотографию нужно не «починить», а пересобрать. Человек остаётся тем же, поза и одежда уже удачны, но городская сцена за спиной выглядит случайной: жёсткий полдень, пустой фон, лишние прохожие. В таком случае удобнее просить GPT не о маленькой ретуши, а о новой версии снимка по исходному кадру.
Что значит регенерировать фотографию
Регенерация — это создание переработанного варианта изображения с опорой на загруженный снимок. Вы задаёте, что должно измениться, и отдельно перечисляете детали, которые нельзя потерять. ChatGPT Images умеет принимать существующее изображение и выполнять описанные изменения; интерфейс и названия отдельных элементов могут отличаться в веб-версии и мобильном приложении. Официальная справка OpenAI описывает этот режим как редактирование загруженного изображения.
Это не то же самое, что точечная правка. Если нужно убрать один столб или заменить маленький участок, можно выделить область инструментом выделения или назвать её прямо в сообщении. Но граница выделения не всегда точна: изменение способно немного выйти за пределы отмеченного места. Когда же вы хотите получить осеннюю версию всего кадра, лучше сразу описать новую сцену и зафиксировать опорные условия снимка.
После первой полезной инструкции можно отдельно подумать о доступе, если изображения станут частью регулярной работы. Для пользователя из России варианты оплаты цифровых сервисов собраны в каталоге Amber Market. Это не официальный тариф OpenAI и не обязательный шаг для самой регенерации: перед заказом проверьте наличие нужного варианта, условия и итоговую стоимость. Если выберете подходящую услугу, способ оплаты через СБП и условия получения будут указаны на странице заказа.
Подготовьте исходные данные
Сначала выберите фотографию, на которой хорошо видны предметы, которые вы хотите сохранить. В нашем примере это собственный горизонтальный снимок человека в городском парке. Лицо и поза должны остаться узнаваемыми, поэтому лицо не стоит описывать как часть новой сцены — оно относится к неизменяемой опоре.
Перед загрузкой разделите задачу на три коротких списка:
- исходные данные: горизонтальная фотография человека в городском парке;
- что пересоздать: фон, превратив его в осенний парк с мягким рассеянным светом;
- что оставить: человека, лицо, руки, одежду, позу, ракурс и кадрирование.
Такой разбор похож на настройку света в кадре. Фон может стать другим материалом, но край фигуры, положение плеч и расстояние до камеры должны остаться прежними. Если всё смешать в одну общую просьбу — «сделай красивее и осеннее» — у модели будет слишком много свободы, и она начнёт переставлять не только деревья.
Загрузите снимок в ChatGPT Images
Откройте ChatGPT и добавьте исходную фотографию в диалог. В зависимости от версии интерфейса можно выбрать раздел Images или прикрепить файл в поле сообщения, а затем написать задачу обычным текстом. Конкретные кнопки и доступность отдельных элементов могут меняться.
Сформулируйте запрос так, чтобы сначала было понятно назначение новой версии, затем — список сохраняемых деталей, а в конце — запреты. Например:
Используй загруженную горизонтальную фотографию как референс и создай новую версию этого же снимка. Пересоздай только фон: вместо городского парка сделай спокойный осенний парк с мягким рассеянным светом, естественными жёлто-оранжевыми листьями и реалистичной глубиной пространства. Сохрани человека, лицо, руки, выражение лица, позу, одежду, ракурс камеры, перспективу, горизонтальную ориентацию и исходное кадрирование. Не добавляй других людей, текст, логотипы или случайные предметы. Не меняй форму и границы фигуры. Это новая версия по исходному фото, а не точная копия каждого пикселя.
В этом примере исходные данные не прячутся внутри красивых эпитетов: есть человек, горизонтальный кадр и городской парк. Отдельно названо пересоздание — фон и свет. Ещё один слой занимает список ограничений. Он работает как рамка вокруг изображения: взгляд может уйти в золотые деревья, но не должен унести с собой лицо или край рукава.
Для качества света лучше выбирать наблюдаемые признаки. «Мягкий рассеянный свет» полезнее, чем просто «сделай атмосферно»: он подсказывает, что на лице не должны появиться резкие пятна и жёсткие тени. «Естественная глубина пространства» удерживает дальние деревья на месте фона, а не превращает их в декоративную стену.
Дождитесь первой версии и рассмотрите её рядом с исходником
Когда новая версия появится, не оценивайте её только по общему впечатлению. Красивый золотой фон иногда маскирует маленькие сдвиги: подбородок стал другим, ладонь потеряла палец, линия плеча поплыла, а горизонт оказался выше.
Сравните две фотографии по порядку:
- Лицо и выражение. Человек должен оставаться узнаваемым, но не рассчитывайте на гарантированную идентичность каждой черты.
- Руки и позу. Проверьте пальцы, положение локтей, плеч и стоп, если они попали в кадр.
- Одежду и границы фигуры. Посмотрите, не пророс ли новый фон сквозь рукав и не появился ли лишний контур вокруг волос.
- Перспективу и кадрирование. Верно ли осталась точка съёмки, размер человека и горизонтальный формат.
- Фон. Деревья должны лежать за человеком, а свет — согласовываться с лицом и одеждой.
- Текст и случайные объекты. Ищите вывески, логотипы, лишних людей и нечитаемые надписи, которых не было в исходнике.
Это иллюстрация рабочего способа проверки, а не обещание заранее полученного результата. GPT может восстановить убедительную сцену, но не видит скрытые за человеком детали исходника и не обязан сохранить каждый пиксель. Поэтому исходная фотография остаётся мерой сравнения.
Если что-то изменилось, сделайте одну короткую итерацию
Не отправляйте сразу новый длинный промпт со всеми пожеланиями. Укажите конкретный сдвиг и повторите главные ограничения. Например:
Фон и осенний свет подходят. Пересоздай эту версию ещё раз, но верни исходное лицо и форму рук, сохрани точную позу и размер фигуры в кадре. Измени только фон за человеком. Не добавляй людей, текст или логотипы.
Такой запрос направляет взгляд в одно место. Если на новой версии изменился только фон, не нужно заново просить сменить одежду или добавить кинематографический цвет — лишние пожелания снова расширят область вмешательства. Рекомендации OpenAI по созданию изображений также сводятся к тому, что изменяемые и сохраняемые детали лучше разделять и уточнять запрос итеративно.
Если в диалоге доступен редактор, можно открыть изображение и выделить проблемную область. Но выделение стоит воспринимать как ориентир, а не как хирургический разрез: сама справка OpenAI предупреждает, что правка может выйти за пределы отмеченной зоны. Для лица и рук безопаснее словами напомнить, что они должны остаться без изменений, а после каждой итерации снова сравнить изображение с исходником.
Подход хорошо работает в несколько спокойных проходов: сначала получить нужную сцену, затем проверить человека и композицию, потом исправить один заметный дефект. В материале о промптах для редактирования фото можно взять дополнительные формулировки, если понадобится точнее описать свет, стиль или отдельную зону.
Когда нужен другой режим
Регенерация всей версии подходит, когда меняется атмосфера или окружение, но важная структура снимка должна сохраниться. Если задача сводится к одному небольшому объекту, начните с локальной правки — например, по инструкции для исправления одной детали в ChatGPT. Так меньше площадь, в которой может измениться лицо или композиция.
Если же фотографии нужно обрабатывать программно, с повторяемыми параметрами и загрузкой из своего приложения, это уже отдельный API-сценарий. Он требует другой подготовки и не нужен для обычного диалога с загруженным снимком; для такого случая есть отдельный материал о редактировании фото через API.
Главное правило остаётся простым: сначала назовите исходник, затем разделите «пересоздать» и «сохранить», после генерации сравните лицо, фигуру, перспективу и фон. GPT помогает собрать новый кадр, но финальное решение принимает человек, который видит, где свет лёг удачно, а где вместе с осенними листьями случайно изменился сам снимок.
Источники
- Images in ChatGPTOpenAI Help Center
- Creating images with ChatGPTOpenAI Academy