Как создать видео по фото в GPT: что работает сейчас и как проверить результат

В этой статье

Если под «GPT» вы имеете в виду ChatGPT, сначала разделите две задачи. Чат может помочь придумать движение, написать промпт и разобрать уже готовый ролик, но обычный диалог не обещает на выходе видеофайл из одной фотографии. Исторически превращением изображения в короткую сцену занималась Sora — отдельный продукт OpenAI.

На 20 сентября 2026 года старые инструкции с кнопкой загрузки фото в Sora нельзя считать действующим способом. Web- и app-опыт Sora прекращён 26 апреля 2026 года — это также указано в анонсе Sora 2 от OpenAI, — а API должен быть прекращён 24 сентября 2026 года; даты подтверждены в официальной справке о прекращении Sora. Поэтому прежний интерфейс полезен только для понимания принципа работы, но не обещает доступ сегодня.

Как раньше создавали ролик из фотографии

Последовательность была похожа на постановку маленького кадра.

  1. Подготовьте фотографию, на которую у вас есть право загрузки и использования.
  2. Загрузите её в поддерживаемый инструмент image-to-video, если такой доступ есть именно у вашей учётной записи.
  3. Опишите не только объект, но и движение: что остаётся неподвижным, куда перемещается камера, меняется ли свет, сколько длится сцена.
  4. Запустите генерацию и сравните получившийся ролик с исходным изображением.

У Sora исторически была возможность создавать видео из изображения; меры безопасности для такого сценария описаны в материале OpenAI о создании в Sora. Но это не означает, что та же функция находится внутри любого чата с GPT или доступна сейчас в прежнем виде. Актуальный статус проверяйте в официальном интерфейсе продукта и справочных материалах OpenAI: если раздел или запуск недоступны, старый скриншот не восстановит доступ.

Если после основного ответа понадобится отдельно проверить способы оплаты зарубежных сервисов, можно познакомиться с каталогом Amber Market. Это каталог услуг оплаты и подписок, а не способ вернуть прекращённый доступ к Sora и не подтверждение наличия конкретного видеогенератора. Наличие, условия и итоговую стоимость нужно смотреть на карточке выбранной услуги перед заказом.

Пример: чашка на деревянном столе

Представим исходный кадр: чашка стоит на деревянном столе, фотография вертикальная, соотношение сторон 4:5. Вокруг достаточно воздуха, фон спокойный, и форма чашки хорошо читается по краю.

Запрос для image-to-video можно было бы сформулировать так:

Создай короткую сцену длительностью 5 секунд на основе загруженной фотографии. Камера плавно приближается к чашке. Над чашкой появляется лёгкий, почти прозрачный пар. Сохрани форму, цвет и положение чашки, деревянную фактуру стола и исходное вертикальное кадрирование. Не добавляй людей, руки, текст, логотипы и новые предметы. Движение должно быть медленным и непрерывным, без резких скачков.

Это иллюстративный пример формулировки, а не результат реально выполненной генерации. В нём камера — главный жест, а пар — единственная заметная перемена. Если одновременно попросить поворот чашки, движение руки, смену фона и солнечный блик, внимание распадётся: модель начнёт перестраивать края предмета и изобретать детали, которых не было в фотографии.

Что проверить в готовом результате

Поставьте рядом исходный кадр и первый кадр ролика. У чашки должен сохраниться тот же силуэт: ручка не должна исчезать, край не должен расплываться, а основание не должно «плыть» по столу. Проверьте и фон — древесный рисунок часто выдаёт лишнюю деформацию раньше, чем главный объект.

Затем посмотрите ролик целиком без пауз. Плавное приближение должно ощущаться одним движением, а не серией скачков. Лёгкий пар должен появляться мягко и не превращаться в густое облако, закрывающее чашку. После этого проверьте длительность и формат: в примере это 5 секунд и вертикальный кадр 4:5.

Полезно отдельно спросить себя, выполнил ли результат именно заданное изменение. Если вы просили приблизить камеру, а чашка выросла за счёт растяжения или изменилась её форма, это не удачное движение камеры. Если появились текст, человек или новая посуда, ролик не соответствует исходным ограничениям — даже если выглядит эффектно.

Если на фотографии есть человек

Для изображения с человеком требования строже. Нужны согласие человека и права на загрузку фотографии; для изображений несовершеннолетних действуют дополнительные ограничения. Эти правила описывались OpenAI применительно к безопасному созданию в Sora и не должны автоматически переноситься на любой другой сервис.

Не используйте чужой портрет без разрешения, не пытайтесь подменять личность и не просите создать ролик, который может обмануть зрителя насчёт реального события. Безопаснее заранее обозначить в запросе допустимое движение — например, лёгкое изменение взгляда или едва заметное движение волос — и проверить, не меняется ли лицо.

Как понять, работает ли решение сейчас

Проверка занимает меньше времени, чем поиск старой кнопки по скриншотам.

Сначала уточните, какой именно инструмент вы открыли: ChatGPT или отдельный продукт OpenAI. Затем посмотрите, есть ли в текущем интерфейсе официально доступная функция загрузки изображения и создания видео для вашей учётной записи. Если доступ не заявлен или кнопка отсутствует, не подменяйте это обычной загрузкой фото в чат: чат может описать будущую сцену, но это ещё не готовый видеофайл.

После генерации проверьте четыре вещи: совпадает ли объект с исходником, сохранилось ли движение из запроса, выдержаны ли длительность и формат, не появились ли запрещённые или случайные детали. Только такой просмотр показывает, что вы получили нужное видео, а не просто красивую вариацию фотографии.

Если нужен не image-to-video, а разбор уже снятого ролика или помощь с камерой и сценарием, подойдёт отдельный материал о работе ChatGPT с готовым видео. А для плана будущего ролика полезнее подготовить сценарий с ChatGPT. Это соседние задачи: сценарий задаёт последовательность кадров, а image-to-video оживляет один исходный кадр.

Источники

Есть следующая задача?Ещё по теме «Видео и сценарии» →