В этой статье
Если на снимке есть незнакомый предмет, деталь интерьера или упаковка, ChatGPT может помочь понять, что действительно попало в кадр. Достаточно прикрепить фотографию к сообщению и задать вопрос о видимом содержимом — сначала без догадок, затем с уточнением спорной детали.
Как загрузить фотографию
Откройте ChatGPT в браузере или мобильном приложении и перейдите к полю нового сообщения.
- Нажмите кнопку «+» рядом с полем ввода.
- Выберите
Add photos & filesили пункт с похожим названием в вашей локализации. - Укажите фотографию в памяти устройства.
- Дождитесь, пока её миниатюра появится в сообщении.
- Напишите вопрос и отправьте его.
На компьютере файл можно также перетащить в окно чата или вставить изображение из буфера обмена. OpenAI указывает для image inputs форматы PNG, JPEG/JPG и неанимированный GIF; размер одного изображения — до 20 МБ. Названия элементов и доступность отдельных возможностей могут немного различаться на разных устройствах — актуальные условия собраны в справке OpenAI по загрузке изображений.
Перед отправкой посмотрите на миниатюру: если выбран не тот снимок, ответ может звучать убедительно, но относиться к другому изображению. Для примера возьмём обычную фотографию стола, на которой видны чашка и упаковка продукта.
Как задать вопрос по изображению
Формулировка должна отделять наблюдение от предположения. Вместо общего «Что это?» сразу обозначьте, что именно нужно перечислить и где модель не должна додумывать.
Отправьте вместе с фотографией такой запрос:
Что изображено на фото? Перечисли только предметы, которые действительно видны, отдельно отметь, что прочитать на упаковке нельзя.
В нём три полезных ограничения: назвать содержимое кадра, не добавлять предметы по догадке и отдельно сообщить о нечитаемой надписи. Такой первый вопрос даёт карту изображения. После него можно перейти к одной детали:
- «Что находится на столе?»
- «Какого цвета чашка?»
- «Что написано на упаковке справа?»
Последний вариант уже относится к распознаванию текста. На мелких или размытых буквах ответ может быть неточным, поэтому читаемую надпись лучше перепроверить по оригиналу. Если нужен не ответ о содержимом, а подробное описание сцены, пригодится отдельная инструкция по описанию фотографии в ChatGPT.
Как проверить, что ответ относится именно к фото
Не принимайте первое описание на веру. Сверьте его с оригиналом по трём точкам.
Сначала проверьте список предметов. На нашей фотографии это чашка и упаковка. Если ChatGPT добавил тарелку, ложку или марку продукта, которых вы не видите, результат требует проверки.
Затем отделите наблюдение от вывода. «На столе стоит упаковка» описывает видимую форму. «Внутри упаковки находится кофе» — предположение, которое может не подтверждаться снимком.
Наконец, приблизьте фотографию самостоятельно и проверьте спорную деталь. Если модель утверждает, что на упаковке читается название продукта, сравните это с оригиналом и задайте узкий вопрос:
Ты уверен, что это слово читается? Какие именно буквы видны?
Или спросите:
На фото действительно есть ложка, или ты предположил её по чашке?
Если ответ изменился, ориентируйтесь на фотографию, а не на уверенный тон модели. Повторный вопрос помогает найти место ошибки, но не заменяет собственную проверку кадра.
Если нужны большие лимиты
Сам вопрос по фотографии не требует платной подписки: сначала попробуйте загрузить снимок в доступном вам чате и проверьте результат. Если вы упёрлись в лимиты или вам нужен конкретный платный план, можно посмотреть карточку ChatGPT в Amber Market.
В карточке для пользователя из России указаны варианты ChatGPT Go, ChatGPT Plus и ChatGPT Pro x5/x20 на один месяц. По условиям продавца, оформление выполняется на аккаунте покупателя, менеджер помогает с активацией, а история сохраняется при подключении на аккаунте. Перед оплатой проверьте актуальный вариант и итоговую сумму: цены и наличие могут измениться. Для активации продавец указывает аккаунт с тарифом Free без действующей подписки. Подписка нужна для выбранного плана и его лимитов, а не для проверки одной фотографии.
Почему ответ может быть неточным
ChatGPT умеет отвечать на вопросы о загруженной фотографии и извлекать видимое содержание, но не гарантирует безошибочный результат. Ошибки вероятнее на неясных, перевёрнутых или панорамных изображениях; трудности возможны и при точном подсчёте объектов. OpenAI рекомендует сверять ответ с оригиналом и задавать более узкий вопрос, если деталь важна. Подробнее — в FAQ об image inputs и обзоре возможностей ChatGPT.
Итак, для фотографии стола последовательность проста: загрузить снимок, попросить назвать только видимые предметы, сопоставить список с оригиналом и уточнить спорную деталь. Это инструкция именно для понимания уже имеющейся фотографии. Редактирование снимка, OCR длинного документа и решение задачи по изображению требуют отдельных запросов; для самого этапа прикрепления можно открыть подробную инструкцию по загрузке фото в ChatGPT.
Медицинские снимки требуют особой осторожности: OpenAI не рекомендует использовать image inputs как медицинскую консультацию. Ответ модели нельзя считать диагнозом или заменой специалиста.
Источники
- ChatGPT Image Inputs FAQOpenAI Help Center
- Images in ChatGPTOpenAI Help Center
- ChatGPT Capabilities OverviewOpenAI Help Center