ChatGPT Image 2: как создать изображение в ChatGPT и через API

В этой статье

Запрос «chatgpt image 2» звучит так, будто речь идёт об одной кнопке или отдельной версии ChatGPT. На практике в нём часто смешиваются два маршрута: создание картинки в интерфейсе ChatGPT Images и генерация через API с моделью gpt-image-2. Это соседние сценарии с разными входами и результатом, поэтому сначала стоит выбрать, где вам удобнее работать.

Что означает ChatGPT Image 2

Если нужен результат без кода — откройте раздел Images в ChatGPT или прямо попросите чат создать изображение. Опишите сцену обычными словами, при необходимости уточните формат, а после генерации попросите изменить отдельную деталь. Готовую картинку можно сохранить на устройство. Такой пользовательский маршрут описан в справке OpenAI: Images in ChatGPT.

В ChatGPT Images не нужно вручную выбирать API-модель gpt-image-2. Название из поискового запроса не означает, что в интерфейсе есть переключатель с таким именем. Если же вы пишете приложение, автоматизируете генерацию или хотите передавать запросы программно, тогда нужен API-маршрут и модель, указанная в запросе к API.

ChatGPT Images доступен на всех тарифах, включая бесплатный, но для генерации действуют отдельные лимиты. Их параметры и доступность элементов интерфейса могут меняться, поэтому не стоит ориентироваться на фиксированное число картинок без проверки текущей справки OpenAI (Images in ChatGPT, ChatGPT Free Tier FAQ).

Вариант без кода: создать картинку в ChatGPT

Для примера возьмём простую задачу: квадратная иллюстрация рабочего стола с красной чашкой, блокнотом и боковым светом. Здесь важен не сам предметный набор, а понятная проверка: видно ли главный объект, не потерялась ли композиция и можно ли использовать сохранённый файл.

Исходные данные:

  • формат — квадратный;
  • главный объект — красная керамическая чашка;
  • дополнительные предметы — закрытый блокнот и спокойная поверхность стола;
  • свет — сбоку, с мягкой тенью;
  • настроение — аккуратная рабочая сцена без пёстрого фона.

В чате можно использовать такой промпт:

Создай квадратную реалистичную иллюстрацию рабочего стола: в центре красная керамическая чашка, рядом закрытый блокнот. Мягкий свет падает сбоку и образует заметную, но не жёсткую тень. Оставь спокойный нейтральный фон, чтобы внимание оставалось на чашке и блокноте. Без лишних предметов и без текста.

После генерации не спешите просить «сделать красивее» — это слишком расплывчатая команда. Лучше менять одну причину за раз: «сделай чашку немного левее», «усиль боковой свет», «убери лишний предмет на заднем плане». Так проще понять, какое изменение действительно улучшило кадр.

Если нужен определённый размер, назовите его в запросе или выберите доступный формат в интерфейсе. Затем сохраните итоговый файл и откройте его отдельно: миниатюра в чате не заменяет проверку самого изображения. В учебном сценарии выше результат фактически не запускался, поэтому этот пример показывает способ постановки задачи, а не измеренное качество генерации.

После бесплатной инструкции может понадобиться уже не картинка в чате, а оплачиваемый доступ к цифровому сервису. Для читателя из России есть каталог Amber Market, где можно посмотреть доступные подписки и цифровые товары. Перед заказом проверьте наличие и итоговые условия; по подтверждённым условиям магазина оплата выполняется через СБП, автоматических списаний нет. Каталог не выдаёт API-ключ, не включает автоматически gpt-image-2 и не обещает безлимитную генерацию — это отдельный вариант оплаты цифрового доступа, если он нужен именно вам.

Вариант с кодом: запрос к API

В API используется модель gpt-image-2 и endpoint /v1/images/generations. Официальное описание модели также указывает endpoint для редактирования /v1/images/edits; ниже нужен только маршрут генерации с нуля: GPT-Image-2 Model.

Перед запуском подготовьте два исходных элемента:

  • ключ API хранится в переменной окружения OPENAI_API_KEY, а не в исходном коде;
  • имя, под которым программа сохранит результат, например desk-red-cup.png.

Минимальный пример на JavaScript может выглядеть так:

import { writeFile } from "node:fs/promises";

const response = await fetch("https://api.openai.com/v1/images/generations", {
  method: "POST",
  headers: {
    "Content-Type": "application/json",
    Authorization: `Bearer ${process.env.OPENAI_API_KEY}`,
  },
  body: JSON.stringify({
    model: "gpt-image-2",
    prompt:
      "Square illustration of a tidy desk with a red ceramic cup and a closed notebook. Soft side lighting, gentle shadow, neutral uncluttered background, no text.",
    size: "1024x1024",
    quality: "medium",
    output_format: "png",
  }),
});

if (!response.ok) {
  throw new Error(`Image request failed: ${response.status}`);
}

const data = await response.json();
const imageBase64 = data.data?.[0]?.b64_json;

if (!imageBase64) {
  throw new Error("The response does not contain an image");
}

await writeFile("desk-red-cup.png", Buffer.from(imageBase64, "base64"));
console.log("Image saved as desk-red-cup.png");

В примере намеренно нет реального ключа. Значения size, quality и output_format показаны как параметры запроса, а перед запуском их нужно сверить с актуальной документацией и ограничениями аккаунта. API-модели изображений возвращают картинку в base64; код декодирует её и записывает как файл. Описание метода генерации находится в справке Create image.

Как проверить результат

Проверка должна отвечать не на вопрос «выглядит ли картинка эффектно», а на вопрос «выполнена ли задача». Откройте сохранённый файл и пройдите короткий список:

  1. Главный объект — красная чашка действительно находится в центре внимания, а не исчезла за блокнотом или тенью.
  2. Надписи — в исходном задании текста нет; если модель добавила случайные буквы на блокнот или фон, это дефект результата.
  3. Композиция — чашка, блокнот и боковой свет читаются вместе, края объектов не обрезаны случайно.
  4. Формат — файл квадратный и соответствует выбранному размеру.
  5. Сохранение — файл открывается после загрузки и имеет ожидаемый формат PNG.

Если проверка не пройдена, исправляйте промпт или запрос точечно. Например, отдельно уточните положение чашки, запретите любые надписи или измените силу бокового света. Не называйте учебный пример тестом качества модели: без фактического запуска он показывает последовательность действий, но не подтверждает конкретный результат.

Итак, ChatGPT Images подходит для ручного создания и уточнения картинки в интерфейсе. gpt-image-2 через /v1/images/generations — маршрут для программного запроса с ключом в окружении, параметрами и последующим сохранением base64-ответа. Выбирайте путь по задаче, а не по похожему названию в поисковой строке.

Источники

Есть следующая задача?Ещё по теме «Создание изображений» →