Сколько стоит OpenAI API: цены токенов и примеры расчёта

В этой статье

У OpenAI API нет единой цены за вопрос: расход зависит от модели, объёма входа и выхода, обработки кэша и дополнительных инструментов. Подписка ChatGPT Plus не оплачивает API — биллинг отдельный. Условия Plus.

Ниже — ставки прямого API OpenAI в долларах США, проверенные 10 сентября 2026 года, и учебные расчёты. Это не тариф стороннего бота и не фактический счёт аккаунта. Примеры относятся к текстовым запросам без платных инструментов и дополнительных региональных начислений.

Тарифы за миллион токенов

В таблице приведён режим Standard, категория Short context официального прайса. Вход, чтение кэша, запись кэша и выход оплачиваются по разным ставкам.

Модель Обычный вход Вход из кэша Запись в кэш Выход
GPT-5.6 Luna $0,20 $0,02 $0,25 $1,20
GPT-5.6 Terra $2,00 $0,20 $2,50 $12,00
GPT-5.6 Sol $4,00 $0,40 $5,00 $20,00
GPT-6 Astra $10,00 $1,00 $12,50 $50,00

Все суммы — за 1 000 000 токенов соответствующей категории. Для Sol в прайсе указаны промоусловия как минимум до 21 ноября 2026 года. У Batch, Flex, Fast mode и длинного контекста другие строки цен; для некоторых региональных адресов API действует надбавка. Официальный прайс API.

Например, для Luna при входе свыше 272 тысяч токенов ставки повышаются для всего запроса: вход вдвое, выход в полтора раза. Поэтому цену короткого запроса нельзя применять к очень большому документу без проверки условий модели. Карточка Luna.

Как посчитать один запрос без кэша

Возьмите из учёта API число входных и выходных токенов. Для случая без чтения и записи кэша:

Стоимость = входные токены × ставка входа / 1 000 000
          + выходные токены × ставка выхода / 1 000 000

Учебный пример для Luna: 400 входных токенов и 100 выходных, Standard, короткий контекст, кэш не использован.

  • Вход: 400 × $0,20 / 1 000 000 = $0,00008.
  • Выход: 100 × $1,20 / 1 000 000 = $0,00012.
  • Всего: $0,00020 за запрос.

Десять тысяч таких запросов обойдутся в $2 за указанное потребление токенов. Это расчёт при одинаковом объёме каждого запроса. Если половина ответов окажется длиннее, сумма изменится.

Не округляйте стоимость одного запроса до цента перед умножением: $0,00020 превратится в ноль, и прогноз потеряет смысл. Сначала суммируйте расход, затем округляйте итог для отображения.

Как учитывать кэш без двойного начисления

Для GPT-5.6 и более новых моделей запись кэша имеет отдельную цену. Она не равна дешёвому чтению уже сохранённого входа. В документации используются поля input_tokens, cached_tokens и cache_write_tokens. Обычный вход — это общий вход за вычетом чтения и записи кэша. Учёт кэширования.

Обычный вход = input_tokens − cached_tokens − cache_write_tokens

Стоимость входа = (обычный вход × ставка обычного входа
                  + cached_tokens × ставка чтения кэша
                  + cache_write_tokens × ставка записи кэша) / 1 000 000

Предположим, у запроса Luna общий вход 3000 токенов, из них 2048 прочитаны из кэша, запись равна нулю. Выход — 400 токенов. Тогда обычный вход составляет 952 токена:

Часть расхода Расчёт Стоимость
Обычный вход 952 × $0,20 / 1 000 000 $0,00019040
Чтение кэша 2048 × $0,02 / 1 000 000 $0,00004096
Выход 400 × $1,20 / 1 000 000 $0,00048000
Итого Сумма трёх строк $0,00071136

Если те же 2048 токенов вместо чтения записываются в кэш, их стоимость составит $0,000512, а итог — $0,00118240. Это другой запрос с другими показателями использования. Нельзя назначить всем входным токенам цену кэша только потому, что в приложении повторяется часть текста.

Проверяйте фактические поля ответа. Если детали кэширования не записаны в ваш журнал, восстановить точную стоимость только по общему числу входных токенов не получится.

Почему видимый ответ может не объяснять весь расход

У моделей с рассуждением есть reasoning tokens: они оплачиваются как выходные, хотя не показываются обычным текстом ответа. Для контроля используется output_tokens; детализацию рассуждения смотрите в output_tokens_details. Не прибавляйте её второй раз к уже учтённому выходу. Учёт токенов рассуждения.

Например, в учебном журнале указаны 400 выходных токенов, из которых 300 относятся к рассуждению. Для расчёта выхода берите 400. Вычитание рассуждений даст неверные 100, а повторное сложение — неверные 700.

Вызовы инструментов, изображения, аудио и видео проверяются по своим разделам прайса. Их нельзя включить в оценку, просто умножив длину текста ответа на текстовую ставку. Разделы тарификации.

Как оценить бюджет проекта

Сначала измерьте небольшой набор реальных задач: короткие, типичные и самые длинные. Для каждого вызова сохраните модель, режим обработки, вход, чтение и запись кэша, выход и использованные инструменты. Отдельно отмечайте повторные обращения: одно пользовательское действие может запускать несколько запросов.

Допустим, первый расчёт на десять тысяч вызовов дал $2, но в приложении каждая операция выполняет три таких вызова. При тех же объёмах токенов прогноз уже $6, даже если пользователь нажимает одну кнопку. Если дополнительные вызовы длиннее, пересчитайте каждый отдельно.

Сравнивайте модели на одинаковых задачах и считайте стоимость принятого результата. Дешёвый запрос, после которого приходится трижды переписывать ответ, может оказаться менее выгодным для вашего процесса. Универсальную экономию без такого измерения обещать нельзя.

Перед запуском сверьте дату прайса, модель, категорию контекста и режим обработки. Приведённые суммы — стоимость указанных токенов; итоговое списание проверяйте в биллинге своего API-аккаунта. Подписка чата и условия посредника не заменяют этот расчёт.

Проверить детали

Источники материала

Функции и условия сервисов меняются. Дата сверки указана в начале статьи. Как подготовлен материал

Есть следующая задача?Ещё по теме «Баланс и стоимость API» →