В этой статье
Запрос «ChatGPT локально» может означать разные вещи. Одному нужен ChatGPT в отдельном окне, другому — модель, которая запускается на собственном компьютере и не отправляет каждый запрос в облачный сервис.
Это важное различие. Официальное desktop-приложение ChatGPT — интерфейс доступа к облачному сервису. Оно не является копией модели на вашем диске и само по себе не гарантирует полноценную работу без интернета: возможности зависят от подключения и доступности сервиса. Описание приложения есть в справке OpenAI.
Поэтому короткий ответ такой: именно ChatGPT как облачный продукт нельзя просто скачать и превратить в полностью локальную офлайн-программу. Но на своём компьютере можно запустить отдельные модели OpenAI с открытыми весами — gpt-oss.
Что выбрать в зависимости от задачи
Если вам нужен привычный диалог, история чатов и готовые возможности ChatGPT, выбирайте сам ChatGPT — через веб-версию или официальное desktop-приложение. Это облачный сценарий: вычисления выполняются на стороне сервиса, а приложение служит точкой доступа.
Если принципиально важно запускать модель на своей инфраструктуре, смотрите в сторону gpt-oss. Это отдельные модели OpenAI с открытыми весами: gpt-oss-20b и gpt-oss-120b. Их можно разворачивать с помощью поддерживаемого локального runtime, например Ollama, vLLM, llama.cpp или LM Studio. OpenAI описывает этот вариант в материале об открытых моделях. Общую разницу между локальной моделью, ChatGPT и API можно держать под рукой в обзоре локального запуска моделей OpenAI.
Если же вы хотите встроить возможности модели в собственную программу, бота или внутренний сервис, обычно подходит OpenAI API. Это облачная интеграция, а не локальный запуск: приложение обращается к API по сети, а модель работает на инфраструктуре провайдера.
Удобно держать развилку в голове так:
- готовый разговор с ChatGPT — ChatGPT;
- модель на своём компьютере или сервере — gpt-oss через локальный runtime;
- подключение AI к своему приложению — облачный OpenAI API.
Являются ли gpt-oss офлайн-версией ChatGPT
Нет. gpt-oss-20b и gpt-oss-120b — самостоятельные модели, а не скрытый локальный режим ChatGPT. Они не доступны внутри ChatGPT и не предоставляются через OpenAI API. Это прямо оговорено в справке OpenAI о gpt-oss.
У такого различия есть практическое значение. Интерфейс, функции, настройки и поведение локального запуска зависят от выбранного runtime и его окружения. Нельзя ожидать, что установка gpt-oss автоматически даст тот же пользовательский опыт, что и ChatGPT: с теми же инструментами, историей, ограничениями и обновлениями.
Локальный запуск также не означает автоматически полную приватность. Запросы могут оставаться на компьютере, но многое зависит от самого runtime, подключённых инструментов, журналов, обновлений и того, не отправляет ли выбранная оболочка данные внешнему сервису. Перед работой с чувствительными текстами стоит проверить настройки конкретного решения.
Какие модели OpenAI можно запустить у себя
OpenAI указывает две модели с открытыми весами:
- gpt-oss-20b — более лёгкий вариант для совместимого оборудования;
- gpt-oss-120b — значительно более крупная модель, требующая заметно больше ресурсов.
В официальных материалах приводятся ориентиры порядка 16 ГБ памяти для 20B и 80 ГБ для 120B. Это не универсальные минимальные требования: результат зависит от runtime, квантования, типа памяти и возможности переноса части вычислений на другие устройства (offload). Даже компьютер, который формально подходит по объёму памяти, может работать медленно или потребовать дополнительной настройки. Ориентиры и особенности запуска собраны в материале OpenAI о gpt-oss.
Поэтому выбирать модель только по числу параметров не стоит. Для первого знакомства разумнее сверить документацию выбранного runtime с вашей видеопамятью, оперативной памятью и операционной системой. Например, OpenAI показывает сценарий запуска через Ollama, а список поддерживаемых вариантов включает также vLLM, llama.cpp и LM Studio.
Подробное сравнение двух моделей и аппаратных требований лучше оставить отдельному разбору gpt-oss-20b и gpt-oss-120b: здесь достаточно понять, что локальность требует подходящей конфигурации, а не только скачивания файла.
Как выглядит первый запуск
Общий порядок выглядит так: вы выбираете runtime, устанавливаете его, загружаете подходящую модель и открываете локальный интерфейс или endpoint, через который отправляются запросы. Дальше runtime отвечает за хранение весов, использование памяти и формат общения с моделью.
На этом шаге полезно заранее проверить четыре вещи:
- хватает ли компьютеру памяти для выбранного варианта;
- поддерживает ли ваша система нужный runtime;
- потребуется ли интернет только для первоначальной загрузки модели и обновлений;
- где сохраняются запросы и журналы работы.
После загрузки модель может работать без постоянного обращения к облачному API, но это не следует понимать как гарантию одинаковой скорости на любом компьютере. Время ответа зависит от оборудования, размера модели, квантования и настроек запуска. Если модель не помещается целиком в подходящую память, offload может помочь запустить её, но часто меняет производительность.
Подключение локальной модели к Python через совместимый API — следующий этап после успешного запуска; подробности собраны в отдельном материале про gpt-oss, Python и Ollama.
Что делать, если нужен именно ChatGPT
Сначала определите, нужна ли вам локальность как таковая. Если вы просто хотите пользоваться ChatGPT в отдельном окне, установите официальное desktop-приложение и учитывайте, что это доступ к облачному сервису, а не офлайн-копия модели.
Если нужен ChatGPT именно как готовый облачный сервис, а вопрос упирается в оплату из России, можно отдельно посмотреть каталог оплаты зарубежных сервисов Amber Market. Это не официальный сайт OpenAI, не способ установить ChatGPT локально и не замена документации OpenAI. Наличие нужного сервиса, условия и итоговую стоимость проверяют на его карточке; оплату можно провести через СБП по подтверждённым условиям каталога.
Если же главная цель — запускать модель у себя и работать с ней без постоянного облачного сеанса, изучайте gpt-oss и требования конкретного runtime. Так вы получите локальную модель OpenAI с открытыми весами, но не локальную копию ChatGPT.
Итак, слово «локально» здесь скрывает выбор между интерфейсом, моделью и способом интеграции. Desktop-приложение делает доступ к ChatGPT удобнее, gpt-oss переносит запуск модели на вашу инфраструктуру, а API соединяет ваше приложение с облачной моделью. От этого выбора зависят интернет, требования к памяти, приватность и дальнейшие шаги.
Источники
- Открытые модели от OpenAIOpenAI
- Модели OpenAI с открытыми весами (gpt-oss)OpenAI Help Center
- Представляем gpt-ossOpenAI
- How to run gpt-oss locally with OllamaOpenAI Cookbook
- Moving to the new ChatGPT desktop appOpenAI Help Center
- Каталог оплаты зарубежных сервисов Amber MarketAmber Market