ChatGPT локально: можно ли запустить на компьютере без интернета

В этой статье

Запрос «ChatGPT локально» может означать разные вещи. Одному нужен ChatGPT в отдельном окне, другому — модель, которая запускается на собственном компьютере и не отправляет каждый запрос в облачный сервис.

Это важное различие. Официальное desktop-приложение ChatGPT — интерфейс доступа к облачному сервису. Оно не является копией модели на вашем диске и само по себе не гарантирует полноценную работу без интернета: возможности зависят от подключения и доступности сервиса. Описание приложения есть в справке OpenAI.

Поэтому короткий ответ такой: именно ChatGPT как облачный продукт нельзя просто скачать и превратить в полностью локальную офлайн-программу. Но на своём компьютере можно запустить отдельные модели OpenAI с открытыми весами — gpt-oss.

Что выбрать в зависимости от задачи

Если вам нужен привычный диалог, история чатов и готовые возможности ChatGPT, выбирайте сам ChatGPT — через веб-версию или официальное desktop-приложение. Это облачный сценарий: вычисления выполняются на стороне сервиса, а приложение служит точкой доступа.

Если принципиально важно запускать модель на своей инфраструктуре, смотрите в сторону gpt-oss. Это отдельные модели OpenAI с открытыми весами: gpt-oss-20b и gpt-oss-120b. Их можно разворачивать с помощью поддерживаемого локального runtime, например Ollama, vLLM, llama.cpp или LM Studio. OpenAI описывает этот вариант в материале об открытых моделях. Общую разницу между локальной моделью, ChatGPT и API можно держать под рукой в обзоре локального запуска моделей OpenAI.

Если же вы хотите встроить возможности модели в собственную программу, бота или внутренний сервис, обычно подходит OpenAI API. Это облачная интеграция, а не локальный запуск: приложение обращается к API по сети, а модель работает на инфраструктуре провайдера.

Удобно держать развилку в голове так:

  • готовый разговор с ChatGPT — ChatGPT;
  • модель на своём компьютере или сервере — gpt-oss через локальный runtime;
  • подключение AI к своему приложению — облачный OpenAI API.

Являются ли gpt-oss офлайн-версией ChatGPT

Нет. gpt-oss-20b и gpt-oss-120b — самостоятельные модели, а не скрытый локальный режим ChatGPT. Они не доступны внутри ChatGPT и не предоставляются через OpenAI API. Это прямо оговорено в справке OpenAI о gpt-oss.

У такого различия есть практическое значение. Интерфейс, функции, настройки и поведение локального запуска зависят от выбранного runtime и его окружения. Нельзя ожидать, что установка gpt-oss автоматически даст тот же пользовательский опыт, что и ChatGPT: с теми же инструментами, историей, ограничениями и обновлениями.

Локальный запуск также не означает автоматически полную приватность. Запросы могут оставаться на компьютере, но многое зависит от самого runtime, подключённых инструментов, журналов, обновлений и того, не отправляет ли выбранная оболочка данные внешнему сервису. Перед работой с чувствительными текстами стоит проверить настройки конкретного решения.

Какие модели OpenAI можно запустить у себя

OpenAI указывает две модели с открытыми весами:

  • gpt-oss-20b — более лёгкий вариант для совместимого оборудования;
  • gpt-oss-120b — значительно более крупная модель, требующая заметно больше ресурсов.

В официальных материалах приводятся ориентиры порядка 16 ГБ памяти для 20B и 80 ГБ для 120B. Это не универсальные минимальные требования: результат зависит от runtime, квантования, типа памяти и возможности переноса части вычислений на другие устройства (offload). Даже компьютер, который формально подходит по объёму памяти, может работать медленно или потребовать дополнительной настройки. Ориентиры и особенности запуска собраны в материале OpenAI о gpt-oss.

Поэтому выбирать модель только по числу параметров не стоит. Для первого знакомства разумнее сверить документацию выбранного runtime с вашей видеопамятью, оперативной памятью и операционной системой. Например, OpenAI показывает сценарий запуска через Ollama, а список поддерживаемых вариантов включает также vLLM, llama.cpp и LM Studio.

Подробное сравнение двух моделей и аппаратных требований лучше оставить отдельному разбору gpt-oss-20b и gpt-oss-120b: здесь достаточно понять, что локальность требует подходящей конфигурации, а не только скачивания файла.

Как выглядит первый запуск

Общий порядок выглядит так: вы выбираете runtime, устанавливаете его, загружаете подходящую модель и открываете локальный интерфейс или endpoint, через который отправляются запросы. Дальше runtime отвечает за хранение весов, использование памяти и формат общения с моделью.

На этом шаге полезно заранее проверить четыре вещи:

  1. хватает ли компьютеру памяти для выбранного варианта;
  2. поддерживает ли ваша система нужный runtime;
  3. потребуется ли интернет только для первоначальной загрузки модели и обновлений;
  4. где сохраняются запросы и журналы работы.

После загрузки модель может работать без постоянного обращения к облачному API, но это не следует понимать как гарантию одинаковой скорости на любом компьютере. Время ответа зависит от оборудования, размера модели, квантования и настроек запуска. Если модель не помещается целиком в подходящую память, offload может помочь запустить её, но часто меняет производительность.

Подключение локальной модели к Python через совместимый API — следующий этап после успешного запуска; подробности собраны в отдельном материале про gpt-oss, Python и Ollama.

Что делать, если нужен именно ChatGPT

Сначала определите, нужна ли вам локальность как таковая. Если вы просто хотите пользоваться ChatGPT в отдельном окне, установите официальное desktop-приложение и учитывайте, что это доступ к облачному сервису, а не офлайн-копия модели.

Если нужен ChatGPT именно как готовый облачный сервис, а вопрос упирается в оплату из России, можно отдельно посмотреть каталог оплаты зарубежных сервисов Amber Market. Это не официальный сайт OpenAI, не способ установить ChatGPT локально и не замена документации OpenAI. Наличие нужного сервиса, условия и итоговую стоимость проверяют на его карточке; оплату можно провести через СБП по подтверждённым условиям каталога.

Если же главная цель — запускать модель у себя и работать с ней без постоянного облачного сеанса, изучайте gpt-oss и требования конкретного runtime. Так вы получите локальную модель OpenAI с открытыми весами, но не локальную копию ChatGPT.

Итак, слово «локально» здесь скрывает выбор между интерфейсом, моделью и способом интеграции. Desktop-приложение делает доступ к ChatGPT удобнее, gpt-oss переносит запуск модели на вашу инфраструктуру, а API соединяет ваше приложение с облачной моделью. От этого выбора зависят интернет, требования к памяти, приватность и дальнейшие шаги.

Источники

Есть следующая задача?Ещё по теме «Первые шаги» →