Как создать голос в ChatGPT: выбор и настройка

В этой статье

«Создать голос в ChatGPT» — это обычно не про запись собственного голоса. Чаще человек хочет включить разговор с ChatGPT и выбрать, как будет звучать ответ. Для этого не нужно загружать образец речи: в обычном интерфейсе ChatGPT выбирается один из готовых голосов.

Как включить голос в ChatGPT

Подготовьте три вещи: аккаунт ChatGPT, устройство с микрофоном и короткую фразу для проверки. Подойдёт, например: «Расскажи в двух предложениях, как ты понял мой вопрос».

Дальше последовательность такая:

  1. Откройте ChatGPT в браузере или запустите приложение на iPhone или Android.
  2. Найдите значок Voice в окне сообщения. На телефоне он находится в строке ввода, а на вебе — в поле запроса.
  3. Разрешите доступ к микрофону, когда браузер или приложение его запросит.
  4. При первом запуске выберите один из доступных готовых голосов.
  5. Произнесите короткую фразу и дождитесь ответа.

После этого в чате появится обычный разговор: вы говорите, ChatGPT отвечает голосом, а текст разговора можно посмотреть в том же чате. Названия и набор вариантов могут меняться, а доступность голосового режима зависит от аккаунта и версии приложения. Если кнопки Voice нет, проверьте, что приложение обновлено, и откройте настройки аккаунта. Последовательность запуска описана в справке OpenAI о ChatGPT Voice.

Например, исходные данные выглядят так: аккаунт ChatGPT, ноутбук с микрофоном и фраза «Объясни, чем голосовой режим отличается от диктовки». Ожидаемый результат простой: ChatGPT отвечает выбранным голосом, а текст разговора можно посмотреть в том же чате.

Если голосовой режим доступен, но прямой способ оплаты ChatGPT из России не подходит, можно отдельно проверить карточку ChatGPT в Amber Market. Там предлагают ChatGPT Go, Plus и Pro на один месяц с подключением вручную к аккаунту покупателя. Перед заказом проверьте выбранный план, итоговую стоимость и условия. Это подключение ChatGPT на вашем аккаунте, а не создание нового пользовательского голоса и не пополнение OpenAI API. Автоматическое продление из описания этой карточки также не следует.

Как выбрать или поменять голос

Первый выбранный голос не обязан становиться постоянным. Откройте Settings → Voice, затем найдите пункт выбора голоса и включите подходящий вариант. На телефоне и в браузере расположение элементов может немного отличаться; иногда смена доступна прямо из меню голосового режима.

Полезно выбирать не «самый красивый» голос, а тот, который не утомляет через десять минут. Для проверки задайте одну и ту же фразу, например:

«Прочитай этот ответ спокойно, без спешки, и сделай паузу перед последним предложением».

Послушайте темп, паузы и разборчивость. Если хочется другой подачи, повторите проверку с соседним вариантом. Не воспринимайте список как неизменный: доступные голоса и их описания могут обновляться.

Если сменить голос во время разговора, ChatGPT запускает новый голосовой вызов в том же чате. Это важная деталь: переписка не обязательно исчезает, но текущий голосовой сеанс заканчивается и начинается заново — такую возможность и результат смены описывают справка OpenAI о ChatGPT Voice и FAQ голосового режима. Подробный маршрут есть в инструкции как поменять голос в ChatGPT, а за полным разбором запуска и общения на русском можно обратиться к материалу как включить голосовой режим ChatGPT.

Голос, диктовка и расшифровка — не одно и то же

Здесь легко перепутать три похожих действия.

  • Voice — разговор туда и обратно: вы говорите, ChatGPT отвечает голосом.
  • Диктовка — вы записываете свой запрос, проверяете его расшифровку и отправляете текстом.
  • Преобразование записи в текст — задача получить текст из аудио, а не вести живой диалог.

Если нужно обсудить идею вслух, выбирайте Voice. Если вы хотите сначала отредактировать продиктованный запрос, удобнее диктовка. Смена языка, темпа или манеры ответа внутри разговора не создаёт новый голос — это только настройка текущего общения.

Можно ли создать собственный голос из образца

В обычном интерфейсе ChatGPT нельзя просто загрузить запись и сделать из неё личный голос для голосового режима. Готовые варианты в Settings → Voice — это выбор из доступного набора, а не конструктор голоса; это различие следует из описания ChatGPT Voice и FAQ голосового режима.

Если под «создать голос» имеется в виду голос для озвучки в собственном приложении, это уже отдельный сценарий OpenAI API. Для него нужны:

  1. аудиосэмпл — файл с образцом голоса;
  2. заранее загруженная запись согласия владельца голоса и её consent ID;
  3. имя нового голоса;
  4. доступ к функции для eligible customers и соблюдение требований к согласию.

Результат API-сценария проверяют иначе: должен появиться voice ID, после чего его используют при создании аудиовывода. Такая процедура относится к разработке через API, а не к настройке голосового режима в приложении ChatGPT. Подробные поля и методы описаны в документации OpenAI API по списку согласий для пользовательских голосов.

Итак, для разговора достаточно открыть Voice, разрешить микрофон и выбрать готовый вариант. Собственный голос из аудиозаписи — это уже API-доступ, отдельная проверка права на использование записи и другой результат. Эти два маршрута похожи только словом «голос».

Источники

Есть следующая задача?Ещё по теме «Голосовой режим» →