В этой статье
DAN — название ролевого jailbreak-промпта и его вариантов. Английское Do Anything Now можно перевести как «делай что угодно прямо сейчас». Автор такого запроса предлагает ChatGPT изображать персонажа, который якобы свободен от обычных правил. Это текстовая инструкция в разговоре, а не отдельная модель, которую устанавливают на компьютер.
Исследователи описали исходный DAN и близкие варианты как группу Basic: её приём — назначить модели другую роль и повторять, что персонаж не обязан соблюдать заданные правила. Исследование Shen и соавторов, раздел Trending Communities
Что пытается изменить DAN
Обычная ролевая инструкция задаёт способ объяснения: например, «будь редактором и сократи письмо». DAN использует роль для попытки изменить границы допустимого ответа. Утверждение внутри промпта о новых полномочиях само по себе не подтверждает, что такие полномочия появились.
В исследовании встречаются и соседние приёмы: выдуманный режим разработчика, требование отвечать обязательно и даже придумывать ответ при незнании. Авторы рассматривают их как атаки через запросы, а не как функции продукта. Описание стратегий
Надпись «режим включён» остаётся текстом ответа модели. Чтобы проверить реальное изменение, нужен наблюдаемый результат конкретной задачи.
Работает ли DAN сейчас
По одному старому скриншоту это определить нельзя. Нужны дата, модель, точный запрос и критерий успеха. Результат для одной версии не доказывает действие того же текста в другой.
Например, в опубликованной 27 августа 2025 года оценке OpenAI старые приёмы DAN/dev-mode в основном не срабатывали против исследованных Sonnet 4 и Opus 4. Это вывод об определённых моделях и наборе тестов, а не гарантия для любого чат-бота. Авторы также отмечают ограничения автоматической оценки. Раздел StrongREJECT в отчёте OpenAI
В этой статье актуальный DAN-промпт не испытывался. Здесь разобраны значение термина и способ оценивать обещания вокруг него.
Пример: нужен более прямой ответ
Допустим, вы ищете DAN, потому что ответы на рабочие вопросы слишком длинные. Сформулируйте желаемое поведение прямо. Учебный запрос:
Помоги выбрать формулировку письма коллеге. Пиши коротко и прямо, без вступления. Исходные данные: макет обещан в четверг, сегодня пятница, срок печати неизвестен. Дай один вариант письма до 60 слов. Попроси назвать новый срок макета. Не придумывай причину задержки и не обвиняй коллегу.
Ожидаемый результат — короткое письмо с вопросом о сроке. Проверьте, что текст не превращает неизвестный срок печати в установленный дедлайн и не приписывает коллеге мотивы. Так вы проверите, решена ли задача, а не только согласилась ли модель играть новую роль.
Если нужен творческий характер, задайте его отдельно: «Пиши как ворчливый, но доброжелательный библиотекарь; придумай три названия клуба чтения». После ответа оцените названия и тон. Такая заготовка не требует обещаний «ответить на всё».
Больше способов задать результат, контекст и формат — в руководстве о том, как составлять промпты.
Как читать обещания «DAN без ограничений»
Перед использованием чужой заготовки отделите её название от доказательств:
- Что именно обещано: иной тон, ответ на конкретный вопрос или доступ к функции?
- Указаны ли модель и дата проверки?
- Показан ли полный результат, который можно оценить, или только фраза о включении режима?
- Сохранилась ли точность ответа, особенно если текст требует всегда что-нибудь придумать?
Для собственной проверки выберите безобидную задачу с ясными условиями, как письмо выше. Сравните прямой запрос с предлагаемой заготовкой по тем же критериям: факты, длина, тон и полезность. Уверенный ответ с выдуманным сроком остаётся ошибкой, как бы ни назывался его персонаж.
Проверить детали
Источники материала
- Do Anything Now: Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language ModelsXinyue Shen et al., arXiv
- Findings from a pilot Anthropic–OpenAI alignment evaluation exercise: OpenAI Safety TestsOpenAI
Функции и условия сервисов меняются. Дата сверки указана в начале статьи. Как подготовлен материал