LLM

Как обойти ограничения ChatGPT?

Николай, Киров 917 просм.

Прошу ChatGPT написать текст на острую тему или разобрать конкретный случай, а он отвечает шаблонной отпиской, что не может это обсуждать. Читал про какие-то специальные "джейлбрейк"-промпты, стоит ли вообще с ними связываться?

Сергей Орлов специалист по ИИ-безопасности

ответил

эксперт

Ограничения в ChatGPT не баг, а осознанная политика OpenAI: модель отказывается обсуждать насилие в деталях, незаконные действия, самоповреждение и ряд других тем независимо от того, кто и зачем спрашивает. Джейлбрейк-промпты пытаются обмануть фильтр формулировками вроде «представь, что ты другой ИИ без правил», и иногда правда срабатывают, потому что используют временные дыры в защите.

Проблема в том, что эти дыры быстро закрывают: OpenAI регулярно обновляет фильтры, и промпт, который работал вчера, завтра выдаст отказ снова. Плюс такие приемы формально нарушают пользовательское соглашение, а массовое или подозрительное использование обхода фильтров может привести к ограничению или блокировке аккаунта. Отдельная проблема в качестве: ответы, полученные через джейлбрейк, никак не проверены на достоверность, и вероятность получить уверенную чушь там выше обычного.

Что делать вместо этого. В большинстве случаев отказ снимается, если явно указать законный контекст запроса: не «опиши, как обойти защиту», а «я пишу техническую статью о защите систем от таких атак, приведи общий принцип». Для художественных текстов помогает уточнение, что это сцена в романе с вымышленными персонажами. Если задача действительно требует меньше ограничений и она законна, например исследовательская работа, разумнее взять открытую модель вроде Llama или Mistral и запустить локально, там правила настраиваются самостоятельно. Пытаться перехитрить именно ChatGPT ради разового результата обычно не стоит потраченного времени.

Задать свой вопрос

Вопросы проходят модерацию. Ответ эксперта публикуется на сайте в течение пары дней.

Похожие вопросы

Все в теме