Почему ИИ отказывается выполнять запрос — и как переформулировать без обмана

Спрашиваешь: «как убить процесс, который занял порт 3000?» — и получаешь вежливую лекцию о том, что насилие неприемлемо.
Ты не сделал ничего запрещённого. Ты просто употребил слово «убить».
И это не редкий курьёз. Исследователи специально собирают наборы безобидных запросов, которые модели отклоняют: в одном таком наборе 250 заведомо безопасных промптов, в другом — 80 000. Явление даже назвали: преувеличенная осторожность.
Разберём три причины, по которым тебе отказывают, — от самой частой к самой неочевидной.
Причина 1. Сработало слово, а не смысл
Самая частая — и самая обидная.
Модель учат отказываться на примерах: опасный запрос — отказ, опасный запрос — отказ. Но вместе с опасным смыслом она запоминает и опасные слова. В работе 2026 года это разобрали прямо: выравнивание учит модель ловить лингвистические зацепки, и среди них оказываются совершенно безобидные. Дальше зацепка срабатывает на твоём «убить процесс», «взломать свой роутер», «отравить кэш», «атака на форму».
Как проверить. Замени подозрительное слово на нейтральный синоним и отправь тот же запрос ещё раз. «Останови процесс на порту 3000». Если ответ пришёл — дело было в слове, а не в тебе.
Как починить. Пиши то, что тебе нужно, техническим языком: не «убить», а «завершить процесс»; не «взломать», а «восстановить доступ»; не «яд», а «некорректные данные в кэше». Ты не обманываешь модель — ты убираешь ложную зацепку. Смысл запроса не меняется ни на грамм.
Причина 2. Модель не знает, что объект твой
Второй случай: слова нормальные, а картина запроса выглядит подозрительно. «Как получить доступ к аккаунту без пароля» — это может быть и взлом, и восстановление собственной почты. Модель не телепат и по умолчанию читает запрос в худшем сценарии.
Как проверить. Добавь одно предложение: кто ты, что это за объект и зачем тебе результат. «Это мой сервер, я админ, восстанавливаю доступ после потери ключа».
Как починить. Держи в запросе три вещи: роль (кто ты), принадлежность (чей объект) и цель (что дальше сделаешь с ответом). Это и есть обычная работа с контекстом — тот же приём, что и в хорошем промпте, просто здесь он снимает подозрение, а не уточняет задачу.
Причина 3. Отказала не модель, а фильтр вокруг неё
Самая неочевидная причина. Отказ может прийти не от модели, а от проверки, которая стоит до или после неё: модерация провайдера, ограждение в приложении, системный промпт продукта, которым ты пользуешься.
Как проверить. Смотри на форму отказа:
- Мгновенный, одинаковый, шаблонный текст без объяснения — почти наверняка внешний фильтр. Модель до запроса даже не добралась.
- Развёрнутый ответ в её обычном тоне, с объяснением и предложением альтернативы — это решение самой модели.
- Ответ начал печататься и оборвался на середине — сработала проверка выхода.
Второй способ проверить: отправь тот же запрос в другом месте. Если в API проходит, а в приложении нет — фильтр стоит в приложении.
Как починить. Переформулировка тут не поможет — фильтр не читает твои намерения. Помогает другой канал: другая модель, другой провайдер, прямой вызов API вместо чужой обёртки. А если приложение твоё — иди чинить собственный порог модерации и системный промпт, а не промпт пользователя.
Бонусная причина: диалог просто накопил лишнего
Если ты полчаса обсуждал безопасность, взломы и уязвимости, а потом попросил что-то невинное — вероятность отказа выше. Проверки 2026 года на многоходовых сценариях показывают: в длинном диалоге ложные отказы случаются заметно чаще, чем на одиночном вопросе. Контекст накапливается, и запрос читается на фоне всего разговора.
Лечится тривиально: открой новый чат и задай вопрос с нуля.
Чего делать не надо
Не пытайся уговорить модель ролевыми играми и «представь, что ты…». Во-первых, это работает всё хуже. Во-вторых — и это важнее — если запрос действительно запрещённый, правильный ответ на него «нет», и обход правил превращается в джейлбрейк, а это уже другая история и другая ответственность.
Полезное правило: если ты не можешь одним предложением объяснить, зачем тебе результат и чей это объект, — возможно, отказ по делу. А если можешь — просто напиши это предложение в запрос.
Почему один и тот же запрос то проходит, то нет?
Потому что модель не выдаёт один и тот же ответ дважды: она каждый раз выбирает слова с элементом случайности. Пограничный запрос стоит ровно на краю — и попадает то в одну сторону, то в другую. За разброс отвечает температура; в чат-интерфейсе ты её не видишь, поэтому иногда достаточно просто нажать «повторить».
Значит, модель считает меня подозрительным?
Нет. У неё нет мнения о тебе и нет памяти о прошлых запросах между чатами. Отказ — это реакция на текст, который сейчас перед ней, а не оценка твоей личности. Никакого «личного дела» не заводится: в новом чате ты для неё абсолютно новый собеседник.
Короткие уроки-истории, симулятор агента и ежедневная практика — в нашем мобильном приложении. Бесплатно.





