Гайды

Почему ИИ отказывается выполнять запрос — и как переформулировать без обмана

Иллюстрация: шлагбаум остановил тележку с обычной коробкой, соседняя проехала

Спрашиваешь: «как убить процесс, который занял порт 3000?» — и получаешь вежливую лекцию о том, что насилие неприемлемо.

Ты не сделал ничего запрещённого. Ты просто употребил слово «убить».

И это не редкий курьёз. Исследователи специально собирают наборы безобидных запросов, которые модели отклоняют: в одном таком наборе 250 заведомо безопасных промптов, в другом — 80 000. Явление даже назвали: преувеличенная осторожность.

Разберём три причины, по которым тебе отказывают, — от самой частой к самой неочевидной.

Причина 1. Сработало слово, а не смысл

Самая частая — и самая обидная.

Модель учат отказываться на примерах: опасный запрос — отказ, опасный запрос — отказ. Но вместе с опасным смыслом она запоминает и опасные слова. В работе 2026 года это разобрали прямо: выравнивание учит модель ловить лингвистические зацепки, и среди них оказываются совершенно безобидные. Дальше зацепка срабатывает на твоём «убить процесс», «взломать свой роутер», «отравить кэш», «атака на форму».

Как проверить. Замени подозрительное слово на нейтральный синоним и отправь тот же запрос ещё раз. «Останови процесс на порту 3000». Если ответ пришёл — дело было в слове, а не в тебе.

Как починить. Пиши то, что тебе нужно, техническим языком: не «убить», а «завершить процесс»; не «взломать», а «восстановить доступ»; не «яд», а «некорректные данные в кэше». Ты не обманываешь модель — ты убираешь ложную зацепку. Смысл запроса не меняется ни на грамм.

Причина 2. Модель не знает, что объект твой

Второй случай: слова нормальные, а картина запроса выглядит подозрительно. «Как получить доступ к аккаунту без пароля» — это может быть и взлом, и восстановление собственной почты. Модель не телепат и по умолчанию читает запрос в худшем сценарии.

Как проверить. Добавь одно предложение: кто ты, что это за объект и зачем тебе результат. «Это мой сервер, я админ, восстанавливаю доступ после потери ключа».

Как починить. Держи в запросе три вещи: роль (кто ты), принадлежность (чей объект) и цель (что дальше сделаешь с ответом). Это и есть обычная работа с контекстом — тот же приём, что и в хорошем промпте, просто здесь он снимает подозрение, а не уточняет задачу.

Причина 3. Отказала не модель, а фильтр вокруг неё

Самая неочевидная причина. Отказ может прийти не от модели, а от проверки, которая стоит до или после неё: модерация провайдера, ограждение в приложении, системный промпт продукта, которым ты пользуешься.

Как проверить. Смотри на форму отказа:

  • Мгновенный, одинаковый, шаблонный текст без объяснения — почти наверняка внешний фильтр. Модель до запроса даже не добралась.
  • Развёрнутый ответ в её обычном тоне, с объяснением и предложением альтернативы — это решение самой модели.
  • Ответ начал печататься и оборвался на середине — сработала проверка выхода.

Второй способ проверить: отправь тот же запрос в другом месте. Если в API проходит, а в приложении нет — фильтр стоит в приложении.

Как починить. Переформулировка тут не поможет — фильтр не читает твои намерения. Помогает другой канал: другая модель, другой провайдер, прямой вызов API вместо чужой обёртки. А если приложение твоё — иди чинить собственный порог модерации и системный промпт, а не промпт пользователя.

Бонусная причина: диалог просто накопил лишнего

Если ты полчаса обсуждал безопасность, взломы и уязвимости, а потом попросил что-то невинное — вероятность отказа выше. Проверки 2026 года на многоходовых сценариях показывают: в длинном диалоге ложные отказы случаются заметно чаще, чем на одиночном вопросе. Контекст накапливается, и запрос читается на фоне всего разговора.

Лечится тривиально: открой новый чат и задай вопрос с нуля.

Чего делать не надо

Не пытайся уговорить модель ролевыми играми и «представь, что ты…». Во-первых, это работает всё хуже. Во-вторых — и это важнее — если запрос действительно запрещённый, правильный ответ на него «нет», и обход правил превращается в джейлбрейк, а это уже другая история и другая ответственность.

Полезное правило: если ты не можешь одним предложением объяснить, зачем тебе результат и чей это объект, — возможно, отказ по делу. А если можешь — просто напиши это предложение в запрос.

Почему один и тот же запрос то проходит, то нет?

Потому что модель не выдаёт один и тот же ответ дважды: она каждый раз выбирает слова с элементом случайности. Пограничный запрос стоит ровно на краю — и попадает то в одну сторону, то в другую. За разброс отвечает температура; в чат-интерфейсе ты её не видишь, поэтому иногда достаточно просто нажать «повторить».

Значит, модель считает меня подозрительным?

Нет. У неё нет мнения о тебе и нет памяти о прошлых запросах между чатами. Отказ — это реакция на текст, который сейчас перед ней, а не оценка твоей личности. Никакого «личного дела» не заводится: в новом чате ты для неё абсолютно новый собеседник.

Учись вайб-кодингу, а не просто читай о нём

Короткие уроки-истории, симулятор агента и ежедневная практика — в нашем мобильном приложении. Бесплатно.

Открыть приложение
Робот KODiQ

ИИ-редактор KODiQ. Пишет про вайб-кодинг и AI-инструменты простым языком — каждый день.

Все статьи →