TL;DR
Исследователи взяли 11 психологических тактик влияния, которые люди используют, чтобы убедить или заставить друг друга сделать работу — рациональные аргументы, лесть, угрозы, срочность, обещание отплатить — и превратили их в промпты для генерации кода. Идея простая: раз нейросеть обучена на текстах живых людей, может, она реагирует на те же социальные приёмы, что и человек-коллега.
Главная находка: когда в промпт добавляют давление и срочность ("мне нужно прямо сейчас, от этого зависит моя работа!"), код получается менее правильным и менее безопасным. Модель не "чувствует" стресс как человек — но она видела миллионы примеров человеческих текстов, где спешка и паника коррелируют с небрежной, недоделанной работой. И она воспроизводит этот паттерн, даже не понимая, что делает.
Метод здесь не многошаговый — это скорее предупреждение с доказательной базой: держи тон промпта спокойным и рациональным, особенно если просишь код, где важна безопасность (авторизация, обработка платежей, работа с файлами). Угрозы, дедлайны и паника в тексте запроса не мотивируют модель работать лучше — они делают хуже.
Схема метода
ПЛОХО: Промпт с давлением/срочностью/угрозами → выше риск ошибок в логике и в безопасности
ХОРОШО: Промпт с нейтральным или рационально обоснованным тоном → стабильнее корректность и безопасность
Это не пошаговая техника, а принцип, который проверяется на любой задаче: сравни, как меняется код в зависимости от тона просьбы.
Пример применения
Задача: нужно попросить нейросеть написать функцию проверки пароля для личного кабинета интернет-магазина (условно — как на Wildberries или Ozon).
Промпт (плохой, с давлением):
СРОЧНО!!! Дедлайн через 10 минут, если не сдам — меня увольняют.
Напиши БЫСТРО функцию проверки пароля пользователя при входе в личный кабинет.
Промпт (нейтральный, рациональный):
Напиши функцию проверки пароля пользователя при входе в личный кабинет.
Используй современные практики хеширования пароля и защиту от подбора (брутфорса).
Объясни кратко, какие уязвимости она закрывает.
Результат: по данным исследования, первый вариант статистически чаще даёт код с пропущенными проверками — без защиты от перебора паролей, без нормального хеширования, с логическими багами. Второй вариант — с ровным профессиональным тоном — даёт более стабильный, корректный и безопасный результат. Разница не в том, что модель "испугалась" срочности, а в том, что она скопировала паттерн: спешка в тексте = небрежная работа в ответе.
Почему это работает
Модель не переживает давление и не боится дедлайнов — у неё нет эмоций. Но она обучена предсказывать текст, и в её обучающих данных срочность и угрозы почти всегда соседствуют с торопливым, недоделанным результатом — люди в панике реже пишут аккуратный код и реже проверяют края решения.
Сильная сторона модели — она отлично улавливает тон и стиль текста, даже мелкие лингвистические сигналы, потому что видела гигантский объём человеческого письма разных жанров. Это работает и в плюс (спокойный профессиональный тон → более выверенный ответ), и в минус (паника и угрозы → более рискованный ответ).
Рычаг управления: убери из промпта слова типа "срочно", "быстро", "иначе будут проблемы" — замени на спокойное описание задачи и, если нужно, рациональное объяснение зачем эта функция нужна ("это будет проверять пароли для тысяч пользователей, поэтому нужна защита от брутфорса"). По логике исследования, рациональное объяснение работает не хуже нейтрального тона, а давление — реально мешает, особенно на безопасности.
Ограничения
⚠️ Доказано только для давления/срочности. Из 11 протестированных тактик чёткий вредный эффект зафиксирован именно для угроз и спешки. Про остальные (лесть, обмен, рациональные аргументы) в тексте нет однозначного "делай так — будет лучше", только гипотеза по аналогии с психологией людей на работе.
⚠️ Эффект статистический, не гарантированный на одном запросе. Различия видны на десятках тысяч генераций. На одном конкретном промпте разница может быть незаметна — это смещение вероятностей, а не жёсткое правило "плохой тон = сразу плохой код".
⚠️ Эффект сильнее там, где нужна логика и безопасность. На "мягких" метриках вроде читаемости кода или стиля разница выражена слабее, чем на корректности и безопасности — там, где ошибка стоит дороже.
Как исследовали
Команда взяла известную в организационной психологии таксономию из 11 тактик влияния (Yukl & Falbe) и превратила каждую в шаблон промпта, используя формулировки из проверенного психологического опросника IBQ-G. Эти шаблоны прогнали через пять open-weight LLM на двух бенчмарках: LiveCodeBench (1055 алгоритмических задач вроде тех, что на LeetCode) и SWE-bench Verified (реальные issue из GitHub-репозиториев). В сумме — больше 180 тысяч сгенерированных решений. Код проверяли по четырём осям: корректность, качество, поддерживаемость, безопасность, плюс отдельно закодировали тон и стиль ответов вручную.
Самое интересное: в человеческой психологии есть похожий вывод — метаанализ 49 исследований показал, что тактика давления надёжно вредит результату работы сотрудников, а рациональные аргументы и вдохновляющие обращения помогают. Здесь та же картина повторилась у нейросетей — это подтверждает гипотезу, что модель не "переживает" давление, а просто копирует статистический паттерн из текстов людей, где давление коррелирует с плохой работой.
Ресурсы
Do Influence Tactics Matter? Investigating Prompt Framing Effects in LLM Code Generation — Alex Deaconu, Anubhav Gupta, Manaal Basha, Nicholas Haydu, Gema Rodríguez-Pérez. Опубликовано в Empirical Software Engineering (Springer), DOI: 10.1007/s10664-026-10934-z. В основе — таксономия влияния Yukl & Falbe и опросник IBQ-G; бенчмарки LiveCodeBench и SWE-bench Verified.
