3,583 papers
arXiv:2610.09935 70 7 окт. 2026 г. PRO

AgentTracer: поиск источника prompt injection в логах агента через сверку «что просил пользователь» и «что агент сделал»

КЛЮЧЕВАЯ СУТЬ
Обнаружено: вредные вызовы агента не связаны друг с другом по данным. «Прочитать почту» и «удалить файл» ничего друг другу не передают, поэтому старые методы трассировки теряют куски цепочки. AgentTracer позволяет по логу агента найти письмо или сайт, через который ему подсунули скрытую команду (косвенную prompt injection). Метод ищет связь не по данным, а по цели. Запрос пользователя превращается в рамку разрешений: какое действие, какая цель, какое ограничение. Каждый вызов сверяется с рамкой, а источник находится точнее конкурентов на 18–54% (по замерам самих авторов).
Адаптировать под запрос
📋 Дайджест исследования

Контент доступен только для PRO подписчиков

Чтобы получить доступ к дайджесту этого исследования, оформите PRO подписку

💳 Оплатить через Геткурс
YandexPay • SberPay • СБП • Карты РФ
⚡ Оплатить через Tribute
Telegram Stars • Моментальный доступ
Узнать о PRO

Контент доступен только для PRO подписчиков

Чтобы получить доступ к концептам этого исследования, оформите PRO подписку

💳 Оплатить через Геткурс
YandexPay • SberPay • СБП • Карты РФ
⚡ Оплатить через Tribute
Telegram Stars • Моментальный доступ
Узнать о PRO
📖 Простыми словами

Контент доступен только для PRO подписчиков

Чтобы получить доступ к упрощённому объяснению этого исследования, оформите PRO подписку

💳 Оплатить через Геткурс
YandexPay • SberPay • СБП • Карты РФ
⚡ Оплатить через Tribute
Telegram Stars • Моментальный доступ
Узнать о PRO

Работа с исследованием

Адаптируйте исследование под ваши задачи или создайте готовый промпт на основе техник из исследования.

0 / 2000
~0.5-2 N-токенов ~10-30с
~0.3-1 N-токенов ~5-15с