3,583 papers
arXiv:2610.11835 80 8 окт. 2026 г. PRO

Fault-enforcing tests: тесты, которые LLM пишет по коду, закрепляют баги

КЛЮЧЕВАЯ СУТЬ
Обнаружено: тесты, которые LLM пишет по свежему коду, чаще закрепляют баг, чем ловят его. Закрепляющих тестов получилось в несколько раз больше. Они проходят на сломанном коде и падают на исправленном. Защитный промпт позволяет получать тесты, где ожидаемые значения берутся из ТЗ, а не из кода. Авторы статьи сам промпт не проверяли, это наша производная от их выводов. Фишка: модель смотрит, что код делает сейчас, а не что он должен делать. Значит, любая ошибка в коде становится «правильным ответом» в тесте. Лечится это правилом «упал — стоп»: нельзя править ожидание под код, нужно сообщить о расхождении. Зелёные тесты, покрытие растёт, все довольны. Только баг теперь прописан в тестах как закон.
Адаптировать под запрос
📋 Дайджест исследования

Контент доступен только для PRO подписчиков

Чтобы получить доступ к дайджесту этого исследования, оформите PRO подписку

💳 Оплатить через Геткурс
YandexPay • SberPay • СБП • Карты РФ
⚡ Оплатить через Tribute
Telegram Stars • Моментальный доступ
Узнать о PRO

Контент доступен только для PRO подписчиков

Чтобы получить доступ к концептам этого исследования, оформите PRO подписку

💳 Оплатить через Геткурс
YandexPay • SberPay • СБП • Карты РФ
⚡ Оплатить через Tribute
Telegram Stars • Моментальный доступ
Узнать о PRO
📖 Простыми словами

Контент доступен только для PRO подписчиков

Чтобы получить доступ к упрощённому объяснению этого исследования, оформите PRO подписку

💳 Оплатить через Геткурс
YandexPay • SberPay • СБП • Карты РФ
⚡ Оплатить через Tribute
Telegram Stars • Моментальный доступ
Узнать о PRO

Работа с исследованием

Адаптируйте исследование под ваши задачи или создайте готовый промпт на основе техник из исследования.

0 / 2000
~0.5-2 N-токенов ~10-30с
~0.3-1 N-токенов ~5-15с