Контент доступен только для PRO подписчиков
Чтобы получить доступ к полному содержанию этого исследования, оформите PRO подписку
Nova Sapiens
/
Research
SKILL.md и файлы рядом) по уликам, а не по вкусу модели. Фишка: одну и ту же задачу гоняют несколько раз и сравнивают успехи с провалами. Так находятся подозрительные действия — те, что есть в провалах и почти нет в успехах. Только после этого пишется правка. Итог: +16% по pass@3 (доля задач, решённых хотя бы с одной из трёх попыток) на SWE-Skills-Bench и +17% на CannBot. Шесть правок приняты в реальной команде.
Чтобы получить доступ к полному содержанию этого исследования, оформите PRO подписку
Чтобы получить доступ к дайджесту этого исследования, оформите PRO подписку
Чтобы получить доступ к концептам этого исследования, оформите PRO подписку
Чтобы получить доступ к упрощённому объяснению этого исследования, оформите PRO подписку
Адаптируйте исследование под ваши задачи или создайте готовый промпт на основе техник из исследования.