3,583 papers
arXiv:2610.04133 87 2 окт. 2026 г. PRO

Рубрика для LLM-судьи и один раунд самокритики: как заставить модель замечать реальные различия между гипотезами

КЛЮЧЕВАЯ СУТЬ
Спрашиваешь у LLM «эти две гипотезы одинаковые или разные?» — и она пропускает замену ключевой причины в 62% случаев. Метод позволяет честно посчитать, сколько у тебя реально разных идей среди 12, 50 или 100 гипотез, а не сколько по-разному звучащих. Фишка: судью заставляют сравнивать не целое, а три куска по очереди — старт, путь, итог. Модель перестаёт оценивать общее впечатление и обязана остановиться на стартовой причине. Чувствительность растёт с 83% до 96%. Вторая находка: из пяти раундов самокритики работает только первый.
Адаптировать под запрос
📋 Дайджест исследования

Контент доступен только для PRO подписчиков

Чтобы получить доступ к дайджесту этого исследования, оформите PRO подписку

💳 Оплатить через Геткурс
YandexPay • SberPay • СБП • Карты РФ
⚡ Оплатить через Tribute
Telegram Stars • Моментальный доступ
Узнать о PRO

Контент доступен только для PRO подписчиков

Чтобы получить доступ к концептам этого исследования, оформите PRO подписку

💳 Оплатить через Геткурс
YandexPay • SberPay • СБП • Карты РФ
⚡ Оплатить через Tribute
Telegram Stars • Моментальный доступ
Узнать о PRO
📖 Простыми словами

Контент доступен только для PRO подписчиков

Чтобы получить доступ к упрощённому объяснению этого исследования, оформите PRO подписку

💳 Оплатить через Геткурс
YandexPay • SberPay • СБП • Карты РФ
⚡ Оплатить через Tribute
Telegram Stars • Моментальный доступ
Узнать о PRO

Работа с исследованием

Адаптируйте исследование под ваши задачи или создайте готовый промпт на основе техник из исследования.

0 / 2000
~0.5-2 N-токенов ~10-30с
~0.3-1 N-токенов ~5-15с