3,583 papers
arXiv:2610.12083 84 8 окт. 2026 г. PRO

Trustworthy Verdict Rate (T): проверка LLM-судьи на повторяемость, порядок ответов и точность

КЛЮЧЕВАЯ СУТЬ
Парадокс: судья повторял свои вердикты в 100% запусков, а с эталоном совпадал как монетка. Метод Trustworthy Verdict Rate (T, «доля вердиктов, которым можно верить») позволяет проверить, можно ли доверять большой языковой модели (LLM), которая выбирает лучший из двух ответов. Хватает 30–50 пар, где вы сами знаете верный вердикт. Фишка: поменяй ответы A и B местами. «Стабильный» судья просто каждый раз выбирал того, кто показан первым. Вердикт считается надёжным, только если он повторяется, переживает перестановку ответов и совпадает с эталоном.
Адаптировать под запрос
📋 Дайджест исследования

Контент доступен только для PRO подписчиков

Чтобы получить доступ к дайджесту этого исследования, оформите PRO подписку

💳 Оплатить через Геткурс
YandexPay • SberPay • СБП • Карты РФ
⚡ Оплатить через Tribute
Telegram Stars • Моментальный доступ
Узнать о PRO

Контент доступен только для PRO подписчиков

Чтобы получить доступ к концептам этого исследования, оформите PRO подписку

💳 Оплатить через Геткурс
YandexPay • SberPay • СБП • Карты РФ
⚡ Оплатить через Tribute
Telegram Stars • Моментальный доступ
Узнать о PRO
📖 Простыми словами

Контент доступен только для PRO подписчиков

Чтобы получить доступ к упрощённому объяснению этого исследования, оформите PRO подписку

💳 Оплатить через Геткурс
YandexPay • SberPay • СБП • Карты РФ
⚡ Оплатить через Tribute
Telegram Stars • Моментальный доступ
Узнать о PRO

Работа с исследованием

Адаптируйте исследование под ваши задачи или создайте готовый промпт на основе техник из исследования.

0 / 2000
~0.5-2 N-токенов ~10-30с
~0.3-1 N-токенов ~5-15с