Что такое hit-rate
Hit-rate — доля сбывшихся прогнозов среди тех, что вообще можно было проверить и которые уже разрешены. «Разрешённый» здесь означает, что у прогноза наступил горизонт и вынесен исход; «проверяемый» — что у прогноза есть актив, направление или порог, срок и источник истины. Метрика отвечает на простой вопрос: из скольких проверяемых утверждений автора сбылось сколько.
Сейчас это главная публичная метрика, по которой сортируется лидерборд. FRI — сводный индекс достоверности — остаётся предварительным, пока в корпусе почти нет прогнозов с заявленной вероятностью, и используется лишь как тай-брейк при равном hit-rate. Подробно об индексе — на странице об FRI; здесь его математику мы не повторяем.
Формула
Расчёт бинарный: каждый разрешённый проверяемый прогноз — это либо попадание, либо промах, частичного зачёта нет. В числителе — прогнозы с исходом «сбылось», в знаменателе — сумма сбывшихся и несбывшихся. Всё остальное (см. ниже) не входит ни в числитель, ни в знаменатель.
- «Сбылось» — исход ровно true: заявленное утверждение подтвердилось по правилу резолюции.
- «Не сбылось» — исход false: утверждение не подтвердилось.
- Hit-rate считается по всем проверяемым типам прогнозов (не только направленным), у которых есть бинарный исход.
Что считается «сбылось»
Прогноз идёт в числитель, только если его исход ровно true — заявленное утверждение подтвердилось по заранее зафиксированному правилу резолюции. Исход false («не сбылось») попадает в знаменатель, но не в числитель. Hit-rate считается по всем проверяемым типам прогнозов, а не только по направленным:
| Тип прогноза | Что оценивается | Пример |
|---|---|---|
| Directional (направление) | Куда пойдёт показатель относительно значения на момент прогноза. | «Рубль ослабнет к концу года». |
| Threshold (порог) | Будет ли пройден заданный уровень. | «USD/RUB ≥ 100 к 31.12.2025». |
| Probabilistic (вероятностный) | Сбудется ли событие, для которого названа вероятность. | «ЦБ сохранит ставку с вероятностью 0.7». |
| Event (событие) | Наступит ли описанное событие к сроку. | «ЦБ снизит ставку на ближайшем заседании». |
| Point target (точечная цель) | Попадёт ли число в допуск по классу актива. | «Brent будет около $80 к середине года». |
Что не попадает в расчёт
В hit-rate входят только исходы true и false. Всё перечисленное ниже не учитывается ни в числителе, ни в знаменателе — такие прогнозы не портят и не улучшают долю, они просто не участвуют:
- Частично сбывшиеся (partial). Частичного зачёта нет; такой прогноз исключается целиком, а не идёт как «половина попадания».
- Недействительные (void). Когда условие резолюции перестало быть проверяемым (например, изменился источник истины).
- Ещё открытые / неразрешённые. Горизонт не наступил или исход пока не вынесен — прогноз не считается, пока не разрешится.
- Из источников низшего тира (C). Прогнозы, доказательство которых не дотягивает до приемлемого тира, в рейтинг не идут.
- Непроверяемые типы. Утверждения без проверяемого критерия (нет актива, порога или срока) не резолвятся и в расчёт не входят.
Диапазонные (range) прогнозы исключены из рейтинга, пока их границы не сверены вручную: автоматически резолвить диапазон без выверенных границ нельзя, поэтому такие прогнозы остаются вне hit-rate до ручной проверки.
Размер выборки: тиры
Малая выборка делает hit-rate неустойчивым: 4 из 4 — это формально 100%, но интервал неопределённости очень широкий. Поэтому авторы разделены по числу разрешённых прогнозов (n), и к долям на малых выборках надо относиться осторожно:
| Размер выборки (n) | Тир | Что это значит |
|---|---|---|
| 1–4 | Отслеживается | Данных слишком мало для вывода; hit-rate показан как наблюдение. |
| 5–19 | Ранний трек-рекорд | Появляется тренд, но интервал ещё широкий. |
| 20–49 | Основной рейтинг | Достаточно для сравнимого, рейтингуемого результата. |
| ≥ 50 | Устойчивая выборка | Доля стабильна — самый надёжный вывод. |
Чем меньше выборка, тем шире неопределённость — это не недостаток конкретного автора, а свойство малых чисел. Поэтому hit-rate всегда выводится рядом с числом прогнозов и периодом, а не как одно обезличенное число.
Интервал Уилсона и порядок в рейтинге
Точечная доля скрывает главное — насколько она надёжна. «3 из 5» и «60 из 100» обе дают 60%, но доверять им можно совершенно по-разному. Поэтому рядом с hit-rate мы показываем 95% доверительный интервал Уилсона [нижняя–верхняя]: на малой выборке он широкий, на большой — узкий.
Лидерборд сортируется по нижней границе интервала, а не по самой доле. Это устойчивый способ ранжировать по неопределённой оценке (Wilson lower bound): он одновременно вознаграждает точность и размер выборки. Эксперт с «3 из 5» имеет высокую долю, но широкий интервал и низкую нижнюю границу — он не встаёт над стабильным треком на шуме. FRI при равенстве служит тай-брейком; эксперты без разрешённых прогнозов — в конце.
- Малая выборка → широкий интервал → низкая нижняя граница → ниже в рейтинге, даже при высокой точечной доле.
- Большая выборка со стабильной долей → узкий интервал → нижняя граница близко к доле → выше в рейтинге.
- Параметр фиксирован (z = 1.96, 95%); его нельзя настроить под конкретного эксперта.
Стратификация: у прогнозов разная трудность
Один hit-rate суммирует прогнозы разной трудности: угадать направление по трендовой валюте и попасть в точный уровень ключевой ставки — оба дают «+1». Без поправки это измеряло бы не точность, а умение выбирать лёгкие вопросы. Поэтому на профиле эксперта hit-rate разложен по стратам — парам (тип прогноза × класс актива).
| Тип прогноза | Класс актива | Что видно из разбивки |
|---|---|---|
| направление | валюта | Лёгкий сегмент: направление по тренду угадать проще. |
| точный уровень | ключевая ставка | Трудный сегмент: попасть в конкретное значение сложно. |
| порог | индекс | Средняя трудность: пройдёт ли уровень к сроку. |
Базовая частота и показатель «над базой»
Чтобы поправка на трудность была честной, для каждой страты мы считаем базовую частоту — объединённую по всему корпусу долю сбываемости в этой же страте (сколько в среднем сбывается таких прогнозов у всех авторов). Это тот же приём, которым сравнивают прогнозистов на одинаковых вопросах: не «сколько сбылось», а «сколько сбылось относительно того, что вообще сбывается в этом сегменте».
Показатель «над базой» (skill-over-chance) — это взвешенная разница между hit-rate эксперта и базовой частотой по его набору прогнозов. «+8 п.п.» значит: по своим стратам эксперт в среднем на 8 процентных пунктов точнее, чем сбывается в них у корпуса. Значение может быть отрицательным — тогда показываем «ниже базы −N п.п.», честно. Зачёт за лёгкие, почти предрешённые прогнозы (высокая базовая частота) при этом близок к нулю.
Зрелость лидерборда
У всего лидерборда есть статус зрелости — он зависит от того, сколько авторов перешли пороги выборки. Статус честно сообщает, можно ли считать рейтинг устоявшимся:
| Стадия | Условие | Смысл |
|---|---|---|
| research | Нет авторов с n ≥ 5 в достатке. | Данных мало, рейтинга по сути ещё нет. |
| early | ≥ 5 авторов с n ≥ 5, но ни одного с n ≥ 20. | Появляются треки, но рейтингуемых авторов нет. |
| preview | 1–4 автора с n ≥ 20. | Есть рейтингуемые авторы, но их мало — предварительный срез. |
| mature | ≥ 5 авторов с n ≥ 20. | Достаточно рейтингуемых авторов для устойчивого сравнения. |
Сейчас лидерборд в стадии preview: рейтингуемые авторы уже есть, но их пока немного, поэтому к сравнению стоит относиться как к предварительному срезу.
Hit-rate и FRI: чем отличаются
Hit-rate и FRI отвечают на разные вопросы. Hit-rate — это просто доля попаданий: легко читается, но не учитывает, насколько смелым и сложным был прогноз и какую вероятность заявил автор. FRI пытается это учесть через skill-score против базовой линии — но требует заявленных вероятностей, которых в корпусе почти нет.
Поэтому сейчас главная метрика — hit-rate, а FRI — предварительный: он держится у паритета (50), пока вероятностных прогнозов мало, и служит лишь тай-брейком при равном hit-rate. Когда вероятностных прогнозов накопится достаточно, роль FRI вырастет. Его формулу и сжатие к паритету мы здесь не повторяем — это на странице об FRI.
Как выносится исход
Hit-rate потребляет уже готовые исходы — движок оценки не определяет сам факт, а считает долю по выставленным вердиктам. Исход выносится так:
- Прогноз сверяется с фактом по заранее зафиксированному правилу резолюции и единственному источнику истины актива — рыночные и официальные данные (MOEX, ЦБ РФ, FRED).
- По результату сверки фиксируется исход: true · false · partial · void (а до наступления горизонта — открыт).
- Движок оценки берёт этот готовый исход: в hit-rate идут только true и false, остальное отбрасывается.
Правило резолюции, источник истины и допуск по классу актива подробно описаны на странице об FRI (раздел «Правила резолюции»). Надёжность доказательства, что прогноз был сделан, задаётся тирами источника T1–T3.
Мы фиксируем высказывания, а не людей
Объект оценки — конкретное публичное утверждение о будущем, а не личность автора. Мы судим прогноз: что именно было сказано, когда, с каким горизонтом и по какому источнику истины это проверяется. Один и тот же человек может иметь и сбывшиеся, и несбывшиеся прогнозы — и то, и другое попадает в выборку без отбора «удобных» случаев.
Поэтому здесь нет ярлыков «эксперт» или «шарлатан». Есть числа: сколько проверяемых прогнозов, сколько из них сбылось, с какой точностью относительно базовой линии. Формулировки фактологичны — «из N проверяемых M сбылись», без оценочных характеристик автора.
Ограничения (честно)
Hit-rate — простая и читаемая метрика, но у простоты есть цена. Радикальная честность о её слабых местах — часть методологии:
- Не учитывает сложность и смелость. Угадать почти предрешённый исход и попасть в трудный, контринтуитивный прогноз дают одинаковый «плюс». Для поправки на это есть FRI.
- Игнорирует заявленную вероятность. Hit-rate не различает уверенный и осторожный прогноз — учитывает только факт «сбылось / не сбылось». Вероятностную оценку измеряет FRI через Brier-skill.
- Не наказывает за «частично». Частично сбывшиеся прогнозы просто исключаются, а не идут как половина попадания — это упрощение в пользу прозрачности.
- Малые выборки нестабильны. На нескольких прогнозах доля скачет, отсюда тиры выборки и стадии зрелости лидерборда. Поэтому hit-rate всегда показывается рядом с числом прогнозов и периодом.
История версий методологии
Здесь — изменения правил (как считается индекс, что считается прогнозом, как резолвится исход). Ошибки в конкретных вердиктах фиксируются отдельно — в журнале исправлений. Это разные вещи: тут меняется метод, там — исправляется ошибка применения метода.
Интервал Уилсона на hit-rate, ранжирование по нижней границе, стратификация и поправка на базовую частоту.
- Интервал Уилсона (95%) на hit-rate: рядом с долей показывается доверительный интервал [нижняя–верхняя], отражающий неопределённость на малой выборке.
- Ранжирование лидерборда — по нижней границе интервала Уилсона, а не по точечной доле. «3 из 5» (60%, но широкий интервал) больше не встаёт над стабильным треком на шуме; FRI остаётся тай-брейком, эксперты без hit-данных — в конце.
- Стратификация: hit-rate раскладывается по стратам (тип прогноза × класс актива). Видно, что 90% попаданий у эксперта — это направления по валюте, а не точные уровни ставки. Разбивка показана на профиле эксперта.
- Базовая частота и «над базой» (skill-over-chance): для каждой страты считается объединённая по всему корпусу частота сбываемости (включая прогнозы самого эксперта); эксперт сравнивается с ней с поправкой на трудность его набора прогнозов. Значение может быть отрицательным — показывается честно. У доминирующего в выборке эксперта база близка к его же частоте, поэтому «над базой» на текущем корпусе — консервативная оценка.
- Новых ручных порогов не введено: z=1.96 фиксирован, базовые частоты вычисляются из корпуса. Обратная совместимость: старые прогнозы не перерезолвлены, изменился только показ и порядок сортировки.
Диапазоны автоматически скорятся: вхождение + допуск класса на границах.
- Правило диапазонов (§5): вместо «ждать ручной проверки» диапазон теперь скорится автоматически — факт должен попасть в [low − δ, high + δ], где δ — допуск класса актива на соответствующей границе.
- Ширина диапазона шире класс-зависимого cap → флаг range_too_wide: прогноз закрыт и показан на карточке, но исключён из hit-rate и FRI (слишком широкий диапазон не является точным прогнозом).
- «Мусорные» диапазоны (нечитаемые границы, нижняя граница ≤ 0, расхождение с фактом > 5×, ширина > 3×cap, сложная агрегация/нелинейный путь) — направляются в очередь ручной проверки; вердикт не выставляется до решения оператора.
- Границы с пометкой manual_verified (оператор проверил вручную) обходят очередь и скорятся напрямую.
- Параметры правила (cap ширины, допуски, флаги auto_score_ranges) хранятся в таблице methodology_config (draft → publish → версионирование) и доступны в /admin-ui/methodology; ночной конвейер читает опубликованный конфиг.
Подключены источники истины (CPI, крипто, Urals) и зафиксирована политика эталонов.
- Политика эталонов: у каждого скоримого актива — один источник истины, решающий вердикт (показан на карточке); вторичные источники служат резервом и сверкой, но не перебивают основной. Где надёжного эталона нет — прогноз не оценивается (monitoring), а не получает сомнительный вердикт.
- Инфляция (CPI) — подключена авторезолюция по годовому ИПЦ Росстата (декабрь к декабрю), с перекрёстной сверкой по Банку России. Раньше CPI-прогнозы оставались открытыми.
- Криптовалюты (BTC/ETH) — дневное закрытие Kraken (UTC) как основной источник, сверка с Coinbase, резерв CoinGecko; институциональный бенчмарк — CME CF Bitcoin/Ether Reference Rate.
- Нефть Urals — официальная средняя цена Минэкономразвития за месяц/год (на данных Argus): скорятся только средние прогнозы; дневные spot-прогнозы помечаются monitoring (нет бесплатного дневного эталона).
- Закрыт пробел: акции ЛУКОЙЛ/Норникель/ВТБ (LKOH/GMKN/VTBR) теперь резолвятся по Московской бирже наравне с остальными. Введён инвариант: каждый актив имеет источник резолюции — без тихих пропусков.
Допуски по рыночным классам сужены ради доверия к вердикту.
- Допуски рынков сужены: валюта — ±1,5% на горизонте до 90 дней, ±2% дальше (±3% только для явно сценарных долгосрочных); индексы, отдельные акции, нефть/золото и крипто — ±2%. Прежние ±5–10% признаны слишком широкими: большой допуск размывает смысл «сбылось / не сбылось».
- Ключевая ставка (точное совпадение, ±0,25 п.п. при «около») и инфляция/CPI (±0,3 п.п., ±0,5 п.п. при «около») оставлены без изменений.
- Ранее разрешённые рыночные прогнозы перерезолвлены по новым допускам; часть вердиктов и значения hit-rate/FRI соответственно обновлены.
Класс-зависимые допуски, операторы порога и шаг ставки.
- Единый «±5%» заменён допуском по классу актива: ключевая ставка — точное совпадение (или ±0,25 п.п. при «около»); CPI ±0,3 п.п.; валюта ±2,5–3%; индексы ±5%; акции ±7,5%; нефть/золото ±5%; крипто ±10%.
- Введены операторы сравнения: «достигнет/превысит/не ниже» → порог (≥/>), «не выше/упадёт до» → ≤; «снизит на N б.п./сохранит» резолвится по фактическому шагу ставки, а не по уровню.
- Числовые точечные прогнозы теперь участвуют в рейтинге (резолвятся по допуску в сбылось/не сбылось); диапазоны идут в рейтинг только после ручной проверки границ.
- База направления — значение на момент прогноза, а не за день до горизонта. «Средняя за период» считается как среднее ряда за период.
- Прогнозы про ФРС/ЕЦБ не резолвятся против ставки ЦБ РФ; добавлены источники Brent (EIA/FRED) и золота (LBMA в $/унц., учётные цены ЦБ в ₽/грамм с базисом).
- Карточка прогноза показывает цель, факт, ошибку, допуск, оператор, источник истины, эффективную дату и причину исхода.
- Brier-skill начисляется только за явно заявленную вероятность; категориальные и точечные прогнозы без вероятности получают skill 0 (идут в hit-rate, но не штрафуются за подставленную «уверенность») — убрана асимметрия прежней оценки.
- Сжатие индекса — к паритету (skill 0 → FRI 50), а не к популяционному среднему; σ доверительного интервала оценивается из данных (не ниже 0,5).
- Главная публичная метрика — доля сбывшихся (hit-rate); FRI предварительный, ярлык «итоговый рейтинг» не присваивается, пока не накопятся вероятностные прогнозы.
Первая публичная версия правил.
- Зафиксирована формула FRI: skill-score против опорной вероятности, веса по горизонту / ясности / тиру источника / свежести, байесовское сжатие к среднему (k = 8), отображение в шкалу 0–100 (50 = паритет).
- Введены тиры источников T1–T3 и правило резолюции по единственному источнику истины на актив.
- Введён порог research / preview / final по числу разрешённых сравнимых прогнозов (финал — от 20 на эксперта).
Хотите узнавать, когда мы меняем правила? Напишите нам — добавим вас в список оповещения об изменениях методологии (это отдельный канал от журнала исправлений).
Частые вопросы
Частые вопросы
- Можно ли поднять hit-rate, публикуя больше прогнозов?
- Нет. В знаменателе только сбывшиеся и несбывшиеся прогнозы; добавить публикаций без попаданий нельзя поднять долю. Открытые и неоднозначные прогнозы в расчёт не входят вовсе.
- Можно ли накрутить рейтинг, выбирая лёгкие прогнозы?
- Поднять hit-rate публикацией нельзя, но можно отбором лёгких утверждений — например, направлений по трендовому активу вместо точных уровней ставки. Именно поэтому рядом мы показываем разбивку по трудности (страты «тип прогноза × класс актива») и базовую частоту сбываемости по корпусу. Показатель «над базой» вычитает эту базовую частоту, так что зачёт за лёгкие, почти предрешённые прогнозы близок к нулю.
- Почему лидерборд отсортирован не по самой доле сбывшихся?
- Порядок задаётся нижней границей 95% интервала Уилсона, а не точечным hit-rate. На малой выборке доля неустойчива: «3 из 5» — это 60%, но интервал очень широкий. Сортировка по нижней границе вознаграждает и точность, и размер выборки, поэтому малые выборки не всплывают наверх на шуме.
- Считается ли «частично сбылось» как половина попадания?
- Нет. Расчёт бинарный: в hit-rate идут только исходы «сбылось» (true) и «не сбылось» (false). Частично сбывшиеся прогнозы исключаются и из числителя, и из знаменателя — частичного зачёта нет.
- Почему у автора с высоким hit-rate стоит оговорка о выборке?
- Потому что на малом числе прогнозов доля неустойчива: 4 из 4 — это 100%, но интервал очень широкий. Поэтому рядом с hit-rate всегда показаны число прогнозов и период, а рейтингуемыми считаются авторы от 20 разрешённых прогнозов.
