Методология · v1.4

hit-rate = сбылось / (сбылось + не сбылось)

Доля сбывшихся среди разрешённых проверяемых прогнозов автора. Это главная публичная метрика, по которой ранжируется лидерборд. Считается бинарно — без частичного зачёта — и всегда показывается рядом с числом прогнозов и периодом.

Коротко
Hit-rate — это доля прогнозов автора, которые сбылись, среди всех его разрешённых проверяемых прогнозов. В числитель идут исходы «сбылось» (true), в знаменатель — «сбылось» плюс «не сбылось» (false). Частично сбывшиеся, недействительные, ещё открытые прогнозы и прогнозы из источников низшего тира в расчёт не входят. Это главная (headline) метрика ранжирования; FRI пока предварительный и используется как тай-брейк. Hit-rate никогда не показывается без числа прогнозов и периода.
true / falseтолько бинарные исходы
n ≥ 20порог рейтинга
previewстадия лидерборда
Актуально на 2026-08-07Источник истины: ForecastReceipts

Что такое hit-rate

Hit-rate — доля сбывшихся прогнозов среди тех, что вообще можно было проверить и которые уже разрешены. «Разрешённый» здесь означает, что у прогноза наступил горизонт и вынесен исход; «проверяемый» — что у прогноза есть актив, направление или порог, срок и источник истины. Метрика отвечает на простой вопрос: из скольких проверяемых утверждений автора сбылось сколько.

Сейчас это главная публичная метрика, по которой сортируется лидерборд. FRI — сводный индекс достоверности — остаётся предварительным, пока в корпусе почти нет прогнозов с заявленной вероятностью, и используется лишь как тай-брейк при равном hit-rate. Подробно об индексе — на странице об FRI; здесь его математику мы не повторяем.

Формула

hit-rate = (число сбывшихся) / (число сбывшихся + число не сбылось)

Расчёт бинарный: каждый разрешённый проверяемый прогноз — это либо попадание, либо промах, частичного зачёта нет. В числителе — прогнозы с исходом «сбылось», в знаменателе — сумма сбывшихся и несбывшихся. Всё остальное (см. ниже) не входит ни в числитель, ни в знаменатель.

  • «Сбылось» — исход ровно true: заявленное утверждение подтвердилось по правилу резолюции.
  • «Не сбылось» — исход false: утверждение не подтвердилось.
  • Hit-rate считается по всем проверяемым типам прогнозов (не только направленным), у которых есть бинарный исход.

Что считается «сбылось»

Прогноз идёт в числитель, только если его исход ровно true — заявленное утверждение подтвердилось по заранее зафиксированному правилу резолюции. Исход false («не сбылось») попадает в знаменатель, но не в числитель. Hit-rate считается по всем проверяемым типам прогнозов, а не только по направленным:

Все пять типов резолвятся в бинарный исход «сбылось / не сбылось» и участвуют в hit-rate.
Тип прогнозаЧто оцениваетсяПример
Directional (направление)Куда пойдёт показатель относительно значения на момент прогноза.«Рубль ослабнет к концу года».
Threshold (порог)Будет ли пройден заданный уровень.«USD/RUB ≥ 100 к 31.12.2025».
Probabilistic (вероятностный)Сбудется ли событие, для которого названа вероятность.«ЦБ сохранит ставку с вероятностью 0.7».
Event (событие)Наступит ли описанное событие к сроку.«ЦБ снизит ставку на ближайшем заседании».
Point target (точечная цель)Попадёт ли число в допуск по классу актива.«Brent будет около $80 к середине года».

Что не попадает в расчёт

В hit-rate входят только исходы true и false. Всё перечисленное ниже не учитывается ни в числителе, ни в знаменателе — такие прогнозы не портят и не улучшают долю, они просто не участвуют:

  • Частично сбывшиеся (partial). Частичного зачёта нет; такой прогноз исключается целиком, а не идёт как «половина попадания».
  • Недействительные (void). Когда условие резолюции перестало быть проверяемым (например, изменился источник истины).
  • Ещё открытые / неразрешённые. Горизонт не наступил или исход пока не вынесен — прогноз не считается, пока не разрешится.
  • Из источников низшего тира (C). Прогнозы, доказательство которых не дотягивает до приемлемого тира, в рейтинг не идут.
  • Непроверяемые типы. Утверждения без проверяемого критерия (нет актива, порога или срока) не резолвятся и в расчёт не входят.

Диапазонные (range) прогнозы исключены из рейтинга, пока их границы не сверены вручную: автоматически резолвить диапазон без выверенных границ нельзя, поэтому такие прогнозы остаются вне hit-rate до ручной проверки.

Размер выборки: тиры

Малая выборка делает hit-rate неустойчивым: 4 из 4 — это формально 100%, но интервал неопределённости очень широкий. Поэтому авторы разделены по числу разрешённых прогнозов (n), и к долям на малых выборках надо относиться осторожно:

Рейтингуемыми (сравнимыми) считаются авторы с n ≥ 20 — основной и устойчивый тиры.
Размер выборки (n)ТирЧто это значит
1–4ОтслеживаетсяДанных слишком мало для вывода; hit-rate показан как наблюдение.
5–19Ранний трек-рекордПоявляется тренд, но интервал ещё широкий.
20–49Основной рейтингДостаточно для сравнимого, рейтингуемого результата.
≥ 50Устойчивая выборкаДоля стабильна — самый надёжный вывод.

Чем меньше выборка, тем шире неопределённость — это не недостаток конкретного автора, а свойство малых чисел. Поэтому hit-rate всегда выводится рядом с числом прогнозов и периодом, а не как одно обезличенное число.

Интервал Уилсона и порядок в рейтинге

Точечная доля скрывает главное — насколько она надёжна. «3 из 5» и «60 из 100» обе дают 60%, но доверять им можно совершенно по-разному. Поэтому рядом с hit-rate мы показываем 95% доверительный интервал Уилсона [нижняя–верхняя]: на малой выборке он широкий, на большой — узкий.

hit-rate = 36% [21–54] — доля 36%, истинное значение с 95% вероятностью в [21%, 54%]

Лидерборд сортируется по нижней границе интервала, а не по самой доле. Это устойчивый способ ранжировать по неопределённой оценке (Wilson lower bound): он одновременно вознаграждает точность и размер выборки. Эксперт с «3 из 5» имеет высокую долю, но широкий интервал и низкую нижнюю границу — он не встаёт над стабильным треком на шуме. FRI при равенстве служит тай-брейком; эксперты без разрешённых прогнозов — в конце.

  • Малая выборка → широкий интервал → низкая нижняя граница → ниже в рейтинге, даже при высокой точечной доле.
  • Большая выборка со стабильной долей → узкий интервал → нижняя граница близко к доле → выше в рейтинге.
  • Параметр фиксирован (z = 1.96, 95%); его нельзя настроить под конкретного эксперта.

Стратификация: у прогнозов разная трудность

Один hit-rate суммирует прогнозы разной трудности: угадать направление по трендовой валюте и попасть в точный уровень ключевой ставки — оба дают «+1». Без поправки это измеряло бы не точность, а умение выбирать лёгкие вопросы. Поэтому на профиле эксперта hit-rate разложен по стратам — парам (тип прогноза × класс актива).

Разбивка показывает, из чего складывается общий hit-rate: 90% попаданий по лёгким направлениям и по трудным уровням — это разные результаты.
Тип прогнозаКласс активаЧто видно из разбивки
направлениевалютаЛёгкий сегмент: направление по тренду угадать проще.
точный уровеньключевая ставкаТрудный сегмент: попасть в конкретное значение сложно.
порогиндексСредняя трудность: пройдёт ли уровень к сроку.

Базовая частота и показатель «над базой»

Чтобы поправка на трудность была честной, для каждой страты мы считаем базовую частоту — объединённую по всему корпусу долю сбываемости в этой же страте (сколько в среднем сбывается таких прогнозов у всех авторов). Это тот же приём, которым сравнивают прогнозистов на одинаковых вопросах: не «сколько сбылось», а «сколько сбылось относительно того, что вообще сбывается в этом сегменте».

над базой = Σ_страта вес · (hit-rate эксперта − базовая частота), вес = доля прогнозов эксперта в страте

Показатель «над базой» (skill-over-chance) — это взвешенная разница между hit-rate эксперта и базовой частотой по его набору прогнозов. «+8 п.п.» значит: по своим стратам эксперт в среднем на 8 процентных пунктов точнее, чем сбывается в них у корпуса. Значение может быть отрицательным — тогда показываем «ниже базы −N п.п.», честно. Зачёт за лёгкие, почти предрешённые прогнозы (высокая базовая частота) при этом близок к нулю.

Зрелость лидерборда

У всего лидерборда есть статус зрелости — он зависит от того, сколько авторов перешли пороги выборки. Статус честно сообщает, можно ли считать рейтинг устоявшимся:

Стадия считается от числа авторов, перешедших пороги, а не от объёма базы в целом.
СтадияУсловиеСмысл
researchНет авторов с n ≥ 5 в достатке.Данных мало, рейтинга по сути ещё нет.
early≥ 5 авторов с n ≥ 5, но ни одного с n ≥ 20.Появляются треки, но рейтингуемых авторов нет.
preview1–4 автора с n ≥ 20.Есть рейтингуемые авторы, но их мало — предварительный срез.
mature≥ 5 авторов с n ≥ 20.Достаточно рейтингуемых авторов для устойчивого сравнения.

Сейчас лидерборд в стадии preview: рейтингуемые авторы уже есть, но их пока немного, поэтому к сравнению стоит относиться как к предварительному срезу.

research samplepreviewfinal

Hit-rate и FRI: чем отличаются

Hit-rate и FRI отвечают на разные вопросы. Hit-rate — это просто доля попаданий: легко читается, но не учитывает, насколько смелым и сложным был прогноз и какую вероятность заявил автор. FRI пытается это учесть через skill-score против базовой линии — но требует заявленных вероятностей, которых в корпусе почти нет.

Поэтому сейчас главная метрика — hit-rate, а FRI — предварительный: он держится у паритета (50), пока вероятностных прогнозов мало, и служит лишь тай-брейком при равном hit-rate. Когда вероятностных прогнозов накопится достаточно, роль FRI вырастет. Его формулу и сжатие к паритету мы здесь не повторяем — это на странице об FRI.

Как выносится исход

Hit-rate потребляет уже готовые исходы — движок оценки не определяет сам факт, а считает долю по выставленным вердиктам. Исход выносится так:

  • Прогноз сверяется с фактом по заранее зафиксированному правилу резолюции и единственному источнику истины актива — рыночные и официальные данные (MOEX, ЦБ РФ, FRED).
  • По результату сверки фиксируется исход: true · false · partial · void (а до наступления горизонта — открыт).
  • Движок оценки берёт этот готовый исход: в hit-rate идут только true и false, остальное отбрасывается.

Правило резолюции, источник истины и допуск по классу актива подробно описаны на странице об FRI (раздел «Правила резолюции»). Надёжность доказательства, что прогноз был сделан, задаётся тирами источника T1–T3.

Мы фиксируем высказывания, а не людей

Объект оценки — конкретное публичное утверждение о будущем, а не личность автора. Мы судим прогноз: что именно было сказано, когда, с каким горизонтом и по какому источнику истины это проверяется. Один и тот же человек может иметь и сбывшиеся, и несбывшиеся прогнозы — и то, и другое попадает в выборку без отбора «удобных» случаев.

Поэтому здесь нет ярлыков «эксперт» или «шарлатан». Есть числа: сколько проверяемых прогнозов, сколько из них сбылось, с какой точностью относительно базовой линии. Формулировки фактологичны — «из N проверяемых M сбылись», без оценочных характеристик автора.

Ограничения (честно)

Hit-rate — простая и читаемая метрика, но у простоты есть цена. Радикальная честность о её слабых местах — часть методологии:

  • Не учитывает сложность и смелость. Угадать почти предрешённый исход и попасть в трудный, контринтуитивный прогноз дают одинаковый «плюс». Для поправки на это есть FRI.
  • Игнорирует заявленную вероятность. Hit-rate не различает уверенный и осторожный прогноз — учитывает только факт «сбылось / не сбылось». Вероятностную оценку измеряет FRI через Brier-skill.
  • Не наказывает за «частично». Частично сбывшиеся прогнозы просто исключаются, а не идут как половина попадания — это упрощение в пользу прозрачности.
  • Малые выборки нестабильны. На нескольких прогнозах доля скачет, отсюда тиры выборки и стадии зрелости лидерборда. Поэтому hit-rate всегда показывается рядом с числом прогнозов и периодом.

История версий методологии

Здесь — изменения правил (как считается индекс, что считается прогнозом, как резолвится исход). Ошибки в конкретных вердиктах фиксируются отдельно — в журнале исправлений. Это разные вещи: тут меняется метод, там — исправляется ошибка применения метода.

v1.4

Интервал Уилсона на hit-rate, ранжирование по нижней границе, стратификация и поправка на базовую частоту.

  • Интервал Уилсона (95%) на hit-rate: рядом с долей показывается доверительный интервал [нижняя–верхняя], отражающий неопределённость на малой выборке.
  • Ранжирование лидерборда — по нижней границе интервала Уилсона, а не по точечной доле. «3 из 5» (60%, но широкий интервал) больше не встаёт над стабильным треком на шуме; FRI остаётся тай-брейком, эксперты без hit-данных — в конце.
  • Стратификация: hit-rate раскладывается по стратам (тип прогноза × класс актива). Видно, что 90% попаданий у эксперта — это направления по валюте, а не точные уровни ставки. Разбивка показана на профиле эксперта.
  • Базовая частота и «над базой» (skill-over-chance): для каждой страты считается объединённая по всему корпусу частота сбываемости (включая прогнозы самого эксперта); эксперт сравнивается с ней с поправкой на трудность его набора прогнозов. Значение может быть отрицательным — показывается честно. У доминирующего в выборке эксперта база близка к его же частоте, поэтому «над базой» на текущем корпусе — консервативная оценка.
  • Новых ручных порогов не введено: z=1.96 фиксирован, базовые частоты вычисляются из корпуса. Обратная совместимость: старые прогнозы не перерезолвлены, изменился только показ и порядок сортировки.
v1.3.1

Диапазоны автоматически скорятся: вхождение + допуск класса на границах.

  • Правило диапазонов (§5): вместо «ждать ручной проверки» диапазон теперь скорится автоматически — факт должен попасть в [low − δ, high + δ], где δ — допуск класса актива на соответствующей границе.
  • Ширина диапазона шире класс-зависимого cap → флаг range_too_wide: прогноз закрыт и показан на карточке, но исключён из hit-rate и FRI (слишком широкий диапазон не является точным прогнозом).
  • «Мусорные» диапазоны (нечитаемые границы, нижняя граница ≤ 0, расхождение с фактом > 5×, ширина > 3×cap, сложная агрегация/нелинейный путь) — направляются в очередь ручной проверки; вердикт не выставляется до решения оператора.
  • Границы с пометкой manual_verified (оператор проверил вручную) обходят очередь и скорятся напрямую.
  • Параметры правила (cap ширины, допуски, флаги auto_score_ranges) хранятся в таблице methodology_config (draft → publish → версионирование) и доступны в /admin-ui/methodology; ночной конвейер читает опубликованный конфиг.
v1.3

Подключены источники истины (CPI, крипто, Urals) и зафиксирована политика эталонов.

  • Политика эталонов: у каждого скоримого актива — один источник истины, решающий вердикт (показан на карточке); вторичные источники служат резервом и сверкой, но не перебивают основной. Где надёжного эталона нет — прогноз не оценивается (monitoring), а не получает сомнительный вердикт.
  • Инфляция (CPI) — подключена авторезолюция по годовому ИПЦ Росстата (декабрь к декабрю), с перекрёстной сверкой по Банку России. Раньше CPI-прогнозы оставались открытыми.
  • Криптовалюты (BTC/ETH) — дневное закрытие Kraken (UTC) как основной источник, сверка с Coinbase, резерв CoinGecko; институциональный бенчмарк — CME CF Bitcoin/Ether Reference Rate.
  • Нефть Urals — официальная средняя цена Минэкономразвития за месяц/год (на данных Argus): скорятся только средние прогнозы; дневные spot-прогнозы помечаются monitoring (нет бесплатного дневного эталона).
  • Закрыт пробел: акции ЛУКОЙЛ/Норникель/ВТБ (LKOH/GMKN/VTBR) теперь резолвятся по Московской бирже наравне с остальными. Введён инвариант: каждый актив имеет источник резолюции — без тихих пропусков.
v1.2

Допуски по рыночным классам сужены ради доверия к вердикту.

  • Допуски рынков сужены: валюта — ±1,5% на горизонте до 90 дней, ±2% дальше (±3% только для явно сценарных долгосрочных); индексы, отдельные акции, нефть/золото и крипто — ±2%. Прежние ±5–10% признаны слишком широкими: большой допуск размывает смысл «сбылось / не сбылось».
  • Ключевая ставка (точное совпадение, ±0,25 п.п. при «около») и инфляция/CPI (±0,3 п.п., ±0,5 п.п. при «около») оставлены без изменений.
  • Ранее разрешённые рыночные прогнозы перерезолвлены по новым допускам; часть вердиктов и значения hit-rate/FRI соответственно обновлены.
v1.1

Класс-зависимые допуски, операторы порога и шаг ставки.

  • Единый «±5%» заменён допуском по классу актива: ключевая ставка — точное совпадение (или ±0,25 п.п. при «около»); CPI ±0,3 п.п.; валюта ±2,5–3%; индексы ±5%; акции ±7,5%; нефть/золото ±5%; крипто ±10%.
  • Введены операторы сравнения: «достигнет/превысит/не ниже» → порог (≥/>), «не выше/упадёт до» → ≤; «снизит на N б.п./сохранит» резолвится по фактическому шагу ставки, а не по уровню.
  • Числовые точечные прогнозы теперь участвуют в рейтинге (резолвятся по допуску в сбылось/не сбылось); диапазоны идут в рейтинг только после ручной проверки границ.
  • База направления — значение на момент прогноза, а не за день до горизонта. «Средняя за период» считается как среднее ряда за период.
  • Прогнозы про ФРС/ЕЦБ не резолвятся против ставки ЦБ РФ; добавлены источники Brent (EIA/FRED) и золота (LBMA в $/унц., учётные цены ЦБ в ₽/грамм с базисом).
  • Карточка прогноза показывает цель, факт, ошибку, допуск, оператор, источник истины, эффективную дату и причину исхода.
  • Brier-skill начисляется только за явно заявленную вероятность; категориальные и точечные прогнозы без вероятности получают skill 0 (идут в hit-rate, но не штрафуются за подставленную «уверенность») — убрана асимметрия прежней оценки.
  • Сжатие индекса — к паритету (skill 0 → FRI 50), а не к популяционному среднему; σ доверительного интервала оценивается из данных (не ниже 0,5).
  • Главная публичная метрика — доля сбывшихся (hit-rate); FRI предварительный, ярлык «итоговый рейтинг» не присваивается, пока не накопятся вероятностные прогнозы.
v0.1

Первая публичная версия правил.

  • Зафиксирована формула FRI: skill-score против опорной вероятности, веса по горизонту / ясности / тиру источника / свежести, байесовское сжатие к среднему (k = 8), отображение в шкалу 0–100 (50 = паритет).
  • Введены тиры источников T1–T3 и правило резолюции по единственному источнику истины на актив.
  • Введён порог research / preview / final по числу разрешённых сравнимых прогнозов (финал — от 20 на эксперта).

Хотите узнавать, когда мы меняем правила? Напишите нам — добавим вас в список оповещения об изменениях методологии (это отдельный канал от журнала исправлений).

Частые вопросы

Частые вопросы

Можно ли поднять hit-rate, публикуя больше прогнозов?
Нет. В знаменателе только сбывшиеся и несбывшиеся прогнозы; добавить публикаций без попаданий нельзя поднять долю. Открытые и неоднозначные прогнозы в расчёт не входят вовсе.
Можно ли накрутить рейтинг, выбирая лёгкие прогнозы?
Поднять hit-rate публикацией нельзя, но можно отбором лёгких утверждений — например, направлений по трендовому активу вместо точных уровней ставки. Именно поэтому рядом мы показываем разбивку по трудности (страты «тип прогноза × класс актива») и базовую частоту сбываемости по корпусу. Показатель «над базой» вычитает эту базовую частоту, так что зачёт за лёгкие, почти предрешённые прогнозы близок к нулю.
Почему лидерборд отсортирован не по самой доле сбывшихся?
Порядок задаётся нижней границей 95% интервала Уилсона, а не точечным hit-rate. На малой выборке доля неустойчива: «3 из 5» — это 60%, но интервал очень широкий. Сортировка по нижней границе вознаграждает и точность, и размер выборки, поэтому малые выборки не всплывают наверх на шуме.
Считается ли «частично сбылось» как половина попадания?
Нет. Расчёт бинарный: в hit-rate идут только исходы «сбылось» (true) и «не сбылось» (false). Частично сбывшиеся прогнозы исключаются и из числителя, и из знаменателя — частичного зачёта нет.
Почему у автора с высоким hit-rate стоит оговорка о выборке?
Потому что на малом числе прогнозов доля неустойчива: 4 из 4 — это 100%, но интервал очень широкий. Поэтому рядом с hit-rate всегда показаны число прогнозов и период, а рейтингуемыми считаются авторы от 20 разрешённых прогнозов.

Другие страницы методологии

Обновлено