Experiments / Statistics

Калькулятор поправки для мультивариантного A/B

Чем больше вариантов в тесте - тем выше шанс случайно найти 'победителя' там, где его нет. Поправка Bonferroni - самый простой способ контролировать это, ценой роста выборки.

Формула
α_corr = α / m, где m = число сравнений с контролем. Инфляция выборки ≈ (z_corr / z_base)²
Главный результат
Скорректированный α (Bonferroni)
1,667%

Без поправки familywise-риск ложного срабатывания ≈ 14,3% при 3 сравнениях.

Поправка умеренная: проще принять её и спать спокойно, чем потом разбирать ложного 'победителя'.

Исходные данные

Сравнений с контролем
3
На столько частей делится α при Bonferroni.
Инфляция выборки
×1,21
Во сколько раз увеличивается требуемая выборка на вариант.
Familywise-риск
14,3%
Шанс хотя бы одной ложной 'победы' без поправки.
z_α/2 после поправки
2,241
Критическое значение для скорректированного α.
Что делать дальше
  • Не запускайте 5+ вариантов 'на всякий случай': это почти всегда означает раздутую выборку или скрытое peeking.
  • Bonferroni - консервативная поправка. Если она 'убивает' тест, можно перейти к Holm-Bonferroni или контролю FDR.
  • Если гипотезы независимые и слабые - лучше разбить на серию последовательных A/B, чем один большой мульти-тест.
  • Для real-world продукта гораздо важнее снизить число вариантов, чем выбрать модную поправку.
Сохранить или обсудить

PDF собирается в браузере - мы не сохраняем ваши данные. Письмо открывается в вашем почтовом клиенте - вы сами решаете, что отправить.

Следите за темпом

Performance ломается не только CPA: budget pacing и frequency часто объясняют провалы раньше отчёта по продажам.

Креатив - расходник

Один победитель не живёт вечно. Планируйте ротацию до того, как CTR и CVR рухнут.

Считайте качество

Лайки, клики и сохранения имеют разную ценность. Сравнивайте weighted-сигналы.

Улучшайте CVR

Иногда прирост посадочной дешевле покупки нового трафика в том же канале.

Связанные калькуляторы

Вопросы и ответы

При 4 вариантах против контроля и α=5% шанс хотя бы одной случайной 'победы' - около 14%. Поправка возвращает контроль на уровень 5%.

Нет, она самая консервативная. Holm-Bonferroni и BH (FDR) дают больше мощности, но сложнее в интерпретации.

Если вы реально их делаете - да, поправка должна быть больше. На практике сравнивают каждый вариант с контролем.

Сократите число вариантов или объедините близкие гипотезы - это честнее, чем игнорировать поправку.