B2B-метрики и A/B ломаются, когда вы путаете “пользователь” и “аккаунт” как единицу анализа.
Ситуация узнаваемая: продуктовая команда считает конверсию по юзерам, маркетинг рапортует по аккаунтам, а в эксперименте рандомизация вообще на уровне куки. В итоге “победитель” в отчёте есть, а в продажах и в продукте эффекта нет. Цена ошибки простая: вы принимаете решения по шуму и систематически переоцениваете изменения, которые просто перераспределили активность внутри одного и того же клиента.
Почему так происходит: в B2B один аккаунт почти всегда мультипользовательский. У людей разные роли (пользователь, админ, закупщик), разные пути и разные тайминги. Действие одного человека меняет вероятность действия другого. Плюс циклы закупки длинные, лиды дублируются, один и тот же аккаунт приходит через несколько каналов. Если вы режете это “по людям”, вы нарушаете независимость наблюдений и получаете эффект масштаба, которого нет.
Минимальный стандарт, чтобы не самообмануться:
- Выберите единицу под решение. Если решение про выручку, удержание и закупку — по аккаунтам. Если про UX внутри продукта (активация фичи, скорость выполнения задач) — можно по пользователям, но с оговорками.
- Единица метрики должна совпадать с единицей рандомизации. Если тест раздаёте на уровне аккаунта, считайте метрики на уровне аккаунта. И наоборот. Смешивание уровней — красный флаг.
- Зафиксируйте “кто считается”. В аккаунте могут быть гостевые, временные, сервисные, бывшие сотрудники. Правила включения/исключения важнее “красивой” конверсии.
- Разведите роли и этапы воронки. Отдельно смотрите действия пользователей, отдельно — сигналы аккаунта (создано, активировано, оплачено, расширено). И не пытайтесь одним числом описать всё.
- Наведите порядок с идентичностью: дедуп лидов, маппинг доменов и компаний, мердж аккаунтов, история переименований. Без этого любые сравнения x_vs_y превращаются в спор о том, чьи дубликаты “правильнее”.
В нормальной практике сначала определяют, где возникает эффект (внутри пользователя или на уровне компании), и только потом выбирают разрез отчёта и дизайн эксперимента. Обычно спорят про “давайте всё считать по юзерам, их больше” — но в B2B больше наблюдений не значит больше правды. Граница простая: если пользователи внутри аккаунта влияют друг на друга, аккаунт почти всегда первичен.