Тема письма B победила с отрывом в 18% по открытиям. Через две недели ее раскатали на всю базу — и получили цифры хуже, чем у старой версии. С командами, которые запускают mindbox ab тестирование «по инструкции платформы», такое случается регулярно. Инструмент считает честно. Ломается все раньше — на дизайне эксперимента.
Ниже — как настроить ab тест в mindbox по шагам: и в массовой рассылке, и в триггерном сценарии. И отдельно — места, где платформа сама, без предупреждения, сужает и смещает вашу выборку, плюс способы это компенсировать. Разбирает Екатерина Чернова, CRM-маркетолог ClientCore: она ведет CRM-проекты на Mindbox и не раз переделывала эксперименты, чьи результаты не сходились при повторном запуске.
«Скидка 10%, бонусы или подарок к заказу — что принесет больше маржи? Разбираем методику A/B-теста промокодов: от гипотезы и выборки до подсчета uplift по деньгам.»
A/B-тест промокодов: как выбрать механику акции и не раздать маржуЧто умеет A/B-тестирование в Mindbox
Тесты живут в двух местах, и логика работы с ними разная.
Первое место — массовые рассылки. Внутри кампании создаются варианты письма: другая тема, другой контент, другое имя отправителя. Платформа отправляет варианты части аудитории, ждет заданное время, определяет победителя по выбранной метрике и докатывает его на остаток базы.
Второе — сценарии. В триггерную цепочку добавляется блок А/Б-теста: он случайно делит поток клиентов на ветки в заданной пропорции. Здесь тестируют уже цепочки целиком — разные серии писем, каналы, паузы между касаниями.
Отдельно стоит глобальная контрольная группа. Она отвечает на другой вопрос — сколько денег приносит CRM-канал сам по себе. Путать ее с тестом вариантов не стоит.
Настройка теста в массовой рассылке: шесть шагов
1. Сформулируйте гипотезу в одну переменную. «Новая тема поднимет открытия» — годится. «Новая тема и пересобранный баннер поднимут продажи» — нет: если сработает, вы не узнаете, что именно. 2. Соберите рассылку и включите А/Б-тест в настройках кампании. 3. Добавьте варианты. Вариант A — текущая версия, она же контроль. Вариант B — копия с одним изменением. 4. Задайте долю тестовой группы. Рабочий стандарт — 20–30% базы на тест, остаток получит победителя. 5. Выберите метрику победителя и длительность теста. Для темы письма — клики и 4 часа минимум. Для оффера — конверсия и сутки. 6. Запустите и до конца теста не трогайте ничего: ни варианты, ни сегмент, ни время отправки.

Екатерина Чернова
CRM-маркетолог, ClientCore
Тест в сценарии: настройка и две особенности
Порядок действий простой:
1. Откройте сценарий и добавьте блок А/Б-теста в нужной точке цепочки. 2. Задайте пропорцию веток — для двух вариантов это 50/50. 3. Постройте ветки. Например, в A — серия из двух писем, в B — одно письмо и пуш. 4. Запустите сценарий и ждите, пока через блок пройдет достаточно клиентов.
Дальше начинаются особенности. Первая: поток через триггер идет медленно. Если брошенную корзину оставляют 300 человек в день, каждая ветка набирает по 150 — до статистически честного вывода пройдут недели. Вторая: правки сценария на лету смешивают когорты. Клиенты, прошедшие блок до изменения и после, попадают в один отчет, и разделить их уже нельзя.
Триггеры при этом отличный полигон для экспериментов: поток стабильный, когорты сопоставимые. Когда мы перезапускали email-маркетинг для AR Fashion, именно триггерные рассылки дали +1063% к выручке канала (кейс) — на таком объеме тесты внутри сценариев набирают значимость за вменяемый срок.
Где Mindbox режет выборку
Теперь главное — что платформа делает с экспериментом без вашего ведома.
Живой сегмент. Массовая рассылка пересчитывает сегмент перед каждой отправкой. Между тестом и докаткой проходят часы, и состав остатка уже другой: кто-то вошел в сегмент, кто-то вышел. Сравнивать «тест» и «остаток» как единую выборку некорректно.
Случайное деление без выравнивания. Платформа раскидывает клиентов по вариантам случайно, но не балансирует группы по признакам. На больших объемах все выровняется само. На сегменте в 2 000 человек в вариант B легко попадет лишняя доля «горячих» клиентов — и он победит незаслуженно.
Докатка в другое время. Победитель уходит остатку через 4–24 часа после старта. Утренний тест и вечерняя докатка живут в разном контексте: другая открываемость, другое настроение аудитории. Метрика победителя на остатке почти всегда отличается от тестовой, и причина тут — время отправки.
Открытия как метрика. После Apple Mail Privacy Protection открытия у заметной части базы фиксируются автоматически, без реального просмотра. Тест тем по open rate сегодня измеряет не интерес читателя, а долю Apple-почты в сегменте.
Отчет без статистики. Mindbox покажет цифры по вариантам и подсветит лидера, но не скажет, значима ли разница. 52% против 48% на выборке в 400 человек — это шум, а в отчете будет «победитель».
Нет нарезки по сегментам. Отчет по тесту — одна таблица на всю аудиторию. Выиграл ли вариант у новых клиентов, но проиграл постоянным — отсюда не видно. Придется смотреть через выгрузки и ручное сравнение сегментов.

Екатерина Чернова
CRM-маркетолог, ClientCore

