
Проверка, которая отсекает лишние деления
Сегментация существует ради одного: обратиться к разным людям по-разному. Отсюда единственная проверка осмысленности группы — сформулируйте сообщение, которое вы отправите ей и не отправите остальным. Не сформулировалось — деление лишнее, каким бы аккуратным ни выглядела таблица.
Проверка работает и в обратную сторону. Если у вас есть два разных предложения, но нет признака, по которому понятно, кому какое подходит, сегментации не хватает — и это единственная ситуация, когда её стоит усложнять.
Из проверки следует неожиданное для многих: правильное число сегментов определяется не структурой базы, а пропускной способностью команды. Каждая группа требует собственного текста, собственного повода и последующего обновления. Пятнадцать групп при трёх написанных письмах — это три сегмента и двенадцать строк в отчёте.
Второе следствие — сегменты не обязаны покрывать базу целиком. Нормально, когда половина клиентов остаётся в общем потоке, а выделены две-три группы, для которых точно есть что сказать отдельно. Стремление разложить всех по полочкам порождает категорию «прочие», в которую попадает большинство, и деление теряет смысл.
Признаки по убыванию отдачи
Первое деление даёт больше всех остальных вместе взятых: покупал или не покупал. Эти две половины различаются во всём — в том, что им можно предложить, в том, что они уже знают, и в том, сколько стоило их привести. Смешивание их в одном отчёте делает бессмысленными и стоимость привлечения, и пожизненную ценность.
Дальше по убыванию отдачи идут признаки поведения: давность последнего действия, частота покупок, потраченная сумма, состав покупки. Затем — поведение в коммуникации: отвечает, кликает, молчит. И только в конце — описательные признаки: город, возраст, отрасль, должность.
Порядок объясняется тем, что поведение — уже совершённое действие, а описание — гипотеза о действии. Возраст связан с готовностью купить через несколько предположений, каждое из которых может не сработать; повторная покупка связана с готовностью купить напрямую. Ту же ошибку — описывать аудиторию свойствами вместо задач — разбирает материал о портрете целевой аудитории.
Исключение из порядка одно: описательный признак поднимается наверх, если от него зависит само предложение. Разный ассортимент по регионам доставки, разные условия для компаний и частных лиц, разный язык — здесь деление по описанию первично, потому что без него сообщение будет просто неверным.
Что каждый признак даёт и чем ломается
| Признак | Что меняет в обращении | Откуда берутся данные | Где ломается |
|---|---|---|---|
| Покупал или нет | Полностью меняет содержание сообщения | Учётная система, история заказов | Повторные покупки под другим адресом не связываются |
| Давность последней покупки | Момент обращения и его тон | История заказов | Не учитывает естественную частоту потребления товара |
| Частота покупок | Выбор между удержанием и стимулированием | История заказов | На короткой истории неотличима от случайности |
| Сумма за период | Уровень внимания и персональность работы | История заказов | Разовый крупный заказ маскируется под постоянного клиента |
| Состав покупки | Что предлагать следующим | Позиции в заказах | Дробится на сотни категорий, если не сгруппировать |
| Реакция на письма | Частота контактов и канал | Почтовый сервис | Открытия завышаются предзагрузкой изображений |
Строка про давность требует оговорки, из-за которой чаще всего ошибаются. «Не покупал три месяца» означает разное для товара, который берут еженедельно, и для товара, который берут раз в год. Пороги давности выводят из собственного интервала между покупками, а не из календаря; как его считать — в материале о повторных продажах.
Источник большинства строк — CRM-система, а не почтовый сервис. Сервис знает про клики, история сделок знает про деньги, и полезная сегментация начинается там, где эти наборы соединяются.
Деление по трём осям сразу
Отдельный приём — не выбирать один признак, а совместить три: давность последней покупки, частота покупок и сумма за период. Каждую ось делят на несколько уровней, и клиент оказывается в клетке, из которой напрямую следует действие.
Смысл в том, что оси описывают разные вещи и по отдельности вводят в заблуждение. Клиент с большой суммой, который давно не появлялся, и клиент с той же суммой, купивший вчера, — это разные задачи: первого нужно возвращать, второго не трогать. Одна ось «сумма» их не различает.
Практические комбинации выглядят так. Недавние и частые — источник отзывов и рекомендаций, им же безопаснее всего предлагать новое. Давние и крупные — приоритет для возврата, потому что цена ошибки выше всего. Недавние разовые — цель для второй покупки, и работа с ними отличается от работы с постоянными. Давние и мелкие — в общий поток без индивидуальных усилий; попытка вернуть их обычно не окупается, что видно из юнит-экономики.
Границы уровней на каждой оси произвольны, и это главное, о чём стоит помнить. Числа вроде «больше трёх покупок» не следуют ни из чего. Честный способ — посмотреть распределение своей базы по каждой оси и разрезать её на доли примерно равного размера. Такие границы тоже условны, но хотя бы опираются на факт, а не на привычку к круглым цифрам.
Что считать: сегмент, когорта и разница между ними
Слова употребляют рядом, а отвечают они на противоположные вопросы, и путаница между ними портит отчёты.
Сегмент — текущее состояние. Человек в нём не закреплён: активный клиент через полгода молчания переезжает в спящие, а вернувшись — обратно. Сегмент нужен, чтобы решить, что сделать сегодня.
Когорта — дата входа, и она не меняется никогда. Пришедший в марте останется в мартовской когорте, что бы дальше ни произошло. Когорта нужна, чтобы сравнить между собой периоды: как ведут себя пришедшие в марте против пришедших в июне, и не ухудшается ли качество привлечения. Механика подробно разобрана в материале о когортном анализе.
Ошибка возникает, когда динамику пытаются смотреть по сегментам. Доля «активных клиентов» выросла — это может значить и улучшение удержания, и просто приток новых, которые пока по определению активны. Разделить два объяснения сегменты не позволяют, потому что их состав меняется вместе с базой. Когорты позволяют.
Проверять саму сегментацию нужно не аккуратностью деления, а разницей в поведении групп. Три сравнения дают почти всё: отклик на обращение по сегментам, средний доход на клиента по сегментам и доля ушедших в каждом. Если по всем трём группы неразличимы, деление не отражает ничего реального.
Сегментов больше, чем сообщений, которые вы отправляете. Деление построено аналитически, а не под действие. Оставить те группы, для которых уже написан отдельный текст, остальные свернуть в общий поток и вернуться к ним, когда появится повод.
Больше половины базы в категории «прочие». Признаки выбраны редкие или данные заполняются не всегда. Проверить полноту полей в учётной системе и заменить редкий признак на тот, что есть у всех.
Один человек получает три письма подряд из разных сегментов. Группы пересекаются, а приоритет между ними не задан. Установить порядок: сегмент с более редким и более важным поводом отменяет остальные на этот период.
Сегментация построена, отклик не изменился. Деление не связано с готовностью действовать — обычно так бывает при делении по описательным признакам. Пересобрать группы на поведении и сравнить результат параллельно, а не до и после, — механика в материале об A/B-тестах.
Границы: где сегментация не помогает
Приём требует истории, которой у молодой базы нет. Пока покупок мало, любое деление по частоте и сумме описывает случайность: один клиент с двумя заказами формирует целый «сегмент постоянных». Ждать данных неприятно, но альтернатива хуже — решения принимаются по шуму.
Второй предел — разовый продукт. Там, где покупка совершается однажды и не повторяется, оси частоты и давности не работают вовсе, и остаётся деление по составу покупки и по стадии до неё; тогда полезнее оказывается скоринг, выстраивающий очередь среди новых обращений.
Третий — стоимость поддержки. Каждый сегмент требует обновления правил, текстов и проверки, что человек не попал сразу в две группы. Когда время на поддержку превышает выигрыш от точности, разумно упрощать: две работающие группы лучше восьми, из которых половина не обновлялась полгода.
И четвёртое: сегментация не создаёт повода для обращения. Точно выделенная группа, которой нечего сказать, остаётся без писем ровно так же, как и неразделённая база; про поводы — в материале о рассылках и о возврате клиентов.
Для продуктов с регулярным использованием к этим срезам добавляется пара DAU и MAU: их отношение показывает, насколько плотно люди возвращаются, и сегмент с редкими возвратами обычно требует другого разговора, чем активный.
Спорное место
Правило «делить только по поведению» я считаю в целом верным и вижу, где оно даёт сбой.
Поведение — след прошлого. Оно хорошо описывает тех, кто уже что-то сделал, и молчит о тех, кто не сделал ничего. Между тем самая ценная группа часто именно там: люди, подходящие под профиль клиента, но не проявившие активности, потому что до них не дошло ни одно осмысленное сообщение. Поведенческая сегментация оставляет их в общем потоке навсегда, и никакая история не появится, потому что не с чего.
Контраргумент к себе такой: описательные признаки в этой ситуации — не альтернатива, а единственный доступный материал. Обращаться к «компаниям такой-то отрасли» неточно, но лучше, чем не обращаться. Точность здесь покупается не выбором признака, а готовностью ошибиться и посмотреть на результат.
Слабость моей позиции в том, что она не даёт правила перехода. Я не могу сказать, в какой момент описательная гипотеза должна уступить место поведенческим данным — это зависит от объёма базы, длины цикла и цены ошибки, а все три различаются от компании к компании. Практически это значит, что первые сегменты почти всегда строятся на догадках, и единственная защита от самообмана — фиксировать догадку письменно до запуска, чтобы потом было с чем сравнить результат, а не переписывать объяснение задним числом.
Частые вопросы
Сколько сегментов нужно?
Чем сегмент отличается от когорты?
Можно ли сегментировать по возрасту и городу?
Откуда брать данные для сегментации, если истории покупок мало?
Как выбрать границу между сегментами?