Медиана

Сегментация базы: по каким признакам делить

Какие признаки деления клиентской базы меняют результат, чем сегмент отличается от когорты, где брать данные и почему дробная сегментация перестаёт работать.

Обновлено 14.09.2026 · 7 мин чтения

Сегментация базы — деление клиентов на группы, к которым обращаются по-разному. Рабочие признаки берутся из поведения: покупал или нет, как давно, как часто, на какую сумму, что именно. Проверка осмысленности одна — сформулировать сообщение, которое уйдёт этому сегменту и не уйдёт остальным. Не получилось, значит группа лишняя.

Коротко

  • Сегмент имеет смысл только тогда, когда из него следует другое сообщение или другой момент обращения; деление, не меняющее действия, — украшение отчёта.
  • Признаки поведения — что человек покупал и когда — предсказывают отклик заметно лучше, чем описательные признаки вроде возраста и города.
  • Сегмент и когорта отвечают на разные вопросы: сегмент группирует по текущему состоянию, когорта — по дате входа и не меняется со временем.
  • Границы между сегментами всегда произвольны, поэтому их выбирают по распределению собственной базы, а не по округлым числам.
  • Число сегментов ограничено не аналитикой, а количеством разных обращений, которые команда способна написать и поддерживать.
Латунный диск, разрезанный на неравные секторы с зазорами между ними

Проверка, которая отсекает лишние деления

Сегментация существует ради одного: обратиться к разным людям по-разному. Отсюда единственная проверка осмысленности группы — сформулируйте сообщение, которое вы отправите ей и не отправите остальным. Не сформулировалось — деление лишнее, каким бы аккуратным ни выглядела таблица.

Проверка работает и в обратную сторону. Если у вас есть два разных предложения, но нет признака, по которому понятно, кому какое подходит, сегментации не хватает — и это единственная ситуация, когда её стоит усложнять.

Из проверки следует неожиданное для многих: правильное число сегментов определяется не структурой базы, а пропускной способностью команды. Каждая группа требует собственного текста, собственного повода и последующего обновления. Пятнадцать групп при трёх написанных письмах — это три сегмента и двенадцать строк в отчёте.

Второе следствие — сегменты не обязаны покрывать базу целиком. Нормально, когда половина клиентов остаётся в общем потоке, а выделены две-три группы, для которых точно есть что сказать отдельно. Стремление разложить всех по полочкам порождает категорию «прочие», в которую попадает большинство, и деление теряет смысл.

Признаки по убыванию отдачи

Первое деление даёт больше всех остальных вместе взятых: покупал или не покупал. Эти две половины различаются во всём — в том, что им можно предложить, в том, что они уже знают, и в том, сколько стоило их привести. Смешивание их в одном отчёте делает бессмысленными и стоимость привлечения, и пожизненную ценность.

Дальше по убыванию отдачи идут признаки поведения: давность последнего действия, частота покупок, потраченная сумма, состав покупки. Затем — поведение в коммуникации: отвечает, кликает, молчит. И только в конце — описательные признаки: город, возраст, отрасль, должность.

Порядок объясняется тем, что поведение — уже совершённое действие, а описание — гипотеза о действии. Возраст связан с готовностью купить через несколько предположений, каждое из которых может не сработать; повторная покупка связана с готовностью купить напрямую. Ту же ошибку — описывать аудиторию свойствами вместо задач — разбирает материал о портрете целевой аудитории.

Исключение из порядка одно: описательный признак поднимается наверх, если от него зависит само предложение. Разный ассортимент по регионам доставки, разные условия для компаний и частных лиц, разный язык — здесь деление по описанию первично, потому что без него сообщение будет просто неверным.

Что каждый признак даёт и чем ломается

ПризнакЧто меняет в обращенииОткуда берутся данныеГде ломается
Покупал или нетПолностью меняет содержание сообщенияУчётная система, история заказовПовторные покупки под другим адресом не связываются
Давность последней покупкиМомент обращения и его тонИстория заказовНе учитывает естественную частоту потребления товара
Частота покупокВыбор между удержанием и стимулированиемИстория заказовНа короткой истории неотличима от случайности
Сумма за периодУровень внимания и персональность работыИстория заказовРазовый крупный заказ маскируется под постоянного клиента
Состав покупкиЧто предлагать следующимПозиции в заказахДробится на сотни категорий, если не сгруппировать
Реакция на письмаЧастота контактов и каналПочтовый сервисОткрытия завышаются предзагрузкой изображений

Строка про давность требует оговорки, из-за которой чаще всего ошибаются. «Не покупал три месяца» означает разное для товара, который берут еженедельно, и для товара, который берут раз в год. Пороги давности выводят из собственного интервала между покупками, а не из календаря; как его считать — в материале о повторных продажах.

Источник большинства строк — CRM-система, а не почтовый сервис. Сервис знает про клики, история сделок знает про деньги, и полезная сегментация начинается там, где эти наборы соединяются.

Деление по трём осям сразу

Отдельный приём — не выбирать один признак, а совместить три: давность последней покупки, частота покупок и сумма за период. Каждую ось делят на несколько уровней, и клиент оказывается в клетке, из которой напрямую следует действие.

Смысл в том, что оси описывают разные вещи и по отдельности вводят в заблуждение. Клиент с большой суммой, который давно не появлялся, и клиент с той же суммой, купивший вчера, — это разные задачи: первого нужно возвращать, второго не трогать. Одна ось «сумма» их не различает.

Практические комбинации выглядят так. Недавние и частые — источник отзывов и рекомендаций, им же безопаснее всего предлагать новое. Давние и крупные — приоритет для возврата, потому что цена ошибки выше всего. Недавние разовые — цель для второй покупки, и работа с ними отличается от работы с постоянными. Давние и мелкие — в общий поток без индивидуальных усилий; попытка вернуть их обычно не окупается, что видно из юнит-экономики.

Границы уровней на каждой оси произвольны, и это главное, о чём стоит помнить. Числа вроде «больше трёх покупок» не следуют ни из чего. Честный способ — посмотреть распределение своей базы по каждой оси и разрезать её на доли примерно равного размера. Такие границы тоже условны, но хотя бы опираются на факт, а не на привычку к круглым цифрам.

Что считать: сегмент, когорта и разница между ними

Слова употребляют рядом, а отвечают они на противоположные вопросы, и путаница между ними портит отчёты.

Сегмент — текущее состояние. Человек в нём не закреплён: активный клиент через полгода молчания переезжает в спящие, а вернувшись — обратно. Сегмент нужен, чтобы решить, что сделать сегодня.

Когорта — дата входа, и она не меняется никогда. Пришедший в марте останется в мартовской когорте, что бы дальше ни произошло. Когорта нужна, чтобы сравнить между собой периоды: как ведут себя пришедшие в марте против пришедших в июне, и не ухудшается ли качество привлечения. Механика подробно разобрана в материале о когортном анализе.

Ошибка возникает, когда динамику пытаются смотреть по сегментам. Доля «активных клиентов» выросла — это может значить и улучшение удержания, и просто приток новых, которые пока по определению активны. Разделить два объяснения сегменты не позволяют, потому что их состав меняется вместе с базой. Когорты позволяют.

Проверять саму сегментацию нужно не аккуратностью деления, а разницей в поведении групп. Три сравнения дают почти всё: отклик на обращение по сегментам, средний доход на клиента по сегментам и доля ушедших в каждом. Если по всем трём группы неразличимы, деление не отражает ничего реального.

Симптом → причина → что делать

Сегментов больше, чем сообщений, которые вы отправляете. Деление построено аналитически, а не под действие. Оставить те группы, для которых уже написан отдельный текст, остальные свернуть в общий поток и вернуться к ним, когда появится повод.

Больше половины базы в категории «прочие». Признаки выбраны редкие или данные заполняются не всегда. Проверить полноту полей в учётной системе и заменить редкий признак на тот, что есть у всех.

Один человек получает три письма подряд из разных сегментов. Группы пересекаются, а приоритет между ними не задан. Установить порядок: сегмент с более редким и более важным поводом отменяет остальные на этот период.

Сегментация построена, отклик не изменился. Деление не связано с готовностью действовать — обычно так бывает при делении по описательным признакам. Пересобрать группы на поведении и сравнить результат параллельно, а не до и после, — механика в материале об A/B-тестах.

Границы: где сегментация не помогает

Приём требует истории, которой у молодой базы нет. Пока покупок мало, любое деление по частоте и сумме описывает случайность: один клиент с двумя заказами формирует целый «сегмент постоянных». Ждать данных неприятно, но альтернатива хуже — решения принимаются по шуму.

Второй предел — разовый продукт. Там, где покупка совершается однажды и не повторяется, оси частоты и давности не работают вовсе, и остаётся деление по составу покупки и по стадии до неё; тогда полезнее оказывается скоринг, выстраивающий очередь среди новых обращений.

Третий — стоимость поддержки. Каждый сегмент требует обновления правил, текстов и проверки, что человек не попал сразу в две группы. Когда время на поддержку превышает выигрыш от точности, разумно упрощать: две работающие группы лучше восьми, из которых половина не обновлялась полгода.

И четвёртое: сегментация не создаёт повода для обращения. Точно выделенная группа, которой нечего сказать, остаётся без писем ровно так же, как и неразделённая база; про поводы — в материале о рассылках и о возврате клиентов.

Для продуктов с регулярным использованием к этим срезам добавляется пара DAU и MAU: их отношение показывает, насколько плотно люди возвращаются, и сегмент с редкими возвратами обычно требует другого разговора, чем активный.

Спорное место

Правило «делить только по поведению» я считаю в целом верным и вижу, где оно даёт сбой.

Поведение — след прошлого. Оно хорошо описывает тех, кто уже что-то сделал, и молчит о тех, кто не сделал ничего. Между тем самая ценная группа часто именно там: люди, подходящие под профиль клиента, но не проявившие активности, потому что до них не дошло ни одно осмысленное сообщение. Поведенческая сегментация оставляет их в общем потоке навсегда, и никакая история не появится, потому что не с чего.

Контраргумент к себе такой: описательные признаки в этой ситуации — не альтернатива, а единственный доступный материал. Обращаться к «компаниям такой-то отрасли» неточно, но лучше, чем не обращаться. Точность здесь покупается не выбором признака, а готовностью ошибиться и посмотреть на результат.

Слабость моей позиции в том, что она не даёт правила перехода. Я не могу сказать, в какой момент описательная гипотеза должна уступить место поведенческим данным — это зависит от объёма базы, длины цикла и цены ошибки, а все три различаются от компании к компании. Практически это значит, что первые сегменты почти всегда строятся на догадках, и единственная защита от самообмана — фиксировать догадку письменно до запуска, чтобы потом было с чем сравнить результат, а не переписывать объяснение задним числом.

Частые вопросы

Сколько сегментов нужно?

Столько, сколько разных обращений вы реально подготовите и обновите. Пятнадцать групп в таблице и три письма на всех означают, что тринадцать делений существуют только на бумаге. Практический ориентир: начинать с двух-трёх крупных групп, добавлять следующую тогда, когда для предыдущей уже написан отдельный сценарий и он работает.

Чем сегмент отличается от когорты?

Сегмент группирует по текущему признаку, и человек переходит между сегментами: сегодня активный, через полгода спящий. Когорта закрепляется датой входа и не меняется никогда — тот, кто пришёл в марте, останется в мартовской когорте навсегда. Сегменты нужны для обращения, когорты — для сравнения периодов между собой.

Можно ли сегментировать по возрасту и городу?

Можно, но отдача обычно ниже, чем от поведенческих признаков. Описательные данные говорят, кем человек является, а не что он собирается делать. Они оправданы там, где напрямую влияют на предложение: разная доставка, разный ассортимент, разный язык общения. Во всех прочих случаях они делят базу красиво и бесполезно.

Откуда брать данные для сегментации, если истории покупок мало?

Из поведения на сайте и в переписке: какие разделы смотрели, на какой материал подписались, отвечали ли. Эти признаки слабее покупочных, но доступны сразу. Параллельно стоит завести минимальный набор полей в учётной системе, иначе через год ситуация повторится — база выросла, а делить её по-прежнему не по чему.

Как выбрать границу между сегментами?

По распределению собственных данных, а не по круглым числам. Постройте распределение клиентов по признаку и посмотрите, где оно естественно разрывается. Граница «покупал больше трёх раз» взята из воздуха; граница, отделяющая четверть базы с наибольшей частотой покупок, хотя бы опирается на факт.

Источники

  1. Сегментация рынка — Wikipedia
  2. Cohort analysis — Wikipedia
Артём Строев
Пишу про измеримый маркетинг и видимость в ИИ-поиске. Публикуюсь под псевдонимом — почему так.