Перейти к содержанию

Сравнимые группы материалов

В большой библиотеке рядом находятся подробные курсы, короткие рецепты, справочные страницы и самостоятельные демонстрации. У каждого формата своя задача. Если сравнивать их одним процентом переходов, можно принять нормальное поведение справочника за недостаток, а частое нажатие на кнопку — за доказательство качества урока.

Построим правило сравнимых групп. Наши вымышленные данные по xml и markdown сохраняются, но двух документов недостаточно для вывода обо всей аудитории. Они помогут показать отбор и знаменатели. Реальная библиотека ProfessorWeb содержит разные платформы и исторические версии; существование материала не означает, что его задача и аудитория совпадают с новым курсом.

Основание группы

Группа определяется вопросом исследования. Для проверки переходов между главами подходят материалы с заданным продолжением. Для использования примеров — статьи с доступной ссылкой исходника. Для поиска быстрого ответа — справочные документы. Основной раздел каталога помогает найти материал, но сам по себе не определяет одинаковую модель поведения.

В нашем упражнении XML условно представляет прикладной разбор, а Markdown — объяснение устройства статического проекта. Эта характеристика относится к учебному примеру, не к доказанной классификации всех старых страниц. Событие sample_download одинаково называется на обеих страницах, однако необходимость исходника может различаться из-за назначения текста.

Сначала сохраните карту ID и задач. Например, «подробный урок с продолжением», «самостоятельный рецепт», «справочная таблица». Значения задаются редакцией и проверяются чтением. Не создавайте сотни категорий по каждой версии заголовка: тогда группы окажутся настолько маленькими, что сравнение будет зависеть от единичных действий.

Признак Зачем нужен Ошибочное применение
Задача материала Выбрать соответствующее действие Считать каждую статью частью курса
Наличие исходника Понять доступный сценарий Назначить ноль странице без ссылки
Возраст после публикации Сопоставить стадии выпуска Сравнить первый день и полный год
Версия маршрута Сохранить последовательность Смешать старое и новое продолжение

Если на странице нет ссылки исходника, ноль скачиваний не описывает отказ посетителей. У действия отсутствовала возможность. Для соответствующего отчёта материал исключается либо отмечается отдельным состоянием. Иначе средний показатель группы будет зависеть от устройства страницы, а редактор прочитает его как интерес к примеру.

Одинаковые документы между периодами

В page-summary.csv обе недели содержат xml и markdown. Это позволяет сравнить прежний набор. Для W1 сумма открытий равна 180, для W2 — 220. Если бы во второй период добавили десять новых документов, общий итог уже отвечал бы на вопрос о расширенном составе, а не только о двух прежних статьях.

Поэтому при росте каталога полезны два отчёта: фиксированный набор и весь текущий выпуск. Первый показывает изменение наблюдений по сопоставимым ID. Второй описывает библиотеку вместе с новым содержанием. Они дополняют друг друга, но должны иметь отдельные подписи и не подменять один вопрос другим.

Идентификатор сохраняется при изменении заголовка и рубрики. Переезд файла Markdown внутри репозитория тоже не должен случайно создавать новый ID документа. Это продолжает принцип постоянного URL. Если материал действительно разделили на две самостоятельные темы, решение по истории принимается явно: новые документы не объявляются тем же объектом только ради непрерывной диаграммы.

Для старых страниц важно учитывать версию инструкции. Сохранённый урок EF6 и новый материал EF Core могут быть связаны переходом, но это разные задачи и условия запуска. Аналитика не даёт основания удалить старый адрес из-за меньшей доли продолжений. Сначала изучается его назначение, полезность и связь с актуальным маршрутом, а сохранение важных URL остаётся отдельным требованием проекта.

Возраст материала и календарный период

Новая статья ещё не успела получить те же каналы распространения, что давний популярный документ. Сравнение первого дня публикации с многолетним материалом смешивает разные стадии. Для исследования запуска можно выбрать одинаковое время с выпуска, а для текущего состояния — общий календарный период. Эти два варианта имеют разные преимущества.

Окно с выпуска удобно для сопоставления нескольких новых серий, но календарные условия могут различаться: праздники, рекламные размещения или изменение спроса. Общая неделя удерживает эти условия ближе, однако статьи будут иметь разный возраст. Универсального идеального окна нет; выбирайте его под вопрос и указывайте ограничения рядом с результатом.

Наш W1/W2 — условные семидневные периоды, а не опубликованные даты двух курсов. Мы не можем вывести возраст материалов из их названий. Если исследование требует возраста, этот признак добавляется из редакционного реестра. Отсутствующее поле не заполняется предположением, что Markdown обязательно новее XML в каждой будущей библиотеке.

Состав аудитории

Одинаковая группа документов ещё не означает одинаковый входящий поток. Устройства, источники и выбранные регионы могут различаться. Например, публикация для начинающих приведёт людей, которым нужен общий разбор, а ссылка из технического обсуждения — тех, кто ищет конкретный фрагмент. Их разные действия не доказывают изменение качества страницы.

Сегментация помогает удержать часть условий, но усложняет выборку. Слишком подробный отбор оставит несколько открытий, где один переход резко меняет процент. Поэтому сохраняйте числитель, знаменатель и правило группы. Не выдавайте маленькую разницу за устойчивый результат только потому, что фильтр имеет длинное точное описание.

Метрика позволяет задавать условия сегментов и показывает область их применения. GA4 различает области действия измерений; это важно, когда вы соединяете события с характеристиками пользователя. Сначала проверьте, что выбранный инструмент отвечает вашему вопросу, а затем сравнивайте значения. Сегменты Метрики, пользовательские измерения GA4.

Взвешивание и общий итог

Для W2 доля продолжений Markdown равна 25%, XML — 10%. Среднее этих процентов равно 17,5%, но общий показатель 40/220 составляет примерно 18,18%. Разница возникает потому, что Markdown имеет 120 открытий, XML — 100. Одна статья получает больший вес по выбранному знаменателю.

Если вопрос — «средний показатель статьи», равный вес документов может быть сознательным выбором. Если вопрос — «отношение всех продолжений ко всем открытиям», нужны суммы. Не существует обязанности всегда использовать одну формулу; существует обязанность объяснить, какую сущность вы усредняете. Подпись и метод расчёта должны совпадать.

При отчёте по большой рубрике сначала показывайте агрегат и несколько значимых составляющих. Это помогает заметить, что общий рост связан с одним новым документом или другим составом открытий. Не превращайте каждую мелкую группу в самостоятельную историю успеха. Анализ должен помогать редактору выбрать работу, а не максимизировать число диаграмм.

Теперь мы можем задать группу так, чтобы она соответствовала назначению материалов и сохраняла условия наблюдения. Такой отбор понадобится в следующем уроке: сравнение до и после правки должно начинаться с тех же ID, версии маршрута и определения события, а уже затем с процентов изменения.