7% и 37% открытий на одинаковых показах: Как тестировать статьи в СМИ и не обмануться

Статья в РБК по официальному прайсу стоит 600 000 ₽, редакционный выход через агентство — 50 000–200 000 ₽. После первой же публикации бизнес выносит приговор: работает или не работает. Это вывод по одному наблюдению, и в маркетинге он самый дорогой из всех. Разбираю принципы честного теста и то, как они переносятся на публикации, где классический A/B невозможен: что можно менять, сколько нужно материалов и почему «на прошлой неделе зашло лучше» — не результат.

7% и 37% открытий на одинаковых показах: Как тестировать статьи в СМИ и не обмануться

Фраза, которая закрывает канал на годы, звучит буднично: «Мы пробовали публикации, не сработало».

За ней почти всегда стоит одна статья. Иногда две, вышедшие на разных площадках с разными заголовками и разными темами. По этим данным принимается решение о канале, в котором конкуренты работают годами.

В перформансе так решать давно разучились: там есть слово «тест» и правила, при нарушении которых цифры ничего не значат. В публикациях этих правил не знает почти никто — а они переносятся почти без потерь.

Правило первое: сравнивать можно только одновременное

Контроль и вариант должны жить в одно и то же время на одном и том же трафике. Иначе вы измеряете не свою гипотезу, а сезон, день недели и то, что происходило в ленте.

«В июле статья зашла, в августе такая же провалилась, значит формат выдохся» — это не тест. Это статистическая динамика. В июле у площадки был другой поток материалов, другая новостная повестка и другая конкуренция за внимание в тот конкретный день.

Честный вывод из такой пары наблюдений ровно один: у вас есть два числа. Гипотезы они не подтверждают и не опровергают.

Правило второе: одно наблюдение — это не наблюдение

В вебе стандарт теста — около десяти тысяч уникальных посетителей, по пять тысяч на группу. Чем меньше эффект вы ловите, тем больше нужно людей: разницу в 20% видно на небольшом трафике, разницу в 3% — только на большом.

У публикаций такого объёма нет и не будет. Значит, честный перенос выглядит так: вы не можете доказать разницу в несколько процентов и не должны пытаться. Вы можете увидеть только крупные эффекты — двукратные и больше.

Отсюда практическое следствие. Пять-семь материалов в одном формате — это минимальная серия, на которой видно хоть что-то. Одна статья не говорит ни о площадке, ни о канале, ни о жанре. Она говорит только о самой себе.

Как это выглядит на практике. Вы решаете проверить, что лучше работает в заголовке — цифра или возражение рынка. Берёте не два материала, а шесть: три с цифрой, три с возражением, все на одной площадке, в одной рубрике, с сопоставимыми темами. Смотрите не на лучший результат в каждой тройке, а на худший: случайный успех бывает у любого варианта, а вот стабильно слабое дно — это уже свойство подхода.

Если разрыв между группами меньше чем в полтора раза, вывода нет. Это не повод расстраиваться, это нормальный результат теста: переменная оказалась слабой, идём проверять следующую.

Правило третье: ловушка ранней победы

Самое нарушаемое правило в тестировании — длительность. Минимум две недели, даже если разница видна на третий день, потому что нужно захватить два полных недельных цикла: в будни и в выходные люди читают по-разному.

В публикациях этот срок другой, но ловушка та же. Материал на деловой площадке получает основной поток в первые сутки, а потом переходит на поисковый трафик, который набирается месяцами. Оценка на второй день говорит вам только про ленту.

У меня есть материал, который в первые дни выглядел средне, а сейчас держит 626 открытий — больше всех остальных, потому что попал в поисковый спрос. Если бы я закрыл тему по итогам первой недели, я бы вычеркнул самый живучий формат из всех, что пробовал.

Правило четвёртое: одна переменная за раз

В вебе это звучит как «один путь пользователя — один тест»: если человек одновременно попадает в два эксперимента, вы не знаете, что сработало.

В публикациях это нарушают всегда. Меняют одновременно площадку, тему, заголовок, обложку и жанр — а потом делают вывод про площадку. Данных для такого вывода нет, и уже не будет.

Дисциплина простая: следующая статья отличается от предыдущей одним элементом. Тот же формат и тема, но другой тип заголовка. Или тот же заголовок по конструкции, но другая площадка. Скучно, зато через пять материалов вы знаете, что у вас работает, а не догадываетесь.

Что вообще является переменной в публикации

Прежде чем что-то менять по одному, стоит договориться, из чего материал состоит. Переменных немного, и они очень разные по силе.

Заголовок — самая сильная и самая дешёвая. Это единственное, что видит человек до клика, и единственное, что можно переписать за пять минут. Типов заголовка ограниченное число: цифра в начале, конфликт или возражение рынка, прямой вопрос, обещание метода. Их и стоит перебирать.

Первый абзац. Он решает, останется ли человек после клика. Здесь проверяется одна вещь: подтверждает ли абзац обещание заголовка или начинает издалека, с истории компании и рынка.

Обложка. Влияет слабее заголовка, но заметно, и проверяется только в миниатюре.

Тема и жанр — самая тяжёлая переменная. Разбор, инструкция, исследование, разбор чужой ошибки читаются по-разному, но чтобы это увидеть, нужна серия, а не одна пара материалов.

Площадка. Формально переменная, практически — отдельный эксперимент: у каждой площадки своя аудитория, свои правила ленты и свой поисковый вес.

Порядок перебора логичный: сначала то, что дёшево менять и что сильно влияет, потом всё остальное. То есть заголовок, потом первый абзац, потом жанр — и только потом разговоры о том, что «площадка не та».

Правило пятое: не смешивать разные аудитории

В вебе mobile и desktop анализируют раздельно, даже если тест шёл на общем трафике. Иначе вариант «выигрывает в среднем», а на деле поднял конверсию на одном устройстве и обвалил на другом, где сидит основная аудитория.

В публикациях та же ошибка называется «сложили ленту и поиск».

Вот как это выглядит на моих цифрах. Двадцать шесть материалов в блоге, показы от 364 до 1 079, медиана 619. Доля открытий гуляет от 7,4% до 65,5% — почти девятикратный разброс, из которого хочется сделать громкий вывод.

Но 65,5% — это тот самый материал, который живёт на поиске: его открывают люди, пришедшие по запросу, а не листающие ленту. Смешивать его с остальными нельзя. Если оставить только двадцать статей, попавших в узкий коридор 440–700 показов, разброс сжимается до 7,4–37,5%. Всё равно пятикратный — и вот он уже про заголовок и первый абзац, потому что аудитория и объём показов у них сопоставимы.

Первое число красивее. Второе — единственное, на которое можно опираться.

Правило шестое: смотреть на деньги, а не на конверсию

Главная ловушка тестирования: вариант выигрывает по конверсии и проигрывает по выручке. Скидка подняла продажи, средний чек упал, себестоимость выросла — денег стало меньше.

Для публикаций это переводится так: самый читаемый материал и самый полезный для бизнеса — обычно разные материалы. Текст с провокацией в заголовке соберёт показы и комментарии. Текст с разбором по существу соберёт меньше внимания и приведёт тех, кто через месяц напишет в личку.

Поэтому метрика теста — не показы и даже не открытия, а следующий шаг: сколько человек пришло в расчёт, в диагностику, в личные сообщения, назвало статью на созвоне. Если такой метрики нет, вы тестируете обложку ради обложки.

Правило седьмое: первые сутки — под микроскопом

В вебе первые 24 часа теста смотрят каждый час, потому что технические поломки вылезают именно там: трафик разъехался, вариант сломался на мобильных, события аналитики не отрабатывают.

У публикации свой список на первые сутки. Как выглядит заголовок в ленте — не обрезан ли он на середине мысли. Читается ли обложка в миниатюре, а не на полном экране. Совпадает ли первый абзац с обещанием заголовка. Что спрашивают в комментариях — это бесплатный отчёт о том, что в тексте непонятно.

Поймать ошибку в первый день дешевле, чем на третьей публикации подряд с тем же дефектом.

Что из этого можно делать уже сейчас

Тестировать заголовок до размещения. Написать три варианта, показать их людям из своей ниши в личных сообщениях и спросить не «какой лучше», а «про что это». Вариант, который пересказывают правильно, и есть рабочий.

Проверять обложку миниатюрой. В ленте она шириной около четырёхсот пикселей, и всё, что не читается в этом размере, для читателя не существует.

Держать журнал. Дата, площадка, заголовок, показы, открытия, следующий шаг. Через десять строк там появятся закономерности, которых не видно ни в одной отдельной публикации. В RUPR Agency, где я работаю, такой журнал ведётся по каждому клиенту — не ради отчёта, а потому что без него любой спор о результате упирается в ощущения.

И главное — перестать выносить приговор каналу по одной статье. Это не осторожность, это арифметика.

Что дальше

Тестирование в публикациях выглядит не так, как в рекламе: групп нет, трафика мало, эксперимент растянут на месяцы. Но принципы, которые делают тест честным, никуда не деваются — меняется только масштаб.

В следующем материале разберу, как читать статистику публикации: какие цифры площадка показывает честно, какие вводят в заблуждение и что из них вообще нельзя складывать. Подписывайтесь, если тема близка.

А сколько публикаций было у вас, прежде чем вы решили, работает канал или нет? Если одна-две — интересно, что именно вы по ним поняли: про площадку, про тему или всё-таки про конкретный текст.

3