Большинство селлеров меняет фото и цену по наитию, а потом гадает, из-за чего изменились продажи — из-за нового креатива, сезона или соседа, который ушёл в минус по цене. A/B-тест снимает эту неопределённость: вы сравниваете два варианта на одном трафике и получаете ответ в цифрах. Разберём процедуру по шагам, от выбора переменной до чтения воронки.
A/B-тест — это сравнение двух версий одного и того же объекта на сопоставимой аудитории. Версия A — то, что есть сейчас (контроль). Версия B — гипотеза, которую вы проверяете. Обе показываются покупателям в одинаковых условиях, после чего вы смотрите, какая набрала лучшие показатели.
Ключевое слово — «в одинаковых условиях». Именно это отличает тест от обычной замены. Когда вы просто ставите новое фото и через неделю сравниваете продажи с прошлой неделей, вы сравниваете не два фото, а две недели. За семь дней могла измениться позиция карточки, начаться или закончиться акция, поменяться погода, зарплатный день, ставки конкурентов. Разделить эти эффекты постфактум невозможно.
На Wildberries классический одновременный A/B-тест по половине трафика недоступен: площадка не даёт показывать разным пользователям разные версии одной карточки. Поэтому на практике используется поочерёдное чередование: вариант A стоит некоторое время, потом автоматически меняется на B, потом снова на A, и так по кругу. Чередование сглаживает влияние времени суток и дня недели — оба варианта получают и утренний трафик, и вечерний, и будни, и выходные.
Это делает A/B-тест карточки на Wildberries технически сложнее, чем в вебе, но принцип остаётся тем же: каждая версия должна набрать сопоставимую выборку в сопоставимых условиях.
Не всё в карточке одинаково влияет на результат и не всё одинаково удобно проверять. Вот основные объекты для теста, примерно в порядке отдачи.
Описание, характеристики и раздел с вопросами тоже влияют на конверсию, но их эффект обычно меньше и измеряется тяжелее — начинать стоит не с них.
Самое частое нарушение методики выглядит так: селлер делает новое фото, на котором одновременно другой фон, другой ракурс, добавлена модель и написан слоган. Вариант B выигрывает 15%. Вопрос: что именно сработало?
Ответ — неизвестно. Возможно, помог фон, а модель, наоборот, отняла часть эффекта. Возможно, всё дал слоган, а остальное нейтрально. Вы получили работающую карточку, но не получили знания, которое можно перенести на другие артикулы. А в следующий раз, применив ту же комбинацию к другому товару, можете получить провал и не понять причину.
Правило простое: в одном тесте меняется одна вещь. Если гипотез несколько, они проверяются последовательно. Победитель первого теста становится контролем для второго.
Из правила есть одно осмысленное исключение. Если задача не изучить механику, а быстро найти лучший вариант из готовых макетов, можно сравнивать целые концепции — например, «студийное фото» против «лайфстайл-сцены». Но тогда честно признавайте, что вы тестируете концепции, а не отдельные элементы, и не делайте выводов вида «модели работают лучше».
До запуска нужно понимать две цифры: сколько показов надо набрать на каждый вариант и сколько дней это займёт. Иначе тест либо оборвётся раньше времени, либо будет тянуться до смены сезона.
Отправная точка — ориентир порядка 10 000 показов на вариант. Он не универсален: если базовый CTR высокий, а ожидаемый эффект крупный, хватит и меньшего объёма; если вы ловите прирост в пару процентов относительно, понадобится в разы больше. Но как рабочая планка для главного фото он подходит.
Длительность считается делением: нужный объём на два варианта, поделить на среднее число показов карточки в сутки. Если карточка получает 4 000 показов в день, а вам нужно по 10 000 на вариант, то это 20 000 показов суммарно, то есть примерно пять дней. Округляйте вверх до целого числа недель, если можете себе позволить, — так в выборку гарантированно попадут и будни, и выходные.
| Показов карточки в сутки | Нужно суммарно | Примерная длительность |
|---|---|---|
| 1 000 | 20 000 | около 20 дней |
| 2 000 | 20 000 | около 10 дней |
| 5 000 | 20 000 | около 4 дней |
| 10 000 | 20 000 | около 2 дней |
| 20 000 | 20 000 | около суток |
Если расчёт даёт больше трёх-четырёх недель, тест лучше не запускать в таком виде: за это время изменится сезон и рыночное окружение, и сравнивать будет уже нечего.
Дальше — сама процедура. Она одинакова и для ручного теста в таблице, и для запуска через сервис; разница только в том, сколько шагов приходится делать руками.
Главная ошибка при чтении итогов — смотреть на одну метрику. Воронка на Wildberries состоит из нескольких шагов, и вариант может выигрывать на одном и проигрывать на следующем.
Полная цепочка выглядит так: показы, переходы в карточку, добавления в корзину, заказы, выкупы. Каждый переход между этапами отвечает за свою часть креатива. Смотреть нужно на все, но принимать решение — по нижним этапам, потому что именно они превращаются в деньги.
| Этап | За что отвечает | Что делать, если вариант B хуже |
|---|---|---|
| Показы | Алгоритм и позиция, не креатив | Убедиться, что варианты получили сопоставимый объём |
| Переходы и CTR | Главное фото, цена, рейтинг в выдаче | Вернуться к главному фото, проверить читаемость в миниатюре |
| Корзина | Остальные фото, описание, цена внутри карточки | Проверить свайп-галерею и соответствие фото ожиданиям |
| Заказы | Цена, отзывы, условия доставки | Смотреть на цену и работу с отзывами, а не на креатив |
| Выкуп | Совпадение товара с обещанием на фото | Проверить, не приукрашивает ли новый вариант товар |
Самый опасный сценарий — вариант с высоким CTR и низким выкупом. Он привлекает кликами, но обманывает ожидания, и в долгую бьёт по рейтингу и юнит-экономике.
Кроме методической причины (непонятно, что сработало) есть и практическая. Резкая одновременная правка фото, цены и заголовка на карточке с историей — это фактически новая карточка для покупателя. Если что-то из изменений сработает в минус, вы увидите общее падение и не сможете быстро откатить именно проблемный элемент.
Второй риск — тестировать одновременно два артикула, которые конкурируют между собой в вашей же выдаче. Трафик перетечёт из одной карточки в другую, и обе метрики будут искажены. Тестируйте по одному товару из связки.
Третье — не запускайте тест в даты крупных распродаж и на границе сезона. Поведение покупателей в такие периоды меняется настолько, что вывод не переносится на обычные дни. Если тест уже идёт и попал в акцию, честнее его перезапустить.
И последнее: не бойтесь, что смена фото сбросит карточку. Ротация изображений — штатная операция, и сама по себе историю карточки не обнуляет. Реальный риск другой: длинный период с заведомо слабым вариантом на большом трафике снижает поведенческие метрики и, как следствие, показы. Именно поэтому объём теста стоит планировать заранее, а не держать эксперимент «пока не надоест».
Вручную A/B-тест ведётся так: будильник на смену фото, выгрузка статистики, ручной перенос в таблицу, сведение по интервалам. Работает, но требует дисциплины и легко ломается, если один раз забыли переключить вариант.
В Вилдоне A/B-тест сравнивает два главных фото по всей воронке. Варианты переключаются автоматически по таймеру, а показы, клики, CTR, добавления в корзину и заказы подтягиваются из официального API статистики воронки продаж Wildberries. Ориентир завершения — порядка 10 000 показов на вариант.
Если задача уже, есть и специализированные форматы. CTR-тест прогоняет десятки вариантов главной картинки и сравнивает их только по кликабельности — удобно, когда гипотез много и нужно быстро отсеять слабые. Свайп-тест сравнивает 2-5 фотографий, идущих после главной, то есть работает с этапом «клик — корзина». Тест цены проверяет, как разные ценники влияют на воронку и итоговую выручку.
Выбор инструмента зависит от того, на каком этапе воронки у вас просадка. Если карточку не открывают — работайте с главным фото. Если открывают, но не кладут в корзину — с галереей и ценой.
Если победил вариант B — ставьте его на постоянку и берите следующую гипотезу. Не останавливайтесь на одном тесте: рост карточки складывается из серии небольших улучшений, а не из одного удачного фото.
Если победил вариант A — это тоже результат, причём ценный. Вы сэкономили деньги, не выкатив изменение, которое сделало бы хуже, и узнали что-то о своей аудитории. Запишите вывод и не проверяйте эту гипотезу второй раз.
Если разница оказалась в пределах погрешности, вариантов два. Либо гипотеза действительно ни на что не влияет — тогда переходите к более смелым идеям, а не к правке оттенка фона. Либо выборки не хватило, чтобы уловить небольшой эффект, — тогда нужно понимать, какой объём требуется под ожидаемый прирост.
И общий принцип: тест отвечает на вопрос, который вы задали, и только на него. Он не скажет, хорошая ли у вас цена, если вы тестировали фото. Держите список гипотез и проходите его по очереди — так за несколько месяцев накапливается понимание ниши, которое конкуренты не смогут скопировать вместе с картинкой.
Нет, площадка не даёт разделять аудиторию и показывать разным покупателям разные версии одной карточки. Поэтому на практике варианты чередуют во времени: A стоит некоторое время, потом B, потом снова A. Частое чередование сглаживает влияние времени суток и дня недели, и результат становится сопоставимым.
Столько, сколько нужно для набора выборки, а не фиксированное число дней. Считайте от трафика: делите нужный объём показов на суточные показы карточки. При ориентире 10 000 показов на вариант карточка с 2 000 показов в сутки наберёт выборку примерно за десять дней. Если по расчёту выходит больше месяца, тест в таком виде лучше не запускать.
Ориентируйтесь на нижние этапы воронки — заказы и выкуп, потому что именно они превращаются в деньги. Высокий CTR при низкой конверсии часто означает, что фото создаёт завышенные ожидания. Такой вариант в долгую вредит рейтингу и проценту выкупа.
Технически можно, но результат будет нечитаемым: вы не поймёте, какой из двух факторов дал эффект и не погасили ли они друг друга. Правильнее проверять последовательно — сначала выбрать главное фото, зафиксировать победителя, затем на нём тестировать цену.
Сама по себе замена изображения историю карточки не обнуляет и штрафа за неё нет. Позиции проседают по другой причине: если слабый вариант долго стоит на большом трафике, ухудшаются поведенческие метрики. Поэтому важно планировать объём теста заранее и не держать эксперимент дольше нужного.
Отключать не обязательно, но менять ставки и запускать новые кампании во время теста нельзя — это меняет структуру трафика и ломает сопоставимость вариантов. Держите рекламные настройки неизменными от начала до конца эксперимента.