ФиксИнтернет-магазин на 1С-Битрикс под ключ за 30 дней по фиксированной цене

Разбор: как фильтры съедали краулинговый бюджет

Разбор: как комбинации умного фильтра 1С-Битрикс съедали краулинговый бюджет и мешали индексации каталога

Каталог из нескольких сотен товаров, а в отчётах поисковика — сотни тысяч просканированных страниц, большинство из которых так и не попали в индекс. Важные карточки индексируются вяло, органический трафик не растёт, хотя товар и контент есть. Знакомая картина? За ней почти всегда стоит один виновник — умный фильтр, чьи комбинации незаметно съели весь краулинговый бюджет сайта.

Это обобщённый разбор типичной проблемы, а не история конкретного клиента — без названий и выдуманных точных цифр, но с узнаваемым паттерном и типовым результатом. Разберём, как фильтр порождает лавину URL, как это диагностировать и как навести порядок средствами 1С-Битрикс, не потеряв ценные посадочные страницы. Системную сторону закрывает аудит и оптимизация 1С.

Коротко

  • Комбинации умного фильтра плодят десятки тысяч почти пустых URL, на которые уходит краулинговый бюджет.
  • Робот тратит лимит на мусор, а важные карточки и категории индексируются медленно или выпадают.
  • Решение — не «закрыть всё», а отделить ценные фильтровые посадочные от мусорных комбинаций.
  • Инструменты: канонические адреса, метатеги индексации, ЧПУ для ценных фильтров, правила обхода.

О чём этот разбор

Сразу оговоримся: это собирательный случай, а не конкретный проект. Мы описываем паттерн, который повторяется на многих каталогах, и типовой эффект от его исправления, намеренно без точных цифр «стало столько-то». Так материал работает как диагностическая карта: вы сверяете свои симптомы и понимаете, есть ли у вас та же болезнь.

Проблема коварна тем, что невидима для посетителя. Пользователь фильтром доволен — он быстро находит товар. А вред происходит на стороне поискового робота, куда владелец обычно не заглядывает. Поэтому сначала разберёмся, что вообще происходит под капотом.

Что такое краулинговый бюджет

Краулинговый бюджет — это объём страниц, который поисковый робот готов обойти на вашем сайте за отведённое время. Ресурс ограничен: у робота есть лимит частоты обращений (чтобы не перегружать сервер) и лимит по объёму, зависящий от авторитета и размера сайта. Он не обходит всё подряд бесконечно — он выбирает, куда потратить визиты.

Для маленького сайта это неважно: робот успевает обойти всё. Но для большого каталога бюджет становится дефицитным ресурсом. И тут ключевой вопрос: на что робот его тратит — на ваши товары и категории, которые должны продавать, или на бесконечные технические страницы фильтров, которые не нужны никому. От ответа зависит, попадут ли важные страницы в индекс.

Как задача превращается в результат Задачачто решаемПодходкак делаемРеализацияна 1С-БитриксПроверкаметрики, тестыРезультатэффект для бизнеса
Схема: любая доработка проходит путь от постановки задачи к реализации на 1С-Битрикс и проверке по метрикам — важен измеримый результат, а не факт правки.

Как умный фильтр порождает лавину URL

Умный фильтр на 1С-Битрикс (компонент catalog.smart.filter) — мощный инструмент: он позволяет комбинировать значения свойств и мгновенно показывать подходящие товары. Но именно комбинаторика становится проблемой для индексации, если каждая комбинация открывается по своему индексируемому адресу.

Математика беспощадна. Возьмём каталог с несколькими свойствами: цвет, размер, бренд, диапазон цены. Каждое сочетание значений — отдельный URL. Несколько десятков значений в разных свойствах перемножаются и дают десятки тысяч комбинаций. Каталог из пятисот товаров превращается для робота в сайт из сотен тысяч страниц, где большинство — почти пустые, дублирующие друг друга или ведущие на один-два товара.

Комбинаторный взрыв: проблема не в числе товаров, а в числе сочетаний фильтров. Именно перемножение свойств превращает небольшой каталог в бесконечный лабиринт URL для поискового робота.

Симптомы: что видно в отчётах

Проблема проявляется в характерных признаках, которые легко узнать, если знать, куда смотреть.

Каждый симптом по отдельности можно списать на что-то другое, но вместе они складываются в узнаваемую картину: бюджет утекает в фильтры. Дальше нужна точная диагностика.

Почему это бьёт по продажам

Казалось бы, техническая мелочь — но она напрямую бьёт по деньгам. Органический трафик — один из самых выгодных каналов: он бесплатный и приводит людей с намерением купить. Когда важные карточки и категории плохо индексируются, магазин недополучает именно этот трафик, а вместе с ним и продажи.

Вдобавок активный робот, обходящий десятки тысяч мусорных страниц, создаёт лишнюю нагрузку на сервер и базу — каждая такая страница часто считается динамически. Это отъедает ресурсы у реальных посетителей и может замедлять сайт. Так что наведение порядка в фильтрах улучшает сразу и индексацию, и стабильность под нагрузкой. Скоростную сторону поддерживает правильная инфраструктура на BitrixVM.

Диагностика по логам и вебмастеру

Прежде чем чинить, нужно измерить. Диагностика опирается на два источника данных.

  1. Панели вебмастеров. Отчёты об индексации показывают долю просканированных, но не проиндексированных страниц и типы мусорных URL.
  2. Логи сервера. В них видно, куда именно и как часто ходит робот — какая доля его визитов приходится на страницы фильтров.
  3. Карта индексации. Сопоставление: какие важные страницы в индексе, какие выпали, сколько мусора висит.
  4. Анализ параметров. Разбор структуры URL фильтров — какие сочетания порождают лавину.

Только на основе этих данных принимают решения. Чинить вслепую, закрывая всё подряд, опасно: можно выкинуть из индекса и ценные посадочные страницы вместе с мусором.

Ценные фильтры против мусорных

Ключевая мысль всего разбора: не все фильтровые страницы вредны. Часть из них — ценные посадочные под реальный спрос. Если люди ищут «красные кроссовки такого-то бренда», страница такого фильтра должна быть в индексе, с человекопонятным URL и оптимизированными метатегами — она приводит целевой трафик.

Проблема только в бесконечных технических комбинациях, под которые никто не ищет: случайные сочетания трёх-четырёх свойств, диапазоны цены, дубли. Их из индекса убирают. Смысл работы — не «закрыть все фильтры», а провести границу: ценные посадочные оставить и усилить, мусорные комбинации закрыть.

Тип страницы фильтраЕсть спрос?Что делать
Одно ценное свойство (бренд, категория)ДаИндексировать, ЧПУ, метатеги
Популярная связка (бренд + тип)ДаПосадочная, оптимизировать
Случайная комбинация 3–4 свойствНетЗакрыть от индекса
Диапазоны цены, сортировкиНетКанонический адрес, закрыть

Инструменты наведения порядка

Правильное решение сочетает несколько инструментов, а не одну «волшебную кнопку».

Инструменты работают вместе: canonical убирает дубли, метатеги — мусор, ЧПУ усиливает ценное, sitemap направляет бюджет. Закрыть всё в robots.txt — грубое полурешение, которое не отличает ценные фильтры от мусорных и не всегда убирает уже проиндексированное.

Как это делается на 1С-Битрикс

Платформа даёт для этого штатные механизмы, которые нужно осознанно настроить. Умный фильтр поддерживает генерацию человекопонятных адресов и SEO-данных для выбранных сочетаний свойств — это основа для ценных посадочных. Фасетный индекс держит фильтр быстрым, чтобы правильные страницы отдавались мгновенно.

Дальше настраивают правила: какие сочетания превращаются в индексируемые посадочные с ЧПУ и метатегами, а какие получают canonical на категорию и закрываются от индекса. Часть логики выносят в шаблон и настройки компонента, часть — в правила обработки URL. Когда каталог большой, эту логику аккуратно программируют поверх штатных средств; смежные вопросы разработки мы разбираем в статьях про D7 и ORM в 1С-Битрикс и деплой изменений через CI/CD, чтобы правки выкатывались без риска для продакшена.

Типовой результат

Что обычно даёт такая работа — в общих чертах, без обещаний конкретных цифр. Робот перестаёт тратить бюджет на мусорные комбинации и перенаправляет визиты на реальные товары и категории. Доля «просканировано, не в индексе» снижается, важные страницы начинают индексироваться быстрее, а ценные фильтровые посадочные приводят дополнительный целевой трафик.

Эффект проявляется постепенно: поисковым системам нужно время переобойти сайт, выкинуть лишнее и заново дойти до нужного. Обычно динамику видно в течение нескольких недель. Параллельный бонус — снижение паразитной нагрузки от робота на сервер, что помогает стабильности под трафиком. Важно сделать настройку правильно один раз и наблюдать, а не ждать мгновенного скачка.

Частые ошибки

Чек-лист исправления

  1. Соберите данные. Отчёты вебмастеров и логи сервера — куда уходит бюджет робота.
  2. Разделите фильтры. Ценные посадочные под спрос отдельно от мусорных комбинаций.
  3. Настройте ЧПУ и метатеги. Для ценных фильтров — человекопонятные URL и уникальные заголовки.
  4. Закройте мусор. Канонические адреса и метатеги индексации для комбинаций без спроса.
  5. Обновите sitemap. Только важные страницы, направляющие робота к нужному.
  6. Держите фильтр быстрым. Фасетный индекс и кэш, чтобы правильные страницы отдавались мгновенно.
  7. Наблюдайте динамику. Отслеживайте индексацию и трафик несколько недель после правок.

Вывод

История о том, как фильтры съедали краулинговый бюджет, — не про один сайт, а про типичную ловушку больших каталогов на 1С-Битрикс. Комбинаторика умного фильтра незаметно порождает лавину URL, робот тратит ограниченный бюджет на мусор, а важные товары и категории недополучают индексацию и трафик.

Решение — не паническое «закрыть всё», а аккуратная работа по данным: продиагностировать по логам и вебмастеру, отделить ценные посадочные от мусорных комбинаций и настроить индексацию инструментами платформы. Сделайте это один раз правильно — и краулинговый бюджет начнёт работать на ваши продажи, а не на бесконечный лабиринт фильтров.

Частые вопросы

Что такое краулинговый бюджет простыми словами?

Это количество страниц вашего сайта, которое поисковый робот готов обойти за отведённое время. Ресурс не бесконечен: у робота свои лимиты по частоте обращений и по объёму. Если сайт тратит этот лимит на мусорные страницы фильтров, до важных карточек и категорий робот доходит реже или не доходит вовсе. Поэтому на большом каталоге за краулинговым бюджетом надо следить, а не отдавать его комбинациям фильтров.

Почему умный фильтр плодит столько URL?

Умный фильтр позволяет комбинировать значения свойств, а число комбинаций растёт лавинообразно: несколько цветов на несколько размеров на несколько брендов на диапазоны цены дают тысячи и десятки тысяч адресов. Если каждая такая комбинация открывается по индексируемому URL, каталог из сотен товаров превращается для робота в сайт из сотен тысяч страниц, большинство из которых — почти пустые или дублирующие.

Как понять, что фильтры съедают бюджет именно у меня?

Признаки узнаваемы: в отчётах поисковых систем видно огромное число просканированных, но не проиндексированных страниц; в индексе висят адреса с параметрами фильтра; важные карточки и категории индексируются медленно или выпадают. Диагностируют это по данным вебмастера и логам сервера, где видно, куда именно ходит робот. Если большая доля его визитов приходится на страницы фильтров — проблема налицо.

Нужно ли вообще индексировать страницы фильтров?

Не все. Часть фильтровых страниц полезна для поиска — например, посадочные под реальный спрос вроде «красные кроссовки такого-то бренда». Их оставляют в индексе с человекопонятным URL и оптимизированными метатегами. А бесконечные комбинации и технические сочетания, под которые никто не ищет, из индекса убирают. Смысл не в том, чтобы закрыть все фильтры, а в том, чтобы отделить ценные страницы от мусорных.

Закрыть фильтры в robots.txt — это решение?

Частично и грубо. robots.txt запрещает обход, но не всегда убирает уже проиндексированные страницы и не отличает ценные фильтры от мусорных. Полноценное решение сочетает несколько инструментов: канонические адреса, метатеги индексации, человекопонятные URL для ценных фильтров и правила обхода. robots.txt — один из инструментов, а не единственная кнопка. Настраивать это надо осознанно, а не закрывать всё подряд.

Влияет ли это на скорость сайта, а не только на индексацию?

Да. Активный робот, обходящий десятки тысяч мусорных страниц фильтров, создаёт лишнюю нагрузку на сервер и базу, а каждая такая страница часто считается динамически. Это отъедает ресурсы у реальных посетителей. Поэтому наведение порядка в фильтрах обычно улучшает и индексацию, и стабильность сайта под нагрузкой. Композитный кэш и правильная инфраструктура здесь работают заодно с настройкой индексации.

Сколько времени занимает восстановление индексации?

Быстро закрыть мусор технически можно за одну итерацию работ, но поисковым системам нужно время, чтобы переобойти сайт, выкинуть лишнее из индекса и заново дойти до важных страниц. Обычно эффект проявляется постепенно в течение нескольких недель, по мере того как робот перераспределяет бюджет. Поэтому важно сделать настройку правильно один раз и наблюдать динамику, а не ждать мгновенного скачка.

Поделиться:

Фильтры съедают индексацию вашего каталога?

Продиагностируем по логам и вебмастеру, отделим ценные посадочные от мусора и настроим индексацию так, чтобы бюджет робота работал на продажи. Рассчитаем работу по вашему сайту.

Редакция B2Bsite

Команда B2Bsite. С 2014 года разрабатываем каталоги на 1С-Битрикс: настраиваем умный фильтр, индексацию и посадочные страницы так, чтобы каталог рос в поиске, а не тонул в дублях.

← Все статьи блога