Настройка robots.txt и sitemap.xml на Битрикс: индексация под контролем
Настраиваем robots.txt и sitemap.xml на 1С-Битрикс так, чтобы поисковики индексировали только нужные страницы: корректные директивы под разделы CMS, закрытие служебных и дублирующих URL, автогенерация и регулярное обновление карты сайта, проверка в Яндекс.Вебмастер и Google Search Console.
Что входит в настройку robots.txt и sitemap.xml
Собираем управление индексацией под структуру вашего Битрикса — от корректных директив robots.txt до автогенерации карты сайта и проверки в панелях вебмастеров.
Настройка robots.txt и sitemap.xml на Битрикс: зачем и как
Настройка robots.txt и sitemap.xml на 1С-Битрикс — это управление тем, что именно поисковики берут в индекс с вашего сайта. Файл robots.txt задаёт правила обхода: какие разделы роботу можно сканировать, а какие закрыты. Файл sitemap.xml, наоборот, ведёт робота к нужным страницам и подсказывает, какие из них важнее и как часто обновляются. Вместе эти два файла определяют, тратится ли краулинговый бюджет на коммерческие страницы или растворяется на служебном мусоре. Цель настройки проста: поисковики должны индексировать только нужное.
Проблема в том, что Битрикс из коробки генерирует множество технических и дублирующих адресов. Это служебные разделы вроде /bitrix/, /personal/ и /auth/, страницы корзины, сравнения и авторизации, а в каталоге — десятки копий одной страницы из-за сортировок, фильтров, постраничной навигации и UTM-меток. Если оставить всё как есть, робот обходит этот мусор, нужные страницы заходят в индекс медленно, а в выдаче появляются дубли, которые конкурируют между собой и размывают позиции. Грамотная настройка возвращает индексацию под контроль.
Что делает robots.txt на Битрикс
robots.txt — это текстовый файл в корне сайта, который читает поисковый робот перед обходом. В нём мы прописываем директивы с учётом стандартных разделов CMS: закрываем служебные и системные зоны, пользовательские кабинеты, технические скрипты и параметрические URL, а посадочные страницы и каталог оставляем открытыми. Отдельные блоки User-agent настраиваются под Яндекс и Google, добавляются директива Sitemap со ссылкой на карту и, при необходимости, Clean-param для аккуратной работы с параметрами вместо грубого закрытия целых разделов.
Что обычно закрывается и настраивается в robots.txt:
- служебные разделы Битрикса: /bitrix/, /upload/, /cgi-bin/ и технические скрипты;
- пользовательские зоны: /personal/, /auth/, корзина, сравнение, оформление заказа;
- дублирующие URL: сортировки, фильтры, постраничная навигация, метки UTM и параметры;
- директива Sitemap со ссылкой на актуальную карту сайта;
- отдельные правила для роботов Яндекса и Google там, где это нужно;
- Clean-param для параметрических адресов вместо полного закрытия раздела.
Что делает sitemap.xml
sitemap.xml — это карта сайта в формате XML, список адресов, которые вы хотите видеть в индексе, с указанием приоритета и частоты обновления. Карта помогает роботу быстрее находить новые и обновлённые страницы, особенно на крупных сайтах со сложной структурой. Мы настраиваем автогенерацию карты средствами Битрикса или скриптом, чтобы при публикации товара или статьи URL попадал в карту автоматически и обновлялся по расписанию, а не вручную. Для типов страниц расставляются приоритеты priority и частота changefreq, чтобы робот понимал важность разделов.
Для больших каталогов один файл карты не подходит: есть ограничения по числу адресов и размеру. В этом случае мы делаем индекс sitemap — главный файл, который ссылается на вложенные карты по разделам каталога. Отдельно настраивается карта изображений, чтобы фотографии товаров корректно попадали в поиск по картинкам. Такой подход позволяет роботу аккуратно обойти даже сайт на сотни тысяч URL, не упираясь в лимиты одного файла и не теряя важные страницы.
Кому нужна настройка индексации
Настройка robots.txt и sitemap.xml нужна любому сайту на Битрикс, который хочет ровно индексироваться, но особенно она критична для интернет-магазинов и крупных порталов. Чем больше каталог и чем сложнее структура, тем больше технических дублей плодит CMS и тем сильнее они мешают продвижению. Если в индексе висят тысячи параметрических адресов, карта сайта устарела на месяцы, а ошибки обхода никто не отслеживает, продвижение буксует на ровном месте. Чистая индексация — это фундамент технического SEO, без которого остальные работы дают меньше отдачи.
Как проверяется и поддерживается настройка
Настройку индексации мы не считаем законченной, пока не проверим её в панелях вебмастеров. В Яндекс.Вебмастер инструмент анализа robots.txt показывает, доступен ли конкретный адрес для обхода, поэтому перед публикацией нового файла мы убеждаемся, что нужные страницы открыты, а служебные закрыты. Карту сайта добавляем в Яндекс.Вебмастер и Google Search Console, отслеживаем, сколько адресов из неё обработано и нет ли ошибок. Контроль в обеих панелях нужен потому, что Яндекс и Google показывают индексацию по-разному, а правила обхода для них могут различаться.
После публикации файлов мы наблюдаем за динамикой индексации: число полезных страниц в индексе должно расти, а мусорные и дублирующие адреса — уходить. Если поисковик продолжает держать в индексе ненужные URL, разбираемся с причиной: убираем их через robots.txt, канонические адреса или исключение из карты сайта. Файлы передаём с понятными комментариями и инструкцией по поддержке, чтобы публикация новых страниц шла без ручной правки и не ломала настроенную логику обхода.
Результат настройки — управляемая индексация: поисковик обходит только полезные страницы, новые материалы попадают в индекс быстро через свежую карту сайта, дубли и служебные адреса исчезают из выдачи, а в Яндекс.Вебмастер и Google Search Console нет критических ошибок обхода. Краулинговый бюджет работает на коммерческие страницы, а не на технический мусор, и это напрямую поддерживает рост видимости сайта в поиске.
Путь поискового робота по сайту на Битрикс
Робот читает robots.txt, отсекает закрытые служебные и дублирующие адреса, по карте sitemap доходит до нужных страниц и забирает их в индекс — с учётом приоритетов и частоты обновления.
Как настроить индексацию: варианты
| Критерий | Шаблон из интернета | Свой контент-менеджер | Студия B2Bsite |
|---|---|---|---|
| Учёт разделов Битрикса | Берётся общий robots без учёта вашей структуры | Базовые разделы закрыты, тонкости упускаются | Директивы под реальную структуру вашего Битрикса |
| Закрытие дублей каталога | Параметры и фильтры остаются открытыми | Закрываются вручную, часть дублей остаётся | Дубли закрыты директивами и Clean-param, разведены canonical |
| Актуальность карты сайта | Карта статична и быстро устаревает | Обновляется вручную, бывают пропуски | Автогенерация с обновлением по расписанию |
| Проверка в вебмастерах | Не выполняется, ошибки не видны | Проверяется эпизодически, без системы | Подключение и контроль в обеих панелях |
| Риск выпасть из индекса | Высокий: можно закрыть нужное или открыть лишнее | Средний: ошибки заметны не сразу | Минимальный: всё проверено перед публикацией |
Где Битрикс отдаёт поисковику лишнее
Битрикс из коробки генерирует множество служебных и дублирующих URL, а карта сайта быстро устаревает. Поисковик тратит краулинговый бюджет на мусор, а нужные страницы заходят в индекс медленно. Грамотные robots.txt и sitemap.xml возвращают индексацию под контроль.
Как мы настраиваем индексацию
Сроки настройки индексации
Сколько стоит настройка robots.txt и sitemap.xml
Стоимость зависит от размера каталога, числа типов страниц и состояния текущей индексации. Ниже — ориентиры; точную смету присылаем после бесплатной проверки robots.txt и индексации.
Корректный robots.txt и автогенерация карты сайта для типового сайта на Битрикс.
- robots.txt под разделы Битрикса
- Закрытие служебных URL
- Автогенерация sitemap.xml
- Проверка в одной панели вебмастера
Полное управление индексацией для интернет-магазина с большим каталогом.
- Закрытие дублей и параметров
- Clean-param и canonical
- Индекс sitemap для каталога
- Карта изображений
- Проверка в Яндекс и Google
Глубокая настройка для крупного портала и регулярный контроль индексации.
- Всё из «Индексация каталога»
- Сложные правила обхода и приоритетов
- Скрипт генерации под нагрузку
- Снятие ошибок индексации
- Контроль и поддержка файлов
Базовая настройка от 9 000 ₽
Корректный robots.txt и автогенерация карты сайта для типового сайта на Битрикс.
- robots.txt под разделы Битрикса
- Закрытие служебных URL
- Автогенерация sitemap.xml
- Проверка в одной панели вебмастера
Популярный Индексация каталога от 22 000 ₽
Полное управление индексацией для интернет-магазина с большим каталогом.
- Закрытие дублей и параметров
- Clean-param и canonical
- Индекс sitemap для каталога
- Карта изображений
- Проверка в Яндекс и Google
Индексация под ключ от 45 000 ₽
Глубокая настройка для крупного портала и регулярный контроль индексации.
- Всё из «Индексация каталога»
- Сложные правила обхода и приоритетов
- Скрипт генерации под нагрузку
- Снятие ошибок индексации
- Контроль и поддержка файлов
Дополнительные опции
| Подключение и настройка Яндекс.Вебмастер | от 3 000 ₽ |
| Подключение и настройка Google Search Console | от 3 000 ₽ |
| Отдельная карта sitemap для изображений | от 5 000 ₽ |
| Ежемесячный контроль индексации | от 6 000 ₽ |
Сколько страниц возвращает чистая индексация
Прикиньте, сколько полезных страниц можно вернуть в индекс и сколько мусора убрать, когда robots.txt и карта сайта настроены правильно. Чистая индексация направляет краулинговый бюджет на коммерческие страницы.
Оценка по формуле: число URL × доля выпавших полезных страниц, скорректированная на долю мусора. Это ориентир потенциала чистой индексации, а не гарантия позиций.
Подберём вариант настройки индексации
Ответьте на несколько вопросов о вашем сайте и каталоге — предложим подходящий объём работ по robots.txt и sitemap.xml и сориентируем по стоимости.
Кейсы по настройке индексации
Что говорят о настройке индексации
На что можно рассчитывать по договору
Частые вопросы об индексации — и наш ответ
Это не общие советы из интернета, а закономерности из реальных проектов на Битрикс. Каждый ответ — позиция нашей команды.
Управление индексацией Битрикса: где теряются позиции и как их вернуть
На технических аудитах сайтов на Битрикс мы почти всегда видим одну и ту же картину: в индексе поисковика висят тысячи адресов, которые там быть не должны. Это служебные разделы, страницы корзины и сравнения, бесконечные комбинации фильтров и сортировок, адреса с UTM-метками и идентификаторами сессий. На фоне этого мусора нужные коммерческие страницы заходят в индекс медленно, а часть из них вообще выпадает. Владелец недоумевает, почему продвижение буксует, хотя контент написан и ссылки закуплены. Ответ почти всегда лежит на уровне индексации — в неправильно настроенных или вовсе шаблонных robots.txt и sitemap.xml.
Почему индексация — это фундамент, а не мелочь
Многие воспринимают robots.txt и карту сайта как технические формальности: лежат в корне, и ладно. На деле это первое, что читает поисковый робот, и именно эти файлы определяют, на что он потратит краулинговый бюджет. Если бюджет уходит на служебные адреса и дубли, до полезных страниц очередь доходит в последнюю очередь. Можно сколько угодно работать над содержимым, но если робот тратит силы на обход технического шума, отдача от остальных работ по продвижению падает. Поэтому чистая индексация — это не финальный штрих, а фундамент, на котором держится всё техническое SEO.
Особенно остро это проявляется на интернет-магазинах и крупных порталах. Чем больше каталог, тем больше параметрических дублей плодит CMS, и тем сильнее они мешают. Сайт на сотни тысяч URL без управления индексацией превращается для робота в лабиринт, где половина коридоров ведёт в тупики. Грамотная настройка превращает этот лабиринт в понятную карту с указателями: сюда не ходить, а вот к этим страницам — в первую очередь.
Чем плох шаблонный robots.txt
Самая частая ошибка — взять готовый robots.txt для Битрикса из статьи в интернете и положить его в корень. Шаблон закрывает базовые разделы CMS, и на первый взгляд этого хватает. Но шаблон ничего не знает о вашей структуре: о ваших ЧПУ, нестандартных разделах каталога, лендингах и кастомных URL. В итоге он либо закрывает что-то важное — и тогда страницы тихо выпадают из индекса, либо оставляет открытыми ваши специфические дубли — и тогда мусор продолжает копиться. Хуже всего, что обе проблемы незаметны без проверки в панелях вебмастеров, и владелец узнаёт о них, когда трафик уже просел.
Мы собираем robots.txt под конкретный сайт: смотрим реальную структуру, отдельно настраиваем блоки User-agent для Яндекса и Google, аккуратно работаем с параметрами через Clean-param вместо грубого закрытия целых разделов и обязательно проверяем директивы перед публикацией. Если по итогам аудита нужно глубже разобраться с техническим состоянием сайта, мы предлагаем технический SEO-аудит Битрикс, на котором выявляем все узкие места обхода и индексации разом.
Дубли каталога: тихий убийца позиций
Параметрические URL — главная головная боль интернет-магазинов на Битрикс. Каждая сортировка, каждый фильтр, каждая страница пагинации создаёт новый адрес. Для каталога из тысячи товаров это легко оборачивается десятками тысяч технических копий. Поисковик видит множество почти одинаковых страниц и не понимает, какую считать основной. В результате позиции размываются между дублями, а основная страница не получает того веса, который должна.
Решение — комбинировать инструменты. Технические параметры, которые не меняют содержимое, закрываем директивами Disallow по маске или убираем через Clean-param. Смысловые дубли, например посадочные страницы фильтров, под которые есть спрос, оставляем в индексе, но снабжаем каноническими адресами, чтобы они не конкурировали друг с другом. Тонкая работа с URL — это часть более широкой задачи, которую мы решаем при настройке ЧПУ и структуры URL: понятные адреса и управляемая индексация работают в связке и усиливают друг друга.
Карта сайта, которая живёт сама
Статичная карта сайта — это бомба замедленного действия. Её сделали один раз при запуске, и с тех пор она устаревает с каждым новым товаром и статьёй. Робот ходит по карте, в которой нет половины актуальных страниц, и не находит свежий контент вовремя. Решение — автогенерация: карта пересобирается по расписанию или по событию публикации, и новые URL попадают к роботу автоматически. Для контентного сайта это означает, что статья индексируется через пару дней после публикации, а не теряется на недели.
Для крупных каталогов одного файла недостаточно. У формата sitemap есть лимиты по числу адресов и размеру файла, и большой магазин в них не помещается. В этом случае мы строим индекс sitemap: главный файл ссылается на вложенные карты по разделам, а изображения выносятся в отдельную карту. Так робот аккуратно обходит даже очень большой сайт, а фотографии товаров получают шанс попасть в поиск по картинкам — это дополнительный, часто недооценённый источник трафика для интернет-магазина.
Приоритеты и частота: подсказки, а не приказы
В карте sitemap можно указать приоритет страницы и частоту её обновления. Здесь важно понимать, что для поисковиков это ориентир, а не строгое правило: они учитывают эти подсказки, но решают сами. Тем не менее разумная расстановка приоритетов помогает: главной и ключевым разделам каталога ставим более высокий вес, статьям — частоту обновления по факту публикаций, статичным страницам — низкую частоту. Это часть аккуратной настройки, которая в совокупности с остальными мерами делает обход сайта более предсказуемым и эффективным.
Проверка в вебмастерах: без неё работа не закончена
Любую настройку индексации мы доводим до проверки в Яндекс.Вебмастер и Google Search Console. В Яндекс.Вебмастер инструмент анализа robots.txt показывает, доступен ли конкретный URL для обхода — это позволяет убедиться, что мы случайно не закрыли важный раздел. Карту сайта добавляем в обе панели и смотрим, сколько адресов обработано и нет ли ошибок. Контроль именно в обеих панелях нужен потому, что Яндекс и Google показывают индексацию по-разному, а правила обхода для них могут различаться. Без этой проверки настройка остаётся гипотезой; с ней — подтверждённым результатом.
Управление индексацией не живёт само по себе — это часть комплекса технического SEO на Битрикс, где скорость загрузки, корректная разметка, структура URL и чистая индексация работают вместе. Мы настраиваем robots.txt и sitemap.xml так, чтобы они стыковались с остальными техническими решениями, а не противоречили им.
Чем мы отличаемся от настройки своими силами
Контент-менеджер или администратор сайта обычно закрывает базовые разделы и обновляет карту вручную. Этого хватает на старте, но тонкости упускаются: часть дублей остаётся открытой, карта периодически отстаёт, ошибки в панелях вебмастеров не отслеживаются системно. Мы подходим иначе: собираем директивы под реальную структуру, закрываем все типы дублей, ставим автогенерацию карты, проверяем результат в обеих панелях и снимаем ошибки обхода. И главное — проверяем каждое изменение перед публикацией, чтобы случайная директива не выкинула сайт из индекса.
Возражения, которые мы слышим
«У нас уже есть robots.txt, зачем что-то менять». Наличие файла не означает, что он настроен правильно. Чаще всего это шаблон, который либо закрывает лишнее, либо пропускает ваши дубли. Мы проверяем текущий файл и показываем в панелях вебмастеров, что именно индексируется не так, прежде чем что-то предлагать.
«Боюсь, что после правок сайт выпадет из индекса». Это обоснованное опасение, и именно поэтому мы тестируем robots.txt в инструментах вебмастеров до публикации и закрываем только то, что действительно не должно быть в поиске. Изменения вносим аккуратно и контролируем динамику индексации после них.
«Карта сайта же есть, разве этого мало». Сам факт наличия карты ничего не гарантирует, если она статична, устарела или не помещается в лимиты. Живая, автоматически обновляемая карта с корректной структурой — совсем другое дело, и именно её мы настраиваем.
Что вы получаете по итогу
По завершении работ у вас управляемая индексация: robots.txt под реальную структуру сайта, автоматически обновляемая карта sitemap с корректными приоритетами, разведённые дубли каталога, отдельная карта изображений при необходимости и подтверждённый в обеих панелях вебмастеров результат без ошибок обхода. Мы передаём файлы с понятными комментариями и инструкцию по поддержке, чтобы публикация новых страниц шла без ручной правки. Поисковики начинают индексировать только нужное, краулинговый бюджет работает на коммерческие страницы, а технический фундамент перестаёт тормозить продвижение.
Типичные ошибки, которые мы исправляем
За годы работы с Битрикс мы собрали коллекцию повторяющихся ошибок индексации, и почти каждый новый проект приносит знакомые симптомы. Первая ошибка — закрытие в robots.txt вместе со служебными разделами папки, в которой лежат картинки или стили, из-за чего страницы индексируются без оформления, а изображения выпадают из поиска по картинкам. Вторая — директива, закрывающая весь каталог одной строкой по неосторожной маске: владелец удивляется, почему товары пропали из выдачи, хотя контент на месте. Третья — оставленные открытыми параметры сортировки и пагинации, которые тихо плодят дубли годами.
Встречается и обратная крайность: в попытке закрыть всё лишнее в robots.txt запрещают обход страниц, которые при этом остаются в карте sitemap. Получается противоречие — карта зовёт робота на страницу, а правила обхода её запрещают, и поисковик сообщает об ошибке. Ещё одна частая беда — карта сайта, в которой лежат адреса с кодами ошибок сервера или редиректами: робот тратит обход на нерабочие ссылки и теряет доверие к карте. Все эти ошибки мы выявляем при разборе и устраняем системно, а не латаем по одной.
Отдельная категория проблем связана с переездами и доработками сайта. После смены структуры URL, перехода на новый шаблон или объединения разделов старые правила robots.txt и карта перестают соответствовать реальности: закрытыми оказываются новые разделы, а в карте остаются адреса, которых уже нет. Мы пересобираем файлы под актуальную структуру и сверяем их с тем, что видит робот в панелях вебмастеров, чтобы переезд не обернулся провалом в индексации.
Индексация и краулинговый бюджет на практике
Понятие краулингового бюджета звучит абстрактно, но на крупных сайтах оно становится осязаемым. Робот обходит ограниченное число страниц за визит, и если значительная их часть приходится на параметрические дубли, до новых товаров и обновлённых разделов он добирается с задержкой. Мы не раз видели магазины, где свежие позиции попадали в индекс неделями именно потому, что бюджет уходил на десятки тысяч технических копий. После закрытия дублей и наведения порядка в карте сайта те же страницы начинали индексироваться за дни, а не недели.
Важно понимать, что управление индексацией — это не разовая акция, а состояние, которое нужно поддерживать. Сайт живёт: появляются новые разделы, меняется структура каталога, добавляются акции и фильтры. Если за этим не следить, со временем накапливаются новые дубли и устаревшие записи в карте. Поэтому для активно растущих проектов мы предлагаем регулярный контроль индексации — периодически сверяем, что в индексе, обновляем директивы под новые типы страниц и снимаем возникающие ошибки обхода, чтобы порядок, наведённый однажды, сохранялся.
С чего начать
Начните с бесплатной проверки. Мы посмотрим ваш текущий robots.txt и индексацию в панелях вебмастеров, покажем, что сейчас попадает в индекс зря и какие полезные страницы выпали, и предложим конкретный объём работ под ваш сайт. Это не абстрактная консультация, а разбор вашей реальной ситуации с цифрами. По итогам вы поймёте, что менять в первую очередь, какой эффект это даст и за какой срок. Обсудим ваш проект — и вернём индексацию под контроль, чтобы поисковики работали на вас, а не на технический мусор.
Частые вопросы о настройке robots.txt и sitemap.xml
Что такое robots.txt простыми словами? +
robots.txt — это текстовый файл в корне сайта, который читает поисковый робот перед обходом. В нём прописаны правила: какие разделы сайта роботу можно сканировать, а какие закрыты. Проще говоря, это инструкция для поисковика о том, куда заходить, а куда нет. На Битрикс через robots.txt обычно закрывают служебные и дублирующие адреса, чтобы они не попадали в индекс.
Что такое sitemap.xml простыми словами? +
sitemap.xml — это карта сайта в формате XML, список адресов страниц, которые вы хотите видеть в поиске. Робот по ней быстрее находит новые и обновлённые страницы, а в самой карте можно указать приоритет страницы и частоту обновления. Карта особенно полезна на больших сайтах со сложной структурой, где робот сам может не дойти до всех нужных разделов.
Чем robots.txt отличается от sitemap.xml? +
robots.txt задаёт ограничения — что роботу нельзя обходить, а sitemap.xml, наоборот, ведёт робота к нужным страницам и подсказывает их важность. Один файл отсекает лишнее, другой направляет к полезному. Работают они в паре: сначала робот читает правила в robots.txt, затем по карте sitemap доходит до страниц, которые вы хотите видеть в индексе.
Что такое краулинговый бюджет? +
Краулинговый бюджет — это объём страниц, который поисковый робот готов обойти на вашем сайте за определённое время. Он не бесконечен. Если робот тратит его на служебные адреса и дубли, до полезных страниц очередь доходит медленнее. Грамотные robots.txt и sitemap направляют бюджет на коммерческие страницы, поэтому нужное индексируется быстрее.
Зачем настраивать индексацию именно на Битрикс? +
Битрикс из коробки генерирует много технических и дублирующих URL: служебные разделы, корзину, сравнение, а в каталоге — копии страниц из-за сортировок и фильтров. Без настройки всё это попадает в индекс, тратит краулинговый бюджет и создаёт дубли в выдаче. Поэтому для Битрикс правильная настройка robots.txt и sitemap.xml особенно важна.
Какие разделы Битрикса нужно закрывать в robots.txt? +
Закрываем служебные и системные зоны: /bitrix/, технические скрипты, /personal/, /auth/, страницы корзины, сравнения и оформления заказа. Также закрываем дублирующие параметрические адреса — сортировки, фильтры, постраничную навигацию и UTM-метки. Посадочные страницы, разделы каталога и статьи при этом остаются открытыми для индексации.
Можно ли взять готовый robots.txt из интернета? +
Готовый шаблон закрывает базовые разделы, но не учитывает вашу структуру: ЧПУ, нестандартные разделы каталога, лендинги и кастомные URL. Часто шаблон либо закрывает нужное, либо оставляет открытыми дубли. robots.txt стоит собирать под конкретный сайт и обязательно проверять перед публикацией, чтобы не выпасть из индекса.
Что такое директива Clean-param и зачем она нужна? +
Clean-param — это директива для Яндекса, которая говорит роботу игнорировать указанные параметры в URL. Она удобна, когда параметры вроде UTM или идентификаторов сессии не меняют содержимое страницы. Вместо грубого закрытия целого раздела через Disallow мы аккуратно убираем параметрические дубли, сохраняя при этом основную страницу в индексе.
Как настроить разные правила для Яндекса и Google? +
В robots.txt можно задать отдельные блоки User-agent: один для робота Яндекса, другой для Google, и общий для остальных. Это нужно, когда правила обхода различаются — например, Clean-param понимает только Яндекс. Мы настраиваем блоки так, чтобы каждый робот получал корректные для него директивы, а директива Sitemap указывалась для всех.
Не опасно ли закрывать страницы в robots.txt? +
Опасно, если делать это вслепую: одной строкой можно случайно закрыть весь каталог или важный раздел и выпасть из индекса. Поэтому мы собираем директивы под реальную структуру сайта и обязательно проверяем их перед публикацией в инструментах вебмастеров. Закрываем только то, что действительно не должно быть в поиске.
Как настроить автогенерацию карты сайта? +
Карту можно генерировать штатными средствами Битрикс или отдельным скриптом с обновлением по расписанию. Мы настраиваем автогенерацию так, чтобы при публикации товара или статьи URL автоматически попадал в sitemap, а карта регулярно пересобиралась. Это избавляет от ручной правки файла и держит карту всегда актуальной.
Что такое приоритет и частота обновления в карте? +
Priority задаёт относительную важность страницы для робота, а changefreq подсказывает, как часто содержимое меняется. Например, главной и разделам каталога ставят более высокий приоритет, а статьям — частоту обновления по факту публикаций. Эти подсказки помогают роботу разумнее распределять обход, хотя поисковики используют их как ориентир, а не строгое правило.
Что делать, если каталог не помещается в один файл? +
Один файл sitemap ограничен по числу адресов и размеру. Большой каталог мы разбиваем на индекс sitemap — главный файл, который ссылается на вложенные карты по разделам. Так робот корректно обходит даже сайт на сотни тысяч URL, не упираясь в лимиты одного файла и не теряя важные страницы каталога.
Можно ли сделать карту для изображений? +
Да. Отдельная карта изображений помогает фотографиям товаров и иллюстрациям попадать в поиск по картинкам. Мы настраиваем sitemap для изображений с привязкой к страницам, на которых они размещены. Для интернет-магазинов это дополнительный источник трафика, поскольку часть пользователей приходит именно из поиска по картинкам.
Как часто нужно обновлять sitemap.xml? +
Чем чаще на сайте появляются новые страницы, тем чаще должна пересобираться карта. Для активного интернет-магазина или блога разумно обновлять её ежедневно или по событию публикации, для статичного сайта — реже. Мы настраиваем расписание автогенерации под темп обновления вашего сайта, чтобы новые URL уходили роботу без задержек.
Откуда на Битрикс берутся дубли страниц? +
Дубли возникают из-за параметров в URL: сортировки и фильтры каталога, постраничная навигация, UTM-метки, идентификаторы сессий. Каждый такой параметр создаёт новый адрес с тем же или похожим содержимым. Если их не закрыть, робот индексирует десятки копий одной страницы, которые конкурируют между собой и размывают позиции в выдаче.
Чем закрытие в robots.txt отличается от canonical? +
robots.txt запрещает роботу обходить адрес вовсе, а canonical указывает основную версию страницы среди похожих, не запрещая обход. Для технических параметров чаще подходит закрытие или Clean-param, а для смысловых дублей — канонический адрес. Мы комбинируем оба инструмента: что-то отсекаем директивами, что-то разводим каноническими ссылками.
Как закрыть от индексации фильтры каталога? +
Параметрические URL фильтров и сортировок закрываем директивами Disallow по маске параметров или через Clean-param для Яндекса, а нужные посадочные страницы фильтров, под которые есть спрос, оставляем открытыми и снабжаем каноническими адресами. Так в индекс попадают полезные комбинации фильтров, а технический шум остаётся за бортом.
Что значит, что страница в индексе, но не нужна там? +
Это значит, что поисковик добавил в выдачу адрес, который вы не хотели продвигать: служебную страницу, дубль или параметрический URL. Такие страницы тратят краулинговый бюджет и могут конкурировать с основными. Мы выявляем их в панелях вебмастеров и убираем из индекса через robots.txt, canonical или удаление из карты сайта.
Поможет ли настройка ускорить попадание в индекс? +
Да. Когда служебный мусор закрыт, а карта sitemap актуальна и обновляется автоматически, краулинговый бюджет тратится на полезные страницы, и новые материалы робот находит быстрее. Это не мгновенный эффект, но на практике скорость попадания новых страниц в индекс заметно растёт после грамотной настройки.
Как проверить robots.txt в Яндекс.Вебмастер? +
В Яндекс.Вебмастер есть инструмент анализа robots.txt: он показывает, какие правила применяются и доступен ли конкретный URL для обхода. Мы загружаем туда новый robots.txt, проверяем, что нужные страницы открыты, а служебные закрыты, и только после этого публикуем файл на сайте. Так исключаем риск случайно закрыть важный раздел.
Как добавить sitemap в панели вебмастеров? +
Карту сайта добавляют в разделе индексирования Яндекс.Вебмастер и Google Search Console, указав ссылку на файл sitemap. После добавления панель показывает, сколько адресов из карты обработано и нет ли ошибок. Ссылку на карту мы также прописываем в robots.txt директивой Sitemap, чтобы роботы находили её самостоятельно.
Какие ошибки индексации чаще всего встречаются? +
Чаще всего это закрытые в robots.txt важные страницы, недоступная или устаревшая карта сайта, дубли в индексе, ошибки обхода из-за неправильных директив и страницы с кодами ошибок сервера в карте. Мы проверяем эти места в панелях вебмастеров и устраняем причины, а не просто скрываем симптомы.
Нужно ли подключать и Яндекс.Вебмастер, и Search Console? +
Да, если вы продвигаетесь и в Яндексе, и в Google. Панели показывают индексацию каждого поисковика по-своему, и правила обхода для них могут различаться. Контроль в обеих панелях даёт полную картину: где какие страницы в индексе, какие ошибки видит конкретный поисковик и как реагирует на изменения в robots и sitemap.
Как понять, что настройка сработала? +
По динамике в панелях вебмастеров: число полезных страниц в индексе растёт, мусорные и дублирующие адреса уходят, ошибок обхода нет, а карта сайта обрабатывается без замечаний. Мы фиксируем картину до и после настройки, чтобы эффект был виден в цифрах, а не на словах.
Что меняется в индексации
Ориентиры по проектам нашей команды. Точную картину покажем на бесплатной проверке robots.txt и индексации вашего сайта.
Ценность настройки для каждой роли
Бюджет робота на дело
Краулинговый бюджет тратится на коммерческие страницы, а не на служебный мусор.
Быстрее в выдачу
Новые товары и статьи попадают в индекс через свежую карту сайта без задержек.
Чистый индекс
В поиске видны только нужные страницы, без дублей и системных адресов.
Понятный результат
Эффект виден в панелях вебмастеров: рост числа полезных страниц в индексе.
Контроль дублей
Параметрические URL, сортировки и фильтры закрыты, дубли разведены каноническими.
Прозрачная карта
Структура sitemap отражает реальную структуру сайта и приоритеты разделов.
Снятые ошибки
Ошибки обхода и индексации в Яндекс.Вебмастер и Search Console устранены.
База под продвижение
Чистая индексация — фундамент, на котором растут позиции и трафик.
Публикация без забот
Новые страницы автоматически уходят в карту сайта без ручной правки файлов.
Ничего не теряется
Свежие материалы быстро находит робот, а не висят месяцами вне индекса.
Понятные правила
Чёткое разделение: что закрыто от поиска, а что должно индексироваться.
Меньше дублей
Технические копии страниц не конкурируют с оригиналом в выдаче.
Настроим индексацию вашего сайта?
Расскажите о вашем сайте и каталоге — бесплатно проверим robots.txt и индексацию, покажем, что попадает в индекс зря, и предложим объём работ под вашу задачу.
- Ответим в течение рабочего дня
- Бесплатный аудит процессов и расчёт
- NDA и фиксированная смета