Главная / База знаний / Индексация и краулинг

Примеры robots.txt для WordPress, 1С-Битрикс и интернет-магазина

6 мин чтения обновлено 19 августа 2026 Индексация и краулинг

Коротко. Готовый robots.txt для WordPress закрывает /wp-admin/, /wp-includes/ и параметры поиска, но открывает /wp-admin/admin-ajax.php. Для 1С-Битрикс блокируют /bitrix/, /cgi-bin/, /upload/1c_exchange/ и служебные параметры вроде PAGEN, sort, filter. Для интернет-магазина на любом движке ключевое — закрыть корзину, оформление заказа, сравнение товаров и все фильтры каталога, которые плодят дубли по URL. Файл не копируется один в один с чужого сайта: структура каталога, плагины и настройки ЧПУ у каждого магазина свои, поэтому шаблон — это отправная точка, а не готовое решение.

Почему нельзя просто скопировать чужой robots.txt

Файл, который отлично работает на одном сайте, может закрыть от индексации нужные разделы на другом — просто потому что структура URL отличается. Например, шаблон для интернет-магазина на 1С-Битрикс с директивой Disallow: /catalog/*sort= бесполезен, если в конкретном магазине параметр сортировки называется order, а не sort. Прежде чем вставлять правила ниже на свой сайт, стоит открыть исходный код нескольких страниц каталога и посмотреть, как реально формируются адреса с фильтрами и сортировкой — это займёт 10-15 минут и убережёт от закрытия рабочих страниц. Если сайт разрабатывался под заказ, такие детали обычно фиксируют ещё на этапе разработки сайта, а не подбирают задним числом.

Пример robots.txt для WordPress

Базовый рабочий вариант, который подходит для большинства сайтов на WordPress без специфичных плагинов каталога:

User-agent: *
Disallow: /wp-admin/
Disallow: /wp-includes/
Disallow: /wp-content/plugins/
Disallow: /wp-content/cache/
Disallow: /wp-login.php
Disallow: /xmlrpc.php
Disallow: /?s=
Disallow: /search/
Disallow: /*?replytocom=
Allow: /wp-admin/admin-ajax.php
Sitemap: https://site.ru/sitemap.xml

Строка Allow: /wp-admin/admin-ajax.php обязательна: этот файл технически лежит в закрытой папке /wp-admin/, но через него подгружается часть интерактивного контента — формы, фильтры, динамические блоки. Без явного разрешения робот может не увидеть этот контент при рендеринге страницы. Если сайт использует WooCommerce, дополнительно закрывают страницы корзины и личного кабинета: Disallow: /cart/, Disallow: /checkout/, Disallow: /my-account/ — это страницы с уникальным содержимым для каждого пользователя, индексировать их незачем.

Пример robots.txt для 1С-Битрикс

Битрикс генерирует много служебных и технических URL, и типовая заготовка от самой платформы обычно избыточна — закрывает лишнее и не учитывает специфику конкретного каталога. Рабочий минимум:

User-agent: *
Disallow: /bitrix/
Disallow: /cgi-bin/
Disallow: /upload/1c_exchange/
Disallow: /search/
Disallow: /auth/
Disallow: /personal/
Disallow: /*?PAGEN_
Disallow: /*?sort=
Disallow: /*?filter=
Disallow: /*ELEMENT_CODE=
Allow: /bitrix/templates/
Sitemap: https://site.ru/sitemap.xml

Папка /upload/1c_exchange/ — это техническая директория обмена с 1С:Предприятие, в ней нет контента для посетителей, но она часто весит гигабайты и без блокировки съедает краулинговый бюджет. Строка Allow: /bitrix/templates/ нужна отдельно, потому что в этой папке лежат CSS и JS файлы шаблона — без доступа к ним робот может не увидеть, как страница выглядит визуально, что иногда сказывается на оценке качества страницы.

Что закрывать в интернет-магазине независимо от движка

Здесь логика не привязана к CMS — это про типы страниц, которые есть в любом каталоге и почти никогда не должны попадать в индекс:

Разница между «закрыть в robots.txt» и «закрыть через canonical или noindex» принципиальна: robots.txt запрещает сканирование, то есть робот вообще не видит содержимое страницы. Canonical и noindex разрешают сканирование, но говорят не добавлять страницу в индекс. Для фильтров и пагинации второй способ обычно правильнее — робот проходит по ссылкам дальше и находит все товары, просто не хранит дублирующие URL-адреса как отдельные страницы в базе. Разбор того, как эти решения влияют на видимость каталога в поиске, — в материале про SEO-продвижение интернет-магазинов.

Таблица: что закрывать по типам сайтов

Тип раздела WordPress 1С-Битрикс Любой интернет-магазин
Админка /wp-admin/ /bitrix/, /auth/ панель управления и логин
Поиск по сайту /?s= /search/ всегда закрывать
Корзина / заказ /cart/, /checkout/ /personal/cart/ всегда закрывать
Фильтры каталога зависит от плагина /*?filter=, /*?sort= лучше через canonical
Технический обмен /upload/1c_exchange/ если применимо

Как проверить, что файл не закрыл лишнее

После публикации robots.txt обязателен ручной прогон через инструмент проверки в Яндекс.Вебмастере или Google Search Console: туда вставляют несколько реальных адресов сайта — карточку товара, категорию, страницу блога — и смотрят, какие директивы их затрагивают. Частая ошибка — слишком широкая маска вроде Disallow: /*?*, которая должна была закрыть только служебные параметры, а на деле блокирует и страницы с ЧПУ, в которых случайно есть знак вопроса из-за UTM-меток. После любого изменения robots.txt стоит подождать несколько дней и сверить в панели вебмастера количество страниц в индексе — резкий обвал сигналит о слишком агрессивной блокировке. Подробный разбор типичных промахов — в материале об ошибках в robots.txt, из-за которых сайт теряет позиции. Если разбираться с файлом самостоятельно некогда, эту работу можно передать в рамках техподдержки сайта.

FAQ

Можно ли обойтись вообще без robots.txt?

Технически да — без файла робот просканирует всё, что найдёт по ссылкам. Но тогда в индекс с высокой вероятностью попадут корзина, страницы поиска и дубли фильтров, что размывает качество сайта в глазах поисковика. Файл на 10-15 строк закрывает основные риски за 20 минут работы.

Нужен ли отдельный robots.txt для мобильной версии сайта?

Нет, если сайт адаптивный (одна и та же страница под все устройства) — а таких сегодня большинство. Отдельный robots.txt нужен только при отдельном мобильном поддомене вроде m.site.ru, что сейчас редкость.

Как часто нужно обновлять robots.txt?

Не по расписанию, а по событию: смена CMS, добавление нового раздела с параметрами в URL, подключение платёжной системы с новыми служебными страницами. У стабильного сайта файл может не меняться годами.

Влияет ли robots.txt на позиции сайта напрямую?

Нет, это не фактор ранжирования. Но косвенно влияет сильно: если робот тратит ресурс сканирования на тысячи дублей фильтров вместо карточек товара, до части реального контента он может просто не доходить вовремя.

Что делать, если после изменения robots.txt сайт потерял трафик?

Первым делом проверить, не закрыт ли случайно рабочий раздел — самая частая причина резкого падения. Сравнить текущий файл с версией до изменений (её можно найти в истории Google Search Console) и вернуть закрытые по ошибке директивы.

Проверить robots.txt своего сайта на ошибки

Бесплатный аудит покажет, что реально закрыто от индексации и не мешает ли это росту трафика.

ПОЛУЧИТЬ БЕСПЛАТНЫЙ АУДИТ →

Готовый robots.txt для WordPress

Базовый набор правил: закрываем служебные каталоги, оставляем открытым ajax-обработчик и указываем карту сайта.

User-agent: *
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php
Disallow: /wp-includes/
Disallow: /?s=
Disallow: /*?replytocom
Allow: /wp-content/uploads/

Sitemap: https://example.ru/sitemap_index.xml

Услуга по теме материала

Приведём техническую часть в порядок: robots, карта сайта, разметка

Материалы по теме