Главная / База знаний

Индексация и краулинг

12 материалов 80 минут чтения обновлено 19 августа 2026

Пока страница не попала в индекс, для поиска её не существует: ни позиций, ни трафика, ни заявок — сколько бы ни стоил контент. Ломается индексация сайта буднично: файл robots.txt закрывает от роботов половину каталога, sitemap.xml отдаёт давно удалённые адреса, дубли съедают краулинговый бюджет, а новые страницы неделями ждут обхода. Хуже всего, что снаружи это не видно — сайт открывается, выглядит нормально, и только проверка индексации показывает, что в Яндексе десятая часть страниц, а в Google — вообще другие адреса.

О разделе

В разделе собрана вся практика по теме: что такое индексация сайта и как поисковые роботы обходят страницы, как проверить индексацию сайта в Яндексе и Google четырьмя способами, как найти выпавшие и незаиндексированные страницы, как настроить robots.txt — какие директивы нужны, что закрывать от роботов и по каким правилам обрабатываются приоритеты, готовые примеры robots.txt для WordPress, 1С-Битрикс и интернет-магазина, как добавить sitemap.xml в Яндекс Вебмастер и Google Search Console и как ускорить попадание страниц в поиск через переобход.

Отдельно разбираем ошибки, из-за которых сайт выпадает из поиска, и чек-лист проверки robots.txt перед запуском — он спасает трафик чаще, чем принято думать. Это тот случай, когда час технической работы даёт больше, чем месяц написания текстов: на аудитах мы регулярно видим, как причиной «SEO не работает» оказывается одна строчка Disallow, добавленная ещё при разработке.

Канонический адрес

Указывает основную версию страницы при дублях с параметрами. Канониклы должны быть абсолютными и вести на код 200.



# проверить, что отдаётся один канонический адрес
curl -s https://example.ru/uslugi/seo/ | grep -i canonical
01 Веб-индексация: как поисковики обходят сайт и как ускорить попадание страниц в индекс Веб-индексация — процесс, в котором робот поисковика (Googlebot, YandexBot) обходит сайт по ссылкам и sitemap. Материал из 8 разделов. 6 мин 02 Как добавить sitemap.xml в Яндекс.Вебмастер и Google Search Console В Яндекс.Вебмастере: раздел «Индексирование → Файлы Sitemap», вставить полный адрес вида https://site.ru/sitemap.xml и нажать «Добавить». Материал из 9 разделов. 7 мин 03 Как закрыть сайт или отдельные страницы от индексации: robots.txt, noindex и пароль Есть три способа закрыть контент от поисковиков, и они не взаимозаменяемы. Disallow в robots.txt запрещает роботу сканировать страницу. Материал из 8 разделов. 7 мин 04 Как проверить robots.txt: валидаторы Яндекса и Google и типовые ошибки Как проверить robots.txt в валидаторе Яндекс.Вебмастера и отчёте Google Search Console: пошагово, 8 типовых ошибок и чек-лист проверки перед релизом. 6 мин 05 Как проверить индексацию сайта в Яндексе и Google: 4 способа Проверить индексацию сайта можно четырьмя способами: оператором site: в поиске (быстро, но приблизительно). Материал из 8 разделов. 6 мин 06 Настройка robots.txt: какие директивы нужны и что закрывать от роботов Рабочий robots.txt строится на трёх директивах: User-agent (для какого робота правило). Материал из 8 разделов. 7 мин 07 Ошибки в robots.txt, из-за которых сайт выпадает из поиска Самая частая и самая разрушительная ошибка — строка Disallow: /. Материал из 9 разделов. 6 мин 08 Правила robots.txt: синтаксис директив и приоритет обработки роботами Robots.txt читается роботом сверху вниз построчно, но при конфликте директив побеждает не порядок в файле. Материал из 8 разделов. 6 мин 09 Примеры robots.txt для WordPress, 1С-Битрикс и интернет-магазина Готовый robots.txt для WordPress закрывает /wp-admin/, /wp-includes/ и параметры поиска, но открывает /wp-admin/admin-ajax.php. Для 1С-Битрикс блокируют… 6 мин 10 Проверка robots.txt перед запуском сайта: чек-лист, который спасает трафик Главная причина, по которой только что запущенный сайт не появляется в поиске неделями, — забытая строка Disallow: / в robots.txt. Материал из… 8 мин 11 Проверка индексации сайта: как найти выпавшие и незаиндексированные страницы Чтобы найти выпавшие и незаиндексированные страницы, сравнивают три числа: сколько страниц реально на сайте. Материал из 9 разделов. 8 мин 12 Что такое индексация сайта и почему без неё нет трафика из поиска Индексация — это когда поисковая система добавляет страницу сайта в свою базу после того, как её просканировал робот. Материал из 9 разделов. 7 мин

Другие разделы