robots.txt и sitemap.xml
robots.txt и sitemap.xml это два служебных файла, которые управляют работой поискового робота на сайте. robots.txt говорит, какие разделы обходить, а какие нет. sitemap.xml это карта со списком всех страниц, которые Вы хотите видеть в поиске. Вместе они следят, чтобы робот тратил время на нужные карточки каталога, а не на мусор.
Обновлено: 13 июля 2026Как это работает
robots.txt лежит в корне сайта и читается роботом первым. В нём директивами Disallow и Allow Вы закрываете от обхода служебные разделы: корзину, личный кабинет, поиск по сайту, параметрические URL фильтров. Здесь же указывают путь к sitemap.xml.
sitemap.xml это XML-список всех страниц, которые должны быть в индексе, с датой последнего изменения. Робот берёт карту, сверяет со своим представлением о сайте и достаёт то, что пропустил при обычном обходе по ссылкам. Для большого каталога карту генерируют автоматически и разбивают на несколько файлов, объединённых индексным sitemap. Так у робота всегда под рукой свежий и полный перечень товара, а не то, что он случайно нашёл, бродя по внутренним ссылкам.
Зачем это производственной компании
У завода с каталогом на тысячи позиций робот физически не успевает обойти всё за один заход. Если в robots.txt не закрыты фильтры и сортировки, он уходит перебирать десятки тысяч мусорных URL вроде «?sort=price&color=red», а до карточек реальной продукции не доходит. В итоге половина номенклатуры не в индексе: по ней Вас не находят.
Пример: производитель крепежа держал открытыми все комбинации фильтров. Робот Яндекса неделями ходил по параметрам, а новые карточки ГОСТ-позиций попадали в поиск с задержкой в месяц-полтора. Закрыли параметры в robots.txt, собрали чистый sitemap только из карточек и категорий: новые позиции стали индексироваться за 3–5 дней.
Типичные ошибки
- Disallow на весь сайт после разработки. Классика: сайт запустили, а строка «Disallow: /», закрывавшая тестовую версию от индексации, осталась. Каталога нет в поиске месяцами.
- Карта с мусором и битыми URL. В sitemap попадают страницы с редиректами, 404 и закрытые в noindex. Робот теряет доверие к карте и обходит её реже.
- Карту собрали один раз. Каталог пополняется, а sitemap статичный. Новые карточки в карту не попадают и ждут обхода по ссылкам неделями.
SEO-продвижение в наших проектах
Термин «robots.txt и sitemap.xml» относится к направлению «SEO-продвижение». Ниже проекты, где мы это направление вели. Цифры из отчётов и систем аналитики клиентов, не расчётные.
Частые вопросы
robots.txt и sitemap.xml это одно и то же?
Нет, у них противоположные роли. robots.txt запрещает: говорит роботу, куда не ходить. sitemap.xml разрешает и подсказывает: перечисляет страницы, которые Вы хотите в индексе. Работают в паре: одним закрываете мусор, другим показываете нужное.
Обязательно ли иметь sitemap.xml для небольшого сайта?
Для сайта в 20–30 страниц робот и так обойдёт всё по ссылкам. Но для каталога от нескольких сотен позиций карта обязательна: без неё часть глубоко вложенных карточек робот может не найти и не проиндексировать месяцами.
Можно ли закрыть страницу от индексации только через robots.txt?
Ненадёжно. robots.txt запрещает обход, но уже известная роботу страница может остаться в выдаче с пометкой «закрыта в robots.txt». Чтобы гарантированно убрать страницу из поиска, используют метатег noindex, а не только robots.txt.