Маркетинг для
производственных компаний
Разбор маркетинга бесплатно
Robots.txt: зачем нужен и как настроить без ошибок
SEO

Robots.txt: зачем нужен и как настроить без ошибок

Короткий ответ

robots.txt выглядит как небольшой технический файл, но ошибка в нём может закрыть поисковому роботу доступ к важным разделам сайта.

Для производителя с большим каталогом это особенно критично.

Файл расположен в корне домена и содержит правила для роботов.

Яндекс поддерживает в нём User-agent, Disallow, Allow, Sitemap и Clean-param.

User-agent

Эта строка указывает, к какому роботу относятся правила.

User-agent: *

Звёздочка означает всех роботов, которые соблюдают эти правила.

При необходимости можно задавать отдельные группы для конкретных crawler'ов.

Disallow

Запрещает обход указанного пути.

Например:

Disallow: /admin/

Так поисковый робот не должен обходить административный раздел.

Особенно внимательно нужно проверять правило:

Disallow: /

Оно запрещает обход всего сайта для выбранного user-agent.

Allow

Позволяет открыть отдельный путь внутри более широкого запрета.

Используется, когда нужно точнее настроить доступ.

Перед использованием сложных сочетаний Allow и Disallow проверьте, какие конкретные URL должны оставаться доступными роботу.

Sitemap

Указывает адрес карты сайта.

Например:

Sitemap: https://site.ru/sitemap.xml

Директива указывает поисковому роботу адрес карты сайта.

Clean-param

Директива Яндекса помогает сообщить роботу, что определённые GET-параметры не меняют существенное содержание страницы и их не нужно учитывать как отдельные адреса.

Это может быть полезно для каталогов с параметрами, но применять её нужно только после анализа конкретной структуры URL.

Пример для сайта производителя

Ниже условный пример, его нельзя копировать без адаптации:

User-agent: *

Disallow: /admin/

Disallow: /search/

Disallow: /cart/

Disallow: /personal/

Sitemap: https://site.ru/sitemap.xml

Если у каталога есть фильтры, параметры и служебные разделы, правила будут сложнее.

Не закрывайте фильтры автоматически.

Часть из них может специально использоваться как SEO-посадочные.

Ошибка 1. После переноса закрыли весь сайт

Разработчики часто закрывают тестовую версию от поисковиков.

После запуска правило случайно переносится на основной домен.

Если правило Disallow: / относится к основному user-agent, важные страницы могут стать недоступны для обхода.

После каждого крупного релиза проверяйте robots.txt.

Ошибка 2. Закрыли важные CSS и JavaScript

Современные поисковые системы могут использовать ресурсы страницы для корректного понимания и рендеринга.

Не нужно механически закрывать все папки со скриптами и стилями.

Проверяйте, какие файлы действительно служебные.

Ошибка 3. Используют robots.txt как noindex

Это разные вещи.

Google прямо указывает: robots.txt управляет обходом, но не является надёжным способом запретить появление HTML-страницы в поиске.

Для запрета индексирования используется noindex, при этом робот должен иметь возможность увидеть соответствующий тег.

Если одновременно закрыть URL через robots.txt и поставить noindex, Googlebot может не увидеть noindex, потому что ему запрещён обход.

Ошибка 4. Закрыли полезные фильтры

На производственном сайте часть фильтров может соответствовать реальному спросу.

Например, категория по материалу, размеру или назначению может быть отдельной посадочной страницей.

Если закрыть все параметры одним правилом без анализа, можно лишить робота доступа к полезным страницам.

Сначала определите, какие фильтры должны участвовать в поиске.

Ошибка 5. Файл давно никто не проверял

Сайт и его структура со временем меняются: появляются новые каталоги, удаляются старые разделы и меняется CMS. Поэтому robots.txt нужно пересматривать после заметных изменений архитектуры.

Как проверить в Яндекс Вебмастере

Добавьте сайт и подтвердите права.

После изменения robots.txt проверьте, как Яндекс видит файл и доступны ли нужные URL.

Отдельно контролируйте разделы индексирования и диагностики.

Сам Яндекс рекомендует проверять корректность robots.txt и указывает требования к месту размещения и ответу сервера.

Что смотреть после правки

После изменения проверьте не только содержимое файла, но и обход сайта, индексирование, технические ошибки и доступность важных категорий.

Если менялись правила для большого каталога, контролируйте соответствующий сегмент URL отдельно.

Что делать, если страницы уже выпали

Сначала устраните запрет.

Затем убедитесь, что URL отдаёт корректный ответ, не содержит noindex и имеет правильный canonical.

Проверьте внутренние ссылки и sitemap.

После этого дождитесь повторного обхода.

Не создавайте новую копию страницы только потому, что старая временно выпала из поиска.

Условный пример

После запуска новой версии сайта производитель замечает, что новые категории не появляются в поиске.

В robots.txt остался запрет на папку /catalog/, который использовался на тестовой версии.

В такой ситуации сначала нужно восстановить доступ поискового робота к каталогу.

Сначала нужно открыть каталог роботу и проверить остальные технические настройки.

Поэтому при SEO-аудите техническую доступность страниц проверяют до работы с контентом и позициями.

Частые вопросы

Нужно ли создавать robots.txt на каждом сайте?

Для управляемого обхода он полезен практически любому полноценному сайту. Состав зависит от структуры.

Можно ли закрыть страницу от поиска через Disallow?

Для Google robots.txt не предназначен как надёжный механизм исключения HTML-страницы из индекса. Для этого используется noindex или ограничение доступа.

Нужно ли закрывать все URL с параметрами?

Нет. Сначала определите, создают ли они дубли или являются полезными посадочными.

Как часто проверять файл?

После редизайна, переезда, смены CMS, крупных изменений каталога и других технических работ.

📚 Часть путеводителяSEO для производственной компании →
Услуга по темеSEO-продвижение →
вопросы и ответы

Частые вопросы

Чем рискуем, если в файле ошибка?

Одной строкой можно закрыть от поиска весь сайт, и он выпадет из выдачи целиком. Это случается чаще всего после переезда или обновления, когда с тестовой версии переносят настройки как есть. Поэтому файл проверяют сразу после любого запуска.

Что закрывать на сайте производителя?

Служебные разделы, корзину и личные кабинеты, результаты внутреннего поиска, бесконечные комбинации фильтров, технические дубли. Не закрывают стили и скрипты: без них поиск не видит страницу так, как видит человек, и оценивает её хуже.

Robots.txt закрывает страницу от индексации?

Не совсем, и это частая путаница. Он запрещает обход, но страница может попасть в выдачу по внешним ссылкам, только без содержимого. Если нужно надёжно убрать страницу из поиска, используют мета-тег на самой странице, а не запрет обхода.

Кто должен его вести и как часто проверять?

Ведёт тот, кто отвечает за техническую часть сайта, а проверять нужно после каждого значимого изменения: переезда, смены платформы, добавления новых разделов. Проверка занимает пять минут в Вебмастере и защищает от самой дорогой ошибки в SEO.

Разберём Ваш случай бесплатно

Покажем, какие каналы дадут заявки именно в Вашей отрасли за 1–2 дня.

Подобрать решение за 1 мин

Читайте также