Купить Корзина
  • Облако и ИТ-инфраструктура
  • Продукты
    • Сайт под ключ
    • Сайт под ключ на Tilda
    • Интернет-магазин под ключ
    • Конструктор сайтов Рег.ру
  • Продукты
    • SEO-продвижениеКомплексное продвижение под ключ — 6 тарифов, стратегия, тексты, ссылки и аналитика
    • SEO-стартБазовая оптимизация с фиксированной ценой
    • SEO-аудитТехнический разбор вашего сайта с рекомендациями по улучшению
  • Продукты
    • Зарегистрировать новый домен
    • Освобождающиеся домены
    • Магазин доменов
    • Доменный брокер
    • Продлить домен
    • Перенести домен в Рег.ру
    • Проверить домен в Whois-сервисе
  • Продукты
    • Базовые тарифы хостинга
    • ВИП-тарифы хостинга
    • Хостинг для 1C-Битрикс
    • Продление хостинга
    • Бесплатный перенос сайта в Рег.ру
    • Сайт на WordPress
  • Продукты
    • Почта на доменеНастройте почту и создайте ящики самостоятельно
  • Продукты
    • Заказать SSL-сертификат
    • Бесплатный SSL-сертификат
    • SSL-сертификаты Wildcard
    • SSL-сертификаты GlobalSign
    • SSL‑сертификаты ТЦИ
    • Проверка SSL-сертификата
  • Продукты
    • Сервис для онлайн-записи YCLIENTS
    • Контур Диадок
    • Электронная подпись от Контура
    • Торговый эквайринг от СберБизнеса
    • Регистрация своего дела со СберБизнесом
    • Антивирус для сайта
    • Лицензия 1С-Битрикс
    • Автоматическое SEO-продвижение
    • Яндекс Директ
    • Яндекс Бизнес
  • Продукты
    • Виртуальные VPS
    • Высокочастотные VPS
    • Дешевые VPS
    • Облачные VPS
    • Управляемые VPS
    • Перенести VPS в Рег.ру
  • Рег.решения
    • Сайт с SEO-продвижением под ключРазработаем дизайн, запустим сайт за 7 дней и сразу настроим SEO-продвижение
    • Подробнее
  • Рег.решения
    • SEO-продвижение под ключ – от 9 900 ₽Берем всю SEO-настройку сайта на себя: аудит, стратегию, технические аспекты, контент и ежемесячные отчеты. Вы занимаетесь бизнесом — мы растим трафик
    • Настроить продвижение
  • Рег.решения
    • Сайт под ключ — от 10 939 ₽Дизайн, наполнение, запуск — мы делаем всё за вас. Домен бесплатно
    • Сайт под ключ на Tilda — от 19 950 ₽Дизайн, интеграции, аналитика. Домен бесплатно
    • Почта под ключ — 4 095 ₽Настроим почту на домене за вас и перенесем письма со старого ящика
    • Многодоменов .ru/.рф — 979 ₽Регистрация доменов по выгодным ценам — чем больше, тем выгоднее
  • Рег.решения
    • Пакет услуг для сайта на хостинге — 5 299 ₽Домен, хостинг и другие инструменты для надежной работы сайта
    • Пакет услуг для высоконагруженных проектов — 60 999 ₽Обеспечьте быструю и бесперебойную работу одного или нескольких сайтов
    • Кибербезопасность сайта — 10 099 ₽Защита сайта и клиентов от утечки данных, спама, фишинга и других угроз
  • Рег.решения
    • Почта под ключ — 4 095 ₽Настроим почту на домене за вас и перенесем письма со старого ящика
    • Сайт и почта под ключ — от 8 399 ₽Современный сайт для бизнеса и корпоративная почта на вашем домене
  • Рег.решения
    • Пакет услуг для сайта на хостинге — 5 299 ₽Домен, хостинг и другие инструменты для надежной работы сайта
    • Пакет услуг для высоконагруженных проектов — 62 099 ₽Обеспечьте быструю и бесперебойную работу одного или нескольких сайтов
    • Кибербезопасность сайта — 10 099 ₽Защита сайта и клиентов от утечки данных, спама, фишинга и других угроз
  • Рег.решения
    • Упаковка бренда — 5 444 ₽
    • Аналитика ниши и товаров — 1 490 ₽
    • Поиск сотрудников — 6 599 ₽
    • Пакет услуг для открытия бизнеса — 80 399 ₽
    • Онлайн-присутствие вашего бизнеса — 8 229 ₽
  • Рег.облако
    • Выделенные серверыГотовые физические (Bare Metal) серверы, большой выбор конфигураций
    • Облачные серверыВиртуальные машины, автоустановка приложений, конфигуратор тарифов
    • Управляемые базы данных (DBaaS)Кластеры баз данных PostgreSQL и MySQL с репликацией
    • Кластеры Kubernetes (KaaS)Сервис автоматизированного развертывания кластеров Kubernetes
    • Частное облако VMwareИзолированное облако под управлением заказчика, индивидуальная конфигурация
    • Объектное хранилище S3Масштабируемое хранилище с платой только за использованные ресурсы
  • Телефон в Москве

    +7 495 580-11-11
  • Бесплатный звонок по России

    8 800 555-34-78
  • Или обратитесь в наши офисы

    Региональные номера
    1. База знаний
    2. Хостинг
    3. Продвижение сайта
    4. Как настроить robots.txt

    Как настроить robots.txt

    Файл robots.txt содержит правила для поисковых роботов. С его помощью можно управлять обходом отдельных страниц и разделов сайта. Важно: Disallow ограничивает обход URL, но не гарантирует удаление страницы из поисковой выдачи. Если страницу нужно исключить из поиска, используйте noindex.

    Что такое robots.txt

    Файл robots.txt — это текстовый документ с правилами для поисковых роботов. Поисковые системы могут использовать его, чтобы определить, какие URL сайта разрешено или запрещено обходить.

    Файл должен называться robots.txt и находиться в корневом каталоге сайта. Например:

    https://example.com/robots.txt

    Правила файла действуют для конкретного хоста. Если на сайте используются поддомены, для каждого из них может потребоваться отдельный файл robots.txt.

    Зачем нужен файл robots.txt

    Файл используют для управления обходом сайта поисковыми роботами.

    С помощью robots.txt можно:

    • запретить обход отдельных страниц,
    • закрыть от обхода каталог сайта,
    • задать разные правила для поисковых роботов,
    • разрешить обход отдельных URL внутри закрытого каталога,
    • указать адрес файла sitemap.xml.

    Например, robots.txt может понадобиться для служебных разделов, страниц внутреннего поиска или других URL, которые не нужно регулярно обходить.

    Не используйте файл для защиты конфиденциальных данных. Правила robots.txt не ограничивают доступ пользователей к страницам сайта. Кроме того, не все роботы обязаны их соблюдать.

    Основные директивы robots.txt

    Файл robots.txt строится на нескольких ключевых директивах. Ниже — основные из них.

    Директива
    Назначение
    Обязательность
    User-agent
    Указывает, для какого поискового робота действует группа правил. * — для всех роботов
    Да
    Disallow
    Запрещает обход указанного URL или раздела сайта
    Нет
    Allow
    Разрешает обход URL внутри области, закрытой директивой Disallow
    Нет
    Sitemap
    Указывает адрес XML-карты сайта
    Рекомендуется
    Clean-param
    Указывает Яндексу параметры URL, которые не влияют на содержимое страницы
    Нет

    В таблице отмечены обязательные и необязательные директивы. Рассмотрим каждую из них подробнее.

    • User-agent

    Директива User-agent определяет поискового робота, для которого действуют следующие правила. Например:

    User-agent: Googlebot

    Чтобы задать правило для всех поисковых роботов, используйте символ *:

    User-agent: *
    • Disallow

    Директива Disallow запрещает роботу обход указанного URL или раздела. Например, чтобы запретить обход страницы /vip.html:

    User-agent: *
    Disallow: /vip.html

    Чтобы запретить обход каталога /private/:

    User-agent: *
    Disallow: /private/

    Пустое значение Disallow означает, что запрета на обход нет:

    User-agent: *
    Disallow:
    • Allow

    Директива Allow разрешает обход URL внутри области, закрытой директивой Disallow. Например:

    User-agent: *
    Disallow: /private/
    Allow: /private/public.html

    В этом примере обход каталога /private/ запрещен, но робот может обойти URL /private/public.html.

    • Sitemap

    Директива Sitemap указывает адрес XML-карты сайта. Например:

    Sitemap: https://example.com/sitemap.xml

    Карта сайта помогает поисковым роботам находить URL сайта.

    • Clean-param

    Clean-param — директива Яндекса для работы с параметрами URL. Она позволяет указать параметры, которые не влияют на содержимое страницы и которые Яндекс может игнорировать при обработке таких URL. Например:

    User-agent: Yandex
    Clean-param: utm_source&utm_medium&utm_campaign

    Clean-param является расширением Яндекса и не является универсальной директивой для всех поисковых роботов.

    • Спецсимволы

    В правилах robots.txt можно использовать специальные символы:

    * — заменяет любую последовательность символов,

    $ — обозначает конец URL.

    Например:

    User-agent: *
    Disallow: /*.pdf$

    Такое правило запрещает обход URL, которые заканчиваются на .pdf.

    Как создать файл robots.txt

    Настройка robots.txt включает следующие шаги:

    • 1
      Откройте текстовый редактор и сохраните новый файл с именем robots.txt.
    • 2

      Добавьте правила для поисковых роботов. Например, чтобы запретить обход каталога /private/, укажите:

      User-agent: *
      Disallow: /private/
    • 3
      Загрузите robots.txt в корневой каталог сайта через файловый менеджер хостинга или по протоколу FTP/SFTP.
    • 4

      Чтобы убедиться, что файл доступен, откройте в браузере:

      https://example.com/robots.txt

      где example.com — доменное имя вашего сайта.

    Яндекс рекомендует, чтобы сервер возвращал для robots.txt код HTTP 200.

    robots.txt должен находиться в корневом каталоге сайта. Файл в подкаталоге не используется как основной файл правил для всего сайта.

    Примеры настройки robots.txt

    Ниже приведены примеры распространенных сценариев настройки robots.txt. Выберите подходящий пример и измените его с учетом структуры сайта.

    Как разрешить обход всего сайта

    Чтобы разрешить поисковым роботам обход всего сайта, укажите:

    User-agent: *
    Disallow:

    При необходимости можно указать карту сайта:

    User-agent: *
    Disallow:
    
    Sitemap: https://example.com/sitemap.xml
    Как закрыть от обхода одну страницу

    Чтобы запретить обход страницы /vip.html, укажите:

    User-agent: *
    Disallow: /vip.html
    Как закрыть от обхода каталог

    Чтобы запретить обход URL в каталоге /private/, укажите:

    User-agent: *
    Disallow: /private/
    Как разрешить страницу внутри закрытого каталога

    Чтобы запретить обход каталога /private/, но разрешить страницу /private/public.html, укажите:

    User-agent: *
    Disallow: /private/
    Allow: /private/public.html
    Как задать правило для конкретного поискового робота

    Чтобы запретить обход страницы только роботу Google, укажите:

    User-agent: Googlebot
    Disallow: /vip.html

    Чтобы запретить роботу Яндекса обход всего сайта, кроме URL, начинающихся с /shared, укажите:

    User-agent: Yandex
    Disallow: /
    Allow: /shared
    Как запретить обход всего сайта

    Чтобы запретить обход сайта всем поисковым роботам, укажите:

    User-agent: *
    Disallow: /

    Используйте это правило с осторожностью. Оно запрещает поисковым роботам обход URL сайта. Если страницы уже известны поисковой системе, Disallow не гарантирует их удаление из поисковой выдачи.

    После загрузки файла обязательно проверьте его работу.

    Как проверить robots.txt

    Для проверки robots.txt выполните следующие шаги:

    • 1

      Откройте в браузере адрес формата https://example.com/robots.txt. Убедитесь, что файл открывается и содержит нужные правила.

    • 2

      В Яндекс Вебмастере откройте инструмент Анализ robots.txt. С его помощью можно:

      • проверить синтаксис файла,

      • найти ошибки,

      • проверить, разрешен ли обход конкретного URL.

    • 3

      После изменения файла убедитесь, что правила не закрыли важные страницы сайта от обхода. Например:

      • главную страницу,

      • страницы товаров и услуг,

      • разделы сайта,

      • статьи.

    Файл robots.txt доступен, а правила работают корректно.

    Частые ошибки при настройке robots.txt

    Даже при правильной настройке robots.txt легко допустить ошибку, которая повлияет на обход сайта поисковыми роботами. Вот самые частые из них.

    Ошибка
    В чем проявляется
    Как исправить
    Файл находится не в корневом каталоге
    Файл доступен по адресу https://example.com/files/robots.txt, а не https://example.com/robots.txt
    Загрузите файл в корневой каталог сайта
    Неправильное имя файла
    Файл называется robot.txt или robots.txt.txt
    Переименуйте файл в robots.txt
    Весь сайт случайно закрыт от обхода
    Добавлено правило Disallow: /, которое запрещает обход всех URL сайта
    Проверьте файл перед публикацией. Если правило добавлено случайно, удалите его или измените на нужное
    Используют robots.txt для запрета индексирования
    Ожидают, что Disallow удалит страницу из поисковой выдачи
    Для исключения страницы из поиска используйте noindex в метатеге robots или HTTP-заголовке X-Robots-Tag. URL при этом должен быть доступен для обхода
    Используют Crawl-delay
    Пытаются управлять скоростью обхода через Crawl-delay
    Google не поддерживает Crawl-delay. Скорость обхода Яндекса настраивается в Яндекс Вебмастере
    Используют robots.txt для защиты данных
    Ожидают, что файл ограничит доступ к конфиденциальным разделам
    robots.txt не ограничивает доступ пользователей. Для защиты данных настройте авторизацию и ограничение доступа на стороне сайта или сервера
    Указывают неправильный путь
    Правило не соответствует нужному URL или разделу сайта
    Проверьте путь в Disallow или Allow. Проверьте действие правила через инструмент Анализ robots.txt в Яндекс Вебмастере

    Чтобы избежать ошибок, проверяйте robots.txt после каждого изменения. Убедитесь, что файл доступен по адресу формата https://example.com/robots.txt, а правила не запрещают обход важных страниц.

    Частые вопросы

    Где находится файл robots.txt?

    Файл должен находиться в корневом каталоге сайта и быть доступен по адресу:

    https://example.com/robots.txt

    где example.com — доменное имя вашего сайта.

    Для поддоменов могут потребоваться отдельные файлы.

    Как настроить robots.txt, чтобы разрешить обход всего сайта?

    Добавьте:

    User-agent: *
    Disallow:

    Такое правило разрешает поисковым роботам обходить URL сайта.

    Как закрыть весь сайт от обхода поисковыми роботами?

    Добавьте:

    User-agent: *
    Disallow: /

    Это правило запрещает поисковым роботам обход URL сайта. Используйте его только при необходимости.

    Можно ли удалить страницу из поиска с помощью robots.txt?
    Нет. Disallow ограничивает обход URL, но не гарантирует удаление страницы из поисковой выдачи. Если страницу нужно исключить из поиска, используйте noindex или другой подходящий способ. URL при этом должен быть доступен роботу, чтобы он мог обработать директиву noindex.
    Как проверить настройку robots.txt?
    Откройте файл по адресу формата https://example.com/robots.txt и проверьте правила в Яндекс Вебмастере с помощью инструмента «Анализ robots.txt».

    Помогла ли вам статья?

    Спасибо за оценку. Рады помочь 😊

     👍
    Специальные предложения
    • Гранты для бизнеса до 500к
    • Скидки на cloud GPU до 50%
    • Скидки на bare-metal с А4000 и А5000
    • Кешбэк 100% на kubernetes
    • vk
    • telegram
    • ok
    • vc
    • dzen
    • rbc
    • max
    • Продукты
      • Домены
      • Хостинг
      • Почта
      • SSL-сертификаты
      • Конструктор сайтов
      • VPS и VDS серверы
      • Магазин доменов
      • Облако для бизнеса
    • Решения по сфере бизнеса
      • Подойдут всем
      • Маркетплейсы
      • Образование
      • Бьюти
      • Медицина
      • Автосервисы
      • Бытовые услуги
      • Досуг
      • Спорт
      • Все решения
    • Сервисы
      • Whois – проверить данные домена
      • Определить IP адрес
      • Проверить порт на доступность
      • Проверить IP адрес сайта
      • Перевести домен в Punycode
      • Проверить скорость интернета
    • Компания
      • О компании
      • Контакты
      • Офисы
      • Новости
      • Акции и скидки
      • Блог
      • Отзывы клиентов
    • Полезное
      • Стоимость услуг
      • Способы оплаты
      • Бонусная программа
      • Документы
      • База знаний
      • ЭДО
      • Партнерам
    • Другое
      • РБК: новости России и мира сегодня
      • Новости компаний РФ
      • РБК Инвестиции: курсы валют
      • Спецпроект с Онлайн Патентом
      • РБК Курсы

    Облачная платформа Рег.ру включена в реестр российского ПО Запись № 23682 от 29.08.2024

    • mintsifry
    • icann
    • cctld
    © ООО «РЕГ.РУ»
    • Политика конфиденциальности
    • Политика обработки персональных данных
    • Правила применения рекомендательных технологий
    • Правила пользования и другие правила и политики
    • Сообщить о нарушении
    • Используем куки, это делает удобнее вашу работу с сайтом