robots.txt — это текстовый файл, расположенный в корневой директории веб-сайта, который содержит инструкции для поисковых роботов (краулеров) о том, какие страницы или разделы сайта следует индексировать, а какие — игнорировать. Этот файл помогает контролировать доступ поисковых систем к определенным частям сайта, улучшая управление его видимостью в результатах поиска.
robots.txtUser-agent: *
Disallow: /
Этот файл запрещает всем поисковым роботам индексацию всех страниц сайта.
User-agent: *
Disallow:
Этот файл разрешает всем поисковым роботам индексацию всех страниц сайта.
User-agent: *
Disallow: /admin/
Disallow: /private/
Disallow: /tmp/
Этот файл запрещает всем поисковым роботам индексацию страниц, расположенных в каталогах /admin/, /private/ и /tmp/.
User-agent: Googlebot
Disallow: /no-google/
User-agent: *
Disallow:
Этот файл запрещает индексацию раздела /no-google/ только для робота Googlebot, а всем остальным роботам разрешает индексацию всех страниц сайта.
User-agent: *
Disallow:Sitemap: https://www.example.com/sitemap.xml
Этот файл разрешает всем роботам индексацию всех страниц сайта и указывает местоположение карты сайта sitemap.xml.
User-agent: *
Disallow: /*?sessionid=
Disallow: /*?ref=
Этот файл запрещает всем роботам индексацию URL с параметрами sessionid и ref.
Также рекомендуем к прочтению: Гайд по robots.txt для начинающих SEO-специалистов
Укажите тематику вашего бизнеса и мы пришлем вам кейсы в ближайшее время