Robots txt пример: готовые образцы файла и настройка индексации для сайта бизнеса

Robots txt пример, это готовый образец текстового файла в корне сайта, который подсказывает поисковым роботам, какие страницы можно обходить, а какие закрыть от индексации. Ниже разберём, как файл устроен, покажем рабочие примеры для типовых сайтов и объясним, где бизнес чаще всего теряет позиции из-за одной кривой строки.

Мы в lucky-seo продвигаем сайты бизнеса и на аудитах регулярно находим, как один неверный запрет в этом файле закрывает от поиска половину каталога или, наоборот, пускает в выдачу корзину и админку. Файл выглядит безобидно, четыре строки текста, но его ошибки стоят реальных заявок. Ниже соберём разбор по полкам с примерами, которые можно скопировать и адаптировать под свой проект.

Что такое robots txt пример и зачем он нужен бизнесу

Robots txt пример показывает, как должен выглядеть служебный файл, который лежит по адресу вашсайт.ру/robots.txt и первым встречает поискового робота. В нём вы указываете, каким ботам разрешён обход, какие разделы закрыты и где искать карту сайта. Для поисковика это не жёсткий закон, а рекомендация, но Яндекс и Google её соблюдают.

Бизнесу файл важен не сам по себе, а через деньги. Если в индекс попадают дубли, страницы фильтров, корзина и технические разделы, поисковик тратит краулинговый бюджет (crawl budget) на мусор, а важные коммерческие страницы обходит реже. В итоге карточки товаров и посадочные под заявки индексируются медленнее, а позиции проседают.

Обратная и более опасная ситуация, когда одной строкой закрывают весь сайт. Такое случается после переезда с тестового домена, где стоял полный запрет, и его забыли снять на боевом. Сайт исчезает из выдачи целиком, трафик падает в ноль, а причина прячется в одной строке файла.

Как устроен файл robots txt: директивы и синтаксис

Файл robots.txt состоит из блоков правил, каждый блок начинается с указания робота, к которому он применяется, и дальше идут разрешения и запреты. Синтаксис простой, но чувствительный к регистру и опечаткам, поэтому лишний пробел или неверная директива ломают всё правило.

Ключевые директивы всего несколько, и запомнить их несложно:

  • User-agent, указывает, к какому роботу относятся правила ниже (звёздочка значит все роботы)
  • Disallow, запрещает обход указанного пути или раздела
  • Allow, разрешает обход внутри уже закрытого раздела (точечное исключение)
  • Sitemap, задаёт полный адрес карты сайта в формате XML
  • Clean-param, для Яндекса убирает из обхода дубли по GET-параметрам

Правила читаются сверху вниз, но приоритет у более длинного и точного пути, а не у порядка строк. Если Disallow закрывает папку целиком, а Allow открывает внутри неё один подраздел, робот учтёт оба правила и обойдёт разрешённое исключение.

Как закрыть от индексации папку или раздел?

Чтобы закрыть папку, укажите её путь в директиве Disallow со слешем на конце: строка Disallow: /admin/ запретит роботу весь раздел администрирования вместе со всем содержимым. Robots txt папка закрывается именно так, одной директивой на весь каталог, а не перечислением каждого файла внутри.

Если внутри закрытой папки есть страница, которая должна попасть в индекс, добавьте под запретом директиву Allow с точным путём к ней. Робот сопоставит оба правила и обойдёт разрешённое исключение, оставив остальное закрытым.

Чем отличается закрытие в robots txt от noindex?

Запрет в robots.txt мешает роботу обойти страницу, а мета-тег noindex запрещает показывать её в выдаче, и это принципиально разные механики. Закрытая в robots.txt страница может остаться в индексе как ссылка без описания, если на неё ведут внешние ссылки, потому что робот к ней просто не пришёл и не увидел запрет на показ.

Правило простое: хотите убрать страницу из выдачи полностью, оставьте её открытой для обхода в robots.txt и повесьте мета-тег noindex. Хотите сэкономить краулинговый бюджет на мусорных разделах, закрывайте их в robots.txt. Путать эти инструменты, значит получить страницы-призраки в поиске.

Рекомендация

После правки файла всегда проверяйте его в Яндекс Вебмастере и Google Search Console через инструмент проверки robots.txt. Введите конкретный URL и посмотрите, разрешён он или закрыт: это отлавливает ошибку за минуту, до того как она вырежет из индекса живые страницы.

Пошаговая инструкция: как составить robots txt под свой сайт

Составить рабочий файл можно за один заход, если идти по порядку и не закрывать лишнего. По нашему опыту продвижения именно спешка и копирование чужого файла без разбора дают потом просадку позиций, поэтому проходите шаги последовательно.

  1. Создайте обычный текстовый файл с именем robots.txt в кодировке UTF-8 без BOM.
  2. Первой строкой пропишите User-agent: * для правил, общих для всех роботов.
  3. Закройте служебные разделы: корзину, личный кабинет, страницы поиска, админку, теги сортировки.
  4. Откройте через Allow нужные исключения внутри закрытых папок, если такие есть.
  5. Добавьте отдельный блок User-agent: Yandex с директивой Clean-param для дублей по параметрам.
  6. Последней строкой укажите Sitemap с полным адресом карты сайта, включая https.
  7. Загрузите файл в корень сайта, чтобы он открывался по адресу вашсайт.ру/robots.txt.
  8. Проверьте каждый важный URL в инструментах Яндекс Вебмастера и Google Search Console.

Порядок не зависит от движка сайта. На WordPress, Bitrix или самописе логика одна: сначала закрываем служебное, потом открываем нужное, в конце отдаём карту сайта и проверяем результат.

Внимание

Самая дорогая ошибка, скопировать robots.txt с чужого сайта на своей CMS. Пути к служебным разделам у разных движков отличаются, и чужой файл либо закроет ваши рабочие страницы, либо оставит открытыми дубли. Чужой пример берут как ориентир по структуре, а пути прописывают под свой сайт.

Готовые примеры robots txt для разных сайтов

Ниже собраны рабочие образцы под типовые задачи бизнеса. Их берут за основу и подгоняют пути под свою CMS, а не копируют вслепую.

Минимальный универсальный пример, который открывает сайт всем роботам и отдаёт карту сайта:

User-agent: *
Disallow:
Sitemap: https://вашсайт.ру/sitemap.xml

Пример для интернет-магазина, где закрыты корзина, оформление заказа, личный кабинет и внутренний поиск:

User-agent: *
Disallow: /cart/
Disallow: /checkout/
Disallow: /personal/
Disallow: /search/
Allow: /catalog/
Sitemap: https://вашсайт.ру/sitemap.xml

Пример полного запрета для тестового домена, чтобы черновик сайта не попал в индекс до запуска:

User-agent: *
Disallow: /

Последний образец удобен на разработке, но именно он чаще всего забывается на боевом сайте и обрушивает трафик. Перед запуском проекта проверка этой строки обязательна.

Задача Ключевая директива Пример строки
Открыть весь сайт для обхода Disallow (пустой) Disallow:
Закрыть один раздел Disallow Disallow: /admin/
Открыть исключение в закрытой папке Allow Allow: /admin/help/
Полностью закрыть сайт Disallow Disallow: /
Указать карту сайта Sitemap Sitemap: https://сайт.ру/sitemap.xml
Убрать дубли по параметрам (Яндекс) Clean-param Clean-param: sort /catalog/

Из таблицы видно главное: почти вся настройка держится на двух директивах, Disallow и Allow, а остальное дополняет их под конкретную задачу. Разобравшись с этими двумя, вы закроете большинство типовых сценариев.

Частые ошибки в robots txt и как их не допустить

Ошибки в файле обходятся дорого именно потому, что незаметны: сайт работает, а трафик тихо утекает. По практике аудитов повторяются одни и те же промахи, и знание их закрывает половину проблем заранее.

Первая по частоте, оставленный полный запрет Disallow: / после переезда с тестового домена. Сайт исчезает из выдачи целиком, а владелец неделями ищет причину падения в чём угодно, кроме одной строки. Вторая, закрытие папок с CSS и JavaScript: робот не видит вёрстку, считает сайт неудобным для мобильных и снижает оценку.

Третья ошибка, вера в robots.txt как в защиту от посторонних глаз. Файл открыт всем, кто наберёт его адрес в браузере, поэтому закрывать через него секретные разделы, значит буквально показать их путь любому желающему. Для настоящей защиты нужен пароль или закрытие на уровне сервера, а не строка в robots.txt.

Можно ли одним файлом закрыть дубли страниц?

Дубли по GET-параметрам в Яндексе аккуратнее закрывать директивой Clean-param, а не сплошным Disallow, потому что она склеивает варианты страницы и передаёт их вес основному адресу. Прямой запрет параметров через Disallow тоже работает, но грубее и может закрыть нужные страницы вместе с мусорными.

Если дублей много и они рождаются фильтрами каталога, одним robots.txt проблему полностью не решить: подключают ещё канонические ссылки (canonical) и настройку CMS. Файл берёт на себя первый рубеж, но не заменяет полноценную работу с дублями. Как выстроить её в связке, разбираем в материалах про robots txt и как настроить robots txt.

Частые вопросы

Что такое robots txt пример простыми словами?

Robots txt пример, это образец текстового файла в корне сайта, который говорит поисковым роботам, какие страницы обходить, а какие пропускать. Файл лежит по адресу вашсайт.ру/robots.txt и состоит из простых директив вроде Disallow и Allow, а нужен для того, чтобы в поиск попадали важные страницы, а не служебный мусор.

Где должен лежать файл robots txt?

Файл robots.txt должен лежать строго в корне сайта и открываться по адресу вашсайт.ру/robots.txt, иначе поисковый робот его не найдёт. Положить его в подпапку или переименовать нельзя: работает только один файл с точным именем в корневой директории.

Как закрыть от индексации целую папку?

Чтобы закрыть папку, добавьте директиву Disallow с её путём и слешем на конце, например Disallow: /admin/, и весь раздел вместе с содержимым уйдёт из обхода. Robots txt папка закрывается одной строкой на весь каталог, а не перечислением каждого файла внутри.

Гарантирует ли robots txt, что страница не попадёт в поиск?

Нет, robots.txt не гарантирует отсутствие страницы в выдаче: он лишь просит робота не обходить её, но закрытая страница может остаться в индексе как ссылка без описания, если на неё ведут внешние ссылки. Чтобы убрать страницу из поиска наверняка, оставьте её открытой для обхода и повесьте мета-тег noindex.

Что будет, если сделать ошибку в robots txt?

Ошибка в robots.txt может закрыть от индексации нужные страницы или весь сайт и обрушить поисковый трафик, при этом внешне сайт продолжит работать. Самый частый случай, оставленный после переезда полный запрет Disallow: /, поэтому после каждой правки файл проверяют в Яндекс Вебмастере и Google Search Console.

Выводы

Robots txt пример, это не украшение, а рабочий инструмент управления индексацией, от которого напрямую зависит, какие страницы бизнеса увидит поиск. Файл простой, несколько директив, но цена ошибки высокая: одна лишняя строка закрывает каталог или весь сайт и режет заявки. Берите готовый образец как ориентир, но пути прописывайте под свою CMS и обязательно проверяйте результат в панелях вебмастеров.

Для владельца бизнеса вывод практичный: robots.txt входит в базовую техническую гигиену сайта наравне со скоростью и мобильной версией. Если сомневаетесь, что файл настроен верно, проще заказать технический аудит, чем терять трафик из-за строки, которую никто не перепроверил. Настроенный один раз с холодной головой, файл дальше тихо делает свою работу и не мешает сайту расти.

Опубликовано в 2026 году. Проверено на актуальность: подход работает на текущих алгоритмах Яндекса и Google.

Оцените статью
Добавить комментарий