Закрыть от индексации сайт, это дать поисковым системам команду не добавлять страницы в поиск, чтобы их не находили пользователи Яндекса и Google. Делают это через файл robots.txt, метатег robots, HTTP-заголовок X-Robots-Tag или пароль на уровне сервера, и способ выбирают под конкретную задачу: спрятать весь сайт, отдельную страницу или один блок.
Мы в lucky-seo продвигаем сайты бизнеса и регулярно чиним последствия одной ошибки: технический сайт или новую версию закрыли на разработке, а потом забыли открыть, и живой проект месяцами не растёт в поиске. Эта статья разбирает, как закрыть сайт от индексации правильно и обратимо, чем сканирование отличается от индексации и как потом проверить результат. Разберём каждый способ на примерах, чтобы вы не потеряли трафик и заявки на ровном месте.
- Что такое закрыть от индексации сайт и зачем это нужно
- Чем сканирование отличается от индексации
- Как запретить сканирование сайта через robots.txt
- Закрытие страницы от сканирования в robots.txt
- Закрытие от индексации Яндекс и Google всей страницы
- Закрыть сайт с помощью серверного файла htaccess
- Скрываем только часть или определённый блок на странице
- Скрыть от индексирования страницы в CMS на примере WordPress
- Как проверить правильность запрета индексации
- Частые вопросы
- Выводы
Что такое закрыть от индексации сайт и зачем это нужно
Закрыть от индексации сайт означает запретить поисковым роботам показывать его страницы в результатах поиска. Сама страница остаётся в интернете и открывается по прямой ссылке, но по запросам в Яндексе и Google её уже не найдут, потому что робот получил команду не включать её в базу выдачи.
Бизнесу это нужно чаще, чем кажется. Тестовая версия сайта, админка, страницы корзины и оформления заказа, дубли с параметрами фильтров, служебные разделы, PDF с прайсом для менеджеров, все они засоряют выдачу и размывают релевантность. Когда в поиск попадает мусор, поисковик хуже понимает, о чём сайт, а это бьёт по позициям коммерческих страниц, которые приводят клиентов.
Есть и оборотная сторона медали: закрыть от индексации проще, чем потом вернуть. Робот сначала должен снова обойти страницу, увидеть снятый запрет и переоценить её, а это занимает от нескольких дней до нескольких недель. Поэтому закрытие всегда планируют заранее и снимают запрет сразу после переезда или запуска.
Чем сканирование отличается от индексации
Сканирование (crawling), это обход страниц роботом, а индексация (indexing), это добавление их содержимого в базу поиска. Разница принципиальная, потому что от неё зависит, какой инструмент сработает в вашей задаче, а какой создаст новую проблему.
При сканировании робот заходит на страницу, читает код и ссылки, но ещё не решает, показывать её в выдаче или нет. Индексация, это следующий шаг: робот кладёт содержимое в базу и начинает отдавать страницу по запросам. Файл robots.txt управляет именно сканированием, он говорит роботу «сюда не ходи». Метатег robots и заголовок X-Robots-Tag управляют индексацией, они говорят «зайти можешь, но в поиск не добавляй».
Отсюда частая ловушка. Если закрыть страницу в robots.txt, робот на неё не зайдёт и не увидит на ней метатег noindex. В результате страница, на которую ведут внешние ссылки, всё равно может попасть в выдачу без описания, с пометкой, что содержимое недоступно. Чтобы гарантированно убрать страницу из поиска, её оставляют открытой для сканирования, но закрывают метатегом noindex.
Определитесь с задачей до выбора инструмента. Нужно скрыть страницу из поиска полностью, ставьте метатег noindex и не блокируйте её в robots.txt. Нужно сэкономить ресурс робота на служебных разделах, где нет ценного контента, закрывайте их в robots.txt.
Как запретить сканирование сайта через robots.txt
Запретить сканирование всего сайта можно директивой Disallow в файле robots.txt, который лежит в корне домена и доступен по адресу site.ru/robots.txt. Это самый быстрый способ увести проект с радаров поисковиков, и его чаще всего используют на этапе разработки.
Файл читается сверху вниз: сначала указывают, к какому роботу обращаются через User-agent, затем что именно запрещают через Disallow. Директива со слэшем закрывает от обхода вообще все страницы домена. Важно помнить, что robots.txt носит рекомендательный характер: добросовестные роботы Яндекса и Google его соблюдают, но он не защищает страницу от прямого открытия по ссылке и не даёт стопроцентной гарантии, что закрытый адрес не всплывёт в выдаче.
Как закрыть сайт от индексации полностью?
Чтобы закрыть весь сайт, добавьте в robots.txt блок с обращением ко всем роботам и запретом на весь каталог. Разместите файл в корне домена и проверьте, что он открывается в браузере.
User-agent: *
Disallow: /
Этот код запрещает обход всех страниц всем роботам. Для точечной настройки под конкретную систему вместо звёздочки указывают имя робота, например Yandex или Googlebot. После загрузки файла проверьте его в панели вебмастера, чтобы убедиться, что синтаксис корректный и запрет применился.
Закрытие страницы от сканирования в robots.txt
Закрыть от индексации одну страницу или раздел в robots.txt можно, указав в директиве Disallow путь к нужному адресу вместо слэша. Так поступают со служебными разделами, которые не должны тратить ресурс робота: корзина, личный кабинет, страницы поиска по сайту, результаты фильтрации.
Путь указывают относительно корня домена. Строка с адресом корзины закроет именно её, а строка с папкой закроет все страницы внутри этой папки. Можно комбинировать несколько запретов подряд для разных разделов в одном блоке User-agent.
Как закрыть страницу от индексации в robots.txt?
Добавьте в robots.txt директиву Disallow с точным путём к странице или папке, которую нужно скрыть от обхода. Проверьте адрес: он должен совпадать с реальным URL без имени домена.
User-agent: *
Disallow: /korzina/
Disallow: /lichnyy-kabinet/
Disallow: /search/
Помните оговорку из раздела про разницу сканирования и индексации: если на закрытую страницу ведут внешние ссылки, для гарантированного удаления из поиска лучше использовать метатег noindex, а не только robots.txt. Файл robots.txt хорошо экономит краулинговый бюджет, но не заменяет прямой запрет индексации.
Закрытие от индексации Яндекс и Google всей страницы
Закрыть страницу от индексации в Яндексе и Google надёжнее всего метатегом robots со значением noindex, который прописывают в HTML-код страницы внутри тега head. В отличие от robots.txt, этот способ даёт роботу прямую команду не добавлять страницу в поиск, и он работает надёжнее, потому что не зависит от внешних ссылок.
Метатег читается роботом при заходе на страницу, поэтому страница должна оставаться открытой для сканирования. Значение noindex запрещает индексацию, а дополнительное nofollow запрещает переходить по ссылкам с этой страницы. Для полного скрытия обычно используют комбинацию обоих значений.
html
<meta name="robots" content="noindex, nofollow">
Этот тег помещают в секцию head каждой страницы, которую нужно убрать из поиска. Яндекс и Google понимают общее имя robots, но при необходимости можно обратиться к конкретному роботу, заменив robots на yandex или googlebot. После установки тега страница постепенно выпадет из выдачи при следующих обходах.
Самая дорогая ошибка бизнеса, оставить noindex на всём сайте после переезда с тестовой версии на боевую. Разработчик закрыл проект на время сборки, сайт запустили, а метатег забыли снять. Проходят недели, реклама крутится, а органического трафика ноль, потому что поисковик честно выполняет команду не индексировать. Проверяйте код боевого сайта на noindex сразу после запуска.
Закрыть сайт с помощью серверного файла htaccess
Закрыть сайт от индексации на уровне сервера можно через файл htaccess, добавив HTTP-заголовок X-Robots-Tag или защитив каталог паролем. Этот способ работает даже для файлов, у которых нет HTML-кода, например для PDF, изображений и архивов, куда метатег robots не вставишь.
Файл htaccess лежит в корне сайта на серверах с Apache и управляет поведением сервера. Заголовок X-Robots-Tag передаёт роботу ту же команду noindex, но на уровне ответа сервера, а не внутри страницы. Второй вариант, парольная защита раздела, полностью закрывает доступ и роботам, и посторонним людям, это самый жёсткий способ спрятать тестовую версию.
Header set X-Robots-Tag "noindex, nofollow"
Строка выше запрещает индексацию всех файлов, к которым применяется этот htaccess. Настройку через серверный файл стоит доверить разработчику или подрядчику, потому что ошибка в синтаксисе htaccess может уронить весь сайт с ошибкой сервера, а не просто закрыть его от поиска.
Скрываем только часть или определённый блок на странице
Скрыть от индексации отдельный блок на странице, оставив саму страницу в поиске, штатными средствами Google напрямую нельзя, но частичные решения есть. Полностью гибкого метатега для куска текста в актуальных алгоритмах не существует, поэтому задачу решают обходными путями.
Раньше в Яндексе для этого применяли тег noindex, оборачивая им ненужный фрагмент, но его поддержка нестабильна и на Google он не действует. Более надёжный приём, выносить служебный контент в отдельный файл и подгружать его так, чтобы робот не считал его частью основного текста, либо закрывать ссылки атрибутом rel nofollow. Если блок повторяется на многих страницах и создаёт дубли, чаще выгоднее пересобрать шаблон, чем прятать текст.
Как закрыть от индексации ссылку, а не всю страницу?
Закрыть отдельную ссылку от передачи веса можно атрибутом rel nofollow прямо в теге ссылки. Так поступают с рекламными и партнёрскими ссылками, а также ссылками на страницы, которым не нужен вес.
Атрибут добавляют внутрь тега a, и робот перестаёт учитывать эту ссылку при передаче ссылочного веса. Это не убирает саму страницу из поиска, а лишь управляет тем, как распределяется авторитет между разделами сайта.
Скрыть от индексирования страницы в CMS на примере WordPress
Закрыть от индексации страницы в WordPress проще всего через SEO-плагин, не редактируя код вручную. В большинстве систем управления сайтом (CMS) настройка индексации вынесена в интерфейс, и это снижает риск ошибки для тех, кто не работает с кодом.
В WordPress есть общий переключатель в настройках чтения, который закрывает от индексации весь сайт одной галочкой, его удобно включать на время разработки. Для отдельных страниц и записей используют плагины вроде Yoast SEO или All in One SEO: в блоке настроек каждой страницы включают запрет индексации, и плагин сам подставляет нужный метатег noindex в код. Другие CMS, Tilda, Bitrix, OpenCart, тоже имеют собственные переключатели индексации в настройках страниц.
Как закрыть сайт от индексации в WordPress на время разработки?
Зайдите в раздел настроек чтения WordPress и включите опцию, которая просит поисковые системы не индексировать сайт. Она добавляет запрет автоматически и снимается одной галочкой после запуска.
Помните, что этот переключатель, это та самая ловушка из блока про noindex: после запуска боевого сайта галочку обязательно снимают, иначе проект останется невидимым для поиска. Внесите этот пункт в чек-лист запуска, чтобы не потерять недели трафика.
Как проверить правильность запрета индексации
Проверить, закрыт ли сайт от индексации, можно через панели вебмастера Яндекса и Google, а также прямым просмотром кода страницы и файла robots.txt. Проверка обязательна и после закрытия, и после снятия запрета, потому что молчаливая ошибка тут стоит месяцев потерянного трафика.
Как понять, что страница закрыта от индексации?
Откройте исходный код страницы и найдите в секции head метатег robots со значением noindex, а в файле robots.txt проверьте наличие директивы Disallow для нужного адреса. Дополнительно используйте инструменты проверки индексации в панелях вебмастера.
Пройдите по шагам, чтобы ничего не упустить:
- Откройте страницу в браузере и вызовите просмотр исходного кода сочетанием клавиш.
- Найдите в секции head метатег robots и проверьте, стоит ли в нём noindex.
- Откройте файл robots.txt по адресу вашсайт.ru/robots.txt и проверьте директивы Disallow.
- Зайдите в Яндекс Вебмастер, в инструмент анализа robots.txt, и проверьте нужный URL.
- В Google Search Console используйте проверку URL, чтобы увидеть статус индексации.
- После снятия запрета отправьте страницу на переобход, чтобы ускорить возврат в поиск.
Не полагайтесь на один инструмент. По нашему опыту продвижения расхождение между тем, что написано в коде, и тем, что видит поисковик, встречается регулярно, особенно после переездов и обновлений CMS. Полезно держать под рукой отдельный чек-лист по проверке индексации сайта и сверяться с ним перед каждым запуском.
| Способ закрытия | Что закрывает | Где применяется | Гарантия удаления из поиска |
|---|---|---|---|
| robots.txt (Disallow) | сканирование страниц и разделов | корень домена | частичная, не защищает от внешних ссылок |
| Метатег robots noindex | индексацию конкретной страницы | секция head в HTML | высокая для страниц с HTML-кодом |
| X-Robots-Tag в htaccess | индексацию любых файлов | серверный ответ Apache | высокая, работает и для PDF, изображений |
| Пароль на каталог | доступ целиком | сервер | полная, скрывает и от людей, и от роботов |
| Настройка в CMS | индексацию через плагин | интерфейс WordPress и других CMS | зависит от корректности плагина |
Из таблицы видно логику выбора. Для тестовой версии на время разработки удобнее пароль или переключатель в CMS. Для точечного скрытия живых страниц нужен метатег noindex. Для служебных разделов без ценного контента подходит robots.txt. А для файлов без HTML остаётся только серверный X-Robots-Tag. Подробнее о том, как именно закрыть сайт от индексации в robots txt, мы разбираем в отдельном материале.
Частые вопросы
Как закрыть от индексации весь сайт быстрее всего?
Быстрее всего закрыть весь сайт через директиву Disallow со слэшем в файле robots.txt в корне домена. Для более надёжного результата на время разработки лучше поставить пароль на каталог или включить запрет индексации в настройках CMS, потому что robots.txt носит рекомендательный характер и не даёт полной гарантии.
В чём разница между robots.txt и метатегом noindex?
Файл robots.txt запрещает роботу сканировать страницу, а метатег noindex запрещает добавлять её в поиск. Если закрыть страницу только в robots.txt, робот не зайдёт на неё и не увидит noindex, поэтому по внешним ссылкам она всё равно может попасть в выдачу. Для гарантированного удаления из поиска страницу оставляют открытой для сканирования и ставят на неё метатег noindex.
Через сколько страница выпадет из поиска после запрета?
Обычно страница выпадает из выдачи в течение от нескольких дней до нескольких недель после того, как робот снова её обойдёт и увидит запрет. Ускорить процесс можно, отправив страницу на переобход через панель вебмастера Яндекса или Google Search Console.
Как вернуть сайт в индекс после закрытия?
Снимите запрет во всех местах, где он стоит: уберите Disallow из robots.txt, удалите метатег noindex из кода и снимите галочку в настройках CMS. После этого отправьте страницы на переобход в панелях вебмастера. Возврат в поиск занимает время, потому что роботу нужно заново обойти и переоценить страницы.
Влияет ли закрытие лишних страниц на позиции сайта?
Да, грамотное закрытие служебных и дублирующих страниц обычно помогает позициям коммерческих разделов. Когда в поиск не попадает мусор вроде корзины, фильтров и технических дублей, поисковику проще понять структуру сайта и его основную тему, а это работает на релевантность нужных страниц.
Выводы
Закрыть от индексации сайт, это рабочий инструмент технического SEO, а не редкая операция: им пользуются на каждой разработке, при переездах и для чистки выдачи от служебных страниц. Главное, выбирать способ под задачу: robots.txt для экономии ресурса робота, метатег noindex для надёжного скрытия живой страницы, серверный htaccess для файлов без HTML и пароль для полной защиты тестовой версии.
Самый дорогой риск здесь не в самом закрытии, а в том, что запрет забудут снять после запуска. Поэтому проверка индексации обязательна и после закрытия, и после открытия сайта, а пункт про noindex стоит внести в чек-лист запуска. Если разбор технических ошибок и индексации кажется зоной риска для вашего проекта, эту часть логично доверить специалистам, которые продвигают сайты и видят такие грабли на практике.
Опубликовано в 2026 году. Проверено на актуальность: подход работает на текущих алгоритмах Яндекса и Google.
