на расчет стоимости
Работаем
по всей России
Меню сайта

Правильно настроенный robots.txt помогает управлять обходом ресурса поисковыми роботами: ограничивать сканирование служебных URL, результатов внутреннего поиска, фильтров, корзины, параметрических адресов и других страниц, которые не должны расходовать краулинговый ресурс. Обычно достаточно 1 текстового файла в корне домена и нескольких точных правил User-agent и Disallow. Однако важно различать сканирование и индексирование: запрет обхода URL сам по себе не гарантирует его удаления из поисковой выдачи. Для надежного исключения HTML-страницы из индекса применяют noindex при доступном для робота URL, авторизацию, корректный HTTP-статус 404/410 или удаление документа. Поэтому настройка выполняется не по принципу «закрыть все лишнее», а после анализа структуры, типов URL и задач SEO, например, при проведении SEO-аудита перед запуском сайта.
Пример из практики. У интернет-магазина после внедрения фильтров появились тысячи адресов с параметрами: варианты сортировки, страницы результатов поиска, комбинации характеристик и служебные URL корзины. Значительная часть таких документов не имела самостоятельной ценности для посетителей из поиска, но была доступна поисковому роботу. После технического аудита URL разделили на полезные посадочные страницы и служебные комбинации. Для последних ограничили обход там, где это было оправдано, а для документов, которые требовалось именно исключить из поисковой выдачи, использовали отдельные механизмы управления индексированием. В результате поисковая система получила более понятную структуру ресурса без риска случайно закрыть коммерческие категории и карточки товаров, что мы всегда тщательно проверяем при аудите сайта перед разработкой или редизайном.
Статистически проблема ошибок в правилах доступа далеко не формальна. Google в 2019 году сообщил, что при анализе неподдерживаемых инструкций, включая noindex внутри robots.txt, такие правила противоречили другим настройкам во всех случаях, кроме примерно 0,001% исследованных файлов. С 1 сентября 2019 года Google окончательно прекратил поддержку noindex непосредственно в этом файле. Актуальная документация Google также прямо указывает: документ, заблокированный от сканирования, при определенных условиях все равно может быть известен поисковой системе и его URL способен появиться в результатах поиска. Именно поэтому техническое SEO должно разделять задачи ограничения обхода и исключения документа из индекса.
robots.txt — текстовый служебный документ, через который владелец ресурса сообщает автоматическим краулерам правила доступа к определенным URL. Он размещается в корне хоста и доступен по стандартному адресу с окончанием /robots.txt. Когда поисковый робот начинает обход, он может обратиться к этому документу и определить, какие пути разрешены, а какие ограничены соответствующей директивой.
Основная функция заключается в управлении сканированием, а не в гарантированном удалении информации из результатов поиска. Это принципиальное различие. Если закрывать URL только через Disallow, робот перестает запрашивать его содержимое, однако сама ссылка может оставаться известной системе из внешних или внутренних источников.
На практике такой способ полезен прежде всего там, где автоматическому краулеру нет необходимости регулярно посещать определенные адреса. Это позволяет сделать обход структуры более рациональным, особенно для крупных интернет-магазинов, каталогов, маркетплейсов и информационных проектов с большим количеством автоматически создаваемых URL.
Универсального набора запретов не существует. Перед изменениями специалист изучает структуру проекта, CMS, внутреннюю перелинковку, параметры URL и данные панелей вебмастеров. Одинаковая папка на двух проектах может выполнять совершенно разные функции: на одном ресурсе она содержит бесполезные системные документы, а на другом — ценные посадочные страницы.
Перед добавлением любого пути необходимо проверить, не приводит ли он к органическому трафику и не участвует ли в формировании полезной посадочной страницы. Особенно внимательно нужно работать с фасетной навигацией. Комбинация фильтров «бренд + категория» иногда представляет ценную страницу спроса, тогда как десятки вариантов сортировки той же выдачи действительно являются лишними для поискового обхода.
Базовая логика достаточно проста. User-agent определяет, для какого краулера действует группа инструкций. Disallow сообщает путь, который соответствующему краулеру не следует обходить. Пустое значение ограничения означает отсутствие запрета в рамках соответствующего правила. В реальном проекте конфигурация может быть сложнее из-за разных групп User-agent и шаблонов URL.

| Элемент | Назначение | Пример применения | Что важно проверить |
|---|---|---|---|
| User-agent | Указывает робота, которому адресованы инструкции | User-agent: * | Какие краулеры должны выполнять правило |
| Disallow | Ограничивает сканирование указанного пути | Disallow: /cart/ | Нет ли внутри пути нужных документов |
| Allow | Разрешает доступ к более конкретному пути при наличии ограничения | Зависит от структуры URL | Поддержку и взаимодействие с другими правилами |
| Sitemap | Сообщает расположение карты ресурса | Адрес sitemap.xml | Доступность карты и наличие в ней канонических URL |
| noindex | Не является поддерживаемой Google инструкцией внутри robots.txt | Для HTML используют meta robots | Робот должен получить страницу, чтобы увидеть meta noindex |
| X-Robots-Tag | Передает правила индексирования через HTTP-заголовок | X-Robots-Tag: noindex | Доступность URL для сканирования |
| HTTP 404/410 | Сообщает, что документ отсутствует | Удаленный URL | Не возвращает ли сервер ошибочный код 200 |
| Авторизация | Защищает закрытую информацию от публичного доступа | Личный кабинет, внутренняя система | Действительно ли контент недоступен без входа |
Таблица показывает главное: один инструмент не решает все задачи. Когда требуется сократить ненужное сканирование, используется правило доступа. Когда требуется убрать HTML-документ из выдачи, чаще нужен noindex. Когда информация конфиденциальна, правильный вариант — реальное ограничение доступа, а не попытка скрывать адрес от краулера строкой в открытом служебном документе.
Это одна из наиболее распространенных ошибок при технической оптимизации. Disallow регулирует получение содержимого краулером. Noindex регулирует возможность присутствия полученного документа в поисковой выдаче. Для обработки meta noindex поисковая система должна иметь возможность загрузить документ и прочитать соответствующий тег.
Если одновременно запрещать сканирование URL и размещать внутри него meta noindex, возникает логическое противоречие: краулер не получает HTML-код и поэтому может не увидеть инструкцию. Google прямо предупреждает об этом в своей документации. Если URL уже известен благодаря ссылкам, сам адрес потенциально способен оставаться в поисковых результатах без обычного сниппета.
Поэтому сначала определяется цель. Если задача — уменьшить число запросов краулера к бесконечным фильтрам, применяются ограничения сканирования. Если задача — удалить доступный документ из органической выдачи, необходимо выбрать механизм запрета индексирования, например, через правильную настройку SEO-метатегов. Если документ вообще больше не существует, корректнее вернуть соответствующий HTTP-статус.
Под этим термином обычно понимаются URL, которые автоматически возникают в работе CMS, фильтров, сортировок, поиска, пользовательских сценариев и других компонентов, но не дают самостоятельной ценности пользователю из органической выдачи. Нельзя считать ненужным документ только потому, что его адрес содержит параметр или находится в служебно выглядящей папке.
Аудит начинается со сбора доступных URL из нескольких источников: внутреннего обхода, XML-карты, данных поисковых систем, логов сервера при их наличии и структуры CMS. Затем адреса группируются по шаблонам. Такой подход помогает найти не единичные документы, а причины появления сотен или тысяч однотипных адресов.
Такой порядок снижает вероятность массовой ошибки. Самый опасный сценарий — добавить слишком широкую маску и случайно закрыть каталог, карточки продукции, изображения, CSS/JavaScript, необходимые для корректного отображения, или другой важный раздел. Изменения лучше тестировать на конкретных примерах URL, а после публикации контролировать доступность ключевых документов.
Для интернет-магазинов именно фасетная навигация часто создает наиболее сложную ситуацию. Допустим, каталог позволяет выбрать 10 брендов, 8 размеров, 7 цветов, несколько ценовых диапазонов и варианты сортировки. Число потенциальных комбинаций быстро становится значительно больше количества действительно полезных посадочных документов.
При этом запрещать все фильтры одним правилом не всегда правильно. Запросы по сочетаниям характеристик могут иметь реальный спрос. Например, категория определенного бренда или типа товара способна отвечать на самостоятельный коммерческий запрос. Поэтому SEO-специалист сначала формирует перечень индексируемых комбинаций, а затем определяет правила для остальных вариантов.
Отдельное внимание уделяется параметрам сортировки: по цене, популярности, рейтингу или дате. Если меняется только порядок тех же товаров, создание множества доступных поиску вариантов редко дает дополнительную ценность. Но конкретное решение зависит от реализации проекта, внутренних ссылок и того, как система формирует канонические адреса, например, создавая понятные ЧПУ URL для сайта.
Первая ошибка — воспринимать служебный документ как универсальный инструмент удаления URL из выдачи. Вторая — копировать готовую конфигурацию с другого проекта без проверки структуры. Даже сайты на одной CMS могут иметь разные плагины, маршруты, каталоги и SEO-логику. Третья ошибка — запрещать папку только из-за ее названия, не проверяя содержимое.
Последняя ошибка особенно критична. Служебные инструкции не являются средством информационной безопасности. Они доступны публично и предназначены для управления поведением добросовестных автоматических систем. Закрытые кабинеты, административные интерфейсы и конфиденциальные документы должны защищаться авторизацией и серверными механизмами доступа.
Выбор зависит от состояния документа. Для существующей публичной HTML-страницы, которую пользователь может открывать напрямую, но которая не должна находиться в Google, применяется meta noindex либо X-Robots-Tag. При этом краулеру оставляют возможность загрузить URL и прочитать инструкцию. Google указывает, что после обнаружения noindex документ исключается из результатов.
Для удаленной информации логичнее вернуть код 404 или 410. Если содержимое перенесено и существует релевантная замена, рассматривается перенаправление. Если доступ разрешен только определенным пользователям, применяется авторизация. Такой подход решает исходную задачу на уровне архитектуры, а не маскирует ее дополнительными SEO-настройками.
Нужно учитывать и историю конкретного адреса. Если страница давно находится в выдаче, изменение правил не означает мгновенного исчезновения результата. Поисковой системе требуется повторно обработать URL. Скорость зависит от частоты обхода, авторитетности ресурса, внутренних и внешних ссылок и других факторов.

Настройка не заканчивается загрузкой нового файла на сервер. Сначала проверяется его доступность по стандартному адресу. Затем специалист тестирует ключевые шаблоны: главную, категории, карточки, статьи, изображения и URL, которые намеренно ограничены. После этого оцениваются данные инструментов поисковых систем.
Для Google полезны URL Inspection, отчет об индексировании страниц и статистика сканирования Search Console. Они помогают увидеть, получает ли Googlebot конкретный документ и как система воспринимает его состояние. Проверка особенно важна после редизайна, миграции, изменения CMS, структуры каталога или логики формирования фильтров.
Нельзя оценивать эффект только по количеству URL в индексе. Цель технической оптимизации — не добиться минимального числа документов, а оставить поисковой системе понятный набор полезных адресов и рационально организовать их обход. На крупном проекте тысячи индексируемых страниц могут быть нормой, если каждая отвечает самостоятельному пользовательскому спросу.
Если необходимо управлять сканированием группы адресов, удобнее использовать служебные правила доступа. Если требуется управлять присутствием отдельной HTML-страницы в поисковой выдаче, применяется meta robots. Для PDF, изображений и других ресурсов, где HTML-тег использовать невозможно или неудобно, может применяться HTTP-заголовок X-Robots-Tag.
В сложных проектах эти инструменты дополняют друг друга, но их нельзя комбинировать механически. Сначала формулируется требуемый результат, затем выбирается средство. Правильный вопрос звучит не «что написать в файле», а «должен ли краулер посещать этот URL и должен ли сам документ присутствовать в поиске».
Даже корректная сегодня конфигурация может стать ошибочной после изменения проекта. Интернет-магазин добавляет новый фильтр, разработчики меняют маршрутизацию, появляются поддомены, личный кабинет, языковые версии или новая CMS. Старый запрет способен начать действовать на адреса, которых раньше не существовало.
Поэтому правила желательно проверять после крупных технических релизов и периодически в рамках SEO-аудита. Особого внимания требуют миграции и смена структуры URL, чтобы обеспечить миграцию сайта без потерь трафика и позиций. Перед переносом нужно зафиксировать текущие инструкции, определить новые пути и проверить их уже после запуска.
Можно ли полностью убрать документ из Google через Disallow?
Не следует рассчитывать на это как на надежный способ. Google указывает, что заблокированный URL в некоторых случаях может появляться в результатах, если поисковая система узнала о нем из других источников. Для исключения доступной HTML-страницы используется noindex, причем URL должен оставаться доступным краулеру для чтения инструкции.
Где должен находиться robots.txt?
Он размещается в корне соответствующего хоста и доступен по стандартному пути /robots.txt. Правила относятся к тому протоколу, хосту и порту, где расположен документ, поэтому при сложной структуре с поддоменами необходимо учитывать область их действия.
Нужно ли закрывать все URL с параметрами?
Нет. Параметр сам по себе не означает низкое качество. Сначала проверяют назначение страницы, спрос, уникальность предложения, внутреннюю перелинковку и роль URL в структуре проекта. Часть параметрических адресов может быть полезными посадочными документами.
Можно ли написать noindex прямо в robots.txt?
Для Google это неподдерживаемое правило. Для управления индексированием используют meta robots или HTTP-заголовок X-Robots-Tag. Google официально отказался от обработки неподдерживаемой инструкции noindex в таком формате еще в 2019 году.
Нужно ли скрывать административную панель таким способом?
Не стоит считать его защитой. Если раздел содержит закрытые данные, необходимы серверное ограничение доступа и авторизация. Публичный перечень правил для краулеров не заменяет средства информационной безопасности.
Что такое robot в контексте SEO?
Это автоматическая программа-краулер, которая обнаруживает URL, запрашивает доступные документы и передает полученные сведения поисковой системе для дальнейшей обработки. У разных систем и сервисов существуют собственные идентификаторы User-agent.
Грамотная настройка доступа начинается с технического аудита, а не с копирования готового шаблона. Необходимо определить полезные посадочные документы, найти дубли и служебные комбинации, проверить внутренние ссылки, sitemap.xml, canonical, HTTP-ответы и правила индексирования. После этого для каждой группы URL выбирается подходящий способ управления. Если вам нужно провести аудит структуры, найти лишние адреса, безопасно настроить правила обхода и исключить риск закрытия важных страниц, закажите техническую SEO-оптимизацию. Вы можете рассчитать стоимость проекта в квиз-калькуляторе или связаться с нами для обсуждения деталей. Мы проанализируем проект, подготовим инструкции для разработчиков, проверим внедрение и проконтролируем, чтобы поисковым системам были доступны именно те документы, которые должны участвовать в продвижении. Мы также оказываем комплексное техническое сопровождение сайта для долгосрочной стабильности вашего ресурса.
Настоящая Политика конфиденциальности персональных данных (далее – Политика конфиденциальности) действует в отношении всей информации, которую сайт , (далее – сайт) расположенный на доменном имени https://delovoistil.ru/ (а также его субдоменах), может получить о Пользователе во время использования сайта (а также его субдоменов), его программ и его продуктов.
1.1 В настоящей Политике конфиденциальности используются следующие термины:
1.1.1. «Администрация сайта» (далее – Администрация) – уполномоченные сотрудники на управление сайтом https://delovoistil.ru/, которые организуют и (или) осуществляют обработку персональных данных, а также определяет цели обработки персональных данных, состав персональных данных, подлежащих обработке, действия (операции), совершаемые с персональными данными.
1.1.2. «Персональные данные» — любая информация, относящаяся к прямо или косвенно определенному, или определяемому физическому лицу (субъекту персональных данных).
1.1.3. «Обработка персональных данных» — любое действие (операция) или совокупность действий (операций), совершаемых с использованием средств автоматизации или без использования таких средств с персональными данными, включая сбор, запись, систематизацию, накопление, хранение, уточнение (обновление, изменение), извлечение, использование, передачу (распространение, предоставление, доступ), обезличивание, блокирование, удаление, уничтожение персональных
данных.
1.1.4. «Конфиденциальность персональных данных» — обязательное для соблюдения Оператором или иным получившим доступ к персональным данным лицом требование не допускать их распространения без согласия субъекта персональных данных или наличия иного законного основания.
1.1.5. «Сайт » — это совокупность связанных между собой веб-страниц, размещенных в сети Интернет по уникальному адресу (URL): https://delovoistil.ru/, а также его субдоменах.
1.1.6. «Субдомены» — это страницы или совокупность страниц, расположенные на доменах третьего уровня, принадлежащие сайту , а также другие временные страницы, внизу который указана контактная информация Администрации
1.1.5. «Пользователь сайта » (далее Пользователь) – лицо, имеющее доступ к сайту , посредством сети Интернет и использующее информацию, материалы и продукты сайта .
1.1.7. «Cookies» — небольшой фрагмент данных, отправленный веб-сервером и хранимый на компьютере пользователя, который веб-клиент или веб-браузер каждый раз пересылает веб-серверу в HTTP-запросе при попытке открыть страницу соответствующего сайта.
1.1.8. «IP-адрес» — уникальный сетевой адрес узла в компьютерной сети, через который Пользователь получает доступ на https://delovoistil.ru/.
2.1. Использование сайта Пользователем означает согласие с настоящей Политикой конфиденциальности и условиями обработки персональных данных Пользователя.
2.2. В случае несогласия с условиями Политики конфиденциальности Пользователь должен прекратить использование сайта https://delovoistil.ru/.
2.3. Настоящая Политика конфиденциальности применяется к сайту . не контролирует и не несет ответственность за сайты третьих лиц, на которые Пользователь может перейти по ссылкам, доступным на сайте https://delovoistil.ru/.
2.4. Администрация не проверяет достоверность персональных данных, предоставляемых Пользователем.
3.1. Настоящая Политика конфиденциальности устанавливает обязательства Администрации по неразглашению и обеспечению режима защиты конфиденциальности персональных данных, которые Пользователь предоставляет по запросу Администрации при регистрации на сайте или при подписке на информационную e-mail рассылку.
3.2. Персональные данные, разрешённые к обработке в рамках настоящей Политики конфиденциальности, предоставляются Пользователем путём заполнения форм на сайте и включают в себя следующую информацию:
3.2.1. фамилию, имя, отчество Пользователя;
3.2.2. контактный телефон Пользователя;
3.2.3. адрес электронной почты (e-mail)
3.2.4. место жительство Пользователя (при необходимости)
3.2.5. фотографию (при необходимости)
3.3. защищает Данные, которые автоматически передаются при посещении страниц:
— IP адрес;
— информация из cookies;
— информация о браузере
— время доступа;
— реферер (адрес предыдущей страницы).
3.3.1. Отключение cookies может повлечь невозможность доступа к частям сайта https://delovoistil.ru/, требующим авторизации.
3.3.2. осуществляет сбор статистики об IP-адресах своих посетителей. Данная информация используется с целью предотвращения, выявления и решения технических проблем.
3.4. Любая иная персональная информация неоговоренная выше (история посещения, используемые браузеры, операционные системы и т.д.) подлежит надежному хранению и нераспространению, за исключением случаев, предусмотренных в п.п. 5.2. настоящей Политики конфиденциальности.
4.1. Персональные данные Пользователя Администрация может использовать в целях:
4.1.1. Идентификации Пользователя, зарегистрированного на сайте для его дальнейшей авторизации.
4.1.2. Предоставления Пользователю доступа к персонализированным данным сайта https://delovoistil.ru/.
4.1.3. Установления с Пользователем обратной связи, включая направление уведомлений, запросов, касающихся использования сайта , обработки запросов и заявок от Пользователя.
4.1.4. Определения места нахождения Пользователя для обеспечения безопасности, предотвращения мошенничества.
4.1.5. Подтверждения достоверности и полноты персональных данных, предоставленных Пользователем.
4.1.6. Создания учетной записи для использования частей сайта , если Пользователь дал согласие на создание учетной записи.
4.1.7. Уведомления Пользователя по электронной почте.
4.1.8. Предоставления Пользователю эффективной технической поддержки при возникновении проблем, связанных с использованием сайта https://delovoistil.ru/.
4.1.9. Предоставления Пользователю с его согласия специальных предложений, новостной рассылки и иных сведений от имени сайта https://delovoistil.ru/.
5.1. Обработка персональных данных Пользователя осуществляется без ограничения срока, любым законным способом, в том числе в информационных системах персональных данных с использованием средств автоматизации или без использования таких средств.
5.2. Персональные данные Пользователя могут быть переданы уполномоченным органам государственной власти Российской Федерации только по основаниям и в порядке, установленным законодательством Российской Федерации.
5.3. При утрате или разглашении персональных данных Администрация вправе не информировать Пользователя об утрате или разглашении персональных данных.
5.4. Администрация принимает необходимые организационные и технические меры для защиты персональной информации Пользователя от неправомерного или случайного доступа, уничтожения, изменения, блокирования, копирования, распространения, а также от иных неправомерных действий третьих лиц.
5.5. Администрация совместно с Пользователем принимает все необходимые меры по предотвращению убытков или иных отрицательных последствий, вызванных утратой или разглашением персональных данных Пользователя.
6.1. Пользователь вправе:
6.1.1. Принимать свободное решение о предоставлении своих персональных данных, необходимых для использования сайта https://delovoistil.ru/, и давать согласие на их обработку.
6.1.2. Обновить, дополнить предоставленную информацию о персональных данных в случае изменения данной информации.
6.1.3. Пользователь имеет право на получение у Администрации информации, касающейся обработки его персональных данных, если такое право не ограничено в соответствии с федеральными законами. Пользователь вправе требовать от Администрации уточнения его персональных данных, их блокирования или уничтожения в случае, если персональные данные являются неполными, устаревшими, неточными, незаконно полученными или не являются необходимыми для заявленной цели обработки, а также принимать предусмотренные законом меры по защите своих прав. Для этого достаточно уведомить Администрацию по указаному E-mail адресу.
6.2. Администрация обязана:
6.2.1. Использовать полученную информацию исключительно для целей, указанных в п. 4 настоящей Политики конфиденциальности.
6.2.2. Обеспечить хранение конфиденциальной информации в тайне, не разглашать без предварительного письменного разрешения Пользователя, а также не осуществлять продажу, обмен, опубликование, либо разглашение иными возможными способами переданных персональных данных Пользователя, за исключением п.п. 5.2. настоящей Политики Конфиденциальности.
6.2.3. Принимать меры предосторожности для защиты конфиденциальности персональных данных Пользователя согласно порядку, обычно используемого для защиты такого рода информации в существующем деловом обороте.
6.2.4. Осуществить блокирование персональных данных, относящихся к соответствующему Пользователю, с момента обращения или запроса Пользователя, или его законного представителя либо уполномоченного органа по защите прав субъектов персональных данных на период проверки, в случае выявления недостоверных персональных данных или неправомерных действий.
7.1. Администрация, не исполнившая свои обязательства, несёт ответственность за убытки, понесённые Пользователем в связи с неправомерным использованием персональных данных, в соответствии с законодательством Российской Федерации, за исключением случаев, предусмотренных п.п. 5.2. и 7.2. настоящей Политики Конфиденциальности.
Обновлен:
13.07.2022