
DataLife Engine часто используется для новостных и контентных проектов, где важна скорость обновления и гибкость системы. Однако бывают ситуации, когда необходимо скрыть сайт или отдельные его разделы от поисковых систем: при разработке, настройке, тестировании или размещении материалов для ограниченного круга пользователей.
Для управления доступом поисковых роботов в DLE можно использовать несколько инструментов. Основной способ – настройка файла robots.txt, где запрещается индексация определённых директорий или страниц с помощью директивы Disallow. Дополнительно доступ к индексации можно ограничить с помощью мета-тегов <meta name=»robots» content=»noindex, nofollow»>, которые удобно прописывать в шаблоне движка для конкретных категорий или статей.
В ситуациях, когда требуется полный запрет индексации всего проекта, эффективным решением станет использование авторизации на сервере (например, через .htpasswd), так как этот метод блокирует не только роботов, но и нежелательных посетителей. Такой подход надёжнее, чем только запреты в robots.txt, поскольку поисковые системы могут учитывать внешние ссылки и всё равно пытаться сканировать закрытые разделы.
Использование файла robots.txt для запрета индексации

Файл robots.txt размещается в корневой директории сайта и используется для управления доступом поисковых роботов к страницам и разделам. Для блокировки индексации движка DLE необходимо точно определить пути к системным каталогам и служебным файлам.
Пример минимальной конфигурации для закрытия технических разделов DLE:
User-agent: * Disallow: /engine/ Disallow: /admin.php Disallow: /uploads/
Директива User-agent: * применяется ко всем поисковым системам. Disallow указывает конкретные каталоги или файлы, которые не должны индексироваться. Если требуется запретить индексацию всего сайта, добавляется строка:
Disallow: /
Файл должен быть доступен по адресу: https://ваш-сайт.ru/robots.txt. После изменений рекомендуется проверить корректность настроек через инструменты вебмастеров Google или Яндекс, чтобы убедиться, что запрет применён правильно.
Настройка мета-тега robots в шаблонах DLE
Для управления индексацией страниц в DataLife Engine достаточно внести изменения в шаблон main.tpl или другие подключаемые файлы. Метатег <meta name="robots" content="noindex, nofollow"> добавляется в блок <head> и применяется ко всем страницам, использующим данный шаблон.
Если требуется разное поведение для различных типов страниц, можно использовать условные теги DLE. Например, чтобы закрыть от индексации только страницу поиска:
[search]<meta name="robots" content="noindex, nofollow">[/search]
Для категорий или материалов удобно использовать аналогичные конструкции: [catlist], [full], [static]. Это позволяет гибко задавать правила, исключая из индексации только нужные разделы, не затрагивая весь сайт.
Рекомендуется проверять результат через исходный код страницы в браузере и инструмент «Проверка URL» в Google Search Console, чтобы убедиться, что нужные страницы действительно закрыты от индексации.
Закрытие определённых категорий и страниц от поисковиков
В DLE можно ограничить индексацию отдельных категорий через файл robots.txt. Для этого укажите правило Disallow с путём к нужной категории, например: Disallow: /index.php?do=cat&category=novosti. Такой способ блокирует доступ поисковых роботов ко всем материалам внутри указанной рубрики.
Если требуется закрыть материалы по ID, используйте динамический запрет: Disallow: /index.php?newsid=123. Этот метод подходит для исключения отдельных публикаций из индекса.
Для точечной блокировки внутри шаблонов рекомендуется подключать мета-тег <meta name="robots" content="noindex, nofollow">. В DLE его можно вставить в main.tpl, обернув в условие {if category="ID"}...{/if} или {if news-id="123"}...{/if}. Таким образом можно закрыть как целые категории, так и конкретные страницы.
Дополнительно, при использовании ЧПУ, запрет в robots.txt указывается по URL: Disallow: /novosti/. Для отдельных материалов с ЧПУ укажите: Disallow: /novosti/primer-novosti.html.
При настройке правил важно проверять их через инструменты вебмастеров Яндекс и Google, чтобы убедиться, что блокировка применяется только к нужным страницам.
Применение заголовков HTTP X-Robots-Tag на сервере
Заголовок X-Robots-Tag позволяет управлять индексацией на уровне HTTP-ответа, что удобно для файлов, к которым нельзя добавить мета-теги (например, PDF или скрипты). Его поддерживают Google, Bing и другие крупные поисковики.
Для Apache используйте директиву Header set в конфигурации или .htaccess:
Header set X-Robots-Tag "noindex, nofollow"
На Nginx настройка выполняется через блок location с директивой add_header:
add_header X-Robots-Tag "noindex, noarchive";
Заголовок можно применять точечно. Например, закрыть только каталог с изображениями:
location /uploads/ {
add_header X-Robots-Tag "noindex";
}
После внесения изменений проверяйте корректность заголовков с помощью команды curl -I или панели для вебмастеров. Ошибки в конфигурации могут привести к блокировке всего сайта вместо отдельных ресурсов.
Ограничение доступа к сайту через.htaccess и пароль

Для полной блокировки индексации удобно использовать базовую HTTP-авторизацию. Такой метод требует ввода логина и пароля до загрузки содержимого, что исключает доступ поисковых роботов к файлам.
В корне сайта создайте файл .htaccess со следующим содержимым:
AuthType Basic AuthName "Закрытый раздел" AuthUserFile /home/user/site/.htpasswd Require valid-user
Файл .htpasswd формируется отдельной командой на сервере или с помощью генератора. Пример создания записи с использованием утилиты htpasswd:
htpasswd -c /home/user/site/.htpasswd admin
После ввода команды система запросит пароль и добавит его в зашифрованном виде. Путь в директиве AuthUserFile всегда указывается абсолютный.
Размещение .htpasswd вне публичной директории public_html предотвращает его скачивание извне. Для нескольких пользователей допускается добавление строк в один файл.
| Файл | Назначение |
|---|---|
| .htaccess | Определяет правила авторизации |
| .htpasswd | Хранит пары логин/пароль в зашифрованном виде |
Таким образом, при запросе сайта без корректных данных авторизации ни один робот не сможет получить доступ к содержимому.
Исключение медиафайлов и вложений из поиска

Для предотвращения индексации медиафайлов в DLE необходимо настроить файл robots.txt. Добавьте строки для блокировки папок с изображениями, видео и документами, например:
Disallow: /uploads/
Disallow: /files/
Disallow: /engine/data/
Для точечной блокировки отдельных форматов используйте директиву Allow в сочетании с Disallow для остальных типов файлов.
Внутри DLE рекомендуется отключать генерацию страниц вложений через панель администратора. В разделе «Настройки» → «SEO» → «Вложения» уберите галочки «Разрешить индексацию вложений» и «Создавать страницы для медиафайлов».
Если необходимо сохранить доступ к медиафайлам для зарегистрированных пользователей, настройте ограничения на уровне .htaccess. Например, запретите доступ всем, кроме конкретного IP или авторизованных сессий, используя правила RewriteCond и RewriteRule.
После внесения изменений рекомендуется проверить результат через Google Search Console или команду site:ваш_домен, чтобы убедиться, что файлы больше не индексируются.
Дополнительно можно использовать метатег <meta name="robots" content="noindex"> в шаблонах страниц вложений, если отключение через панель администрирования невозможно.
Проверка закрытых разделов с помощью инструментов вебмастеров
После настройки запрета индексации на сайте DLE важно убедиться, что закрытые разделы действительно не доступны поисковым системам. Для этого используют официальные инструменты вебмастеров Google и Яндекс.
Алгоритм проверки:
- Google Search Console:
- Перейдите в раздел Проверка URL.
- Введите адрес страницы, которую хотите проверить.
- Нажмите Тестировать URL. Если доступ запрещён robots.txt или установлен тег
noindex, инструмент покажет соответствующее уведомление. - Используйте Отчет об исключениях, чтобы увидеть все страницы, закрытые для индексации.
- Яндекс.Вебмастер:
- Откройте Индексация → Статус страниц.
- Введите URL и проверьте статус. Страница с ограничением индексации будет отмечена как «Закрыта для робота».
- Используйте отчеты Файл robots.txt и Метатеги noindex, чтобы убедиться, что правила применяются ко всем нужным разделам.
Дополнительные рекомендации:
- Проверяйте закрытые разделы периодически после обновления контента или структуры сайта.
- Для динамических разделов используйте инструмент Просмотр как Googlebot в Search Console.
- Если страница случайно индексируется, проверьте наличие ошибок в файле
robots.txtи корректность метатеговnoindex.
Вопрос-ответ:
Зачем закрывать сайт DLE от индексации поисковиков?
Закрытие сайта от индексации может потребоваться, если ресурс находится в разработке, содержит конфиденциальную информацию или не предназначен для широкой аудитории. Это позволяет избежать появления черновых страниц в поиске и сохранить структуру сайта для внутреннего тестирования.
Какие способы ограничения индексации на DLE существуют?
На DLE можно использовать несколько методов: добавить директивы в файл robots.txt, запретить индексацию через метатеги в шаблонах страниц, настроить HTTP-заголовки с запретом индексирования, ограничить доступ к разделам с помощью .htaccess или плагинов. Выбор метода зависит от того, какие страницы нужно скрыть и на какой период.
Что произойдет с сайтом, если полностью запретить индексацию?
Если закрыть весь сайт от индексации, поисковики перестанут добавлять новые страницы в свои базы и постепенно удалят уже проиндексированные. Это может снизить видимость сайта в поиске до нуля. С другой стороны, для тестовых или закрытых проектов это защитит контент от попадания в открытый доступ через поиск. Нужно учитывать, что полный запрет подходит только для временных или внутренних ресурсов.
