Архивы авторов и дат часто остаются включёнными по умолчанию, хотя на небольшом или корпоративном сайте они не несут отдельной ценности. В результате поисковик получает дополнительные страницы с повторяющимся списком записей, а в отчётах по индексации появляются URL, которые не должны конкурировать с основными материалами.
Задача здесь не в том, чтобы «спрятать всё подряд», а в том, чтобы аккуратно убрать из индекса служебные архивы, сохранив нормальную работу сайта и не создав цепочки редиректов, битых ссылок и конфликтов с SEO-плагином.
Когда архивы авторов и дат действительно мешают
Проблема обычно проявляется не сразу. Сайт может работать годами, а потом в Search Console начинают всплывать страницы вида /author/username/ или /2024/05/. Если на сайте один автор, архив автора почти всегда дублирует главную ленту или страницу блога. Архив даты ещё хуже: он редко отвечает на отдельный пользовательский запрос, но при этом создаёт много пустых или слабых страниц.
Есть и технический нюанс: даже если архивы закрыты в robots.txt, это не гарантирует их исключение из индекса. Если на них ведут внутренние ссылки, а контент страницы доступен, поисковик может продолжить их обходить и хранить в базе как дубликаты или вспомогательные URL.
Что проверить перед изменениями
- Есть ли на сайте несколько авторов и нужен ли отдельный архив для каждого.
- Используются ли архивы дат как навигация для новостей или журналов.
- Не завязаны ли на эти страницы хлебные крошки, меню или внутренние ссылки.
- Не управляет ли уже индексацией SEO-плагин, чтобы не получить двойные правила.
Диагностика: как понять, что именно индексируется
Перед правками откройте несколько типовых URL и посмотрите, что реально отдаёт шаблон. Для архива автора и архива даты важно понять, есть ли там уникальный текст, или это просто список записей с одинаковым заголовком и метаданными.
Если у вас включён доступ к серверным логам или Search Console, проверьте, какие URL чаще всего попадают в обход. На практике это помогает отличить «проблему индексации» от «проблемы шаблона». Иногда архивы не вредят SEO сами по себе, но создают лишнюю нагрузку на обход и мешают приоритизации страниц.
Быстрый способ проверить статус страницы — открыть исходный код и найти meta robots. Если там уже стоит noindex, не стоит дублировать это ещё одним плагином или правилом в шаблоне.
Пошаговое решение без поломки сайта
Самый безопасный вариант — сначала отключить архивы на уровне SEO-логики, а не физически удалять URL. Тогда старые ссылки не сломаются, а поисковик получит явный сигнал не индексировать эти страницы.
Вариант 1: отключить архивы через код темы или мини-плагин
Если нужен контроль без лишних зависимостей, добавьте код в дочернюю тему или в небольшой mu-plugin. Этот вариант подходит, когда вы хотите убрать архивы авторов и дат из индекса, но не ломать доступ к самим страницам для пользователей, если они уже где-то используются.
<?php
add_action('template_redirect', function () {
if (is_author() || is_date()) {
nocache_headers();
status_header(404);
include get_query_template('404');
exit;
}
});
Такой подход жёсткий: архивы перестанут открываться и будут отдавать 404. Он уместен только если вы уверены, что эти URL нигде не нужны. Для многих сайтов это слишком радикально, поэтому чаще лучше оставить страницы доступными, но закрыть их от индексации.
Вариант 2: оставить страницы доступными, но поставить noindex
Если архивы нужны для навигации, используйте wp_robots. Это штатный фильтр WordPress, который позволяет добавить директивы для конкретных типов страниц без правки шаблонов.
<?php
add_filter('wp_robots', function ($robots) {
if (is_author() || is_date()) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
});
Здесь логика простая: страницу можно обходить по ссылкам, но индексировать её не нужно. Это обычно лучше, чем закрывать архивы через robots.txt, потому что поисковик получает явный сигнал на самой странице.
Вариант 3: управлять через SEO-плагин
Если на сайте уже стоит SEO-плагин, проверьте его настройки архивов. Во многих случаях там есть отдельные переключатели для архивов авторов и дат. Это удобнее, чем писать код, если проект ведётся не разработчиком, а редактором или контент-менеджером.
| Подход | Когда использовать | Минус |
|---|---|---|
| Код в теме / mu-plugin | Нужен точный контроль | Требует поддержки при смене темы |
| SEO-плагин | Настройки должны менять редакторы | Зависит от конкретного плагина и его логики |
| 404 для архивов | URL точно не нужны | Можно сломать старые ссылки и навигацию |
Как проверить, что решение сработало
После внедрения откройте архив автора и архив даты в браузере и проверьте три вещи: код ответа, наличие noindex в исходнике и отсутствие этих URL в карте сайта, если она генерируется автоматически.
- Для варианта с
noindexв исходном коде должна быть директиваnoindex. - Для варианта с 404 страница должна реально отдавать статус 404, а не просто визуально выглядеть как ошибка.
- В Search Console новые сигналы могут появляться не сразу, поэтому ориентируйтесь на повторный обход, а не на мгновенный результат.
Если используете кэш, очистите его после правок. Иначе вы можете проверять старую версию страницы и решить, что код не работает.
Частые ошибки и как их исправить
Закрыли архивы только в robots.txt
Это частая ошибка. Disallow не равен noindex. Если страница уже известна поисковику, она может продолжать фигурировать в индексе без обхода содержимого. Для удаления из индекса нужен либо noindex, либо 404/410, либо корректная каноникализация.
Сделали 404 там, где архив нужен для навигации
Если на сайте есть рубрика новостей или журнал с архивами по месяцам, жёсткое отключение может ухудшить UX. В таком случае лучше оставить страницу доступной и закрыть её от индексации.
Получили конфликт с SEO-плагином
Если плагин уже добавляет свои robots-метки, ваш код может перезаписать их или создать противоречие. В таких случаях оставьте один источник истины: либо настройки плагина, либо код.
Забыли про внутренние ссылки
Если архивы остаются в меню, хлебных крошках или блоках темы, поисковик всё равно будет их находить. После отключения проверьте шаблоны, виджеты и меню.
Практические советы по безопасности и производительности
Если вы выбираете кодовый вариант, лучше вынести его в mu-plugin, а не править functions.php активной темы. Так настройка не исчезнет при обновлении темы и не потеряется при переключении оформления.
Для сайтов с большим количеством контента полезно не только закрыть архивы от индексации, но и убрать лишние ссылки на них из шаблонов. Это уменьшает шум в обходе и делает структуру сайта чище.
Если вам нужно массово чистить SEO-дубли и служебные страницы, иногда проще использовать специализированный инструмент вроде Clearfy Pro от WPShop: https://wpshop.ru/plugins/clearfy. Но даже в этом случае стоит понимать, какие именно архивы отключаются и как это влияет на шаблоны и индексацию.
Мини-чек-лист перед публикацией изменений
- Проверить, нужны ли архивы авторов и дат пользователям.
- Выбрать один способ управления: код, SEO-плагин или 404.
- Убедиться, что нет двойных правил
noindex. - Очистить кэш страниц и CDN.
- Проверить статус ответа и исходный код страницы.
- Посмотреть, не осталось ли внутренних ссылок на архивы в меню и шаблонах.
Если после правок архивы всё ещё появляются в отчётах, обычно проблема не в самом noindex, а в том, что поисковик ещё не переобходил страницы или где-то осталась ссылка на старый URL. В таких случаях полезно повторно проверить шаблон, карту сайта и настройки SEO-плагина, а не вносить ещё одно правило поверх уже существующего.