Старые archive-страницы в WordPress часто остаются в индексе даже тогда, когда они уже не приносят пользы: пустые архивы авторов, страницы рубрик с одним-двумя записями, архивы по датам, служебные таксономии, страницы пагинации с дублирующимся контентом. Проблема не в самом архиве, а в том, что поисковик тратит на него обход и может считать такие страницы слабым дублем.
Но закрывать всё подряд нельзя. Если архив реально помогает пользователю и собирает переходы, его лучше оставить доступным. Ниже — практический сценарий: как диагностировать лишние архивы, закрыть только ненужные и проверить, что решение сработало.
Какие archive-страницы обычно мешают индексации
В WordPress под архивами чаще всего понимают:
- архивы рубрик и меток;
- архивы авторов;
- архивы по датам;
- страницы пагинации архивов;
- архивы пользовательских таксономий;
- страницы с тонким или повторяющимся контентом.
Если на сайте много похожих архивов, поисковик может выбрать не ту страницу как основную, а остальные оставить в индексе как дубли. Это особенно заметно на новостных, блоговых и контентных проектах, где структура таксономий менялась несколько раз.
Диагностика: какие архивы реально нужно закрывать
Сначала не трогайте код. Проверьте, какие страницы уже попали в индекс и что именно они отдают.
Что смотреть в первую очередь
- Google Search Console: разделы «Страницы» и «Индексирование»;
- поисковую выдачу по шаблону
site:example.com categoryилиsite:example.com/author/; - HTML-код страницы: есть ли
noindex, canonical и корректный title; - пустые архивы или архивы с одной записью;
- страницы пагинации, которые дублируют первую страницу архива.
Если архив нужен только для навигации внутри сайта, а не для поиска, его обычно имеет смысл закрыть от индексации. Если же архив даёт трафик по узкой теме, лучше оставить его открытым и улучшить контент на самой странице архива.
Пошаговое решение: закрываем лишние архивы через код
Самый предсказуемый способ — управлять мета-тегом robots и canonical на уровне темы или небольшого mu-plugin. Так вы не зависите от настроек конкретного SEO-плагина и можете точно задать условия.
Вариант 1: добавить noindex для архивов авторов и дат
Если архивы авторов и даты не нужны для поиска, их можно закрыть так:
add_action('wp_head', function () {
if (is_author() || is_date()) {
echo '<meta name="robots" content="noindex,follow">' . "\n";
}
}, 1);Здесь важно оставить follow, если вы не хотите ломать передачу веса по внутренним ссылкам. Это не магия SEO, а просто более безопасный вариант для служебных архивов.
Вариант 2: закрыть пустые рубрики и архивы с малым количеством записей
Если проблема в конкретных рубриках, можно закрывать только пустые или почти пустые архивы. Пример ниже добавляет noindex для рубрик с нулём записей:
add_action('wp_head', function () {
if (is_category()) {
$term = get_queried_object();
if ($term instanceof WP_Term && (int) $term->count === 0) {
echo '<meta name="robots" content="noindex,follow">' . "\n";
}
}
}, 1);Если хотите закрывать рубрики с одной записью, замените условие на <= 1. Но делайте это только после проверки: иногда такая рубрика — нормальная посадочная страница для узкой темы.
Вариант 3: убрать архивы из sitemap
Если архивы уже закрыты, они не должны оставаться в XML-карте сайта. Иначе вы сами подсказываете поисковику URL, который не хотите индексировать. В популярных SEO-плагинах это обычно настраивается в интерфейсе. Если делаете вручную, проверьте, что sitemap не содержит архивные URL.
Если используете собственную генерацию sitemap, исключайте архивные типы на этапе формирования списка URL, а не постфактум.
Когда лучше использовать плагин, а когда код
Если задача типовая, проще настроить её в SEO-плагине. Если условия сложные — например, закрывать только часть архивов по логике сайта — код надёжнее.
| Подход | Когда подходит | Минус |
|---|---|---|
| Плагин | Нужно быстро закрыть стандартные архивы | Меньше контроля над исключениями |
| Код | Нужны точные условия по рубрикам, авторам, датам | Требует аккуратного тестирования |
| Комбинация | Часть архивов закрыта в плагине, часть — кодом | Нужно следить, чтобы правила не конфликтовали |
Если на сайте уже стоит решение для SEO и чистки дублей, например Clearfy Pro, проверьте, не дублирует ли оно ваши ручные правила. Два разных источника noindex обычно не ломают сайт, но усложняют диагностику.
Проверка результата после внедрения
После правки не ограничивайтесь просмотром страницы в браузере. Проверьте результат технически.
Что проверить вручную
- в исходном коде страницы есть
<meta name="robots" content="noindex,follow">; - canonical указывает на нужную страницу, а не на архивную копию;
- страница отдаёт код ответа
200, если вы не делали редирект; - архив не попадает в sitemap;
- в Search Console после переобхода статус меняется на «Исключено тегом noindex» или аналогичный.
Проверять лучше не только главную страницу архива, но и пагинацию. Иногда первая страница закрыта, а /page/2/ остаётся открытой и продолжает индексироваться.
Быстрая проверка через curl
curl -I https://example.com/author/admin/Эта команда не покажет meta robots, но поможет увидеть редиректы, код ответа и заголовки. Для проверки HTML используйте обычный просмотр исходника или инструменты разработчика.
Частые ошибки и как их исправить
Закрыли архивы, но оставили их в sitemap
Поисковик видит противоречие: URL есть в карте сайта, но на странице стоит noindex. Уберите такие URL из sitemap и дождитесь повторного обхода.
Поставили noindex на нужную посадочную страницу
Так бывает с рубриками, которые реально собирают трафик. Перед закрытием проверьте статистику, запросы из Search Console и внутренние переходы. Если архив полезен, лучше доработать его контент, а не прятать от индекса.
Использовали редирект вместо noindex
Редирект уместен, если архив полностью устарел и есть замена. Но если архив нужен для навигации, редирект может сломать структуру сайта и внутренние ссылки.
Закрыли только первую страницу архива
Пагинация часто остаётся открытой. Проверьте все URL вида /page/2/, /page/3/ и так далее. Если архив не нужен, закрывайте весь шаблон, а не только первый URL.
Практические советы по безопасности и производительности
Если вы добавляете код вручную, не вставляйте его в файл темы без контроля версий. Лучше использовать дочернюю тему или небольшой mu-plugin. Так вы не потеряете изменения после обновления.
Для сайтов с большим количеством архивов полезно:
- не генерировать лишние архивные страницы в sitemap;
- не создавать десятки пустых рубрик и меток;
- не плодить архивы по датам, если они не используются в навигации;
- проверять canonical и robots после обновления темы или SEO-плагина;
- не смешивать ручные правила и автоматические настройки без документации для команды.
Если нужно быстро навести порядок на сайте с дублями, служебными архивами и лишними страницами, имеет смысл сначала составить список URL, которые должны остаться в индексе, а уже потом закрывать всё остальное. Это экономит время и снижает риск случайно убрать полезные страницы.